Le filThèmes : RechercheOutils dev
Une méthode alloue des rangs différents par couche et par tâche pour fusionner des LoRA
1 sourcemis à jour 28 sept.pertinence 3,0 sur5
L’essentiel
La métrique Net Utility, qui n’utilise aucune donnée, améliore en moyenne les performances de 2,1 % sur les tâches de vision et de 2,2 % sur les tâches de langage, avec cinq méthodes de fusion.
Propagation1 article, publié par HF Daily Papers le 28 sept..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceAvinash Amballa, Yashas Malur Saidutta, Wenbo Li et al.huggingface.co
Not All Ranks Are Equal: Budget-Aware LoRA Merging Across Tasks (site externe)
Merging low-rank adapters (LoRAs) promises to eliminate the overhead of swapping task-specific weights at inference time. However, existing merging methods assume every layer needs the same rank budget.
Sur les mêmes thèmes
Recherche
TokenCast prévoit la consommation de tokens d’un agent LLM pendant l’exécution de l’agent
Outils dev
Reasonable explique TLA+ et transforme des spécifications TLA+ en preuves Verus vérifiées par machine
Outils dev
Des agents de code synthétisent des programmes pour la planification généralisée de tâches et de mouvements
Recherche
Omni-IO Skills rend des agents existants omni-natifs grâce à une surcouche de Skills
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5