Le filThèmes : RechercheAgentsInfra
Des chercheurs présentent les Context Language Models, qui gèrent eux-mêmes leur contexte comme un fichier
1 sourcemis à jour 30 sept.pertinence 3,6 sur5
L’essentiel
Construits sans entraînement sur des modèles existants, les CLMs gagnent 11,4 % de précision avec 21,5 % de FLOPs en moins sur BrowseComp-Plus. Une méthode d’apprentissage par renforcement améliore Qwen3.5-9B de 47,6 %.
Propagation1 article, publié par HF Daily Papers le 30 sept..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceRulin Shao, Shannon Zejiang Shen, Junjie Oscar Yin et al.huggingface.co
Context Language Models (site externe)
We introduce Context Language Models (CLMs), language models that natively manage their own context. We implement this by treating the context as a file and allowing the model to make unrestricted updates to this file.
Sur les mêmes thèmes
Infra
AgSpec accélère le décodage spéculatif par récupération dans les pipelines d’agents de code
Agents
QwenGyre, un framework de RL élastique, entraîne des agents d’IA sur des tâches très longues
Agents
Des chercheurs présentent SSR, qui remplace le raisonnement libre des agents de recherche par une sélection
Recherche
CacheBack filtre les caches KV échangés entre agents selon les besoins de l’agent récepteur
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5