Le filThèmes : RechercheAgentsInfra
CacheBack filtre les caches KV échangés entre agents selon les besoins de l’agent récepteur
1 sourcemis à jour il y a 2 jpertinence 3,4 sur5
L’essentiel
Sur FanOutQA avec Qwen 3, CacheBack retire 75 % de l’état reçu par l’agent, améliore la précision de 14,7 points et divise par 3,2 la latence médiane par rapport à la communication par texte.
Propagation1 article, publié par HF Daily Papers le 5 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceMaximillian Rossi, Prajwal Raghunath, Haoqing Xuan et al.huggingface.co
Receiver-Conditioned Latent Communication gives 94% CacheBack (site externe)
Multi-agent systems distribute large contexts across agents that communicate to solve a task. Text messages are compact but require decoding and may omit evidence the receiving agent needs. Recent latent communication instead transfers KV caches.
Sur les mêmes thèmes
Infra
AgSpec accélère le décodage spéculatif par récupération dans les pipelines d’agents de code
Recherche
Des chercheurs présentent les Context Language Models, qui gèrent eux-mêmes leur contexte comme un fichier
Agents
QwenGyre, un framework de RL élastique, entraîne des agents d’IA sur des tâches très longues
Agents
Des chercheurs présentent SSR, qui remplace le raisonnement libre des agents de recherche par une sélection
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5