Le filThèmes : InfraAgentsRecherche
AgSpec accélère le décodage spéculatif par récupération dans les pipelines d’agents de code
1 sourcemis à jour il y a 5 jpertinence 3,6 sur5
L’essentiel
Ce framework puise dans des corpus de session, d’espace de travail et globaux, et adapte la longueur des brouillons. Il atteint jusqu’à 4,37 fois le débit du décodage autorégressif à batch 1 et 4,76 fois à batch 16.
Propagation1 article, publié par HF Daily Papers le 2 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceSumin Lee, Sukmin Cho, Suengjae Lim et al.huggingface.co
AgSpec: Pushing the Limits of Retrieval-Based Speculative Decoding in Coding Agent Pipelines (site externe)
Retrieval-based speculative decoding (SD) drafts tokens by copying continuations from existing text, which suits coding agents that repeatedly reproduce code, logs, and earlier attempts.
Sur les mêmes thèmes
Recherche
Des chercheurs présentent les Context Language Models, qui gèrent eux-mêmes leur contexte comme un fichier
Agents
QwenGyre, un framework de RL élastique, entraîne des agents d’IA sur des tâches très longues
Agents
Des chercheurs présentent SSR, qui remplace le raisonnement libre des agents de recherche par une sélection
Recherche
CacheBack filtre les caches KV échangés entre agents selon les besoins de l’agent récepteur
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5