Le filThèmes : AgentsInfraRecherche
Des chercheurs lancent les outils d’un agent vocal sur l’appareil avant la fin de la phrase de l’utilisateur
1 sourcemis à jour il y a 13 hpertinence 3,2 sur5
L’essentiel
Un module Predictor anticipe les appels d’outils d’après la reconnaissance vocale partielle et met leurs résultats en cache. Sur un assistant Android, le délai médian avant le premier son passe de 5,79 s à 4,60 s.
Propagation1 article, publié par HF Daily Papers le 7 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceKyudan Jung, Hyunsin Park, Yoonhyung Lee et al.huggingface.co
Hiding Tool Latency in On-Device Cascaded Voice Agent through Speculative Execution (site externe)
Tool-augmented speech assistants typically serialize automatic speech recognition, large language model inference, and external tool execution.
Sur les mêmes thèmes
Infra
AgSpec accélère le décodage spéculatif par récupération dans les pipelines d’agents de code
Recherche
Des chercheurs présentent les Context Language Models, qui gèrent eux-mêmes leur contexte comme un fichier
Agents
QwenGyre, un framework de RL élastique, entraîne des agents d’IA sur des tâches très longues
Agents
Des chercheurs présentent SSR, qui remplace le raisonnement libre des agents de recherche par une sélection
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5