Le filThèmes : RechercheAgentsÉvaluations
Une étude montre que la recherche agentique surpasse la recherche dense standard sur des tâches complexes
1 sourcemis à jour il y a 2 jpertinence 3,3 sur5
L’essentiel
Avec le même modèle d’embedding, elle gagne 8,7 points de nDCG@10. En moyenne, elle prend 107,4 secondes contre 0,67 et consomme 764,1K tokens en entrée et 5,8K en sortie par requête.
Propagation1 article, publié par HF Daily Papers le 6 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceReza Esfandiarpoor, Radek Osmulski, Yauhen Babakhin et al.huggingface.co
Beyond Semantic Similarity: Performance and Costs of Agentic Retrieval for Complex Tasks (site externe)
Modern information systems, including many agentic workflows, use dense retrieval to explore large amounts of unstructured data.
Sur les mêmes thèmes
Agents
SkillSeek montre que BM25 rivalise avec la recherche agentique de skills pour les agents
Agents
VeriHarness transforme le modèle générateur en vérificateur agentique pour les tâches de longue durée
Agents
MILO fait évoluer des harnais d’agents et leur stratégie de recherche, et dépasse huit harnais de référence
Évaluations
Des chercheurs suggèrent que les modèles de langage tendent à présenter par défaut des récits de succès
À lire ensuite
Modèles
Anthropic lance Claude Haiku 5.5, son nouveau modèle rapide et peu cher, au même prix que GPT-6 Luna
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart