Le filThèmes : AgentsÉvaluationsOutils dev
LangChain intègre un routeur de modèles à son agent open source Open SWE et réduit le coût médian
1 sourcemis à jour il y a 5 jpertinence 4,2 sur5
L’essentiel
Selon LangChain, le coût médian par thread baisse de 64 % face au modèle le plus puissant seul, sans changement mesurable de qualité, lors d’un test A/B sur 973 threads. 56 % des threads vont au niveau équilibré.
Propagation1 article, publié par Blog LangChain le 1 oct. à 19 h 01.
Les sources
1 article
Blog LangChainOfficiel : fiche de la sourceSource primaire
LangChain (fondée par Harrison Chase et Ankush Gola)LangChain Accountslangchain.com
How to Build a Model Router in the Harness (site externe)
Our test bed was Open SWE, which our engineers use from Slack and a web UI to ask questions about our codebases and request code changes. Before building a router, we needed to understand the types of tasks that developers use Open SWE for.
Sur les mêmes thèmes
Évaluations
WideSWE mesure la capacité des agents de code à coordonner des modifications entre dépôts
Agents
LangChain montre comment associer Jev, modèle de décision de TypeSafe AI, à LangGraph
Agents
Hugging Face ajoute un filtre pour les environnements d’apprentissage par renforcement sur le Hub
Outils dev
LangChain lance la version 2 de LangSmith Engine, son agent de diagnostic des agents d’IA
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5