Le filThèmes : Outils devÉvaluationsAgents
Claude.dev explique à quel niveau régler l’effort dans Claude Code
1 sourcemis à jour 25 sept.pertinence 3,3 sur5
L’essentiel
Claude.dev s’appuie sur des tests de trois versions et sur une analyse de Terminal-Bench 3.0 avec Opus 5.5 et Fable 5.1 pour expliquer ce qu’est l’effort et quand utiliser chaque niveau.
Propagation1 article, publié par claude.dev le 25 sept. à 14 h 00.
Les sources
1 article
claude.devOfficiel : fiche de la sourceSource primaire
AnthropicThariq Shihiparclaude.dev
Using Claude Code: Spending your effort (site externe)
What effort really is and when to use which level in Claude Code, from my own tests of three builds and a deep dive into Terminal-Bench 3.0 on Opus 5.5 and Fable 5.1.
Sur les mêmes thèmes
Agents
LangChain intègre un routeur de modèles à son agent open source Open SWE et réduit le coût médian
Évaluations
WideSWE mesure la capacité des agents de code à coordonner des modifications entre dépôts
Agents
LangChain montre comment associer Jev, modèle de décision de TypeSafe AI, à LangGraph
Agents
Hugging Face ajoute un filtre pour les environnements d’apprentissage par renforcement sur le Hub
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5