Le filThèmes : Open sourceModèlesInfra
PostHog publie Jeeves, un modèle de décision de 9 milliards de paramètres qui raisonne avant de trancher
1 sourcemis à jour 29 sept.pertinence 3,6 sur5
L’essentiel
Basé sur Qwen3.5-9B, il obtient 0,889 sur les données de test contre 0,857 pour Jev, et 0,935 contre 0,866 sur les niveaux publics de JevBench. Il met environ 0,3 s par requête sans raisonnement, 3,3 s en médiane avec.
Propagation1 article, publié par github.com le 29 sept. à 13 h 13.
Les sources
1 article
github.comCommunautéSource primaire
repéré sur Hacker News
Jeeves. Reasoning improves Jev-like decision models (site externe)
Sur les mêmes thèmes
Open source
OrcaRouter publie OrcaSAQ2 27B, Qwen3.8-27B quantifié à 3 bits, qui est en tendance sur Hugging Face
Open source
ISTA-DASLab publie Qwen3.8-Flash-Next-GSQ-RCO-Coder-GGUF, une version compressée de Qwen3.8-Flash-Next
Open source
ISTA-DASLab publie des quantifications GGUF de Qwen3.8-Flash-Next en quatre tailles, de 66,4 à 83,6 Go
Open source
OrcaRouter publie OrcaSAQ2 27B Cyber Uncensored, une version GGUF compressée de Qwen3.8-27B sans censure
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5