poids ferméspoids ouvertsfrontière de Pareto
Sur la frontière (tous modèles), du moins cher au plus cher : 1. Qwen2.5-Coder (7B) (113,1, 0,02 $), 2. Llama 3.1-8B (116,6, 0,03 $), 3. gpt-oss-20b (137,8, 0,03 $), 4. Qwen3-32B (138,5, 0,06 $), 5. gpt-oss-120b (139,9, 0,07 $), 6. DeepSeek V4 Flash 0731 (154,5, 0,11 $), 7. DeepSeek V4.1 Flash (154,9, 0,26 $), 8. GPT-5.6 Luna (156,4, 0,45 $), 9. Gemini 3.7 Flash (157,3, 1,50 $), 10. Claude Sonnet 5.5 (165,0, 4,00 $), 11. Claude Opus 5.5 (167,3, 8,00 $).
Sur la frontière (poids ouverts), du moins cher au plus cher : 1. Qwen2.5-Coder (7B) (113,1, 0,02 $), 2. Llama 3.1-8B (116,6, 0,03 $), 3. gpt-oss-20b (137,8, 0,03 $), 4. Qwen3-32B (138,5, 0,06 $), 5. gpt-oss-120b (139,9, 0,07 $), 6. DeepSeek V4 Flash 0731 (154,5, 0,11 $), 7. DeepSeek V4.1 Flash (154,9, 0,26 $), 8. DeepSeek V4 Pro 0813 (155,3, 1,38 $), 9. Kimi K3 (157,5, 6,00 $).
Sur la frontière (poids fermés), du moins cher au plus cher : 1. Ministral 3B (118,1, 0,04 $), 2. GPT-5 nano (139,4, 0,14 $), 3. GPT-5.6 Luna (156,4, 0,45 $), 4. Gemini 3.7 Flash (157,3, 1,50 $), 5. Claude Sonnet 5.5 (165,0, 4,00 $), 6. Claude Opus 5.5 (167,3, 8,00 $).
Capacité : indice ECI d'Epoch AI. Prix : catalogue de l'éditeur, sinon de l'hébergeur le moins cher, 3 jetons d'entrée pour 1 de sortie, d'après LiteLLM ; c'est un prix au jeton, pas un coût par tâche (un modèle bavard coûte plus que son prix ne le dit). 83 modèles sans prix dans la table n’y figurent pas. Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.