Le Crible

Mesures de tiers, sources ouvertes

Benchmarks

274 modèles d’IA, ouverts et fermés, mesurés par des évaluateurs indépendants des labos. Chaque benchmark est expliqué, chaque chiffre mène à sa source, chaque modèle a sa fiche : prix par fournisseur, et comment l’héberger soi-même.

Relevé le 07/10/2026. Dernier chiffre publié par chaque source : Epoch AI 29/09/2026 · LMArena 02/10/2026 · SWE-bench 26/02/2026 · LiteLLM non daté.

Comment lire ces chiffres · Tous les modèles, filtres · Méthode et sources

Poids274 modèles128 à poids ouverts125 à poids fermés

Capacités

Indice ECI d’Epoch AI, plus haut = meilleur

  1. Claude Opus 5.5167,3
  2. GPT-6 Astra166,5
  3. GPT-6.1 Sol166,1
  4. Claude Sonnet 5.5165,0
  5. Claude Fable 5.1164,7
  6. Claude Opus 5162,8
  7. GPT-6 Sol162,7
  8. GPT-5.5 Pro162,1
  1. Kimi K3OUV.157,5
  2. DeepSeek V4 Pro 0813OUV.155,3
  3. DeepSeek V4.1 FlashOUV.154,9
  4. DeepSeek V4 Flash 0731OUV.154,5
  5. GLM-5.3-FlashOUV.151,9
  6. GLM-5.2OUV.151,8
  7. Kimi K2.6OUV.151,1
  8. Inkling-SmallOUV.150,2
  1. Claude Opus 5.5167,3
  2. GPT-6 Astra166,5
  3. GPT-6.1 Sol166,1
  4. Claude Sonnet 5.5165,0
  5. Claude Fable 5.1164,7
  6. Claude Opus 5162,8
  7. GPT-6 Sol162,7
  8. GPT-5.5 Pro162,1

Epoch AI, CC BY 4.0

Meilleur rapport capacité-prix

Frontière de Pareto, du moins cher au plus cher : $ par million de jetons

  1. Qwen2.5-Coder (7B)OUV.ECI 113,10,02 $
  2. Llama 3.1-8BOUV.ECI 116,60,03 $
  3. gpt-oss-20bOUV.ECI 137,80,03 $
  4. Qwen3-32BOUV.ECI 138,50,06 $
  5. gpt-oss-120bOUV.ECI 139,90,07 $
  6. DeepSeek V4 Flash 0731OUV.ECI 154,50,11 $
  7. DeepSeek V4.1 FlashOUV.ECI 154,90,26 $
  8. GPT-5.6 LunaECI 156,40,45 $
  1. Qwen2.5-Coder (7B)OUV.ECI 113,10,02 $
  2. Llama 3.1-8BOUV.ECI 116,60,03 $
  3. gpt-oss-20bOUV.ECI 137,80,03 $
  4. Qwen3-32BOUV.ECI 138,50,06 $
  5. gpt-oss-120bOUV.ECI 139,90,07 $
  6. DeepSeek V4 Flash 0731OUV.ECI 154,50,11 $
  7. DeepSeek V4.1 FlashOUV.ECI 154,90,26 $
  8. DeepSeek V4 Pro 0813OUV.ECI 155,31,38 $
  1. Ministral 3BECI 118,10,04 $
  2. GPT-5 nanoECI 139,40,14 $
  3. GPT-5.6 LunaECI 156,40,45 $
  4. Gemini 3.7 FlashECI 157,31,50 $
  5. Claude Sonnet 5.5ECI 165,04,00 $
  6. Claude Opus 5.5ECI 167,38,00 $

LiteLLM, MIT

Code

SWE-bench Verified (Epoch), part des tickets résolus

  1. Claude Opus 4.783,5 %
  2. GPT-5.580,6 %
  3. Gemini 3.5 Flash79,3 %
  4. Claude Opus 4.678,7 %
  5. GLM-5.2OUV.78,7 %
  6. DeepSeek-V4-ProOUV.77,6 %
  7. Qwen3.7-Max77,3 %
  8. GPT-5.476,9 %
  1. GLM-5.2OUV.78,7 %
  2. DeepSeek-V4-ProOUV.77,6 %
  3. Kimi K2.6OUV.76,7 %
  4. GLM-5.1OUV.74,2 %
  5. Kimi K2.5OUV.73,8 %
  6. GLM-5OUV.72,1 %
  1. Claude Opus 4.783,5 %
  2. GPT-5.580,6 %
  3. Gemini 3.5 Flash79,3 %
  4. Claude Opus 4.678,7 %
  5. Qwen3.7-Max77,3 %
  6. GPT-5.476,9 %
  7. Claude Opus 4.576,7 %
  8. Gemini 3.1 Pro75,6 %

Epoch AI, CC BY 4.0

Mathématiques

FrontierMath, niveaux 1 à 3, part résolue

  1. GPT-6 Astra93,7 %
  2. GPT-6.1 Sol93,7 %
  3. Claude Opus 5.591,2 %
  4. Claude Fable 5.190,2 %
  5. GPT-6 Sol89,8 %
  6. GPT-5.6 Sol89,1 %
  7. Claude Sonnet 5.588,8 %
  8. GPT-5.5 Pro87,7 %
  1. Kimi K3OUV.72,2 %
  2. DeepSeek V4 Pro 0813OUV.64,6 %
  3. GLM-5.2OUV.59,2 %
  4. DeepSeek V4 Flash 0731OUV.57,5 %
  5. Kimi K2.6OUV.57,2 %
  6. GLM-5.3-FlashOUV.55,8 %
  7. Kimi K2.7 CodeOUV.54,0 %
  8. Inkling-SmallOUV.46,3 %
  1. GPT-6 Astra93,7 %
  2. GPT-6.1 Sol93,7 %
  3. Claude Opus 5.591,2 %
  4. Claude Fable 5.190,2 %
  5. GPT-6 Sol89,8 %
  6. GPT-5.6 Sol89,1 %
  7. Claude Sonnet 5.588,8 %
  8. GPT-5.5 Pro87,7 %

Epoch AI, CC BY 4.0

Les 8 premiers de chaque liste ; un nom mène à la fiche du modèle. Barres : de zéro à 100 % pour les pourcentages, depuis zéro pour les prix ; pour l’ECI, qui n’a pas de zéro, depuis le repère 130 de l’échelle d’Epoch (Claude 3.5 Sonnet). Prix : 3 jetons d’entrée pour 1 de sortie, chez l’éditeur, sinon chez l’hébergeur le moins cher. Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Comment lire ces chiffres

Un benchmark est un examen : un jeu de questions fixes, posé à chaque modèle de la même façon. Aucun ne dit à lui seul quel modèle est « le meilleur » : chacun mesure une tâche, avec ses angles morts. Voici ce que mesure chacun de ceux repris ici ; ouvrir une fiche pour lire comment lire un score, ses limites et qui le publie.

Epoch Capabilities Index (ECI)

Capacités générales · 274 modèles évalués iciUn indice unique qui combine les résultats de nombreux benchmarks en une seule échelle de « capacité générale », pour comparer des modèles même quand un benchmark est devenu trop facile.
Lire un score
L'échelle est fixée par deux repères : Claude 3.5 Sonnet = 130 et GPT-5 = 150. Elle est linéaire : 10 points d'écart pèsent autant en bas qu'en haut. Au lancement de l'indice, 5 points de plus correspondaient à peu près à un doublement de la durée des tâches qu'un modèle sait mener seul (mesure METR).
Limites
La valeur absolue n'a pas de sens, seuls les écarts en ont. Un modèle très spécialisé peut avoir un ECI bas malgré d'excellents scores dans son domaine. Les repères peuvent être révisés quand des modèles et des benchmarks s'ajoutent.
Qui le publie
Epoch AI, institut de recherche à but non lucratif.
D’après
epoch.ai/benchmarks/eci (lu le 01/10/2026)

LMArena, classement texte

Conversation (préférence humaine) · 166 modèles évalués iciDes internautes posent leur propre question à deux modèles anonymes et votent pour la meilleure réponse. Les votes donnent une note par modèle. La version reprise ici corrige l'effet du style (longueur, mise en forme) pour ne pas récompenser les réponses simplement plus longues.
Lire un score
La note se lit comme un classement aux échecs (Elo) : avec cette formule, 100 points d'écart veulent dire que le mieux noté gagne environ 64 % de ses duels contre l'autre.
Limites
Une préférence n'est pas une exactitude : une réponse agréable peut gagner en étant fausse. La note est relative, elle bouge quand de nouveaux modèles arrivent. Les questions viennent des visiteurs du site et ne représentent pas tous les usages.
Qui le publie
LMArena (Arena Intelligence Inc.), issu du projet Chatbot Arena de l’université de Berkeley.
D’après
lmarena.ai/how-it-works Chiang et al., Chatbot Arena (2024) (lu le 01/10/2026)

GPQA Diamond

Sciences · 186 modèles évalués ici198 questions à choix multiples de biologie, physique et chimie, écrites par des docteurs ou doctorants, et conçues pour qu'un non-spécialiste échoue même avec internet.
Lire un score
Quatre réponses possibles, donc le hasard donne 25 %. Des experts de niveau doctorat recrutés par OpenAI ont obtenu 69,7 %. Un modèle à 90 % fait donc mieux que ces experts sur ces questions.
Limites
Les questions sont publiques depuis 2023 : un modèle a pu les voir à l'entraînement. Le score est proche du plafond pour les meilleurs modèles, il départage mal le haut du classement. Une réponse mal formatée compte comme fausse.
Qui le publie
Questions : Rein et al. (université de New York, 2023). Évaluation : Epoch AI.
D’après
epoch.ai/benchmarks/gpqa-diamond Rein et al., GPQA (2023) (lu le 01/10/2026)

FrontierMath, niveaux 1 à 3

Maths · 81 modèles évalués ici295 problèmes de mathématiques originaux et non publiés, écrits et vérifiés par des mathématiciens, du niveau fin de licence à celui d'un jeune chercheur. Les plus durs demandent des heures à un spécialiste du domaine. Le modèle peut faire tourner du code Python.
Lire un score
Part des problèmes résolus. Le niveau 4, plus dur encore (43 problèmes), est compté à part. 30 % veut dire environ 90 problèmes de niveau recherche résolus.
Limites
OpenAI a financé le benchmark et a un accès exclusif à une partie des problèmes, ce qu'Epoch déclare. Le jeu a été corrigé en juin 2026 (erreurs dans 42 % des problèmes) : les scores d'avant et d'après ne se comparent pas.
Qui le publie
Epoch AI (questions et évaluation).
D’après
epoch.ai/benchmarks/frontiermath-tiers-1-3 Glazer et al., FrontierMath (2024) (lu le 01/10/2026)

OTIS Mock AIME 2024-2025

Maths de concours · 176 modèles évalués ici45 problèmes de concours de mathématiques (lycée, niveau olympiades) tirés des examens blancs OTIS, qui imitent l'AIME américain. Chaque réponse est un entier de 0 à 999.
Lire un score
Part des problèmes résolus. Plus difficile que les exercices de MATH niveau 5, beaucoup plus facile que FrontierMath. Répondre au hasard ne rapporte presque rien (une chance sur mille).
Limites
45 problèmes seulement : quelques réponses de plus ou de moins font bouger le score de plusieurs points. Les meilleurs modèles approchent le plafond.
Qui le publie
Problèmes : élèves du programme OTIS (Evan Chen). Évaluation : Epoch AI.
D’après
epoch.ai/benchmarks/otis-mock-aime-2024-2025 (lu le 01/10/2026)

SWE-bench Verified (évaluation Epoch)

Code · 32 modèles évalués iciDes tickets GitHub réels pris dans 12 projets Python open source. Le modèle reçoit le code et la description du problème, modifie le dépôt, puis les tests du projet vérifient la correction. Le jeu « Verified » (500 tickets) a été relu par des développeurs ; Epoch en utilise 484.
Lire un score
Part des tickets résolus. 70 % veut dire que le modèle a corrigé, sans aide, environ 7 tickets réels sur 10, tests du projet à l'appui.
Limites
Python seulement, sur des projets connus que les modèles ont pu voir. Epoch estime que 5 à 10 % des tickets restent ambigus ou mal notés. Le score dépend de l'outillage : celui d'Epoch a été nettement amélioré en février 2026.
Qui le publie
Jeu de données : équipe SWE-bench (Princeton) et OpenAI. Évaluation : Epoch AI.
D’après
epoch.ai/benchmarks/swe-bench-verified Jimenez et al., SWE-bench (2023) (lu le 01/10/2026)

SimpleQA Verified

Connaissances factuelles · 77 modèles évalués ici1 000 questions factuelles courtes (politique, sciences, art, sport, géographie…) posées sans recherche web, avec une seule bonne réponse : une date, une personne, un nombre, un lieu.
Lire un score
Part de bonnes réponses. Un score bas veut dire que le modèle se trompe souvent sur des faits précis quand il n'a pas accès au web : ce qu'il affirme de mémoire est à vérifier.
Limites
Les questions ont été choisies pour être difficiles pour les modèles de 2024-2025. Une IA qui cherche sur le web fait bien mieux. Epoch compte seulement les bonnes réponses, sans la mesure de Google qui valorise aussi le fait de s'abstenir.
Qui le publie
Questions : Google, d’après SimpleQA d’OpenAI. Évaluation : Epoch AI.
D’après
epoch.ai/benchmarks/simpleqa-verified Haas et al., SimpleQA Verified (2025) (lu le 01/10/2026)

SWE-bench Verified, mini-SWE-agent (classement officiel)

CodeLes mêmes 500 tickets, avec un outil minimal identique pour tous les modèles (un terminal bash, rien d'autre) : la comparaison porte sur le modèle, pas sur l'outillage autour.
Lire un score
Part des tickets résolus avec ce seul outil. Plus bas que les scores annoncés par les labos, qui utilisent des outils plus riches.
Limites
Mis à jour au fil des soumissions, parfois avec des mois de retard : la date de chaque ligne est affichée. Licence non commerciale (CC BY-NC).
Qui le publie
Équipe SWE-bench (Princeton, Stanford).
D’après
swebench.com (lu le 01/10/2026)

Capacité contre prix

En haut à gauche, le plus capable pour le moins cher. La ligne en tirets relie les modèles qu'aucun autre ne bat à la fois sur la capacité et sur le prix (frontière de Pareto) ; la liste sous le graphique mène à leurs fiches.

Capacité (ECI) contre prix catalogue de 191 modèlesFrontière de Pareto (tous les modèles) : Qwen2.5-Coder (7B) (113,1 ; 0,02 $), Llama 3.1-8B (116,6 ; 0,03 $), gpt-oss-20b (137,8 ; 0,03 $), Qwen3-32B (138,5 ; 0,06 $), gpt-oss-120b (139,9 ; 0,07 $), DeepSeek V4 Flash 0731 (154,5 ; 0,11 $), DeepSeek V4.1 Flash (154,9 ; 0,26 $), GPT-5.6 Luna (156,4 ; 0,45 $), Gemini 3.7 Flash (157,3 ; 1,50 $), Claude Sonnet 5.5 (165,0 ; 4,00 $), Claude Opus 5.5 (167,3 ; 8,00 $). Le tableau plus bas donne chaque valeur.0,01 $0,02 $0,05 $0,10 $0,20 $0,50 $1 $2 $5 $10 $20 $50 $100 $859095100105110115120125130135140145150155160165170Prix mélangé, $ par million de jetons (échelle log) · ← moins cherECI (Epoch AI) · ↑ meilleurQwen2.5-Coder (7B) : ECI 113,1 · 0,02 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Qwen2.5-Coder-3B : ECI 107,7 · 0,02 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Llama 3.2 1B : ECI 102,0 · 0,02 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)Llama 3.1-8B : ECI 116,6 · 0,03 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)gpt-oss-20b : ECI 137,8 · 0,03 $ par million de jetons (3 entrée pour 1 sortie, darkbloom)Llama 3-8B : ECI 116,5 · 0,04 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Ministral 3B : ECI 118,1 · 0,04 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Gemma 3 4B : ECI 116,0 · 0,05 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Qwen2.5-7B : ECI 118,5 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Mistral Small 3 : ECI 127,1 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-8B : ECI 136,2 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)Qwen3-32B : ECI 138,5 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Lambda)Llama 4 Maverick : ECI 132,2 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Lambda)Llama 4 Scout : ECI 129,6 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Lambda)Gemma 3 12B : ECI 123,5 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)gpt-oss-120b : ECI 139,9 · 0,07 $ par million de jetons (3 entrée pour 1 sortie, Weights & Biases)DeepSeek-R1-Distill-Qwen-14B : ECI 135,4 · 0,07 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Mistral NeMo : ECI 118,7 · 0,07 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)Phi-4 : ECI 130,4 · 0,09 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen2.5-32B : ECI 128,5 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Qwen2.5-Coder-32B : ECI 119,5 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Gemma 3 27B : ECI 130,0 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Mistral 7B v0.1 : ECI 112,2 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Replicate)Llama 2-7B : ECI 99,1 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Replicate)Gemma 2B : ECI 94,2 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)StarCoder 2 3B : ECI 88,8 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)DeepSeek V4 Flash 0731 : ECI 154,5 · 0,11 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Mistral Small 3.2 : ECI 131,7 · 0,11 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3.5-9B : ECI 139,5 · 0,11 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-14B : ECI 138,2 · 0,12 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Qwen3-30B-A3B : ECI 136,2 · 0,12 $ par million de jetons (3 entrée pour 1 sortie, Cloudflare Workers AI)Mixtral 8x7B : ECI 118,5 · 0,12 $ par million de jetons (3 entrée pour 1 sortie, Perplexity)Qwen 3.6 35B-A3B : ECI 143,9 · 0,14 $ par million de jetons (3 entrée pour 1 sortie, Sail)Gemma 4 26B A4B : ECI 141,9 · 0,14 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)GPT-5 nano : ECI 139,4 · 0,14 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)DeepSeek-R1-Distill-Qwen-32B : ECI 137,4 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Gemma 7B : ECI 112,0 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, anyscale)Qwen3-30B-A3B-Instruct (Jul 2025) : ECI 137,4 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Mistral Small 3.1 : ECI 127,5 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)Gemma 4 31B IT : ECI 142,7 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Weights & Biases)Qwen2.5-72B : ECI 129,0 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3.1-405B : ECI 128,8 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3.3 70B : ECI 127,3 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3.1-70B : ECI 125,9 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3-70B : ECI 122,9 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)GPT-4.1 nano : ECI 129,6 · 0,18 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)QwQ-32B : ECI 137,6 · 0,19 $ par million de jetons (3 entrée pour 1 sortie, Nscale)DeepSeek-V3 : ECI 132,3 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Gemma 2 9B : ECI 119,8 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Llama 2-13B : ECI 106,2 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Replicate)StarCoder 2 15B : ECI 105,0 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Yi 6B : ECI 104,8 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)StarCoder 2 7B : ECI 93,6 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Qwen3-235B-A22B-Instruct (Jul 2025) : ECI 138,9 · 0,21 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)phi-3-mini 3.8B : ECI 117,4 · 0,23 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)GLM-5.3-Flash : ECI 151,9 · 0,24 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Qwen3.6 27B : ECI 146,5 · 0,24 $ par million de jetons (3 entrée pour 1 sortie, LibertAI)DeepSeek-R1 (May 2025) : ECI 141,3 · 0,25 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)DeepSeek V4.1 Flash : ECI 154,9 · 0,26 $ par million de jetons (3 entrée pour 1 sortie, Sail)GPT-4o mini : ECI 126,6 · 0,26 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)phi-3-small 7.4B : ECI 121,8 · 0,26 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Qwen3-235B-A22B : ECI 139,4 · 0,27 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)phi-3-medium 14B : ECI 121,2 · 0,30 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)DeepSeek-V3 (Mar 2025) : ECI 135,9 · 0,30 $ par million de jetons (3 entrée pour 1 sortie, Lambda)DeepSeek-V3.2-Exp : ECI 145,0 · 0,31 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)DeepSeek-V3.2 : ECI 146,3 · 0,31 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)Qwen3.5-35B-A3B : ECI 142,5 · 0,36 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-235B-A22B-Thinking (Jul 2025) : ECI 143,9 · 0,39 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)DeepSeek-V3.1 : ECI 139,9 · 0,43 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)MiniMax-M2.7 : ECI 145,9 · 0,44 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)GPT-5.6 Luna : ECI 156,4 · 0,45 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.4 Nano : ECI 145,8 · 0,46 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude 3 Haiku : ECI 118,4 · 0,50 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)DeepSeek-Coder-V2-Lite-Base : ECI 108,9 · 0,50 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Grok-3 mini : ECI 140,4 · 0,51 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)MiniMax-M3 : ECI 147,0 · 0,52 $ par million de jetons (3 entrée pour 1 sortie, MiniMax)MiniMax-M2.5 : ECI 146,7 · 0,52 $ par million de jetons (3 entrée pour 1 sortie, MiniMax)DeepSeek-V4-Flash : ECI 146,1 · 0,52 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)Qwen3.7-Plus : ECI 147,4 · 0,56 $ par million de jetons (3 entrée pour 1 sortie, Together AI)Gemini 3.1 Flash-Lite : ECI 144,5 · 0,56 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Inkling-Small : ECI 150,2 · 0,64 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)GPT-5 mini : ECI 145,5 · 0,69 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4.1 mini : ECI 135,0 · 0,70 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Llama 3.2 90B : ECI 125,5 · 0,72 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Magistral Small 1.2 : ECI 131,4 · 0,75 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)GPT-3.5 Turbo (Jan 2024) : ECI 115,7 · 0,75 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Gemma 2 27B : ECI 122,1 · 0,80 $ par million de jetons (3 entrée pour 1 sortie, Together AI)DeepSeek Coder 33B : ECI 96,3 · 0,80 $ par million de jetons (3 entrée pour 1 sortie, Together AI)Nemotron 3 Ultra : ECI 146,2 · 0,81 $ par million de jetons (3 entrée pour 1 sortie, Perplexity)Gemini 3.5 Flash-Lite : ECI 145,1 · 0,85 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Kimi K2 (Jul 2025) : ECI 140,1 · 0,88 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-30B-A3B-Thinking (Jul 2025) : ECI 139,6 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Qwen2-72B : ECI 125,3 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Yi-34B : ECI 117,4 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Kimi K2 Thinking : ECI 146,0 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, GMI Cloud)DeepSeek-R1 : ECI 139,0 · 0,96 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)GLM-4.7 : ECI 143,5 · 1,00 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Llama 2-70B : ECI 113,8 · 1,00 $ par million de jetons (3 entrée pour 1 sortie, anyscale)Qwen 3.8 27B : ECI 149,4 · 1,05 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3.5 397B-A17B : ECI 146,7 · 1,09 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen 3.6 Plus : ECI 147,7 · 1,13 $ par million de jetons (3 entrée pour 1 sortie, Together AI)Kimi K2.5 : ECI 148,0 · 1,20 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Mixtral 8x22B : ECI 122,0 · 1,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Claude Instant : ECI 120,3 · 1,20 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)GPT-3.5 Turbo (Nov 2023) : ECI 118,6 · 1,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)DeepSeek V4 Pro 0813 : ECI 155,3 · 1,38 $ par million de jetons (3 entrée pour 1 sortie, Sail)Amazon Nova Pro : ECI 123,8 · 1,40 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Gemini 3 Flash : ECI 151,8 · 1,41 $ par million de jetons (3 entrée pour 1 sortie, Databricks)Gemini 3.7 Flash : ECI 157,3 · 1,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Gemini 3.8 Flash : ECI 156,7 · 1,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Gemini 3.6 Flash : ECI 154,3 · 1,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)GLM-5 : ECI 145,8 · 1,55 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Grok 4.20 : ECI 152,0 · 1,56 $ par million de jetons (3 entrée pour 1 sortie, xAI)Claude 3.5 Haiku : ECI 127,2 · 1,60 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)GPT-5.4 Mini : ECI 148,8 · 1,69 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Kimi K2.6 : ECI 151,1 · 1,71 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Kimi K2.7 Code : ECI 150,0 · 1,71 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Inkling : ECI 148,5 · 1,72 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)o4-mini : ECI 145,6 · 1,93 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o3-mini : ECI 140,3 · 1,93 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o1-mini : ECI 135,8 · 1,93 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)DeepSeek-V4-Pro : ECI 149,1 · 1,98 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)Muse Spark 1.3 : ECI 156,8 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Meta)Muse Spark 1.2 : ECI 154,9 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Meta)Muse Spark 1.1 : ECI 154,2 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Meta)Claude Haiku 4.5 : ECI 142,4 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GLM-5.3 : ECI 155,6 · 2,15 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)GLM-5.2 : ECI 151,8 · 2,15 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)GLM-5.1 : ECI 149,8 · 2,15 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Qwen3-Max : ECI 142,4 · 2,40 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Grok 4.6 : ECI 156,4 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, xAI)Qwen 3.8 Max : ECI 156,4 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Alibaba Cloud (DashScope))Grok 4.5 : ECI 153,9 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, xAI)Mistral Medium 3.5 : ECI 141,4 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Mistral AI)Mistral Medium 3 : ECI 134,1 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Mistral AI)Mistral Large 2 (Nov 2024) : ECI 128,5 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)Mistral Large 2 (Jul 2024) : ECI 127,5 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Gemini 3.5 Flash : ECI 154,5 · 3,38 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)GPT-5 : ECI 150,0 · 3,44 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.1 : ECI 149,6 · 3,44 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o3 : ECI 146,9 · 3,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4.1 : ECI 136,8 · 3,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Qwen3.7-Max : ECI 153,7 · 3,75 $ par million de jetons (3 entrée pour 1 sortie, Alibaba Cloud (DashScope))Claude Sonnet 5.5 : ECI 165,0 · 4,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Sonnet 5 : ECI 156,2 · 4,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GPT-4o (Nov 2024) : ECI 128,8 · 4,38 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4o (Aug 2024) : ECI 128,8 · 4,38 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.6 Terra : ECI 159,6 · 4,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Gemini 3.1 Pro : ECI 154,8 · 4,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Gemini 3 Pro : ECI 152,9 · 4,50 $ par million de jetons (3 entrée pour 1 sortie, Replicate)Mistral Large : ECI 122,0 · 4,75 $ par million de jetons (3 entrée pour 1 sortie, IBM watsonx)GPT-5.3 Codex : ECI 156,8 · 4,81 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.2 : ECI 153,5 · 4,81 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.4 : ECI 156,8 · 5,63 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Kimi K3 : ECI 157,5 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Claude Sonnet 4.6 : ECI 152,2 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Sonnet 4.5 : ECI 146,8 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Grok 4 : ECI 146,4 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Claude Sonnet 4 : ECI 141,7 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3.7 Sonnet : ECI 141,2 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Grok 3 : ECI 138,3 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Claude 3.5 Sonnet (October 2024) : ECI 133,6 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3.5 Sonnet : ECI 130,0 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3 Sonnet : ECI 120,7 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)Command R+ : ECI 119,3 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)GPT-4o (May 2024) : ECI 129,0 · 7,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude Opus 5.5 : ECI 167,3 · 8,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GPT-5.6 Sol : ECI 161,7 · 8,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude Opus 5 : ECI 162,8 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.8 : ECI 158,2 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.7 : ECI 156,3 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.6 : ECI 155,2 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.5 : ECI 150,1 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GPT-5.5 : ECI 159,1 · 11,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4 Turbo (Apr 2024) : ECI 127,3 · 15,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4 Turbo (Nov 2023) : ECI 126,5 · 15,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-6 Astra : ECI 166,5 · 20,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude Fable 5.1 : ECI 164,7 · 20,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Fable 5 : ECI 162,1 · 20,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)o1 : ECI 141,9 · 26,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o1-preview : ECI 134,8 · 28,88 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)Claude Opus 4.1 : ECI 144,1 · 30,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude Opus 4 : ECI 142,7 · 30,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3 Opus : ECI 126,9 · 30,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)o3-pro : ECI 147,4 · 35,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4 (Jun 2023) : ECI 123,1 · 37,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5 Pro : ECI 150,3 · 41,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.2 Pro : ECI 155,4 · 57,75 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.5 Pro : ECI 162,1 · 67,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.4 Pro : ECI 158,9 · 67,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4.5 : ECI 136,7 · 93,75 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)
Capacité (ECI) contre prix catalogue de 191 modèlesFrontière de Pareto (tous les modèles) : Qwen2.5-Coder (7B) (113,1 ; 0,02 $), Llama 3.1-8B (116,6 ; 0,03 $), gpt-oss-20b (137,8 ; 0,03 $), Qwen3-32B (138,5 ; 0,06 $), gpt-oss-120b (139,9 ; 0,07 $), DeepSeek V4 Flash 0731 (154,5 ; 0,11 $), DeepSeek V4.1 Flash (154,9 ; 0,26 $), GPT-5.6 Luna (156,4 ; 0,45 $), Gemini 3.7 Flash (157,3 ; 1,50 $), Claude Sonnet 5.5 (165,0 ; 4,00 $), Claude Opus 5.5 (167,3 ; 8,00 $). Le tableau plus bas donne chaque valeur.0,01 $0,03 $0,10 $0,30 $1 $3 $10 $30 $100 $859095100105110115120125130135140145150155160165170Prix, $/M jetons (log) · ← moins cherECI (Epoch AI) · ↑ meilleurQwen2.5-Coder (7B) : ECI 113,1 · 0,02 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Qwen2.5-Coder-3B : ECI 107,7 · 0,02 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Llama 3.2 1B : ECI 102,0 · 0,02 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)Llama 3.1-8B : ECI 116,6 · 0,03 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)gpt-oss-20b : ECI 137,8 · 0,03 $ par million de jetons (3 entrée pour 1 sortie, darkbloom)Llama 3-8B : ECI 116,5 · 0,04 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Ministral 3B : ECI 118,1 · 0,04 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Gemma 3 4B : ECI 116,0 · 0,05 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Qwen2.5-7B : ECI 118,5 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Mistral Small 3 : ECI 127,1 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-8B : ECI 136,2 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)Qwen3-32B : ECI 138,5 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Lambda)Llama 4 Maverick : ECI 132,2 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Lambda)Llama 4 Scout : ECI 129,6 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Lambda)Gemma 3 12B : ECI 123,5 · 0,06 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)gpt-oss-120b : ECI 139,9 · 0,07 $ par million de jetons (3 entrée pour 1 sortie, Weights & Biases)DeepSeek-R1-Distill-Qwen-14B : ECI 135,4 · 0,07 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Mistral NeMo : ECI 118,7 · 0,07 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)Phi-4 : ECI 130,4 · 0,09 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen2.5-32B : ECI 128,5 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Qwen2.5-Coder-32B : ECI 119,5 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Gemma 3 27B : ECI 130,0 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Mistral 7B v0.1 : ECI 112,2 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Replicate)Llama 2-7B : ECI 99,1 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Replicate)Gemma 2B : ECI 94,2 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)StarCoder 2 3B : ECI 88,8 · 0,10 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)DeepSeek V4 Flash 0731 : ECI 154,5 · 0,11 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Mistral Small 3.2 : ECI 131,7 · 0,11 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3.5-9B : ECI 139,5 · 0,11 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-14B : ECI 138,2 · 0,12 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Qwen3-30B-A3B : ECI 136,2 · 0,12 $ par million de jetons (3 entrée pour 1 sortie, Cloudflare Workers AI)Mixtral 8x7B : ECI 118,5 · 0,12 $ par million de jetons (3 entrée pour 1 sortie, Perplexity)Qwen 3.6 35B-A3B : ECI 143,9 · 0,14 $ par million de jetons (3 entrée pour 1 sortie, Sail)Gemma 4 26B A4B : ECI 141,9 · 0,14 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)GPT-5 nano : ECI 139,4 · 0,14 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)DeepSeek-R1-Distill-Qwen-32B : ECI 137,4 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, Nscale)Gemma 7B : ECI 112,0 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, anyscale)Qwen3-30B-A3B-Instruct (Jul 2025) : ECI 137,4 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, Nebius)Mistral Small 3.1 : ECI 127,5 · 0,15 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)Gemma 4 31B IT : ECI 142,7 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Weights & Biases)Qwen2.5-72B : ECI 129,0 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3.1-405B : ECI 128,8 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3.3 70B : ECI 127,3 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3.1-70B : ECI 125,9 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Llama 3-70B : ECI 122,9 · 0,16 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)GPT-4.1 nano : ECI 129,6 · 0,18 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)QwQ-32B : ECI 137,6 · 0,19 $ par million de jetons (3 entrée pour 1 sortie, Nscale)DeepSeek-V3 : ECI 132,3 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)Gemma 2 9B : ECI 119,8 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Llama 2-13B : ECI 106,2 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Replicate)StarCoder 2 15B : ECI 105,0 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Yi 6B : ECI 104,8 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)StarCoder 2 7B : ECI 93,6 · 0,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Qwen3-235B-A22B-Instruct (Jul 2025) : ECI 138,9 · 0,21 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)phi-3-mini 3.8B : ECI 117,4 · 0,23 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)GLM-5.3-Flash : ECI 151,9 · 0,24 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Qwen3.6 27B : ECI 146,5 · 0,24 $ par million de jetons (3 entrée pour 1 sortie, LibertAI)DeepSeek-R1 (May 2025) : ECI 141,3 · 0,25 $ par million de jetons (3 entrée pour 1 sortie, Hyperbolic)DeepSeek V4.1 Flash : ECI 154,9 · 0,26 $ par million de jetons (3 entrée pour 1 sortie, Sail)GPT-4o mini : ECI 126,6 · 0,26 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)phi-3-small 7.4B : ECI 121,8 · 0,26 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Qwen3-235B-A22B : ECI 139,4 · 0,27 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)phi-3-medium 14B : ECI 121,2 · 0,30 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)DeepSeek-V3 (Mar 2025) : ECI 135,9 · 0,30 $ par million de jetons (3 entrée pour 1 sortie, Lambda)DeepSeek-V3.2-Exp : ECI 145,0 · 0,31 $ par million de jetons (3 entrée pour 1 sortie, Novita AI)DeepSeek-V3.2 : ECI 146,3 · 0,31 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)Qwen3.5-35B-A3B : ECI 142,5 · 0,36 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-235B-A22B-Thinking (Jul 2025) : ECI 143,9 · 0,39 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)DeepSeek-V3.1 : ECI 139,9 · 0,43 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)MiniMax-M2.7 : ECI 145,9 · 0,44 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)GPT-5.6 Luna : ECI 156,4 · 0,45 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.4 Nano : ECI 145,8 · 0,46 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude 3 Haiku : ECI 118,4 · 0,50 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)DeepSeek-Coder-V2-Lite-Base : ECI 108,9 · 0,50 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Grok-3 mini : ECI 140,4 · 0,51 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)MiniMax-M3 : ECI 147,0 · 0,52 $ par million de jetons (3 entrée pour 1 sortie, MiniMax)MiniMax-M2.5 : ECI 146,7 · 0,52 $ par million de jetons (3 entrée pour 1 sortie, MiniMax)DeepSeek-V4-Flash : ECI 146,1 · 0,52 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)Qwen3.7-Plus : ECI 147,4 · 0,56 $ par million de jetons (3 entrée pour 1 sortie, Together AI)Gemini 3.1 Flash-Lite : ECI 144,5 · 0,56 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Inkling-Small : ECI 150,2 · 0,64 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)GPT-5 mini : ECI 145,5 · 0,69 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4.1 mini : ECI 135,0 · 0,70 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Llama 3.2 90B : ECI 125,5 · 0,72 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Magistral Small 1.2 : ECI 131,4 · 0,75 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)GPT-3.5 Turbo (Jan 2024) : ECI 115,7 · 0,75 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Gemma 2 27B : ECI 122,1 · 0,80 $ par million de jetons (3 entrée pour 1 sortie, Together AI)DeepSeek Coder 33B : ECI 96,3 · 0,80 $ par million de jetons (3 entrée pour 1 sortie, Together AI)Nemotron 3 Ultra : ECI 146,2 · 0,81 $ par million de jetons (3 entrée pour 1 sortie, Perplexity)Gemini 3.5 Flash-Lite : ECI 145,1 · 0,85 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Kimi K2 (Jul 2025) : ECI 140,1 · 0,88 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3-30B-A3B-Thinking (Jul 2025) : ECI 139,6 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Qwen2-72B : ECI 125,3 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Yi-34B : ECI 117,4 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Kimi K2 Thinking : ECI 146,0 · 0,90 $ par million de jetons (3 entrée pour 1 sortie, GMI Cloud)DeepSeek-R1 : ECI 139,0 · 0,96 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)GLM-4.7 : ECI 143,5 · 1,00 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Llama 2-70B : ECI 113,8 · 1,00 $ par million de jetons (3 entrée pour 1 sortie, anyscale)Qwen 3.8 27B : ECI 149,4 · 1,05 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen3.5 397B-A17B : ECI 146,7 · 1,09 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Qwen 3.6 Plus : ECI 147,7 · 1,13 $ par million de jetons (3 entrée pour 1 sortie, Together AI)Kimi K2.5 : ECI 148,0 · 1,20 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Mixtral 8x22B : ECI 122,0 · 1,20 $ par million de jetons (3 entrée pour 1 sortie, Fireworks AI)Claude Instant : ECI 120,3 · 1,20 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)GPT-3.5 Turbo (Nov 2023) : ECI 118,6 · 1,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)DeepSeek V4 Pro 0813 : ECI 155,3 · 1,38 $ par million de jetons (3 entrée pour 1 sortie, Sail)Amazon Nova Pro : ECI 123,8 · 1,40 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Gemini 3 Flash : ECI 151,8 · 1,41 $ par million de jetons (3 entrée pour 1 sortie, Databricks)Gemini 3.7 Flash : ECI 157,3 · 1,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Gemini 3.8 Flash : ECI 156,7 · 1,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Gemini 3.6 Flash : ECI 154,3 · 1,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)GLM-5 : ECI 145,8 · 1,55 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Grok 4.20 : ECI 152,0 · 1,56 $ par million de jetons (3 entrée pour 1 sortie, xAI)Claude 3.5 Haiku : ECI 127,2 · 1,60 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)GPT-5.4 Mini : ECI 148,8 · 1,69 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Kimi K2.6 : ECI 151,1 · 1,71 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Kimi K2.7 Code : ECI 150,0 · 1,71 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Inkling : ECI 148,5 · 1,72 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)o4-mini : ECI 145,6 · 1,93 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o3-mini : ECI 140,3 · 1,93 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o1-mini : ECI 135,8 · 1,93 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)DeepSeek-V4-Pro : ECI 149,1 · 1,98 $ par million de jetons (3 entrée pour 1 sortie, DeepSeek)Muse Spark 1.3 : ECI 156,8 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Meta)Muse Spark 1.2 : ECI 154,9 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Meta)Muse Spark 1.1 : ECI 154,2 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Meta)Claude Haiku 4.5 : ECI 142,4 · 2,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GLM-5.3 : ECI 155,6 · 2,15 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)GLM-5.2 : ECI 151,8 · 2,15 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)GLM-5.1 : ECI 149,8 · 2,15 $ par million de jetons (3 entrée pour 1 sortie, Z.ai)Qwen3-Max : ECI 142,4 · 2,40 $ par million de jetons (3 entrée pour 1 sortie, DeepInfra)Grok 4.6 : ECI 156,4 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, xAI)Qwen 3.8 Max : ECI 156,4 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Alibaba Cloud (DashScope))Grok 4.5 : ECI 153,9 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, xAI)Mistral Medium 3.5 : ECI 141,4 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Mistral AI)Mistral Medium 3 : ECI 134,1 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Mistral AI)Mistral Large 2 (Nov 2024) : ECI 128,5 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)Mistral Large 2 (Jul 2024) : ECI 127,5 · 3,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Gemini 3.5 Flash : ECI 154,5 · 3,38 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)GPT-5 : ECI 150,0 · 3,44 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.1 : ECI 149,6 · 3,44 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o3 : ECI 146,9 · 3,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4.1 : ECI 136,8 · 3,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Qwen3.7-Max : ECI 153,7 · 3,75 $ par million de jetons (3 entrée pour 1 sortie, Alibaba Cloud (DashScope))Claude Sonnet 5.5 : ECI 165,0 · 4,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Sonnet 5 : ECI 156,2 · 4,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GPT-4o (Nov 2024) : ECI 128,8 · 4,38 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4o (Aug 2024) : ECI 128,8 · 4,38 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.6 Terra : ECI 159,6 · 4,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Gemini 3.1 Pro : ECI 154,8 · 4,50 $ par million de jetons (3 entrée pour 1 sortie, Google AI Studio)Gemini 3 Pro : ECI 152,9 · 4,50 $ par million de jetons (3 entrée pour 1 sortie, Replicate)Mistral Large : ECI 122,0 · 4,75 $ par million de jetons (3 entrée pour 1 sortie, IBM watsonx)GPT-5.3 Codex : ECI 156,8 · 4,81 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.2 : ECI 153,5 · 4,81 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.4 : ECI 156,8 · 5,63 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Kimi K3 : ECI 157,5 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Moonshot AI)Claude Sonnet 4.6 : ECI 152,2 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Sonnet 4.5 : ECI 146,8 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Grok 4 : ECI 146,4 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Claude Sonnet 4 : ECI 141,7 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3.7 Sonnet : ECI 141,2 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Grok 3 : ECI 138,3 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure AI Foundry)Claude 3.5 Sonnet (October 2024) : ECI 133,6 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3.5 Sonnet : ECI 130,0 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3 Sonnet : ECI 120,7 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Google Vertex AI)Command R+ : ECI 119,3 · 6,00 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)GPT-4o (May 2024) : ECI 129,0 · 7,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude Opus 5.5 : ECI 167,3 · 8,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GPT-5.6 Sol : ECI 161,7 · 8,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude Opus 5 : ECI 162,8 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.8 : ECI 158,2 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.7 : ECI 156,3 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.6 : ECI 155,2 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Opus 4.5 : ECI 150,1 · 10,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)GPT-5.5 : ECI 159,1 · 11,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4 Turbo (Apr 2024) : ECI 127,3 · 15,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4 Turbo (Nov 2023) : ECI 126,5 · 15,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-6 Astra : ECI 166,5 · 20,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)Claude Fable 5.1 : ECI 164,7 · 20,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)Claude Fable 5 : ECI 162,1 · 20,00 $ par million de jetons (3 entrée pour 1 sortie, Anthropic)o1 : ECI 141,9 · 26,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)o1-preview : ECI 134,8 · 28,88 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)Claude Opus 4.1 : ECI 144,1 · 30,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude Opus 4 : ECI 142,7 · 30,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)Claude 3 Opus : ECI 126,9 · 30,00 $ par million de jetons (3 entrée pour 1 sortie, Amazon Bedrock)o3-pro : ECI 147,4 · 35,00 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4 (Jun 2023) : ECI 123,1 · 37,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5 Pro : ECI 150,3 · 41,25 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.2 Pro : ECI 155,4 · 57,75 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.5 Pro : ECI 162,1 · 67,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-5.4 Pro : ECI 158,9 · 67,50 $ par million de jetons (3 entrée pour 1 sortie, OpenAI)GPT-4.5 : ECI 136,7 · 93,75 $ par million de jetons (3 entrée pour 1 sortie, Microsoft Azure OpenAI)

poids ferméspoids ouvertsfrontière de Pareto

Sur la frontière (tous modèles), du moins cher au plus cher : 1. Qwen2.5-Coder (7B) (113,1, 0,02 $), 2. Llama 3.1-8B (116,6, 0,03 $), 3. gpt-oss-20b (137,8, 0,03 $), 4. Qwen3-32B (138,5, 0,06 $), 5. gpt-oss-120b (139,9, 0,07 $), 6. DeepSeek V4 Flash 0731 (154,5, 0,11 $), 7. DeepSeek V4.1 Flash (154,9, 0,26 $), 8. GPT-5.6 Luna (156,4, 0,45 $), 9. Gemini 3.7 Flash (157,3, 1,50 $), 10. Claude Sonnet 5.5 (165,0, 4,00 $), 11. Claude Opus 5.5 (167,3, 8,00 $).

Sur la frontière (poids ouverts), du moins cher au plus cher : 1. Qwen2.5-Coder (7B) (113,1, 0,02 $), 2. Llama 3.1-8B (116,6, 0,03 $), 3. gpt-oss-20b (137,8, 0,03 $), 4. Qwen3-32B (138,5, 0,06 $), 5. gpt-oss-120b (139,9, 0,07 $), 6. DeepSeek V4 Flash 0731 (154,5, 0,11 $), 7. DeepSeek V4.1 Flash (154,9, 0,26 $), 8. DeepSeek V4 Pro 0813 (155,3, 1,38 $), 9. Kimi K3 (157,5, 6,00 $).

Sur la frontière (poids fermés), du moins cher au plus cher : 1. Ministral 3B (118,1, 0,04 $), 2. GPT-5 nano (139,4, 0,14 $), 3. GPT-5.6 Luna (156,4, 0,45 $), 4. Gemini 3.7 Flash (157,3, 1,50 $), 5. Claude Sonnet 5.5 (165,0, 4,00 $), 6. Claude Opus 5.5 (167,3, 8,00 $).

Capacité : indice ECI d'Epoch AI. Prix : catalogue de l'éditeur, sinon de l'hébergeur le moins cher, 3 jetons d'entrée pour 1 de sortie, d'après LiteLLM ; c'est un prix au jeton, pas un coût par tâche (un modèle bavard coûte plus que son prix ne le dit). 83 modèles sans prix dans la table n’y figurent pas. Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Tous les modèles

Les 274 modèles de l’indice ECI, triés par ECI. Le nom mène à la fiche (scores détaillés, prix par fournisseur, auto-hébergement) ; chaque chiffre mène à sa source. Un tiret : Epoch AI n’a pas évalué ce modèle ; dans la colonne Arena, le modèle est absent du classement LMArena ou son nom n’a pas été rapproché. Les chiffres annoncés par les éditeurs eux-mêmes ne sont pas repris.

Benchmarks, taille et prix des 274 modèles de l’indice ECI
ModèleÉditeurPoidsTailleECIArenaGPQAFrontier­MathAIMESimpleQASWE-benchPrix $/M
Claude Opus 5.5Anthropicfermés—167,31 50490,691,2100,072,2—8,00
GPT-6 AstraOpenAIfermés—166,51 47795,893,7100,075,6—20,00
GPT-6.1 SolOpenAIfermés—166,1—95,493,7100,073,9——
Claude Sonnet 5.5Anthropicfermés—165,0—95,688,8100,046,5—4,00
Claude Fable 5.1Anthropicfermés—164,71 501—90,2100,070,8—20,00
Claude Opus 5Anthropicfermés—162,81 48993,985,698,959,9—10,00
GPT-6 SolOpenAIfermés—162,7—94,389,8100,060,7——
GPT-5.5 ProOpenAIfermés—162,1—93,987,7100,0——67,50
Claude Fable 5Anthropicfermés—162,11 50485,987,0100,070,7—20,00
GPT-5.6 SolOpenAIfermés—161,71 48493,589,1100,069,7—8,00
GPT-5.6 TerraOpenAIfermés—159,61 46593,386,099,743,2—4,50
GPT-5.5OpenAIfermés—159,11 48194,085,3100,063,080,611,25
GPT-5.4 ProOpenAIfermés—158,9—94,682,5—46,3—67,50
Claude Opus 4.8Anthropicfermés—158,21 48291,080,098,353,0—10,00
Kimi K3Moonshotouverts2 800 Md104 Md act.157,51 48893,172,297,250,6—6,00
Gemini 3.7 FlashGoogle DeepMindfermés—157,31 48894,871,697,269,2—1,50
GPT-5.4OpenAIfermés—156,81 47593,378,697,845,176,95,63
GPT-5.3 CodexOpenAIfermés—156,8—————74,84,81
Muse Spark 1.3Meta AIfermés—156,81 494—74,499,2——2,00
Gemini 3.8 FlashGoogle DeepMindfermés—156,71 49595,468,498,969,7—1,50
Grok 4.6xAIfermés1 500 Md156,41 45494,066,099,249,3—3,00
Qwen 3.8 MaxAlibabafermés2 400 Md95 Md act.156,41 48292,774,799,445,8—3,00
GPT-5.6 LunaOpenAIfermés—156,41 45391,682,198,341,0—0,45
GPT-6 LunaOpenAIfermés—156,3—90,578,998,941,4——
Claude Opus 4.7Anthropicfermés—156,31 50190,270,297,851,783,510,00
Claude Sonnet 5Anthropicfermés—156,21 46290,565,694,733,7—4,00
GLM-5.3Z.ai (Zhipu AI)fermés744 Md40 Md act.155,61 47890,968,891,141,0—2,15
GPT-5.2 ProOpenAIfermés—155,4——74,0———57,75
DeepSeek V4 Pro 0813DeepSeekouverts—155,31 46491,764,698,652,9—1,38
Claude Opus 4.6Anthropicfermés—155,21 50590,566,094,447,078,710,00
Qwen3.8 Max (0902)Alibabafermés—155,1—92,365,6100,047,3——
DeepSeek V4.1 FlashDeepSeekouverts748 Md16 Md act.154,91 474—————0,26
Muse Spark 1.2Meta AIfermés—154,91 494———60,3—2,00
Gemini 3.1 ProGoogle DeepMindfermés—154,81 48794,459,695,673,575,64,50
DeepSeek V4 Flash 0731DeepSeekouverts284 Md13 Md act.154,5—91,057,594,433,6—0,11
Gemini 3.5 FlashGoogle DeepMindfermés—154,51 47792,862,895,666,279,33,38
Gemini 3.6 FlashGoogle DeepMindfermés—154,31 48394,158,994,266,2—1,50
Muse Spark 1.1Meta AIfermés—154,21 491———57,8—2,00
Grok 4.5xAIfermés1 500 Md153,91 46693,457,297,848,3—3,00
Qwen3.7-MaxAlibabafermés—153,7—90,964,695,655,877,33,75
Grok 4.7xAIfermés2,1 Md153,5—92,753,098,156,0——
GPT-5.2OpenAIfermés—153,51 43791,467,496,137,173,84,81
Gemini 3 ProGoogle DeepMindfermés—152,91 48592,6—91,4—72,94,50
Claude Sonnet 4.6Anthropicfermés—152,21 47287,4—85,835,575,26,00
Muse SparkMeta AIfermés—152,01 48989,8—88,9———
Grok 4.20xAIfermés500 Md152,0—89,344,992,230,2—1,56
GLM-5.3-FlashZ.ai (Zhipu AI)ouverts320 Md18 Md act.151,91 47390,255,893,9——0,24
Gemini 3 FlashGoogle DeepMindfermés—151,81 47389,451,295,666,875,41,41
GLM-5.2Z.ai (Zhipu AI)ouverts744 Md40 Md act.151,81 47691,959,286,434,278,72,15
Kimi K2.6Moonshotouverts1 040 Md151,11 46190,857,296,134,976,71,71
GPT-5 ProOpenAIfermés—150,3——55,8———41,25
Inkling-SmallThinking Machinesouverts276 Md12 Md act.150,21 40588,546,390,019,1—0,64
Claude Opus 4.5Anthropicfermés—150,11 47086,034,486,145,776,710,00
GPT-5OpenAIfermés—150,01 43586,255,491,450,173,63,44
Kimi K2.7 CodeMoonshotouverts1 040 Md150,0—87,954,095,636,5—1,71
GLM-5.1Z.ai (Zhipu AI)ouverts754 Md149,81 46589,936,893,334,074,22,15
GPT-5.1OpenAIfermés—149,61 45687,6—88,648,068,03,44
Qwen 3.8 27BAlibabaouverts27 Md149,41 438—————1,05
Qwen 3.6 Max (Preview)Alibaba?—149,21 46087,4—91,152,076,7—
Grok 4.3 BetaxAIfermés500 Md149,2—88,842,893,333,2——
DeepSeek-V4-ProDeepSeekouverts1 600 Md49 Md act.149,11 45890,945,396,747,077,61,98
GPT-5.4 MiniOpenAIfermés—148,81 44786,951,288,929,4—1,69
InklingThinking Machinesouverts975 Md41 Md act.148,51 44188,333,388,940,3—1,72
Kimi K2.5Moonshotouverts1 040 Md148,01 45087,6—92,234,373,81,20
Qwen 3.6 PlusAlibabafermés—147,71 44388,438,293,344,157,91,13
o3-proOpenAIfermés—147,4——————35,00
Qwen3.7-PlusAlibabafermés—147,41 45687,934,493,3——0,56
MiniMax-M3MiniMaxouverts428 Md22 Md act.147,01 44090,9—71,1——0,52
o3OpenAIfermés—146,91 43281,833,384,449,462,33,50
Claude Sonnet 4.5Anthropicfermés—146,81 45582,323,977,830,771,36,00
Qwen 3.5 Plus (hosted 397B-A17B)Alibaba?—146,8—84,8—86,725,4——
MiniMax-M2.5MiniMaxouverts229 Md10 Md act.146,71 391—————0,52
Qwen3.5 397B-A17BAlibabaouverts397 Md146,71 44286,431,288,9——1,09
Qwen3.6 27BAlibabaouverts28 Md146,5—85,935,191,1——0,24
Grok 4xAIfermés3 000 Md146,4—87,0—84,0——6,00
DeepSeek-V3.2DeepSeekouverts—146,31 42383,4—87,8——0,31
Nemotron 3 UltraNvidiaouverts550 Md55 Md act.146,21 42685,4—86,7——0,81
DeepSeek-V4-FlashDeepSeekouverts284 Md13 Md act.146,11 436—————0,52
Kimi K2 ThinkingMoonshotouverts1 000 Md146,0—84,2—83,1——0,90
MiniMax-M2.7MiniMaxouverts229 Md145,91 415—————0,44
GLM-5Z.ai (Zhipu AI)ouverts744 Md145,81 45887,8—80,0—72,11,55
GPT-5.4 NanoOpenAIfermés—145,81 40178,544,987,811,7—0,46
o4-miniOpenAIfermés—145,61 39179,636,181,719,6—1,93
GPT-5 miniOpenAIfermés—145,51 39075,046,786,721,664,70,69
Gemini 2.5 Pro (Jun 2025)Google DeepMindfermés—145,3—85,324,684,7—57,6—
Gemini 3.5 Flash-LiteGoogle DeepMindfermés—145,11 45583,326,071,1——0,85
DeepSeek-V3.2-ExpDeepSeekouverts671 Md37 Md act.145,01 425—————0,31
Qwen3.7 FlashAlibabafermés—144,6—82,319,386,7———
Gemini 3.1 Flash-LiteGooglefermés—144,5—81,827,780,0——0,56
Grok 4 FastxAIfermés—144,21 405——————
Gemini 2.5 Pro (Mar 2025)Google DeepMindfermés—144,2—83,8—————
Claude Opus 4.1Anthropicfermés—144,11 44877,312,668,9—73,330,00
Qwen 3.5 Flash (hosted 35B-A3B)Alibaba?—144,0—82,318,284,420,3——
Qwen 3.6 35B-A3BAlibabaouverts—143,9—84,820,486,7——0,14
Qwen3-235B-A22B-Thinking (Jul 2025)Alibabaouverts235 Md143,91 40080,1—86,740,4—0,39
GLM-4.7Z.ai (Zhipu AI)ouverts358 Md32 Md act.143,51 44183,3—83,332,2—1,00
Qwen 3.6 FlashAlibaba?—143,3—83,322,584,415,9——
Gemini 2.5 Flash (Sep 2025)Google DeepMindfermés—143,0———————
Gemma 4 31B ITGoogle DeepMindouverts31 Md142,71 45375,8—73,310,4—0,16
Claude Opus 4Anthropicfermés—142,71 41476,3—64,4—70,730,00
GPT-5.5 InstantOpenAIfermés—142,51 47382,526,368,1———
Qwen3.5-35B-A3BAlibabaouverts35 Md3,0 Md act.142,51 39483,5—70,0——0,36
Gemini 2.5 Pro (May 2025)Google DeepMindfermés—142,5—66,7—————
Claude Haiku 4.5Anthropicfermés—142,41 41471,2—66,713,2—2,00
Qwen3-MaxAlibabafermés1 000 Md142,41 42372,618,973,348,7—2,40
o1OpenAIfermés—141,91 40276,814,773,341,1—26,25
Gemma 4 26B A4BGoogle DeepMindouverts25 Md3,8 Md act.141,91 43773,2—82,2——0,14
Claude Sonnet 4Anthropicfermés—141,71 39179,2—71,1——6,00
Gemini 2.5 Flash (May 2025)Google DeepMindfermés—141,5———70,8———
Mistral Medium 3.5Mistral AIouverts128 Md141,41 427—————3,00
DeepSeek-R1 (May 2025)DeepSeekouverts671 Md141,31 42276,3—66,4——0,25
Claude 3.7 SonnetAnthropicfermés—141,21 37379,7—57,8—61,06,00
Gemini 2.5 Flash (Jun 2025)Google DeepMindfermés—140,8———————
Grok-3 minixAIfermés—140,41 36376,3—77,8——0,51
o3-miniOpenAIfermés—140,31 36477,018,676,915,3—1,93
Kimi K2 (Jul 2025)Moonshotouverts—140,11 418—————0,88
Gemini 2.5 Flash (Apr 2025)Google DeepMindfermés—140,0———73,1———
gpt-oss-120bOpenAIouverts117 Md139,91 35275,8—88,9——0,065
DeepSeek-V3.1DeepSeekouverts671 Md37 Md act.139,91 416—————0,43
Qwen3-30B-A3B-Thinking (Jul 2025)Alibabaouverts—139,6—70,1—70,3——0,90
Qwen3.5-9BAlibabaouverts9,0 Md139,5—79,0—61,7——0,11
GPT-5 nanoOpenAIfermés—139,41 33869,420,081,111,7—0,14
Qwen3-235B-A22BAlibabaouverts235 Md139,41 37570,7————0,27
DeepSeek-R1DeepSeekouverts671 Md139,01 39871,7—53,3——0,96
Qwen3-235B-A22B-Instruct (Jul 2025)Alibabaouverts—138,91 422—————0,21
Qwen3-32BAlibabaouverts33 Md138,51 34765,7—66,9——0,063
Grok 3xAIfermés3 000 Md138,3—75,8—55,6——6,00
Qwen3-14BAlibabaouverts15 Md138,2—63,8—66,4——0,12
gpt-oss-20bOpenAIouverts21 Md137,81 31860,8—65,3——0,029
QwQ-32BAlibabaouverts33 Md137,61 33665,3—59,2——0,19
DeepSeek-R1-Distill-Qwen-32BDeepSeekouverts32 Md137,4—64,1—55,6——0,15
Qwen3-30B-A3B-Instruct (Jul 2025)Alibabaouverts—137,41 38355,6—62,2——0,15
GPT-4.1OpenAIfermés—136,81 41566,96,038,331,148,53,50
GPT-4.5OpenAIfermés—136,71 44568,7—37,8——93,75
Qwen3-30B-A3BAlibabaouverts30 Md136,21 32661,7—62,8——0,12
Qwen3-8BAlibabaouverts8,2 Md136,2—56,8—56,1——0,061
DeepSeek-V3 (Mar 2025)DeepSeekouverts671 Md135,91 39667,6—37,8——0,30
o1-miniOpenAIfermés—135,81 33762,4—46,9——1,93
DeepSeek-R1-Distill-Qwen-14BDeepSeekouverts15 Md135,4—44,7—50,6——0,070
Gemini 2.0 Flash Thinking (Jan 2025)Google DeepMindfermés—135,4—57,1—57,8———
Gemini 2.0 ProGoogle DeepMindfermés—135,1—65,7—————
GPT-4.1 miniOpenAIfermés—135,01 38365,86,744,712,7—0,70
o1-previewOpenAIfermés—134,81 38950,3—31,1——28,88
Gemini 2.0 Flash (Dec 2024)Google DeepMindfermés—134,7———————
Gemini 2.0 Flash (Feb 2025)Google DeepMindfermés—134,71 36064,1—31,1———
Mistral Medium 3Mistral AIfermés—134,1—59,5—32,2——3,00
Gemini 2.5 Flash-Lite (Jun 2025)Google DeepMindfermés—133,9———————
Claude 3.5 Sonnet (October 2024)Anthropicfermés—133,61 37455,3—8,5——6,00
Magistral Small 1.0Mistral AIouverts24 Md133,2—56,1—30,0———
Qwen2.5-MaxAlibabafermés—132,51 37456,1—16,1———
DeepSeek-V3DeepSeekouverts671 Md132,31 35856,5—15,8——0,20
Llama 4 MaverickMeta AIouverts400 Md17 Md act.132,21 32767,0—20,6——0,063
Mistral Small 3.2Mistral AIouverts24 Md131,71 35649,1—30,3——0,11
Gemini 1.5 Pro (Sept 2024)Google DeepMindfermés—131,71 35157,2—23,1———
Magistral Small 1.2Mistral AIouverts24 Md131,4—47,6—28,1——0,75
Grok-2 (Dec 2024)xAIfermés—130,5—53,8—11,5———
Phi-4Microsoft Researchouverts14 Md130,41 25656,1—13,8——0,088
Gemma 3 27BGoogle DeepMindouverts27 Md130,01 36547,7—22,5——0,10
Claude 3.5 SonnetAnthropicfermés—130,01 34354,0—6,5——6,00
Llama 4 ScoutMeta AIouverts109 Md17 Md act.129,61 32251,8—7,8——0,063
GPT-4.1 nanoOpenAIfermés—129,61 32248,9—28,96,0—0,18
Gemini 1.5 Flash (Sep 2024)Google DeepMindfermés—129,41 30947,3—16,3———
Qwen2.5-72BAlibabaouverts73 Md129,01 30349,1—8,1——0,16
GPT-4o (May 2024)OpenAIfermés—129,01 34648,9—6,3——7,50
GPT-4o (Nov 2024)OpenAIfermés—128,8—47,9—6,3—31,04,38
GPT-4o (Aug 2024)OpenAIfermés—128,81 33649,20,46,426,0—4,38
Llama 3.1-405BMeta AIouverts405 Md128,81 33550,9—9,7——0,16
Mistral Large 2 (Nov 2024)Mistral AIouverts—128,51 30651,3—7,8——3,00
Qwen2.5-32BAlibabaouverts33 Md128,5—46,1—7,4——0,095
Mistral Large 2 (Jul 2024)Mistral AIouverts—127,51 31449,0—8,5——3,00
Mistral Small 3.1Mistral AIouverts24 Md127,51 30347,5—5,8——0,15
Llama 3.3 70BMeta AIouverts70 Md127,31 31847,4—5,1——0,16
GPT-4 Turbo (Apr 2024)OpenAIfermés—127,31 32446,60,76,7——15,00
Claude 3.5 HaikuAnthropicfermés—127,21 32538,1—4,3——1,60
Mistral Small 3Mistral AIouverts24 Md127,11 27447,3—6,7——0,058
Claude 3 OpusAnthropicfermés—126,91 32247,2—4,712,6—30,00
Gemini 1.5 Pro (May 2024)Google DeepMindfermés—126,91 32445,9—6,8———
GPT-4o miniOpenAIfermés—126,61 31837,70,76,98,3—0,26
GPT-4 Turbo (Nov 2023)OpenAIfermés—126,51 31342,3————15,00
Llama 3.1-70BMeta AIouverts70 Md125,91 29344,2—3,6——0,16
GPT-4 (Mar 2023)OpenAIfermés1 800 Md125,91 28835,7—0,6———
Llama 3.2 90BMeta AIouverts89 Md125,5—41,0—2,6——0,72
Qwen2-72BAlibabaouverts73 Md125,31 26240,8————0,90
DeepSeek-V2 (MoE-236B, May 2024)DeepSeekouverts—124,8———————
Amazon Nova ProAmazonfermés—123,81 290—————1,40
Gemma 3 12BGoogle DeepMindouverts12 Md123,51 34239,5—16,7——0,063
GPT-4 (Jun 2023)OpenAIfermés1 800 Md123,11 27630,7—1,1——37,50
Llama 3-70BMeta AIouverts70 Md122,91 27740,6—4,3——0,16
Gemini 1.5 Flash (May 2024)Google DeepMindfermés—122,61 28640,4—3,9———
Gemma 2 27BGoogle DeepMindouverts27 Md122,11 28936,5—1,4——0,80
Mixtral 8x22BMistral AIouverts141 Md39 Md act.122,0—34,1————1,20
Mistral LargeMistral AIfermés—122,0—38,8—1,9——4,75
phi-3-small 7.4BMicrosoftouverts7,4 Md121,81 171—————0,26
phi-3-medium 14BMicrosoftouverts14 Md121,21 19827,6————0,30
Claude 3 SonnetAnthropicfermés—120,71 28140,6—2,5——6,00
Claude InstantAnthropicfermés—120,3——————1,20
Claude 2Anthropicfermés—120,1—34,7—2,5———
Gemma 2 9BGoogle DeepMindouverts9,0 Md119,81 26727,5—0,6——0,20
Qwen2.5-Coder-32BAlibabaouverts—119,51 271—————0,095
Command R+Cohereouverts104 Md119,31 262—————6,00
Claude 2.1Anthropicfermés—119,3—33,0—1,9———
Mistral NeMoMistral AIouverts12 Md118,7—29,9————0,073
GPT-3.5 Turbo (Nov 2023)OpenAIfermés—118,61 20428,0————1,25
Qwen2.5-7BAlibabaouverts7,6 Md118,5—35,5—2,5——0,055
Mixtral 8x7BMistral AIouverts47 Md118,5—30,6————0,12
Claude 3 HaikuAnthropicfermés—118,41 26236,3—1,8——0,50
Ministral 3BMistral AIfermés3,0 Md118,1—25,3————0,040
Yi-34B01.AIouverts34 Md117,41 18414,7————0,90
phi-3-mini 3.8BMicrosoftouverts3,8 Md117,41 128—————0,23
Stable Beluga 2Stability AIouverts70 Md117,1———————
Gemini 1.0 ProGoogle DeepMindfermés—117,0—34,0—1,1———
Llama 3.1-8BMeta AIouverts8,0 Md116,61 21127,0—1,7——0,028
Llama 3-8BMeta AIouverts8,0 Md116,51 22426,1—1,9——0,038
Qwen2.5-Coder-14BInconnu?—116,4———————
Gemma 3 4BGoogle DeepMindouverts4,0 Md116,01 30323,2—7,5——0,050
GPT-3.5 Turbo (Jan 2024)OpenAIfermés—115,71 22627,20,02,2——0,75
PaLM 2-LInconnu?—115,0———————
Llama 2-70BMeta AIouverts70 Md113,81 17126,3—0,0——1,00
GPT-3.5 Turbo (Jun 2023)OpenAIfermés—113,4———————
Qwen2.5-Coder (7B)Alibabaouverts7,6 Md113,1——————0,015
Qwen-14BAlibabaouverts14 Md113,01 139——————
Mistral 7B v0.1Mistral AIouverts—112,2——————0,10
Falcon-180BTechnology Innovation Instituteouverts180 Md112,11 148——————
internlm-20bInconnu?—112,1———————
Gemma 7BGoogle DeepMindouverts8,5 Md112,01 138—————0,15
DeepSeek LLM 67BDeepSeekouverts67 Md110,51 18524,6—0,8———
LLaMA-65BMeta AIouverts65 Md110,2———————
Falcon 2 11BTechnology Innovation Instituteouverts11 Md109,6———————
Mistral 7B v0.3Mistral AIouverts—109,0—15,2—0,3———
DeepSeek-Coder-V2-Lite-BaseInconnu?—108,9——————0,50
PaLM 2-MInconnu?—108,3———————
Phi-2Microsoftouverts2,7 Md107,9———————
Qwen2.5-Coder-3BInconnu?—107,7——————0,015
Nemotron-4 15BNvidiafermés15 Md107,7———————
Yi-9BInconnu?—107,6———————
LLaMA-33BMeta AIouverts33 Md107,4———————
Qwen-7BAlibabaouverts7,0 Md106,8———————
Llama 2-13BMeta AIouverts13 Md106,21 141—————0,20
PaLM 2-SInconnu?—106,2———————
Llama 2-34BMeta AIfermés34 Md105,2———————
StarCoder 2 15BHugging Faceouverts15 Md105,0——————0,20
Yi 6B01.AIouverts6,0 Md104,8——————0,20
Falcon-40BTechnology Innovation Instituteouverts40 Md104,5———————
Baichuan2-13BBaichuanouverts13 Md103,2———————
Qwen2.5-Coder (1.5B)Alibabaouverts1,5 Md103,0———————
internlm-7bInconnu?—102,9———————
Llama 3.2 1BMeta AIouverts1,2 Md102,01 11123,9—0,6——0,020
INTELLECT-1Prime Intellect?10 Md100,9———————
MPT-30BMosaicMLouverts30 Md100,71 151——————
LLaMA-13BMeta AIouverts13 Md100,6975——————
Llama 2-7BMeta AIouverts7,0 Md99,11 108—————0,10
chatglm2-6bInconnu?—98,91 025——————
LLaMA-7BMeta AIouverts6,7 Md96,7———————
Baichuan 2-7BBaichuanouverts7,0 Md96,3———————
DeepSeek Coder 33BDeepSeekouverts33 Md96,3——————0,80
Falcon-7BTechnology Innovation Instituteouverts7,0 Md95,1———————
CodeQwen1.5-7BInconnu?—94,9———————
vicuna-13b-v1.1Inconnu?—94,7———————
MPT-7BMosaicMLouverts7,0 Md94,61 063——————
Gemma 2BGoogle DeepMindouverts2,5 Md94,21 094—————0,10
StarCoder 2 7BHugging Faceouverts7,0 Md93,6——————0,20
XGen-7BSalesforceouverts6,7 Md93,4———————
Qwen-1_8BInconnu?—92,9———————
open_llama_7bInconnu?—91,7———————
Phi-1.5Microsoftouverts1,3 Md91,5———————
Baichuan1-7BBaichuanouverts7,0 Md90,5———————
RedPajama-INCITE-7B-BaseInconnuouverts6,9 Md90,4———————
Dolly 2.0-12bDatabricksouverts12 Md89,7———————
DeepSeek Coder 6.7BDeepSeekouverts6,7 Md89,6———————
StarCoder 2 3BHugging Faceouverts3,0 Md88,8——————0,10
Qwen2.5-Coder-0.5BInconnu?—88,2———————
Cerebras-GPT-13BCerebras Systemsouverts13 Md83,2———————
DeepSeek Coder 1.3BDeepSeekouverts1,3 Md63,6———————
stablelm-tuned-alpha-7bInconnu?—55,8953——————

Taille : paramètres totaux publiés par Epoch AI (et paramètres actifs pour les modèles à experts, quand sa note les donne). Prix : $ par million de jetons, 3 entrée pour 1 sortie. Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; Epoch AI, « Data on AI models », epoch.ai/data/ai-models (CC BY 4.0) ; LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0 ; Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Classement par benchmark

Les dix premiers de chaque source, tous modèles confondus (en couleur : poids ouverts). Le trait sur la barre est l'intervalle de confiance publié.

Indice de capacités (ECI)

Points, plus haut = meilleur (échelle resserrée, sans zéro) · Epoch AI, CC BY 4.0 · non daté par la source, relevé le 07/10/2026 · 274 modèles

  1. 1Claude Opus 5.5167,3
  2. 2GPT-6 Astra166,5
  3. 3GPT-6.1 Sol166,1
  4. 4Claude Sonnet 5.5165,0
  5. 5Claude Fable 5.1164,7
  6. 6Claude Opus 5162,8
  7. 7GPT-6 Sol162,7
  8. 8GPT-5.5 Pro162,1
  9. 9Claude Fable 5162,1
  10. 10GPT-5.6 Sol161,7
  1. 1Kimi K3OUV.157,5
  2. 2DeepSeek V4 Pro 0813OUV.155,3
  3. 3DeepSeek V4.1 FlashOUV.154,9
  4. 4DeepSeek V4 Flash 0731OUV.154,5
  5. 5GLM-5.3-FlashOUV.151,9
  6. 6GLM-5.2OUV.151,8
  7. 7Kimi K2.6OUV.151,1
  8. 8Inkling-SmallOUV.150,2
  9. 9Kimi K2.7 CodeOUV.150,0
  10. 10GLM-5.1OUV.149,8
  1. 1Claude Opus 5.5167,3
  2. 2GPT-6 Astra166,5
  3. 3GPT-6.1 Sol166,1
  4. 4Claude Sonnet 5.5165,0
  5. 5Claude Fable 5.1164,7
  6. 6Claude Opus 5162,8
  7. 7GPT-6 Sol162,7
  8. 8GPT-5.5 Pro162,1
  9. 9Claude Fable 5162,1
  10. 10GPT-5.6 Sol161,7

Échelle d’Epoch AI qui combine des dizaines d’évaluations ; intervalle à 90 % par rééchantillonnage, tel que publié (bornes asymétriques).

LMArena texte, contrôle du style

Points, plus haut = meilleur (échelle resserrée, sans zéro) · LMArena, CC BY 4.0 · dernier chiffre publié le 02/10/2026 · 413 modèles

  1. 1gemini-4-argon-high1 525
  2. 2claude-opus-4-6-high1 505
  3. 3claude-fable-5-high1 504
  4. 4claude-opus-5.5-high1 504
  5. 5claude-opus-4-7-high1 501
  6. 6claude-fable-5.1-max1 501
  7. 7claude-opus-4-61 497
  8. 8gemini-3.8-flash-high1 495
  9. 9muse-spark-1.3-max1 494
  10. 10claude-opus-4-71 494
  1. 1kimi-k3-maxOUV.1 488
  2. 2mimo-v2.6-proOUV.1 480
  3. 3glm-5.2-maxOUV.1 476
  4. 4deepseek-v4.1-flash-maxOUV.1 474
  5. 5glm-5.3-flashOUV.1 473
  6. 6mimo-v2.5-proOUV.1 468
  7. 7glm-5.1OUV.1 465
  8. 8deepseek-v4-pro-high-20260813OUV.1 464
  9. 9kimi-k2.6OUV.1 461
  10. 10deepseek-v4-proOUV.1 458
  1. 1gemini-4-argon-high1 525
  2. 2claude-opus-4-6-high1 505
  3. 3claude-fable-5-high1 504
  4. 4claude-opus-5.5-high1 504
  5. 5claude-opus-4-7-high1 501
  6. 6claude-fable-5.1-max1 501
  7. 7claude-opus-4-61 497
  8. 8gemini-3.8-flash-high1 495
  9. 9muse-spark-1.3-max1 494
  10. 10claude-opus-4-71 494

Note issue de votes humains à l’aveugle, relative aux autres modèles du classement. Poids : statut d’Epoch AI quand le modèle y figure, sinon licence publiée par LMArena (autre que « Proprietary » = ouverts).

GPQA Diamond

Part réussie, plus haut = meilleur · Epoch AI, CC BY 4.0 · dernier chiffre publié le 29/09/2026 · 215 modèles

  1. 1GPT-6 Astra95,8 %
  2. 2Claude Sonnet 5.595,6 %
  3. 3GPT-6.1 Sol95,4 %
  4. 4Gemini 3.8 Flash95,4 %
  5. 5Gemini 3.7 Flash94,8 %
  6. 6GPT-5.4 Pro94,6 %
  7. 7Gemini 3.1 Pro94,4 %
  8. 8GPT-6 Sol94,3 %
  9. 9Gemini 3.6 Flash94,1 %
  10. 10Grok 4.694,0 %
  1. 1Kimi K3OUV.93,1 %
  2. 2GLM-5.2OUV.91,9 %
  3. 3DeepSeek V4 Pro 0813OUV.91,7 %
  4. 4DeepSeek V4 Flash 0731OUV.91,0 %
  5. 5MiniMax-M3OUV.90,9 %
  6. 6DeepSeek-V4-ProOUV.90,9 %
  7. 7Kimi K2.6OUV.90,8 %
  8. 8GLM-5.3-FlashOUV.90,2 %
  9. 9GLM-5.1OUV.89,9 %
  10. 10Inkling-SmallOUV.88,5 %
  1. 1GPT-6 Astra95,8 %
  2. 2Claude Sonnet 5.595,6 %
  3. 3GPT-6.1 Sol95,4 %
  4. 4Gemini 3.8 Flash95,4 %
  5. 5Gemini 3.7 Flash94,8 %
  6. 6GPT-5.4 Pro94,6 %
  7. 7Gemini 3.1 Pro94,4 %
  8. 8GPT-6 Sol94,3 %
  9. 9Gemini 3.6 Flash94,1 %
  10. 10Grok 4.694,0 %

Évaluation lancée par Epoch AI ; meilleur réglage publié de chaque modèle ; intervalle à 95 % (± 1,96 erreur type).

FrontierMath, niveaux 1 à 3

Part réussie, plus haut = meilleur · Epoch AI, CC BY 4.0 · dernier chiffre publié le 29/09/2026 · 81 modèles

  1. 1GPT-6.1 Sol93,7 %
  2. 2GPT-6 Astra93,7 %
  3. 3Claude Opus 5.591,2 %
  4. 4Claude Fable 5.190,2 %
  5. 5GPT-6 Sol89,8 %
  6. 6GPT-5.6 Sol89,1 %
  7. 7Claude Sonnet 5.588,8 %
  8. 8GPT-5.5 Pro87,7 %
  9. 9Claude Fable 587,0 %
  10. 10GPT-5.6 Terra86,0 %
  1. 1Kimi K3OUV.72,2 %
  2. 2DeepSeek V4 Pro 0813OUV.64,6 %
  3. 3GLM-5.2OUV.59,2 %
  4. 4DeepSeek V4 Flash 0731OUV.57,5 %
  5. 5Kimi K2.6OUV.57,2 %
  6. 6GLM-5.3-FlashOUV.55,8 %
  7. 7Kimi K2.7 CodeOUV.54,0 %
  8. 8Inkling-SmallOUV.46,3 %
  9. 9DeepSeek-V4-ProOUV.45,3 %
  10. 10GLM-5.1OUV.36,8 %
  1. 1GPT-6.1 Sol93,7 %
  2. 2GPT-6 Astra93,7 %
  3. 3Claude Opus 5.591,2 %
  4. 4Claude Fable 5.190,2 %
  5. 5GPT-6 Sol89,8 %
  6. 6GPT-5.6 Sol89,1 %
  7. 7Claude Sonnet 5.588,8 %
  8. 8GPT-5.5 Pro87,7 %
  9. 9Claude Fable 587,0 %
  10. 10GPT-5.6 Terra86,0 %

Évaluation lancée par Epoch AI ; meilleur réglage publié de chaque modèle ; intervalle à 95 % (± 1,96 erreur type).

SWE-bench Verified (Epoch)

Part réussie, plus haut = meilleur · Epoch AI, CC BY 4.0 · dernier chiffre publié le 25/06/2026 · 32 modèles

Classement peu mis à jour : sa dernière ligne date du 25/06/2026. Les modèles sortis depuis n’y figurent pas.

  1. 1Claude Opus 4.783,5 %
  2. 2GPT-5.580,6 %
  3. 3Gemini 3.5 Flash79,3 %
  4. 4Claude Opus 4.678,7 %
  5. 5GLM-5.2OUV.78,7 %
  6. 6DeepSeek-V4-ProOUV.77,6 %
  7. 7Qwen3.7-Max77,3 %
  8. 8GPT-5.476,9 %
  9. 9Qwen 3.6 Max (Preview)76,7 %
  10. 10Kimi K2.6OUV.76,7 %
  1. 1GLM-5.2OUV.78,7 %
  2. 2DeepSeek-V4-ProOUV.77,6 %
  3. 3Kimi K2.6OUV.76,7 %
  4. 4GLM-5.1OUV.74,2 %
  5. 5Kimi K2.5OUV.73,8 %
  6. 6GLM-5OUV.72,1 %
  1. 1Claude Opus 4.783,5 %
  2. 2GPT-5.580,6 %
  3. 3Gemini 3.5 Flash79,3 %
  4. 4Claude Opus 4.678,7 %
  5. 5Qwen3.7-Max77,3 %
  6. 6GPT-5.476,9 %
  7. 7Claude Opus 4.576,7 %
  8. 8Gemini 3.1 Pro75,6 %
  9. 9Gemini 3 Flash75,4 %
  10. 10Claude Sonnet 4.675,2 %

Évaluation lancée par Epoch AI ; meilleur réglage publié de chaque modèle ; intervalle à 95 % (± 1,96 erreur type).

OTIS Mock AIME 2024-2025

Part réussie, plus haut = meilleur · Epoch AI, CC BY 4.0 · dernier chiffre publié le 29/09/2026 · 194 modèles

  1. 1GPT-6.1 Sol100,0 %
  2. 2Claude Sonnet 5.5100,0 %
  3. 3GPT-6 Sol100,0 %
  4. 4Claude Opus 5.5100,0 %
  5. 5Qwen3.8 Max (0902)100,0 %
  6. 6Claude Fable 5.1100,0 %
  7. 7GPT-6 Astra100,0 %
  8. 8GPT-5.6 Sol100,0 %
  9. 9GPT-5.5100,0 %
  10. 10Claude Fable 5100,0 %
  1. 1DeepSeek V4 Pro 0813OUV.98,6 %
  2. 2Kimi K3OUV.97,2 %
  3. 3DeepSeek-V4-ProOUV.96,7 %
  4. 4Kimi K2.6OUV.96,1 %
  5. 5Kimi K2.7 CodeOUV.95,6 %
  6. 6DeepSeek V4 Flash 0731OUV.94,4 %
  7. 7GLM-5.3-FlashOUV.93,9 %
  8. 8GLM-5.1OUV.93,3 %
  9. 9Kimi K2.5OUV.92,2 %
  10. 10Qwen3.6 27BOUV.91,1 %
  1. 1GPT-6.1 Sol100,0 %
  2. 2Claude Sonnet 5.5100,0 %
  3. 3GPT-6 Sol100,0 %
  4. 4Claude Opus 5.5100,0 %
  5. 5Qwen3.8 Max (0902)100,0 %
  6. 6Claude Fable 5.1100,0 %
  7. 7GPT-6 Astra100,0 %
  8. 8GPT-5.6 Sol100,0 %
  9. 9GPT-5.5100,0 %
  10. 10Claude Fable 5100,0 %

Évaluation lancée par Epoch AI ; meilleur réglage publié de chaque modèle ; intervalle à 95 % (± 1,96 erreur type).

SimpleQA Verified

Part réussie, plus haut = meilleur · Epoch AI, CC BY 4.0 · dernier chiffre publié le 29/09/2026 · 77 modèles

  1. 1GPT-6 Astra75,6 %
  2. 2GPT-6.1 Sol73,9 %
  3. 3Gemini 3.1 Pro73,5 %
  4. 4Claude Opus 5.572,2 %
  5. 5Claude Fable 5.170,8 %
  6. 6Claude Fable 570,7 %
  7. 7Gemini 3.8 Flash69,7 %
  8. 8GPT-5.6 Sol69,7 %
  9. 9Gemini 3.7 Flash69,2 %
  10. 10Gemini 3 Flash66,8 %
  1. 1DeepSeek V4 Pro 0813OUV.52,9 %
  2. 2Kimi K3OUV.50,6 %
  3. 3DeepSeek-V4-ProOUV.47,0 %
  4. 4Qwen3-235B-A22B-Thinking (Jul 2025)OUV.40,4 %
  5. 5InklingOUV.40,3 %
  6. 6Kimi K2.7 CodeOUV.36,5 %
  7. 7Kimi K2.6OUV.34,9 %
  8. 8Kimi K2.5OUV.34,3 %
  9. 9GLM-5.2OUV.34,2 %
  10. 10GLM-5.1OUV.34,0 %
  1. 1GPT-6 Astra75,6 %
  2. 2GPT-6.1 Sol73,9 %
  3. 3Gemini 3.1 Pro73,5 %
  4. 4Claude Opus 5.572,2 %
  5. 5Claude Fable 5.170,8 %
  6. 6Claude Fable 570,7 %
  7. 7Gemini 3.8 Flash69,7 %
  8. 8GPT-5.6 Sol69,7 %
  9. 9Gemini 3.7 Flash69,2 %
  10. 10Gemini 3 Flash66,8 %

Évaluation lancée par Epoch AI ; meilleur réglage publié de chaque modèle ; intervalle à 95 % (± 1,96 erreur type).

SWE-bench Verified, mini-SWE-agent

Part réussie, plus haut = meilleur · SWE-bench, CC BY-NC 4.0 · dernier chiffre publié le 26/02/2026 · 47 modèles

Classement peu mis à jour : sa dernière ligne date du 26/02/2026. Les modèles sortis depuis n’y figurent pas.

  1. 1Claude 4.5 Opus (high)76,8 %
  2. 2Gemini 3 Flash (high)75,8 %
  3. 3MiniMax M2.5 (high)OUV.75,8 %
  4. 4Claude 4.6 Opus75,6 %
  5. 5Claude 4.5 Opus (20251101) (medium)74,4 %
  6. 6Gemini 3 Pro Preview (2025-11-18)74,2 %
  7. 7GLM 5 (high)OUV.72,8 %
  8. 8GPT 5.2 (high)72,8 %
  9. 9GPT 5.2 Codex72,8 %
  10. 10GPT 5.2 (2025-12-11) (high)71,8 %
  1. 1MiniMax M2.5 (high)OUV.75,8 %
  2. 2GLM 5 (high)OUV.72,8 %
  3. 3Kimi K2.5 (high)OUV.70,8 %
  4. 4DeepSeek V3.2 (high)OUV.70,0 %
  5. 5Kimi K2 ThinkingOUV.63,4 %
  6. 6MiniMax M2OUV.61,0 %
  7. 7DeepSeek V3.2 ReasonerOUV.60,0 %
  8. 8Devstral Small (2512)OUV.56,4 %
  9. 9Qwen3-Coder 480B/A35B InstructOUV.55,4 %
  10. 10GLM 4.6 (T=1)OUV.55,4 %
  1. 1Claude 4.5 Opus (high)76,8 %
  2. 2Gemini 3 Flash (high)75,8 %
  3. 3Claude 4.6 Opus75,6 %
  4. 4Claude 4.5 Opus (20251101) (medium)74,4 %
  5. 5Gemini 3 Pro Preview (2025-11-18)74,2 %
  6. 6GPT 5.2 (high)72,8 %
  7. 7GPT 5.2 Codex72,8 %
  8. 8GPT 5.2 (2025-12-11) (high)71,8 %
  9. 9Claude 4.5 Sonnet (high)71,4 %
  10. 10Claude 4.5 Sonnet (20250929)70,6 %

Classement officiel, lignes « bash seul » (mini-SWE-agent) : même outil pour tous, donc une comparaison de modèles.

Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0 ; SWE-bench, swebench.com, CC BY-NC 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Évolution

Ce qui change dans le temps, tel que les sources le publient. Une baisse de note ou de rang n'est pas une baisse de qualité : les classements sont relatifs et les réglages changent.

Records successifs de l'indice ECI, poids fermés et poids ouverts, depuis 2023Dernier record, poids fermés : Claude Opus 5.5, 167,3, 22/09/2026. Poids ouverts : Kimi K3, 157,5, 16/07/2026. Écart : 9,9 points.1101201301401501601702023202420252026Meilleur ECI sorti à cette date · ↑ meilleurGPT-4 (Mar 2023) : ECI 125,9, sorti le 14/03/2023GPT-4 Turbo (Nov 2023) : ECI 126,5, sorti le 25/01/2024Claude 3 Opus : ECI 126,9, sorti le 29/02/2024GPT-4 Turbo (Apr 2024) : ECI 127,3, sorti le 09/04/2024GPT-4o (May 2024) : ECI 129,0, sorti le 13/05/2024Claude 3.5 Sonnet : ECI 130,0, sorti le 20/06/2024o1-mini : ECI 135,8, sorti le 12/09/2024o1 : ECI 141,9, sorti le 17/12/2024Gemini 2.5 Pro (Mar 2025) : ECI 144,2, sorti le 31/03/2025o3 : ECI 146,9, sorti le 16/04/2025o3-pro : ECI 147,4, sorti le 10/06/2025GPT-5 : ECI 150,0, sorti le 07/08/2025GPT-5 Pro : ECI 150,3, sorti le 07/10/2025Gemini 3 Pro : ECI 152,9, sorti le 18/11/2025GPT-5.2 Pro : ECI 155,4, sorti le 11/12/2025GPT-5.3 Codex : ECI 156,8, sorti le 05/02/2026GPT-5.4 Pro : ECI 158,9, sorti le 05/03/2026GPT-5.5 Pro : ECI 162,1, sorti le 23/04/2026Claude Opus 5 : ECI 162,8, sorti le 24/07/2026Claude Fable 5.1 : ECI 164,7, sorti le 01/09/2026GPT-6 Astra : ECI 166,5, sorti le 03/09/2026Claude Opus 5.5 : ECI 167,3, sorti le 22/09/2026LLaMA-65B : ECI 110,2, sorti le 24/02/2023Llama 2-70B : ECI 113,8, sorti le 18/07/2023Stable Beluga 2 : ECI 117,1, sorti le 20/07/2023Yi-34B : ECI 117,4, sorti le 02/11/2023Mixtral 8x7B : ECI 118,5, sorti le 11/12/2023Mixtral 8x22B : ECI 122,0, sorti le 17/04/2024Llama 3-70B : ECI 122,9, sorti le 18/04/2024DeepSeek-V2 (MoE-236B, May 2024) : ECI 124,8, sorti le 07/05/2024Qwen2-72B : ECI 125,3, sorti le 07/06/2024Llama 3.1-405B : ECI 128,8, sorti le 23/07/2024Qwen2.5-72B : ECI 129,0, sorti le 19/09/2024Phi-4 : ECI 130,4, sorti le 12/12/2024DeepSeek-V3 : ECI 132,3, sorti le 26/12/2024DeepSeek-R1 : ECI 139,0, sorti le 20/01/2025Qwen3-235B-A22B : ECI 139,4, sorti le 28/04/2025DeepSeek-R1 (May 2025) : ECI 141,3, sorti le 28/05/2025Qwen3-235B-A22B-Thinking (Jul 2025) : ECI 143,9, sorti le 25/07/2025DeepSeek-V3.2-Exp : ECI 145,0, sorti le 29/09/2025Kimi K2 Thinking : ECI 146,0, sorti le 06/11/2025DeepSeek-V3.2 : ECI 146,3, sorti le 01/12/2025Kimi K2.5 : ECI 148,0, sorti le 27/01/2026GLM-5.1 : ECI 149,8, sorti le 07/04/2026Kimi K2.6 : ECI 151,1, sorti le 20/04/2026GLM-5.2 : ECI 151,8, sorti le 16/06/2026Kimi K3 : ECI 157,5, sorti le 16/07/2026

poids ferméspoids ouverts

Chaque marche est un modèle qui bat, à sa sortie, tous ceux sortis avant lui dans sa catégorie. Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0). Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Note LMArena

À chaque classement publié, 180 derniers jours

Même amplitude verticale pour chaque modèle (10 points, centrée sur sa note), même période : du 30/09/2026 au 02/10/2026. Une note d'arène est relative : elle bouge aussi quand d'autres modèles entrent au classement.

Prix catalogue

  • 07/10/2026 · Kimi K3 chez Together AI, prix d'entrée : 3,00 $ → 2,70 $
  • 07/10/2026 · Kimi K3 chez Together AI, prix de sortie : 15,00 $ → 13,50 $
  • 07/10/2026 · Grok 4.6 chez Microsoft Azure AI Foundry, prix d'entrée : 1,25 $ → 2,00 $
  • 02/10/2026 · GPT-5.6 Sol chez Perplexity, prix d'entrée : 5,00 $ → 4,00 $
  • 02/10/2026 · GPT-5.6 Sol chez Perplexity, prix de sortie : 30,00 $ → 20,00 $

Méthode et sources

Ne sont repris que des chiffres dont la licence permet la republication avec attribution, lue sur pièce. Relevé quotidien, sans modèle de langage : téléchargement, lecture, enregistrement daté de chaque valeur.

Epoch AI, Benchmarking Hub

Indice de capacités ECI (une échelle commune calculée à partir de dizaines d'évaluations) et les évaluations qu'Epoch fait tourner lui-même : GPQA Diamond, FrontierMath (niveaux 1 à 3), SWE-bench Verified, OTIS Mock AIME, SimpleQA Verified.

Éditeur
Epoch AI (institut de recherche à but non lucratif)
Licence
CC BY 4.0, lue le 01/10/2026 : epoch.ai/benchmarks/use-this-data, « Licensing », et README.md de l'archive : données libres d'usage et de diffusion si la source et les auteurs sont cités. Les fichiers « external » gardent la licence de leur projet d'origine : ils ne sont pas repris ici.
Mention
Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0)
Données
https://epoch.ai/data/benchmark_data.zip
Page
epoch.ai/benchmarks
Relevé
07/10/2026 (1125 chiffres lus, 0 nouveaux)

Epoch AI, Data on AI models

Fiche technique de chaque modèle telle qu'Epoch la tient : nombre de paramètres (et sa note, qui donne souvent les paramètres actifs), accès aux poids (libres, usage restreint, non commercial, API seulement), lien de publication.

Éditeur
Epoch AI (institut de recherche à but non lucratif)
Licence
CC BY 4.0, lue le 01/10/2026 : README.md de l'archive ai_models.zip, « Licensing » : « free to use, distribute, and reproduce provided the source and authors are credited ».
Mention
Epoch AI, « Data on AI models », epoch.ai/data/ai-models (CC BY 4.0)
Données
https://epoch.ai/data/ai_models.zip (all_ai_models.csv)
Page
epoch.ai/data/ai-models
Relevé
07/10/2026 (1519 chiffres lus, 0 nouveaux)

LMArena, classement texte

Note Bradley-Terry issue de votes humains à l’aveugle entre deux réponses, avec contrôle du style (longueur, mise en forme), intervalle de confiance publié (niveau non précisé dans le jeu de données) et nombre de votes.

Éditeur
LMArena (Arena Intelligence Inc.)
Licence
CC BY 4.0, lue le 01/10/2026 : carte du jeu de données lmarena-ai/leaderboard-dataset sur Hugging Face, champ « license: cc-by-4.0 ».
Mention
LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0
Données
https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset (text_style_control, latest)
Page
lmarena.ai/leaderboard/text
Relevé
07/10/2026 (413 chiffres lus, 0 nouveaux)

SWE-bench, classement officiel

Part des 500 tickets GitHub réels de SWE-bench Verified résolus. Seules les lignes « mini-SWE-agent » (bash seul, même outil pour tous) sont reprises : elles comparent des modèles, pas des agents.

Éditeur
Équipe SWE-bench (Princeton, Stanford)
Licence
CC BY-NC 4.0, lue le 01/10/2026 : fichier LICENSE du dépôt SWE-bench/swe-bench.github.io (« Attribution-NonCommercial 4.0 International »). Le Crible est un site personnel non commercial, sans publicité ni abonnement : usage permis.
Mention
SWE-bench, swebench.com, CC BY-NC 4.0
Données
https://raw.githubusercontent.com/SWE-bench/swe-bench.github.io/master/data/leaderboards.json
Page
www.swebench.com/
Relevé
07/10/2026 (47 chiffres lus, 0 nouveaux)

LiteLLM, table des prix

Prix catalogue publics par jeton, compilés à partir des grilles des fournisseurs d'API : l'éditeur du modèle (Anthropic, OpenAI, Mistral…) et les hébergeurs qui le servent (Amazon Bedrock, Azure, Together, Fireworks, DeepInfra…). Les routeurs et passerelles qui revendent l'offre d'un autre ne sont pas repris.

Éditeur
BerriAI (LiteLLM)
Licence
MIT, lue le 01/10/2026 : fichier LICENSE du dépôt BerriAI/litellm : MIT pour tout ce qui est hors du dossier enterprise/ ; la table des prix est à la racine.
Mention
Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI
Données
https://raw.githubusercontent.com/BerriAI/litellm/main/model_prices_and_context_window.json
Page
github.com/BerriAI/litellm/blob/main/model_prices_and_context_window.json
Relevé
07/10/2026 (5194 chiffres lus, 27 nouveaux)

Calculs

  • Prix mélangé : (3 × prix d'entrée + prix de sortie) / 4, en dollars par million de jetons, tarif public sans remise ni cache. Prix de référence d’un modèle : celui de son éditeur s’il le vend, sinon celui de l’hébergeur le moins cher (nommé dans l’infobulle).
  • Évaluations d'Epoch : quand un modèle a été évalué avec plusieurs réglages (effort de raisonnement), le meilleur publié est retenu, comme sur les graphiques d'Epoch ; l'intervalle affiché est ± 1,96 erreur type.
  • Frontière de Pareto : un modèle y est s'il n'existe aucun modèle moins cher (ou au même prix) avec un ECI plus haut.
  • Poids ouverts ou fermés : un seul statut par modèle, celui d’Epoch AI (« Model accessibility » de l’indice, sinon de « Data on AI models »), partout sur la page. Quand LMArena publie une licence qui le contredit, la fiche du modèle montre les deux. Dans le classement LMArena, un modèle absent d’Epoch garde la licence publiée par LMArena.
  • Dates : « publié le » est la date donnée par la source (classement, lancement de l’évaluation, soumission). L’ECI n’est pas daté par Epoch : il est dit « non daté », avec le jour où notre relevé l’a vu publié.
  • Mémoire pour héberger un modèle (fiches) : paramètres × 2 octets en BF16, × 1 en FP8, × 0,6 environ en 4 bits (GGUF Q4_K_M, environ 4,8 bits par paramètre) ; poids seuls, sans le cache de contexte.
  • Poids et licence (fiches des modèles ouverts) : dépôt Hugging Face de l’éditeur, rapproché par la table de correspondance et vérifié auprès de l’API de Hugging Face quand la table est régénérée, jamais par le relevé quotidien. La licence est celle que l’éditeur déclare sur la carte du dépôt (identifiant et lien vers le texte, rien d’autre n’est repris) ; sans dépôt, celle publiée par LMArena ; quand les deux diffèrent, la fiche montre les deux. Un modèle sans dépôt officiel (poids envoyés sur demande, dépôt retiré) le dit, avec la raison et sa pièce.
  • Historique : chaque valeur publiée est gardée avec sa date chez la source et la date de notre relevé ; rien n'est réécrit.

Correspondance des noms

Le nom d’Epoch AI fait référence. Dans cet ordre, sans aucun rapprochement approché : (1) égalité des noms normalisés (minuscules ; « . », « _ », espaces en « - » ; préfixe d'hébergeur retiré), y compris avec une courte liste d'alias écrits à la main, chacun avec sa pièce (bench-aliases.json) ; (2) date complète ramenée au mois des deux côtés (« -2024-05-13 » et « (May 2024) ») ; (3) pour un modèle dont Epoch AI ne dit pas les poids fermés, suffixes de variante retirés en fin de nom (« -instruct », « -it », « -chat », « -hf », « -bf16 », « -fp8 »…), seulement si le nom de base ne désigne qu'un modèle ; une date (« -2507 ») n'est jamais un suffixe de variante ; (4) date de version finale retirée, seulement si le nom sans date désigne un seul modèle. LMArena : réglage de raisonnement le plus poussé publié, en précision d'origine plutôt qu'en FP8. Une clé par fournisseur (la plus courte). Dépôt Hugging Face, dans cet ordre : dépôt officiel écrit à la main avec sa pièce (bench-aliases.json), lien d'Epoch AI vers la racine d'un dépôt au nom du modèle, identifiant d'hébergeur de la forme organisation/nom ; à poids réglés pour suivre des instructions quand ils existent ; existence vérifiée par l'API Hugging Face, qui rend aussi la graphie canonique et la licence déclarée sur la carte du dépôt. La table proposée par cette règle est relue à la main puis versionnée ; le relevé quotidien n’utilise que la table, jamais un modèle de langage. Elle est publiée telle quelle : correspondance.json (166 noms LMArena, 908 offres de prix, 120 dépôts Hugging Face, 01/10/2026).

Sources écartées

  • Artificial Analysis : Conditions d'utilisation (§2.1, 2.2, 3.3) et Data Platform Terms (§2.3) : usage personnel, pas de site similaire, pas de reproduction des données sous forme de tableau. Sert seulement de modèle de mise en page. (lu le 29/09/2026)
  • OpenRouter (prix) : Conditions d'utilisation, §7 « Prohibited Conduct » : interdit de copier par un moyen automatisé les informations du site ou du service. Les prix viennent donc de LiteLLM (MIT). (lu le 01/10/2026)
  • ARC Prize (ARC-AGI) : Conditions, §2 « Intellectual property rights » : contenus pour usage personnel ; aucune partie ne peut être reproduite, agrégée ni republiée sans accord écrit. (lu le 01/10/2026)
  • Humanity's Last Exam : Aucune licence publiée pour le classement (le code du dépôt centerforaisafety/hle est sous MIT, pas les scores du site). Non repris tant que les auteurs ne précisent pas. (lu le 01/10/2026)
  • LiveBench : Les tableaux du classement sont dans un dépôt sans licence (le code d'évaluation, lui, est sous Apache 2.0). Non repris. (lu le 01/10/2026)
  • Terminal-Bench : Code sous Apache 2.0 (harbor-framework/terminal-bench-1), mais aucune licence trouvée pour les scores du classement du site. Non repris. (lu le 01/10/2026)
  • Aider polyglot : Apache 2.0, donc permis, mais figé : dernière entrée le 03/10/2025, aucun modèle de la sélection. Non affiché. (lu le 01/10/2026)
  • Open LLM Leaderboard (Hugging Face) : Arrêté : données inchangées depuis le 20/03/2025. Non affiché. (lu le 29/09/2026)
  • MLE-bench : MIT, mais le classement compare des agents (outillage compris), pas des modèles, et compte peu de lignes. Non affiché pour l’instant. (lu le 01/10/2026)