Le Crible

Fiche modèle

gpt-oss-120b

OpenAI · poids ouverts · sorti le 05/08/2025

Date de sortie, éditeur et accès : Epoch AI, CC BY 4.0. Fiche régénérée le 07/10/2026.

ECI

139,9

118e sur 274

LMArena

1 352

101e sur 166 modèles de l’indice

Prix

0,065 $

par million de jetons, Weights & Biases

Taille

117 Md

paramètres

Scores

Rang parmi les 274 modèles de l’indice ECI évalués par la même source. Un nom de benchmark mène à son explication.

BenchmarkScoreRangRéglageSource
Indice de capacités ECI (Epoch AI)Capacités générales139,9135,2–142,8118 / 274Epoch AI, CC BY 4.0, non daté par la source, vu publié le 07/10/2026
LMArena texte, contrôle du styleConversation (préférence humaine)1 3521 347–1 356101 / 166« gpt-oss-120b »LMArena, CC BY 4.0, publié le 02/10/2026
GPQA Diamond (Epoch AI)Sciences75,8 %70,4–81,192 / 186réglage « openai/gpt-oss-120b_high »Epoch AI, CC BY 4.0, publié le 11/12/2025
FrontierMath, niveaux 1 à 3 (Epoch AI)non évalué par Epoch AI
OTIS Mock AIME 2024-2025 (Epoch AI)Maths de concours88,9 %80,1–97,654 / 176réglage « openai/gpt-oss-120b_high »Epoch AI, CC BY 4.0, publié le 11/12/2025
SimpleQA Verified (Epoch AI)non évalué par Epoch AI
SWE-bench Verified (Epoch AI)non évalué par Epoch AI

Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Prix par fournisseur d’API

Prix par fournisseur d’API
FournisseurEntrée $/MSortie $/MMélangéClé LiteLLM
Weights & Biases0,030 $0,17 $0,065 $wandb/openai/gpt-oss-120b
DeepInfra0,037 $0,17 $0,070 $deepinfra/openai/gpt-oss-120b
Novita AI0,050 $0,25 $0,10 $novita/openai/gpt-oss-120b
Sail0,060 $0,40 $0,15 $sail/openai/gpt-oss-120b
vertex_ai-openai_models0,090 $0,36 $0,16 $vertex_ai/openai/gpt-oss-120b-maas
OVHcloud0,080 $0,40 $0,16 $ovhcloud/gpt-oss-120b
Baseten0,10 $0,50 $0,20 $baseten/openai/gpt-oss-120b
Amazon Bedrock0,15 $0,60 $0,26 $bedrock_mantle/openai.gpt-oss-120b
Databricks0,15 $0,60 $0,26 $databricks/databricks-gpt-oss-120b
Fireworks AI0,15 $0,60 $0,26 $fireworks_ai/gpt-oss-120b
Groq0,15 $0,60 $0,26 $groq/openai/gpt-oss-120b
Microsoft Azure AI Foundry0,15 $0,60 $0,26 $azure_ai/gpt-oss-120b
Nebius0,15 $0,60 $0,26 $nebius/openai/gpt-oss-120b
Scaleway0,15 $0,60 $0,26 $scaleway/openai/gpt-oss-120b
TensorMesh0,15 $0,60 $0,26 $tensormesh/openai/gpt-oss-120b
Together AI0,15 $0,60 $0,26 $together_ai/openai/gpt-oss-120b
IBM watsonx0,16 $0,64 $0,28 $watsonx/openai/gpt-oss-120b
SambaNova0,22 $0,59 $0,31 $sambanova/gpt-oss-120b
Replicate0,18 $0,72 $0,32 $replicate/openai/gpt-oss-120b
Cerebras0,35 $0,75 $0,45 $cerebras/gpt-oss-120b
Cloudflare Workers AI0,35 $0,75 $0,45 $cloudflare/@cf/openai/gpt-oss-120b
Crusoe0,80 $0,80 $0,80 $crusoe/openai/gpt-oss-120b

$ par million de jetons, tarif catalogue sans remise, sans cache ni traitement par lots. 22 offres rapprochées. Écart entre le moins cher (Weights & Biases, 0,065 $) et le plus cher : × 12,3. Relevé du 07/10/2026 ; vérifier chez le fournisseur avant de choisir. Sources : Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

L’héberger soi-même

Accès aux poids
poids libres (usage sans restriction) (Epoch AI, CC BY 4.0)
Licence
Apache 2.0 (carte du dépôt, déclaration de l’éditeur lue le 01/10/2026 ; lire la licence avant tout usage commercial)
Taille
117 Md de paramètres (Epoch AI, CC BY 4.0 ; note : « Total parameters: 116.83B »)
Poids
huggingface.co/openai/gpt-oss-120b (dépôt rapproché par la table de correspondance, existence vérifiée auprès de Hugging Face le 01/10/2026)

Mémoire nécessaire

Format des poidsPoids seulsOrdre de grandeur du matériel
BF16 (pleine précision usuelle)234 Goun serveur à huit cartes de 80 Go (640 Go)
FP8 / 8 bits117 Godeux à quatre cartes de 80 Go, ou un Mac de 192 Go
4 bits (GGUF Q4_K_M, environ 4,8 bits par paramètre)70 Goune carte de centre de données de 80 Go, ou un Mac de 96 Go

Calcul du Crible : 117 Md de paramètres × 2 octets (BF16), × 1 (FP8), × 0,6 environ (4 bits). Ajouter le cache de contexte, qui grandit avec la longueur des conversations et le nombre d’utilisateurs.

Outils

Commandes d’après la documentation de chaque outil (liens ci-dessus). Les tailles, l’accès et les liens viennent des sources citées ; de Hugging Face, Le Crible ne reprend que l’adresse du dépôt et l’identifiant de licence déclaré sur sa carte. Sources : Epoch AI, « Data on AI models », epoch.ai/data/ai-models (CC BY 4.0) ; LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Évolution

1 3451 3501 3551 36030/09/202602/10/2026
Note LMArena (« gpt-oss-120b ») à chaque classement publié depuis 180 jours, bande : intervalle publié. Une note d’arène est relative : elle bouge aussi quand d’autres modèles entrent au classement, sans que ce modèle ait changé. Sources : LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Aucun changement de prix relevé depuis le début de nos relevés quotidiens.

Lien permanent de cette fiche · Méthode et sources