Le Crible

Fiche modèle

GLM-5.1

Z.ai (Zhipu AI) · poids ouverts · sorti le 07/04/2026

Date de sortie, éditeur et accès : Epoch AI, CC BY 4.0. Fiche régénérée le 07/10/2026.

ECI

149,8

56e sur 274

LMArena

1 465

34e sur 166 modèles de l’indice

Prix

2,15 $

par million de jetons, Z.ai

Taille

754 Md

paramètres

Scores

Rang parmi les 274 modèles de l’indice ECI évalués par la même source. Un nom de benchmark mène à son explication.

BenchmarkScoreRangRéglageSource
Indice de capacités ECI (Epoch AI)Capacités générales149,8147,9–151,556 / 274Epoch AI, CC BY 4.0, non daté par la source, vu publié le 07/10/2026
LMArena texte, contrôle du styleConversation (préférence humaine)1 4651 461–1 46834 / 166« glm-5.1 »LMArena, CC BY 4.0, publié le 02/10/2026
GPQA Diamond (Epoch AI)Sciences89,9 %85,7–94,141 / 186réglage « glm-5.1 »Epoch AI, CC BY 4.0, publié le 10/08/2026
FrontierMath, niveaux 1 à 3 (Epoch AI)Maths36,8 %31,2–42,554 / 81réglage « glm-5.1 »Epoch AI, CC BY 4.0, publié le 29/08/2026
OTIS Mock AIME 2024-2025 (Epoch AI)Maths de concours93,3 %86,0–100,741 / 176réglage « glm-5.1 »Epoch AI, CC BY 4.0, publié le 10/08/2026
SimpleQA Verified (Epoch AI)Connaissances factuelles34,0 %31,1–36,953 / 77réglage « glm-5.1 »Epoch AI, CC BY 4.0, publié le 27/08/2026
SWE-bench Verified (Epoch AI)Code74,2 %70,3–78,116 / 32réglage « glm-5.1 »Epoch AI, CC BY 4.0, publié le 15/05/2026

Sources : Epoch AI, « Capabilities & benchmarking », epoch.ai/benchmarks (CC BY 4.0) ; LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Prix par fournisseur d’API

Prix par fournisseur d’API
FournisseurEntrée $/MSortie $/MMélangéClé LiteLLM
Z.aiéditeur1,40 $4,40 $2,15 $zai/glm-5.1
DeepInfra1,05 $3,50 $1,66 $deepinfra/zai-org/GLM-5.1
Novita AI1,38 $4,40 $2,14 $novita/zai-org/glm-5.1
Alibaba Cloud (DashScope)1,40 $4,40 $2,15 $dashscope/glm-5.1
Alibaba Cloud (Qwen AI Platform)1,40 $4,40 $2,15 $qwen_ai_platform/glm-5.1
Alibaba Cloud (Qwen Cloud)1,40 $4,40 $2,15 $qwencloud/glm-5.1
FriendliAI1,40 $4,40 $2,15 $friendliai/zai-org/GLM-5.1
Nebius1,40 $4,40 $2,15 $nebius/zai-org/GLM-5.1
Together AI1,40 $4,40 $2,15 $together_ai/zai-org/GLM-5.1
Microsoft Azure AI Foundry1,54 $4,84 $2,37 $azure_ai/FW-GLM-5.1

$ par million de jetons, tarif catalogue sans remise, sans cache ni traitement par lots. 10 offres rapprochées. Écart entre le moins cher (DeepInfra, 1,66 $) et le plus cher : × 1,4. Relevé du 07/10/2026 ; vérifier chez le fournisseur avant de choisir. Sources : Prix : LiteLLM (BerriAI), licence MIT, © 2023 Berri AI. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

L’héberger soi-même

Accès aux poids
poids libres (usage sans restriction) (Epoch AI, CC BY 4.0)
Licence
MIT (carte du dépôt, déclaration de l’éditeur lue le 01/10/2026 ; lire la licence avant tout usage commercial)
Taille
754 Md de paramètres (Epoch AI, CC BY 4.0 ; note : « Based on HF page: https://huggingface.co/zai-org/GLM-5.1 »)
Poids
huggingface.co/zai-org/GLM-5.1 (dépôt rapproché par la table de correspondance, existence vérifiée auprès de Hugging Face le 01/10/2026)

Mémoire nécessaire

Format des poidsPoids seulsOrdre de grandeur du matériel
BF16 (pleine précision usuelle)1 508 Goplusieurs serveurs à huit cartes
FP8 / 8 bits754 Goun serveur à huit cartes de 141 à 192 Go
4 bits (GGUF Q4_K_M, environ 4,8 bits par paramètre)452 Goun serveur à huit cartes de 80 Go (640 Go)

Calcul du Crible : 754 Md de paramètres × 2 octets (BF16), × 1 (FP8), × 0,6 environ (4 bits). Ajouter le cache de contexte, qui grandit avec la longueur des conversations et le nombre d’utilisateurs.

Outils

Commandes d’après la documentation de chaque outil (liens ci-dessus). Les tailles, l’accès et les liens viennent des sources citées ; de Hugging Face, Le Crible ne reprend que l’adresse du dépôt et l’identifiant de licence déclaré sur sa carte. Sources : Epoch AI, « Data on AI models », epoch.ai/data/ai-models (CC BY 4.0) ; LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Évolution

1 4551 4601 4651 4701 47530/09/202602/10/2026
Note LMArena (« glm-5.1 ») à chaque classement publié depuis 180 jours, bande : intervalle publié. Une note d’arène est relative : elle bouge aussi quand d’autres modèles entrent au classement, sans que ce modèle ait changé. Sources : LMArena, leaderboard-dataset (Hugging Face), CC BY 4.0. Données adaptées : pourcentages, arrondis, meilleur réglage retenu, prix mélangé, rangs et frontière calculés ici.

Aucun changement de prix relevé depuis le début de nos relevés quotidiens.

Lien permanent de cette fiche · Méthode et sources