Revue publiée le Scores mis à jour le
Comparer

Z.ai : GLM 5.1

Nouvelle version : GLM 5.2

GLM 5.1 est un modèle publié par Z.ai le 7 avril 2026, qui lit et produit du texte. Selon l’éditeur, il sert à l’ingénierie agentique, au développement front-end, à la conversation générale et à l’écriture créative.

Ce que GLM 5.1 change par rapport à GLM 5

GLM 5.1 est présenté à sa sortie par Z.ai comme son modèle phare pour l’ingénierie agentique, avec des capacités de code nettement plus fortes que celles de GLM 5. Selon l’éditeur, il est conçu pour rester efficace sur des tâches agentiques bien plus longues, en soutenant l’optimisation sur des centaines de tours et des milliers d’appels d’outils. Les modèles précédents, dont son prédécesseur, épuisent vite leur répertoire et plafonnent tôt, selon Z.ai.

Selon la documentation de Z.ai, GLM 5 et GLM 5.1 lisent et produisent du texte. Pour GLM 5, les limites sont de 200K tokens en entrée et de 128K tokens par réponse ; pour GLM 5.1, elles restent de 200K tokens en entrée et de 128K tokens par réponse. Le tableau d’écart compare les deux versions sur la longueur d’entrée acceptée, les formats d’entrée, la réflexion et les prix relevés sur OpenRouter.

Par rapport à la version précédente

GLM 5GLM 5.1
Score14461486+40
Contexte maximal (selon OpenRouter)205 k205 k
Formats compris (selon OpenRouter)textetexte
Réflexion (selon OpenRouter)Activée par défautActivée par défaut
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,60 $ / M tokens1,40 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)1,92 $ / M tokens4,40 $ / M tokens

À quoi sert GLM 5.1

Chat

GLM 5.1 couvre la conversation générale, l’écriture créative et la productivité de bureau, selon la documentation de Z.ai. Il prend en charge l’appel de fonctions et les outils MCP, un protocole de connexion à des outils externes. Les sorties structurées incluent le format JSON. À sa sortie, le modèle était annoncé par Z.ai dans son chat « dans les prochains jours ».

Code

GLM 5.1 décompose les problèmes complexes, lance des expériences et lit leurs résultats, selon Z.ai. Au fil des itérations, il repère les blocages et révise sa stratégie. Dans l’exemple publié par l’éditeur, le modèle a optimisé une base de données vectorielle, évaluée par VectorDBBench, sur plus de 600 itérations et plus de 6 000 appels d’outils. Sans plafonner après 50 ou 100 soumissions, il a atteint 21,5k requêtes par seconde dans cette expérience.

Front-end

GLM 5.1 compte les artefacts et le développement front-end parmi ses usages, selon la documentation de Z.ai. Dans une démonstration de l’éditeur, il a construit en 8 heures un environnement de bureau de type Linux sous forme d’application web. Sa boucle de travail comprenait une relecture après chaque tour. L’application réunissait un explorateur de fichiers, un terminal, un éditeur de texte, un moniteur système, une calculatrice et des jeux.

Les performances de GLM 5.1

À sa sortie, Z.ai publie les scores de GLM 5.1 et de GLM 5 réunis dans le tableau. Sur SWE-Bench Pro, l’éditeur présente le résultat du nouveau modèle comme l’état de l’art à ce moment-là.

ÉvaluationDomaineScore annoncé pour GLM 5.1Score annoncé pour GLM 5
SWE-Bench ProCode58,455,1
NL2RepoGénération de dépôt42,735,9
Terminal-Bench 2.0 avec Terminus-2Tâches en terminal63,556,2
CyberGymCybersécurité68,748,3
BrowseCompNavigation68,062,0
MCP-AtlasAgents71,869,2

GLM 5.1 reste sous GLM 5 sur AIME 2026, avec 95,3 contre 95,4, et sur HMMT Nov. 2025, avec 94,0 contre 96,9, selon les scores publiés par Z.ai à sa sortie. Selon l’éditeur, sur KernelBench niveau 3, qui évalue l’accélération de noyaux GPU, GLM 5 progresse vite puis plafonne tôt. Dans cette évaluation, le nouveau modèle atteint une accélération de 3,6×. Claude Opus 4.6 reste devant, à 4,2×, selon Z.ai.

Bien utiliser GLM 5.1 : la réflexion

  1. Activation et désactivation : GLM 5.1 active la réflexion par défaut en mode dynamique, selon la documentation de Z.ai : le modèle décide lui-même s’il réfléchit. OpenRouter indique également une activation par défaut. Pour des réponses directes, la réflexion se désactive avec le réglage thinking.type disabled, selon Z.ai.
  2. Absence de niveau d’effort : GLM 5.1 ne prend pas en charge le paramètre reasoning_effort, qui règle l’effort de réflexion. Selon la documentation de Z.ai, ce paramètre n’est pris en charge qu’à partir de GLM 5.2.
  3. Choix selon la tâche : Pour l’analyse de problèmes complexes et le raisonnement en plusieurs étapes, la réflexion est conseillée par Z.ai. Elle peut être désactivée pour une question factuelle simple, une traduction de base, une classification simple ou un échange rapide de questions-réponses, selon les recommandations de l’éditeur.

Caractéristiques techniques de GLM 5.1

GLM 5.1 est sorti le 7 avril 2026, jour de son annonce par Z.ai, et accepte uniquement du texte en entrée. Selon OpenRouter, sa fenêtre de contexte atteint 204 800 tokens, des unités de texte traitées par le modèle, et sa sortie maximale est de 131 072 tokens par réponse. Le tableau des caractéristiques rassemble les chiffres techniques du modèle.

Éditeur
Z.ai
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
205 k tokens
Réponse maximale (selon OpenRouter)
131 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, AtlasCloud, Baidu, Chutes, Friendli, GMICloud, Nebius, Novita, Phala, SiliconFlow, StreamLake, Venice, Z.AI

Où utiliser GLM 5.1, et comment il se facture

GLM 5.1 était accessible à sa sortie sur les plateformes de Z.ai et pouvait être auto-hébergé, selon l’éditeur.

  • Plateformes pour développeurs : à sa sortie, selon Z.ai, le modèle était proposé sur api.z.ai et BigModel.cn.
  • GLM Coding Plan : à sa sortie, Z.ai ouvrait le modèle à tous les abonnés de ce plan. Son activation passait par le nom de modèle GLM-5.1, par exemple dans ~/.claude/settings.json pour Claude Code. Les agents de code concernés comprenaient Claude Code, OpenCode, Kilo Code, Roo Code, Cline et Droid. À sa sortie, selon Z.ai, la consommation du quota était multipliée par trois aux heures de pointe.
  • Compatibilité : à sa sortie, Z.ai annonçait une compatibilité avec Claude Code et OpenClaw.
  • Auto-hébergement : à sa sortie, selon Z.ai, les poids du modèle étaient publics sur Hugging Face et ModelScope, sous licence MIT. Le déploiement local s’appuyait sur vLLM et SGLang, des moteurs d’inférence qui exécutent le modèle.

La carte d’accès donne les derniers prix relevés.

L'API Z.ai

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 1,40 $ / M tokens en entrée, 4,40 $ / M tokens en sortie.

Tarification1,40 $ en entrée, 4,40 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, AtlasCloud, Baidu, Chutes, Friendli, GMICloud, Nebius, Novita, Phala, SiliconFlow, StreamLake, Venice, Z.AI

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

GLM 5.1 parmi les versions de GLM

GLM 5, sorti le 12 février 2026, est la version qui précède GLM 5.1. Plus tôt dans la gamme, GLM 4.5 est sorti le 28 juillet 2025, puis GLM 4.7 le 22 décembre 2025. Avec sa sortie le 16 juin 2026, GLM 5.2 lui succède. La frise des versions situe le modèle parmi les versions de la famille GLM, avec leurs dates de sortie.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

GLM 5.1 est-il open source ?

Oui, selon Z.ai : GLM 5.1 est publié en open source sous licence MIT. Ses poids sont publics sur Hugging Face et ModelScope.

Peut-on faire tourner GLM 5.1 en local ?

GLM 5.1 peut se déployer en local avec les moteurs d’inférence vLLM et SGLang, selon Z.ai. Ces moteurs servent à exécuter le modèle à partir de ses poids publics.

GLM 5.1 est-il gratuit ?

Les poids de GLM 5.1 s’utilisent gratuitement au titre de la licence MIT publiée avec eux sur Hugging Face. Cette licence autorise aussi la copie, la modification, la fusion, la publication, la distribution, la sous-licence et la vente. Tu dois conserver la notice de copyright et de licence.

Quelle est la fenêtre de contexte de GLM 5.1 ?

GLM 5.1 dispose d’une fenêtre de contexte de 200K tokens, selon la documentation de Z.ai. Il lit et produit du texte, avec une sortie maximale de 128K tokens.

Comment utiliser GLM 5.1 dans Claude Code ?

GLM 5.1 était accessible dans Claude Code à tous les abonnés du GLM Coding Plan à sa sortie, selon Z.ai. Son activation passait alors par le nom de modèle « GLM-5.1 » dans la configuration, par exemple dans le fichier ~/.claude/settings.json.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.