Revue publiée le Scores mis à jour le
Comparer

Z.ai : GLM 5

Nouvelle version : GLM 5.1

GLM 5, modèle de Z.ai sorti le 12 février 2026, lit et produit du texte. Selon la documentation de Z.ai, ses usages comprennent le code agentique, la traduction et l’extraction de données textuelles.

Ce que GLM 5 change par rapport à GLM 4.7

GLM 5 progresse nettement, à sa sortie, face à GLM 4.7, son prédécesseur, sur un large éventail d’évaluations académiques, selon Z.ai. Le tableau d’écart compare les fenêtres de contexte, les formats d’entrée, la réflexion et les prix relevés sur OpenRouter.

Sur CC-Bench-V2, sa suite d’évaluation interne, Z.ai indique que le modèle dépasse nettement GLM 4.7 en front-end, en back-end et sur les tâches longues, et qu’il réduit l’écart avec Claude Opus 4.5. Il intègre DeepSeek Sparse Attention (DSA), qui réduit nettement le coût de déploiement tout en préservant la capacité en contexte long, selon Z.ai.

GLM 4.7 lisait et produisait déjà du texte, comme GLM 5, selon la documentation de Z.ai. Pour les deux versions, les valeurs documentées restent identiques : une fenêtre de contexte de 200K tokens et une sortie maximale de 128K tokens. Sur OpenRouter, le prédécesseur avait déjà une fenêtre de contexte de 204 800 tokens.

Par rapport à la version précédente

GLM 4.7GLM 5
Score14381446+8
Contexte maximal (selon OpenRouter)205 k205 k
Formats compris (selon OpenRouter)textetexte
Réflexion (selon OpenRouter)Activée par défautActivée par défaut
Prix de sortie (OpenRouter, relevé du 05/10/2026)2,20 $ / M tokens1,92 $ / M tokens

À quoi sert GLM 5

Chat

À sa sortie, GLM 5 est accessible dans le chat de Z.ai, qui le propose en mode Chat, à réponse instantanée, et en mode Agent, avec plusieurs outils et compétences. Sur OpenRouter, il prend en charge l’appel d’outils et les sorties structurées. Selon l’éditeur, le modèle peut transformer un texte ou des documents sources en fichiers .docx, .pdf et .xlsx prêts à l’emploi. À sa sortie, l’application Z.ai accompagne ces capacités de compétences de création PDF, Word et Excel dans son mode Agent.

Rédaction créative

GLM 5 prend en charge le jeu de rôle ainsi que la génération de scripts et de storyboards, selon la documentation de Z.ai. Ses usages comprennent également la traduction.

Code

GLM 5 prend en charge le code agentique, selon la documentation de Z.ai. À sa sortie, l’éditeur indique qu’il peut s’utiliser dans des agents de code comme Claude Code, OpenCode, Kilo Code, Roo Code, Cline et Droid.

Fullstack

GLM 5 progresse nettement face à GLM 4.7 en développement front-end et en ingénierie back-end, selon les évaluations internes décrites par Z.ai, calquées sur les tâches de Claude Code. Dans sa documentation, l’éditeur indique également qu’il peut mener en autonomie la planification de longue haleine, la refonte de code back-end et le débogage approfondi.

Les performances de GLM 5

À sa sortie, Z.ai compare GLM 5 à GLM 4.7, DeepSeek-V3.2, Kimi K2.5, Claude Opus 4.5, Gemini 3 Pro et GPT-5.2. Le tableau reprend les scores annoncés par l’éditeur face à GLM 4.7, sans constituer un classement indépendant.

ÉvaluationScore annoncé pour GLM 5Score annoncé pour GLM 4.7
SWE-bench Verified77,873,8
SWE-bench Multilingual73,366,7
Terminal-Bench 2.0 (Terminus 2)56,241,0
HLE avec outils50,442,8
BrowseComp62,052,0
τ²-Bench89,787,4
MCP-Atlas67,852,0

Sur AIME 2026 I, GLM 5 obtient 92,7 contre 92,9 pour GLM 4.7, selon le même tableau publié à sa sortie par Z.ai. Claude Opus 4.5 y atteint 80,9 sur SWE-bench Verified, au-dessus des 77,8 de GLM 5. Avec Vending Bench 2, l’évaluation porte sur la gestion d’un distributeur automatique simulé pendant un an : selon l’éditeur, le modèle termine avec un solde final qui approche celui de Claude Opus 4.5.

Bien utiliser GLM 5 : la réflexion

GLM 5 utilise la réflexion par défaut selon OpenRouter, mais ce réglage n’est pas obligatoire : la réflexion peut être désactivée. Selon la documentation de Z.ai, le modèle propose plusieurs modes de réflexion adaptés aux scénarios. Dans l’exemple d’appel de l’API présenté par l’éditeur, le paramètre thinking active la réflexion avec un champ type défini sur enabled.

Caractéristiques techniques de GLM 5

GLM 5 est sorti le 12 février 2026, accepte uniquement du texte en entrée et est distribué sous licence MIT. Sur OpenRouter, sa fenêtre de contexte atteint 204 800 tokens et sa sortie maximale 128 000 tokens par réponse ; le tableau des caractéristiques reprend ces chiffres. Selon Z.ai, le modèle compte 744 milliards de paramètres, dont 40 milliards actifs.

Éditeur
Z.ai
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
205 k tokens
Réponse maximale (selon OpenRouter)
128 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Amazon Bedrock, Baidu, GMICloud, Novita, SiliconFlow, StreamLake, Venice, Z.AI

Où utiliser GLM 5, et comment il se facture

GLM 5 pouvait être utilisé dans le chat, par API ou en auto-hébergement à sa sortie, selon Z.ai. Son accès dans le GLM Coding Plan dépendait du forfait et de l’avancement du déploiement.

  • Chat de Z.ai : le modèle pouvait être essayé gratuitement dans le chat de Z.ai à sa sortie.
  • API : à sa sortie, le modèle était accessible sur les plateformes de développement api.z.ai et BigModel.cn. Selon Z.ai, cet accès était compatible avec Claude Code et OpenClaw.
  • GLM Coding Plan : à sa sortie, l’accès s’ouvrait progressivement aux abonnés, faute de capacité de calcul. Les abonnés du forfait Max pouvaient l’activer immédiatement ; les autres forfaits suivaient au fil du déploiement. Selon Z.ai, une requête à GLM 5 consommait davantage de quota qu’une requête à GLM 4.7.
  • Auto-hébergement : à sa sortie, les poids étaient publics sur Hugging Face et ModelScope sous licence MIT. Selon Z.ai, le déploiement local pouvait utiliser vLLM et SGLang, des moteurs d’inférence qui exécutent le modèle. Il était aussi possible sur des puces non NVIDIA : Huawei Ascend, Moore Threads, Cambricon, Kunlun Chip, MetaX, Enflame et Hygon.

La carte d’accès donne les derniers prix relevés.

L'API Z.ai

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,60 $ / M tokens en entrée, 1,92 $ / M tokens en sortie.

Tarification0,60 $ en entrée, 1,92 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAmazon Bedrock, Baidu, GMICloud, Novita, SiliconFlow, StreamLake, Venice, Z.AI

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

GLM 5 parmi les versions de GLM

GLM 5, sorti le 12 février 2026, prend place dans la gamme texte après GLM 4.7, son prédécesseur, sorti le 22 décembre 2025, et avant GLM 5.1, sorti le 7 avril 2026, qui lui succède. Dans cette lignée, GLM 4.5 (28 juillet 2025) puis GLM 4.6 (30 septembre 2025) ont précédé la version 4.7. La frise des versions retrace cette succession et porte les dates de sortie de chacun de ces modèles.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

GLM 5 est-il open source ?

GLM 5 est publié sous licence MIT. Selon Z.ai, à sa sortie, il est publié en open source sur Hugging Face et ModelScope, ses poids sous cette licence.

Peut-on faire tourner GLM 5 en local ?

GLM 5 peut se déployer en local avec les moteurs d’inférence vLLM et SGLang, selon Z.ai. Ses poids sont publics sur Hugging Face et ModelScope, et le déploiement prend aussi en charge des puces non NVIDIA. Selon Z.ai, le modèle compte 744 milliards de paramètres, dont 40 milliards actifs.

GLM 5 est-il disponible en API ?

Selon Z.ai, à sa sortie, GLM 5 est disponible sur les plateformes de développement api.z.ai et BigModel.cn, et compatible avec Claude Code et OpenClaw.

Quelle version succède à GLM 5 ?

GLM 5.1, sorti le 7 avril 2026, succède à GLM 5 dans la gamme GLM.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.