Revue publiée le Scores mis à jour le
Comparer

Z.ai : GLM 4.5

Nouvelle version : GLM 4.6

GLM 4.5 est un modèle publié par Z.ai, sorti le 28 juillet 2025, qui lit et produit du texte. Selon Z.ai, il réunit raisonnement, programmation et capacités d’agent pour résoudre des problèmes complexes, construire des projets de code et travailler avec des outils.

À quoi sert GLM 4.5

Chat

GLM 4.5 est accessible, à sa sortie, dans le chat de Z.ai en sélectionnant GLM-4.5, selon Z.ai. Il y génère des artefacts, des diapositives et des projets full-stack. Sur OpenRouter, le modèle sait aussi appeler des outils.

Mathématiques

GLM 4.5 résout, à sa sortie, des problèmes complexes de mathématiques en mode réflexion, selon Z.ai. Ses capacités dans ce mode couvrent également les problèmes complexes de sciences et de logique.

Code

GLM 4.5 sait, à sa sortie, bâtir un projet de code de zéro, selon Z.ai. Il peut également agir en agent pour résoudre des tâches de code dans un projet existant. Selon le même éditeur, le modèle se combine avec des outils de code comme Claude Code, Roo Code et CodeGeex.

Full-stack

GLM 4.5 crée, à sa sortie, des applications web complètes, de l’interface front-end à la base de données et au déploiement du back-end, selon Z.ai. Avec le modèle, l’entreprise a bâti un agent de code inspiré de Claude Code qui crée un site entier en quelques mots à partir d’une base de site full-stack. Cet agent enrichit ensuite le site au fil d’un dialogue.

  • Chat1411
  • Mathématiques1411
  • Code
  • Fullstack
Comment lire ces scores

Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.

Les performances de GLM 4.5

À sa sortie, Z.ai évalue GLM 4.5 sur 12 évaluations : 3 d’agent, 7 de raisonnement et 2 de code. Ces tests le comparent à des modèles d’OpenAI, d’Anthropic, de Google DeepMind, de xAI, d’Alibaba, de Moonshot et de DeepSeek.

Sur τ-bench et BFCL-v3, qui évaluent les capacités d’agent et d’appel de fonctions, le modèle égale Claude 4 Sonnet selon Z.ai. Avec un outil de navigation web, il répond correctement à 26,4 % des questions de BrowseComp, contre 18,8 % pour Claude 4 Opus et 28,3 % pour o4-mini-high dans la comparaison publiée par l’éditeur à sa sortie.

Dans son évaluation sur 52 tâches de code menées dans Claude Code, Z.ai annonce 53,9 % de victoires face à Kimi K2 et 80,8 % de réussite face à Qwen3-Coder. L’éditeur reconnaît encore une marge de progrès face à Claude 4 Sonnet. Sur ces mêmes tâches, le modèle réussit en moyenne 90,6 % de ses appels d’outils, contre 89,5 % pour Claude 4 Sonnet, selon les résultats publiés par Z.ai à sa sortie.

Bien utiliser GLM 4.5 : les modes de réflexion

GLM 4.5 est présenté à sa sortie par Z.ai comme un modèle de réflexion hybride. Selon l’éditeur, le mode réflexion sert au raisonnement complexe et à l’usage d’outils, tandis que le mode sans réflexion sert aux réponses immédiates.

Selon la documentation de Z.ai, le paramètre thinking.type permet de choisir entre enabled et disabled, avec une réflexion dynamique activée par défaut. Sur OpenRouter, la réflexion peut être désactivée, selon la plateforme. Depuis ce modèle, la réflexion entrelacée permet aussi de réfléchir entre deux appels d’outils et après réception de leurs résultats, selon la documentation de Z.ai.

Caractéristiques techniques de GLM 4.5

GLM 4.5 est sorti le 28 juillet 2025 selon les notes de version de Z.ai, avec une architecture Mixture-of-Experts (MoE), ou mélange d’experts, comptant selon l’éditeur 355 milliards de paramètres au total, dont 32 milliards actifs.

Le tableau des caractéristiques présente les entrées et sorties textuelles ainsi que la fenêtre de contexte et la longueur maximale des réponses, décrites dans la documentation de Z.ai et également référencées sur OpenRouter. Selon sa fiche Hugging Face, le modèle est publié sous licence MIT, qui permet notamment l’usage commercial.

Éditeur
Z.ai
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
131 k tokens
Réponse maximale (selon OpenRouter)
98 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
décembre 2024
Retrait annoncé (selon OpenRouter)
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolstemperaturetop_preasoningresponse_formatmax_tokens
Hébergeurs via OpenRouter
Z.AI

Où utiliser GLM 4.5, comment il se facture et jusqu’à quand

GLM 4.5 était accessible à sa sortie par l’API de Z.ai, dans des agents de code et en auto-hébergement, selon Z.ai.

  • API de Z.ai : à sa sortie, le modèle était proposé sur la plateforme d’API de Z.ai, avec des interfaces compatibles avec celles d’OpenAI.
  • Agents de code : à sa sortie, le modèle pouvait être branché sur Claude Code et d’autres agents de code, selon les instructions de la documentation de l’API de Z.ai.
  • Auto-hébergement : à sa sortie, les poids étaient publics sur Hugging Face et ModelScope, selon Z.ai. Le modèle pouvait être déployé en local avec vLLM et SGLang.

Selon OpenRouter, la fin de vie du modèle sur sa plateforme est fixée au 31 décembre 2026. Les cartes d’accès donnent les derniers prix relevés.

L'API Z.ai

Retrait annoncé le 31/12/2026 selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,60 $ / M tokens en entrée, 2,20 $ / M tokens en sortie. Son retrait est annoncé le 31/12/2026 selon OpenRouter.

Tarification0,60 $ en entrée, 2,20 $ en sortie, par million de tokens
Hébergé via OpenRouter chezZ.AI

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

GLM 4.5 parmi les versions de GLM

GLM 4.5 et GLM 4.5 Air ont été annoncés ensemble le 28 juillet 2025, selon Z.ai, pour réunir raisonnement, code et capacités d’agent. Sa version sœur, Air, est un modèle distinct et plus compact : selon Z.ai, elle compte 106 milliards de paramètres, dont 12 milliards actifs. Selon Z.ai, le modèle principal intègre les capacités générales de GLM-4-0414 et le raisonnement de GLM-Z1, tout en renforçant les capacités d’agent.

GLM 4.6, sorti le 30 septembre 2025, succède à GLM 4.5 dans la gamme. Selon Z.ai, sa fenêtre de contexte passe de 128K à 200K tokens par rapport au modèle auquel il succède. La frise des versions situe les modèles dans la famille GLM et présente leurs dates de sortie.

  1. GLM 5 1446
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

C’est quoi GLM ?

GLM est la famille de modèles de Z.ai. Selon Z.ai, GLM 4.5 et GLM 4.5 Air en sont deux membres conçus pour réunir raisonnement, code et capacités d’agent dans un seul modèle.

Quand GLM 4.5 est-il sorti ?

GLM 4.5 est sorti le 28 juillet 2025, selon les notes de version de Z.ai. Sa variante Air a été présentée le même jour.

GLM 4.5 est-il open source ?

GLM 4.5 est publié par Z.ai sous licence MIT, selon sa fiche Hugging Face. Cette licence permet l’usage commercial du modèle.

Peut-on faire tourner GLM 4.5 en local ?

GLM 4.5 peut se déployer en local avec vLLM et SGLang, selon Z.ai à sa sortie. Ses poids étaient alors publics sur Hugging Face et ModelScope.

Quelle différence entre GLM 4.5 et GLM 4.5 Air ?

GLM 4.5 Air est plus compact : selon Z.ai, il compte 106 milliards de paramètres au total, dont 12 milliards actifs. Toujours selon Z.ai, GLM 4.5 compte 355 milliards de paramètres au total, dont 32 milliards actifs.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.