Revue publiée le Scores mis à jour le
Comparer

Z.ai : GLM 4.6

Nouvelle version : GLM 4.7

GLM 4.6, publié par Z.ai le 30 septembre 2025, lit et produit du texte. Selon Z.ai, il s’utilise à sa sortie dans des agents de code comme Claude Code, Cline, Roo Code et Kilo Code.

Ce que GLM 4.6 change par rapport à GLM 4.5

GLM 4.6 élargit, à sa sortie, la fenêtre de contexte de 128K à 200K tokens par rapport à GLM 4.5, selon Z.ai, pour traiter des tâches d’agent plus complexes. Selon la documentation de Z.ai, la sortie maximale passe de 96K à 128K tokens entre les deux versions. Les entrées et sorties restent textuelles.

À sa sortie, le modèle progresse nettement en raisonnement par rapport à son prédécesseur, selon Z.ai, et peut utiliser des outils pendant cette réflexion. Toujours selon Z.ai, il est plus performant que GLM 4.5 dans les agents qui utilisent des outils ou la recherche, et s’intègre mieux aux frameworks d’agents. Le tableau d’écart compare les caractéristiques des deux versions relevées sur OpenRouter.

Par rapport à la version précédente

GLM 4.5GLM 4.6
Score14111382−29
Contexte maximal (selon OpenRouter)131 k205 k+74 k
Formats compris (selon OpenRouter)textetexte
Réflexion (selon OpenRouter)FacultativeFacultative
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,60 $ / M tokens0,43 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)2,20 $ / M tokens1,75 $ / M tokens

À quoi sert GLM 4.6

Chat

GLM 4.6 est accessible, à sa sortie, dans le chat de Z.ai en choisissant le modèle GLM-4.6, selon Z.ai. Sur OpenRouter, il sait appeler des outils et produire des sorties structurées, c’est-à-dire des réponses organisées selon un format défini.

Rédaction créative

GLM 4.6 propose, à sa sortie, une écriture mieux accordée aux préférences humaines en matière de style et de lisibilité, selon Z.ai. Dans le jeu de rôle, le modèle se comporte aussi plus naturellement, d’après l’éditeur.

Code

GLM 4.6 s’utilise, à sa sortie, dans des agents de code comme Claude Code, Cline, Roo Code et Kilo Code, selon Z.ai. L’éditeur annonce de meilleurs scores sur les évaluations de code ainsi que de meilleures performances en usage réel dans ces outils.

Front-end

GLM 4.6 génère, à sa sortie, des pages front-end plus soignées visuellement, selon Z.ai.

Les performances de GLM 4.6

GLM 4.6 est évalué à sa sortie par Z.ai sur huit évaluations publiques couvrant les agents, le raisonnement et le code. Selon l’éditeur, il affiche des gains nets sur GLM 4.5 et des avantages face à DeepSeek-V3.2-Exp et Claude Sonnet 4 sur ces évaluations. Z.ai précise qu’à sa sortie, GLM 4.6 reste derrière Claude Sonnet 4.5 en code.

Sur CC-Bench, Z.ai fait évaluer des tâches réelles en plusieurs tours par des évaluateurs humains, dans des conteneurs Docker isolés. Ces tâches portent sur le front-end, la création d’outils, l’analyse de données, les tests et les algorithmes. Selon l’éditeur, à sa sortie, GLM 4.6 approche la parité avec Claude Sonnet 4, avec 48,6 % de victoires, et dépasse nettement les autres modèles open source de référence. Dans la même annonce, Z.ai indique qu’il y termine ses tâches avec environ 15 % de tokens en moins que GLM 4.5.

Bien utiliser GLM 4.6 : les modes de réflexion

GLM 4.6 applique par défaut une réflexion hybride, selon la documentation de Z.ai, tandis que la réflexion est activée par défaut à partir de GLM 4.7. Sur OpenRouter, la réflexion peut être désactivée.

Dans l’exemple d’appel de sa documentation, Z.ai active la réflexion du modèle avec le paramètre thinking, de type enabled. Selon cette même documentation, la réflexion entrelacée (Interleaved Thinking), proposée depuis GLM 4.5, permet au modèle de réfléchir entre deux appels d’outils et après avoir reçu les résultats de ces appels.

Caractéristiques techniques de GLM 4.6

GLM 4.6 est sorti le 30 septembre 2025 et accepte uniquement du texte en entrée. Sous licence MIT, il compte 357 milliards de paramètres selon sa fiche Hugging Face. Sur OpenRouter, sa fenêtre de contexte est de 204 800 tokens et sa sortie maximale de 16 384 tokens par réponse, sous les 128K tokens de la documentation de Z.ai. Le tableau des caractéristiques rassemble ces données techniques.

Éditeur
Z.ai
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
205 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
mars 2025
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
DeepInfra, Novita, Venice, Z.AI

Où utiliser GLM 4.6, et comment il se facture

GLM 4.6 était accessible à sa sortie par API, avec le GLM Coding Plan ou en auto-hébergement, selon Z.ai.

  • API : à sa sortie, le modèle était proposé par l’API de la plateforme Z.ai. Les développeurs pouvaient aussi y accéder par OpenRouter.
  • GLM Coding Plan : les abonnés étaient passés automatiquement au modèle à sa sortie. Pour ceux qui avaient modifié la configuration de leur outil, le changement se limitait au nom du modèle, à remplacer par glm-4.6.
  • Auto-hébergement : à sa sortie, les poids étaient publics sur Hugging Face et ModelScope. Le déploiement local était possible avec vLLM et SGLang, des moteurs d’inférence qui exécutent le modèle.

Les cartes d’accès donnent les prix.

L'API Z.ai

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,43 $ / M tokens en entrée, 1,75 $ / M tokens en sortie.

Tarification0,43 $ en entrée, 1,75 $ en sortie, par million de tokens
Hébergé via OpenRouter chezDeepInfra, Novita, Venice, Z.AI

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

GLM 4.6 parmi les versions de GLM

GLM 4.6, sorti le 30 septembre 2025, s’inscrit dans la gamme texte de GLM après GLM 4.5, sorti le 28 juillet 2025, et avant GLM 4.7, sorti le 22 décembre 2025. Dans son annonce de GLM 4.7, Z.ai désigne explicitement GLM 4.6 comme son prédécesseur. La frise des versions situe ces modèles dans l’histoire de la famille et porte les dates de sortie de chacun.

  1. GLM 5 1446
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

C’est quoi GLM ?

GLM désigne la famille de modèles de Z.ai, dont GLM 4.6 est une version sortie le 30 septembre 2025. À sa sortie, Z.ai la compare à GLM 4.5, la version qui la précède. GLM 4.7 lui succède.

Quelle est la fenêtre de contexte de GLM 4.6 ?

GLM 4.6 dispose d’une fenêtre de contexte de 200K tokens selon la documentation de Z.ai. Selon cette même documentation, il lit et produit du texte, avec une sortie maximale de 128K tokens.

GLM 4.6 est-il open source ?

GLM 4.6 est publié sous licence MIT, comme l’indique sa fiche Hugging Face. Selon Z.ai, ses poids sont publics sur Hugging Face et ModelScope.

Peut-on faire tourner GLM 4.6 en local ?

Selon Z.ai, les poids de GLM 4.6 sont publics sur Hugging Face et ModelScope, et le modèle se déploie en local avec les moteurs d’inférence vLLM et SGLang. Selon sa fiche Hugging Face, il compte 357 milliards de paramètres.

Comment accéder à l’API GLM-4.6 ?

GLM 4.6 était proposé à sa sortie par l’API de la plateforme Z.ai, selon l’éditeur. Les développeurs pouvaient également y accéder par OpenRouter.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.