Revue publiée le Scores mis à jour le
Comparer

Z.ai : GLM 5.2

Nouvelle version : GLM 5.3

GLM 5.2 est un modèle open-weight de Z.ai, sous licence MIT, sorti le 16 juin 2026, qui lit et produit du texte. Z.ai le présente pour les tâches de longue haleine et le code, avec une fenêtre de contexte de 1 048 576 tokens.

Ce que GLM 5.2 change par rapport à GLM 5.1

GLM 5.2 étend d’abord la fenêtre de contexte : sur OpenRouter, elle passe de 204 800 tokens dans GLM 5.1 à 1 048 576 tokens dans GLM 5.2. Z.ai présente aussi GLM 5.2 comme un net progrès sur les tâches de longue haleine par rapport à GLM 5.1, un niveau qu’il tient pour la première fois sur un contexte d’un million de tokens.

Deuxième changement, le réglage de l’effort de réflexion apparaît avec GLM 5.2 : selon Z.ai, le paramètre reasoning_effort n’est pris en charge qu’à partir de lui. Côté architecture, Z.ai introduit IndexShare, qui partage un même indexeur entre quatre couches d’attention clairsemée et divise par 2,9 les calculs par token à 1M de contexte, et améliore la couche MTP de décodage spéculatif, dont la longueur d’acceptation progresse de jusqu’à 20 %.

Sur OpenRouter, GLM 5.2 reprend enfin la limite de 131 072 tokens par réponse déjà présente dans GLM 5.1. Le tableau d’écart met ces deux versions face à face.

Par rapport à la version précédente

GLM 5.1GLM 5.2
Score14861540+54
Contexte maximal (selon OpenRouter)205 k1,05 M+844 k
Formats compris (selon OpenRouter)textetexte
Réflexion (selon OpenRouter)Activée par défautActivée par défaut
Prix d'entrée (OpenRouter, relevé du 05/10/2026)1,40 $ / M tokens0,032 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)4,40 $ / M tokens12 $ / M tokens

À quoi sert GLM 5.2

Chat

GLM 5.2 est disponible dans le chat de Z.ai à sa sortie. Sur OpenRouter, il sait appeler des outils et produire des sorties structurées.

Code

Selon Z.ai, GLM 5.2 tient le contexte d’un projet logiciel entier et peut mener, en une seule tâche, tout le cycle de développement jusqu’à un produit déployable sur plusieurs plateformes. Z.ai le juge aussi adapté aux refontes de longue haleine, comme le découplage de modules, la migration d’API ou la refonte d’un langage à un autre.

Jeux

Selon Z.ai, GLM 5.2 se prête au développement de mini-jeux, des règles du jeu jusqu’à une boucle jouable. L’éditeur y voit un terrain qui met à l’épreuve la compréhension des règles, la conception d’une machine à états, la structure des niveaux et la logique de score.

Les performances de GLM 5.2

À sa sortie, Z.ai publie des scores qui placent GLM 5.2 devant GLM 5.1 sur les quatre évaluations du tableau, en code, en raisonnement et en agents.

ÉvaluationDomaineScore annoncé pour GLM 5.2Score de GLM 5.1 selon l’annonce de GLM 5.2
Terminal-Bench 2.1code81,063,5
SWE-bench Procode62,158,4
GPQA-Diamondraisonnement91,286,2
MCP-Atlasagents76,871,8

Ces scores sont ceux que Z.ai publie à la sortie : une annonce de l’éditeur, pas un classement général.

À sa sortie, Z.ai reconnaît aussi une limite face à Claude Opus 4.8. L’écart annoncé atteint 13 % sur SWE-Marathon, et quelques points sur Terminal-Bench 2.1, avec 81,0 contre 85,0.

Bien utiliser GLM 5.2 : réflexion et effort

  1. Réflexion par défaut : selon Z.ai, GLM 5.2 active la réflexion en mode dynamique, où le modèle décide lui-même s’il réfléchit ; tu peux la couper avec thinking.type disabled pour obtenir une réponse directe.
  2. Réglage de l’effort : selon Z.ai, l’effort se règle en max, le réglage par défaut et recommandé, ou en high. Les autres valeurs y reviennent : low et medium donnent high, xhigh donne max, et none ou minimal arrêtent la réflexion.
  3. Choix de max : selon Z.ai, max alloue davantage de calcul quand une tâche difficile demande plus de performance, et le choix de l’effort arbitre entre la capacité du modèle, la vitesse d’exécution et le coût de calcul.
  4. Quand couper la réflexion : selon Z.ai, la réflexion peut être désactivée pour une question factuelle simple, une traduction de base, une classification simple ou un échange rapide de questions-réponses. L’éditeur la conseille en revanche pour les problèmes complexes et le raisonnement en plusieurs étapes.

Caractéristiques techniques de GLM 5.2

GLM 5.2 est sorti le 16 juin 2026, jour de son annonce par Z.ai. Sur OpenRouter, il lit uniquement du texte en entrée, et sa fenêtre de contexte atteint 1 048 576 tokens, avec un plafond de 131 072 tokens par réponse.

Le tableau des caractéristiques donne la liste complète.

Éditeur
Z.ai
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
131 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, AtlasCloud, Baidu, BaseTen, Cloudflare, CoreWeave, Decart, DeepInfra, DigitalOcean, Friendli, GMICloud, Inceptron, InferenceNet, Mistral, Morph, Novita, Parasail, Phala, Relace, SiliconFlow, StreamLake, Together, Venice, Wafer, Z.AI

Où utiliser GLM 5.2, et comment il se facture

  • Les applications de Z.ai : à sa sortie, GLM 5.2 s’utilise dans le chat de Z.ai et dans ZCode, l’agent de bureau de l’éditeur. ZCode sert aux tâches longues avec la commande /goal, au développement à distance par SSH et au pilotage depuis un mobile.
  • L’accès API : à sa sortie, Z.ai propose GLM 5.2 sur la Z.ai API Platform.
  • Le GLM Coding Plan : Z.ai a ouvert GLM 5.2 aux utilisateurs du plan avant sa sortie officielle, puis à tous ses abonnés à la sortie. Ils l’utilisent dans des agents de code comme ZCode, Claude Code ou OpenCode ; dans Claude Code, le nom GLM-5.2[1m] active le contexte d’un million de tokens.
  • L’auto-hébergement des poids : les poids de GLM 5.2 sont publics sur Hugging Face et ModelScope. Le modèle se déploie en local avec Transformers, vLLM, SGLang, xLLM et KTransformers, sous licence MIT sans limite régionale.

Les tarifs changent avec le temps, et les cartes d’accès donnent les prix.

L'API Z.ai

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,032 $ / M tokens en entrée, 12 $ / M tokens en sortie.

Tarification0,032 $ en entrée, 12 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, AtlasCloud, Baidu, BaseTen, Cloudflare, CoreWeave, Decart, DeepInfra, DigitalOcean, Friendli, GMICloud, Inceptron, InferenceNet, Mistral, Morph, Novita, Parasail, Phala, Relace, SiliconFlow, StreamLake, Together, Venice, Wafer, Z.AI

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

GLM 5.2 parmi les versions de GLM

GLM 5.2 s’inscrit entre GLM 5.1 et GLM 5.3 dans la gamme GLM. GLM 5 est sorti le 12 février 2026, puis GLM 5.1 le 7 avril 2026 et GLM 5.2 le 16 juin 2026. GLM 5.3, sorti le 18 août 2026, lui succède.

La frise des versions porte la date de sortie de chaque version.

  1. GLM 5 1446
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Qu’est-ce que GLM 5.2 ?

GLM 5.2 est un modèle de Z.ai, sorti le 16 juin 2026, qui lit et produit du texte, avec une fenêtre de contexte d’un million de tokens. Z.ai le présente pour les tâches de longue haleine et le code, et le publie sous licence MIT. GLM 5.1 est la version qui précède GLM 5.2 dans la gamme.

GLM 5.2 est-il open source ?

Ses poids, oui : Z.ai les publie sur Hugging Face et ModelScope, sous une licence MIT que l’éditeur qualifie d’open source, sans limite régionale. Cette licence, publiée avec les poids, autorise gratuitement l’usage, la copie, la modification, la fusion, la publication, la distribution, la sous-licence et la vente, à condition de reprendre la notice de copyright et de licence.

Peut-on faire tourner GLM 5.2 en local ?

Oui. Selon Z.ai, les poids de GLM 5.2 sont publics sur Hugging Face et ModelScope, et le modèle se déploie en local avec les moteurs d’inférence Transformers, vLLM, SGLang, xLLM et KTransformers.

Quand GLM 5.2 est-il sorti ?

GLM 5.2 est sorti le 16 juin 2026. Selon Z.ai, GLM 5.1 est la version qui précède GLM 5.2 dans la gamme. Z.ai a aussi ouvert GLM 5.2 aux utilisateurs du GLM Coding Plan avant sa sortie officielle.

Comment utiliser GLM 5.2 dans Claude Code ?

À sa sortie, GLM 5.2 est ouvert à tous les abonnés du GLM Coding Plan, qui l’utilisent dans des agents de code comme ZCode, Claude Code ou OpenCode. Dans Claude Code, le nom GLM-5.2[1m] active le contexte d’un million de tokens.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.