Revue publiée le Scores mis à jour le
Comparer

Z.ai : GLM 4.6V

GLM 4.6V, publié par Z.ai le 8 décembre 2025, lit la vidéo, l’image, le texte et les fichiers et produit du texte, selon la documentation de l’API de Z.ai. Selon Z.ai, à sa sortie, le modèle comprend les documents mêlant texte et éléments visuels, résume de longues vidéos et produit du code HTML, CSS et JavaScript à partir de captures d’écran ou de maquettes.

Ce que GLM 4.6V change par rapport à GLM 4.5V

GLM 4.6V succède à GLM 4.5V dans la gamme sur OpenRouter. À sa sortie le 8 décembre 2025, le modèle étend le contexte à 128K tokens, selon les notes de version de Z.ai. Selon Z.ai, il intègre aussi pour la première fois un appel de fonctions natif (function calling), qui permet au modèle de demander l’exécution d’une fonction.

Sur OpenRouter, la fenêtre de contexte passe de 65 536 à 131 072 tokens par rapport au prédécesseur. Pour une réponse, la sortie maximale passe de 16 384 à 32 768 tokens sur OpenRouter. En entrée, la vidéo s’ajoute au texte et à l’image sur OpenRouter, tandis que le prédécesseur accepte le texte et l’image. Le tableau d’écart compare la fenêtre de contexte, les formats d’entrée et la réflexion relevés sur OpenRouter.

Par rapport à la version précédente

GLM 4.5VGLM 4.6V
Score13521379+27
Contexte maximal (selon OpenRouter)66 k131 k×2
Formats compris (selon OpenRouter)texte, imagetexte, image, vidéo
Réflexion (selon OpenRouter)FacultativeFacultative
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,60 $ / M tokens0,30 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)1,80 $ / M tokens0,90 $ / M tokens

À quoi sert GLM 4.6V

Chat

GLM 4.6V sait appeler des outils sur OpenRouter. Selon Z.ai, à sa sortie, il reçoit des images, des captures d’écran et des pages de documents comme paramètres d’outils, sans conversion préalable en texte, et lit leurs résultats visuels, notamment des graphiques ou des captures de pages web. Pour les questions-réponses en texte seul, le modèle conserve à sa sortie une large marge de progrès selon Z.ai, ce cycle de développement ayant porté sur les usages multimodaux visuels.

Vision et compréhension

GLM 4.6V comprend à sa sortie des documents mêlant texte, graphiques, figures, tableaux et formules, selon Z.ai. En une seule passe, il traite environ 150 pages de documents complexes, 200 diapositives ou une vidéo d’une heure, selon Z.ai à sa sortie. Pour une longue vidéo, le modèle produit un résumé en raisonnant sur les repères temporels, selon Z.ai à sa sortie, par exemple les buts et leurs horodatages dans un match de football entier.

Code

GLM 4.6V est optimisé à sa sortie pour le développement front-end, c’est-à-dire la partie visible d’une interface web, selon Z.ai. À sa sortie, tu peux entourer une zone sur la capture d’une page générée et demander une modification en langage naturel : le modèle retrouve puis modifie le passage de code correspondant, selon Z.ai.

Design d’après référence

GLM 4.6V produit à sa sortie le code HTML, CSS et JavaScript d’une page à partir d’une capture d’écran ou d’un fichier de maquette, selon Z.ai. Pour construire la page à partir de cette référence visuelle, il repère la mise en page, les composants et les couleurs, selon Z.ai à sa sortie.

  • Chat1379
  • Vision et compréhension1161
  • Code
  • Design d'après référence
Comment lire ces scores

Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.

Bien utiliser GLM 4.6V : réflexion et paramètres de génération

GLM 4.6V permet de désactiver la réflexion sur OpenRouter : elle n’est pas obligatoire. Selon Z.ai, à sa sortie, le modèle peut encore trop réfléchir, voire se répéter, surtout face à des consignes complexes. Pour reproduire ses résultats d’évaluation, Z.ai recommande à sa sortie top_p à 0,6, top_k à 2, une température de 0,8, une pénalité de répétition de 1,1 et au plus 16K tokens générés.

Caractéristiques techniques de GLM 4.6V

GLM 4.6V est sorti le 8 décembre 2025 et est publié sous licence MIT sur la fiche Hugging Face de Z.ai. Selon Z.ai, le modèle compte 106 milliards de paramètres, tandis que GLM-4.6V-Flash, sorti le même jour, en compte 9 milliards : le premier est conçu pour le cloud et les grappes de calcul haute performance, le second pour le déploiement local et les applications à faible latence.

Selon la documentation de Z.ai, le modèle accepte la vidéo, l’image, le texte et le fichier en entrée, produit du texte et dispose d’une fenêtre de contexte de 128K tokens. Le tableau des caractéristiques présente notamment les valeurs relevées sur OpenRouter : image, texte et vidéo en entrée, fenêtre de contexte de 131 072 tokens et sortie maximale de 32 768 tokens par réponse.

Éditeur
Z.ai
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
131 k tokens
Réponse maximale (selon OpenRouter)
33 k tokens
Réflexion (selon OpenRouter)
Facultative
Tâches
Aide au codeAffaires et financeJuridiqueConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolstemperaturetop_preasoningseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
Novita, Z.AI

Où utiliser GLM 4.6V, et comment il se facture

  • Plateforme et application : GLM 4.6V pouvait être essayé à sa sortie sur la plateforme Z.ai et dans l’application Zhipu Qingyan, selon Z.ai.
  • API : selon Z.ai, à sa sortie, le modèle s’intégrait aux applications par l’API de l’éditeur, compatible avec celle d’OpenAI.
  • Auto-hébergement : à sa sortie, selon Z.ai, les poids du modèle étaient publics sur Hugging Face et ModelScope. Le modèle pouvait être exécuté en local avec les moteurs d’inférence vLLM et SGLang, selon Z.ai.

La carte d’accès donne les derniers prix relevés.

L'API Z.ai

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 0,90 $ / M tokens en sortie.

Tarification0,30 $ en entrée, 0,90 $ en sortie, par million de tokens
Hébergé via OpenRouter chezNovita, Z.AI

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

GLM 4.6V parmi les versions de GLM

GLM 4.6V appartient, selon Z.ai, à la famille GLM-V, présentée avec GLM-4.1V-Thinking et GLM-4.5V. La frise des versions situe le modèle dans la gamme GLM et porte les dates de sortie.

GLM 4.5 est sorti le 28 juillet 2025, puis GLM 4.5V le 11 août 2025. Avec ce dernier, la lignée visuelle compte la version qui précède GLM 4.6V. Entre ces versions visuelles, GLM 4.6 est sorti le 30 septembre 2025 : selon les notes de version de Z.ai, ce modèle distinct est un modèle phare pour le code.

  1. GLM 5 1446
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand GLM 4.6V est-il sorti ?

GLM 4.6V est sorti le 8 décembre 2025. Il succède à GLM 4.5V dans la gamme.

Que lit GLM 4.6V en entrée ?

GLM 4.6V accepte la vidéo, l’image, le texte et le fichier en entrée, selon Z.ai. En sortie, il produit du texte, selon Z.ai.

Quelle est la fenêtre de contexte de GLM 4.6V ?

GLM 4.6V possède une fenêtre de contexte de 128K tokens, selon Z.ai. Un token est une unité de traitement, qui ne correspond pas nécessairement à un mot entier.

Peut-on faire tourner GLM 4.6V en local ?

GLM 4.6V peut être servi en local avec vLLM et SGLang, selon Z.ai. Ses poids sont publics sur Hugging Face et ModelScope, selon Z.ai.

Quelle version précède GLM 4.6V ?

GLM 4.5V est la version qui précède GLM 4.6V dans la gamme. GLM 4.6V est sorti le 8 décembre 2025.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.