Revue publiée le Scores mis à jour le
Comparer

Qwen3 Max Thinking

Nouvelle version : Qwen3.6 Max Preview

Qwen3 Max Thinking est présenté par Qwen, à sa sortie le 23 janvier 2026, comme un modèle de raisonnement doté de capacités d’agent. Au relevé du 8 octobre 2026, sur OpenRouter, qui fixe sa fin de vie au 9 octobre 2026, le modèle accepte du texte en entrée et peut produire des réponses structurées ou appeler des outils.

Ce que Qwen3 Max Thinking change par rapport à Qwen3 Max

Qwen3 Max Thinking progresse, à sa sortie, en connaissances factuelles, en raisonnement complexe et en suivi des consignes, selon Qwen. Selon Qwen, à sa sortie, ses progrès concernent aussi l’alignement sur les préférences humaines et les capacités d’agent, grâce à davantage de paramètres et à d’importantes ressources de calcul consacrées à l’apprentissage par renforcement.

Selon le journal des sorties d’Alibaba Cloud Model Studio, l’instantané qwen3-max-2026-01-23, publié le 23 janvier 2026, intègre les modes avec et sans réflexion. Par rapport à l’instantané du 23 septembre 2025, cette version améliore nettement les performances d’ensemble, selon le journal des sorties d’Alibaba Cloud Model Studio.

Au relevé du 8 octobre 2026, sur OpenRouter, Qwen3 Max Thinking accepte les paramètres reasoning et include_reasoning, liés à la réflexion, que Qwen3 Max ne liste pas. Sur OpenRouter, les deux versions ont les mêmes limites de contexte et de sortie maximale au même relevé. Le tableau d’écart compare le contexte, les formats d’entrée et la réflexion relevés sur OpenRouter.

Par rapport à la version précédente

Qwen3 MaxQwen3 Max Thinking
Contexte maximal (selon OpenRouter)262 k262 k
Formats compris (selon OpenRouter)textetexte
Réflexion (selon OpenRouter)Non prise en chargeFacultativeModifié

À quoi sert Qwen3 Max Thinking

Chat

Qwen3 Max Thinking était disponible dans Qwen Chat à sa sortie, selon Qwen, avec un choix automatique des outils de recherche, de mémoire et d’interpréteur de code au fil de la conversation. Selon Qwen, à sa sortie, la recherche et la mémoire limitaient les hallucinations, apportaient des informations en temps réel et personnalisaient les réponses. Au relevé du 8 octobre 2026, sur OpenRouter, le modèle accepte l’appel d’outils et les sorties structurées.

Suivi de consignes

Qwen3 Max Thinking obtient, selon Qwen, à sa sortie, 70,9 sur IFBench et 63,3 sur MultiChallenge. Qwen range ces deux évaluations sous « suivi des consignes et alignement ».

Code

Qwen3 Max Thinking obtient, selon Qwen, à sa sortie, 75,3 sur SWE Verified, une évaluation classée par Qwen dans le code en agent. Selon Qwen, à sa sortie, les API de l’éditeur étaient aussi compatibles avec le protocole de l’API d’Anthropic, ce qui permettait au modèle de fonctionner avec Claude Code.

Les performances de Qwen3 Max Thinking

Qwen3 Max Thinking affiche, selon Qwen, à sa sortie, des performances comparables à celles de GPT-5.2-Thinking, Claude-Opus-4.5 et Gemini 3 Pro sur 19 évaluations de référence. À sa sortie, selon Qwen, il obtient 87,4 sur GPQA, 85,9 sur LiveCodeBench v6 et 98,0 sur HMMT Feb 25.

Avec les outils, le modèle obtient 49,8 sur HLE selon Qwen, à sa sortie, dans une évaluation de recherche en agent où l’accès à Hugging Face et aux sites liés à HLE a été bloqué. Pour Tau² Bench, qui évalue l’usage des outils, il atteint 82,1 selon Qwen, à sa sortie, avec le réglage officiel et sans échafaudage sur mesure.

En mode « heavy », sa stratégie de calcul à l’inférence en plusieurs tours dépasse l’échantillonnage parallèle standard avec agrégation, pour une consommation de tokens à peu près identique, selon Qwen, à sa sortie. Sur GPQA, le score passe de 90,3 avec cette méthode standard à 92,8 avec la stratégie en plusieurs tours, selon Qwen, à sa sortie. Pour LiveCodeBench v6, la même comparaison donne respectivement 88,0 et 91,4, selon Qwen, à sa sortie.

Bien utiliser Qwen3 Max Thinking : réflexion et outils

Qwen3 Max Thinking permet de désactiver la réflexion sur OpenRouter, au relevé du 8 octobre 2026. Selon Qwen, à sa sortie, l’exemple d’appel de l’API active la réflexion avec le paramètre enable_thinking. En mode réflexion, l’instantané qwen3-max-2026-01-23 combine à sa sortie recherche web, extraction d’informations sur le web et interpréteur de code pour mobiliser des outils externes pendant un raisonnement lent et réfléchi, selon le journal des sorties d’Alibaba Cloud Model Studio.

Caractéristiques techniques de Qwen3 Max Thinking

Qwen3 Max Thinking est sorti le 23 janvier 2026. Selon Qwen, à sa sortie, il constitue le nouveau modèle de raisonnement phare de l’éditeur.

Au relevé du 8 octobre 2026, sur OpenRouter, le modèle accepte du texte en entrée. Au relevé du 8 octobre 2026, sur OpenRouter, sa fenêtre de contexte atteint 262 144 tokens et sa réponse peut contenir au plus 65 536 tokens. Le tableau des caractéristiques reprend les données d’OpenRouter.

Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Facultative
Retrait annoncé (selon OpenRouter)
Entrées (selon OpenRouter)
Texte
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba

Où utiliser Qwen3 Max Thinking, et jusqu’à quand

Qwen3 Max Thinking était accessible dans Qwen Chat à sa sortie, selon Qwen.

Pour l’accès par API, le modèle portait à sa sortie l’identifiant qwen3-max-2026-01-23 et nécessitait un compte Alibaba Cloud ainsi que le service Alibaba Cloud Model Studio, selon Qwen. À la sortie du modèle, les API de Qwen étaient compatibles avec l’API d’OpenAI, selon Qwen. Selon OpenRouter, la fin de vie du modèle sur OpenRouter est fixée au 9 octobre 2026. La carte d’accès présente les derniers prix relevés.

L'API Qwen

Retrait annoncé le 09/10/2026 selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,78 $ / M tokens en entrée, 3,90 $ / M tokens en sortie. Son retrait est annoncé le 09/10/2026 selon OpenRouter.

Tarification0,78 $ en entrée, 3,90 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Qwen3 Max Thinking parmi les versions de Qwen Max

Qwen3 Max, sorti le 24 septembre 2025, est la version qui précède Qwen3 Max Thinking dans la gamme. Selon Qwen, à la sortie de Qwen3 Max, sa variante de raisonnement, nommée Qwen3-Max-Thinking dans l’annonce, était en cours d’entraînement intensif.

Au relevé du 8 octobre 2026, sur OpenRouter, Qwen3.6 Max Preview, sorti le 20 avril 2026, lui succède dans la gamme. Qwen3.7 Max est sorti le 20 mai 2026, puis Qwen3.8 Max (0902) le 3 septembre 2026. La frise des versions situe le modèle parmi les autres versions de Qwen Max, avec leurs dates de sortie.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Qwen3 Max Thinking est-il sorti ?

Qwen3 Max Thinking est sorti le 23 janvier 2026. Il vient après Qwen3 Max dans la gamme.

Que peut lire Qwen3 Max Thinking ?

Qwen3 Max Thinking accepte du texte en entrée sur OpenRouter, au relevé du 8 octobre 2026.

Quelle est la fenêtre de contexte de Qwen3 Max Thinking ?

Qwen3 Max Thinking dispose d’une fenêtre de contexte de 262 144 tokens sur OpenRouter, au relevé du 8 octobre 2026. Cette valeur décrit la capacité de contexte, pas la longueur maximale d’une réponse.

Quelle version précède Qwen3 Max Thinking ?

Qwen3 Max est la version qui précède Qwen3 Max Thinking dans la gamme. Selon Qwen, à la sortie de Qwen3 Max, sa variante de raisonnement Qwen3-Max-Thinking était en cours d’entraînement intensif.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.