Qwen3 Max Thinking est présenté par Qwen, à sa sortie le 23 janvier 2026, comme un modèle de raisonnement doté de capacités d’agent. Au relevé du 8 octobre 2026, sur OpenRouter, qui fixe sa fin de vie au 9 octobre 2026, le modèle accepte du texte en entrée et peut produire des réponses structurées ou appeler des outils.
Ce que Qwen3 Max Thinking change par rapport à Qwen3 Max
Qwen3 Max Thinking progresse, à sa sortie, en connaissances factuelles, en raisonnement complexe et en suivi des consignes, selon Qwen. Selon Qwen, à sa sortie, ses progrès concernent aussi l’alignement sur les préférences humaines et les capacités d’agent, grâce à davantage de paramètres et à d’importantes ressources de calcul consacrées à l’apprentissage par renforcement.
Selon le journal des sorties d’Alibaba Cloud Model Studio, l’instantané qwen3-max-2026-01-23, publié le 23 janvier 2026, intègre les modes avec et sans réflexion. Par rapport à l’instantané du 23 septembre 2025, cette version améliore nettement les performances d’ensemble, selon le journal des sorties d’Alibaba Cloud Model Studio.
Au relevé du 8 octobre 2026, sur OpenRouter, Qwen3 Max Thinking accepte les paramètres reasoning et include_reasoning, liés à la réflexion, que Qwen3 Max ne liste pas. Sur OpenRouter, les deux versions ont les mêmes limites de contexte et de sortie maximale au même relevé. Le tableau d’écart compare le contexte, les formats d’entrée et la réflexion relevés sur OpenRouter.
Par rapport à la version précédente
Qwen3 MaxQwen3 Max Thinking
Contexte maximal (selon OpenRouter)262 k→262 k
Formats compris (selon OpenRouter)texte→texte
Réflexion (selon OpenRouter)Non prise en charge→FacultativeModifié
À quoi sert Qwen3 Max Thinking
Chat
Qwen3 Max Thinking était disponible dans Qwen Chat à sa sortie, selon Qwen, avec un choix automatique des outils de recherche, de mémoire et d’interpréteur de code au fil de la conversation. Selon Qwen, à sa sortie, la recherche et la mémoire limitaient les hallucinations, apportaient des informations en temps réel et personnalisaient les réponses. Au relevé du 8 octobre 2026, sur OpenRouter, le modèle accepte l’appel d’outils et les sorties structurées.
Suivi de consignes
Qwen3 Max Thinking obtient, selon Qwen, à sa sortie, 70,9 sur IFBench et 63,3 sur MultiChallenge. Qwen range ces deux évaluations sous « suivi des consignes et alignement ».
Code
Qwen3 Max Thinking obtient, selon Qwen, à sa sortie, 75,3 sur SWE Verified, une évaluation classée par Qwen dans le code en agent. Selon Qwen, à sa sortie, les API de l’éditeur étaient aussi compatibles avec le protocole de l’API d’Anthropic, ce qui permettait au modèle de fonctionner avec Claude Code.
Les performances de Qwen3 Max Thinking
Qwen3 Max Thinking affiche, selon Qwen, à sa sortie, des performances comparables à celles de GPT-5.2-Thinking, Claude-Opus-4.5 et Gemini 3 Pro sur 19 évaluations de référence. À sa sortie, selon Qwen, il obtient 87,4 sur GPQA, 85,9 sur LiveCodeBench v6 et 98,0 sur HMMT Feb 25.
Avec les outils, le modèle obtient 49,8 sur HLE selon Qwen, à sa sortie, dans une évaluation de recherche en agent où l’accès à Hugging Face et aux sites liés à HLE a été bloqué. Pour Tau² Bench, qui évalue l’usage des outils, il atteint 82,1 selon Qwen, à sa sortie, avec le réglage officiel et sans échafaudage sur mesure.
En mode « heavy », sa stratégie de calcul à l’inférence en plusieurs tours dépasse l’échantillonnage parallèle standard avec agrégation, pour une consommation de tokens à peu près identique, selon Qwen, à sa sortie. Sur GPQA, le score passe de 90,3 avec cette méthode standard à 92,8 avec la stratégie en plusieurs tours, selon Qwen, à sa sortie. Pour LiveCodeBench v6, la même comparaison donne respectivement 88,0 et 91,4, selon Qwen, à sa sortie.
Bien utiliser Qwen3 Max Thinking : réflexion et outils
Qwen3 Max Thinking permet de désactiver la réflexion sur OpenRouter, au relevé du 8 octobre 2026. Selon Qwen, à sa sortie, l’exemple d’appel de l’API active la réflexion avec le paramètre enable_thinking. En mode réflexion, l’instantané qwen3-max-2026-01-23 combine à sa sortie recherche web, extraction d’informations sur le web et interpréteur de code pour mobiliser des outils externes pendant un raisonnement lent et réfléchi, selon le journal des sorties d’Alibaba Cloud Model Studio.
Caractéristiques techniques de Qwen3 Max Thinking
Qwen3 Max Thinking est sorti le 23 janvier 2026. Selon Qwen, à sa sortie, il constitue le nouveau modèle de raisonnement phare de l’éditeur.
Au relevé du 8 octobre 2026, sur OpenRouter, le modèle accepte du texte en entrée. Au relevé du 8 octobre 2026, sur OpenRouter, sa fenêtre de contexte atteint 262 144 tokens et sa réponse peut contenir au plus 65 536 tokens. Le tableau des caractéristiques reprend les données d’OpenRouter.
Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Facultative
Retrait annoncé (selon OpenRouter)
Entrées (selon OpenRouter)
Texte
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Qwen3 Max Thinking était accessible dans Qwen Chat à sa sortie, selon Qwen.
Pour l’accès par API, le modèle portait à sa sortie l’identifiant qwen3-max-2026-01-23 et nécessitait un compte Alibaba Cloud ainsi que le service Alibaba Cloud Model Studio, selon Qwen. À la sortie du modèle, les API de Qwen étaient compatibles avec l’API d’OpenAI, selon Qwen. Selon OpenRouter, la fin de vie du modèle sur OpenRouter est fixée au 9 octobre 2026. La carte d’accès présente les derniers prix relevés.
L'API Qwen
Retrait annoncé le 09/10/2026 selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,78 $ / M tokens en entrée, 3,90 $ / M tokens en sortie. Son retrait est annoncé le 09/10/2026 selon OpenRouter.
Tarification0,78 $ en entrée, 3,90 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Qwen3 Max Thinking parmi les versions de Qwen Max
Qwen3 Max, sorti le 24 septembre 2025, est la version qui précède Qwen3 Max Thinking dans la gamme. Selon Qwen, à la sortie de Qwen3 Max, sa variante de raisonnement, nommée Qwen3-Max-Thinking dans l’annonce, était en cours d’entraînement intensif.
Au relevé du 8 octobre 2026, sur OpenRouter, Qwen3.6 Max Preview, sorti le 20 avril 2026, lui succède dans la gamme. Qwen3.7 Max est sorti le 20 mai 2026, puis Qwen3.8 Max (0902) le 3 septembre 2026. La frise des versions situe le modèle parmi les autres versions de Qwen Max, avec leurs dates de sortie.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Qwen3 Max ThinkingVous êtes ici
Qwen3 Max
Qwen3.6 Max Preview
Qwen3.7 Max
Qwen3.8 Max (0902)
Score
1434
1471
1475
1670
Sortie
Contexte
262 k tokens
262 k tokens
262 k tokens
1 M tokens
1 M tokens
Prix d'entrée
0,78 $ / M tokens
0,78 $ / M tokens
1,03 $ / M tokens
1,48 $ / M tokens
2 $ / M tokens
Prix de sortie
3,90 $ / M tokens
3,90 $ / M tokens
6,16 $ / M tokens
4,43 $ / M tokens
6 $ / M tokens
Entrées
Texte
Texte
Texte
Texte
Texte, Image, Vidéo
Réflexion
Facultative
Non prise en charge
Activée par défaut
Activée par défaut
Toujours active
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Qwen3 Max Thinking est présenté par Qwen, à sa sortie le 23 janvier 2026, comme un modèle de raisonnement doté de capacités d’agent. Au relevé du 8 octobre 2026, sur OpenRouter, qui fixe sa fin de vie au 9 octobre 2026, le modèle accepte du texte en entrée et peut produire des réponses structurées ou appeler des outils.
Qwen3 Max, publié par Qwen le 24 septembre 2025, lit du texte et produit des réponses sur OpenRouter, au relevé du 8 octobre 2026. Selon Alibaba Cloud, il a reçu à sa sortie, par rapport à sa préversion, des améliorations ciblées en programmation d'agents et en appel d'outils.
Qwen publie Qwen3.6 Max Preview le 20 avril 2026, une préversion propriétaire dont le journal des sorties d'Alibaba Cloud Model Studio annonce à sa sortie, face à Qwen3-Max et à Qwen3.6-Plus, des compétences nettement améliorées en développement front-end et une exécution plus efficace en agent de code. Selon la documentation d'Alibaba Cloud Model Studio, le modèle lit et produit du texte.
Qwen3.7 Max, publié par Qwen et sorti le 20 mai 2026, accepte du texte sur OpenRouter et produit des réponses textuelles. Selon Qwen, à sa sortie, il sert d’assistant de bureautique et d’agent de code, du prototypage front-end à l’ingénierie sur plusieurs fichiers.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Qwen3 Max Thinking est-il sorti ?
Qwen3 Max Thinking est sorti le 23 janvier 2026. Il vient après Qwen3 Max dans la gamme.
Que peut lire Qwen3 Max Thinking ?
Qwen3 Max Thinking accepte du texte en entrée sur OpenRouter, au relevé du 8 octobre 2026.
Quelle est la fenêtre de contexte de Qwen3 Max Thinking ?
Qwen3 Max Thinking dispose d’une fenêtre de contexte de 262 144 tokens sur OpenRouter, au relevé du 8 octobre 2026. Cette valeur décrit la capacité de contexte, pas la longueur maximale d’une réponse.
Quelle version précède Qwen3 Max Thinking ?
Qwen3 Max est la version qui précède Qwen3 Max Thinking dans la gamme. Selon Qwen, à la sortie de Qwen3 Max, sa variante de raisonnement Qwen3-Max-Thinking était en cours d’entraînement intensif.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.