Qwen3 Next 80B A3B Thinking est un modèle publié par Qwen le 11 septembre 2025, recommandé selon Qwen pour les tâches de raisonnement très complexes. Selon Qwen, il lit nativement 262 144 tokens de contexte et fonctionne uniquement en mode réflexion, avec une longueur de sortie recommandée de 32 768 tokens pour la plupart des requêtes.
Qwen3 Next 80B A3B Thinking sait appeler des outils et produire des sorties structurées au relevé du 8 octobre 2026, sur OpenRouter. Selon Qwen, les modèles Qwen3 excellent dans l’appel d’outils. Pour exploiter leurs capacités d’agent, Qwen recommande Qwen-Agent. Qwen recommande aussi fortement l’utilisation de ce modèle pour des tâches de raisonnement très complexes.
Mathématiques
Qwen3 Next 80B A3B Thinking obtient un score de 87,8 sur AIME25, selon la carte du modèle publiée par Qwen sur Hugging Face. Sur ce test de mathématiques, Qwen annonce 85,0 pour Qwen3-30B-A3B-Thinking-2507 et 72,0 pour Gemini-2.5-Flash Thinking.
Code
Qwen3 Next 80B A3B Thinking obtient un score de 68,7 sur LiveCodeBench v6, selon la carte du modèle publiée par Qwen sur Hugging Face. Sur ce test de code, Qwen annonce 66,0 pour Qwen3-30B-A3B-Thinking-2507 et 61,2 pour Gemini-2.5-Flash Thinking.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances de Qwen3 Next 80B A3B Thinking
Qwen3 Next 80B A3B Thinking obtient, selon Qwen, un score de 82,7 sur MMLU-Pro, contre 80,9 pour Qwen3-30B-A3B-Thinking-2507, 84,4 pour Qwen3-235B-A22B-Thinking-2507 et 81,9 pour Gemini-2.5-Flash Thinking. Sur GPQA, selon Qwen, son score atteint 77,2, contre 73,4 pour Qwen3-30B-A3B-Thinking-2507, 81,1 pour Qwen3-235B-A22B-Thinking-2507 et 82,8 pour Gemini-2.5-Flash Thinking.
À sa sortie, selon Qwen, le débit de Qwen3-Next avec un contexte de 4K tokens est près de 7 fois celui de Qwen3-32B en préremplissage et près de 4 fois en décodage. Au-delà de 32K tokens de contexte, Qwen annonce, à sa sortie, un débit plus de 10 fois supérieur à celui de Qwen3-32B.
Bien utiliser Qwen3 Next 80B A3B Thinking : réflexion et réglages
Qwen3 Next 80B A3B Thinking impose la réflexion au relevé du 8 octobre 2026, sur OpenRouter. Selon Qwen, il ne fonctionne qu’en mode réflexion. Son modèle de conversation par défaut insère de lui-même la balise d’ouverture de la réflexion, selon Qwen.
Pour l’échantillonnage, Qwen suggère les réglages Temperature=0.6, TopP=0.95, TopK=20 et MinP=0. Selon Qwen, la longueur de sortie recommandée pour la plupart des requêtes est de 32 768 tokens. Pour évaluer le modèle sur des problèmes très complexes, Qwen suggère une longueur de sortie de 81 920 tokens au plus, notamment pour les problèmes rencontrés dans les compétitions de mathématiques et de programmation.
Caractéristiques techniques de Qwen3 Next 80B A3B Thinking
Qwen3 Next 80B A3B Thinking est sorti le 11 septembre 2025. Le tableau des caractéristiques présente ses données techniques.
Au relevé du 8 octobre 2026, sur OpenRouter, le modèle accepte du texte en entrée et dispose d’une fenêtre de contexte de 262 144 tokens. Selon Qwen, cette capacité de contexte est native et peut être étendue jusqu’à 1 010 000 tokens. Il est publié sous licence Apache 2.0. Son attention hybride combine Gated DeltaNet et Gated Attention, selon Qwen.
Selon Qwen, le modèle compte 80 milliards de paramètres au total, dont 3 milliards activés. Il comprend, selon Qwen, 512 experts, dont 10 activés et 1 partagé. À sa sortie, selon Qwen, son entraînement repose sur un sous-ensemble de 15T tokens tiré du corpus de préentraînement de 36T tokens de Qwen3.
Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
33 k tokens
Réflexion (selon OpenRouter)
Toujours active
Connaissances jusqu'à (selon OpenRouter)
septembre 2025
Retrait annoncé (selon OpenRouter)
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Qwen3 Next 80B A3B Thinking, et jusqu’à quand
Qwen3 Next 80B A3B Thinking apparaît sous l’identifiant qwen3-next-80b-a3b-thinking dans la région International d’Alibaba Cloud Model Studio le 11 septembre 2025, selon le journal des sorties du service. À sa sortie, selon Qwen, Qwen3-Next est publié sur Hugging Face et ModelScope. Le service Qwen3-Next est également utilisable, à sa sortie selon Qwen, via Alibaba Cloud Model Studio et NVIDIA API Catalog.
Selon Qwen, SGLang 0.5.2 ou plus et vLLM 0.10.2 ou plus permettent de déployer le modèle derrière une API compatible avec celle d’OpenAI. Sur OpenRouter, la fin de vie de Qwen3 Next 80B A3B Thinking est fixée au 9 octobre 2026. La carte d’accès donne les derniers prix relevés.
L'API Qwen
Retrait annoncé le 09/10/2026 selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,15 $ / M tokens en entrée, 1,20 $ / M tokens en sortie. Son retrait est annoncé le 09/10/2026 selon OpenRouter.
Tarification0,15 $ en entrée, 1,20 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Qwen3 Next 80B A3B Thinking parmi les versions de Qwen Next
Qwen3 Next 80B A3B Instruct partage la même date de sortie, le 11 septembre 2025. À sa sortie, selon Qwen, ces deux éditions sont issues du post-entraînement de Qwen3-Next-80B-A3B-Base. Selon Qwen, Qwen3-Next-80B-A3B est le premier modèle de la série Qwen3-Next. La frise des versions situe les éditions Thinking et Instruct dans la famille, avec leurs dates de sortie.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Qwen3 Next 80B A3B ThinkingVous êtes ici
Qwen3 Next 80B A3B Instruct
Score
1369
1399
Sortie
Contexte
262 k tokens
262 k tokens
Prix d'entrée
0,15 $ / M tokens
0,10 $ / M tokens
Prix de sortie
1,20 $ / M tokens
1,10 $ / M tokens
Entrées
Texte
Texte
Réflexion
Toujours active
Non prise en charge
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Ce qui le distingue
Qwen3 Next 80B A3B Thinking est un modèle publié par Qwen le 11 septembre 2025, recommandé selon Qwen pour les tâches de raisonnement très complexes. Selon Qwen, il lit nativement 262 144 tokens de contexte et fonctionne uniquement en mode réflexion, avec une longueur de sortie recommandée de 32 768 tokens pour la plupart des requêtes.
Qwen3 Next 80B A3B Instruct, publié par Qwen, est sorti le 11 septembre 2025. Sur OpenRouter, il lit du texte, sait appeler des outils et produit des sorties structurées.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Qwen3 Next 80B A3B Thinking est-il sorti ?
Qwen3 Next 80B A3B Thinking est sorti le 11 septembre 2025.
Que peut lire Qwen3 Next 80B A3B Thinking ?
Qwen3 Next 80B A3B Thinking accepte du texte en entrée au relevé du 8 octobre 2026, sur OpenRouter.
Quelle est la fenêtre de contexte de Qwen3 Next 80B A3B Thinking ?
Qwen3 Next 80B A3B Thinking dispose d’une fenêtre de contexte de 262 144 tokens au relevé du 8 octobre 2026, sur OpenRouter.
Jusqu’à quand Qwen3 Next 80B A3B Thinking est-il disponible ?
Sur OpenRouter, la fin de vie de Qwen3 Next 80B A3B Thinking est fixée au 9 octobre 2026.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.