Revue publiée le Scores mis à jour le
Comparer

Qwen3.8 2.4T A95B

Récent

Qwen3.8 2.4T A95B, publié par Qwen le 12 août 2026, accepte uniquement du texte selon Qwen et produit des sorties structurées sur OpenRouter. Selon Qwen, la génération Qwen3.8 est conçue pour mener des tâches complexes en plusieurs étapes jusqu'à leur terme.

À quoi sert Qwen3.8 2.4T A95B

Chat

Qwen3.8 2.4T A95B prend en charge l’appel d’outils et les sorties structurées sur OpenRouter. Selon Qwen, la génération Qwen3.8 est conçue pour mener des tâches complexes en plusieurs étapes jusqu’à leur terme, avec une fiabilité accrue. Toujours selon Qwen, elle planifie de façon plus autonome et gère mieux les retours de l’environnement pour mener les tâches de bout en bout.

Code

Qwen3.8 bénéficie d’améliorations en code, en travail professionnel, en recherche et sur les tâches d’agent de longue haleine, selon Qwen. D’après Qwen, cette génération prend aussi mieux en charge les environnements d’agent et les outils de développement courants, afin de faciliter son intégration à une chaîne de développement existante.

Bien utiliser Qwen3.8 2.4T A95B : réflexion et effort

Qwen3.8 2.4T A95B réfléchit à chaque échange et commence chaque réponse par un raisonnement, selon Qwen : la réflexion ne peut pas être désactivée. Selon Qwen, l’option preserve_thinking conserve la réflexion des messages précédents et reste activée par défaut.

Selon Qwen, le paramètre reasoning_effort règle la profondeur de réflexion : xhigh, le niveau par défaut, correspond aux tâches complexes qui demandent une analyse approfondie. Pour équilibrer précision et vitesse, Qwen propose le niveau medium. Avec low, Qwen décrit un raisonnement efficace qui privilégie la vitesse et le coût.

Qwen recommande les réglages d’échantillonnage temperature=1.0, top_p=0.95, top_k=20, min_p=0.0, presence_penalty=0.0 et repetition_penalty=1.0. Pour les tâches d’agent exécutées dans des cadres qui séparent les limites de réflexion et de réponse finale, Qwen recommande une longueur maximale de 262 144 tokens pour la réflexion et de 131 072 tokens pour la réponse finale.

Caractéristiques techniques de Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B est sorti le 12 août 2026. Le modèle est publié sous licence Qwen3.8-Max License.

Selon Qwen, son architecture en mélange d’experts comprend 2,4 billions de paramètres au total, dont 95 milliards activés, répartis sur 92 couches. Parmi les 512 experts, 10 experts routés et 1 expert partagé sont activés, selon Qwen. Pour les entrées, le modèle se limite au texte et n’accepte pas de contenu multimodal, selon Qwen.

Selon Qwen, le contexte natif atteint 262 144 tokens, extensibles jusqu’à 1 010 000 tokens. Sur OpenRouter, le modèle accepte le texte en entrée et dispose d’une fenêtre de contexte de 1 048 576 tokens. Le bloc des caractéristiques reprend les entrées, le contexte, la réponse maximale, la réflexion, la licence, les paramètres et les hébergeurs.

Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
131 k tokens
Réflexion (selon OpenRouter)
Toujours active
Entrées (selon OpenRouter)
Texte
Licence
Qwen3.8-Max License
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, DeepInfra, Modal, Novita, SiliconFlow, Together, Venice

Où utiliser Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B a été mis à disposition sur Hugging Face Hub et ModelScope le 12 août 2026, selon Qwen. Au format Hugging Face Transformers, ses poids sont compatibles avec vLLM, SGLang et TokenSpeed, selon la carte de modèle de Qwen. La carte d’accès indique les derniers tarifs relevés.

Qwen décrit Qwen3.8-Max comme la version officielle fondée sur ce modèle, servie par l’API de Qwen Cloud. Selon la carte de modèle de Qwen, cette version ajoute l’entrée d’images, un mode sans réflexion et un contexte de 1M de tokens par défaut. Elle dispose également d’outils intégrés officiels, selon Qwen.

L'API Qwen

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 2 $ / M tokens en entrée, 6 $ / M tokens en sortie.

Tarification2 $ en entrée, 6 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, DeepInfra, Modal, Novita, SiliconFlow, Together, Venice

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Qwen3.8 2.4T A95B parmi les versions de Qwen

Qwen3.8 2.4T A95B appartient à la génération Qwen3.8, qui repose sur l’architecture de Qwen3.5 selon Qwen. Avec cette génération, un modèle de la classe Qwen-Max est publié en accès ouvert pour la première fois, selon Qwen. La frise des versions situe le modèle parmi les versions de sa famille, avec leurs dates de sortie.

Qwen2.5 72B Instruct est sorti le 19 septembre 2024. Puis Qwen3 235B A22B a été publié le 29 avril 2025. Qwen3.5 397B A17B est sorti le 15 février 2026, suivi de Qwen3.6 27B le 22 avril 2026. Enfin, Qwen3.8 27B a été publié le 14 août 2026.

  1. Qwen3 8B
  2. Qwen3 14B
  3. Qwen3.5-9B
  4. Qwen3.6 27B
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Qwen3.8 2.4T A95B est-il sorti ?

Qwen3.8 2.4T A95B est sorti le 12 août 2026. Sur OpenRouter, il accepte du texte en entrée.

Que peut lire Qwen3.8 2.4T A95B ?

Qwen3.8 2.4T A95B lit du texte en entrée sur OpenRouter. Sa fenêtre de contexte sur OpenRouter est de 1 048 576 tokens.

Quelle est la fenêtre de contexte de Qwen3.8 2.4T A95B ?

Qwen3.8 2.4T A95B dispose d’une fenêtre de contexte de 1 048 576 tokens sur OpenRouter. Sur OpenRouter, il accepte du texte en entrée.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.