Revue publiée le Scores mis à jour le
Comparer

Qwen3 30B A3B

Qwen publie Qwen3 30B A3B, sorti le 29 avril 2025, sous licence Apache 2.0. Sur OpenRouter, il accepte du texte en entrée ; selon Qwen, il sert au dialogue, au raisonnement mathématique et à la génération de code.

Qwen3 30B A3B, Qwen3 32B ou Qwen3 235B A22B : lequel choisir ?

Qwen3 30B A3B faisait partie, à sa sortie, des deux modèles à mélange d’experts (MoE) à poids ouverts de la génération Qwen3, selon Qwen. Avec 30 milliards de paramètres au total dont 3 milliards activés, il était plus petit que Qwen3-235B-A22B, doté de 235 milliards de paramètres dont 22 milliards activés, selon Qwen. À sa sortie, selon Qwen, la génération comprenait aussi six modèles denses sous licence Apache 2.0, allant de Qwen3-32B à Qwen3-0.6B.

Selon Qwen, à sa sortie, Qwen3-32B était un modèle dense de 64 couches, tandis que Qwen3-30B-A3B comptait 48 couches et 128 experts dont 8 activés. Dans la même génération, selon Qwen, Qwen3-235B-A22B comptait 94 couches et 128 experts dont 8 activés. Pour ces trois versions, selon Qwen, la longueur de contexte annoncée à leur sortie était identique : 128K.

À quoi sert Qwen3 30B A3B

Chat et agents

Qwen3 30B A3B permet le dialogue généraliste en mode sans réflexion, selon Qwen, tout en conservant un mode de réflexion dans le même modèle. Selon Qwen, les modèles Qwen3 excellent dans l’appel d’outils, et l’entreprise conseille Qwen-Agent pour exploiter cette capacité. Son exemple d’agent utilise la configuration Qwen3-30B-A3B, selon Qwen.

Mathématiques

Qwen3 30B A3B utilise son mode de réflexion pour le raisonnement logique complexe, les mathématiques et le code, selon Qwen.

Suivi de consignes

Qwen3 30B A3B appartient à la famille des modèles Qwen3 qui, selon Qwen, excellent en écriture créative, en jeu de rôle, en dialogue à plusieurs tours et en suivi de consignes. Selon Qwen, les modèles Qwen3 prennent également en charge le suivi de consignes en plusieurs langues et la traduction.

  • Chat1327
  • Suivi de consignes1310
  • Mathématiques1351
Comment lire ces scores

Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.

Les performances de Qwen3 30B A3B

Qwen3-30B-A3B dépassait à sa sortie, selon Qwen, QwQ-32B, un modèle qui compte dix fois plus de paramètres activés. Selon Qwen, en mathématiques, en génération de code et en raisonnement logique de sens commun, les modèles Qwen3 dépassent QwQ en mode réflexion et les modèles Qwen2.5 Instruct en mode sans réflexion.

Bien utiliser Qwen3 30B A3B : réflexion et paramètres

Qwen3 30B A3B active la réflexion par défaut sur OpenRouter. Sur OpenRouter, cette réflexion reste facultative et peut être désactivée.

Selon Qwen, enable_thinking=True active la réflexion par défaut : le modèle l’écrit dans un bloc distinct, avant sa réponse finale. Avec enable_thinking=False, la réflexion est strictement coupée, selon Qwen, comme sur les modèles Qwen2.5-Instruct. Quand elle est activée, les commandes /think et /no_think ajoutées au message de l’utilisateur ou au message système permettent de changer de mode tour par tour, selon Qwen.

En mode réflexion, les réglages conseillés selon Qwen sont Temperature=0.6, TopP=0.95, TopK=20 et MinP=0. Selon Qwen, le décodage glouton est à éviter dans ce mode, car il peut dégrader les performances et provoquer des répétitions sans fin. Sans réflexion, les paramètres d’échantillonnage suggérés selon Qwen sont Temperature=0.7, TopP=0.8, TopK=20 et MinP=0.

Pour la plupart des requêtes, la longueur de sortie recommandée selon Qwen est de 32 768 tokens. Pour les évaluations portant sur des problèmes très complexes, comme ceux rencontrés dans les compétitions de mathématiques et de programmation, la longueur de sortie suggérée selon Qwen est de 38 912 tokens.

Caractéristiques techniques de Qwen3 30B A3B

Qwen3 30B A3B est sorti le 29 avril 2025. Il est distribué sous licence Apache 2.0.

Selon Qwen, ce modèle de langage causal compte 30,5 milliards de paramètres au total, dont 3,3 milliards activés. Hors embeddings, les représentations numériques des tokens, il possède 29,9 milliards de paramètres selon Qwen. Son architecture comprend 48 couches selon Qwen. Avec 128 experts dont 8 activés selon Qwen, le modèle ne mobilise qu’une partie de ses paramètres lors du traitement.

Sur OpenRouter, le modèle accepte le texte en entrée. Selon Qwen, sa fenêtre de contexte native atteint 32 768 tokens, ces unités de texte traitées par le modèle, et passe à 131 072 tokens avec la méthode YaRN. Sur OpenRouter, sa fenêtre de contexte est de 131 072 tokens. Il produit au plus 16 384 tokens par réponse sur OpenRouter. La liste des caractéristiques rassemble les repères techniques du modèle.

Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
131 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Connaissances jusqu'à (selon OpenRouter)
mars 2025
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, DeepInfra

Où utiliser Qwen3 30B A3B, et comment il se facture

  • Poids à télécharger : Qwen3 30B A3B est publié par Qwen sous licence Apache 2.0, selon sa fiche sur Hugging Face. À sa sortie, selon Qwen, Qwen3-30B-A3B et sa version préentraînée Qwen3-30B-A3B-Base étaient disponibles sur Hugging Face, ModelScope et Kaggle.
  • Déploiement sur serveur : à sa sortie, selon Qwen, les frameworks SGLang et vLLM étaient recommandés pour déployer les modèles Qwen3.
  • Utilisation en local : à sa sortie, selon Qwen, les outils Ollama, LMStudio, MLX, llama.cpp et KTransformers étaient recommandés pour utiliser les modèles Qwen3 en local.

La carte d’accès donne les derniers prix relevés.

L'API Qwen

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,12 $ / M tokens en entrée, 0,50 $ / M tokens en sortie.

Tarification0,12 $ en entrée, 0,50 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, DeepInfra

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Qwen3 30B A3B parmi les versions de Qwen

Qwen3 30B A3B appartient à une génération postérieure à Qwen2.5. Dans cette famille, Qwen2.5 7B Instruct, sorti le 19 septembre 2024, représente une génération antérieure et une autre taille de modèle.

Qwen3 30B A3B Instruct 2507, sorti le 29 juillet 2025, succède à Qwen3 30B A3B dans la gamme sur OpenRouter. Selon Qwen, cette révision met à jour le mode sans réflexion du modèle d’origine et ne prend en charge que ce mode. Selon Qwen, elle lit nativement 262 144 tokens de contexte. Pour la branche avec réflexion, Qwen présente Qwen3-30B-A3B-Thinking-2507 comme une révision qui ne prend en charge que le mode réflexion.

Qwen3.5-35B-A3B, sorti le 24 février 2026, puis Qwen3.6 35B A3B, sorti le 15 avril 2026, appartiennent à des générations ultérieures de la famille. Ces deux modèles correspondent à une autre taille que celle de Qwen3 30B A3B. La frise des versions situe les modèles dans leur famille et porte leurs dates de sortie.

  1. Qwen3 8B
  2. Qwen3 14B
  3. Qwen3.5-9B
  4. Qwen3.6 27B
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Qwen3 30B A3B est-il sorti ?

Qwen3 30B A3B est sorti le 29 avril 2025. Il précède Qwen3 30B A3B Instruct 2507 dans la gamme.

Combien de paramètres Qwen3 30B A3B active-t-il ?

Qwen3 30B A3B active 3,3 milliards de paramètres, selon Qwen. Son nombre total de paramètres est de 30,5 milliards, selon Qwen.

Quelle est la fenêtre de contexte de Qwen3 30B A3B ?

Qwen3 30B A3B lit nativement 32 768 tokens de contexte, selon Qwen. Avec la méthode YaRN, cette fenêtre atteint 131 072 tokens, selon Qwen.

Comment désactiver la réflexion de Qwen3 30B A3B ?

Qwen3 30B A3B permet de désactiver la réflexion, selon Qwen. Le réglage à utiliser est enable_thinking=False, selon Qwen.

Qwen3 30B A3B fonctionne-t-il avec Ollama ?

Qwen3 30B A3B fait partie des modèles Qwen3 pour lesquels Qwen recommandait Ollama à leur sortie. Selon Qwen, Ollama permettait de les utiliser en local.

Quelle version succède à Qwen3 30B A3B ?

Qwen3 30B A3B a pour successeur Qwen3 30B A3B Instruct 2507 dans la gamme, sur OpenRouter. Cette version porte la désignation Instruct 2507.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.