Revue publiée le Scores mis à jour le
Comparer

Qwen3 14B

Qwen3 14B, publié par Qwen et sorti le 29 avril 2025, accepte du texte en entrée sur OpenRouter et peut générer du code selon Qwen. Selon Qwen, il associe un mode de réflexion pour le raisonnement logique complexe, les mathématiques et le code à un mode sans réflexion pour le dialogue généraliste.

Qwen3 14B, Qwen3 8B ou Qwen3 32B : lequel choisir ?

Qwen3 14B appartenait, à sa sortie, à une génération comprenant six modèles denses sous licence Apache 2.0, selon Qwen : Qwen3-32B, Qwen3-14B, Qwen3-8B, Qwen3-4B, Qwen3-1.7B et Qwen3-0.6B. Selon Qwen, cette génération comprenait aussi deux modèles MoE, à mélange d’experts : Qwen3-235B-A22B et Qwen3-30B-A3B.

Selon Qwen, à la sortie de Qwen3 14B, Qwen3-8B avait 36 couches, Qwen3-14B en avait 40 et Qwen3-32B en avait 64. Pour la longueur de contexte, selon Qwen, ces trois modèles partageaient une capacité de 128K, contre 32K pour les modèles denses Qwen3-4B, Qwen3-1.7B et Qwen3-0.6B de la même génération.

À quoi sert Qwen3 14B

Chat et agents

Qwen3 14B permet de passer, dans un même modèle, de la réflexion au dialogue généraliste sans réflexion, selon Qwen. Pour les agents, les modèles Qwen3 excellent dans l’appel d’outils selon Qwen, qui conseille Qwen-Agent pour exploiter cette capacité. Selon Qwen, l’exemple d’agent proposé utilise Qwen3-14B comme modèle.

Mathématiques

Qwen3 14B utilise le mode de réflexion pour le raisonnement logique complexe, les mathématiques et le code, selon Qwen. En mathématiques, en génération de code et en raisonnement logique de sens commun, les modèles Qwen3 dépassent QwQ en mode réflexion et les modèles Qwen2.5 Instruct en mode sans réflexion, selon Qwen.

Suivi de consignes

Les modèles Qwen3 excellent en suivi de consignes, en écriture créative, en jeu de rôle et en dialogue à plusieurs tours, selon Qwen. Pour les échanges multilingues, les modèles Qwen3 prennent en charge un large éventail de langues et de dialectes, avec le suivi de consignes en plusieurs langues et la traduction, selon Qwen.

  • Chat
  • Suivi de consignes
  • Mathématiques

Bien utiliser Qwen3 14B : réflexion et paramètres

Qwen3 14B permet de désactiver la réflexion sur OpenRouter. Selon Qwen, le paramètre enable_thinking=True l’active par défaut : le modèle écrit alors sa réflexion dans un bloc séparé, avant la réponse finale.

Avec enable_thinking=False, la réflexion est strictement désactivée selon Qwen, comme sur les modèles Qwen2.5-Instruct. Lorsque la réflexion est activée, les commandes /think et /no_think permettent de passer d’un mode à l’autre, tour par tour, selon Qwen. Ces commandes se placent dans le message de l’utilisateur ou dans le message système, selon Qwen.

En mode réflexion, les paramètres recommandés selon Qwen sont Temperature=0.6, TopP=0.95, TopK=20 et MinP=0. Sans réflexion, les réglages suggérés selon Qwen deviennent Temperature=0.7, TopP=0.8, TopK=20 et MinP=0. Avec la réflexion activée, le décodage glouton est déconseillé selon Qwen, car il peut dégrader les performances et provoquer des répétitions sans fin.

Pour la plupart des requêtes, une longueur de sortie de 32 768 tokens est recommandée selon Qwen. Lors des évaluations portant sur des problèmes très complexes, une longueur de sortie de 38 912 tokens est suggérée selon Qwen, notamment pour les problèmes issus des compétitions de mathématiques et de programmation.

Caractéristiques techniques de Qwen3 14B

Qwen3 14B est sorti le 29 avril 2025. Selon Qwen, ce modèle de langage causal compte 14,8 milliards de paramètres, dont 13,2 milliards hors embeddings, les représentations numériques des éléments du langage, répartis sur 40 couches. Sur OpenRouter, il accepte le texte en entrée. Sa licence est Apache 2.0.

Selon Qwen, le contexte natif atteint 32 768 tokens, les unités de texte traitées par le modèle, et s’étend à 131 072 tokens avec la méthode YaRN. Sur OpenRouter, la fenêtre de contexte est de 131 072 tokens. Chaque réponse peut atteindre au plus 16 384 tokens sur OpenRouter. La liste des caractéristiques rassemble les repères techniques du modèle.

Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
131 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
mars 2025
Entrées (selon OpenRouter)
Texte
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, DeepInfra, NextBit

Où utiliser Qwen3 14B, et comment il se facture

  • Poids à télécharger : Qwen3 14B est publié sur Hugging Face sous licence Apache 2.0, selon la carte de modèle de Qwen. Ces poids permettent de l’héberger soi-même.
  • Déploiement sur ton serveur : selon la carte de modèle de Qwen, SGLang ou vLLM permettent de déployer le modèle et de créer un point d’accès compatible avec l’API d’OpenAI.
  • Utilisation en local : à sa sortie, selon Qwen, Ollama, LMStudio, MLX, llama.cpp et KTransformers étaient vivement recommandés pour utiliser les modèles Qwen3 en local.

La carte d’accès donne les derniers prix relevés.

L'API Qwen

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,12 $ / M tokens en entrée, 0,24 $ / M tokens en sortie.

Tarification0,12 $ en entrée, 0,24 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, DeepInfra, NextBit

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Qwen3 14B parmi les versions de Qwen

Qwen3 14B appartient à la génération Qwen3 de la famille Qwen. La frise des versions situe le modèle parmi les générations de cette famille et porte leurs dates de sortie.

Qwen2.5 7B Instruct, sorti le 19 septembre 2024, relève de la génération Qwen2.5 et d’une autre taille. Selon Qwen, la génération Qwen3 a été préentraînée sur environ 36 billions de tokens couvrant des langues et dialectes variés, près de deux fois les 18 billions de Qwen2.5. D’autres tailles apparaissent ensuite dans la famille : Qwen3.5 397B A17B, sorti le 15 février 2026, puis Qwen3.8 2.4T A95B, sorti le 12 août 2026.

  1. Qwen3 8B
  2. Qwen3.5-9B
  3. Qwen3.6 27B
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Qwen3 14B est-il sorti ?

Qwen3 14B est sorti le 29 avril 2025. Cette date concerne la version 14B de la gamme Qwen3.

Quelle est la fenêtre de contexte de Qwen3 14B ?

Qwen3 14B lit nativement 32 768 tokens de contexte, selon Qwen. Avec la méthode YaRN, cette fenêtre peut atteindre 131 072 tokens, selon Qwen.

Qwen3 14B est-il open source ?

Qwen3 14B dispose de poids publiés par Qwen sur Hugging Face sous licence Apache 2.0.

Comment désactiver la réflexion de Qwen3 14B ?

Qwen3 14B permet de désactiver la réflexion, selon Qwen. Pour obtenir ce comportement, le réglage est enable_thinking=False, selon Qwen.

Qwen3 14B fonctionne-t-il avec Ollama ?

Qwen3 14B pouvait être utilisé en local avec Ollama à sa sortie, selon Qwen. À sa sortie, Qwen recommandait vivement cet outil pour utiliser les modèles Qwen3 en local.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.