Revue publiée le Scores mis à jour le
Comparer

Qwen3.5-35B-A3B

Nouvelle version : Qwen3.6 35B A3B

Qwen3.5-35B-A3B est sorti le 24 février 2026 et fait partie, selon Qwen, des modèles Qwen3.5 qui excellent dans l’appel d’outils. Sur OpenRouter, il lit du texte, des images et des vidéos et produit jusqu’à 235 929 tokens par réponse.

Qwen3.5-35B-A3B, Qwen3.5-27B ou Qwen3.5-122B-A10B : lequel choisir ?

Qwen3.5-35B-A3B paraît, à sa sortie le 24 février 2026, aux côtés de Qwen3.5-27B et de Qwen3.5-122B-A10B, selon Qwen.

À sa sortie, Qwen3.5-35B-A3B est un mélange d’experts de 35 milliards de paramètres au total, dont 3 milliards activés, répartis sur 40 couches, selon Qwen. Qwen3.5-27B compte, à sa sortie, 27 milliards de paramètres répartis sur 64 couches, selon Qwen. Pour Qwen3.5-122B-A10B, à sa sortie, le total atteint 122 milliards de paramètres, dont 10 milliards activés, répartis sur 48 couches, selon Qwen.

Sur SWE-bench Verified, à sa sortie, Qwen3.5-35B-A3B obtient 69,2, contre 72,4 pour Qwen3.5-27B et 72,0 pour Qwen3.5-122B-A10B, selon Qwen. À sa sortie, Qwen3.5-35B-A3B obtient également 81,2 sur TAU2-Bench, contre 79,0 pour Qwen3.5-27B et 79,5 pour Qwen3.5-122B-A10B, selon Qwen.

À quoi sert Qwen3.5-35B-A3B

Chat et agents

Qwen3.5-35B-A3B fait partie des modèles Qwen3.5 qui, selon Qwen, excellent dans l’appel d’outils. Pour bâtir rapidement des agents avec les modèles Qwen3.5, Qwen conseille Qwen-Agent. Selon Qwen, la génération Qwen3.5 prend en charge un large répertoire de langues et de dialectes.

Vision et compréhension

Qwen3.5-35B-A3B est, selon Qwen, un modèle de langage causal doté d’un encodeur de vision. Pour ce modèle, Qwen documente l’envoi d’une image ou d’une vidéo accompagnée de texte.

Code

Qwen3.5-35B-A3B dispose, selon Qwen, de réglages d’échantillonnage propres aux tâches de code précises, comme le développement web. Pour ces tâches en mode réflexion, Qwen indique les valeurs suivantes : temperature=0.6, top_p=0.95, top_k=20, min_p=0.0 et presence_penalty=0.0.

Les performances de Qwen3.5-35B-A3B

Qwen3.5-35B-A3B obtient à sa sortie un score de 84,2 sur GPQA Diamond, selon Qwen, contre 82,8 pour GPT-5-mini et 80,1 pour GPT-OSS-120B.

Sur BFCL-V4, qui évalue l’appel de fonctions, Qwen annonce à la sortie du modèle un score de 67,3, contre 55,5 pour GPT-5-mini et 54,8 pour Qwen3-235B-A22B. Pour MMMU et VideoMME avec sous-titres, Qwen annonce à sa sortie des scores respectifs de 81,4 et 86,6, contre 79,0 et 83,5 pour GPT-5-mini et 79,6 et 81,1 pour Claude-Sonnet-4.5.

Bien utiliser Qwen3.5-35B-A3B : réflexion et paramètres

Qwen3.5-35B-A3B réfléchit par défaut et écrit sa réflexion avant la réponse finale, selon Qwen. Sur OpenRouter, la réflexion du modèle n’est pas obligatoire et peut être désactivée. Pour obtenir une réponse directe sans réflexion, le paramètre enable_thinking de l’API se règle sur False, selon Qwen. Les commandes /think et /nothink de Qwen3 ne sont pas officiellement prises en charge par Qwen3.5, selon Qwen.

Qwen conseille de garder au moins 128K tokens de contexte pour préserver les capacités de réflexion des modèles Qwen3.5. Pour la plupart des requêtes, une longueur de réponse de 32 768 tokens convient, selon Qwen. Une longueur de réponse de 81 920 tokens est recommandée pour les problèmes de compétition en mathématiques ou en programmation, selon Qwen.

Caractéristiques techniques de Qwen3.5-35B-A3B

Qwen3.5-35B-A3B est sorti le 24 février 2026. Il est distribué sous licence Apache 2.0. Sur OpenRouter, ses entrées acceptées sont le texte, l’image et la vidéo.

Selon Qwen, le modèle compte 256 experts, dont 8 experts routés et 1 expert partagé activés. Ses 40 couches suivent, selon Qwen, un schéma répété 10 fois : trois couches Gated DeltaNet, qui utilisent une attention linéaire, puis une couche Gated Attention, chacune étant suivie du mélange d’experts.

Selon Qwen, le contexte natif atteint 262 144 tokens et peut être étendu jusqu’à 1 010 000 tokens. Sur OpenRouter, la fenêtre de contexte est de 262 144 tokens. Chaque réponse peut atteindre au plus 235 929 tokens sur OpenRouter. La liste des caractéristiques rassemble les repères techniques du modèle.

Éditeur
Qwen
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
236 k tokens
Réflexion (selon OpenRouter)
Facultative
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, AtlasCloud, Darkbloom, DeepInfra, Parasail, SiliconFlow, Venice

Où utiliser Qwen3.5-35B-A3B, et comment il se facture

  • Poids à télécharger : Qwen3.5-35B-A3B était proposé à sa sortie sur Hugging Face sous licence Apache 2.0, selon Qwen.
  • Cadres de déploiement : selon Qwen, les poids étaient compatibles à sa sortie avec Transformers, vLLM, SGLang et KTransformers.
  • Version hébergée : selon Qwen, Qwen3.5-Flash correspondait à sa sortie à la version hébergée du modèle, accessible par le service d’API officiel fourni par Alibaba Cloud Model Studio. Selon Qwen, cette version proposait des fonctions supplémentaires pour la production, notamment un contexte de 1M par défaut et des outils intégrés officiels.

La carte d’accès donne les derniers prix relevés.

L'API Qwen

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,15 $ / M tokens en entrée, 1 $ / M tokens en sortie.

Tarification0,15 $ en entrée, 1 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, AtlasCloud, Darkbloom, DeepInfra, Parasail, SiliconFlow, Venice

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Qwen3.5-35B-A3B parmi les versions de Qwen

Qwen3.5-35B-A3B appartient à la génération Qwen3.5, venue après la génération Qwen3 dont fait partie Qwen3 30B A3B. Selon Qwen, cette génération commence avec Qwen3.5-397B-A17B, un modèle MoE, une architecture qui mobilise un mélange d’experts. La frise des versions situe ces modèles dans l’histoire de la famille et porte leurs dates de sortie.

Selon Qwen, Qwen3.5-9B, Qwen3.5-4B, Qwen3.5-2B et Qwen3.5-0.8B rejoignent ensuite la génération Qwen3.5 lors de leur mise à disposition sur Hugging Face et ModelScope. Qwen3.6 35B A3B succède à Qwen3.5-35B-A3B dans la gamme sur OpenRouter. Dans son annonce de Qwen3.6 35B A3B, Qwen indique une nette progression face à son prédécesseur direct, Qwen3.5-35B-A3B, surtout pour les tâches de code en agent et de raisonnement.

  1. Qwen3 8B
  2. Qwen3 14B
  3. Qwen3.5-9B
  4. Qwen3.6 27B
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Qwen3.5-35B-A3B est-il sorti ?

Qwen3.5-35B-A3B est sorti le 24 février 2026. Qwen en publie les poids sur Hugging Face.

Combien de paramètres actifs compte Qwen3.5-35B-A3B ?

Qwen3.5-35B-A3B active 3 milliards de paramètres, selon Qwen. Son nombre total de paramètres est de 35 milliards, selon Qwen.

Quelle est la fenêtre de contexte de Qwen3.5-35B-A3B ?

Qwen3.5-35B-A3B possède une fenêtre de contexte native de 262 144 tokens, selon Qwen. Elle est extensible jusqu’à 1 010 000 tokens, selon Qwen.

Qwen3.5-35B-A3B est-il open source ?

Qwen3.5-35B-A3B est distribué avec des poids publics sur Hugging Face par Qwen. Ces poids sont publiés sous licence Apache 2.0.

Qwen3.5-35B-A3B est-il multimodal ?

Qwen3.5-35B-A3B est un modèle de langage causal doté d’un encodeur de vision, selon Qwen. Il accepte une image ou une vidéo accompagnée de texte, selon les exemples d’utilisation documentés par Qwen.

Quelle version succède à Qwen3.5-35B-A3B ?

Qwen3.5-35B-A3B a pour successeur Qwen3.6 35B A3B, selon Qwen. Il s’agit d’une succession directe, selon Qwen.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.