Revue publiée le Scores mis à jour le
Comparer

NVIDIA : Nemotron 3 Super

Nemotron 3 Super est un modèle publié par NVIDIA, sorti le 11 mars 2026. Selon NVIDIA, ce modèle de raisonnement et de conversation lit et produit du texte, et il est destiné aux développeurs de systèmes d’agents, de chatbots et de systèmes RAG.

Nemotron 3 Super ou Nemotron 3 Nano : lequel choisir ?

Nemotron 3 Super rejoint, à sa sortie, une gamme où NVIDIA proposait déjà Nemotron 3 Nano 30B A3B sur OpenRouter. Selon NVIDIA, Super se distingue alors de Nano par ses couches de prédiction multi-tokens (MTP), qui accélèrent la génération de texte, et par son entraînement en quantification NVFP4. Nano est, selon NVIDIA, un modèle ouvert à mélange d’experts, doté d’une architecture hybride Mamba-Transformer et conçu pour le raisonnement agentique.

À quoi sert Nemotron 3 Super

Chat

Nemotron 3 Super est, selon NVIDIA, un modèle généraliste de raisonnement et de conversation destiné aux développeurs d’agents, de chatbots et de systèmes RAG, qui associent recherche documentaire et génération de réponses. Selon NVIDIA, il est optimisé pour les agents qui collaborent et les gros volumes de tâches, comme l’automatisation des tickets informatiques. Dans un système multi-agents, il gère des sous-tâches complexes avec des appels d’outils de haute précision, selon NVIDIA. Sur OpenRouter, le modèle prend en charge l’appel d’outils et les sorties structurées.

Suivi de consignes

Nemotron 3 Super convient au suivi de consignes complexes, selon NVIDIA. Pour les tâches de raisonnement, il peut également travailler sur de longs contextes, selon NVIDIA.

Code

Nemotron 3 Super peut recevoir une base de code entière dans son contexte pour un agent de développement logiciel, selon NVIDIA. Cet agent peut générer et déboguer du code de bout en bout sans découper les documents, selon NVIDIA.

  • Chat
  • Suivi de consignes
  • Code

Les performances de Nemotron 3 Super

Nemotron 3 Super offre, selon NVIDIA à sa sortie, un débit jusqu’à 5 fois supérieur à celui du modèle Nemotron Super précédent. NVIDIA annonce aussi, à sa sortie, une précision jusqu’à 2 fois supérieure à celle de ce même modèle. Le tableau rassemble les scores annoncés par NVIDIA sur sa carte Hugging Face, avec les conditions d’évaluation indiquées pour chaque test.

ÉvaluationDomaineScore annoncé par NVIDIA à la sortie
MMLU-ProConnaissances et raisonnement83,73
GPQA sans outilsRaisonnement scientifique79,23
HMMT Feb25 avec outilsMathématiques94,73
LiveCodeBench v5Programmation81,19
SciCode, sous-tâchesProgrammation scientifique42,05
Terminal Bench, sous-ensemble difficileExécution de tâches dans un terminal25,78
TauBench V2Agents utilisant des outils61,15 en moyenne
IFBench, promptSuivi des instructions72,58
Arena-Hard-V2, Hard PromptRéponses à des requêtes difficiles73,88
RULER-500 à 128k tokensCompréhension de longs contextes96,79
RULER-500 à 512k tokensCompréhension de longs contextes96,09

Bien utiliser Nemotron 3 Super : réflexion et effort

  1. Activer ou couper la réflexion : Nemotron 3 Super produit une trace de raisonnement avant sa réponse finale, selon NVIDIA. Le paramètre enable_thinking active ou coupe ce mode dans le modèle de chat, selon NVIDIA. Sur OpenRouter, la réflexion est activée par défaut, mais elle peut être désactivée.
  2. Réduire l’effort de réflexion : selon NVIDIA, le mode low_effort utilise nettement moins de tokens de raisonnement que la réflexion complète. Sur OpenRouter, les niveaux d’effort proposés sont medium et low, medium par défaut.
  3. Régler la génération : NVIDIA recommande une température de 1,0 et un top_p de 0,95 pour toutes les tâches. Selon NVIDIA, ces valeurs s’appliquent au raisonnement, à l’appel d’outils et à la conversation.

Caractéristiques techniques de Nemotron 3 Super

Nemotron 3 Super est sorti le 11 mars 2026. Le bloc des caractéristiques présente les données techniques du modèle.

Selon NVIDIA, le modèle compte 120 milliards de paramètres, dont 12 milliards actifs. Son architecture hybride LatentMoE, un mélange d’experts latent, alterne des couches Mamba-2 et MoE avec quelques couches d’attention, selon NVIDIA. Il accepte jusqu’à 1 million de tokens de contexte selon NVIDIA. Sur OpenRouter, la fenêtre de contexte est de 262 144 tokens. Une réponse peut atteindre 235 929 tokens sur OpenRouter.

Selon NVIDIA, le modèle lit et produit du texte en anglais, français, allemand, italien, japonais, espagnol et chinois. Ses données de post-entraînement s’arrêtent en février 2026, selon NVIDIA. Pour le pré-entraînement, les données s’arrêtent en juin 2025, selon NVIDIA. Le modèle est publié sous la licence NVIDIA Nemotron Open Model License et prêt pour un usage commercial, selon la carte Hugging Face de NVIDIA.

Éditeur
NVIDIA
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
236 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Entrées (selon OpenRouter)
Texte
Licence
NVIDIA Nemotron Open Model License
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
DeepInfra, DekaLLM

Où utiliser Nemotron 3 Super, et comment il se facture

Nemotron 3 Super était accessible via des services hébergés à sa sortie, selon NVIDIA. Les cartes d’accès donnent les derniers prix relevés.

  • Déploiement des poids ouverts : Selon NVIDIA, les développeurs peuvent déployer et personnaliser les poids du modèle sur une station de travail, dans un centre de données ou dans le cloud.
  • Service en local : Selon la documentation de NVIDIA, le modèle peut être servi avec vLLM, SGLang ou TRT-LLM, derrière une API compatible avec celle d’OpenAI.
  • Contexte du service : Selon la documentation de NVIDIA, le contexte est de 256k tokens par défaut et peut atteindre 1 million de tokens après réglage.

L'API chez des hébergeurs

Servi par d'autres hébergeurs que NVIDIA, selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,080 $ / M tokens en entrée, 0,45 $ / M tokens en sortie.

Tarification0,080 $ en entrée, 0,45 $ en sortie, par million de tokens
Hébergé via OpenRouter chezDeepInfra, DekaLLM

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

FAQ

Quand Nemotron 3 Super est-il sorti ?

Nemotron 3 Super est sorti en mars 2026, selon NVIDIA. Selon NVIDIA, la date exacte de sortie est le 11 mars 2026.

Nemotron 3 Super est-il un modèle ouvert ?

Nemotron 3 Super est publié à poids ouverts, selon NVIDIA. Selon NVIDIA, sa distribution relève de la licence NVIDIA Nemotron Open Model License.

Quel matériel faut-il pour faire tourner Nemotron 3 Super ?

Selon NVIDIA, la version FP8 de Nemotron 3 Super demande au minimum deux GPU H100 de 80 Go, ou un seul GPU B200 ou B300. Selon NVIDIA, la version BF16 demande au minimum huit GPU H100 de 80 Go, ou deux GPU B200 ou B300.

Nemotron 3 Super comprend-il le français ?

Nemotron 3 Super prend en charge le français, selon NVIDIA. Selon NVIDIA, le français fait partie des sept langues prises en charge par le modèle.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.