Nemotron 3 Super est un modèle publié par NVIDIA, sorti le 11 mars 2026. Selon NVIDIA, ce modèle de raisonnement et de conversation lit et produit du texte, et il est destiné aux développeurs de systèmes d’agents, de chatbots et de systèmes RAG.
Nemotron 3 Super ou Nemotron 3 Nano : lequel choisir ?
Nemotron 3 Super rejoint, à sa sortie, une gamme où NVIDIA proposait déjà Nemotron 3 Nano 30B A3B sur OpenRouter. Selon NVIDIA, Super se distingue alors de Nano par ses couches de prédiction multi-tokens (MTP), qui accélèrent la génération de texte, et par son entraînement en quantification NVFP4. Nano est, selon NVIDIA, un modèle ouvert à mélange d’experts, doté d’une architecture hybride Mamba-Transformer et conçu pour le raisonnement agentique.
À quoi sert Nemotron 3 Super
Chat
Nemotron 3 Super est, selon NVIDIA, un modèle généraliste de raisonnement et de conversation destiné aux développeurs d’agents, de chatbots et de systèmes RAG, qui associent recherche documentaire et génération de réponses. Selon NVIDIA, il est optimisé pour les agents qui collaborent et les gros volumes de tâches, comme l’automatisation des tickets informatiques. Dans un système multi-agents, il gère des sous-tâches complexes avec des appels d’outils de haute précision, selon NVIDIA. Sur OpenRouter, le modèle prend en charge l’appel d’outils et les sorties structurées.
Suivi de consignes
Nemotron 3 Super convient au suivi de consignes complexes, selon NVIDIA. Pour les tâches de raisonnement, il peut également travailler sur de longs contextes, selon NVIDIA.
Code
Nemotron 3 Super peut recevoir une base de code entière dans son contexte pour un agent de développement logiciel, selon NVIDIA. Cet agent peut générer et déboguer du code de bout en bout sans découper les documents, selon NVIDIA.
Nemotron 3 Super offre, selon NVIDIA à sa sortie, un débit jusqu’à 5 fois supérieur à celui du modèle Nemotron Super précédent. NVIDIA annonce aussi, à sa sortie, une précision jusqu’à 2 fois supérieure à celle de ce même modèle. Le tableau rassemble les scores annoncés par NVIDIA sur sa carte Hugging Face, avec les conditions d’évaluation indiquées pour chaque test.
Évaluation
Domaine
Score annoncé par NVIDIA à la sortie
MMLU-Pro
Connaissances et raisonnement
83,73
GPQA sans outils
Raisonnement scientifique
79,23
HMMT Feb25 avec outils
Mathématiques
94,73
LiveCodeBench v5
Programmation
81,19
SciCode, sous-tâches
Programmation scientifique
42,05
Terminal Bench, sous-ensemble difficile
Exécution de tâches dans un terminal
25,78
TauBench V2
Agents utilisant des outils
61,15 en moyenne
IFBench, prompt
Suivi des instructions
72,58
Arena-Hard-V2, Hard Prompt
Réponses à des requêtes difficiles
73,88
RULER-500 à 128k tokens
Compréhension de longs contextes
96,79
RULER-500 à 512k tokens
Compréhension de longs contextes
96,09
Bien utiliser Nemotron 3 Super : réflexion et effort
Activer ou couper la réflexion : Nemotron 3 Super produit une trace de raisonnement avant sa réponse finale, selon NVIDIA. Le paramètre enable_thinking active ou coupe ce mode dans le modèle de chat, selon NVIDIA. Sur OpenRouter, la réflexion est activée par défaut, mais elle peut être désactivée.
Réduire l’effort de réflexion : selon NVIDIA, le mode low_effort utilise nettement moins de tokens de raisonnement que la réflexion complète. Sur OpenRouter, les niveaux d’effort proposés sont medium et low, medium par défaut.
Régler la génération : NVIDIA recommande une température de 1,0 et un top_p de 0,95 pour toutes les tâches. Selon NVIDIA, ces valeurs s’appliquent au raisonnement, à l’appel d’outils et à la conversation.
Caractéristiques techniques de Nemotron 3 Super
Nemotron 3 Super est sorti le 11 mars 2026. Le bloc des caractéristiques présente les données techniques du modèle.
Selon NVIDIA, le modèle compte 120 milliards de paramètres, dont 12 milliards actifs. Son architecture hybride LatentMoE, un mélange d’experts latent, alterne des couches Mamba-2 et MoE avec quelques couches d’attention, selon NVIDIA. Il accepte jusqu’à 1 million de tokens de contexte selon NVIDIA. Sur OpenRouter, la fenêtre de contexte est de 262 144 tokens. Une réponse peut atteindre 235 929 tokens sur OpenRouter.
Selon NVIDIA, le modèle lit et produit du texte en anglais, français, allemand, italien, japonais, espagnol et chinois. Ses données de post-entraînement s’arrêtent en février 2026, selon NVIDIA. Pour le pré-entraînement, les données s’arrêtent en juin 2025, selon NVIDIA. Le modèle est publié sous la licence NVIDIA Nemotron Open Model License et prêt pour un usage commercial, selon la carte Hugging Face de NVIDIA.
Éditeur
NVIDIA
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
236 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Entrées (selon OpenRouter)
Texte
Licence
NVIDIA Nemotron Open Model License
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Nemotron 3 Super, et comment il se facture
Nemotron 3 Super était accessible via des services hébergés à sa sortie, selon NVIDIA. Les cartes d’accès donnent les derniers prix relevés.
Déploiement des poids ouverts : Selon NVIDIA, les développeurs peuvent déployer et personnaliser les poids du modèle sur une station de travail, dans un centre de données ou dans le cloud.
Service en local : Selon la documentation de NVIDIA, le modèle peut être servi avec vLLM, SGLang ou TRT-LLM, derrière une API compatible avec celle d’OpenAI.
Contexte du service : Selon la documentation de NVIDIA, le contexte est de 256k tokens par défaut et peut atteindre 1 million de tokens après réglage.
L'API chez des hébergeurs
Servi par d'autres hébergeurs que NVIDIA, selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,080 $ / M tokens en entrée, 0,45 $ / M tokens en sortie.
Tarification0,080 $ en entrée, 0,45 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
FAQ
Quand Nemotron 3 Super est-il sorti ?
Nemotron 3 Super est sorti en mars 2026, selon NVIDIA. Selon NVIDIA, la date exacte de sortie est le 11 mars 2026.
Nemotron 3 Super est-il un modèle ouvert ?
Nemotron 3 Super est publié à poids ouverts, selon NVIDIA. Selon NVIDIA, sa distribution relève de la licence NVIDIA Nemotron Open Model License.
Quel matériel faut-il pour faire tourner Nemotron 3 Super ?
Selon NVIDIA, la version FP8 de Nemotron 3 Super demande au minimum deux GPU H100 de 80 Go, ou un seul GPU B200 ou B300. Selon NVIDIA, la version BF16 demande au minimum huit GPU H100 de 80 Go, ou deux GPU B200 ou B300.
Nemotron 3 Super comprend-il le français ?
Nemotron 3 Super prend en charge le français, selon NVIDIA. Selon NVIDIA, le français fait partie des sept langues prises en charge par le modèle.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.