Mistral Small 4 est un modèle de Mistral AI, présenté le 16 mars 2026, qui lit le texte et les images. Il réunit raisonnement, multimodal et code agentique dans un seul modèle à poids ouverts, avec une fenêtre de 262 144 tokens.
Ce que Mistral Small 4 change par rapport à Mistral Small 3.2
Mistral AI a présenté Mistral Small 4 le 16 mars 2026 comme la nouvelle version majeure de la famille Mistral Small, après Mistral Small 3.2 24B. Selon l’éditeur, c’est son premier modèle à réunir en un seul les capacités de Magistral pour le raisonnement, de Pixtral pour le multimodal et de Devstral pour le code agentique.
L’autre nouveauté est le paramètre reasoning_effort, qui règle le comportement du modèle à chaque requête. Réglé sur « none », il donne, selon Mistral AI, des réponses rapides et légères dans le même style de conversation que Mistral Small 3.2 ; réglé sur « high », il raisonne pas à pas sur les problèmes complexes.
Par rapport à la version précédente
Mistral Small 3.2 24BMistral Small 4
Contexte maximal (selon OpenRouter)256 k→262 k+6 k
Réflexion (selon OpenRouter)Non prise en charge→Sur demandeModifié
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,094 $ / M tokens→0,15 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)0,25 $ / M tokens→0,60 $ / M tokens
Mistral Small 4, Mistral Medium 3.1 ou Mistral Large 3 : lequel choisir ?
Version
Position à sa sortie
Pour qui
Mistral Small 4
Facturé sous Mistral Medium 3.1 et Mistral Large 3
Assistants de conversation, documents et images, mathématiques, code agentique (selon Mistral AI)
Mistral Medium 3.1
Déjà en ligne, facturé au-dessus de Mistral Small 4
Pour viser un palier au-dessus de Mistral Small 4
Mistral Large 3 2512
Déjà en ligne, facturé au-dessus de Mistral Small 4
Pour viser un palier au-dessus de Mistral Small 4
À sa sortie, le 16 mars 2026, Mistral proposait déjà Mistral Medium 3.1 et Mistral Large 3 2512, tous deux facturés au-dessus de Mistral Small 4.
À quoi sert Mistral Small 4
Mistral AI destine Mistral Small 4 à trois publics : les entreprises, pour les assistants de conversation, la compréhension de documents et l’analyse multimodale ; les chercheurs, pour les mathématiques et le raisonnement complexe ; les développeurs, pour le code.
Chat
Selon Mistral AI, Mistral Small 4 est conçu pour les assistants de conversation généralistes. Il prend en charge des dizaines de langues, dont le français, l’anglais, l’espagnol et l’allemand, et, réglé sur « none », il répond vite dans le style de conversation de Mistral Small 3.2.
Vision et compréhension
Mistral Small 4 analyse les images en plus du texte. Selon Mistral AI, sa multimodalité sert à comprendre des documents et des images pour en extraire et en analyser les données.
Mathématiques
Mistral AI le destine aux chercheurs pour les mathématiques, la recherche et les tâches de raisonnement complexe. Pour ces demandes complexes, l’éditeur recommande le réglage « high ».
Code
Pour les développeurs, Mistral AI annonce l’automatisation du code, l’exploration d’une base de code et les flux de travail agentiques sur le code, les capacités qu’il reprend de Devstral. Sur OpenRouter, Mistral Small 4 sait aussi appeler des outils et produire des sorties structurées.
À sa sortie, Mistral AI annonce pour Mistral Small 4, par rapport à Mistral Small 3, un temps de réponse de bout en bout réduit de 40 % dans une installation optimisée pour la latence, et trois fois plus de requêtes par seconde dans une installation optimisée pour le débit.
Avec le raisonnement activé, Mistral AI annonce que Mistral Small 4 égale ou dépasse GPT-OSS 120B sur ses trois tests de comparaison, avec des réponses nettement plus courtes. Sur AA LCR, l’éditeur donne un score de 0,72 avec des réponses de 1,6 millier de signes, quand les modèles Qwen produisent 3,5 à 4 fois plus de texte pour un résultat comparable. Sur LiveCodeBench, il annonce que Mistral Small 4 dépasse GPT-OSS 120B avec 20 % de texte en moins.
Ce sont des chiffres de l’éditeur, publiés le 16 mars 2026 : ils disent ce que Mistral AI met en avant à la sortie, la longueur des réponses autant que le score, pas un classement du jour.
Bien utiliser Mistral Small 4 : réflexion et effort
Sur OpenRouter, la réflexion de Mistral Small 4 est désactivée par défaut. Selon Mistral AI, elle se règle à chaque requête avec le paramètre reasoning_effort : « none » pour une réponse rapide, « high », que l’éditeur recommande pour les demandes complexes, pour un raisonnement pas à pas.
Avec « high », selon Mistral AI, le modèle raisonne de façon aussi détaillée que les précédents modèles Magistral, et l’éditeur conseille une température de 0,7. Avec « none », il conseille une température de 0,0 à 0,7 selon la tâche.
La réflexion n’est pas obligatoire : elle se désactive.
Caractéristiques techniques de Mistral Small 4
Mistral Small 4 lit du texte et des images, avec une fenêtre de contexte de 262 144 tokens et, sur OpenRouter, une sortie maximale de 209 715 tokens par réponse. Le tableau des caractéristiques donne la liste complète.
Selon Mistral AI, le modèle repose sur un mélange d’experts : 128 experts, dont 4 actifs par token. Il compte 119 milliards de paramètres au total, dont 6 milliards actifs par token, ou 8 milliards en comptant les couches d’embedding et de sortie. Sa licence, Apache 2.0, permet l’usage commercial comme l’usage non commercial.
Éditeur
Mistral AI
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
210 k tokens
Réflexion (selon OpenRouter)
Sur demande
Entrées (selon OpenRouter)
Texte, Image
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Mistral Small 4, et comment il se facture
API de Mistral AI : dès sa sortie, Mistral Small 4 est disponible sur l’API de Mistral AI et dans AI Studio. Les prix de l’API sont dans les cartes d’accès.
Poids ouverts : Mistral AI publie ses poids sur Hugging Face, sous licence Apache 2.0.
Déploiement chez soi : selon Mistral AI, il s’affine pour des tâches spécialisées ou se déploie tel quel, et il est disponible sur vLLM, llama.cpp, SGLang et Transformers.
Matériel minimum : selon Mistral AI, le faire tourner demande au minimum 4 NVIDIA HGX H100, 2 NVIDIA HGX H200 ou 1 NVIDIA DGX B200.
NVIDIA : Mistral AI annonce un essai gratuit sur l’infrastructure de NVIDIA et, dès sa sortie, une version NVIDIA NIM pour la production.
OpenRouter : Mistral Small 4 y est proposé, aussi en traitement par lot (batch), pour des envois groupés plutôt qu’un échange en temps réel.
L'API Mistral AI
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,15 $ / M tokens en entrée, 0,60 $ / M tokens en sortie.
Tarification0,15 $ en entrée, 0,60 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Mistral Small 4 parmi les versions de Mistral Small
Selon Mistral AI, Mistral Small 4 est la nouvelle version majeure de la famille Mistral Small. Il succède à Mistral Small 3.2 24B, sorti le 20 juin 2025, lui-même venu après Mistral Small 3.1 24B, sorti le 17 mars 2025.
Mistral Small 4 sort le 16 mars 2026, près de neuf mois après Mistral Small 3.2. Les deux versions précédentes portent « 24B » dans leur nom ; Mistral Small 4 compte, selon l’éditeur, 119 milliards de paramètres au total, dont 6 milliards actifs par token. La frise situe chaque version de la famille par sa date de sortie.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Mistral Small 4Vous êtes ici
Mistral Small 3
Mistral Small 3.1 24B
Mistral Small 3.2 24B
Score
1274
Sortie
Contexte
262 k tokens
33 k tokens
128 k tokens
256 k tokens
Prix d'entrée
0,15 $ / M tokens
0,050 $ / M tokens
0,35 $ / M tokens
0,094 $ / M tokens
Prix de sortie
0,60 $ / M tokens
0,080 $ / M tokens
0,56 $ / M tokens
0,25 $ / M tokens
Entrées
Texte, Image
Texte
Texte, Image
Texte, Image
Réflexion
Sur demande
Non prise en charge
Non prise en charge
Non prise en charge
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Ce qui le distingue
Mistral Small 4 est un modèle de Mistral AI, présenté le 16 mars 2026, qui lit le texte et les images. Il réunit raisonnement, multimodal et code agentique dans un seul modèle à poids ouverts, avec une fenêtre de 262 144 tokens.
Mistral Small 3 est un modèle publié par Mistral AI le 30 janvier 2025. Sur OpenRouter, il lit du texte ; selon Mistral AI à sa sortie, il produit des réponses pour l'assistance conversationnelle rapide et prend en charge l'appel de fonctions.
Mistral Small 3.2 24B, publié par Mistral AI le 20 juin 2025, lit du texte et des images. La documentation de Mistral AI lui attribue les sorties structurées, l'appel de fonctions et les questions sur des documents.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Mistral Small 4 est-il sorti ?
Mistral AI a présenté Mistral Small 4 le 16 mars 2026, sur son API et dans AI Studio, avec ses poids publiés sur Hugging Face.
Combien de paramètres compte Mistral Small 4 ?
Selon Mistral AI, Mistral Small 4 compte 119 milliards de paramètres au total, dont 6 milliards actifs par token (8 milliards en comptant les couches d’embedding et de sortie).
Quels modèles Mistral sont au-dessus de Mistral Small 4 ?
À la sortie de Mistral Small 4, Mistral proposait Mistral Medium 3.1 et Mistral Large 3 2512, tous deux facturés au-dessus de lui. Mistral AI destine Small 4 aux assistants de conversation, à l’analyse de documents et d’images, aux mathématiques et au code agentique.
Est-ce que l’IA mistral est gratuite ?
Mistral Small 4 est publié sous licence Apache 2.0 : ses poids, sur Hugging Face, s’utilisent librement, y compris pour un usage commercial, à condition d’avoir le matériel (au minimum 4 NVIDIA HGX H100, selon Mistral AI). L’éditeur annonce aussi un essai gratuit sur l’infrastructure de NVIDIA ; sur OpenRouter, il se facture à l’usage.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.