Revue publiée le Scores mis à jour le
Comparer

MiniMax M3

MiniMax M3 est un modèle de MiniMax, sorti le 1er juin 2026 selon l’éditeur, qui lit le texte, l’image et la vidéo et répond en texte. Il succède à MiniMax M2.7 ; selon MiniMax, le code et les tâches d’agent sont ses principaux axes de progrès. Il a une fenêtre d’un million de tokens et des poids ouverts.

Ce que MiniMax M3 change par rapport à MiniMax M2.7

MiniMax M3 succède à MiniMax M2.7, sorti le 18 mars 2026. Le tableau d’écart met les deux versions côte à côte.

La fenêtre de contexte passe de 204 800 tokens chez MiniMax M2.7 à 1 048 576 tokens chez MiniMax M3. Les entrées, limitées au texte chez MiniMax M2.7, s’ouvrent à l’image et à la vidéo ; les deux versions répondent en texte. Enfin, sur OpenRouter, la réflexion, obligatoire chez MiniMax M2.7, devient facultative : chez MiniMax M3, elle se désactive.

Par rapport à la version précédente

MiniMax M2.7MiniMax M3
Score14061461+55
Contexte maximal (selon OpenRouter)205 k1,05 M+844 k
Formats compris (selon OpenRouter)textetexte, image, vidéo
Réflexion (selon OpenRouter)Toujours activeFacultativeModifié
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,21 $ / M tokens0,30 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)0,84 $ / M tokens1,20 $ / M tokens

À quoi sert MiniMax M3

MiniMax M3 lit le texte, l’image et la vidéo, et répond en texte. Selon MiniMax, le code et les tâches d’agent sont les principaux axes de progrès de cette version.

Chat

Selon MiniMax, réflexion désactivée, MiniMax M3 répond plus vite, ce qui convient aux usages sensibles au délai de réponse comme la conversation. Réflexion activée, l’éditeur le destine plutôt au raisonnement complexe et à la collaboration longue.

Vision et compréhension

MiniMax M3 accepte l’image et la vidéo en entrée, à côté du texte : selon MiniMax, c’est un modèle nativement multimodal, qui peut aussi piloter un ordinateur de bureau.

Code

Selon MiniMax, MiniMax M3 progresse nettement par rapport à MiniMax M2 en correction de bugs, en développement front-end et back-end et en optimisation des performances. Réflexion désactivée, l’éditeur le destine aussi à la complétion de code, quand le délai de réponse compte.

Sur OpenRouter, le modèle sait appeler des outils et produire des sorties structurées.

Les performances de MiniMax M3

À sa sortie, MiniMax annonce pour MiniMax M3 59,0 % sur SWE-Bench Pro et 66,0 % sur Terminal-Bench 2.1, des scores mesurés sur sa propre infrastructure, ainsi que 34,8 % sur SWE-fficiency, 28,8 % sur KernelBench Hard et 74,2 % sur MCP Atlas. Ce sont les chiffres de l’éditeur, sur des tests qu’il a choisis, pas une mesure indépendante.

MiniMax décrit aussi deux tâches longues menées sans intervention humaine. Dans la première, selon l’éditeur, en environ 24 heures et 147 soumissions, MiniMax M3 a fait passer l’utilisation de la puissance de crête FP8 d’un GPU NVIDIA Hopper de 7,6 % à 71,3 % sur un noyau de calcul qu’il optimisait, soit une accélération de 9,4 fois. Dans la seconde, il a reproduit seul, en près de 12 heures, les expériences centrales d’un article primé à ICLR 2025, avec 18 commits et 23 figures.

Bien utiliser MiniMax M3 : les modes de réflexion

Selon la carte du modèle publiée par MiniMax sur Hugging Face, MiniMax M3 a trois modes de réflexion, choisis par le paramètre « thinking ».

  1. Active la réflexion (enabled) : selon MiniMax, ce mode convient au raisonnement complexe, aux tâches d’agent et à la collaboration longue.
  2. Passe en mode adaptatif (adaptive) : MiniMax M3 décide lui-même quand une réflexion supplémentaire est utile.
  3. Désactive la réflexion (disabled) : MiniMax M3 répond plus vite, et MiniMax destine ce mode aux usages sensibles au délai, comme la conversation et la complétion de code. Selon l’éditeur, réflexion activée ou désactivée, le tarif est le même, et le choix se fait à chaque requête.
  4. Règle l’inférence : MiniMax recommande une température de 1,0 et un top_p de 0,95 pour de meilleures performances.

Caractéristiques techniques de MiniMax M3

Selon MiniMax, MiniMax M3 est sorti le 1er juin 2026. Il lit en entrée du texte, des images et de la vidéo, avec une fenêtre de contexte de 1 048 576 tokens, et, sur OpenRouter, produit au plus 512 000 tokens par réponse.

Toujours selon MiniMax, le modèle compte environ 428 milliards de paramètres, dont environ 23 milliards activés. Son mécanisme d’attention, MiniMax Sparse Attention (MSA), accélère le préremplissage 9 fois et le décodage 15 fois par rapport à MiniMax M2, à 1 million de tokens de contexte. Le bloc des caractéristiques reprend la liste complète.

Éditeur
MiniMax
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
512 k tokens
Réflexion (selon OpenRouter)
Facultative
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
MiniMax Community License
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
AtlasCloud, CoreWeave, DeepInfra, GMICloud, Mara, Minimax, ModelRun, Novita, Parasail, SambaNova, StreamLake, Together, Venice

Où utiliser MiniMax M3, et comment il se facture

  • API et offres MiniMax : selon MiniMax, MiniMax M3 s’utilise dès sa sortie dans MiniMax Code, avec le Token Plan et par l’API de MiniMax. L’API facture à un tarif long contexte, plus élevé, les appels de plus de 512K tokens en entrée.
  • Poids ouverts et déploiement local : les poids de MiniMax M3 se téléchargent sur Hugging Face, sous l’identifiant MiniMaxAI/MiniMax-M3. MiniMax recommande SGLang, vLLM ou Transformers pour le servir en local.
  • Licence communautaire : MiniMax M3 est publié sous la MiniMax Community License. Un usage commercial impose d’afficher « Built with MiniMax M3 » et, au-delà d’un seuil de chiffre d’affaires annuel, une autorisation écrite préalable de MiniMax.

L'API MiniMax

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 1,20 $ / M tokens en sortie.

Tarification0,30 $ en entrée, 1,20 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAtlasCloud, CoreWeave, DeepInfra, GMICloud, Mara, Minimax, ModelRun, Novita, Parasail, SambaNova, StreamLake, Together, Venice

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

MiniMax M3 parmi les versions de MiniMax

Avant MiniMax M3, la famille MiniMax passe par MiniMax-01 (15 janvier 2025), MiniMax M1 (16 juin 2025), MiniMax M2 (27 octobre 2025), MiniMax M2.1 (23 décembre 2025), MiniMax M2.5 (12 février 2026) et MiniMax M2.7 (18 mars 2026).

MiniMax M3 succède à MiniMax M2.7 dans la gamme. La frise des versions situe chaque version par sa date de sortie.

  1. MiniMax-01
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

MiniMax M3 est-il open source ?

MiniMax M3 n’est pas open source au sens strict : ses poids sont ouverts et se téléchargent sur Hugging Face, sous la MiniMax Community License, qui pose des conditions à l’usage commercial.

Quand MiniMax M3 est-il sorti ?

MiniMax a annoncé la sortie officielle de MiniMax M3 le 1er juin 2026.

Quelle est la fenêtre de contexte de MiniMax M3 ?

MiniMax M3 a une fenêtre de contexte de 1 048 576 tokens, contre 204 800 pour MiniMax M2.7, la version qui le précède.

MiniMax M3 peut-il traiter des images et des vidéos ?

Oui. MiniMax M3 lit le texte, l’image et la vidéo en entrée, puis répond en texte seulement.

Qu’est-ce que MiniMax Sparse Attention (MSA) ?

Selon MiniMax, MiniMax Sparse Attention (MSA) est le mécanisme d’attention qui donne à MiniMax M3 sa fenêtre d’un million de tokens. Selon la carte du modèle publiée par MiniMax sur Hugging Face, à 1 million de tokens de contexte, il ramène le calcul par token à 1/20 de celui de MiniMax M2.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.