Gemma 4 31B, publié par Google le 2 avril 2026, lit du texte et des images, analyse la vidéo comme une suite d’images et produit du texte. Selon Google, il sert à construire des interfaces conversationnelles et des agents utilisant des outils, à analyser des documents et à générer, compléter ou corriger du code.
Gemma 4 31B privilégie la qualité brute et sert de base à l’affinage, selon Google à sa sortie. Face à ce modèle dense, Gemma 4 26B A4B repose selon Google sur un mélange d’experts (MoE) et vise une faible latence : seuls 3,8 milliards de paramètres sont actifs pendant la génération des réponses. Selon Google, cette architecture tourne presque aussi vite qu’un modèle de 4 milliards de paramètres.
Sur MMLU Pro, le modèle dense obtient 85,2 % contre 82,6 % pour la variante MoE, selon les évaluations publiées par Google à leur sortie. Sur GPQA Diamond, Google donne respectivement 84,3 % et 82,3 %.
À quoi sert Gemma 4 31B
Chat et agents
Gemma 4 31B peut animer des interfaces conversationnelles de service client, des assistants virtuels et des applications interactives, selon Google. Pour construire des agents utilisant des outils et des API, Google annonce une prise en charge native de l’appel de fonctions, qui permet de solliciter une fonction externe. Il prend aussi en charge les instructions système et les sorties structurées au format JSON.
Vision et documents
Gemma 4 31B comprend les images, selon Google, avec des capacités de détection d’objets et d’analyse de documents ou de PDF. Parmi les usages annoncés figurent aussi la compréhension d’écrans et d’interfaces, ainsi que la lecture de graphiques. Pour les contenus écrits, il prend en charge la reconnaissance optique de caractères (OCR) multilingue et la reconnaissance de l’écriture manuscrite.
Mathématiques
Gemma 4 31B obtient, à sa sortie, 89,2 % sur AIME 2026 sans outils, selon la carte du modèle publiée par Google sur Hugging Face. Sur MATH-Vision, Google rapporte un score de 85,6 %.
Code
Gemma 4 31B génère, complète et corrige du code, selon Google. Au-delà de ces tâches, Google décrit un usage d’assistant de code local sur une station de travail, capable d’écrire du code hors ligne.
Gemma 4 31B affiche les scores de sa version instruite, selon la carte Hugging Face publiée par Google à sa sortie. Le tableau rassemble les résultats annoncés par l’éditeur pour chaque évaluation.
Évaluation
Score annoncé par Google
GPQA Diamond
84,3 %
LiveCodeBench v6
80,0 %
Tau2
76,9 %
MMMU Pro
76,9 %
MRCR v2 à 128k
66,4 %
AIME 2026 sans outils
89,2 %
Sur l’épreuve AIME sans outils, Google compare ce résultat à celui de Gemma 3 27B sans réflexion, qui obtient 20,8 %.
Bien utiliser Gemma 4 31B : réflexion et effort
Gemma 4 31B permet d’activer ou de désactiver la réflexion selon Google. Sur OpenRouter, celle-ci est désactivée par défaut et reste facultative.
Activer ou désactiver la réflexion : selon Google, l’activation passe par un jeton de contrôle placé au début du prompt système, c’est-à-dire les instructions qui encadrent la réponse du modèle. Retirer ce jeton désactive la réflexion. Même dans ce mode, le modèle produit les balises de réflexion, mais le bloc qu’elles délimitent reste vide.
Régler l’échantillonnage : Google recommande les paramètres temperature 1.0, top_p 0.95 et top_k 64 pour Gemma 4.
Choisir le budget de jetons par image : selon Google, les valeurs possibles sont 70, 140, 280, 560 ou 1120 jetons. L’éditeur recommande un budget bas pour la classification, le sous-titrage ou la vidéo, et un budget haut pour l’OCR, c’est-à-dire la reconnaissance de caractères, l’analyse de documents ou les petits textes.
Caractéristiques techniques de Gemma 4 31B
Gemma 4 31B est sorti le 2 avril 2026, avec une fenêtre de contexte de 256K tokens selon Google. Sur OpenRouter, il produit au plus 16 384 tokens par réponse. Le tableau des caractéristiques rassemble les données techniques du modèle. Selon Google, son architecture dense compte 30,7 milliards de paramètres répartis sur 60 couches.
Selon Google, le modèle reçoit du texte et des images, et analyse une vidéo comme une suite d’images. Il ne reçoit pas d’audio. Ses réponses sont textuelles, et ses données de pré-entraînement s’arrêtent à janvier 2025, selon Google. Pré-entraîné sur un large ensemble de langues, il prend en charge un répertoire multilingue sans adaptation et est publié sous licence Apache 2.0, selon la carte Hugging Face de Google.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Sur demande
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Gemma 4 31B pouvait être exécuté localement ou déployé sur Google Cloud à sa sortie, selon Google. La carte d’accès présente les derniers tarifs relevés.
Poids téléchargeables : à sa sortie, selon Google, les poids étaient accessibles sur Hugging Face et Kaggle. Ollama permettait également de télécharger Gemma 4 31B.
Exécution locale : selon Google, à sa sortie, les poids non quantifiés au format bfloat16 tenaient sur un seul GPU NVIDIA H100 de 80 Go. Des versions quantifiées pouvaient tourner sur des GPU grand public.
Essai dans Google AI Studio : à sa sortie, selon Google, le modèle pouvait être essayé dans Google AI Studio.
Déploiement sur Google Cloud : selon Google, à sa sortie, le déploiement passait par Vertex AI, Cloud Run ou GKE.
L'API chez des hébergeurs
Servi par d'autres hébergeurs que Google, selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,090 $ / M tokens en entrée, 0,34 $ / M tokens en sortie.
Tarification0,090 $ en entrée, 0,34 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemma 4 31B parmi les versions de Gemma
Gemma 4 31B s’inscrit dans la famille Gemma, après les sorties de Gemma 2 27B et de Gemma 3 27B. Sa version sœur, Gemma 4 26B A4B, est sortie le même jour. La frise des versions situe ces modèles dans la famille et donne leurs dates de sortie respectives.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemma 4 31BVous êtes ici
Gemma 2 27B
Gemma 3 4B
Gemma 3 12B
Gemma 3 27B
Gemma 4 26B A4B
Score
1289
1303
1342
1365
Sortie
Contexte
262 k tokens
8 k tokens
131 k tokens
131 k tokens
131 k tokens
262 k tokens
Prix d'entrée
0,090 $ / M tokens
0,65 $ / M tokens
0,050 $ / M tokens
0,050 $ / M tokens
0,080 $ / M tokens
0,077 $ / M tokens
Prix de sortie
0,34 $ / M tokens
0,65 $ / M tokens
0,10 $ / M tokens
0,15 $ / M tokens
0,45 $ / M tokens
0,26 $ / M tokens
Entrées
Texte, Image, Vidéo
Texte
Texte, Image
Texte, Image
Texte, Image
Texte, Image, Vidéo
Réflexion
Sur demande
Non prise en charge
Non prise en charge
Non prise en charge
Non prise en charge
Sur demande
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemma 4 31B, publié par Google le 2 avril 2026, lit du texte et des images, analyse la vidéo comme une suite d’images et produit du texte. Selon Google, il sert à construire des interfaces conversationnelles et des agents utilisant des outils, à analyser des documents et à générer, compléter ou corriger du code.
Gemma 2 27B est un modèle de Google sorti le 27 juin 2024, qui lit du texte. Selon Google, ses poids sont ouverts, il produit du texte en anglais et il convient à la réponse aux questions, au résumé, au raisonnement et aux interfaces conversationnelles.
Gemma 3 4B, publié par Google le 12 mars 2025, lit du texte et des images et produit du texte selon Google. Il peut répondre à des questions, résumer des contenus et animer des interfaces conversationnelles, selon Google.
Gemma 3 12B est un modèle de Google sorti le 12 mars 2025. Selon Google, il lit du texte et des images, produit du texte et sert à la réponse aux questions, au résumé et au raisonnement.
Gemma 3 27B est un modèle de Google sorti le 12 mars 2025. Selon Google, il lit du texte et des images, produit du texte et convient à la réponse aux questions, au résumé et au raisonnement.
Gemma 4 26B A4B est publié par Google le 2 avril 2026. Selon Google, il lit du texte et des images, analyse une vidéo comme une suite d’images et produit du texte ; il peut animer des interfaces conversationnelles, analyser des documents et générer du code.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
C’est quoi Gemma 4 31B ?
Selon Google, Gemma 4 31B est le modèle dense de 30,7 milliards de paramètres de Gemma 4, la famille de modèles ouverts de Google DeepMind.
Gemma 4 31B est-il gratuit ?
Selon Google, à sa sortie, les poids de Gemma 4 sont publiés sous licence Apache 2.0 et se téléchargent sur Hugging Face, Kaggle ou Ollama.
Quelle est la configuration de Gemma 4 31B ?
Selon Google, à sa sortie, les poids non quantifiés en bfloat16 des modèles 26B et 31B tiennent sur un seul GPU NVIDIA H100 de 80 Go, et des versions quantifiées tournent sur des GPU grand public.
Quand Gemma 4 31B est-il sorti ?
Gemma 4 31B est sorti le 2 avril 2026.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.