Revue publiée le Scores mis à jour le
Comparer

Google : Gemma 4 31B

Gemma 4 31B, publié par Google le 2 avril 2026, lit du texte et des images, analyse la vidéo comme une suite d’images et produit du texte. Selon Google, il sert à construire des interfaces conversationnelles et des agents utilisant des outils, à analyser des documents et à générer, compléter ou corriger du code.

Gemma 4 31B ou Gemma 4 26B A4B : lequel choisir ?

Gemma 4 31B privilégie la qualité brute et sert de base à l’affinage, selon Google à sa sortie. Face à ce modèle dense, Gemma 4 26B A4B repose selon Google sur un mélange d’experts (MoE) et vise une faible latence : seuls 3,8 milliards de paramètres sont actifs pendant la génération des réponses. Selon Google, cette architecture tourne presque aussi vite qu’un modèle de 4 milliards de paramètres.

Sur MMLU Pro, le modèle dense obtient 85,2 % contre 82,6 % pour la variante MoE, selon les évaluations publiées par Google à leur sortie. Sur GPQA Diamond, Google donne respectivement 84,3 % et 82,3 %.

À quoi sert Gemma 4 31B

Chat et agents

Gemma 4 31B peut animer des interfaces conversationnelles de service client, des assistants virtuels et des applications interactives, selon Google. Pour construire des agents utilisant des outils et des API, Google annonce une prise en charge native de l’appel de fonctions, qui permet de solliciter une fonction externe. Il prend aussi en charge les instructions système et les sorties structurées au format JSON.

Vision et documents

Gemma 4 31B comprend les images, selon Google, avec des capacités de détection d’objets et d’analyse de documents ou de PDF. Parmi les usages annoncés figurent aussi la compréhension d’écrans et d’interfaces, ainsi que la lecture de graphiques. Pour les contenus écrits, il prend en charge la reconnaissance optique de caractères (OCR) multilingue et la reconnaissance de l’écriture manuscrite.

Mathématiques

Gemma 4 31B obtient, à sa sortie, 89,2 % sur AIME 2026 sans outils, selon la carte du modèle publiée par Google sur Hugging Face. Sur MATH-Vision, Google rapporte un score de 85,6 %.

Code

Gemma 4 31B génère, complète et corrige du code, selon Google. Au-delà de ces tâches, Google décrit un usage d’assistant de code local sur une station de travail, capable d’écrire du code hors ligne.

  • Chat
  • Vision et compréhension
  • Mathématiques
  • Code

Les performances de Gemma 4 31B

Gemma 4 31B affiche les scores de sa version instruite, selon la carte Hugging Face publiée par Google à sa sortie. Le tableau rassemble les résultats annoncés par l’éditeur pour chaque évaluation.

ÉvaluationScore annoncé par Google
GPQA Diamond84,3 %
LiveCodeBench v680,0 %
Tau276,9 %
MMMU Pro76,9 %
MRCR v2 à 128k66,4 %
AIME 2026 sans outils89,2 %

Sur l’épreuve AIME sans outils, Google compare ce résultat à celui de Gemma 3 27B sans réflexion, qui obtient 20,8 %.

Bien utiliser Gemma 4 31B : réflexion et effort

Gemma 4 31B permet d’activer ou de désactiver la réflexion selon Google. Sur OpenRouter, celle-ci est désactivée par défaut et reste facultative.

  1. Activer ou désactiver la réflexion : selon Google, l’activation passe par un jeton de contrôle placé au début du prompt système, c’est-à-dire les instructions qui encadrent la réponse du modèle. Retirer ce jeton désactive la réflexion. Même dans ce mode, le modèle produit les balises de réflexion, mais le bloc qu’elles délimitent reste vide.
  2. Régler l’échantillonnage : Google recommande les paramètres temperature 1.0, top_p 0.95 et top_k 64 pour Gemma 4.
  3. Choisir le budget de jetons par image : selon Google, les valeurs possibles sont 70, 140, 280, 560 ou 1120 jetons. L’éditeur recommande un budget bas pour la classification, le sous-titrage ou la vidéo, et un budget haut pour l’OCR, c’est-à-dire la reconnaissance de caractères, l’analyse de documents ou les petits textes.

Caractéristiques techniques de Gemma 4 31B

Gemma 4 31B est sorti le 2 avril 2026, avec une fenêtre de contexte de 256K tokens selon Google. Sur OpenRouter, il produit au plus 16 384 tokens par réponse. Le tableau des caractéristiques rassemble les données techniques du modèle. Selon Google, son architecture dense compte 30,7 milliards de paramètres répartis sur 60 couches.

Selon Google, le modèle reçoit du texte et des images, et analyse une vidéo comme une suite d’images. Il ne reçoit pas d’audio. Ses réponses sont textuelles, et ses données de pré-entraînement s’arrêtent à janvier 2025, selon Google. Pré-entraîné sur un large ensemble de langues, il prend en charge un répertoire multilingue sans adaptation et est publié sous licence Apache 2.0, selon la carte Hugging Face de Google.

Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Sur demande
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Chutes, CoreWeave, Crusoe, DeepInfra, Friendli, Io Net, ModelRun, Novita, Parasail, SambaNova, SiliconFlow, Venice

Où utiliser Gemma 4 31B, et comment il se facture

Gemma 4 31B pouvait être exécuté localement ou déployé sur Google Cloud à sa sortie, selon Google. La carte d’accès présente les derniers tarifs relevés.

  • Poids téléchargeables : à sa sortie, selon Google, les poids étaient accessibles sur Hugging Face et Kaggle. Ollama permettait également de télécharger Gemma 4 31B.
  • Exécution locale : selon Google, à sa sortie, les poids non quantifiés au format bfloat16 tenaient sur un seul GPU NVIDIA H100 de 80 Go. Des versions quantifiées pouvaient tourner sur des GPU grand public.
  • Essai dans Google AI Studio : à sa sortie, selon Google, le modèle pouvait être essayé dans Google AI Studio.
  • Déploiement sur Google Cloud : selon Google, à sa sortie, le déploiement passait par Vertex AI, Cloud Run ou GKE.

L'API chez des hébergeurs

Servi par d'autres hébergeurs que Google, selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,090 $ / M tokens en entrée, 0,34 $ / M tokens en sortie.

Tarification0,090 $ en entrée, 0,34 $ en sortie, par million de tokens
Hébergé via OpenRouter chezChutes, CoreWeave, Crusoe, DeepInfra, Friendli, Io Net, ModelRun, Novita, Parasail, SambaNova, SiliconFlow, Venice

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Gemma 4 31B parmi les versions de Gemma

Gemma 4 31B s’inscrit dans la famille Gemma, après les sorties de Gemma 2 27B et de Gemma 3 27B. Sa version sœur, Gemma 4 26B A4B, est sortie le même jour. La frise des versions situe ces modèles dans la famille et donne leurs dates de sortie respectives.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

C’est quoi Gemma 4 31B ?

Selon Google, Gemma 4 31B est le modèle dense de 30,7 milliards de paramètres de Gemma 4, la famille de modèles ouverts de Google DeepMind.

Gemma 4 31B est-il gratuit ?

Selon Google, à sa sortie, les poids de Gemma 4 sont publiés sous licence Apache 2.0 et se téléchargent sur Hugging Face, Kaggle ou Ollama.

Quelle est la configuration de Gemma 4 31B ?

Selon Google, à sa sortie, les poids non quantifiés en bfloat16 des modèles 26B et 31B tiennent sur un seul GPU NVIDIA H100 de 80 Go, et des versions quantifiées tournent sur des GPU grand public.

Quand Gemma 4 31B est-il sorti ?

Gemma 4 31B est sorti le 2 avril 2026.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.