Revue publiée le Scores mis à jour le
Comparer

Google : Gemma 4 26B A4B

Gemma 4 26B A4B est publié par Google le 2 avril 2026. Selon Google, il lit du texte et des images, analyse une vidéo comme une suite d’images et produit du texte ; il peut animer des interfaces conversationnelles, analyser des documents et générer du code.

Gemma 4 26B A4B ou Gemma 4 31B : lequel choisir ?

Gemma 4 26B A4B vise une faible latence à sa sortie, selon Google. Pour la qualité brute et comme base d’affinage, Google destine Gemma 4 31B, à architecture dense, à ces usages.

À leur sortie, Google propose quatre tailles : E2B, E4B, 26B à mélange d’experts, ou MoE, et 31B dense. Avec son mélange d’experts, la variante 26B n’active que 3,8 milliards de paramètres pendant l’inférence, c’est-à-dire le calcul qui produit la réponse, selon Google. Elle tourne alors presque aussi vite qu’un modèle de 4 milliards de paramètres, selon Google, qui la destine aux usages sensibles à la latence.

Sur MMLU Pro, à leur sortie, Gemma 4 26B A4B obtient 82,6 % contre 85,2 % pour Gemma 4 31B, selon Google. Pour GPQA Diamond, les résultats à leur sortie atteignent respectivement 82,3 % pour la variante à mélange d’experts et 84,3 % pour la variante dense, selon Google.

À quoi sert Gemma 4 26B A4B

Chat et agents

Gemma 4 26B A4B peut animer des interfaces conversationnelles de service client, des assistants virtuels et des applications interactives, selon Google. Pour construire des agents utilisant des outils et des API, Google annonce la prise en charge native de l’appel de fonctions, de la sortie structurée au format JSON et des instructions système.

Vision et documents

Selon Google, le modèle comprend les images et prend en charge la détection d’objets, l’analyse de documents et de PDF, ainsi que la compréhension d’écrans et d’interfaces. Ses capacités visuelles comprennent aussi la lecture de graphiques, la reconnaissance optique de caractères (OCR) multilingue et la reconnaissance de l’écriture manuscrite, selon Google.

Mathématiques

À sa sortie, le modèle obtient 88,3 % sur AIME 2026 sans outils, selon la carte Hugging Face publiée par Google. Sur MATH-Vision, qui évalue les mathématiques avec une composante visuelle, son score à la sortie atteint 82,4 %, selon la carte Hugging Face de Google.

Code

Selon Google, le modèle prend en charge la génération, la complétion et la correction de code. Pour cet usage, Google décrit aussi un assistant de code local sur une station de travail, capable d’écrire du code hors ligne.

  • Chat
  • Vision et compréhension
  • Mathématiques
  • Code

Les performances de Gemma 4 26B A4B

Gemma 4 26B A4B affiche, à sa sortie, les scores du modèle instruit, selon la carte Hugging Face de Google. Le tableau rassemble les résultats annoncés par Google pour chaque évaluation.

ÉvaluationScore annoncé par Google à la sortie
LiveCodeBench v677,1 %
Tau268,2 %
MMMU Pro73,8 %
MRCR v2 à 128k44,1 %
AIME 2026 sans outils88,3 %

Sur AIME 2026, selon la carte Hugging Face de Google, Gemma 4 26B A4B obtient à sa sortie 88,3 % sans outils, contre 20,8 % pour Gemma 3 27B sans réflexion.

Bien utiliser Gemma 4 26B A4B : réflexion et effort

Gemma 4 26B A4B a la réflexion désactivée par défaut sur OpenRouter. Sur OpenRouter, cette réflexion n’est pas obligatoire et peut être désactivée.

  1. Activer ou désactiver la réflexion : selon Google, la réflexion s’active par un jeton de contrôle placé au début du prompt système, la consigne système du modèle. Selon Google, retirer ce jeton désactive la réflexion. Même désactivée, elle laisse apparaître les balises de réflexion avec un bloc vide, selon Google.
  2. Régler l’échantillonnage : selon Google, les réglages recommandés sont temperature 1.0, top_p 0.95 et top_k 64.
  3. Ajuster le budget d’une image : selon Google, le budget se règle à 70, 140, 280, 560 ou 1120 jetons par image. Pour la classification, le sous-titrage ou la vidéo, Google recommande un budget bas. Pour l’OCR, la reconnaissance optique de caractères, l’analyse de documents ou les petits textes, Google recommande un budget haut.

Caractéristiques techniques de Gemma 4 26B A4B

Gemma 4 26B A4B est sorti le 2 avril 2026. Le tableau des caractéristiques rassemble la fenêtre de contexte, la sortie maximale et les autres propriétés techniques du modèle.

Selon Google, son architecture à mélange d’experts mobilise un sous-ensemble des paramètres pendant l’inférence, c’est-à-dire pendant la production d’une réponse. Dans le nom du modèle, le « A » désigne les paramètres actifs, selon Google. Sur OpenRouter, la sortie maximale correspond au plafond de tokens produits par réponse. Selon Google, le modèle a une fenêtre de contexte de 256K tokens.

Selon Google, le mélange d’experts compte 25,2 milliards de paramètres, dont 3,8 milliards actifs, répartis sur 30 couches. Pour chaque traitement, le modèle active 8 experts sur 128, plus un expert partagé, selon Google. Ses données de pré-entraînement s’arrêtent à janvier 2025, selon Google. Il est publié sous licence Apache 2.0, selon la carte Hugging Face de Google.

Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
236 k tokens
Réflexion (selon OpenRouter)
Sur demande
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Cloudflare, CoreWeave, Darkbloom, DeepInfra, DekaLLM, Google, Io Net, Makora, NextBit, Novita, Parasail, SiliconFlow, Venice

Où utiliser Gemma 4 26B A4B, et comment il se facture

Gemma 4 26B A4B s’essaie dans Google AI Studio à sa sortie, selon Google. La carte d’accès donne les derniers prix relevés.

  • Poids ouverts : à sa sortie, selon Google, les poids du modèle se téléchargent sur Hugging Face, Kaggle ou Ollama.
  • Exécution locale : à sa sortie, selon Google, les poids non quantifiés au format bfloat16 tiennent sur un seul GPU NVIDIA H100 de 80 Go. Selon Google, à sa sortie, des versions quantifiées peuvent aussi fonctionner sur des GPU grand public.
  • Déploiement sur Google Cloud : à sa sortie, selon Google, le modèle se déploie par Vertex AI, Cloud Run ou GKE.

L'API Google

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,077 $ / M tokens en entrée, 0,26 $ / M tokens en sortie.

Tarification0,077 $ en entrée, 0,26 $ en sortie, par million de tokens
Hébergé via OpenRouter chezCloudflare, CoreWeave, Darkbloom, DeepInfra, DekaLLM, Google, Io Net, Makora, NextBit, Novita, Parasail, SiliconFlow, Venice

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Gemma 4 26B A4B parmi les versions de Gemma

Gemma 4 26B A4B et Gemma 4 31B sont sortis le même jour : ce sont deux tailles de la même génération. Dans l’histoire de la famille, Gemma 2 27B puis Gemma 3 27B précèdent cette génération. La frise des versions situe ces modèles dans la famille et porte leurs dates de sortie.

  1. Gemma 4 31B
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

C’est quoi Gemma 4 26B A4B ?

Gemma 4 26B A4B est un modèle ouvert, selon Google. Il appartient à la famille Gemma 4 de Google DeepMind, selon Google.

Quelle est la configuration de Gemma 4 26B A4B ?

Gemma 4 26B A4B tient, à sa sortie, sur un seul GPU NVIDIA H100 de 80 Go avec ses poids non quantifiés en bfloat16, selon Google. Des versions quantifiées tournent sur des GPU grand public, selon Google.

Gemma 4 26B A4B est-il un modèle à mélange d’experts ?

Gemma 4 26B A4B est un modèle à mélange d’experts, selon Google. Il n’active que 3,8 milliards de ses 25,2 milliards de paramètres, selon Google.

Quand Gemma 4 26B A4B est-il sorti ?

Gemma 4 26B A4B est sorti le 2 avril 2026. Il appartient à la famille Gemma 4 de Google DeepMind, selon Google.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.