Gemma 4 26B A4B est publié par Google le 2 avril 2026. Selon Google, il lit du texte et des images, analyse une vidéo comme une suite d’images et produit du texte ; il peut animer des interfaces conversationnelles, analyser des documents et générer du code.
Gemma 4 26B A4B vise une faible latence à sa sortie, selon Google. Pour la qualité brute et comme base d’affinage, Google destine Gemma 4 31B, à architecture dense, à ces usages.
À leur sortie, Google propose quatre tailles : E2B, E4B, 26B à mélange d’experts, ou MoE, et 31B dense. Avec son mélange d’experts, la variante 26B n’active que 3,8 milliards de paramètres pendant l’inférence, c’est-à-dire le calcul qui produit la réponse, selon Google. Elle tourne alors presque aussi vite qu’un modèle de 4 milliards de paramètres, selon Google, qui la destine aux usages sensibles à la latence.
Sur MMLU Pro, à leur sortie, Gemma 4 26B A4B obtient 82,6 % contre 85,2 % pour Gemma 4 31B, selon Google. Pour GPQA Diamond, les résultats à leur sortie atteignent respectivement 82,3 % pour la variante à mélange d’experts et 84,3 % pour la variante dense, selon Google.
À quoi sert Gemma 4 26B A4B
Chat et agents
Gemma 4 26B A4B peut animer des interfaces conversationnelles de service client, des assistants virtuels et des applications interactives, selon Google. Pour construire des agents utilisant des outils et des API, Google annonce la prise en charge native de l’appel de fonctions, de la sortie structurée au format JSON et des instructions système.
Vision et documents
Selon Google, le modèle comprend les images et prend en charge la détection d’objets, l’analyse de documents et de PDF, ainsi que la compréhension d’écrans et d’interfaces. Ses capacités visuelles comprennent aussi la lecture de graphiques, la reconnaissance optique de caractères (OCR) multilingue et la reconnaissance de l’écriture manuscrite, selon Google.
Mathématiques
À sa sortie, le modèle obtient 88,3 % sur AIME 2026 sans outils, selon la carte Hugging Face publiée par Google. Sur MATH-Vision, qui évalue les mathématiques avec une composante visuelle, son score à la sortie atteint 82,4 %, selon la carte Hugging Face de Google.
Code
Selon Google, le modèle prend en charge la génération, la complétion et la correction de code. Pour cet usage, Google décrit aussi un assistant de code local sur une station de travail, capable d’écrire du code hors ligne.
Gemma 4 26B A4B affiche, à sa sortie, les scores du modèle instruit, selon la carte Hugging Face de Google. Le tableau rassemble les résultats annoncés par Google pour chaque évaluation.
Évaluation
Score annoncé par Google à la sortie
LiveCodeBench v6
77,1 %
Tau2
68,2 %
MMMU Pro
73,8 %
MRCR v2 à 128k
44,1 %
AIME 2026 sans outils
88,3 %
Sur AIME 2026, selon la carte Hugging Face de Google, Gemma 4 26B A4B obtient à sa sortie 88,3 % sans outils, contre 20,8 % pour Gemma 3 27B sans réflexion.
Bien utiliser Gemma 4 26B A4B : réflexion et effort
Gemma 4 26B A4B a la réflexion désactivée par défaut sur OpenRouter. Sur OpenRouter, cette réflexion n’est pas obligatoire et peut être désactivée.
Activer ou désactiver la réflexion : selon Google, la réflexion s’active par un jeton de contrôle placé au début du prompt système, la consigne système du modèle. Selon Google, retirer ce jeton désactive la réflexion. Même désactivée, elle laisse apparaître les balises de réflexion avec un bloc vide, selon Google.
Régler l’échantillonnage : selon Google, les réglages recommandés sont temperature 1.0, top_p 0.95 et top_k 64.
Ajuster le budget d’une image : selon Google, le budget se règle à 70, 140, 280, 560 ou 1120 jetons par image. Pour la classification, le sous-titrage ou la vidéo, Google recommande un budget bas. Pour l’OCR, la reconnaissance optique de caractères, l’analyse de documents ou les petits textes, Google recommande un budget haut.
Caractéristiques techniques de Gemma 4 26B A4B
Gemma 4 26B A4B est sorti le 2 avril 2026. Le tableau des caractéristiques rassemble la fenêtre de contexte, la sortie maximale et les autres propriétés techniques du modèle.
Selon Google, son architecture à mélange d’experts mobilise un sous-ensemble des paramètres pendant l’inférence, c’est-à-dire pendant la production d’une réponse. Dans le nom du modèle, le « A » désigne les paramètres actifs, selon Google. Sur OpenRouter, la sortie maximale correspond au plafond de tokens produits par réponse. Selon Google, le modèle a une fenêtre de contexte de 256K tokens.
Selon Google, le mélange d’experts compte 25,2 milliards de paramètres, dont 3,8 milliards actifs, répartis sur 30 couches. Pour chaque traitement, le modèle active 8 experts sur 128, plus un expert partagé, selon Google. Ses données de pré-entraînement s’arrêtent à janvier 2025, selon Google. Il est publié sous licence Apache 2.0, selon la carte Hugging Face de Google.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
262 k tokens
Réponse maximale (selon OpenRouter)
236 k tokens
Réflexion (selon OpenRouter)
Sur demande
Entrées (selon OpenRouter)
Texte, Image, Vidéo
Licence
Apache 2.0
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Gemma 4 26B A4B, et comment il se facture
Gemma 4 26B A4B s’essaie dans Google AI Studio à sa sortie, selon Google. La carte d’accès donne les derniers prix relevés.
Poids ouverts : à sa sortie, selon Google, les poids du modèle se téléchargent sur Hugging Face, Kaggle ou Ollama.
Exécution locale : à sa sortie, selon Google, les poids non quantifiés au format bfloat16 tiennent sur un seul GPU NVIDIA H100 de 80 Go. Selon Google, à sa sortie, des versions quantifiées peuvent aussi fonctionner sur des GPU grand public.
Déploiement sur Google Cloud : à sa sortie, selon Google, le modèle se déploie par Vertex AI, Cloud Run ou GKE.
L'API Google
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,077 $ / M tokens en entrée, 0,26 $ / M tokens en sortie.
Tarification0,077 $ en entrée, 0,26 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemma 4 26B A4B parmi les versions de Gemma
Gemma 4 26B A4B et Gemma 4 31B sont sortis le même jour : ce sont deux tailles de la même génération. Dans l’histoire de la famille, Gemma 2 27B puis Gemma 3 27B précèdent cette génération. La frise des versions situe ces modèles dans la famille et porte leurs dates de sortie.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemma 4 26B A4BVous êtes ici
Gemma 2 27B
Gemma 3 4B
Gemma 3 12B
Gemma 3 27B
Gemma 4 31B
Score
1289
1303
1342
1365
Sortie
Contexte
262 k tokens
8 k tokens
131 k tokens
131 k tokens
131 k tokens
262 k tokens
Prix d'entrée
0,077 $ / M tokens
0,65 $ / M tokens
0,050 $ / M tokens
0,050 $ / M tokens
0,080 $ / M tokens
0,090 $ / M tokens
Prix de sortie
0,26 $ / M tokens
0,65 $ / M tokens
0,10 $ / M tokens
0,15 $ / M tokens
0,45 $ / M tokens
0,34 $ / M tokens
Entrées
Texte, Image, Vidéo
Texte
Texte, Image
Texte, Image
Texte, Image
Texte, Image, Vidéo
Réflexion
Sur demande
Non prise en charge
Non prise en charge
Non prise en charge
Non prise en charge
Sur demande
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemma 4 26B A4B est publié par Google le 2 avril 2026. Selon Google, il lit du texte et des images, analyse une vidéo comme une suite d’images et produit du texte ; il peut animer des interfaces conversationnelles, analyser des documents et générer du code.
Gemma 2 27B est un modèle de Google sorti le 27 juin 2024, qui lit du texte. Selon Google, ses poids sont ouverts, il produit du texte en anglais et il convient à la réponse aux questions, au résumé, au raisonnement et aux interfaces conversationnelles.
Gemma 3 4B, publié par Google le 12 mars 2025, lit du texte et des images et produit du texte selon Google. Il peut répondre à des questions, résumer des contenus et animer des interfaces conversationnelles, selon Google.
Gemma 3 12B est un modèle de Google sorti le 12 mars 2025. Selon Google, il lit du texte et des images, produit du texte et sert à la réponse aux questions, au résumé et au raisonnement.
Gemma 3 27B est un modèle de Google sorti le 12 mars 2025. Selon Google, il lit du texte et des images, produit du texte et convient à la réponse aux questions, au résumé et au raisonnement.
Gemma 4 31B, publié par Google le 2 avril 2026, lit du texte et des images, analyse la vidéo comme une suite d’images et produit du texte. Selon Google, il sert à construire des interfaces conversationnelles et des agents utilisant des outils, à analyser des documents et à générer, compléter ou corriger du code.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
C’est quoi Gemma 4 26B A4B ?
Gemma 4 26B A4B est un modèle ouvert, selon Google. Il appartient à la famille Gemma 4 de Google DeepMind, selon Google.
Quelle est la configuration de Gemma 4 26B A4B ?
Gemma 4 26B A4B tient, à sa sortie, sur un seul GPU NVIDIA H100 de 80 Go avec ses poids non quantifiés en bfloat16, selon Google. Des versions quantifiées tournent sur des GPU grand public, selon Google.
Gemma 4 26B A4B est-il un modèle à mélange d’experts ?
Gemma 4 26B A4B est un modèle à mélange d’experts, selon Google. Il n’active que 3,8 milliards de ses 25,2 milliards de paramètres, selon Google.
Quand Gemma 4 26B A4B est-il sorti ?
Gemma 4 26B A4B est sorti le 2 avril 2026. Il appartient à la famille Gemma 4 de Google DeepMind, selon Google.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.