Gemma 3 4B, publié par Google le 12 mars 2025, lit du texte et des images et produit du texte selon Google. Il peut répondre à des questions, résumer des contenus et animer des interfaces conversationnelles, selon Google.
Gemma 3 4B peut animer des interfaces conversationnelles de service client, des assistants virtuels ou des applications interactives, selon la documentation de Google. Selon la documentation de Google, les modèles Gemma 3 conviennent aussi à des tâches de génération de texte et de compréhension d’images, dont la réponse aux questions, le résumé et le raisonnement.
Images et documents
Gemma 3 4B utilise, à sa sortie, le même modèle de vision que les tailles 12B et 27B, selon Google. Il permet d’analyser et de comparer des images, d’identifier des objets et de répondre à des questions sur une image ou sur le texte qu’elle contient, selon Google. Selon la documentation de Google, ses usages comprennent aussi l’extraction, l’interprétation et le résumé de données visuelles sous forme de texte.
Rédaction créative
Gemma 3 4B peut générer des poèmes, des scripts et du code, selon la documentation de Google. Pour la rédaction commerciale et les échanges écrits, le modèle peut également produire des textes marketing et des brouillons d’e-mails, selon Google.
Mathématiques
Gemma 3 4B bénéficie, à sa sortie, d’un entraînement comprenant un apprentissage par renforcement à partir d’un retour automatique, appelé RLMF, destiné à améliorer le raisonnement mathématique, selon Google. Dans les évaluations publiées à sa sortie, sa variante instruite obtient un score de 75,6 sur MATH et de 43,0 sur HiddenMath, selon Google.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances de Gemma 3 4B
Gemma 3 4B instruit est compétitif avec Gemma 2 27B instruit grâce à la nouvelle recette de post-entraînement, selon le rapport technique de Google publié à sa sortie. Selon Google, ces évaluations portent sur les modèles instruits, sans exemple dans la consigne : c’est le protocole zero-shot.
Selon Google, à sa sortie, le modèle instruit obtient 75,6 sur MATH et 43,0 sur HiddenMath, contre respectivement 55,6 et 14,8 pour Gemma 2 27B instruit. Sur MMLU-Pro et LiveCodeBench, selon Google, à sa sortie, la comparaison oppose les scores repris dans le tableau à respectivement 56,9 et 20,4 pour Gemma 2 27B instruit. Le tableau rassemble les autres scores annoncés par Google à sa sortie, avec le nom de chaque évaluation.
Évaluation
Score annoncé par Google à sa sortie
MMLU-Pro
43,6
LiveCodeBench
12,6
Bird-SQL (dev)
36,3
GPQA Diamond
30,8
SimpleQA
4,0
FACTS Grounding
70,1
Global MMLU-Lite
54,5
MMMU (val)
48,8
Caractéristiques techniques de Gemma 3 4B
Gemma 3 4B est sorti le 12 mars 2025 sous licence Gemma Terms of Use. Le bloc des caractéristiques présente la date de sortie, la fenêtre de contexte, la réponse maximale, les entrées, la licence, les paramètres et les hébergeurs.
Selon Google, la fenêtre de contexte atteint 128K tokens, les unités de texte traitées par le modèle. Sur OpenRouter, une réponse peut contenir au plus 16 384 tokens. Selon la documentation de Google, le modèle accepte du texte et des images en entrée et produit du texte, avec des poids ouverts en version pré-entraînée comme en version ajustée aux instructions.
Selon Google, l’entraînement du modèle a porté sur quatre mille milliards de tokens. D’après la documentation de Google, les données d’entraînement s’arrêtent en août 2024. À sa sortie, selon Google, Gemma 3 prend en charge plus de 35 langues sans adaptation, et son pré-entraînement en couvre plus de 140.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
131 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Non prise en charge
Connaissances jusqu'à (selon OpenRouter)
août 2024
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte, Image
Licence
Gemma Terms of Use
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Gemma 3 4B appartient, à sa sortie, à une famille conçue pour tourner directement sur des appareils, du téléphone et de l’ordinateur portable à la station de travail, selon Google. La carte d’accès donne les derniers prix relevés.
Téléchargement des modèles : à sa sortie, selon Google, Gemma 3 se télécharge sur Hugging Face, Ollama ou Kaggle.
Déploiement sur les services de Google : à sa sortie, selon Google, Gemma 3 se déploie à grande échelle sur Vertex AI. À sa sortie, selon Google, son inférence, c’est-à-dire l’exécution du modèle pour produire une réponse, fonctionne aussi sur Cloud Run avec Ollama.
Versions quantifiées : à sa sortie, selon Google, Gemma 3 propose des versions quantifiées officielles, qui réduisent la taille du modèle et les besoins de calcul.
L'API chez des hébergeurs
Servi par d'autres hébergeurs que Google, selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,050 $ / M tokens en entrée, 0,10 $ / M tokens en sortie.
Tarification0,050 $ en entrée, 0,10 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemma 3 4B parmi les versions de Gemma
Gemma 3 4B appartient à la génération Gemma 3, arrivée après la génération Gemma 2, dont Gemma 2 27B est sorti le 27 juin 2024. Selon Google, à sa sortie, le 12 mars 2025, Gemma 3 existe en quatre tailles : 1B, 4B, 12B et 27B. Ces tailles permettent, selon Google, de choisir le modèle selon son matériel et les performances visées.
Gemma 3 12B et Gemma 3 27B sont d’autres tailles de la même génération, sorties le même jour que la variante 4B. Puis Gemma 4 26B A4B et Gemma 4 31B sont sortis le 2 avril 2026. La frise des versions situe ces modèles dans la famille Gemma et porte leurs dates de sortie.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemma 3 4BVous êtes ici
Gemma 2 27B
Gemma 3 12B
Gemma 3 27B
Gemma 4 26B A4B
Gemma 4 31B
Score
1303
1289
1342
1365
Sortie
Contexte
131 k tokens
8 k tokens
131 k tokens
131 k tokens
262 k tokens
262 k tokens
Prix d'entrée
0,050 $ / M tokens
0,65 $ / M tokens
0,050 $ / M tokens
0,080 $ / M tokens
0,077 $ / M tokens
0,090 $ / M tokens
Prix de sortie
0,10 $ / M tokens
0,65 $ / M tokens
0,15 $ / M tokens
0,45 $ / M tokens
0,26 $ / M tokens
0,34 $ / M tokens
Entrées
Texte, Image
Texte
Texte, Image
Texte, Image
Texte, Image, Vidéo
Texte, Image, Vidéo
Réflexion
Non prise en charge
Non prise en charge
Non prise en charge
Non prise en charge
Sur demande
Sur demande
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemma 3 4B, publié par Google le 12 mars 2025, lit du texte et des images et produit du texte selon Google. Il peut répondre à des questions, résumer des contenus et animer des interfaces conversationnelles, selon Google.
Gemma 2 27B est un modèle de Google sorti le 27 juin 2024, qui lit du texte. Selon Google, ses poids sont ouverts, il produit du texte en anglais et il convient à la réponse aux questions, au résumé, au raisonnement et aux interfaces conversationnelles.
Gemma 3 12B est un modèle de Google sorti le 12 mars 2025. Selon Google, il lit du texte et des images, produit du texte et sert à la réponse aux questions, au résumé et au raisonnement.
Gemma 3 27B est un modèle de Google sorti le 12 mars 2025. Selon Google, il lit du texte et des images, produit du texte et convient à la réponse aux questions, au résumé et au raisonnement.
Gemma 4 26B A4B est publié par Google le 2 avril 2026. Selon Google, il lit du texte et des images, analyse une vidéo comme une suite d’images et produit du texte ; il peut animer des interfaces conversationnelles, analyser des documents et générer du code.
Gemma 4 31B, publié par Google le 2 avril 2026, lit du texte et des images, analyse la vidéo comme une suite d’images et produit du texte. Selon Google, il sert à construire des interfaces conversationnelles et des agents utilisant des outils, à analyser des documents et à générer, compléter ou corriger du code.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Gemma 3 4B est-il sorti ?
Gemma 3 4B est sorti le 12 mars 2025. Selon Google, à sa sortie, le modèle était proposé au téléchargement sur Hugging Face et Kaggle.
Gemma 3 4B peut-il lire des images ?
Gemma 3 4B peut analyser des images et répondre à des questions sur une image, selon Google à sa sortie. Selon Google, à sa sortie, le modèle de vision était identique pour les tailles 4B, 12B et 27B.
Gemma 3 4B est-il disponible sur Ollama ?
Gemma 3 4B faisait partie des modèles proposés au téléchargement sur Ollama à sa sortie, selon Google. Cet accès concernait les modèles de la famille Gemma 3, selon l’annonce de Google.
Quelle mémoire faut-il pour faire tourner Gemma 3 4B ?
Gemma 3 4B occupe 8,0 Go pour ses poids en bfloat16 et 2,6 Go après quantification en int4, selon le rapport technique de Google. Avec le cache KV, qui conserve les clés et les valeurs utilisées par le mécanisme d’attention, un contexte de 32 768 tokens porte ces besoins respectivement à 12,7 Go et 7,3 Go, selon le rapport technique de Google.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.