Revue publiée le Scores mis à jour le
Comparer

Google : Gemma 3 4B

Gemma 3 4B, publié par Google le 12 mars 2025, lit du texte et des images et produit du texte selon Google. Il peut répondre à des questions, résumer des contenus et animer des interfaces conversationnelles, selon Google.

À quoi sert Gemma 3 4B

Conversation

Gemma 3 4B peut animer des interfaces conversationnelles de service client, des assistants virtuels ou des applications interactives, selon la documentation de Google. Selon la documentation de Google, les modèles Gemma 3 conviennent aussi à des tâches de génération de texte et de compréhension d’images, dont la réponse aux questions, le résumé et le raisonnement.

Images et documents

Gemma 3 4B utilise, à sa sortie, le même modèle de vision que les tailles 12B et 27B, selon Google. Il permet d’analyser et de comparer des images, d’identifier des objets et de répondre à des questions sur une image ou sur le texte qu’elle contient, selon Google. Selon la documentation de Google, ses usages comprennent aussi l’extraction, l’interprétation et le résumé de données visuelles sous forme de texte.

Rédaction créative

Gemma 3 4B peut générer des poèmes, des scripts et du code, selon la documentation de Google. Pour la rédaction commerciale et les échanges écrits, le modèle peut également produire des textes marketing et des brouillons d’e-mails, selon Google.

Mathématiques

Gemma 3 4B bénéficie, à sa sortie, d’un entraînement comprenant un apprentissage par renforcement à partir d’un retour automatique, appelé RLMF, destiné à améliorer le raisonnement mathématique, selon Google. Dans les évaluations publiées à sa sortie, sa variante instruite obtient un score de 75,6 sur MATH et de 43,0 sur HiddenMath, selon Google.

  • Chat1303
  • Vision et compréhension
  • Rédaction créative1275
  • Mathématiques1254
Comment lire ces scores

Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.

Les performances de Gemma 3 4B

Gemma 3 4B instruit est compétitif avec Gemma 2 27B instruit grâce à la nouvelle recette de post-entraînement, selon le rapport technique de Google publié à sa sortie. Selon Google, ces évaluations portent sur les modèles instruits, sans exemple dans la consigne : c’est le protocole zero-shot.

Selon Google, à sa sortie, le modèle instruit obtient 75,6 sur MATH et 43,0 sur HiddenMath, contre respectivement 55,6 et 14,8 pour Gemma 2 27B instruit. Sur MMLU-Pro et LiveCodeBench, selon Google, à sa sortie, la comparaison oppose les scores repris dans le tableau à respectivement 56,9 et 20,4 pour Gemma 2 27B instruit. Le tableau rassemble les autres scores annoncés par Google à sa sortie, avec le nom de chaque évaluation.

ÉvaluationScore annoncé par Google à sa sortie
MMLU-Pro43,6
LiveCodeBench12,6
Bird-SQL (dev)36,3
GPQA Diamond30,8
SimpleQA4,0
FACTS Grounding70,1
Global MMLU-Lite54,5
MMMU (val)48,8

Caractéristiques techniques de Gemma 3 4B

Gemma 3 4B est sorti le 12 mars 2025 sous licence Gemma Terms of Use. Le bloc des caractéristiques présente la date de sortie, la fenêtre de contexte, la réponse maximale, les entrées, la licence, les paramètres et les hébergeurs.

Selon Google, la fenêtre de contexte atteint 128K tokens, les unités de texte traitées par le modèle. Sur OpenRouter, une réponse peut contenir au plus 16 384 tokens. Selon la documentation de Google, le modèle accepte du texte et des images en entrée et produit du texte, avec des poids ouverts en version pré-entraînée comme en version ajustée aux instructions.

Selon Google, l’entraînement du modèle a porté sur quatre mille milliards de tokens. D’après la documentation de Google, les données d’entraînement s’arrêtent en août 2024. À sa sortie, selon Google, Gemma 3 prend en charge plus de 35 langues sans adaptation, et son pré-entraînement en couvre plus de 140.

Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
131 k tokens
Réponse maximale (selon OpenRouter)
16 k tokens
Réflexion (selon OpenRouter)
Non prise en charge
Connaissances jusqu'à (selon OpenRouter)
août 2024
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte, Image
Licence
Gemma Terms of Use
Paramètres pris en charge (noms techniques de l'API OpenRouter)
structured_outputstemperaturetop_pseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
DeepInfra

Où utiliser Gemma 3 4B, et comment il se facture

Gemma 3 4B appartient, à sa sortie, à une famille conçue pour tourner directement sur des appareils, du téléphone et de l’ordinateur portable à la station de travail, selon Google. La carte d’accès donne les derniers prix relevés.

  • Téléchargement des modèles : à sa sortie, selon Google, Gemma 3 se télécharge sur Hugging Face, Ollama ou Kaggle.
  • Déploiement sur les services de Google : à sa sortie, selon Google, Gemma 3 se déploie à grande échelle sur Vertex AI. À sa sortie, selon Google, son inférence, c’est-à-dire l’exécution du modèle pour produire une réponse, fonctionne aussi sur Cloud Run avec Ollama.
  • Versions quantifiées : à sa sortie, selon Google, Gemma 3 propose des versions quantifiées officielles, qui réduisent la taille du modèle et les besoins de calcul.

L'API chez des hébergeurs

Servi par d'autres hébergeurs que Google, selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,050 $ / M tokens en entrée, 0,10 $ / M tokens en sortie.

Tarification0,050 $ en entrée, 0,10 $ en sortie, par million de tokens
Hébergé via OpenRouter chezDeepInfra

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Gemma 3 4B parmi les versions de Gemma

Gemma 3 4B appartient à la génération Gemma 3, arrivée après la génération Gemma 2, dont Gemma 2 27B est sorti le 27 juin 2024. Selon Google, à sa sortie, le 12 mars 2025, Gemma 3 existe en quatre tailles : 1B, 4B, 12B et 27B. Ces tailles permettent, selon Google, de choisir le modèle selon son matériel et les performances visées.

Gemma 3 12B et Gemma 3 27B sont d’autres tailles de la même génération, sorties le même jour que la variante 4B. Puis Gemma 4 26B A4B et Gemma 4 31B sont sortis le 2 avril 2026. La frise des versions situe ces modèles dans la famille Gemma et porte leurs dates de sortie.

  1. Gemma 4 31B
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Gemma 3 4B est-il sorti ?

Gemma 3 4B est sorti le 12 mars 2025. Selon Google, à sa sortie, le modèle était proposé au téléchargement sur Hugging Face et Kaggle.

Gemma 3 4B peut-il lire des images ?

Gemma 3 4B peut analyser des images et répondre à des questions sur une image, selon Google à sa sortie. Selon Google, à sa sortie, le modèle de vision était identique pour les tailles 4B, 12B et 27B.

Gemma 3 4B est-il disponible sur Ollama ?

Gemma 3 4B faisait partie des modèles proposés au téléchargement sur Ollama à sa sortie, selon Google. Cet accès concernait les modèles de la famille Gemma 3, selon l’annonce de Google.

Quelle mémoire faut-il pour faire tourner Gemma 3 4B ?

Gemma 3 4B occupe 8,0 Go pour ses poids en bfloat16 et 2,6 Go après quantification en int4, selon le rapport technique de Google. Avec le cache KV, qui conserve les clés et les valeurs utilisées par le mécanisme d’attention, un contexte de 32 768 tokens porte ces besoins respectivement à 12,7 Go et 7,3 Go, selon le rapport technique de Google.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.