Gemini 3.8 Flash est publié par Google le 2 septembre 2026 en disponibilité générale et conçu pour l’ingénierie logicielle sur le long terme, les agents autonomes et les workflows d’entreprise complexes, selon les notes de version de l’API Gemini. Selon la page du modèle de Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Ce que Gemini 3.8 Flash change par rapport à Gemini 3.7 Flash
Gemini 3.8 Flash repose sur Gemini 3.7 Flash, selon la carte du modèle publiée par Google DeepMind le 2 septembre 2026. Dans cette même carte, Google DeepMind annonce des progrès de performance en ingénierie logicielle et dans les processus de travail fondés sur la connaissance menés par des agents, tout en conservant des niveaux d’effort réglables pour doser qualité, coût et latence.
Selon la carte de Google DeepMind du 2 septembre 2026, les deux versions ont un comportement similaire en matière de sécurité et de ton. En revanche, selon cette même carte de Google DeepMind, la sécurité dans les langues autres que l’anglais recule légèrement, avec un écart de +5,4 points à l’évaluation automatique de sécurité multilingue.
Selon la documentation de Google mise à jour le 25 septembre 2026, les deux versions partagent les niveaux de réflexion low, medium et high. Medium reste le niveau par défaut, selon cette documentation de Google. Le tableau d’écart compare les fenêtres de contexte, les formats d’entrée et la réflexion relevés sur OpenRouter.
Réflexion (selon OpenRouter)Toujours active→Toujours active
Gemini 3.8 Flash ou Gemini 3.5 Flash Lite ou Gemini 3.1 Pro Preview : lequel choisir ?
Gemini 3.8 Flash occupait, à sa sortie, une position tarifaire intermédiaire sur OpenRouter : Gemini 3.5 Flash Lite était facturé en dessous, et Gemini 3.1 Pro Preview au-dessus.
Selon les notes de version de l’API Gemini du 21 juillet 2026, Google présentait Flash Lite à sa sortie comme une option de sous-agent à faible latence et très économique, conçue pour l’automatisation en volume. Selon la page de tarifs de l’API Gemini dans sa version d’octobre 2026, le modèle Pro de troisième génération était conçu pour la compréhension multimodale, les capacités d’agent et le vibe coding, la programmation guidée par des instructions en langage naturel.
À quoi sert Gemini 3.8 Flash
Gemini 3.8 Flash est conçu, selon Google à sa sortie, pour l’ingénierie logicielle sur le long terme, les agents autonomes et les workflows d’entreprise complexes. Selon le guide de Google, le modèle permet de construire des processus de planification en plusieurs étapes et d’orchestration d’outils.
Chat
Le modèle est distribué à sa sortie dans l’application Gemini et dans le mode IA de Google, selon la carte du modèle publiée par Google DeepMind le 2 septembre 2026. Selon le guide des nouveautés de Google, son niveau de réflexion low réduit le temps de réponse pour le chat en temps réel.
Vision et compréhension
Selon la page du modèle de Google, il lit l’image, la vidéo, l’audio et le PDF en plus du texte, et répond en texte. Pour la compréhension de longues vidéos, il obtient à sa sortie 87,8 % à LVBench en mode agentique, contre 85,4 % pour Gemini 3.7 Flash, selon Google DeepMind.
Code
Selon le guide de Google, le modèle donne de bons résultats sur des tests de code réels et sur le remaniement complexe de plusieurs fichiers. Il obtient également de bons résultats sur l’exécution déterministe d’outils, selon ce même guide. Selon la page du modèle de Google, il prend en charge l’exécution de code, l’appel de fonction et les sorties structurées.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances de Gemini 3.8 Flash
Gemini 3.8 Flash obtient, selon Google DeepMind dans sa carte publiée le 2 septembre 2026, 73,7 % à DeepSWE v1.1, qui évalue l’ingénierie logicielle sur le long terme, contre 65,3 % pour Gemini 3.7 Flash. À sa sortie, selon Google DeepMind, il atteint 89,4 % à Terminal-bench 2.1, consacré au code d’agent dans le terminal, contre 85,8 % pour Gemini 3.7 Flash.
Sur OSWorld-2.0, qui évalue l’utilisation d’un ordinateur par un agent, le modèle obtient à sa sortie un score partiel de 59,0 %, selon Google DeepMind, contre 50,6 % pour Gemini 3.7 Flash. Pour la compréhension de longues vidéos, il atteint à sa sortie 87,8 % à LVBench en mode agentique, selon Google DeepMind, contre 85,4 % pour Gemini 3.7 Flash.
Bien utiliser Gemini 3.8 Flash : réflexion et effort
Gemini 3.8 Flash accepte les niveaux de réflexion low, medium et high, selon la page du modèle de Google. Selon le guide de Google sur les nouveautés du modèle, le niveau par défaut est medium.
Sur OpenRouter, la réflexion est obligatoire. Selon la page du modèle de Google, le niveau minimal n’est pas pris en charge et renvoie une erreur. Selon le guide des nouveautés de Google, le niveau low réduit le temps de réponse des tâches sensibles à la latence, comme le chat en temps réel ou la rédaction de brouillons. Pour le code complexe et les usages d’agent, Google recommande medium. Pour le raisonnement approfondi, les mathématiques et les tâches difficiles en plusieurs étapes, Google conseille high.
Selon le guide des nouveautés de Google, le modèle peut, par conception, consommer davantage de tokens sur les tâches longues et complexes : il avance par petites étapes de raisonnement, appelle les outils de façon itérative et vérifie son travail. Pour les tâches courantes, Google conseille de baisser l’effort de réflexion afin de réduire cette consommation.
Caractéristiques techniques de Gemini 3.8 Flash
Gemini 3.8 Flash est publié en disponibilité générale le 2 septembre 2026, selon les notes de version de l’API Gemini de Google. Le tableau des caractéristiques reprend les données techniques d’OpenRouter.
Selon la page du modèle de Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte. Pour les tokens, la même page de Google fixe la limite d’entrée à 1 048 576 et la limite de sortie à 65 536. Ses connaissances s’arrêtent en mars 2026 selon la carte du modèle de Google DeepMind, mais peuvent s’arrêter en janvier 2025 dans certains domaines, comme pour la famille Gemini 3.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Toujours active
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Série
Gemini
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Gemini 3.8 Flash est distribué à sa sortie dans l’application Gemini, Gemini Enterprise Agent Platform, Google AI Studio, l’API Gemini, le mode IA de Google (Google AI Mode) et Google Antigravity, selon la carte du modèle publiée par Google DeepMind le 2 septembre 2026. La carte d’accès présente les derniers prix relevés.
Selon le guide de Google sur les nouveautés du modèle, le prix de lancement s’applique jusqu’au 31 décembre 2026, puis le prix standard prend effet le 1er janvier 2027. Pour l’API Gemini, un niveau sans frais coexiste avec le niveau payant, selon la page de tarifs de Google dans sa version d’octobre 2026. Selon cette même page de tarifs de Google, les données du niveau sans frais servent à améliorer les produits de Google.
L'API Google
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,75 $ / M tokens en entrée, 3,75 $ / M tokens en sortie.
Tarification0,75 $ en entrée, 3,75 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemini 3.8 Flash parmi les versions de Gemini Flash
Gemini 3.8 Flash s’inscrit dans la famille Gemini Flash, dont la frise des versions présente les modèles avec leurs dates de sortie. Dans cette famille, Gemini 3.5 Flash est sorti le 19 mai 2026. Puis Gemini 3.6 Flash est sorti le 21 juillet 2026. La sortie de Gemini 3.7 Flash date du 13 août 2026.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemini 3.8 FlashVous êtes ici
Gemini 2.5 Flash
Gemini 3 Flash Preview
Gemini 3.5 Flash
Gemini 3.6 Flash
Gemini 3.7 Flash
Score
1538
1409
1488
1510
1540
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
0,75 $ / M tokens
0,30 $ / M tokens
0,50 $ / M tokens
1,50 $ / M tokens
0,75 $ / M tokens
0,75 $ / M tokens
Prix de sortie
3,75 $ / M tokens
2,50 $ / M tokens
3 $ / M tokens
9 $ / M tokens
3,75 $ / M tokens
3,75 $ / M tokens
Entrées
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Réflexion
Toujours active
Facultative
Facultative
Toujours active
Toujours active
Toujours active
Tâches
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemini 3.8 Flash est publié par Google le 2 septembre 2026 en disponibilité générale et conçu pour l’ingénierie logicielle sur le long terme, les agents autonomes et les workflows d’entreprise complexes, selon les notes de version de l’API Gemini. Selon la page du modèle de Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Gemini 2.5 Flash est un modèle de Google, sorti en version stable le 17 juin 2025, qui lit le texte, l’image, la vidéo et l’audio et répond en texte. Selon Google, il est conçu pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, ainsi que pour les cas d’usage agentiques.
Gemini 3 Flash Preview est un modèle de Google sorti le 17 décembre 2025 ; selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et répond en texte. À sa sortie, selon Google, il sert aux tâches du quotidien et au développement itératif.
Gemini 3.5 Flash est un modèle de Google sorti le 19 mai 2026, qui lit du texte, des images, de la vidéo, des fichiers et de l'audio. Google en fait à sa sortie le modèle par défaut de l'application Gemini, et le destine aussi à la lecture de documents et aux boucles agentiques de code.
Gemini 3.6 Flash est un modèle publié par Google le 21 juillet 2026. Selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, produit du texte et sert à l’analyse de documents, à la rédaction de rapports et au code.
Gemini 3.7 Flash, publié par Google le 13 août 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et produit du texte, selon Google. Selon la carte du modèle de Google DeepMind, ses usages comprennent les workflows d’agents, le raisonnement complexe sur la vidéo, les tâches de code et les workflows d’entreprise.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Gemini 3.8 Flash est-il sorti ?
Gemini 3.8 Flash est sorti en disponibilité générale le 2 septembre 2026, selon les notes de version de l’API Gemini de Google. Son identifiant est gemini-3.8-flash, selon ces mêmes notes.
Que peut lire Gemini 3.8 Flash ?
Gemini 3.8 Flash lit le texte, l’image, la vidéo, l’audio et le PDF, selon la page du modèle de Google. Il produit du texte, selon cette même page.
Quelle est la fenêtre de contexte de Gemini 3.8 Flash ?
Gemini 3.8 Flash accepte jusqu’à 1 048 576 tokens en entrée, selon la page du modèle de Google. Sa limite de sortie est de 65 536 tokens, selon cette même page.
Quelle version précède Gemini 3.8 Flash ?
Gemini 3.8 Flash est précédé par Gemini 3.7 Flash dans la gamme. Il repose sur cette version, selon la carte du modèle publiée par Google DeepMind le 2 septembre 2026.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.