Gemini 3.5 Flash est un modèle de Google sorti le 19 mai 2026, qui lit du texte, des images, de la vidéo, des fichiers et de l'audio. Google en fait à sa sortie le modèle par défaut de l'application Gemini, et le destine aussi à la lecture de documents et aux boucles agentiques de code.
Ce que Gemini 3.5 Flash change par rapport à Gemini 3 Flash Preview
Gemini 3.5 Flash succède à Gemini 3 Flash Preview, sorti le 17 décembre 2025. D’après OpenRouter, la réflexion était facultative chez Gemini 3 Flash Preview, elle devient obligatoire chez Gemini 3.5 Flash. Selon le guide de migration de Google, l’effort de réflexion par défaut change aussi : il était high dans la version preview de Gemini 3 Flash, il passe à medium.
Ce qui change
Gemini 3 Flash Preview
Gemini 3.5 Flash
Réflexion (d’après OpenRouter)
facultative
obligatoire
Effort de réflexion par défaut (selon Google)
high
medium
Diffusion (selon Google)
preview
disponibilité générale
Le reste est repris : selon Google, Gemini 3.5 Flash garde la fenêtre de contexte d’un million de jetons, la réflexion et le même ensemble d’outils que Gemini 3 Flash. Une nouveauté touche l’API GenerateContent : à partir de Gemini 3.5 Flash, le modèle reprend le raisonnement de tous les tours précédents d’une conversation, quand des signatures de pensée figurent dans l’historique.
La carte du modèle publiée par Google DeepMind indique qu’il repose sur Gemini 3 Flash et fait mieux que lui en sécurité et en ton, tout en gardant peu de refus injustifiés. À sa sortie, il est en revanche facturé plus cher que Gemini 3 Flash Preview : pour un usage très sensible au coût, Google conseille plutôt Gemini 3.1 Flash Lite.
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,50 $ / M tokens→1,50 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)3 $ / M tokens→9 $ / M tokens
Gemini 3.5 Flash, Gemini 3.1 Flash Lite ou Gemini 3.1 Pro Preview : lequel choisir ?
À sa sortie, Gemini 3.5 Flash se place entre deux autres modèles de Google : Gemini 3.1 Flash Lite, facturé en dessous de lui, et Gemini 3.1 Pro Preview, facturé au-dessus.
Gemini 3.1 Flash Lite : Google le recommande pour les tâches à faible coût et à volume élevé qui n’ont pas besoin de la profondeur de raisonnement de Gemini 3.5 Flash.
Gemini 3.1 Pro Preview : à la sortie de Gemini 3.5 Flash, il est facturé au-dessus de lui, mais Google annonce que Gemini 3.5 Flash le dépasse sur des tests de code et d’agents comme Terminal-Bench 2.1, GDPval-AA et MCP Atlas.
À quoi sert Gemini 3.5 Flash
Chat
Selon Google, Gemini 3.5 Flash devient à sa sortie le modèle par défaut de l’application Gemini et du mode IA de la Recherche, dans le monde entier.
Vision et compréhension
Gemini 3.5 Flash lit des images, de la vidéo et des fichiers en plus du texte. Google cite Ramp, qu’il aide à mettre en place une reconnaissance optique des caractères plus intelligente et plus fiable, grâce à sa compréhension multimodale des factures complexes.
Business et finance
Selon Google, Gemini 3.5 Flash aide à préparer des documents financiers. Macquarie Bank teste le modèle pour accélérer l’accueil de ses clients, en appuyant son analyse sur des documents complexes de plus de 100 pages.
Code
Selon Google, Gemini 3.5 Flash est particulièrement efficace pour les boucles agentiques rapides, faites de cycles de code et d’itérations complexes. Il sait aussi appeler des outils et produire des sorties structurées.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances de Gemini 3.5 Flash
Les chiffres du tableau sont ceux que Google a publiés à la sortie de Gemini 3.5 Flash, sur des tests qu’il a choisis. Google le présente alors comme son modèle agentique et de codage le plus solide, avec une intelligence qui rivalise sur plusieurs plans avec les plus grands modèles, aux vitesses attendues de la série Flash.
Évaluation (Google, à la sortie)
Ce qu’elle mesure, selon Google
Gemini 3.5 Flash
Terminal-Bench 2.1
code et agents
76,2 %
MCP Atlas
code et agents
83,6 %
CharXiv Reasoning
compréhension multimodale
84,2 %
Sur Terminal-Bench 2.1, GDPval-AA et MCP Atlas, Google annonce que Gemini 3.5 Flash dépasse Gemini 3.1 Pro Preview. Ce sont des annonces de l’éditeur à la sortie du modèle, pas un classement entre tous les modèles.
Bien utiliser Gemini 3.5 Flash : réflexion et effort
Selon Google, Gemini 3.5 Flash propose quatre niveaux d’effort de réflexion : minimal, low, medium (par défaut) et high.
La réflexion ne se coupe pas sur OpenRouter : elle y est activée par défaut et obligatoire. Selon Google, même le niveau minimal ne garantit pas qu’elle soit désactivée : le modèle peut encore raisonner un peu sur une tâche complexe.
Commencer par medium : c’est l’effort par défaut, et Google le conseille comme point de départ, car il offre selon lui la meilleure qualité pour la grande majorité des tâches.
Descendre à low ou minimal pour la vitesse : Google propose low pour une expérience plus rapide et moins chère qui garde une qualité élevée, et minimal pour optimiser la vitesse des requêtes simples.
Monter à high pour les cas difficiles : Google le conseille pour les problèmes de raisonnement complexes, les mathématiques difficiles et les défis de code difficiles.
Caractéristiques techniques de Gemini 3.5 Flash
Gemini 3.5 Flash est sorti le 19 mai 2026. Il lit du texte, des images, de la vidéo, des fichiers et de l’audio ; sa fenêtre de contexte atteint 1 048 576 tokens, et il produit au plus 65 536 tokens par réponse.
Le bloc des caractéristiques en donne la liste complète.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Toujours active
Connaissances jusqu'à (selon OpenRouter)
janvier 2025
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemini 3.5 Flash parmi les versions de Gemini Flash
Gemini 3.5 Flash prend place dans la suite des versions de Gemini Flash : Gemini 2.5 Flash est sorti le 17 juin 2025, Gemini 3 Flash Preview le 17 décembre 2025, Gemini 3.5 Flash le 19 mai 2026, puis Gemini 3.6 Flash, son successeur, le 21 juillet 2026.
Gemini 3 Flash Preview est donc la version qui le précède, et Gemini 3.6 Flash celle qui lui succède ; la frise montre toute la suite des versions.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemini 3.5 FlashVous êtes ici
Gemini 2.5 Flash
Gemini 3 Flash Preview
Gemini 3.6 Flash
Gemini 3.7 Flash
Gemini 3.8 Flash
Score
1488
1409
1510
1540
1538
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
1,50 $ / M tokens
0,30 $ / M tokens
0,50 $ / M tokens
0,75 $ / M tokens
0,75 $ / M tokens
0,75 $ / M tokens
Prix de sortie
9 $ / M tokens
2,50 $ / M tokens
3 $ / M tokens
3,75 $ / M tokens
3,75 $ / M tokens
3,75 $ / M tokens
Entrées
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Réflexion
Toujours active
Facultative
Facultative
Toujours active
Toujours active
Toujours active
Tâches
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemini 3.5 Flash est un modèle de Google sorti le 19 mai 2026, qui lit du texte, des images, de la vidéo, des fichiers et de l'audio. Google en fait à sa sortie le modèle par défaut de l'application Gemini, et le destine aussi à la lecture de documents et aux boucles agentiques de code.
Gemini 2.5 Flash est un modèle de Google, sorti en version stable le 17 juin 2025, qui lit le texte, l’image, la vidéo et l’audio et répond en texte. Selon Google, il est conçu pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, ainsi que pour les cas d’usage agentiques.
Gemini 3 Flash Preview est un modèle de Google sorti le 17 décembre 2025 ; selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et répond en texte. À sa sortie, selon Google, il sert aux tâches du quotidien et au développement itératif.
Gemini 3.6 Flash est un modèle publié par Google le 21 juillet 2026. Selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, produit du texte et sert à l’analyse de documents, à la rédaction de rapports et au code.
Gemini 3.7 Flash, publié par Google le 13 août 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et produit du texte, selon Google. Selon la carte du modèle de Google DeepMind, ses usages comprennent les workflows d’agents, le raisonnement complexe sur la vidéo, les tâches de code et les workflows d’entreprise.
Gemini 3.8 Flash est publié par Google le 2 septembre 2026 en disponibilité générale et conçu pour l’ingénierie logicielle sur le long terme, les agents autonomes et les workflows d’entreprise complexes, selon les notes de version de l’API Gemini. Selon la page du modèle de Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
C’est quoi Gemini Flash ?
Gemini Flash est une série de modèles de Google, que l’éditeur associe à la vitesse : il annonce Gemini 3.5 Flash aux vitesses attendues de la série Flash. Gemini 3.5 Flash, sorti le 19 mai 2026, y succède à Gemini 3 Flash Preview et précède Gemini 3.6 Flash.
Quelle est la différence entre Gemini Flash et Gemini Pro ?
À la sortie de Gemini 3.5 Flash, Gemini 3.1 Pro Preview est facturé au-dessus de lui dans la gamme de Google. Google annonce pourtant que Gemini 3.5 Flash le dépasse sur des tests de code et d’agents (Terminal-Bench 2.1, GDPval-AA, MCP Atlas).
Gemini 3.5 Flash est-il en GA ?
Oui. Google recommande de migrer vers Gemini 3.5 Flash pour la stabilité de la disponibilité générale, alors que Gemini 3 Flash restait proposé en preview aux développeurs qui voulaient continuer à le tester. Google l’a présenté le 19 mai 2026.
Est-ce que l’IA Gemini est gratuite ?
À sa sortie, Gemini 3.5 Flash est accessible à tous dans l’application Gemini et dans le mode IA de la Recherche, dont il devient le modèle par défaut. Par l’API, Google le dit, à sa sortie, plus cher que Gemini 3 Flash Preview.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.