Gemini 2.5 Flash est un modèle de Google, sorti en version stable le 17 juin 2025, qui lit le texte, l’image, la vidéo et l’audio et répond en texte. Selon Google, il est conçu pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, ainsi que pour les cas d’usage agentiques.
Ce que Gemini 2.5 Flash change par rapport à Gemini 2.0 Flash
Gemini 2.5 Flash devient, selon Google, le premier modèle Flash doté de capacités de réflexion, une capacité absente de Gemini 2.0 Flash. À l’annonce de la préversion, le 17 avril 2025, il s’appuie sur la base de son prédécesseur et apporte, selon l’éditeur, un net progrès en raisonnement tout en privilégiant la vitesse et le coût. Il permet aussi de voir son processus de réflexion pendant la génération de sa réponse.
Selon Google, la version stable du 17 juin 2025 reprend sans changement le modèle de la préversion 05-20 présentée à Google I/O. À cette sortie, l’éditeur supprime l’écart de prix entre réflexion activée et désactivée. Un seul palier tarifaire s’applique, quelle que soit la taille de l’entrée. Par rapport à la préversion, le prix des jetons d’entrée augmente, tandis que celui des jetons de sortie baisse.
Gemini 2.5 Flash ou Gemini 2.5 Pro : lequel choisir ?
Gemini 2.5 Flash vise, selon Google, les traitements à grande échelle qui demandent de la réflexion, avec un fort volume et une faible latence, ainsi que les usages agentiques. À sa sortie, Gemini 2.5 Pro était facturé au-dessus de lui. Google a rendu les deux modèles stables le même jour.
Selon Google, Pro se distingue pour les tâches exigeant le plus d’intelligence et de capacités, notamment le code et les tâches agentiques. Selon Google encore, la réflexion se désactive sur Flash, alors qu’elle est obligatoire sur Pro.
À quoi sert Gemini 2.5 Flash
Chat
Gemini 2.5 Flash lit le texte, l’image, la vidéo et l’audio et répond en texte, selon Google. À la sortie de sa version stable, il était accessible dans l’application Gemini, selon Google.
Vision et compréhension
Gemini 2.5 Flash accepte, selon Google, jusqu’à 3 000 images par requête et des fichiers PDF ou texte jusqu’à 3 000 pages par fichier. Pour le résumé audio, la transcription et la traduction, il comprend la parole, selon Google.
Code
Gemini 2.5 Flash prend en charge, selon Google, l’exécution de code, l’appel de fonction, l’ancrage avec la recherche Google et les sorties structurées. Selon Google, le 20 mai 2025, la préversion mise à jour 05-20, reprise sans changement par la version stable, s’améliore sur les tests de référence du raisonnement, de la multimodalité, du code et du contexte long, avec entre 20 et 30 % de jetons en moins dans ses évaluations.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Bien utiliser Gemini 2.5 Flash : réflexion et budget
Gemini 2.5 Flash règle sa réflexion avec le paramètre thinking_budget, qui définit, selon Google, une limite souple du nombre de jetons consacrés au raisonnement. Dès l’annonce de sa préversion, le 17 avril 2025, Google indique que ce budget peut aller de 0 à 24 576 jetons.
Sans budget fixé, le modèle détermine lui-même son budget de réflexion, jusqu’à 8 192 jetons, selon Google. Une valeur de -1 active explicitement ce fonctionnement dynamique. Avec un budget de 0, la réflexion est désactivée, même si le texte généré peut encore prendre la forme d’un raisonnement. Selon Google, un budget plus faible, ou nul, réduit la latence, c’est-à-dire le délai nécessaire pour obtenir la réponse.
Caractéristiques techniques de Gemini 2.5 Flash
Gemini 2.5 Flash est sorti en version stable le 17 juin 2025 ; au relevé du 8 octobre 2026, sur OpenRouter, sa fenêtre de contexte est de 1 048 576 tokens. Selon Google, il produit au plus 65 536 jetons par réponse. Ses connaissances s’arrêtent à janvier 2025, selon Google. Pour les entrées, il accepte le texte, l’image, la vidéo et l’audio, et répond en texte, selon Google. Le bloc des caractéristiques porte la liste complète des spécifications techniques.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
janvier 2025
Retrait annoncé (selon OpenRouter)
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Gemini 2.5 Flash, et comment il se facture
Gemini 2.5 Flash était accessible à sa sortie dans Google AI Studio et Vertex AI en version stable, ainsi que dans l’application Gemini, selon Google. Les cartes d’accès et de prix présentent les fournisseurs et leurs conditions de facturation.
Dans sa version mise à jour le 22 septembre 2026, la documentation de l’API Gemini indique que Google réserve l’accès aux modèles 2.5 aux utilisateurs qui s’en servaient déjà activement. Dans cette même version, Google précise que ces modèles ne sont pas obsolètes.
Google Cloud fixe le retrait du modèle de Gemini Enterprise Agent Platform au 20 octobre 2026. Selon Google Cloud, le modèle peut rester accessible par l’API Gemini après cette date. Selon OpenRouter, sa fin de vie est fixée au même 20 octobre 2026.
L'API Google
Retrait annoncé le 20/10/2026 selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 2,50 $ / M tokens en sortie. Son retrait est annoncé le 20/10/2026 selon OpenRouter.
Tarification0,30 $ en entrée, 2,50 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemini 2.5 Flash parmi les versions de Gemini Flash
Gemini 2.5 Flash est présenté par Google en préversion le 17 avril 2025. Une préversion mise à jour suit le 20 mai 2025, avant le passage à la version stable, en disponibilité générale le 17 juin 2025. Gemini 3 Flash Preview, sorti le 17 décembre 2025, lui succède dans la gamme. La frise des versions situe Gemini 2.5 Flash parmi les versions de Gemini Flash.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemini 2.5 FlashVous êtes ici
Gemini 3 Flash Preview
Gemini 3.5 Flash
Gemini 3.6 Flash
Gemini 3.7 Flash
Gemini 3.8 Flash
Score
1409
1488
1510
1540
1538
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
0,30 $ / M tokens
0,50 $ / M tokens
1,50 $ / M tokens
0,75 $ / M tokens
0,75 $ / M tokens
0,75 $ / M tokens
Prix de sortie
2,50 $ / M tokens
3 $ / M tokens
9 $ / M tokens
3,75 $ / M tokens
3,75 $ / M tokens
3,75 $ / M tokens
Entrées
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Réflexion
Facultative
Facultative
Toujours active
Toujours active
Toujours active
Toujours active
Tâches
Aide au code, Affaires et finance, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemini 2.5 Flash est un modèle de Google, sorti en version stable le 17 juin 2025, qui lit le texte, l’image, la vidéo et l’audio et répond en texte. Selon Google, il est conçu pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, ainsi que pour les cas d’usage agentiques.
Gemini 3 Flash Preview est un modèle de Google sorti le 17 décembre 2025 ; selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et répond en texte. À sa sortie, selon Google, il sert aux tâches du quotidien et au développement itératif.
Gemini 3.5 Flash est un modèle de Google sorti le 19 mai 2026, qui lit du texte, des images, de la vidéo, des fichiers et de l'audio. Google en fait à sa sortie le modèle par défaut de l'application Gemini, et le destine aussi à la lecture de documents et aux boucles agentiques de code.
Gemini 3.6 Flash est un modèle publié par Google le 21 juillet 2026. Selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, produit du texte et sert à l’analyse de documents, à la rédaction de rapports et au code.
Gemini 3.7 Flash, publié par Google le 13 août 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et produit du texte, selon Google. Selon la carte du modèle de Google DeepMind, ses usages comprennent les workflows d’agents, le raisonnement complexe sur la vidéo, les tâches de code et les workflows d’entreprise.
Gemini 3.8 Flash est publié par Google le 2 septembre 2026 en disponibilité générale et conçu pour l’ingénierie logicielle sur le long terme, les agents autonomes et les workflows d’entreprise complexes, selon les notes de version de l’API Gemini. Selon la page du modèle de Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Gemini 2.5 Flash est-il sorti ?
Gemini 2.5 Flash est passé en disponibilité générale le 17 juin 2025, selon l’annonce de Google. Sa préversion avait été présentée le 17 avril 2025 dans l’API Gemini, via Google AI Studio et Vertex AI.
Quelle est la différence entre Gemini 2.5 Flash et Gemini 2.5 Pro ?
Gemini 2.5 Flash était facturé en dessous de Gemini 2.5 Pro à sa sortie. Selon Google, Flash est fait pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, et sa réflexion se désactive, ce qui n’est pas le cas de Pro.
Peut-on désactiver la réflexion de Gemini 2.5 Flash ?
Gemini 2.5 Flash permet de désactiver la réflexion avec un budget de réflexion réglé à 0, selon Google. Même avec ce réglage, le texte généré peut encore prendre la forme d’un raisonnement.
Comment accéder à Gemini 2.5 Flash ?
Selon Google, à sa sortie, la version stable de Gemini 2.5 Flash était disponible dans Google AI Studio et Vertex AI, et le modèle était accessible dans l’application Gemini. Selon Google Cloud, son retrait de Gemini Enterprise Agent Platform est fixé au 20 octobre 2026.
Quelle version succède à Gemini 2.5 Flash ?
Gemini 3 Flash Preview succède à Gemini 2.5 Flash dans la gamme Flash. Il est sorti le 17 décembre 2025.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.