Revue publiée le Scores mis à jour le
Comparer

Google : Gemini 2.5 Flash

Nouvelle version : Gemini 3 Flash Preview

Gemini 2.5 Flash est un modèle de Google, sorti en version stable le 17 juin 2025, qui lit le texte, l’image, la vidéo et l’audio et répond en texte. Selon Google, il est conçu pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, ainsi que pour les cas d’usage agentiques.

Ce que Gemini 2.5 Flash change par rapport à Gemini 2.0 Flash

Gemini 2.5 Flash devient, selon Google, le premier modèle Flash doté de capacités de réflexion, une capacité absente de Gemini 2.0 Flash. À l’annonce de la préversion, le 17 avril 2025, il s’appuie sur la base de son prédécesseur et apporte, selon l’éditeur, un net progrès en raisonnement tout en privilégiant la vitesse et le coût. Il permet aussi de voir son processus de réflexion pendant la génération de sa réponse.

Selon Google, la version stable du 17 juin 2025 reprend sans changement le modèle de la préversion 05-20 présentée à Google I/O. À cette sortie, l’éditeur supprime l’écart de prix entre réflexion activée et désactivée. Un seul palier tarifaire s’applique, quelle que soit la taille de l’entrée. Par rapport à la préversion, le prix des jetons d’entrée augmente, tandis que celui des jetons de sortie baisse.

Gemini 2.5 Flash ou Gemini 2.5 Pro : lequel choisir ?

Gemini 2.5 Flash vise, selon Google, les traitements à grande échelle qui demandent de la réflexion, avec un fort volume et une faible latence, ainsi que les usages agentiques. À sa sortie, Gemini 2.5 Pro était facturé au-dessus de lui. Google a rendu les deux modèles stables le même jour.

Selon Google, Pro se distingue pour les tâches exigeant le plus d’intelligence et de capacités, notamment le code et les tâches agentiques. Selon Google encore, la réflexion se désactive sur Flash, alors qu’elle est obligatoire sur Pro.

À quoi sert Gemini 2.5 Flash

Chat

Gemini 2.5 Flash lit le texte, l’image, la vidéo et l’audio et répond en texte, selon Google. À la sortie de sa version stable, il était accessible dans l’application Gemini, selon Google.

Vision et compréhension

Gemini 2.5 Flash accepte, selon Google, jusqu’à 3 000 images par requête et des fichiers PDF ou texte jusqu’à 3 000 pages par fichier. Pour le résumé audio, la transcription et la traduction, il comprend la parole, selon Google.

Code

Gemini 2.5 Flash prend en charge, selon Google, l’exécution de code, l’appel de fonction, l’ancrage avec la recherche Google et les sorties structurées. Selon Google, le 20 mai 2025, la préversion mise à jour 05-20, reprise sans changement par la version stable, s’améliore sur les tests de référence du raisonnement, de la multimodalité, du code et du contexte long, avec entre 20 et 30 % de jetons en moins dans ses évaluations.

  • Chat1409
  • Vision et compréhension1215
  • Code
Comment lire ces scores

Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.

Bien utiliser Gemini 2.5 Flash : réflexion et budget

Gemini 2.5 Flash règle sa réflexion avec le paramètre thinking_budget, qui définit, selon Google, une limite souple du nombre de jetons consacrés au raisonnement. Dès l’annonce de sa préversion, le 17 avril 2025, Google indique que ce budget peut aller de 0 à 24 576 jetons.

Sans budget fixé, le modèle détermine lui-même son budget de réflexion, jusqu’à 8 192 jetons, selon Google. Une valeur de -1 active explicitement ce fonctionnement dynamique. Avec un budget de 0, la réflexion est désactivée, même si le texte généré peut encore prendre la forme d’un raisonnement. Selon Google, un budget plus faible, ou nul, réduit la latence, c’est-à-dire le délai nécessaire pour obtenir la réponse.

Caractéristiques techniques de Gemini 2.5 Flash

Gemini 2.5 Flash est sorti en version stable le 17 juin 2025 ; au relevé du 8 octobre 2026, sur OpenRouter, sa fenêtre de contexte est de 1 048 576 tokens. Selon Google, il produit au plus 65 536 jetons par réponse. Ses connaissances s’arrêtent à janvier 2025, selon Google. Pour les entrées, il accepte le texte, l’image, la vidéo et l’audio, et répond en texte, selon Google. Le bloc des caractéristiques porte la liste complète des spécifications techniques.

Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
janvier 2025
Retrait annoncé (selon OpenRouter)
Tâches
Aide au codeAffaires et financeJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
Google, Google AI Studio

Où utiliser Gemini 2.5 Flash, et comment il se facture

Gemini 2.5 Flash était accessible à sa sortie dans Google AI Studio et Vertex AI en version stable, ainsi que dans l’application Gemini, selon Google. Les cartes d’accès et de prix présentent les fournisseurs et leurs conditions de facturation.

Dans sa version mise à jour le 22 septembre 2026, la documentation de l’API Gemini indique que Google réserve l’accès aux modèles 2.5 aux utilisateurs qui s’en servaient déjà activement. Dans cette même version, Google précise que ces modèles ne sont pas obsolètes.

Google Cloud fixe le retrait du modèle de Gemini Enterprise Agent Platform au 20 octobre 2026. Selon Google Cloud, le modèle peut rester accessible par l’API Gemini après cette date. Selon OpenRouter, sa fin de vie est fixée au même 20 octobre 2026.

L'API Google

Retrait annoncé le 20/10/2026 selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 2,50 $ / M tokens en sortie. Son retrait est annoncé le 20/10/2026 selon OpenRouter.

Tarification0,30 $ en entrée, 2,50 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Gemini 2.5 Flash parmi les versions de Gemini Flash

Gemini 2.5 Flash est présenté par Google en préversion le 17 avril 2025. Une préversion mise à jour suit le 20 mai 2025, avant le passage à la version stable, en disponibilité générale le 17 juin 2025. Gemini 3 Flash Preview, sorti le 17 décembre 2025, lui succède dans la gamme. La frise des versions situe Gemini 2.5 Flash parmi les versions de Gemini Flash.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Gemini 2.5 Flash est-il sorti ?

Gemini 2.5 Flash est passé en disponibilité générale le 17 juin 2025, selon l’annonce de Google. Sa préversion avait été présentée le 17 avril 2025 dans l’API Gemini, via Google AI Studio et Vertex AI.

Quelle est la différence entre Gemini 2.5 Flash et Gemini 2.5 Pro ?

Gemini 2.5 Flash était facturé en dessous de Gemini 2.5 Pro à sa sortie. Selon Google, Flash est fait pour les traitements à grande échelle, à faible latence et à fort volume qui demandent de la réflexion, et sa réflexion se désactive, ce qui n’est pas le cas de Pro.

Peut-on désactiver la réflexion de Gemini 2.5 Flash ?

Gemini 2.5 Flash permet de désactiver la réflexion avec un budget de réflexion réglé à 0, selon Google. Même avec ce réglage, le texte généré peut encore prendre la forme d’un raisonnement.

Comment accéder à Gemini 2.5 Flash ?

Selon Google, à sa sortie, la version stable de Gemini 2.5 Flash était disponible dans Google AI Studio et Vertex AI, et le modèle était accessible dans l’application Gemini. Selon Google Cloud, son retrait de Gemini Enterprise Agent Platform est fixé au 20 octobre 2026.

Quelle version succède à Gemini 2.5 Flash ?

Gemini 3 Flash Preview succède à Gemini 2.5 Flash dans la gamme Flash. Il est sorti le 17 décembre 2025.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.