Revue publiée le Scores mis à jour le
Comparer

Google : Gemini 2.5 Flash Lite

Nouvelle version : Gemini 3.1 Flash Lite

Gemini 2.5 Flash Lite est un modèle de Google sorti le 22 juillet 2025 qui, selon Google, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction, à la classification et au résumé à grande échelle.

Ce que Gemini 2.5 Flash Lite change par rapport à Gemini 2.0 Flash-Lite

Gemini 2.5 Flash-Lite succède dans la lignée Flash-Lite à Gemini 2.0 Flash-Lite, sorti le 25 février 2025 selon la page des abandons de l’API Gemini de Google. À la sortie de sa version stable, le 22 juillet 2025, il présente selon Google une latence plus faible que son prédécesseur et Gemini 2.0 Flash sur un large échantillon de requêtes.

En code, en mathématiques, en sciences, en raisonnement et en compréhension multimodale, le modèle offre à sa sortie une qualité supérieure à Gemini 2.0 Flash-Lite sur un large éventail de tests de performance, selon Google. Sa version stable repose sur le même modèle sous-jacent que la préversion, selon Google dans son annonce de lancement.

Gemini 2.5 Flash Lite, Gemini 2.5 Flash ou Gemini 2.5 Pro : lequel choisir ?

Gemini 2.5 Flash Lite occupait, à sa sortie, un palier tarifaire inférieur à Gemini 2.5 Flash et Gemini 2.5 Pro sur OpenRouter. Selon Google, à la sortie de sa version stable, il complétait l’ensemble des modèles 2.5 prêts pour la production à grande échelle, après les déclinaisons Pro et Flash.

Selon Google, à l’annonce de la préversion, le modèle visait les usages sensibles au coût et à la latence, demandant moins d’intelligence, avec ou sans réflexion. Gemini 2.5 Pro se distinguait, selon Google lors de cette même annonce, pour les besoins exigeant davantage d’intelligence et de capacités, notamment le code et les tâches agentiques, où le modèle intervient dans un enchaînement d’actions.

À quoi sert Gemini 2.5 Flash Lite

Chat

Gemini 2.5 Flash-Lite équilibre performances et coût pour les tâches sensibles à la latence, comme la traduction et la classification, selon Google à la sortie de sa version stable le 22 juillet 2025. Pour les traitements à haut débit, Google le présente également comme adapté à la classification ou au résumé à grande échelle, lors de l’annonce de sa préversion le 17 juin 2025.

Vision et compréhension

Gemini 2.5 Flash-Lite sert à DocsHound pour traiter de longues vidéos de démonstration de produits et en extraire des milliers de captures d’écran avec une faible latence, afin de les transformer en documentation, selon Google le 22 juillet 2025.

Chez HeyGen, il sert à automatiser la planification de vidéos, à analyser et optimiser leur contenu ainsi qu’à traduire des vidéos, selon Google le 22 juillet 2025. Pour les contenus à traiter, le modèle accepte jusqu’à 3 000 images par requête, des vidéos d’environ 45 minutes avec l’audio et des fichiers PDF de 1 000 pages au plus, selon la documentation de Google Cloud.

  • Chat
  • Vision et compréhension

Bien utiliser Gemini 2.5 Flash Lite : réflexion et budget

Selon Google, à l’annonce de sa préversion le 17 juin 2025, la réflexion de Gemini 2.5 Flash-Lite est désactivée par défaut, contrairement aux autres modèles de Google, parce que le modèle est optimisé pour le coût et la vitesse. Son budget de réflexion se règle alors par un paramètre de l’API, selon Google. À la sortie de la version stable le 22 juillet 2025, le modèle dispose, selon Google, d’un raisonnement natif activable au besoin pour les cas d’usage plus exigeants, avec des budgets réglables.

Selon la documentation de Google Cloud sur la réflexion, le paramètre thinking_budget définit un budget dont le minimum est de 512 jetons. Sans budget fixé, le modèle règle lui-même ce budget, jusqu’à 8 192 jetons, selon la documentation de Google Cloud. Avec un budget à 0, la réflexion est désactivée, selon la documentation de Google Cloud, même si le texte généré peut encore prendre la forme d’un raisonnement.

Caractéristiques techniques de Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite est sorti le 22 juillet 2025 et accepte, selon Google, jusqu’à 1 048 576 jetons en entrée et 65 536 jetons en sortie. Selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et répond en texte. Ses connaissances s’arrêtent en janvier 2025, selon Google.

Selon Google, à l’annonce de sa préversion le 17 juin 2025, le modèle prend en charge l’appel de fonction et les outils natifs de Google : l’ancrage avec la recherche Google, l’exécution de code et le contexte d’URL. Le tableau des caractéristiques rassemble les données techniques du modèle.

Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
janvier 2025
Retrait annoncé (selon OpenRouter)
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
Google, Google AI Studio

Où utiliser Gemini 2.5 Flash Lite, comment il se facture et jusqu’à quand

Gemini 2.5 Flash Lite était disponible en version stable dans Google AI Studio et Vertex AI à sa sortie, le 22 juillet 2025, selon Google. Son identifiant était gemini-2.5-flash-lite, selon l’annonce de Google à cette date.

Selon la page de tarifs de l’API Gemini, dans sa version d’octobre 2026, le modèle dispose d’un niveau sans frais et d’un niveau payant facturé par million de jetons. Les données du niveau sans frais servent à améliorer les produits de Google, selon cette même page de tarifs d’octobre 2026. La carte d’accès donne les derniers prix relevés.

Selon les notes de version de l’API Gemini du 18 septembre 2026, Google réserve l’accès aux modèles 2.5 aux utilisateurs qui s’en sont servis activement. Ces modèles ne sont pas obsolètes et restent servis par l’API jusqu’à nouvel ordre, selon les notes de version de l’API Gemini à cette date.

Selon Google Cloud, le retrait du modèle de Gemini Enterprise Agent Platform est fixé au 20 octobre 2026. Son accès par l’API Gemini peut se poursuivre après cette date, selon Google Cloud. Selon OpenRouter, la fin de vie du modèle est fixée au 20 octobre 2026.

L'API Google

Retrait annoncé le 20/10/2026 selon OpenRouter

Chez OpenRouter (relevé du 05/10/2026) : 0,10 $ / M tokens en entrée, 0,40 $ / M tokens en sortie. Son retrait est annoncé le 20/10/2026 selon OpenRouter.

Tarification0,10 $ en entrée, 0,40 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Gemini 2.5 Flash Lite parmi les versions de Gemini Flash Lite

Gemini 2.5 Flash Lite est publié par Google en préversion sous l’identifiant gemini-2.5-flash-lite-preview-06-17 le 17 juin 2025, puis en version stable sous l’identifiant gemini-2.5-flash-lite le 22 juillet 2025, selon les notes de version de l’API Gemini. Au relevé du 8 octobre 2026, sur OpenRouter, Gemini 3.1 Flash Lite, sorti le 7 mai 2026, lui succède dans la gamme. La frise des versions situe le modèle parmi les versions stables de Gemini Flash Lite, avec leurs dates.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Gemini 2.5 Flash Lite est-il sorti ?

Gemini 2.5 Flash Lite est sorti en préversion le 17 juin 2025, selon les notes de version de l’API Gemini. Google a publié la version stable le 22 juillet 2025, selon ces mêmes notes de version.

Quelle est la différence entre Gemini 2.5 Flash Lite et Gemini 2.5 Flash ?

Gemini 2.5 Flash Lite est présenté par Google, à l’annonce de sa préversion le 17 juin 2025, comme une option moins chère que Gemini 2.5 Flash, avec ou sans réflexion. Selon Google, il vise les usages sensibles au coût et à la latence qui demandent moins d’intelligence du modèle.

Peut-on désactiver la réflexion de Gemini 2.5 Flash Lite ?

Gemini 2.5 Flash Lite désactive sa réflexion lorsque son budget de réflexion est réglé à 0, selon la documentation de Google Cloud. Même avec ce réglage, le texte généré peut encore prendre la forme d’un raisonnement, selon Google Cloud.

L’API de Gemini 2.5 Flash Lite est-elle gratuite ?

Gemini 2.5 Flash Lite dispose d’un niveau sans frais et d’un niveau payant facturé par million de jetons, selon la page de tarifs de l’API Gemini dans sa version d’octobre 2026, avec des données du niveau sans frais utilisées pour améliorer les produits de Google.

Quelle est la date de retrait de Gemini 2.5 Flash Lite ?

Gemini 2.5 Flash Lite a une date de retrait fixée au 20 octobre 2026 sur Gemini Enterprise Agent Platform, selon Google Cloud. Selon Google Cloud, le modèle peut rester accessible par l’API Gemini après cette date.

Quelle version succède à Gemini 2.5 Flash Lite ?

Gemini 2.5 Flash Lite a pour successeur Gemini 3.1 Flash Lite dans la gamme. Ce successeur est sorti le 7 mai 2026.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.