Gemini 2.5 Flash Lite est un modèle de Google sorti le 22 juillet 2025 qui, selon Google, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction, à la classification et au résumé à grande échelle.
Ce que Gemini 2.5 Flash Lite change par rapport à Gemini 2.0 Flash-Lite
Gemini 2.5 Flash-Lite succède dans la lignée Flash-Lite à Gemini 2.0 Flash-Lite, sorti le 25 février 2025 selon la page des abandons de l’API Gemini de Google. À la sortie de sa version stable, le 22 juillet 2025, il présente selon Google une latence plus faible que son prédécesseur et Gemini 2.0 Flash sur un large échantillon de requêtes.
En code, en mathématiques, en sciences, en raisonnement et en compréhension multimodale, le modèle offre à sa sortie une qualité supérieure à Gemini 2.0 Flash-Lite sur un large éventail de tests de performance, selon Google. Sa version stable repose sur le même modèle sous-jacent que la préversion, selon Google dans son annonce de lancement.
Gemini 2.5 Flash Lite, Gemini 2.5 Flash ou Gemini 2.5 Pro : lequel choisir ?
Gemini 2.5 Flash Lite occupait, à sa sortie, un palier tarifaire inférieur à Gemini 2.5 Flash et Gemini 2.5 Pro sur OpenRouter. Selon Google, à la sortie de sa version stable, il complétait l’ensemble des modèles 2.5 prêts pour la production à grande échelle, après les déclinaisons Pro et Flash.
Selon Google, à l’annonce de la préversion, le modèle visait les usages sensibles au coût et à la latence, demandant moins d’intelligence, avec ou sans réflexion. Gemini 2.5 Pro se distinguait, selon Google lors de cette même annonce, pour les besoins exigeant davantage d’intelligence et de capacités, notamment le code et les tâches agentiques, où le modèle intervient dans un enchaînement d’actions.
À quoi sert Gemini 2.5 Flash Lite
Chat
Gemini 2.5 Flash-Lite équilibre performances et coût pour les tâches sensibles à la latence, comme la traduction et la classification, selon Google à la sortie de sa version stable le 22 juillet 2025. Pour les traitements à haut débit, Google le présente également comme adapté à la classification ou au résumé à grande échelle, lors de l’annonce de sa préversion le 17 juin 2025.
Vision et compréhension
Gemini 2.5 Flash-Lite sert à DocsHound pour traiter de longues vidéos de démonstration de produits et en extraire des milliers de captures d’écran avec une faible latence, afin de les transformer en documentation, selon Google le 22 juillet 2025.
Chez HeyGen, il sert à automatiser la planification de vidéos, à analyser et optimiser leur contenu ainsi qu’à traduire des vidéos, selon Google le 22 juillet 2025. Pour les contenus à traiter, le modèle accepte jusqu’à 3 000 images par requête, des vidéos d’environ 45 minutes avec l’audio et des fichiers PDF de 1 000 pages au plus, selon la documentation de Google Cloud.
Chat
Vision et compréhension
Bien utiliser Gemini 2.5 Flash Lite : réflexion et budget
Selon Google, à l’annonce de sa préversion le 17 juin 2025, la réflexion de Gemini 2.5 Flash-Lite est désactivée par défaut, contrairement aux autres modèles de Google, parce que le modèle est optimisé pour le coût et la vitesse. Son budget de réflexion se règle alors par un paramètre de l’API, selon Google. À la sortie de la version stable le 22 juillet 2025, le modèle dispose, selon Google, d’un raisonnement natif activable au besoin pour les cas d’usage plus exigeants, avec des budgets réglables.
Selon la documentation de Google Cloud sur la réflexion, le paramètre thinking_budget définit un budget dont le minimum est de 512 jetons. Sans budget fixé, le modèle règle lui-même ce budget, jusqu’à 8 192 jetons, selon la documentation de Google Cloud. Avec un budget à 0, la réflexion est désactivée, selon la documentation de Google Cloud, même si le texte généré peut encore prendre la forme d’un raisonnement.
Caractéristiques techniques de Gemini 2.5 Flash Lite
Gemini 2.5 Flash Lite est sorti le 22 juillet 2025 et accepte, selon Google, jusqu’à 1 048 576 jetons en entrée et 65 536 jetons en sortie. Selon Google, il lit le texte, l’image, la vidéo, l’audio et le PDF, et répond en texte. Ses connaissances s’arrêtent en janvier 2025, selon Google.
Selon Google, à l’annonce de sa préversion le 17 juin 2025, le modèle prend en charge l’appel de fonction et les outils natifs de Google : l’ancrage avec la recherche Google, l’exécution de code et le contexte d’URL. Le tableau des caractéristiques rassemble les données techniques du modèle.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Facultative
Connaissances jusqu'à (selon OpenRouter)
janvier 2025
Retrait annoncé (selon OpenRouter)
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Gemini 2.5 Flash Lite, comment il se facture et jusqu’à quand
Gemini 2.5 Flash Lite était disponible en version stable dans Google AI Studio et Vertex AI à sa sortie, le 22 juillet 2025, selon Google. Son identifiant était gemini-2.5-flash-lite, selon l’annonce de Google à cette date.
Selon la page de tarifs de l’API Gemini, dans sa version d’octobre 2026, le modèle dispose d’un niveau sans frais et d’un niveau payant facturé par million de jetons. Les données du niveau sans frais servent à améliorer les produits de Google, selon cette même page de tarifs d’octobre 2026. La carte d’accès donne les derniers prix relevés.
Selon les notes de version de l’API Gemini du 18 septembre 2026, Google réserve l’accès aux modèles 2.5 aux utilisateurs qui s’en sont servis activement. Ces modèles ne sont pas obsolètes et restent servis par l’API jusqu’à nouvel ordre, selon les notes de version de l’API Gemini à cette date.
Selon Google Cloud, le retrait du modèle de Gemini Enterprise Agent Platform est fixé au 20 octobre 2026. Son accès par l’API Gemini peut se poursuivre après cette date, selon Google Cloud. Selon OpenRouter, la fin de vie du modèle est fixée au 20 octobre 2026.
L'API Google
Retrait annoncé le 20/10/2026 selon OpenRouter
Chez OpenRouter (relevé du 05/10/2026) : 0,10 $ / M tokens en entrée, 0,40 $ / M tokens en sortie. Son retrait est annoncé le 20/10/2026 selon OpenRouter.
Tarification0,10 $ en entrée, 0,40 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemini 2.5 Flash Lite parmi les versions de Gemini Flash Lite
Gemini 2.5 Flash Lite est publié par Google en préversion sous l’identifiant gemini-2.5-flash-lite-preview-06-17 le 17 juin 2025, puis en version stable sous l’identifiant gemini-2.5-flash-lite le 22 juillet 2025, selon les notes de version de l’API Gemini. Au relevé du 8 octobre 2026, sur OpenRouter, Gemini 3.1 Flash Lite, sorti le 7 mai 2026, lui succède dans la gamme. La frise des versions situe le modèle parmi les versions stables de Gemini Flash Lite, avec leurs dates.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemini 2.5 Flash LiteVous êtes ici
Gemini 3.1 Flash Lite
Gemini 3.5 Flash Lite
Score
1447
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
0,10 $ / M tokens
0,25 $ / M tokens
0,30 $ / M tokens
Prix de sortie
0,40 $ / M tokens
1,50 $ / M tokens
2,50 $ / M tokens
Entrées
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Réflexion
Facultative
Activée par défaut
Toujours active
Tâches
Aide au code, Affaires et finance, Front-end, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemini 2.5 Flash Lite est un modèle de Google sorti le 22 juillet 2025 qui, selon Google, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction, à la classification et au résumé à grande échelle.
Gemini 3.1 Flash Lite, publié par Google le 7 mai 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction à volume élevé, au résumé de PDF et à la transcription d’enregistrements.
Gemini 3.5 Flash Lite est un modèle de Google sorti le 21 juillet 2026, conçu à sa sortie pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents, selon l’annonce de Google. Selon la documentation de l’API Gemini, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Gemini 2.5 Flash Lite est-il sorti ?
Gemini 2.5 Flash Lite est sorti en préversion le 17 juin 2025, selon les notes de version de l’API Gemini. Google a publié la version stable le 22 juillet 2025, selon ces mêmes notes de version.
Quelle est la différence entre Gemini 2.5 Flash Lite et Gemini 2.5 Flash ?
Gemini 2.5 Flash Lite est présenté par Google, à l’annonce de sa préversion le 17 juin 2025, comme une option moins chère que Gemini 2.5 Flash, avec ou sans réflexion. Selon Google, il vise les usages sensibles au coût et à la latence qui demandent moins d’intelligence du modèle.
Peut-on désactiver la réflexion de Gemini 2.5 Flash Lite ?
Gemini 2.5 Flash Lite désactive sa réflexion lorsque son budget de réflexion est réglé à 0, selon la documentation de Google Cloud. Même avec ce réglage, le texte généré peut encore prendre la forme d’un raisonnement, selon Google Cloud.
L’API de Gemini 2.5 Flash Lite est-elle gratuite ?
Gemini 2.5 Flash Lite dispose d’un niveau sans frais et d’un niveau payant facturé par million de jetons, selon la page de tarifs de l’API Gemini dans sa version d’octobre 2026, avec des données du niveau sans frais utilisées pour améliorer les produits de Google.
Quelle est la date de retrait de Gemini 2.5 Flash Lite ?
Gemini 2.5 Flash Lite a une date de retrait fixée au 20 octobre 2026 sur Gemini Enterprise Agent Platform, selon Google Cloud. Selon Google Cloud, le modèle peut rester accessible par l’API Gemini après cette date.
Quelle version succède à Gemini 2.5 Flash Lite ?
Gemini 2.5 Flash Lite a pour successeur Gemini 3.1 Flash Lite dans la gamme. Ce successeur est sorti le 7 mai 2026.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.