Gemini 3.1 Flash Lite, publié par Google le 7 mai 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction à volume élevé, au résumé de PDF et à la transcription d’enregistrements.
Ce que Gemini 3.1 Flash Lite change par rapport à Gemini 2.5 Flash Lite
Gemini 3.1 Flash Lite change le réglage initial de la réflexion par rapport à son prédécesseur, Gemini 2.5 Flash Lite. Selon la documentation de Google, la réflexion, désactivée par défaut chez Gemini 2.5 Flash-Lite, est réglée par défaut au niveau minimal chez Gemini 3.1 Flash-Lite.
Le tableau d’écart compare la fenêtre de contexte, les formats d’entrée, la réflexion et les prix relevés sur OpenRouter. Selon la carte du modèle publiée par Google DeepMind le 3 mars 2026, le jour du lancement de la préversion, Gemini 3.1 Flash-Lite faisait mieux que Gemini 2.5 Flash-Lite en sécurité et en ton, tout en gardant peu de refus injustifiés.
Réflexion (selon OpenRouter)Facultative→Activée par défaut
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,10 $ / M tokens→0,25 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)0,40 $ / M tokens→1,50 $ / M tokens
Gemini 3.1 Flash Lite, Gemini 3 Flash Preview ou Gemini 3.1 Pro Preview : lequel choisir ?
Gemini 3.1 Flash Lite occupait, à sa sortie, un palier tarifaire inférieur à Gemini 3 Flash Preview et Gemini 3.1 Pro Preview, deux préversions proposées par Google. Selon le guide Gemini 3 de Google, le modèle vise la maîtrise des coûts et les tâches à volume élevé. Le même guide destine Gemini 3.1 Pro aux tâches complexes mobilisant une large connaissance du monde et un raisonnement avancé sur plusieurs modalités.
À quoi sert Gemini 3.1 Flash Lite
Chat
Gemini 3.1 Flash Lite sert à la traduction rapide de textes en volume élevé, selon Google. Parmi les exemples cités figurent les messages de chat, les avis et les tickets d’assistance.
Vision et compréhension
Google cite l’analyse de PDF pour produire des résumés concis parmi les usages du modèle. Pour les contenus audio, l’éditeur mentionne la transcription d’enregistrements et de notes vocales.
Business et finance
Selon Google Cloud, le 8 mai 2026, OffDeal utilisait le modèle pour faire fonctionner Archie, un agent destiné aux banquiers d’affaires pendant leurs appels Zoom. Cet agent assurait la recherche, la consultation de données et l’exécution de tâches. Dans sa configuration répertoriée sur OpenRouter, le modèle prend en charge l’appel d’outils et les sorties structurées, c’est-à-dire des réponses organisées selon un format défini.
Code
Google Cloud citait, le 8 mai 2026, la complétion de code et les outils de développement agentiques, capables d’exécuter des tâches. JetBrains avait intégré le modèle à son assistant d’IA pour environnement de développement intégré (IDE) et à son agent Junie. Selon Google, la CLI Gemini, son interface en ligne de commande open source, utilise aussi Flash-Lite pour classer la complexité des tâches et les acheminer vers Flash ou Pro.
Selon la carte du modèle de Google DeepMind, publiée le 3 mars 2026, le jour du lancement de la préversion, Gemini 3.1 Flash-Lite obtenait en mars 2026 les scores suivants, deux mois avant la version stable du 7 mai 2026. Le tableau compare les tests d’évaluation en réflexion High avec ceux de Gemini 2.5 Flash-Lite en réflexion dynamique.
Test d’évaluation
Gemini 3.1 Flash-Lite, réflexion High (mars 2026)
Gemini 2.5 Flash-Lite, réflexion dynamique
GPQA Diamond, sans outils
86,9 %
66,7 %
MMMU-Pro, compréhension multimodale, sans outils
76,8 %
51,0 %
LiveCodeBench, génération de code
72,0 %
34,3 %
Bien utiliser Gemini 3.1 Flash Lite : réflexion et effort
Gemini 3.1 Flash Lite accepte les niveaux de réflexion minimal, low, medium et high, selon le guide Gemini 3 de Google ; high utilise une réflexion dynamique. Le niveau minimal s’applique par défaut. Selon Google, il correspond à un fonctionnement « sans réflexion » pour la plupart des requêtes et réduit la latence, c’est-à-dire le délai de réponse. Ce réglage ne garantit toutefois pas que la réflexion soit coupée. Sur OpenRouter, la réflexion est facultative et peut être désactivée.
Caractéristiques techniques de Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite est sorti le 7 mai 2026. Le tableau des caractéristiques détaille les limites d’entrée et de sortie ainsi que les formats pris en charge.
Selon Google, le modèle accepte le texte, les images, la vidéo, l’audio et les PDF, avec une limite de 1 048 576 jetons en entrée et de 65 536 jetons en sortie. Ses réponses sont uniquement textuelles. Selon le guide Gemini 3 de Google, ses connaissances s’arrêtent en janvier 2025. Google DeepMind indique qu’il repose sur Gemini 3 Pro.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Gemini 3.1 Flash Lite, et comment il se facture
Gemini 3.1 Flash Lite est passé en disponibilité générale dans l’API Gemini le 7 mai 2026, sous l’identifiant gemini-3.1-flash-lite, selon les notes de version de Google. La carte d’accès donne les derniers prix relevés.
Gemini Enterprise Agent Platform : Google Cloud annonce la disponibilité générale du modèle sur cette plateforme le 8 mai 2026.
Traitement par lot : OpenRouter répertorie aussi une offre de traitement par lot.
Niveau sans frais : selon les tarifs de l’API Gemini dans leur version d’octobre 2026, le modèle possède un niveau sans frais à côté du niveau payant. Les données du niveau sans frais servent à améliorer les produits de Google.
Arrêt annoncé : Google fixe l’arrêt de gemini-3.1-flash-lite au plus tôt au 7 mai 2027 dans son calendrier des abandons de l’API Gemini. Le remplaçant recommandé est gemini-3.5-flash-lite.
L'API Google
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,25 $ / M tokens en entrée, 1,50 $ / M tokens en sortie.
Tarification0,25 $ en entrée, 1,50 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemini 3.1 Flash Lite parmi les versions de Gemini Flash Lite
Gemini 3.1 Flash Lite appartient à une gamme qui comprend aussi une préversion distincte. Gemini 2.5 Flash Lite est sorti le 22 juillet 2025. Selon les notes de version de l’API Gemini, Google lance ensuite Gemini 3.1 Flash-Lite Preview le 3 mars 2026 et le présente comme le premier modèle Flash-Lite de la série Gemini 3.
Google arrête la préversion le 25 mai 2026 et renvoie vers gemini-3.1-flash-lite, selon les notes de version de l’API Gemini. Gemini 3.5 Flash Lite, sorti le 21 juillet 2026, succède à la version 3.1 dans la gamme. La frise des versions situe Gemini 2.5 Flash Lite, Gemini 3.1 Flash Lite et Gemini 3.5 Flash Lite dans la famille Gemini Flash Lite, avec leurs dates respectives.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemini 3.1 Flash LiteVous êtes ici
Gemini 2.5 Flash Lite
Gemini 3.5 Flash Lite
Score
1447
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
0,25 $ / M tokens
0,10 $ / M tokens
0,30 $ / M tokens
Prix de sortie
1,50 $ / M tokens
0,40 $ / M tokens
2,50 $ / M tokens
Entrées
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Réflexion
Activée par défaut
Facultative
Toujours active
Tâches
Aide au code, Affaires et finance, Front-end, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemini 3.1 Flash Lite, publié par Google le 7 mai 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction à volume élevé, au résumé de PDF et à la transcription d’enregistrements.
Gemini 2.5 Flash Lite est un modèle de Google sorti le 22 juillet 2025 qui, selon Google, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction, à la classification et au résumé à grande échelle.
Gemini 3.5 Flash Lite est un modèle de Google sorti le 21 juillet 2026, conçu à sa sortie pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents, selon l’annonce de Google. Selon la documentation de l’API Gemini, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Gemini 3.1 Flash Lite est-il sorti ?
Gemini 3.1 Flash-Lite est sorti en disponibilité générale le 7 mai 2026, selon les notes de version de l’API Gemini. Google l’a publié sous l’identifiant gemini-3.1-flash-lite, avec une optimisation pour la vitesse, l’échelle et la maîtrise des coûts.
L’API de Gemini 3.1 Flash Lite est-elle gratuite ?
Gemini 3.1 Flash-Lite dispose d’un niveau sans frais à côté du niveau payant, selon les tarifs de l’API Gemini d’octobre 2026. Avec ce niveau sans frais, les données servent à améliorer les produits de Google.
Quelle fenêtre de contexte pour Gemini 3.1 Flash Lite ?
Selon Google, Gemini 3.1 Flash-Lite accepte jusqu’à 1 048 576 jetons en entrée et produit au plus 65 536 jetons en sortie.
Jusqu’à quand Google prévoit-il de servir Gemini 3.1 Flash Lite dans l’API Gemini ?
Gemini 3.1 Flash-Lite a une date d’arrêt fixée au plus tôt au 7 mai 2027, selon le calendrier des abandons de l’API Gemini. Cette échéance n’annonce pas un arrêt certain à cette date : elle fixe la première date possible de retrait.
Quelle version succède à Gemini 3.1 Flash Lite ?
Gemini 3.5 Flash Lite succède à Gemini 3.1 Flash Lite dans la gamme. Pour remplacer l’ancien modèle dans l’API Gemini, Google recommande l’identifiant gemini-3.5-flash-lite dans son calendrier des abandons.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.