Gemini 3.5 Flash Lite est un modèle de Google sorti le 21 juillet 2026, conçu à sa sortie pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents, selon l’annonce de Google. Selon la documentation de l’API Gemini, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Ce que Gemini 3.5 Flash Lite change par rapport à Gemini 3.1 Flash Lite
Gemini 3.5 Flash Lite repose sur Gemini 3.1 Flash Lite, selon la carte du modèle publiée par Google DeepMind le 21 juillet 2026. À sa sortie, Google annonce des résultats nettement meilleurs que ceux de son prédécesseur à tous les niveaux de réflexion.
Selon la carte du modèle de Google DeepMind, à sa sortie, le modèle progresse en sécurité et en ton, mais recule légèrement sur les refus injustifiés : il refuse plus volontiers de répondre sur les sujets sensibles. Google le publie aussi comme une version stable prête pour la production le 21 juillet 2026, selon les notes de version de l’API Gemini.
Gemini 3.5 Flash Lite, sorti le 21 juillet 2026, rend la réflexion obligatoire sur OpenRouter, alors qu’elle était facultative chez son prédécesseur. Sorti le 21 juillet 2026, le modèle reprend sur OpenRouter la fenêtre de contexte de Gemini 3.1 Flash Lite. Le tableau d’écart compare la fenêtre de contexte, les formats d’entrée et la réflexion des deux versions, avec les valeurs relevées sur OpenRouter.
Réflexion (selon OpenRouter)Activée par défaut→Toujours activeModifié
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,25 $ / M tokens→0,30 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)1,50 $ / M tokens→2,50 $ / M tokens
Gemini 3.5 Flash Lite, Gemini 3.6 Flash ou Gemini 3.1 Pro Preview : lequel choisir ?
Gemini 3.5 Flash Lite est, à sa sortie, facturé sur OpenRouter en dessous de Gemini 3.6 Flash et de Gemini 3.1 Pro Preview. Selon l’annonce de Google du 21 juillet 2026, il paraît le même jour que Gemini 3.6 Flash. Google le conçoit, à sa sortie, pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents.
À quoi sert Gemini 3.5 Flash Lite
Chat
Gemini 3.5 Flash Lite est présenté à sa sortie comme économique et rapide par Google DeepMind. Selon la carte du modèle publiée le 21 juillet 2026, il est optimisé pour les tâches à volume élevé et sensibles à la latence, notamment la traduction et la classification. Google DeepMind compte aussi les workflows agentiques parmi ses cas d’usage.
Vision et compréhension
Gemini 3.5 Flash Lite peut traduire et résumer des reçus à grande échelle grâce à sa compréhension multimodale, selon l’annonce de Google du 21 juillet 2026. Google DeepMind cite également, dans sa carte du modèle publiée à sa sortie, le raisonnement sur des vidéos complexes et le traitement de documents. Selon les notes de version de l’API Gemini, la compréhension vidéo agentique lui est ouverte le 1er septembre 2026 : il parcourt la vidéo et demande à la volée des transcriptions, des images ou des pistes audio.
Code
Gemini 3.5 Flash Lite compte les tâches de code parmi ses cas d’usage, selon la carte du modèle publiée par Google DeepMind à sa sortie. Sur OpenRouter, il sait également appeler des outils et produire des sorties structurées.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances de Gemini 3.5 Flash Lite
Gemini 3.5 Flash Lite dépasse Gemini 3.1 Flash-Lite et Gemini 3 Flash sur les évaluations annoncées par Google le 21 juillet 2026. Le tableau rassemble ces comparaisons et la vitesse mesurée par Artificial Analysis.
Évaluation
Résultats
Terminal-Bench 2.1 : code et tâches agentiques
Selon Google, dans son annonce du 21 juillet 2026, le modèle obtient 54 %, contre 31 % pour Gemini 3.1 Flash-Lite.
GDM-MRCR v2 : long contexte
Selon Google, dans son annonce du 21 juillet 2026, le modèle obtient 72,2 %, contre 60,1 % pour Gemini 3.1 Flash-Lite.
SWE-Bench Pro
Selon Google, dans son annonce du 21 juillet 2026, le modèle obtient 54,2 %, contre 49,6 % pour Gemini 3 Flash.
OSWorld-Verified
Selon Google, dans son annonce du 21 juillet 2026, le modèle obtient 74,0 %, contre 65,1 % pour Gemini 3 Flash.
Vitesse de génération
Selon Google, dans son annonce du 21 juillet 2026, le modèle produit 350 tokens de sortie par seconde, mesurés par Artificial Analysis.
Bien utiliser Gemini 3.5 Flash Lite : réflexion et effort
Gemini 3.5 Flash Lite active la réflexion par défaut au niveau minimal, selon la documentation de Google sur la réflexion. Selon cette documentation, il accepte les niveaux minimal, low, medium et high. Sur OpenRouter, la réflexion est obligatoire.
À sa sortie, selon Google, les développeurs peuvent régler le modèle sur les niveaux minimal et low pour une exécution rapide et peu coûteuse des tâches à volume élevé. Selon la même annonce de Google, ils peuvent aussi passer à des niveaux de réflexion plus élevés pour les charges de sous-agents qui travaillent en plusieurs étapes.
Selon la documentation de Google sur la réflexion des modèles Gemini, minimal ou low convient aux tâches simples, comme retrouver un fait ou classer. Pour les tâches moyennes, comme comparer des notions ou exercer un raisonnement créatif, cette documentation recommande le niveau par défaut. Pour le code avancé, les mathématiques et la planification en plusieurs étapes, Google recommande dans cette documentation le niveau maximal.
Caractéristiques techniques de Gemini 3.5 Flash Lite
Gemini 3.5 Flash Lite est sorti le 21 juillet 2026. Selon la documentation de l’API Gemini, sa limite d’entrée est de 1 048 576 jetons et sa limite de sortie de 65 536 jetons.
Selon la documentation de l’API Gemini, le modèle accepte le texte, l’image, la vidéo, l’audio et le PDF en entrée, et produit du texte. Ses connaissances s’arrêtent en mars 2026 selon la carte du modèle de Google DeepMind, avec une limite pouvant remonter à janvier 2025 dans certains domaines. Le tableau des caractéristiques rassemble les données techniques du modèle.
Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Toujours active
Tâches
Aide au codeAffaires et financeFront-endJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
Où utiliser Gemini 3.5 Flash Lite, et comment il se facture
Gemini 3.5 Flash-Lite est accessible à sa sortie dans l’API Gemini via Google AI Studio et Android Studio, dans Gemini Enterprise Agent Platform pour les entreprises et dans l’application Gemini pour tous, selon l’annonce de Google du 21 juillet 2026. Selon cette même annonce de Google, son déploiement dans la recherche Google commence également à sa sortie, en parallèle de ces accès destinés aux développeurs, aux entreprises et au grand public.
Dans sa version d’octobre 2026, la page de tarifs de l’API Gemini présente un niveau sans frais à côté du niveau payant pour le modèle. Selon cette page de tarifs de Google, les données du niveau sans frais servent à améliorer les produits de Google. La carte d’accès donne les derniers prix relevés.
L'API Google
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 2,50 $ / M tokens en sortie.
Tarification0,30 $ en entrée, 2,50 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
Gemini 3.5 Flash Lite parmi les versions de Gemini Flash Lite
Gemini 3.5 Flash Lite est le remplaçant recommandé de gemini-3.1-flash-lite selon la page des abandons de l’API Gemini de Google. Dans la famille Flash Lite, Gemini 2.5 Flash Lite est sorti le 22 juillet 2025, puis Gemini 3.1 Flash Lite le 7 mai 2026. Selon la page des abandons de l’API Gemini de Google, l’arrêt de gemini-3.1-flash-lite est fixé au 7 mai 2027. La frise des versions situe le modèle parmi les versions de sa famille, avec leurs dates de sortie.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
Gemini 3.5 Flash LiteVous êtes ici
Gemini 2.5 Flash Lite
Gemini 3.1 Flash Lite
Score
1447
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
0,30 $ / M tokens
0,10 $ / M tokens
0,25 $ / M tokens
Prix de sortie
2,50 $ / M tokens
0,40 $ / M tokens
1,50 $ / M tokens
Entrées
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Texte, Image, Fichier, Audio, Vidéo
Réflexion
Toujours active
Facultative
Activée par défaut
Tâches
Aide au code, Affaires et finance, Front-end, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes, Vision et compréhension
Ce qui le distingue
Gemini 3.5 Flash Lite est un modèle de Google sorti le 21 juillet 2026, conçu à sa sortie pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents, selon l’annonce de Google. Selon la documentation de l’API Gemini, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.
Gemini 2.5 Flash Lite est un modèle de Google sorti le 22 juillet 2025 qui, selon Google, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction, à la classification et au résumé à grande échelle.
Gemini 3.1 Flash Lite, publié par Google le 7 mai 2026, lit le texte, l’image, la vidéo, l’audio et le PDF et répond en texte. Selon Google, il sert à la traduction à volume élevé, au résumé de PDF et à la transcription d’enregistrements.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand Gemini 3.5 Flash Lite est-il sorti ?
Gemini 3.5 Flash-Lite est sorti le 21 juillet 2026, selon les notes de version de l’API Gemini. Google le publie à cette date sous l’identifiant gemini-3.5-flash-lite comme version stable prête pour la production.
Sur quel modèle repose Gemini 3.5 Flash Lite ?
Gemini 3.5 Flash-Lite repose sur Gemini 3.1 Flash-Lite, selon la carte du modèle publiée par Google DeepMind le 21 juillet 2026. Il est publié comme version stable prête pour la production, selon les notes de version de l’API Gemini.
Gemini 3.5 Flash-Lite est-il gratuit ?
Gemini 3.5 Flash-Lite dispose d’un niveau sans frais à côté du niveau payant, selon les tarifs de l’API Gemini d’octobre 2026. Les données du niveau sans frais servent à améliorer les produits de Google, selon cette même page de tarifs.
Quelle différence entre Gemini 3.5 Flash et Gemini 3.5 Flash Lite ?
Gemini 3.5 Flash-Lite exécute des tâches à volume élevé, selon l’annonce de Google à sa sortie. Pour ces tâches, Google annonce une latence plus faible que celle de Gemini 3.5 Flash.
Quelle est la vitesse de Gemini 3.5 Flash-Lite ?
Gemini 3.5 Flash-Lite produit 350 tokens de sortie par seconde, selon l’annonce de Google à sa sortie. Le modèle a été mesuré par Artificial Analysis pour ce débit de génération, selon Google.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.