Revue publiée le Scores mis à jour le
Comparer

Google : Gemini 3.5 Flash Lite

Récent

Gemini 3.5 Flash Lite est un modèle de Google sorti le 21 juillet 2026, conçu à sa sortie pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents, selon l’annonce de Google. Selon la documentation de l’API Gemini, il lit le texte, l’image, la vidéo, l’audio et le PDF, et produit du texte.

Ce que Gemini 3.5 Flash Lite change par rapport à Gemini 3.1 Flash Lite

Gemini 3.5 Flash Lite repose sur Gemini 3.1 Flash Lite, selon la carte du modèle publiée par Google DeepMind le 21 juillet 2026. À sa sortie, Google annonce des résultats nettement meilleurs que ceux de son prédécesseur à tous les niveaux de réflexion.

Selon la carte du modèle de Google DeepMind, à sa sortie, le modèle progresse en sécurité et en ton, mais recule légèrement sur les refus injustifiés : il refuse plus volontiers de répondre sur les sujets sensibles. Google le publie aussi comme une version stable prête pour la production le 21 juillet 2026, selon les notes de version de l’API Gemini.

Gemini 3.5 Flash Lite, sorti le 21 juillet 2026, rend la réflexion obligatoire sur OpenRouter, alors qu’elle était facultative chez son prédécesseur. Sorti le 21 juillet 2026, le modèle reprend sur OpenRouter la fenêtre de contexte de Gemini 3.1 Flash Lite. Le tableau d’écart compare la fenêtre de contexte, les formats d’entrée et la réflexion des deux versions, avec les valeurs relevées sur OpenRouter.

Par rapport à la version précédente

Gemini 3.1 Flash LiteGemini 3.5 Flash Lite
Contexte maximal (selon OpenRouter)1,05 M1,05 M
Formats compris (selon OpenRouter)texte, image, fichier, audio, vidéotexte, image, fichier, audio, vidéo
Réflexion (selon OpenRouter)Activée par défautToujours activeModifié
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,25 $ / M tokens0,30 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)1,50 $ / M tokens2,50 $ / M tokens

Gemini 3.5 Flash Lite, Gemini 3.6 Flash ou Gemini 3.1 Pro Preview : lequel choisir ?

Gemini 3.5 Flash Lite est, à sa sortie, facturé sur OpenRouter en dessous de Gemini 3.6 Flash et de Gemini 3.1 Pro Preview. Selon l’annonce de Google du 21 juillet 2026, il paraît le même jour que Gemini 3.6 Flash. Google le conçoit, à sa sortie, pour les tâches à faible latence et celles où le débit compte, comme la recherche agentique et le traitement de documents.

À quoi sert Gemini 3.5 Flash Lite

Chat

Gemini 3.5 Flash Lite est présenté à sa sortie comme économique et rapide par Google DeepMind. Selon la carte du modèle publiée le 21 juillet 2026, il est optimisé pour les tâches à volume élevé et sensibles à la latence, notamment la traduction et la classification. Google DeepMind compte aussi les workflows agentiques parmi ses cas d’usage.

Vision et compréhension

Gemini 3.5 Flash Lite peut traduire et résumer des reçus à grande échelle grâce à sa compréhension multimodale, selon l’annonce de Google du 21 juillet 2026. Google DeepMind cite également, dans sa carte du modèle publiée à sa sortie, le raisonnement sur des vidéos complexes et le traitement de documents. Selon les notes de version de l’API Gemini, la compréhension vidéo agentique lui est ouverte le 1er septembre 2026 : il parcourt la vidéo et demande à la volée des transcriptions, des images ou des pistes audio.

Code

Gemini 3.5 Flash Lite compte les tâches de code parmi ses cas d’usage, selon la carte du modèle publiée par Google DeepMind à sa sortie. Sur OpenRouter, il sait également appeler des outils et produire des sorties structurées.

Les performances de Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite dépasse Gemini 3.1 Flash-Lite et Gemini 3 Flash sur les évaluations annoncées par Google le 21 juillet 2026. Le tableau rassemble ces comparaisons et la vitesse mesurée par Artificial Analysis.

ÉvaluationRésultats
Terminal-Bench 2.1 : code et tâches agentiquesSelon Google, dans son annonce du 21 juillet 2026, le modèle obtient 54 %, contre 31 % pour Gemini 3.1 Flash-Lite.
GDM-MRCR v2 : long contexteSelon Google, dans son annonce du 21 juillet 2026, le modèle obtient 72,2 %, contre 60,1 % pour Gemini 3.1 Flash-Lite.
SWE-Bench ProSelon Google, dans son annonce du 21 juillet 2026, le modèle obtient 54,2 %, contre 49,6 % pour Gemini 3 Flash.
OSWorld-VerifiedSelon Google, dans son annonce du 21 juillet 2026, le modèle obtient 74,0 %, contre 65,1 % pour Gemini 3 Flash.
Vitesse de générationSelon Google, dans son annonce du 21 juillet 2026, le modèle produit 350 tokens de sortie par seconde, mesurés par Artificial Analysis.

Bien utiliser Gemini 3.5 Flash Lite : réflexion et effort

Gemini 3.5 Flash Lite active la réflexion par défaut au niveau minimal, selon la documentation de Google sur la réflexion. Selon cette documentation, il accepte les niveaux minimal, low, medium et high. Sur OpenRouter, la réflexion est obligatoire.

À sa sortie, selon Google, les développeurs peuvent régler le modèle sur les niveaux minimal et low pour une exécution rapide et peu coûteuse des tâches à volume élevé. Selon la même annonce de Google, ils peuvent aussi passer à des niveaux de réflexion plus élevés pour les charges de sous-agents qui travaillent en plusieurs étapes.

Selon la documentation de Google sur la réflexion des modèles Gemini, minimal ou low convient aux tâches simples, comme retrouver un fait ou classer. Pour les tâches moyennes, comme comparer des notions ou exercer un raisonnement créatif, cette documentation recommande le niveau par défaut. Pour le code avancé, les mathématiques et la planification en plusieurs étapes, Google recommande dans cette documentation le niveau maximal.

Caractéristiques techniques de Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite est sorti le 21 juillet 2026. Selon la documentation de l’API Gemini, sa limite d’entrée est de 1 048 576 jetons et sa limite de sortie de 65 536 jetons.

Selon la documentation de l’API Gemini, le modèle accepte le texte, l’image, la vidéo, l’audio et le PDF en entrée, et produit du texte. Ses connaissances s’arrêtent en mars 2026 selon la carte du modèle de Google DeepMind, avec une limite pouvant remonter à janvier 2025 dans certains domaines. Le tableau des caractéristiques rassemble les données techniques du modèle.

Éditeur
Google
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
66 k tokens
Réflexion (selon OpenRouter)
Toujours active
Tâches
Aide au codeAffaires et financeFront-endJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignesVision et compréhension
Entrées (selon OpenRouter)
Texte, Image, Fichier, Audio, Vidéo
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstopresponse_formatmax_tokens
Hébergeurs via OpenRouter
Google, Google AI Studio

Où utiliser Gemini 3.5 Flash Lite, et comment il se facture

Gemini 3.5 Flash-Lite est accessible à sa sortie dans l’API Gemini via Google AI Studio et Android Studio, dans Gemini Enterprise Agent Platform pour les entreprises et dans l’application Gemini pour tous, selon l’annonce de Google du 21 juillet 2026. Selon cette même annonce de Google, son déploiement dans la recherche Google commence également à sa sortie, en parallèle de ces accès destinés aux développeurs, aux entreprises et au grand public.

Dans sa version d’octobre 2026, la page de tarifs de l’API Gemini présente un niveau sans frais à côté du niveau payant pour le modèle. Selon cette page de tarifs de Google, les données du niveau sans frais servent à améliorer les produits de Google. La carte d’accès donne les derniers prix relevés.

L'API Google

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 2,50 $ / M tokens en sortie.

Tarification0,30 $ en entrée, 2,50 $ en sortie, par million de tokens
Hébergé via OpenRouter chezGoogle, Google AI Studio

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

Gemini 3.5 Flash Lite parmi les versions de Gemini Flash Lite

Gemini 3.5 Flash Lite est le remplaçant recommandé de gemini-3.1-flash-lite selon la page des abandons de l’API Gemini de Google. Dans la famille Flash Lite, Gemini 2.5 Flash Lite est sorti le 22 juillet 2025, puis Gemini 3.1 Flash Lite le 7 mai 2026. Selon la page des abandons de l’API Gemini de Google, l’arrêt de gemini-3.1-flash-lite est fixé au 7 mai 2027. La frise des versions situe le modèle parmi les versions de sa famille, avec leurs dates de sortie.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand Gemini 3.5 Flash Lite est-il sorti ?

Gemini 3.5 Flash-Lite est sorti le 21 juillet 2026, selon les notes de version de l’API Gemini. Google le publie à cette date sous l’identifiant gemini-3.5-flash-lite comme version stable prête pour la production.

Sur quel modèle repose Gemini 3.5 Flash Lite ?

Gemini 3.5 Flash-Lite repose sur Gemini 3.1 Flash-Lite, selon la carte du modèle publiée par Google DeepMind le 21 juillet 2026. Il est publié comme version stable prête pour la production, selon les notes de version de l’API Gemini.

Gemini 3.5 Flash-Lite est-il gratuit ?

Gemini 3.5 Flash-Lite dispose d’un niveau sans frais à côté du niveau payant, selon les tarifs de l’API Gemini d’octobre 2026. Les données du niveau sans frais servent à améliorer les produits de Google, selon cette même page de tarifs.

Quelle différence entre Gemini 3.5 Flash et Gemini 3.5 Flash Lite ?

Gemini 3.5 Flash-Lite exécute des tâches à volume élevé, selon l’annonce de Google à sa sortie. Pour ces tâches, Google annonce une latence plus faible que celle de Gemini 3.5 Flash.

Quelle est la vitesse de Gemini 3.5 Flash-Lite ?

Gemini 3.5 Flash-Lite produit 350 tokens de sortie par seconde, selon l’annonce de Google à sa sortie. Le modèle a été mesuré par Artificial Analysis pour ce débit de génération, selon Google.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.