DeepSeek V4.1 Flash est publié par DeepSeek et est sorti le 10 septembre 2026. Selon DeepSeek et la documentation de son API, il lit nativement le texte et les images, génère du texte, décrit des images et analyse des graphiques.
Ce que DeepSeek V4.1 Flash change par rapport à DeepSeek V4 Flash 0731
DeepSeek V4.1 Flash accepte le texte et les images sur OpenRouter, contre le texte seul pour DeepSeek V4 Flash 0731, sorti le 31 juillet 2026. Sur OpenRouter, ce dernier disposait déjà d’une fenêtre de contexte de 1 048 576 tokens. Le tableau d’écart compare les formats d’entrée, la fenêtre de contexte et la réflexion relevés sur OpenRouter pour les deux versions.
Selon le journal de l’API de DeepSeek, le 10 septembre 2026, DeepSeek V4 Flash et DeepSeek V4 Flash Vision Exp ont été retirés de l’API, comme modèles de la génération précédente. Leurs noms deepseek-v4-flash et deepseek-v4-flash-vision-exp ont été temporairement redirigés vers DeepSeek V4.1 Flash, selon ce journal. À sa sortie, selon DeepSeek, son cache KV, qui conserve les clés et valeurs de l’attention, demande le quart de la mémoire HBM et le huitième du stockage SSD de la génération précédente.
Selon DeepSeek, le modèle de base de DeepSeek V4.1 Flash compte 552 milliards de paramètres, dont 8 milliards activés en entrée et 16 milliards en sortie, contre 284 milliards, dont 13 milliards activés, pour DeepSeek V4 Flash. Au niveau d’effort de réflexion maximal, selon DeepSeek, il obtient 90,6 sur Terminal-Bench 2.1, contre 82,7 pour DeepSeek V4 Flash. Sur DeepSWE v1.1, selon DeepSeek, il atteint 74,2 au même niveau d’effort, contre 54,4 pour DeepSeek V4 Flash.
Réflexion (selon OpenRouter)Activée par défaut→Activée par défaut
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,015 $ / M tokens→0,30 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)1,28 $ / M tokens→1,20 $ / M tokens
À quoi sert DeepSeek V4.1 Flash
Chat
DeepSeek V4.1 Flash prend en charge l’appel d’outils et les sorties structurées sur OpenRouter. Selon la documentation de l’API de DeepSeek, le modèle deepseek-flash peut également appeler des outils et produire une réponse au format JSON.
Vision et compréhension
DeepSeek V4.1 Flash accepte des images accompagnées de texte sous l’identifiant deepseek-flash, selon la documentation de l’API de DeepSeek. Selon cette documentation, tu peux lui demander de décrire une image, de lire le texte d’une capture d’écran ou d’analyser un graphique. Il lit les formats JPEG, PNG, GIF et WebP, selon la documentation de l’API de DeepSeek.
Code
DeepSeek V4.1 Flash obtient à sa sortie une cote Codeforces de 3471, selon le journal de l’API de DeepSeek. Sur DeepSWE v1.1, au niveau d’effort de réflexion maximal, il obtient, selon DeepSeek, les scores de 69,8 avec Claude Code, de 65,6 avec Codex, de 65,5 avec OpenCode et de 74,2 avec mini-SWE, chacun utilisé comme cadre d’agent.
Le score est un Elo calculé par Arena, d'après des duels à l'aveugle : plus il est haut, plus le modèle l'emporte souvent face aux autres. Quand un modèle existe en plusieurs niveaux de réflexion, seul son meilleur score est retenu.
Les performances de DeepSeek V4.1 Flash
DeepSeek V4.1 Flash obtient, à sa sortie, 90,9 sur GPQA Diamond, 36,8 sur HLE et 65,6 sur MathArena Apex, selon le journal de l’API de DeepSeek ; le score sur la seule partie en texte de HLE atteint 39,1, selon ce même journal. Sur CyberGym, Automation-Bench et Agents’ Last Exam, les scores à sa sortie sont respectivement de 88,1, 54,8 et 31,8, selon le journal de l’API de DeepSeek.
Pour les tests visuels avec outils, le modèle obtient, à sa sortie, 78,9 sur Chartography, 89,6 sur BabyVision et 49,0 sur ZeroBench-main, selon le journal de l’API de DeepSeek. Selon la carte du modèle publiée par DeepSeek sur Hugging Face, les résultats du modèle instruct sont mesurés au réglage d’effort maximal (reasoning_effort=100), avec une température de 1,0 et un top_p de 0,95.
Bien utiliser DeepSeek V4.1 Flash : réflexion et effort
DeepSeek V4.1 Flash active la réflexion par défaut sur OpenRouter, mais ce réglage peut être désactivé sur OpenRouter. Pour l’effort de réflexion, les niveaux proposés sur OpenRouter sont max, high et low, avec high par défaut sur OpenRouter. Selon la documentation de l’API de DeepSeek, le modèle nommé deepseek-flash prend également en charge un mode sans réflexion et un mode avec réflexion, ce dernier étant le mode par défaut.
Selon la carte du modèle de DeepSeek, l’effort de réflexion se règle avec un entier de 1 à 100, en échangeant du coût d’inférence contre de la précision. Pour l’échantillonnage, DeepSeek recommande sur cette carte une température de 1,0 et un top_p de 0,95 ou 1,0. Selon DeepSeek, cette configuration recommandée comprend aussi une fenêtre de contexte de 1M tokens et un paramètre max_tokens d’au moins 256K.
Caractéristiques techniques de DeepSeek V4.1 Flash
DeepSeek V4.1 Flash est sorti le 10 septembre 2026 ; selon le journal de l’API de DeepSeek, il était à sa sortie le plus petit modèle de sa nouvelle famille d’architecture, avec une compréhension visuelle multimodale native. Le tableau des caractéristiques présente ses données techniques.
Sur OpenRouter, le modèle accepte du texte et des images dans une fenêtre de contexte de 1 048 576 tokens. Selon DeepSeek, il traite nativement ces deux types d’entrée et génère du texte. Pour la version DeepSeek-V4.1-Flash identifiée par deepseek-flash, la documentation de l’API de DeepSeek donne un contexte de 1M tokens et une sortie maximale de 384K tokens.
Selon DeepSeek, le modèle repose sur une architecture multimodale Mixture-of-Experts (MoE), ou mélange d’experts, de 552 milliards de paramètres. Son architecture Causal Encoder-Decoder (CED) active, selon DeepSeek, 8 milliards de paramètres par token pendant la lecture de l’entrée, appelée prefill, et 16 milliards pendant la génération, appelée decode. Selon DeepSeek, le dépôt sur Hugging Face et les poids du modèle sont publiés sous licence MIT.
Éditeur
DeepSeek
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
944 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte, Image
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
DeepSeek V4.1 Flash est arrivé sur l’API de DeepSeek le 10 septembre 2026 sous le nom de modèle deepseek-flash, selon le journal de l’API de DeepSeek. À sa sortie, les partenaires officiels WorkBuddy, CodeBuddy compris, et OpenCode le prenaient entièrement en charge, selon DeepSeek. La carte d’accès présente les derniers prix relevés.
L'API DeepSeek
Pour relier le modèle à votre application
Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 1,20 $ / M tokens en sortie.
Tarification0,30 $ en entrée, 1,20 $ en sortie, par million de tokens
Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.
DeepSeek V4.1 Flash parmi les versions de DeepSeek Flash
DeepSeek V4.1 Flash figure dans la frise des versions de la famille DeepSeek Flash, qui situe les modèles avec leurs dates de sortie. DeepSeek V4 Flash 0423 est sorti le 24 avril 2026, puis DeepSeek V4 Flash 0731 le 31 juillet 2026.
1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.
Comparaison rapide
Les versions sélectionnées
Repères
DeepSeek V4.1 FlashVous êtes ici
DeepSeek V4 Flash 0423
DeepSeek V4 Flash 0731
Score
1546
1581
Sortie
Contexte
1,05 M tokens
1,05 M tokens
1,05 M tokens
Prix d'entrée
0,30 $ / M tokens
0,030 $ / M tokens
0,015 $ / M tokens
Prix de sortie
1,20 $ / M tokens
1,28 $ / M tokens
1,28 $ / M tokens
Entrées
Texte, Image
Texte
Texte
Réflexion
Activée par défaut
Facultative
Activée par défaut
Tâches
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes
Aide au code, Affaires et finance, Design d'après référence, Données et analyse, Front-end, Fullstack, HTML, Jeux, Juridique, Mathématiques, Conversation à plusieurs tours, Prompts difficiles, React, Rédaction créative, Santé et bien-être, Suivi de consignes
Ce qui le distingue
DeepSeek V4.1 Flash est publié par DeepSeek et est sorti le 10 septembre 2026. Selon DeepSeek et la documentation de son API, il lit nativement le texte et les images, génère du texte, décrit des images et analyse des graphiques.
Les repères sont ceux renseignés dans l'annuaire ; un repère absent de toutes les versions sélectionnées n'est pas affiché. Comparaison complète dans le comparateur
FAQ
Quand DeepSeek V4.1 Flash est-il sorti ?
DeepSeek V4.1 Flash est sorti le 10 septembre 2026. Sur OpenRouter, il vient après DeepSeek V4 Flash 0731 dans la gamme.
Que peut lire DeepSeek V4.1 Flash ?
DeepSeek V4.1 Flash accepte du texte en entrée sur OpenRouter. Il accepte également des images sur OpenRouter.
Quelle est la fenêtre de contexte de DeepSeek V4.1 Flash ?
DeepSeek V4.1 Flash possède une fenêtre de contexte de 1 048 576 tokens sur OpenRouter. Ses entrées sur OpenRouter peuvent être du texte ou des images.
Quelle version précède DeepSeek V4.1 Flash ?
Sur OpenRouter, DeepSeek V4.1 Flash est précédé par DeepSeek V4 Flash 0731 dans la gamme. Sa sortie date du 10 septembre 2026.
Testez votre outil avec un prompt
Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.
Prêt à utiliser
1Choisissez un testPrenez le cas qui vous intéresse.
2Copiez le promptIl fonctionne sans modification.
3Collez-le dans votre outilPuis continuez la conversation.
Tester la rédaction
Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.
Rédigez un e-mail professionnel et cordial pour relancer un client qui n'a pas encore répondu à une proposition commerciale envoyée il y a une semaine. Le message doit rester chaleureux, ne pas paraître insistant et se terminer par une question simple pour savoir s'il souhaite poursuivre. Faites une version courte, naturelle et directement envoyable.
Tester l'explication
Voir s'il sait rendre un sujet complexe vraiment compréhensible.
Expliquez-moi ce qu'est l'intelligence artificielle générative comme si je n'y connaissais absolument rien. Utilisez des mots simples, donnez deux exemples du quotidien, évitez le jargon et terminez par trois choses importantes à retenir.
Tester l'organisation
Voir comment il transforme un projet en étapes simples et concrètes.
Je souhaite créer un nouveau site internet pour une petite entreprise. Organisez le projet étape par étape, depuis la définition des besoins jusqu'à la mise en ligne. Pour chaque étape, indiquez ce qu'il faut préparer, la décision principale à prendre et l'erreur la plus fréquente à éviter. Terminez par les trois premières actions à réaliser cette semaine.
Vous pouvez copier ce texte tel quel
Aucune modification nécessaire : copiez, collez et envoyez.
Après la copie
Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.