Revue publiée le Scores mis à jour le

Ce que DeepSeek V4.1 Flash change par rapport à DeepSeek V4 Flash 0731

DeepSeek V4.1 Flash accepte le texte et les images sur OpenRouter, contre le texte seul pour DeepSeek V4 Flash 0731, sorti le 31 juillet 2026. Sur OpenRouter, ce dernier disposait déjà d’une fenêtre de contexte de 1 048 576 tokens. Le tableau d’écart compare les formats d’entrée, la fenêtre de contexte et la réflexion relevés sur OpenRouter pour les deux versions.

Selon le journal de l’API de DeepSeek, le 10 septembre 2026, DeepSeek V4 Flash et DeepSeek V4 Flash Vision Exp ont été retirés de l’API, comme modèles de la génération précédente. Leurs noms deepseek-v4-flash et deepseek-v4-flash-vision-exp ont été temporairement redirigés vers DeepSeek V4.1 Flash, selon ce journal. À sa sortie, selon DeepSeek, son cache KV, qui conserve les clés et valeurs de l’attention, demande le quart de la mémoire HBM et le huitième du stockage SSD de la génération précédente.

Selon DeepSeek, le modèle de base de DeepSeek V4.1 Flash compte 552 milliards de paramètres, dont 8 milliards activés en entrée et 16 milliards en sortie, contre 284 milliards, dont 13 milliards activés, pour DeepSeek V4 Flash. Au niveau d’effort de réflexion maximal, selon DeepSeek, il obtient 90,6 sur Terminal-Bench 2.1, contre 82,7 pour DeepSeek V4 Flash. Sur DeepSWE v1.1, selon DeepSeek, il atteint 74,2 au même niveau d’effort, contre 54,4 pour DeepSeek V4 Flash.

Par rapport à la version précédente

DeepSeek V4 Flash 0731DeepSeek V4.1 Flash
Contexte maximal (selon OpenRouter)1,05 M1,05 M
Formats compris (selon OpenRouter)textetexte, image
Réflexion (selon OpenRouter)Activée par défautActivée par défaut
Prix d'entrée (OpenRouter, relevé du 05/10/2026)0,015 $ / M tokens0,30 $ / M tokens
Prix de sortie (OpenRouter, relevé du 05/10/2026)1,28 $ / M tokens1,20 $ / M tokens

À quoi sert DeepSeek V4.1 Flash

Chat

DeepSeek V4.1 Flash prend en charge l’appel d’outils et les sorties structurées sur OpenRouter. Selon la documentation de l’API de DeepSeek, le modèle deepseek-flash peut également appeler des outils et produire une réponse au format JSON.

Vision et compréhension

DeepSeek V4.1 Flash accepte des images accompagnées de texte sous l’identifiant deepseek-flash, selon la documentation de l’API de DeepSeek. Selon cette documentation, tu peux lui demander de décrire une image, de lire le texte d’une capture d’écran ou d’analyser un graphique. Il lit les formats JPEG, PNG, GIF et WebP, selon la documentation de l’API de DeepSeek.

Code

DeepSeek V4.1 Flash obtient à sa sortie une cote Codeforces de 3471, selon le journal de l’API de DeepSeek. Sur DeepSWE v1.1, au niveau d’effort de réflexion maximal, il obtient, selon DeepSeek, les scores de 69,8 avec Claude Code, de 65,6 avec Codex, de 65,5 avec OpenCode et de 74,2 avec mini-SWE, chacun utilisé comme cadre d’agent.

Les performances de DeepSeek V4.1 Flash

DeepSeek V4.1 Flash obtient, à sa sortie, 90,9 sur GPQA Diamond, 36,8 sur HLE et 65,6 sur MathArena Apex, selon le journal de l’API de DeepSeek ; le score sur la seule partie en texte de HLE atteint 39,1, selon ce même journal. Sur CyberGym, Automation-Bench et Agents’ Last Exam, les scores à sa sortie sont respectivement de 88,1, 54,8 et 31,8, selon le journal de l’API de DeepSeek.

Pour les tests visuels avec outils, le modèle obtient, à sa sortie, 78,9 sur Chartography, 89,6 sur BabyVision et 49,0 sur ZeroBench-main, selon le journal de l’API de DeepSeek. Selon la carte du modèle publiée par DeepSeek sur Hugging Face, les résultats du modèle instruct sont mesurés au réglage d’effort maximal (reasoning_effort=100), avec une température de 1,0 et un top_p de 0,95.

Bien utiliser DeepSeek V4.1 Flash : réflexion et effort

DeepSeek V4.1 Flash active la réflexion par défaut sur OpenRouter, mais ce réglage peut être désactivé sur OpenRouter. Pour l’effort de réflexion, les niveaux proposés sur OpenRouter sont max, high et low, avec high par défaut sur OpenRouter. Selon la documentation de l’API de DeepSeek, le modèle nommé deepseek-flash prend également en charge un mode sans réflexion et un mode avec réflexion, ce dernier étant le mode par défaut.

Selon la carte du modèle de DeepSeek, l’effort de réflexion se règle avec un entier de 1 à 100, en échangeant du coût d’inférence contre de la précision. Pour l’échantillonnage, DeepSeek recommande sur cette carte une température de 1,0 et un top_p de 0,95 ou 1,0. Selon DeepSeek, cette configuration recommandée comprend aussi une fenêtre de contexte de 1M tokens et un paramètre max_tokens d’au moins 256K.

Caractéristiques techniques de DeepSeek V4.1 Flash

DeepSeek V4.1 Flash est sorti le 10 septembre 2026 ; selon le journal de l’API de DeepSeek, il était à sa sortie le plus petit modèle de sa nouvelle famille d’architecture, avec une compréhension visuelle multimodale native. Le tableau des caractéristiques présente ses données techniques.

Sur OpenRouter, le modèle accepte du texte et des images dans une fenêtre de contexte de 1 048 576 tokens. Selon DeepSeek, il traite nativement ces deux types d’entrée et génère du texte. Pour la version DeepSeek-V4.1-Flash identifiée par deepseek-flash, la documentation de l’API de DeepSeek donne un contexte de 1M tokens et une sortie maximale de 384K tokens.

Selon DeepSeek, le modèle repose sur une architecture multimodale Mixture-of-Experts (MoE), ou mélange d’experts, de 552 milliards de paramètres. Son architecture Causal Encoder-Decoder (CED) active, selon DeepSeek, 8 milliards de paramètres par token pendant la lecture de l’entrée, appelée prefill, et 16 milliards pendant la génération, appelée decode. Selon DeepSeek, le dépôt sur Hugging Face et les poids du modèle sont publiés sous licence MIT.

Éditeur
DeepSeek
Produit (selon OpenRouter)
Texte
Sortie
Contexte (selon OpenRouter)
1,05 M tokens
Réponse maximale (selon OpenRouter)
944 k tokens
Réflexion (selon OpenRouter)
Activée par défaut
Tâches
Aide au codeAffaires et financeDesign d'après référenceDonnées et analyseFront-endFullstackHTMLJeuxJuridiqueMathématiquesConversation à plusieurs toursPrompts difficilesReactRédaction créativeSanté et bien-êtreSuivi de consignes
Entrées (selon OpenRouter)
Texte, Image
Licence
MIT
Paramètres pris en charge (noms techniques de l'API OpenRouter)
toolsstructured_outputstemperaturetop_preasoningseedstoplogprobsresponse_formatmax_tokens
Hébergeurs via OpenRouter
Alibaba, AtlasCloud, Baidu, BaseTen, CoreWeave, Decart, DeepInfra, DeepSeek, DekaLLM, DigitalOcean, Fireworks, GMICloud, InferenceNet, Ionstream, Makora, Modal, Morph, NextBit, Novita, Parasail, Phala, Relace, Sail Research, SiliconFlow, StreamLake, Together, Venice, Wafer

Où utiliser DeepSeek V4.1 Flash

DeepSeek V4.1 Flash est arrivé sur l’API de DeepSeek le 10 septembre 2026 sous le nom de modèle deepseek-flash, selon le journal de l’API de DeepSeek. À sa sortie, les partenaires officiels WorkBuddy, CodeBuddy compris, et OpenCode le prenaient entièrement en charge, selon DeepSeek. La carte d’accès présente les derniers prix relevés.

L'API DeepSeek

Pour relier le modèle à votre application

Chez OpenRouter (relevé du 05/10/2026) : 0,30 $ / M tokens en entrée, 1,20 $ / M tokens en sortie.

Tarification0,30 $ en entrée, 1,20 $ en sortie, par million de tokens
Hébergé via OpenRouter chezAlibaba, AtlasCloud, Baidu, BaseTen, CoreWeave, Decart, DeepInfra, DeepSeek, DekaLLM, DigitalOcean, Fireworks, GMICloud, InferenceNet, Ionstream, Makora, Modal, Morph, NextBit, Novita, Parasail, Phala, Relace, Sail Research, SiliconFlow, StreamLake, Together, Venice, Wafer

Un accès gratuit dépend toujours de l'outil, de l'offre et de ses limites : nous ne l'attribuons pas au modèle seul.

DeepSeek V4.1 Flash parmi les versions de DeepSeek Flash

DeepSeek V4.1 Flash figure dans la frise des versions de la famille DeepSeek Flash, qui situe les modèles avec leurs dates de sortie. DeepSeek V4 Flash 0423 est sorti le 24 avril 2026, puis DeepSeek V4 Flash 0731 le 31 juillet 2026.

1 version sélectionnéeAjoutez 1 ou 2 autres versions pour comparer leurs données.

FAQ

Quand DeepSeek V4.1 Flash est-il sorti ?

DeepSeek V4.1 Flash est sorti le 10 septembre 2026. Sur OpenRouter, il vient après DeepSeek V4 Flash 0731 dans la gamme.

Que peut lire DeepSeek V4.1 Flash ?

DeepSeek V4.1 Flash accepte du texte en entrée sur OpenRouter. Il accepte également des images sur OpenRouter.

Quelle est la fenêtre de contexte de DeepSeek V4.1 Flash ?

DeepSeek V4.1 Flash possède une fenêtre de contexte de 1 048 576 tokens sur OpenRouter. Ses entrées sur OpenRouter peuvent être du texte ou des images.

Quelle version précède DeepSeek V4.1 Flash ?

Sur OpenRouter, DeepSeek V4.1 Flash est précédé par DeepSeek V4 Flash 0731 dans la gamme. Sa sortie date du 10 septembre 2026.

Testez votre outil avec un prompt

Pas besoin d'écrire un bon prompt vous-même. Choisissez un exemple, copiez-le tel quel, puis collez-le dans votre outil pour voir immédiatement le type de réponse obtenu.

Prêt à utiliser
  1. 1Choisissez un testPrenez le cas qui vous intéresse.
  2. 2Copiez le promptIl fonctionne sans modification.
  3. 3Collez-le dans votre outilPuis continuez la conversation.

Tester la rédaction

Voir comment il rédige un e-mail professionnel à partir d'une situation concrète.

Tester l'explication

Voir s'il sait rendre un sujet complexe vraiment compréhensible.

Tester l'organisation

Voir comment il transforme un projet en étapes simples et concrètes.

Après la copie

Ouvrez votre outil, collez le texte et envoyez. Ensuite, répondez naturellement à l'IA si vous voulez préciser ou modifier le résultat.

Suivez l'IA et les agents IA avec notre newsletter.

Inscrivez-vous pour recevoir les nouveautés, les tendances et des astuces sur l'intelligence artificielle.

En vous abonnant, vous acceptez notre politique de confidentialité et notre politique de cookies.