← Tous les modèles

DeepSeek V4 Flash : référence historique du modèle

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash n’est plus proposé sur Okou. Consultez GPT 6 Luna pour une alternative actuellement prise en charge. Cette page conserve des informations historiques, pas les tarifs actuels de Okou.

Voir GPT 6 Luna

Qu'est-ce que DeepSeek V4 Flash ?

31 juillet 2026 (DeepSeek-V4-Flash-0731, bêta publique)

Ce qui distingue DeepSeek V4 Flash

Principales caractéristiques d'architecture et de capacités.

V4 Flash est un modèle Mixture-of-Experts creux : 284 Md de paramètres au total, dont 13 Md activés par token. Chaque couche MoE comporte 1 expert partagé et 256 experts routés avec une dimension intermédiaire de 2048, et 6 experts routés s'activent par token. Les trois premières couches MoE utilisent un routage par hachage et la profondeur de prédiction multi-token est de 1. Le checkpoint 0731 publié pèse 304 Md de paramètres car il embarque un module de brouillon pour le décodage spéculatif par-dessus la base de 284 Md. Il prend en charge une fenêtre de contexte d'un million de tokens avec jusqu'à 384 K en sortie, les modes réflexion et sans réflexion, ainsi qu'un paramètre reasoning_effort à trois niveaux : low, high et max. Les poids sont sous licence MIT et accessibles sans restriction.

Spécifications en un coup d'œil

FournisseurDeepSeek
Identifiant du modèledeepseek-v4-flash
ModalitésText, Code

Benchmarks de DeepSeek V4 Flash

Chiffres annoncés par DeepSeek, tirés de la fiche du modèle DeepSeek-V4-Flash-0731, obtenus avec le DeepSeek Harness en mode minimal et un effort de raisonnement max (température 1,0, top_p 0,95). Le harness n'ayant pas été publié, aucun de ces résultats n'a été reproduit indépendamment ; DSBench-FullStack et DSBench-Hard sont des jeux de tests internes à DeepSeek.

Terminal-Bench 2.1travail agentique en terminal ; V4 Pro (Preview) 72,1
82,7
SWE-bench Verifiedversion preview, annoncé par le fournisseur
79,0 %
Cybergymannoncé par le fournisseur
76,7
Toolathlon (verified)usage d'outils ; V4 Pro (Preview) 55,9
70,3
DSBench-FullStackjeu interne DeepSeek
68,7
DSBench-Hardjeu interne DeepSeek
59,6
DeepSWEcontre 7,3 pour la version preview
54,4
NL2Repoconstruction de dépôt
54,2
Agents' Last ExamClaude Opus 4.8 obtient 25,7
25,2

Meilleures tâches d'agent pour DeepSeek V4 Flash

Agents de code à gros volume

Revue de PR en masse, écriture de tests, passes lint-et-correction et refactorisations planifiées, là où le même agent tourne des centaines de fois par jour. À 0,28 $ par million de tokens en sortie, le coût par exécution reste assez bas pour que le volume cesse d'être la contrainte.

Automatisation pilotée par terminal et outils

Les meilleurs résultats publiés de la version 0731 portent sur le travail en terminal et l'usage d'outils, c'est-à-dire exactement ce que fait toute la journée un agent de correction de build, de vérification de déploiement ou de tri de logs.

Lecture à l'échelle du dépôt

Une fenêtre d'un million de tokens absorbe un dépôt de taille moyenne, une longue chronologie d'incident ou un jeu complet de documents de conception en une passe : un agent de migration ou d'audit peut raisonner sur l'ensemble plutôt que morceau par morceau.

La couche économique sous un orchestrateur de pointe

Laissez Claude Opus 5 ou GPT 5.6 Sol planifier et relire, et confiez à V4 Flash les nombreuses étapes mécaniques — lire des fichiers, exécuter des commandes, rédiger des correctifs. Vous ne payez le tarif haut de gamme que sur les étapes qui décident du résultat.

Questions fréquentes

Quelle est la fenêtre de contexte de DeepSeek V4 Flash ?

Un million de tokens en entrée et jusqu'à 384 K tokens de sortie par réponse. DeepSeek recommande le plafond de 384 K en sortie aux niveaux d'effort high et max.

DeepSeek V4 Flash gère-t-il la vision ?

Non. Il n'accepte que du texte et du code. Routez les étapes fondées sur des captures d'écran, des graphiques ou des PDF vers un modèle multimodal comme Claude Sonnet 4.6 ou GPT 5.6 Luna.

Alternatives

Disponibilité de DeepSeek V4 Flash sur Okou

DeepSeek V4 Flash n’est plus proposé sur Okou. Consultez GPT 6 Luna pour une alternative actuellement prise en charge. Cette page conserve des informations historiques, pas les tarifs actuels de Okou.