← Alle modeller

DeepSeek V4 Flash: historisk modelreference

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash tilbydes ikke længere på Okou. Se GPT 6 Luna for et alternativ, der understøttes i dag. Denne side bevarer historiske modeloplysninger, ikke aktuelle Okou-priser.

Se GPT 6 Luna

Hvad er DeepSeek V4 Flash?

31. juli 2026 (DeepSeek-V4-Flash-0731, offentlig beta)

Hvad er bemærkelsesværdigt ved DeepSeek V4 Flash

Overskriftsarkitektur og kapacitetsfunktioner.

V4 Flash er en sparsom Mixture-of-Experts-model: 284B samlede parametre med 13B aktiveret pr. token, hvor hvert MoE-lag indeholder 1 delt ekspert og 256 routede eksperter ved en mellemliggende dimension på 2048, og 6 routede eksperter aktiveres pr. token. De første tre MoE-lag bruger hash-routing, og multi-token forudsigelsesdybden er 1. Det publicerede 0731-kontrolpunkt er 304B parametre, fordi det leverer et spekulativt-dekodende udkastmodul oven på den 284B base. Det understøtter et 1M-token kontekstvindue med op til 384K output, tænkende og ikke-tænkende tilstande og en reasoning_effort-parameter med low, high og max-niveauer. Vægtene er MIT-licenserede og ubeskyttede.

Specifikationer på et øjeblik

UdbyderDeepSeek
Model-IDdeepseek-v4-flash
ModaliteterText, Code

DeepSeek V4 Flash benchmarks

DeepSeek-rapporterede tal fra DeepSeek-V4-Flash-0731 modelkortet, kørt med DeepSeek Harness i minimal tilstand ved maksimal ræsonneringsindsats (temperatur 1.0, top_p 0.95). Harness er ikke blevet frigivet, så ingen af disse er blevet reproduceret uafhængigt, og DSBench-FullStack og DSBench-Hard er DeepSeeks interne testsæt.

Terminal-Bench 2.1agentisk terminalarbejde; V4 Pro (forhåndsvisning) 72.1
82.7
SWE-bench Verificeretforhåndsvisningsbygning, leverandørrapporteret
79.0%
Cybergymleverandør-rapporteret
76.7
Toolathlon (verificeret)værktøjsbrug; V4 Pro (Preview) 55.9
70.3
DSBench-FullStackDeepSeek internt sæt
68.7
DSBench-HardDeepSeek internt sæt
59.6
DeepSWEop fra 7.3 i forhåndsvisningsbygningen
54.4
NL2Reporepository konstruktion
54.2
Agenternes sidste eksamenClaude Opus 4.8 scorer 25.7
25.2

Bedste agentopgaver for DeepSeek V4 Flash

Terminal- og værktøjsdrevet automatisering

0731-buildets stærkeste publicerede resultater er på terminalarbejde og værktøjsbrug, hvilket er præcis, hvad en build-fix, deployment-check eller log-triage-agent gør hele dagen.

Repository-dækkende læsning

Et 1M-token vindue tager et helt mellemstort repository, en lang hændelsestidslinje eller et komplet sæt designdokumenter i én omgang, så en migrations- eller revisionsagent kan ræsonnere over det hele i stedet for stykke for stykke.

Det billige lag under en frontier-orkestrator

Lad Claude Opus 5 eller GPT 5.6 Sol planlægge og gennemgå, og overlad de mange mekaniske trin – læsning af filer, kørsel af kommandoer, udarbejdelse af patches – til V4 Flash. Du betaler kun frontier-prisen for de trin, der afgør kørslen.

Ofte stillede spørgsmål

Hvad er DeepSeek V4 Flash's kontekstvindue?

1M tokens ind, og op til 384K tokens output pr. svar. DeepSeek anbefaler det fulde 384K outputloft på high og max ræsonnementsniveauer.

Understøtter DeepSeek V4 Flash vision?

Nej. Den tager kun tekst og kode. Send skærmbillede-, diagram- eller PDF-drevne trin til en multimodal model som Claude Sonnet 4.6 eller GPT 5.6 Luna.

Alternativer

Tilgængelighed af DeepSeek V4 Flash på Okou

DeepSeek V4 Flash tilbydes ikke længere på Okou. Se GPT 6 Luna for et alternativ, der understøttes i dag. Denne side bevarer historiske modeloplysninger, ikke aktuelle Okou-priser.