DeepSeek V4 Flash: historisk modelreference
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash tilbydes ikke længere på Okou. Se GPT 6 Luna for et alternativ, der understøttes i dag. Denne side bevarer historiske modeloplysninger, ikke aktuelle Okou-priser.
Se GPT 6 LunaHvad er DeepSeek V4 Flash?
31. juli 2026 (DeepSeek-V4-Flash-0731, offentlig beta)
Hvad er bemærkelsesværdigt ved DeepSeek V4 Flash
Overskriftsarkitektur og kapacitetsfunktioner.
V4 Flash er en sparsom Mixture-of-Experts-model: 284B samlede parametre med 13B aktiveret pr. token, hvor hvert MoE-lag indeholder 1 delt ekspert og 256 routede eksperter ved en mellemliggende dimension på 2048, og 6 routede eksperter aktiveres pr. token. De første tre MoE-lag bruger hash-routing, og multi-token forudsigelsesdybden er 1. Det publicerede 0731-kontrolpunkt er 304B parametre, fordi det leverer et spekulativt-dekodende udkastmodul oven på den 284B base. Det understøtter et 1M-token kontekstvindue med op til 384K output, tænkende og ikke-tænkende tilstande og en reasoning_effort-parameter med low, high og max-niveauer. Vægtene er MIT-licenserede og ubeskyttede.
Specifikationer på et øjeblik
DeepSeek V4 Flash benchmarks
DeepSeek-rapporterede tal fra DeepSeek-V4-Flash-0731 modelkortet, kørt med DeepSeek Harness i minimal tilstand ved maksimal ræsonneringsindsats (temperatur 1.0, top_p 0.95). Harness er ikke blevet frigivet, så ingen af disse er blevet reproduceret uafhængigt, og DSBench-FullStack og DSBench-Hard er DeepSeeks interne testsæt.
Bedste agentopgaver for DeepSeek V4 Flash
Terminal- og værktøjsdrevet automatisering
0731-buildets stærkeste publicerede resultater er på terminalarbejde og værktøjsbrug, hvilket er præcis, hvad en build-fix, deployment-check eller log-triage-agent gør hele dagen.
Repository-dækkende læsning
Et 1M-token vindue tager et helt mellemstort repository, en lang hændelsestidslinje eller et komplet sæt designdokumenter i én omgang, så en migrations- eller revisionsagent kan ræsonnere over det hele i stedet for stykke for stykke.
Det billige lag under en frontier-orkestrator
Lad Claude Opus 5 eller GPT 5.6 Sol planlægge og gennemgå, og overlad de mange mekaniske trin – læsning af filer, kørsel af kommandoer, udarbejdelse af patches – til V4 Flash. Du betaler kun frontier-prisen for de trin, der afgør kørslen.
Ofte stillede spørgsmål
Hvad er DeepSeek V4 Flash's kontekstvindue?
1M tokens ind, og op til 384K tokens output pr. svar. DeepSeek anbefaler det fulde 384K outputloft på high og max ræsonnementsniveauer.
Understøtter DeepSeek V4 Flash vision?
Nej. Den tager kun tekst og kode. Send skærmbillede-, diagram- eller PDF-drevne trin til en multimodal model som Claude Sonnet 4.6 eller GPT 5.6 Luna.
Alternativer
Tilgængelighed af DeepSeek V4 Flash på Okou
DeepSeek V4 Flash tilbydes ikke længere på Okou. Se GPT 6 Luna for et alternativ, der understøttes i dag. Denne side bevarer historiske modeloplysninger, ikke aktuelle Okou-priser.

