← Alle modeller

DeepSeek V4 Flash: historisk modellreferanse

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash tilbys ikke lenger på Okou. Se GPT 6 Luna for et alternativ som støttes i dag. Denne siden bevarer historisk modellinformasjon, ikke gjeldende Okou-priser.

Se GPT 6 Luna

En nåværende resonnementsmodell fra DeepSeek, tilgjengelig i Okous offentlige modellkatalog.

Hva er DeepSeek V4 Flash?

31. juli 2026 (DeepSeek-V4-Flash-0731, offentlig beta)

Hva er bemerkelsesverdig med DeepSeek V4 Flash

Overskriftsarkitektur og funksjonsfunksjoner.

V4 Flash er en sparsom Mixture-of-Experts-modell: 284B totale parametere med 13B aktivert per token, der hvert MoE-lag inneholder 1 delt ekspert og 256 rutet eksperter ved en mellomliggende dimensjon på 2048, og 6 rutet eksperter aktiveres per token. De tre første MoE-lagene bruker hash-ruting, og multi-token prediksjonsdybde er 1. Den publiserte 0731-sjekkpunktet er 304B parametere fordi den leveres med en spekulativ-dekodingsutkastmodul på toppen av den 284B-basen. Den støtter et 1M-token kontekstvindu med opptil 384K utdata, tenkende og ikke-tenkende moduser, og en reasoning_effort-parameter med low, high og max-nivåer. Vektene er MIT-lisensiert og ubeskyttet.

Spesifikasjoner på et øyeblikk

LeverandørDeepSeek
Modell-IDdeepseek-v4-flash
ModaliteterText, Code

DeepSeek V4 Flash referansepunkter

DeepSeek-rapporterte tall fra DeepSeek-V4-Flash-0731 modellkort, kjørt med DeepSeek Harness i minimal modus med maksimal resonnementsinnsats (temperatur 1.0, top_p 0.95). Harness er ikke utgitt, så ingen av disse er reprodusert uavhengig, og DSBench-FullStack og DSBench-Hard er DeepSeeks interne testsett.

Terminal-Bench 2.1agentisk terminalarbeid; V4 Pro (forhåndsvisning) 72.1
82.7
SWE-bench Verifiedforhåndsversjon, leverandørrapportert
79.0%
Cybergymleverandør-rapportert
76.7
Toolathlon (verifisert)verktøybruk; V4 Pro (forhåndsvisning) 55.9
70.3
DSBench-FullStackDeepSeek internt sett
68.7
DSBench-HardDeepSeek internt sett
59.6
DeepSWEopp fra 7.3 i forhåndsversjonen
54.4
NL2Repokonstruksjon av depot
54.2
Agentenes siste eksamenClaude Opus 4.8 scorer 25.7
25.2

Beste agentoppgaver for DeepSeek V4 Flash

Terminal- og verktøydrevet automatisering

De sterkeste publiserte resultatene fra 0731-bygget er på terminalarbeid og verktøybruk, noe som er akkurat det en build-fix, deployment-check eller log-triage-agent gjør hele dagen.

Repository-bred lesing

Et 1M-token-vindu tar et helt mellomstort depot, en lang hendelses tidslinje eller et komplett sett med designdokumenter i ett pass, slik at en migrasjons- eller revisjonsagent kan resonnere over hele saken i stedet for bit for bit.

Det billige laget under en grenseorkestrator

La Claude Opus 5 eller GPT 5.6 Sol planlegge og gjennomgå, og overlat de mange mekaniske trinnene – lesing av filer, kjøring av kommandoer, utarbeidelse av patcher – til V4 Flash. Du betaler grenseprisen bare for trinnene som bestemmer kjøringen.

Ofte stilte spørsmål

Hva er DeepSeek V4 Flashs kontekstvindu?

1M tokens inn, og opptil 384K tokens ut per svar. DeepSeek anbefaler det fulle 384K utgangstaket på high og max resonnementsnivåer.

Støtter DeepSeek V4 Flash syn?

Nei. Den tar kun tekst og kode. Send skjermbilde-, diagram- eller PDF-drevne trinn til en multimodal modell som Claude Sonnet 4.6 eller GPT 5.6 Luna.

Alternativer

Tilgjengelighet av DeepSeek V4 Flash på Okou

DeepSeek V4 Flash tilbys ikke lenger på Okou. Se GPT 6 Luna for et alternativ som støttes i dag. Denne siden bevarer historisk modellinformasjon, ikke gjeldende Okou-priser.