DeepSeek V4 Flash: historisk modellreferanse
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash tilbys ikke lenger på Okou. Se GPT 6 Luna for et alternativ som støttes i dag. Denne siden bevarer historisk modellinformasjon, ikke gjeldende Okou-priser.
Se GPT 6 LunaEn nåværende resonnementsmodell fra DeepSeek, tilgjengelig i Okous offentlige modellkatalog.
Hva er DeepSeek V4 Flash?
31. juli 2026 (DeepSeek-V4-Flash-0731, offentlig beta)
Hva er bemerkelsesverdig med DeepSeek V4 Flash
Overskriftsarkitektur og funksjonsfunksjoner.
V4 Flash er en sparsom Mixture-of-Experts-modell: 284B totale parametere med 13B aktivert per token, der hvert MoE-lag inneholder 1 delt ekspert og 256 rutet eksperter ved en mellomliggende dimensjon på 2048, og 6 rutet eksperter aktiveres per token. De tre første MoE-lagene bruker hash-ruting, og multi-token prediksjonsdybde er 1. Den publiserte 0731-sjekkpunktet er 304B parametere fordi den leveres med en spekulativ-dekodingsutkastmodul på toppen av den 284B-basen. Den støtter et 1M-token kontekstvindu med opptil 384K utdata, tenkende og ikke-tenkende moduser, og en reasoning_effort-parameter med low, high og max-nivåer. Vektene er MIT-lisensiert og ubeskyttet.
Spesifikasjoner på et øyeblikk
DeepSeek V4 Flash referansepunkter
DeepSeek-rapporterte tall fra DeepSeek-V4-Flash-0731 modellkort, kjørt med DeepSeek Harness i minimal modus med maksimal resonnementsinnsats (temperatur 1.0, top_p 0.95). Harness er ikke utgitt, så ingen av disse er reprodusert uavhengig, og DSBench-FullStack og DSBench-Hard er DeepSeeks interne testsett.
Beste agentoppgaver for DeepSeek V4 Flash
Terminal- og verktøydrevet automatisering
De sterkeste publiserte resultatene fra 0731-bygget er på terminalarbeid og verktøybruk, noe som er akkurat det en build-fix, deployment-check eller log-triage-agent gjør hele dagen.
Repository-bred lesing
Et 1M-token-vindu tar et helt mellomstort depot, en lang hendelses tidslinje eller et komplett sett med designdokumenter i ett pass, slik at en migrasjons- eller revisjonsagent kan resonnere over hele saken i stedet for bit for bit.
Det billige laget under en grenseorkestrator
La Claude Opus 5 eller GPT 5.6 Sol planlegge og gjennomgå, og overlat de mange mekaniske trinnene – lesing av filer, kjøring av kommandoer, utarbeidelse av patcher – til V4 Flash. Du betaler grenseprisen bare for trinnene som bestemmer kjøringen.
Ofte stilte spørsmål
Hva er DeepSeek V4 Flashs kontekstvindu?
1M tokens inn, og opptil 384K tokens ut per svar. DeepSeek anbefaler det fulle 384K utgangstaket på high og max resonnementsnivåer.
Støtter DeepSeek V4 Flash syn?
Nei. Den tar kun tekst og kode. Send skjermbilde-, diagram- eller PDF-drevne trinn til en multimodal modell som Claude Sonnet 4.6 eller GPT 5.6 Luna.
Alternativer
Tilgjengelighet av DeepSeek V4 Flash på Okou
DeepSeek V4 Flash tilbys ikke lenger på Okou. Se GPT 6 Luna for et alternativ som støttes i dag. Denne siden bevarer historisk modellinformasjon, ikke gjeldende Okou-priser.

