DeepSeek V4 Flash: historisk modellreferens
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash erbjuds inte längre på Okou. Se GPT 6 Luna för ett alternativ som stöds i dag. Den här sidan bevarar historisk modellinformation, inte aktuella Okou-priser.
Se GPT 6 LunaVad är DeepSeek V4 Flash?
31 juli 2026 (DeepSeek-V4-Flash-0731, offentlig beta)
Vad är anmärkningsvärt med DeepSeek V4 Flash
Rubrikarkitektur och funktionsfunktioner.
V4 Flash är en gles Mixture-of-Experts-modell: 284B totala parametrar med 13B aktiverade per token, där varje MoE-lager innehåller 1 delad expert och 256 dirigerade experter vid en mellanliggande dimension på 2048, och 6 dirigerade experter aktiveras per token. De första tre MoE-lagren använder hash-routing, och förutsägelsedjupet för flera tokens är 1. Den publicerade 0731-checkpointen har 304B parametrar eftersom den levereras med en spekulativ-avkodningsmodul ovanpå den 284B-basen. Den stöder ett 1M-token kontextfönster med upp till 384K utdata, tänkande och icke-tänkande lägen, och en reasoning_effort-parameter med low, high och max-nivåer. Vikterna är MIT-licensierade och ogated.
Specifikationer i korthet
DeepSeek V4 Flash benchmarks
DeepSeek-rapporterade siffror från DeepSeek-V4-Flash-0731-modellkortet, körda med DeepSeek Harness i minimalt läge vid maximal resonemangsinsats (temperatur 1.0, top_p 0.95). Harness har inte släppts, så ingen av dessa har reproducerats oberoende, och DSBench-FullStack och DSBench-Hard är DeepSeeks interna testuppsättningar.
Bästa agentuppgifter för DeepSeek V4 Flash
Terminal- och verktygsdriven automatisering
0731-versionens starkaste publicerade resultat är på terminalarbete och verktygsanvändning, vilket är precis vad en bygg-fix, distributionskontroll eller logg-triage-agent gör hela dagen.
Repository-bred läsning
Ett 1M-tokenfönster tar en hel medelstor databas, en lång incidenttidslinje eller en komplett uppsättning designspecifikationer i ett enda pass, så en migrerings- eller revisionsagent kan resonera över hela saken istället för bit för bit.
Det billiga lagret under en banbrytande orkestrator
Låt Claude Opus 5 eller GPT 5.6 Sol planera och granska, och överlämna de många mekaniska stegen – läsa filer, köra kommandon, utarbeta patchar – till V4 Flash. Du betalar gränspriset endast för de steg som avgör körningen.
Vanliga frågor
Vad är DeepSeek V4 Flashs kontextfönster?
1M tokens in, och upp till 384K tokens utdata per svar. DeepSeek rekommenderar det fulla 384K utdatataket vid high och max resonemangsnivåer.
Stöder DeepSeek V4 Flash vision?
Nej. Den tar endast text och kod. Skicka skärmbilds-, diagram- eller PDF-drivna steg till en multimodal modell som Claude Sonnet 4.6 eller GPT 5.6 Luna.
Alternativ
Tillgänglighet av DeepSeek V4 Flash på Okou
DeepSeek V4 Flash erbjuds inte längre på Okou. Se GPT 6 Luna för ett alternativ som stöds i dag. Den här sidan bevarar historisk modellinformation, inte aktuella Okou-priser.

