DeepSeek V4 Flash: historické informace o modelu
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash již není na Okou nabízen. Aktuálně podporovanou alternativu najdete u GPT 6 Luna. Tato stránka uchovává historické informace o modelu, nikoli současné ceny Okou.
Viz GPT 6 LunaCo je DeepSeek V4 Flash?
31. července 2026 (DeepSeek-V4-Flash-0731, veřejná beta)
Co je pozoruhodné na DeepSeek V4 Flash
Architektura nadpisů a funkce schopností.
V4 Flash je řídký model Mixture-of-Experts: celkem 284B parametrů s 13B aktivovanými na token, kde každá vrstva MoE obsahuje 1 sdíleného experta a 256 směrovaných expertů s mezilehlou dimenzí 2048, a 6 směrovaných expertů se spouští na token. První tři vrstvy MoE používají hashové směrování a hloubka predikce více tokenů je 1. Publikovaný kontrolní bod 0731 má 304B parametrů, protože obsahuje modul pro spekulativní dekódování nad základem 284B. Podporuje kontextové okno 1M tokenů s až 384K výstupu, režimy myšlení a nemyšlení a parametr reasoning_effort s úrovněmi low, high a max. Váhy jsou licencovány pod MIT a jsou neomezené.
Specifikace na první pohled
Benchmarky DeepSeek V4 Flash
DeepSeek-hlášené údaje z karty modelu DeepSeek-V4-Flash-0731, spuštěné s DeepSeek Harness v minimálním režimu s maximálním úsilím o uvažování (teplota 1.0, top_p 0.95). Harness nebyl vydán, takže žádný z těchto údajů nebyl nezávisle reprodukován a DSBench-FullStack a DSBench-Hard jsou interní testovací sady DeepSeek.
Nejlepší úkoly agenta pro DeepSeek V4 Flash
Agenti pro kódování s vysokým objemem
Hromadné revize PR, psaní testů, lint-and-fix průchody a plánované refaktoringy, kde stejný agent běží stokrát denně. Při 0,28 $ za 1M výstupních tokenů zůstávají náklady na jedno spuštění dostatečně nízké, takže objem přestává být omezením.
Automatizace řízená terminálem a nástroji
Nejsilnější publikované výsledky sestavení 0731 jsou v terminálové práci a používání nástrojů, což je přesně to, co agent pro opravu sestavení, kontrolu nasazení nebo třídění protokolů dělá celý den.
Čtení celého úložiště
Okno 1M tokenů pojme celý středně velký repozitář, dlouhou časovou osu incidentu nebo kompletní sadu návrhových dokumentů v jednom průchodu, takže migrační nebo auditní agent může uvažovat o celé věci namísto po částech.
Levná vrstva pod hraničním orchestrátorem
Nechte Claude Opus 5 nebo GPT 5.6 Sol plánovat a revidovat a mnoho mechanických kroků – čtení souborů, spouštění příkazů, navrhování záplat – předejte V4 Flash. Hraniční sazbu platíte pouze za kroky, které rozhodují o běhu.
Často kladené otázky
Jaké je kontextové okno DeepSeek V4 Flash?
1M tokenů na vstupu a až 384K tokenů výstupu na odpověď. DeepSeek doporučuje plný strop 384K výstupu na úrovních úsilí high a max.
Podporuje DeepSeek V4 Flash vizi?
Ne. Přijímá pouze text a kód. Kroky řízené snímky obrazovky, grafy nebo PDF směrujte na multimodální model, jako je Claude Sonnet 4.6 nebo GPT 5.6 Luna.
Alternativy
Dostupnost DeepSeek V4 Flash na Okou
DeepSeek V4 Flash již není na Okou nabízen. Aktuálně podporovanou alternativu najdete u GPT 6 Luna. Tato stránka uchovává historické informace o modelu, nikoli současné ceny Okou.

