DeepSeek V4 Flash: historyczne informacje o modelu
1M tokens · Text / Code · Prompt cache
Model DeepSeek V4 Flash nie jest już oferowany w Okou. Zobacz GPT 6 Luna jako obecnie obsługiwaną alternatywę. Ta strona zachowuje historyczne informacje o modelu, a nie aktualne ceny Okou.
Zobacz GPT 6 LunaCzym jest DeepSeek V4 Flash?
31 lipca 2026 (DeepSeek-V4-Flash-0731, publiczna beta)
Co jest godne uwagi w DeepSeek V4 Flash
Architektura nagłówków i funkcje możliwości.
V4 Flash to rzadki model Mixture-of-Experts: 284B całkowitych parametrów z 13B aktywowanych na token, gdzie każda warstwa MoE zawiera 1 wspólnego eksperta i 256 kierowanych ekspertów o pośrednim wymiarze 2048, a 6 kierowanych ekspertów uruchamia się na token. Pierwsze trzy warstwy MoE używają routingu haszującego, a głębokość przewidywania wielu tokenów wynosi 1. Opublikowany punkt kontrolny 0731 ma 304B parametrów, ponieważ zawiera moduł roboczy do spekulatywnego dekodowania na szczycie bazy 284B. Obsługuje okno kontekstowe 1M tokenów z wyjściem do 384K, tryby myślenia i niemyślenia oraz parametr reasoning_effort z poziomami low, high i max. Wagi są objęte licencją MIT i nie są bramkowane.
Specyfikacje w skrócie
Benchmarki DeepSeek V4 Flash
Dane zgłoszone przez DeepSeek z karty modelu DeepSeek-V4-Flash-0731, uruchomione z DeepSeek Harness w trybie minimalnym przy maksymalnym wysiłku rozumowania (temperatura 1.0, top_p 0.95). Uprząż nie została wydana, więc żadne z tych danych nie zostało niezależnie odtworzone, a DSBench-FullStack i DSBench-Hard to wewnętrzne zestawy testowe DeepSeek.
Najlepsze zadania agenta dla DeepSeek V4 Flash
Agenci kodujący o dużej objętości
Masowe przeglądy PR, pisanie testów, przechodzenie lint-and-fix i zaplanowane refaktoryzacje, gdzie ten sam agent działa setki razy dziennie. Przy 0,28 USD za 1 milion tokenów wyjściowych koszt pojedynczego uruchomienia pozostaje na tyle niski, że objętość przestaje być ograniczeniem.
Automatyzacja terminalowa i sterowana narzędziami
Najsilniejsze opublikowane wyniki kompilacji 0731 dotyczą pracy terminalowej i użycia narzędzi, co jest dokładnie tym, co agent do naprawy kompilacji, sprawdzania wdrożenia lub sortowania logów robi przez cały dzień.
Czytanie w całym repozytorium
Okno 1M tokenów pozwala na jednorazowe przetworzenie całego średniej wielkości repozytorium, długiej osi czasu incydentu lub pełnego zestawu dokumentów projektowych, dzięki czemu agent migracji lub audytu może rozumować nad całością, zamiast fragment po fragmencie.
Tania warstwa pod orkiestratorem granicznym
Pozwól Claude Opus 5 lub GPT 5.6 Sol zaplanować i przejrzeć, a wiele mechanicznych kroków — czytanie plików, uruchamianie poleceń, tworzenie poprawek — przekaż V4 Flash. Płacisz stawkę graniczną tylko za kroki, które decydują o przebiegu.
Często zadawane pytania
Jakie jest okno kontekstowe DeepSeek V4 Flash?
1M tokenów wejściowych i do 384K tokenów wyjściowych na odpowiedź. DeepSeek zaleca pełny limit 384K wyjściowych tokenów na poziomach wysiłku rozumowania high i max.
Czy DeepSeek V4 Flash obsługuje wizję?
Nie. Przyjmuje tylko tekst i kod. Kroki oparte na zrzutach ekranu, wykresach lub PDF kieruj do modelu multimodalnego, takiego jak Claude Sonnet 4.6 lub GPT 5.6 Luna.
Alternatywy
Dostępność DeepSeek V4 Flash na Okou
Model DeepSeek V4 Flash nie jest już oferowany w Okou. Zobacz GPT 6 Luna jako obecnie obsługiwaną alternatywę. Ta strona zachowuje historyczne informacje o modelu, a nie aktualne ceny Okou.

