← Wszystkie modele

DeepSeek V4 Flash: historyczne informacje o modelu

1M tokens · Text / Code · Prompt cache

Model DeepSeek V4 Flash nie jest już oferowany w Okou. Zobacz GPT 6 Luna jako obecnie obsługiwaną alternatywę. Ta strona zachowuje historyczne informacje o modelu, a nie aktualne ceny Okou.

Zobacz GPT 6 Luna

Czym jest DeepSeek V4 Flash?

31 lipca 2026 (DeepSeek-V4-Flash-0731, publiczna beta)

Co jest godne uwagi w DeepSeek V4 Flash

Architektura nagłówków i funkcje możliwości.

V4 Flash to rzadki model Mixture-of-Experts: 284B całkowitych parametrów z 13B aktywowanych na token, gdzie każda warstwa MoE zawiera 1 wspólnego eksperta i 256 kierowanych ekspertów o pośrednim wymiarze 2048, a 6 kierowanych ekspertów uruchamia się na token. Pierwsze trzy warstwy MoE używają routingu haszującego, a głębokość przewidywania wielu tokenów wynosi 1. Opublikowany punkt kontrolny 0731 ma 304B parametrów, ponieważ zawiera moduł roboczy do spekulatywnego dekodowania na szczycie bazy 284B. Obsługuje okno kontekstowe 1M tokenów z wyjściem do 384K, tryby myślenia i niemyślenia oraz parametr reasoning_effort z poziomami low, high i max. Wagi są objęte licencją MIT i nie są bramkowane.

Specyfikacje w skrócie

DostawcaDeepSeek
ID modeludeepseek-v4-flash
ModalnościText, Code

Benchmarki DeepSeek V4 Flash

Dane zgłoszone przez DeepSeek z karty modelu DeepSeek-V4-Flash-0731, uruchomione z DeepSeek Harness w trybie minimalnym przy maksymalnym wysiłku rozumowania (temperatura 1.0, top_p 0.95). Uprząż nie została wydana, więc żadne z tych danych nie zostało niezależnie odtworzone, a DSBench-FullStack i DSBench-Hard to wewnętrzne zestawy testowe DeepSeek.

Terminal-Bench 2.1agentowa praca terminalowa; V4 Pro (podgląd) 72.1
82.7
SWE-bench Verifiedkompilacja podglądowa, zgłoszona przez dostawcę
79.0%
Cybergymzgłoszone przez dostawcę
76.7
Toolathlon (zweryfikowany)użycie narzędzi; V4 Pro (podgląd) 55.9
70.3
DSBench-FullStackWewnętrzny zestaw DeepSeek
68.7
DSBench-HardWewnętrzny zestaw DeepSeek
59.6
DeepSWEwzrost z 7.3 w wersji podglądowej
54.4
NL2Repobudowa repozytorium
54.2
Ostatni egzamin agentówClaude Opus 4.8 osiąga 25.7
25.2

Najlepsze zadania agenta dla DeepSeek V4 Flash

Agenci kodujący o dużej objętości

Masowe przeglądy PR, pisanie testów, przechodzenie lint-and-fix i zaplanowane refaktoryzacje, gdzie ten sam agent działa setki razy dziennie. Przy 0,28 USD za 1 milion tokenów wyjściowych koszt pojedynczego uruchomienia pozostaje na tyle niski, że objętość przestaje być ograniczeniem.

Automatyzacja terminalowa i sterowana narzędziami

Najsilniejsze opublikowane wyniki kompilacji 0731 dotyczą pracy terminalowej i użycia narzędzi, co jest dokładnie tym, co agent do naprawy kompilacji, sprawdzania wdrożenia lub sortowania logów robi przez cały dzień.

Czytanie w całym repozytorium

Okno 1M tokenów pozwala na jednorazowe przetworzenie całego średniej wielkości repozytorium, długiej osi czasu incydentu lub pełnego zestawu dokumentów projektowych, dzięki czemu agent migracji lub audytu może rozumować nad całością, zamiast fragment po fragmencie.

Tania warstwa pod orkiestratorem granicznym

Pozwól Claude Opus 5 lub GPT 5.6 Sol zaplanować i przejrzeć, a wiele mechanicznych kroków — czytanie plików, uruchamianie poleceń, tworzenie poprawek — przekaż V4 Flash. Płacisz stawkę graniczną tylko za kroki, które decydują o przebiegu.

Często zadawane pytania

Jakie jest okno kontekstowe DeepSeek V4 Flash?

1M tokenów wejściowych i do 384K tokenów wyjściowych na odpowiedź. DeepSeek zaleca pełny limit 384K wyjściowych tokenów na poziomach wysiłku rozumowania high i max.

Czy DeepSeek V4 Flash obsługuje wizję?

Nie. Przyjmuje tylko tekst i kod. Kroki oparte na zrzutach ekranu, wykresach lub PDF kieruj do modelu multimodalnego, takiego jak Claude Sonnet 4.6 lub GPT 5.6 Luna.

Alternatywy

Dostępność DeepSeek V4 Flash na Okou

Model DeepSeek V4 Flash nie jest już oferowany w Okou. Zobacz GPT 6 Luna jako obecnie obsługiwaną alternatywę. Ta strona zachowuje historyczne informacje o modelu, a nie aktualne ceny Okou.