← Alle modellen

DeepSeek V4 Flash: historische modelreferentie

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash wordt niet meer aangeboden op Okou. Bekijk GPT 6 Luna voor een momenteel ondersteund alternatief. Deze pagina bewaart historische modelinformatie, geen actuele Okou-prijzen.

Zie GPT 6 Luna

Wat is DeepSeek V4 Flash?

31 juli 2026 (DeepSeek-V4-Flash-0731, openbare bèta)

Wat is opmerkelijk aan DeepSeek V4 Flash

Koparchitectuur en functionaliteiten.

V4 Flash is een spaarzaam Mixture-of-Experts-model: 284B totale parameters met 13B geactiveerd per token, waarbij elke MoE-laag 1 gedeelde expert en 256 gerouteerde experts bevat met een intermediaire dimensie van 2048, en 6 gerouteerde experts per token worden geactiveerd. De eerste drie MoE-lagen gebruiken hash-routing, en de voorspellingsdiepte van meerdere tokens is 1. Het gepubliceerde 0731-checkpoint heeft 304B parameters omdat het een speculatief-decoderende conceptmodule bovenop de 284B-basis levert. Het ondersteunt een contextvenster van 1M tokens met tot 384K uitvoer, denk- en niet-denkmodi, en een reasoning_effort-parameter met low, high en max-niveaus. Gewichten zijn MIT-gelicentieerd en onbeperkt.

Specificaties in één oogopslag

AanbiederDeepSeek
Model IDdeepseek-v4-flash
ModaliteitenText, Code

DeepSeek V4 Flash benchmarks

Door DeepSeek gerapporteerde cijfers van de DeepSeek-V4-Flash-0731 modelkaart, uitgevoerd met de DeepSeek Harness in minimale modus met maximale redeneerinspanning (temperatuur 1.0, top_p 0.95). De harness is niet vrijgegeven, dus geen van deze is onafhankelijk gereproduceerd, en DSBench-FullStack en DSBench-Hard zijn DeepSeek's interne testsets.

Terminal-Bench 2.1agentic terminal werk; V4 Pro (Preview) 72.1
82.7
SWE-bench Geverifieerdpreview build, door leverancier gerapporteerd
79.0%
Cybergymdoor leverancier gerapporteerd
76.7
Toolathlon (geverifieerd)toolgebruik; V4 Pro (Preview) 55.9
70.3
DSBench-FullStackDeepSeek interne set
68.7
DSBench-HardDeepSeek interne set
59.6
DeepSWEomhoog van 7.3 in de preview build
54.4
NL2Reporepository constructie
54.2
Laatste examen van agentenClaude Opus 4.8 scoort 25.7
25.2

Beste agenttaken voor DeepSeek V4 Flash

Terminal- en toolgestuurde automatisering

De sterkste gepubliceerde resultaten van de 0731-build zijn op terminalwerk en toolgebruik, wat precies is wat een build-fix, deployment-check of log-triage agent de hele dag doet.

Repository-brede lezing

Een venster van 1M tokens neemt een hele middelgrote repository, een lange incidenttijdlijn of een volledige set ontwerpdokumenten in één keer op, zodat een migratie- of auditagent over het geheel kan redeneren in plaats van stukje bij beetje.

De goedkope laag onder een grensverleggende orkestrator

Laat Claude Opus 5 of GPT 5.6 Sol plannen en beoordelen, en geef de vele mechanische stappen — bestanden lezen, commando's uitvoeren, patches opstellen — aan V4 Flash. U betaalt het grenspercentage alleen voor de stappen die de run bepalen.

Veelgestelde vragen

Wat is het contextvenster van DeepSeek V4 Flash?

1M tokens in, en tot 384K tokens output per antwoord. DeepSeek beveelt het volledige 384K outputplafond aan op de high en max redeneringsinspanningsniveaus.

Ondersteunt DeepSeek V4 Flash visie?

Nee. Het accepteert alleen tekst en code. Leid stappen die gebaseerd zijn op screenshots, grafieken of PDF naar een multimodaal model zoals Claude Sonnet 4.6 of GPT 5.6 Luna.

Alternatieven

Beschikbaarheid van DeepSeek V4 Flash op Okou.

DeepSeek V4 Flash wordt niet meer aangeboden op Okou. Bekijk GPT 6 Luna voor een momenteel ondersteund alternatief. Deze pagina bewaart historische modelinformatie, geen actuele Okou-prijzen.