← Alla modeller

DeepSeek V4 Pro: historisk modellreferens

1M tokens · Text / Code · Prompt cache

Okou kör inte längre DeepSeek V4 Pro. Denna sida behålls som referens för dess specifikationer, prissättning och benchmarks. För samma typ av arbete, använd GPT 6 Luna.

Se GPT 6 Luna

DeepSeek V4 Pro är flaggskeppet i DeepSeeks V4-generation – en MoE med öppen vikt och 1,6T parametrar under MIT-licensen. Rubriken är förhållandet mellan pris och kvalitet: leverantörsrapporterad SWE-bench Verified är 80,6 %, inom en bråkdel av en poäng från Claude Opus 4.6, till ungefär en sjundedel av Anthropic:s leverantörskostnad. Det gör resonemangstunga agenter – massgranskning av PR, batchdokumentanalys, schemalagd sammanfattning – prisvärda i stora volymer.

Leverantörens listpris är 1,74 USD / 3,48 USD per 1M tokens med cacheläsningar till 0,028 USD / 1M och gratis cache-skrivningar (unikt i sortimentet). 1M-token kontext, Anthropic-kompatibel API. Välj Sonnet 4.6 när tillförlitligheten för verktygsroutning i produktion är den avgörande faktorn, och för GPT-5.4 Mini eller Kimi K2.7 Code när engångsarbete inte behöver V4 Pros resonemangsdjup.

Vad är DeepSeek V4 Pro?

24 april 2026

DeepSeek V4 Pro är flaggskeppet i DeepSeeks V4-generation, släppt den 24 april 2026 under MIT-licensen. Det är en open-weight Mixture-of-Experts-modell med 1,6T totala parametrar och 49B aktiva per token.

V4 Pro stöder ett 1M-token kontextfönster, 384K maximal utdata, tre resonemangsinsatslägen (standard, tänk, tänk-max), JSON utdata, verktygsanrop och FIM-komplettering i icke-tänkläge. Pro-modellen lägger till en hybrid uppmärksamhetsarkitektur (Compressed Sparse Attention + Heavily Compressed Attention) för dramatiskt förbättrad långkontexteffektivitet. 27% av enkel-token inferens FLOPs och 10% av KV-cache jämfört med DeepSeek V3.2 vid 1M kontext.

Vad är anmärkningsvärt med DeepSeek V4 Pro

Rubrikarkitektur och funktionsfunktioner.

V4 Pro är en Mixture-of-Experts-modell med 1.6T totala parametrar och 49B aktiva per token, med en hybrid uppmärksamhetsstack (Compressed Sparse Attention plus Heavily Compressed Attention) som håller långkontextinferens billig. Den stöder ett 1M-token kontextfönster med 384K maximal utdata, tre resonemangsinsatslägen (standard, think och think-max), och använder Manifold-Constrained Hyper-Connections för stabil signalutbredning. Modellen tränades på 32T+ tokens med Muon-optimeraren och släpps under MIT-licensen med öppna vikter.

Specifikationer i korthet

FamiljDeepSeek V4-serien
Parametrar1.6T totalt / 49B aktiv (MoE)
ModaliteterText, kod
SpråkFlerspråkig
Kontextfönster1M tokens
Max utdata384K tokens
LicensMIT (öppna vikter)

DeepSeek V4 Pro benchmarks

Leverantörsrapporterade poäng från DeepSeeks V4 Pro-release. Oberoende recensioner (Geeky Gadgets, Code Arena) placerar V4 Pro på tredje plats på Code Arena efter GLM-5.1 och Kimi K2.7 Code. De starkaste benchmark-påståendena kommer från DeepSeeks egna material. Behandla dem som riktlinjer snarare än som absoluta sanningar.

SWE-bench Verifieradleverantörsrapporterad; inom 0,2 poäng från Opus 4.6
80.6%
Terminal-Bench 2.0leverantörsrapporterad; leder Opus 4.6
67.9%
LiveCodeBenchleverantörsrapporterad
93.5%
Codeforces-betygleverantörsrapporterad
3206
MMLU-Proleverantörsrapporterad
Matchar GPT-5.4
Artificiell analys intelligensindexmaximal ansträngning
52
HastighetArtificiell analys
~36 tokens/sek

DeepSeek V4 Pro prissättning

Historiska listpriser från leverantören per miljon token. Dessa referensvärden är inte aktuella Okou-avgifter.

Inmatning$1.74
Utdata$3.48
Cacheläsning$0.14
CacheskrivningEj fakturerad

Hur DeepSeek V4 Pro beter sig i praktiken

Observerat beteende från produktionsagentkörningar.

Resonemang

Starkaste sub-Sonnet-resonemang i vårt sortiment. Håller för flerstegsarbete där billigare modeller börjar driva. Leverantörsrapporterad MMLU-Pro matchar GPT-5.4.

Kodningsbenchmarks

Leverantörsrapporterad SWE-bench Verifierad 80,6 % (inom 0,2 från Opus 4.6), Terminal-Bench 2.0 67,9 % (leder Opus 4.6), LiveCodeBench 93,5 %.

Kostnadseffektivitet

$ Inbyggda nivå gör V4 Pro till ett kostnadsbesparande resonemangsalternativ samtidigt som det förblir konkurrenskraftigt med Sonnet 4.6.

Hastighet

Cirka 36 tokens/sek vid maximal ansträngning per artificiell analys. Långsammare än Kimi K2.7 Code, något långsammare än Opus 4.6.

Bästa agentuppgifter för DeepSeek V4 Pro

PR-granskningsagenten som körs vid varje commit

Noggrannhet i Sonnet-klass till en bråkdel av Sonnets leverantörskostnad är det som gör "granska varje commit, inte bara de stora PR:erna" faktiskt genomförbart. V4 Pro läser diffen, de relaterade filerna och den länkade frågan, skriver sedan en strukturerad kommentar – och priset per samtal är tillräckligt lågt för att köra det som ett CI-steg vid varje push inte syns som en märkbar post.

Den schemalagda sammanfattaren som körs varje natt

Hämtar gårdagens kundkonversationer, supportärenden eller säljsamtal och skriver en sammanfattning. Systemprompten och verktygsschemat ändras inte mellan körningar, och DeepSeek debiterar inte för cache-skrivningar – så det långa fasta prefixet betalas en gång och cache-läsningar kostar en bråkdel av normal inmatning. Det är här V4 Pro:s prissättningsmodell verkligen ändrar vad som är överkomligt.

Hela-repo-kodagenten som kostar mindre än Opus

1M-token kontext med hybriduppmärksamhet (Compressed Sparse Attention plus Heavily Compressed Attention) innebär att en medelstor kodbas får plats i en prompt och att inferenskostnaden förblir hanterbar när fönstret fylls. För refaktoriseringar över flera filer och granskningar på arkitekturnivå är det här du får Opus-liknande "se allt på en gång"-arbetsflöde utan Opus-liknande faktura.

När man ska hoppa över DeepSeek V4 Pro

Hoppa över V4 Pro på de svåraste verktygsroutningsfallen där Sonnet 4.6 fortfarande leder, och på bulk engångsarbete där GPT-5.4 Mini eller Kimi K2.7 Code är tillräckligt till en lägre kostnad.

DeepSeek V4 Pro vs andra modeller

DeepSeek V4 Pro vs Claude Sonnet 4.6

Sonnet 4.6 förblir det mer tillförlitliga valet för svåra verktygsroutingsfall. V4 Pro kostar mindre och är konkurrenskraftig på leverantörsrapporterade kodningsbenchmarks. A/B-testa båda på en riktig agent innan standardisering.

Vanliga frågor

När släpptes DeepSeek V4 Pro?

DeepSeek släppte V4 Pro den 24 april 2026 under MIT-licensen med öppna vikter.

Varför är cache-skrivningar gratis?

DeepSeek fakturerar inte cache-skrivningsdelen. Endast cache-läsningar faktureras, till 0,145 USD per 1 miljon tokens. Stabila systemprompter och stora referenskontexter kostar inget extra att cacha.

Vad är V4 Pros kontextfönster?

1 miljon tokens med upp till 384K tokens utdata. Den hybrida uppmärksamhetsarkitekturen gör hela fönstret användbart till en mycket lägre inferenskostnad än V3.2.

Hur jämför V4 Pro med Claude Opus 4.6?

Leverantörsrapporterad SWE-bench Verified ligger inom 0,2 poäng (80,6 vs 80,8). Terminal-Bench 2.0 gynnar V4 Pro (67,9 vs 65,4). Opus 4.6 leder på HLE (40,0 vs 37,7) och HMMT 2026 matematik (96,2 vs 95,2). Med ~7 gånger lägre leverantörskostnad är V4 Pro det rätta valet när resonemangskvalitet är kravet men kostnaden spelar roll.

Tillgänglighet av DeepSeek V4 Pro på Okou

DeepSeek V4 Pro erbjuds inte längre på Okou. Se GPT 6 Luna för ett alternativ som stöds i dag. Den här sidan bevarar historisk modellinformation, inte aktuella Okou-priser.