DeepSeek V4 Pro: historisk modelreference
1M tokens · Text / Code · Prompt cache
Okou kører ikke længere DeepSeek V4 Pro. Denne side opbevares som reference for dens specifikationer, priser og benchmarks. Til samme type arbejde, brug GPT 6 Luna.
Se GPT 6 LunaDeepSeek V4 Pro er flagskibet i DeepSeeks V4-generation – en open-weight 1.6T-parameter MoE under MIT-licensen. Overskriften er pris-kvalitetsforholdet: leverandørrapporteret SWE-bench Verified er 80,6 %, inden for en brøkdel af et punkt fra Claude Opus 4.6, til omtrent en syvendedel af Anthropic's leverandøromkostninger. Det gør ræsonnementstunge agenter – bulk PR-gennemgang, batchdokumentanalyse, planlagt opsummering – overkommelige i store mængder.
Leverandørens listepris er 1,74 USD / 3,48 USD pr. 1M tokens med cachelæsninger til 0,028 USD / 1M og gratis cache-skrivninger (unikt i sortimentet). 1M-token kontekst, Anthropic-kompatibel API. Vælg Sonnet 4.6, når pålidelighed i produktionsværktøjsrouting er den afgørende faktor, og for GPT-5.4 Mini eller Kimi K2.7 Code, når enkeltstående bulk-arbejde ikke kræver V4 Pro's ræsonnementsdybde.
Hvad er DeepSeek V4 Pro?
24. april 2026
DeepSeek V4 Pro er flagskibet i DeepSeeks V4-generation, udgivet den 24. april 2026 under MIT-licensen. Det er en open-weight Mixture-of-Experts-model med 1,6T samlede parametre og 49B aktive pr. token.
V4 Pro understøtter et 1M-token kontekstvindue, 384K maksimalt output, tre ræsonnementsindsatsformer (standard, tænk, tænk-max), JSON output, værktøjskald og FIM-fuldførelse i ikke-tænketilstand. Pro-modellen tilføjer en hybrid opmærksomhedsarkitektur (Compressed Sparse Attention + Heavily Compressed Attention) for dramatisk forbedret langkonteksteffektivitet. 27% af single-token inferens FLOPs og 10% af KV cache vs DeepSeek V3.2 ved 1M kontekst.
Hvad er bemærkelsesværdigt ved DeepSeek V4 Pro
Overskriftsarkitektur og kapacitetsfunktioner.
V4 Pro er en Mixture-of-Experts-model med 1,6T samlede parametre og 49B aktive pr. token, frontet af en hybrid opmærksomhedsstak (Compressed Sparse Attention plus Heavily Compressed Attention), der holder lang-kontekst inferens billig. Den understøtter et 1M-token kontekstvindue med 384K maksimal output, tre ræsonnementstilstande (standard, tænk og tænk-max), og bruger Manifold-Constrained Hyper-Connections til stabil signaludbredelse. Modellen blev trænet på 32T+ tokens med Muon-optimereren og er udgivet under MIT-licensen med åbne vægte.
Specifikationer på et øjeblik
DeepSeek V4 Pro benchmarks
Leverandørrapporterede scores fra DeepSeeks V4 Pro-udgivelse. Uafhængige anmeldelser (Geeky Gadgets, Code Arena) placerer V4 Pro som nummer tre på Code Arena efter GLM-5.1 og Kimi K2.7 Code. De stærkeste benchmark-påstande kommer fra DeepSeeks egne materialer. Behandl dem retningsgivende snarere end som absolut sandhed.
DeepSeek V4 Pro priser
Historiske listepriser fra udbyderen pr. million tokens. Disse referenceværdier er ikke aktuelle Okou-gebyrer.
Hvordan DeepSeek V4 Pro opfører sig i praksis
Observeret adfærd fra produktionsagentkørsler.
Begrundelse
Stærkeste sub-Sonnet ræsonnement i vores sortiment. Holder stand på flertrinsarbejde, hvor billigere modeller begynder at afvige. Leverandørrapporteret MMLU-Pro matcher GPT-5.4.
Kodningsbenchmarks
Leverandørrapporteret SWE-bench Verificeret 80,6% (inden for 0,2 af Opus 4.6), Terminal-Bench 2.0 67,9% (fører Opus 4.6), LiveCodeBench 93,5%.
Hastighed
Omkring 36 tokens/sek. ved maksimal indsats pr. Artificial Analysis. Langsommere end Kimi K2.7 Code, lidt langsommere end Opus 4.6.
Bedste agentopgaver for DeepSeek V4 Pro
PR-review-agenten, der kører på hver commit
Nøjagtighed på Sonnet-niveau til en brøkdel af Sonnets leverandøromkostninger er det, der gør "gennemgå hver commit, ikke kun de store PR'er" faktisk levedygtigt. V4 Pro læser diff'en, de relaterede filer og det linkede problem, og skriver derefter en struktureret kommentar – og prisen pr. opkald er lav nok til, at kørsel som et CI-trin ved hvert push ikke fremstår som en mærkbar post.
Den planlagte opsummering, der kører hver nat
Henter gårsdagens kundesamtaler, supportbilletter eller salgsopkald og skriver et resumé. Systemprompten og værktøjsskemaet ændres ikke mellem kørsler, og DeepSeek fakturerer ikke cache-skrivninger – så det lange faste præfiks betales én gang, og cache-læsninger koster en brøkdel af normal input. Det er her, V4 Pro's prismodel virkelig ændrer, hvad der er overkommeligt.
Hele repo-kodeagenten, der koster mindre end Opus
1M-token kontekst med hybrid opmærksomhed (Compressed Sparse Attention plus Heavily Compressed Attention) betyder, at en mellemstor kodebase passer ind i én prompt, og inferensomkostningerne forbliver håndterbare, efterhånden som vinduet fyldes op. Til refactoring på tværs af filer og arkitektur-niveau anmeldelser er det her, du får den Opus-lignende "se alt på én gang"-arbejdsgang uden den Opus-lignende faktura.
Hvornår man skal springe DeepSeek V4 Pro over
Spring V4 Pro over på de sværeste værktøjsrouting-grænsetilfælde, hvor Sonnet 4.6 stadig fører an, og på bulk single-shot-arbejde, hvor GPT-5.4 Mini eller Kimi K2.7 Code er tilstrækkelig til en lavere pris.
DeepSeek V4 Pro vs. andre modeller
DeepSeek V4 Pro vs Claude Sonnet 4.6
Sonnet 4.6 forbliver det mere pålidelige valg til vanskelige værktøjsrouting-edge cases. V4 Pro koster mindre og er konkurrencedygtig på leverandørrapporterede kodningsbenchmarks. A/B-test begge på en rigtig agent, før du standardiserer.
Ofte stillede spørgsmål
Hvornår blev DeepSeek V4 Pro udgivet?
DeepSeek udgav V4 Pro den 24. april 2026 under MIT-licensen med åbne vægte.
Hvorfor er cache-skrivninger gratis?
DeepSeek fakturerer ikke cache-skrivningsdelen. Kun cache-læsninger faktureres til $0,145 pr. 1M tokens. Stabile systemprompter og store referencekontekster koster intet ekstra at cache.
Hvad er V4 Pro's kontekstvindue?
1 million tokens med op til 384K tokens output. Den hybride opmærksomhedsarkitektur gør hele vinduet brugbart til en meget lavere inferensomkostning end V3.2.
Hvordan sammenligner V4 Pro sig med Claude Opus 4.6?
Leverandørrapporteret SWE-bench Verified er inden for 0,2 point (80,6 vs. 80,8). Terminal-Bench 2.0 favoriserer V4 Pro (67,9 vs. 65,4). Opus 4.6 fører på HLE (40,0 vs. 37,7) og HMMT 2026 matematik (96,2 vs. 95,2). Til ~7 gange lavere leverandøromkostninger er V4 Pro det rigtige valg, når ræsonnementskvalitet er målestokken, men omkostninger betyder noget.
Tilgængelighed af DeepSeek V4 Pro på Okou
DeepSeek V4 Pro tilbydes ikke længere på Okou. Se GPT 6 Luna for et alternativ, der understøttes i dag. Denne side bevarer historiske modeloplysninger, ikke aktuelle Okou-priser.

