DeepSeek V4 Flash: mallin historiatiedot
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash ei ole enää saatavilla Okou:ssa. Katso GPT 6 Luna, jos etsit tällä hetkellä tuettua vaihtoehtoa. Tämä sivu säilyttää mallin historiatiedot, ei Okou:n nykyisiä hintoja.
Katso GPT 6 LunaMikä on DeepSeek V4 Flash?
31. heinäkuuta 2026 (DeepSeek-V4-Flash-0731, julkinen beta)
Mitä DeepSeek V4 Flash:ssä on huomattavaa
Otsikkoarkkitehtuuri ja ominaisuudet.
V4 Flash on harva Mixture-of-Experts-malli: yhteensä 284B parametria, joista 13B aktivoituu tokenia kohden, missä jokaisessa MoE-kerroksessa on 1 jaettu asiantuntija ja 256 reititettyä asiantuntijaa välitasolla 2048, ja 6 reititettyä asiantuntijaa aktivoituu tokenia kohden. Kolme ensimmäistä MoE-kerrosta käyttävät hash-reititystä, ja monen tokenin ennustussyvyys on 1. Julkaistu 0731-tarkistuspiste on 304B parametria, koska se sisältää spekulatiivisen dekoodauksen luonnosmoduulin 284B-perustan lisäksi. Se tukee 1M tokenin konteksti-ikkunaa jopa 384K ulostulolla, ajattelu- ja ei-ajattelutiloja sekä reasoning_effort-parametria low-, high- ja max-tasoilla. Painot ovat MIT-lisensoituja ja avoimia.
Tekniset tiedot yhdellä silmäyksellä
DeepSeek V4 Flash vertailuarvot
DeepSeekin raportoimat luvut DeepSeek-V4-Flash-0731-mallikortista, ajettu DeepSeek Harnessilla minimitilassa maksimipäättelyteholla (lämpötila 1.0, top_p 0.95). Harnessia ei ole julkaistu, joten mitään näistä ei ole toistettu itsenäisesti, ja DSBench-FullStack ja DSBench-Hard ovat DeepSeekin sisäisiä testisarjoja.
Parhaat agenttitehtävät DeepSeek V4 Flash:lle
Suuren volyymin koodausagentit
Massiivinen PR-tarkistus, testien kirjoittaminen, lint-and-fix-ajot ja ajoitetut refaktoroinnit, joissa sama agentti suorittaa satoja kertoja päivässä. 0,28 dollarin hinnalla 1 miljoonasta tulostetusta tokenista yhden ajon kustannus pysyy riittävän alhaisena, jotta volyymi ei enää ole rajoite.
Terminaali- ja työkaluvetoinen automaatio
0731-rakennelman vahvimmat julkaistut tulokset ovat terminaalityössä ja työkalujen käytössä, mikä on juuri sitä, mitä rakennuskorjaus-, käyttöönotto- tai lokien lajitteluagentti tekee koko päivän.
Koko arkiston lukeminen
1M-tokenin ikkuna ottaa koko keskikokoisen repositorion, pitkän tapahtuma-aikajanan tai täyden joukon suunnitteluasiakirjoja yhdellä kertaa, joten siirto- tai auditointiagentti voi päätellä koko asiasta palojen sijaan.
Halpa kerros edelläkävijäorkestraattorin alla
Anna Claude Opus 5:n tai GPT 5.6 Solin suunnitella ja tarkistaa, ja anna monet mekaaniset vaiheet – tiedostojen lukeminen, komentojen suorittaminen, korjausten luonnostelu – V4 Flashille. Maksat rajahinnan vain niistä vaiheista, jotka päättävät ajon.
Usein kysytyt kysymykset
Mikä on DeepSeek V4 Flashin konteksti-ikkuna?
1M tokenia sisään ja jopa 384K tokenia ulos per vastaus. DeepSeek suosittelee täyttä 384K ulostulokattoa high- ja max-päättelytasolla.
Tukeeko DeepSeek V4 Flash näkökykyä?
Ei. Se käsittelee vain tekstiä ja koodia. Ohjaa kuvakaappaus-, kaavio- tai PDF-pohjaiset vaiheet multimodaaliseen malliin, kuten Claude Sonnet 4.6 tai GPT 5.6 Luna.
Vaihtoehdot
DeepSeek V4 Flash:n saatavuus Okou:ssä
DeepSeek V4 Flash ei ole enää saatavilla Okou:ssa. Katso GPT 6 Luna, jos etsit tällä hetkellä tuettua vaihtoehtoa. Tämä sivu säilyttää mallin historiatiedot, ei Okou:n nykyisiä hintoja.

