← Semua model

DeepSeek V4 Flash: referensi historis model

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash tidak lagi ditawarkan di Okou. Lihat GPT 6 Luna sebagai alternatif yang saat ini didukung. Halaman ini menyimpan informasi historis model, bukan harga Okou saat ini.

Lihat GPT 6 Luna

Apa itu DeepSeek V4 Flash?

31 Juli 2026 (DeepSeek-V4-Flash-0731, beta publik)

Apa yang menonjol dari DeepSeek V4 Flash

Fitur arsitektur dan kapabilitas utama.

V4 Flash adalah model Mixture-of-Experts yang jarang: total 284 miliar parameter dengan 13 miliar diaktifkan per token, di mana setiap lapisan MoE memiliki 1 expert bersama dan 256 expert terrute dengan dimensi antara 2048, dan 6 expert terrute aktif per token. Tiga lapisan MoE pertama memakai hash routing, dan kedalaman prediksi multi-token adalah 1. Checkpoint 0731 yang dipublikasikan berukuran 304 miliar parameter karena menyertakan modul draft untuk speculative decoding di atas basis 284 miliar. Model ini mendukung jendela konteks satu juta token dengan keluaran hingga 384 K, mode berpikir dan non-berpikir, serta parameter reasoning_effort dengan tingkat low, high, dan max. Bobotnya berlisensi MIT dan terbuka tanpa pembatasan.

Spesifikasi sekilas

PenyediaDeepSeek
ID modeldeepseek-v4-flash
ModalitasText, Code

Benchmark DeepSeek V4 Flash

Angka yang dilaporkan DeepSeek dari kartu model DeepSeek-V4-Flash-0731, dijalankan dengan DeepSeek Harness pada mode minimal dan tingkat penalaran max (temperature 1,0, top_p 0,95). Harness tersebut belum dirilis sehingga tidak satu pun angka ini direproduksi secara independen; DSBench-FullStack dan DSBench-Hard adalah set uji internal DeepSeek.

Terminal-Bench 2.1kerja terminal agentik; V4 Pro (Preview) 72,1
82,7
SWE-bench Verifiedbuild preview, laporan vendor
79,0%
Cybergymlaporan vendor
76,7
Toolathlon (verified)penggunaan alat; V4 Pro (Preview) 55,9
70,3
DSBench-FullStackset internal DeepSeek
68,7
DSBench-Hardset internal DeepSeek
59,6
DeepSWEnaik dari 7,3 pada build preview
54,4
NL2Repopembangunan repositori
54,2
Agents' Last ExamClaude Opus 4.8 memperoleh 25,7
25,2

Tugas agen terbaik untuk DeepSeek V4 Flash

Otomasi berbasis terminal dan alat

Hasil terkuat yang dipublikasikan untuk build 0731 ada pada kerja terminal dan penggunaan alat — persis yang dikerjakan sepanjang hari oleh agen perbaikan build, pemeriksaan deployment, atau triase log.

Pembacaan seluruh repositori

Jendela satu juta token menampung satu repositori berukuran menengah secara utuh, linimasa insiden yang panjang, atau satu set lengkap dokumen desain dalam sekali jalan, sehingga agen migrasi atau audit dapat menalar atas keseluruhannya, bukan sepotong-sepotong.

Lapisan murah di bawah orkestrator kelas atas

Biarkan Claude Opus 5 atau GPT 5.6 Sol merencanakan dan meninjau, lalu serahkan banyak langkah mekanis — membaca berkas, menjalankan perintah, menyusun patch — kepada V4 Flash. Tarif kelas atas hanya Anda bayar pada langkah yang menentukan hasil.

Pertanyaan yang sering diajukan

Berapa jendela konteks DeepSeek V4 Flash?

Satu juta token masukan, dan hingga 384 K token keluaran per respons. DeepSeek menyarankan batas keluaran penuh 384 K pada tingkat penalaran high dan max.

Apakah DeepSeek V4 Flash mendukung vision?

Tidak. Model ini hanya menerima teks dan kode. Arahkan langkah berbasis tangkapan layar, grafik, atau PDF ke model multimodal seperti Claude Sonnet 4.6 atau GPT 5.6 Luna.

Alternatif

Ketersediaan DeepSeek V4 Flash di Okou

DeepSeek V4 Flash tidak lagi ditawarkan di Okou. Lihat GPT 6 Luna sebagai alternatif yang saat ini didukung. Halaman ini menyimpan informasi historis model, bukan harga Okou saat ini.