DeepSeek V4 Flash: referensi historis model
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash tidak lagi ditawarkan di Okou. Lihat GPT 6 Luna sebagai alternatif yang saat ini didukung. Halaman ini menyimpan informasi historis model, bukan harga Okou saat ini.
Lihat GPT 6 LunaApa itu DeepSeek V4 Flash?
31 Juli 2026 (DeepSeek-V4-Flash-0731, beta publik)
Apa yang menonjol dari DeepSeek V4 Flash
Fitur arsitektur dan kapabilitas utama.
V4 Flash adalah model Mixture-of-Experts yang jarang: total 284 miliar parameter dengan 13 miliar diaktifkan per token, di mana setiap lapisan MoE memiliki 1 expert bersama dan 256 expert terrute dengan dimensi antara 2048, dan 6 expert terrute aktif per token. Tiga lapisan MoE pertama memakai hash routing, dan kedalaman prediksi multi-token adalah 1. Checkpoint 0731 yang dipublikasikan berukuran 304 miliar parameter karena menyertakan modul draft untuk speculative decoding di atas basis 284 miliar. Model ini mendukung jendela konteks satu juta token dengan keluaran hingga 384 K, mode berpikir dan non-berpikir, serta parameter reasoning_effort dengan tingkat low, high, dan max. Bobotnya berlisensi MIT dan terbuka tanpa pembatasan.
Spesifikasi sekilas
Benchmark DeepSeek V4 Flash
Angka yang dilaporkan DeepSeek dari kartu model DeepSeek-V4-Flash-0731, dijalankan dengan DeepSeek Harness pada mode minimal dan tingkat penalaran max (temperature 1,0, top_p 0,95). Harness tersebut belum dirilis sehingga tidak satu pun angka ini direproduksi secara independen; DSBench-FullStack dan DSBench-Hard adalah set uji internal DeepSeek.
Tugas agen terbaik untuk DeepSeek V4 Flash
Otomasi berbasis terminal dan alat
Hasil terkuat yang dipublikasikan untuk build 0731 ada pada kerja terminal dan penggunaan alat — persis yang dikerjakan sepanjang hari oleh agen perbaikan build, pemeriksaan deployment, atau triase log.
Pembacaan seluruh repositori
Jendela satu juta token menampung satu repositori berukuran menengah secara utuh, linimasa insiden yang panjang, atau satu set lengkap dokumen desain dalam sekali jalan, sehingga agen migrasi atau audit dapat menalar atas keseluruhannya, bukan sepotong-sepotong.
Lapisan murah di bawah orkestrator kelas atas
Biarkan Claude Opus 5 atau GPT 5.6 Sol merencanakan dan meninjau, lalu serahkan banyak langkah mekanis — membaca berkas, menjalankan perintah, menyusun patch — kepada V4 Flash. Tarif kelas atas hanya Anda bayar pada langkah yang menentukan hasil.
Pertanyaan yang sering diajukan
Berapa jendela konteks DeepSeek V4 Flash?
Satu juta token masukan, dan hingga 384 K token keluaran per respons. DeepSeek menyarankan batas keluaran penuh 384 K pada tingkat penalaran high dan max.
Apakah DeepSeek V4 Flash mendukung vision?
Tidak. Model ini hanya menerima teks dan kode. Arahkan langkah berbasis tangkapan layar, grafik, atau PDF ke model multimodal seperti Claude Sonnet 4.6 atau GPT 5.6 Luna.
Alternatif
Ketersediaan DeepSeek V4 Flash di Okou
DeepSeek V4 Flash tidak lagi ditawarkan di Okou. Lihat GPT 6 Luna sebagai alternatif yang saat ini didukung. Halaman ini menyimpan informasi historis model, bukan harga Okou saat ini.

