DeepSeek V4 Flash: ข้อมูลอ้างอิงโมเดลในอดีต
1M tokens · Text / Code · Prompt cache
Okou ไม่ให้บริการ DeepSeek V4 Flash แล้ว ดู GPT 6 Luna สำหรับทางเลือกที่รองรับในปัจจุบัน หน้านี้เก็บข้อมูลโมเดลในอดีต ไม่ใช่ราคาปัจจุบันของ Okou
ดู GPT 6 LunaDeepSeek V4 Flash คืออะไร?
31 กรกฎาคม 2026 (DeepSeek-V4-Flash-0731, รุ่นเบต้าสาธารณะ)
อะไรที่น่าสนใจเกี่ยวกับ DeepSeek V4 Flash
สถาปัตยกรรมหัวข้อข่าวและคุณสมบัติความสามารถ
V4 Flash เป็นโมเดล Mixture-of-Experts แบบ Sparse: พารามิเตอร์ทั้งหมด 284B โดยมี 13B เปิดใช้งานต่อโทเค็น โดยแต่ละเลเยอร์ MoE มีผู้เชี่ยวชาญที่ใช้ร่วมกัน 1 คนและผู้เชี่ยวชาญที่กำหนดเส้นทาง 256 คนที่มิติกลาง 2048 และผู้เชี่ยวชาญที่กำหนดเส้นทาง 6 คนทำงานต่อโทเค็น สามเลเยอร์ MoE แรกใช้การกำหนดเส้นทางแบบแฮช และความลึกของการทำนายหลายโทเค็นคือ 1 จุดตรวจสอบ 0731 ที่เผยแพร่มีพารามิเตอร์ 304B เนื่องจากมีการจัดส่งโมดูลร่างการถอดรหัสแบบคาดเดาเพิ่มเติมจากฐาน 284B รองรับหน้าต่างบริบท 1M โทเค็นพร้อมเอาต์พุตสูงสุด 384K โหมดการคิดและไม่คิด และพารามิเตอร์ reasoning_effort ที่มีระดับ low, high และ max น้ำหนักได้รับอนุญาตภายใต้ MIT และไม่ถูกจำกัด
ข้อมูลจำเพาะโดยย่อ
เกณฑ์มาตรฐาน DeepSeek V4 Flash
ตัวเลขที่รายงานโดย DeepSeek จากการ์ดโมเดล DeepSeek-V4-Flash-0731 ซึ่งรันด้วย DeepSeek Harness ในโหมดขั้นต่ำที่ความพยายามในการให้เหตุผลสูงสุด (อุณหภูมิ 1.0, top_p 0.95) Harness ยังไม่ได้รับการเผยแพร่ ดังนั้นจึงไม่มีการทำซ้ำสิ่งเหล่านี้อย่างอิสระ และ DSBench-FullStack และ DSBench-Hard เป็นชุดทดสอบภายในของ DeepSeek
งานตัวแทนที่ดีที่สุดสำหรับ DeepSeek V4 Flash
ระบบอัตโนมัติที่ขับเคลื่อนด้วยเทอร์มินัลและเครื่องมือ
ผลลัพธ์ที่เผยแพร่ที่แข็งแกร่งที่สุดของบิลด์ 0731 คือในงานเทอร์มินัลและการใช้เครื่องมือ ซึ่งเป็นสิ่งที่เอเจนต์แก้ไขบิลด์ ตรวจสอบการปรับใช้ หรือคัดแยกบันทึกทำตลอดทั้งวัน
การอ่านทั่วทั้งที่เก็บ
หน้าต่าง 1M โทเค็นสามารถรองรับที่เก็บข้อมูลขนาดกลางทั้งหมด, ไทม์ไลน์เหตุการณ์ที่ยาวนาน หรือชุดเอกสารการออกแบบทั้งหมดในครั้งเดียว ดังนั้นตัวแทนการย้ายข้อมูลหรือการตรวจสอบสามารถให้เหตุผลกับทั้งหมดได้แทนที่จะเป็นส่วนๆ
เลเยอร์ราคาถูกภายใต้ผู้ประสานงานแนวหน้า
ให้ Claude Opus 5 หรือ GPT 5.6 Sol วางแผนและตรวจสอบ และมอบขั้นตอนทางกลไกมากมาย — การอ่านไฟล์ การรันคำสั่ง การร่างแพตช์ — ให้กับ V4 Flash คุณจ่ายอัตราสูงสุดเฉพาะในขั้นตอนที่ตัดสินการรันเท่านั้น
คำถามที่พบบ่อย
หน้าต่างบริบทของ DeepSeek V4 Flash คืออะไร?
อินพุต 1M โทเค็น และเอาต์พุตสูงสุด 384K โทเค็นต่อการตอบสนอง DeepSeek แนะนำให้ใช้เพดานเอาต์พุต 384K เต็มที่ในระดับความพยายามในการให้เหตุผลของ high และ max
DeepSeek V4 Flash รองรับวิสัยทัศน์หรือไม่?
ไม่ มันรับเฉพาะข้อความและโค้ดเท่านั้น กำหนดเส้นทางขั้นตอนที่ขับเคลื่อนด้วยภาพหน้าจอ แผนภูมิ หรือ PDF ไปยังโมเดลหลายรูปแบบ เช่น Claude Sonnet 4.6 หรือ GPT 5.6 Luna
ทางเลือก
ความพร้อมใช้งานของ DeepSeek V4 Flash บน Okou
Okou ไม่ให้บริการ DeepSeek V4 Flash แล้ว ดู GPT 6 Luna สำหรับทางเลือกที่รองรับในปัจจุบัน หน้านี้เก็บข้อมูลโมเดลในอดีต ไม่ใช่ราคาปัจจุบันของ Okou

