← 全部模型

DeepSeek V4 Flash:歷史模型參考資料

1M tokens · Text / Code · Prompt cache

Okou 已不再提供 DeepSeek V4 Flash。目前支援的替代模型請參閱 GPT 6 Luna。本頁保留模型的歷史資料,不代表 Okou 目前定價。

檢視GPT 6 Luna

DeepSeek V4 Flash是什麼?

2026年7月31日(DeepSeek-V4-Flash-0731,公測版)

DeepSeek V4 Flash有什麼特別之處

架構與能力上的主要亮點。

V4 Flash是稀疏混合專家模型:總參數2840億,每個token啟用130億;每個MoE層有1個共享專家和256個路由專家,中間維度為2048,每個token觸發6個路由專家。前三個MoE層使用雜湊路由,多token預測深度為1。公開的0731檢查點是3040億參數,因為它在2840億的基座之上還帶了一個投機解碼的草稿模組。它支援100萬token的上下文視窗、最多384K的輸出,支援思考與非思考兩種模式,以及帶low、high、max三檔的reasoning_effort參數。權重採用MIT許可證,無需申請即可獲取。

規格速覽

提供商DeepSeek
模型 IDdeepseek-v4-flash
模態Text, Code

DeepSeek V4 Flash基準測試

資料由DeepSeek自行公佈,來自DeepSeek-V4-Flash-0731模型卡,用DeepSeek Harness的minimal模式在最高推理強度下執行(temperature 1.0,top_p 0.95)。該Harness尚未發布,所以沒有一項經過獨立復現,DSBench-FullStack和DSBench-Hard則是DeepSeek的內部測試集。

Terminal-Bench 2.1智能體終端任務;V4 Pro(Preview)為72.1
82.7
SWE-bench Verified預覽版本,服務商自報
79.0%
Cybergym服務商自報
76.7
Toolathlon (verified)工具使用;V4 Pro(Preview)為55.9
70.3
DSBench-FullStackDeepSeek內部測試集
68.7
DSBench-HardDeepSeek內部測試集
59.6
DeepSWE從預覽版本的7.3提升而來
54.4
NL2Repo程式碼倉庫構建
54.2
Agents' Last ExamClaude Opus 4.8為25.7
25.2

DeepSeek V4 Flash最適合的智能體任務

高頻執行的編碼智能體

批次PR評審、寫測試、lint加修復、定時重構——同一個智能體一天要跑上百次。輸出每100萬token只要0.28美元,單次成本低到量不再是限制。

終端與工具驅動的自動化

0731版本公佈的最強成績就在終端任務和工具使用上,而修構建、查部署、排日誌的智能體整天干的正是這些。

通讀整個程式碼倉庫

100萬token的視窗能一次裝下一個中等規模的程式碼倉庫、一條很長的事故時間線或一整套設計文件,做遷移或審計的智能體可以對著全域性推理,不必一塊一塊地看。

前沿編排模型下面那層便宜的執行層

讓Claude Opus 5或GPT 5.6 Sol負責規劃和複核,把讀檔案、跑命令、寫補丁這些機械步驟交給V4 Flash。只有決定這次執行成敗的那幾步,才按前沿模型的價格付費。

常見問題

DeepSeek V4 Flash的上下文視窗有多大?

輸入100萬token,每次回覆最多輸出384K token。DeepSeek建議在high和max推理強度下使用完整的384K輸出上限。

DeepSeek V4 Flash支援視覺嗎?

不支援。它只接受文字和程式碼。需要處理截圖、圖表或PDF的步驟,交給Claude Sonnet 4.6或GPT 5.6 Luna這樣的多模態模型。

替代選擇

DeepSeek V4 Flash在Okou上的可用情況

Okou 已不再提供 DeepSeek V4 Flash。目前支援的替代模型請參閱 GPT 6 Luna。本頁保留模型的歷史資料,不代表 Okou 目前定價。