← 全部模型

DeepSeek V4 Flash:历史模型参考资料

1M tokens · Text / Code · Prompt cache

Okou 已不再提供 DeepSeek V4 Flash。当前支持的替代模型请参阅 GPT 6 Luna。本页保留模型的历史资料,不代表 Okou 当前定价。

查看GPT 6 Luna

DeepSeek V4 Flash是什么?

2026年7月31日(DeepSeek-V4-Flash-0731,公测版)

DeepSeek V4 Flash有什么特别之处

架构与能力上的主要亮点。

V4 Flash是稀疏混合专家模型:总参数2840亿,每个token激活130亿;每个MoE层有1个共享专家和256个路由专家,中间维度为2048,每个token触发6个路由专家。前三个MoE层使用哈希路由,多token预测深度为1。公开的0731检查点是3040亿参数,因为它在2840亿的基座之上还带了一个投机解码的草稿模块。它支持100万token的上下文窗口、最多384K的输出,支持思考与非思考两种模式,以及带low、high、max三档的reasoning_effort参数。权重采用MIT许可证,无需申请即可获取。

规格速览

提供商DeepSeek
模型 IDdeepseek-v4-flash
模态Text, Code

DeepSeek V4 Flash基准测试

数据由DeepSeek自行公布,来自DeepSeek-V4-Flash-0731模型卡,用DeepSeek Harness的minimal模式在最高推理强度下运行(temperature 1.0,top_p 0.95)。该Harness尚未发布,所以没有一项经过独立复现,DSBench-FullStack和DSBench-Hard则是DeepSeek的内部测试集。

Terminal-Bench 2.1智能体终端任务;V4 Pro(Preview)为72.1
82.7
SWE-bench Verified预览版本,服务商自报
79.0%
Cybergym服务商自报
76.7
Toolathlon (verified)工具使用;V4 Pro(Preview)为55.9
70.3
DSBench-FullStackDeepSeek内部测试集
68.7
DSBench-HardDeepSeek内部测试集
59.6
DeepSWE从预览版本的7.3提升而来
54.4
NL2Repo代码仓库构建
54.2
Agents' Last ExamClaude Opus 4.8为25.7
25.2

DeepSeek V4 Flash最适合的智能体任务

高频运行的编码智能体

批量PR评审、写测试、lint加修复、定时重构——同一个智能体一天要跑上百次。输出每100万token只要0.28美元,单次成本低到量不再是限制。

终端与工具驱动的自动化

0731版本公布的最强成绩就在终端任务和工具使用上,而修构建、查部署、排日志的智能体整天干的正是这些。

通读整个代码仓库

100万token的窗口能一次装下一个中等规模的代码仓库、一条很长的事故时间线或一整套设计文档,做迁移或审计的智能体可以对着全局推理,不必一块一块地看。

前沿编排模型下面那层便宜的执行层

让Claude Opus 5或GPT 5.6 Sol负责规划和复核,把读文件、跑命令、写补丁这些机械步骤交给V4 Flash。只有决定这次运行成败的那几步,才按前沿模型的价格付费。

常见问题

DeepSeek V4 Flash的上下文窗口有多大?

输入100万token,每次回复最多输出384K token。DeepSeek建议在high和max推理强度下使用完整的384K输出上限。

DeepSeek V4 Flash支持视觉吗?

不支持。它只接受文本和代码。需要处理截图、图表或PDF的步骤,交给Claude Sonnet 4.6或GPT 5.6 Luna这样的多模态模型。

替代选择

DeepSeek V4 Flash在Okou上的可用情况

Okou 已不再提供 DeepSeek V4 Flash。当前支持的替代模型请参阅 GPT 6 Luna。本页保留模型的历史资料,不代表 Okou 当前定价。