DeepSeek V4 Flash:過去のモデル参考情報
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash は Okou で提供されなくなりました。現在対応している代替モデルは GPT 6 Luna をご覧ください。このページは過去のモデル情報を保存しており、Okou の現在の料金を示すものではありません。
GPT 6 Luna を見るDeepSeek V4 Flashとは?
2026年7月31日(DeepSeek-V4-Flash-0731、パブリックベータ)
DeepSeek V4 Flashの注目ポイント
アーキテクチャと機能の主な特徴。
V4 Flashはスパースなmixture-of-expertsモデルです:総パラメータ284B、トークンあたり13Bをアクティブ化し、各MoE層は共有エキスパート1つとルーテッドエキスパート256(中間次元2048)を持ち、トークンごとに6つのルーテッドエキスパートが発火します。最初の3つのMoE層はハッシュルーティングを使い、マルチトークン予測の深さは1です。公開された0731チェックポイントが304Bパラメータなのは、284Bのベースに投機的デコード用のドラフトモジュールを載せているためです。1Mトークンのコンテキストウィンドウと最大384Kの出力、思考モードと非思考モード、low・high・maxの3段階を持つreasoning_effortパラメータをサポートします。ウェイトはMITライセンスで、ゲートなしで公開されています。
スペック概要
DeepSeek V4 Flashのベンチマーク
DeepSeek-V4-Flash-0731モデルカードによるDeepSeek報告値。DeepSeek Harnessのminimalモード、推論努力max(temperature 1.0、top_p 0.95)で実行。ハーネスは未公開のため、いずれも独立に再現されていません。DSBench-FullStackとDSBench-HardはDeepSeekの内部テストセットです。
DeepSeek V4 Flashに最適なエージェントタスク
ターミナルとツール駆動の自動化
0731ビルドの最も強い公開結果はターミナル作業とツール使用です。ビルド修正、デプロイ確認、ログトリアージのエージェントが一日中やっていることそのものです。
リポジトリ全体の読み込み
1Mトークンのウィンドウなら中規模リポジトリ全体、長いインシデントの時系列、設計ドキュメント一式を一度に収められます。移行や監査のエージェントがチャンクごとではなく全体を対象に推論できます。
フロンティアのオーケストレータを支える安価レイヤー
計画とレビューはClaude Opus 5やGPT 5.6 Solに任せ、ファイル読み取り、コマンド実行、パッチ草案といった多数の機械的ステップはV4 Flashへ。フロンティア価格を払うのは結果を左右するステップだけになります。
よくある質問
DeepSeek V4 Flashのコンテキストウィンドウは?
入力1Mトークン、レスポンスあたり最大384Kトークンの出力です。DeepSeekはhighとmaxの推論努力レベルで384Kの出力上限を推奨しています。
DeepSeek V4 Flashはビジョンに対応していますか?
いいえ。テキストとコードのみです。スクリーンショット、チャート、PDF駆動のステップはClaude Sonnet 4.6やGPT 5.6 Lunaのようなマルチモーダルモデルにルーティングしてください。
代替モデル
Okou での DeepSeek V4 Flash の提供状況
DeepSeek V4 Flash は Okou で提供されなくなりました。現在対応している代替モデルは GPT 6 Luna をご覧ください。このページは過去のモデル情報を保存しており、Okou の現在の料金を示すものではありません。

