← すべてのモデル

Claude Opus 5: Okou の現行推論モデル

Okou の Built-in で利用できる現行推論モデルです。

1M tokens · Text / Vision / Code · Prompt cache

Anthropic の現行推論モデル。Okou の公開モデルカタログで利用できます。

Claude Opus 5とは?

2026年7月24日リリース

Okou は現在、公開推論モデルカタログで Claude Opus 5 を提供しています。モデル ID claude-opus-5 で選択でき、Built-in の相対コストは $$$ ティアです。

Claude Opus 5の注目ポイント

アーキテクチャと機能の主な特徴。

Opus 5 のコンテキストウィンドウは100万トークン(最大値がそのままデフォルト)で、出力は最大128Kトークン、知識のカットオフは2026年5月です。思考はデフォルトで有効で、推論の深さは effort(low/medium/high/xhigh/max)で調整します。生の思考過程は公開されず、読みやすい要約のみが返ります。アシスタントメッセージのプレフィルには非対応で、サンプリングパラメータ(temperature、top_p、top_k)は拒否されるため、挙動はプロンプトで制御します。入力はテキスト、高解像度のビジョン、コードに対応します。

スペック概要

プロバイダーAnthropic
モデル IDclaude-opus-5
モダリティText, Code
Okou 料金ティア$$$

Claude Opus 5のベンチマーク

Anthropic の公開資料に基づくベンダー報告値です。同じベンチマークでもデータセット、effort の設定、エージェントのスキャフォールドによって第三者計測の数値は異なるため、代表値は構成に依存するものとして扱ってください。

Frontier-Bench v0.1リリース時点で最高水準。Fable 5(33.7%)と GPT 5.6 Sol(34.4%)を上回る
43.3%
SWE-bench VerifiedFable 5 の95.0%をわずかに上回る。フロンティアでは飽和に近づいている指標
96.0%
SWE-bench Proより難しいコーディング指標。80.3%の Fable 5 が依然首位
79.2%
GDPval-AA v2ナレッジワークのリーダーボード。Fable 5 の1,747を上回る
1,861 Elo
Humanity's Last Exam(ツールなし)専門家レベルの推論。Fable 5 の56.5%をわずかに下回る
56.3%

Claude Opus 5の価格

Built-in の相対的なクレジットコストです。実際の料金は使用量や設定によって異なります。最新の料金はアプリでご確認ください。

料金ティア$$$

Claude Opus 5に最適なエージェントタスク

一度の実行で仕上がる複数ファイルの機能追加

仕様を最初にすべて渡して、あとは走らせてください。Opus 4.8 に対する Opus 5 の伸びは、大規模なリファクタリングや一気通貫の機能追加といった難易度の高い多段階作業で最も大きく、単発の編集では最も小さくなります。難易度の上限に近い仕事を任せてください。

夜通し走らせても採算が合うエージェント

長時間の自律実行ほど価格差が効いてきます。Fable に近い品質でトークン単価は半分のため、夜間のトリアージ、マイグレーション、リサーチのエージェントは完了タスクあたりおよそ半分のコストで済みます。

返答ではなく完了が求められる業務フロー

チケット起票、スプレッドシートの更新、記録の突き合わせなど、ツールを使い明確な終着点がある多段階タスク。Anthropic の AutomationBench と OSWorld の結果はいずれも同じ点を示しています。他のモデルが途中で投げ出すタスクを、最後までやり切れるということです。

よくある質問

Claude Opus 5 は Claude Fable 5 より優れていますか?

複数の評価では優れています。Opus 5 は Frontier-Bench v0.1、GDPval-AA v2、SWE-bench Verified で Fable 5 を上回ります。一方 Fable 5 はより難しい SWE-bench Pro と知識の広さで依然優位で、最も難しい推論における上限としても健在です。ただし多くのエージェント作業では、完了タスクあたりのコストで Opus 5 が勝ります。

Claude Opus 5 は思考がデフォルトで有効ですか?

はい。thinking パラメータを省略したリクエストでも回答前に推論します。指定しない限り思考しなかった Opus 4.8 からの変更点です。深さは effort(low から max)で制御し、思考を無効化できるのは effort が high 以下のときだけです。生の思考過程は返されず、読みやすい要約のみが得られます。

Opus 4.8 から移行するとき何が変わりますか?

モデル ID の変更と、そのあとのプロンプト調整です。思考がデフォルトで有効になったため max_tokens は推論と回答の両方をカバーします。Opus 5 は自己検証するので、検証指示は書き換えるのではなく削除してください。回答もデフォルトで長くなるため、長さが重要なら簡潔さを明示的に指示してください。

代替モデル

OkouでClaude Opus 5を使う

ワークスペースで有効な場合、チャットのモデル選択で Claude Opus 5 を選んでください。プロバイダー接続と課金はモデル設定で確認できます。

クレジットと$$$価格ティア

Built-in の相対的なクレジットコストです。実際の料金は使用量や設定によって異なります。最新の料金はアプリでご確認ください。

OkouでJuly 25, 2026から利用可能。