← 全部模型

Claude Opus 5:Okou 目前支援的推理模型

Okou 目前支援的推理模型,提供內建存取方式。

1M tokens · Text / Vision / Code · Prompt cache

由 Anthropic 提供的推理模型,收錄於 Okou 目前模型目錄。

Claude Opus 5是什麼?

2026年7月24日發布

Okou 目前支援 Claude Opus 5,模型 ID 為 claude-opus-5,內建模型相對成本級別為 $$$。

Claude Opus 5有什麼特別之處

架構與能力上的主要亮點。

Opus 5擁有100萬token的上下文視窗——最大值同時也是預設值——輸出最多128K token,知識截止到2026年5月。思考預設開啟,推理深度透過effort等級low、medium、high、xhigh、max設定;原始思維鏈從不暴露,只給出可讀的摘要。不支援助手訊息預填充,取樣參數(temperature、top_p、top_k)會被拒絕——想引導行為請改用提示詞。輸入涵蓋文字、高解析度視覺和程式碼。

規格速覽

提供商Anthropic
模型 IDclaude-opus-5
模態Text, Code
Okou 價格級別$$$

Claude Opus 5基準測試

以下為Anthropic發布材料中公佈的廠商成績。第三方跟蹤站點在同一項測試上給出的數字會因資料集、effort設定和智能體腳手架而不同,所以這些頭條數字要當作與配置相關的結果來看。

Frontier-Bench v0.1發布時的最佳成績;領先Fable 5(33.7%)和GPT 5.6 Sol(34.4%)
43.3%
SWE-bench Verified略微超過Fable 5的95.0%;這套題集在前沿已接近飽和
96.0%
SWE-bench Pro更難的程式設計題集——Fable 5仍以80.3%領先
79.2%
GDPval-AA v2知識工作榜單;高於Fable 5的1,747
1,861 Elo
Humanity's Last Exam(不用工具)專家級推理;略微落後於Fable 5的56.5%
56.3%

Claude Opus 5價格

內建模型的相對 credits 成本。實際費用取決於用量和設定,最新價格請以產品內顯示為準。

價格級別$$$

Claude Opus 5最適合的智能體任務

一次執行就落地的多檔案功能

把完整需求一次交代清楚,然後讓它跑。Opus 5相對Opus 4.8的提升,在高難度、多步驟的工程工作上最明顯——較大規模的重構、端到端的功能開發——在單輪小修改上最不明顯,所以把它對準你難度區間的上端。

可以放心掛一整夜的智能體

長時間自主執行正是價格差被放大的地方。質量接近Fable,token成本卻只有一半,一個每晚跑的工單分揀、遷移或調研智能體,單次完成任務的花費大約能省一半。

必須做完、而不只是回話的業務流程

帶工具、有真實終態的多步任務——提交工單、更新表格、對賬。Anthropic的AutomationBench和OSWorld結果指向同一件事:別的模型做到一半就撂挑子的端到端任務,它能做完。

常見問題

Claude Opus 5比Claude Fable 5更好嗎?

在若干評測上確實更好:Frontier-Bench v0.1、GDPval-AA v2和SWE-bench Verified上,Opus 5都領先Fable 5。而在更難的SWE-bench Pro題集和事實廣度上,Fable 5仍然領先,最難的推理任務上它也依然是更高的上限。就大多數智能體工作而言,Opus 5贏在單次完成任務的成本。

Claude Opus 5預設開啟思考嗎?

是的。省略thinking參數的請求也會先推理再作答——這和Opus 4.8不同,那時不主動要求就不會思考。深度用effort控制(low到max),並且只有effort在high或更低時才能關閉思考。原始思維鏈不會返回,只有可讀的摘要。

從Opus 4.8遷移過來要改什麼?

先是模型id,然後是提示詞調優。思考預設開啟意味著max_tokens現在同時覆蓋推理和答案;驗證類指令應該直接刪掉而不是改寫,因為Opus 5會自檢;預設回答也更長,如果在意長度,就明確加一句精簡要求。

替代選擇

在Okou上使用Claude Opus 5

如果工作區已啟用 Claude Opus 5,可在聊天的模型選擇器中選擇它。可用的服務商連線和計費方式請查看模型設定。

積分與$$$價格檔

內建模型的相對 credits 成本。實際費用取決於用量和設定,最新價格請以產品內顯示為準。

自July 25, 2026起在Okou上可用。