← 全部模型

Claude Opus 5:Okou 当前支持的推理模型

Okou 当前支持的推理模型,提供内置访问方式。

1M tokens · Text / Vision / Code · Prompt cache

由 Anthropic 提供的推理模型,收录于 Okou 当前模型目录。

Claude Opus 5是什么?

2026年7月24日发布

Okou 当前支持 Claude Opus 5,模型 ID 为 claude-opus-5,内置模型相对成本档位为 $$$。

Claude Opus 5有什么特别之处

架构与能力上的主要亮点。

Opus 5拥有100万token的上下文窗口——最大值同时也是默认值——输出最多128K token,知识截止到2026年5月。思考默认开启,推理深度通过effort等级low、medium、high、xhigh、max设置;原始思维链从不暴露,只给出可读的摘要。不支持助手消息预填充,采样参数(temperature、top_p、top_k)会被拒绝——想引导行为请改用提示词。输入涵盖文本、高分辨率视觉和代码。

规格速览

提供商Anthropic
模型 IDclaude-opus-5
模态Text, Code
Okou 价格档位$$$

Claude Opus 5基准测试

以下为Anthropic发布材料中公布的厂商成绩。第三方跟踪站点在同一项测试上给出的数字会因数据集、effort设置和智能体脚手架而不同,所以这些头条数字要当作与配置相关的结果来看。

Frontier-Bench v0.1发布时的最佳成绩;领先Fable 5(33.7%)和GPT 5.6 Sol(34.4%)
43.3%
SWE-bench Verified略微超过Fable 5的95.0%;这套题集在前沿已接近饱和
96.0%
SWE-bench Pro更难的编程题集——Fable 5仍以80.3%领先
79.2%
GDPval-AA v2知识工作榜单;高于Fable 5的1,747
1,861 Elo
Humanity's Last Exam(不用工具)专家级推理;略微落后于Fable 5的56.5%
56.3%

Claude Opus 5价格

内置模型的相对 credits 成本。实际费用取决于用量和设置,最新价格请以产品内显示为准。

价格档位$$$

Claude Opus 5最适合的智能体任务

一次运行就落地的多文件功能

把完整需求一次交代清楚,然后让它跑。Opus 5相对Opus 4.8的提升,在高难度、多步骤的工程工作上最明显——较大规模的重构、端到端的功能开发——在单轮小修改上最不明显,所以把它对准你难度区间的上端。

可以放心挂一整夜的智能体

长时间自主运行正是价格差被放大的地方。质量接近Fable,token成本却只有一半,一个每晚跑的工单分拣、迁移或调研智能体,单次完成任务的花费大约能省一半。

必须做完、而不只是回话的业务流程

带工具、有真实终态的多步任务——提交工单、更新表格、对账。Anthropic的AutomationBench和OSWorld结果指向同一件事:别的模型做到一半就撂挑子的端到端任务,它能做完。

常见问题

Claude Opus 5比Claude Fable 5更好吗?

在若干评测上确实更好:Frontier-Bench v0.1、GDPval-AA v2和SWE-bench Verified上,Opus 5都领先Fable 5。而在更难的SWE-bench Pro题集和事实广度上,Fable 5仍然领先,最难的推理任务上它也依然是更高的上限。就大多数智能体工作而言,Opus 5赢在单次完成任务的成本。

Claude Opus 5默认开启思考吗?

是的。省略thinking参数的请求也会先推理再作答——这和Opus 4.8不同,那时不主动要求就不会思考。深度用effort控制(low到max),并且只有effort在high或更低时才能关闭思考。原始思维链不会返回,只有可读的摘要。

从Opus 4.8迁移过来要改什么?

先是模型id,然后是提示词调优。思考默认开启意味着max_tokens现在同时覆盖推理和答案;验证类指令应该直接删掉而不是改写,因为Opus 5会自检;默认回答也更长,如果在意长度,就明确加一句精简要求。

替代选择

在Okou上使用Claude Opus 5

如果工作区已启用 Claude Opus 5,可在聊天的模型选择器中选择它。可用的服务商连接和计费方式请查看模型设置。

积分与$$$价格档

内置模型的相对 credits 成本。实际费用取决于用量和设置,最新价格请以产品内显示为准。

自July 25, 2026起在Okou上可用。