全部模型

Claude Opus 5

Anthropic的旗舰Opus模型,2026年7月24日发布——用Claude Fable 5一半的价格提供接近前沿的智能,思考默认开启,effort从low到max全档可调。

1M tokens · Text / Vision / Code · Prompt cache

Claude Opus 5是Anthropic当前的旗舰Opus模型,2026年7月24日发布,接替Opus 4.8。它用一半的价格逼近Claude Fable 5的前沿智能,而在几项编程和知识工作评测上——比如Frontier-Bench v0.1和GDPval-AA v2——它直接领先Fable 5。定价与Opus 4.8一致,每100万token输入$5、输出$25,所以对已经跑在Opus档上的智能体来说,它是可以直接替换的升级。

Claude Opus 5是什么?

2026年7月24日发布 · Anthropic的旗舰Opus档——绝对能力上限低于Fable 5,但在多项智能体和知识工作评测上反超,token价格只有一半。在Okou上,它是高难度智能体工作的默认选择。

Anthropic于2026年7月24日在Claude API、Claude应用、Amazon Bedrock、Google Cloud和Microsoft Foundry上发布了Claude Opus 5;Okou在2026年7月25日把它加入内置模型。它以完全相同的价格接替Opus 4.8,Frontier-Bench v0.1成绩大约翻了一倍,这也是核心卖点:同样的单token成本,换来明显更强的能力。

它的定位是智能体编程和企业知识工作的主力——多文件功能开发、较大规模重构、长时间自主运行、端到端交付——而不是绝对的能力天花板。在更难的SWE-bench Pro题集和事实广度上,Fable 5仍然领先;Opus 5赢在单次完成任务的成本,而当智能体流量涨起来之后,账单上体现的正是这个数字。

相对Opus 4.8有两处API行为变化。一是思考默认开启,什么都不配置的请求现在也会先推理再作答,而关闭思考只在effort为high或更低时才被允许。二是可缓存提示词的最低长度降到512个token,过去缓存不了的短系统提示词现在可以缓存了。Opus 5还配备了更强的网络安全防护,属于禁止或高风险领域的请求可能会收到拒答。

Claude Opus 5有什么特别之处

架构与能力上的主要亮点。

Opus 5拥有100万token的上下文窗口——最大值同时也是默认值——输出最多128K token,知识截止到2026年5月。思考默认开启,推理深度通过effort等级lowmediumhighxhighmax设置;原始思维链从不暴露,只给出可读的摘要。不支持助手消息预填充,采样参数(temperaturetop_ptop_k)会被拒绝——想引导行为请改用提示词。输入涵盖文本、高分辨率视觉和代码。

规格速览

系列Claude 5代
模态文本、视觉、代码
上下文窗口100万token(默认值即最大值)
最大输出最多128K token
知识截止2026年5月
思考默认开启;effort可选low / medium / high / xhigh / max
提示词缓存支持(最低512个token)
厂商标价每100万token输入$5 / 输出$25

Claude Opus 5基准测试

以下为Anthropic发布材料中公布的厂商成绩。第三方跟踪站点在同一项测试上给出的数字会因数据集、effort设置和智能体脚手架而不同,所以这些头条数字要当作与配置相关的结果来看。

Frontier-Bench v0.1发布时的最佳成绩;领先Fable 5(33.7%)和GPT 5.6 Sol(34.4%)
43.3%
SWE-bench Verified略微超过Fable 5的95.0%;这套题集在前沿已接近饱和
96.0%
SWE-bench Pro更难的编程题集——Fable 5仍以80.3%领先
79.2%
GDPval-AA v2知识工作榜单;高于Fable 5的1,747
1,861 Elo
Humanity's Last Exam(不用工具)专家级推理;略微落后于Fable 5的56.5%
56.3%

Claude Opus 5价格

服务商标价,按每100万token计。

输入$5.00
输出$25.00
缓存读取$0.50
缓存写入$6.25

Claude Opus 5实际用起来怎么样

来自生产环境智能体运行的实际观察。

单次完成任务的成本

选Opus 5而不是Fable 5,最直接的理由是:智能体工作上效果相当,token价格却大约只有一半。在Zapier的AutomationBench上,同样的单任务成本下,它的通过率约为第二名模型的1.5倍;即便把effort调到最低一档,它通过的任务数也比其他任何模型都多。

思考默认开启

和Opus 4.8不同,省略thinking参数的请求现在也会先推理再作答。这一点要算进预算:max_tokens同时覆盖思考和答案,按不开思考的工况调好的上限可能会被截断。只有effort在high或更低时才允许关闭思考。

effort是主要的成本杠杆

这个模型上的lowmedium强得出人意料,往往能达到上一代旗舰在最高档才有的水平。先从high起步——最难的编程和智能体运行用xhigh——然后逐级往下试,保留评测仍能接受的最便宜那一档。

会自己检查成果

不用你提醒,Opus 5也会检查自己的输出,所以从旧模型沿用过来的验证类指令往往只会带来重复的检查。它默认写得也更长;与其调低effort,不如加一句简短的精简要求。

Claude Opus 5最适合的智能体任务

一次运行就落地的多文件功能

把完整需求一次交代清楚,然后让它跑。Opus 5相对Opus 4.8的提升,在高难度、多步骤的工程工作上最明显——较大规模的重构、端到端的功能开发——在单轮小修改上最不明显,所以把它对准你难度区间的上端。

可以放心挂一整夜的智能体

长时间自主运行正是价格差被放大的地方。质量接近Fable,token成本却只有一半,一个每晚跑的工单分拣、迁移或调研智能体,单次完成任务的花费大约能省一半。

必须做完、而不只是回话的业务流程

带工具、有真实终态的多步任务——提交工单、更新表格、对账。Anthropic的AutomationBench和OSWorld结果指向同一件事:别的模型做到一半就撂挑子的端到端任务,它能做完。

Claude Opus 5与其他模型对比

Claude Opus 5对比Claude Opus 4.8

同样的价格、同样的档位,能力却明显更强:Opus 5把Opus 4.8的Frontier-Bench成绩大约翻了一倍,SWE-bench Verified再加七个百分点。迁移就是换一个模型id,外加重新调一遍提示词——思考现在默认开启,记得重新检查max_tokens,并删掉所有「验证你的工作」之类的指令,它们现在只会导致重复检查。

Claude Opus 5对比GPT 5.6 Sol

两者都是顶级的智能体模型。Frontier-Bench上Opus 5领先Sol(43.3%对34.4%);DeepSWE v1.1上Sol领先(72.7%对68.8%)。在Okou上这是一个路由选择,而不是采购决策——同一个智能体在两边各跑一遍,比一比就知道。

结论:你该用Claude Opus 5吗?

Okou上的默认旗舰。Opus 5已经足够接近Fable 5的上限,以至于大多数智能体工作上价格成了决定因素;对任何已经跑在Opus 4.8上的场景来说,它都是可以直接替换的升级。常规循环留给Sonnet 5,Fable 5则留给少数真正需要顶配的任务。

常见问题

Claude Opus 5是什么时候发布的?

Anthropic在2026年7月24日发布了Opus 5,覆盖Claude API和Claude应用,以及Amazon Bedrock、Google Cloud和Microsoft Foundry。Okou在2026年7月25日把它加入内置模型(模型id为claude-opus-5)。

Claude Opus 5比Claude Fable 5更好吗?

在若干评测上确实更好:Frontier-Bench v0.1、GDPval-AA v2和SWE-bench Verified上,Opus 5都领先Fable 5。而在更难的SWE-bench Pro题集和事实广度上,Fable 5仍然领先,最难的推理任务上它也依然是更高的上限。就大多数智能体工作而言,Opus 5赢在单次完成任务的成本。

Claude Opus 5默认开启思考吗?

是的。省略thinking参数的请求也会先推理再作答——这和Opus 4.8不同,那时不主动要求就不会思考。深度用effort控制(lowmax),并且只有effort在high或更低时才能关闭思考。原始思维链不会返回,只有可读的摘要。

从Opus 4.8迁移过来要改什么?

先是模型id,然后是提示词调优。思考默认开启意味着max_tokens现在同时覆盖推理和答案;验证类指令应该直接删掉而不是改写,因为Opus 5会自检;默认回答也更长,如果在意长度,就明确加一句精简要求。

替代选择

在Okou上使用Claude Opus 5

在Okou上使用Claude Opus 5的两种方式

Okou既支持把Claude Opus 5作为Built-in模型使用、按Okou积分计费,也支持你用Anthropic API key自带密钥接入。Built-in这条路走的是Okou Managed路由和下文说明的价格档;自带密钥这条路由上游服务商直接向你收费,完全跳过Okou的积分换算。

Okou的建议

Okou把Claude Opus 5定位为核心智能体模型,用于编排、涉及代码的工作,以及其他一旦答错代价很高的环节。

积分与$$$价格档

Okou给每个Built-in模型都定了四档积分价格——$$$$$$$$$$——它会作为标记出现在模型选择器里,也出现在zero model lsprice tier那一行。Claude Opus 5属于$$$。这一档决定你从Okou积分余额里扣掉多少;上表里的服务商标价,则是上游服务商在Okou把它换算成积分之前收取的费用。

自July 25, 2026起在Okou上可用。