Anthropic 发布 Claude Opus 5:以一半价格提供前沿性能
Anthropic 于 2026 年 7 月 24 日发布了 Claude Opus 5——这是继 6 月推出 Mythos 5、Fable 5 和 Sonnet 5 之后,不到两个月内的第四次模型发布。与以往强调能力上限不同,Anthropic 此次将发布重点放在经济性上:这是一款为日常使用而非仅应对最棘手问题而设计的模型。
定价与性能对比
Opus 5 的定价与其前代 Opus 4.8 相同,每百万输入 token 收费 5 美元,每百万输出 token 收费 25 美元——根据报道,这一价格恰好是 Anthropic 旗舰级 Fable 5 模型定价的一半。尽管价格更低,但在 Anthropic 发布时公布的多项基准测试中,Opus 5 的实际表现甚至优于 Fable 5——这对一家公司的次旗舰模型来说,是颇为罕见的局面。
买家关心的关键数据
在衡量智能编程能力的 Frontier-Bench v0.1 测试中,Opus 5 得分 43.3%,是 Opus 4.8(21.1%)的两倍多,并比紧随其后的模型高出约 10 个百分点。在测试新颖推理能力的 ARC-AGI-3 中,Opus 5 得分 30.2%,约为次优模型的三倍。此外,Anthropic 还引入了低/中/高三档计算强度开关,让开发者可以根据每次请求调整推理计算量,从而直接控制成本。
值得注意的细节
Anthropic 披露,其最受关注的编程基准测试采用了特定的内部测试框架,其中 Opus 4.8 作为 Opus 5 和 Fable 5 在安全分类器拒绝情况下的后备模型——这意味着公布的得分并非纯粹的单模型结果。Anthropic 已详细记录了该方法,但该测试框架由供应商自行运行,因此 43.3% 这一数字应结合此背景来理解,而非视为独立验证的数据。
在另一项编程基准测试 CursorBench 3.2 中,Opus 5 在最大计算强度下与 Fable 5 的最高得分相差不到 0.5 个百分点,而每次任务的成本却只有后者的一半。Anthropic 还报告称,Opus 5 的偏差评分低于其此前测量过的所有模型。
对买家的启示
目前使用 Opus 4.8 进行编程或智能体工作流的团队,可以在相同价格下获得显著的能力提升。Fable 5 在应对最困难任务时仍是前沿选择,但 Opus 5 以一半的成本弥补了大部分差距——在续签企业级 Fable 5 合约之前,值得先行测试。计算强度开关为财务和工程团队提供了直接管理 AI 支出的杠杆,无需切换整个模型。

交易所
交易所排行榜
24小时成交排行榜
人气排行榜
交易所比特币余额
交易所资产透明度证明
去中心化交易所
资金费率
资金费率热力图
爆仓数据
清算最大痛点
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
ETF追踪
索拉纳ETF
瑞波币ETF
香港ETF
比特币持币公司
加密资产反转
以太坊储备
HyperLiquid钱包分析
Hyperliquid鲸鱼监控
大额转账
链上异动
比特币回报率
稳定币市值
期权分析
新闻
文章
财经日历
专题
钱包
合约计算器
账号安全
资讯收藏
自选币种
我的关注