• 全部
  • 产业
  • Web 3.0
  • DAO
  • DeFi
  • 符文
  • 空投再质押
  • 以太坊
  • Meme
  • 比特币L2
  • 以太坊L2
  • 研报
  • 头条
  • 投资

免责声明:内容不构成买卖依据,投资有风险,入市需谨慎!

Anthropic推出Claude Sonnet 5.5,AI转向按任务计费

2026-09-29 07:58:14
收藏

Anthropic发布Claude Sonnet 5.5:成本效率成为AI评估新核心

9月28日,Anthropic发布了Claude 5.5系列的第二款产品——Claude Sonnet 5.5。此举正值该公司筹备首次公开募股(IPO)之际。这标志着AI技术评估标准的重要转变:虽然原始基准测试性能仍然是关键考量因素,但企业现在同样关注使用特定模型交付结果的高昂成本。

Anthropic声称,与Sonnet 5相比,Sonnet 5.5的运行速度提升了30%以上。在大多数任务中,即使代币价格保持不变,其应用成本最高可降低30%。根据Anthropic的发布页面说明,这种成本的降低是通过在完成相同任务时减少代币使用量来实现的。



标价不变,代币用量更少

Sonnet 5.5的定价为每百万输入代币2美元,输出代币10美元,缓存读取代币0.20美元。专注于复杂推理和判断操作的Opus 5.5,其输入和输出代币的价格分别为4美元和20美元。而Sonnet系列则旨在处理编码、文档生成和电子表格等简单任务。

这使得效率问题成为了讨论的焦点。对于许多任务而言,企业无需追求性能最高的模型。如果一个低成本模型能够始终如一地完成任务,那么其在基准测试中多得的几分可能就不那么重要了。这一点对Anthropic尤为重要,因为据报道,该公司约80%的收入来自企业客户。



基准测试不再是全部故事

Anthropic表示,Sonnet 5.5在Terminal-Bench 4.0上的得分为70.6%,而Sonnet 5仅为10.3%。然而,Artificial Analysis排行榜显示了为什么基准测试分数只是图景的一部分:

  • Sonnet 5.5以最大努力运行,在智能量表上达到56分,每项任务的预估成本为7.60美元。
  • GPT-6 Sol可以达到48分,每项任务成本仅为1.06美元。
  • 小米的MiMo-V2.6-Pro得分46分,但成本极低,仅需0.13美元。

这种成本差异促使企业采取多种策略:可以将复杂任务分配给高端系统,而所有常规任务则由更便宜的系统完成。



思考的成本持续下降

这一变化符合长期以来的更大趋势。根据Epoch AI在9月22日发布的报告,自2023年以来,特定水平AI性能的成本每个季度大约下降47%,年降幅约为13倍。9月29日发表在Cryptopolitan的报道指出,企业买家越来越倾向于选择能以最低成本完成所需任务的模型,而低价格也使得企业更有理由使用多个模型。



更便宜的代币,更大的账单

然而,成本降低并不意味着AI总支出的减少。Gartner在8月17日发布的报告《Gartner预测到2028年,代理工作流的AI推理成本将增加五倍以上》中提到了“推理悖论”。代币价格的下降激发了更复杂的工作流,导致总代币使用量增加。

Gartner高级分析师Will Sommer在2026年8月17日的报告中指出:“产品领导者不能依赖更高效的代币经济学来合理化AI成本。”



谁真正受益于更便宜的AI?

根据微软发布的《全球AI扩散报告》,低成本和开放权重的模型有潜力提高可访问性,特别是在全球南方国家。虽然较低模型成本确实能提高可访问性,但基础设施、连接性和技能才是决定廉价AI模型是否会被使用的关键因素。

对于企业买家而言,Sonnet 5.5展示了市场的方向:最好的模型不一定是最强大的,而是能以合理成本出色完成任务的模型。未来几周内即将推出的Haiku 5.5可能会进一步推动这一转变,使高容量AI工作变得更便宜,并让企业更难为常规任务支付更高价格提供正当理由。

免责声明:

本网站、超链接、相关应用程序、论坛、博客等媒体账户以及其他平台和用户发布的所有内容均来源于第三方平台及平台用户。百亿财经对于网站及其内容不作任何类型的保证,网站所有区块链相关数据以及其他内容资料仅供用户学习及研究之用,不构成任何投资、法律等其他领域的建议和依据。百亿财经用户以及其他第三方平台在本网站发布的任何内容均由其个人负责,与百亿财经无关。百亿财经不对任何因使用本网站信息而导致的任何损失负责。您需谨慎使用相关数据及内容,并自行承担所带来的一切风险。强烈建议您独自对内容进行研究、审查、分析和验证。

展开阅读全文
更多新闻
自选
我的自选
查看全部
市值 价格 24h%