Anthropic发布Opus 5 性能翻倍价格不变

iEXExchanger
Anthropic发布Opus 5 性能翻倍价格不变

Anthropic以与上代相同的价格发布了Claude Opus 5,但在真实工作任务测试中的表现几乎翻倍。我们梳理了具体变化,以及这如何回应企业对token费用的不满。

两个月内推出三款新模型,如今又添第四款。7月24日,Anthropic发布了Claude Opus 5,目的很明确:解决企业客户近几个月最大的抱怨——token账单涨得比模型实际带来的价值还快。

Opus 5的定价和上一代Opus 4.8完全一样:每百万输入token收费5美元,输出token收费25美元。但在衡量真实工作任务的Frontier-Bench和GDPval-AA测试中,得分翻了一倍还多。在测试模型处理陌生逻辑问题能力的ARC-AGI 3中,Opus 5的得分是排名第二模型的三倍。在CursorBench 3.2的最高强度设置下,它与旗舰型号Claude Fable 5的最高分相差不到0.5%,但每个任务的成本只有后者的一半。

最大的新功能是强度调节键:低、中、高三档,用户可以自行决定简单任务省token,还是让模型在难题上多花时间。还有一个反向选项Fast Mode,响应速度提升约2.5倍,但价格是原价的两倍。Anthropic还允许开发者在对话中途更换可用工具,而不必清空提示缓存,这个细节看似不起眼,放到API的调用规模上却能省下真金白银。

当然也有短板。Anthropic自己的行为审计显示,Opus 5是该公司所有模型里偏离对齐得分最低的一款,也就是更不容易耍花招欺骗用户。不过在网络安全相关任务上,它依然不敌同系列的Claude Mythos 5;对于真正需要自主完成多步骤的复杂项目,Anthropic自己也建议客户选Fable 5而不是Opus 5。

这次发布时机耐人寻味。OpenAI在7月初推出GPT-5.6时也打出了同样的省钱牌。整个行业似乎都撞上了同一堵墙:智能的价格没法无限往上加,企业挑模型时看的是月底账单,而不只是跑分表。

问答

本文相关常见问题

Claude Opus 5是什么?

这是Anthropic于2026年7月24日发布的新旗舰模型,取代Opus 4.8成为Claude Pro和Claude Max的默认模型,在真实工作任务测试中的得分翻倍以上,价格却保持不变。

Opus 5比上一代贵吗?

不贵。价格保持不变:每百万输入token 5美元,输出token 25美元,与Opus 4.8完全相同,而关键测试的表现却翻了一倍多。

强度调节功能是什么?

这是Opus 5的新设置,让用户选择模型在任务上投入多少思考——低、中、高三档,从而自行在速度、成本和答案质量之间取得平衡。

Opus 5与Claude Fable 5、Mythos 5有什么区别?

Fable 5仍是Anthropic处理复杂多步骤自主项目的最强模型,官方也推荐将其用于此类任务。Mythos 5在网络安全任务上更强。Opus 5则介于两者之间:性能接近Fable 5,价格却只有一半。