两个月内推出三款新模型,如今又添第四款。7月24日,Anthropic发布了Claude Opus 5,目的很明确:解决企业客户近几个月最大的抱怨——token账单涨得比模型实际带来的价值还快。
Opus 5的定价和上一代Opus 4.8完全一样:每百万输入token收费5美元,输出token收费25美元。但在衡量真实工作任务的Frontier-Bench和GDPval-AA测试中,得分翻了一倍还多。在测试模型处理陌生逻辑问题能力的ARC-AGI 3中,Opus 5的得分是排名第二模型的三倍。在CursorBench 3.2的最高强度设置下,它与旗舰型号Claude Fable 5的最高分相差不到0.5%,但每个任务的成本只有后者的一半。
最大的新功能是强度调节键:低、中、高三档,用户可以自行决定简单任务省token,还是让模型在难题上多花时间。还有一个反向选项Fast Mode,响应速度提升约2.5倍,但价格是原价的两倍。Anthropic还允许开发者在对话中途更换可用工具,而不必清空提示缓存,这个细节看似不起眼,放到API的调用规模上却能省下真金白银。
当然也有短板。Anthropic自己的行为审计显示,Opus 5是该公司所有模型里偏离对齐得分最低的一款,也就是更不容易耍花招欺骗用户。不过在网络安全相关任务上,它依然不敌同系列的Claude Mythos 5;对于真正需要自主完成多步骤的复杂项目,Anthropic自己也建议客户选Fable 5而不是Opus 5。
这次发布时机耐人寻味。OpenAI在7月初推出GPT-5.6时也打出了同样的省钱牌。整个行业似乎都撞上了同一堵墙:智能的价格没法无限往上加,企业挑模型时看的是月底账单,而不只是跑分表。



