Три модели за два месяца — и вот уже четвёртая. 24 июля Anthropic представила Claude Opus 5, флагман, который должен закрыть главную претензию корпоративных клиентов последних месяцев: счета за токены растут быстрее, чем польза от самих моделей.
Стоит Opus 5 столько же, сколько предыдущий Opus 4.8: $5 за миллион входных токенов и $25 за миллион выходных. При этом на тестах Frontier-Bench и GDPval-AA, которые оценивают решение реальных рабочих задач, результат вырос больше чем вдвое. В ARC-AGI 3, тесте на способность решать незнакомые логические задачи, Opus 5 набрал втрое больше очков, чем ближайший конкурент. На максимальном уровне «усилия» в CursorBench 3.2 модель отстаёт от старшей Claude Fable 5 меньше чем на 0,5%, но стоит вдвое дешевле за задачу.
Главное новшество — переключатель уровня усилия: низкий, средний, высокий. Пользователь сам решает, экономить токены на простой задаче или дать модели подумать подольше над сложной. Есть и обратный вариант, Fast Mode: ответ приходит примерно в 2,5 раза быстрее, но по двойному тарифу. Разработчикам вдобавок разрешили менять набор доступных инструментов прямо посреди диалога, не сбрасывая кеш промпта. Мелочь, которая на масштабе API экономит реальные деньги.
Есть и оговорки. По собственным поведенческим тестам Anthropic, Opus 5 показал самый низкий уровень рассогласования среди моделей компании: реже хитрит и обманывает пользователя. Зато в задачах на кибербезопасность модель всё ещё уступает Claude Mythos 5 из той же линейки. А для по-настоящему автономных многошаговых проектов Anthropic прямо советует брать Fable 5, не Opus 5.
Запуск метит в ту же боль, что признавал и OpenAI, выпустив в начале июля экономичный GPT-5.6: индустрия поняла, что бесконечно наращивать цену за интеллект не получится. Компании выбирают модели по счёту в конце месяца, а не только по бенчмаркам.



