Три моделі за два місяці — і ось уже четверта. 24 липня Anthropic представила Claude Opus 5, флагман, покликаний зняти головну претензію корпоративних клієнтів останніх місяців: рахунки за токени ростуть швидше, ніж реальна користь від моделей.
Opus 5 коштує стільки ж, скільки попередній Opus 4.8: 5 доларів за мільйон вхідних токенів і 25 доларів за мільйон вихідних. Але на тестах Frontier-Bench і GDPval-AA, які оцінюють вирішення реальних робочих задач, результат зріс більш ніж удвічі. У ARC-AGI 3, тесті на здатність розв'язувати незнайомі логічні задачі, Opus 5 набрав утричі більше балів, ніж найближчий конкурент. На максимальному рівні «зусилля» в CursorBench 3.2 модель відстає від старшої Claude Fable 5 менш ніж на 0,5%, але коштує вдвічі дешевше за завдання.
Головна новинка — перемикач рівня зусилля: низький, середній, високий. Користувач сам вирішує, заощаджувати токени на простому завданні чи дати моделі подумати довше над складним. Є і зворотний варіант, Fast Mode: відповідь приходить приблизно у 2,5 раза швидше, але за подвійним тарифом. Розробникам також дозволили змінювати набір доступних інструментів просто посеред діалогу, не скидаючи кеш промпту. Дрібниця, яка в масштабах API економить реальні гроші.
Є й застереження. За власними поведінковими тестами Anthropic, Opus 5 показала найнижчий рівень розбіжності з наміром розробників серед моделей компанії: рідше хитрує і вводить користувача в оману. Натомість у завданнях з кібербезпеки модель усе ще поступається Claude Mythos 5 з тієї ж лінійки. А для по-справжньому автономних багатоетапних проєктів Anthropic прямо радить брати Fable 5, а не Opus 5.
Запуск мітить у той самий біль, що визнавала й OpenAI, випустивши на початку липня економічну GPT-5.6: індустрія зрозуміла, що нескінченно нарощувати ціну за інтелект не вийде. Компанії обирають моделі за рахунком наприкінці місяця, а не лише за бенчмарками.



