OpenAI запустила GPT-5.6 Sol після схвалення урядом США

iEXExchanger
OpenAI запустила GPT-5.6 Sol після схвалення урядом США

OpenAI випустила GPT-5.6: флагман Sol обійшов Claude Mythos 5 у кодингу, Terra пропонує схожу якість удвічі дешевше. Запуск відбувся після тижнів перевірок з боку уряду США.

Наприкінці червня Білий дім попросив OpenAI не поспішати з GPT-5.6: надто потужний інструмент, а спецслужбам потрібен час оцінити ризики. Три тижні по тому, 9 липня, Міністерство торгівлі США дало дозвіл — і нова лінійка стала публічно доступна.

GPT-5.6 виходить трьома варіантами: Sol, Terra і Luna. Флагман Sol орієнтований на складний код, агентські сценарії та завдання кібербезпеки. На бенчмарку TerminalBench 2.1 Sol Ultra набрав 91,91%, а базовий Sol — 88,76%, обійшовши Claude Mythos 5 (88%) і попередній GPT-5.5 (83,4%). Terra показала 84,27% — фактично на рівні Claude Fable 5, але коштує вдвічі дешевше від Sol: $2,50/$15 за мільйон токенів. Luna — найбюджетніший варіант, $1/$6, для масових швидких запитів.

Ключова новинка — режим ultra: замість одного агента задачу виконує оркестр субагентів паралельно. Це відкриває можливість для складних проектів, що раніше потребували ручного управління. Кешування промптів також оновлено: кеш живе мінімум 30 хвилин з коефіцієнтом запису 1,25x.

На інфраструктурі Cerebras Sol розганяється до 750 токенів на секунду. Швидкий режим обходиться в $12,50/$75 за мільйон токенів і поки доступний обмеженому колу клієнтів.

Ринок флагманових AI-моделей ніколи не був таким щільним. Grok 4.5 вийшов напередодні, Claude Mythos 5 тримає орієнтир, а GPT-5.6 Sol перевершує його менш ніж на один відсоток. Для розробників — ідеальна конкуренція: ціни падають, вибір залежить від задачі, а не від переваги одного продукту.

Запитання та відповіді

Часті питання на тему статті

Чим відрізняються Sol, Terra і Luna у GPT-5.6?

Sol ($5/$30 за млн токенів) — флагман для складного коду та агентських завдань. Terra ($2,50/$15) дає продуктивність рівня GPT-5.5 вдвічі дешевше Sol. Luna ($1/$6) — бюджетний варіант для масових запитів.

Як GPT-5.6 Sol порівнюється з Claude Mythos 5 і Grok 4.5?

На TerminalBench 2.1 Sol набрав 88,76% проти 88,0% у Claude Mythos 5 — різниця мінімальна. Grok 4.5 вийшов напередодні з аналогічним позиціонуванням. Три моделі тепер змагаються в межах частки відсотка на агентських бенчмарках.

Чому публічний запуск GPT-5.6 затримали на три тижні?

Наприкінці червня Білий дім попросив OpenAI провести додаткові перевірки безпеки через побоювання щодо можливостей моделі у сфері кібербезпеки. OpenAI співпрацювала з держорганами, після чого Міністерство торгівлі дало дозвіл.

Що таке режим ultra у GPT-5.6?

Режим ultra використовує команду субагентів, що працюють паралельно, замість одного агента, який обробляє завдання послідовно. Призначений для великих багатоетапних проектів із підвищеними вимогами до продуктивності.