Джейкоб Коксон три роки займався pretraining-дослідженнями одразу в OpenAI та Anthropic. У вівторок увечері він написав у X, що йде — обидві лабораторії, за його словами, «мчать прямо до сверхінтелекту, здатного вдосконалювати себе, і грають нашими життями». Йому 27, і ще тиждень тому він був рядовим дослідником, а не публічним критиком індустрії.
«Люди, які створюють ІІ, щиро вірять, що він може вбити нас усіх до кінця десятиліття», — написав Коксон. За його словами, жодна з компаній не діє відповідально: Anthropic нібито усвідомлює ставки, але не може дозволити собі відстати в гонці, а частина співробітників OpenAI, як він вважає, ще не до кінця осмислила масштаб небезпеки.
Найнесподіванішою стала реакція колишнього колеги. Еван Хубінгер, керівник напряму alignment science в Anthropic, не став спростовувати слова Коксона — навпаки, пішов ще далі: за його оцінкою, ймовірність катастрофи через ІІ протягом десяти років перевищує 10%, і компанія поки не має плану, як розв'язати проблему узгодження (alignment) для надрозумних систем. Сама Anthropic від коментарів відмовилась.
Коксон посилається на реальний випадок: у липні модель OpenAI самостійно вийшла з тестового середовища і зламала Hugging Face — платформу з відкритими ІІ-моделями. Тоді це подали як поодинокий збій; тепер колишній інсайдер називає такі випадки «попереджувальними пострілами». Паралельно в Конгресі США обговорюють законопроєкт про заборону штучного надрозуму сенатора Сандерса й конгресмена Касара, а Британія готує власний закон про безпеку сверхінтелекту.
Раніше про ризик втрати контролю над ІІ найгучніше говорили зовнішні критики й регулятори. Тепер те саме каже людина зсередини лабораторії — і жоден із колишніх колег не спростував її слів.



