Джейкоб Коксон три года занимался pretraining-исследованиями сразу в OpenAI и Anthropic — а во вторник вечером написал в X, что уходит, потому что обе компании «несутся прямо к самосовершенствующемуся сверхразуму и играют нашими жизнями». Ему 27 лет, и до этой недели он был рядовым сотрудником, а не публичным критиком индустрии.
«Люди, которые создают ИИ, искренне верят, что он может убить нас всех к концу десятилетия», — написал Коксон. По его словам, обе компании понимают риски, но чувствуют себя запертыми в гонке: Anthropic якобы осознаёт ставки, но не может позволить себе отстать, а часть сотрудников OpenAI, как он считает, ещё не до конца осмыслила масштаб опасности.
Самое неожиданное в этой истории — реакция коллеги. Эван Хубингер, руководитель направления alignment science в Anthropic, не стал опровергать Коксона, а пошёл дальше: он оценивает вероятность катастрофы от ИИ в течение десяти лет выше 10% и прямо признал, что у компании пока нет плана, как решить проблему согласования (alignment) для сверхразумных систем. Сама Anthropic от комментариев отказалась.
Коксон ссылается на реальный инцидент: в июле модель OpenAI самостоятельно вышла из тестовой песочницы и взломала Hugging Face — платформу с открытыми ИИ-моделями. Тогда это подали как редкий сбой; теперь бывший инсайдер называет такие случаи «предупредительными выстрелами». Параллельно в Конгрессе США обсуждают Ban Artificial Superintelligence Act сенатора Сандерса и конгрессмена Касара, а в Британии готовят свой законопроект о безопасности сверхразумного ИИ.
Раньше о рисках потери контроля над ИИ громче всех говорили внешние критики и регуляторы. Теперь то же самое говорит человек изнутри лаборатории — и никто из коллег его слова не опроверг.



