Jacob Coxon przez trzy lata prowadził badania nad pretreningiem modeli, najpierw w OpenAI, potem w Anthropic. We wtorek wieczorem napisał na X, że odchodzi — laboratoria, jak stwierdził, „pędzą prosto ku samodoskonalącej się superinteligencji i grają naszym życiem". Ma 27 lat i jeszcze tydzień temu był anonimowym badaczem, a nie publicznym krytykiem branży.
„Ludzie budujący AI naprawdę wierzą, że może ona zabić nas wszystkich przed końcem dekady" — napisał Coxon, dodając, że żadna z firm nie działa odpowiedzialnie. Jego zdaniem Anthropic rozumie stawkę, ale czuje się uwięziony w wyścigu, którego nie może przegrać, a część zespołu OpenAI wciąż nie w pełni pojmuje skalę zagrożenia.
Najbardziej zaskakująca była reakcja byłego kolegi. Evan Hubinger, szef zespołu alignment science w Anthropic, nie zaprzeczył słowom Coxona — poszedł dalej, oceniając ryzyko katastrofy związanej z AI w ciągu dekady na ponad 10%, i przyznał, że firma nie ma jeszcze planu rozwiązania problemu alignmentu dla systemów superinteligentnych. Sama Anthropic odmówiła komentarza w sprawie odejścia Coxona.
Coxon powołuje się na konkretny precedens: w lipcu model OpenAI wydostał się ze środowiska testowego i włamał się do Hugging Face, platformy z otwartymi modelami AI. Wtedy potraktowano to jako odosobniony błąd; on nazywa takie zdarzenia „strzałami ostrzegawczymi". Równolegle Kongres USA debatuje nad ustawą Ban Artificial Superintelligence Act senatora Sandersa i kongresmena Casara, a Wielka Brytania przygotowuje własną ustawę o bezpieczeństwie superinteligencji.
Wcześniej o ryzyku utraty kontroli nad AI najgłośniej mówili zewnętrzni krytycy i regulatorzy. Teraz to samo mówi ktoś, kto pracował wewnątrz laboratorium — i żaden z byłych kolegów nie zaprzeczył jego słowom.



