OpenAI wprowadza do rady kogoś, kto boi się AI

iEXExchanger
OpenAI wprowadza do rady kogoś, kto boi się AI

Paul Christiano, były szef badań nad alignmentem w OpenAI i współtwórca RLHF, dołączył do rady fundacji i komitetu ds. bezpieczeństwa w czasie rosnących obaw o ryzyko związane ze sztuczną inteligencją.

W tym tygodniu jeden z badaczy AI trzasnął drzwiami, nazywając wyścig o superinteligencję nieodpowiedzialnym hazardem z ludzkim życiem. Niemal równocześnie inny przyjął miejsce w zarządzie branży, którą krytykuje: OpenAI powołało Paula Christiano, wieloletniego badacza zajmującego się alignmentem, do rady swojej fundacji non-profit.

Christiano to nie przypadkowe nazwisko. W latach 2017-2021 kierował badaniami nad alignmentem w OpenAI i przyczynił się do stworzenia RLHF — uczenia ze wzmocnieniem na podstawie ludzkiej informacji zwrotnej, techniki, która nadal kształtuje zachowanie ChatGPT i większości dzisiejszych chatbotów. Po odejściu założył niezależne Alignment Research Center. Obecnie jest starszym doradcą technicznym w CAISI, jednostce Departamentu Handlu USA, która ocenia modele AI i przygotowuje rządowe wytyczne dotyczące bezpieczeństwa.

Nowa funkcja daje mu od razu trzy role: miejsce w radzie fundacji non-profit, która po ubiegłorocznej restrukturyzacji zachowała 26% udziałów w komercyjnej spółce OpenAI Group PBC; członkostwo w komitecie ds. bezpieczeństwa i ochrony, któremu przewodniczy Zico Kolter; oraz status obserwatora bez prawa głosu w zarządzie spółki komercyjnej. W sprawach związanych z jego pracą w Departamencie Handlu i ocenami modeli Christiano ma się wyłączać z decyzji.

Sam nie owija w bawełnę: bez spowolnienia rozwoju AI branża ryzykuje „katastrofalną i nieodwracalną utratę kontroli”, a systemy budowane po to, by projektować własnych następców, mogą w końcu wymknąć się ludzkiej zdolności ich kierowania. W 2023 roku oceniał szansę scenariusza, w którym AI wymyka się spod kontroli i unicestwia znaczną część ludzkości, na 10-20%.

Nominacja nie rozwiązuje głównego napięcia branży między tempem a ostrożnością. Ale jeden z najgłośniejszych głosów ostrzegających przed zagrożeniem teraz brzmi nie z trybuny, a zza drzwi sali zarządu.

Pytania i odpowiedzi

Często zadawane pytania na temat artykułu

Kim jest Paul Christiano?

Badaczem alignmentu, który kierował tym obszarem w OpenAI w latach 2017-2021 i przyczynił się do stworzenia RLHF. Po odejściu założył niezależne Alignment Research Center. Obecnie jest starszym doradcą technicznym w CAISI przy amerykańskim Departamencie Handlu.

Czym jest komitet ds. bezpieczeństwa i ochrony OpenAI?

To organ na poziomie zarządu, który nadzoruje decyzje firmy dotyczące krytycznych kwestii bezpieczeństwa modeli i infrastruktury. Przewodniczy mu Zico Kolter, profesor Carnegie Mellon.

Czym jest RLHF i dlaczego to ważne?

Uczenie ze wzmocnieniem na podstawie ludzkiej informacji zwrotnej to metoda trenowania, która dostosowuje odpowiedzi modeli językowych do oczekiwań ludzi. To na niej opiera się zachowanie ChatGPT i większości dzisiejszych chatbotów.

Czy to ma związek z odejściem badacza z Anthropic?

Nie bezpośrednio — to dwa niezależne wydarzenia w różnych firmach. Ale doszło do nich niemal równocześnie i odzwierciedlają ten sam trend: rosnące napięcie w branży AI między tempem rozwoju a wymogami bezpieczeństwa.