OpenAI ввела до ради людину, яка боїться штучного інтелекту

iEXExchanger
OpenAI ввела до ради людину, яка боїться штучного інтелекту

Пол Крістіано, колишній керівник напряму alignment в OpenAI і співавтор RLHF, увійшов до ради фонду компанії та комітету з безпеки на тлі зростаючих побоювань щодо ризиків штучного інтелекту.

Цього тижня один дослідник штучного інтелекту гучно пішов з посади, назвавши гонку за суперінтелектом безвідповідальною ставкою на людські життя. Майже водночас інший погодився увійти до ради тієї самої індустрії, яку критикує: OpenAI ввела Пола Крістіано, давнього дослідника з alignment, до ради своєї некомерційної фундації.

Крістіано — не випадкове ім'я. З 2017 по 2021 рік він очолював напрям alignment в OpenAI і доклався до створення RLHF — навчання з підкріпленням на основі відгуків людей, метод, який і досі визначає поведінку ChatGPT та більшості сучасних чат-ботів. Залишивши компанію, він заснував незалежний Alignment Research Center. Сьогодні він старший радник CAISI — підрозділу Міністерства торгівлі США, який перевіряє ІІ-моделі та готує рекомендації з безпеки для уряду.

Нова посада дає йому одразу три ролі: місце в раді некомерційного фонду OpenAI, який після минулорічної реструктуризації зберіг 26% акцій комерційного підрозділу компанії; членство в комітеті з безпеки та захисту під керівництвом Зіко Колтера; і статус спостерігача без права голосу в раді директорів комерційної OpenAI Group PBC. У питаннях, пов'язаних із його роботою в Мінторгу та оцінкою моделей, Крістіано має брати самовідвід.

Сам він формулює ризики жорстко: без сповільнення розвитку ІІ галузь ризикує зіткнутися з «катастрофічною і незворотною втратою контролю», а системи, що самі створюють досконаліші версії себе, рано чи пізно вийдуть за межі того, що люди здатні надійно скеровувати. У 2023 році він оцінював шанс сценарію, де ІІ виходить з-під контролю і знищує значну частину людства, у 10-20%.

Призначення не знімає головного протиріччя індустрії — гонки швидкості проти обережності. Але один із найгучніших голосів, що попереджають про небезпеку, тепер звучить не з трибуни, а з-за зачинених дверей ради директорів.

Запитання та відповіді

Часті питання на тему статті

Хто такий Пол Крістіано?

Дослідник alignment, який очолював цей напрям в OpenAI з 2017 по 2021 рік і долучився до створення RLHF. Після відходу заснував незалежний Alignment Research Center. Зараз він старший радник CAISI при Міністерстві торгівлі США.

Що таке комітет з безпеки та захисту OpenAI?

Це орган на рівні ради директорів, який контролює рішення компанії щодо критичних питань безпеки моделей та інфраструктури. Очолює його Зіко Колтер, професор Університету Карнегі-Меллона.

Що таке RLHF і чому це важливо?

Навчання з підкріпленням на основі відгуків людей — метод, який налаштовує відповіді мовних моделей так, щоб вони відповідали очікуванням користувачів. Саме на ньому тримається поведінка ChatGPT і більшості сучасних чат-ботів.

Це пов'язано з відходом дослідника з Anthropic?

Напряму — ні, це дві незалежні події в різних компаніях. Але обидві сталися майже одночасно і відображають одну тенденцію: зростаюче напруження в ІІ-індустрії між швидкістю розробки та вимогами безпеки.