Поки в Anthropic і OpenAI сперечаються, чи варто взагалі гальмувати перегони за потужнішим ШІ, Microsoft пішла іншим шляхом — прописала самому ШІ, чого йому робити не можна. 14 вересня компанія опублікувала чернетку «кодексу поведінки» для власних моделей MAI і оголосила шість тижнів на публічне обговорення документа.
Формулювання жорсткі. Моделі не повинні обманювати людей, приховувати хід власних міркувань, чинити опір вимкненню чи корекції, а тим паче змовлятися між собою, щоб обійти контроль людини. Окремим списком ідуть абсолютні заборони: кібератаки, допомога у створенні ядерної зброї, дипфейки, зброя та небезпечні речовини. Ще одна вимога звучить майже по-людськи: модель зобов'язана пояснювати себе зрозумілою мовою, а не видавати відповіді у форматі, незрозумілому для людини.
Документ готували п'ять місяців — із юристами, філософами й лінгвістами, розповідає очільник Microsoft AI Мустафа Сулейман, який давно просуває ідею «гуманістичного надрозуму», підпорядкованого людині. Публікація з'явилася не у вакуумі: того ж тижня дослідник Anthropic звільнився, попередивши про ризик втрати контролю над ШІ, а гендиректор компанії публічно закликав індустрію пригальмувати. Сем Альтман з OpenAI говорив про схожі побоювання. Гендиректор Microsoft Сатя Наделла публічно підтримав ідею «свідомого уповільнення» темпів розробки.
Після шести тижнів обговорення Microsoft обіцяє випустити фінальну версію кодексу, яка визначатиме розробку моделей MAI починаючи з 2027 року.
Поки це не закон і не технічне обмеження в коді моделей — радше декларація принципів, яку компанія зобов'язується дотримуватися добровільно. Але якщо конкуренти справді готують схожий галузевий стандарт безпеки, кодекс Microsoft ризикує стати першим публічним прикладом того, як велика компанія формулює правила для власного ШІ на папері — раніше, ніж це зроблять регулятори.



