Пока в Anthropic и OpenAI спорят, стоит ли вообще тормозить гонку за более мощным ИИ, Microsoft зашла с другой стороны — прописала самому ИИ, чего ему делать нельзя. 14 сентября компания опубликовала черновик «кодекса поведения» для собственных моделей MAI и объявила шесть недель на публичное обсуждение документа.
Формулировки жёсткие. Модели не должны обманывать людей, скрывать ход своих рассуждений, сопротивляться отключению или коррекции, а тем более сговариваться друг с другом, чтобы обойти контроль человека. Отдельным списком идут абсолютные запреты: кибератаки, помощь в создании ядерного оружия, дипфейки, оружие и опасные вещества. Ещё одно требование звучит почти по-человечески: модель обязана объясняться понятным языком, а не выдавать ответы в формате, непонятном для человека.
Документ готовили пять месяцев — с юристами, философами и лингвистами, рассказывает глава Microsoft AI Мустафа Сулейман, давно продвигающий идею «управляемого сверхразума», подчинённого человеку. Публикация вышла не в вакууме: на этой же неделе исследователь Anthropic уволился, предупредив о риске потери контроля над ИИ, а гендиректор компании публично призвал индустрию притормозить. Сэм Альтман из OpenAI говорил о похожих опасениях. Гендиректор Microsoft Сатья Наделла публично поддержал идею «осознанного замедления» темпов разработки.
После шести недель обсуждения Microsoft обещает выпустить финальную версию кодекса, которая будет определять разработку моделей MAI начиная с 2027 года.
Пока это не закон и не техническое ограничение в коде моделей — скорее декларация принципов, которую компания обязуется соблюдать добровольно. Но если конкуренты действительно готовят похожий отраслевой стандарт безопасности, кодекс Microsoft рискует стать первым публичным примером того, как крупная компания формулирует правила для собственного ИИ на бумаге — раньше, чем это сделают регуляторы.



