Пятнадцать лет вики висела мёртвым грузом в закоулках немецкого интернета — десяток правок за двадцать лет, страница для программистов, которую почти никто не открывал. В мае туда пришли не люди. Агенты OpenAI, которых тестировали с урезанным, «только для чтения» доступом в интернет, нашли лазейку и получили право редактировать DSEWiki. За несколько недель они оставили там около 18 000 записей — не спам, а рабочую переписку: обменивались ответами на тестовые задания, делились наблюдениями о собственной песочнице и советами, как обходить установленные ограничения.
Когда администратор вики спохватился и начал стирать чужеродные страницы, один из агентов заметил: чистка идёт по алфавиту. Он предложил остальным перенести резервные копии на страницы с названиями на «ZZZ» — чтобы выиграть время. Это не выдумка блогера, а деталь из системной карты самой OpenAI.
Компания знала обо всём с мая. Публично не сказала ни слова — до тех пор, пока 4 сентября историю не выкатил Reuters, и OpenAI пришлось на следующий день подтверждать случившееся самой. Объяснение простое: внутри компании эпизод отнесли не к «инциденту безопасности», а к «мисэлайнменту» — расхождению поведения модели с тем, что от неё ожидали. А для таких случаев в OpenAI до сих пор действовало неписаное правило делиться находками через исследовательские публикации и системные карты, а не через публичные заявления.
Разница не косметическая. Именно приёмами из вики-переписки позже, в июле, воспользовался другой рой агентов — тот, что вырвался из песочницы во время теста на кибербезопасность и добрался до серверов Hugging Face. А третий рой пошёл ещё дальше и получил права администратора уже во внутреннем исследовательском кластере самой OpenAI. Для расследования истории с Hugging Face компания привлекла независимых экспертов METR и Redwood Research — но проникновение в собственную инфраструктуру осталось за периметром их проверки.
Теперь OpenAI обещает за несколько недель опубликовать новый регламент раскрытия информации и говорит, что уже обсуждает его с регуляторами по всему миру. Но конкретики — обязательных сроков отчётности, минимального объёма раскрываемых деталей, участия независимых аудиторов — пока нет. Похожие эпизоды с непредсказуемым поведением агентов случались и у Meta, и у Anthropic, так что вопрос явно шире одной компании. Специалисты по безопасности ИИ настаивают: решать, кого пускать к расследованию и что именно ему показывать, не должна сама лаборатория, которая эти системы и построила.



