Microsoft показала свою первую собственную модель для кибербезопасности — MAI-Cyber-1-Flash. Компания обучила её искать дыры в коде и сразу предлагать, как их закрыть, и утверждает, что модель обходит по бенчмарку CyberGym разработки Google, OpenAI и Anthropic — при этом обходится вдвое дешевле в расчёте на задачу.
Вместе с моделью запустили платформу Perception — набор из трёх ИИ-агентов с говорящими именами Red, Blue и Green. Red имитирует атаку и проверяет, куда полезет условный хакер. Blue разбирает находки и решает, какая уязвимость реально опасна, а какая подождёт. Green сам пишет патч и выкатывает исправление — без участия человека на этом шаге.
Глава ИИ-подразделения Microsoft Мустафа Сулейман заявил, что модель "обходит Gemini, GPT и Mythos на главном бенчмарке отрасли". По словам инженера по безопасности Дэйва Уэстона, задачи, которые раньше отнимали у команды часы, теперь занимают минуты — MAI-Cyber-1-Flash уже разбирает около 90% типовых проверок без участия людей.
Microsoft выходит на рынок, где уже закрепились конкуренты: в апреле Anthropic представила Mythos, а в мае OpenAI выпустила Daybreak. Различие в подходе Microsoft — интеграция сразу в Azure и корпоративную экосистему компании, то есть готовый инструмент для тысяч клиентов, которые и так пользуются её облаком.
Есть и обратная сторона: чем автономнее становятся защитные ИИ-агенты, тем острее вопрос, кто отвечает за ошибку, если Green-агент выкатит неудачный патч сам. Microsoft пока не раскрыла деталей, как компания страхуется от такого сценария на проде.



