Microsoft показала свою першу власну модель для кібербезпеки — MAI-Cyber-1-Flash. Її навчили шукати дірки в коді й одразу пропонувати, як їх закрити, а компанія стверджує, що за бенчмарком CyberGym модель випереджає розробки Google, OpenAI та Anthropic — і при цьому обходиться вдвічі дешевше за задачу.
Разом із моделлю запустили платформу Perception — трьох ШІ-агентів під іменами Red, Blue і Green. Red імітує атаку й перевіряє, куди поліз би реальний хакер. Blue розбирає знахідки і вирішує, яка вразливість справді небезпечна. Green сам пише патч і викочує виправлення — без участі людини на цьому кроці.
Керівник ШІ-напрямку Microsoft Мустафа Сулейман заявив, що модель "випереджає Gemini, GPT і Mythos на головному бенчмарку галузі". За словами інженера з безпеки Дейва Вестона, завдання, що раніше забирали години, тепер займають хвилини — MAI-Cyber-1-Flash вже самостійно опрацьовує близько 90% типових перевірок.
Microsoft виходить на ринок, де конкуренти вже встигли закріпитися: у квітні Anthropic представила Mythos, у травні OpenAI випустила Daybreak. Перевага Microsoft — у дистрибуції: інструменти одразу вбудовані в Azure та корпоративну екосистему компанії, тож доступні тисячам клієнтів, які й так користуються її хмарою.
Є й зворотний бік. Що більше автономії отримують захисні ШІ-агенти, то гостріше постає питання, хто відповідає за помилку, якщо агент Green сам викотить невдалий патч. Поки Microsoft не розкрила деталей, як компанія убезпечує себе від такого сценарію на проді.



