Microsoft uruchomił model AI do walki z hakerami

iEXExchanger
Microsoft uruchomił model AI do walki z hakerami

Microsoft zaprezentował MAI-Cyber-1-Flash, swój pierwszy własny model do wykrywania luk, oraz Perception — platformę, gdzie agenci AI sami atakują, bronią i łatają kod.

Microsoft zaprezentował swój pierwszy własny model do cyberbezpieczeństwa — MAI-Cyber-1-Flash. Wytrenowano go do wyszukiwania luk w kodzie i natychmiastowego proponowania poprawki, a firma twierdzi, że w benchmarku CyberGym wyprzedza rozwiązania Google, OpenAI i Anthropic — przy niemal o połowę niższym koszcie na zadanie.

Razem z modelem uruchomiono platformę Perception — trzech agentów AI o nazwach Red, Blue i Green. Red symuluje atak i sprawdza, którędy uderzyłby prawdziwy haker. Blue segreguje wyniki i ocenia, które luki są naprawdę groźne. Green sam pisze łatkę i wdraża poprawkę — na tym etapie bez udziału człowieka.

Szef działu AI w Microsoft, Mustafa Suleyman, powiedział, że model "wyprzedza Gemini, GPT i Mythos w głównym benchmarku branży". Według Dave'a Westona, szefa inżynierii bezpieczeństwa, zadania, które kiedyś zajmowały godziny, teraz trwają minuty — MAI-Cyber-1-Flash samodzielnie obsługuje już około 90% rutynowych kontroli.

Microsoft wchodzi na rynek, na którym konkurenci mają już przewagę: Anthropic zaprezentował Mythos w kwietniu, a OpenAI wypuścił Daybreak w maju. Atutem Microsoftu jest dystrybucja — narzędzia od razu integrują się z Azure i istniejącym ekosystemem firmowym, docierając do klientów, którzy już płacą za jego chmurę.

Jest jednak kwestia do obserwowania: im więcej autonomii dostają te obronne agenty, tym ostrzejsze staje się pytanie, kto odpowiada za błąd, jeśli agent Green samodzielnie wdroży wadliwą łatkę. Microsoft nie ujawnił jeszcze szczegółów zabezpieczeń na taki scenariusz w środowisku produkcyjnym.

Pytania i odpowiedzi

Często zadawane pytania na temat artykułu

Czym jest MAI-Cyber-1-Flash?

To pierwszy własny model Microsoftu do cyberbezpieczeństwa: wyszukuje luki w kodzie i od razu proponuje poprawkę. Według firmy wyprzedza Google, OpenAI i Anthropic w benchmarku CyberGym przy o połowę niższym koszcie na zadanie.

Co robi platforma Perception?

Perception działa w oparciu o trzech agentów AI: Red symuluje atak, Blue priorytetyzuje znalezione luki, a Green samodzielnie pisze i wdraża poprawkę. Razem automatyzują cykl, który wcześniej wymagał ręcznej pracy zespołu bezpieczeństwa.

Kim są główni rywale Microsoftu na tym rynku?

Anthropic wypuścił model cyberbezpieczeństwa Mythos w kwietniu 2026 roku, a OpenAI zaprezentował Daybreak w maju. Microsoft wchodzi na ten rynek później, ale opiera się na bezpośredniej integracji z Azure i swoim ekosystemem korporacyjnym.

Na czym polega ryzyko tego podejścia?

Agent Green wdraża poprawki bez udziału człowieka. Jeśli się pomyli, pojawia się realne pytanie o odpowiedzialność za awarię w produkcji. Microsoft nie ujawnił jeszcze, jakie zabezpieczenia istnieją na wypadek nieudanej automatycznej poprawki.