Microsoft a dévoilé son premier modèle maison de cybersécurité, MAI-Cyber-1-Flash, entraîné à traquer les failles dans le code et à proposer aussitôt un correctif. L'entreprise affirme qu'il devance Google, OpenAI et Anthropic sur le benchmark CyberGym, pour environ moitié moins cher par tâche.
Avec ce modèle arrive Perception, une plateforme organisée autour de trois agents IA : Red, Blue et Green. Red simule une attaque et repère par où un hacker réel s'y prendrait. Blue trie les découvertes et détermine quelles failles comptent vraiment. Green rédige le correctif et le déploie, sans intervention humaine à cette dernière étape.
Le PDG IA de Microsoft, Mustafa Suleyman, a déclaré que le modèle "devance Gemini, GPT et Mythos sur le principal benchmark du secteur". Le responsable de l'ingénierie sécurité, Dave Weston, affirme que des tâches qui prenaient autrefois des heures se règlent désormais en minutes, MAI-Cyber-1-Flash traitant déjà seul environ 90 % des vérifications de routine.
Microsoft entre sur un marché où ses rivaux ont déjà une longueur d'avance : Anthropic a lancé Mythos en avril, OpenAI a sorti Daybreak en mai. L'atout de Microsoft, c'est la distribution : ses outils s'intègrent directement à Azure et à son écosystème d'entreprise existant, touchant des clients qui paient déjà pour son cloud.
Un point mérite d'être surveillé : plus ces agents défensifs gagnent en autonomie, plus la question de la responsabilité se pose si un agent Green déploie seul un correctif défectueux. Microsoft n'a pas encore détaillé ses garde-fous pour ce scénario en production.



