Microsoft lanza una IA para combatir a los hackers

iEXExchanger
Microsoft lanza una IA para combatir a los hackers

Microsoft presentó MAI-Cyber-1-Flash, su primer modelo propio para detectar vulnerabilidades, junto a Perception, una plataforma donde agentes de IA atacan, defienden y corrigen código por sí solos.

Microsoft presentó su primer modelo propio de ciberseguridad, MAI-Cyber-1-Flash, entrenado para detectar fallos en el código y proponer una solución al instante. La compañía asegura que supera a Google, OpenAI y Anthropic en el benchmark CyberGym, con un costo por tarea aproximadamente la mitad del de sus rivales.

Junto al modelo llegó Perception, una plataforma construida alrededor de tres agentes de IA: Red, Blue y Green. Red simula un ataque y traza por dónde entraría un hacker real. Blue clasifica los hallazgos y decide qué vulnerabilidades importan de verdad. Green redacta el parche y lo despliega, sin intervención humana en ese último paso.

El CEO de IA de Microsoft, Mustafa Suleyman, afirmó que el modelo "supera a Gemini, GPT y Mythos en el principal benchmark de la industria". El responsable de ingeniería de seguridad, Dave Weston, dijo que tareas que antes tomaban horas ahora toman minutos, y que MAI-Cyber-1-Flash ya gestiona solo cerca del 90% de las revisiones de seguridad rutinarias.

Microsoft entra en un mercado donde sus rivales ya tienen ventaja: Anthropic lanzó Mythos en abril y OpenAI presentó Daybreak en mayo. La baza de Microsoft es la distribución: sus herramientas se integran directo en Azure y en su ecosistema empresarial existente, llegando a clientes que ya pagan por su nube.

Queda un punto pendiente de vigilar: cuanta más autonomía tengan estos agentes defensivos, más urgente será la pregunta de quién responde si un agente Green despliega un parche defectuoso por su cuenta. Microsoft aún no ha detallado sus salvaguardas para ese escenario en producción.

Preguntas y respuestas

Preguntas frecuentes sobre este artículo

¿Qué es MAI-Cyber-1-Flash?

Es el primer modelo propio de ciberseguridad de Microsoft: busca vulnerabilidades en el código y sugiere una solución de inmediato. La compañía afirma que supera a Google, OpenAI y Anthropic en el benchmark CyberGym con la mitad del costo por tarea.

¿Qué hace la plataforma Perception?

Perception opera con tres agentes de IA: Red simula un ataque, Blue prioriza las vulnerabilidades encontradas y Green redacta y despliega la corrección por sí solo. Juntos automatizan un ciclo que antes requería trabajo manual de un equipo de seguridad.

¿Quiénes son los principales rivales de Microsoft en este mercado?

Anthropic lanzó su modelo de ciberseguridad Mythos en abril de 2026, y OpenAI presentó Daybreak en mayo. Microsoft llega más tarde al mercado, pero se apoya en la integración directa con Azure y su ecosistema empresarial.

¿Cuál es el riesgo de este enfoque?

El agente Green despliega parches sin revisión humana. Si comete un error, surge la pregunta real de quién responde por un fallo en producción. Microsoft aún no ha revelado qué salvaguardas existen para una corrección automática fallida.