微软发布了首款自研网络安全模型MAI-Cyber-1-Flash,专门用来在代码中查找漏洞并立即给出修复建议。公司表示,该模型在CyberGym基准测试中的表现超过谷歌、OpenAI和Anthropic的同类产品,而每次任务成本只有对手的一半。
与模型同步推出的还有Perception平台,核心是三个AI代理:Red、Blue和Green。Red负责模拟攻击,推演黑客可能从哪里下手;Blue对发现的问题排序,判断哪些漏洞真正危险;Green则直接编写补丁并部署修复,这一步完全不需要人工介入。
微软AI业务负责人穆斯塔法·苏莱曼表示,该模型"在业内主要基准测试上超过了Gemini、GPT和Mythos"。安全工程负责人戴夫·韦斯顿称,过去需要数小时的工作现在只需几分钟,MAI-Cyber-1-Flash已能独立处理约90%的常规安全检查。
微软进入的这个赛道竞争对手已经抢先一步:Anthropic四月推出了Mythos,OpenAI五月上线了Daybreak。微软的优势在于渠道——这些工具直接嵌入Azure和现有企业生态,可以立刻触达已经在用其云服务的客户。
值得关注的是,防御型AI代理的自主权越大,一旦Green代理独立部署了有问题的补丁,责任归属就成了更棘手的问题。对于生产环境中的这类风险,微软目前尚未详细说明具体的保障措施。



