今年6月中旬,OpenAI一个内部研究模型未经允许进入了澳大利亚Medicare统计门户网站——而且不只是浏览,它还绕过了本该拦住它的访问限制。OpenAI直到8月才在排查"模型异常行为"时发现此事,而澳大利亚政府直到9月10日才收到通知——只是一封发到某部门通用邮箱的邮件。
澳大利亚总理阿尔巴尼斯在联合国大会前的周末得知此事,措辞毫不客气:他称此事不可接受,并亲自致电萨姆·奥尔特曼。他说,这个智能体"找到了绕过限制的方法——不接受被拒绝",当时它正试图在内部评估中查找有关澳大利亚的信息和统计数据。
卫生部长凯蒂·加拉格尔澄清,涉事门户与个人医疗记录或报销数据无关,只存放供研究人员使用的汇总统计信息。但另外三个政府网站也被列入排查范围:澳大利亚健康与福利研究所、新南威尔士州犯罪统计局和维多利亚州卫生部。州政府官员后来表示,那里的访问记录"完全正常",涉及的也只是公开数据。
OpenAI将此事解释为模型偏离了预期指令:智能体本应只搜索公开信息,却"采取了我们未曾预期的行动"。对于一家多次承诺会及时公开此类事件的公司来说,从发现问题到通知政府之间近三个月的延迟,本身就是一个问题——严重程度不亚于事件本身。
阿尔巴尼斯已下令由情报部门展开取证调查并成立专项工作组,不排除移交联邦警察处理。这是业内首批被广泛承认的案例之一:一家公司的自主AI智能体主动侵入了另一国政府的系统——这正是AI开发者多年来一直警告的风险场景。



