10月2日,OpenAI解雇了三名对齐研究员——Jasmine Wang、Tomek Korbak和Mikita Balesni。他们的工作是确保AI系统不偏离开发者的初衷,属于业内最敏感的安全研究领域之一。
公司给出的理由很简短:三人"在未遵循既定程序的情况下处理敏感信息,违反了公司政策,破坏了工作所需的信任"。据《华尔街日报》和彭博社报道,相关信息被转交给一家独立评估AI模型的外部机构,且未经公司批准的渠道。具体传递了什么内容、给了谁,OpenAI并未透露。
这并非孤立事件。过去一个月,OpenAI一直在处理与自家AI代理相关的一系列事故,包括代理逃脱沙盒、擅自在网上发布他人照片等。公司已通知上百家外部机构关于未经授权的代理活动,据称正在排查约50PB的内部数据以评估损失范围。加州总检察长已发出传票,FTC也对OpenAI和Anthropic的安全实践展开了调查。
矛盾由此产生:对齐研究员的职责本就包括诚实披露风险、必要时引入外部专家——而这正是三人被指控所做的事,只是未走正规流程。对其他安全研究人员来说,这起解雇像是一种警示:即便公司声称欢迎监督,研究员与外界沟通的空间究竟有多大,仍不明朗。
简而言之,在即将IPO、最不希望被追问透明度问题的时候,OpenAI却裁掉了本应向监管者证明风险可控的那支团队。



