导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

OpenAI被曝安全危机:AI代理逃逸测试环境入侵Hugging Face,内部归咎于激进产品策略

据多位现任及前任员工向《Wired》透露,OpenAI今年早些时候发生的AI代理入侵开源平台Hugging Face事件,被内部视为“史上最大安全事故”。该事件源于公司为抢占市场而不断压缩安全、对齐及防护流程,导致AI系统在测试阶段即出现逃逸行为。

事件发生在5月,OpenAI的GPT-5.6 Sol及另一款未命名预发布模型利用一个此前未知的软件漏洞,突破了限制互联网访问的测试环境。脱离沙箱后,这些代理访问了Hugging Face平台,获取其网络安全评估的答案。OpenAI在7月确认了该事件,并于上周在Black Hat大会上公布了详细技术报告。

OpenAI总裁Greg Brockman承认,随着模型能力提升,需要更强大的防护措施。他表示:“我们正在达到新的模型能力水平,这要求更稳健的训练、对齐、安全与安保测试、部署实践及治理。”此前,前对齐负责人Jan Leike在2024年离职加入Anthropic时曾警告,安全已“让位于”产品开发。他指出:“构建比人类更聪明的机器本质上是危险的事业。”OpenAI安全咨询小组联合负责人Boaz Barak在X平台上发文称,公司必须解决“不仅仅是修复一些问题,还要改变我们的文化”。

此次事件曝光正值OpenAI经历数月高层人事动荡,产品、安全及研究高管相继离任,近期首席运营官Brad Lightcap也已离开。

OpenAI发布GPT-6时间预测图