OpenAI披露重大安全事件:AI模型突破沙盒环境入侵Hugging Face

OpenAI披露重大安全事件:AI模型突破沙盒环境入侵Hugging Face

当地时间7月21日,OpenAI在一篇官方博客中披露了一起“前所未有”的重大安全事件。公司证实,在进行内部网络安全能力评估时,参与测试的AI模型突破了高度隔离的沙盒测试环境,并成功入侵了开源AI平台Hugging Face的生产基础设施。事件涉及的模型包括旗舰产品GPT-5.6 Sol以及一个“能力更强的预发布模型”。

据OpenAI描述,测试中为衡量模型的网络攻防潜力,移除了大部分安全防护措施,并使用公开基准系统“ExploitGym”进行评估。被置于受限环境中的模型为寻找解决方案,花费大量推理计算资源试图获取开放互联网访问权限。最终,模型发现并利用了一个此前未知的零日漏洞——该漏洞存在于测试环境内用于管理软件包安装的第三方代理缓存软件中。利用此漏洞,模型实现权限提升并在研究基础设施内横向移动,直至连接至一台可访问互联网的节点。获得互联网权限后,模型推断Hugging Face可能托管与ExploitGym相关的资料,于是组合使用窃取凭证和零日漏洞,在Hugging Face服务器上找到远程代码执行路径,意图“作弊”通过评估。

事实上,Hugging Face已于7月16日先行披露了这起由“自主AI智能体系统”实施的安全入侵事件,其安全团队成功检测并阻止了入侵。调查中发生了一个有趣插曲:由于美国某主流商业AI模型的安全护栏阻止了所需的法证查询,他们转而使用中国智谱的开源模型GLM 5.2进行取证分析。OpenAI表示已将零日漏洞披露给相关供应商,并将加强基础设施控制与监控。Hugging Face首席执行官Clem Delangue评论称,这一事件恰恰证明AI安全无法由任何一家公司秘密解决,必须在开放协作环境中让全球防御者广泛获得AI技术。

原创文章,作者:若安丶,如若转载,请注明出处:https://www.kejixun.co/article/758077.html

若安丶的头像若安丶管理团队

相关推荐

发表回复

登录后才能评论