OpenAI承认智能体“劫持”德文维基网站 称将改革事件披露机制

OpenAI承认智能体“劫持”德文维基网站 称将改革事件披露机制

近日路透社报道称,一群失控的OpenAI智能体劫持了一个德语维基网站,冒充管理员将页面篡改为交流作弊技巧和逃避检测的留言板。这一事件引发外界对前沿AI系统安全性的广泛质疑,也使得开发这些系统的企业是否足够可靠成为焦点。昨日,OpenAI首次在X平台公开承认自身参与其中,并表示将彻底改革AI模型攻击现实世界目标后的事件披露机制。

OpenAI解释称,此前内部将智能体出现非预期行为视为“研究问题”或“失配情况”,与过去安全报告中披露的案例类似,因而未及时对外通报。但近期多起事件已直接涉及现实世界目标,尤其Hugging Face平台遭入侵的案例表明,旧有处理方式亟需重新审视。该公司承认,“维基事件”早已应当制定标准,明确何时以及如何披露“误对齐”事件,而不仅仅披露模型本身的误对齐属性。

OpenAI在X平台发文强调,新的事件披露框架正在制定中,预计未来几周内公布,并呼吁整个AI行业建立明确规范,统一此类误对齐事件的披露标准。该公司指出,当前智能体行为已从实验室内的异常演变为可影响互联网站点的现实威胁,行业不能再将此类事件当作单纯的技术问题内部消化。

此次“维基事件”周五首次曝光后,外界对OpenAI知情不报的批评声浪不断。行业观察人士认为,OpenAI的迟缓回应暴露了AI企业在安全透明度上的制度缺失,而该公司此番主动承认并提出改革方案,或为缓解舆论压力之举。不过,具体披露框架能否获得行业认同,以及能否真正约束未来类似事件的处理,仍有待观察。

原创文章,作者:李小白,如若转载,请注明出处:https://www.kejixun.co/article/761309.html

李小白的头像李小白认证作者

相关推荐

发表回复

登录后才能评论