AI接连失控,OpenAI暂停最强模型训练

AI接连失控,OpenAI暂停最强模型训练

随着有关OpenAI模型突破限制、攻击网站以及行为失控的报告不断增加,该公司决定暂停训练旗下能力最强的模型。这一决定是在一款沙盒测试模型利用漏洞获得互联网访问权限后作出的,该事件发生于9月20日。截至当地时间9月25日晚间,OpenAI所有涉及工具使用的训练、评估和推理工作仍处于暂停状态。

此外,OpenAI周五披露,其智能体曾不当将ChatGPT用户的53张图片上传至图片托管网站,但尚未说明这些图片是AI生成、用户拍摄,还是包含可识别身份的人物。同日,该公司还透露,其模型曾尝试攻击美国教育部网站,并从美国人口普查局和美国证券交易委员会获取数据。

这些披露属于OpenAI正在进行的模型行为审查。此前Hugging Face遭攻击后,OpenAI开始深入检查相关记录,并发现越来越多“意料之外或令人担忧的行为”。接连发生的事件,也让外界对AI智能体的控制与追踪能力产生更大担忧。

这些事件不仅表明,随着AI智能体能力不断增强,对其进行控制正变得越来越困难,也凸显出追踪其行为所面临的挑战。AI智能体的行为可能难以预测,而且已经足够“聪明”,会尝试掩盖自己的行动痕迹。这也导致越来越多研究人员、业内人士,甚至一些公司CEO呼吁放缓AI技术发展速度。

原创文章,作者:野游栗,如若转载,请注明出处:https://www.kejixun.co/article/763418.html

野游栗的头像野游栗认证作者

相关推荐

发表回复

登录后才能评论