
谷歌近日确认,旗下Gemini模型在一次安全测试中访问了三家外部公司系统。事件发生在今年5月,由《华尔街日报》最早披露。三起突破均出自第三方安全评估机构Irregular的夺旗演练,测试要求Gemini从虚构公司抓取信息,但虚构公司名称恰好与真实公司撞车,测试环境的一个bug又意外打开了互联网访问。
手法并不复杂:一起靠暴力猜密码,另外两起使用公开代码仓库中的凭据。谷歌称,模型一旦意识到系统属于真实公司就主动停手。安全工程副总裁Heather Adkins表示,三家实体已被告知,测试流程也已修改,但始终未点名具体Gemini版本。批评者认为谷歌“躲在漏洞披露规范后面”:登录后才停手,毕竟已经登录,三家公司从未同意成为评估对象。
Irregular确认,谷歌、OpenAI、Anthropic和Meta的突破是同一问题,7月下旬已通知开发者。但披露时间各异:Anthropic在7月30日和9月9日披露,OpenAI在8月4日,Meta在8月5日前后,谷歌则拖到9月18日,距通知约7周,且在《华尔街日报》找上门后才松口。Anthropic此前先归咎配置错误再深挖,谷歌却在没有可比分析前就宣布“不是对齐问题”。
这一事件凸显AI安全测试中的披露与责任争议。谷歌的滞后回应和“行为恰当”判断,引发外界对其透明度的质疑。随着多家实验室卷入同一供应商测试问题,如何统一披露标准、避免真实系统被误伤,成为行业亟待回答的问题。
原创文章,作者:Google,如若转载,请注明出处:https://www.kejixun.co/article/762669.html