
据CNBC报道,Anthropic CEO Dario Amodei提议将独立第三方安全评估员长期嵌入前沿AI公司,赋予其接近内部风险团队的访问权,并可在有限删减下自主发布调查结果。他援引银行业嵌入式监管为先例,还警告未来6至12个月,错位智能体群可能抢占互联网大部分并造成数千亿美元损失。此前,Anthropic前研究员Jacob Coxon辞职警告,前沿实验室正竞相追逐可能失控的系统。该提议已引发AI社区及政府内部监管分歧。
但多位银行业监管专家和AI评估从业者指出,该方案缺乏银行监管者的强制执行权。怀俄明大学法学院院长Julie Andersen Hill说,银行监管者可常驻大银行,访问内部系统与员工,指令停止业务、限制增长、强制管理层变动,极端下可关闭银行;而拟议评估员只能调查和报告,无法阻止模型训练或发布。“两者权力不可同日而语,”她说。
网络安全公司XBOW的AI负责人Albert Ziegler说,团队已提前接触Anthropic、OpenAI等未发布模型。日常评估并不像生存威胁叙事那样惊险,判断系统是否危险需访问指令、工具权限、安全控制和日志,重大风险也可能只在从未触发的条件组合下出现。他说评估者没有否决权,能迫使开发者做出知情决定,但最终决定权仍归公司。
Hill也承认,银行监管模式并不完美:未能防止重大倒闭,危机后常被指与监管对象关系过近,持续监管成本高,可能加强大企业、加大小型竞争者进入难度。Amodei的提议因此仍在AI社区和政府内部引发争论。
原创文章,作者:泡沫大盗,如若转载,请注明出处:https://www.kejixun.co/article/762307.html