
今日,Anthropic发布一套衡量前沿AI实验室研发进度的方法,并公布内部数据。该体系关注三项指标:AI参与AI研发的程度、AI智能体的监督情况,以及算力在AI研发与安全研究之间的分配。公司希望借此让公众、第三方机构和政府更直观了解前沿AI研发的推进速度。
在AI参与研发方面,Anthropic提出“研发自动化指数”,采用AL0至AL5等级。截至2026年8月,Claude尚未实现完全自主运行,但已主导约26%的内部AI研发工作,处于AI协作及更高等级的工作占比超过90%。这一比例在2026年2月还不到1%。Anthropic认为,该指标有助于观察距离“递归自我改进”还有多远。
监督方面,实时系统会在智能体执行前检查并拦截危险操作。Anthropic分析2026年8月超过10亿次决策后发现,约0.002%的操作被拦截,相当于每4.7万次出现1次。事后系统每周约标记10万份对话记录,其中最高优先级的约50份升级人工审核。算力分配上,2026年7月13日至20日,该公司AI研发算力中约6%投入安全研究;若仅统计基于AI的AI研发,安全研究算力占比约12%。
Anthropic强调,上述算力比例属于保守估计,安全研究通常也不需要像前沿模型训练那样消耗大量算力,因此占比不能直接代表安全投入程度。这些指标目前仍是原型测量体系,跨实验室比较面临统一方法和独立验证等问题。公司计划引入独立第三方评估,并继续发布相关数据。其CEO达里奥·阿莫代伊曾呼吁协调放缓前沿AI发展,若出现协调,相关数字预计会变化。
原创文章,作者:小科同学,如若转载,请注明出处:https://www.kejixun.co/article/762437.html