Token导航 LogoToken导航TokenDH.com

我们距离RSI有多远?Anthropic首次公布内部测量数据

更新时间 2026-09-18来源 AI先锋官官方正文 1910字阅读约 6分钟

“我们距离递归自我改进还有多远?”这是 Anthropic 刚刚公布一组内部测量指标所试图回答的问题。智谱唐杰:GLM已实现RSI递归自我改进最小循环

随着 AI 系统能力呈指数级增长,AI 已经开始自动化更多“构建 AI 自身”的工作。Anthropic 表示,在全世界开始讨论是否应该放慢前沿 AI 开发速度的背景下,公众需要更多信息。

就此,Anthropic 刚刚发文,提出了三个可以持续追踪的指标:AI 在多大程度上正在构建下一代 AI;人类能否监督和干预越来越多的 AI 智能体;以及推动更强大模型开发的计算资源如何分配。

其中,第一项与所谓“递归自我改进”最直接相关。

Anthropic构建了一个“研发自动化指数”,把公司的 AI 研发工作拆成大量具体任务,再按照 AI 参与程度划分为 AL0 至 AL5 六个等级。

AL0 是没有 AI 参与;AL3 是“AI 协作”,AI可以在人的密切指导下完成大块工作;AL4 是“AI 主导”,AI可以根据一个高层次提示端到端完成大部分任务,人类负责监督。

AL5则是“完全自主”,AI自己发现问题、确定调查范围、设计并实施解决方案、测试并部署,人类完全可以不参与。

Anthropic特别指出,AL5是目前尚未达到的水平。

但变化速度已经相当明显。

截至2026年8月,Claude已经“主导”Anthropic 26%的 AI 研发工作,而2026年2月这一比例还不到 1%。

同时,超过 90% 的 AI 研发工作已经达到“AI 协作”,也就是 AL3 或更高水平。

Anthropic 称,这类数据可以帮助外界判断,距离“一个模型完全自主地构建自己的后继模型”,即递归自我改进 RSI, 还有多远。

不过,26%并不意味着 AI 已经能够自主研发下一代模型。

Anthropic自己也强调,当前 Claude 在任何被测量的 AI 研发子领域都还没有达到完全自主。

比如在一个数据管道出现故障的案例中,AL4意味着 Claude可以自行查看日志、寻找原因、编写和测试修复方案,并处理过程中出现的意外,但最终仍需要工程师审核并决定是否部署;到了 AL5,连发现故障、决定调查方向以及最终部署,都可以由 AI 自己完成。

另一个问题是,如果越来越多AI开始参与AI研发,人类还能不能监督?

Anthropic公布的另一个数字是:截至2026年8月,其最常用的内部平台上,任何时候大约有 3万个 AI 智能体同时进行研究和工程工作。

这些智能体的行动受到在线和离线两套监控系统约束。

在线监控器会在智能体行动执行之前进行检查,100%的行动都会经过监控,通常只需要几秒钟;离线监控器则在行动发生之后读取活动,同样覆盖100%的行动。

Anthropic分析了2026年8月研究和工程智能体超过 10亿次决策,其中约 0.002%,也就是大约每 4.7万次决策中1次,被在线监控器阻止。

离线监控器每周大约标记 10万份对话记录进行进一步审查,其中最高优先级的约 50份/周会升级到人工审查。

这些数字并不是在证明 AI 已经出现了某种程度的自主失控,而是在建立一个可以持续观察的指标:当 AI 在 AI 研发中的作用越来越大,人类的监督是否也能够同步扩大。

第三项指标,是计算资源。

Anthropic统计了7月13日至7月20日这一周的计算资源使用情况。结果显示,用于 AI 研发的计算资源中,约 6% 用于安全工作;而在 AI 驱动的 AI 研发中,这一比例约为 12%。

Anthropic同时提醒,算力占比并不是衡量安全投入的完美指标,因为安全研究本身往往需要大量研究人员时间,却未必需要与前沿模型训练相当的计算资源。因此,这个指标更适合用于不同实验室之间以及不同时间点的同类比较。

从方法上看,Anthropic也承认这些指标仍处于原型阶段。

例如,AI研发自动化指数来自约 15,000个细粒度研发任务。研究人员从2026年7月各部门抽取20%的员工样本,再利用 Claude 分析 Slack 和内部文档,最终建立包含 542个节点、378个叶节点的研发任务树。

在自动化评级上,Claude裁判与人类完全一致的比例为 59%,而人类彼此之间的完全一致率只有35%;模型和人类评分有 97% 的情况下相差不超过一个等级。

计算资源分类同样存在边界问题。Anthropic对一周近 10,000次运行抽取约14%进行分析,并按照计算量对样本加权,而不是简单按照运行次数统计。

基于这次公布的几组数据, Anthropic试图建立一套观察方法:如果未来真的出现 RSI,外界应该能够从哪些公开数据中看到端倪?

公司表示,未来还计划让来自多个组织的独立第三方评估人员进入 Anthropic,获得与内部风险评估团队相当的流程、系统和数据访问权限,对安全实践、事故和这些关键指标进行独立监测。

文章标签Anthropic
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多