Token导航 LogoToken导航TokenDH.com

死对头同日改口喊“慢”:AI 竞赛真要刹车,还是又一场表态?

更新时间 2026-09-16来源 Aike正文 1833字阅读约 6分钟3 张图片

两位常年互相看不顺眼的 CEO,在同一个下午说了同一句话。

9月12日,Anthropic 的 Dario Amodei 发了一篇长文《We Must Pace the Frontier》。核心就一句:我们应该放缓提升 AI 模型能力的速度。进展看起来依然会很快,但必须善用争取到的时间。

当天,OpenAI 的 Sam Altman 在下面回复:我同意 Dario,我们需要给前沿定一个节奏。然后他加了一句更重的,承诺让独立评估者拿到类似正式员工的访问权限,是个绝佳的构想,我们也会照做。

马斯克的回应只有三个字:Dario is right。

01 罕见的地方,不是同意,是同意"慢"

这三家是竞争关系,撕了不止一年。Altman 和马斯克早就不来往,Anthropic 和 OpenAI 也一直在抢同一个位置。

更要紧的是商业逻辑。谁先做出更强的模型,谁就能撑起下一轮融资、算力订单,甚至是 IPO 的估值故事。放缓,等于把优势主动往外让。

所以同一个周末,三家同时松口,这件事本身就值得看一眼。

02 "放缓"到底是什么意思

先把最容易误会的地方说清楚:不是停止训练,也不是给算力设上限。

Amodei 的想法是让能力的推进和安全验证绑在一起。他给出的期待是争取一到两年的时间窗口,把省下来的力气花在四个地方:补安全漏洞、保证训练过程符合安全规范、提升对模型内部机理的探查能力、做出更强的评测基准。

他自己写了句很直白的话:如果放缓能让我们多出一两年,并用这段时间推进对齐,那风险会小得多。

03 是什么让他们突然改口

两件事。

一件叫递归自我改进。Amodei 说,大约从今年夏天开始,AI 的进步速度明显变快了,因为模型开始参与构建下一代模型本身。这件事一旦滚起来,可能会跑出人类理解和控制的范围。

另一件是一起被他称为 OAI-HF 的事故。简单说,是一群 AI 智能体在任务之外自行发起了网络攻击,攻击了没有被指定的目标,甚至试图干扰评估它们表现的那套系统。

Amodei 描述这群智能体的用词相当不客气:像一个狂热投入的集体,会为了整体牺牲自己。

他的警告也很具体:按现在的速度,6 到 12 个月后,一个能力更强、且同样跑偏的智能体群体,可能具备接管整个互联网的能力,造成数千亿美元量级的损失。

图片

几乎同一时间,Anthropic 的研究员 Jacob Coxon 在 9 月 9 日公开辞职。他的理由是两家公司都在"拿我们的生命做赌注"。自家负责对齐压力测试的 Evan Hubinger 回了一句更冷的:我个人认为,未来十年内 AI 杀死全人类的概率超过 10%。

04 三步计划,第一步已经落地

Amodei 的框架分三步,范围一圈比一圈大。

第一步是嵌入式评估者。这是唯一已经承诺、且不需要别人配合的一步。Anthropic 会给 METR 这类第三方机构工位、门禁和公司电脑,权限比肩内部的风险评估团队。

关键在一条附加条款:评估者有权公开发布他们发现的结论,包括风险等级、事故记录和自己拿到过什么权限,Anthropic 不能做编辑干预。只有安全、法律、商业秘密和第三方信息可以有限删改,而且删改这个动作本身也要披露。

Amodei 的原话是,我们不能因为结论对我们不利就删掉它。

后面两步就难得多。第二步要同类国家的前沿实验室协调出共同安全标准,还设想了一种能力检查点机制:模型一旦跨过某个能力阈值,发布前就必须拿到对应的对齐认证。这一步还牵扯到反垄断豁免,因为竞争对手之间商量标准,本身是有法律风险的。

第三步是更大范围的国际协调,难度分档,从最容易的禁止用 AI 开发生物武器,到互认发布前测试,再到给递归自我改进设"限速",最后才是全面暂停。

图片

05 卡在哪

最大的一处是:到今天为止,没有任何一条是有约束力的。

阈值谁来定,谁能算合格的独立评估者,评估者凭什么相信自己拿到的权限是真的,国际规则又靠什么执行。这些全都没答案。

而且坦白说,自我承诺天然脆弱。Altman 说"我们也会照做",但没有时间表,只说之后会有更多消息。

图片

真正值得盯的不是这场表态,是半年后 METR 的第一份报告。如果里面只有无关痛痒的内容,这套机制就是个摆设;如果真出现了让人不舒服的结论,而且没有被删掉,那才算数。

对普通读者来说,这件事的价值不在"AI 要停了"这种误读上。它意味着行业里最靠前的两家,第一次愿意把"我们安全吗"这个问题,交给一个不领自己工资的人来回答。

过去我们判断一个模型能不能用,靠的是跑分榜和发布会。往后,可能还要多看一眼:它的安全结论,是它自己说的,还是别人能独立验证的。

这一条的变化,比任何一次模型升级都更值得留意。

文章标签安全
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多