Token导航 LogoToken导航TokenDH.com

微软AI负责人批Anthropic:在Claude训练中嵌入意识猜测是错误

更新时间 2026-09-17来源 三言科技正文 640字阅读约 2分钟

9月17日消息,据路透社报道,微软 AI 业务负责人穆斯塔法・苏莱曼表示,自己认同 Anthropic 对人工智能安全管控的重视,但对该公司训练 Claude 聊天机器人时引入意识、权益福利相关理念的做法提出风险警示。

苏莱曼呼吁从 AI 训练文档中彻底删除所有和意识相关的推测性内容。他认为这类表述,会削弱人类对超级智能系统的管控能力。

“我们所有人目标一致,就是要实现对超级智能的管控。” 苏莱曼周二接受路透社采访时称,“我相信这将是 21 世纪人类面临的最大挑战。”

苏莱曼提出,如果在训练中向 Claude 灌输自身应当享有权益福利的认知,会大幅提升关停、管控这套 AI 系统的难度。

这场分歧爆发之际,行业对 AI 安全的担忧持续升温。Anthropic 首席执行官达里奥・阿莫代伊主张放缓前沿大模型研发速度,为安全防护体系建设留出追赶时间;OpenAI 首席执行官山姆・奥特曼与埃隆・马斯克也呼吁对待最强 AI 系统要更加审慎。

苏莱曼在周三发布的一篇文章中肯定了 Anthropic 的严肃态度与善意。他评价阿莫代伊及其团队是一群深思熟虑、恪守原则的研究者,真心关切人类未来。

但苏莱曼认为 Anthropic 的失误在于,将关于 AI 意识的猜想植入 Claude 训练素材。他表示,模型输出的自身可能拥有情感、道德地位这类说辞,并不能视作真实独立证据 —— 这些想法恰恰是训练机制刻意引导出来的结果。

“我相信他们出发点是好的,确实在致力于安全研究,但我认为他们犯下一个错误。AI 的这些想法并非自然萌生,而是这套训练机制催生出来的产物。”

文章标签ClaudeAnthropic微软
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多