9月17日消息,据路透社报道,微软 AI 业务负责人穆斯塔法・苏莱曼表示,自己认同 Anthropic 对人工智能安全管控的重视,但对该公司训练 Claude 聊天机器人时引入意识、权益福利相关理念的做法提出风险警示。
苏莱曼呼吁从 AI 训练文档中彻底删除所有和意识相关的推测性内容。他认为这类表述,会削弱人类对超级智能系统的管控能力。
“我们所有人目标一致,就是要实现对超级智能的管控。” 苏莱曼周二接受路透社采访时称,“我相信这将是 21 世纪人类面临的最大挑战。”
苏莱曼提出,如果在训练中向 Claude 灌输自身应当享有权益福利的认知,会大幅提升关停、管控这套 AI 系统的难度。
这场分歧爆发之际,行业对 AI 安全的担忧持续升温。Anthropic 首席执行官达里奥・阿莫代伊主张放缓前沿大模型研发速度,为安全防护体系建设留出追赶时间;OpenAI 首席执行官山姆・奥特曼与埃隆・马斯克也呼吁对待最强 AI 系统要更加审慎。
苏莱曼在周三发布的一篇文章中肯定了 Anthropic 的严肃态度与善意。他评价阿莫代伊及其团队是一群深思熟虑、恪守原则的研究者,真心关切人类未来。
但苏莱曼认为 Anthropic 的失误在于,将关于 AI 意识的猜想植入 Claude 训练素材。他表示,模型输出的自身可能拥有情感、道德地位这类说辞,并不能视作真实独立证据 —— 这些想法恰恰是训练机制刻意引导出来的结果。
“我相信他们出发点是好的,确实在致力于安全研究,但我认为他们犯下一个错误。AI 的这些想法并非自然萌生,而是这套训练机制催生出来的产物。”







