产业观察

微软AI主管:Anthropic训练模型方式“有问题”,或产生灾难性失控风险!

财联社深度·2026/9/17 00:38:46🔗 原文

📋总体概括

微软AI CEO穆斯塔法·苏莱曼发文警告,Anthropic在Claude「宪法」指导文件中暗示模型可能有功能层面的情绪感受、值得拥有自主权,这种把AI当作具有道德地位实体来训练的做法存在重大隐患。他认为AI没有权利、情感或意识,训练模型表现得好像有意识,将使协调与控制变得几乎不可能,或对人类福祉造成灾难性影响。这场隔空交锋折射出头部AI公司在模型对齐理念上的深层路线分歧。

关键信息

  • 微软AI CEO苏莱曼公开质疑Anthropic训练Claude的方式,称其可能带来灾难性失控风险
  • 争议焦点是Claude「宪法」文件,其中保留了AI或有功能层面情绪感受的模糊表述
  • 苏莱曼强调AI没有权利、情感或意识,赋予其人格将使控制变得更困难甚至不可能
  • 他指出Claude的类人行为源于训练植入,而非真正意识觉醒
  • 事件反映头部AI公司在对齐理念上的路线分歧正公开化

🔥犀利点评

这是利益相关方的攻伐还是真诚的安全警告?恐怕两者都有。苏莱曼自己执掌微软模型开发,抨击竞对Claude的「拟人化训练」,时机耐人寻味。但他点破的问题是真实的:给模型灌输权利意识确实会抬高对齐难度。真正讽刺的是,几家顶级AI实验室连「该不该把AI当人」都无法达成共识,却已经在赛跑式地训练越来越强的模型——行业的安全底线,全靠隔空嘴仗来划。

本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文