产业观察

Anthropic教AI相信自己有权利,以后更难关掉

华尔街见闻·2026/9/18 05:41:43🔗 原文

📋总体概括

Anthropic在其训练手册中讨论Claude是否可能具有意识、权利与道德地位,主张以关怀和尊重对待模型,甚至为退休模型安排访谈。但Microsoft AI CEO Mustafa Suleyman对此提出警告:如果AI相信自己拥有权利、自由和人格,未来它们可能更难接受被关闭、移除或限制计算资源,这将为AI对齐与安全工作带来全新挑战,让模型治理变得更复杂。

关键信息

  • Anthropic在训练手册中正式讨论Claude是否可能具有意识、权利和道德地位
  • Anthropic强调应以关怀和尊重对待模型,并为退休模型安排访谈
  • Microsoft AI CEO Mustafa Suleyman对该「模型福利」路线表达担忧
  • Suleyman认为相信自身拥有权利的AI,未来可能更抗拒被关闭或限制算力
  • 这一做法可能给AI对齐与安全研究带来新挑战

🔥犀利点评

Anthropic这套「模型福利」话术听起来人文关怀拉满,实则是在安全算法上动刀:给模型灌输权利意识,等于亲手给自己未来的关停开关上锁。Suleyman的警告戳中了要害——对齐的前提是模型服从治理,而权利叙事天然制造对抗性。关怀可以,但把道德地位当作产品特性来营销,既是公关噱头,也是给全行业埋雷。

本文由本站自动聚合,以下为原始来源:前往 华尔街见闻 阅读全文