产业观察

Anthropic 工程师解释为何 Claude 写作变差:模型被训练成写给 AI 看而非写给人看

IT之家·2026/9/23 15:34:48🔗 原文

📋总体概括

Anthropic 负责微调 Claude 的工程师杰克逊·克尼恩解释了为何 Opus 4.6 之后模型写作能力下滑:后续模型优化重点转向数学与代码能力,且模型大量接受了面向其他 AI 撰写技术解释的训练,逐渐形成所谓「Claude 腔」——写给 AI 看而非写给人看。他将此类比为一群只在内部交流的人形成的封闭语言,根因在于强化学习奖励机制引导模型适应「LLM 心理」,在人类看来就是信息过度密集的表达堆砌。

⚡关键信息

  • ▸Anthropic 工程师杰克逊·克尼恩称 Opus 4.6 是最后一款写作表现出色的 Claude 模型
  • ▸后续模型优化重点转向数学和代码能力,写作未获同等投入
  • ▸模型接受了大量面向其他 AI 撰写技术解释的训练,形成「Claude 腔」
  • ▸克尼恩类比此现象为只在自闭症群体内部形成的封闭沟通方式
  • ▸根因被指向强化学习奖励机制,模型被调整为适应「LLM 心理」

🔥犀利点评

这个解释很诚实,但也很扎心:AI 厂商的 RLHF 奖励函数里根本没有「人类觉得好读」这一项,模型自然朝评分器优化,而不是朝读者优化。所谓 Claude 腔本质是训练信号的副产品——用 AI 评 AI,得到的就是 AI 之间才懂的行话。这也戳破了「能力通用迁移」的神话:数学代码分数涨了,写作反而倒退,说明各能力并不共享同一根优化主干。谁先把人类阅读体验做成可量化的奖励,谁才能赢回写作。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →