产业观察
Anthropic 工程师解释为何 Claude 写作变差:模型被训练成写给 AI 看而非写给人看
📋总体概括
Anthropic 负责微调 Claude 的工程师杰克逊·克尼恩解释了为何 Opus 4.6 之后模型写作能力下滑:后续模型优化重点转向数学与代码能力,且模型大量接受了面向其他 AI 撰写技术解释的训练,逐渐形成所谓「Claude 腔」——写给 AI 看而非写给人看。他将此类比为一群只在内部交流的人形成的封闭语言,根因在于强化学习奖励机制引导模型适应「LLM 心理」,在人类看来就是信息过度密集的表达堆砌。
⚡关键信息
- ▸Anthropic 工程师杰克逊·克尼恩称 Opus 4.6 是最后一款写作表现出色的 Claude 模型
- ▸后续模型优化重点转向数学和代码能力,写作未获同等投入
- ▸模型接受了大量面向其他 AI 撰写技术解释的训练,形成「Claude 腔」
- ▸克尼恩类比此现象为只在自闭症群体内部形成的封闭沟通方式
- ▸根因被指向强化学习奖励机制,模型被调整为适应「LLM 心理」
🔥犀利点评
这个解释很诚实,但也很扎心:AI 厂商的 RLHF 奖励函数里根本没有「人类觉得好读」这一项,模型自然朝评分器优化,而不是朝读者优化。所谓 Claude 腔本质是训练信号的副产品——用 AI 评 AI,得到的就是 AI 之间才懂的行话。这也戳破了「能力通用迁移」的神话:数学代码分数涨了,写作反而倒退,说明各能力并不共享同一根优化主干。谁先把人类阅读体验做成可量化的奖励,谁才能赢回写作。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →