科技·商业·财经

Claude 写作能力退化了!工程师解释:模型被训成“写给 AI 看”而非“写给人看”

   时间:2026-09-24 10:03 作者:CHINAZ

不少人发现,AI 模型在数学、编程和推理上进步飞快,写作水平却停滞甚至退步,Anthropic 的 Claude 同样如此。为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师克尼恩昨日给出了解释。

Opus 4.6 之后为何写作退步

克尼恩表示,后续模型的优化重点更多放在了数学和代码能力上。与此同时,这些模型还接受了大量“面向其他 AI 模型撰写技术解释”的训练——而这正是 Claude 逐渐形成奇特表达方式、即所谓“Claude 腔”(Claudeish)的主要原因。

他解释,模型被调整得适应 LLM 的“心理”,最终学会了写给 AI 模型看,而不是写给人看。克尼恩把这种现象类比为“只与其他自闭症人士交流的人”:这类群体会逐渐形成一套在内部沟通顺畅、外人却难以理解的表达方式。由于 LLM 拥有远超人类的工作记忆,也能捕捉更细微的信息,训练中便逐渐形成了一种非常适合 AI 理解的写法;但在人类读者眼中,这种表达就成了过度密集的信息堆砌。

奖励机制偏向 AI 理解,Opus 5.5 找回平衡

克尼恩认为,问题的根源在于强化学习的奖励机制:有些奖励着重提升 AI 模型之间的理解效果,有些则着重让人类更容易理解。数学和代码方面的训练越多,就越需要主动抵消“写给 AI 看”的倾向,对简洁、易读的解释给予更多奖励。

他透露,Anthropic 在 Opus 5.5 上找到了更好的平衡,“自 Opus 4.6 以来,我还没有对一款模型的写作表现这么满意过”。不过他也坦言,这并不代表 Opus 5.5 已经超越 Opus 4.6,“这是一个很难解决的问题,我们会继续改进”。

 
 
更多>同类内容
全站最新
热门内容