Anthropic 工程师:Claude 学会了写给 AI 看

Anthropic 负责 Claude 微调的工程师 Jackson Kernion 最近在 X 上连发几条帖子,解释为什么很多用户觉得 Claude 越来越聪明,写出来的东西却越来越难读。他的说法很直接:后续模型把训练重心放在数学和代码上,还做了大量”给其他 AI 模型写技术说明”的训练,模型逐渐适应了”LLM 的心理”,学会了写给 AI 看,而不写给人看。

讨论起于网友对 Claude 写作水平的吐槽,有人认为 Opus 4.6 是 Anthropic 最后一个好用的”写作模型”。Kernion 没有否认这种感受。

“Claude 腔”从哪来

Kernion 给出的解释落在强化学习的奖励设计上。训练里有一部分奖励针对的是”另一个模型能不能看懂”,另一部分针对”人能不能看懂”。数学和代码的训练量越大,前一类信号越强,模型就越倾向于写出信息极度压缩、术语堆叠的段落。人读起来的感受,他用了一个词组:overly-dense info dumps,信息过密的倾倒。

他还打了个比方:一群只跟彼此交流的人,会慢慢形成一套圈内很顺、圈外很难懂的表达方式。模型和模型之间也是这样。

要纠正,就得在训练里主动加码,奖励那些人类读者能跟上的简单解释。Kernion 说这件事难做,团队会继续改。

Opus 5.5 改了什么

他在帖子里写:

“Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps.” Opus 5.5 是我们第一个针对句子清晰度和信息过密问题做了定向改进的模型版本。

紧接着他补了一句:自 Opus 4.6 以来,他还没对哪个模型的写作这么满意过。这个表述留有余地,他没说 Opus 5.5 已经超过 4.6。

Opus 5.5 发布时,外界报道也提到 Anthropic 承诺减少”Claudish”式写法。英文用户列举过的典型症状包括反复出现的固定词、层层嵌套的小标题、把一件事拆成过多的要点。这些是用户侧的归纳,Anthropic 没有公开过一份”Claude 腔”清单,也没有发布针对写作可读性的评测分数。

对用中文的人有什么影响

Kernion 讨论的全是英文场景。中文输出有没有同样的倾向、这次的定向改进有没有覆盖中文,他没有提,Anthropic 也没有单独说明。

从他的解释能推出一点:这种倾向和任务类型有关。越偏技术的任务,模型越容易切到”写给模型看”的模式。国内开发者拿 Claude 写接口文档、写方案说明、写代码注释,正好落在这个区间。

在官方给出中文侧的数据之前,编辑部的建议是两条,都属于经验做法:一是在提示词里写清读者是谁,比如”给刚入职的产品经理看”,比一句”写得通俗些”管用;二是让它先写结论再展开,限制每段的信息点数量。已经切到 Opus 5.5 的团队,可以拿同一批旧提示词重跑一遍,对照 4.6 和 5.x 时期的输出,自己判断改进有多大。

参考来源:Jackson Kernion 的 X 帖子、The Decoder、CocoLoop、凤凰网科技;Kernion 的职务与原话按其本人帖子及媒体转述核对。