工程師曝Claude學會寫給AI看

負責 Claude 微調的 Anthropic 工程師 Jackson Kernion 最近在 X 上連續發文,解釋為什麼許多使用者覺得 Claude 變聰明了,寫出來的東西卻越來越難讀。他的說法很直白:後續模型把訓練重心放在數學和程式碼上,還做了大量「幫其他 AI 模型寫技術說明」的訓練,模型逐漸適應了「LLM 的心理」,學會了寫給 AI 看,而不是寫給人看。

討論起於網友對 Claude 寫作水準的抱怨,有人認為 Opus 4.6 是 Anthropic 最後一個好用的「寫作模型」。Kernion 沒有否認這種感受。

「Claude 腔」從哪裡來

Kernion 給出的解釋落在強化學習的獎勵設計上。訓練裡有一部分獎勵針對的是「另一個模型看不看得懂」,另一部分針對「人看不看得懂」。數學和程式碼的訓練量越大,前一類訊號就越強,模型就越傾向寫出資訊極度壓縮、術語堆疊的段落。人讀起來的感受,他用了一個詞組:overly-dense info dumps,資訊過度密集的傾倒。

他還打了個比方:一群只跟彼此交流的人,會慢慢形成一套圈內很順、圈外很難懂的表達方式。模型和模型之間也是這樣。

要糾正,就得在訓練裡主動加碼,獎勵那些人類讀者能跟得上的簡單解釋。Kernion 說這件事不容易做,團隊會繼續改善。

Opus 5.5 改了什麼

他在貼文裡寫道:

"Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps."

Opus 5.5 是我們第一個針對句子清晰度和資訊過密問題做了針對性改善的模型版本。

緊接著他補了一句:自 Opus 4.6 以來,他還沒對哪個模型的寫作這麼滿意過。這個說法留有餘地,他並沒有說 Opus 5.5 已經超越 4.6。

Opus 5.5 發布時,外界報導也提到 Anthropic 承諾減少「Claudish」式寫法。英語使用者列舉過的典型症狀包括反覆出現的固定詞句、層層嵌套的小標題、把一件事拆成過多的要點。這些是使用者這一側的歸納,Anthropic 沒有公開過一份「Claude 腔」清單,也沒有發布針對寫作可讀性的評測分數。

對使用中文的人有什麼影響

Kernion 討論的全是英文情境。中文輸出有沒有同樣的傾向、這次的針對性改善有沒有涵蓋中文,他沒有提到,Anthropic 也沒有另外說明。

從他的解釋能推論出一點:這種傾向和任務類型有關。越偏技術性的任務,模型越容易切到「寫給模型看」的模式。中國大陸的開發者拿 Claude 寫 API 文件、寫方案說明、寫程式碼註解,正好落在這個區間。

在官方提供中文側的數據之前,編輯部的建議有兩條,都屬於經驗做法:一是在提示詞裡寫清楚讀者是誰,比如「給剛入職的產品經理看」,會比一句「寫得白話一點」更管用;二是讓它先寫結論再展開,限制每段的資訊點數量。已經切換到 Opus 5.5 的團隊,可以拿同一批舊提示詞重跑一次,對照 4.6 和 5.x 時期的輸出,自行判斷改善幅度有多大。

參考來源:Jackson Kernion 的 X 貼文、The Decoder、CocoLoop、鳳凰網科技;Kernion 的職務與原話已按其本人貼文及媒體轉述核對。