Claudeは「AI向けの文章」を学んだ

Claudeの微調整を担当するAnthropicのエンジニア、ジャクソン・カーニオン(Jackson Kernion)氏が最近X(旧Twitter)に一連の投稿をし、多くのユーザーが「Claudeは賢くなったはずなのに、書く文章はますます読みにくくなった」と感じる理由を説明した。彼の説明は率直だ。後続モデルは数学とコードの学習に重心を置くと同時に、「他のAIモデル向けの技術説明を書く」訓練を大量に行った結果、モデルは徐々に「LLMの心理」に適応し、人間ではなくAI向けに書くことを覚えてしまったという。

議論のきっかけは、Claudeの文章力に対するユーザーの不満だった。Opus 4.6がAnthropic最後の使える「ライティングモデル」だと主張する声もあり、Kernion氏はその感覚を否定しなかった。

「Claude節」はどこから来るのか

Kernion氏の説明は強化学習の報酬設計に集約される。訓練の報酬の一部は「別のモデルが理解できるか」を対象とし、もう一部は「人間が理解できるか」を対象としている。数学とコードの学習量が増えるほど前者のシグナルが強まり、モデルは情報を極度に圧縮し専門用語を積み重ねた文章を書きやすくなる。人間が読んだときの感覚を、彼は「overly-dense info dumps(情報が過密に詰め込まれたもの)」という表現で言い表した。

彼はこんな比喩も使った。互いにしか話さない集団は、内輪では通じやすいが外部には理解しにくい独特の言い回しを徐々に作り上げる。モデル同士のやり取りでも同じことが起きる、と。

これを直すには、訓練の中で人間の読者がついてこられる分かりやすい説明に、意図的に報酬を上乗せする必要がある。Kernion氏はこれが難しい課題だとしたうえで、チームとして改善を続けると述べた。

Opus 5.5で何が変わったのか

彼は投稿でこう書いている。

"Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps."

Opus 5.5は、文の明快さと情報過密の問題を重点的に改善した、私たちにとって初めてのモデルリリースだ。

続けて彼は、Opus 4.6以来、これほど文章に満足したモデルはなかったと付け加えた。この言い方には含みがあり、Opus 5.5が4.6をすでに上回ったとまでは言っていない。

Opus 5.5の発表に関する報道でも、Anthropicが「Claudeらしさ(Claudish)」的な書き方を減らすと約束したことが取り上げられた。英語圏のユーザーが挙げてきた典型的な症状には、決まり文句の繰り返し、何重にも入れ子になった小見出し、一つの内容を過剰に箇条書きへ分解することなどがある。ただしこれらはユーザー側がまとめたものであり、Anthropicは「Claude節」の公式リストも、文章の読みやすさを測る評価スコアも公表していない。

中国語を使う人への影響

Kernion氏が論じたのはすべて英語圏の話だ。中国語の出力に同じ傾向があるのか、今回の重点的な改善が中国語にも及んでいるのかについて、彼は言及しておらず、Anthropicも個別に説明していない。

彼の説明から一つ推測できることがある。この傾向はタスクの種類と関係しているという点だ。技術寄りのタスクほど、モデルは「モデル向けに書く」モードに切り替わりやすい。中国国内の開発者がClaudeでAPIドキュメントや設計資料、コードコメントを書く場面は、まさにこの領域に当てはまる。

Anthropicが中国語側のデータを示すまでの間、編集部からの提案は経験則として次の二つだ。一つは、プロンプトに読み手が誰かを明記すること。「入社したばかりのプロダクトマネージャー向けに」と指定する方が、「分かりやすく書いて」と頼むより効果的だ。もう一つは、先に結論を書かせてから展開させ、各段落に詰め込む情報量を制限すること。すでにOpus 5.5に切り替えたチームは、同じ旧プロンプトの束をもう一度実行し、4.6期や5.x期の出力と比較して、改善の程度を自分たちで判断できる。

参考資料:Jackson Kernion氏のXへの投稿、The Decoder、CocoLoop、鳳凰網科技(Ifeng Technology);Kernion氏の役職と発言は本人の投稿および報道内容と照合済み。