Jackson Kernion, l'ingénieur d'Anthropic chargé du fine-tuning de Claude, a récemment publié une série de messages sur X pour expliquer pourquoi de nombreux utilisateurs trouvent Claude de plus en plus intelligent, mais ses textes de plus en plus difficiles à lire. Son explication est directe : les modèles récents ont concentré l'entraînement sur les mathématiques et le code, et ont aussi reçu un entraînement massif consistant à "rédiger des explications techniques destinées à d'autres modèles d'IA", ce qui a progressivement adapté le modèle à la "psychologie des LLM" — il a appris à écrire pour l'IA, pas pour les humains.
La discussion est partie de critiques d'internautes sur la qualité d'écriture de Claude ; certains estiment qu'Opus 4.6 était le dernier bon "modèle rédacteur" d'Anthropic. Kernion n'a pas nié cette impression.
D'où vient le "ton Claude"
L'explication de Kernion porte sur la conception des récompenses en apprentissage par renforcement. Une partie des récompenses de l'entraînement vise à savoir si "un autre modèle peut comprendre le texte", une autre partie vise à savoir si "un humain peut le comprendre". Plus le volume d'entraînement en mathématiques et en code est important, plus le premier signal est fort, et plus le modèle tend à produire des paragraphes extrêmement compressés, saturés de jargon. Pour décrire la sensation ressentie par un lecteur humain, il emploie une expression : overly-dense info dumps, des "déversements d'informations" excessivement denses.
Il propose aussi une comparaison : un groupe de personnes qui ne communique qu'entre elles finit par développer une façon de s'exprimer fluide en interne, mais difficile à comprendre de l'extérieur. Il en va de même entre modèles.
Pour corriger cela, il faut renforcer délibérément l'entraînement en récompensant les explications simples que les lecteurs humains peuvent suivre. Kernion affirme que c'est difficile à réaliser et que l'équipe continuera à ajuster ce point.
Ce qu'Opus 5.5 a changé
Il a écrit dans son message :
"Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps." Opus 5.5 est notre premier modèle à recevoir des améliorations ciblées sur la clarté des phrases et sur le problème des déversements d'informations excessivement denses.
Il a aussitôt ajouté que, depuis Opus 4.6, il n'avait plus été aussi satisfait de l'écriture d'un modèle. Cette formulation laisse une marge : il n'a pas affirmé qu'Opus 5.5 dépassait déjà 4.6.
Lors du lancement d'Opus 5.5, la presse a également rapporté qu'Anthropic avait promis de réduire le style d'écriture "Claudish". Des utilisateurs anglophones avaient déjà listé des symptômes typiques : des tournures figées qui reviennent sans cesse, des sous-titres imbriqués sur plusieurs niveaux, une même idée découpée en trop de puces. Ce sont des constats venant des utilisateurs ; Anthropic n'a publié aucune liste officielle du "ton Claude", ni communiqué de score d'évaluation sur la lisibilité de ses textes.
Quel impact pour les utilisateurs en chinois
Tout ce que Kernion aborde concerne des scénarios en anglais. Il n'a pas précisé si la production en chinois présente la même tendance, ni si cette amélioration ciblée couvre le chinois, et Anthropic ne l'a pas non plus clarifié séparément.
De son explication, on peut déduire une chose : cette tendance dépend du type de tâche. Plus une tâche est technique, plus le modèle bascule facilement vers un mode "écrire pour un modèle". Les développeurs qui utilisent Claude pour rédiger de la documentation d'API, des descriptions de solutions ou des commentaires de code se trouvent justement dans cette zone.
En attendant des données officielles côté chinois, la rédaction suggère deux pratiques, toutes deux issues de l'expérience : d'abord, préciser dans le prompt qui est le lecteur, par exemple "pour un chef de produit qui vient d'arriver", ce qui fonctionne mieux qu'un simple "écris de façon plus simple" ; ensuite, faire en sorte que le modèle rédige d'abord la conclusion avant de développer, en limitant le nombre de points d'information par paragraphe. Les équipes déjà passées à Opus 5.5 peuvent relancer le même lot d'anciens prompts et comparer les productions de l'ère 4.6 et de l'ère 5.x pour juger elles-mêmes de l'ampleur de l'amélioration.
Sources : publications de Jackson Kernion sur X, The Decoder, CocoLoop, Ifeng Tech ; le poste occupé par Kernion et ses propos ont été vérifiés à partir de ses propres publications et des reprises dans la presse.