Jackson Kernion, el ingeniero de Anthropic encargado del ajuste fino (fine-tuning) de Claude, publicó recientemente varios mensajes en X explicando por qué muchos usuarios sienten que Claude es cada vez más inteligente, pero lo que escribe resulta cada vez más difícil de leer. Su explicación es directa: los modelos más recientes concentraron el entrenamiento en matemáticas y código, y además recibieron una gran cantidad de entrenamiento para "escribir explicaciones técnicas dirigidas a otros modelos de IA", lo que hizo que el modelo se fuera adaptando a la "psicología de los LLM": aprendió a escribir para la IA, no para las personas.
La discusión surgió de quejas de usuarios sobre la calidad de la escritura de Claude; algunos consideran que Opus 4.6 fue el último "modelo de escritura" realmente bueno de Anthropic. Kernion no negó esa percepción.
De dónde viene el "tono Claude"
La explicación de Kernion se centra en el diseño de recompensas del aprendizaje por refuerzo. Una parte de la recompensa en el entrenamiento apunta a si "otro modelo puede entenderlo", y otra parte a si "una persona puede entenderlo". Cuanto mayor es el volumen de entrenamiento en matemáticas y código, más fuerte es la primera señal, y más tiende el modelo a producir párrafos extremadamente comprimidos y cargados de jerga. Para describir la sensación de quien lee, usa una expresión: overly-dense info dumps, volcados de información excesivamente densos.
También hizo una comparación: un grupo de personas que solo habla entre sí acaba desarrollando, poco a poco, una forma de expresarse fluida dentro del grupo pero difícil de entender fuera de él. Entre modelos ocurre algo parecido.
Para corregirlo, hay que reforzar deliberadamente en el entrenamiento, recompensando las explicaciones simples que los lectores humanos puedan seguir. Kernion dice que esto es difícil de lograr y que el equipo seguirá ajustándolo.
Qué cambió con Opus 5.5
Escribió en su publicación:
"Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps." Opus 5.5 es nuestro primer modelo lanzado con mejoras específicas en la claridad de las frases y en el problema de los volcados de información excesivamente densos.
Justo después añadió: desde Opus 4.6 no había estado tan satisfecho con la escritura de ningún modelo. Esta formulación deja margen: no dijo que Opus 5.5 ya haya superado a 4.6.
Cuando se lanzó Opus 5.5, la prensa externa también mencionó que Anthropic prometió reducir el estilo de escritura "Claudish". Usuarios de habla inglesa habían enumerado antes síntomas típicos: expresiones fijas que se repiten, subtítulos anidados en varios niveles, y dividir una sola idea en demasiados puntos. Son conclusiones del lado de los usuarios; Anthropic no ha publicado ninguna lista oficial del "tono Claude", ni ha divulgado puntuaciones de evaluación sobre la legibilidad de sus textos.
Qué significa esto para quienes usan Claude en chino
Todo lo que discute Kernion se refiere a escenarios en inglés. Si la salida en chino tiene la misma tendencia y si esta mejora específica cubre el chino, no lo mencionó, y Anthropic tampoco lo ha aclarado por separado.
De su explicación se puede deducir algo: esta tendencia está relacionada con el tipo de tarea. Cuanto más técnica es la tarea, más fácilmente el modelo cambia al modo "escribir para un modelo". Los desarrolladores que usan Claude para escribir documentación de API, descripciones de soluciones y comentarios de código caen justo en ese rango.
Antes de que existan datos oficiales para el chino, la redacción sugiere dos prácticas, ambas basadas en la experiencia: primero, dejar claro en el prompt quién es el lector, por ejemplo "para un gerente de producto recién incorporado", lo cual funciona mejor que simplemente pedir "escríbelo de forma más sencilla"; segundo, hacer que el modelo escriba primero la conclusión y luego la desarrolle, limitando el número de puntos de información por párrafo. Los equipos que ya migraron a Opus 5.5 pueden volver a ejecutar el mismo lote de prompts antiguos, comparar las salidas de la época de 4.6 y de 5.x, y juzgar por sí mismos cuánto ha mejorado.
Fuentes: publicaciones de Jackson Kernion en X, The Decoder, CocoLoop, Ifeng Tech; el cargo de Kernion y sus citas se verificaron con base en sus propias publicaciones y en reportes de prensa.