Anthropic confirma que la optimización de Claude para código empeora su estilo de escritura
Jackson Kernion, ingeniero de Anthropic, explica que los últimos modelos de Claude priorizan matemáticas y código sobre la claridad textual.

Anthropic ha admitido que la calidad de redacción de sus modelos Claude ha decaído tras la última ronda de afinado. Jackson Kernion, responsable del fine‑tuning, señaló que Opus 4.6 fue el último modelo que ofrecía una escritura natural aceptable. A partir de ahí, los entrenamientos se orientaron a mejorar el rendimiento en matemáticas, generación de código y razonamiento complejo, lo que cambió la estructura de la recompensa en el proceso de aprendizaje reforzado.
Según Kernion, los modelos más recientes se entrenan también para producir explicaciones técnicas dirigidas a otras IA, no a usuarios humanos. Esa “psicología de LLM” genera un estilo que él compara con la comunicación entre personas con autismo: funciona dentro del grupo, pero resulta denso y difícil de seguir para el exterior. Los LLM disponen de mayor memoria de trabajo que los humanos, por lo que capturan detalles finos que terminan en “volcados de información” que confunden a lectores humanos.
El problema radica en la función de recompensa. Algunas recompensas favorecen la comprensión por parte de otras máquinas, mientras que otras buscan la claridad humana. Cuando se refuerza la capacidad de resolver ecuaciones o escribir código, hay que contrarrestar esa tendencia premiando explicaciones simples, pero Anthropic aún no ha encontrado el equilibrio perfecto.
Con la llegada de Opus 5.5, la compañía afirma haber recuperado parte del equilibrio, aunque Kernion admite que no está tan satisfecho con la redacción como con Opus 4.6. El nuevo modelo es más rápido y barato, pero todavía muestra trazas de lo que él denomina “claudish”, una forma de expresión que parece diseñada para otras IA.
Esta situación plantea un dilema para equipos que dependen de Claude en aplicaciones de generación de texto orientadas a usuarios finales. Si el modelo prioriza la precisión técnica sobre la legibilidad, los desarrolladores tendrán que aplicar post‑procesamiento o ajustar los prompts para obtener respuestas más amigables. Anthropic ha prometido seguir trabajando en la mejora del estilo de escritura, pero por ahora los usuarios deben estar preparados para filtrar o re‑escribir la salida del modelo.
Para los que necesiten más detalle, Anthropic ha publicado una nota en su sitio alemán que resume los cambios de Opus 5.5 y la promesa de reducir el tono “claudish”.


