Fable 5.1 escribe más largo y con menos muletillas que Fable 5, según Arena.ai
Arena.ai compara decenas de miles de respuestas de Claude y detecta menos rayas, menos aperturas de acuerdo y textos un 30% más largos en la versión 5.1.

Anthropic ha cambiado la manera en que escribe su modelo Claude al pasar de Fable 5 a Fable 5.1, y el rastro queda en los números. Arena.ai ha comparado decenas de miles de respuestas de alta carga de razonamiento generadas en su Text Arena y ha encontrado menos aperturas de asentimiento, menos rayas y menos coletillas de honestidad y franqueza. A cambio, las respuestas son más largas.
El recuento es literal. Fable 5.1 usa 11,0 rayas por cada mil palabras, frente a las 16,2 de Fable 5, pero se apoya más en el punto y coma: 6,09 contra 3,73. Las frases de honestidad y las aperturas de acuerdo caen con fuerza, igual que las frases hechas, que bajan un 20% por cada mil palabras. Los matices del tipo "quizá" o "podría argumentarse" retroceden un 36%.
Respuestas más largas, frases más cortas
La mediana de longitud por respuesta sube un 30%, de 319 a 414 palabras. Opus 5 sigue siendo más hablador, con 525 palabras de mediana, un 21% por encima de Fable 5.1. La longitud de frase se queda en 12,54 palabras, apenas por encima de las 12,20 de Opus 5. La proporción de palabras largas cae del 42,6% al 38,6%, y los sustantivos abstractos bajan un 25%, de 4,39 a 3,28 por cada cien palabras. Los elogios y las validaciones aparecen en el 1,98% de las respuestas, cuando antes salían en el 3,17%. Todo el análisis se apoya en esas métricas de estilo, no en evaluaciones de capacidad.
Qué se puede leer de aquí
Menos adornos y menos halagos suenan a un ajuste de tono deliberado, pero el estudio tampoco lo afirma. Mide la forma de las respuestas, no lo que hay detrás ni cómo se entrenó la versión nueva. Tampoco hay detalle sobre ventanas de contexto, precios, disponibilidad por API o cambios en el sistema de instrucciones, que es lo que de verdad condiciona si merece la pena mover una integración de Fable 5 a Fable 5.1.
Para quien elige modelo o escribe prompts de sistema, estas cifras sirven sobre todo como recordatorio: el estilo se puede medir, y cambia entre versiones aunque el fabricante no lo anuncie. Ahora bien, los datos salen del entorno de Arena.ai sobre las respuestas que pasan por él, no de una especificación oficial. Un modelo puede escribir distinto en una arena pública que dentro de un pipeline con instrucciones propias y temperatura fija, así que conviene probarlo en el caso de uso concreto antes de dar por bueno cualquier cambio de comportamiento.


