BookinglyTech News
Inteligencia artificial

Claude Opus 5.5 reduce un 95% el uso de guiones largos pero escribe respuestas más largas

Arena mide un desplome del 95% en el uso de rayas y frases más cortas en el modelo de Anthropic, aunque la longitud media de sus respuestas sube de 453 a 481 palabras.

2 min de lecturaBleepingComputer0 vistas

Anthropic ha retocado la escritura de su modelo tope. Según las mediciones de Arena, herramienta de comparación de modelos, Claude Opus 5.5 usa un 95% menos de guiones largos que Opus 5, construye frases más cortas y elige palabras más simples. El precio que paga por ello es la verbosidad: sus respuestas medias son más largas que las de la versión anterior.

Arena ha analizado respuestas de razonamiento alto recogidas en su Text Arena durante agosto y septiembre de 2026. De las doce métricas de escritura que mide, diez se movieron en la dirección que la herramienta considera mejor. La caída de la raya es la más llamativa: Opus 5 gastaba 15,2 por cada 1.000 palabras y Opus 5.5 se queda en 0,8. El punto y coma sigue el mismo camino, de 6,10 a 1,64 por cada 1.000 palabras.

Frases más cortas, respuestas más largas

La longitud de frase baja de 12,14 palabras de media en Opus 5 a 10,03 en Opus 5.5. Menos subordinadas, menos rodeos. Lo que sube es el total: la respuesta media pasa de 453 a 481 palabras, lo que convierte a este modelo en el más locuaz de la comparativa.

Conviene poner los datos en su sitio. Son de Arena, no de Anthropic, y la compañía no ha publicado nada sobre el cambio ni ha enseñado ejemplos. Tampoco hay una nota de versión que aclare si el origen está en los datos de entrenamiento, en el posentrenamiento o en las instrucciones de sistema. Lo único que hay es la medición de un tercero sobre conversaciones recogidas en su propia plataforma, y el margen para que el estilo varíe según el prompt sigue siendo enorme.

Que un modelo escriba con menos rayas importa más de lo que parece. La raya se ha convertido en uno de los marcadores más reconocibles de texto generado, así que su desaparición afecta tanto a quien revisa contenido como a quien intenta detectarlo de forma automática. También toca la operación: 481 palabras por respuesta frente a 453 son más tokens de salida en cada llamada, y eso se acumula en la factura y en la ventana de contexto cuando se encadenan muchas peticiones sobre el mismo hilo.

Queda por ver cuáles fueron las dos medidas de las doce que no mejoraron, algo que la comparativa no detalla. Y si Anthropic confirma que el cambio de estilo fue deliberado o es un efecto colateral de otro ajuste.