BookinglyTech News
Inteligencia artificial

Anthropic lanza Claude Sonnet 5.5 con rendimiento cercano al de Opus a mitad de precio

El nuevo modelo de Anthropic promete ser 30 % más rápido y hasta 30 % más barato que su predecesor, acercándose al desempeño de Claude Opus 5.5.

2 min de lecturaThe New Stack0 vistas

Anthropic anunció este lunes la disponibilidad de Claude Sonnet 5.5, la segunda entrega de la familia Claude 5.5 tras el lanzamiento de Opus 5.5 la semana anterior. El modelo afirma generar respuestas más de un tercio más rápido que Sonnet 5 y reducir el coste por tarea hasta en un 30 %, posicionándose como la opción más veloz y económica dentro de la línea Sonnet.

En pruebas de referencia, Sonnet 5.5 destaca en tareas de programación. En Terminal‑Bench 4.0, que mide la capacidad de agentes en la línea de comandos, alcanzó un 70,6 % de puntuación, frente al 10,3 % de su antecesor y superó al Opus 5.5 (66,4 %). En CursorBench, el modelo quedó a solo dos puntos del Opus 5.5, y en FrontierCode de Cognition obtuvo 52,1 % frente al 54,4 % de Opus 5.5 y 49,3 % de GPT‑6 Sol. Para trabajos de conocimiento, Sonnet 5.5 obtuvo 1 844 puntos en el ranking GDPval‑AA, apenas dos puntos por debajo de Opus 5.5 y 400 puntos por encima de Sonnet 5, superando también a GPT‑6 Sol (1 487).

El precio se mantiene en 2 USD por millón de tokens de entrada y 10 USD por millón de tokens de salida, idéntico al de la versión anterior y equiparable al de GPT‑6 Sol. Con un consumo de tokens menor, Anthropic asegura que el coste total de ejecución será inferior al de Sonnet 5. El modelo ya está disponible en la Claude Platform y en los principales proveedores cloud: AWS, Google Cloud y Microsoft Azure. Los desarrolladores que utilicen la opción thinking desactivada deberán migrar a la nueva configuración between_tools; Opus 5.5 ya rechaza peticiones sin razonamiento.

En cuanto a seguridad, Sonnet 5.5 incorpora los mismos filtros de ciberseguridad que los modelos de mayor capacidad de Anthropic. Las solicitudes de alto riesgo volverán a Sonnet 5, mientras que el modelo incluye clasificadores diseñados para impedir la extracción de su razonamiento por parte de atacantes.

Un detalle curioso: en pruebas informales de larga duración y comprensión de imágenes, el modelo fue el primero de la serie Sonnet en superar a Pokémon Red trabajando únicamente a partir de capturas de pantalla, un hito que ilustra su mejora en tareas visuales de bajo nivel.

Implicaciones para los equipos

Para los equipos de desarrollo que ya usan modelos de Anthropic, la propuesta de Sonnet 5.5 permite acelerar pipelines de generación de código y documentación sin incurrir en mayores gastos. La compatibilidad con los principales clouds simplifica la adopción, y la continuidad de los precios facilita la planificación financiera. Sin embargo, la distinción de seguridad entre Sonnet 5.5 y Opus 5.5 sugiere que los casos de uso críticos seguirán requiriendo el modelo más robusto.

En resumen, Claude Sonnet 5.5 representa un paso intermedio significativo: combina velocidad y coste reducido con un rendimiento cercano al de Opus 5.5, lo que lo convierte en una opción atractiva para la mayoría de las cargas de trabajo de programación y documentación.