BookinglyTech News
Inteligencia artificial

Arena publica la semana 36 del 2026 con varios modelos chinos en los rankings de frontend y video

El ranking ciego de modelos grandes de Arena muestra a Qwen 3.8‑max‑0902 en el puesto 4 del ranking de desarrollo frontend y a Wan 3.0 dentro de los tres primeros del ranking de generación de video.

2 min de lecturaITHome0 vistas

Arena.ai ha publicado esta semana el ranking ciego de la semana 36 (31 ago – 6 sep) de modelos grandes. La tabla incluye un ranking global, sub‑rankings por tarea y un apartado de agentes inteligentes. Los resultados confirman la hegemonía de los modelos extranjeros en la lista global, pero destacan la irrupción de varios modelos chinos en categorías especializadas.

Frontend development

En el ranking de desarrollo frontend, OpenAI lanzó gpt‑6‑astra‑max, que debutó en el puesto 1 con 1 797 puntos ELO. Le sigue claude‑fable‑5.1‑max (Anthropic) en el segundo puesto. La novedad más llamativa es qwen3.8‑max‑0902 de Alibaba, que entra directamente en el puesto 4 con 1 686 puntos, superando a todos los modelos chinos anteriores. Otros modelos locales que aparecen en el top 15 son qwen3.8‑flash‑next (Alibaba), hy4‑preview (Tencent) y glm‑5.3‑flash (Z‑ai).

Video generation

En la categoría de generación de video, el modelo wan3.0 de Alibaba entra directamente en el top 3, demostrando que la capacidad de crear contenido visual está alcanzando niveles competitivos con los principales proveedores extranjeros.

Ranking global y de agentes

En la tabla global, los modelos de Anthropic siguen dominando: claude‑fable‑5 mantiene la primera posición con 1 507 puntos, seguido de claude‑opus‑4‑6‑high con 1 505. Un nuevo modelo, claude‑fable‑5.1‑max, llega en tercer lugar con 1 504 puntos. Google introduce gemini‑3.8‑flash‑high en el puesto 8, todavía en fase preliminar.

En el ranking de agentes inteligentes, claude‑fable‑5.1‑max también lidera con un aumento neto del 15,87 %, mientras que el modelo de Alibaba qwen3.8‑max se sitúa en el puesto 16 con un crecimiento del 5,51 %.

Qué implica para los profesionales

Para los equipos de desarrollo y de infraestructura, la aparición de modelos chinos en los rankings de frontend y video significa más opciones de despliegue on‑premise o en la nube con precios locales (por ejemplo, qwen3.8‑max‑0902 cotiza a 2 USD por millón de tokens de entrada). Además, la competencia presiona a los proveedores tradicionales a ajustar sus precios y a ofrecer mejores ratios de relación precio‑rendimiento.

En conclusión, aunque los líderes globales siguen dominando el ranking general, la presencia creciente de modelos chinos en sub‑categorías críticas sugiere una diversificación del ecosistema de IA que los responsables de arquitectura y de costos deberán seguir de cerca.