BookinglyTech News
Inteligencia artificial

Pesos abiertos ya son mayoría en tokens de Vercel, pero Anthropic se lleva el 64% del gasto

El gateway de IA de Vercel enrutó en agosto un 56% de los tokens hacia modelos de pesos abiertos, la primera vez que pasan del 50%, pero solo generaron 14 centavos de cada dólar gastado.

2 min de lecturaThe New Stack0 vistas

Los modelos de pesos abiertos procesaron el 56% de los tokens que pasaron por el AI Gateway de Vercel en agosto. Es la primera vez que superan la mitad del volumen mensual en ese servicio, que enruta decenas de billones de tokens al mes. La factura, en cambio, cuenta otra historia: esos modelos solo se llevaron 14 centavos de cada dólar gastado, mientras Anthropic se quedó con 64.

Del 7% al 56% en nueve meses

La progresión es rápida. En diciembre de 2025 la cuota abierta era del 7%; en abril llegó al 13% y subió todos los meses siguientes. El informe anterior de Vercel, publicado en agosto, situaba julio en el 36%. El propio CEO de la compañía, Guillermo Rauch, señaló en redes que el 22 de agosto fue un día récord, con un 62% del tráfico. "Esto es muy probablemente solo el principio, porque la adopción empresarial todavía es temprana, y los harnesses, CLIs, IDEs, SDKs, etc. necesitan adaptarse para ser agnósticos al modelo", escribió.

Conviene no confundir tokens con dinero. DeepSeek, Moonshot AI o Z.ai son más baratos de ejecutar que los modelos propietarios de los laboratorios estadounidenses. El precio medio por token en el gateway cayó un 23,2% en agosto, tercer mes consecutivo de descenso. Entre los equipos que movieron más de 10 millones de tokens en julio y agosto, la mediana del coste por token bajó un 7,6%.

La fidelidad sigue al modelo, no a la marca

Anthropic mantiene una constancia llamativa: 64 centavos de cada dólar en agosto y nunca por debajo del 61% desde diciembre de 2025. Eso no significa que sus clientes no se muevan. Fable 5 pasó del 13,2% del gasto total en julio al 4,9% en agosto, mientras el más barato Opus 5 subía al 22,5%. El 90% de los equipos que usaban Fable redujeron su uso, y más migraron a Opus 5 que a cualquier otro modelo. Vercel lo atribuye a que cubre cargas parecidas a la mitad de precio. Anthropic conservó el dinero aunque el cliente cambiara de modelo dentro de su catálogo.

El salto entre laboratorios también ocurre. En cinco días, GLM-5.3-Flash de Z.ai triplicó el volumen diario de GLM-5.2. Y cuando un reemplazo no cubre lo que cubría el anterior, la gente se va: más de tres cuartas partes del volumen perdido por Gemini 3 Flash de Google acabó en modelos de OpenAI y de Anthropic. La cuota de Google en tokens del gateway cayó del 30% al 5%, y 22 de esos 25 puntos se explican solo por Gemini 3 Flash.

Para quien despliega aplicaciones sobre varios proveedores, el dato útil es que la vía más barata ya soporta la mayor parte de la carga y que el coste por token sigue bajando. Lo que no se mueve es dónde está el gasto: en el modelo puntero de siempre.