Vercel AI Gateway suma Sonnet 5.5, credenciales efímeras y voz full-duplex
El gateway de IA de Vercel añade Sonnet 5.5 como reemplazo directo, credenciales OIDC para agentes y varios modelos nuevos. Migrar el modelo es cambiar un identificador.

El AI Gateway de Vercel ha incorporado Claude Sonnet 5.5 y un puñado de modelos nuevos, y de paso ha metido mano en el problema que más duele cuando despliegas agentes: las credenciales. Sonnet 5.5 se enruta con anthropic/claude-sonnet-5.5 desde el AI SDK, el endpoint compatible con OpenAI y el de Anthropic Messages.
Cambiar el identificador y poco más
La migración es un cambio de cadena de texto. La superficie de API es idéntica a la de Sonnet 5: no hay que tocar prompts ni actualizar librerías cliente. Las cifras que se manejan son 70,6% en Terminal-Bench frente al 10,3% de Sonnet 5, un banco de pruebas de tareas agénticas multietapa en terminal. El precio por token no cambia, pero el rendimiento por dólar sube alrededor de un 30% según la parte interesada. Traducido a presupuesto: mover las cargas de Sonnet 5 —código, generación de documentos, tareas agénticas rutinarias— a 5.5 y dejar Opus 5.5 para el razonamiento complejo. Zero Data Retention viene incluido, algo que pesa si operas con datos que no pueden salir de una ubicación concreta.
Vercel Connect ataca otra cosa: los tokens de larga vida. En lugar de guardar secretos de Slack, GitHub o bases de datos en variables de entorno y rotarlos a mano, se registra un conector por proveedor y se pide un token efímero y con alcance limitado en tiempo de ejecución mediante getToken(), apoyado en identidad OIDC. El despliegue lleva su identidad, no un secreto compartido. Hay registros de auditoría, RBAC y más de cien conectores predefinidos en disponibilidad general. El límite es evidente: si tus agentes no corren en Vercel, no hay capa de identidad OIDC y el mecanismo no te sirve.
Voz full-duplex y modelos de terceros
GPT-Live 1 trae voz full-duplex al gateway: se puede interrumpir al modelo a mitad de respuesta porque escucha y habla a la vez, sin una capa de detección de turno en tu aplicación. Permite delegar subtareas a cualquier modelo de texto mientras la sesión de voz sigue viva, con la aplicación controlando facturación y accesos del modelo secundario. Pide AI SDK 7, @ai-sdk/openai 4.0.67 o superior, cliente WebSocket y una clave del gateway.
También entra Hy4 Preview, el modelo MoE de 770.000 millones de parámetros de Tencent con ventana de contexto de un millón de tokens, con integración nativa en Claude Code y Cursor. Y Wan 3.0 unifica los endpoints separados de texto a vídeo e imagen a vídeo en un solo identificador y dobla la duración máxima de clip.
Lo relevante del lote es que buena parte se resuelve cambiando una cadena de texto, y eso no es lo habitual. Lo que no se resuelve solo es el acoplamiento: Vercel Connect y el enrutado unificado empujan a concentrar la infraestructura de agentes en un proveedor, y esa comodidad se paga el día que quieras moverlos. Hy4 y Wan están en preview: banco de pruebas, no producción.

