BookinglyTech News
Inteligencia artificial

Google lanza Gemini 3.8 Live para plantar cara a GPT-Live-1 a una fracción del precio

DeepMind publica dos modelos de audio para desarrolladores, Gemini 3.8 Live y 3.8 Live Extended Thinking, con tarifas muy por debajo de las de OpenAI.

2 min de lecturaThe Decoder0 vistas

Google ha liberado dos modelos de audio para desarrolladores: Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking. Se sirven desde la Gemini API y desde Google AI Studio, y apuntan justo al terreno donde OpenAI puso a competir GPT-Live-1: agentes de voz que conversan y, al mismo tiempo, ejecutan tareas.

La variante Extended Thinking se ha colocado primera en la clasificación de voz a voz de Artificial Analysis con un 82,6 por ciento, por delante de la familia GPT-Live-1. El dato sale de esa tabla, no de una medición independiente.

Agentes que hablan y trabajan a la vez

Gemini 3.8 Live está pensada para agentes que lanzan llamadas a API en segundo plano sin dejar de hablar, procesan entrada visual y sostienen la conversación de forma simultánea. Cubre más de 97 idiomas. Quien quiera verla en marcha tiene aplicaciones de ejemplo en el repositorio de Google en GitHub.

El argumento de venta más claro es el precio. Google cobra 0,005 dólares por minuto de audio de entrada y 0,018 por minuto de salida. OpenAI cobra 0,05 dólares por minuto con GPT-Live-1. Traducido a una hora de conversación de voz, sale a unos 1,38 dólares con Gemini frente a un mínimo de 3 dólares con el modelo de OpenAI.

El intercambio

Lo que Google no iguala, sobre el papel, es la naturalidad. GPT-Live-1 trabaja en dúplex completo: escucha y habla a la vez, lo que suaviza los turnos de palabra. El modelo de DeepMind no se anuncia con esa característica. Y las demos publicadas hasta ahora apuntan a que el de OpenAI suena mejor, así que Gemini 3.8 Live compite por coste más que por calidad de voz.

Para quien despliega agentes de voz, ahí está la clave: cuando el minuto de audio es lo que decide la factura, un salto de 0,05 a 0,005 dólares en la entrada cambia las cuentas de cualquier servicio que atienda llamadas todo el día. Queda por ver si esa diferencia de precio se sostiene cuando el agente tiene que resolver cosas complicadas y no solo mantener una charla, y si el Extended Thinking, que es el que gana en la tabla, se cobra igual que el modelo base. Google tampoco ha detallado todavía los límites de tasa ni la latencia en producción, dos datos que pesan más que el ranking cuando hay usuarios reales al otro lado.