BookinglyTech News
Inteligencia artificial

DeepSeek prueba en su app un chat de voz nativo con cuatro voces TTS

La compañía despliega en pruebas cerradas un control de altavoz y cuatro voces sintéticas seleccionables, una función de producto separada del lanzamiento de Flash y del cambio de API.

2 min de lecturaPandaily0 vistas

DeepSeek ha empezado a probar el chat de voz dentro de su aplicación. El despliegue es un gray test, es decir, llega solo a una parte de los usuarios y no está anunciado como disponible para todos. Lo que aparece en esa versión es un control de altavoz en la esquina superior derecha de la interfaz y cuatro voces TTS que el usuario puede elegir: Beike, Bailang, Haixing y Anchao.

El detalle que importa para quien sigue a DeepSeek de cerca es que esto se presenta como una función de producto, no como parte de los otros dos movimientos que la compañía tiene en marcha. El primero es el lanzamiento de Flash en disponibilidad general. El segundo es el corte que lleva las llamadas de la API de Pro a Flash, un cambio que afecta a quien tenga integraciones apuntando al endpoint antiguo.

Son tres cosas distintas y conviene no mezclarlas: una es un cambio en el catálogo de modelos y en la API, y la otra es una capacidad nueva dentro del cliente móvil. Que coincidan en el tiempo no significa que compartan calendario ni dependencias.

Qué falta por saber

El anuncio, tal y como se ha conocido, se queda en la existencia del gray test y en los nombres de las cuatro voces. No hay información sobre idiomas soportados, latencia, si la voz convive con la entrada de texto o la sustituye, ni sobre si esa capacidad acabará expuesta en la API para que otros la integren. Tampoco está claro el tamaño del grupo de usuarios que la está viendo.

Para un administrador de sistemas o un desarrollador que use DeepSeek vía API, el asunto es relevante sobre todo por lo segundo: si el corte de Pro a Flash ya está en marcha, cualquier integración que fije el nombre del modelo en la configuración debería revisarse antes de que el endpoint antiguo deje de responder. La parte de voz, de momento, es una prueba en el cliente y no toca a quien consume el servicio por HTTP.