DeepSeek prueba la voz en su app y WeChat mete IA en el envío de imágenes
DeepSeek prueba la conversación por voz en su aplicación y WeChat añade procesamiento con IA al enviar imágenes, ambas en despliegue parcial y sin anuncio oficial.

DeepSeek está probando la conversación por voz en su aplicación, y WeChat ha añadido procesamiento con IA en la interfaz de envío de imágenes. Las dos funciones están en despliegue parcial y ninguna de las dos empresas ha publicado un anuncio: lo que se sabe llega de usuarios que se han encontrado los cambios.
En DeepSeek, los elegidos para la prueba ven un botón de altavoz en la esquina superior derecha de la app. En los ajustes aparece además una opción de timbre de lectura con cuatro voces. Nada más. No hay nota de versión ni detalle de si el reconocimiento corre en el dispositivo o en servidores. El asistente ya dictaba texto y leía respuestas; esto añade la conversación hablada de ida y vuelta, que es lo que separa a un chat de un asistente al que se le puede preguntar mientras se conduce.
WeChat va por la misma vía, sin aspavientos
La app de Tencent ha metido la etiqueta de procesamiento con IA en el envío de imágenes, con mejora, edición y extracción de información. El despliegue es más amplio de lo que sugiere el titular: hay al menos 16 funciones pequeñas de IA en pruebas, repartidas entre cuentas oficiales, Momentos y el escaneo. La casa lleva meses soltando estas piezas de una en una en vez de anunciar un asistente propio. Para quien desarrolla integraciones, la lectura es sencilla: cuando la función salga de la prueba, saldrá dentro del cliente que usa prácticamente todo el mundo en China.
El contexto lo puso esta semana Rao Shaoyang, del instituto de estrategia del China Telecom Research Institute: el consumo anual de tokens en el país llegaría a 100.000 billones este año y superaría los 3,5×10^19 en 2030. La cifra es suya, no de un tercero, y el crecimiento compuesto que cita en la misma frase —casi 12 veces al año— llevaría bastante más lejos de lo que él mismo estima para 2030.
Para quien administra sistemas, lo relevante no es la voz en sí, sino cuándo llega a una API. Estas pruebas por fases son la forma habitual de medir carga y aceptación antes de abrir la función a terceros y, en el caso de WeChat, antes de decidir si las capacidades se ofrecen a los mini programas o a la versión de empresa. Merece la pena seguir los dos frentes: si DeepSeek publica la parte de voz como endpoint y si Tencent abre el procesamiento de imágenes fuera del cliente de consumo. Hasta entonces, son funciones que solo ven unos pocos.

