BookinglyTech News
Inteligencia artificial

Hy3, el modelo agéntico de Tencent de 295.000 millones, ya no es gratis

La ventana de acceso sin coste a Hy3 en Nous Portal y OpenRouter duró dos semanas de julio de 2026 y está cerrada. Los pesos siguen abiertos y quedan alternativas gratuitas para agentes.

3 min de lecturaDev.to0 vistas

Tencent Hy3 dejó de estar disponible sin coste en Nous Portal y en OpenRouter. La promoción duró unas dos semanas, del 6 al 21 de julio de 2026, y ya está cerrada. El modelo no ha desaparecido: sigue publicado con pesos abiertos bajo Apache 2.0 y se puede seguir usando pagando. Lo que se acabó fue el acceso gratuito, no el modelo.

Hy3 es un Mixture-of-Experts de 295.000 millones de parámetros con 21.000 millones activos por token, repartidos como top-8 de 192 expertos, y una ventana de contexto de 256K. Tencent lo publicó a principios de julio de 2026 como sucesor de Hy3 Preview, el modelo que había enseñado en abril, y lo afinó para cargas de trabajo de agente: código, llamada a herramientas, razonamiento y contexto largo. El repositorio de Hy3 está en GitHub con las variantes y el detalle de pesos.

Los números que da el fabricante son SWE-bench Verified 78,0, SWE-bench Pro 57,9, GPQA Diamond 90,4 y HLE 53,2. Son cifras de Tencent, no de un tercero, así que conviene tratarlas como orientativas hasta que alguien las reproduzca.

Por qué el coste por token es el dato interesante

Solo se activan 21.000 millones de parámetros en cada paso, de modo que una iteración de un bucle agéntico cuesta aproximadamente lo que costaría en un modelo denso de ese tamaño, aunque la capacidad total sea mucho mayor. Ese patrón de coste es la razón por la que Nous Research lo colocó como el cerebro barato de Hermes Agent en lugar de venderlo como chatbot.

Hermes Agent, por su parte, sigue siendo gratis y no está afectado por nada de esto: es un agente de línea de comandos autónomo con licencia MIT, memoria persistente, skills que se reescriben solas y una pasarela de mensajería que cubre más de 21 plataformas, Telegram, Discord y Slack entre ellas. Lo que caducó fue el modelo, no el agente.

Lo que todavía se puede usar sin pagar

A agosto de 2026, la colección de modelos gratuitos de OpenRouter ronda los 25 modelos. Los más útiles para trabajo de agente son KAT-Coder-Air V2.5, con 256K de contexto y buen comportamiento en código y tool calling; Qwen3 Coder 480B-A35B, con 1M; DeepSeek V4 Flash, con 1,3M y un precio de 0,07 dólares por millón de tokens de entrada, que no es gratis pero se le acerca; NVIDIA Nemotron 3 Nano Omni de 30B, orientado a percepción multimodal; y Liquid LFM2.5-2.6B, de 128K, para tareas ligeras en el borde.

Las listas de capa gratuita rotan sin avisar, así que conviene mirar la colección antes de montar nada encima. La verificación más reciente de estas cifras es del 24 de agosto de 2026.

Conectar cualquiera de ellos a Hermes Agent es un comando: hermes model, elegir proveedor y escoger modelo. No hace falta tocar YAML en una instalación estándar. Si se usa OpenRouter directamente, basta con la clave y el identificador del modelo en el selector. El único requisito duro es que el modelo tenga al menos 64K de contexto para que el harness arranque limpio.

La jugada sensata hoy es mezclar niveles: un modelo gratuito para los pasos rutinarios, resúmenes, borradores y ediciones pequeñas, y reservar uno de frontera para el razonamiento difícil en la parte alta del bucle. Quien esperaba un cerebro agéntico de 295.000 millones sin pagar se ha quedado fuera de la ventana, pero la distancia entre lo gratis y lo bueno es bastante menor de lo que sugiere el titular.