BookinglyTech News
Inteligencia artificial

MiniMax H3 Max: qué es, cuánto cuesta y en qué se diferencia de H3

fal.ai publicó una versión afinada en velocidad del modelo de vídeo multimodal MiniMax H3. Cuesta 0,08 dólares por segundo a 768p y hay tres nombres circulando mezclados.

3 min de lecturaDev.to0 vistas

MiniMax liberó los pesos abiertos de H3 en agosto de 2026 y fal.ai publicó unas semanas después una variante optimizada en velocidad, H3 Max. El dato que importa: renderiza un clip de cinco segundos a 768p en unos tres segundos, más rápido de lo que dura el propio clip. Eso abre casos de uso que antes no existían, como streams de vídeo generados en vivo a partir de un chat.

El problema es que en cada hilo sobre el tema aparecen tres nombres mezclados, y no son lo mismo.

Tres nombres, tres cosas distintas

MiniMax H3 es el modelo original: pesos abiertos bajo la MiniMax H3 Community License, hasta 2K de resolución en la API alojada y 768p si se despliega desde los pesos, con unos tres segundos por clip de cinco segundos como referencia de velocidad. H3 Max es el post-entrenamiento de fal.ai sobre H3: misma resolución de 768p, velocidad similar, solo por API. H3 Max Turbo aprieta más la velocidad y también es únicamente API.

H3 es multimodal en las dos direcciones. Una petición acepta texto, imagen, vídeo o audio y devuelve entre 5 y 15 segundos de vídeo a 24 fps con pista de audio estéreo nativa, generada en la misma pasada. No hay que pegar un clip mudo a otro modelo de audio ni arreglar el sonido después: si no gusta, se regenera.

Cómo se llama y cuánto cuesta

Hay cinco endpoints. Texto a vídeo, imagen a vídeo y referencia a vídeo cuelgan de minimax/h3-max/, y texto e imagen a vídeo de minimax/h3-max-turbo/. Los parámetros cambian según el modo: texto a vídeo toma prompt, aspect_ratio, duration, resolution y seed; imagen a vídeo cambia el aspect ratio por image_url y un end_image_url opcional para animar hacia un fotograma final; referencia a vídeo acepta reference_image_urls, reference_video_urls y reference_audio_urls, que es lo que mantiene a un personaje consistente entre planos.

La llamada se hace con el cliente @fal-ai/client y subscribe, que bloquea hasta que el clip está listo. En un script da igual; en una aplicación web no, porque un render de 15 segundos sigue siendo una espera que no conviene mantener con la conexión abierta. Ahí toca encolar con webhook y devolver la petición inmediatamente.

El precio va por segundo generado y la promoción de lanzamiento terminó el 7 de septiembre de 2026. Turbo cuesta 0,025 dólares por segundo a 480p y 0,04 a 768p, o 0,60 por un clip de 15 segundos a 768p. H3 Max sube a 0,05 y 0,08 por segundo, y 1,20 por esos mismos 15 segundos. fal activa la recarga automática por defecto, así que si se quiere un techo de gasto hay que desactivarla antes de empezar a probar.

Lo que aparece al usarlo

Un clip de 15 segundos a 1080p desde H3 pesa 124 MB. Autoreproducir un muro de esos en una página es una forma rápida de quemar el ancho de banda del visitante, así que lo razonable es mostrar pósteres y cargar el vídeo solo al clic. La URL de salida es pública, con CORS abierto y soporte de range requests, de modo que se puede apuntar un directamente a ella, pero la retención la decide fal y la vida de esa URL no está en manos de quien la consume. Otro detalle que rompe promesas de producto: en imagen a vídeo el aspect ratio sigue a la imagen de entrada, convenga o no.

Para quien esté empezando, el directorio h3max.info reúne los enlaces oficiales, los endpoints de fal, los pesos abiertos, precios y proyectos ya publicados, revisados a mano. Lo mantienen los mismos autores del anuncio, así que conviene leerlo con eso en mente.

Lo que queda por ver es si fal sostiene estas tarifas ahora que se acabó la promoción, y si la licencia comunitaria de los pesos aguanta el uso comercial sin sorpresas.