Ant Group open sourcea Ming-Image-0.1-Design, líder en diseño UI entre modelos abiertos
El modelo de 6B genera interfaces, infografías y posters desde texto, destacando en renderizado de texto y control de estructura.

Ant Group ha abierto el código del modelo Ming-Image-0.1-Design, una familia de modelos de generación de imágenes de 6.000 millones de parámetros especializada en diseño gráfico y de interfaces. La iniciativa incluye dos variantes principales: una que genera diseños completos a partir de prompts de texto y otra que descompone imágenes en capas transparentes editables. Además, se han publicado herramientas adicionales para conectar esta capacidad con la generación de código frontend y presentaciones PPT editables.
En la evaluación especializada en diseño UI/UX de Artificial Analysis, actualizada el 18 de septiembre de 2026, Ming-Image-0.1-Design ocupa el primer puesto entre los modelos de código abierto con un Elo de 1082. Las métricas detalladas muestran un 67,4% de éxito en el establecimiento del layout, un 67,0% en composiciones complejas y un 66,7% en el renderizado de texto. El modelo soporta prompts estructurados de hasta 8K tokens, lo que permite organizar la salida en módulos, estilos visuales y jerarquías de contenido con mayor consistencia que los enfoques tradicionales de llamada a múltiples modelos de genéricos.
La variante Layer introduce un VAE RGBA nativo, lo que permite la generación directa de activos con fondos transparentes, como iconos, productos o elementos decorativos. Sin embargo, el equipo de Ant Group subraya limitaciones claras en la documentación: la precisión deca en movimientos humanos complejos o efectos de iluminación muy específicos, y la segmentación en capas puede presentar artefactos en bordes o transparencia inconsistente cuando hay superposiciones densas.
Para facilitar la adopción, el proveedor ha habilitado un acceso gratuito a la API a través de OpenRouter por un periodo de dos semanas. Para los equipos de desarrollo, esto representa una oportunidad de probar la integración de un modelo de diseño dedicado directamente en sus pipelines de frontend, eliminando la necesidad de orquestar múltiples llamadas a modelos de imagen genéricas para lograr una coherencia visual global.