Cua abre la puerta a agentes de IA que usan el escritorio de forma nativa
Cua, infraestructura open‑source, permite que los agentes de IA naveguen entre scripts, APIs y aplicaciones gráficas sin interrumpir al desarrollador.

Cua (trycua/cua) llega como un sistema de automatización de escritorio diseñado para agentes de IA que necesitan operar aplicaciones gráficas, algo que antes requería soluciones frágiles y con interferencia del cursor. La plataforma se compone de cinco módulos.
Cua Driver
El driver integra la automatización a nivel de sistema operativo en macOS, Windows y Linux. A diferencia de PyAutoGUI, el driver permite que los agentes envíen clics y teclas al fondo, sin mover el puntero ni sacar foco de la ventana de código.
Cua Fleets
Para ejecuciones no confiables o pruebas escalables, Cua Fleets crea escritorios Linux aislados en la nube. Un agente puede reclamar una instancia pre‑caliente, ejecutar comandos bash, lanzar software gráfico y capturar capturas de pantalla de alta resolución.
CUA‑S1
Los LLM generales son lentos cuando se usan para decidir interacciones de UI. CUA‑S1 son modelos especializados que, a partir de árboles de accesibilidad, determinan qué elemento UI activar en menos de un segundo, reduciendo costos de cómputo.
Lume
Lume es un CLI ligero que administra máquinas virtuales macOS y Linux en Apple Silicon usando Virtualization.Framework. Permite arrancar VMs macOS Tahoe en segundos y conectarse por SSH.
Cua Bench
Proporciona un marco reproducible para definir tareas de escritorio, ejecutar soluciones de referencia y exportar trayectorias de pasos. Es útil para entrenar y evaluar agentes.
Instalación
Para macOS y Linux:
/bin/bash -c "$(curl -fsSL https://cua.ai/driver/install.sh)"
Para Windows (PowerShell):
irm https://cua.ai/driver/install.ps1 | iex
Integración con agentes
Si ya usas Claude Code, Codex o Cursor, simplemente instruye al agente a instalar el driver siguiendo el README del repositorio.
Ejemplo de benchmark
# Cua Bench con soporte de navegador
uv tool install 'cua-bench[browser]'
uv tool run --from 'cua-bench[browser]' playwright install chromium
cua-bench run --task example-task
El evaluador confirma la interacción, verifica los cambios de estado de la UI y devuelve una puntuación normalizada y los logs de acción.
Por qué importa
Con Cua, los agentes pueden pasar de generar código a interactuar con el entorno real de desarrollo sin sacrificar la experiencia del desarrollador. La arquitectura modular y la compatibilidad multi‑SO garantizan que la solución sea escalable y segura para entornos productivos.

