Perplexity libera su motor Lily, optimizado para Apple Silicon
El motor Lily, construido en Rust y Metal, promete un 23 % más de velocidad en prompts y un 35 % en generación de tokens respecto a MLX‑LM en el M5 Max.

Perplexity ha creado un motor de inteligencia artificial local pensado para Apple Silicon y el modelo Qwen3.6‑35B‑A3B. Se llama Lily y está construido con un runtime en Rust y kernels personalizados en Metal, evitando PyTorch y MLX en su ruta de ejecución.
En pruebas realizadas en un MacBook Pro M5 Max con 128 GB de memoria unificada, Lily obtuvo un 23 % de mejora en el procesamiento de prompts y un 35 % en la generación de tokens comparado con MLX‑LM. El motor se centra en el modelo Qwen3.6‑35B‑A3B, a diferencia de MLX‑LM que admite una gama más amplia de modelos y arquitecturas.
Perplexity planea lanzar el código bajo licencia open source, aunque aún no está disponible públicamente, por lo que las cifras de rendimiento dependen únicamente de pruebas internas.
Esta iniciativa muestra cómo la optimización de hardware específico puede superar a bibliotecas más genéricas, aunque la comunidad deberá esperar a que el repositorio esté accesible para evaluar la reproducibilidad de los resultados.
