Lean, el lenguaje que demuestra que la IA no alucina
Leo de Moura, creador de Lean, explica en una entrevista cómo la verificación formal complementa a los modelos probabilísticos de IA.
Leo de Moura, Senior Principal Applied Scientist en AWS y creador del lenguaje Lean, ha pasado por el podcast de Stack Overflow para hablar de un tema que cada vez preocupa más: cómo demostrar que los agentes de IA hacen lo correcto.
La conversación gira alrededor de Lean, un lenguaje de programación diseñado para la verificación formal. No es un lenguaje cualquiera: permite escribir pruebas matemáticas que verifican que el código cumple con su especificación. De Moura lleva años desarrollándolo y ahora lo aplica a la IA.
La idea es sencilla de explicar: los modelos de IA actuales son probabilísticos, generan respuestas basadas en patrones aprendidos, y a veces se equivocan. Lean entra donde la estadística no llega, demostrando de manera rigurosa que ciertos resultados son correctos.
¿Por qué ahora?
La entrevista llega en un momento en el que las empresas están desplegando agentes de IA autónomos que toman decisiones. Si un agente maneja código o datos críticos, un error no es una anécdota, es un incidente.
De Moura no propone sustituir los modelos probabilísticos por verificación formal, sino combinarlos. Cada uno cubre las carencias del otro. La verificación formal es costosa y compleja, pero para tareas críticas puede ser la diferencia entre un fallo y un acierto.
También menciona el uso de IA para optimizar código de forma continua, aunque no entra en detalles. La entrevista es más una conversación que una presentación técnica, así que no esperes ejemplos de código ni demos.
Lo que queda por ver
La gran pregunta es si esta combinación de técnicas llegará a los desarrolladores normales o se quedará en un nicho para sistemas críticos. De momento, la propuesta es interesante, pero habrá que ver si las herramientas maduran lo suficiente como para usarlas sin un equipo de especialistas.
La entrevista completa, eso sí, está en el blog de Stack Overflow, y merece la pena si te interesa el futuro de la IA fiable.
##Relacionado

Runway presenta Solaris, un modelo que genera interfaces de software en tiempo real
La compañía de IA Runway ha presentado Solaris, un sistema que genera la interfaz de usuario fotograma a fotograma en lugar de ejecutar código.

Anthropic abre la detección de texto de Claude a reguladores y medios
Anthropic lanza una API de verificación de marcas de agua para que organizaciones autorizadas comprueben si un texto fue generado por Claude.
Un transformer diminuto entrenado en 1,5 horas supera a muchos LLMs en ARC
Un desarrollador ha entrenado un transformer pequeño desde cero en solo 1,5 horas con una RTX 5090 y logra un 44% en ARC-1, superando a muchos modelos grandes y con un coste de 67 céntimos.