BookinglyTech News
Inteligencia artificial

llms.txt estrena la versión 2 de su especificación y Chrome ya la audita

Jeremy Howard publica la versión 2 de la propuesta, que define rutas y anuncios del archivo, mientras Chrome lo audita en Lighthouse y Google Search dice que no lo lee.

3 min de lecturaDev.to0 vistas

Jeremy Howard publicó el 10 de agosto de 2026 la versión 2 de llms.txt, la propuesta que describe cómo debe ser un archivo de texto plano para que los agentes de IA entiendan un sitio. El formato no cambia; lo que cambia es dónde puede vivir el archivo y cómo se anuncia. Chrome ya lo audita en Lighthouse 13.3, WordPress.org sirve el suyo en la raíz y tres de los cuatro grandes plugins de SEO para WordPress lo generan en su versión gratuita.

El formato sigue siendo un H1

Según la propuesta, un archivo válido contiene "un H1 con el nombre del proyecto o del sitio. Es la única sección obligatoria", seguido de un resumen en blockquote, párrafos libres y secciones H2 con listas de enlaces markdown. Un archivo con una sola línea, # Example Shop, ya vale. La sección ## Optional sobrevive, aunque las herramientas ya no la tratan como una señal mecánica.

Lo nuevo es el descubrimiento. La v1 permitía archivos en subrutas sin aclarar qué implicaba eso; la v2 define que un archivo cubre las páginas bajo su ruta y que se aplica el más específico. Una página puede anunciar el suyo con <link rel="describedby" href="/llms.txt"> en el head o con una cabecera HTTP Link: puesta en el CDN. La versión markdown de una página puede estar en page.html.md o en page.md.

Howard afirma que hay miles de sitios publicándolo, y las documentaciones de OpenAI y Anthropic responden 200 en sus rutas. WordPress.org también: 75 líneas que empiezan recordando que WordPress mueve más del 43% de los sitios web.

Chrome lo audita, Google Search dice que no lo lee

Lighthouse 13.3 añadió la categoría Agentic Browsing, con cuatro auditorías. Una se llama "llms.txt does not follow recommendations" y suspende un archivo sin H1, demasiado corto o sin enlaces. Si el servidor responde 404, la auditoría queda como no aplicable y la categoría no da puntuación. Hay además un bug abierto: el issue 17082 documenta un archivo conforme a la especificación que devuelve 200 y aun así aparece como "Fetch of llms.txt failed" en PageSpeed Insights.

Frente a eso, John Mueller, de Google, escribió en Bluesky en junio de 2025 que ningún sistema de IA usa el archivo. Su prueba está en los registros: los LLM de consumo descargan las páginas, para entrenamiento y para fundamentar respuestas, pero no el llms.txt. Quince meses después Search y Chrome no dicen lo mismo. La propia especificación admite que el uso más intensivo está en la documentación de software, donde los agentes lo siguen para encontrar referencias de API. Y nada de esto sustituye a robots.txt, que sigue decidiendo qué se puede rastrear.

En el directorio de plugins de WordPress había 521 resultados para "llms.txt" el 24 de septiembre de 2026. Yoast SEO 28.5 lo trae desactivado y escribe un archivo físico en la raíz una vez por semana por WP-Cron, con cinco enlaces por tipo de contenido y descartando lo publicado hace más de doce meses. Rank Math 1.0.279 también arranca apagado y lo sirve en cada petición con una regla de reescritura, sin nada en disco, 50 enlaces por tipo y cabecera X-Robots-Tag: noindex, nofollow. All in One SEO 5.0.2, igualmente desactivado por defecto, genera el archivo a diario con Action Scheduler y admite 1.000 enlaces por tipo de contenido. Los valores por defecto de los plugins comparados difieren en un factor de 200.

En la práctica, un administrador decide si publica unos kilobytes de texto que hoy casi nadie lee. El coste de confiar en ellos sí es mayor: los rastreadores descargan el HTML, y a eso se accede por robots.txt.