Qué es llms.txt, cómo se estructura según la propuesta original, en qué se diferencia de robots.txt y sitemap.xml, y qué puedes esperar de él en SEO.
llms.txt es un archivo Markdown que se coloca en la raíz de una web para que los modelos de lenguaje encuentren su contenido importante sin tener que leer el HTML. Es un índice pensado para máquinas, pero escrito en un formato que cualquier persona puede leer y editar.
La propuesta la publicó Jeremy Howard en septiembre de 2024 y está documentada en llmstxt.org. Parte de un problema concreto: las páginas web están hechas para personas, con menús, scripts, banners y maquetación, y un modelo de lenguaje que quiere leerlas tiene que extraer el contenido útil de entre todo ese ruido. Además, una web entera no cabe en la ventana de contexto de un modelo.
La solución es un archivo en /llms.txt que hace dos cosas: resume de qué va el sitio y lista, con enlaces, las páginas que merece la pena leer. Un agente que necesita información sobre el proyecto empieza por ahí en lugar de rastrear el sitio a ciegas.
La propuesta deja claro que está pensada para el momento de uso, no para el entrenamiento: sirve cuando un agente necesita información sobre un tema mientras ayuda a un usuario.
El formato no es casual. Markdown es lo que mejor leen los modelos de lenguaje, porque está lleno de estructura explícita (un ## es una sección, un - es un elemento de lista) sin el peso de las etiquetas HTML. Lo explicamos con más detalle en Markdown y la inteligencia artificial.
Al mismo tiempo, es texto que una persona puede escribir y revisar sin herramientas. Un llms.txt es, en la práctica, una página de índice escrita con la sintaxis básica de Markdown.
La propuesta define un orden fijo para las secciones. Solo la primera es obligatoria:
Cada elemento de esas listas lleva un enlace en formato Markdown, [nombre](url), seguido opcionalmente de dos puntos y una nota que explica qué hay en esa página. Si necesitas repasar la sintaxis de los enlaces, la tienes en la guía de Markdown.
Hay una sección con un nombre especial: ## Optional. Por convención, lo que se pone ahí es información secundaria que un agente puede saltarse si va justo de contexto.
Este sitio tiene su propio llms.txt, que puedes ver completo en tutorialmarkdown.com/llms.txt. Este es su principio y su final:
# TutorialMarkdown
> Sitio educativo en español sobre Markdown: sintaxis básica, extendida y avanzada, aplicaciones y herramientas, conversores online y uso de Markdown con chatbots y agentes de IA.
Todo el contenido está en español. Las guías de sintaxis siguen CommonMark y GitHub Flavored Markdown, e indican cuándo un elemento es una extensión que no funciona en todos los editores.
## Aprender Markdown
- [Qué es Markdown](https://tutorialmarkdown.com/markdown): qué es, cómo funciona y para qué se usa
- [Guía rápida](https://tutorialmarkdown.com/guia): referencia rápida con toda la sintaxis básica
- [Sintaxis básica](https://tutorialmarkdown.com/sintaxis): encabezados, énfasis, listas, enlaces, imágenes, citas y código, con ejemplos
## Optional
- [Glosario](https://tutorialmarkdown.com/glosario): términos del ecosistema Markdown
- [Preguntas frecuentes](https://tutorialmarkdown.com/faq): respuestas a las dudas más habituales sobre MarkdownFíjate en que las notas tras cada enlace no repiten el título: dicen qué va a encontrar el agente si abre esa página. Esa es la información que le permite decidir qué leer.
La propuesta incluye una segunda idea, igual de útil que el propio archivo: que cada página tenga una versión limpia en Markdown en la misma URL con .md añadido. Así, junto a pagina.html existiría pagina.html.md, o pagina.md si se sustituye la extensión.
Con eso, los enlaces del llms.txt pueden apuntar directamente a la versión Markdown, y el agente se ahorra la conversión. Si tu contenido ya está escrito en Markdown, como en la mayoría de sitios de documentación, publicar esa versión es casi gratis. Si no, herramientas como las que comentamos en cómo usar MarkItDown con Claude o nuestro conversor de HTML a Markdown sirven para generarla.
Algunos sitios publican además un llms-full.txt con todo el contenido concatenado en un único archivo. Es una práctica extendida, pero no forma parte de la propuesta original.
Los tres archivos viven en la raíz del sitio y se dirigen a máquinas, así que es fácil confundirlos. Cada uno cumple una función distinta:
| Archivo | Para qué sirve | Formato |
|---|---|---|
robots.txt | Dice a los rastreadores qué pueden visitar | Texto con directivas |
sitemap.xml | Lista todas las páginas indexables del sitio | XML |
llms.txt | Resume el sitio y señala lo que merece la pena leer | Markdown |
La propia propuesta explica la diferencia. robots.txt regula el acceso, mientras que llms.txt se consulta bajo demanda cuando un agente necesita información. Y un sitemap.xml lista todas las páginas, pero no ofrece versiones legibles para un modelo ni selecciona lo importante: para una ventana de contexto, una lista de cientos de URL no es útil.
llms.txt no sustituye a ninguno de los dos. Se añade a ellos.
Aquí conviene ser claro, porque se ha vendido mucho como una técnica de posicionamiento. Google indica en su documentación sobre las funciones de IA de la Búsqueda que no hace falta crear archivos legibles por máquinas, archivos de texto para IA ni marcado especial para aparecer en ellas. Lo que cuenta es lo de siempre: que la página esté indexada y sea apta para mostrarse en los resultados.
Así que llms.txt no es una palanca de SEO en Google. Si lo que buscas es posicionar, el esfuerzo rinde más en contenido y estructura.
Donde sí tiene sentido es en la documentación técnica. Cuando un desarrollador trabaja con un agente de programación y le pasa la documentación de una librería, un llms.txt bien hecho le da al agente un índice limpio de por dónde empezar. Por ejemplo, la documentación de Claude Code publica el suyo en code.claude.com/docs/llms.txt, y la de la especificación de skills en agentskills.io/llms.txt.
Como cuesta muy poco de mantener, la decisión práctica es sencilla: si tu web es documentación de un producto, una API o una librería, créalo. Si es un blog o una tienda, no esperes nada de él.
El proceso es corto y no necesita ninguna herramienta especial. Estos son los pasos:
public/ en Next.js, para que se sirva en /llms.txt.## Optional.Para crear el archivo puedes seguir lo mismo que para cualquier archivo .md: la extensión es .txt, pero el contenido es Markdown.
No hace falta ninguna herramienta: basta con añadir /llms.txt a la dirección del sitio y abrirla en el navegador. Si existe, verás el Markdown en texto plano; si no, una página de error.
Algunos ejemplos que puedes abrir para ver cómo lo resuelven otros:
code.claude.com/docs/llms.txt: la documentación de Claude Code, con todas sus páginas organizadas por secciones.agentskills.io/llms.txt: la especificación de las skills, un caso pequeño y fácil de leer.tutorialmarkdown.com/llms.txt: el de este sitio, del que has visto un fragmento más arriba.Ten en cuenta que algunos sitios de documentación lo publican dentro de la ruta de la documentación, como /docs/llms.txt, y no en la raíz del dominio. La propuesta lo permite: el archivo puede estar en la raíz o en cualquier ruta dentro del sitio.
Estos son los fallos que más se repiten en los llms.txt publicados:
llms.txt con enlaces rotos o páginas antiguas es peor que no tenerlo.👋 Hola! Soy Edu, me encanta crear cosas y he redactado este tutorial. Si te ha resultado útil, el mayor favor que me podrías hacer es el de compatirlo en Twitter.
Sígueme en Twitter para estar al día con mi contenido. 😊