Qué es llms.txt y cómo crearlo (con plantilla)
Google documenta que no hacen falta archivos de texto para IA en sus funciones. Que si lo lee, y el uso propio que tiene igualmente.
Un archivo de texto en la raíz de tu dominio que le resume a un modelo de lenguaje qué hay en tu sitio y qué merece la pena leer. Lo propuso Jeremy Howard en 2024 y desde entonces se ha instalado en la conversación de SEO como si fuera obligatorio. No lo es, y conviene decirlo antes que nada: Google no lo usa. Lo que sí hace es barato, tarda veinte minutos y en algunos motores cambia lo que se lee de tu sitio. La variable que decide si te sirve no es técnica, es qué tan grande y qué tan desordenado es tu sitio.
¿Para qué sirve el archivo llms.txt?
Es una propuesta de archivo de texto que lista el contenido principal de un sitio para modelos de lenguaje. Google no lo usa. En un sitio nuevo no cambia nada; en uno de autoridad media lo leen algunos rastreadores de IA; en uno consolidado sirve sobre todo para declarar qué consideras tu contenido central.
Respuesta rápida
- Si tu sitio tiene menos de 30 páginas: el beneficio es marginal. Un modelo recorre eso entero sin ayuda.
- Si tienes documentación, cursos o cientos de artículos: aquí sí. El archivo es un índice curado que evita que el modelo se quede con la página equivocada.
- Si esperas que suba posiciones en Google: no va a pasar. Google no lo lee. Ese no es el trabajo de este archivo.
- Si lo que quieres es que ChatGPT o Perplexity te citen: ayuda a que entiendan tu sitio, pero lo que decide la cita es tener algo que valga la pena citar.
| Motor | ¿Lee llms.txt? | Qué usar en su lugar |
|---|---|---|
| Google (buscador y AI Overviews) | No | Sitemap XML y datos estructurados |
| ChatGPT | Parcialmente, según la implementación | Contenido claro y robots.txt que permita OAI-SearchBot |
| Perplexity | Sí en varios casos documentados | Ambos: llms.txt y sitemap |
| Claude | Sí | Ambos |
Qué tipo de archivo es esto en realidad
El modelo mental que trae casi todo el mundo es que llms.txt es "el robots.txt de la IA". Esa analogía es cómoda y es falsa, y lleva a usarlo mal.
robots.txt es un archivo de permisos: dice qué se puede rastrear y qué no. Es una barrera. llms.txt no da ni quita permisos a nadie: es un índice curado, escrito en Markdown, que dice "de todo lo que hay aquí, esto es lo importante y esto es lo que significa". Es una recomendación, no una regla.
La diferencia práctica importa. Bloquear a un rastreador en robots.txt funciona porque el rastreador lo respeta o se le nota. Poner una página en llms.txt no obliga a nadie a leerla. Nadie firma ese contrato.
Cuánto cambia eso depende del tamaño del sitio.
Sitio pequeño, menos de 30 páginas. Un modelo que llegue va a recorrerlo entero. El archivo no le ahorra nada porque no hay nada que filtrar. Se puede poner, cuesta veinte minutos, y el efecto medible va a ser cero.
Sitio mediano con secciones mezcladas, entre 30 y 300 páginas. Aquí empieza a ganar. Si tienes artículos, páginas de servicio, casos y una zona de soporte, el archivo separa lo que explica de lo que vende y evita que un modelo describa tu negocio a partir de una página de política de cookies.
Documentación o sitio grande, más de 300 páginas. Es su caso de uso original. Howard lo propuso pensando en documentación técnica, donde un modelo necesita saber cuál es la página de referencia de cada concepto entre cientos de páginas casi idénticas.
Cómo crearlo paso a paso
1. El esqueleto
El archivo va en https://tudominio.com/llms.txt, en texto plano con sintaxis Markdown. La estructura que propone la especificación es corta:
- Un
# H1con el nombre del sitio. - Una cita en bloque, la línea que empieza por
>, con una frase que resuma qué es. - Secciones
##con listas de enlaces, cada uno con una descripción de una línea. - Una sección
## Optionalal final con lo que se puede omitir si hace falta recortar.
2. Escribir la frase de resumen
Es la parte que más rinde y la que peor se hace. La regla que funciona: escribe lo que escribiría un periodista sobre ti, no lo que escribiría tu departamento de marketing.
"Consultoría de sistemas de captación y posicionamiento para negocios en Colombia y Estados Unidos" es una frase útil: nombra el servicio, el mercado y el país. La versión con adjetivos que se ve en la mitad de los sitios, esa que promete excelencia y transformación sin decir qué se vende, no aporta ninguna entidad que un modelo pueda usar y ocupa el espacio donde debía ir la información.
3. Listar solo lo que de verdad representa el sitio
El error más común es volcar el sitemap entero. Un índice que lo incluye todo no es un índice: es el mismo problema con otro nombre. Si tienes 200 artículos, entran los 20 que definen de qué sabes.
4. Plantilla
Si prefieres rellenar campos en vez de escribir Markdown a mano, el generador de llms.txt de este sitio arma el archivo en el navegador y lo deja listo para descargar. No pide correo y nada de lo que escribas sale de tu equipo.
# Nombre del sitio
> Una frase que diga qué es esto, sin adjetivos comerciales.
## Guías principales
- [Título de la guía](https://tudominio.com/guia/): qué resuelve y para quién.
- [Otra guía](https://tudominio.com/otra/): qué resuelve y para quién.
## Servicios
- [Servicio](https://tudominio.com/servicio/): qué incluye y desde qué precio.
## Optional
- [Aviso legal](https://tudominio.com/legal/)
5. Comprobar que se sirve como texto plano
El fallo silencioso más habitual: el servidor devuelve el archivo con Content-Type: text/html o, peor, la página 404 con estado 200. Se comprueba en una línea:
curl -sI https://tudominio.com/llms.txt
Tiene que responder 200 y un tipo de contenido de texto. Si tu sitio corre en WordPress y la URL devuelve la plantilla del tema, el archivo no existe donde crees que existe.
Que se sirva bien no garantiza que esté bien escrito, y son dos fallos distintos. Un archivo con enlaces relativos, secciones vacías o viñetas que no tienen la forma - [Nombre](url) se sube igual y no protesta nadie. El validador de llms.txt revisa esa parte pegando el contenido, también sin subirlo a ningún sitio.
Lo que se aprende al ponerlo en varios sitios
El archivo envejece peor que el sitemap. Un sitemap se regenera solo; el llms.txt se escribe a mano y a los seis meses apunta a tres artículos que ya no existen. Un índice curado que enlaza a 404 es peor que no tener índice, porque lo que le enseña al modelo es que tu sitio no es fiable. Si no vas a mantenerlo, no lo pongas.
Escribirlo obliga a una decisión útil, aunque ningún modelo lo lea. Elegir las veinte páginas que representan tu sitio es un ejercicio de arquitectura que casi nadie ha hecho. En más de una ocasión el resultado del ejercicio fue descubrir que las páginas que mejor explicaban el negocio no estaban enlazadas desde ningún sitio.
No sustituye a dejar entrar a los rastreadores. Un llms.txt perfecto en un sitio que bloquea a los rastreadores de OpenAI en robots.txt no sirve para nada, y ahí hay un matiz que cuesta caro: no todos los rastreadores hacen lo mismo. Conviene revisar los dos archivos el mismo día, porque se contradicen con facilidad.
Cuidado con las cifras que circulan. Se repite mucho que implementarlo sube entre un 30 % y un 45 % las menciones en herramientas de IA. Esa afirmación circula sin una metodología pública detrás, y no hay forma de aislar el efecto del archivo del efecto de haber reorganizado el contenido a la vez. Trátalo como lo que es: una hipótesis, no un dato.
Cuándo NO ponerlo
Cuando el sitio todavía no se indexa bien. Un archivo que describe un contenido que los buscadores no han guardado no arregla nada, y las causas reales de esa falta de indexación son otras.
Cuando implica mantener a mano una lista que va a quedarse desactualizada. Un llms.txt que describe una estructura que ya cambió es peor que no tenerlo: describe un sitio que no existe.
Lo que Google dice sobre esto, con esas palabras
Es la pregunta que trae aquí a casi todo el mundo y tiene respuesta publicada, aunque no en la página que uno esperaría.
En su documentación sobre funciones de IA en la búsqueda, Google enumera qué hace falta para aparecer en ellas: que la página esté indexada y sea apta para mostrarse con un fragmento. Y a continuación dice que no hace falta crear archivos nuevos legibles por máquina, ni archivos de texto para IA, ni añadir ningún dato estructurado especial.
Esa frase cubre este archivo de forma explícita. No es que Google lo ignore por descuido o que esté por llegar: es que declara que no lo necesita.
Lo que no significa es que el archivo no sirva para nada, y ahí está el matiz que se pierde en las dos direcciones. Hay rastreadores de sistemas de IA que sí lo leen, y para un sitio grande tiene un uso propio que no depende de nadie más: obliga a decidir qué considera uno su contenido central, que es un ejercicio útil aunque no lo lea ninguna máquina.
Qué lo lee de verdad, y qué no
Google no lo usa. Su documentación sobre funciones de IA dice expresamente que no hace falta crear archivos de texto para IA para aparecer en ellas, y lo que sí exige está en cómo aparecer en los AI Overviews.
Sí lo leen algunos rastreadores de IA, que es donde tiene sentido, con la implementación en WordPress descrita en llms.txt en WordPress.
Y no sustituye a nada de lo que ya existe: el sitemap sigue siendo lo que declara las URLs a los buscadores, según sitemap XML, y el trabajo que sí mueve la aguja en sistemas generativos está en GEO.
Errores que se repiten
- Volcar el sitemap completo. Deja de ser un índice curado y vuelve al problema original.
- Rellenarlo de lenguaje comercial. Los adjetivos ocupan el sitio de la información y no aportan ninguna entidad que el modelo pueda usar.
- Ponerlo y olvidarlo. Enlaces rotos a los seis meses.
- Esperar tráfico. El archivo no genera visitas. En el mejor de los casos mejora cómo te describen.
- Confundirlo con
llms-full.txt. Esa variante incluye el contenido completo, no solo los enlaces. Tiene sentido en documentación y casi nunca en un sitio de negocio. - Publicarlo bloqueando a los rastreadores de IA. Los dos archivos tienen que contar la misma historia.
Datos y transparencia
Que no hace falta crear archivos legibles por máquina ni archivos de texto para IA para aparecer en las funciones de IA de Google, y que lo que sí exige es estar indexado y ser apto para mostrarse con fragmento, procede de su documentación pública sobre funciones de IA en la búsqueda, comprobada el 12 de agosto de 2026. Que otros rastreadores sí lo leen es observación, no una lista verificable: ninguno publica un compromiso de soporte.
Verificado a agosto de 2026. La propuesta original es de Jeremy Howard (2024) y no ha sido adoptada como estándar por ningún buscador. Google no ha declarado que lo use. Anthropic y Perplexity sí lo leen en casos documentados. Las cifras de mejora que circulan en artículos del sector no vienen acompañadas de metodología pública y aquí se tratan como no verificadas.
Lo que este archivo dice de tu sitio
Veinte minutos, cero riesgo y un beneficio que depende de tu tamaño. Esa es la respuesta corta, y hace que la pregunta de si ponerlo o no sea bastante menos interesante de lo que parece.
La pregunta que sí vale la pena es la que aparece al escribirlo. Para llenar el archivo hay que decidir cuáles son las veinte páginas que representan lo que sabes hacer, y esa lista casi nunca coincide con las veinte que más tráfico reciben. Cuando no coinciden, el problema no es que falte un archivo en la raíz: es que el sitio está organizado alrededor de lo que la gente busca y no alrededor de lo que el negocio vende.
Preguntas frecuentes
¿Google lee el archivo llms.txt?
No. Google no ha declarado que lo use ni en el buscador ni en los AI Overviews. Para Google, las señales que cuentan siguen siendo el sitemap XML, el enlazado interno y los datos estructurados. Implementar llms.txt no tiene efecto sobre las posiciones orgánicas.
¿Es obligatorio tener llms.txt?
No. Es una propuesta de estándar, no un requisito. Ningún motor penaliza su ausencia. Su utilidad crece con el tamaño del sitio: en menos de 30 páginas el beneficio es marginal, y en documentación extensa es donde de verdad aporta.
¿Dónde se coloca el archivo?
En la raíz del dominio, accesible en https://tudominio.com/llms.txt, servido como texto plano con estado 200. El fallo más común es que el servidor devuelva la plantilla del tema en vez del archivo, así que conviene comprobarlo con una petición directa.
¿Qué diferencia hay entre llms.txt y robots.txt?
robots.txt concede o niega permisos de rastreo y los rastreadores lo respetan. llms.txt no da permisos: es un índice curado en Markdown que sugiere qué leer. Uno es una barrera, el otro una recomendación que nadie está obligado a seguir.
¿Sirve llms.txt para que ChatGPT cite mi web?
Ayuda a que entienda la estructura del sitio, pero no es lo que decide la cita. Lo que pesa es tener contenido con datos verificables y fuentes, que es lo que el estudio de GEO de Princeton midió: la evidencia con fuente sube entre un 30 y un 40 % la visibilidad en citas de IA (atribución precisada contra el paper el 17 de agosto de 2026).
La mayoría de sitios no tienen un problema de posicionamiento
Tienen un problema de qué pasa cuando alguien llega. Se puede estar primero en Google y no vender nada. El diagnóstico mira las dos cosas y te dice cuál de ellas te está costando dinero.
Ver el diagnóstico