Blog IA generativa

Qué es llms.txt y cómo crearlo (con plantilla)

Google documenta que no hacen falta archivos de texto para IA en sus funciones. Que si lo lee, y el uso propio que tiene igualmente.

Alexander González 9 de agosto de 2026 · actualizado el 18 de agosto de 2026 2.304 palabras

Un archivo de texto en la raíz de tu dominio que le resume a un modelo de lenguaje qué hay en tu sitio y qué merece la pena leer. Lo propuso Jeremy Howard en 2024 y desde entonces se ha instalado en la conversación de SEO como si fuera obligatorio. No lo es, y conviene decirlo antes que nada: Google no lo usa. Lo que sí hace es barato, tarda veinte minutos y en algunos motores cambia lo que se lee de tu sitio. La variable que decide si te sirve no es técnica, es qué tan grande y qué tan desordenado es tu sitio.

¿Para qué sirve el archivo llms.txt?

Es una propuesta de archivo de texto que lista el contenido principal de un sitio para modelos de lenguaje. Google no lo usa. En un sitio nuevo no cambia nada; en uno de autoridad media lo leen algunos rastreadores de IA; en uno consolidado sirve sobre todo para declarar qué consideras tu contenido central.

Respuesta rápida

Motor¿Lee llms.txt?Qué usar en su lugar
Google (buscador y AI Overviews)NoSitemap XML y datos estructurados
ChatGPTParcialmente, según la implementaciónContenido claro y robots.txt que permita OAI-SearchBot
PerplexitySí en varios casos documentadosAmbos: llms.txt y sitemap
ClaudeAmbos

Qué tipo de archivo es esto en realidad

El modelo mental que trae casi todo el mundo es que llms.txt es "el robots.txt de la IA". Esa analogía es cómoda y es falsa, y lleva a usarlo mal.

robots.txt es un archivo de permisos: dice qué se puede rastrear y qué no. Es una barrera. llms.txt no da ni quita permisos a nadie: es un índice curado, escrito en Markdown, que dice "de todo lo que hay aquí, esto es lo importante y esto es lo que significa". Es una recomendación, no una regla.

La diferencia práctica importa. Bloquear a un rastreador en robots.txt funciona porque el rastreador lo respeta o se le nota. Poner una página en llms.txt no obliga a nadie a leerla. Nadie firma ese contrato.

Cuánto cambia eso depende del tamaño del sitio.

Sitio pequeño, menos de 30 páginas. Un modelo que llegue va a recorrerlo entero. El archivo no le ahorra nada porque no hay nada que filtrar. Se puede poner, cuesta veinte minutos, y el efecto medible va a ser cero.

Sitio mediano con secciones mezcladas, entre 30 y 300 páginas. Aquí empieza a ganar. Si tienes artículos, páginas de servicio, casos y una zona de soporte, el archivo separa lo que explica de lo que vende y evita que un modelo describa tu negocio a partir de una página de política de cookies.

Documentación o sitio grande, más de 300 páginas. Es su caso de uso original. Howard lo propuso pensando en documentación técnica, donde un modelo necesita saber cuál es la página de referencia de cada concepto entre cientos de páginas casi idénticas.

Cómo crearlo paso a paso

1. El esqueleto

El archivo va en https://tudominio.com/llms.txt, en texto plano con sintaxis Markdown. La estructura que propone la especificación es corta:

2. Escribir la frase de resumen

Es la parte que más rinde y la que peor se hace. La regla que funciona: escribe lo que escribiría un periodista sobre ti, no lo que escribiría tu departamento de marketing.

"Consultoría de sistemas de captación y posicionamiento para negocios en Colombia y Estados Unidos" es una frase útil: nombra el servicio, el mercado y el país. La versión con adjetivos que se ve en la mitad de los sitios, esa que promete excelencia y transformación sin decir qué se vende, no aporta ninguna entidad que un modelo pueda usar y ocupa el espacio donde debía ir la información.

3. Listar solo lo que de verdad representa el sitio

El error más común es volcar el sitemap entero. Un índice que lo incluye todo no es un índice: es el mismo problema con otro nombre. Si tienes 200 artículos, entran los 20 que definen de qué sabes.

4. Plantilla

Si prefieres rellenar campos en vez de escribir Markdown a mano, el generador de llms.txt de este sitio arma el archivo en el navegador y lo deja listo para descargar. No pide correo y nada de lo que escribas sale de tu equipo.

# Nombre del sitio

> Una frase que diga qué es esto, sin adjetivos comerciales.

## Guías principales

- [Título de la guía](https://tudominio.com/guia/): qué resuelve y para quién.
- [Otra guía](https://tudominio.com/otra/): qué resuelve y para quién.

## Servicios

- [Servicio](https://tudominio.com/servicio/): qué incluye y desde qué precio.

## Optional

- [Aviso legal](https://tudominio.com/legal/)

5. Comprobar que se sirve como texto plano

El fallo silencioso más habitual: el servidor devuelve el archivo con Content-Type: text/html o, peor, la página 404 con estado 200. Se comprueba en una línea:

curl -sI https://tudominio.com/llms.txt

Tiene que responder 200 y un tipo de contenido de texto. Si tu sitio corre en WordPress y la URL devuelve la plantilla del tema, el archivo no existe donde crees que existe.

Que se sirva bien no garantiza que esté bien escrito, y son dos fallos distintos. Un archivo con enlaces relativos, secciones vacías o viñetas que no tienen la forma - [Nombre](url) se sube igual y no protesta nadie. El validador de llms.txt revisa esa parte pegando el contenido, también sin subirlo a ningún sitio.

Lo que se aprende al ponerlo en varios sitios

El archivo envejece peor que el sitemap. Un sitemap se regenera solo; el llms.txt se escribe a mano y a los seis meses apunta a tres artículos que ya no existen. Un índice curado que enlaza a 404 es peor que no tener índice, porque lo que le enseña al modelo es que tu sitio no es fiable. Si no vas a mantenerlo, no lo pongas.

Escribirlo obliga a una decisión útil, aunque ningún modelo lo lea. Elegir las veinte páginas que representan tu sitio es un ejercicio de arquitectura que casi nadie ha hecho. En más de una ocasión el resultado del ejercicio fue descubrir que las páginas que mejor explicaban el negocio no estaban enlazadas desde ningún sitio.

No sustituye a dejar entrar a los rastreadores. Un llms.txt perfecto en un sitio que bloquea a los rastreadores de OpenAI en robots.txt no sirve para nada, y ahí hay un matiz que cuesta caro: no todos los rastreadores hacen lo mismo. Conviene revisar los dos archivos el mismo día, porque se contradicen con facilidad.

Cuidado con las cifras que circulan. Se repite mucho que implementarlo sube entre un 30 % y un 45 % las menciones en herramientas de IA. Esa afirmación circula sin una metodología pública detrás, y no hay forma de aislar el efecto del archivo del efecto de haber reorganizado el contenido a la vez. Trátalo como lo que es: una hipótesis, no un dato.

Cuándo NO ponerlo

Cuando el sitio todavía no se indexa bien. Un archivo que describe un contenido que los buscadores no han guardado no arregla nada, y las causas reales de esa falta de indexación son otras.

Cuando implica mantener a mano una lista que va a quedarse desactualizada. Un llms.txt que describe una estructura que ya cambió es peor que no tenerlo: describe un sitio que no existe.

Lo que Google dice sobre esto, con esas palabras

Es la pregunta que trae aquí a casi todo el mundo y tiene respuesta publicada, aunque no en la página que uno esperaría.

En su documentación sobre funciones de IA en la búsqueda, Google enumera qué hace falta para aparecer en ellas: que la página esté indexada y sea apta para mostrarse con un fragmento. Y a continuación dice que no hace falta crear archivos nuevos legibles por máquina, ni archivos de texto para IA, ni añadir ningún dato estructurado especial.

Esa frase cubre este archivo de forma explícita. No es que Google lo ignore por descuido o que esté por llegar: es que declara que no lo necesita.

Lo que no significa es que el archivo no sirva para nada, y ahí está el matiz que se pierde en las dos direcciones. Hay rastreadores de sistemas de IA que sí lo leen, y para un sitio grande tiene un uso propio que no depende de nadie más: obliga a decidir qué considera uno su contenido central, que es un ejercicio útil aunque no lo lea ninguna máquina.

Qué lo lee de verdad, y qué no

Google no lo usa. Su documentación sobre funciones de IA dice expresamente que no hace falta crear archivos de texto para IA para aparecer en ellas, y lo que sí exige está en cómo aparecer en los AI Overviews.

Sí lo leen algunos rastreadores de IA, que es donde tiene sentido, con la implementación en WordPress descrita en llms.txt en WordPress.

Y no sustituye a nada de lo que ya existe: el sitemap sigue siendo lo que declara las URLs a los buscadores, según sitemap XML, y el trabajo que sí mueve la aguja en sistemas generativos está en GEO.

Errores que se repiten

Datos y transparencia

Que no hace falta crear archivos legibles por máquina ni archivos de texto para IA para aparecer en las funciones de IA de Google, y que lo que sí exige es estar indexado y ser apto para mostrarse con fragmento, procede de su documentación pública sobre funciones de IA en la búsqueda, comprobada el 12 de agosto de 2026. Que otros rastreadores sí lo leen es observación, no una lista verificable: ninguno publica un compromiso de soporte.

Verificado a agosto de 2026. La propuesta original es de Jeremy Howard (2024) y no ha sido adoptada como estándar por ningún buscador. Google no ha declarado que lo use. Anthropic y Perplexity sí lo leen en casos documentados. Las cifras de mejora que circulan en artículos del sector no vienen acompañadas de metodología pública y aquí se tratan como no verificadas.

Lo que este archivo dice de tu sitio

Veinte minutos, cero riesgo y un beneficio que depende de tu tamaño. Esa es la respuesta corta, y hace que la pregunta de si ponerlo o no sea bastante menos interesante de lo que parece.

La pregunta que sí vale la pena es la que aparece al escribirlo. Para llenar el archivo hay que decidir cuáles son las veinte páginas que representan lo que sabes hacer, y esa lista casi nunca coincide con las veinte que más tráfico reciben. Cuando no coinciden, el problema no es que falte un archivo en la raíz: es que el sitio está organizado alrededor de lo que la gente busca y no alrededor de lo que el negocio vende.

Preguntas frecuentes

¿Google lee el archivo llms.txt?

No. Google no ha declarado que lo use ni en el buscador ni en los AI Overviews. Para Google, las señales que cuentan siguen siendo el sitemap XML, el enlazado interno y los datos estructurados. Implementar llms.txt no tiene efecto sobre las posiciones orgánicas.

¿Es obligatorio tener llms.txt?

No. Es una propuesta de estándar, no un requisito. Ningún motor penaliza su ausencia. Su utilidad crece con el tamaño del sitio: en menos de 30 páginas el beneficio es marginal, y en documentación extensa es donde de verdad aporta.

¿Dónde se coloca el archivo?

En la raíz del dominio, accesible en https://tudominio.com/llms.txt, servido como texto plano con estado 200. El fallo más común es que el servidor devuelva la plantilla del tema en vez del archivo, así que conviene comprobarlo con una petición directa.

¿Qué diferencia hay entre llms.txt y robots.txt?

robots.txt concede o niega permisos de rastreo y los rastreadores lo respetan. llms.txt no da permisos: es un índice curado en Markdown que sugiere qué leer. Uno es una barrera, el otro una recomendación que nadie está obligado a seguir.

¿Sirve llms.txt para que ChatGPT cite mi web?

Ayuda a que entienda la estructura del sitio, pero no es lo que decide la cita. Lo que pesa es tener contenido con datos verificables y fuentes, que es lo que el estudio de GEO de Princeton midió: la evidencia con fuente sube entre un 30 y un 40 % la visibilidad en citas de IA (atribución precisada contra el paper el 17 de agosto de 2026).

La mayoría de sitios no tienen un problema de posicionamiento

Tienen un problema de qué pasa cuando alguien llega. Se puede estar primero en Google y no vender nada. El diagnóstico mira las dos cosas y te dice cuál de ellas te está costando dinero.

Ver el diagnóstico