Qué es llms.txt, cómo crearlo y si de verdad sirve
llms.txt es un archivo en formato Markdown que colocas en la raíz de tu web (https://tudominio.com/llms.txt) para ofrecer a los modelos de IA una lista curada y limpia de tus contenidos más importantes, con enlaces y descripciones breves. Se propuso en 2024 como complemento al SEO, pero su adopción real es limitada y ningún gran buscador —Google incluido— confirma que lo use para generar respuestas. Es un complemento de bajo coste, no una prioridad. Si tu meta es aparecer en ChatGPT, Perplexity o Google AI Overviews, invierte antes en autoridad de entidad y contenido citable que en perfeccionar un llms.txt.
Qué es el archivo llms.txt
llms.txt es un archivo de texto en Markdown que funciona como un índice curado de tu sitio para los grandes modelos de lenguaje. Lo creas tú, lo publicas en la raíz de tu servidor (https://tudominio.com/llms.txt) y los rastreadores de IA (GPTBot de OpenAI, ClaudeBot de Anthropic, PerplexityBot) pueden leerlo cuando visitan tu web.
La idea, propuesta por Jeremy Howard (Answer.AI) en llmstxt.org en septiembre de 2024, parte de un problema técnico real: una página HTML está llena de menús, banners, scripts y avisos de cookies que gastan la ventana de contexto del modelo y esconden lo importante. llms.txt ofrece, en su lugar, una lista limpia en Markdown de tus URLs clave con una frase de contexto por cada una. Piénsalo como un índice para máquinas, no como un robots.txt (que ordena qué se puede rastrear) ni como un sitemap (que lista todo sin jerarquía).
El formato real: cómo se estructura de verdad
Aquí está el punto donde más guías se equivocan. llms.txt no es un archivo de pares «clave: valor» tipo Nombre: o Citar como:. La especificación de llmstxt.org define una estructura Markdown concreta:
- Un
# H1con el nombre del sitio o proyecto. Es el único campo obligatorio. - Un blockquote
>con un resumen corto del sitio (opcional pero muy recomendado). - Cero o más párrafos o listas en Markdown con detalles adicionales (sin usar encabezados).
- Secciones delimitadas por
## H2, cada una con una lista de enlaces en formato- [Nombre](URL): nota opcional. - Una sección especial
## Optional: sus enlaces son secundarios y el modelo puede omitirlos si necesita un contexto más corto.
Un ejemplo mínimo y válido:
# Nombre de tu empresa
> Breve descripción de qué hace tu negocio y a quién sirve, en una o dos frases.
Información adicional en texto plano: sectores, cobertura, propuesta de valor.
## Documentación
- [Guía de inicio](https://tudominio.com/guia): Cómo empezar en 5 minutos.
- [Preguntas frecuentes](https://tudominio.com/faq): Dudas habituales de clientes.
## Optional
- [Aviso legal](https://tudominio.com/legal): Se puede omitir si el contexto es corto.
Buena práctica. Muchos sitios enlazan a versiones limpias en Markdown de cada página (añadiendo
.mda la URL, p. ej./guia.md) para que el modelo reciba el contenido sin el ruido del HTML. Y no confundasllms.txtcon robots.txt: uno es un índice curado; el otro, una orden de acceso para rastreadores.
Cómo crearlo: plantilla lista para copiar
Copia esta plantilla, adáptala a tu negocio y guárdala como /llms.txt en la raíz. Sirve igual para una empresa en España, México, Colombia o Argentina —cambia las URLs y el contexto, no el formato:
# Tu Marca
> Tu Marca ayuda a [tu público] a [resultado que consigues]. Con sede en
> [tu país] y cobertura en [mercados]. Contacto: [email de contacto].
Sectores que atendemos, propuesta de valor y cualquier dato de contexto
que ayude a un modelo a describirte bien en una respuesta.
## Páginas principales
- [Inicio](https://tudominio.com/): Qué hacemos y para quién.
- [Servicios](https://tudominio.com/servicios): Detalle de lo que ofrecemos.
- [Sobre nosotros](https://tudominio.com/sobre): Equipo, trayectoria y autoridad.
## Recursos y blog
- [Blog](https://tudominio.com/blog): Guías y artículos de referencia.
- [Preguntas frecuentes](https://tudominio.com/faq): Respuestas directas.
- [Casos de éxito](https://tudominio.com/casos): Resultados con clientes reales.
## Optional
- [Aviso legal](https://tudominio.com/legal)
- [Política de privacidad](https://tudominio.com/privacidad)
Requisitos para que funcione: el archivo debe ser accesible públicamente en https://tudominio.com/llms.txt, devolver un 200 (no un 404), no exigir autenticación y estar en texto plano UTF-8. Comprueba también que tu robots.txt no bloquee a los bots de IA que quieras que lo lean.
llms.txt frente a llms-full.txt
Aunque llms.txt es la variante difundida, existe otra más extensa llamada llms-full.txt.
| Aspecto | llms.txt | llms-full.txt |
|---|---|---|
| Qué contiene | Índice curado: enlaces + descripciones | El texto completo del sitio concatenado en un solo archivo |
| Tamaño | Compacto: decenas de líneas | Muy extenso: puede superar el millón de palabras |
| Uso | Orientar al modelo hacia lo importante | Servir todo el contenido como contexto directo |
| Adopción | Limitada | Muy limitada |
| Recomendación | Créalo si optimizas para IA | Solo si tu documentación es tu producto (SaaS/dev tools) |
Para la mayoría de negocios, llms-full.txt es innecesario: mantente con llms.txt simple.
¿De verdad lo usan los modelos? (La controversia)
Aquí viene la verdad incómoda: la adopción de llms.txt por los grandes modelos es limitada e incierta.
Lo que sabemos
- Ningún gran buscador confirma que lo consuma. Google ha dicho públicamente (John Mueller) que no lo usa y lo ha comparado con la vieja etiqueta
meta keywords. No forma parte de su documentación de rastreo. - OpenAI, Anthropic y Perplexity pueden descargarlo técnicamente, pero no publican si —ni cuánto— lo ponderan frente a otras señales (enlaces, autoridad, contenido de la propia página).
- Adopción baja del lado editor: solo una minoría de webs lo ha implementado.
- Muchos archivos no se procesan: publicar el archivo no garantiza que un modelo lo lea al responder.
Por qué la incertidumbre
Los modelos no divulgan cómo procesan cada señal. robots.txt es un estándar respetado desde hace décadas; llms.txt es una propuesta joven sin adopción oficial. Un bot puede descargarlo, ignorarlo o procesarlo parcialmente según su arquitectura.
La recomendación práctica
Trata llms.txt como un complemento de bajo coste (30–60 minutos), no como estrategia central. Tu ROI real está en:
- Optimizar tu web para la IA: estructura clara y extraíble.
- Contenido citable: respuestas directas que un modelo pueda copiar.
- Datos estructurados:
Organization,FAQPageyArticleen JSON-LD. - Construir autoridad de entidad: menciones en terceros, perfiles, reseñas.
Si haces bien todo eso, llms.txt es solo la guinda.
Cómo implementarlo por CMS
El reto no es escribir el archivo, sino poder publicarlo en la raíz del dominio. Eso depende de tu plataforma:
| CMS / plataforma | ¿Acceso a la raíz? | Cómo publicarlo |
|---|---|---|
| WordPress / WooCommerce | Sí | Sube llms.txt a la carpeta raíz por FTP o gestor de archivos; hay plugins que lo generan |
| Hugo, Astro, Next.js y sitios estáticos | Sí | Colócalo en la carpeta static/ o public/; se sirve tal cual en la raíz |
| Shopify | No (raíz bloqueada) | No admite archivos raíz arbitrarios; usa una página de recursos y refuerza schema y blog |
| Wix, Squarespace, Webflow | No | Sin acceso a la raíz; algunas añaden soporte por su cuenta —consulta su documentación actual |
Para WordPress, el flujo es: crea llms.txt con la plantilla, adáptalo, súbelo a la raíz (donde está wp-config.php) y verifica que https://tudominio.com/llms.txt devuelve el contenido sin error 404. Existen generadores y plugins que automatizan el archivo, pero revisa siempre el resultado a mano: un índice curado por ti supera a uno generado en bloque.
Preguntas frecuentes
¿Qué es llms.txt?
Es un archivo Markdown que colocas en la raíz de tu web (/llms.txt) con una lista curada de tus contenidos más importantes, para orientar a los modelos de IA sobre qué priorizar y cómo describir tu sitio. Es un complemento del SEO, no un sustituto.
¿En qué formato se escribe?
En Markdown, con una estructura concreta: un encabezado # H1 con el nombre del sitio (obligatorio), un resumen en blockquote >, y secciones ## H2 con listas de enlaces - [Nombre](URL): nota. No es un archivo de pares «clave: valor».
¿Lo usa Google?
No. Google ha declarado que no utiliza llms.txt y lo ha comparado con la etiqueta obsoleta meta keywords. Tampoco hay confirmación oficial de que ChatGPT o Perplexity lo ponderen al responder.
¿Merece la pena crearlo?
Si ya tienes autoridad de entidad, contenido citable y datos estructurados, crear un llms.txt básico suma poco trabajo por un beneficio incierto: hazlo. Si estás empezando en GEO, dedica ese tiempo primero a esas tres áreas.
¿Cuál es la diferencia con llms-full.txt?
llms.txt es un índice de enlaces; llms-full.txt contiene el texto completo del sitio concatenado. Para la mayoría de negocios, llms-full.txt es innecesario.
¿Afecta llms.txt al SEO tradicional (Google Search)? No. No impacta en tu posicionamiento orgánico en Google. Solo es relevante para modelos de IA y motores generativos.
¿En qué se diferencia de robots.txt?
robots.txt ordena a los rastreadores qué pueden o no pueden visitar; llms.txt sugiere qué contenido priorizar y cómo entenderlo. Lo explicamos en detalle en llms.txt frente a robots.txt.
¿Quieres saber si ChatGPT, Perplexity o Google AI Overviews ya hablan de tu marca? Solicita una auditoría GEO y descubre en qué preguntas apareces, qué competidores te ganan la cita y qué cambios técnicos —incluido llms.txt— tendrían más impacto para tu negocio.
Y si quieres el marco completo, la guía qué es GEO te ayuda a situar dónde encaja llms.txt dentro de tu estrategia de visibilidad en IA.
Última actualización: julio de 2026. Esta guía forma parte de nuestro contenido sobre posicionamiento en IA y se revisa conforme evolucionan los estándares y la adopción de nuevos archivos por parte de los modelos.
Coautor de investigación sobre clasificación de consultas con modelos transformer y creador de comunidades web usadas por millones de personas. Escribe sobre cómo la IA decide qué marcas recomendar.