llms.txt: qué es, cómo se crea y qué dicen los datos sobre si sirve
Publicado el 07-10-20269 min de lecturaPor la redacción de SmoothSeen
llms.txt es un archivo en Markdown, propuesto por Jeremy Howard en septiembre de 2024, que se coloca en la raíz de una web para resumir a los modelos de lenguaje qué contenido importa. No es un estándar: Google Search lo ignora1 y, según Ahrefs, el 97 % de estos archivos no recibió ni una petición en mayo de 20262.
Lo esencial
- llms.txt es una propuesta de Jeremy Howard (03-09-2024), no un estándar; su versión 2 es del 10-08-2026.
- Google dice en su guía de IA generativa que Google Search ignora los llms.txt: ni ayudan ni perjudican.
- Ahrefs midió 137.210 dominios en mayo de 2026: el 97 % de los llms.txt válidos no recibió ni una petición.
- Solo el 19,5 % de las peticiones a llms.txt vino de bots o agentes de IA; los buscadores de IA hicieron unas 200.
- Crearlo cuesta diez minutos; tiene sentido si publicas documentación técnica, no como vía para que te cite ChatGPT.
Para comprobarlo en tu web: Auditoría de visibilidad en IA
En esta página
¿Qué es llms.txt?
llms.txt es un archivo de texto en formato Markdown que vive en /llms.txt y ofrece a los agentes de IA un resumen de la web con enlaces a sus páginas clave. La propuesta la publicó Jeremy Howard el 03-09-2024 en llmstxt.org, y la propia página la presenta como una propuesta para estandarizar, no como un estándar aprobado3.
El formato es sencillo. Solo un elemento es obligatorio: un título H1 con el nombre del sitio o del proyecto. Después, de forma opcional, una cita con el resumen, párrafos de contexto y secciones H2 con listas de enlaces, cada uno con una nota breve tras dos puntos3. La propuesta recomienda además servir una versión limpia en Markdown de cada página, en la misma URL con .md añadido.
La versión 2, del 10-08-2026, cambió el enfoque: pasa de «meter más contexto en el modelo» a «ayudar al agente a descubrir contenido». Añade la forma de anunciar el archivo con un enlace rel="describedby" en el HTML o en una cabecera Link y aclara que un llms.txt cubre las páginas bajo su ruta, de modo que una subcarpeta puede tener el suyo4.
Si estás empezando con este tema, la guía de posicionamiento en IA pone llms.txt en contexto frente al resto de factores.
En qué se diferencia de robots.txt y sitemap.xml
- Archivo
robots.txt- Para qué sirve
- Decir qué rastreadores pueden entrar y dónde
- Quién lo respeta hoy
- Google, OpenAI, Anthropic y Perplexity explican cómo controlar sus rastreadores con él
- Archivo
sitemap.xml- Para qué sirve
- Listar las URL indexables para que un buscador las descubra
- Quién lo respeta hoy
- Buscadores tradicionales
- Archivo
llms.txt- Para qué sirve
- Resumir el sitio y señalar el contenido clave para un agente de IA
- Quién lo respeta hoy
- Ningún buscador de IA ha documentado que lo use
La propia llmstxt.org marca la diferencia: robots.txt habla de permisos, mientras que llms.txt se consulta bajo demanda, cuando un agente necesita información3. llms.txt no bloquea ni autoriza nada.
¿Lo lee alguien? Lo que dicen los datos
La respuesta corta es: casi nadie, y ningún buscador de IA ha dicho lo contrario por escrito. Estas son las fuentes primarias que hay a fecha de 07-10-2026.
Google: no hacen falta archivos especiales
Google publicó en mayo de 2026 una guía para optimizar webs para sus funciones de IA generativa (actualizada el 10-07-2026). En ella dice que no hace falta crear archivos legibles por máquina, archivos de texto para IA ni Markdown para aparecer en Google Search, y que el buscador no los usa1. Añade que puedes mantener un llms.txt para otros servicios si quieres, porque no ayuda ni perjudica tu visibilidad en Google.
La página «AI features and your website» repite la idea para AI Overviews y AI Mode: no hay archivos ni marcado especiales que añadir5.
Ahrefs: 137.210 dominios y quién pidió de verdad el archivo
Ahrefs analizó en mayo de 2026 el tráfico de 137.210 dominios y encontró que el 97 % de los llms.txt válidos no recibió ninguna petición. El estudio, firmado por Louise Linehan y publicado el 15-06-2026, usa los datos de Ahrefs Web Analytics y descarta los archivos que en realidad son una página de error o HTML en vez de Markdown2.
Las cifras principales:
- El 28 % de los dominios (unos 38.000) publica un llms.txt válido. Ahrefs advierte que sus clientes son más técnicos que la media, así que es un techo, no la adopción real de la web.
- Unas 22.000 peticiones llegaron a esos archivos en todo el mes. El 21,7 % vino de herramientas de auditoría SEO; los bots y agentes de IA sumaron el 19,5 %.
- Los bots de búsqueda de IA (OAI-SearchBot, PerplexityBot y el buscador de Claude) hicieron entre todos unas 200 peticiones, el 1,1 %.
- Claude Code, el agente de programación de Anthropic, pidió más llms.txt que cualquier bot de búsqueda o asistente de IA.
La conclusión de Ahrefs es clara: si tu objetivo es salir en ChatGPT, Perplexity o AI Overviews, el archivo es sobre todo decorativo. El límite del estudio también: es un solo mes y una muestra sesgada hacia webs con perfil SEO.
OpenAI, Anthropic y Perplexity: publican el suyo, pero sus bots siguen robots.txt
Aquí hay un matiz que confunde. OpenAI, Anthropic y Perplexity publican un llms.txt en sus webs de documentación para desarrolladores. Lo comprobamos el 07-10-2026: developers.openai.com/llms.txt, platform.claude.com/llms.txt y docs.perplexity.ai/llms.txt responden con código 200.
Publicar uno no es lo mismo que leer el de los demás. La documentación de rastreadores de OpenAI explica OAI-SearchBot, GPTBot y ChatGPT-User y cómo controlarlos con robots.txt; solo menciona llms.txt como índice de su propia documentación6. La página de Anthropic sobre ClaudeBot, Claude-User y Claude-SearchBot no lo nombra7. La de Perplexity describe PerplexityBot y Perplexity-User en términos de robots.txt y, como OpenAI, solo enlaza su llms.txt como índice de sus documentos8.
Chrome Lighthouse lo revisa, pero si falta no lo cuenta
Lighthouse, la herramienta de auditoría de Chrome, incluye una comprobación de llms.txt dentro de su categoría de navegación por agentes. Solo la marca como fallida si el servidor da error al pedir el archivo. Si no existe (un 404), la da por «no aplicable», porque, según la documentación de Chrome, tenerlo es opcional por ahora9.
Entonces, ¿creo un llms.txt o no?
Crear un llms.txt cuesta muy poco y su beneficio para salir en respuestas de IA no está demostrado. Con eso, la decisión depende de qué web tienes:
- Tu caso
- Documentación técnica, API o software
- Recomendación
- Créalo
- Motivo
- Los agentes de programación como Claude Code sí lo piden, según Ahrefs
- Tu caso
- Web de empresa, tienda o negocio local
- Recomendación
- Opcional, sin prioridad
- Motivo
- Ningún buscador de IA documenta que lo lea
- Tu caso
- Tienda en Shopify
- Recomendación
- Revisa el que ya tienes
- Motivo
- Shopify sirve uno por defecto desde mayo de 2026
- Tu caso
- Poco tiempo para SEO técnico
- Recomendación
- Déjalo para el final
- Motivo
- Hay tareas con más respaldo antes
Lo que no debes hacer es venderlo, o comprarlo, como la llave para que te cite ChatGPT. Ningún dato publicado respalda esa promesa.
Cómo crear un llms.txt en 10 minutos
Este es un ejemplo completo para un negocio inventado. Usa el dominio example.com, reservado para ejemplos:
# Carpintería Ribera
> Taller de carpintería a medida en Valencia desde 1998. Hacemos cocinas, armarios empotrados y puertas de madera maciza para particulares de la provincia.
Solo trabajamos en la provincia de Valencia. No vendemos muebles de catálogo ni hacemos envíos.
## Servicios
- [Cocinas a medida](https://www.example.com/cocinas/): materiales, plazos habituales y cómo es el montaje.
- [Armarios empotrados](https://www.example.com/armarios/): tipos de puerta, herrajes y garantía.
- [Puertas de madera maciza](https://www.example.com/puertas/): maderas disponibles y tratamiento para exterior.
## Empresa
- [Quiénes somos](https://www.example.com/nosotros/): historia del taller y equipo.
- [Contacto y zona de servicio](https://www.example.com/contacto/): dirección, horario y municipios que cubrimos.
## Optional
- [Blog](https://www.example.com/blog/): guías de cuidado de la madera.Qué hace cada parte:
- El H1 es lo único obligatorio. Pon el nombre del negocio tal como quieres que te nombren.
- La cita (
>) es el resumen. Escribe qué haces, dónde y para quién en dos frases, sin eslóganes. - El párrafo suelto aclara límites: qué no haces. Es la información que un agente no deduce de tus páginas.
- Cada sección H2 agrupa enlaces. El formato es
[nombre](url): nota. Enlaza páginas que ya existen y funcionan. - La sección
Optionalmarcaba en la versión 1 lo que un agente podía saltarse; la versión 2 la deja como simple convención4.
Guárdalo como texto plano en UTF-8, súbelo a la raíz del dominio y comprueba que responde:
curl -sI https://www.example.com/llms.txt
# Busca «HTTP/2 200» y un Content-Type de texto, no text/htmlSi recibes un 200 pero con tu página de inicio en HTML, tu servidor está tapando un 404: el archivo no existe.
En WordPress
Yoast SEO genera el archivo en su versión gratuita. Se activa en los ajustes del plugin, dentro de las funciones del sitio, en el apartado de herramientas de IA. Puedes dejar que elija las páginas o seleccionarlas a mano. No funciona en instalaciones multisitio10. Sin plugin, basta con subir el archivo por SFTP o desde el gestor de archivos de tu alojamiento.
En Shopify
Desde el 28-05-2026, cada tienda Shopify sirve un agents.md por defecto, y /llms.txt apunta a ese mismo contenido11. Si quieres un llms.txt propio, crea la plantilla templates/llms.txt.liquid en Tienda online, Temas, Editar código. Si no existe esa plantilla, Shopify recurre a la de agents.md y, en último término, a la que genera por defecto.
Qué hacer en su lugar si quieres que la IA te lea
Si tu objetivo es aparecer en respuestas de ChatGPT, Claude o Perplexity, estas tareas tienen respaldo en la documentación oficial:
- Revisa tu robots.txt. Deja pasar a los rastreadores de búsqueda: OAI-SearchBot, Claude-SearchBot y PerplexityBot. Vetar los de entrenamiento, como GPTBot o ClaudeBot, es otra decisión distinta67. Lo explicamos bot a bot en rastreadores de IA y robots.txt.
- Escribe contenido que se pueda citar: respuesta al principio, cifras con fuente y definiciones claras. Lo explicamos en cómo escribir contenido citable por la IA.
- Mide antes de tocar nada. Una auditoría de visibilidad en IA te dice qué falla de verdad en tu web.
Cómo trata SmoothSeen el llms.txt
Este blog es de SmoothSeen, así que conviene decir cómo lo trata la herramienta. SmoothSeen pide /llms.txt en la raíz del dominio y lo da por presente si responde con código 200 y tiene contenido. No revisa llms.txt en subcarpetas. Es una de las comprobaciones de acceso de la mitad de Posicionamiento IA.
Si no lo encuentra, te lo indica en el informe. Trátalo como lo que es, una buena práctica de coste casi nulo sin efecto demostrado en las citas, y arregla antes lo que bloquea a los rastreadores o impide citar tu contenido.
Preguntas frecuentes
¿Qué es el archivo llms.txt?
Es un archivo de texto en Markdown que se publica en la raíz de una web, en /llms.txt, para dar a los agentes de IA un resumen del sitio y una lista de enlaces a sus páginas clave. Lo propuso Jeremy Howard en septiembre de 2024 y su versión 2 es de agosto de 2026. Es una propuesta abierta, no un estándar de ningún organismo.
¿Google usa llms.txt?
No. Su guía de optimización para IA generativa dice que Google Search no usa llms.txt ni archivos parecidos, y que tenerlo no ayuda ni perjudica tu visibilidad. Google puede rastrear el archivo como cualquier otro texto de tu web, pero eso no significa que lo trate de forma especial. Para AI Overviews y AI Mode tampoco hace falta.
¿llms.txt mejora el posicionamiento en ChatGPT?
No hay pruebas de que lo haga. OpenAI no documenta que OAI-SearchBot, el rastreador de la búsqueda de ChatGPT, lea el llms.txt de otras webs. En el estudio de Ahrefs sobre mayo de 2026, OAI-SearchBot, PerplexityBot y el buscador de Claude hicieron entre todos unas 200 peticiones a llms.txt, de unas 22.000.
¿En qué se diferencia llms.txt de robots.txt?
robots.txt es una norma de permisos: dice a cada rastreador qué puede visitar, y Google, OpenAI, Anthropic y Perplexity explican cómo usarlo para controlar sus rastreadores. llms.txt no permite ni bloquea nada; es un resumen del contenido pensado para que un agente lo consulte cuando lo necesite. Si quieres controlar el acceso de la IA a tu web, la herramienta es robots.txt.
¿Cómo creo un llms.txt en WordPress?
La vía más rápida es Yoast SEO: su versión gratuita genera el archivo al activar la opción en los ajustes de funciones del sitio, y te deja elegir las páginas a mano. Si prefieres escribirlo tú, crea un archivo de texto con la plantilla de este artículo y súbelo a la raíz del dominio por SFTP o desde el gestor de archivos del alojamiento.
Qué hacer ahora
Si publicas documentación técnica, crea el llms.txt hoy con la plantilla de arriba; si no, déjalo al final de la lista. Después dedica ese tiempo a lo que sí tiene respaldo, empezando por la guía de posicionamiento en IA.
Fuentes
- 1Optimizing your website for generative AI features on Google Search, Google Search Central, actualizada el 10-07-2026.
- 2We Analyzed 137K Sites: 97% of llms.txt Files Never Get Read, Louise Linehan, Ahrefs, publicada el 15-06-2026. Muestra: 137.210 dominios con tráfico en mayo de 2026.
- 3The /llms.txt file, Jeremy Howard, llmstxt.org, actualizada el 10-08-2026.
- 4Changes, llmstxt.org, consultada el 07-10-2026.
- 5AI features and your website, Google Search Central, actualizada el 10-12-2025.
- 6Overview of OpenAI Crawlers, OpenAI, consultada el 07-10-2026.
- 7Does Anthropic crawl data from the web, and how can site owners block the crawler?, Anthropic, actualizada el 07-04-2026.
- 8Perplexity Crawlers, Perplexity, consultada el 07-10-2026.
- 9llms.txt, Chrome for Developers, actualizada el 05-05-2026.
- 10How to enable llms.txt with Yoast SEO, Yoast, consultada el 07-10-2026.
- 11Customize /llms.txt, /llms-full.txt and /agents.md, Shopify, publicada el 28-05-2026.
Cómo citar este artículo
SmoothSeen. (2026, 7 de octubre). llms.txt: qué es, cómo se crea y qué dicen los datos sobre si sirve. https://smoothseen.com/es/blog/llms-txt/
Sigue leyendo
Posicionamiento en IA: guía de AEO y GEO para que ChatGPT, Gemini y Google te citen
Qué es el posicionamiento en IA (AEO y GEO), cómo eligen fuentes ChatGPT, Gemini y Google, qué bots dejar pasar y una checklist por bloques.
AEO, GEO y SEO: qué es cada uno y en qué se diferencian (con ejemplos)
Diferencia entre AEO, GEO y SEO: qué busca cada uno, dónde aparece el resultado, qué señales pesan y cómo se mide. Con tabla y un ejemplo.
Bloquear bots de IA en Cloudflare sin desaparecer de ChatGPT ni de Google
Qué ajuste de Cloudflare elegir para frenar el entrenamiento de IA sin bloquear a OAI-SearchBot, PerplexityBot ni Googlebot. Con reglas de WAF probadas.