Saltar al contenido

robots.txt de Shopify para bots de IA: robots.txt.liquid, búsqueda frente a entrenamiento y llms.txt

Publicado el 07-10-20267 min de lecturaPor la redacción de SmoothSeen

En Shopify, los rastreadores de IA se controlan con la plantilla robots.txt.liquid del tema: conservas el bucle que pinta las reglas por defecto y añades al final un grupo que veta a los de entrenamiento, como GPTBot, ClaudeBot o Google-Extended. Los de búsqueda (OAI-SearchBot, Claude-SearchBot, PerplexityBot) no necesitan nada: siguen el grupo general y pueden citarte.

Lo esencial

  • El robots.txt que genera Shopify no nombra a ningún rastreador de IA, así que OAI-SearchBot, Claude-SearchBot y PerplexityBot siguen el grupo general y pueden leer productos y colecciones.
  • Para vetar el entrenamiento (GPTBot, ClaudeBot, Google-Extended, CCBot…) se crea la plantilla robots.txt.liquid, se conserva el bucle de reglas por defecto y se añade un grupo al final.
  • Crear un grupo propio para un buscador de IA le hace ignorar el grupo general, incluidos los vetos de carrito, pago y filtros.
  • Bloquear rastreadores no corta los datos que Shopify Catalog envía a las tiendas basadas en agentes, como ChatGPT o Microsoft Copilot; eso se gestiona aparte.
  • Cada tienda Shopify sirve un /agents.md por defecto y /llms.txt muestra lo mismo; desde el 28-05-2026 se puede cambiar con plantillas propias.

Para comprobarlo en tu web: Auditoría de visibilidad en IA

En esta página

Shopify genera el robots.txt de cada tienda y lo mantiene al día; tú solo puedes cambiarlo con una plantilla del tema. Esta guía explica qué trae de serie, qué rastreadores de IA conviene dejar pasar, cómo se escribe la plantilla sin perder las reglas de Shopify y qué pasa con llms.txt y agents.md. El resto del SEO técnico de la plataforma está en la guía de SEO técnico en Shopify, y la lista completa de rastreadores, en la de bots de IA en robots.txt.

¿Qué trae el robots.txt de serie de Shopify?

Según Shopify, el fichero por defecto permite el contenido público con Allow: / y aparta del rastreo el panel, el carrito, el pago, las cuentas y los pedidos, además de las colecciones ordenadas (sort_by) y filtradas con +, porque duplican la colección1. Lo comprobamos en la tienda pública de demostración del tema Dawn el 09-10-2026:

  • Hay dos grupos: User-agent: * y User-agent: adsbot-google, más la línea Sitemap:.
  • También bloquea las URL de colección con dos filtros a la vez (/collections/*filter*&*filter*), los parámetros de vista previa de temas y algunas rutas internas.
  • Arriba lleva comentarios que remiten a los agentes de IA a /agents.md y a los puntos de acceso de compra de Shopify.
  • No nombra a GPTBot, ClaudeBot, OAI-SearchBot ni a ningún otro rastreador de IA.

La consecuencia de lo último: todos los rastreadores de IA siguen el grupo general. Pueden leer productos, colecciones, páginas y blog, y no entran en carrito ni pago.

¿Qué rastreadores de IA conviene dejar pasar y cuáles vetar?

La pregunta útil no es «IA sí o no», sino para qué lee tu tienda cada rastreador. Las empresas los separan por uso2345:

Uso
Búsqueda: citarte en sus respuestas
Rastreadores
OAI-SearchBot (ChatGPT), Claude-SearchBot, PerplexityBot
Si los vetas
Dejas de aparecer como fuente en esas respuestas
Uso
A petición del usuario
Rastreadores
ChatGPT-User, Claude-User, Perplexity-User
Si los vetas
Algunos pueden no seguir robots.txt
Uso
Entrenamiento de modelos
Rastreadores
GPTBot, ClaudeBot, meta-externalagent, CCBot
Si los vetas
Tu contenido no entra en futuros entrenamientos
Uso
Marcas de control (no rastrean)
Rastreadores
Google-Extended, Applebot-Extended
Si los vetas
Vetas el uso para entrenar Gemini o modelos de Apple

Google-Extended no afecta a tu inclusión en Google Search; las AI Overviews y el modo IA dependen de Googlebot56. Applebot-Extended tampoco saca tus páginas de Spotlight, Siri ni Safari7. Vetar el entrenamiento es una decisión editorial legítima: OpenAI deja claro que puedes permitir OAI-SearchBot mientras vetas GPTBot2.

¿Cómo se crea robots.txt.liquid en Shopify?

Los pasos de Shopify1:

  1. En el panel de control, ve a Tienda online.
  2. En el tema publicado, abre el menú de acciones (…) y pulsa Editar código.
  3. Pulsa Agregar una nueva plantilla, elige robots y pulsa Crear plantilla.
  4. Edita la plantilla y guarda.

Shopify lo marca como personalización sin soporte: su atención al cliente no ayuda con este fichero y avisa de que un uso incorrecto puede provocar la pérdida de todo el tráfico1. Otros dos detalles de su documentación: los cambios son inmediatos, y subir un tema desde la sección Temas del panel no importa robots.txt.liquid (con Theme Kit o la línea de comandos sí se conserva). La plantilla solo admite los objetos robots, group, rule, user_agent, sitemap y request8.

Una plantilla que veta el entrenamiento y conserva las reglas de Shopify

Shopify recomienda no sustituir la plantilla por texto plano, sino mantener el bucle que pinta sus grupos por defecto y añadir lo tuyo; así sus reglas se actualizan solas81. Esta es la plantilla, con el bucle copiado de la documentación oficial y un grupo propio al final:

{% for group in robots.default_groups %}
  {{- group.user_agent }}

  {%- for rule in group.rules -%}
    {{ rule }}
  {%- endfor -%}

  {%- if group.sitemap != blank -%}
    {{ group.sitemap }}
  {%- endif -%}
{% endfor %}

# Rastreadores de entrenamiento: vetarlos no te saca de las respuestas de IA
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: Applebot-Extended
User-agent: meta-externalagent
User-agent: CCBot
Disallow: /

Varias líneas User-agent seguidas forman un solo grupo, como permite el estándar9. Lo comprobamos así: la plantilla compila en modo estricto con Liquid 5.14 (la biblioteca de código abierto de Shopify), con objetos simulados que imitan a los de Shopify. Después pasamos el resultado por un comparador que aplica las reglas de Google. Productos y colecciones quedan permitidos para Googlebot, OAI-SearchBot, Claude-SearchBot y PerplexityBot; el carrito, la ordenación y las URL con dos filtros, bloqueados para todos; y los seis rastreadores de entrenamiento, bloqueados en toda la tienda. La simulación no reproduce el servidor de Shopify: compara tu /robots.txt real después de publicar.

La trampa de nombrar a los buscadores de IA

Es tentador añadir esto «para asegurar» que ChatGPT te lee:

User-agent: OAI-SearchBot
Allow: /

No lo hagas. Un rastreador obedece solo al grupo más específico que le nombra e ignora el resto10. Con ese grupo, OAI-SearchBot deja de leer el User-agent: * de Shopify y queda autorizado a rastrear carrito, pago, colecciones ordenadas y combinaciones de filtros. Sin grupo propio ya podía leer todo lo público. Si alguna vez necesitas reglas propias para un buscador de IA, copia en su grupo los vetos del general.

Lo que el robots.txt de Shopify no controla

Shopify Catalog. Si vendes en tiendas basadas en agentes, como ChatGPT o Microsoft Copilot, Shopify envía los datos de producto a esos canales a través de Shopify Catalog, sin pasar por robots.txt. Vetar rastreadores no corta ese envío; se gestiona en la configuración de esas tiendas basadas en agentes1.

La capa de red. Shopify gestiona los bots en su red y no recomienda poner un proxy delante de la tienda, ni puede dar soporte si lo haces1. Por eso un bloqueo de bots de IA en Cloudflare delante de Shopify queda fuera de lo que Shopify soporta. Y recuerda que robots.txt es orientativo: no todos los rastreadores lo siguen, y bloquear por user-agent no frena a quien lo falsifica.

Tus propias auditorías. Si un rastreador de SEO que lanzas tú recibe errores de límite de peticiones, Shopify permite firmarlo con Web Bot Auth en Tienda online > Preferencias, sección Acceso del rastreador, con firmas que caducan en un máximo de tres meses. Shopify aclara que los buscadores y los modelos de lenguaje pueden indexar la tienda sin firma11.

¿Y llms.txt en Shopify?

Cada tienda Shopify sirve un /agents.md por defecto, y /llms.txt y /llms-full.txt muestran el mismo contenido. El 28-05-2026 Shopify anunció que se pueden personalizar12: si quieres cambiarlo, creas en el tema agents.md.liquid (vale para las tres URL) o llms.txt.liquid (solo para /llms.txt). Esas plantillas tienen un contexto restringido: solo ven los objetos request y agents, no shop ni collections13. Shopify recomienda quedarse con el fichero gestionado salvo necesidades avanzadas.

Antes de dedicarle tiempo: Google no usa llms.txt, y ningún buscador de IA ha documentado que lo lea6. Es barato, pero su efecto no está demostrado. Lo explica la guía de qué es llms.txt y si sirve.

Cómo comprobarlo

  • El fichero publicado: abre https://www.example.com/robots.txt y comprueba que siguen los grupos de Shopify y que el tuyo está al final.
  • Antes y después: Shopify aconseja guardar una copia del /robots.txt actual y compararla con lo que pinta la plantilla8; una plantilla que pinta los grupos por defecto puede incluir reglas que el fichero generado ya no tiene, como Disallow: /search1.
  • Search Console: el informe de robots.txt muestra la versión que ha leído Google.
  • Respuesta a cada bot: curl -I -A "OAI-SearchBot/1.0" https://www.example.com/products/un-producto debe devolver 200, como para un navegador.

Qué hace SmoothSeen con esto

SmoothSeen lee tu robots.txt y te dice qué rastreadores de IA deja pasar, separando los de búsqueda de los de entrenamiento: vetar los de entrenamiento no cuenta como fallo. También pide la página con el user-agent de cada rastreador para ver si la red responde 403 a alguno mientras sirve la página a un navegador, y comprueba si hay llms.txt.

Qué hacer esta semana

Abre tu /robots.txt y guarda una copia. Si decides vetar el entrenamiento, crea robots.txt.liquid con la plantilla de arriba, publica y compara el resultado con la copia. Si quieres ver qué rastreadores de IA llegan de verdad a tu tienda, haz una auditoría de IA con SmoothSeen.

Preguntas frecuentes

¿Vetar GPTBot en Shopify me saca de ChatGPT?

No. GPTBot recoge contenido para entrenar modelos de OpenAI. La búsqueda de ChatGPT usa OAI-SearchBot, que sigue el grupo general del robots.txt de Shopify mientras no le crees uno propio. Además, si tienes activado ChatGPT como tienda basada en agentes, tus productos le llegan por Shopify Catalog, sin depender de robots.txt.

¿Puedo bloquear bots de IA con Cloudflare delante de Shopify?

Shopify gestiona los bots en su propia red y no recomienda una configuración de proxy delante de la tienda, ni puede dar soporte si la usas. La vía soportada para decidir qué rastreadores entran es robots.txt.liquid. Si aun así usas un proxy, comprueba que Googlebot y los buscadores de IA reciben un 200.

¿Cómo vuelvo al robots.txt por defecto de Shopify?

Borra la plantilla robots.txt.liquid del tema. Shopify vuelve a servir el fichero que genera y mantiene, con las reglas actuales. Shopify lo indica también cuando la plantilla arrastra reglas que el fichero por defecto ya no incluye, como el veto a /search o a /policies/: borrarla es la forma de volver al fichero actual.

¿El robots.txt de Shopify afecta a las AI Overviews de Google?

Solo a través de Googlebot. Las AI Overviews y el modo IA usan el índice de Google Search, así que dependen de que Googlebot pueda rastrear tus páginas. Vetar Google-Extended no te saca de Google Search ni de esas funciones: decide si tu contenido se usa para entrenar Gemini y para fundamentar sus respuestas.

Fuentes

  1. 1Editar robots.txt.liquid, Centro de ayuda de Shopify, consultada el 09-10-2026.
  2. 2Overview of OpenAI Crawlers, OpenAI, consultada el 07-10-2026.
  3. 3Does Anthropic crawl data from the web, and how can site owners block the crawler?, Anthropic (Claude Help Center), actualizada el 07-04-2026.
  4. 4Perplexity Crawlers, Perplexity, consultada el 07-10-2026.
  5. 5Google's common crawlers, Google Crawling Infrastructure, actualizada el 14-07-2026.
  6. 6AI features and your website, Google Search Central, actualizada el 10-12-2025.
  7. 7About Applebot, Apple, actualizada el 04-09-2026.
  8. 8Customize robots.txt y robots.txt.liquid, Shopify.dev, consultadas el 07-10-2026.
  9. 9RFC 9309: Robots Exclusion Protocol, IETF, publicada en septiembre de 2022.
  10. 10How Google interprets the robots.txt specification, Google Search Central, actualizada el 31-08-2026.
  11. 11Rastrear la tienda, Centro de ayuda de Shopify, consultada el 07-10-2026.
  12. 12Customize /llms.txt, /llms-full.txt and /agents.md, Shopify developer changelog, 28-05-2026.
  13. 13agents.md.liquid y llms.txt.liquid, Shopify.dev, consultadas el 07-10-2026.

Cómo citar este artículo

SmoothSeen. (2026, 7 de octubre). robots.txt de Shopify para bots de IA: robots.txt.liquid, búsqueda frente a entrenamiento y llms.txt. https://smoothseen.com/es/blog/shopify-robots-txt-bots-ia/

Quién lo escribe

SmoothSeen es una herramienta de auditoría web que mide el posicionamiento en buscadores y en asistentes de IA y entrega informes con la marca de la agencia.

Este blog es de SmoothSeen: cuando un artículo habla del producto, lo hace sabiendo que es el nuestro. Las cifras de terceros enlazan a su fuente original.

Historial de cambios

  • Primera versión.

Sigue leyendo

robots.txt de Shopify para bots de IA (robots.txt.liquid)