Saltar al contenido

Cómo hacer una auditoría de visibilidad en IA: checklist por bloques para auditar a un cliente

Publicado el 07-10-202610 min de lecturaPor la redacción de SmoothSeen

Una auditoría de visibilidad en IA comprueba si una página puede ser leída, extraída y citada por asistentes como ChatGPT o Gemini. Se revisa en cinco bloques: acceso de los rastreadores de búsqueda, extraibilidad de la respuesta, credibilidad (datos, fuentes, autoría y fecha), cobertura del tema y los requisitos propios del tipo de página.

Lo esencial

  • La auditoría revisa causas en cinco bloques: acceso, extraibilidad, credibilidad, cobertura y lo propio del tipo de página.
  • Los rastreadores de búsqueda (OAI-SearchBot, Claude-SearchBot, PerplexityBot) no son los de entrenamiento (GPTBot, ClaudeBot, Google-Extended): vetar unos y otros tiene efectos distintos.
  • Google dice que para AI Overviews y AI Mode basta con estar indexado y poder mostrarse con fragmento; no hay requisitos extra.
  • Seguir menciones no sustituye a auditar: según SISTRIX, entre el 42 % y el 74 % de los dominios que cita ChatGPT son nuevos cada semana, según el país.
  • Cada punto de la checklist lleva su prueba manual y la evidencia que se entrega al cliente.

Para comprobarlo en tu web: Para agencias

En esta página

Es la parte técnica y editorial del posicionamiento en IA: no mide si un asistente nombra hoy a tu cliente, sino si tiene motivos para poder hacerlo. Lo que sigue es la checklist que puedes aplicar a mano, bloque a bloque, con la evidencia que conviene guardar para el apartado de IA del informe SEO para clientes.

¿En qué se diferencia auditar causas de seguir menciones?

Seguir menciones responde a «¿nos citan?»; auditar responde a «¿pueden citarnos?». Son dos herramientas para dos preguntas, y la segunda es la que tu cliente puede arreglar.

La primera cambia mucho de una semana a otra. Según SISTRIX, entre el 42 % y el 74 % de los dominios que cita ChatGPT Search son nuevos cada semana, según el país (74 % en Alemania, 60 % en el Reino Unido), en un estudio de 82.619 prompts en seis países entre el 17-12-2025 y el 08-04-20261. Con esa rotación, una captura aislada de una respuesta no demuestra nada, ni para bien ni para mal. Las causas, en cambio, son estables: un robots.txt que veta al buscador de OpenAI lo veta todas las semanas.

Por eso la auditoría va primero. Si la página no es accesible o no es extraíble, medir menciones solo confirma una ausencia que ya podías explicar.

Bloque 1 · ¿Pueden entrar los rastreadores que buscan?

El acceso se audita por tipo de bot, no por empresa. Cada proveedor usa agentes distintos para buscar, para atender una petición de un usuario y para entrenar modelos, y vetar uno no equivale a vetar los demás.

Proveedor
OpenAI
Búsqueda y consulta en vivo
OAI-SearchBot (resultados de la búsqueda de ChatGPT), ChatGPT-User (acciones de un usuario)
Entrenamiento
GPTBot
Proveedor
Anthropic
Búsqueda y consulta en vivo
Claude-SearchBot, Claude-User
Entrenamiento
ClaudeBot
Proveedor
Perplexity
Búsqueda y consulta en vivo
PerplexityBot, Perplexity-User
Entrenamiento
Perplexity dice que PerplexityBot no rastrea para entrenar modelos
Proveedor
Google
Búsqueda y consulta en vivo
Googlebot (AI Overviews y AI Mode salen del índice de la Búsqueda)
Entrenamiento
Google-Extended (token de control, sin agente propio)
Proveedor
Apple
Búsqueda y consulta en vivo
Applebot
Entrenamiento
Applebot-Extended (tampoco rastrea: solo es un permiso)

Tres matices que conviene conocer antes de dar un veredicto:

  • OpenAI lo dice sin ambigüedad: las webs que vetan a OAI-SearchBot no se muestran en las respuestas de la búsqueda de ChatGPT, y cada agente se configura por separado, así que puedes permitir OAI-SearchBot y vetar GPTBot2. Los cambios tardan unas 24 horas en reflejarse.
  • Google-Extended no afecta a la inclusión en la Búsqueda de Google ni es una señal de ranking. Sí controla el uso del contenido para entrenar Gemini y para el grounding en Gemini Apps y en Vertex AI3. Vetarlo, por tanto, no saca a nadie de AI Overviews.
  • Los agentes que dispara un usuario no siempre leen robots.txt. OpenAI avisa de que con ChatGPT-User esas reglas pueden no aplicarse2, y Perplexity, de que Perplexity-User generalmente las ignora4. Anthropic, en cambio, afirma que sus tres bots respetan robots.txt y que vetar Claude-SearchBot o Claude-User puede reducir la visibilidad de la web en sus búsquedas5.

Así queda un robots.txt que separa las dos decisiones. Es un ejemplo: si el cliente quiere o no ceder su contenido para entrenar modelos es una decisión suya, no un fallo técnico.

# 1) Búsqueda y consulta en vivo: son los que pueden enlazar la web
#    en una respuesta. Vetarlos te saca de esa búsqueda o te resta
#    visibilidad en ella.
User-agent: OAI-SearchBot
User-agent: Claude-SearchBot
User-agent: PerplexityBot
Allow: /

# 2) Visitas que pide un usuario desde el chat. OpenAI y Perplexity
#    avisan de que pueden no obedecer robots.txt; Anthropic dice que
#    Claude-User sí lo obedece.
User-agent: ChatGPT-User
User-agent: Claude-User
User-agent: Perplexity-User
Allow: /

# 3) Entrenamiento: decisión editorial del cliente. Según sus dueños,
#    vetarlos no quita la web de sus buscadores.
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: Applebot-Extended
Disallow: /

# 4) CCBot (Common Crawl) construye un archivo abierto de la web.
#    Vetarlo tampoco toca la búsqueda de ningún asistente.
User-agent: CCBot
Disallow: /

# 5) El resto, incluido Googlebot, del que dependen AI Overviews y AI Mode.
User-agent: *
Allow: /

El acceso no termina en robots.txt. Google exige para AI Overviews y AI Mode lo mismo que para la Búsqueda: que la página esté indexada y pueda mostrarse con fragmento, sin requisitos técnicos adicionales6. Un noindex o un nosnippet olvidados cierran esa puerta. Y el texto tiene que estar en el HTML que sirve el servidor: en el análisis de Vercel de diciembre de 2024, ninguno de los grandes rastreadores de IA ejecutaba JavaScript, salvo Gemini (vía Googlebot) y Applebot7.

Bloque 2 · ¿Se puede sacar la respuesta sin más contexto?

La extraibilidad mide si un fragmento de la página se entiende solo. Un asistente cita trozos, no páginas enteras, y un trozo que empieza con «como decíamos arriba» no sirve.

Lo que revisas:

  • Respuesta directa al principio: un primer párrafo de 40-60 palabras que conteste la consulta principal, sin introducción.
  • Un H1 y H2 que describan lo que hay debajo, mejor en forma de pregunta cuando responden a una.
  • Listas y tablas para pasos, comparativas y umbrales: un extractor las toma enteras.
  • Resumen y preguntas frecuentes visibles, con el marcado coincidiendo con el texto.

El detalle de cómo se escribe cada cosa está en la guía de contenido citable. Si el cliente pregunta por llms.txt, conviene saber que Google dice expresamente que no hace falta crear ficheros de texto para IA, ni otros ficheros o marcado nuevos, para aparecer en sus funciones de IA6; el resto de la evidencia está en el artículo sobre llms.txt.

Bloque 3 · ¿Hay motivos para fiarse de la página?

La credibilidad se audita buscando lo que un tercero puede comprobar: cifras con fuente, autor con nombre, fecha visible y una empresa identificable detrás.

La mejor evidencia pública de que esto importa viene del artículo académico que propuso el término GEO. En sus pruebas (10.000 consultas, presentado en KDD 2024), añadir citas textuales, estadísticas y referencias a fuentes mejoró hasta un 40 % la visibilidad de una página en las respuestas de un motor generativo basado en GPT-3.58. Es un experimento de laboratorio, no una garantía de campo, y así hay que contárselo al cliente.

Google plantea lo mismo desde otro ángulo: pregunta si es evidente quién ha escrito el contenido y si aporta información, investigación o análisis originales9. En la auditoría eso se traduce en cinco comprobaciones: cifras con fuente enlazada, autor con nombre y perfil, fecha de publicación y de actualización, página «Sobre nosotros» con datos reales y datos estructurados que no contradigan el texto visible.

Bloque 4 · ¿La página resuelve la intención completa?

La cobertura mide si la página contesta lo que busca quien llega, incluidas las preguntas que vienen después. Una página de «precio de una reforma de baño» que no da rangos, plazos ni qué incluye obliga al asistente a buscar esos datos en otra web, y a citar esa otra.

Para auditarla, escribe las cuatro o cinco preguntas que haría un comprador real y comprueba cuáles responde la página con un dato concreto. Las que no responde son el hueco.

Bloque 5 · ¿Cumple lo que exige su tipo de página?

Cada tipo de página tiene requisitos propios, y la checklist genérica no los ve:

  • Negocio local: nombre, dirección y teléfono idénticos en la web y en la ficha de Google, horario, zona de servicio y marcado LocalBusiness. Lo desarrollamos en la guía de SEO local con IA.
  • Ficha de producto: precio, disponibilidad, marca y descripción visibles y en el marcado Product.
  • Catálogo o categoría: un texto que explique qué hay y cómo elegir, no solo una rejilla de productos.

Decide el tipo de cada plantilla antes de auditar. Aplicar los requisitos de una ficha a un artículo produce hallazgos falsos.

La checklist completa

Bloque
Acceso
Qué comprobar
robots.txt por tipo de bot
Cómo comprobarlo a mano
Abrir /robots.txt y buscar cada agente de la tabla del bloque 1
Evidencia para el cliente
Captura del fichero con las líneas marcadas
Bloque
Acceso
Qué comprobar
Indexable y con fragmento
Cómo comprobarlo a mano
Ver el código fuente: noindex, nosnippet, max-snippet; inspeccionar la URL en Search Console
Evidencia para el cliente
Resultado de la inspección de URL
Bloque
Acceso
Qué comprobar
Texto en el HTML servido
Cómo comprobarlo a mano
curl de la URL, o desactivar JavaScript, y buscar el primer párrafo
Evidencia para el cliente
El HTML recibido junto a la página renderizada
Bloque
Extraibilidad
Qué comprobar
Respuesta en el primer párrafo
Cómo comprobarlo a mano
Leer las primeras 60 palabras sin el resto de la página
Evidencia para el cliente
El párrafo actual y una propuesta reescrita
Bloque
Extraibilidad
Qué comprobar
H1, H2, listas y tablas
Cómo comprobarlo a mano
Revisar el esquema de encabezados
Evidencia para el cliente
El índice de encabezados
Bloque
Extraibilidad
Qué comprobar
Resumen y FAQ visibles
Cómo comprobarlo a mano
Buscarlos en la página y comparar con el marcado
Evidencia para el cliente
Resultado del validador de schema.org
Bloque
Credibilidad
Qué comprobar
Cifras con fuente y fecha
Cómo comprobarlo a mano
Anotar cada cifra y si enlaza a su origen
Evidencia para el cliente
Lista de cifras sin fuente
Bloque
Credibilidad
Qué comprobar
Autoría, fecha, «Sobre nosotros»
Cómo comprobarlo a mano
Buscar firma, perfil del autor y fechas
Evidencia para el cliente
Captura de la cabecera del artículo
Bloque
Cobertura
Qué comprobar
Intención resuelta
Cómo comprobarlo a mano
Responder con la página las preguntas del comprador
Evidencia para el cliente
Tabla pregunta · respondida sí/no
Bloque
Tipo
Qué comprobar
Requisitos del tipo
Cómo comprobarlo a mano
Comparar web, ficha de Google y marcado
Evidencia para el cliente
Discrepancias encontradas

Audita una URL por plantilla (portada, categoría, ficha, artículo, página local), no todas las URL: los fallos de plantilla se repiten en cada página que la usa.

¿Cómo priorizar y presentar lo que encuentres?

Primero lo que bloquea, después lo demás. Un veto a OAI-SearchBot o un noindex dejan la página fuera, por buena que sea; una tabla que falta solo la hace menos citable. Dentro de cada bloque, ordena por páginas afectadas: un fallo de plantilla pesa más que uno aislado.

Para el cliente, separa tres cosas: lo que está bien, lo que falla y lo que no se pudo comprobar, con su motivo. Nada que no hayas comprobado debe aparecer como correcto. Y como un despliegue puede volver a poner un veto o un noindex en cualquier momento, conviene repetir la parte de acceso cada mes; cómo organizarlo está en la guía de monitorización SEO.

Declaración de interés: este blog es de SmoothSeen, una herramienta de auditoría web que mide el posicionamiento en buscadores y en asistentes de IA. Su auditoría de posicionamiento en IA agrupa las comprobaciones en cuatro bloques parecidos a estos (extraibilidad; credibilidad, que incluye el acceso de los rastreadores de búsqueda; cobertura; y lo propio del tipo de página), separa en robots.txt los rastreadores de búsqueda de los de entrenamiento y avisa del contenido que solo aparece con JavaScript. Desde el plan Profesional, el resultado sale en PDF y en un enlace para el cliente; en Agencia, con tu marca. Para la otra pregunta, la de las menciones, los planes de pago siguen en ChatGPT y Gemini las preguntas que definas. La checklist de arriba funciona igual sin SmoothSeen.

Preguntas frecuentes

¿Qué es una auditoría de visibilidad en IA?

Es una revisión de las causas por las que un asistente como ChatGPT, Gemini o Perplexity podría citar o no una página. Comprueba si los rastreadores de búsqueda pueden entrar, si la respuesta se puede extraer sin contexto, si la página ofrece motivos para fiarse de ella, si cubre la intención completa y si cumple los requisitos de su tipo.

¿En qué se diferencia de una auditoría SEO?

Comparten la base: indexación, velocidad y estructura siguen importando, y Google usa su índice normal para AI Overviews. La auditoría de IA añade el acceso de los rastreadores de cada asistente, la extraibilidad de fragmentos sueltos y la credibilidad comprobable, como las cifras con fuente o la autoría visible, que en una auditoría SEO clásica suelen quedar en segundo plano.

¿Cuánto se tarda en auditar una web para IA?

Depende del número de plantillas, no del de URL. Una web con portada, categorías, fichas y blog tiene cuatro plantillas: con una URL representativa de cada una cubres la mayor parte de los fallos, porque se repiten en todas las páginas que comparten plantilla. Después se revisan aparte las páginas que más tráfico o negocio aportan.

¿Hay que vetar GPTBot para proteger el contenido del cliente?

Es una decisión del cliente, no un requisito técnico. Según OpenAI, vetar GPTBot indica que el contenido no debe usarse para entrenar sus modelos, y es independiente de OAI-SearchBot, que es el que decide si la web aparece en la búsqueda de ChatGPT. Lo que no conviene es vetar a los dos sin saber que hacen cosas distintas.

Qué hacer ahora

Abre el robots.txt de tu cliente y comprueba, agente por agente, si deja pasar a OAI-SearchBot, Claude-SearchBot y PerplexityBot. Después aplica la tabla a una URL por plantilla y separa lo bloqueante de lo mejorable. Para llevar lo que encuentres al informe mensual, sigue con la guía de informe SEO para clientes.

Fuentes

  1. 1AI Citation drift: How stable are sources in AI search results?, Johannes Beus, SISTRIX, actualizada el 12-05-2026.
  2. 2Overview of OpenAI Crawlers, OpenAI, consultada el 07-10-2026.
  3. 3Google's common crawlers, Google Search Central, actualizada el 14-07-2026.
  4. 4Perplexity Crawlers, Perplexity, consultada el 07-10-2026.
  5. 5Does Anthropic crawl data from the web, and how can site owners block the crawler?, Anthropic, actualizada el 07-04-2026.
  6. 6AI features and your website, Google Search Central, actualizada el 10-12-2025.
  7. 7The rise of the AI crawler, Vercel, publicada el 17-12-2024.
  8. 8GEO: Generative Engine Optimization, Aggarwal y otros, KDD 2024 (versión 3, 28-06-2024).
  9. 9Creating helpful, reliable, people-first content, Google Search Central, actualizada el 05-10-2026.

Cómo citar este artículo

SmoothSeen. (2026, 7 de octubre). Cómo hacer una auditoría de visibilidad en IA: checklist por bloques para auditar a un cliente. https://smoothseen.com/es/blog/auditoria-visibilidad-ia/

Quién lo escribe

SmoothSeen es una herramienta de auditoría web que mide el posicionamiento en buscadores y en asistentes de IA y entrega informes con la marca de la agencia.

Este blog es de SmoothSeen: cuando un artículo habla del producto, lo hace sabiendo que es el nuestro. Las cifras de terceros enlazan a su fuente original.

Historial de cambios

  • Primera versión publicada, con las fuentes revisadas.

Sigue leyendo

Auditoría de visibilidad en IA: checklist por bloques