Cómo hacer una auditoría de visibilidad en IA: checklist por bloques para auditar a un cliente
Publicado el 07-10-202610 min de lecturaPor la redacción de SmoothSeen
Una auditoría de visibilidad en IA comprueba si una página puede ser leída, extraída y citada por asistentes como ChatGPT o Gemini. Se revisa en cinco bloques: acceso de los rastreadores de búsqueda, extraibilidad de la respuesta, credibilidad (datos, fuentes, autoría y fecha), cobertura del tema y los requisitos propios del tipo de página.
Lo esencial
- La auditoría revisa causas en cinco bloques: acceso, extraibilidad, credibilidad, cobertura y lo propio del tipo de página.
- Los rastreadores de búsqueda (OAI-SearchBot, Claude-SearchBot, PerplexityBot) no son los de entrenamiento (GPTBot, ClaudeBot, Google-Extended): vetar unos y otros tiene efectos distintos.
- Google dice que para AI Overviews y AI Mode basta con estar indexado y poder mostrarse con fragmento; no hay requisitos extra.
- Seguir menciones no sustituye a auditar: según SISTRIX, entre el 42 % y el 74 % de los dominios que cita ChatGPT son nuevos cada semana, según el país.
- Cada punto de la checklist lleva su prueba manual y la evidencia que se entrega al cliente.
Para comprobarlo en tu web: Para agencias
En esta página
- ¿En qué se diferencia auditar causas de seguir menciones?
- Bloque 1 · ¿Pueden entrar los rastreadores que buscan?
- Bloque 2 · ¿Se puede sacar la respuesta sin más contexto?
- Bloque 3 · ¿Hay motivos para fiarse de la página?
- Bloque 4 · ¿La página resuelve la intención completa?
- Bloque 5 · ¿Cumple lo que exige su tipo de página?
- La checklist completa
- ¿Cómo priorizar y presentar lo que encuentres?
- Preguntas frecuentes
- Qué hacer ahora
Es la parte técnica y editorial del posicionamiento en IA: no mide si un asistente nombra hoy a tu cliente, sino si tiene motivos para poder hacerlo. Lo que sigue es la checklist que puedes aplicar a mano, bloque a bloque, con la evidencia que conviene guardar para el apartado de IA del informe SEO para clientes.
¿En qué se diferencia auditar causas de seguir menciones?
Seguir menciones responde a «¿nos citan?»; auditar responde a «¿pueden citarnos?». Son dos herramientas para dos preguntas, y la segunda es la que tu cliente puede arreglar.
La primera cambia mucho de una semana a otra. Según SISTRIX, entre el 42 % y el 74 % de los dominios que cita ChatGPT Search son nuevos cada semana, según el país (74 % en Alemania, 60 % en el Reino Unido), en un estudio de 82.619 prompts en seis países entre el 17-12-2025 y el 08-04-20261. Con esa rotación, una captura aislada de una respuesta no demuestra nada, ni para bien ni para mal. Las causas, en cambio, son estables: un robots.txt que veta al buscador de OpenAI lo veta todas las semanas.
Por eso la auditoría va primero. Si la página no es accesible o no es extraíble, medir menciones solo confirma una ausencia que ya podías explicar.
Bloque 1 · ¿Pueden entrar los rastreadores que buscan?
El acceso se audita por tipo de bot, no por empresa. Cada proveedor usa agentes distintos para buscar, para atender una petición de un usuario y para entrenar modelos, y vetar uno no equivale a vetar los demás.
- Proveedor
- OpenAI
- Búsqueda y consulta en vivo
OAI-SearchBot(resultados de la búsqueda de ChatGPT),ChatGPT-User(acciones de un usuario)- Entrenamiento
GPTBot
- Proveedor
- Anthropic
- Búsqueda y consulta en vivo
Claude-SearchBot,Claude-User- Entrenamiento
ClaudeBot
- Proveedor
- Perplexity
- Búsqueda y consulta en vivo
PerplexityBot,Perplexity-User- Entrenamiento
- Perplexity dice que PerplexityBot no rastrea para entrenar modelos
- Proveedor
- Búsqueda y consulta en vivo
Googlebot(AI Overviews y AI Mode salen del índice de la Búsqueda)- Entrenamiento
Google-Extended(token de control, sin agente propio)
- Proveedor
- Apple
- Búsqueda y consulta en vivo
Applebot- Entrenamiento
Applebot-Extended(tampoco rastrea: solo es un permiso)
Tres matices que conviene conocer antes de dar un veredicto:
- OpenAI lo dice sin ambigüedad: las webs que vetan a OAI-SearchBot no se muestran en las respuestas de la búsqueda de ChatGPT, y cada agente se configura por separado, así que puedes permitir OAI-SearchBot y vetar GPTBot2. Los cambios tardan unas 24 horas en reflejarse.
- Google-Extended no afecta a la inclusión en la Búsqueda de Google ni es una señal de ranking. Sí controla el uso del contenido para entrenar Gemini y para el grounding en Gemini Apps y en Vertex AI3. Vetarlo, por tanto, no saca a nadie de AI Overviews.
- Los agentes que dispara un usuario no siempre leen robots.txt. OpenAI avisa de que con ChatGPT-User esas reglas pueden no aplicarse2, y Perplexity, de que Perplexity-User generalmente las ignora4. Anthropic, en cambio, afirma que sus tres bots respetan robots.txt y que vetar Claude-SearchBot o Claude-User puede reducir la visibilidad de la web en sus búsquedas5.
Así queda un robots.txt que separa las dos decisiones. Es un ejemplo: si el cliente quiere o no ceder su contenido para entrenar modelos es una decisión suya, no un fallo técnico.
# 1) Búsqueda y consulta en vivo: son los que pueden enlazar la web
# en una respuesta. Vetarlos te saca de esa búsqueda o te resta
# visibilidad en ella.
User-agent: OAI-SearchBot
User-agent: Claude-SearchBot
User-agent: PerplexityBot
Allow: /
# 2) Visitas que pide un usuario desde el chat. OpenAI y Perplexity
# avisan de que pueden no obedecer robots.txt; Anthropic dice que
# Claude-User sí lo obedece.
User-agent: ChatGPT-User
User-agent: Claude-User
User-agent: Perplexity-User
Allow: /
# 3) Entrenamiento: decisión editorial del cliente. Según sus dueños,
# vetarlos no quita la web de sus buscadores.
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: Applebot-Extended
Disallow: /
# 4) CCBot (Common Crawl) construye un archivo abierto de la web.
# Vetarlo tampoco toca la búsqueda de ningún asistente.
User-agent: CCBot
Disallow: /
# 5) El resto, incluido Googlebot, del que dependen AI Overviews y AI Mode.
User-agent: *
Allow: /El acceso no termina en robots.txt. Google exige para AI Overviews y AI Mode lo mismo que para la Búsqueda: que la página esté indexada y pueda mostrarse con fragmento, sin requisitos técnicos adicionales6. Un noindex o un nosnippet olvidados cierran esa puerta. Y el texto tiene que estar en el HTML que sirve el servidor: en el análisis de Vercel de diciembre de 2024, ninguno de los grandes rastreadores de IA ejecutaba JavaScript, salvo Gemini (vía Googlebot) y Applebot7.
Bloque 2 · ¿Se puede sacar la respuesta sin más contexto?
La extraibilidad mide si un fragmento de la página se entiende solo. Un asistente cita trozos, no páginas enteras, y un trozo que empieza con «como decíamos arriba» no sirve.
Lo que revisas:
- Respuesta directa al principio: un primer párrafo de 40-60 palabras que conteste la consulta principal, sin introducción.
- Un H1 y H2 que describan lo que hay debajo, mejor en forma de pregunta cuando responden a una.
- Listas y tablas para pasos, comparativas y umbrales: un extractor las toma enteras.
- Resumen y preguntas frecuentes visibles, con el marcado coincidiendo con el texto.
El detalle de cómo se escribe cada cosa está en la guía de contenido citable. Si el cliente pregunta por llms.txt, conviene saber que Google dice expresamente que no hace falta crear ficheros de texto para IA, ni otros ficheros o marcado nuevos, para aparecer en sus funciones de IA6; el resto de la evidencia está en el artículo sobre llms.txt.
Bloque 3 · ¿Hay motivos para fiarse de la página?
La credibilidad se audita buscando lo que un tercero puede comprobar: cifras con fuente, autor con nombre, fecha visible y una empresa identificable detrás.
La mejor evidencia pública de que esto importa viene del artículo académico que propuso el término GEO. En sus pruebas (10.000 consultas, presentado en KDD 2024), añadir citas textuales, estadísticas y referencias a fuentes mejoró hasta un 40 % la visibilidad de una página en las respuestas de un motor generativo basado en GPT-3.58. Es un experimento de laboratorio, no una garantía de campo, y así hay que contárselo al cliente.
Google plantea lo mismo desde otro ángulo: pregunta si es evidente quién ha escrito el contenido y si aporta información, investigación o análisis originales9. En la auditoría eso se traduce en cinco comprobaciones: cifras con fuente enlazada, autor con nombre y perfil, fecha de publicación y de actualización, página «Sobre nosotros» con datos reales y datos estructurados que no contradigan el texto visible.
Bloque 4 · ¿La página resuelve la intención completa?
La cobertura mide si la página contesta lo que busca quien llega, incluidas las preguntas que vienen después. Una página de «precio de una reforma de baño» que no da rangos, plazos ni qué incluye obliga al asistente a buscar esos datos en otra web, y a citar esa otra.
Para auditarla, escribe las cuatro o cinco preguntas que haría un comprador real y comprueba cuáles responde la página con un dato concreto. Las que no responde son el hueco.
Bloque 5 · ¿Cumple lo que exige su tipo de página?
Cada tipo de página tiene requisitos propios, y la checklist genérica no los ve:
- Negocio local: nombre, dirección y teléfono idénticos en la web y en la ficha de Google, horario, zona de servicio y marcado
LocalBusiness. Lo desarrollamos en la guía de SEO local con IA. - Ficha de producto: precio, disponibilidad, marca y descripción visibles y en el marcado
Product. - Catálogo o categoría: un texto que explique qué hay y cómo elegir, no solo una rejilla de productos.
Decide el tipo de cada plantilla antes de auditar. Aplicar los requisitos de una ficha a un artículo produce hallazgos falsos.
La checklist completa
- Bloque
- Acceso
- Qué comprobar
- robots.txt por tipo de bot
- Cómo comprobarlo a mano
- Abrir
/robots.txty buscar cada agente de la tabla del bloque 1 - Evidencia para el cliente
- Captura del fichero con las líneas marcadas
- Bloque
- Acceso
- Qué comprobar
- Indexable y con fragmento
- Cómo comprobarlo a mano
- Ver el código fuente:
noindex,nosnippet,max-snippet; inspeccionar la URL en Search Console - Evidencia para el cliente
- Resultado de la inspección de URL
- Bloque
- Acceso
- Qué comprobar
- Texto en el HTML servido
- Cómo comprobarlo a mano
curlde la URL, o desactivar JavaScript, y buscar el primer párrafo- Evidencia para el cliente
- El HTML recibido junto a la página renderizada
- Bloque
- Extraibilidad
- Qué comprobar
- Respuesta en el primer párrafo
- Cómo comprobarlo a mano
- Leer las primeras 60 palabras sin el resto de la página
- Evidencia para el cliente
- El párrafo actual y una propuesta reescrita
- Bloque
- Extraibilidad
- Qué comprobar
- H1, H2, listas y tablas
- Cómo comprobarlo a mano
- Revisar el esquema de encabezados
- Evidencia para el cliente
- El índice de encabezados
- Bloque
- Extraibilidad
- Qué comprobar
- Resumen y FAQ visibles
- Cómo comprobarlo a mano
- Buscarlos en la página y comparar con el marcado
- Evidencia para el cliente
- Resultado del validador de schema.org
- Bloque
- Credibilidad
- Qué comprobar
- Cifras con fuente y fecha
- Cómo comprobarlo a mano
- Anotar cada cifra y si enlaza a su origen
- Evidencia para el cliente
- Lista de cifras sin fuente
- Bloque
- Credibilidad
- Qué comprobar
- Autoría, fecha, «Sobre nosotros»
- Cómo comprobarlo a mano
- Buscar firma, perfil del autor y fechas
- Evidencia para el cliente
- Captura de la cabecera del artículo
- Bloque
- Cobertura
- Qué comprobar
- Intención resuelta
- Cómo comprobarlo a mano
- Responder con la página las preguntas del comprador
- Evidencia para el cliente
- Tabla pregunta · respondida sí/no
- Bloque
- Tipo
- Qué comprobar
- Requisitos del tipo
- Cómo comprobarlo a mano
- Comparar web, ficha de Google y marcado
- Evidencia para el cliente
- Discrepancias encontradas
Audita una URL por plantilla (portada, categoría, ficha, artículo, página local), no todas las URL: los fallos de plantilla se repiten en cada página que la usa.
¿Cómo priorizar y presentar lo que encuentres?
Primero lo que bloquea, después lo demás. Un veto a OAI-SearchBot o un noindex dejan la página fuera, por buena que sea; una tabla que falta solo la hace menos citable. Dentro de cada bloque, ordena por páginas afectadas: un fallo de plantilla pesa más que uno aislado.
Para el cliente, separa tres cosas: lo que está bien, lo que falla y lo que no se pudo comprobar, con su motivo. Nada que no hayas comprobado debe aparecer como correcto. Y como un despliegue puede volver a poner un veto o un noindex en cualquier momento, conviene repetir la parte de acceso cada mes; cómo organizarlo está en la guía de monitorización SEO.
Declaración de interés: este blog es de SmoothSeen, una herramienta de auditoría web que mide el posicionamiento en buscadores y en asistentes de IA. Su auditoría de posicionamiento en IA agrupa las comprobaciones en cuatro bloques parecidos a estos (extraibilidad; credibilidad, que incluye el acceso de los rastreadores de búsqueda; cobertura; y lo propio del tipo de página), separa en robots.txt los rastreadores de búsqueda de los de entrenamiento y avisa del contenido que solo aparece con JavaScript. Desde el plan Profesional, el resultado sale en PDF y en un enlace para el cliente; en Agencia, con tu marca. Para la otra pregunta, la de las menciones, los planes de pago siguen en ChatGPT y Gemini las preguntas que definas. La checklist de arriba funciona igual sin SmoothSeen.
Preguntas frecuentes
¿Qué es una auditoría de visibilidad en IA?
Es una revisión de las causas por las que un asistente como ChatGPT, Gemini o Perplexity podría citar o no una página. Comprueba si los rastreadores de búsqueda pueden entrar, si la respuesta se puede extraer sin contexto, si la página ofrece motivos para fiarse de ella, si cubre la intención completa y si cumple los requisitos de su tipo.
¿En qué se diferencia de una auditoría SEO?
Comparten la base: indexación, velocidad y estructura siguen importando, y Google usa su índice normal para AI Overviews. La auditoría de IA añade el acceso de los rastreadores de cada asistente, la extraibilidad de fragmentos sueltos y la credibilidad comprobable, como las cifras con fuente o la autoría visible, que en una auditoría SEO clásica suelen quedar en segundo plano.
¿Cuánto se tarda en auditar una web para IA?
Depende del número de plantillas, no del de URL. Una web con portada, categorías, fichas y blog tiene cuatro plantillas: con una URL representativa de cada una cubres la mayor parte de los fallos, porque se repiten en todas las páginas que comparten plantilla. Después se revisan aparte las páginas que más tráfico o negocio aportan.
¿Hay que vetar GPTBot para proteger el contenido del cliente?
Es una decisión del cliente, no un requisito técnico. Según OpenAI, vetar GPTBot indica que el contenido no debe usarse para entrenar sus modelos, y es independiente de OAI-SearchBot, que es el que decide si la web aparece en la búsqueda de ChatGPT. Lo que no conviene es vetar a los dos sin saber que hacen cosas distintas.
Qué hacer ahora
Abre el robots.txt de tu cliente y comprueba, agente por agente, si deja pasar a OAI-SearchBot, Claude-SearchBot y PerplexityBot. Después aplica la tabla a una URL por plantilla y separa lo bloqueante de lo mejorable. Para llevar lo que encuentres al informe mensual, sigue con la guía de informe SEO para clientes.
Fuentes
- 1AI Citation drift: How stable are sources in AI search results?, Johannes Beus, SISTRIX, actualizada el 12-05-2026.
- 2Overview of OpenAI Crawlers, OpenAI, consultada el 07-10-2026.
- 3Google's common crawlers, Google Search Central, actualizada el 14-07-2026.
- 4Perplexity Crawlers, Perplexity, consultada el 07-10-2026.
- 5Does Anthropic crawl data from the web, and how can site owners block the crawler?, Anthropic, actualizada el 07-04-2026.
- 6AI features and your website, Google Search Central, actualizada el 10-12-2025.
- 7The rise of the AI crawler, Vercel, publicada el 17-12-2024.
- 8GEO: Generative Engine Optimization, Aggarwal y otros, KDD 2024 (versión 3, 28-06-2024).
- 9Creating helpful, reliable, people-first content, Google Search Central, actualizada el 05-10-2026.
Cómo citar este artículo
SmoothSeen. (2026, 7 de octubre). Cómo hacer una auditoría de visibilidad en IA: checklist por bloques para auditar a un cliente. https://smoothseen.com/es/blog/auditoria-visibilidad-ia/
Sigue leyendo
Qué debe llevar un informe SEO para clientes en 2026, visibilidad en IA incluida, cómo demostrar resultados sin inflar cifras y plantilla por secciones.
Informes SEO de marca blanca: qué deben llevar y qué contarle al cliente sobre tus herramientas
Qué es un informe SEO de marca blanca, qué debe llevar con tu marca, qué contarle al cliente sobre tus herramientas y los errores que delatan al proveedor.
Monitorización SEO: qué vigilar en la web de un cliente, cada cuánto y cómo evitar el ruido
Qué vigilar en la web de un cliente y cada cuánto: indexación, robots.txt, certificado, Core Web Vitals, enlaces y seguridad, con alertas sin ruido.