Saltar al contenido

Posicionamiento en Perplexity: cómo elige y cita sus fuentes y qué puedes controlar

Publicado el 07-10-202610 min de lecturaPor la redacción de SmoothSeen

Posicionarse en Perplexity es conseguir que su motor de respuestas elija tu página como una de las fuentes numeradas que enlaza en cada respuesta. Depende de tres cosas que controlas: que su rastreador, PerplexityBot, pueda leer tu web, que cada sección se entienda sola y que la información esté al día. Nadie puede garantizar la cita.

Lo esencial

  • Perplexity busca en la web en el momento de cada pregunta y enlaza sus fuentes con citas numeradas; su índice sigue más de 200.000 millones de URL, según la propia empresa (septiembre de 2025).
  • PerplexityBot es su rastreador de búsqueda, respeta robots.txt y no se usa para entrenar modelos. Perplexity-User visita páginas a petición de un usuario y, según Perplexity, en general no sigue robots.txt.
  • En agosto de 2025 Cloudflare acusó a Perplexity de rastrear con un navegador camuflado; Perplexity lo negó y atribuyó ese tráfico a un servicio externo. Ninguna de las dos versiones está verificada por un tercero.
  • Lo que controlas es el acceso de PerplexityBot (robots.txt y servidor), secciones que se entiendan solas, fechas al día y datos con fuente. Nadie puede garantizar una cita.

Para comprobarlo en tu web: Auditoría de visibilidad en IA

En esta página

Perplexity es uno de los asistentes que el posicionamiento en IA tiene en cuenta, y el que más claro enseña sus fuentes. Esta guía reúne lo que la propia Perplexity documenta sobre cómo busca y rastrea, lo que se discutió en 2025 sobre cómo lo hace de verdad y lo que puedes revisar en tu web esta semana.

¿Cómo responde Perplexity y cómo elige sus fuentes?

Perplexity es un motor de respuestas: busca en internet en el momento de cada pregunta, resume lo que encuentra con un modelo de lenguaje y enlaza cada afirmación a su fuente con una cita numerada. Su centro de ayuda lo explica así: cada respuesta incluye citas numeradas que llevan a las fuentes originales, para que el usuario pueda comprobar la información1. El mismo artículo dice que trabaja con modelos de varias empresas, entre ellos los de OpenAI y Anthropic.

Perplexity ha publicado cómo funciona su búsqueda por dentro. Lo hizo al lanzar su API de búsqueda, que según la empresa usa la misma infraestructura que su motor de respuestas público2. En el artículo técnico que acompañó al lanzamiento da estos datos3:

  • Su índice sigue más de 200.000 millones de URL únicas y atiende 200 millones de consultas al día.
  • Recupera candidatos con búsqueda léxica (palabras) y semántica (significado) a la vez, y los ordena en varias fases; la última usa modelos de reordenación más potentes.
  • Parte cada documento en fragmentos que se entienden solos y los puntúa uno a uno. La empresa lo justifica en que un modelo responde peor cuando recibe contexto irrelevante.
  • Un modelo de aprendizaje automático decide qué URL volver a indexar y cuándo, según su importancia y lo a menudo que cambian.

La consecuencia práctica es directa. Perplexity no cita tu página entera: cita el fragmento que mejor responde. Una sección que solo se entiende si has leído las tres anteriores tiene menos papeletas que una que abre con la respuesta y nombra de qué habla. Cómo escribir así está en la guía de contenido citable por la IA.

¿Qué rastreadores usa Perplexity y qué respeta cada uno?

Perplexity documenta dos agentes, con funciones y reglas distintas4:

Agente
PerplexityBot
Para qué lo usa Perplexity
Encontrar webs y enlazarlas en los resultados de Perplexity
¿Sigue robots.txt?
Sí: Perplexity pide que se le permita en robots.txt y dice que respeta sus reglas
¿Entrena modelos?
No, según Perplexity
Agente
Perplexity-User
Para qué lo usa Perplexity
Visitar una página cuando un usuario hace una pregunta que la necesita
¿Sigue robots.txt?
En general no, porque la petición la inicia una persona
¿Entrena modelos?
No, según Perplexity

Los dos publican su user-agent y la lista de IP desde la que salen, en perplexitybot.json y perplexity-user.json4. Perplexity recomienda a quien use un cortafuegos de aplicaciones web que combine el user-agent con la comprobación de la IP. En su artículo técnico añade que PerplexityBot respeta los límites de ritmo que fije el robots.txt y frena cuando detecta que una web no está disponible3.

Esto tiene dos lecturas. Vetar a PerplexityBot no te protege del entrenamiento de modelos, porque según Perplexity no entrena con lo que rastrea: solo te saca de sus resultados. Y vetar a Perplexity-User en robots.txt probablemente no sirva de nada, porque la empresa avisa de que ese agente no suele leerlo. Si de verdad no quieres que entre, la herramienta es el cortafuegos, no robots.txt. La diferencia entre rastreadores de búsqueda y de entrenamiento en todos los asistentes está en la guía de rastreadores de IA y robots.txt.

Un robots.txt para Perplexity, comentado

Un detalle que se olvida a menudo: según el estándar de robots.txt, un rastreador que encuentra un grupo con su nombre obedece ese grupo y deja de mirar el de User-agent: *5. Si nombras a PerplexityBot, repite en su grupo lo que no quieras que rastree nadie.

# Regla general para todos los rastreadores
User-agent: *
Disallow: /carrito/
Disallow: /mi-cuenta/

# PerplexityBot lee SOLO este grupo, no el de arriba:
# por eso se repiten los Disallow que también le afectan.
User-agent: PerplexityBot
Allow: /
Disallow: /carrito/
Disallow: /mi-cuenta/

# Perplexity-User no aparece: según Perplexity, en general
# no sigue robots.txt, así que un grupo para él no garantiza nada.

Comprueba también lo que hace tu servidor

robots.txt es lo que tu web declara; el servidor puede hacer otra cosa. Hay hostings y cortafuegos que rechazan por defecto los user-agents de rastreadores de IA, y el dueño de la web ni lo sabe. Compara lo que recibe un navegador con lo que recibe alguien que se presenta como PerplexityBot (cambia example.com por tu dominio):

# 1. Lo que recibe un navegador: debería ser 200
curl -s -o /dev/null -w "%{http_code}\n" \
  -A "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/128.0.0.0 Safari/537.36" \
  https://www.example.com/

# 2. Lo que recibe el user-agent publicado de PerplexityBot
curl -s -o /dev/null -w "%{http_code}\n" \
  -A "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; PerplexityBot/1.0; +https://perplexity.ai/perplexitybot)" \
  https://www.example.com/

Si la primera orden da 200 y la segunda 403, algo en tu servidor o en tu CDN rechaza a PerplexityBot por su nombre. Ojo con la lectura contraria: si tu cortafuegos verifica la IP de los rastreadores, rechazará esta imitación y dejará pasar al PerplexityBot real, que sale de las IP de su lista. En ese caso, el 403 no dice nada del rastreador de verdad.

¿Qué pasó entre Cloudflare y Perplexity en 2025?

El 4 de agosto de 2025, Cloudflare acusó a Perplexity de usar rastreadores no declarados para saltarse los vetos de las webs, y Perplexity respondió que Cloudflare había confundido su tráfico con el de otro servicio. Las dos partes publicaron datos que la otra niega, y no conocemos ninguna verificación independiente.

Lo que dice Cloudflare6:

  • Webs de clientes que habían vetado a PerplexityBot seguían viendo su contenido en las respuestas de Perplexity.
  • Cloudflare registró dominios nuevos, sin publicar en ninguna parte, con un robots.txt que vetaba todo. Al preguntar por ellos a Perplexity, obtuvo información detallada de su contenido.
  • Según su análisis, cuando el rastreador declarado se encontraba un bloqueo, aparecían peticiones con un user-agent genérico de Chrome en macOS, desde IP y redes que iban cambiando. Cifró el tráfico declarado en 20-25 millones de peticiones diarias y el no declarado en 3-6 millones.
  • Cloudflare retiró a Perplexity de su lista de bots verificados y añadió reglas para bloquear ese rastreo. Como contraste, contó que ChatGPT-User leyó el robots.txt y dejó de pedir páginas cuando se le vetó.

Lo que responde Perplexity7:

  • Un asistente que visita una página porque un usuario lo ha pedido no es un rastreador, y lo compara con los agentes de Google que actúan a petición del usuario.
  • Los 3-6 millones de peticiones diarias serían de BrowserBase, un servicio externo de navegadores en la nube que Perplexity dice usar solo para tareas concretas, con menos de 45.000 peticiones al día.
  • Acusa a Cloudflare de no explicar su método y de no saber distinguir un asistente legítimo de una amenaza.

Para ti, la lección no depende de quién tenga razón. robots.txt es una petición que cada empresa decide respetar o no, y la propia documentación de Perplexity ya dice que Perplexity-User en general no la sigue4. Si necesitas impedir el acceso, hace falta una regla en el servidor o en el cortafuegos. Si quieres que te citen, lo que importa es que PerplexityBot no se encuentre la puerta cerrada.

¿Tiene Perplexity un programa para editores?

Perplexity ha anunciado dos. El primero, el Perplexity Publishers' Program, del 30 de julio de 2024, prometía a los medios asociados una parte de los ingresos por publicidad cuando su contenido apareciera en una respuesta. Arrancó con TIME, Der Spiegel, Fortune, Entrepreneur, The Texas Tribune y WordPress.com8.

El segundo es Comet Plus, anunciado el 25 de agosto de 2025: una suscripción con acceso a contenido de editores asociados cuyos ingresos, menos una parte para costes de computación, se reparten entre ellos según tres tipos de tráfico: visitas humanas, citas en búsquedas y acciones de agentes9. Según Press Gazette, el reparto es del 80 % para los editores, y los primeros socios fueron CNN, Condé Nast, Fortune, Los Angeles Times, The Washington Post, Le Monde y Le Figaro10.

A fecha de esta guía no hemos encontrado una página oficial de Perplexity con las condiciones vigentes ni con lo que se ha pagado. Lo que hay son esos anuncios, y Comet Plus invitaba a los editores interesados a escribir por correo. Dos avisos: los dos programas están pensados para medios con acuerdos comerciales, no para cualquier web, y ninguno de los anuncios dice que participar haga que Perplexity te cite más.

¿Qué puedes controlar para que Perplexity te cite?

Lo que depende de ti cabe en esta lista. Ninguno de los puntos garantiza una cita, pero cada uno quita una razón para no elegirte:

Qué revisar
PerplexityBot permitido en robots.txt
Por qué importa en Perplexity
Es el agente que enlaza webs en sus resultados
Cómo comprobarlo
Abre /robots.txt y busca un grupo con su nombre o un Disallow: / general
Qué revisar
El servidor no lo rechaza
Por qué importa en Perplexity
Un 403 al user-agent tiene el mismo efecto que un veto
Cómo comprobarlo
Las dos órdenes curl de arriba
Qué revisar
Contenido en el HTML
Por qué importa en Perplexity
Si el texto solo aparece al ejecutar JavaScript, el rastreador puede no verlo
Cómo comprobarlo
Ver el código fuente de la página y buscar una frase del cuerpo
Qué revisar
Secciones que se entienden solas
Por qué importa en Perplexity
Perplexity puntúa fragmentos, no páginas enteras
Cómo comprobarlo
Lee un apartado suelto: ¿dice de qué habla sin el resto?
Qué revisar
Respuesta al principio de cada sección
Por qué importa en Perplexity
El fragmento que gana es el que responde antes
Cómo comprobarlo
La primera frase bajo cada título responde a ese título
Qué revisar
Fecha visible y contenido al día
Por qué importa en Perplexity
Perplexity reindexa según lo a menudo que cambia cada URL
Cómo comprobarlo
Fecha de actualización en la página y en el marcado
Qué revisar
Datos con su fuente
Por qué importa en Perplexity
Una cifra con origen enlazado es más fácil de citar y de comprobar
Cómo comprobarlo
Cada cifra lleva fuente y fecha en la misma frase

Una nota sobre la frescura: actualizar la fecha sin cambiar nada no es actualizar. Lo que Perplexity describe es un sistema que aprende cada cuánto cambia de verdad una página3. Si cambias la fecha y el texto sigue igual, solo pierdes credibilidad con el lector.

¿Qué comprueba SmoothSeen de todo esto?

Declaración de interés: este blog es de SmoothSeen. Su análisis de Posicionamiento IA comprueba si tu robots.txt deja pasar a PerplexityBot y a los demás rastreadores de búsqueda de los asistentes, y pide la página con el user-agent de cada uno para avisarte si el servidor la rechaza aunque robots.txt la permita. También revisa si el contenido depende de JavaScript y si cada sección se puede citar sola.

Lo que SmoothSeen no hace es medir si Perplexity te menciona o te enlaza. Revisa las causas que están en tu página, no el resultado en Perplexity. Las preguntas que sigue en los planes de pago son de ChatGPT y Gemini; para Perplexity, la forma de saberlo es hacerle tú las preguntas de tus clientes, siempre las mismas, cada cierto tiempo.

Preguntas frecuentes

¿Bloquear a PerplexityBot evita que Perplexity entrene con mi contenido?

Según Perplexity, PerplexityBot no se usa para entrenar modelos de IA, así que vetarlo no cambia nada en ese sentido. Lo que consigues es que deje de rastrear tu web para enlazarla en sus resultados. Si tu objetivo es no aparecer en Perplexity, el veto tiene sentido; si quieres que te citen, es justo lo contrario de lo que te conviene.

¿Perplexity-User respeta robots.txt?

En general no. La documentación de Perplexity dice que Perplexity-User actúa cuando un usuario hace una pregunta y que, por ser una petición iniciada por una persona, suele ignorar las reglas de robots.txt. Si necesitas impedir esas visitas, tendrás que bloquearlas en el servidor o en el cortafuegos, combinando el user-agent con la lista de IP que publica la empresa.

¿Cómo sé si Perplexity cita mi web?

Haz en Perplexity las preguntas que haría un cliente tuyo y mira las fuentes numeradas de cada respuesta. Repite siempre las mismas preguntas cada cierto tiempo y anota quién aparece, porque las fuentes cambian de una vez a otra. En tu analítica, las visitas que llegan desde sus enlaces suelen verse como tráfico de referencia desde perplexity.ai, cuando el navegador transmite el origen.

¿Hace falta un llms.txt para salir en Perplexity?

Perplexity no lo pide en su documentación de rastreadores ni lo menciona como señal para elegir fuentes. Lo que sí documenta es que su rastreador respeta robots.txt y que puntúa fragmentos de cada página. Un llms.txt no hace daño, pero no sustituye a tener PerplexityBot permitido y secciones que se entiendan solas.

Qué hacer ahora

Abre el robots.txt de tu web, comprueba que PerplexityBot no está vetado y pasa las dos órdenes curl para ver lo que hace tu servidor. Después elige tus tres páginas más importantes y reescribe la primera frase de cada sección para que responda sola. El resto de asistentes funciona con la misma lógica: lo tienes en la guía de posicionamiento en IA.

Fuentes

  1. 1How does Perplexity work?, Perplexity Help Center, consultada el 07-10-2026.
  2. 2Introducing the Perplexity Search API, Perplexity, 25-09-2025.
  3. 3Architecting and Evaluating an AI-First Search API, Perplexity, 25-09-2025.
  4. 4Perplexity Crawlers, Perplexity, consultada el 07-10-2026.
  5. 5RFC 9309: Robots Exclusion Protocol, IETF, septiembre de 2022, consultada el 07-10-2026.
  6. 6Perplexity is using stealth, undeclared crawlers to evade website no-crawl directives, Cloudflare, 04-08-2025.
  7. 7Agents or Bots? Making Sense of AI on the Open Web, Perplexity, 04-08-2025.
  8. 8Introducing the Perplexity Publishers' Program, Perplexity, 30-07-2024.
  9. 9Introducing Comet Plus, Perplexity, 25-08-2025.
  10. 10Perplexity launches AI subscription revenue-share scheme for publishers, Press Gazette, actualizada el 13-11-2025.

Cómo citar este artículo

SmoothSeen. (2026, 7 de octubre). Posicionamiento en Perplexity: cómo elige y cita sus fuentes y qué puedes controlar. https://smoothseen.com/es/blog/posicionamiento-perplexity/

Quién lo escribe

SmoothSeen es una herramienta de auditoría web que mide el posicionamiento en buscadores y en asistentes de IA y entrega informes con la marca de la agencia.

Este blog es de SmoothSeen: cuando un artículo habla del producto, lo hace sabiendo que es el nuestro. Las cifras de terceros enlazan a su fuente original.

Historial de cambios

  • Primera versión.

Sigue leyendo

Posicionamiento en Perplexity: cómo elige y cita fuentes