Spanish site
Spanish site

¿Cómo elige Perplexity las fuentes que cita?

·

Equipo Quint-IA Vantage

Perplexity encuentra sus fuentes con un rastreador propio, PerplexityBot, y cuando alguien hace una pregunta envía un segundo agente, Perplexity-User, a leer páginas en ese momento. Cada respuesta incluye enlaces a las páginas que usó. De los motores de respuesta (herramientas de IA como ChatGPT, Gemini o Perplexity que contestan con un texto en lugar de una lista de enlaces), es el que más se asemeja a un buscador tradicional.

Para una empresa latinoamericana que vende en Estados Unidos, esto importa por una razón concreta: cuando un comprador estadounidense investiga proveedores en Perplexity, la respuesta que recibe enlaza a sitios específicos. Si el tuyo no está entre ellos, ese comprador no te encuentra.

Este artículo explica cómo funciona la recuperación de contenido en Perplexity, con base en la documentación oficial de sus rastreadores y en un estudio de Ahrefs sobre 15.000 consultas.

¿Perplexity usa el índice de Google o de Bing?

No. Perplexity tiene su propio rastreador (crawler), PerplexityBot, que recorre e indexa páginas para mostrarlas y enlazarlas en sus respuestas [1]. Ahrefs confirma que Perplexity mantiene su propio rastreador de búsqueda y no depende de los índices de Google ni de Bing [2].

Según Perplexity, PerplexityBot no se usa para recopilar contenido destinado a entrenar modelos de IA [1]. Su función es la búsqueda: encontrar páginas que puedan aparecer enlazadas en una respuesta.

Esto tiene una consecuencia práctica. Si tu archivo robots.txt (el archivo que indica a los rastreadores qué páginas pueden visitar) bloquea a PerplexityBot, es poco probable que tus páginas aparezcan en los resultados de Perplexity. La documentación recomienda permitirle el acceso y publica los rangos de IP del bot para que puedas verificar que el tráfico es legítimo [1].

¿Cómo cita Perplexity sus fuentes en tiempo real?

Cuando un usuario hace una pregunta, Perplexity puede enviar a Perplexity-User a visitar páginas en ese mismo momento e incluir los enlaces en la respuesta [1]. La respuesta se construye con páginas leídas en el instante de la consulta.

Como Perplexity-User actúa a pedido de una persona, Perplexity indica que por lo general ignora las reglas de robots.txt [1]. Igual que PerplexityBot, no se usa para entrenar modelos.

Los dos agentes se reparten el trabajo así:

  • PerplexityBot rastrea e indexa páginas para mostrarlas y enlazarlas en las respuestas. Respeta robots.txt y no se usa para entrenar modelos.

  • Perplexity-User visita páginas en vivo cuando alguien pregunta y las enlaza en la respuesta. Por lo general ignora robots.txt y no se usa para entrenar modelos.

El resultado es un motor diseñado para citar. Ahrefs lo describe como una herramienta pensada para respaldar casi cada afirmación con una fuente [2], y puedes comprobarlo tú mismo: hazle a Perplexity cualquier pregunta de compra y verás los enlaces numerados dentro de la respuesta.

Para tu contenido, esto significa que una página que Perplexity puede leer hoy puede ser citada hoy, sin esperar a que un modelo se vuelva a entrenar.


Gráfico de barras: coincidencia de citas con el top 10 de Google. Perplexity 28,6 %, Gemini 8,6 %, ChatGPT 6,1 %

¿Qué tanto coinciden las citas de Perplexity con el posicionamiento de Google?

Más que las de cualquier otro asistente de IA que midió Ahrefs. En un estudio de 15.000 consultas de cola larga recopiladas a inicios de julio de 2025, el 28,6 % de las URL citadas por Perplexity también estaba en el top 10 de Google para la misma consulta [2].

Los demás asistentes quedaron muy por debajo. En promedio, solo el 12 % de las citas de los asistentes de IA aparecía también en el top 10 de Google [2].

  • Perplexity: 28,6 %

  • Gemini: 8,6 %

  • Copilot: 8,2 %

  • ChatGPT (citas dentro del texto): 8,0 %

  • ChatGPT (lista de referencias): 6,1 %

La coincidencia llama la atención porque Perplexity no usa el índice de Google. Su rastreador llega a muchas de las páginas que Google posiciona en los primeros lugares. Ahrefs lo atribuye al diseño de Perplexity: un motor hecho para citar tiende a preferir contenido que ya posiciona bien [2].

Con Bing pasa lo contrario. Apenas el 3,3 % de las citas de Perplexity coincidió con el top 10 de Bing, la cifra más baja entre los asistentes medidos [2].

¿Qué hacer para que Perplexity cite tu sitio?

Primero asegura el acceso y después cubre las preguntas que hacen tus compradores. Estos cuatro pasos se desprenden de cómo Perplexity recupera contenido.

1. Deja que PerplexityBot rastree tu sitio. Revisa robots.txt y las reglas de tu CDN o firewall. Si el rastreador no llega a una página, esa página no puede aparecer en los resultados de Perplexity [1].

2. Cuida tu posicionamiento en Google. Con un 28,6 % de las citas de Perplexity también presentes en el top 10 de Google [2], un SEO sólido es la base de tu visibilidad en Perplexity. Si tus páginas no posicionan para ninguna búsqueda relevante, empieza por ahí.

3. Responde las variantes de cada pregunta. Ahrefs explica que los asistentes de IA convierten una pregunta en varias búsquedas relacionadas (un proceso llamado query fan-out) y combinan los resultados. Una página en el sexto lugar para tres variantes puede ganarle a otra que ocupa el primer lugar solo para la frase original [2]. Arma grupos de contenido (topic clusters) que respondan también las preguntas vecinas.

4. Mide Perplexity por separado. Su patrón de citas es muy distinto al de ChatGPT, Gemini y Copilot, así que un puntaje único de "visibilidad en IA" esconde tu posición real. Registra qué páginas tuyas cita Perplexity ante las preguntas reales de tus compradores y qué competidores aparecen en tu lugar.

Si tus compradores están en Estados Unidos, haz este ejercicio con sus preguntas en inglés. Son esas consultas las que deciden qué proveedores aparecen en su respuesta.

Qué significa esto para tu estrategia de búsqueda con IA

Perplexity es el motor de respuesta donde el trabajo de SEO se traslada de forma más directa: rastrea por su cuenta, consulta páginas en vivo y cita de forma visible. Por eso es el lugar más claro para comprobar si tu contenido es citable, y uno donde una página mejorada puede empezar a aparecer sin esperar a que un modelo se vuelva a entrenar.

Preguntas frecuentes

¿Perplexity usa los resultados de Google? No. Perplexity tiene su propio rastreador, PerplexityBot, y no toma resultados del índice de Google ni del de Bing. Aun así, según un estudio de Ahrefs con 15.000 consultas de julio de 2025, el 28,6 % de sus citas coincide con el top 10 de Google, la coincidencia más alta entre los asistentes de IA analizados.

¿Qué es PerplexityBot? Es el rastreador web de Perplexity. Indexa páginas para que Perplexity pueda mostrarlas y enlazarlas en sus respuestas. Según la empresa, no se usa para recopilar contenido destinado a entrenar modelos de IA y respeta las reglas de robots.txt. Perplexity publica sus rangos de IP para que puedas verificar su tráfico.

¿Qué es Perplexity-User? Es el agente que Perplexity envía a visitar páginas en vivo cuando un usuario hace una pregunta, para incluir enlaces a esas páginas en la respuesta. Como cada visita la origina una persona, Perplexity indica que por lo general ignora robots.txt. Tampoco se usa para entrenar modelos.

¿Conviene bloquear a PerplexityBot en robots.txt? Solo si no quieres que tus páginas aparezcan en Perplexity. Bloquearlo deja tus páginas fuera de su índice de búsqueda, que es tu principal vía para aparecer citado en sus respuestas. Perplexity afirma que este rastreador no se usa para entrenar modelos, así que bloquearlo no cambia si tu contenido entrena una IA.

¿En qué se diferencia aparecer en Perplexity de aparecer en ChatGPT? Perplexity cita fuentes en casi todas sus respuestas y favorece páginas que posicionan bien en Google. En el mismo estudio de Ahrefs, ChatGPT, Gemini y Copilot citaron páginas del top 10 de Google solo entre el 6,1 % y el 8,6 % de las veces. En esos tres, el 80 % de las citas ni siquiera posicionaba en Google para la consulta original.

¿El contenido tiene que ser reciente para que Perplexity lo cite? Perplexity puede leer una página en vivo en el momento de la consulta, así que una página nueva o actualizada puede aparecer citada sin esperar a que un modelo se vuelva a entrenar. Las dos fuentes de este artículo no miden cuánto pesa la antigüedad del contenido, así que tómala como un factor entre varios.

Descubre cómo aparece tu marca en 4 motores de respuesta.

Referencias

  1. Perplexity. "Perplexity Crawlers". Documentación de Perplexity. docs.perplexity.ai/docs/resources/perplexity-crawlers

  2. Linehan, L. y Guan, X. "AI Search Overlap". Ahrefs, publicado el 11 de agosto de 2025 (datos recopilados en julio de 2025). ahrefs.com/blog/ai-search-overlap