PerplexityBot: rastreador de búsqueda operado por Perplexity
PerplexityBot es un rastreador de búsqueda. Lee páginas para crear el índice que utiliza Perplexity. Lo opera Perplexity.
De un vistazo
- Responsable del sitio
- Perplexity
- Identificador en robots.txt
PerplexityBot- Función
- Búsqueda. Los rastreadores de búsqueda leen páginas para crear el índice que consulta un asistente al responder. Si no pueden leer una página, no podrán encontrarla ni citarla en sus respuestas.
- Qué alimenta
- Perplexity
Qué cambia al bloquearlo
Si bloqueas PerplexityBot, tus páginas no podrán aparecer ni citarse en las respuestas de búsqueda de Perplexity.
Agente de usuario
El agente de usuario completo, según la documentación de quien lo opera. Las solicitudes de PerplexityBot incluyen este texto, que aparece en los registros del servidor.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; PerplexityBot/1.0; +https://perplexity.ai/perplexitybot)Reglas de robots.txt para PerplexityBot
robots.txt es un archivo de texto sin formato situado en la raíz de un sitio (yoursite.com/robots.txt). Un grupo empieza con una o varias líneas User-agent que nombran rastreadores, seguidas de líneas Allow y Disallow para las rutas. Un rastreador nombrado en un grupo sigue los grupos que lo nombran e ignora el grupo general (User-agent: *).
Para permitirle el acceso
User-agent: PerplexityBot
Allow: /Para bloquearle el acceso
User-agent: PerplexityBot
Disallow: /¿Tu sitio le permite el acceso?
La comprobación de rastreadores lee tu robots.txt para PerplexityBot y solicita tu página con su agente de usuario. Así muestra si lo bloquea una regla de robots.txt o un firewall.