PerplexityBot: een zoekcrawler van Perplexity
PerplexityBot is een zoekcrawler. Hij leest pagina's voor de zoekindex achter Perplexity. Perplexity beheert deze crawler.
In één oogopslag
- Beheerder
- Perplexity
- robots.txt-token
PerplexityBot- Doel
- Zoeken. Zoekcrawlers lezen pagina's om de index op te bouwen waarin een assistent zoekt wanneer die antwoord geeft. Een pagina die ze niet kunnen lezen, kan niet in die antwoorden worden gevonden of geciteerd.
- Waarvoor de gegevens worden gebruikt
- Perplexity
Wat blokkeren verandert
Als je PerplexityBot weert, kunnen je pagina's niet worden gevonden of geciteerd in de zoekantwoorden van Perplexity.
User-agent
De volledige user-agent volgens de documentatie van de beheerder. Een verzoek van PerplexityBot bevat deze tekst, die ook in serverlogs te zien is.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; PerplexityBot/1.0; +https://perplexity.ai/perplexitybot)robots.txt-regels voor PerplexityBot
robots.txt is een tekstbestand in de hoofdmap van een site (yoursite.com/robots.txt). Een groep begint met één of meer User-agent-regels die crawlers benoemen, gevolgd door Allow- en Disallow-regels voor paden. Een crawler die in een groep wordt genoemd, volgt de groepen met zijn naam en negeert de groep voor alle crawlers (User-agent: *).
Toelaten
User-agent: PerplexityBot
Allow: /Blokkeren
User-agent: PerplexityBot
Disallow: /Laat jouw site deze crawler toe?
De gratis crawlercheck leest je robots.txt voor PerplexityBot en vraagt je pagina op met de bijbehorende user-agent. Zo zie je of een robots.txt-regel of een firewall deze crawler weert.