PerplexityBot: crawler di ricerca gestito da Perplexity
PerplexityBot è un crawler di ricerca. Legge le pagine per creare l’indice usato da questo prodotto: Perplexity. È gestito da Perplexity.
In breve
- Gestore
- Perplexity
- Identificativo robots.txt
PerplexityBot- Scopo
- Ricerca. I crawler di ricerca leggono le pagine per costruire l’indice che un assistente consulta quando risponde. Se non possono leggere una pagina, questa non può comparire né essere citata in quelle risposte.
- Cosa alimenta
- Perplexity
Effetti del blocco
Se blocchi PerplexityBot, le tue pagine non potranno comparire né essere citate nelle risposte di ricerca di questo prodotto: Perplexity.
User agent
Questo è lo user agent completo riportato nella documentazione del gestore. Le richieste di PerplexityBot lo includono e puoi vederlo nei log del server.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; PerplexityBot/1.0; +https://perplexity.ai/perplexitybot)Regole robots.txt per PerplexityBot
robots.txt è un file di testo semplice nella directory principale di un sito (yoursite.com/robots.txt). Un gruppo inizia con una o più righe User-agent che indicano i crawler, seguite da righe Allow e Disallow per i percorsi. Un crawler indicato in un gruppo segue i gruppi che lo nominano e ignora quello valido per tutti i crawler (User-agent: *).
Per consentire l’accesso
User-agent: PerplexityBot
Allow: /Per bloccare l’accesso
User-agent: PerplexityBot
Disallow: /Il tuo sito gli consente l’accesso?
Il controllo dei crawler legge il tuo robots.txt per PerplexityBot e richiede una pagina usando il suo user agent. Ti mostra così se a bloccarlo è una regola robots.txt o un firewall.