Amazonbot: crawler di ricerca gestito da Amazon
Amazonbot è un crawler di ricerca. Legge le pagine per creare l’indice usato da questo prodotto: Alexa e Rufus. È gestito da Amazon.
In breve
- Gestore
- Amazon
- Identificativo robots.txt
Amazonbot- Scopo
- Ricerca. I crawler di ricerca leggono le pagine per costruire l’indice che un assistente consulta quando risponde. Se non possono leggere una pagina, questa non può comparire né essere citata in quelle risposte.
- Cosa alimenta
- Alexa e Rufus
Effetti del blocco
Se blocchi Amazonbot, le tue pagine non potranno comparire né essere citate nelle risposte di ricerca di questo prodotto: Alexa e Rufus.
User agent
Questo è lo user agent completo riportato nella documentazione del gestore. Le richieste di Amazonbot lo includono e puoi vederlo nei log del server.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1; +https://developer.amazon.com/support/amazonbot) Chrome/119.0.6045.214 Safari/537.36Regole robots.txt per Amazonbot
robots.txt è un file di testo semplice nella directory principale di un sito (yoursite.com/robots.txt). Un gruppo inizia con una o più righe User-agent che indicano i crawler, seguite da righe Allow e Disallow per i percorsi. Un crawler indicato in un gruppo segue i gruppi che lo nominano e ignora quello valido per tutti i crawler (User-agent: *).
Per consentire l’accesso
User-agent: Amazonbot
Allow: /Per bloccare l’accesso
User-agent: Amazonbot
Disallow: /Il tuo sito gli consente l’accesso?
Il controllo dei crawler legge il tuo robots.txt per Amazonbot e richiede una pagina usando il suo user agent. Ti mostra così se a bloccarlo è una regola robots.txt o un firewall.