Amazonbot: En søgecrawler, som drives af Amazon
Amazonbot er en søgecrawler. Den læser sider til søgeindekset bag produktet (Alexa og Rufus). Operatøren er Amazon.
Overblik
- Ansvarlig virksomhed
- Amazon
- robots.txt-token
Amazonbot- Formål
- Søgning. Søgecrawlere læser sider for at opbygge det indeks, en assistent søger i, når den svarer. Hvis de ikke kan læse en side, kan den hverken findes eller citeres i de svar.
- Hvad den leverer data til
- Alexa og Rufus
Hvad det ændrer at blokere den
Hvis du blokerer Amazonbot, kan dine sider ikke findes eller citeres i søgesvar fra produktet (Alexa og Rufus).
User agent
Den fulde user agent fra operatørens dokumentation. En forespørgsel fra Amazonbot indeholder denne tekst, som kan ses i serverloggen.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1; +https://developer.amazon.com/support/amazonbot) Chrome/119.0.6045.214 Safari/537.36Linjer i robots.txt for Amazonbot
robots.txt er en almindelig tekstfil i roden af et website (yoursite.com/robots.txt). En gruppe begynder med en eller flere User-agent-linjer, der navngiver crawlere, efterfulgt af Allow- og Disallow-linjer for stier. En crawler, der er nævnt i en gruppe, følger de grupper, hvor dens navn står, og ignorerer gruppen for alle crawlere (User-agent: *).
Tillad adgang
User-agent: Amazonbot
Allow: /Blokér adgang
User-agent: Amazonbot
Disallow: /Giver dit website adgang?
Det gratis crawlertjek læser din robots.txt for Amazonbot og henter din side med crawlerens user agent. Så kan du se, om en regel i robots.txt eller en firewall afviser den.