Amazonbot: een zoekcrawler van Amazon
Amazonbot is een zoekcrawler. Hij leest pagina's voor de zoekindex achter Alexa en Rufus. Amazon beheert deze crawler.
In één oogopslag
- Beheerder
- Amazon
- robots.txt-token
Amazonbot- Doel
- Zoeken. Zoekcrawlers lezen pagina's om de index op te bouwen waarin een assistent zoekt wanneer die antwoord geeft. Een pagina die ze niet kunnen lezen, kan niet in die antwoorden worden gevonden of geciteerd.
- Waarvoor de gegevens worden gebruikt
- Alexa en Rufus
Wat blokkeren verandert
Als je Amazonbot weert, kunnen je pagina's niet worden gevonden of geciteerd in de zoekantwoorden van Alexa en Rufus.
User-agent
De volledige user-agent volgens de documentatie van de beheerder. Een verzoek van Amazonbot bevat deze tekst, die ook in serverlogs te zien is.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1; +https://developer.amazon.com/support/amazonbot) Chrome/119.0.6045.214 Safari/537.36robots.txt-regels voor Amazonbot
robots.txt is een tekstbestand in de hoofdmap van een site (yoursite.com/robots.txt). Een groep begint met één of meer User-agent-regels die crawlers benoemen, gevolgd door Allow- en Disallow-regels voor paden. Een crawler die in een groep wordt genoemd, volgt de groepen met zijn naam en negeert de groep voor alle crawlers (User-agent: *).
Toelaten
User-agent: Amazonbot
Allow: /Blokkeren
User-agent: Amazonbot
Disallow: /Laat jouw site deze crawler toe?
De gratis crawlercheck leest je robots.txt voor Amazonbot en vraagt je pagina op met de bijbehorende user-agent. Zo zie je of een robots.txt-regel of een firewall deze crawler weert.