Amazonbot: ein Such-Crawler, den Amazon betreibt
Amazonbot ist ein Such-Crawler. Er liest Seiten für den Suchindex des jeweiligen Angebots (Alexa und Rufus). Betrieben wird er von Amazon.
Auf einen Blick
- Betreiber
- Amazon
- robots.txt-Token
Amazonbot- Zweck
- Suche. Such-Crawler lesen Seiten, um den Index aufzubauen, den ein Assistent für seine Antworten durchsucht. Kann er eine Seite nicht lesen, kann sie in diesen Antworten weder gefunden noch zitiert werden.
- Wofür er Daten liefert
- Alexa und Rufus
Was sich durch das Blockieren ändert
Wenn Sie Amazonbot aussperren, können Ihre Seiten in den Suchantworten des jeweiligen Angebots (Alexa und Rufus) weder gefunden noch zitiert werden.
User-Agent
Der vollständige User-Agent aus der Dokumentation des Betreibers. Wenn Amazonbot eine Anfrage sendet, enthält sie diesen Text. Er erscheint auch im Serverprotokoll.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1; +https://developer.amazon.com/support/amazonbot) Chrome/119.0.6045.214 Safari/537.36robots.txt-Zeilen für Amazonbot
robots.txt ist eine reine Textdatei im Stammverzeichnis einer Website (yoursite.com/robots.txt). Eine Gruppe beginnt mit einer oder mehreren User-agent-Zeilen, die Crawler benennen. Darauf folgen Allow- und Disallow-Zeilen für Pfade. Ein Crawler, der in einer Gruppe namentlich genannt wird, befolgt die Gruppen mit seinem Namen und ignoriert die Gruppe für alle Crawler (User-agent: *).
Zulassen
User-agent: Amazonbot
Allow: /Sperren
User-agent: Amazonbot
Disallow: /Lässt Ihre Website den Crawler zu?
Die kostenlose Crawler-Prüfung liest Ihre robots.txt für Amazonbot und ruft Ihre Seite mit dessen User-Agent auf. So zeigt sie, ob eine robots.txt-Regel oder eine Firewall den Crawler abweist.