Bytespider: ein Trainings-Crawler, den ByteDance betreibt
Bytespider ist ein Trainings-Crawler. Er sammelt Seiten für den jeweiligen Zweck (Doubao). Betrieben wird er von ByteDance.
Auf einen Blick
- Betreiber
- ByteDance
- robots.txt-Token
Bytespider- Zweck
- Training. Trainings-Crawler sammeln Seiten für künftige Modelle. Wenn Sie sie aussperren, halten Sie damit nicht die Crawler auf, die Seiten für Antworten abrufen. Diese haben eigene Namen.
- Wofür er Daten liefert
- Doubao
Was sich durch das Blockieren ändert
Wenn Sie Bytespider aussperren, werden Ihre Seiten nicht für den jeweiligen Zweck (Doubao) gesammelt. Die Crawler, die Seiten für Antworten abrufen, haben eigene Namen und können Ihre Website weiterhin lesen.
User-Agent
Der vollständige User-Agent aus der Dokumentation des Betreibers. Wenn Bytespider eine Anfrage sendet, enthält sie diesen Text. Er erscheint auch im Serverprotokoll.
Mozilla/5.0 (Linux; Android 5.0) AppleWebKit/537.36 (KHTML, like Gecko) Mobile Safari/537.36 (compatible; Bytespider; [email protected])robots.txt-Zeilen für Bytespider
robots.txt ist eine reine Textdatei im Stammverzeichnis einer Website (yoursite.com/robots.txt). Eine Gruppe beginnt mit einer oder mehreren User-agent-Zeilen, die Crawler benennen. Darauf folgen Allow- und Disallow-Zeilen für Pfade. Ein Crawler, der in einer Gruppe namentlich genannt wird, befolgt die Gruppen mit seinem Namen und ignoriert die Gruppe für alle Crawler (User-agent: *).
Zulassen
User-agent: Bytespider
Allow: /Sperren
User-agent: Bytespider
Disallow: /Lässt Ihre Website den Crawler zu?
Die kostenlose Crawler-Prüfung liest Ihre robots.txt für Bytespider und ruft Ihre Seite mit dessen User-Agent auf. So zeigt sie, ob eine robots.txt-Regel oder eine Firewall den Crawler abweist.