ClaudeBot: ein Trainings-Crawler, den Anthropic betreibt
ClaudeBot ist ein Trainings-Crawler. Er sammelt Seiten für den jeweiligen Zweck (künftige Claude-Modelle). Betrieben wird er von Anthropic.
Auf einen Blick
- Betreiber
- Anthropic
- robots.txt-Token
ClaudeBot- Zweck
- Training. Trainings-Crawler sammeln Seiten für künftige Modelle. Wenn Sie sie aussperren, halten Sie damit nicht die Crawler auf, die Seiten für Antworten abrufen. Diese haben eigene Namen.
- Wofür er Daten liefert
- künftige Claude-Modelle
Was sich durch das Blockieren ändert
Wenn Sie ClaudeBot aussperren, werden Ihre Seiten nicht für den jeweiligen Zweck (künftige Claude-Modelle) gesammelt. Die Crawler, die Seiten für Antworten abrufen, haben eigene Namen und können Ihre Website weiterhin lesen.
User-Agent
Der vollständige User-Agent aus der Dokumentation des Betreibers. Wenn ClaudeBot eine Anfrage sendet, enthält sie diesen Text. Er erscheint auch im Serverprotokoll.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; [email protected])robots.txt-Zeilen für ClaudeBot
robots.txt ist eine reine Textdatei im Stammverzeichnis einer Website (yoursite.com/robots.txt). Eine Gruppe beginnt mit einer oder mehreren User-agent-Zeilen, die Crawler benennen. Darauf folgen Allow- und Disallow-Zeilen für Pfade. Ein Crawler, der in einer Gruppe namentlich genannt wird, befolgt die Gruppen mit seinem Namen und ignoriert die Gruppe für alle Crawler (User-agent: *).
Zulassen
User-agent: ClaudeBot
Allow: /Sperren
User-agent: ClaudeBot
Disallow: /Lässt Ihre Website den Crawler zu?
Die kostenlose Crawler-Prüfung liest Ihre robots.txt für ClaudeBot und ruft Ihre Seite mit dessen User-Agent auf. So zeigt sie, ob eine robots.txt-Regel oder eine Firewall den Crawler abweist.