Meta-ExternalAgent: ein Trainings-Crawler, den Meta betreibt
Meta-ExternalAgent ist ein Trainings-Crawler. Er sammelt Seiten für den jeweiligen Zweck (Meta AI). Betrieben wird er von Meta.
Auf einen Blick
- Betreiber
- Meta
- robots.txt-Token
Meta-ExternalAgent- Zweck
- Training. Trainings-Crawler sammeln Seiten für künftige Modelle. Wenn Sie sie aussperren, halten Sie damit nicht die Crawler auf, die Seiten für Antworten abrufen. Diese haben eigene Namen.
- Wofür er Daten liefert
- Meta AI
Was sich durch das Blockieren ändert
Wenn Sie Meta-ExternalAgent aussperren, werden Ihre Seiten nicht für den jeweiligen Zweck (Meta AI) gesammelt. Die Crawler, die Seiten für Antworten abrufen, haben eigene Namen und können Ihre Website weiterhin lesen.
User-Agent
Der vollständige User-Agent aus der Dokumentation des Betreibers. Wenn Meta-ExternalAgent eine Anfrage sendet, enthält sie diesen Text. Er erscheint auch im Serverprotokoll.
meta-externalagent/1.1 (+https://developers.facebook.com/docs/sharing/webmasters/crawler)robots.txt-Zeilen für Meta-ExternalAgent
robots.txt ist eine reine Textdatei im Stammverzeichnis einer Website (yoursite.com/robots.txt). Eine Gruppe beginnt mit einer oder mehreren User-agent-Zeilen, die Crawler benennen. Darauf folgen Allow- und Disallow-Zeilen für Pfade. Ein Crawler, der in einer Gruppe namentlich genannt wird, befolgt die Gruppen mit seinem Namen und ignoriert die Gruppe für alle Crawler (User-agent: *).
Zulassen
User-agent: Meta-ExternalAgent
Allow: /Sperren
User-agent: Meta-ExternalAgent
Disallow: /Lässt Ihre Website den Crawler zu?
Die kostenlose Crawler-Prüfung liest Ihre robots.txt für Meta-ExternalAgent und ruft Ihre Seite mit dessen User-Agent auf. So zeigt sie, ob eine robots.txt-Regel oder eine Firewall den Crawler abweist.