Meta-ExternalAgent: robot treningowy, za którego odpowiada Meta
Meta-ExternalAgent to robot treningowy. Zbiera strony na potrzeby Meta AI. Za robota odpowiada Meta.
W skrócie
- Podmiot prowadzący stronę
- Meta
- nazwa robota w robots.txt
Meta-ExternalAgent- Zastosowanie
- Trenowanie. Roboty treningowe zbierają strony na potrzeby przyszłych modeli. Ich zablokowanie nie zatrzymuje robotów pobierających strony na potrzeby odpowiedzi, ponieważ działają one pod innymi nazwami.
- Do czego służy
- Meta AI
Co zmienia zablokowanie
Jeśli Meta-ExternalAgent nie ma dostępu do twoich stron, Meta AI nie uwzględni ich w zbieranych danych. Roboty pobierające strony na potrzeby odpowiedzi działają pod innymi nazwami, więc nadal mogą czytać twoją witrynę.
Identyfikator User-Agent
Pełny identyfikator User-Agent z dokumentacji operatora. Żądania wysyłane przez Meta-ExternalAgent zawierają ten tekst, który widać w logach serwera.
meta-externalagent/1.1 (+https://developers.facebook.com/docs/sharing/webmasters/crawler)Reguły robots.txt: Meta-ExternalAgent
robots.txt to zwykły plik tekstowy w katalogu głównym witryny (yoursite.com/robots.txt). Grupa zaczyna się od jednego lub kilku wierszy User-agent z nazwami robotów, po których następują reguły Allow i Disallow dla ścieżek. Robot wymieniony w grupie stosuje reguły grup, w których podano jego nazwę, i ignoruje grupę ogólną dla wszystkich robotów (User-agent: *).
Aby zezwolić na dostęp
User-agent: Meta-ExternalAgent
Allow: /Aby zablokować dostęp
User-agent: Meta-ExternalAgent
Disallow: /Czy ma dostęp do twojej strony?
Bezpłatny test sprawdza reguły robots.txt, a następnie wysyła żądanie z identyfikatorem User-Agent, którego używa Meta-ExternalAgent. Dzięki temu pokazuje, czy dostęp blokuje reguła robots.txt lub zapora sieciowa.