Meta-ExternalAgent: en träningscrawlare som drivs av Meta
Meta-ExternalAgent är en träningscrawlare. Den samlar in sidor till Meta AI och drivs av Meta.
Översikt
- Ansvarig för webbplatsen
- Meta
- robots.txt-token
Meta-ExternalAgent- Syfte
- Träning. Träningscrawlare samlar in sidor till framtida modeller. Att stänga ute dem stoppar inte de crawlare som hämtar sidor för att ge svar. De har egna namn.
- Vad den bidrar till
- Meta AI
Vad som händer om du blockerar den
Om du stänger ute Meta-ExternalAgent kommer dina sidor inte med i det som samlas in till Meta AI. Crawlarna som hämtar sidor för att ge svar har egna namn och kan därför fortfarande läsa din webbplats.
Användaragent
Den fullständiga användaragenten enligt operatörens dokumentation. En förfrågan från Meta-ExternalAgent innehåller den här texten, som också syns i serverloggen.
meta-externalagent/1.1 (+https://developers.facebook.com/docs/sharing/webmasters/crawler)Rader i robots.txt för Meta-ExternalAgent
robots.txt är en vanlig textfil i en webbplats rotkatalog (yoursite.com/robots.txt). En grupp börjar med en eller flera User-agent-rader som namnger crawlare, följt av Allow- och Disallow-rader för sökvägar. En crawlare som namnges i en grupp följer grupperna där den namnges och ignorerar gruppen för alla crawlare (User-agent: *).
För att släppa in den
User-agent: Meta-ExternalAgent
Allow: /För att stänga den ute
User-agent: Meta-ExternalAgent
Disallow: /Släpper din webbplats in den?
Den kostnadsfria kontrollen läser din robots.txt för Meta-ExternalAgent och begär din sida med dess användaragent. Då ser du om en regel i robots.txt eller en brandvägg stänger den ute.