Meta-ExternalAgent: En træningscrawler, som drives af Meta
Meta-ExternalAgent er en træningscrawler. Den indsamler sider til Meta AI. Operatøren er Meta.
Overblik
- Ansvarlig virksomhed
- Meta
- robots.txt-token
Meta-ExternalAgent- Formål
- Træning. Træningscrawlere indsamler sider til fremtidige modeller. Hvis du blokerer dem, stopper det ikke de crawlere, der henter sider til svar. De har deres egne navne.
- Hvad den leverer data til
- Meta AI
Hvad det ændrer at blokere den
Hvis du blokerer Meta-ExternalAgent, kommer dine sider ikke med i det, den indsamler til Meta AI. De crawlere, der henter sider til svar, har deres egne navne og kan derfor stadig læse dit website.
User agent
Den fulde user agent fra operatørens dokumentation. En forespørgsel fra Meta-ExternalAgent indeholder denne tekst, som kan ses i serverloggen.
meta-externalagent/1.1 (+https://developers.facebook.com/docs/sharing/webmasters/crawler)Linjer i robots.txt for Meta-ExternalAgent
robots.txt er en almindelig tekstfil i roden af et website (yoursite.com/robots.txt). En gruppe begynder med en eller flere User-agent-linjer, der navngiver crawlere, efterfulgt af Allow- og Disallow-linjer for stier. En crawler, der er nævnt i en gruppe, følger de grupper, hvor dens navn står, og ignorerer gruppen for alle crawlere (User-agent: *).
Tillad adgang
User-agent: Meta-ExternalAgent
Allow: /Blokér adgang
User-agent: Meta-ExternalAgent
Disallow: /Giver dit website adgang?
Det gratis crawlertjek læser din robots.txt for Meta-ExternalAgent og henter din side med crawlerens user agent. Så kan du se, om en regel i robots.txt eller en firewall afviser den.