Meta-ExternalAgent: een trainingscrawler van Meta
Meta-ExternalAgent is een trainingscrawler. Hij verzamelt pagina's voor Meta AI. Meta beheert deze crawler.
In één oogopslag
- Beheerder
- Meta
- robots.txt-token
Meta-ExternalAgent- Doel
- Training. Trainingscrawlers verzamelen pagina's voor toekomstige modellen. Als je ze weert, kunnen crawlers die pagina's ophalen voor antwoorden je site nog steeds lezen. Die hebben eigen namen.
- Waarvoor de gegevens worden gebruikt
- Meta AI
Wat blokkeren verandert
Als je Meta-ExternalAgent weert, worden je pagina's niet verzameld voor Meta AI. Crawlers die pagina's ophalen voor antwoorden hebben eigen namen en kunnen je site dus nog steeds lezen.
User-agent
De volledige user-agent volgens de documentatie van de beheerder. Een verzoek van Meta-ExternalAgent bevat deze tekst, die ook in serverlogs te zien is.
meta-externalagent/1.1 (+https://developers.facebook.com/docs/sharing/webmasters/crawler)robots.txt-regels voor Meta-ExternalAgent
robots.txt is een tekstbestand in de hoofdmap van een site (yoursite.com/robots.txt). Een groep begint met één of meer User-agent-regels die crawlers benoemen, gevolgd door Allow- en Disallow-regels voor paden. Een crawler die in een groep wordt genoemd, volgt de groepen met zijn naam en negeert de groep voor alle crawlers (User-agent: *).
Toelaten
User-agent: Meta-ExternalAgent
Allow: /Blokkeren
User-agent: Meta-ExternalAgent
Disallow: /Laat jouw site deze crawler toe?
De gratis crawlercheck leest je robots.txt voor Meta-ExternalAgent en vraagt je pagina op met de bijbehorende user-agent. Zo zie je of een robots.txt-regel of een firewall deze crawler weert.