Meta-ExternalAgent: crawler per l’addestramento gestito da Meta
Meta-ExternalAgent è un crawler per l’addestramento. Raccoglie pagine per questo prodotto: Meta AI. È gestito da Meta.
In breve
- Gestore
- Meta
- Identificativo robots.txt
Meta-ExternalAgent- Scopo
- Addestramento. I crawler per l’addestramento raccolgono pagine per i modelli futuri. Bloccarli non ferma i crawler che recuperano pagine per fornire risposte, perché hanno nomi distinti.
- Cosa alimenta
- Meta AI
Effetti del blocco
Se blocchi Meta-ExternalAgent, le tue pagine resteranno fuori dai contenuti che raccoglie per questo prodotto: Meta AI. I crawler che recuperano pagine per fornire risposte hanno nomi distinti e potranno comunque leggere il tuo sito.
User agent
Questo è lo user agent completo riportato nella documentazione del gestore. Le richieste di Meta-ExternalAgent lo includono e puoi vederlo nei log del server.
meta-externalagent/1.1 (+https://developers.facebook.com/docs/sharing/webmasters/crawler)Regole robots.txt per Meta-ExternalAgent
robots.txt è un file di testo semplice nella directory principale di un sito (yoursite.com/robots.txt). Un gruppo inizia con una o più righe User-agent che indicano i crawler, seguite da righe Allow e Disallow per i percorsi. Un crawler indicato in un gruppo segue i gruppi che lo nominano e ignora quello valido per tutti i crawler (User-agent: *).
Per consentire l’accesso
User-agent: Meta-ExternalAgent
Allow: /Per bloccare l’accesso
User-agent: Meta-ExternalAgent
Disallow: /Il tuo sito gli consente l’accesso?
Il controllo dei crawler legge il tuo robots.txt per Meta-ExternalAgent e richiede una pagina usando il suo user agent. Ti mostra così se a bloccarlo è una regola robots.txt o un firewall.