ClaudeBot: crawler per l’addestramento gestito da Anthropic
ClaudeBot è un crawler per l’addestramento. Raccoglie pagine per questo prodotto: futuri modelli Claude. È gestito da Anthropic.
In breve
- Gestore
- Anthropic
- Identificativo robots.txt
ClaudeBot- Scopo
- Addestramento. I crawler per l’addestramento raccolgono pagine per i modelli futuri. Bloccarli non ferma i crawler che recuperano pagine per fornire risposte, perché hanno nomi distinti.
- Cosa alimenta
- futuri modelli Claude
Effetti del blocco
Se blocchi ClaudeBot, le tue pagine resteranno fuori dai contenuti che raccoglie per questo prodotto: futuri modelli Claude. I crawler che recuperano pagine per fornire risposte hanno nomi distinti e potranno comunque leggere il tuo sito.
User agent
Questo è lo user agent completo riportato nella documentazione del gestore. Le richieste di ClaudeBot lo includono e puoi vederlo nei log del server.
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; [email protected])Regole robots.txt per ClaudeBot
robots.txt è un file di testo semplice nella directory principale di un sito (yoursite.com/robots.txt). Un gruppo inizia con una o più righe User-agent che indicano i crawler, seguite da righe Allow e Disallow per i percorsi. Un crawler indicato in un gruppo segue i gruppi che lo nominano e ignora quello valido per tutti i crawler (User-agent: *).
Per consentire l’accesso
User-agent: ClaudeBot
Allow: /Per bloccare l’accesso
User-agent: ClaudeBot
Disallow: /Il tuo sito gli consente l’accesso?
Il controllo dei crawler legge il tuo robots.txt per ClaudeBot e richiede una pagina usando il suo user agent. Ti mostra così se a bloccarlo è una regola robots.txt o un firewall.