cohere-ai: een trainingscrawler van Cohere
cohere-ai is een trainingscrawler. Hij verzamelt pagina's voor Cohere-modellen. Cohere beheert deze crawler.
In één oogopslag
- Beheerder
- Cohere
- robots.txt-token
cohere-ai- Doel
- Training. Trainingscrawlers verzamelen pagina's voor toekomstige modellen. Als je ze weert, kunnen crawlers die pagina's ophalen voor antwoorden je site nog steeds lezen. Die hebben eigen namen.
- Waarvoor de gegevens worden gebruikt
- Cohere-modellen
Wat blokkeren verandert
Als je cohere-ai weert, worden je pagina's niet verzameld voor Cohere-modellen. Crawlers die pagina's ophalen voor antwoorden hebben eigen namen en kunnen je site dus nog steeds lezen.
robots.txt-regels voor cohere-ai
robots.txt is een tekstbestand in de hoofdmap van een site (yoursite.com/robots.txt). Een groep begint met één of meer User-agent-regels die crawlers benoemen, gevolgd door Allow- en Disallow-regels voor paden. Een crawler die in een groep wordt genoemd, volgt de groepen met zijn naam en negeert de groep voor alle crawlers (User-agent: *).
Toelaten
User-agent: cohere-ai
Allow: /Blokkeren
User-agent: cohere-ai
Disallow: /Laat jouw site deze crawler toe?
cohere-ai is alleen een naam voor robots.txt-regels. De crawlercheck leest daarvoor je robots.txt en verstuurt geen verzoek namens deze crawler.