Snelle antwoorden

AIGrow biedt monitoring van AI-zichtbaarheid, een bedrijfsassistent, blogpublicatie en afgebakende automatiseringsdiensten. Begin met de gratis scan om het resultaat te bekijken voordat je betaalt.

Voer de gratis scan uit

De scan is gratis en monitoringplannen beginnen bij € 29 per maand. De operationele audit kost € 290, de zichtbaarheidsaudit kost € 490 en voor maatwerk ontvang je vóór de start een schriftelijke prijsopgave.

Bekijk de plannen

Voer de gratis scan uit. Die leest je site, vraagt verschillende AI-assistenten wat je klanten vragen en wijst je op één ding. Aanmelden is niet nodig en de scan vertelt je als je ons niet nodig hebt.

Begin nu

Ja. Gebruik het contactformulier voor vragen over het product, facturatie, ondersteuning of een project. Beschrijf het doel en het betrokken systeem, zodat de eerste reactie specifiek kan zijn.

Neem contact op met AIGrow
AI-crawlers

CCBot: een trainingscrawler van Common Crawl

CCBot is een trainingscrawler. Hij verzamelt pagina's voor de open dataset waarop de meeste modellen worden getraind. Common Crawl beheert deze crawler.

In één oogopslag

Beheerder
Common Crawl
robots.txt-token
CCBot
Doel
Training. Trainingscrawlers verzamelen pagina's voor toekomstige modellen. Als je ze weert, kunnen crawlers die pagina's ophalen voor antwoorden je site nog steeds lezen. Die hebben eigen namen.
Waarvoor de gegevens worden gebruikt
de open dataset waarop de meeste modellen worden getraind

Wat blokkeren verandert

Als je CCBot weert, worden je pagina's niet verzameld voor de open dataset waarop de meeste modellen worden getraind. Crawlers die pagina's ophalen voor antwoorden hebben eigen namen en kunnen je site dus nog steeds lezen.

User-agent

De volledige user-agent volgens de documentatie van de beheerder. Een verzoek van CCBot bevat deze tekst, die ook in serverlogs te zien is.

CCBot/2.0 (https://commoncrawl.org/faq/)

robots.txt-regels voor CCBot

robots.txt is een tekstbestand in de hoofdmap van een site (yoursite.com/robots.txt). Een groep begint met één of meer User-agent-regels die crawlers benoemen, gevolgd door Allow- en Disallow-regels voor paden. Een crawler die in een groep wordt genoemd, volgt de groepen met zijn naam en negeert de groep voor alle crawlers (User-agent: *).

Toelaten

User-agent: CCBot
Allow: /

Blokkeren

User-agent: CCBot
Disallow: /

Laat jouw site deze crawler toe?

De gratis crawlercheck leest je robots.txt voor CCBot en vraagt je pagina op met de bijbehorende user-agent. Zo zie je of een robots.txt-regel of een firewall deze crawler weert.

Controleer of jouw site CCBot toelaat

Vragen over CCBot

CCBot is een trainingscrawler. Hij verzamelt pagina's voor de open dataset waarop de meeste modellen worden getraind. Common Crawl beheert deze crawler.

Dat bepaal je zelf. Als je deze crawler blokkeert, worden je pagina's niet verzameld voor de open dataset waarop de meeste modellen worden getraind. Crawlers die pagina's ophalen voor antwoorden blijven toegang houden.

Voeg een groep toe met de naam van de crawler en een regel voor alle paden: “User-agent: CCBot”, gevolgd door “Disallow: /”. Wil je de crawler toelaten, gebruik dan “Allow: /”.