Snelle antwoorden

AIGrow biedt monitoring van AI-zichtbaarheid, een bedrijfsassistent, blogpublicatie en afgebakende automatiseringsdiensten. Begin met de gratis scan om het resultaat te bekijken voordat je betaalt.

Voer de gratis scan uit

De scan is gratis en monitoringplannen beginnen bij € 29 per maand. De operationele audit kost € 290, de zichtbaarheidsaudit kost € 490 en voor maatwerk ontvang je vóór de start een schriftelijke prijsopgave.

Bekijk de plannen

Voer de gratis scan uit. Die leest je site, vraagt verschillende AI-assistenten wat je klanten vragen en wijst je op één ding. Aanmelden is niet nodig en de scan vertelt je als je ons niet nodig hebt.

Begin nu

Ja. Gebruik het contactformulier voor vragen over het product, facturatie, ondersteuning of een project. Beschrijf het doel en het betrokken systeem, zodat de eerste reactie specifiek kan zijn.

Neem contact op met AIGrow
AI-crawlers

AI-crawlers: wat elke bot doet en wat blokkeren verandert

De crawlers die websites lezen voor AI-assistenten: wie ze beheert, waarvoor ze gegevens verzamelen en met welke robots.txt-regels je ze toelaat of blokkeert.

AI-crawlers zijn bots die websites lezen voor AI-assistenten. Zoekcrawlers zoals OAI-SearchBot bouwen de index op waaruit een assistent citeert. Crawlers voor gebruikersverzoeken zoals ChatGPT-User openen een pagina wanneer iemand daarom vraagt. Trainingscrawlers zoals GPTBot verzamelen pagina's voor toekomstige modellen. Deze lijst bevat 22 crawlers, elk met eigen robots.txt-regels.

Drie soorten AI-crawlers

Zoeken
Zoekcrawlers lezen pagina's om de index op te bouwen waarin een assistent zoekt wanneer die antwoord geeft. Een pagina die ze niet kunnen lezen, kan niet in die antwoorden worden gevonden of geciteerd.
Verzoek van gebruiker
Crawlers voor gebruikersverzoeken openen een pagina wanneer iemand een assistent vraagt die te lezen. Als ze de pagina niet kunnen lezen, kan de assistent die in dat gesprek niet openen.
Training
Trainingscrawlers verzamelen pagina's voor toekomstige modellen. Als je ze weert, kunnen crawlers die pagina's ophalen voor antwoorden je site nog steeds lezen. Die hebben eigen namen.

Alle crawlers, ingedeeld naar waarvoor ze gegevens verzamelen

Elke naam is het bijbehorende robots.txt-token. Open een crawler om de user-agent en regels te bekijken.

Zoekcrawlers

CrawlerBeheerderWaarvoor de gegevens worden gebruikt
OAI-SearchBotOpenAIChatGPT-zoekfunctie
Claude-SearchBotAnthropicClaude-zoekfunctie
PerplexityBotPerplexityPerplexity
GooglebotGoogleGoogle Search en AI Overviews
BingbotMicrosoftBing en Copilot
ApplebotAppleSiri en Spotlight
DuckAssistBotDuckDuckGoantwoorden van DuckDuckGo
AmazonbotAmazonAlexa en Rufus
YouBotYou.comantwoorden van You.com

Crawlers voor gebruikersverzoeken

CrawlerBeheerderWaarvoor de gegevens worden gebruikt
ChatGPT-UserOpenAIChatGPT
Claude-UserAnthropicClaude
Perplexity-UserPerplexityPerplexity
MistralAI-UserMistralLe Chat
Meta-ExternalFetcherMetaMeta AI

Trainingscrawlers

CrawlerBeheerderWaarvoor de gegevens worden gebruikt
GPTBotOpenAItoekomstige OpenAI-modellen
ClaudeBotAnthropictoekomstige Claude-modellen
Google-ExtendedGoogleGemini-training en onderbouwing van antwoorden
Applebot-ExtendedAppletraining van Apple Intelligence
Meta-ExternalAgentMetaMeta AI
CCBotCommon Crawlde open dataset waarop de meeste modellen worden getraind
BytespiderByteDanceDoubao
cohere-aiCohereCohere-modellen

Een robots.txt-sjabloon

robots.txt is een tekstbestand in de hoofdmap van een site (yoursite.com/robots.txt). Een groep begint met één of meer User-agent-regels die crawlers benoemen, gevolgd door Allow- en Disallow-regels voor paden. Een crawler die in een groep wordt genoemd, volgt de groepen met zijn naam en negeert de groep voor alle crawlers (User-agent: *).

Deze regels laten alle crawlers toe die pagina's ophalen voor antwoorden. De trainingscrawlers staan achter #-tekens: je kiest zelf of je ze toelaat.

Voeg deze regels toe aan het robots.txt-bestand in de hoofdmap van de site en verwijder elke groep die deze crawlers blokkeert. Een crawler die in een eigen groep staat, volgt alleen die groep. Kopieer daarom alle Disallow-regels die moeten blijven gelden naar die groep.

# Crawlers die pagina's ophalen voor antwoorden
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: PerplexityBot
User-agent: Perplexity-User
User-agent: Googlebot
User-agent: Bingbot
User-agent: Applebot
User-agent: DuckAssistBot
User-agent: MistralAI-User
User-agent: Meta-ExternalFetcher
User-agent: Amazonbot
User-agent: YouBot
Allow: /

# Trainingscrawlers: aan jou de keuze. Verwijder de # tekens om ze toegang te geven.
# User-agent: GPTBot
# User-agent: ClaudeBot
# User-agent: Google-Extended
# User-agent: Applebot-Extended
# User-agent: Meta-ExternalAgent
# User-agent: CCBot
# User-agent: Bytespider
# User-agent: cohere-ai
# Allow: /

Stel een volledig AI robots.txt-bestand samen

Welke van deze crawlers laat jouw site toe?

Met robots.txt kun je een crawler weren. Dat kan ook met een instelling van je CDN of firewall, terwijl je site er in een browser gewoon goed uitziet. De gratis crawlercheck leest je robots.txt en vraagt je pagina als elke crawler op. Dat duurt een paar seconden.

Doe de gratis crawlercheck

Vragen over AI-crawlers

Beide worden beheerd door OpenAI. OAI-SearchBot is een zoekcrawler die pagina's leest voor de ChatGPT-zoekfunctie. GPTBot is een trainingscrawler die pagina's verzamelt voor toekomstige OpenAI-modellen. Met robots.txt kun je de ene blokkeren en de andere toelaten.

Voeg een groep toe waarin je één of meer crawlers noemt, gevolgd door “Disallow: /”. Een crawler die in een groep wordt genoemd, volgt de groepen waarin zijn naam staat. De regels voor alle crawlers (User-agent: *) gelden dan niet meer voor hem.

Trainingscrawlers hebben andere namen dan crawlers die pagina's ophalen voor antwoorden. Je kunt trainingscrawlers weren en de crawlers voor antwoorden toch toelaten.

De gratis crawlercheck leest je robots.txt voor alle 22 crawlers in deze lijst en vraagt voor elke crawler met een user-agent een pagina op. Daarna zie je welke crawlers worden toegelaten en welke worden geweerd.

Kunnen AI-assistenten jouw site lezen?

De gratis crawlercheck geeft binnen een paar seconden antwoord, zonder account of e-mailadres.