Schnelle Antworten

AIGrow bietet Monitoring der KI-Sichtbarkeit, einen Business-Assistenten, Blog-Veröffentlichungen und klar abgegrenzte Automatisierungsleistungen. Starten Sie mit dem kostenlosen Scan, um das Ergebnis vor einer Zahlung zu prüfen.

Kostenlosen Scan starten

Der Scan ist kostenlos, und die Monitoring-Tarife beginnen bei 29 € pro Monat. Das Betriebsaudit kostet 290 €, das Sichtbarkeitsaudit kostet 490 €. Für individuelle Umsetzungen erhalten Sie vor Beginn der Arbeit einen schriftlich mitgeteilten Preis.

Tarife ansehen

Starten Sie den kostenlosen Scan. Er liest Ihre Website aus, fragt mehrere KI-Assistenten, wonach Ihre Kunden fragen, und weist Sie auf eine Sache hin. Eine Registrierung ist nicht erforderlich, und Sie erfahren, wenn Sie uns nicht brauchen.

Jetzt starten

Ja. Nutzen Sie das Kontaktformular für Fragen zu Produkten, Abrechnung, Support oder Projekten. Beschreiben Sie das Ziel und das beteiligte System, damit die erste Antwort konkret sein kann.

AIGrow kontaktieren
KI-Crawler

KI-Crawler: Was die einzelnen Bots tun und was sich durch das Blockieren ändert

Die Crawler, die Websites für KI-Assistenten lesen: wer sie betreibt, wofür sie Daten liefern und mit welchen robots.txt-Zeilen Sie sie zulassen oder sperren.

KI-Crawler sind Bots, die Websites für KI-Assistenten lesen. Such-Crawler wie OAI-SearchBot bauen den Index auf, aus dem ein Assistent Quellen zitiert. Nutzer-Crawler wie ChatGPT-User öffnen eine Seite auf Anfrage. Trainings-Crawler wie GPTBot sammeln Seiten für künftige Modelle. Diese Liste umfasst 22 Crawler mit den jeweiligen robots.txt-Regeln.

Drei Arten von KI-Crawlern

Suche
Such-Crawler lesen Seiten, um den Index aufzubauen, den ein Assistent für seine Antworten durchsucht. Kann er eine Seite nicht lesen, kann sie in diesen Antworten weder gefunden noch zitiert werden.
Nutzeranfrage
Nutzer-Crawler öffnen eine einzelne Seite, wenn jemand einen Assistenten bittet, sie zu lesen. Können sie die Seite nicht lesen, lässt sie sich in diesem Gespräch nicht öffnen.
Training
Trainings-Crawler sammeln Seiten für künftige Modelle. Wenn Sie sie aussperren, halten Sie damit nicht die Crawler auf, die Seiten für Antworten abrufen. Diese haben eigene Namen.

Alle Crawler nach Verwendungszweck

Die Namen sind die jeweiligen robots.txt-Token. Öffnen Sie einen Eintrag, um den User-Agent und die Regeln zu sehen.

Such-Crawler

CrawlerBetreiberWofür er Daten liefert
OAI-SearchBotOpenAIChatGPT-Suche
Claude-SearchBotAnthropicClaude-Suche
PerplexityBotPerplexityPerplexity
GooglebotGoogleGoogle Search und AI Overviews
BingbotMicrosoftBing und Copilot
ApplebotAppleSiri und Spotlight
DuckAssistBotDuckDuckGoAntworten von DuckDuckGo
AmazonbotAmazonAlexa und Rufus
YouBotYou.comAntworten von You.com

Nutzer-Crawler

CrawlerBetreiberWofür er Daten liefert
ChatGPT-UserOpenAIChatGPT
Claude-UserAnthropicClaude
Perplexity-UserPerplexityPerplexity
MistralAI-UserMistralLe Chat
Meta-ExternalFetcherMetaMeta AI

Trainings-Crawler

CrawlerBetreiberWofür er Daten liefert
GPTBotOpenAIkünftige OpenAI-Modelle
ClaudeBotAnthropickünftige Claude-Modelle
Google-ExtendedGoogleTraining und Fundierung von Gemini
Applebot-ExtendedAppleTraining von Apple Intelligence
Meta-ExternalAgentMetaMeta AI
CCBotCommon Crawlder offene Datensatz, mit dem die meisten Modelle trainiert werden
BytespiderByteDanceDoubao
cohere-aiCohereCohere-Modelle

Eine robots.txt-Vorlage

robots.txt ist eine reine Textdatei im Stammverzeichnis einer Website (yoursite.com/robots.txt). Eine Gruppe beginnt mit einer oder mehreren User-agent-Zeilen, die Crawler benennen. Darauf folgen Allow- und Disallow-Zeilen für Pfade. Ein Crawler, der in einer Gruppe namentlich genannt wird, befolgt die Gruppen mit seinem Namen und ignoriert die Gruppe für alle Crawler (User-agent: *).

Diese Zeilen lassen alle Crawler zu, die Seiten für Antworten abrufen. Die Trainings-Crawler stehen hinter #-Zeichen. Ob Sie sie zulassen, entscheiden Sie.

Fügen Sie diese Zeilen in die robots.txt-Datei im Stammverzeichnis der Website ein und entfernen Sie alle Gruppen, die diese Crawler ausschließen. Ein Crawler mit einer eigenen Gruppe beachtet nur diese Gruppe. Kopieren Sie deshalb alle Disallow-Zeilen hinein, die weiterhin gelten sollen.

# Crawler, die Seiten für Antworten abrufen
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: PerplexityBot
User-agent: Perplexity-User
User-agent: Googlebot
User-agent: Bingbot
User-agent: Applebot
User-agent: DuckAssistBot
User-agent: MistralAI-User
User-agent: Meta-ExternalFetcher
User-agent: Amazonbot
User-agent: YouBot
Allow: /

# Trainings-Crawler: Sie entscheiden. Entfernen Sie die #-Zeichen, um sie zuzulassen.
# User-agent: GPTBot
# User-agent: ClaudeBot
# User-agent: Google-Extended
# User-agent: Applebot-Extended
# User-agent: Meta-ExternalAgent
# User-agent: CCBot
# User-agent: Bytespider
# User-agent: cohere-ai
# Allow: /

Vollständige robots.txt für KI-Crawler erstellen

Welche davon lässt Ihre Website zu?

Mit robots.txt können Sie einen Crawler abweisen. Das geht auch über eine CDN- oder Firewall-Einstellung, während die Website im Browser weiterhin normal aussieht. Die kostenlose Crawler-Prüfung liest Ihre robots.txt und ruft Ihre Seite innerhalb weniger Sekunden als jeder einzelne Crawler auf.

Kostenlose Crawler-Prüfung starten

Fragen zu KI-Crawlern

Beide werden von OpenAI betrieben. OAI-SearchBot ist ein Such-Crawler: Er liest Seiten für die ChatGPT-Suche. GPTBot ist ein Trainings-Crawler: Er sammelt Seiten für künftige OpenAI-Modelle. Mit robots.txt können Sie einen blockieren und den anderen zulassen.

Fügen Sie eine Gruppe hinzu, in der Sie einen oder mehrere Crawler benennen, gefolgt von „Disallow: /“. Ein Crawler, der in einer Gruppe namentlich genannt wird, befolgt die Gruppen mit seinem Namen. Die Regeln für alle Crawler (User-agent: *) gelten dann nicht mehr für ihn.

Trainings-Crawler und Crawler, die Seiten für Antworten abrufen, haben unterschiedliche Namen. Eine Website kann Trainings-Crawler aussperren und die Crawler für Antworten trotzdem zulassen.

Die kostenlose Crawler-Prüfung liest Ihre robots.txt für alle 22 Crawler auf dieser Liste und ruft eine Seite als jeder Crawler mit einem User-Agent auf. Anschließend zeigt sie, welche zugelassen und welche abgewiesen werden.

Können KI-Assistenten Ihre Website lesen?

Die kostenlose Crawler-Prüfung liefert in wenigen Sekunden eine Antwort, ohne Konto und ohne E-Mail-Adresse.