Szybkie odpowiedzi

AIGrow oferuje monitorowanie widoczności w AI, asystenta biznesowego, publikowanie wpisów na blogu oraz usługi automatyzacji w ustalonym zakresie. Zacznij od bezpłatnego skanu, aby sprawdzić wynik przed dokonaniem płatności.

Uruchom bezpłatny skan

Skan jest bezpłatny, a plany monitorowania zaczynają się od 29 € miesięcznie. Audyt operacyjny kosztuje 290 €, audyt widoczności 490 €, a w przypadku niestandardowych wdrożeń otrzymasz pisemną wycenę przed rozpoczęciem prac.

Zobacz plany

Uruchom bezpłatny skan. Przeanalizuje twoją stronę, zapyta kilku asystentów AI, o co pytają twoi klienci, i wskaże ci jedną rzecz. Rejestracja nie jest wymagana. Skan poinformuje cię też, jeśli nie potrzebujesz naszej pomocy.

Zacznij teraz

Tak. Skorzystaj z formularza kontaktowego w sprawach dotyczących produktu, płatności, wsparcia lub projektu. Opisz cel i system, którego dotyczy sprawa, aby pierwsza odpowiedź mogła być konkretna.

Skontaktuj się z AIGrow
Roboty AI

CCBot: robot treningowy, za którego odpowiada Common Crawl

CCBot to robot treningowy. Zbiera strony na potrzeby otwarty zbiór danych, na którym trenuje się większość modeli. Za robota odpowiada Common Crawl.

W skrócie

Podmiot prowadzący stronę
Common Crawl
nazwa robota w robots.txt
CCBot
Zastosowanie
Trenowanie. Roboty treningowe zbierają strony na potrzeby przyszłych modeli. Ich zablokowanie nie zatrzymuje robotów pobierających strony na potrzeby odpowiedzi, ponieważ działają one pod innymi nazwami.
Do czego służy
otwarty zbiór danych, na którym trenuje się większość modeli

Co zmienia zablokowanie

Jeśli CCBot nie ma dostępu do twoich stron, otwarty zbiór danych, na którym trenuje się większość modeli nie uwzględni ich w zbieranych danych. Roboty pobierające strony na potrzeby odpowiedzi działają pod innymi nazwami, więc nadal mogą czytać twoją witrynę.

Identyfikator User-Agent

Pełny identyfikator User-Agent z dokumentacji operatora. Żądania wysyłane przez CCBot zawierają ten tekst, który widać w logach serwera.

CCBot/2.0 (https://commoncrawl.org/faq/)

Reguły robots.txt: CCBot

robots.txt to zwykły plik tekstowy w katalogu głównym witryny (yoursite.com/robots.txt). Grupa zaczyna się od jednego lub kilku wierszy User-agent z nazwami robotów, po których następują reguły Allow i Disallow dla ścieżek. Robot wymieniony w grupie stosuje reguły grup, w których podano jego nazwę, i ignoruje grupę ogólną dla wszystkich robotów (User-agent: *).

Aby zezwolić na dostęp

User-agent: CCBot
Allow: /

Aby zablokować dostęp

User-agent: CCBot
Disallow: /

Czy ma dostęp do twojej strony?

Bezpłatny test sprawdza reguły robots.txt, a następnie wysyła żądanie z identyfikatorem User-Agent, którego używa CCBot. Dzięki temu pokazuje, czy dostęp blokuje reguła robots.txt lub zapora sieciowa.

Sprawdź, czy CCBot ma dostęp do twojej strony

Pytania o CCBot

CCBot to robot treningowy. Zbiera strony na potrzeby otwarty zbiór danych, na którym trenuje się większość modeli. Za robota odpowiada Common Crawl.

To twój wybór. Jeśli go zablokujesz, twoje strony nie trafią do danych zbieranych na potrzeby tego produktu (otwarty zbiór danych, na którym trenuje się większość modeli). Nie zablokuje to jednak robotów, które pobierają strony, by przygotować odpowiedzi.

Dodaj grupę z nazwą robota i regułą obejmującą wszystkie ścieżki: „User-agent: CCBot”, a pod nią „Disallow: /”. Aby zezwolić na dostęp, wpisz zamiast tego „Allow: /”.