Risposte rapide

AIGrow offre il monitoraggio della visibilità AI, un assistente aziendale, la pubblicazione di articoli sul blog e servizi di automazione mirati. Inizia dalla scansione gratuita per esaminare il risultato prima di pagare.

Esegui la scansione gratuita

La scansione è gratuita e i piani di monitoraggio partono da 29 € al mese. L’audit operativo costa 290 €, l’audit della visibilità costa 490 € e per le realizzazioni personalizzate riceverai un prezzo scritto prima dell’inizio dei lavori.

Vedi i piani

Esegui la scansione gratuita. Analizza il tuo sito, chiede a diversi assistenti AI quali domande fanno i tuoi clienti e ti indica una cosa su cui intervenire. Non è richiesta alcuna registrazione e ti dirà se non hai bisogno di noi.

Inizia ora

Sì. Usa il modulo di contatto per domande sul prodotto, sulla fatturazione, sull’assistenza o sul progetto. Descrivi l’obiettivo e il sistema coinvolto, così la prima risposta potrà essere precisa.

Contatta AIGrow
Crawler AI

CCBot: crawler per l’addestramento gestito da Common Crawl

CCBot è un crawler per l’addestramento. Raccoglie pagine per questo prodotto: il dataset aperto su cui viene addestrata la maggior parte dei modelli. È gestito da Common Crawl.

In breve

Gestore
Common Crawl
Identificativo robots.txt
CCBot
Scopo
Addestramento. I crawler per l’addestramento raccolgono pagine per i modelli futuri. Bloccarli non ferma i crawler che recuperano pagine per fornire risposte, perché hanno nomi distinti.
Cosa alimenta
il dataset aperto su cui viene addestrata la maggior parte dei modelli

Effetti del blocco

Se blocchi CCBot, le tue pagine resteranno fuori dai contenuti che raccoglie per questo prodotto: il dataset aperto su cui viene addestrata la maggior parte dei modelli. I crawler che recuperano pagine per fornire risposte hanno nomi distinti e potranno comunque leggere il tuo sito.

User agent

Questo è lo user agent completo riportato nella documentazione del gestore. Le richieste di CCBot lo includono e puoi vederlo nei log del server.

CCBot/2.0 (https://commoncrawl.org/faq/)

Regole robots.txt per CCBot

robots.txt è un file di testo semplice nella directory principale di un sito (yoursite.com/robots.txt). Un gruppo inizia con una o più righe User-agent che indicano i crawler, seguite da righe Allow e Disallow per i percorsi. Un crawler indicato in un gruppo segue i gruppi che lo nominano e ignora quello valido per tutti i crawler (User-agent: *).

Per consentire l’accesso

User-agent: CCBot
Allow: /

Per bloccare l’accesso

User-agent: CCBot
Disallow: /

Il tuo sito gli consente l’accesso?

Il controllo dei crawler legge il tuo robots.txt per CCBot e richiede una pagina usando il suo user agent. Ti mostra così se a bloccarlo è una regola robots.txt o un firewall.

Controlla se il tuo sito consente l’accesso a CCBot

Domande su CCBot

CCBot è un crawler per l’addestramento. Raccoglie pagine per questo prodotto: il dataset aperto su cui viene addestrata la maggior parte dei modelli. È gestito da Common Crawl.

Sta a te decidere. Se lo blocchi, le tue pagine resteranno fuori dai contenuti che raccoglie per questo prodotto: il dataset aperto su cui viene addestrata la maggior parte dei modelli. Il blocco non riguarda i crawler che recuperano pagine per fornire risposte.

Aggiungi un gruppo con il suo nome e una regola valida per tutti i percorsi: “User-agent: CCBot”, seguita da “Disallow: /”. Per consentirgli l’accesso, scrivi invece “Allow: /”.