---
title: "CCBot: blocca o consenti questo crawler IA · DotsAgent"
description: "CCBot è gestito da Common Crawl ed è classificato come addestramento. Il token robots.txt, il rispetto delle regole, l'elenco IP e le modalità per controllarlo."
url: https://dotsagent.io/it/agent-ready/bots/ccbot
---

Common Crawl · Addestramento

# Che cos'è CCBot?

Crawler di Common Crawl, che crea un corpus web aperto ampiamente usato per addestrare modelli AI. Rispetta robots.txt.

- **Token robots.txt**: `CCBot`
- **Operatore**: Common Crawl
- **Scopo**: Addestramento
- **Rispetta robots.txt**: L'operatore dichiara che rispetta robots.txt.
- **Documentato dall'operatore**: Sì, nelle pagine dell'operatore.
- **Elenco IP pubblicato**: [index.commoncrawl.org/ccbot.json](https://index.commoncrawl.org/ccbot.json)
- **Documentazione**: [commoncrawl.org](https://commoncrawl.org/ccbot)

I suoi host si risolvono in *.crawl.commoncrawl.org tramite DNS inverso e Common Crawl pubblica un elenco IP.

## Blocca CCBot su tutto il sito

`robots.txt`

```
User-agent: CCBot
Disallow: /
```

## Consenti l'accesso, ma escludi i percorsi privati

`robots.txt`

```
User-agent: CCBot
Allow: /
Disallow: /admin/
```

[Aggiungilo a robots.txt nel generatore →](https://dotsagent.io/it/agent-ready/robots-txt)

## Fonti

1. [commoncrawl.org](https://commoncrawl.org/ccbot)/ccbot

Riferimento indipendente per chi sviluppa agenti IA. Non siamo affiliati a nessun fornitore citato qui.

© 2026 DotsAgent · Dati verificati il 1 ottobre 2026
