---
title: "CCBot: zablokuj lub zezwól temu crawlerowi AI · DotsAgent"
description: "CCBot jest obsługiwany przez Common Crawl i przypisany do celu trenowanie. Token robots.txt, przestrzeganie reguł, lista adresów IP i sposób kontroli."
url: https://dotsagent.io/pl/agent-ready/bots/ccbot
---

Common Crawl · Trenowanie

# Czym jest CCBot?

Crawler Common Crawl, który tworzy otwarty korpus sieci powszechnie wykorzystywany do trenowania modeli AI. Przestrzega robots.txt.

- **Token robots.txt**: `CCBot`
- **Operator**: Common Crawl
- **Cel**: Trenowanie
- **Przestrzega robots.txt**: Operator informuje, że bot przestrzega robots.txt.
- **Udokumentowany przez operatora**: Tak, na własnych stronach operatora.
- **Opublikowana lista adresów IP**: [index.commoncrawl.org/ccbot.json](https://index.commoncrawl.org/ccbot.json)
- **Dokumentacja**: [commoncrawl.org](https://commoncrawl.org/ccbot)

W reverse DNS jego hosty wskazują na *.crawl.commoncrawl.org, a Common Crawl publikuje listę adresów IP.

## Zablokuj CCBot w całej witrynie

`robots.txt`

```
User-agent: CCBot
Disallow: /
```

## Zezwól na dostęp, ale zablokuj ścieżki prywatne

`robots.txt`

```
User-agent: CCBot
Allow: /
Disallow: /admin/
```

[Dodaj do robots.txt w generatorze →](https://dotsagent.io/pl/agent-ready/robots-txt)

## Źródła

1. [commoncrawl.org](https://commoncrawl.org/ccbot)/ccbot

Niezależne źródło informacji dla osób tworzących agentów AI. Nie jesteśmy powiązani z żadnym wymienionym tu dostawcą.

© 2026 DotsAgent · Dane sprawdzone 1 października 2026
