---
title: "CCBot：このAIクローラーをブロックまたは許可する · DotsAgent"
description: "CCBotはCommon Crawlが運営し、学習に分類されています。robots.txtトークン、ルールへの準拠状況、IPリスト、制御方法を紹介します。"
url: https://dotsagent.io/ja/agent-ready/bots/ccbot
---

Common Crawl · 学習

# CCBotとは？

Common Crawlのクローラーです。AIモデルのトレーニングに広く使われる、オープンなWebコーパスを構築します。robots.txtに従います。

- **robots.txtトークン**: `CCBot`
- **運営者**: Common Crawl
- **用途**: 学習
- **robots.txtへの準拠**: 運営者は、robots.txt に従うと明言しています。
- **運営者によるドキュメント**: はい。運営者自身のページに記載されています。
- **公開IPリスト**: [index.commoncrawl.org/ccbot.json](https://index.commoncrawl.org/ccbot.json)
- **ドキュメント**: [commoncrawl.org](https://commoncrawl.org/ccbot)

ホストの逆引きDNS名は*.crawl.commoncrawl.orgに解決され、Common CrawlはIPリストを公開しています。

## サイト全体で CCBot をブロックする

`robots.txt`

```
User-agent: CCBot
Disallow: /
```

## 許可しつつ、非公開パスへのアクセスを防ぐ

`robots.txt`

```
User-agent: CCBot
Allow: /
Disallow: /admin/
```

[ジェネレーターで robots.txt に追加 →](https://dotsagent.io/ja/agent-ready/robots-txt)

## 出典

1. [commoncrawl.org](https://commoncrawl.org/ccbot)/ccbot

AIエージェント開発者向けの独立したリファレンスです。ここに記載されているいずれのベンダーとも提携していません。

© 2026 DotsAgent · 確認日: 2026年10月1日
