---
title: "CCBot: บล็อกหรืออนุญาต AI crawler นี้ · DotsAgent"
description: "CCBot ดำเนินการโดย Common Crawl และจัดอยู่ในหมวด การฝึกโมเดล ดู token สำหรับ robots.txt ว่าทำตามกฎหรือไม่ รายการ IP และวิธีควบคุม"
url: https://dotsagent.io/th/agent-ready/bots/ccbot
---

Common Crawl · การฝึกโมเดล

# CCBot คืออะไร?

crawler ของ Common Crawl ซึ่งสร้างคลังข้อมูลเว็บแบบเปิดที่มีการนำไปใช้ฝึกโมเดล AI อย่างแพร่หลาย โดยปฏิบัติตาม robots.txt

- **token สำหรับ robots.txt**: `CCBot`
- **ผู้ให้บริการ**: Common Crawl
- **วัตถุประสงค์**: การฝึกโมเดล
- **ทำตาม robots.txt**: ผู้ให้บริการระบุว่าบอตนี้ปฏิบัติตาม robots.txt
- **มีเอกสารจากผู้ให้บริการ**: มีระบุไว้ในหน้าเว็บของผู้ให้บริการ
- **รายการ IP ที่เผยแพร่**: [index.commoncrawl.org/ccbot.json](https://index.commoncrawl.org/ccbot.json)
- **เอกสาร**: [commoncrawl.org](https://commoncrawl.org/ccbot)

โฮสต์ของ crawler นี้ resolve เป็น *.crawl.commoncrawl.org เมื่อค้นหา reverse DNS และ Common Crawl เผยแพร่รายการ IP ไว้

## บล็อก CCBot จากทั้งเว็บไซต์

`robots.txt`

```
User-agent: CCBot
Disallow: /
```

## อนุญาตให้เข้าถึง แต่กันเส้นทางส่วนตัวไว้

`robots.txt`

```
User-agent: CCBot
Allow: /
Disallow: /admin/
```

[เพิ่มลงใน robots.txt ใน generator →](https://dotsagent.io/th/agent-ready/robots-txt)

## แหล่งข้อมูล

1. [commoncrawl.org](https://commoncrawl.org/ccbot)/ccbot

แหล่งอ้างอิงอิสระสำหรับผู้สร้าง AI agent ไม่มีส่วนเกี่ยวข้องกับผู้ให้บริการที่กล่าวถึง

© 2026 DotsAgent · ตรวจสอบข้อมูลเมื่อ 1 ตุลาคม 2569
