---
title: "CCBot: حظر زاحف الذكاء الاصطناعي هذا أو السماح له · DotsAgent"
description: "تدير Common Crawl ‏CCBot، وهو مُدرج ضمن التدريب. تعرّف على رمز robots.txt الخاص به، ومدى التزامه بالقواعد، وقائمة عناوين IP الخاصة به، وكيفية التحكم فيه."
url: https://dotsagent.io/ar/agent-ready/bots/ccbot
---

Common Crawl · التدريب

# ما هو CCBot؟

زاحف Common Crawl، الذي ينشئ مجموعة مفتوحة من محتوى الويب تُستخدم على نطاق واسع لتدريب نماذج الذكاء الاصطناعي. يلتزم بـ robots.txt.

- **رمز robots.txt**: `CCBot`
- **المشغّل**: Common Crawl
- **الغرض**: التدريب
- **يلتزم بـ robots.txt**: يذكر المشغّل أن هذا البوت يلتزم بملف robots.txt.
- **موثّق من المشغّل**: نعم، في صفحات المشغّل نفسه.
- **قائمة IP منشورة**: [index.commoncrawl.org/ccbot.json](https://index.commoncrawl.org/ccbot.json)
- **التوثيق**: [commoncrawl.org](https://commoncrawl.org/ccbot)

تُحل أسماء مضيفاته في نظام DNS العكسي إلى *.crawl.commoncrawl.org، وتنشر Common Crawl قائمة بعناوين IP.

## احظر CCBot من موقعك بالكامل

`robots.txt`

```
User-agent: CCBot
Disallow: /
```

## اسمح له، مع حجب المسارات الخاصة

`robots.txt`

```
User-agent: CCBot
Allow: /
Disallow: /admin/
```

[أضِفه إلى ملف robots.txt في المولّد →](https://dotsagent.io/ar/agent-ready/robots-txt)

## المصادر

1. [commoncrawl.org](https://commoncrawl.org/ccbot)/ccbot

مرجع مستقل لمطوّري وكلاء الذكاء الاصطناعي. لا تربطنا أي علاقة بأي من المورّدين المذكورين هنا.

© 2026 DotsAgent · تم التحقق من المعلومات في 1 أكتوبر 2026
