---
title: "AIボット一覧：40種類のクローラー、トークン、IPリスト · DotsAgent"
description: "OpenAI、Anthropic、Google、Apple、Meta、Amazon などの AI クローラーとエージェントを40件掲載。robots.txt 用のトークン、目的、準拠状況、IP リストを確認できます。"
url: https://dotsagent.io/ja/agent-ready/bots
---

40件のクローラーとエージェント

# AIクローラーとエージェント一覧

確認できた各AIボットについて、robots.txtで使うトークン、取得するデータ、運営元がルールに従うと表明しているか、リクエストが本当にそのボットからのものかを確認する方法を掲載しています。コミュニティの ai.robots.txt レジストリでのみ確認できたトークンは、各ボットのページにその旨を明記しています。

| ボット | トークン | 目的 | robots.txtに従う | 確認方法 |
| --- | --- | --- | --- | --- |
| [GPTBot](https://dotsagent.io/ja/agent-ready/bots/gptbot)OpenAI | `GPTBot` | 学習 | — | IPリスト |
| [OAI-SearchBot](https://dotsagent.io/ja/agent-ready/bots/oai-searchbot)OpenAI | `OAI-SearchBot` | 検索 | — | IPリスト |
| [ChatGPT-User](https://dotsagent.io/ja/agent-ready/bots/chatgpt-user)OpenAI | `ChatGPT-User` | ユーザーによる取得 | — | IPリスト |
| [OAI-AdsBot](https://dotsagent.io/ja/agent-ready/bots/oai-adsbot)OpenAI | `OAI-AdsBot` | 広告 | — | IPリスト |
| [ChatGPT agent](https://dotsagent.io/ja/agent-ready/bots/chatgpt-agent)OpenAI | トークンなし | エージェント | — | 署名付きリクエスト |
| [ClaudeBot](https://dotsagent.io/ja/agent-ready/bots/claudebot)Anthropic | `ClaudeBot` | 学習 | — | IPリスト |
| [Claude-SearchBot](https://dotsagent.io/ja/agent-ready/bots/claude-searchbot)Anthropic | `Claude-SearchBot` | 検索 | — | IPリスト |
| [Claude-User](https://dotsagent.io/ja/agent-ready/bots/claude-user)Anthropic | `Claude-User` | ユーザーによる取得 | — | IPリスト |
| [Googlebot](https://dotsagent.io/ja/agent-ready/bots/googlebot)Google | `Googlebot` | 検索 | — | IPリスト |
| [Google-Extended](https://dotsagent.io/ja/agent-ready/bots/google-extended)Google | `Google-Extended` | 学習 | — | — |
| [Google-CloudVertexBot](https://dotsagent.io/ja/agent-ready/bots/google-cloudvertexbot)Google | `Google-CloudVertexBot` | 検索 | — | IPリスト |
| [GoogleOther](https://dotsagent.io/ja/agent-ready/bots/googleother)Google | `GoogleOther` | 学習 | — | IPリスト |
| [Google-Agent](https://dotsagent.io/ja/agent-ready/bots/google-agent)Google | `Google-Agent` | エージェント | — | IPリスト |
| [Google-GeminiNotebook](https://dotsagent.io/ja/agent-ready/bots/google-gemininotebook)Google | `Google-GeminiNotebook` | ユーザーによる取得 | — | IPリスト |
| [Gemini Spark](https://dotsagent.io/ja/agent-ready/bots/gemini-spark)Google | トークンなし | エージェント | — | — |
| [Gemini-Deep-Research](https://dotsagent.io/ja/agent-ready/bots/gemini-deep-research)Google | `Gemini-Deep-Research` | ユーザーによる取得 | — | — |
| [GoogleAgent-Mariner](https://dotsagent.io/ja/agent-ready/bots/googleagent-mariner)Google | `GoogleAgent-Mariner` | エージェント | — | — |
| [Applebot](https://dotsagent.io/ja/agent-ready/bots/applebot)Apple | `Applebot` | 検索 | — | IPリスト |
| [Applebot-Extended](https://dotsagent.io/ja/agent-ready/bots/applebot-extended)Apple | `Applebot-Extended` | 学習 | — | — |
| [PerplexityBot](https://dotsagent.io/ja/agent-ready/bots/perplexitybot)Perplexity | `PerplexityBot` | 検索 | — | IPリスト |
| [Perplexity-User](https://dotsagent.io/ja/agent-ready/bots/perplexity-user)Perplexity | `Perplexity-User` | ユーザーによる取得 | — | IPリスト |
| [meta-externalagent](https://dotsagent.io/ja/agent-ready/bots/meta-externalagent)Meta | `meta-externalagent` | 学習 | — | — |
| [meta-webindexer](https://dotsagent.io/ja/agent-ready/bots/meta-webindexer)Meta | `meta-webindexer` | 検索 | — | — |
| [meta-externalfetcher](https://dotsagent.io/ja/agent-ready/bots/meta-externalfetcher)Meta | `meta-externalfetcher` | ユーザーによる取得 | — | — |
| [meta-externalads](https://dotsagent.io/ja/agent-ready/bots/meta-externalads)Meta | `meta-externalads` | 広告 | — | — |
| [facebookexternalhit](https://dotsagent.io/ja/agent-ready/bots/facebookexternalhit)Meta | `facebookexternalhit` | ユーザーによる取得 | — | — |
| [Muse](https://dotsagent.io/ja/agent-ready/bots/muse)Meta | トークンなし | エージェント | — | — |
| [Amazonbot](https://dotsagent.io/ja/agent-ready/bots/amazonbot)Amazon | `Amazonbot` | 学習 | — | IPリスト |
| [Amzn-SearchBot](https://dotsagent.io/ja/agent-ready/bots/amzn-searchbot)Amazon | `Amzn-SearchBot` | 検索 | — | IPリスト |
| [Amzn-User](https://dotsagent.io/ja/agent-ready/bots/amzn-user)Amazon | `Amzn-User` | ユーザーによる取得 | — | IPリスト |
| [DuckAssistBot](https://dotsagent.io/ja/agent-ready/bots/duckassistbot)DuckDuckGo | `DuckAssistBot` | 検索 | — | IPリスト |
| [MistralAI-User](https://dotsagent.io/ja/agent-ready/bots/mistralai-user)Mistral | `MistralAI-User` | ユーザーによる取得 | — | IPリスト |
| [MistralAI-Index](https://dotsagent.io/ja/agent-ready/bots/mistralai-index)Mistral | `MistralAI-Index` | 検索 | — | IPリスト |
| [MistralAI-Training](https://dotsagent.io/ja/agent-ready/bots/mistralai-training)Mistral | `MistralAI-Training` | 学習 | — | — |
| [CCBot](https://dotsagent.io/ja/agent-ready/bots/ccbot)Common Crawl | `CCBot` | 学習 | — | IPリスト |
| [cohere-ai](https://dotsagent.io/ja/agent-ready/bots/cohere-ai)Cohere | `cohere-ai` | ユーザーによる取得 | — | — |
| [Bytespider](https://dotsagent.io/ja/agent-ready/bots/bytespider)ByteDance | `Bytespider` | 学習 | — | — |
| [YouBot](https://dotsagent.io/ja/agent-ready/bots/youbot)You.com | `YouBot` | 検索 | — | — |
| [Diffbot](https://dotsagent.io/ja/agent-ready/bots/diffbot)Diffbot | `Diffbot` | 検索 | — | — |
| [Timpibot](https://dotsagent.io/ja/agent-ready/bots/timpibot)Timpi | `Timpibot` | 学習 | — | — |

## 目的の説明

- **学習**: モデルのトレーニングや一般的な調査用のクロールを目的に、ページを収集します。Google-Extended と Applebot-Extended は制御用トークンであり、それ自体がページを取得することはありません。
- **検索**: Google Search から ChatGPT search、Perplexity、DuckAssist などのAI回答エンジンまで、検索サービス向けにページをインデックスします。ブロックすると、そのサービスに掲載されなくなります。
- **ユーザーによる取得**: チャットやツールでユーザーが求めたページを取得します。robots.txtがこうしたリクエストに適用されない場合があると表明している運営元も複数あります。
- **エージェント**: 多くの場合、フルブラウザーを使ってユーザーに代わりページを閲覧し、操作します。トークンがないものも多く、署名がある場合に限り、それによって識別できます。
- **広告**: 広告主が登録した広告のリンク先ページを確認します。robots.txtジェネレーターの対象外です。

## ボットの身元を確認する

user-agent文字列は簡単に偽装できます。大半の大手事業者は、ボットが使用するIPアドレス範囲をJSONファイルで公開しており、一覧では「IPリスト」と表示しています。リクエスト元のアドレスを、そのトークンに対応するリストと照合してください。名前だけが一致しても、身元は未確認として扱います。

逆引きDNSを公開している事業者もあります。たとえばCommon Crawlによると、CCBotのホスト名は*.crawl.commoncrawl.orgに解決されます。信頼する前に、そのホスト名を逆引きして同じアドレスに解決されることを確認してください。

エージェントはWeb Bot Authドラフトに基づき、HTTP Message Signatures (RFC 9421) でリクエストに署名するケースが増えています。リクエストではSignature-Agentに事業者を指定し、そのドメインの/.well-known/http-message-signatures-directoryにある公開鍵で検証します。有効な署名で証明できるのは事業者の身元であり、背後にいるユーザーや、そのユーザーに許可された操作ではありません。

[この一覧からrobots.txtを作成 →](https://dotsagent.io/ja/agent-ready/robots-txt)

## AIクローラーに関する質問

### robots.txtを無視するAIクローラーはどれですか？

各事業者の公式ドキュメントによると、ChatGPT-User、Perplexity-User、Google-Agent、Google-GeminiNotebook、Amzn-User、meta-externalfetcher、facebookexternalhitは、ユーザーが取得を開始するケースが主な理由で、robots.txtに従わない場合があります。また、コミュニティからはBytespiderがrobots.txtを尊重しないとの報告があります。

### GPTBot、OAI-SearchBot、ChatGPT-Userの違いは何ですか？

GPTBotはOpenAIモデルの学習用にページを収集し、OAI-SearchBotはChatGPT検索用にページをインデックスし、ChatGPT-Userはユーザーからのリクエストに応じてページを取得します。前者の2つはrobots.txtに従いますが、OpenAIによると、そのルールは3つ目には適用されない場合があります。

### robots.txtトークンがないAIエージェントはどれですか？

ChatGPT agent、Gemini Spark、MetaのMuseです。ChatGPT agentはhttps://chatgpt.comからのWeb Bot Auth署名で検証できます。Gemini SparkはローカルのChromeモードではユーザー自身のブラウザーのように見え、Museはuser-agentが公開されていません。

### リクエストが本当にGooglebotからのものか確認するには？

GoogleはGooglebotのIPアドレス範囲をJSONファイルで公開しており、このディレクトリのGooglebotの項目からリンクしています。user-agent文字列を信頼するのではなく、リクエスト元のアドレスをその範囲と照合してください。

### このAIボット一覧の情報源は何ですか？

各項目には、公開されている場合は事業者のドキュメントをリンクしています。ドキュメントがないトークンは、コミュニティのai.robots.txtレジストリから取得しています。DeepSeekBot、Kimi-User、Manus-User、NovaAct、Devin、PetalBotは、事業者のドキュメントが見つからなかったため掲載していません。一覧は2026年10月1日に確認しました。

AIエージェント開発者向けの独立したリファレンスです。ここに記載されているいずれのベンダーとも提携していません。

© 2026 DotsAgent · 確認日: 2026年10月1日
