無料の道具・端末内で動く・何も送信しない

AI クローラーに、読ませるか、断るか。

27 種の AI クローラーを「何のために来るか」で分け、押すだけで robots.txt を作ります。内容の使い方の意思表示(Content-Signal)も一行で入ります。

学習のため9

AI の検索・回答の索引9

人の指示でその場で取りに来る5

従来の検索の土台・その他4

Content-Signal(内容の使い方の意思表示)

robots.txt読ませない名乗り 0

できた文字を、サイトの一番上の階層に robots.txt という名前で置きます(例 https://example.co.jp/robots.txt)。置いたあとは、上の道具「AI にはこう見える」で読めているか確かめられます。

LIST

AI クローラー一覧(27 種・何のために来るか・実際に来た回数)

名前は、各社が公開している名乗り(User-agent)です。「何のために来るか」は各社の公開文書の記述を当方が 4 つに分けました。回数は、当方が運営する 6 サイトの配信の入口で数えた 7 日間(2026年9月15日から9月21日)の実測です。推計ではありません。

名乗り運営何のために来るか7 日の来訪(6 サイト)説明
GPTBotOpenAI学習のため10 位以下ChatGPT の基盤モデルの学習に使われることがある 公式の文書 ↗
OAI-SearchBotOpenAIAI の検索・回答の索引353ChatGPT の検索の索引。引用の根拠になる 公式の文書 ↗
ChatGPT-UserOpenAI人の指示でその場で取りに来る320人が ChatGPT で頁を開いたときにその場で取りに来る 公式の文書 ↗
ClaudeBotAnthropic学習のため1,817Claude のモデルの学習と改善のための収集 公式の文書 ↗
Claude-SearchBotAnthropicAI の検索・回答の索引10 位以下Claude の検索の索引 公式の文書 ↗
Claude-UserAnthropic人の指示でその場で取りに来る10 位以下人が Claude で頁を開いたときにその場で取りに来る 公式の文書 ↗
anthropic-aiAnthropic学習のため10 位以下以前の名乗り。古い robots.txt に残っていることがある
PerplexityBotPerplexityAI の検索・回答の索引363Perplexity の検索の索引 公式の文書 ↗
Perplexity-UserPerplexity人の指示でその場で取りに来る10 位以下人が Perplexity で頁を開いたときにその場で取りに来る 公式の文書 ↗
Google-ExtendedGoogle学習のため10 位以下Gemini の学習と根拠づけの制御。Google 検索の順位には影響しない 公式の文書 ↗
Google-CloudVertexBotGoogleAI の検索・回答の索引10 位以下Vertex AI の顧客向けの索引 公式の文書 ↗
GoogleOtherGoogle従来の検索の土台・その他10 位以下研究や開発のための汎用の取得 公式の文書 ↗
GooglebotGoogle従来の検索の土台・その他524従来の検索。AI 概要と AI モードの土台。閉じると検索から消える 公式の文書 ↗
bingbotMicrosoft従来の検索の土台・その他1,539従来の検索。Copilot と ChatGPT の検索の土台。閉じると両方から消える 公式の文書 ↗
DuckAssistBotDuckDuckGoAI の検索・回答の索引10 位以下DuckAssist の回答の根拠 公式の文書 ↗
MistralAI-UserMistral AI人の指示でその場で取りに来る10 位以下人が Le Chat で頁を開いたときにその場で取りに来る
Meta-ExternalAgentMeta学習のため618Meta の AI の学習と改善のための収集 公式の文書 ↗
Meta-ExternalFetcherMeta人の指示でその場で取りに来る10 位以下人の指示でその場で取りに来る 公式の文書 ↗
Applebot-ExtendedApple学習のため10 位以下Apple の基盤モデルの学習の制御。Applebot 本体(検索)とは別 公式の文書 ↗
AmazonbotAmazonAI の検索・回答の索引370Alexa などの回答の索引 公式の文書 ↗
BytespiderByteDance学習のため1,447TikTok の親会社の収集。robots.txt を守らない報告が多い
CCBotCommon Crawl学習のため10 位以下公開の巨大な収集。多くのモデルの学習の元になっている 公式の文書 ↗
cohere-aiCohere学習のため10 位以下Cohere のモデルの学習
YouBotYou.comAI の検索・回答の索引10 位以下You.com の検索の索引 公式の文書 ↗
DiffbotDiffbot従来の検索の土台・その他10 位以下構造化した知識グラフの収集
TimpibotTimpiAI の検索・回答の索引10 位以下分散型の検索の索引
PetalBotHuaweiAI の検索・回答の索引813Petal 検索の索引

HOW TO WRITE

AI クローラーを拒否する robots.txt の書き方(と、許可する書き方)

robots.txt は、サイトの一番上に置く文字のファイルです。User-agent に名乗りを書き、Disallow: / で「読ませない」、Allow: / で「読んでよい」を伝えます。学習だけ断りたいなら、GPTBot・ClaudeBot・Google-Extended・CCBot などを Disallow にし、OAI-SearchBot・Claude-SearchBot・PerplexityBot は Allow のままにします。上の道具の「学習だけ断り、検索と回答には読ませる」がその形です。Googlebot と bingbot を Disallow にすると、AI からだけでなく従来の検索からも消えます。robots.txt は「お願い」です。守らない収集者(Bytespider など)には効きません。それを止めるには配信側での遮断が要ります。

GPTBot とは、OpenAI が ChatGPT の基盤モデルの学習のために使う名乗りです。ChatGPT の検索の索引は OAI-SearchBot、人が ChatGPT で頁を開くときは ChatGPT-User と、三つに分かれています。

CONTENT-SIGNAL

Content-Signal とは

robots.txt に一行で書く、内容の使い方の意思表示です。search(検索の索引と表示)、ai-input(AI の回答の根拠にすること)、ai-train(AI の学習に使うこと)の三つに yes か no を書きます。書かない場合は unknown の扱いで、意思が伝わりません。当方の 6 サイトは三つとも yes にしています。AI に引かれることが売上に直結するからです。これは法律の効力を持つものではなく、読む側が守ることを期待した表示です。守らない収集者もいます。

DECIDE

どれを断るべきか、の考え方

  • 従来の検索(Googlebot・bingbot)は断らないGoogle の AI 概要と AI モード、Copilot と ChatGPT の検索は、この二つの索引の上に載っています。断ると AI からも消えます。
  • 「AI の検索・回答の索引」は、引用されたいなら開くOAI-SearchBot・Claude-SearchBot・PerplexityBot は、答えの中で御社を根拠として引くための取得です。
  • 「人の指示でその場で取りに来る」は、開くのが自然ChatGPT-User・Claude-User は、人が御社の頁を開こうとしたときに動きます。ブラウザで人が見るのと同じです。
  • 「学習のため」は、方針で決めるGPTBot・ClaudeBot・Google-Extended・CCBot などは学習に使われることがあります。断っても検索と回答の索引には影響しない、と各社は書いています。
  • Google が「不要」と明言したものに時間を使わないllms.txt のような特別な標識、AI 向けの頁の分割や書き換え、不自然な言及集め。Google は AI の機能に載るための追加の技術要件は無いとしています。

BASICS

AI クローラーとは

AI クローラーとは、ChatGPT・Claude・Gemini・Perplexity などを運営する会社が、ウェブの頁を自動で取りに来るときの仕組みと、その名乗り(User-agent)のことです。従来の検索のクローラー(Googlebot・bingbot)と違うのは、目的が三つに分かれていることです。モデルの学習のため、AI の検索と回答の索引のため、人の指示でその場で取りに来るため。同じ会社でも名乗りを分けています。OpenAI なら GPTBot(学習)、OAI-SearchBot(検索の索引)、ChatGPT-User(人の指示)の三つです。当方の 6 サイトでは、7 日間に 10,008 回の来訪がありました。最も多いのは ClaudeBot、次に bingbot、Bytespider です。学習のための収集が、検索のための収集より多い、というのが実測です。

robots.txt の生成器で、学習だけ断り検索と回答には読ませるを押した画面。学習の 9 種の印が外れ、Content-Signal が ai-train=no になっている
上の生成器で「学習だけ断り、検索と回答には読ませる」を押した画面。学習の 9 種の印が外れ、Content-Signal が ai-train=no に変わります。

SYNTAX

robots.txt の書き方(文法の全部)

  • 置く場所は、サイトの一番上https://example.co.jp/robots.txt のように、ドメインの直下です。下の階層に置いても読まれません。サブドメインごとに別のファイルが要ります。
  • User-agent: で相手を指定し、続く行で Allow / Disallow を書く一つの塊(グループ)に複数の User-agent を並べられます。空行で塊が分かれます。* は全部の相手です。
  • Disallow: / は「全部読ませない」、Disallow: だけ(値が空)は「全部読んでよい」Allow: / と書いても同じ意味です。特定の階層だけ断るなら Disallow: /admin/ のように書きます。
  • 相手に一番よく当てはまる塊だけが使われるGPTBot 向けの塊があれば、GPTBot は * の塊を見ません。「* は全部許可、GPTBot だけ拒否」は、GPTBot 向けの塊に Disallow: / を書けば成立します。
  • Allow と Disallow が両方当てはまるときは、長い(具体的な)方が勝つGoogle の実装ではこの規則です。Disallow: /docs/ と Allow: /docs/public/ なら、/docs/public/ は読めます。
  • * と $ が使えるDisallow: /*.pdf$ で PDF だけ断る、のような書き方です。大文字と小文字は区別されます。
  • Sitemap: の行は塊の外に書ける絶対 URL で書きます。複数あれば複数行です。
  • robots.txt に noindex は書けないGoogle は 2019 年に robots.txt の noindex の扱いをやめました。索引から外したいときは、頁の meta robots に noindex を書き、robots.txt では読ませます(読めないと noindex が見えません)。
  • Crawl-delay は Google が無視するbingbot など一部は読みます。速度を落としたいなら Search Console や Bing Webmaster の設定を使います。
  • 文字は UTF-8、大きさは 500KB までGoogle はこの上限を超えた分を読みません。日本語のコメント(# で始まる行)は書けます。
kotaroasahina.com の robots.txt の実物。AI の名乗りを並べて Allow と Disallow を書き、最後にサイトマップと Content-Signal がある
このサイトの robots.txt の実物(2026年9月21日)。* の塊と AI の名乗りの塊を分け、Sitemap と Content-Signal を最後に置いています。

SPEC

Content-Signal の仕様(Cloudflare・2025 年 9 月 24 日)

Content-Signal は、Cloudflare が 2025 年 9 月 24 日に公開した、robots.txt に一行で書く意思表示です。三つの信号に yes か no を書きます。search は検索の索引と表示に使ってよいか、ai-input は AI の回答の根拠(引用・要約・AI 概要)に使ってよいか、ai-train は AI の学習に使ってよいか。書き方は Content-Signal: search=yes, ai-input=yes, ai-train=no のように、カンマで区切ります。書かなかった信号は「表明なし」で、yes とも no とも取られません。robots.txt の User-agent や Disallow とは独立していて、両方を書けます。Cloudflare が管理する robots.txt を使うサイト(発表時に 380 万ドメイン)には、既定で search=yes, ai-train=no が入り、ai-input は表明なしになっています。つまり、いま多くのサイトは「知らないうちに学習を断っている」状態です。自分のサイトの robots.txt を開いて確かめる価値があります。これは標準ではありません。IETF の AIPREF という作業部会が、AI の利用の意思表示の標準化を進めていて、決まるまでは Content-Signal と AIPREF の両方を書くと矛盾を作るおそれがあります。当方は Content-Signal だけを書いています。法律上の効力はなく、読む側が守ることを期待した表示です。守らない収集者には、次の節の方法が要ります。

BEYOND

robots.txt で止まらない相手を止めるには

  • 配信側で名乗りごとに遮断するCloudflare の AI Crawl Control(旧 AI Audit)は、名乗りごとの来訪を数え、一つずつ止められます。当方の来訪の数字も配信の入口で数えています。
  • 名乗りを偽る相手は、IP の範囲で見分けるOpenAI・Google・Perplexity は自社のクローラーの IP の範囲を公開しています。名乗りは GPTBot なのに範囲の外から来るものは偽物です。
  • 読ませる代わりに対価を求める仕組みが始まっているCloudflare は 2025 年 7 月に、AI クローラーに取得ごとの支払いを求める仕組み(pay per crawl)を試験的に始めました。当方はまだ使っていません。読ませて引用される方が、いまの当方には価値があるからです。
  • Bytespider のように robots.txt を守らないと報告される相手当方の 6 サイトにも 7 日で 1,447 回来ています。robots.txt で断っても来る場合は、配信側の遮断だけが効きます。

EACH

27 種それぞれの説明と、断る書き方

名前で検索して来た方のために、一つずつ置きます。回数は当方の 6 サイトへの 7 日間(2026年9月15日から9月21日)の実測です。

GPTBotOpenAI

学習のためChatGPT の基盤モデルの学習に使われることがある当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: GPTBot
Disallow: /

OAI-SearchBotOpenAI

AI の検索・回答の索引ChatGPT の検索の索引。引用の根拠になる当方の 6 サイトへ 7 日で 353 回。 公式の文書 ↗

User-agent: OAI-SearchBot
Disallow: /

ChatGPT-UserOpenAI

人の指示でその場で取りに来る人が ChatGPT で頁を開いたときにその場で取りに来る当方の 6 サイトへ 7 日で 320 回。 公式の文書 ↗

User-agent: ChatGPT-User
Disallow: /

ClaudeBotAnthropic

学習のためClaude のモデルの学習と改善のための収集当方の 6 サイトへ 7 日で 1,817 回。 公式の文書 ↗

User-agent: ClaudeBot
Disallow: /

Claude-SearchBotAnthropic

AI の検索・回答の索引Claude の検索の索引当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Claude-SearchBot
Disallow: /

Claude-UserAnthropic

人の指示でその場で取りに来る人が Claude で頁を開いたときにその場で取りに来る当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Claude-User
Disallow: /

anthropic-aiAnthropic

学習のため以前の名乗り。古い robots.txt に残っていることがある当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。

User-agent: anthropic-ai
Disallow: /

PerplexityBotPerplexity

AI の検索・回答の索引Perplexity の検索の索引当方の 6 サイトへ 7 日で 363 回。 公式の文書 ↗

User-agent: PerplexityBot
Disallow: /

Perplexity-UserPerplexity

人の指示でその場で取りに来る人が Perplexity で頁を開いたときにその場で取りに来る当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Perplexity-User
Disallow: /

Google-ExtendedGoogle

学習のためGemini の学習と根拠づけの制御。Google 検索の順位には影響しない当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Google-Extended
Disallow: /

Google-CloudVertexBotGoogle

AI の検索・回答の索引Vertex AI の顧客向けの索引当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Google-CloudVertexBot
Disallow: /

GoogleOtherGoogle

従来の検索の土台・その他研究や開発のための汎用の取得当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: GoogleOther
Disallow: /

GooglebotGoogle

従来の検索の土台・その他従来の検索。AI 概要と AI モードの土台。閉じると検索から消える当方の 6 サイトへ 7 日で 524 回。 公式の文書 ↗

User-agent: Googlebot
Disallow: /

bingbotMicrosoft

従来の検索の土台・その他従来の検索。Copilot と ChatGPT の検索の土台。閉じると両方から消える当方の 6 サイトへ 7 日で 1,539 回。 公式の文書 ↗

User-agent: bingbot
Disallow: /

DuckAssistBotDuckDuckGo

AI の検索・回答の索引DuckAssist の回答の根拠当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: DuckAssistBot
Disallow: /

MistralAI-UserMistral AI

人の指示でその場で取りに来る人が Le Chat で頁を開いたときにその場で取りに来る当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。

User-agent: MistralAI-User
Disallow: /

Meta-ExternalAgentMeta

学習のためMeta の AI の学習と改善のための収集当方の 6 サイトへ 7 日で 618 回。 公式の文書 ↗

User-agent: Meta-ExternalAgent
Disallow: /

Meta-ExternalFetcherMeta

人の指示でその場で取りに来る人の指示でその場で取りに来る当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Meta-ExternalFetcher
Disallow: /

Applebot-ExtendedApple

学習のためApple の基盤モデルの学習の制御。Applebot 本体(検索)とは別当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: Applebot-Extended
Disallow: /

AmazonbotAmazon

AI の検索・回答の索引Alexa などの回答の索引当方の 6 サイトへ 7 日で 370 回。 公式の文書 ↗

User-agent: Amazonbot
Disallow: /

BytespiderByteDance

学習のためTikTok の親会社の収集。robots.txt を守らない報告が多い当方の 6 サイトへ 7 日で 1,447 回。

User-agent: Bytespider
Disallow: /

CCBotCommon Crawl

学習のため公開の巨大な収集。多くのモデルの学習の元になっている当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: CCBot
Disallow: /

cohere-aiCohere

学習のためCohere のモデルの学習当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。

User-agent: cohere-ai
Disallow: /

YouBotYou.com

AI の検索・回答の索引You.com の検索の索引当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。 公式の文書 ↗

User-agent: YouBot
Disallow: /

DiffbotDiffbot

従来の検索の土台・その他構造化した知識グラフの収集当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。

User-agent: Diffbot
Disallow: /

TimpibotTimpi

AI の検索・回答の索引分散型の検索の索引当方の 6 サイトへの 7 日の来訪は上位 10 に入らず。

User-agent: Timpibot
Disallow: /

PetalBotHuawei

AI の検索・回答の索引Petal 検索の索引当方の 6 サイトへ 7 日で 813 回。

User-agent: PetalBot
Disallow: /
生成器の中の、AI の検索と回答の索引の 9 種。OAI-SearchBot・PerplexityBot などに当方の 6 サイトへの 7 日の来訪回数が添えてある
生成器の中の、AI の検索と回答の索引の 9 種。回数は当方の 6 サイトへの 7 日の記録です。

VERIFY

置いたあとの確かめ方

  • ブラウザで開くhttps://自分のドメイン/robots.txt を開き、書いたとおりに表示されるか。文字化けしていれば UTF-8 で保存し直します。
  • この頁の上の道具「AI にはこう見える」で読むAI クローラーを閉じていないか、Content-Signal が書かれているかを、機械が読む目で確かめます。
  • Google Search Console の robots.txt レポートGoogle が最後に取得した内容と、取得できなかったときの理由が見えます。
  • 配信側の記録で、名乗りごとの来訪を数える断ったはずの名乗りが来続けていれば、robots.txt を守っていない相手です。当方はこの数字を毎週見ています。
LLMO 診断ツールで kuon-rnd.com を点検した実際の画面。FAQPage の構造化データと事業者の型の数に直すところが出ている
置いたあとは LLMO 診断ツールで読めます。kuon-rnd.com では、AI クローラーの受け入れと Content-Signal が「問題なし」と出ました。

Q&A

よくある問い

  • AI クローラーを全部断ったら、Google の検索順位は下がりますかGooglebot を断らない限り、下がりません。Google-Extended を断っても検索の順位には影響しない、と Google は明記しています。AI 概要と AI モードは検索の一部で、Googlebot が取得した頁を使います。Google-Extended で断れるのは Gemini の学習と、Gemini の回答の根拠づけです。
  • 学習を断ると、ChatGPT に自社が出なくなりますかGPTBot(学習)を断っても、OAI-SearchBot(検索の索引)を開いていれば、ChatGPT の検索の答えには出ます。学習と検索は別の名乗りです。
  • WordPress では、どこに置きますかWordPress は robots.txt を自動で作ります。編集するには、サーバーの直下に実物の robots.txt を置くか、SEO の部品の設定画面から書きます。実物が優先されます。
  • llms.txt も置いたほうがよいですかGoogle は不要と明言しています。置いて害はありませんが、robots.txt と本文を先に整えます。詳しくは llms.txt の頁に書きました。
  • 当方の 6 サイトはどうしていますか全部に読ませ、Content-Signal は三つとも yes です。AI に引かれることが、道具とマイクの売上に直結するからです。方針は事業ごとに違ってよいものです。

SOURCES

出典

各社の名乗りと目的は、上の表の「公式の文書」から。Content-Signal の書き方は Cloudflare が 2025 年 9 月に公開した仕様に沿っています。来訪の回数は当方の 6 サイト(kotaroasahina.com・kuon-rnd.com・tango.blue・kuongeo.com・curanzsounds.com・kazokunomado.com)の記録で、月に一度更新します。

Cloudflare「Content Signals Policy」(2025年9月24日)↗ contentsignals.org(仕様の原文)↗ Google 検索セントラル「robots.txt の仕様」↗ IETF AIPREF 作業部会 ↗(取得 2026年9月21日)