本文へ移動

AIに選ばれる情報は、どう作られるのか。

検証レポート

AIの学習を断ると、AI検索にも出なくなるのか ChatGPT検索を断るサイトは16.9%から3.0%へ

  • AIの学習を断っても、検索やAIの検索から消えるとは限りません。OpenAIは学習用のGPTBotとChatGPTの検索用のOAI-SearchBotを分けていて、学習用だけを断れば、ChatGPTの検索の回答には引き続き出られます。
  • ところが、Cloudflareの設定が切り替わった2026年9月15日の前後で比べると、Cloudflareを使う746サイトでOAI-SearchBotを断る割合は16.9%から3.0%に下がりました。学習を止めるつもりの一括ブロックが、ChatGPTの検索まで止めていたとみられます。
  • 9月15日からは、Cloudflareで学習の設定に「Block」を選ぶとGoogle検索まで止まります。自社サイトのrobots.txtをブラウザで開き、学習用と検索用のどちらの名前を断っているかを確かめることが最初の一歩です。
AIの学習を断ると、AI検索にも出なくなるのか ChatGPT検索を断るサイトは16.9%から3.0%へ

答え:学習だけを断るなら残れる。ただし断り方を誤ると、AI検索から消える

AIの学習を断っても、正しく設定すれば検索にもAIの検索にも残れます。ところが実際には、学習を止めるつもりの一括ブロックで、ChatGPTの検索に使われる読み取りまで断っていたサイトが少なくありませんでした。

自社の文章をAIの学習に使われたくない一方で、検索やAIの回答には出たいという悩みは、多くの会社が抱えています。Cloudflareを使うサイトのうち、検索用のロボットを断っているのは1%未満ですが、学習を断る仕組みを何かしら入れているサイトは17%にのぼります。

話をややこしくしているのは、1つのロボットが検索と学習を兼ねている場合があることです。そのロボットを断れば検索からも消えてしまうため、学習だけを断る手段がなかったサイトは、どちらを取るかの二択を迫られてきました。

学習用と検索用は、別々に断れるようになっている

OpenAIは学習用のGPTBotと、ChatGPTの検索用のOAI-SearchBotを分けていて、2つの設定は互いに独立しています。GoogleとAppleも、検索のロボットとは別に、学習だけを断るための名前を用意しています。

学習だけを断るときに、robots.txtで指定する名前(2026年9月時点)
会社学習を断る名前検索に使うロボット学習を断ったときの検索への影響
OpenAIGPTBotOAI-SearchBot影響しない。OAI-SearchBotを断るとChatGPTの検索の回答に出なくなる
GoogleGoogle-ExtendedGooglebot検索順位に影響しないとGoogleが表明
AppleApplebot-ExtendedApplebot検索順位に影響しないとAppleが表明
Microsoftrobots.txtでの指定は2027年初めの予定。いまはNOARCHIVEのメタタグBingbotNOARCHIVEは検索順位に影響しないとMicrosoftが表明

OpenAIの場合、OAI-SearchBotを断ったサイトはChatGPTの検索の回答に出なくなりますが、GPTBotだけを断ればそうはなりません。robots.txtを書き換えてから検索の側に反映されるまでは、24時間ほどかかります。

つまり、学習を断るときに止めるべきなのはGPTBotやGoogle-Extendedのような学習用の名前であって、OAI-SearchBotやGooglebotではありません。ここを取り違えると、学習を断ったつもりで、AIの検索から自社を外すことになります。

一括の「AIを止める」は、AIの検索まで止めていた

Cloudflareの新しい設定が始まった9月15日の前後で比べると、Cloudflareを使うサイトでOAI-SearchBotを断る割合は16.9%から3.0%に下がりました。学習を断るための一括ブロックが、ChatGPTの検索まで巻き込んでいたことになります。

AIのロボットを断っていたサイトの割合(2026年9月14日と16日の比較)
ロボット用途分母9月14日9月16日
GPTBotOpenAIの学習Cloudflareを使う746サイト18.9%22.0%
ClaudeBotAnthropicの学習19.9%22.8%
OAI-SearchBotChatGPTの検索16.9%3.0%

この2日間で、学習用のロボットを断るサイトは増え、検索用のロボットを断るサイトは大きく減りました。Cloudflareを使わない300サイトでは変化がなかったため、動いたのはCloudflareの設定の切り替えによるものと見てよさそうです。

Cloudflareの発表は、AIの検索用のロボットについて何も変えるとは書いていませんでした。それでも、検索用とエージェントのロボットを断る割合はそれぞれ約13ポイント下がっています。

手がかりは、古い設定を新しい設定へ移す対応表にあります。旧来の「AIをブロック」を選んでいたサイトは、新しい設定で検索が「許可」、学習が「Disallow AI Training」に置き換わりました。旧設定がAIの検索用のロボットまで止めていて、それが移行で外れたと見るのが自然ですが、旧設定がどのロボットを止めていたかを直接示す資料はなく、これはAIMAの読みです。

この読みが正しければ、学習を断ったつもりの会社の一部は、知らないうちにChatGPTの検索からも外れていたことになります。AIに引用されない原因が、文章の中身ではなく入口の設定にあったという場合もありえます。

9月15日からは、「ブロック」を選ぶとGoogle検索まで止まる

Cloudflareでは9月15日から、学習の設定で「Block」を選ぶと、Googlebot、Bingbot、Applebotまで止まり、通常の検索からも外れます。学習だけを断るなら、「Disallow AI Training」を選ぶ必要があります。

これまでの設定は自動で新しい設定へ移されるので、ほとんどのサイトは何もしなくてかまいません。危ないのは、あとから設定画面を開いて、強そうな「Block」を選び直す場面です。

Disallow AI Trainingを選ぶと、robots.txtにGoogle-ExtendedとApplebot-Extendedを断る2行が足されます。Amazon、Anthropic、Meta、OpenAIは学習専用のロボットを分けているので、そちらは直接ブロックされます。検索用のロボットは残るので、ChatGPTの検索などからは引き続き読める状態になります。

新しくドメインを登録するときのおすすめの初期設定も、広告で稼ぐかどうかで分かれました。広告収入は人がページを見て初めて生まれ、学習はその訪問を答えに置き換えてしまうため、広告で稼ぐサイトには学習を断る設定が、広告で稼がないサイトには学習も許可する設定がすすめられています。

学習を断っても、AIの回答に出るかどうかは別に決まる

学習の拒否が決めるのは、モデルを作る材料に使われるかどうかです。AIの回答や要約に自社のページが出るかどうかは、検索用のロボットを通すかどうかと、今後用意される要約の設定で別に決まります。

要約への出方を断る設定は、Cloudflareが次に取り組む対象としていて、自前の設定は来年の予定です。Bingbotはrobots.txtの学習拒否を2027年初めまで読まないため、それまでBingに学習させない手段はNOARCHIVEのメタタグに限られます。

robots.txtの指定はあくまでお願いであり、無視するロボットも出てきます。Cloudflareは無視したロボットを見つけて止められますが、Google、Apple、Microsoftについては、各社の約束を信じて任せる形になっています。

広告で稼がない会社にとっては、学習を断ること自体が得とは限りません。AIに社名を知ってもらい、名前を出してもらいたいなら学習の材料に入っているほうが有利な面もありますが、それがどれだけ効くかを明らかにしたAIの会社はありません。

Webマーケ担当者が、いまやること

自社サイトのrobots.txtをブラウザで開き、学習用と検索用のどちらの名前を断っているかを確かめます。Cloudflareを使っているなら、学習の設定が「Block」になっていないかを管理者に見てもらいます。

robots.txtはサイトのアドレスの後ろに「/robots.txt」を付けるだけで誰でも読めるため、エンジニアに頼まなくても最初の確認はできます。

  • ブラウザで自社サイトのrobots.txtを開き、GPTBot、OAI-SearchBot、Google-Extended、Googlebotの名前が書かれているかを書き写す
  • OAI-SearchBotやGooglebotの下に「Disallow: /」があれば、学習ではなく検索を断っている状態なので、それが意図したものかを管理者に確かめる
  • Cloudflareを使っているかを制作会社や管理者に聞き、使っていれば学習の設定が「Disallow AI Training」か「Block」かを確認してもらう
  • 広告で稼いでいない会社なら、そもそも学習を断る必要があるのかを、AIに社名を出してもらいたいかどうかと合わせて社内で決め直す
  • 設定を変える前に、ChatGPTの検索で自社名や主力サービスについて数問たずね、答えと引用元を日付つきで記録しておき、数週間後に同じ質問で比べる
  • robots.txtに問題がないのにAIの検索にまったく出ない場合は、防火壁の側で止めていないかも管理者に調べてもらう

学習を断るかどうかは会社ごとの判断ですが、検索用のロボットまで止めてしまうのは、ほとんどの会社にとって意図しない損失です。まずは自社がいま何を断っているのかを、自分の目で確かめるところから始めます。

観測手法

公開された資料3件だけを使いました。1件目は、Cloudflareが2026年9月15日に公開した「Have it both ways: stay discoverable in search while disallowing AI training」です。新しい設定の中身、古い設定からの移行表、新規ドメインのおすすめの初期設定、各社のロボットの扱いが書かれた、仕組みの側の一次資料です。

2件目は、Semrushが2026年9月18日に公開した「Cloudflare's AI training block now spares Googlebot」です。この中で紹介されているSeenSureの測定は、1,046のサイトが8種類のAIのロボットにどう応じるかを9月14日と16日に確かめたもので、そのうち746サイトがCloudflareを使い、300サイトが使っていません。測定の元データは取得しておらず、記事に載った数字だけを使っています。

3件目は、OpenAIの開発者向け文書「Overview of OpenAI Crawlers」で、2026年9月19日に取得した版です。GPTBot、OAI-SearchBot、ChatGPT-Userの役割と、robots.txtでの扱いを確認しました。

AIMAによる独自の計測は行っていません。本文中の数値は、取得時に保存した原文から機械的に抽出したものです。

この記事で言えないこと

切り替え前後の割合は、1,046サイトを9月14日と16日の2回だけ確かめた測定で、サイトの選び方は記事からは分かりません。日本のサイトで同じ割合になるかは確かめられていません。OAI-SearchBotを断る割合が下がった理由を、旧来の一括ブロックが検索用のロボットまで止めていたことに求める部分はAIMAの読みで、旧設定が止めていたロボットの一覧は確認できていません。Google、Apple、Microsoftが学習の拒否は検索順位に影響しないとしている点は各社の表明であり、独立に検証した資料はありません。学習の材料に入ることがAIの回答に社名が出ることにどれだけ効くかも、どの資料にも数字がありません。ここから言えるのは、学習用と検索用のロボットは別々に断れること、一括の設定では検索用まで止まっていた例が多かったとみられること、Cloudflareの「Block」は9月15日以降Google検索まで止めること、この3点までです。

突き合わせた資料

  1. 学習だけを断る新しい設定の仕組みと、古い設定からの移行表Have it both ways: stay discoverable in search while disallowing AI training(Cloudflareの公式発表)
    Cloudflare Blog/取得 2026-09-15
  2. 設定の切り替え前後で、AIのロボットを断るサイトの割合の実測Cloudflare's AI training block now spares Googlebot(SeenSureの1,046サイトの測定を収録)
    Semrush/取得 2026-09-18
  3. 学習用と検索用のロボットを分ける仕様Overview of OpenAI Crawlers(GPTBot・OAI-SearchBotの役割)
    OpenAI クローラ文書/取得 2026-09-19

出典

  1. Have it both ways: stay discoverable in search while disallowing AI training|Cloudflare Blog(Bryan Becker、2026年9月15日)
  2. Cloudflare's AI training block now spares Googlebot|Semrush(Cecilia Meis、2026年9月18日)
  3. Overview of OpenAI Crawlers|OpenAI Developers(2026年9月19日取得)
検証レポート 自社名で検索されても、AIの要約が先に出るのか 米国では社名を含む検索の83%に表示 米国のデスクトップ検索では、社名を含む検索の82.91%にAIの要約が出て、社名だけの検索では表示された63件中48件が1番目。引用元はWikipedia71.9%、YouTube38.6%で、競合は57件中1件。要約の主張の11.0%は引用元で裏付けられず、フランスでは要約が多く出るサイトのクリック率が9日で23.1%下がった。表示回数は減らないため、社名検索のクリック率と要約の中身を自分で確かめる必要がある。 検証レポート AIに一度引用されれば、その後も載り続けるのか 引用の78%は2週間以内に半分へ落ちる 引用された883,000ページのうち、ピークから2週間以内に引用の割合が半分へ落ちたのは78%。続いた22%でも半減までの中央値は27〜29日。AIごとの寿命はほぼ連動せず(相関0.03〜0.09)、5種以上に引用されたページは8週後に残る見込みが5.5倍。測る側は、1回の出現ではなく同じ質問の繰り返しの頻度で見る必要がある。 検証レポート 比較記事で自社を1位にするのは、効くのか 1位にした効果は4%、統計上は差がない 自社1位の比較記事は90.4%が流入増(全体は67.3%)だが、条件をそろえた上乗せは4%(p値0.91)。AIは自社1位の記事を材料に競合を推薦することがある。古い日付は上位3位の見込みが56%低く、AIが引用する内容は通常の検索結果より25.7%新しい。 検証レポート AIに社名を出してもらうには、自社サイトが引用される必要があるのか 引用なしで2.8%、ありで49.0% 社名を含まない質問で、自社サイトが引用されない回答に社名が出たのはGPT2.8%・Gemini3.8%。引用されると49.0%・58.4%、引用に加えてAIが社名入りで検索し直すと91.4%・100%。見せ方を整えると引用は1回答あたり+0.50件増えるが、引用元に入れるかは+4.5ポイントで決め手を欠く。 検証レポート AIにすすめられる会社は、何が違うのか 口コミ件数は3〜5倍、評価は10分の1星の差 ウェブ検索を切ったAIの推薦は、実在の医師と一致したのが4%と11%。検索をつなぐと同じ分野で64〜71%へ上がる(米国100大都市圏・公式の登録簿と照合)。実在する推薦でも、選ばれた飲食店は口コミ件数が3〜5倍、評価の差は10分の1星まで。名前が挙がると社名検索が4.3ポイント増える。