robots.txt テスター|URL がブロックされるかの判定・書き方チェック・AI クローラーのブロック生成
Search Console の robots.txt テスターがなくなったあとの代わりに使える、robots.txt の確認ツールです。robots.txt の中身と確かめたい URL を貼りつけると、Googlebot・Googlebot-Image・AdsBot-Google・Bingbot・Applebot や、GPTBot・ClaudeBot・Google-Extended・PerplexityBot などの AI クローラーごとに、許可かブロックかと、その決め手になったルール(行番号)を表示します。判定は Google と同じく「いちばん長く一致したルールが勝ち、同じ長さなら Allow」「名前を書いたグループがあれば User-agent: * は使わない」「* と末尾の $」「日本語の URL」のルールで行います。全角の「:」、URL を書いた Disallow、User-agent より前のルール、Googlebot-Images のような名前の間違い、サポートの終わった Noindex、Google が読まない Crawl-delay などの書き方のチェックと、AI の学習だけを止める robots.txt の生成、* と $ の早見表つき。
1. robots.txt を貼りつける
サイトの「https://ドメイン/robots.txt」を開いて中身をコピーし、ここに貼りつけます。公開前の書きかけでも試せます。Google と同じ読み方(いちばん長く一致したルールが勝つ・同じ長さなら Allow)で判定します。
5行・111バイト(Google が読むのは先頭の 500KiB まで)・グループ 1個・Sitemap 1件
2. 確かめたい URL とクローラー
URL は1行に1つ(https:// からでも、/blog/ のようなパスだけでも可)。最大50件まで判定します。
ほかの検索エンジン
AI
3. 判定の結果
| URL | Googlebot | Googlebot-Image | Google-Extended | Bingbot | GPTBot | ClaudeBot |
|---|---|---|---|---|---|---|
| https://example.com/ | 許可 | 許可 | 許可 | 許可 | 許可 | 許可 |
| https://example.com/wp-admin/ | ブロック | ブロック | ブロック | ブロック | ブロック | ブロック |
| https://example.com/wp-admin/admin-ajax.php | 許可 | 許可 | 許可 | 許可 | 許可 | 許可 |
| https://example.com/wp-admin-guide/ | 許可 | 許可 | 許可 | 許可 | 許可 | 許可 |
https://example.com/判定に使うパス: /
- 許可
GooglebotGoogle 検索
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
- 許可
Googlebot-ImageGoogle 画像検索
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
Googlebot-Image のグループがなければ Googlebot のグループに従います。
- 許可
Google-ExtendedGemini の学習・回答への利用
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
Google-Extended はクローラーではなく、Googlebot が取得したページを Gemini などの生成 AI に使ってよいかを決める名前です。ブロックしても Google 検索の順位・表示には影響しません。
- 許可
BingbotBing 検索
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
- 許可
GPTBotOpenAI の学習
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
- 許可
ClaudeBotAnthropic(Claude)の学習
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
https://example.com/wp-admin/判定に使うパス: /wp-admin/
- ブロック
GooglebotGoogle 検索
「Disallow: /wp-admin/」(2行目)に一致しました。
使ったグループ: User-agent: *(1行目)
- ブロック
Googlebot-ImageGoogle 画像検索
「Disallow: /wp-admin/」(2行目)に一致しました。
使ったグループ: User-agent: *(1行目)
Googlebot-Image のグループがなければ Googlebot のグループに従います。
- ブロック
Google-ExtendedGemini の学習・回答への利用
「Disallow: /wp-admin/」(2行目)に一致しました。
使ったグループ: User-agent: *(1行目)
Google-Extended はクローラーではなく、Googlebot が取得したページを Gemini などの生成 AI に使ってよいかを決める名前です。ブロックしても Google 検索の順位・表示には影響しません。
- ブロック
BingbotBing 検索
「Disallow: /wp-admin/」(2行目)に一致しました。
使ったグループ: User-agent: *(1行目)
- ブロック
GPTBotOpenAI の学習
「Disallow: /wp-admin/」(2行目)に一致しました。
使ったグループ: User-agent: *(1行目)
- ブロック
ClaudeBotAnthropic(Claude)の学習
「Disallow: /wp-admin/」(2行目)に一致しました。
使ったグループ: User-agent: *(1行目)
https://example.com/wp-admin/admin-ajax.php判定に使うパス: /wp-admin/admin-ajax.php
- 許可
GooglebotGoogle 検索
一致したルールのうち、いちばん長い「Allow: /wp-admin/admin-ajax.php」(3行目)を使います。書いた順番は関係ありません。
使ったグループ: User-agent: *(1行目)
ほかに一致したルール: Disallow: /wp-admin/(2行目)
- 許可
Googlebot-ImageGoogle 画像検索
一致したルールのうち、いちばん長い「Allow: /wp-admin/admin-ajax.php」(3行目)を使います。書いた順番は関係ありません。
使ったグループ: User-agent: *(1行目)
ほかに一致したルール: Disallow: /wp-admin/(2行目)
Googlebot-Image のグループがなければ Googlebot のグループに従います。
- 許可
Google-ExtendedGemini の学習・回答への利用
一致したルールのうち、いちばん長い「Allow: /wp-admin/admin-ajax.php」(3行目)を使います。書いた順番は関係ありません。
使ったグループ: User-agent: *(1行目)
ほかに一致したルール: Disallow: /wp-admin/(2行目)
Google-Extended はクローラーではなく、Googlebot が取得したページを Gemini などの生成 AI に使ってよいかを決める名前です。ブロックしても Google 検索の順位・表示には影響しません。
- 許可
BingbotBing 検索
一致したルールのうち、いちばん長い「Allow: /wp-admin/admin-ajax.php」(3行目)を使います。書いた順番は関係ありません。
使ったグループ: User-agent: *(1行目)
ほかに一致したルール: Disallow: /wp-admin/(2行目)
- 許可
GPTBotOpenAI の学習
一致したルールのうち、いちばん長い「Allow: /wp-admin/admin-ajax.php」(3行目)を使います。書いた順番は関係ありません。
使ったグループ: User-agent: *(1行目)
ほかに一致したルール: Disallow: /wp-admin/(2行目)
- 許可
ClaudeBotAnthropic(Claude)の学習
一致したルールのうち、いちばん長い「Allow: /wp-admin/admin-ajax.php」(3行目)を使います。書いた順番は関係ありません。
使ったグループ: User-agent: *(1行目)
ほかに一致したルール: Disallow: /wp-admin/(2行目)
https://example.com/wp-admin-guide/判定に使うパス: /wp-admin-guide/
- 許可
GooglebotGoogle 検索
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
- 許可
Googlebot-ImageGoogle 画像検索
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
Googlebot-Image のグループがなければ Googlebot のグループに従います。
- 許可
Google-ExtendedGemini の学習・回答への利用
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
Google-Extended はクローラーではなく、Googlebot が取得したページを Gemini などの生成 AI に使ってよいかを決める名前です。ブロックしても Google 検索の順位・表示には影響しません。
- 許可
BingbotBing 検索
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
- 許可
GPTBotOpenAI の学習
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
- 許可
ClaudeBotAnthropic(Claude)の学習
User-agent: * のグループに一致するルールがないので許可です。
使ったグループ: User-agent: *(1行目)
4. 書き方のチェック
Google が読めない行・意味のない行・よくある勘違いを、行番号つきで知らせます。
書き方の問題は見つかりませんでした。
グループの一覧
*
1行目から・Disallow 1件・Allow 1件
Sitemap
- 5行目: https://example.com/wp-sitemap.xml
貼りつけた robots.txt と URL はこのブラウザに保存されるだけで、サーバーには送りません。サイトにアクセスして robots.txt を取りに行くこともしません。
ABOUT
robots.txt テスター|URL がブロックされるかの判定・書き方チェック・AI クローラーのブロック生成について
robots.txt テスターは、サイトの robots.txt を貼りつけて、確かめたい URL がクローラーごとに「許可」か「ブロック」かを判定するツールです。Google Search Console にあった robots.txt テスターは 2023年12月に提供が終わり、今の「robots.txt レポート」では URL ごとの判定ができなくなったため、その代わりに使えるように作りました。判定は Google の仕様(RFC 9309 と Google が公開している robots.txt パーサーのふるまい)に合わせ、Allow と Disallow の両方に一致したら「パターンがいちばん長いルール」を使い、同じ長さなら Allow を使います。「*」は0文字以上の何か、末尾の「$」は URL の終わりとして扱い、パスの大文字小文字を区別し、日本語の URL は %E3%81… の形にそろえて比べます。Googlebot の名前を書いたグループがあると Googlebot は「User-agent: *」のルールを使わないこと、Googlebot-Image は自分のグループがなければ Googlebot のグループに従うこと、AdsBot-Google と AdSense の Mediapartners-Google は「*」を無視すること、Applebot は Googlebot のルールに従うことも反映しています。GPTBot・ClaudeBot・Google-Extended・Applebot-Extended・PerplexityBot・CCBot などの AI クローラーも選べ、AI の学習だけを止める robots.txt を作る機能もあります。書き方のチェックでは、全角の「:」、Disallow に URL を書いた行、User-agent より前のルール、Googlebot-Images のようなクローラー名の間違い、サポートの終わった Noindex、Google が読まない Crawl-delay、パスだけの Sitemap などを行番号つきで知らせます。
robots.txt テスター|URL がブロックされるかの判定・書き方チェック・AI クローラーのブロック生成の使い方
- 1サイトの「https://ドメイン/robots.txt」を開いて中身をコピーし、「robots.txt の中身」に貼りつける
- 2確かめたい URL かパスを1行に1つずつ入れる(https:// からでも /blog/ のようなパスだけでも可)
- 3Googlebot・Bingbot・GPTBot・ClaudeBot など、判定したいクローラーを選ぶ
- 4判定の結果の表で、URL × クローラーごとの「許可」「ブロック」を確かめる
- 5URL を開いて、決め手になったルールの行番号と、使われたグループ(User-agent)を確かめる
- 6「書き方のチェック」でエラー・注意の行を直し、もう一度判定する
- 7AI クローラーを止めたいときは「AI クローラーのブロックを作る」で行を作り、テスト中の robots.txt に足して確かめる
使いやすい場面
- Search Console の robots.txt テスターがなくなったので、代わりに URL がブロックされていないか確かめたい
- robots.txt を書き換える前に、大事なページを誤ってブロックしていないか確かめたい
- Allow と Disallow のどちらが優先されるのか、自分の書き方で実際に試したい
- 「Disallow: /*?」や「Disallow: /*.pdf$」など、ワイルドカードの書き方が意図どおりか確かめたい
- 検索結果ページやパラメータつきの URL だけをクロールから外したい
- GPTBot・ClaudeBot・Google-Extended など、AI の学習用クローラーだけを止める robots.txt を作りたい
- Googlebot 用のグループを足したら、「User-agent: *」のルールが効かなくなっていないか確かめたい
- WordPress の robots.txt で wp-admin の admin-ajax.php が許可されているか確かめたい
- ブログやサイトの引き継ぎで、前任者が書いた robots.txt に間違いがないか点検したい
利用時のポイント
- 判定は Google の読み方に合わせています。Bing など、ほかの検索エンジンや AI のクローラーは細かいところで読み方が違うことがあります。
- Allow と Disallow の両方に一致したときは、パターンの長い(具体的な)ほうを使い、同じ長さなら Allow を使います。上から順に読んで最初に一致したルールを使う、という読み方はしません。
- Googlebot の名前を書いたグループが1つでもあると、Googlebot はそのグループのルールだけを使い、「User-agent: *」のルールは使いません。「*」と同じように止めたいパスは、Googlebot のグループにも書く必要があります。
- Googlebot-Image・Googlebot-Video・Googlebot-News は、自分の名前のグループがなければ Googlebot のグループに、それもなければ「*」に従います。AdsBot-Google と Mediapartners-Google(AdSense)は「*」を無視するので、止めるには名前を書きます。
- パスは大文字小文字を区別します。「Disallow: /Admin/」は /admin/ を止めません。日本語のパスは %E3%81… の形にそろえて比べるので、どちらで書いても同じ URL として判定します。
- robots.txt はクロール(ページの取得)を止めるもので、検索結果に出ないようにするものではありません。ほかのページからリンクされていると、ブロックした URL が説明文なしで検索結果に出ることがあります。検索結果から消したいときは noindex を使い、そのページは robots.txt でブロックしないでください(ブロックすると noindex が読まれません)。
- robots.txt の Noindex は Google が 2019年9月1日にサポートを終了しました。Crawl-delay も Google は読みません。
- robots.txt はドメインごと(サブドメイン、http と https、ポート番号も別)にサイトの一番上に置きます。/blog/robots.txt のような場所に置いても読まれません。
- Google が読むのは robots.txt の先頭 500KiB までです。それより後ろのルールは無視されます。
- AI クローラーの名前(User-agent)は各社が公開しているものです。新しい名前が増えたり変わったりすることがあるので、止める前に各社の案内も確かめてください。robots.txt は守るかどうかがクローラーに任されたお願いで、強制力はありません。
- 貼りつけた robots.txt と URL はこのブラウザの中だけで判定し、サーバーには送りません。サイトにアクセスして robots.txt を取りに行くこともしません。
こんなときに使えます
robots.txt テスター|URL がブロックされるかの判定・書き方チェック・AI クローラーのブロック生成は、次のような場面の答えになります。
- Search Console の robots.txt テスターの代わりになるツールを使いたい
- robots.txt で特定の URL がブロックされているか確かめたい
- robots.txt の Allow と Disallow の優先順位を知りたい
- robots.txt の * と $ の使い方を確かめたい
- User-agent: * と Googlebot の両方を書いたときの動きを知りたい
- robots.txt に書き間違いがないかチェックしたい
- GPTBot や ClaudeBot をブロックする robots.txt の書き方を知りたい
- AI の学習だけを止めて検索には出したい
- robots.txt の noindex や crawl-delay が効いているか知りたい
よくある質問
- Search Console の robots.txt テスターはどこにいきましたか?
- Google Search Console の robots.txt テスターは 2023年12月に提供が終わり、代わりに「設定」の中の「robots.txt レポート」になりました。レポートでは robots.txt を取得できたかやエラーの行は分かりますが、URL を入れてブロックされるかを試す機能はありません。URL ごとの判定は、このツールか、URL 検査ツール(公開中の URL のみ)で確かめられます。
- Allow と Disallow の両方に一致したら、どちらが優先されますか?
- Google は、パターンがいちばん長い(具体的な)ルールを使います。たとえば「Disallow: /blog/」と「Allow: /blog/public/」なら、/blog/public/a.html は長いほうの Allow が勝って許可です。同じ長さのときは Allow(制限の少ないほう)を使います。書いた順番は関係ありません。
- User-agent: * と User-agent: Googlebot の両方を書くとどうなりますか?
- Googlebot は自分の名前のグループだけを使い、「User-agent: *」のグループのルールは一切使いません。「*」でブロックしているパスを Googlebot にも止めたいときは、Googlebot のグループにも同じ Disallow を書く必要があります。
- robots.txt の * と $ はどういう意味ですか?
- 「*」は0文字以上のどんな文字にも一致し、「$」はパターンの最後に置いたときだけ「URL の終わり」を意味します。「Disallow: /*.pdf$」は .pdf で終わる URL を止め、/a.pdf?download=1 のようにあとにクエリが続く URL は止めません。パターンの末尾の「*」は意味がなく、「/fish*」は「/fish」と同じです。
- Disallow: /fish と Disallow: /fish/ は違いますか?
- 違います。「/fish」は前方一致なので、/fish.html や /fishheads も止めます。「/fish/」はフォルダの中だけを止め、/fish や /fish.html は止めません。
- robots.txt でブロックすれば検索結果から消えますか?
- 消えるとは限りません。robots.txt はクロールを止めるだけなので、ほかのページからリンクされている URL は、中身なしで検索結果に出ることがあります。検索結果から消したいときは、ページに noindex を入れ、そのページは robots.txt でブロックしないでください。ブロックすると Googlebot が noindex を読めません。
- ChatGPT や Claude などの AI にサイトを学習させないようにするには?
- robots.txt で、OpenAI の GPTBot、Anthropic の ClaudeBot、Google の Google-Extended、Apple の Applebot-Extended、Common Crawl の CCBot などを「Disallow: /」でブロックします。Google-Extended と Applebot-Extended を止めても、Google 検索・Apple の検索での表示には影響しません。OAI-SearchBot や Claude-SearchBot、PerplexityBot は AI の検索の回答に使うクローラーなので、止めるとその回答で紹介されにくくなります。
- Crawl-delay を書けば Googlebot のクロールを遅くできますか?
- できません。Google は Crawl-delay を読みません。Googlebot はサーバーの応答の速さやエラーに合わせて自動で頻度を調整します。Bing や Yandex は Crawl-delay を読みます。
- 日本語の URL は robots.txt にどう書けばいいですか?
- 「Disallow: /カテゴリ/」のように日本語のまま書いても、「Disallow: /%E3%82%AB%E3%83%86%E3%82%B4%E3%83%AA/」のように %エンコードして書いても、Google は同じものとして扱います。ファイルは UTF-8 で保存してください。このツールも両方の書き方を同じ URL として判定します。
ARTICLES
robots.txt テスター|URL がブロックされるかの判定・書き方チェック・AI クローラーのブロック生成の使い方ガイド
Special Thanks