SEO ツール · 外部取得は行いません

robots.txt 生成とテスト

robots.txt のルールを生成し、特定のパスが許可されるかを最長一致規則で判定します。

入力

結果

User-agent: *
Disallow: /admin
Disallow: /private
Allow: /admin/public

Sitemap: https://example.com/sitemap.xml

テストするパス

クロール許可適用されたルール: Allow: /admin/public

このツールについて

User-agent グループごとに Disallow と Allow を設定し、サイトマップの場所を加えると標準的な robots.txt が生成されます。同じページでテストもできます。パスとクローラー名を入力すると、許可か拒否か、そしてどのルールが効いたかを表示します。判定は Google と Bing の**最長一致**規則に従います。一致したパスが最も長い(具体的な)ものが優先され、長さが同じなら Allow が優先されます。「上から最初に一致したもの」という直感とは異なり、誤解が生じやすい点です。

操作手順

  1. User-agent グループと Disallow・Allow のパスを設定します。
  2. サイトマップ URL を追加します。
  3. テスト欄にパスを入力し、判定と適用されたルールを確認します。

制限と注意

Google と Bing の最長一致規則を適用します。robots.txt はクロールを制御するもので、インデックス登録を防ぐものではありません。

プライバシー

貼り付けた HTML・URL・文章はこのブラウザ内でのみ分析され、送信も保存も記録もされません。

よくある質問

Disallow でページを検索結果から消せますか。
消せません。robots.txt が制御するのはクロールであり、インデックス登録ではありません。Disallow された URL でも外部リンクがあれば、説明のない URL のみの形で検索結果に出ることがあります。確実に載せないためにはクローラーがページを読めるようにしたうえで `noindex` を置く必要があり、そのページを同時に Disallow してはいけません。
なぜ最初の一致ではなく最長一致なのですか。
Google と Bing の実装はすべてのルールを評価し、一致したパスが最も長い(最も具体的な)ものを採用し、同じ長さなら Allow を優先します。そのため `Disallow: /admin` と `Allow: /admin/public` があると、Disallow が先にあっても `/admin/public/x` は許可されます。本ツールのテストもこの規則に従います。