robots.txt作成・テスト

User-agentごとのAllow・Disallowルールとサイトマップからrobots.txtを作成し、指定したURLをクローラーが巡回できるかをRFC 9309の規則でテストできます。

robots.txtはクローラーに「どこを巡回してよいか」を伝えるファイルです。検索結果からの削除や非表示(インデックスの制御)にはnoindexや各検索エンジンの削除ツールを使います。また、アクセス制限やセキュリティ対策にはなりません。従うかどうかはクローラー次第で、ファイルは誰でも読めます。

ひな形

AIクローラーの名前は一例です。名前は変わることがあり、従うかどうかは各事業者の任意です。最新の名前は各社の資料で確認してください。

編集方法

パスは / から始めます。* は任意の文字列、末尾の $ はURLの終わりを表します(例:/*.pdf$)。空のDisallowはすべて許可です。

URLのテスト

クローラーがこのrobots.txtに従った場合に巡回できるかを、RFC 9309の規則で判定します。

使い方

  1. ひな形を選ぶか、グループごとにUser-agentとAllow・Disallowのルールを入力します。必要ならSitemapのURLも入力します。
  2. 下の欄にrobots.txtが表示されます。「テキストを直接編集」を選ぶと、今あるrobots.txtを貼り付けて確認・修正できます。
  3. 「URLのテスト」にクローラー名とURLを入力すると、許可か拒否か、どのルールが使われたかが表示されます。
  4. 「コピー」または「robots.txtを保存」で取り出し、サイトのルート(https://example.com/robots.txt)に置きます。

注意事項

  • robots.txtは巡回(クロール)の指示で、インデックスの制御ではありません。拒否したページも、他のサイトからリンクされていれば検索結果にURLが表示されることがあります。検索結果から外すにはnoindexや削除ツールを使います(noindexはクローラーがページを読めないと機能しません)。
  • アクセス制限やセキュリティの手段ではありません。従うかどうかはクローラー次第で、robots.txtは誰でも読めるため、非公開にしたいパスを書くと逆に場所を知らせることになります。
  • AIクローラーのひな形は例です。名前は変わることがあり、すべてのAIサービスを網羅しているわけではありません。
  • テストはRFC 9309の規則による判定です。クローラーによっては独自の解釈(Crawl-delayへの対応など)をする場合があります。

計算・変換の仕組み

グループの選択:クローラー名(製品トークン)と大文字・小文字を区別せずに一致するUser-agentのグループを使い、同じ名前のグループが複数あれば結合します。一致するグループがなければ * のグループを使い、それもなければすべて許可です。

ルールの選択:URLのパス(クエリを含む)の先頭から一致するルールのうち、パスが最も長い(バイト数が多い)ものを使います。同じ長さのAllowとDisallowが一致した場合はAllowを優先します。一致するルールがなければ許可です。/robots.txt は常に許可です。

* は任意の文字列、末尾の $ はURLの終わりに一致します。日本語などの文字と %XX のパーセントエンコードは同じものとして比較し、パスの大文字・小文字は区別します。

よくある質問

robots.txtで検索結果から消せますか?

いいえ。robots.txtは巡回を止めるだけです。検索結果から消すには、ページにnoindexを設定し、クローラーが読めるようにしたうえで、検索エンジンの削除ツールを使います。

AIの学習に使われないようにできますか?

AIクローラーの名前を指定して拒否することはできますが、従うかどうかは各事業者の任意で、名前も変わることがあります。確実に防ぐ方法ではありません。

Crawl-delayは使えますか?

RFC 9309の規格には含まれず、Googleは無視します。一部のクローラーは対応しているため、テキスト編集で書くことはできますが、このツールでは注意として表示します。

入力した内容は送信されますか?

いいえ。作成とテストはブラウザ内で行い、入力内容を送信・保存しません。

最終更新日: