robots.txt作成・テスト
User-agentごとのAllow・Disallowルールとサイトマップからrobots.txtを作成し、指定したURLをクローラーが巡回できるかをRFC 9309の規則でテストできます。
robots.txtはクローラーに「どこを巡回してよいか」を伝えるファイルです。検索結果からの削除や非表示(インデックスの制御)にはnoindexや各検索エンジンの削除ツールを使います。また、アクセス制限やセキュリティ対策にはなりません。従うかどうかはクローラー次第で、ファイルは誰でも読めます。
AIクローラーの名前は一例です。名前は変わることがあり、従うかどうかは各事業者の任意です。最新の名前は各社の資料で確認してください。
フォームに戻したため、コメントや対応していない行は取り除かれました。
パスは / から始めます。* は任意の文字列、末尾の $ はURLの終わりを表します(例:/*.pdf$)。空のDisallowはすべて許可です。
確認してください
URLのテスト
クローラーがこのrobots.txtに従った場合に巡回できるかを、RFC 9309の規則で判定します。
使い方
- ひな形を選ぶか、グループごとにUser-agentとAllow・Disallowのルールを入力します。必要ならSitemapのURLも入力します。
- 下の欄にrobots.txtが表示されます。「テキストを直接編集」を選ぶと、今あるrobots.txtを貼り付けて確認・修正できます。
- 「URLのテスト」にクローラー名とURLを入力すると、許可か拒否か、どのルールが使われたかが表示されます。
- 「コピー」または「robots.txtを保存」で取り出し、サイトのルート(https://example.com/robots.txt)に置きます。
注意事項
- robots.txtは巡回(クロール)の指示で、インデックスの制御ではありません。拒否したページも、他のサイトからリンクされていれば検索結果にURLが表示されることがあります。検索結果から外すにはnoindexや削除ツールを使います(noindexはクローラーがページを読めないと機能しません)。
- アクセス制限やセキュリティの手段ではありません。従うかどうかはクローラー次第で、robots.txtは誰でも読めるため、非公開にしたいパスを書くと逆に場所を知らせることになります。
- AIクローラーのひな形は例です。名前は変わることがあり、すべてのAIサービスを網羅しているわけではありません。
- テストはRFC 9309の規則による判定です。クローラーによっては独自の解釈(Crawl-delayへの対応など)をする場合があります。
計算・変換の仕組み
グループの選択:クローラー名(製品トークン)と大文字・小文字を区別せずに一致するUser-agentのグループを使い、同じ名前のグループが複数あれば結合します。一致するグループがなければ * のグループを使い、それもなければすべて許可です。
ルールの選択:URLのパス(クエリを含む)の先頭から一致するルールのうち、パスが最も長い(バイト数が多い)ものを使います。同じ長さのAllowとDisallowが一致した場合はAllowを優先します。一致するルールがなければ許可です。/robots.txt は常に許可です。
* は任意の文字列、末尾の $ はURLの終わりに一致します。日本語などの文字と %XX のパーセントエンコードは同じものとして比較し、パスの大文字・小文字は区別します。
よくある質問
robots.txtで検索結果から消せますか?
いいえ。robots.txtは巡回を止めるだけです。検索結果から消すには、ページにnoindexを設定し、クローラーが読めるようにしたうえで、検索エンジンの削除ツールを使います。
AIの学習に使われないようにできますか?
AIクローラーの名前を指定して拒否することはできますが、従うかどうかは各事業者の任意で、名前も変わることがあります。確実に防ぐ方法ではありません。
Crawl-delayは使えますか?
RFC 9309の規格には含まれず、Googleは無視します。一部のクローラーは対応しているため、テキスト編集で書くことはできますが、このツールでは注意として表示します。
入力した内容は送信されますか?
いいえ。作成とテストはブラウザ内で行い、入力内容を送信・保存しません。
関連する使い方ガイド
- メタタグの書き方と検索結果・SNSプレビューの確認方法ページのタイトル・説明文・正規URL・Open Graphの書き方と、長さの目安やプレビューの見方、robotsや画像でよくある間違いを説明します。
関連ツール
最終更新日: