robots.txtでクロールがブロックされている

robots.txtでブロックされたURLは、検索エンジンがページの中身を取得できません。意図的なら正しい設定ですが、意図せずブロックしていると、そのページは内容を評価されないまま検索結果から実質的に外れます。

公開日: 2026年8月16日 / 最終更新日: 2026年9月6日

カテゴリ: クロール / 影響度: 高 / 想定工数: 1時間 / ルールID: robots_blocked

この問題の意味

robots.txtは、クローラーに対して「このURLは取得しないでほしい」と伝えるファイルです。あくまでクロール(取得)の制御であり、インデックス(検索結果への登録)の制御ではありません。

この違いが重要です。ブロックされたURLでも、外部からリンクされていればURL自体は検索結果に出ることがあります。ただし中身を取得できないため、説明文が表示されない不自然な状態になります。

noindexとの違い、そして併用してはいけない理由

robots.txtは「取得するな」、noindexは「検索結果に出すな」です。目的が違います。

検索結果から確実に外したい場合、robots.txtでブロックしてはいけません。ブロックすると検索エンジンはページを取得できず、HTMLに書かれたnoindexを読むことができないためです。結果として、noindexが効かないままURLが残り続けます。

正しい手順は、クロールは許可したうえでnoindexを設定することです。検索結果から消えたことを確認してから、必要であればrobots.txtでのブロックを追加します。

よくある発生原因

Smash SEOの検出条件

クロール実行時にrobots.txtを取得し、各URLがクロール許可されているかを判定します。ブロックされているURLはクロールをスキップし、その事実を診断結果に記録します。

つまり、この項目に挙がったURLは「Smash SEOも取得できなかったURL」です。検索エンジンから見ても同じ状態になります。

直し方

robots.txtの基本形

User-agent: *
Allow: /
Disallow: /admin
Disallow: /mypage

Sitemap: https://example.com/sitemap.xml

修正後の確認方法

よくある質問

robots.txtでブロックすれば検索結果から消えますか?

消えるとは限りません。外部リンクがあればURLだけが検索結果に残ることがあります。確実に消すにはクロールを許可したうえでnoindexを使います。

CSSやJSをブロックすると何が起きますか?

検索エンジンがページを正しく描画できず、モバイル対応やレイアウトの評価が正しく行われない可能性があります。ブロックしないでください。

関連記事

この問題が自分のサイトで起きているかは、URLを入力するだけで確認できます。 無料で診断するルール一覧料金プラン