検索ブランド相談室 | 検索と評判の専門メディア

SEOのインデックス監査方法|Search Consoleで未登録・除外・重複URLを診断する

部署:マーケティング担当者レベル:実践
Search Consoleのインデックス状況を確認しながら重要URLを監査するSEO担当者の手元

Search Consoleで「インデックス未登録」が増えていても、すべてが修正対象とは限りません。重複URL、リダイレクト元、意図的なnoindexなどは未登録でも正常です。インデックス監査で重要なのは、検索結果に出したい正規URLが登録され、不要URLが意図どおり除外されているかを確認することです。この記事では、監査対象の決め方から未登録理由の分類、URL検査、canonical・noindex・robots.txt・サイトマップ・内部リンクの確認、修正優先順位、再検証までを整理します。

インデックス監査を含むクロール・正規化・構造化・表示などテクニカルSEO全体は「テクニカルSEOの実務チェックリスト」で整理しています。

インデックス監査は「未登録をゼロにする作業」ではない

SEOのインデックス監査とは、サイト内URLの発見・クロール・インデックス状態が、運営側の意図と一致しているかを確認する作業です。

Google Search Consoleも、重複URL、noindex、robots.txtによる制御、削除済みURLなどが未登録になることは正常だと案内しています。そこで、最初に次の4分類を作ります。

運営側の意図Googleの状態判断
インデックスさせたい登録済み原則正常
インデックスさせたい未登録原因調査・修正候補
インデックスさせたくない未登録原則正常
インデックスさせたくない登録済み制御方法を確認
インデックスさせたいかどうかとGoogleの登録状態を組み合わせた4分類マトリクス

インデックス監査では、未登録URLの件数ではなく、運営側の意図とGoogleの状態が一致しているかを確認します。

見るべき数字は未登録URLの総数ではなく、本来インデックスされるべき重要URLが未登録になっていないかです。

STEP1|「インデックスさせたいURL」の母集団を作る

Search Consoleを見る前に、検索結果へ表示したい正規URLの一覧を作ります。オウンドメディアなら公開記事、ピラーページ、主要カテゴリ、サービスページ、事例ページなどが対象です。一方、管理画面、検索結果ページ、重複パラメータURL、テストURL、リダイレクト元などは原則として対象外です。

CMSの公開URL一覧、XMLサイトマップ、サイトクロール結果を突き合わせ、「検索結果に出したい正規URL」を監査母集団にします。

Googleは、サイトマップには検索結果に表示したいURLを含めるよう案内しています。1サイトマップの上限は非圧縮50MBまたは50,000URLです。大規模サイトでは記事・商品・カテゴリなどに分けると、URL群ごとの異常を追いやすくなります。

STEP2|Search Consoleの未登録理由を分類する

「ページのインデックス登録」レポートでは、登録済み・未登録の総数より「なぜ登録されなかったか」の内訳を見ます。

主な状態初期判断最初の確認
クロール済み – インデックス未登録要調査URL検査、重複、内容、内部リンク
検出 – インデックス未登録要調査サイトマップ、内部リンク、サーバー
noindexタグによって除外意図確認meta robots、X-Robots-Tag
robots.txtによりブロック意図確認robots.txt
代替ページ(適切なcanonicalあり)多くは正常canonical先
Googleが別URLを正規URLとして選択要確認Google選択canonical
リダイレクトのあるページ多くは正常転送先

件数が多い理由から機械的に直すのではなく、重要URLが含まれる状態を優先します。主要サービスページ1件の誤noindexは、不要なパラメータURLが多数除外されている状態より優先度が高いからです。

STEP3|重要URLはURL検査で個別確認する

サイト全体の傾向はページのインデックス登録レポートで見て、重要URLの原因特定にはURL検査ツールを使います。

主な確認項目は、インデックス登録の有無、検出元、最終クロール日時、クロール可否、取得成功、インデックス可否、ユーザー指定canonical、Google選択canonicalです。

URL検査に表示される登録済み情報は、Googleが最後に取得した状態であり、現在公開中のページと一致しない場合があります。設定変更直後はライブテストで現在のHTML・HTTP応答を確認してください。ただし、ライブテストで「インデックス登録可能」と出ても、実際の登録を保証するものではありません。

STEP4|noindex・robots.txt・HTTPステータスを先に確認する

本来インデックスさせたいURLが未登録なら、本文を直す前に明確な技術制御を確認します。

noindexはHTMLだけでなく、HTTPレスポンスの`X-Robots-Tag`でも指定できます。

“`html <meta name=”robots” content=”noindex”> “`

“`text X-Robots-Tag: noindex “`

Googleがnoindexを認識するにはページをクロールできる必要があります。noindexを付けたURLをrobots.txtでもブロックすると、Googlebotがnoindexを読み取れない場合があります。

robots.txtでは、記事やサービスページを意図せず止めていないか確認します。リニューアル直後は、開発環境用の全体ブロックが本番に残っていないかも要確認です。

さらに、重要ページが200を返しているか、5xx、認証要求、意図しないリダイレクトなどがないかを見ます。

STEP5|canonicalは「指定」ではなくGoogleの選択まで見る

canonicalは、重複・類似URLの中で代表として扱ってほしいURLを伝える仕組みです。ただし強制命令ではありません。Googleはリダイレクト、サイトマップ、`rel=”canonical”`など複数のシグナルから正規URLを選び、運営者の指定とは異なるURLを選ぶことがあります。

重複URL、誤指定、自己参照、Google選択URLとの不一致をURL単位で確認する手順は「canonicalタグの監査方法」で詳しく解説しています。

監査では、self canonical、canonical先の200応答、noindexの有無、内部リンクの向き先、サイトマップ掲載URLを確認し、最後にURL検査の「Googleが選択した正規URL」と照合します。

canonical指定と内部リンク、XMLサイトマップ、リダイレクトをGoogle選択canonicalと照合する図

canonical監査ではタグの有無だけでなく、複数シグナルとGoogleが実際に選んだ正規URLの一致を確認します。

パラメータURLが除外され、意図した通常URLが正規URLなら多くの場合は正常です。一方、重要記事が別記事の重複としてまとめられている場合は、技術指定だけでなくページ同士の内容差も見直します。

STEP6|「クロール済み」と「検出済み」を分けて診断する

「クロール済み – インデックス未登録」は、GoogleがURLを取得したものの現在は登録していない状態です。200、noindex、canonical、レンダリング結果が正常なら、類似ページとの重複、固有情報、内部リンク、サイト内での位置づけを確認します。インデックス登録リクエストだけを繰り返すのではなく、原因を修正することが先です。

クロール済み未登録と検出済み未登録で確認項目を分けたインデックス監査の診断フロー

クロール済みか、まだクロールされていないかで、確認すべき原因は変わります。

「検出 – インデックス未登録」は、URLの存在を認識しているものの、まだクロールしていない状態です。XMLサイトマップ、重要ページからの内部リンク、不要URLの大量発生、サーバーの安定性などを確認します。

同じ未登録でも、Googleがどこまで処理しているかによって見る場所を変えるのがポイントです。

STEP7|XMLサイトマップと内部リンクの整合を確認する

サイトマップは、原則として200を返し、noindexではなく、正規URLとして扱いたい公開中ページに揃えます。404、リダイレクト元、noindex、非canonical URLが混ざっていれば整理します。

掲載URL・lastmod・分割・Search Consoleの送信エラーまで確認する手順は「XMLサイトマップのSEO監査方法」で詳しく解説しています。

同時に、重要ページがサイト内からクロール可能なリンクでつながっているかも確認します。Googleはリンクを新しいページの発見や関連性判断に使っています。

特に改善候補になるのは、サイトマップにはあるが内部リンクがないURL、カテゴリやピラー記事から辿れない重要記事、非canonical URLへ向く内部リンクです。

STEP8|修正優先順位は件数ではなく事業影響で決める

監査後は、原因件数の多い順ではなく、重要URLへの影響で対応順を決めます。

優先度状態対応
最優先主要LP・重要記事の誤noindex、誤canonical、クロール不可、5xx即時修正
重要URLのクロール済み未登録重複・固有性・内部リンクを診断
重要URLの検出済み未クロール発見経路・URL量・サーバーを確認
非canonical URLが大量発生URL生成・canonical・内部リンクを整理
意図した重複・リダイレクト元・noindex URLが未登録原則経過観察
インデックス問題を事業影響と深刻度で分類した修正優先順位マトリクス

未登録URLの件数ではなく、重要ページへの影響と問題の深刻度から対応順を決めます。

監査表には「URL」「ページ種別」「インデックスさせたいか」「Search Console状態」「原因」「事業重要度」「対応」「修正日」「再確認日」を持たせると、定点観測しやすくなります。

STEP9|修正後は再検証する

修正しただけでは監査完了ではありません。ブラウザ・HTTPレスポンスで反映を確認し、URL検査のライブテストを実行します。重要URLは必要に応じてインデックス登録をリクエストし、その後、ページのインデックス登録レポートとGoogle選択canonicalの変化を追います。

canonicalの再評価は即時とは限りません。Googleは、重複クラスタの再評価に最大2週間程度かかる場合があると案内しています。修正日と再確認結果を記録し、同じURLを継続して追えるようにしてください。

インデックス監査のチェックリスト

  • 検索結果に出したい正規URL一覧がある
  • Search Consoleの未登録理由を分類した
  • 重要URLをURL検査した
  • 意図しないnoindex・robots.txt制御がない
  • HTTPステータスと取得が正常
  • ユーザー指定canonicalとGoogle選択canonicalを確認した
  • サイトマップは正規URL中心になっている
  • 重要ページが孤立していない
  • クロール済み・検出済み未登録を分けて診断した
  • 修正後にライブテストと再確認を行った

通常運用では月次の確認を基本にし、サイトリニューアル、URL変更、CMS・テンプレート変更、大量公開の後は追加監査すると異常を早く発見できます。

まとめ

SEOのインデックス監査では、未登録URLをゼロにすることではなく、「検索結果に出したい正規URLが登録されているか」を確認します。

まず監査母集団を定義し、Search Consoleで未登録理由を分類します。重要URLはURL検査を使い、noindex、robots.txt、HTTPステータス、canonical、重複、サイトマップ、内部リンクの順に原因を切り分けます。

修正優先順位は件数ではなく事業影響で決めてください。必要なページが正しく登録され、不要URLが意図どおり除外されている状態を維持することが、インデックス監査のゴールです。

参考文献・データ元

この記事で参照した情報を確認できます。

‹ 親記事: テクニカルSEOとは?クロールからセキュリティまで、企業担当者が押さえるべき7領域の実務チェックリスト

このテーマの記事

関連記事

関連テーマ