無料サイトマップチェッカー

検索エンジンとAIの発見性を低下させるXMLサイトマップの構造的な問題を検証します。サイトマップ構造をチェックし、問題を即座に報告します。

登録不要サイトマップインデックス対応即時結果

サイトマップとは?

XMLサイトマップは、ウェブサイト上のURLを最終更新日や更新頻度などのメタデータとともにリストしたファイルです。検索エンジンとAIクローラーがページを発見し、インデックスの優先順位を決定するのに役立ちます。

なぜ重要か

  • 重要なページが検索エンジンとAIクローラーに発見されることを保証
  • コンテンツの最終更新日をクローラーに伝え、より新鮮なインデックスを実現
  • クロール効率を向上 — クローラーが重要なページに集中

よくある問題

  • サイトマップの欠落 — クローラーがどのページが存在するか推測に依存
  • 無効なXML — 壊れたサイトマップはクローラーに黙って無視される
  • 重複URL — クロールバジェットの浪費と矛盾するシグナル

よくある質問

サイトマップチェッカーは、XMLサイトマップを検出して検証します。robots.txtのサイトマップ参照をチェックし、サイトマップインデックスとURLセットを解析し、XML構造を検証し、重複URLを検出し、検索エンジンとAIアシスタントがコンテンツを適切にインデックスするのを妨げる問題を報告します。

ChatGPT、Gemini、Claude、PerplexityなどのAIアシスタントは、知識を構築するためにウェブクロールに依存しています。サイトマップは、サイト上にどのページが存在し、いつ最後に更新されたかをクローラーに正確に伝えます。有効なサイトマップがないと、AIクローラーは重要なページを見逃したり、無関係なページに時間を浪費する可能性があります — AI生成回答で引用される可能性が低下します。

壊れた・到達不能なサイトマップ、無効なXML構文、必須要素の欠落、サイトマップ間の重複URL、推奨される深さを超えるサイトマップインデックスのネスト、サイトマップあたり50,000エントリの制限を超えるURLを検出します。各問題はエラー、警告、または情報として分類されます。

サイトマップインデックス(sitemapindex)は、他のサイトマップファイルを参照するファイルで、目次のような役割を果たします。URLセット(urlset)は、最終更新日や更新頻度などのオプションのメタデータを持つ実際のページURLを含みます。大規模サイトでは通常、最大50,000URLを含む複数のURLセットサイトマップを指すサイトマップインデックスを使用します。

はい。GeoVectorのサイトマップチェッカーは完全無料で、登録不要です。無料版では最大10,000URLのサイトマップ構造とXML検証をチェックできます。URL到達可能性チェック、壊れたリンクの検出、継続的なモニタリングなどのより詳細な分析には、GeoVectorのプレミアムプランをご利用ください。

ページの追加・削除、URL構造の変更、CMSの更新、サイト変更のデプロイ時にサイトマップをチェックすべきです。アクティブなサイトでは、月次チェックが推奨されます。壊れたサイトマップは、検索エンジンとAIアシスタントが最新のコンテンツを発見するのを静かに妨げる可能性があります。

サイトマップの上限と、このスキャンの扱い

仕様には厳格な上限があります。この無料スキャンは1回の確認を速く終わらせるため、より低い独自の上限を適用します。有料監査はツリー全体をたどります。

LimitSpecificationWhat this scan does
URLs per sitemap file50,000This scan reads up to 10,000 and then reports MAX_URLS_REACHED.
Uncompressed size per file50 MBSplit past the limit and list the parts in a sitemap index.
Sitemaps per index file50,000This scan fetches up to 100 files per run.
Index nesting depthOne level in the specificationThis scan follows three levels before reporting MAX_DEPTH_EXCEEDED.
URL scopeSame protocol and host, at or below the sitemap file's own directoryA sitemap at /catalog/sitemap.xml only affects /catalog/. Google lifts that restriction for sitemaps submitted through Search Console, which also allows cross-submitting URLs for other verified sites.

正しいサイトマップXMLの形

2種類のファイルが1つの名前空間を共有します。urlset はページを、sitemapindex は他のサイトマップファイルを列挙します。

urlset — ページの一覧
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <url>
    <loc>https://example.com/</loc>
    <lastmod>2026-08-01</lastmod>
  </url>
  <url>
    <loc>https://example.com/pricing</loc>
    <lastmod>2026-07-18</lastmod>
  </url>
</urlset>
sitemapindex — サイトマップの一覧
<?xml version="1.0" encoding="UTF-8"?>
<sitemapindex xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <sitemap>
    <loc>https://example.com/sitemap-pages.xml</loc>
    <lastmod>2026-08-01</lastmod>
  </sitemap>
  <sitemap>
    <loc>https://example.com/sitemap-blog.xml</loc>
    <lastmod>2026-08-05</lastmod>
  </sitemap>
</sitemapindex>
robots.txt から参照する
User-agent: *
Allow: /

Sitemap: https://example.com/sitemap.xml

lastmod は正確なときにだけ意味を持ちます。デプロイのたびにビルドが全URLへ当日の日付を刻むと、クローラーはこのフィールドを無視するようになります。失うのは「実際に何が変わったか」を伝えられる唯一のシグナルです。

このスキャンが返す問題コード

Error はクローラーがそのサイトマップを利用できない状態です。Warning は利用できるものの、内容に誤解を招く点があることを示します。

CodeSeverityWhat triggers it
NO_SITEMAP_FOUNDErrorNothing in robots.txt and no /sitemap.xml. Crawlers fall back to link discovery only.
SITEMAP_HTTP_ERRORErrorThe sitemap URL returned 4xx or 5xx. A referenced-but-broken sitemap is worse than none.
SITEMAP_REDIRECTEDErrorThe sitemap redirects. Point robots.txt at the final URL.
DUPLICATE_URLWarningThe same URL appears more than once across your sitemaps.
MAX_DEPTH_EXCEEDEDWarningIndexes nested more than three deep. Flatten the hierarchy.
URL_INACCESSIBLEWarningA listed URL did not respond with 200 when accessibility checking is on.
URL_REDIRECTEDInfoA listed URL redirects. List destinations, not redirects.

出典と仕様

このページの内容はすべて、以下の一次資料に照らして確認しています。ベンダーがルールを変更したときは、まずそこに現れます。

最終確認日: 。ベンダーが仕様を更新するたびに、このページを原典と突き合わせて見直しています。

無料サイトマップチェッカー | GeoVector