無料オンラインツール

サイトマップ 抽出

ドメインを入力すると、サイトが sitemap で公開している全 URL を取得します。セクション別に整理・検索でき、そのまま出力や Markdown 変換に使えます。

例
読み取り元
  1. robots.txt
  2. sitemap.xml
  3. sitemap_index.xml
  4. .xml.gz
  5. ページ内リンク(フォールバック)
仕組み

推測ではなく、サイトが公開する sitemap を読む

  1. ドメインを入力

    example.com だけで十分です。サイト内のどの URL を入れても同じ結果になり、同じホスト名の URL だけが残ります。

  2. サイトマップを自動検出

    robots.txt の Sitemap: 指定を優先し、次に一般的なパスを確認します。インデックスや gzip も自動で展開します。

  3. 閲覧・絞り込み・出力

    URL は第 1 階層のセクションごとに整理されます。キーワードで絞り込み、TXT・CSV で出力、各ページを Markdown に変換できます。

活用例

全 URL リストの使いどころ

SEO 監査

検索エンジンに実際に送っているページを確認。紛れ込んだテストページ、抜けているセクション、インデックス不要な URL を洗い出せます。

サイト移行

旧サイトの URL 一覧を CSV で出力し、切り替え前のリダイレクト設計の元リストにできます。

クロールと RAG

リンクをたどる代わりに、クロール対象のページ一覧を正確に取得。各ページを Markdown にしてインデックスへ。

コンテンツ調査

競合がドキュメント、ブログ、LP をどう構成し、各セクションに何ページあるかを把握できます。

よくある質問

URL 一覧はどこから取得していますか?

サイトが公開している XML サイトマップです。まず robots.txt の Sitemap: 指定を読み、次に /sitemap.xml、/sitemap_index.xml、/sitemap-index.xml、/sitemap.xml.gz を確認します。インデックスは 1 階層展開します。

サイトマップがないサイトは?

入力したページ内のリンクを同じホスト名で絞り込んで返します。通常、本来のサイトマップよりかなり少なくなります。

URL 数に上限はありますか?

1 回の抽出で最大 5,000 件、サイトマップの記載順です。docs.example.com のようなサブドメインは独自のサイトマップを持つため、個別に抽出できます。

無料ですか?

はい。ログインなしで 1 日 10 回使えます。無料アカウントでは 1 回ごとに自分の API キーから 1 クレジットを消費し、新規アカウントには 100 クレジットが付与されます。

結果を出力できますか?

できます。全 URL をクリップボードにコピー、.txt で一覧を保存、または URL・パス・セクションを含む .csv をダウンロードできます。

コードから使えますか?

このページは Search1API の /sitemap エンドポイントで動いています。同じリクエストを REST API、SDK、MCP サーバーから実行できます。

自分のコードからサイトマップを取得

同じサイトマップ抽出が POST リクエスト 1 回で使えます。/crawl と組み合わせれば、全ページを Markdown に変換できます。