サイトマップ 抽出
ドメインを入力すると、サイトが sitemap で公開している全 URL を取得します。セクション別に整理・検索でき、そのまま出力や Markdown 変換に使えます。
- robots.txt
- sitemap.xml
- sitemap_index.xml
- .xml.gz
- ページ内リンク(フォールバック)
推測ではなく、サイトが公開する sitemap を読む
ドメインを入力
example.com だけで十分です。サイト内のどの URL を入れても同じ結果になり、同じホスト名の URL だけが残ります。
サイトマップを自動検出
robots.txt の Sitemap: 指定を優先し、次に一般的なパスを確認します。インデックスや gzip も自動で展開します。
閲覧・絞り込み・出力
URL は第 1 階層のセクションごとに整理されます。キーワードで絞り込み、TXT・CSV で出力、各ページを Markdown に変換できます。
全 URL リストの使いどころ
SEO 監査
検索エンジンに実際に送っているページを確認。紛れ込んだテストページ、抜けているセクション、インデックス不要な URL を洗い出せます。
サイト移行
旧サイトの URL 一覧を CSV で出力し、切り替え前のリダイレクト設計の元リストにできます。
クロールと RAG
リンクをたどる代わりに、クロール対象のページ一覧を正確に取得。各ページを Markdown にしてインデックスへ。
コンテンツ調査
競合がドキュメント、ブログ、LP をどう構成し、各セクションに何ページあるかを把握できます。
よくある質問
URL 一覧はどこから取得していますか?
サイトが公開している XML サイトマップです。まず robots.txt の Sitemap: 指定を読み、次に /sitemap.xml、/sitemap_index.xml、/sitemap-index.xml、/sitemap.xml.gz を確認します。インデックスは 1 階層展開します。
サイトマップがないサイトは?
入力したページ内のリンクを同じホスト名で絞り込んで返します。通常、本来のサイトマップよりかなり少なくなります。
URL 数に上限はありますか?
1 回の抽出で最大 5,000 件、サイトマップの記載順です。docs.example.com のようなサブドメインは独自のサイトマップを持つため、個別に抽出できます。
無料ですか?
はい。ログインなしで 1 日 10 回使えます。無料アカウントでは 1 回ごとに自分の API キーから 1 クレジットを消費し、新規アカウントには 100 クレジットが付与されます。
結果を出力できますか?
できます。全 URL をクリップボードにコピー、.txt で一覧を保存、または URL・パス・セクションを含む .csv をダウンロードできます。
コードから使えますか?
このページは Search1API の /sitemap エンドポイントで動いています。同じリクエストを REST API、SDK、MCP サーバーから実行できます。
自分のコードからサイトマップを取得
同じサイトマップ抽出が POST リクエスト 1 回で使えます。/crawl と組み合わせれば、全ページを Markdown に変換できます。