論文とプレプリントを検索する arXiv 検索 API
arXiv を HTTP で検索し、著者・投稿日・アブストラクトを 1 つのフィールドで取得します。公式インターフェースが返す Atom フィードのパースは不要です。
エンドポイントPOST https://api.search1api.com/search
結果は他のエンジンと同じ JSON 形式で返るため、既存のパース処理をそのまま利用できます。
リンクは arxiv.org の論文ページを指します。
スニペットは著者リストと ISO 形式の日付から始まります。
スニペットの残りは論文のアブストラクトです。
主な用途
文献調査 / リサーチエージェント / 動向追跡
Atom ではなく JSON で受け取るプレプリント
`search_service` に `arxiv` を指定すると、arXiv から結果が返ります。エンドポイント、認証方式、レスポンス構造は他のエンジンと同じで、専用のフィードパーサーは必要ありません。
スニペット内の引用情報
`snippet` フィールドの形式は「著者 | 日付 | アブストラクト」で、追加リクエストなしで引用を組み立てられます。
ISO 形式の投稿日
日付は `YYYY-MM-DD` で返るため、正規化なしでソートとフィルタが可能です。
タイトルだけでなくアブストラクトも
アブストラクトがスニペットに含まれるため、論文を取得するかどうかを判断する前に関連性を評価できます。
標準の Search パラメータ
`max_results` は最大 50、ほかに `include_sites`、`exclude_sites`、`time_range` が利用できます。
arXiv 検索 API とは?
arXiv 検索 API は、arXiv の論文を構造化された結果として返す HTTP インターフェースです。arXiv も独自のクエリインターフェースを公開していますが、パースと整形が必要な Atom フィードを返し、呼び出し側での流量制御を求めています。Search1API は arXiv を Search endpoint の検索サービスの 1 つとして提供し、論文タイトル、arxiv.org のリンク、著者リスト・投稿日・アブストラクトを含むスニペットを、他のエンジンと同じ JSON 形式で返します。リサーチエージェントにとってはこの順序が重要で、検索結果と同時にアブストラクトが届くため、全文取得のコストを払う前に関連性を判断できます。
典型的な流れ
arXiv を HTTP で検索し、著者・投稿日・アブストラクトを 1 つのフィールドで取得します。公式インターフェースが返す Atom フィードのパースは不要です。
`search_service` に `arxiv` を指定してクエリを送信します。
`snippet` をパイプで分割して、著者、日付、アブストラクトを切り分けます。
アブストラクトではなく論文ページが必要な場合は `crawl_results` を指定します。
1 回のリクエストで引用情報付きの論文を取得
1 回の呼び出しで arXiv を検索し、各結果に著者・投稿日・アブストラクトを付けて返すため、引用の組み立てと関連性の判断を同時に行えます。
bashcurl -X POST https://api.search1api.com/search \-H "Authorization: Bearer $SEARCH1API_KEY" \-H "Content-Type: application/json" \-d '{"query": "retrieval augmented generation","search_service": "arxiv","max_results": 5}'
主な用途
全文に進む前にアブストラクトが必要な文献調査。
著者と日付を付けて論文を引用するリサーチエージェント。
投稿日で分野の動向を追う調査。
アブストラクトを一次検索層として索引する RAG パイプライン。
FAQ
arXiv の API と何が違いますか?
arXiv 自身のインターフェースはパースと整形が必要な Atom フィードを返し、呼び出し側での流量制御を求めています。Search1API は他のエンジンと同じ形式の JSON を返し、著者・日付・アブストラクトがすでにスニペットに組み立てられています。
論文の全文は取得できますか?
`crawl_results` に取得したい上位件数を指定すると、取得に成功したページに Markdown 形式の本文を含む `content` フィールドが付与されます。取得できなかった結果は `content` なしで返り、課金されません。
結果はプレプリントのみですか?
結果は arXiv 由来で、arXiv にはプレプリントに加えて著者が登録した出版済み論文のバージョンも含まれます。スニペットの投稿日は arXiv の日付であり、ジャーナルの出版日ではありません。
arXiv 検索の料金はいくらですか?
検索 1 回あたり 1 クレジット、`crawl_results` で取得に成功したページごとに 1 クレジットが加算されます。チャージの基本レート($1 = 1,000 クレジット)では 1,000 回の検索が $1 です。登録時にクレジットカードなしで 100 クレジットが付与されます。
期間で絞り込めますか?
day、week、month、year の期間指定には `time_range` を使います。特定の範囲が必要な場合は、投稿日がスニペットに返るため取得後にフィルタできます。
他の調査系ソースにも対応していますか?
同じ Search endpoint が参照記事の `wikipedia`、実装の `github`、議論の `reddit` に対応します。一般 Web エンジンや中国語エンジンと合わせ、1 つの契約で計 17 エンジンを利用できます。