夸克网页搜索

用夸克搜索 API 检索中文网页

通过 HTTP 检索夸克,拿到一套依托不同语料的中文结果,其中包含阿里和 UC 系的内容。

接口
POST https://api.search1api.com/search
夸克搜索结果包含什么

结果的 JSON 结构与其他引擎一致,现有的解析逻辑不需要改动。

1
页面标题与链接

除开放中文网页外,还包含阿里和 UC 系的内容。

2
中文摘要

摘要就是夸克展示的页面描述。

3
第三套结果集

同一个查询,构成与百度和 360 都不同。

适用于

移动端中国 / 扩大覆盖 / 交叉验证

有自己语料的第三套中文索引

把 `search_service` 设为 `quark`,结果就来自夸克。接口地址、鉴权方式和响应结构与其他引擎完全一致。

是换了语料,不是换个排序

同一个在 `baidu` 上返回百度百科的查询,在这里返回的是阿里和 UC 系的内容 —— 差别在于结果集里有哪些页面,而不只是它们的先后。

移动端起家的取向

夸克是以移动浏览器和搜索产品成长起来的,它的排序反映的是中国手机用户被推到面前的内容。

补齐中文三件套

同一个查询跑 `baidu`、`360`、`quark`,覆盖的是三套独立索引,而不是一套索引的三个视角。

标准 Search 参数

`max_results` 最大 50,以及 `include_sites`、`exclude_sites`、`time_range`。

什么是夸克搜索 API?

夸克搜索 API 是一种 HTTP 接口,把夸克的结果作为结构化数据返回。夸克是阿里旗下的搜索与浏览器产品,主要在移动端成长起来,这一点体现在它的索引上:除了开放中文网页,它还依托阿里和 UC 系的内容,同一个查询返回的页面集合与百度不同。Search1API 把夸克作为 Search 接口的一个搜索服务提供,返回标题、链接和中文摘要,JSON 结构与其他引擎一致。它和 `baidu`、`360` 合起来,让一套契约就能从三个独立视角读中文互联网。

接入路径

典型流程

通过 HTTP 检索夸克,拿到一套依托不同语料的中文结果,其中包含阿里和 UC 系的内容。

1

把 `search_service` 设为 `quark`,用中文发送查询。

2

和 `baidu`、`360` 的结果对比,看哪些页面只有其中一个索引会给出。

3

当流程需要页面正文而不只是链接时,设置 `crawl_results`。

一次请求,第三套中文结果集

一次调用即可检索夸克,以标准结构返回中文结果。和百度、360 的查询打包成批量请求,一个来回就能覆盖三套索引。

bash
curl -X POST https://api.search1api.com/search \
-H "Authorization: Bearer $SEARCH1API_KEY" \
-H "Content-Type: application/json" \
-d '{
"query": "人工智能",
"search_service": "quark",
"max_results": 5
}'

适合场景

需要跨多个索引扩大广度的中文调研。

想了解中国移动端用户看到的是什么结果。

用第三个独立来源佐证论断的交叉验证。

从多个排序里拼装中文答案的 AI 助手。

常见问题

夸克和百度、360 有什么不同?

夸克是阿里的搜索产品,在移动端成长起来。它的索引除了开放中文网页还依托阿里和 UC 系内容,因此同一个查询返回的是不同的页面集合,而不只是不同的顺序。

应该用中文还是英文查询?

用中文。索引是中文内容,只有中文查询才能得到有意义的排序。

可以一次查完三个中文引擎吗?

可以。Search 接口接受查询对象的数组,`baidu`、`360`、`quark` 可以放在一次批量请求里发出。每一条单独计费,失败的条目不计费。

夸克搜索的费用是多少?

每次搜索消耗 1 积分,通过 `crawl_results` 每成功抓取一个页面追加 1 积分。按 $1 = 1,000 积分的充值基础价计算,1,000 次搜索为 $1。注册即送 100 个免费积分,无需信用卡。

可以顺便拿到页面正文吗?

可以。把 `crawl_results` 设为需要抓取的结果数量,成功抓取的页面会包含 `content` 字段,内容是 markdown 格式的正文。抓取失败的结果不返回 `content`,也不计费。

还支持哪些中文来源?

同一个 Search 接口还支持中文网页的 `baidu` 和 `360`、公众号文章的 `wechat`、视频的 `bilibili`。加上全球引擎,一套契约共 17 个引擎。