用夸克搜索 API 检索中文网页
通过 HTTP 检索夸克,拿到一套依托不同语料的中文结果,其中包含阿里和 UC 系的内容。
接口POST https://api.search1api.com/search
结果的 JSON 结构与其他引擎一致,现有的解析逻辑不需要改动。
除开放中文网页外,还包含阿里和 UC 系的内容。
摘要就是夸克展示的页面描述。
同一个查询,构成与百度和 360 都不同。
适用于
移动端中国 / 扩大覆盖 / 交叉验证
有自己语料的第三套中文索引
把 `search_service` 设为 `quark`,结果就来自夸克。接口地址、鉴权方式和响应结构与其他引擎完全一致。
是换了语料,不是换个排序
同一个在 `baidu` 上返回百度百科的查询,在这里返回的是阿里和 UC 系的内容 —— 差别在于结果集里有哪些页面,而不只是它们的先后。
移动端起家的取向
夸克是以移动浏览器和搜索产品成长起来的,它的排序反映的是中国手机用户被推到面前的内容。
补齐中文三件套
同一个查询跑 `baidu`、`360`、`quark`,覆盖的是三套独立索引,而不是一套索引的三个视角。
标准 Search 参数
`max_results` 最大 50,以及 `include_sites`、`exclude_sites`、`time_range`。
什么是夸克搜索 API?
夸克搜索 API 是一种 HTTP 接口,把夸克的结果作为结构化数据返回。夸克是阿里旗下的搜索与浏览器产品,主要在移动端成长起来,这一点体现在它的索引上:除了开放中文网页,它还依托阿里和 UC 系的内容,同一个查询返回的页面集合与百度不同。Search1API 把夸克作为 Search 接口的一个搜索服务提供,返回标题、链接和中文摘要,JSON 结构与其他引擎一致。它和 `baidu`、`360` 合起来,让一套契约就能从三个独立视角读中文互联网。
典型流程
通过 HTTP 检索夸克,拿到一套依托不同语料的中文结果,其中包含阿里和 UC 系的内容。
把 `search_service` 设为 `quark`,用中文发送查询。
和 `baidu`、`360` 的结果对比,看哪些页面只有其中一个索引会给出。
当流程需要页面正文而不只是链接时,设置 `crawl_results`。
一次请求,第三套中文结果集
一次调用即可检索夸克,以标准结构返回中文结果。和百度、360 的查询打包成批量请求,一个来回就能覆盖三套索引。
bashcurl -X POST https://api.search1api.com/search \-H "Authorization: Bearer $SEARCH1API_KEY" \-H "Content-Type: application/json" \-d '{"query": "人工智能","search_service": "quark","max_results": 5}'
适合场景
需要跨多个索引扩大广度的中文调研。
想了解中国移动端用户看到的是什么结果。
用第三个独立来源佐证论断的交叉验证。
从多个排序里拼装中文答案的 AI 助手。
常见问题
夸克和百度、360 有什么不同?
夸克是阿里的搜索产品,在移动端成长起来。它的索引除了开放中文网页还依托阿里和 UC 系内容,因此同一个查询返回的是不同的页面集合,而不只是不同的顺序。
应该用中文还是英文查询?
用中文。索引是中文内容,只有中文查询才能得到有意义的排序。
可以一次查完三个中文引擎吗?
可以。Search 接口接受查询对象的数组,`baidu`、`360`、`quark` 可以放在一次批量请求里发出。每一条单独计费,失败的条目不计费。
夸克搜索的费用是多少?
每次搜索消耗 1 积分,通过 `crawl_results` 每成功抓取一个页面追加 1 积分。按 $1 = 1,000 积分的充值基础价计算,1,000 次搜索为 $1。注册即送 100 个免费积分,无需信用卡。
可以顺便拿到页面正文吗?
可以。把 `crawl_results` 设为需要抓取的结果数量,成功抓取的页面会包含 `content` 字段,内容是 markdown 格式的正文。抓取失败的结果不返回 `content`,也不计费。
还支持哪些中文来源?
同一个 Search 接口还支持中文网页的 `baidu` 和 `360`、公众号文章的 `wechat`、视频的 `bilibili`。加上全球引擎,一套契约共 17 个引擎。