logo

Data Hub 条件搜索重排

指定关键词、排除项、时间和地域等搜索条件,返回按问题相关性排序的公开网页结果

概览

当搜索范围已经明确时,条件搜索重排可以把“哪些网页有资格进入候选结果”和“候选结果按什么问题排序”分开控制。

例如调查“小米汽车近期交付和销量表现”,可以要求结果必须涉及“小米汽车”,优先包含“交付”“销量”,用“门店”“试驾”扩展线索,排除“招聘”,并限定中国和 2026 年;候选网页随后再按这个业务问题排序。这种方式的搜索口径更明确,适合需要保持筛选标准一致的研究任务。

数据说明

结果来自公开网页搜索,按重排问题的相关性排序,同一个跳转链接只保留一次。发布时间取自页面可识别的时间,通常形如 yyyy-MM-dd HH:mm:ss;页面内容不足时摘要可能为空。只覆盖可公开检索的网页,不包含图片、视频、登录后内容和站内私有内容。

结果长什么样

每条记录是一条网页结果:

排序标识标题跳转链接摘要发布时间
0小米汽车交付节奏持续提升https://data-hub.example/r/8f3a2c小米汽车近期交付节奏持续提升,相关门店试驾热度上升。2026-08-05 14:23:10
1小米汽车销量数据公布https://data-hub.example/r/7b91de最新销量信息显示,小米汽车多个城市交付中心保持较高关注度。2026-08-03 09:40:21

应用场景

  • 做市场动态跟踪时,看「标题」「摘要」「发布时间」,快速筛出近期与目标主题最相关的网页线索。
  • 做事实核查时,用「跳转链接」打开原文,再结合「摘要」判断这条结果是否支持当前问题。
  • 做竞品舆情整理时,把「发布时间」按时间排序,结合「标题」观察某个品牌或产品在不同阶段的报道重点。

适用边界

单次最多返回 200 条公开网页结果;仅返回标题、摘要、发布时间和跳转链接。

  • 适合用于
  • 已经明确搜索边界,需要分别控制必须词、优先词、扩展词、排除词、时间或地域条件时
  • 需要将候选网页的搜索范围与最终排序目标分开控制时
  • 需要获得精简网页结果用于资料收集、事实核查或线索整理时
  • 不要用于
  • 只有一段自然语言问题且不想拆分搜索条件时——应使用智能搜索重排
  • 需要图片、视频或网页扩展字段时——公开版不返回这些字段
  • 需要站内私有内容、登录后内容或不可公开检索页面时——本应用只覆盖公开网页结果

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1返回空列表通常是结构化意图为空、过滤条件过窄或关键词互相冲突,可放宽条件后重试
  2. 2限流或临时服务不可用可稍后原样重试

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
intent结构化搜索意图object{"must":["小米汽车"],"should":["交付","销量"],"may":["门店","试驾"],"mustNot":["招聘"],"filter":{"region":["中国"],"time":["2026年"]}}已经识别好的搜索意图条件,至少填写一个关键词或过滤条件;全部留空会返回空结果。
rerank_query重排问题string小米汽车近期交付和销量表现用于对候选网页结果重新排序的问题或主题,必须是非空文本。
count返回条数integer101–200最多返回多少条网页结果,默认 10,范围 1 到 200。
freshness时间新鲜度stringnoLimit限制结果时间范围,默认 noLimit;可填 oneDay、oneWeek、oneMonth、oneYear、YYYY-MM-DD 或 YYYY-MM-DD..YYYY-MM-DD。
include_summary返回摘要booleantrue打开后返回网页文本摘要,默认打开;关闭时摘要可能为空。

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
id排序标识string本次结果中的排序标识
name标题string网页内容标题
url跳转链接string用于访问对应网页的跳转链接
summary摘要string网页正文摘要,未返回摘要时为空
date_published发布时间string内容发布时间,通常为 yyyy-MM-dd HH:mm:ss

记录 Schema

输出按记录逐条返回。记录主键为 url,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "id": {
      "type": "string",
      "title": "排序标识",
      "description": "本次结果中的排序标识"
    },
    "name": {
      "type": "string",
      "title": "标题",
      "description": "网页内容标题"
    },
    "url": {
      "type": "string",
      "title": "跳转链接",
      "description": "用于访问对应网页的跳转链接"
    },
    "summary": {
      "type": "string",
      "title": "摘要",
      "description": "网页正文摘要,未返回摘要时为空"
    },
    "date_published": {
      "type": "string",
      "title": "发布时间",
      "description": "内容发布时间,通常为 yyyy-MM-dd HH:mm:ss"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "DataHub__data-hub-web-search-intent-rerank-public": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=DataHub/data-hub-web-search-intent-rerank-public",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

发起一次搜索

每提交一次任务计费一次,与返回条数无关。

¥0.001/
网页结果

按实际成功返回的数据条数计费,任务失败不计费。每 50 条为一个计费单位,不足 50 条按 50 条计。

¥0.03/ 50 条

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
请先填写必填参数
¥0.03 / 50 条起