logo

百度新闻采集

输入一组文章关键字,返回百度新闻公开结果的标题、描述、发布时间、链接、页码和采集时间

概览

想围绕一个品牌、事件、人物或行业词快速看公开新闻动向,可以用这份百度新闻结果作为线索底表。它按文章关键字取回新闻列表中的标题、描述、发布时间和文章链接,适合先做覆盖面扫描,再决定哪些报道值得继续阅读和分析。

相比手工在新闻搜索里反复翻页,它把多个关键词的结果集中成统一表格,便于后续按关键词、时间和标题做筛选。它提供的是公开新闻列表信息,不替代正文级研读,但很适合作为舆情监测、竞品动态和行业事件追踪的第一层数据。

数据说明

结果来自百度新闻公开可见列表页,同一关键词下按页面展示顺序返回。发布时间是新闻结果页展示的时间口径,采集时间表示该条结果被记录下来的时间。只覆盖搜索结果页可见的新闻线索,无法覆盖已删除、需要登录、付费可见或未被新闻搜索展示的内容。

结果长什么样

每条记录是一条新闻搜索结果:

关键字发布时间文章标题描述文章链接
人工智能2026年08月25日人工智能产业应用加速落地多地发布人工智能相关政策和应用案例https://example.com/news/ai
新能源汽车2026年08月25日新能源汽车出口保持增长车企海外市场布局持续推进https://example.com/news/ev

应用场景

  • 做舆情监测时,按「关键字」聚合「文章标题」和「描述」,快速判断近期报道集中在哪些主题。
  • 跟踪行业事件时,结合「发布时间」和「文章标题」看报道节奏,识别消息发酵的时间段。
  • 做线索筛选时,用「描述」初步判断相关性,再打开「文章链接」进入重点报道继续研读。

适用边界

单次可按关键词采集多页公开新闻结果;实际返回量受关键词、页数和新闻可见性影响。

  • 适合用于
  • 需要按关键词批量获取百度新闻搜索结果时
  • 需要沉淀新闻标题、发布时间和文章链接作为监测底表时
  • 需要围绕品牌、事件或行业词做公开新闻线索收集时
  • 不要用于
  • 需要新闻正文全文时,本 App 只返回新闻列表页可见信息
  • 需要登录后、付费或非公开新闻内容时,本 App 只覆盖公开可见结果

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1返回空结果时,可换成更明确、更常见或更短的关键词重试
  2. 2任务异常停止时,可稍后用相同输入重试一次

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
article_keywords文章关键字array<string>最多 50 项["人工智能","新能源汽车"]要批量采集的百度新闻关键词,一行输入一个关键词。建议使用品牌、事件、人物或行业词
page_count翻页次数integer11–502每个关键词最多向后翻多少页新闻结果,不填默认 1 页。页数越多耗时越长、返回记录越多
max_collected_rows最多返回条数integer00–100000010限制本次任务最多返回多少条结果,0 表示不限制。实际返回可能少于该值

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
keyword关键字string触发该条新闻结果的搜索关键词
published_at发布时间string新闻结果展示的发布时间
description描述string新闻结果展示的摘要描述
article_url文章链接string新闻结果指向的文章页面链接
article_title文章标题string新闻结果展示的文章标题
crawled_at采集时间string该条结果被采集到的时间
page_number页码string该条结果所在的新闻搜索结果页码

记录 Schema

输出按记录逐条返回。记录主键为 article_url,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "keyword": {
      "type": "string",
      "title": "关键字",
      "description": "触发该条新闻结果的搜索关键词"
    },
    "published_at": {
      "type": "string",
      "title": "发布时间",
      "description": "新闻结果展示的发布时间"
    },
    "description": {
      "type": "string",
      "title": "描述",
      "description": "新闻结果展示的摘要描述"
    },
    "article_url": {
      "type": "string",
      "title": "文章链接",
      "description": "新闻结果指向的文章页面链接"
    },
    "article_title": {
      "type": "string",
      "title": "文章标题",
      "description": "新闻结果展示的文章标题"
    },
    "crawled_at": {
      "type": "string",
      "title": "采集时间",
      "description": "该条结果被采集到的时间"
    },
    "page_number": {
      "type": "string",
      "title": "页码",
      "description": "该条结果所在的新闻搜索结果页码"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "DataHub__baidu-news": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=DataHub/baidu-news",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

返回一条新闻结果

按实际成功返回的数据条数计费,任务失败不计费。

¥0.001/

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
请先填写必填参数
¥0.001 / 条