logo

搜狐时政新闻采集

采集搜狐时政频道的新闻列表(标题、阅读量、正文)

概览

想知道搜狐时政频道都在发什么、哪条阅读量高?运行后会取回时政频道的新闻列表,每条带标题、发布者、阅读量和正文,可以直接导出到表格里做内容分析。

比起在频道页一屏屏往下翻,它把时政新闻一次拉全,阅读数据、发布者信息都保留在结果里,适合当作时政内容监测的原始数据底表。

数据说明

新闻取自搜狐时政频道公开页面,只覆盖页面展示的新闻。阅读量为采集当时页面展示的值,随时间变化;正文为页面提取的正文内容,个别新闻可能因页面限制返回部分内容。结果按页面展示顺序返回,不做去重与排序。

结果长什么样

每条记录是一条数据:

标题发布时间发布者阅读量
多部委联合部署下半年重点工作2026-08-27 08:40时政观察128000
地方经济半年报陆续出炉2026-08-27 07:15时政观察96000

应用场景

  • 做热点监测时,把「阅读量」按高低排序,找出频道内最受关注的时政新闻。
  • 做信源梳理时,从「发布者」统计高频账号,判断该频道内哪些账号在主导发声。
  • 做内容盘点时,按「发布时间」看频道发文节奏,结合「正文提取」提炼议题主线。

适用边界

单次任务采集搜狐时政频道的新闻列表,结果条数受采集上限控制(默认 1000 条)。

  • 适合用于
  • 采集搜狐时政频道的新闻列表(标题、阅读量、正文)时
  • 需要批量获取并导出该数据做分析时
  • 不要用于
  • 需要实时逐条推送的数据时——本 App 按任务批量返回
  • 需要该平台之外的跨源数据时——本 App 只覆盖单一数据源

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1任务失败属可重试错误,可原样重新提交
  2. 2结果分页返回,条数多时请用 SDK/REST 导出而非反复翻页

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
scroll_times滚动次数integer1–100页面向下滚动加载的次数,滚动越多加载的新闻越多。不填表示不限制滚动、按页面可加载的新闻全部采集。数值越大耗时和费用越高
max_collected_rows采集条数上限integer10001–1000000本次任务总共采集的记录条数上限,默认 1000 条。数值越大耗时和费用越高

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
title标题string采集结果中的标题
title_url标题链接string采集结果中的标题链接
publish_time发布时间string采集结果中的发布时间
publisher发布者string采集结果中的发布者
publisher_page发布者主页信息string采集结果中的发布者主页信息
cover_image封面图片string采集结果中的封面图片
reads阅读量string采集结果中的阅读量
publish_location发布地string采集结果中的发布地
content正文提取string采集结果中的正文提取

记录 Schema

输出按记录逐条返回。记录主键为 title_url,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "title": {
      "type": "string",
      "title": "标题",
      "description": "采集结果中的标题"
    },
    "title_url": {
      "type": "string",
      "title": "标题链接",
      "description": "采集结果中的标题链接"
    },
    "publish_time": {
      "type": "string",
      "title": "发布时间",
      "description": "采集结果中的发布时间"
    },
    "publisher": {
      "type": "string",
      "title": "发布者",
      "description": "采集结果中的发布者"
    },
    "publisher_page": {
      "type": "string",
      "title": "发布者主页信息",
      "description": "采集结果中的发布者主页信息"
    },
    "cover_image": {
      "type": "string",
      "title": "封面图片",
      "description": "采集结果中的封面图片"
    },
    "reads": {
      "type": "string",
      "title": "阅读量",
      "description": "采集结果中的阅读量"
    },
    "publish_location": {
      "type": "string",
      "title": "发布地",
      "description": "采集结果中的发布地"
    },
    "content": {
      "type": "string",
      "title": "正文提取",
      "description": "采集结果中的正文提取"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "SpiderByte__sohu-politics-news": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=SpiderByte/sohu-politics-news",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

返回一条新闻

按实际成功返回的数据条数计费,任务失败不计费。

¥0.001/

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
运行会真实调用该 App,需要先登录
¥0.001 / 条