概览
想把中新网公开新闻整理成可分析的内容底表,可以使用这份新闻采集结果。它会返回新闻时间、来源、标题、正文、类别和采集时间,适合做媒体监测、新闻归档和专题资料沉淀。
这类数据的价值在于把页面上的新闻内容转成统一记录,方便后续按类别、时间或标题关键词筛选。它不需要先输入关键词,适合获取站点公开新闻流中的一批内容,再做后续主题判断。
数据说明
结果来自中新网公开新闻页面,按页面可见顺序返回。时间、来源、类别和正文以采集时页面展示为准,其中两个来源字段保留页面上的不同来源信息。只覆盖公开可访问新闻,页面删除、调整或临时不可访问时,实际返回会减少。
结果长什么样
每条记录是一篇中新网新闻:
| 时间 | 来源1 | 来源2 | 标题 | 类别 |
|---|---|---|---|---|
| 2026-08-25 | 中国新闻网 | 示例来源 | 国内新闻示例标题 | 国内 |
| 2026-08-25 | 中国新闻网 | 示例来源 | 国际动态示例标题 | 国际 |
应用场景
- 做新闻归档时,按「时间」和「类别」整理每日内容清单。
- 做主题筛选时,用「标题」和「正文」匹配关注词,快速定位相关报道。
- 做来源比对时,结合「来源1」和「来源2」判断报道署名和转载线索。
适用边界
单次采集中新网公开新闻列表;实际返回量受页面可见内容影响。
- 适合用于
- 需要采集中新网公开新闻和正文内容时
- 需要整理新闻时间、来源、类别和正文作为媒体监测底表时
- 不要用于
- 需要按关键词定向搜索时,本模板不提供关键词输入
- 需要登录后、付费或非公开内容时,本 App 只覆盖公开可见页面
失败处理
作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。
- 1返回空结果时,可稍后重试一次
- 2任务异常停止时,可使用相同输入重新运行
输入参数
调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。
| 字段名 | 业务名称 | 类型 | 必填 | 默认值 | 枚举 / 约束 | 示例 | 说明 |
|---|---|---|---|---|---|---|---|
| max_collected_rows | 最多返回条数 | integer | 是 | 0 | 0–1000000 | 10 | 限制本次任务最多返回多少条结果,0 表示不限制。实际返回可能少于该值 |
输出数据
单条记录的字段结构,与 manifest.json 的 output.schema 同源。
| 字段名 | 业务名称 | 类型 | 示例 | 说明 |
|---|---|---|---|---|
| published_at | 时间 | string | — | 新闻展示的发布时间 |
| source_primary | 来源1 | string | — | 新闻展示的第一来源信息 |
| source_secondary | 来源2 | string | — | 新闻展示的第二来源信息 |
| title | 标题 | string | — | 新闻标题 |
| content | 正文 | string | — | 新闻正文内容 |
| category | 类别 | string | — | 新闻所属类别 |
| crawled_at | 采集时间 | string | — | 该条新闻被采集到的时间 |
记录 Schema
输出按记录逐条返回。记录主键为 title,去重、增量、关联以它为准。
{
"type": "object",
"properties": {
"published_at": {
"type": "string",
"title": "时间",
"description": "新闻展示的发布时间"
},
"source_primary": {
"type": "string",
"title": "来源1",
"description": "新闻展示的第一来源信息"
},
"source_secondary": {
"type": "string",
"title": "来源2",
"description": "新闻展示的第二来源信息"
},
"title": {
"type": "string",
"title": "标题",
"description": "新闻标题"
},
"content": {
"type": "string",
"title": "正文",
"description": "新闻正文内容"
},
"category": {
"type": "string",
"title": "类别",
"description": "新闻所属类别"
},
"crawled_at": {
"type": "string",
"title": "采集时间",
"description": "该条新闻被采集到的时间"
}
},
"required": [],
"additionalProperties": false
}调用方式
本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。
通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。
客户端配置
把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。
{
"mcpServers": {
"DataHub__chinanews-articles": {
"type": "http",
"url": "https://mcp-v2.bazhuayu.com?pin=DataHub/chinanews-articles",
"headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
}
}
}让 AI 自己完成配置
不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。
如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。
价格
按实际成功返回的数据条数计费,任务失败不计费。
多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。
立即体验
填写参数直接运行,结果来自真实调用。