概览
想持续观察界面新闻某个频道下的文章更新,可以用分类页链接直接采集一批公开文章。它会返回文章标题、导语、发布时间、来源、正文、正文源码和页面网址,适合做媒体内容监测、选题观察和专题资料沉淀。
相比手工打开分类页再逐篇复制,它把同一分类下的文章整理成统一记录,后续可以按发布时间、来源或标题关键词筛选。正文和正文源码同时保留,既方便直接阅读,也便于后续做文本清洗和内容分析。
数据说明
结果来自界面新闻公开分类页和文章页,按页面展示顺序返回。发布时间、导语、来源和正文以采集时页面展示为准,正文源码保留页面正文区域的原始形态。只覆盖公开可访问文章,页面删除、调整、需要登录或临时不可访问时,实际返回会减少。
结果长什么样
每条记录是一篇界面新闻文章:
| 发布时间 | 来源 | 标题 | 导语 | 页面网址 |
|---|---|---|---|---|
| 2026-08-25 | 界面新闻 | 消费行业观察示例标题 | 新消费品牌正在调整渠道和产品策略。 | https://www.jiemian.com/article/example-a.html |
| 2026-08-25 | 界面新闻 | 科技公司动态示例标题 | 多家公司围绕新业务展开布局。 | https://www.jiemian.com/article/example-b.html |
应用场景
- 做频道监测时,按「发布时间」和「标题」整理近期更新,判断该分类的内容节奏。
- 做选题研究时,结合「导语」和「正文」提取高频主题,快速筛出值得深读的文章。
- 做内容归档时,用「页面网址」保留原文入口,用「正文源码」支持后续清洗和结构化处理。
适用边界
单次可按分类页链接采集多页公开文章;实际返回量受分类页可见内容和翻页次数影响。
- 适合用于
- 需要按界面新闻分类采集公开文章列表和正文时
- 需要整理某个频道下的标题、导语、来源和原文链接作为内容监测底表时
- 不要用于
- 需要按关键词搜索全站文章时,本 App 面向分类页链接采集
- 需要登录后、付费或非公开内容时,本 App 只覆盖公开可见页面
失败处理
作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。
- 1返回空结果时,可检查分类页链接是否公开可访问,或减少翻页次数后重试
- 2任务异常停止时,可稍后用相同输入重试一次
输入参数
调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。
| 字段名 | 业务名称 | 类型 | 必填 | 默认值 | 枚举 / 约束 | 示例 | 说明 |
|---|---|---|---|---|---|---|---|
| category_urls | 分类页链接 | array<string> | 是 | — | 最多 50 项 | ["https://www.jiemian.com/lists/9.html"] | 要采集的界面新闻分类页链接,每项填写一个完整 URL |
| page_count | 翻页次数 | integer | 否 | 1 | 1–50 | 1 | 每个分类页最多向后翻多少页文章列表,不填默认 1 页。页数越多耗时越长、返回记录越多 |
| max_collected_rows | 最多返回条数 | integer | 否 | 0 | 0–1000000 | 10 | 限制本次任务最多返回多少条结果,0 表示不限制。实际返回可能少于该值 |
输出数据
单条记录的字段结构,与 manifest.json 的 output.schema 同源。
| 字段名 | 业务名称 | 类型 | 示例 | 说明 |
|---|---|---|---|---|
| published_at | 发布时间 | string | — | 文章展示的发布时间 |
| lead | 导语 | string | — | 文章展示的导语或摘要 |
| current_time | 当前时间 | string | — | 该条记录采集时页面展示或记录的当前时间 |
| source | 来源 | string | — | 文章展示的来源 |
| title | 标题 | string | — | 文章标题 |
| content | 正文 | string | — | 文章正文内容 |
| content_html | 正文源码 | string | — | 文章正文区域的源码内容 |
| page_url | 页面网址 | string | — | 文章原文页面的网址 |
记录 Schema
输出按记录逐条返回。记录主键为 page_url,去重、增量、关联以它为准。
{
"type": "object",
"properties": {
"published_at": {
"type": "string",
"title": "发布时间",
"description": "文章展示的发布时间"
},
"lead": {
"type": "string",
"title": "导语",
"description": "文章展示的导语或摘要"
},
"current_time": {
"type": "string",
"title": "当前时间",
"description": "该条记录采集时页面展示或记录的当前时间"
},
"source": {
"type": "string",
"title": "来源",
"description": "文章展示的来源"
},
"title": {
"type": "string",
"title": "标题",
"description": "文章标题"
},
"content": {
"type": "string",
"title": "正文",
"description": "文章正文内容"
},
"content_html": {
"type": "string",
"title": "正文源码",
"description": "文章正文区域的源码内容"
},
"page_url": {
"type": "string",
"title": "页面网址",
"description": "文章原文页面的网址"
}
},
"required": [],
"additionalProperties": false
}调用方式
本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。
通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。
客户端配置
把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。
{
"mcpServers": {
"DataHub__jiemian-category-articles": {
"type": "http",
"url": "https://mcp-v2.bazhuayu.com?pin=DataHub/jiemian-category-articles",
"headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
}
}
}让 AI 自己完成配置
不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。
如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。
价格
按实际成功返回的数据条数计费,任务失败不计费。
多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。
立即体验
填写参数直接运行,结果来自真实调用。