logo

界面新闻分类文章采集

输入界面新闻分类页链接,采集该分类下的文章标题、导语、发布时间、来源、正文和页面网址

概览

想持续观察界面新闻某个频道下的文章更新,可以用分类页链接直接采集一批公开文章。它会返回文章标题、导语、发布时间、来源、正文、正文源码和页面网址,适合做媒体内容监测、选题观察和专题资料沉淀。

相比手工打开分类页再逐篇复制,它把同一分类下的文章整理成统一记录,后续可以按发布时间、来源或标题关键词筛选。正文和正文源码同时保留,既方便直接阅读,也便于后续做文本清洗和内容分析。

数据说明

结果来自界面新闻公开分类页和文章页,按页面展示顺序返回。发布时间、导语、来源和正文以采集时页面展示为准,正文源码保留页面正文区域的原始形态。只覆盖公开可访问文章,页面删除、调整、需要登录或临时不可访问时,实际返回会减少。

结果长什么样

每条记录是一篇界面新闻文章:

发布时间来源标题导语页面网址
2026-08-25界面新闻消费行业观察示例标题新消费品牌正在调整渠道和产品策略。https://www.jiemian.com/article/example-a.html
2026-08-25界面新闻科技公司动态示例标题多家公司围绕新业务展开布局。https://www.jiemian.com/article/example-b.html

应用场景

  • 做频道监测时,按「发布时间」和「标题」整理近期更新,判断该分类的内容节奏。
  • 做选题研究时,结合「导语」和「正文」提取高频主题,快速筛出值得深读的文章。
  • 做内容归档时,用「页面网址」保留原文入口,用「正文源码」支持后续清洗和结构化处理。

适用边界

单次可按分类页链接采集多页公开文章;实际返回量受分类页可见内容和翻页次数影响。

  • 适合用于
  • 需要按界面新闻分类采集公开文章列表和正文时
  • 需要整理某个频道下的标题、导语、来源和原文链接作为内容监测底表时
  • 不要用于
  • 需要按关键词搜索全站文章时,本 App 面向分类页链接采集
  • 需要登录后、付费或非公开内容时,本 App 只覆盖公开可见页面

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1返回空结果时,可检查分类页链接是否公开可访问,或减少翻页次数后重试
  2. 2任务异常停止时,可稍后用相同输入重试一次

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
category_urls分类页链接array<string>最多 50 项["https://www.jiemian.com/lists/9.html"]要采集的界面新闻分类页链接,每项填写一个完整 URL
page_count翻页次数integer11–501每个分类页最多向后翻多少页文章列表,不填默认 1 页。页数越多耗时越长、返回记录越多
max_collected_rows最多返回条数integer00–100000010限制本次任务最多返回多少条结果,0 表示不限制。实际返回可能少于该值

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
published_at发布时间string文章展示的发布时间
lead导语string文章展示的导语或摘要
current_time当前时间string该条记录采集时页面展示或记录的当前时间
source来源string文章展示的来源
title标题string文章标题
content正文string文章正文内容
content_html正文源码string文章正文区域的源码内容
page_url页面网址string文章原文页面的网址

记录 Schema

输出按记录逐条返回。记录主键为 page_url,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "published_at": {
      "type": "string",
      "title": "发布时间",
      "description": "文章展示的发布时间"
    },
    "lead": {
      "type": "string",
      "title": "导语",
      "description": "文章展示的导语或摘要"
    },
    "current_time": {
      "type": "string",
      "title": "当前时间",
      "description": "该条记录采集时页面展示或记录的当前时间"
    },
    "source": {
      "type": "string",
      "title": "来源",
      "description": "文章展示的来源"
    },
    "title": {
      "type": "string",
      "title": "标题",
      "description": "文章标题"
    },
    "content": {
      "type": "string",
      "title": "正文",
      "description": "文章正文内容"
    },
    "content_html": {
      "type": "string",
      "title": "正文源码",
      "description": "文章正文区域的源码内容"
    },
    "page_url": {
      "type": "string",
      "title": "页面网址",
      "description": "文章原文页面的网址"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "DataHub__jiemian-category-articles": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=DataHub/jiemian-category-articles",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

返回一篇文章

按实际成功返回的数据条数计费,任务失败不计费。

¥0.001/

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
请先填写必填参数
¥0.001 / 条