logo

站长之家文章采集

采集站长之家的文章资讯(标题、稿源、正文)

概览

想知道站长之家最近都发布了哪些互联网资讯?运行后会取回文章列表,每条带标题、稿源、类别和正文,可以直接导出到表格里做内容盘点或行业动态跟踪。

比起在资讯页一屏屏往下翻,它把文章一次拉全,稿源、类别信息都保留在结果里,适合当作互联网行业资讯监测的原始数据底表。

数据说明

文章取自站长之家公开资讯页面,只覆盖页面展示的文章。抓取时间为本条数据的采集时刻;正文为页面展示的正文内容,个别文章可能因页面限制返回部分内容。结果按页面展示顺序返回,不做去重与排序。

结果长什么样

每条记录是一条数据:

标题发布时间稿源类别
2026 年 AI 应用落地趋势盘点2026-08-27 09:20站长之家行业观察
服务器市场新格局:国产化提速2026-08-26 18:05站长之家云计算

应用场景

  • 做行业动态跟踪时,按「发布时间」看资讯更新节奏,结合「类别」筛出自己关注的领域。
  • 做内容盘点时,从「标题」提炼高频话题,结合「稿源」判断主要信息来源。
  • 做舆情监测时,定期跑同一页面,比对两次的「标题」看新增文章,及时掌握行业讨论热点。

适用边界

单次任务采集站长之家的文章资讯列表,结果条数受采集上限控制(默认 1000 条)。

  • 适合用于
  • 采集站长之家的文章资讯(标题、稿源、正文)时
  • 需要批量获取并导出该数据做分析时
  • 不要用于
  • 需要实时逐条推送的数据时——本 App 按任务批量返回
  • 需要该平台之外的跨源数据时——本 App 只覆盖单一数据源

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1任务失败属可重试错误,可原样重新提交
  2. 2结果分页返回,条数多时请用 SDK/REST 导出而非反复翻页

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
scroll_times滚动次数integer1–100页面向下滚动加载的次数,滚动越多加载的文章越多。不填表示不限制滚动、按页面可加载的文章全部采集。数值越大耗时和费用越高
max_collected_rows采集条数上限integer10001–1000000本次任务总共采集的记录条数上限,默认 1000 条。数值越大耗时和费用越高

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
title标题string采集结果中的标题
publish_time发布时间string采集结果中的发布时间
source稿源string采集结果中的稿源
category类别string采集结果中的类别
content正文string采集结果中的正文
crawl_time抓取时间string采集结果中的抓取时间

记录 Schema

输出按记录逐条返回。记录主键为 title,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "title": {
      "type": "string",
      "title": "标题",
      "description": "采集结果中的标题"
    },
    "publish_time": {
      "type": "string",
      "title": "发布时间",
      "description": "采集结果中的发布时间"
    },
    "source": {
      "type": "string",
      "title": "稿源",
      "description": "采集结果中的稿源"
    },
    "category": {
      "type": "string",
      "title": "类别",
      "description": "采集结果中的类别"
    },
    "content": {
      "type": "string",
      "title": "正文",
      "description": "采集结果中的正文"
    },
    "crawl_time": {
      "type": "string",
      "title": "抓取时间",
      "description": "采集结果中的抓取时间"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "SpiderByte__chinaz-articles": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=SpiderByte/chinaz-articles",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

返回一篇文章

按实际成功返回的数据条数计费,任务失败不计费。

¥0.001/

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
运行会真实调用该 App,需要先登录
¥0.001 / 条