概览
想知道腾讯新闻某个栏目下的报道和网友评论?给一个栏目链接,它会取回新闻列表,每条带标题、作者、正文,以及展开的一级、二级评论内容,可以直接导出到表格里做舆情分析。
比起在页面上一层层点开评论,它把新闻与评论一次拉全,评论人、点赞、回复关系都保留在结果里,适合当作新闻舆情与评论分析的原始数据底表。
数据说明
新闻与评论取自腾讯新闻公开栏目页,只覆盖页面展示的内容,评论区未展开的评论不在其中。IP位置与来源标签为页面展示值;一级、二级评论条数受展开设置限制。结果按页面展示顺序返回,不做去重与排序。
结果长什么样
每条记录是一条数据:
| 标题 | 发布时间 | 栏目 | 一级评论点赞数 |
|---|---|---|---|
| AI 大模型加速赋能千行百业 | 2026-08-27 09:10 | 科技频道 | 1280 |
| 多地出台新举措促消费 | 2026-08-26 20:35 | 要闻频道 | 860 |
应用场景
- 做舆情分析时,把「一级评论内容」按情感归类,结合「一级评论点赞数」找出高共识的评论声音。
- 做互动追踪时,从「二级评论内容」看评论下的讨论走向,判断话题是否在发酵。
- 做信源画像时,按「栏目」归组统计新闻来源,结合「IP位置」看评论区的地域分布特征。
适用边界
单次任务采集一个栏目页的新闻及其评论,结果条数受采集上限控制(默认 1000 条)。
- 适合用于
- 输入腾讯新闻栏目网址,获取新闻列表及其一级、二级评论时
- 需要批量获取并导出该数据做分析时
- 不要用于
- 需要实时逐条推送的数据时——本 App 按任务批量返回
- 需要该平台之外的跨源数据时——本 App 只覆盖单一数据源
失败处理
作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。
- 1任务失败属可重试错误,可原样重新提交
- 2结果分页返回,条数多时请用 SDK/REST 导出而非反复翻页
输入参数
调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。
| 字段名 | 业务名称 | 类型 | 必填 | 默认值 | 枚举 / 约束 | 示例 | 说明 |
|---|---|---|---|---|---|---|---|
| news_url | 栏目网址 | string | 是 | — | — | https://news.qq.com/ | 要采集的腾讯新闻栏目页完整链接,形如 https://news.qq.com/。一次任务填写一个链接 |
| scroll_times | 滚动加载次数 | integer | 否 | — | 1–100 | — | 列表页向下滚动加载的次数,滚动越多加载的新闻越多。不填表示不限制滚动 |
| level1_comments | 一级评论条数 | integer | 否 | — | 1–1000 | — | 每篇新闻展开查看的一级评论条数上限,不填表示不限制。数值越大耗时和费用越高 |
| level2_comments | 二级评论条数 | integer | 否 | — | 1–1000 | — | 每条一级评论下展开的二级评论条数上限,不填表示不限制。数值越大耗时和费用越高 |
| max_collected_rows | 采集条数上限 | integer | 否 | 1000 | 1–1000000 | — | 本次任务总共采集的记录条数上限,默认 1000 条。数值越大耗时和费用越高 |
输出数据
单条记录的字段结构,与 manifest.json 的 output.schema 同源。
| 字段名 | 业务名称 | 类型 | 示例 | 说明 |
|---|---|---|---|---|
| category | 栏目 | string | — | 采集结果中的栏目 |
| title | 标题 | string | — | 采集结果中的标题 |
| author | 作者 | string | — | 采集结果中的作者 |
| publish_time | 发布时间 | string | — | 采集结果中的发布时间 |
| ip_location | IP位置 | string | — | 采集结果中的IP位置 |
| source_tag | 来源标签 | string | — | 采集结果中的来源标签 |
| content | 正文 | string | — | 采集结果中的正文 |
| page_url | 页面网址 | string | — | 采集结果中的页面网址 |
| level1_commenter | 一级评论人 | string | — | 采集结果中的一级评论人 |
| level1_content | 一级评论内容 | string | — | 采集结果中的一级评论内容 |
| level1_region | 一级评论地区 | string | — | 采集结果中的一级评论地区 |
| level1_time | 一级评论时间 | string | — | 采集结果中的一级评论时间 |
| level1_likes | 一级评论点赞数 | string | — | 采集结果中的一级评论点赞数 |
| level1_replies | 一级评论回复数 | string | — | 采集结果中的一级评论回复数 |
| level2_commenter | 二级评论人 | string | — | 采集结果中的二级评论人 |
| level2_content | 二级评论内容 | string | — | 采集结果中的二级评论内容 |
| level2_region | 二级评论地区 | string | — | 采集结果中的二级评论地区 |
| level2_time | 二级评论时间 | string | — | 采集结果中的二级评论时间 |
| level2_likes | 二级评论点赞数 | string | — | 采集结果中的二级评论点赞数 |
| level2_replies | 二级评论回复数 | string | — | 采集结果中的二级评论回复数 |
记录 Schema
输出按记录逐条返回。记录主键为 page_url,去重、增量、关联以它为准。
{
"type": "object",
"properties": {
"category": {
"type": "string",
"title": "栏目",
"description": "采集结果中的栏目"
},
"title": {
"type": "string",
"title": "标题",
"description": "采集结果中的标题"
},
"author": {
"type": "string",
"title": "作者",
"description": "采集结果中的作者"
},
"publish_time": {
"type": "string",
"title": "发布时间",
"description": "采集结果中的发布时间"
},
"ip_location": {
"type": "string",
"title": "IP位置",
"description": "采集结果中的IP位置"
},
"source_tag": {
"type": "string",
"title": "来源标签",
"description": "采集结果中的来源标签"
},
"content": {
"type": "string",
"title": "正文",
"description": "采集结果中的正文"
},
"page_url": {
"type": "string",
"title": "页面网址",
"description": "采集结果中的页面网址"
},
"level1_commenter": {
"type": "string",
"title": "一级评论人",
"description": "采集结果中的一级评论人"
},
"level1_content": {
"type": "string",
"title": "一级评论内容",
"description": "采集结果中的一级评论内容"
},
"level1_region": {
"type": "string",
"title": "一级评论地区",
"description": "采集结果中的一级评论地区"
},
"level1_time": {
"type": "string",
"title": "一级评论时间",
"description": "采集结果中的一级评论时间"
},
"level1_likes": {
"type": "string",
"title": "一级评论点赞数",
"description": "采集结果中的一级评论点赞数"
},
"level1_replies": {
"type": "string",
"title": "一级评论回复数",
"description": "采集结果中的一级评论回复数"
},
"level2_commenter": {
"type": "string",
"title": "二级评论人",
"description": "采集结果中的二级评论人"
},
"level2_content": {
"type": "string",
"title": "二级评论内容",
"description": "采集结果中的二级评论内容"
},
"level2_region": {
"type": "string",
"title": "二级评论地区",
"description": "采集结果中的二级评论地区"
},
"level2_time": {
"type": "string",
"title": "二级评论时间",
"description": "采集结果中的二级评论时间"
},
"level2_likes": {
"type": "string",
"title": "二级评论点赞数",
"description": "采集结果中的二级评论点赞数"
},
"level2_replies": {
"type": "string",
"title": "二级评论回复数",
"description": "采集结果中的二级评论回复数"
}
},
"required": [],
"additionalProperties": false
}调用方式
本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。
通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。
客户端配置
把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。
{
"mcpServers": {
"SpiderByte__tencent-news-comments": {
"type": "http",
"url": "https://mcp-v2.bazhuayu.com?pin=SpiderByte/tencent-news-comments",
"headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
}
}
}让 AI 自己完成配置
不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。
如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。
价格
按实际成功返回的数据条数计费,任务失败不计费。
多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。
立即体验
填写参数直接运行,结果来自真实调用。