logo

Reddit 帖子详情采集

给一个 Reddit 帖子链接,返回帖子正文、作者、互动、媒体与时间详情

概览

一条 Reddit 帖子往往同时承载主题讨论、作者表达和社区反馈。这个 App 根据已知帖子链接取回帖子标题、正文、作者、互动数量、媒体链接、标签和时间信息,形成可直接用于内容研究的单条详情记录。

相比手工打开页面摘录,它把分散在页面上的核心信息收拢到同一条记录中,适合核验内容原文、保存公开帖子快照,或为选题、舆情和账号观察准备基础数据。

数据说明

数据取自无需登录即可访问的公开 Reddit 帖子页面,每个提交链接对应至多一条详情记录,并按提交链接识别同一帖子。标题、正文、作者和媒体信息按采集结果保留;评论数与点赞数是采集时看到的快照,之后可能变化。图片、视频与标签集合保留原始文本,不做拆分或改写。帖子被删除、设为受限或无法公开访问时,可能只返回无数据标记。发布时间与采集时间保留来源中的原始值,不推断其时区。

结果长什么样

每条记录代表一个 Reddit 帖子详情:

帖子编号帖子标题账号名称评论数点赞数
t3_1umpju4Hot GosSip the Special ✨ w/Reed RichardsGosamyrBaby516
t3_1w1qzntI need guidance, im a messTurtusMaghurtus64

记录中另有帖子正文、帖子链接、图片链接集合、视频链接集合、标签集合、发布时间和采集时间等信息。

应用场景

  • 做内容选题研究时,结合「帖子标题」「帖子正文」归纳社区正在讨论的问题、叙事方式和高频主题。
  • 做互动表现观察时,对照「评论数」「点赞数」筛出更容易引发讨论或认同的帖子,作为后续人工研判样本。
  • 做账号内容盘点时,按「账号名称」汇总「内容类型」与「标签集合」,观察不同账号的内容方向和表达习惯。

适用边界

单次提交 1 个公开 Reddit 帖子链接,固定采集 1 条帖子详情;仅覆盖无需登录即可访问的帖子。

  • 适合用于
  • 需要获取单个公开 Reddit 帖子的正文、作者和互动详情时
  • 需要按帖子链接核验内容、媒体与发布时间信息时
  • 不要用于
  • 需要按关键词批量发现帖子时——本 App 只采集已知链接对应的单个帖子
  • 需要评论明细或登录后可见内容时——本 App 只提供公开帖子本身的详情

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1无数据时检查帖子链接是否准确,以及帖子是否已删除、受限或需要登录访问
  2. 2限流、请求超时或服务暂时不可用时可稍后用同一链接重试
  3. 3鉴权、权限或任务上下文错误不可直接重试,需先检查执行环境凭证和调用配置

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
reddit_post_urlReddit 帖子链接stringhttps://old.reddit.com/r/XaviersMansion/comments/1umpju4/hot_gossip_the_special_wreed_richards/要采集的公开 Reddit 帖子完整 URL,地址路径需包含社区、comments 和帖子编号;长度不超过 512 个字符

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
account_avatar_url账号头像链接string发帖账号头像图片链接
account_id账号编号stringReddit 发帖账号编号
account_name账号名称stringReddit 发帖账号展示名称
biz_id业务标识string帖子记录携带的业务标识原始值
comment_count评论数string帖子采集时的评论数量原始文本
content_id帖子编号stringReddit 帖子的内容编号
content_text帖子正文stringReddit 帖子的正文原文
content_title帖子标题stringReddit 帖子的展示标题
content_url帖子链接stringReddit 帖子的公开访问链接
cover_image_url封面图片链接string帖子封面或预览图片链接
crawl_time采集时间string帖子详情被采集的时间原始值
image_urls图片链接集合string帖子图片链接集合的 JSON 文本
keyword采集目标string记录关联的采集目标原始值
like_count点赞数string帖子采集时的点赞数量原始文本
message_type内容类型string帖子内容类型的原始文本
publish_time发布时间string帖子发布时间的原始值
tag_list标签集合string帖子标签集合的 JSON 文本
task_item提交链接string本条记录对应的提交帖子链接,作为稳定记录标识
no_data是否无数据boolean该帖子是否未采集到可用详情
video_urls视频链接集合string帖子视频链接集合的 JSON 文本

记录 Schema

输出按记录逐条返回。记录主键为 content_id,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "account_avatar_url": {
      "type": "string",
      "title": "账号头像链接",
      "description": "发帖账号头像图片链接"
    },
    "account_id": {
      "type": "string",
      "title": "账号编号",
      "description": "Reddit 发帖账号编号"
    },
    "account_name": {
      "type": "string",
      "title": "账号名称",
      "description": "Reddit 发帖账号展示名称"
    },
    "biz_id": {
      "type": "string",
      "title": "业务标识",
      "description": "帖子记录携带的业务标识原始值"
    },
    "comment_count": {
      "type": "string",
      "title": "评论数",
      "description": "帖子采集时的评论数量原始文本"
    },
    "content_id": {
      "type": "string",
      "title": "帖子编号",
      "description": "Reddit 帖子的内容编号"
    },
    "content_text": {
      "type": "string",
      "title": "帖子正文",
      "description": "Reddit 帖子的正文原文"
    },
    "content_title": {
      "type": "string",
      "title": "帖子标题",
      "description": "Reddit 帖子的展示标题"
    },
    "content_url": {
      "type": "string",
      "title": "帖子链接",
      "description": "Reddit 帖子的公开访问链接"
    },
    "cover_image_url": {
      "type": "string",
      "title": "封面图片链接",
      "description": "帖子封面或预览图片链接"
    },
    "crawl_time": {
      "type": "string",
      "title": "采集时间",
      "description": "帖子详情被采集的时间原始值"
    },
    "image_urls": {
      "type": "string",
      "title": "图片链接集合",
      "description": "帖子图片链接集合的 JSON 文本"
    },
    "keyword": {
      "type": "string",
      "title": "采集目标",
      "description": "记录关联的采集目标原始值"
    },
    "like_count": {
      "type": "string",
      "title": "点赞数",
      "description": "帖子采集时的点赞数量原始文本"
    },
    "message_type": {
      "type": "string",
      "title": "内容类型",
      "description": "帖子内容类型的原始文本"
    },
    "publish_time": {
      "type": "string",
      "title": "发布时间",
      "description": "帖子发布时间的原始值"
    },
    "tag_list": {
      "type": "string",
      "title": "标签集合",
      "description": "帖子标签集合的 JSON 文本"
    },
    "task_item": {
      "type": "string",
      "title": "提交链接",
      "description": "本条记录对应的提交帖子链接,作为稳定记录标识"
    },
    "no_data": {
      "type": "boolean",
      "title": "是否无数据",
      "description": "该帖子是否未采集到可用详情"
    },
    "video_urls": {
      "type": "string",
      "title": "视频链接集合",
      "description": "帖子视频链接集合的 JSON 文本"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "SpiderKing999__reddit-detail": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=SpiderKing999/reddit-detail",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

提交一次帖子详情采集

每提交一次任务计费一次,与返回条数无关。

¥0.001/
返回一条帖子详情

按实际成功返回的数据条数计费,任务失败不计费。

¥0.01/

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
请先填写必填参数
¥0.01 / 条起