logo

豆瓣热门电影采集

输入豆瓣电影列表页链接,获取热门电影的评分、类型、导演主演与剧情简介

概览

想知道豆瓣上最近的热门电影都有哪些、口碑怎么样?给它一个豆瓣电影列表页链接,它会取回该列表下的电影条目,每条带影名、导演、主演、评分、评价人数和剧情简介,可以直接导出到表格里做选片参考或内容分析。

比起在网页上一部部点开看,它把列表页的电影信息一次拉全,评分分布、主创阵容、剧情简介都保留在结果里,适合当作电影情报与口碑分析的原始数据底表。

数据说明

电影信息取自豆瓣电影公开列表页,只覆盖列表页展示的电影条目。评分、评价人数与各星级占比为采集当时页面展示的值,随时间变化;影名、导演、主演等主创信息以页面展示为准,个别条目可能因页面排版缺失部分字段。结果按列表页顺序返回,不做去重与排序。

结果长什么样

每条记录是一部电影:

影名导演评分评价人数类型
星际穿越克里斯托弗·诺兰9.41800000剧情/科幻
盗梦空间克里斯托弗·诺兰9.31600000剧情/科幻

应用场景

  • 做选片参考时,把「评分」按高低排序,结合「评价人数」筛出高分且口碑扎实的片单。
  • 做口碑分析时,从「五星」「一星」占比看评分结构,识别评分高但两极分化的电影。
  • 盯榜单变化时,隔几天跑同一个列表页,比对两次的「影名」看谁新上榜、谁跌出榜单。

适用边界

单次任务采集一个豆瓣电影列表页的电影条目,结果条数受采集上限控制(默认 1000 条)。

  • 适合用于
  • 需要按列表页批量获取豆瓣电影的基础信息与评分时
  • 需要对比多部电影的评价人数、星级分布做选片或内容分析时
  • 不要用于
  • 需要单部电影的完整影评内容时——用影评采集类 App
  • 需要实时价格或购票信息时——本 App 只覆盖豆瓣展示信息

失败处理

作者声明的失败与重试处理方式,接入时建议一并写进系统提示词。

  1. 1任务失败属可重试错误,可原样重新提交
  2. 2结果分页返回,条数多时请用 SDK/REST 导出而非反复翻页

输入参数

调用本 App 需要传入的参数,与 manifest.json 的 input.schema 同源。

字段名业务名称类型必填默认值枚举 / 约束示例说明
list_url列表页链接stringhttps://movie.douban.com/chart要采集的豆瓣电影列表页完整链接,形如 https://movie.douban.com/chart。一次任务填写一个链接
max_pages翻页次数integer1–100列表结果最多翻几页,不填表示不限制翻页、按列表实际页数全部采集。数值越大耗时和费用越高
max_collected_rows采集条数上限integer10001–1000000本次任务总共采集的记录条数上限,默认 1000 条。数值越大耗时和费用越高

输出数据

单条记录的字段结构,与 manifest.json 的 output.schema 同源。

字段名业务名称类型示例说明
keyword关键词string采集时使用的关键词或列表标识(原字段名 关键词)
page_no页码string电影所在列表页码(原字段名 页码)
movie_name影名string电影名称(原字段名 影名)
director导演string电影导演(原字段名 导演)
writer编剧string电影编剧(原字段名 编剧)
cast主演string电影主演(原字段名 主演)
release_date上映时间string电影上映时间(原字段名 上映时间)
genre类型string电影类型,如剧情/喜剧(原字段名 类型)
production_country制片国家/地区string电影制片国家或地区(原字段名 制片国家_地区)
language语言string电影语言(原字段名 语言)
duration片长string电影时长(原字段名 片长)
aka又名string电影的其他名称(原字段名 又名)
rating评分string豆瓣评分,如 8.5(原字段名 评分)
star_rating星级string评分对应的星级展示(原字段名 星级)
rating_count评价人数string参与评分的人数(原字段名 评价人数)
five_star五星string五星评价占比(原字段名 五星)
four_star四星string四星评价占比(原字段名 四星)
three_star三星string三星评价占比(原字段名 三星)
two_star二星string二星评价占比(原字段名 二星)
one_star一星string一星评价占比(原字段名 一星)
summary剧情简介string电影剧情简介(原字段名 剧情简介)
collect_time采集时间string本条的采集时间(原字段名 采集时间)
page_url页面网址string电影条目所在页面的网址(原字段名 页面网址)

记录 Schema

输出按记录逐条返回。记录主键为 movie_name,去重、增量、关联以它为准。

output.schema
{
  "type": "object",
  "properties": {
    "keyword": {
      "type": "string",
      "title": "关键词",
      "description": "采集时使用的关键词或列表标识(原字段名 关键词)"
    },
    "page_no": {
      "type": "string",
      "title": "页码",
      "description": "电影所在列表页码(原字段名 页码)"
    },
    "movie_name": {
      "type": "string",
      "title": "影名",
      "description": "电影名称(原字段名 影名)"
    },
    "director": {
      "type": "string",
      "title": "导演",
      "description": "电影导演(原字段名 导演)"
    },
    "writer": {
      "type": "string",
      "title": "编剧",
      "description": "电影编剧(原字段名 编剧)"
    },
    "cast": {
      "type": "string",
      "title": "主演",
      "description": "电影主演(原字段名 主演)"
    },
    "release_date": {
      "type": "string",
      "title": "上映时间",
      "description": "电影上映时间(原字段名 上映时间)"
    },
    "genre": {
      "type": "string",
      "title": "类型",
      "description": "电影类型,如剧情/喜剧(原字段名 类型)"
    },
    "production_country": {
      "type": "string",
      "title": "制片国家/地区",
      "description": "电影制片国家或地区(原字段名 制片国家_地区)"
    },
    "language": {
      "type": "string",
      "title": "语言",
      "description": "电影语言(原字段名 语言)"
    },
    "duration": {
      "type": "string",
      "title": "片长",
      "description": "电影时长(原字段名 片长)"
    },
    "aka": {
      "type": "string",
      "title": "又名",
      "description": "电影的其他名称(原字段名 又名)"
    },
    "rating": {
      "type": "string",
      "title": "评分",
      "description": "豆瓣评分,如 8.5(原字段名 评分)"
    },
    "star_rating": {
      "type": "string",
      "title": "星级",
      "description": "评分对应的星级展示(原字段名 星级)"
    },
    "rating_count": {
      "type": "string",
      "title": "评价人数",
      "description": "参与评分的人数(原字段名 评价人数)"
    },
    "five_star": {
      "type": "string",
      "title": "五星",
      "description": "五星评价占比(原字段名 五星)"
    },
    "four_star": {
      "type": "string",
      "title": "四星",
      "description": "四星评价占比(原字段名 四星)"
    },
    "three_star": {
      "type": "string",
      "title": "三星",
      "description": "三星评价占比(原字段名 三星)"
    },
    "two_star": {
      "type": "string",
      "title": "二星",
      "description": "二星评价占比(原字段名 二星)"
    },
    "one_star": {
      "type": "string",
      "title": "一星",
      "description": "一星评价占比(原字段名 一星)"
    },
    "summary": {
      "type": "string",
      "title": "剧情简介",
      "description": "电影剧情简介(原字段名 剧情简介)"
    },
    "collect_time": {
      "type": "string",
      "title": "采集时间",
      "description": "本条的采集时间(原字段名 采集时间)"
    },
    "page_url": {
      "type": "string",
      "title": "页面网址",
      "description": "电影条目所在页面的网址(原字段名 页面网址)"
    }
  },
  "required": [],
  "additionalProperties": false
}

调用方式

本 App 支持通过 MCP、API、SDK 与文件导出方式接入,各接入方式共享同一套能力与计价。所有请求统一使用 Authorization: Bearer 请求头完成身份认证,凭证为 API Key(长期有效,在开放平台创建);MCP 客户端另支持 OAuth 免密钥登录。CLI、Skill 等更多接入方式正在规划中。

通过 MCP(Model Context Protocol)协议,可在 Claude、Cursor 等 AI 客户端中直接调用本 App。选择你的客户端与认证方式,复制下方配置即可接入。

客户端配置

把 Bearer 后替换为长期有效的 API Key 即可,各类客户端与 CI、无浏览器环境通用。

mcpServers 配置
{
  "mcpServers": {
    "SpiderByte__douban-hot-movies": {
      "type": "http",
      "url": "https://mcp-v2.bazhuayu.com?pin=SpiderByte/douban-hot-movies",
      "headers": { "Authorization": "Bearer <YOUR_API_KEY>" }
    }
  }
}

让 AI 自己完成配置

不想手动改配置?复制安装提示词,粘贴到任意 AI 客户端对话框,由它按自身方式完成接入(提示词会让 AI 向你索要 API Key,避免凭证留在对话记录或共享配置里)。

如需在同一个 MCP 连接里指定多个 App,前往 MCP 连接页(已为你指定本 App)。

价格

返回一部电影

按实际成功返回的数据条数计费,任务失败不计费。

¥0.001/

多个计费事件按各自口径独立累计,具体以每一项说明为准;任务失败不计费。

立即体验

填写参数直接运行,结果来自真实调用。

示例
参数按 input.schema 校验后提交
请先填写必填参数
¥0.001 / 条