Skip to main content
八爪鱼采集器 MCP 的模板云采集推荐流程:

第一步:搜索并精确读取模板

先用 query 搜索模板,再用返回的 idslug 精确读取详情。仅选择 executionMode 包含 Cloud 的模板;Local only 模板应在八爪鱼桌面客户端运行。
精确查询后,记录 templateName,并只使用 inputSchema[].field 作为参数 key。下拉或多选字段要传 sourceTree 的 option key,不是页面上的显示名称。

第二步:创建并启动任务

用唯一的 taskName 便于稍后恢复任务。parameters 原始接口为 JSON 对象字符串;MultiInputCheckboxList 即使只有一个值也传数组。
参数还不完整时,调用会返回 input_required 和下一层 sourceOptions;补齐后再次调用。若失败结果已经带有 taskId,不要重建,直接查状态。

第三步:确认任务完成

使用 get_task_status(taskId) 查询真实状态。常见状态为 unexecutedrunningcompletedstoppedcollectedRows0 时也要结合状态判断。直到任务完成或停止后,再记录该次运行的 lotNo

第四步:分页读取或下载数据

totalPages 分页处理 data。总数据较大时优先使用返回的 directAccess 签名下载 URL 或 curlTemplate,不要将大批量结果反复粘贴到会话中。

其他工作流

  • 已有任务:search_tasksget_task_statusexport_data;需要改变状态时才用 start_or_stop_task
  • 数据中心内容检索:list_platformssearch_platform_content;这是查询提前采集的存量内容,不会创建网页采集任务。
  • Temu / TikTok Shop:ecommerce_data_taskdescribe_ecommerce_datasetquery_collected_reviews
  • Amazon:使用模板云采集链路。先用关键词搜索模板获取商品与 ASIN,再用详情、评论模板补充数据;不要将 Amazon 当作电商专项接口的支持平台。
另请参阅:search_templatesget_task_statusexport_data