第一步:搜索并精确读取模板
先用query 搜索模板,再用返回的 id 或 slug 精确读取详情。仅选择 executionMode 包含 Cloud 的模板;Local only 模板应在八爪鱼桌面客户端运行。
templateName,并只使用 inputSchema[].field 作为参数 key。下拉或多选字段要传 sourceTree 的 option key,不是页面上的显示名称。
第二步:创建并启动任务
用唯一的taskName 便于稍后恢复任务。parameters 原始接口为 JSON 对象字符串;MultiInput 和 CheckboxList 即使只有一个值也传数组。
input_required 和下一层 sourceOptions;补齐后再次调用。若失败结果已经带有 taskId,不要重建,直接查状态。
第三步:确认任务完成
使用get_task_status(taskId) 查询真实状态。常见状态为 unexecuted、running、completed 和 stopped;collectedRows 为 0 时也要结合状态判断。直到任务完成或停止后,再记录该次运行的 lotNo。
第四步:分页读取或下载数据
totalPages 分页处理 data。总数据较大时优先使用返回的 directAccess 签名下载 URL 或 curlTemplate,不要将大批量结果反复粘贴到会话中。
其他工作流
- 已有任务:
search_tasks→get_task_status→export_data;需要改变状态时才用start_or_stop_task。 - 数据中心内容检索:
list_platforms→search_platform_content;这是查询提前采集的存量内容,不会创建网页采集任务。 - Temu / TikTok Shop:
ecommerce_data_task→describe_ecommerce_dataset→query_collected_reviews。 - Amazon:使用模板云采集链路。先用关键词搜索模板获取商品与 ASIN,再用详情、评论模板补充数据;不要将 Amazon 当作电商专项接口的支持平台。
search_templates、get_task_status、export_data