bazhuayu detect是网页检测与任务生成入口。v0.1.32 使用bazhuayu作为唯一命令入口,并继续兼容用户浏览器模式、Agent 计划、API 列表候选、可见 DOM 字段选择和自定义候选区能力。
v0.1.32 识别与命令更新
- 命令改名:所有当前调用改用
bazhuayu detect;octopus可执行命令已删除。 - 验证页提前终止:检测到验证码、访问限制或安全验证页面时,
detect会在生成任务前失败退出,避免把验证页保存成无效任务。 - 候选区判断优化:弱候选和整页导航区域的判断得到优化,降低把导航栏、侧边栏误选为主数据区的概率。
bazhuayu detect。不要把失败输出当作已生成的任务继续执行 run。
v0.1.30 用户浏览器模式
默认independent 模式使用临时 Chrome for Testing Profile。需要检测后台、会员页或其他登录后页面时,可使用 v0.1.30 新增的 user 模式复用 Chrome / Edge 登录状态:
bazhuayu browser 安装扩展,并确认 browser status --json 的 readyForUserBrowserRun 为 true。用户模式仅支持 Windows 和 macOS,不支持 --headless。日常 detect 会复用已打开的浏览器并创建专用会话窗口;只有 browser install 要求浏览器完全关闭。
浏览器选择优先级为 --browser 参数、OCTOPUS_BROWSER 环境变量、browser use 保存的默认设置、independent。--force-close-browser 仅用于多开或 Profile 锁定等故障恢复,通常无需传入。
v0.1.28 更新要点(历史)
v0.1.28 的主要新增能力集中在任务管理、任务组、模板任务、云定时和数据检查命令。新建任务的推荐流程保持为:v0.1.27 更新要点(历史)
--agent 当前不再需要 --yes。为了兼容旧脚本,CLI 仍接受 --yes,但新示例和新脚本请省略。
API 列表任务会在 JSON 输出中标记 generatedTask.mode: "api_list" 与 localOnly: true。这类任务可以用 bazhuayu run <taskId> --task-file task.json 本地运行,当前不自动同步云端任务。
v0.1.26 更新要点(历史)
所有 v0.1.23~v0.1.25 的命令和脚本无需修改即可直接使用。
v0.1.25 更新要点(历史)
所有 v0.1.24 的命令和脚本无需修改即可直接使用。
Agent 最短路径
LLM 或 Agent 创建任务时,应先运行bazhuayu capabilities --json,再使用可信的本地 Agent 运行器:
--run-sample <n> 只支持 --agent,且 n 必须是正整数。它会使用生成的任务执行一次 --max-rows <n> 本地采集。可用 --run-output <dir> 指定样品产物目录。独立模式可用 --headless 控制样品采集;用户浏览器模式不支持无头运行。
generatedTask:任务文件、任务 ID、字段和候选区preview:Agent plan 风险预览agentFiles:使用--keep-agent-files时保留的上下文和计划文件sampleRun:样品采集的退出码、运行结果和质量摘要
sampleRun.summary 会提供 sampledRows、fieldFillRates、missingFieldsByRow 和 judgment。即使样品采集失败,任务文件仍可能已经成功生成,因此自动化程序应分别检查顶层 ok 和 sampleRun.exitCode。
v0.1.27 的 Agent 计划可在 preview 未通过时根据 repairInstruction 修正后重新应用:
Agent 审计路径
需要保留完整上下文和人工审查记录时,使用分步流程:visualElements、pageVisualElements 和 apiCandidates,路径位于 context.screenshot、context.visualArtifacts 和 context.decisionSummary。Agent 写 plan.json 前必须:
- 打开标注截图或全页截图。
- 检查所选候选区的裁剪图。
- 根据用户目标、页面标题、首屏、当前导航/Tab、语义目的和主内容显著性判断主目标。
- 核对主数据区域、字段、详情链接和分页控件。
- 在
visualReview中记录视觉证据。
visualReview 与 selection 均为必需对象。visualReview 至少需要 reviewed: true、screenshotPath、selectedCandidateId 和一条 evidence。缺少视觉证据、截图路径错误或候选 ID 不一致时,--preview-agent-plan 会判定计划不通过。
字段选择优先使用 context.visualElements[].id 作为 selection.fields[].elementId。当截图中有标题、价格、图片、作者、指标或详情链接,但 deterministic detector 没有提升为字段时,可选择 source=visible_dom 的元素;需要链接或图片地址时设置 kind: "href" 或 kind: "src"。
如果 context.candidates 都没有覆盖目标可见区域,可用 context.pageVisualElements 构造自定义候选区:
customCandidate 至少需要 xpath,并需要 fields 或 fieldElementIds。引用的元素 ID 必须存在于 context.pageVisualElements,否则 preview/apply 会失败。
当 context.apiCandidates 存在,且它清楚对应页面主列表、用户需要可扩展列表采集、DOM 候选又很弱时,Agent 可以选择 API 候选:
api_list 本地任务;输出会包含 localOnly: true。
样品数据出现少量空字段不一定表示任务错误。广告、推荐卡、专题块或异构记录可能天然缺少可选字段;只有主数据区域选错、核心字段在多数代表性行中缺失、搜索或分页结构错误时,才应重新生成任务。
自动模式
--auto 适合用户直接操作 CLI,由确定性检测结果自动选择最佳候选区。它不是 LLM/Agent 创建任务的默认路径。
--output,CLI 会在当前目录自动创建 detected_<host>.json。带有 &、? 等 shell 特殊字符的 URL 应使用引号包裹。
手动与搜索模式
--save-session 与 --session-name。
在无图形界面的 Linux 服务器上,非手动检测可在安装 Xvfb 后自动使用虚拟显示;手动模式需要桌面或 VNC 环境。
detect 任务同步到客户端
v0.1.25 新增能力:detect --auto 或 detect --agent 生成的普通任务会自动同步到八爪鱼桌面客户端的任务列表,可在客户端直接查看和编辑。v0.1.27 的 api_list 任务当前为本地任务,不自动同步云端。
- CLI 生成任务 → 同事在客户端微调 → 大家一起用
- 本地和云端任务打通,不再割裂
校验并运行
detect 负责生成任务,不会直接执行采集。推荐流程:
从旧命令迁移
下一步
运行采集任务
校验并运行
detect 生成的任务文件。浏览器管理
配置用户 Profile、扩展和浏览器默认模式。
输出与退出码
在脚本、CI 和 Agent 中使用结构化输出。
