采集原理/逻辑 - 八爪鱼文档

经过前几课的学习，我们已经掌握了列表数据、点击多个链接后的详情页数据、表格数据任务配置方法。在此基础上，本课将详解八爪鱼的采集原理和流程执行逻辑，让大家对八爪鱼采集数据的方法有一个更深入的理解。

一、八爪鱼采集原理

1、模拟人的行为，通过内置Chrome浏览器浏览网页数据。所以采集数据的第一步永远是找到目标网址并输入。这跟通过普通浏览器访问网页完全一样。在普通浏览器中需要点击链接进入详情、点击翻页按钮查看更多数据，在八爪鱼中也需如此操作。 2、根据网页特性和采集需求，设计采集流程，八爪鱼根据流程全自动采集数据。平常我们浏览网页的动作不会被记录下来。例如：这次在京东上输入关键词【手机】查询相关商品数据，下次还需要输。在用八爪鱼采集数据的时候，我们就需要根据网页特性和采集需求，设计采集流程，将我们的采集需求记录下来。之后八爪鱼就能根据设计好的采集流程，全自动的采集数据。例如：在前几课中学到的，需采集页面上的所有商品列表，我们就做一个【循环-提取数据】的步骤。采集时有很多页，需要翻页，我们就做一个【循环翻页】的步骤。