> ## Documentation Index
> Fetch the complete documentation index at: https://www.bazhuayu.com/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# 【智联招聘】智联招聘职位数据采集

**采集场景**

在智联招聘地区招聘搜索页（[https://sou.zhaopin.com/?jl=765）](https://sou.zhaopin.com/?jl=765）)， 输入关键词搜索（示例中的搜索关键词为【爬虫工程师】），搜索后得到招聘信息列表页。点击职位链接，进入职位详情页，采集详情页数据。

 

**采集字段**

职位名称、职位薪资、职位描述、职位链接等。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/01-653b640d89c80.png?fit=max&auto=format&n=K6D877_j6dDijaTL&q=85&s=fea59cbc568d3758b1379f816a867fcd" alt="【智联招聘】智联招聘职位数据采集" width="1503" height="525" data-path="assets/academy/case-studies/zhaopin-job-listings/01-653b640d89c80.png" />

 

 

**采集结果**

采集结果可导出为Excel、CSV、HTML、数据库等多种格式。导出为Excel示例：

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/02-653b642bba043.png?fit=max&auto=format&n=K6D877_j6dDijaTL&q=85&s=3557c7b3652c82b09e22d8be6e15acf1" alt="【智联招聘】智联招聘职位数据采集" width="1019" height="572" data-path="assets/academy/case-studies/zhaopin-job-listings/02-653b642bba043.png" />

 

 

**采集步骤**

步骤一：打开网页

步骤二、输入关键词并搜索

步骤三、建立【循环-点击元素】，进入每个职位的详情页

步骤四、提取职位详情页中的字段

步骤五、编辑字段

步骤六、创建【循环翻页】，采集多页数据

步骤七、启动采集

 

**以下为具体步骤：**

 

## 步骤一、打开网页

 

在首页【输入框】中输入目标网址 [https://sou.zhaopin.com/?jl=765](https://sou.zhaopin.com/?jl=765)，点击【开始采集】，八爪鱼自动打开网页。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/03-653b643533929.gif?s=a084ed88ae02046e28ae20b19a98546f" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/03-653b643533929.gif" />

 

特别说明：

* a. 打开网页后，如果开始开始【自动识别】，请点击【不再自动识别】或【取消识别】将其关掉。因为本文不适合使用【自动识别】。
* b. 【自动识别】适用于自动识别网页上的列表、滚动和翻页，识别成功后直接启动采集即可获取数据。详情点击查看 [【自动识别】教程](../tutorial8/81zdypz)
* c. 示例中输入的网址 [https://sou.zhaopin.com/?jl=765](https://sou.zhaopin.com/?jl=765) ，是深圳智联招聘的网址，可根据需求，更换目标城市，得到相关网址。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/04-653b643ecec29.png?fit=max&auto=format&n=K6D877_j6dDijaTL&q=85&s=1ff459a0894d278e4bf407dc8791f676" alt="【智联招聘】智联招聘职位数据采集" width="1013" height="319" data-path="assets/academy/case-studies/zhaopin-job-listings/04-653b643ecec29.png" />

 

## 步骤二、输入关键词并搜索

 

1、输入关键词并搜索

选中搜索框，在操作提示框中点击【输入文本】，输入要搜索的职位或公司，如【爬虫工程师】、【python工程师】等。

选中【搜索】按钮，在操作提示框中点击【点击该元素】，出现搜索结果列表页。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/05-653b6447a6acc.gif?s=32d97ea8355641678dbb9df4f81e494f" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/05-653b6447a6acc.gif" />

 

2、设置滚动，以加载更多职位列表

搜索后，向下滚动页面加载出新的职位列表，在八爪鱼中也需设置滚动。

在【点击元素】下方的设置页面，点击【高级设置】，设置【页面加载后向下滚动】，滚动方式为【直接滚动到底部】，【滚动次数】为4次，【每次间隔】2秒 ，设置后保存。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/06-653b644ed4b2c.gif?s=6ece7aa345f293fd447022c44077f3ce" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/06-653b644ed4b2c.gif" />

 

特别说明：

* a. 设置中的滚动次数和时间间隔，请根据采集需求和网页加载情况进行设置，并非是一成不变的，具体请点击查看 [处理滚动加载数据的网页教程](../tutorial8/81ymgd)

 

## 步骤三、建立【循环-点击元素】，进入每个职位的详情页

 

通过以下几步，实现循环点击每个职位链接，进入职位详情页

① 选中页面上第1个职位链接

② 在黄色操作提示框中，点击【选中全部】，以选中全部职位链接

③ 点击【循环点击每个元素】，进入第1个职位的详情页

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/07-653b645d2f3c5.gif?s=f9f4badc1d241485ddce3c73e59c9705" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/07-653b645d2f3c5.gif" />

 

特别说明：

* a. 经过以上连续3步，【循环-点击元素】创建完成。【循环】中的项，对应着页面上所有职位链接。启动采集以后，八爪鱼就会按照循环中的顺序依次点击每个职位链接，进入情页，以采集每个职位的具体数据。
* b. 为何通过以上3步，可建立【循环-点击元素】？详情点击查看 [采集点击多个链接后的详情页数据教程](../tutorial8/81xsrm6) 。

 

## 步骤四、提取详情页中的字段

 

进入详情页后，手动提取我们需要采集的字段。

不同类型的字段有不同的提取方式：

 

1、采集文本

选中页面中的文本，然后在操作提示框中点击【采集该元素文本】。

职位名称、职位薪资、职位描述等文本类型的字段，均可这样提取。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/08-653b64661982c.gif?s=cca1571125d43955860344a1506c29c9" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/08-653b64661982c.gif" />

 

2、采集页面网址

进入【提取数据】设置页面，点击 【+】 按钮，选择【添加当前页面信息】-【页面网址】，然后保存

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/09-653b646d935e1.gif?s=b6d19374d282389727a80b158d8e0278" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/09-653b646d935e1.gif" />

 

## 步骤五、创建【循环翻页】，采集多页数据

 

1、创建【循环翻页】

如果只是采集一页数据，可跳过此步骤。

 

如果需要翻页以采集多页数据：

点击规流程图里的【循环列表】，让页面返回到上一级页面。选择页面中的【下一页】按钮，在操作提示上单击【循环点击下一页】，创建【循环翻页】。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/10-653b64778ea51.gif?s=9613525005a9d87b9b7a22c16da3f0c8" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/10-653b64778ea51.gif" /> \
\
 2、设置滚动

【点击翻页】后，也会向下滚动页面加载出新的职位列表，也需设置滚动。

在【点击翻页】步骤下方的高级设置页面，设置【页面加载后向下滚动】，滚动方式为【直接滚动到底部】，【滚动次数】为4次，【每次间隔】2秒 ，设置后保存。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/11-653b647dd6703.gif?s=10e19113897942f4146ec954ef3b4ea0" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/11-653b647dd6703.gif" />

 

3、修改【循环翻页】的XPath

默认的【循环翻页】XPath会在最后一页重复翻页，导致其他关键词无法输入并采集，需修改【循环翻页】XPath。

进入【循环翻页】设置页面，修改XPath为：//button\[text()="下一页" and not(@disabled)]** ** 。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/12-653b6486a28a8.gif?s=db48218e5b5fa67a83fbd699b694aed1" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/12-653b6486a28a8.gif" />

 

特别说明：

* a. 创建【循环翻页】后，八爪鱼会自动点击【下一页】按钮进行翻页，从第1页，第2页......直到最后1页。如果只需采集特定页的数据，可在八爪鱼中设置循环翻页的次数，详情点击查看  [翻页以采集多页数据教程](../tutorial8/81xsrm7)。
* b. 设置中的滚动次数和时间间隔，请根据采集需求和网页加载情况进行设置，并非是一成不变的，具体请点击查看 [处理滚动加载数据的网页教程](../tutorial8/81ymgd)
* c. 什么是XPath？如何写一条正确的XPath？点击查看 [XPath学习与实例教程](../tutorial8/81xpath) 。

 

## 步骤六、编辑字段

 

点击规流程图里的【提取数据】，让页面返回到职位详情页页面。

在【当前数据预览】页面，删除多余字段，修改字段名，移动字段顺序等。 

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/13-653b64900b1ec.gif?s=e3741dfa98203f2563d566f59761b0bd" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/13-653b64900b1ec.gif" />

 

## 步骤七、启动采集

 

1、点击【采集】并【启动本地采集】。启动后八爪鱼开始自动采集数据。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/14-653b649e2ae59.gif?s=f3dedc30d852e2de947ab8767c1c7c97" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="800" data-path="assets/academy/case-studies/zhaopin-job-listings/14-653b649e2ae59.gif" />

 

2、采集完成后，选择合适的导出方式来导出数据。支持导出为Excel，CSV，HTML，数据库等。这里导出为Excel。

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/15-653b64a5bb32d.png?fit=max&auto=format&n=K6D877_j6dDijaTL&q=85&s=2406dc67e9ca1f798c4a65dcfce820eb" alt="【智联招聘】智联招聘职位数据采集" width="1200" height="734" data-path="assets/academy/case-studies/zhaopin-job-listings/15-653b64a5bb32d.png" />

 

示例数据：

<img src="https://mintcdn.com/bazhuayu/K6D877_j6dDijaTL/assets/academy/case-studies/zhaopin-job-listings/16-653b64ae6d2c2.png?fit=max&auto=format&n=K6D877_j6dDijaTL&q=85&s=6bfc370e7db4b610b83ccee57b634301" alt="【智联招聘】智联招聘职位数据采集" width="1019" height="572" data-path="assets/academy/case-studies/zhaopin-job-listings/16-653b64ae6d2c2.png" />
