学习资料收集自知乎专栏:
具体的学习路线是什么?
总体分为三个大方面:
简单的定向脚本爬虫(request —- bs4 —- re)
大型框架式爬虫(Scrapy框架为主)
浏览器模拟爬虫 (Selenium 模拟)
具体的步骤:
一:Beautiful Soup 爬虫
Ehco:从零开始写Python爬虫 --- 1.1 requests库的安装与使用zhuanlan.zhihu.com
Ehco:从零开始写Python爬虫 --- 1.2 BS4库的安装与使用zhuanlan.zhihu.com
图标

图标

图标

图标

图标

图标

图标
二: Scrapy 爬虫框架
Ehco:从零开始写Python爬虫 --- 2.1 Scrapy 爬虫框架的安装与基本介绍zhuanlan.zhihu.com
Ehco:从零开始写Python爬虫 --- 2.2 Scrapy 选择器和基本使用zhuanlan.zhihu.com
图标

图标

图标

图标

图标
三: 浏览器模拟爬虫
Ehco:从零开始写Python爬虫 --- 3.1 Selenium模拟浏览器zhuanlan.zhihu.com
Ehco:从零开始写Python爬虫 --- 3.2 爬虫实践:获取快代理zhuanlan.zhihu.com
图标

图标
四: 练手项目:
Ehco:从零开始写Python爬虫 --- 爬虫实践:螺纹钢数据&Cookieszhuanlan.zhihu.com
Ehco:从零开始写Python爬虫 --- 爬虫实践:登录正方教务系统zhuanlan.zhihu.com
图标

图标

图标

图标

图标

图标

图标

图标

图标

图标

图标

图标
五: 自己写点小工具:
Ehco:爬虫存储海量数据太麻烦? 换个姿势试一试!zhuanlan.zhihu.com
Ehco:爬虫会用到的小工具: LazySpider 发布啦!zhuanlan.zhihu.com
图标




