Python网络爬虫
内容简介:本书围绕Python网络爬虫技术及相关框架, 主要参照1+X数据采集职业技能等级要求, 以学习情境方式介绍了基于静态网页的爬虫技术及相关框架, 如Requests、BeautifulSoup4、XPath、CSV和PyMySQL ; 基于动态网页的爬虫技术及框架, 如Scrapy、Selenium、JSON、PhantomJS和Pillow ; 基于App应用的爬虫技术与应用软件, 如Fiddler ; 反爬虫策略, 如用Headers模拟浏览器, 用Cookies记录身份信息 ; 通过结合Scrapy和Redis提高网络爬虫的效率、安全性及数据一致性。
登录后可荐购