本书从技术、工具与实战3个维度讲解了Python 络爬虫:
技术维度:详细讲解了Python 络爬虫实现的核心技术,包括 络爬虫的工作原理、如何用urllib库编写 络爬虫、爬虫的异常处理、正则表达式、爬虫中Cookie的使用、爬虫的浏览器伪装技术、定向爬取技术、反爬虫技术,以及如何自己动手编写 络爬虫;
工具维度:以流行的Python 络爬虫框架Scrapy为对象,详细讲解了Scrapy的功能使用、高级技巧、架构设计、实现原理,以及如何通过Scrapy来更便捷、高效地编写 络爬虫;
实战维度:以实战为导向,是本书的主旨,除了完全通过手动编程实现 络爬虫和通过Scrapy框架实现 络爬虫的实战案例以外,本书还有博客爬取、图片爬取、模拟登录等多个综合性的 络爬虫实践案例。
韦玮
资深 络爬虫技术专家、大数据专家和软件开发工程师,从事大型软件开发与技术服务多年,现任重庆韬翔 络科技有限公司创始人兼CEO,国家专利发明人。
精通Python技术,在Python 络爬虫、Python机器学习、Python数据分析与挖掘、Python Web开发等多个领域都有丰富的实战经验。
CSDN、51CTO、天善智能等科技类 区和媒体的特邀专家和讲师,输出了大量的高质量课程和文章,深受用户喜爱。
微博:http://weibo.com/qiansyy
声明:本站部分文章及图片源自用户投稿,如本站任何资料有侵权请您尽早请联系jinwei@zod.com.cn进行处理,非常感谢!