
Python网络爬虫:从入门到精通
教材教辅研究生/本科/专科教材11.2万字
更新时间:2023-10-25 19:34:57 最新章节:参考文献
书籍简介
本书主要介绍如何使用Python语言进行网络爬虫程序的开发,从Python语言的基本特性入手,详细介绍Python网络爬虫开发的多个方面,涉及HTTP、HTML、正则表达式、JavaScript、自然语言处理、数据处理与科学计算等不同领域的内容。全书共12章,包括基础篇、进阶篇、提高篇和实战篇4个部分。基础篇包括第1、2、3章,分别为Python基础及网络爬虫、静态网页抓取、数据存储。进阶篇包括第4、5、6章,分别为JavaScript与动态内容、模拟登录与验证码、爬虫数据的分析与处理。提高篇包括第7、8、9章,分别为爬虫的灵活性和多样性、Selenium模拟浏览器与网站测试、爬虫框架Scrapy与反爬虫。实战篇提供了3个实战项目供读者学习参考。本书内容覆盖网络数据抓取与爬虫编程中的主要知识和前沿技术。同时,本书在重视理论基础的前提下,从实用性和丰富度出发,结合实例演示爬虫程序编写的核心流程,将理论与实践结合,力求提高读者的网络爬虫实操技能。本书可作为高等院校数据科学、统计学、计算机科学、软件工程等相关专业课程的教材,也可作为Python语言初学者、网络爬虫技术爱好者的参考书。
品牌:人邮图书
上架时间:2023-07-01 00:00:00
出版社:人民邮电出版社
本书数字版权由人邮图书提供,并由其授权上海阅文信息技术有限公司制作发行
最新章节
吕云翔主编
- 会员本书结合了Python3.6的新特性,完全为零基础的初学者量身定做。书中例举大量实例,介绍了Python的基本语法、编码规范和一些编程思想。本书第1~8章为Python语言基础,主要介绍Python的基本用法;第9章为一个实战,帮助读者理解前8章的知识;第10~17章为Python的进阶使用,包含面向对象编程、函数式编程入门、文件读写、异常处理、模块和包几个部分;第18章为第2个实战,帮助读者融高教教材8.4万字
最新上架
- 会员本书以中华传统文化在商业实践中的影响、传承、融合与光大为主线,系统阐述了伴随商业活动成长起来的中华商业文化的内涵和外延,分析了其对经济发展和社会进步的影响和推动作用。在数智化时代背景下,本书力求将传统与现代商业文化兼收并蓄,取中外商业思想之精华,将以人为本的商业情怀融入其中,倡导合作共赢、和谐发展,并展现新时代社会主义奋斗者的精神风貌。本书共8章,包括商业文化概论、中华商业文化的演变与觉醒、中华传教材教辅13.1万字
- 会员本书以Hive为开发平台,主要介绍了如何使用HiveQL来查询和分析存储在Hadoop分布式文件系统上的大数据集合,具体内容包括Hive入门、Hive数据库及表操作、Hive元数据、Hive高级操作、Hive函数与Streaming、Hive视图与索引、Hive调优、Hive与HBase集成、数据迁移框架Sqoop等。本书介绍的每个任务都运用了大量案例,紧密结合实际应用,融入了含金量十足的开发经验教材教辅8万字
- 会员本书全面、系统地介绍新媒体技术的核心知识与应用领域,包括新媒体技术概述、图形图像的编辑与制作、视频的编辑与制作、音频的编辑与制作、动画的编辑与制作及综合案例等内容。本书第1章为基础知识;第2~5章以课堂案例为主线展开讲解,每个课堂案例都有详细的操作步骤,学生通过实际操作可以快速熟悉新媒体技术并掌握应用技巧,课堂练习和课后习题可以提升学生应用新媒体技术的能力,拓展学生的设计思路;第6章综合案例设有8教材教辅9万字
- 会员《运筹学课程思政案例集》系统介绍了运筹学的基本理论与实务,共包括十三章内容,分别介绍了运筹学绪论、线性规划与单纯形法、对偶理论与灵敏度分析、运输问题、目标规划、整数规划、图与网络分析、非线性规划、动态规划、排队论、存储论、决策分析、启发式算法。每章按照运筹学相关理论内容展开,编排了相关的课程思政案例。各章设置了“教学反思”栏目,各节设置了“知识点与对应的思政元素”“课程思政教学案例”栏目,以求实现教材教辅7万字