Python3网络爬虫开发实战(第3集)解析和提取网页数据
发布时间
阅读量:
阅读量
文章结构概述
- 一、XPath
-
- 1. 节点选取
- 2. 定位具有特定属性或包含特定内容的节点
- 3. XPath 运算符的使用
- 4. 节点轴的概念与应用
- 5. 在 lxml 模块中实现 XPath 查询
-
二、CSS
-
三、Beautiful Soup
-
- 1. 数据抓取与提取
- 2. 多层嵌套结构的选择方式
- 3. 相关元素之间的关联选取方法
- 4. 基于方法的选取策略
- 5. CSS 样式选择器的应用
-
四、PyQuery
-
- 1. 对文档对象的初始化处理
- 2. 使用 CSS 样式选择器进行元素定位
- 3. 提取所需的信息内容
- 4. 对节点执行相关操作
-
五、Parsel
-
- 1. XPath 和 CSS 样式选择器的综合运用
- 2. 数据信息的提取过程
- 3. 利用正则表达式进行数据匹配与提取
-

一、XPath
全部评论 (0)
还没有任何评论哟~
