Advertisement

Python3网络爬虫开发实战(第3集)解析和提取网页数据

阅读量:

文章结构概述

  • 一、XPath
      • 1. 节点选取
      • 2. 定位具有特定属性或包含特定内容的节点
      • 3. XPath 运算符的使用
      • 4. 节点轴的概念与应用
      • 5. 在 lxml 模块中实现 XPath 查询
    • 二、CSS

    • 三、Beautiful Soup

      • 1. 数据抓取与提取
      • 2. 多层嵌套结构的选择方式
      • 3. 相关元素之间的关联选取方法
      • 4. 基于方法的选取策略
      • 5. CSS 样式选择器的应用
    • 四、PyQuery

      • 1. 对文档对象的初始化处理
      • 2. 使用 CSS 样式选择器进行元素定位
      • 3. 提取所需的信息内容
      • 4. 对节点执行相关操作
    • 五、Parsel

      • 1. XPath 和 CSS 样式选择器的综合运用
      • 2. 数据信息的提取过程
      • 3. 利用正则表达式进行数据匹配与提取
在这里插入图片描述

一、XPath

全部评论 (0)

还没有任何评论哟~