Advertisement

Beautiful soup用于数据解析与提取

阅读量:

目录

一、配置Beautiful soup

二、解析与提取网页所需内容

1、标签树的遍历方式

1.1 soup.

1.2 标签树的下行遍历方法:.contents 和 .children 及.descendants

1.3 标签树的上行遍历方式:.parent .parents

1.4 标签树的平行遍历方式:.next_sibling 和 .previous_sibling及.next_siblings 和 .previous_siblings

1.5 信息提取方法:.string、.strings、.stripped_strings

2、标签树的查找操作

2.1 find() 和find_all()

2.2 CSS选择器的应用

3. 信息提取过程

3.1 节点名称的获取方式

3.2 节点属性值的提取方法

3.3 内容的获取途径

一、安装Beautiful soup

本文的创作思路同样受到崔庆才先生的启发,随后根据个人的理解进行了整理与归纳,因此对于重复的部分在此不再详细说明。建议读者可前往崔庆才的个人网站获取更多相关信息,相关链接如下:https://cuiqingcai.com/5548.html>

二、解析并获取网页中想要的内容

Beautiful Soup是一款功能强大的数据解析与提取工具库,其不仅兼容Py

全部评论 (0)

还没有任何评论哟~