Beautiful soup用于数据解析与提取
发布时间
阅读量:
阅读量
目录
一、配置Beautiful soup
二、解析与提取网页所需内容
1、标签树的遍历方式
1.1 soup.
1.2 标签树的下行遍历方法:.contents 和 .children 及.descendants
1.3 标签树的上行遍历方式:.parent .parents
1.4 标签树的平行遍历方式:.next_sibling 和 .previous_sibling及.next_siblings 和 .previous_siblings
1.5 信息提取方法:.string、.strings、.stripped_strings
2、标签树的查找操作
2.1 find() 和find_all()
2.2 CSS选择器的应用
3. 信息提取过程
3.1 节点名称的获取方式
3.2 节点属性值的提取方法
3.3 内容的获取途径
一、安装Beautiful soup
本文的创作思路同样受到崔庆才先生的启发,随后根据个人的理解进行了整理与归纳,因此对于重复的部分在此不再详细说明。建议读者可前往崔庆才的个人网站获取更多相关信息,相关链接如下:https://cuiqingcai.com/5548.html>
二、解析并获取网页中想要的内容
Beautiful Soup是一款功能强大的数据解析与提取工具库,其不仅兼容Py
全部评论 (0)
还没有任何评论哟~
