Advertisement

爬虫爬取新闻列表

阅读量:

爬取标题-链接-时间

较早前便接触过爬虫相关的知识学习,但一直未在实际工作中加以应用。近期工作事务相对减少,因此决定整理一下关于爬虫的内容。
本次所采用的模块包括:
BeautifulSoup4以及requests
从观察可知,新闻的链接地址为:
https://news.sina.com.cn/world/
并且请求方式采用了get方法

在这里插入图片描述

通过查看源代码可以发现,新闻条目被赋予了一个类属性,其值为’news-item’。

在这里插入图片描述

因此,借助这一特性,能够有效定位后续所需的相关内容。

复制代码
    import requests
    from bs4 import BeautifulSoup
    
    res = requests.get('https://news.sina.com.cn/world/')
    r

全部评论 (0)

还没有任何评论哟~