Advertisement

获取Sina数据存储到MySQL中

阅读量:

将自己之前学习爬取新浪记录的内容分享一下吧!

通过Python的pip工具安装软件包
使用 pip 安装 openpyxl 库
为了执行功能需求, 使用 pip 从 douban 网站上的 Python 包仓库下载 pandas 库, 并启用信任该仓库的认证机制
通过 pip 安装 requests 模块
使用BeautifulSoup4库进行网页处理
启动Jupyter Notebook服务器

查看能否爬取网页内容

复制代码
    import requests
    res = requests.get('https://www.sina.com.cn/')
    res.encoding='utf-8'
    print(res.text)
在这里插入图片描述

简单叙述关于BeautifulSoup使用

复制代码
    from bs4 import BeautifulSoup
    html_sample = '\
    <html> \
     <body> \
     <h1 id="title">Hello World</h1> \
     <

全部评论 (0)

还没有任何评论哟~