获取Sina数据存储到MySQL中
发布时间
阅读量:
阅读量
将自己之前学习爬取新浪记录的内容分享一下吧!
通过Python的pip工具安装软件包
使用 pip 安装 openpyxl 库
为了执行功能需求, 使用 pip 从 douban 网站上的 Python 包仓库下载 pandas 库, 并启用信任该仓库的认证机制
通过 pip 安装 requests 模块
使用BeautifulSoup4库进行网页处理
启动Jupyter Notebook服务器
查看能否爬取网页内容
import requests
res = requests.get('https://www.sina.com.cn/')
res.encoding='utf-8'
print(res.text)

简单叙述关于BeautifulSoup使用
from bs4 import BeautifulSoup
html_sample = '\
<html> \
<body> \
<h1 id="title">Hello World</h1> \
<
全部评论 (0)
还没有任何评论哟~
