python数据分析之爬虫七:爬取豆瓣书籍排行榜(Top250)
发布时间
阅读量:
阅读量
豆瓣书籍Top250链接:https://book.douban.com/top250?icn=index-book250-all>
涉及的知识点与实例内容可参考以下来源:
python数据分析之爬虫三:BeautifulSoup库爬虫实例
import re
import requests
from bs4 import BeautifulSoup
import pandas as pd
def getHTMLText(url):
try:
kw = {'user-agent': 'chrome/10.0'}
r = requests.get(url, params=kw)
r.raise_for_status()
r.encoding = r.apparent_encoding
return r.text
except:
print('error')
def parseHTML(bookinfo, html):
soup = Beaut
全部评论 (0)
还没有任何评论哟~
