Advertisement

python数据分析之爬虫七:爬取豆瓣书籍排行榜(Top250)

阅读量:

豆瓣书籍Top250链接:https://book.douban.com/top250?icn=index-book250-all>

涉及的知识点与实例内容可参考以下来源:

python数据分析之爬虫五:实例

python数据分析之爬虫三:BeautifulSoup库爬虫实例

复制代码
 import re

    
 import requests
    
 from bs4 import BeautifulSoup
    
 import pandas as pd
    
  
    
 def getHTMLText(url):
    
     try:
    
     kw = {'user-agent': 'chrome/10.0'}
    
     r = requests.get(url, params=kw)
    
     r.raise_for_status()
    
     r.encoding = r.apparent_encoding
    
     return r.text
    
     except:
    
     print('error')
    
  
    
 def parseHTML(bookinfo, html):
    
     soup = Beaut

全部评论 (0)

还没有任何评论哟~