Python程序抓取小说
发布时间
阅读量:
阅读量
采用Python语言再次实施网络爬虫程序:主要采集玄幻类小说内容
目标网站:起点
所用模块:bs4以及os模块
整体思路:
首先提取所需页面的HTML元素代码,并将其载入bs4解析容器中,随后进行相关处理
第一步是获取接口地址:https://www.qidian.com/xuanhuan,可以看到,亲求方法是get

首先提取玄幻小说中所有页面的元素代码,并将其加载至bs4容器中进行后续处理:
url = "https://www.qidian.com/xuanhuan"
method = 'get'
headers = {"user-agent":"Mozilla/5.0 (Windows NT 10.0; Win64; x64)","Referer":"https://www.qidian.com"}
res = requests.get(url,headers=headers)
res.encoding = 'utf-8'
全部评论 (0)
还没有任何评论哟~
