Advertisement

Python程序抓取小说

阅读量:

采用Python语言再次实施网络爬虫程序:主要采集玄幻类小说内容
目标网站:起点
所用模块:bs4以及os模块
整体思路:
首先提取所需页面的HTML元素代码,并将其载入bs4解析容器中,随后进行相关处理

第一步是获取接口地址:https://www.qidian.com/xuanhuan,可以看到,亲求方法是get

在这里插入图片描述

首先提取玄幻小说中所有页面的元素代码,并将其加载至bs4容器中进行后续处理:

复制代码
    url = "https://www.qidian.com/xuanhuan"
    method = 'get'
    headers = {"user-agent":"Mozilla/5.0 (Windows NT 10.0; Win64; x64)","Referer":"https://www.qidian.com"}
    res = requests.get(url,headers=headers)
    res.encoding = 'utf-8'

全部评论 (0)

还没有任何评论哟~