Advertisement

Scrapy框架抓取我爱我家二手房信息存储CSV、mysql(IP代理及User-Agent)

阅读量:

有一段时间没有外出活动了

复制代码
    scrapy startproject pachong2(创一个pachong2的文件)
    cd pachong2	#进入创的文件
    scrapy genspider aijia wx.5i5j.com	#生成名叫aijia的爬虫

然后就生成了这些

在这里插入图片描述

访问我爱我家网站的主页后导航至二手房信息页面https://wx.5i5j.com/ershoufang开始编写爬虫脚本
发现了生成的aijia项目并提供了若干个 urls

复制代码
    import scrapy
    
    class AijiaSpider(scrapy.Spider):
    name = 'aijia'
    allowed_domains = ['www.5i5j.com']
    start_urls = ['http://www.5i5j.com/']
    
    def parse(self, response):
        pass

由于目标为二手房因此需要调整位于star

全部评论 (0)

还没有任何评论哟~