Advertisement

使用Scrapy框架:2:执行爬虫脚本

阅读量:
在这里插入图片描述

在上一篇文章中我们讲解了使用scrapy shell以交互的方式获取Web页面的标题信息这篇文章将继续通过这个简单的案例来阐述在Scrapy框架下爬虫应用程序的使用方法

爬虫示例代码

复制代码
    liumiaocn:scrapy liumiao$ ls
    myspider.py
    liumiaocn:scrapy liumiao$ cat myspider.py 
    import scrapy
    
    class MySpider(scrapy.Spider):
    name = 'myspider'
    start_urls = ['https://scrapy.org/']
    
    def parse(self, response):
        for title in response.css('title'):
            yield {'title': title.get()}
    liumiaocn:scrapy liumiao$ 

代码极为简单, 主要是获取该网站的标

全部评论 (0)

还没有任何评论哟~