Advertisement

Python脚本用于从51job爬取数据并导出为CSV文件

阅读量:
复制代码
    import requests
    from lxml import etree
    import csv
    
    
    def spider(url_):
    response = requests.get(url_, headers=headers)
    response.encoding = 'gbk'
    return etree.HTML(response.text)
    
    
    # 获取网页内容
    def download(list_url):
    selector = spider(list_url)
    all_list = selector.xpath('//div[@class="dw_table"]/div[@class="el"]')  # 获取页面全部的例子
    for div in all_list:
        a = div.xpath("p/span/a")[0]
        name = a.xpath("text()")[0].strip()  # 招聘职位名字
        company = div.xpath('span[@class="t2"]/a/text()')[0]  # 招聘公司
        place = div.xpath('s

全部评论 (0)

还没有任何评论哟~