Python脚本用于从51job爬取数据并导出为CSV文件
发布时间
阅读量:
阅读量
import requests
from lxml import etree
import csv
def spider(url_):
response = requests.get(url_, headers=headers)
response.encoding = 'gbk'
return etree.HTML(response.text)
# 获取网页内容
def download(list_url):
selector = spider(list_url)
all_list = selector.xpath('//div[@class="dw_table"]/div[@class="el"]') # 获取页面全部的例子
for div in all_list:
a = div.xpath("p/span/a")[0]
name = a.xpath("text()")[0].strip() # 招聘职位名字
company = div.xpath('span[@class="t2"]/a/text()')[0] # 招聘公司
place = div.xpath('s
全部评论 (0)
还没有任何评论哟~
