获取和可视化
发布时间
阅读量:
阅读量
首先爬取淘宝美食信息
所运用的数据采集方式为selenium库与pyquery库的结合,并将获取到的餐饮相关内容以csv格式进行存储,具体实现代码如下:
import re
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from pyquery import PyQuery as pq
from config import *
import pymongo
import csv
import pandas as pd
client=pymongo.MongoClient(MONGO_URL)
db=client[MONGO_DB]
browser=webdriver.Chrome()
wait=WebDriverWait(brow
全部评论 (0)
还没有任何评论哟~
