Advertisement

获取和可视化

阅读量:

首先爬取淘宝美食信息

所运用的数据采集方式为selenium库与pyquery库的结合,并将获取到的餐饮相关内容以csv格式进行存储,具体实现代码如下:

复制代码
 import re

    
 from selenium import webdriver
    
 from selenium.webdriver.common.by import By
    
 from selenium.webdriver.support.ui import WebDriverWait
    
 from selenium.webdriver.support import expected_conditions as EC
    
 from pyquery import PyQuery as pq
    
 from config import *
    
 import pymongo
    
 import csv
    
 import pandas as pd
    
  
    
 client=pymongo.MongoClient(MONGO_URL)
    
 db=client[MONGO_DB]
    
  
    
 browser=webdriver.Chrome()
    
 wait=WebDriverWait(brow

全部评论 (0)

还没有任何评论哟~