Advertisement

SQL VS Pandas(1):排名、前n名及连续数字

阅读量:

这是一个系列,其主要功能在于提升SQL与Pandas的使用能力,并通过对比同一问题采用SQL与Pandas进行解决的不同方式,从而深入探讨最为适宜的解决方案。

1. 数据情况

1.Jupyter环境应用与功能解析

通过jupyter notebook平台执行SQL语句及pandas库的数据处理操作,实现pandas模块的导入与数据库的连接过程:

复制代码
    import pandas as pd
    %load_ext sql
    %sql mysql+pymysql://root:123zxc@localhost/testdb
    
    
      
      
      
    

1.数据基础与研究支撑

从拉勾网爬取的部分职位信息数据

image-20201110194748227

为便于后续处理,需将相关数据以pandas的DataFrame格式进行存储:

复制代码
    data = %sql select * from jobs
    df = data.DataFrame()
    
    

全部评论 (0)

还没有任何评论哟~