SQL VS Pandas(1):排名、前n名及连续数字
发布时间
阅读量:
阅读量
这是一个系列,其主要功能在于提升SQL与Pandas的使用能力,并通过对比同一问题采用SQL与Pandas进行解决的不同方式,从而深入探讨最为适宜的解决方案。
1. 数据情况
1.Jupyter环境应用与功能解析
通过jupyter notebook平台执行SQL语句及pandas库的数据处理操作,实现pandas模块的导入与数据库的连接过程:
import pandas as pd
%load_ext sql
%sql mysql+pymysql://root:123zxc@localhost/testdb
1.数据基础与研究支撑
从拉勾网爬取的部分职位信息数据

为便于后续处理,需将相关数据以pandas的DataFrame格式进行存储:
data = %sql select * from jobs
df = data.DataFrame()
全部评论 (0)
还没有任何评论哟~
