Advertisement

pandas中groupby分组后数据操作

阅读量:

我国苹果的主要产区包括山东烟台、陕西洛川、新疆阿克苏、甘肃天水以及山西临猗等地。现假定某一平台上的苹果店铺数量共计356家,其平均销售量为x吨。据此可构建如下数据集:

复制代码
 shop_id = np.arange(356)

    
 product_ = np.random.choice(["山东烟台", "陕西洛川", "新疆阿克苏", "甘肃天水", "山西临猗"], 356)
    
 quantity = np.random.choice(np.arange(1, 10), 356)
    
 苹果 = pd.DataFrame({"店铺id": shop_id, "产地": product_, "销量": quantity})
    
 苹果.head()
    
    
    
    
店铺id 产地 销量
0 0 甘肃天水 6
1 1 陕西洛川 7
2 2 甘肃天水 2
3 3 新疆阿克苏 3
4 4 山东烟台 5

依据groupby函数对产品来源地进行分类处理

复制代码
    groups_var = 苹果.loc[:, ["产地", "销量"]].groupby(["产地"])
    

在调用groups_var.groups.keys()这一操作之后,

全部评论 (0)

还没有任何评论哟~