pandas中groupby分组后数据操作
发布时间
阅读量:
阅读量
我国苹果的主要产区包括山东烟台、陕西洛川、新疆阿克苏、甘肃天水以及山西临猗等地。现假定某一平台上的苹果店铺数量共计356家,其平均销售量为x吨。据此可构建如下数据集:
shop_id = np.arange(356)
product_ = np.random.choice(["山东烟台", "陕西洛川", "新疆阿克苏", "甘肃天水", "山西临猗"], 356)
quantity = np.random.choice(np.arange(1, 10), 356)
苹果 = pd.DataFrame({"店铺id": shop_id, "产地": product_, "销量": quantity})
苹果.head()
| 店铺id | 产地 | 销量 | |
|---|---|---|---|
| 0 | 0 | 甘肃天水 | 6 |
| 1 | 1 | 陕西洛川 | 7 |
| 2 | 2 | 甘肃天水 | 2 |
| 3 | 3 | 新疆阿克苏 | 3 |
| 4 | 4 | 山东烟台 | 5 |
依据groupby函数对产品来源地进行分类处理
groups_var = 苹果.loc[:, ["产地", "销量"]].groupby(["产地"])
在调用groups_var.groups.keys()这一操作之后,
全部评论 (0)
还没有任何评论哟~
