使用pandas从指定列中筛选重复记录,并获取其is_unique属性和duplicated方法。
发布时间
阅读量:
阅读量
is_unique与duplicated这两个功能均可用于检测数据中是否包含重复条目,其主要差异体现在以下方面:
1)is_unique:作为Series对象的一个属性,仅适用于系列数据结构
2)duplicated:属于DataFrame类中的方法,不仅可应用于数据框,同时也支持系列数据的处理
df = pd.DataFrame({
'名字': ['小王', '小三', '李四', '王二', '小四'],
'年龄': ['45', '23', '28', '35', '23'],
'体重': [98, 92, 98, 102, 92]
})
# 名字 年龄 体重
# 0 小王 45 98
# 1 小三 23 92
# 2 李四 28 98
# 3 王二 35 102
# 4 小四 23 92
1、核查特定字段中是否包含重复条目
df.loc[:
全部评论 (0)
还没有任何评论哟~
