Advertisement

使用pandas从指定列中筛选重复记录,并获取其is_unique属性和duplicated方法。

阅读量:

is_uniqueduplicated这两个功能均可用于检测数据中是否包含重复条目,其主要差异体现在以下方面:
1)is_unique:作为Series对象的一个属性,仅适用于系列数据结构
2)duplicated:属于DataFrame类中的方法,不仅可应用于数据框,同时也支持系列数据的处理

复制代码
    df = pd.DataFrame({
    '名字': ['小王', '小三', '李四', '王二', '小四'],
    '年龄': ['45', '23', '28', '35', '23'],
    '体重': [98, 92, 98, 102, 92]
    })
    
    # 	  名字	   年龄	   体重
    # 0	  小王	  	45		98
    # 1	  小三	  	23		92
    # 2	  李四	  	28		98
    # 3	  王二	    35		102
    # 4	  小四		23		92
    
    
      
      
      
      
      
      
      
      
      
      
      
      
    

1、核查特定字段中是否包含重复条目

复制代码
    df.loc[:

全部评论 (0)

还没有任何评论哟~