Advertisement

Python 列表处理数据方法

阅读量:

在进行数据处理的过程中,经常会涉及到对列表内容的筛选操作,例如存在如下两个列表:

依据上表中所列的KEY1信息,对下方数据进行筛选,即为标记为黄色的数据。当数据量较小时,通常采用遍历比较的方式,逻辑较为简单,仅需几行代码即可完成。

然而,若列表规模达到万级、百万级甚至千万级时,遍历方式的效率将明显下降。

首先需要构建用于测试的列表。

复制代码
 # 构造筛选目标列表,确保KEY不重复

    
 n1 = 30000
    
 n1_set = set([random.randint(1,n1)  for n in range(n1)])
    
 n1 = len(n1_set)
    
 list1 = [['1108{:0>6d}27'.format(n), "".join(random.sample('ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklm

全部评论 (0)

还没有任何评论哟~