Advertisement

大规模数据的分析和计算

阅读量:

在处理QA测试人员提供的一个体积达3.24G的大型日志文件时,由于文件过大,难以直接进行分析,因此编写了以下Python代码,用于将该大文件进行分割,并提取其中包含特定关键字的部分以便进一步监测。

具体的代码实现如下

复制代码
 #!/usr/bin/python

    
 # AUTHER: ZPEG
    
  
    
 import os,sys,shutil
    
  
    
 findstr = "CTRL-EVENT-DISCONNECTED"
    
 kilobytes = 1024
    
 megabytes = 1024 * kilobytes
    
 chunksize = int(100*megabytes)#default chunksize
    
  
    
 def isstr(filename, str):
    
 	file = open(filename)
    
 	print('Bengin find ',str,' in ',  filename)
    
 	for line in file.readlines():
    
 		if str in line:
    
 			file.close()
    
 			print('find ',str,' in ',  filen

全部评论 (0)

还没有任何评论哟~