Python切割大日志文件幾種方法
背景
工作線上報錯了,找運維下載了線上的日志文件排查問題,但是日志文件太大了,沒辦法用NotePad++打開,于是乎想著要切割一下日志文件
方法一:指定目標文件數(shù)量分割
import os
# 要分割的文件
sourceFileName = 'normal-app.log'
# 分割的文件個數(shù)
fileNum = 10
def cutFile():
print("正在讀取文件...")
sourceFileData = open(sourceFileName, 'r', encoding='utf-8')
ListOfLine = sourceFileData.read().splitlines() # 將讀取的文件內(nèi)容按行分割,然后存到一個列表中
totalLine = len(ListOfLine)
print("文件共有" + str(totalLine) + "行")
print("請輸入需要將文件分割的個數(shù):")
p = totalLine//fileNum + 1
print("需要將文件分成"+str(fileNum)+"個子文件")
print("每個文件最多有"+str(p)+"行")
print("開始進行分割···")
for i in range(fileNum):
destFileName = os.path.splitext(sourceFileName)[
0] + "_" + str(i + 1)+".log"
print("正在生成子文件" + destFileName)
destFileData = open(destFileName, "w", encoding='utf-8')
if(i == fileNum-1):
for line in ListOfLine[i*p:]:
destFileData.write(line+'\n')
else:
for line in ListOfLine[i*p:(i+1)*p]:
destFileData.write(line+'\n')
destFileData.close()
print("分割完成")
if __name__ == '__main__':
cutFile()
方法二:指定文件大小分割
這種方法是按照大小分割文件,會存在同一行被分割在兩個文件中的情況
import os
filename = "normal-app.log" # 需要進行分割的文件
size = 10000000 # 分割大小10M
def createSubFile(srcName, sub, buf):
[des_filename, extname] = os.path.splitext(srcName)
filename = des_filename + '_' + str(sub) + extname
print('正在生成子文件: %s' % filename)
with open(filename, 'wb') as fout:
fout.write(buf)
return sub+1
def cutFile(filename, size):
with open(filename, 'rb') as fin:
buf = fin.read(size)
sub = 1
while len(buf) > 0:
sub = createSubFile(filename, sub, buf)
buf = fin.read(size)
print("ok")
if __name__ == "__main__":
cutFile(filename, size)
方法三:指定目標行數(shù)分割
import os
# 要分割的文件
sourceFileName = 'normal-app.log'
# 定義分割的行數(shù)
lineNum = 100000
def cutFile():
print("正在讀取文件...")
sourceFileData = open(sourceFileName, 'r', encoding='utf-8')
ListOfLine = sourceFileData.read().splitlines() # 將讀取的文件內(nèi)容按行分割,然后存到一個列表中
totalLine = len(ListOfLine)
print("文件共有" + str(totalLine) + "行")
print("請輸入需要將文件分割的個數(shù):")
fileNum = totalLine//lineNum + 1
print("需要將文件分成"+str(fileNum)+"個子文件")
print("開始進行分割···")
for i in range(fileNum):
destFileName = os.path.splitext(sourceFileName)[
0] + "_" + str(i + 1)+".log"
print("正在生成子文件" + destFileName)
destFileData = open(destFileName, "w", encoding='utf-8')
if(i == fileNum-1):
for line in ListOfLine[i*lineNum:]:
destFileData.write(line+'\n')
else:
for line in ListOfLine[i*lineNum:(i+1)*lineNum]:
destFileData.write(line+'\n')
destFileData.close()
print("分割完成")
if __name__ == '__main__':
cutFile()
到此這篇關于Python切割大日志文件幾種方法的文章就介紹到這了,更多相關Python切割大日志內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!
相關文章
windows下pycharm搭建spark環(huán)境并成功運行 附源碼
這篇文章主要介紹了windows下pycharm搭建spark環(huán)境并成功運行 附源碼,本文分步驟給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2021-04-04
python seaborn heatmap可視化相關性矩陣實例
這篇文章主要介紹了python seaborn heatmap可視化相關性矩陣實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2020-06-06
python3 如何使用 goto 跳轉(zhuǎn)執(zhí)行到指定代碼行
這篇文章主要介紹了python3 使用goto跳轉(zhuǎn)執(zhí)行到指定代碼行的操作,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教2021-05-05
python Multiprocessing.Pool進程池模塊詳解
multiprocessing模塊提供了一個Process類來代表一個進程對象,multiprocessing模塊像線程一樣管理進程,這個是multiprocessing的核心,它與threading很相似,對多核CPU的利用率會比threading好的多2022-10-10
python算法與數(shù)據(jù)結構朋友圈與水杯實驗題分析實例
這篇文章主要介紹了python算法與數(shù)據(jù)結構朋友圈與水杯實驗題分析,總的來說這并不是難題,那為什么要拿出這道題介紹?拿出這道題真正想要傳達的是解題的思路,以及不斷優(yōu)化探尋最優(yōu)解的過程。希望通過這道題能給你帶來一種解題優(yōu)化的思路2022-12-12
Pandas DataFrame數(shù)據(jù)存儲格式比較分析
Pandas 支持多種存儲格式,在本文中將對不同類型存儲格式下的Pandas Dataframe的讀取速度、寫入速度和大小的進行測試對比,有需要的朋友可以借鑒參考下,希望能夠有所幫助2023-09-09
Python網(wǎng)絡編程之socket與socketserver
這篇文章介紹了Python網(wǎng)絡編程之socket與socketserver,文中通過示例代碼介紹的非常詳細。對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2022-05-05

