如何利用Python 快速找到最大文件
更新時間:2021年11月10日 10:36:59 作者:somenzz
現在的電腦差不多都是固態(tài)硬盤了,速度很快,但容量不會太大,經常會出現磁盤空間不足的情況,怎么辦,刪除那些不重要的最大的文件是最有效的辦法,這篇文章我們就來介紹介紹了如何利用Python 快速找到最大文件,需要的朋友可以參考一下

現在的電腦差不多都是固態(tài)硬盤了,速度很快,但容量不會太大,經常會出現磁盤空間不足的情況,怎么辦,刪除那些不重要的最大的文件是最有效的辦法。
那么如何用找到最大的文件呢?比如說找到最大的前 10 個文件?
思路:我們遍歷目錄,將文件路徑和文件大小作為生成器返回,然后插入大小為 10 的大頂堆,最后將大頂堆的內容打印即可。
借助 Python,代碼很簡潔:
import os
import time
from os.path import join, getsize
from heapq import nlargest
def walk_files_and_sizes(start_at: str):
for root, _, files in os.walk(start_at):
for file in files:
path = join(root, file)
try:
size = getsize(path) # bytes
yield path, size
except OSError:
continue
def largest_files(n: int, start_at: str) -> None:
MB = 1024 * 1024
largest = nlargest(n, walk_files_and_sizes(start_at), key=lambda x: x[1])
for path, size in largest:
print(f'{size//MB} MB {path}')
if __name__ == '__main__':
start = time.perf_counter()
largest_files(10, "/Users/aaron/")
elapsed = time.perf_counter() - start
print(f'{elapsed} seconds elapsed')
我在自己電腦上跑了下,200 GB 左右的目錄,123 秒就跑完了:

接下來刪除不需要的文件就可以了。
如果是 Windows 系統(tǒng)也是可以的:
largest_files(10, "C:/Users/xxx/")
到此這篇關于如何利用Python 快速找到最大文件的文章就介紹到這了,更多相關Python 快速找最大文件內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

