Python實(shí)現(xiàn)讀取大量Excel文件并跨文件批量計(jì)算平均值
本文介紹基于Python語言,實(shí)現(xiàn)對(duì)多個(gè)不同Excel文件進(jìn)行數(shù)據(jù)讀取與平均值計(jì)算的方法。
首先,讓我們來看一下具體需求:目前有一個(gè)文件夾,其中存放了大量Excel文件;文件名稱是每一位同學(xué)的名字,即文件名稱沒有任何規(guī)律。

而每一個(gè)文件都是一位同學(xué)對(duì)全班除了自己之外的其他同學(xué)的各項(xiàng)打分,我們以其中一個(gè)Excel文件為例來看:

可以看到,全班同學(xué)人數(shù)(即表格行數(shù))很多、需要打分的項(xiàng)目(即表格列數(shù))有11個(gè)(不算總分);同時(shí),由于不能給自己打分,導(dǎo)致每一份表格中會(huì)有一行沒有數(shù)據(jù)。
而我們需要做的,就是求出每一位同學(xué)的、11個(gè)打分項(xiàng)目分別的平均分,并存放在一個(gè)新的、表頭(行頭與列頭)與大家打分文件一致的總文件中,如下圖。其中,每一個(gè)格子都代表了這位同學(xué)、這一項(xiàng)打分項(xiàng)目在經(jīng)過班級(jí)除其之外的每一位同學(xué)打分后計(jì)算出的平均值。

可以看到,一個(gè)人就需要算11次平均,更何況一個(gè)班會(huì)有數(shù)十位同學(xué)。如果單獨(dú)用Excel計(jì)算,是非常麻煩的。
而借助Python,就會(huì)簡(jiǎn)單很多。具體代碼如下。在這里,就不再像平日里機(jī)器學(xué)習(xí)、深度學(xué)習(xí)代碼博客那樣,對(duì)代碼加以逐段、分部分的具體解釋了,直接列出全部代碼,大家參考注釋即可理解。
# -*- coding: utf-8 -*-
"""
Created on Thu Apr 8 16:24:41 2021
@author: fkxxgis
"""
import os
import numpy as np
from openpyxl import load_workbook
file_path='F:/班長(zhǎng)/2020-2021綜合測(cè)評(píng)與評(píng)獎(jiǎng)評(píng)優(yōu)/01_綜合測(cè)評(píng)/地信XXXX班互評(píng)打分表/' #這里是每一位同學(xué)打分Excel文件存放的路徑
output_path='F:/班長(zhǎng)/2020-2021綜合測(cè)評(píng)與評(píng)獎(jiǎng)評(píng)優(yōu)/01_綜合測(cè)評(píng)/地信XXXX班綜合素質(zhì)測(cè)評(píng)互評(píng)打分表.xlsx' #這里是最終結(jié)果存放路徑,請(qǐng)不要和上述路徑一致
first_row=5 #第一個(gè)分?jǐn)?shù)所在的行數(shù)
first_column=3 #第一個(gè)分?jǐn)?shù)所在的列數(shù)
all_row=32 #班級(jí)同學(xué)總數(shù)
all_column=11 #需要計(jì)算的分?jǐn)?shù)項(xiàng)目個(gè)數(shù)
all_excel=os.listdir(file_path) #獲取打分文件路徑下全部Excel文件
file_row=first_row+all_row-1
file_column=first_column+all_column-1
all_mean_score=np.zeros((file_row,file_column),dtype=float) #新建一個(gè)二維數(shù)組,存放每一位同學(xué)、每一項(xiàng)項(xiàng)目的分?jǐn)?shù)平均值
for now_row in range(first_row,file_row+1):
for now_column in range (first_column,file_column+1):
all_score=[]
for excel_num in range(0,len(all_excel)):
now_excel=load_workbook(file_path+all_excel[excel_num]) #打開第一個(gè)打分Excel文件
all_sheet=now_excel.get_sheet_names() #獲取打分文件的全部Sheet名稱
now_sheet=now_excel.get_sheet_by_name(all_sheet[0]) #本文中分?jǐn)?shù)全部存儲(chǔ)于第一個(gè)Sheet,因此下標(biāo)為0
single_score=now_sheet.cell(now_row,now_column).value #獲取對(duì)應(yīng)單元格數(shù)據(jù)
if single_score==None: #如果這個(gè)單元格為空(也就是自己不給自己打分的那一行)
pass
else:
all_score.append(single_score)
all_mean_score[now_row-1,now_column-1]=np.mean(all_score) #計(jì)算全部同學(xué)為這一位同學(xué)、這一個(gè)打分項(xiàng)目所打分?jǐn)?shù)的平均值
output_excel=load_workbook(output_path) #讀取結(jié)果存放Excel
output_all_sheet=output_excel.get_sheet_names() #這里代碼含義同上
output_sheet=output_excel.get_sheet_by_name(output_all_sheet[0])
output_sheet=output_excel.active
for output_now_row in range(first_row,file_row+1):
for output_now_column in range (first_column,file_column+1):
exec("output_sheet.cell(output_now_row,output_now_column).value=all_mean_score[output_now_row-1,output_now_column-1]") #將二維數(shù)組中每一位同學(xué)、每一項(xiàng)打分項(xiàng)目的最終平均分?jǐn)?shù)寫入結(jié)果文件的對(duì)應(yīng)位置
output_excel.save(output_path)
至此,大功告成。
到此這篇關(guān)于Python實(shí)現(xiàn)讀取大量Excel文件并跨文件批量計(jì)算平均值的文章就介紹到這了,更多相關(guān)Python讀取Excel內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
使用PIL(Python-Imaging)反轉(zhuǎn)圖像的顏色方法
今天小編就為大家分享一篇使用PIL(Python-Imaging)反轉(zhuǎn)圖像的顏色方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧2019-01-01
python+django快速實(shí)現(xiàn)文件上傳
本篇文章主要介紹了django快速實(shí)現(xiàn)文件上傳,通過django web框架來實(shí)現(xiàn)一些簡(jiǎn)單的功能,有需要的可以了解一下。2016-10-10
Python+Selenium+Pytesseract實(shí)現(xiàn)圖片驗(yàn)證碼識(shí)別
這篇文章主要介紹了利用Python+Selenium+Pytesseract實(shí)現(xiàn)圖片驗(yàn)證碼識(shí)別,文中的示例代碼講解詳細(xì),感興趣的小伙伴可以跟隨小編一起學(xué)習(xí)一下2022-01-01
Python實(shí)戰(zhàn)之OpenCV實(shí)現(xiàn)貓臉檢測(cè)
今天給大家?guī)淼氖顷P(guān)于Python的相關(guān)知識(shí),文章圍繞著OpenCV實(shí)現(xiàn)貓臉檢測(cè)展開,文中有非常詳細(xì)的介紹及代碼示例,需要的朋友可以參考下2021-06-06
Tensorflow 訓(xùn)練自己的數(shù)據(jù)集將數(shù)據(jù)直接導(dǎo)入到內(nèi)存
這篇文章主要介紹了Tensorflow 訓(xùn)練自己的數(shù)據(jù)集將數(shù)據(jù)直接導(dǎo)入到內(nèi)存,小編覺得挺不錯(cuò)的,現(xiàn)在分享給大家,也給大家做個(gè)參考。一起跟隨小編過來看看吧2018-06-06
Python對(duì)象的生命周期源碼學(xué)習(xí)
這篇文章主要為大家介紹了Python對(duì)象的生命周期源碼學(xué)習(xí),有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪2022-05-05

