Pandas庫中dataframe.corr()函數(shù)的使用
一、簡介
dataframe.corr()是Pandas庫中的一個函數(shù),用于計算DataFrame中各列之間的相關(guān)系數(shù)。相關(guān)系數(shù)衡量的是兩個變量之間線性關(guān)系的強度和方向,結(jié)果在-1到1之間,分別表示完全負相關(guān)和完全正相關(guān)。
二、語法和參數(shù)
DataFrame.corr(method='pearson', min_periods=1)
method: 可選。計算相關(guān)系數(shù)的方法,有’pearson’(默認)、‘kendall’、'spearman’三種可選。
'pearson':標準皮爾遜相關(guān)系數(shù)。'kendall':肯德爾等級相關(guān)系數(shù)。'spearman':斯皮爾曼等級相關(guān)系數(shù)。
min_periods: 可選。每對元素的最小數(shù)量,以便計算相關(guān)系數(shù)。
三、實例
3.1 計算默認的皮爾遜相關(guān)系數(shù)
import pandas as pd
# 創(chuàng)建示例數(shù)據(jù)
data = {
'A': [1, 2, 3, 4, 5],
'B': [5, 4, 3, 2, 1],
'C': [2, 2, 3, 4, 4]
}
df = pd.DataFrame(data)
# 計算相關(guān)系數(shù)
correlation_matrix = df.corr()
print(correlation_matrix)
輸出:
A B C
A 1.000000 -1.000000 0.948683
B -1.000000 1.000000 -0.948683
C 0.948683 -0.948683 1.000000
3.2 計算斯皮爾曼相關(guān)系數(shù)
import pandas as pd
# 創(chuàng)建示例數(shù)據(jù)
data = {
'A': [1, 2, 3, 4, 5],
'B': [5, 4, 3, 2, 1],
'C': [2, 2, 3, 4, 4]
}
df = pd.DataFrame(data)
# 計算相關(guān)系數(shù)
correlation_matrix = df.corr(method='spearman')
print(correlation_matrix)
輸出:
A B C
A 1.000000 -1.000000 0.948683
B -1.000000 1.000000 -0.948683
C 0.948683 -0.948683 1.000000
3.3 計算斯皮爾曼相關(guān)系數(shù)
import pandas as pd
# 創(chuàng)建示例數(shù)據(jù)
data = {
'A': [1, 2, 3, 4, 5],
'B': [5, 4, 3, 2, 1],
'C': [2, 2, 3, 4, 4]
}
df = pd.DataFrame(data)
# 計算相關(guān)系數(shù)
correlation_matrix = df.corr(method='kendall')
print(correlation_matrix)
輸出
A B C
A 1.000000 -1.000000 0.894427
B -1.000000 1.000000 -0.894427
C 0.894427 -0.894427 1.000000
四、注意事項
- 當使用
kendall和spearman方法時,計算可能會比pearson方法慢,因為這些方法需要排序。 - 如果數(shù)據(jù)集中存在
NaN值,默認情況下這些值會被忽略。 - 計算相關(guān)系數(shù)前,確保數(shù)據(jù)已經(jīng)清洗并準備好,以避免錯誤或不準確的結(jié)果。
到此這篇關(guān)于Pandas庫中dataframe.corr()函數(shù)的使用的文章就介紹到這了,更多相關(guān)Pandas dataframe.corr()函數(shù)內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
- 探討python??pandas.DataFrame.to_json?函數(shù)
- pandas DataFrame.to_sql()用法小結(jié)
- 使用pandas中的DataFrame.rolling方法查看時間序列中的異常值
- Python Pandas Dataframe.describe()使用及代碼實例
- 解讀pandas.DataFrame.corrwith
- Python?Pandas中DataFrame.drop_duplicates()刪除重復值詳解
- pandas.DataFrame.iloc的具體使用詳解
- pandas.DataFrame.from_dict直接從字典構(gòu)建DataFrame的方法
- pandas.DataFrame.drop_duplicates 用法介紹
相關(guān)文章
python爬蟲搭配起B(yǎng)ilibili唧唧的流程分析
這篇文章主要介紹了python爬蟲搭配起B(yǎng)ilibili唧唧的流程分析,本文通過圖文并茂的形式給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2020-12-12
python代碼規(guī)范之異常,規(guī)則,函數(shù)返回值使用解讀
文章主要介紹了Python的集合、自定義哈希對象、數(shù)據(jù)類、字符串格式化、容器、異常處理、函數(shù)返回建議以及Django框架中的AnonymousUser等知識點2025-12-12

