最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

pandas應用實例之pivot函數(shù)詳解

 更新時間:2022年07月04日 15:38:16   作者:superY25  
最近在做基于python的數(shù)據(jù)分析工作,引用第三方數(shù)據(jù)分析庫pandas,所以下面這篇文章主要給大家介紹了關于pandas應用實例之pivot函數(shù)的相關資料,文中通過圖文介紹的非常詳細,需要的朋友可以參考下

1、pivot函數(shù)的定義

pivot(index=None,columns=None,values=None) -> DataFrame

2、pivot函數(shù)的說明

通過給定的索引(index)和列(column)的值重新生一個DataFrame對象。

根據(jù)列值對數(shù)據(jù)進行整形(生成一個“透視”表)。從指定的索引/列中使用唯一的值來形成結果數(shù)據(jù)幀的軸。此函數(shù)不支持數(shù)據(jù)聚合,多個值將導致列中的多索引。

3、pivo函數(shù)的參數(shù)

index:指定一列做為生成DataFrame對象的索引,如果為空則默認為原來的索引。

columns:指定一列的值作為列名,必須傳值。

values:指定一列作為生成DataFrame對象的值。可以為空。

4、pivot函數(shù)實例

df = pd.DataFrame({'foo': ['one', 'one', 'one', 'two', 'two', 'two'],
                    'bar': ['A', 'B', 'C', 'A', 'B', 'C'],
                    'baz': [1, 2, 3, 4, 5, 6],
                    'zoo': ['x', 'y', 'z', 'q', 'w', 't']})

# 指定foo的值為新dataframe的index,bar的值為columns,dataframe中對應的值為baz
df.pivot(index='foo', columns='bar', values='baz')

# 沒有指定value,列名最外層保留原來的列,如下結果baz和zoo為原dataframe中的列名,新指定的列名bar在里層(暫時這么理解)。
df.pivot(index='foo', columns='bar')

# 可以通過索引的方式取指定的列數(shù)據(jù)
df.pivot(index='foo', columns='bar')['baz']

# 可以指定多個values
df.pivot(index='foo', columns='bar', values=['baz', 'zoo'])

# 指定多個columns
df.pivot(index='foo', columns=['bar','baz'], values=['zoo'])

# 指定多個index
df.pivot(index=['foo','bar'], columns='baz', values='zoo')

# 指定多個index可以通過index名取當個index的數(shù)據(jù)
df.pivot(index=['foo','bar'], columns='baz', values='zoo').loc["one",:]

# 這兩行代碼運行將會報錯。
# 報錯提示:ValueError: Index contains duplicate entries, cannot reshape
# 意思是指定的索引one有兩個列bar=A沖突了。
df = pd.DataFrame({"foo": ['one', 'one', 'two', 'two'],
                   "bar": ['A', 'A', 'B', 'C'],
                   "baz": [1, 2, 3, 4]})
df.pivot(index='foo', columns='bar', values='baz')

5、pivot函數(shù)在實際工作中解決的案例

現(xiàn)在要上圖中的不同code之間從2020-11-16到2020-11-18三天內num序列數(shù)的相關性。

首先,dataframe對象可以直接調用函數(shù)corr()計算不同列之間的相關性,所以現(xiàn)在需要將原始的dataframe對象轉換成以code為列,date為索引,num為值的dataframe。
第一種比較笨的方法就是循環(huán),此方法不但代碼量較多而且在數(shù)據(jù)量很大時會比較耗時。不建議使用。

grouped = df.groupby(by=["code"])
df_num = pd.DataFrame()
for name,group in grouped:
    d = pd.Series(data=group["num"].values,name=name)
    df_num = pd.concat([df_num,d],axis=1)

df_close

第二種方法就是使用pivot函數(shù),一行代碼解決,運行快速。

df_num = df.pivot(index='date',columns='code',values='num')

想要的形式的dataframe生成了就可以直接調用corr()函數(shù)直接求出code之間的相關性了

# 計算列之間的相關性
df_num.corr()

總結

到此這篇關于pandas應用實例之pivot函數(shù)的文章就介紹到這了,更多相關pandas pivot函數(shù)內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

最新評論

聊城市| 贡嘎县| 焉耆| 太仆寺旗| 桂林市| 古交市| 阿拉善左旗| 游戏| 梅河口市| 荆州市| 平塘县| 石嘴山市| 原平市| 嘉义县| 响水县| 三台县| 沙坪坝区| 林周县| 玛沁县| 静宁县| 南部县| 上思县| 明星| 华宁县| 新兴县| 龙泉市| 武川县| 民丰县| 上栗县| 陇川县| 深圳市| 安图县| 富顺县| 岳普湖县| 莱州市| 青浦区| 合川市| 望城县| 天津市| 杨浦区| 尼玛县|