Pandas groupby方法中的group_keys屬性使用及說明
Pandas groupby方法的group_keys屬性
pandas版本1.5.3中g(shù)roupby方法
當設置group_keys=True時,會以groupby的字段為第一級索引
如下述代碼中time_id作為第一級索引,同時保留了原dataframe(df)中的索引作為第二級索引。
>>> df.groupby(['time_id'], group_keys=True)['wap'].apply(log_return)
time_id
0 0 NaN
1 0.000000
2 0.000000
3 0.000000
4 0.000000
...
26454 5237975 -0.001228
5237976 0.000491
5237977 -0.005031
5237978 0.003219
5237979 0.003264
Name: wap, Length: 5237980, dtype: float64
group_keys的意思是
是否保留groupby的feature(如time_id)作為keys放入結(jié)果中,True是放,False是不放。
這也印證了幫助里的說明:
group_keys : bool, optional
When calling apply and thebyargument produces a like-indexed
(i.e. :ref:a transform <groupby.transform>) result, add group keys to
index to identify pieces. By default group keys are not included
when the result’s index (and column) labels match the inputs, and
are included otherwise. This argument has no effect if the result produced
is not like-indexed with respect to the input.
因此,當設置group_keys=False時,group keys(time_id)就不在返回結(jié)果中了,如下所示。
在設置為False是可以直接將返回結(jié)果,作為原dataframe(df)的一列,很方便。
>>> df.groupby(['time_id'], group_keys=False)['wap'].apply(log_return)
0 NaN
1 0.000000
2 0.000000
3 0.000000
4 0.000000
...
5237975 -0.001228
5237976 0.000491
5237977 -0.005031
5237978 0.003219
5237979 0.003264
Name: wap, Length: 5237980, dtype: float64
PS:對英文幫助的深入理解,需要結(jié)合實際應用。
總結(jié)
以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關(guān)文章
基于 Python實現(xiàn)云服務器的CDN域名遠程鑒權(quán)配置
這篇文章主要介紹了基于 Python實現(xiàn)云服務器的CDN域名遠程鑒權(quán)配置,文章內(nèi)容技術(shù)詳細,具有一定的參考價值,需要的小伙伴可以參考一下2022-05-05
賺瘋了!轉(zhuǎn)手立賺800+?大佬的python「搶茅臺腳本」使用教程
這篇文章主要介紹了如果利用python搶購京東茅臺,幫助大家更好的理解和使用python,感興趣的朋友可以了解下2021-01-01
Python調(diào)用大模型API的多種方式與最佳實踐
在大模型廣泛應用的時代,開發(fā)者在調(diào)用 API 時,往往需要安全、靈活地管理訪問密鑰(API Key)、接口地址(Endpoint)和模型參數(shù),本文將系統(tǒng)介紹調(diào)用大模型 API 的多種方式,需要的朋友可以參考下2025-10-10

