最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Pandas對DataFrame單列/多列進行運算(map, apply, transform, agg)

 更新時間:2020年06月14日 11:49:54   作者:BlankSeed  
這篇文章主要介紹了Pandas對DataFrame單列/多列進行運算(map, apply, transform, agg),文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧

1.單列運算

在Pandas中,DataFrame的一列就是一個Series, 可以通過map來對一列進行操作:

df['col2'] = df['col1'].map(lambda x: x**2)

其中l(wèi)ambda函數(shù)中的x代表當前元素??梢允褂昧硗獾暮瘮?shù)來代替lambda函數(shù),例如:

define square(x): 
  return (x ** 2) 
 
df['col2'] = df['col1'].map(square) 

2.多列運算

 apply()會將待處理的對象拆分成多個片段,然后對各片段調用傳入的函數(shù),最后嘗試將各片段組合到一起。

要對DataFrame的多個列同時進行運算,可以使用apply,例如col3 = col1 + 2 * col2:

df['col3'] = df.apply(lambda x: x['col1'] + 2 * x['col2'], axis=1) 

其中x帶表當前行,可以通過下標進行索引。

示例2

In [44]: f = lambda x : x.max()-x.min()

In [45]: df.apply(f)
Out[45]:
data1  5.042275
data2  1.967290
dtype: float64

In [46]: df.apply(f,axis=1)
Out[46]:
0  2.810074
1  1.009774
2  0.537183
3  0.813714
4  1.750022
dtype: float64

applymap()

用DataFrame的applymap方法,可以將函數(shù)應用到元素級的數(shù)據(jù)上。

In [47]: f = lambda x : x+1

In [48]: df.applymap(f)
Out[48]:
   data1   data2
0 -1.332263 1.477812
1 0.284755 1.294528
2 0.066644 0.603827
3 1.757402 2.571117
4 3.710012 1.959990

Series也有一個元素級函數(shù)應用的方法map

In [49]: df['data1']
Out[49]:
0  -2.332263
1  -0.715245
2  -0.933356
3  0.757402
4  2.710012
Name: data1, dtype: float64

In [50]: df['data1'].map(f)
Out[50]:
0  -1.332263
1  0.284755
2  0.066644
3  1.757402
4  3.710012
Name: data1, dtype: float64

3.分組運算

可以結合groupby與transform來方便地實現(xiàn)類似SQL中的聚合運算的操作:

df['col3'] = df.groupby('col1')['col2'].transform(lambda x: (x.sum() - x) / x.count()) 

在transform函數(shù)中x.sum()與x.count()與SQL類似,計算的是當前group中的和與數(shù)量,還可以將transform的結果作為一個一個映射來使用, 例如:

sumcount = df.groupby('col1')['col2'].transform(lambda x: x.sum() + x.count()) 
df['col1'].map(sumcount) 

對col1進行一個map,得到對應的col2的運算值。

4.聚合函數(shù)

結合groupby與agg實現(xiàn)SQL中的分組聚合運算操作,需要使用相應的聚合函數(shù):

df['col2'] = df.groupby('col1').agg({'col1':{'col1_mean': mean, 'col1_sum‘': sum}, 'col2': {'col2_count': count}}) 

上述代碼生成了col1_mean, col1_sum與col2_count列。

示例2

In [52]: df.agg(['mean','sum'])
Out[52]:
     data1   data2
mean -0.102690 0.581455
sum -0.513449 2.907274

函數(shù) 說明
count 分組中非Nan值的數(shù)量
sum 非Nan值的和
mean 非Nan值的平均值
median 非Nan值的算術中間數(shù)
std,var 標準差、方差
min,max 非Nan值的最小值和最大值
prob 非Nan值的積
first,last 第一個和最后一個非Nan值

到此這篇關于Pandas對DataFrame單列/多列進行運算(map, apply, transform, agg)的文章就介紹到這了,更多相關Pandas map apply transform agg內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

最新評論

苏尼特右旗| 吉安市| 黄梅县| 来宾市| 从化市| 巴楚县| 唐河县| 佛坪县| 武川县| 安阳县| 大方县| 忻城县| 筠连县| 仁寿县| 钦州市| 会宁县| 福安市| 津市市| 瑞安市| 荣成市| 白城市| 盐城市| 长岭县| 天水市| 东莞市| 梁平县| 铜山县| 噶尔县| 武冈市| 出国| 同心县| 梅河口市| 靖宇县| 麻城市| 商河县| 视频| 都昌县| 庐江县| 黑水县| 高平市| 霍山县|