最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python?pandas中apply函數簡介以及用法詳解

 更新時間:2022年09月09日 10:38:28   作者:獨影月下酌酒  
apply()函數是pandas里面所有函數中自由度最高的函數, apply()函數的參數是一個函數指針,這里可以使用lambda表達式幫助簡化代碼,下面這篇文章主要給大家介紹了關于Python?pandas中apply函數簡介以及用法的相關資料,需要的朋友可以參考下

1.基本信息

? Pandas 的 apply() 方法是用來調用一個函數(Python method),讓此函數對數據對象進行批量處理。Pandas 的很多對象都可以使用 apply() 來調用函數,如 Dataframe、Series、分組對象、各種時間序列等。

2.語法結構

? apply() 使用時,通常放入一個 lambda 函數表達式、或一個函數作為操作運算,官方上給出DataFrame的 apply() 用法:

DataFrame.apply(self, func, axis=0, raw=False, result_type=None, args=(), **kwargs)

參數:

  • func:函數或 lambda 表達式,應用于每行或者每列
  • axis:{0 or ‘index’, 1 or ‘columns’}, 默認為0
    • 0 or ‘index’: 表示函數處理的是每一列
    • 1 or ‘columns’: 表示函數處理的是每一行
  • raw:bool 類型,默認為 False;
    • False ,表示把每一行或列作為 Series 傳入函數中;
    • True,表示接受的是 ndarray 數據類型;
  • result_type:{‘expand’, ‘reduce’, ‘broadcast’, None}, default None
    These only act when axis=1 (columns):
    • ‘expand’ : 列表式的結果將被轉化為列。
    • ‘reduce’ : 如果可能的話,返回一個 Series,而不是展開類似列表的結果。這與 expand 相反。
    • ‘broadcast’ : 結果將被廣播到 DataFrame 的原始形狀,原始索引和列將被保留。
  • args: func 的位置參數
  • **kwargs:要作為關鍵字參數傳遞給 func 的其他關鍵字參數,1.3.0 開始支持

返回值:

  • Series 或者 DataFrame:沿數據的給定軸應用 func 的結果
	Objects passed to the function are Series objects whose index is either the DataFrame's index (``axis=0``) or the DataFrame's columns(``axis=1``). 
	傳遞給函數的對象是Series對象,其索引是DataFrame的索引(axis=0)或DataFrame的列(axis=1)。
	By default (``result_type=None``), the final return type is inferred from the return type of the applied function. Otherwise,it depends on the `result_type` argument.
	默認情況下( result_type=None),最終的返回類型是從應用函數的返回類型推斷出來的。否則,它取決于' result_type '參數。

注:DataFrame與Series的區(qū)別與聯(lián)系:

區(qū)別:

  • series,只是一個一維結構,它由index和value組成。
  • dataframe,是一個二維結構,除了擁有index和value之外,還擁有column。

聯(lián)系:

  • dataframe由多個series組成,無論是行還是列,單獨拆分出來都是一個series。

3.使用案例

3.1 DataFrame使用apply

官方使用案例

import pandas as pd
import numpy as np

df = pd.DataFrame([[4, 9]] * 3, columns=['A', 'B'])
df
   A  B
0  4  9
1  4  9
2  4  9


# 使用numpy通用函數 (如 np.sqrt(df)),
df.apply(np.sqrt)
'''
     A    B
0  2.0  3.0
1  2.0  3.0
2  2.0  3.0
'''

# 使用聚合功能
df.apply(np.sum, axis=0)
'''
A    12
B    27
dtype: int64
'''

df.apply(np.sum, axis=1)
'''
0    13
1    13
2    13
dtype: int64
'''

# 在每行上返回類似列表的內容
df.apply(lambda x: [1, 2], axis=1)
'''
0    [1, 2]
1    [1, 2]
2    [1, 2]
dtype: object
'''

# result_type='expand' 將類似列表的結果擴展到數據的列
df.apply(lambda x: [1, 2], axis=1, result_type='expand')

'''
   0  1
0  1  2
1  1  2
2  1  2
'''

# 在函數中返回一個序列,生成的列名將是序列索引。
df.apply(lambda x: pd.Series([1, 2], index=['foo', 'bar']), axis=1)

'''
   foo  bar
0    1    2
1    1    2
2    1    2
'''

# result_type='broadcast' 將確保函數返回相同的形狀結果
# 無論是 list-like 還是 scalar,并沿軸進行廣播
# 生成的列名將是原始列名。
df.apply(lambda x: [1, 2], axis=1, result_type='broadcast')
'''
A  B
0  1  2
1  1  2
2  1  2
'''

其他案例:

import numpy as np
import pandas as pd

df = pd.DataFrame({'A': [1, 2, 3],
                   'B': [4, 5, 6],
                   'C': [7, 8, 9]},
                  index=['a', 'b', 'c'])
df
	A	B	C
a	1	4	7
b	2	5	8
c	3	6	9

# 對各列應用函數 axis=0
df.apply(lambda x: np.sum(x))
A     6
B    15
C    24
dtype: int64

# 對各行應用函數
df.apply(lambda x: np.sum(x), axis=1)
a    12
b    15
c    18
dtype: int64

3.2 Series使用apply

官網案例

s = pd.Series([20, 21, 12],index=['London', 'New York', 'Helsinki'])
s
'''
London      20
New York    21
Helsinki    12
dtype: int64
'''

# 定義函數并將其作為參數傳遞給 apply,求值平方化。
def square(x):
     return x ** 2

s.apply(square)
'''
London      400
New York    441
Helsinki    144
dtype: int64
'''

# 通過將匿名函數作為參數傳遞給 apply
s.apply(lambda x: x ** 2)
'''
London      400
New York    441
Helsinki    144
dtype: int64
'''

# 定義一個需要附加位置參數的自定義函數
# 并使用args關鍵字傳遞這些附加參數。
def subtract_custom_value(x, custom_value):
     return x - custom_value

s.apply(subtract_custom_value, args=(5,))
'''
London      15
New York    16
Helsinki     7
dtype: int64
'''

# 定義一個接受關鍵字參數并將這些參數傳遞
# 給 apply 的自定義函數。
def add_custom_values(x, **kwargs):
     for month in kwargs:
         x += kwargs[month]
     return x

s.apply(add_custom_values, june=30, july=20, august=25)
'''
London      95
New York    96
Helsinki    87
dtype: int64
'''

# 使用Numpy庫中的函數
s.apply(np.log)
'''
London      2.995732
New York    3.044522
Helsinki    2.484907
dtype: float64
'''

3.3 其他案例

import pandas as pd

# 顯示所有列
pd.set_option('display.max_columns', None)
# 顯示所有行
pd.set_option('display.max_rows', None)
# 設置value的顯示長度為100,默認為50
pd.set_option('max_colwidth', 100)
# 用來計算日期差的包
import datetime

def dataInterval(data1, data2):
    """
    Args:
    :param data1: datetime
    :param data2: datetime
    :return: delta days
    """
    d1 = datetime.datetime.strptime(data1, '%Y-%m-%d')
    d2 = datetime.datetime.strptime(data2, '%Y-%m-%d')
    delta = d1 - d2
    return delta.days

def getInterval(arrLike):  
    """
    Args:
    :param arrLike: DataFrame 
    :return: delta days
    """
    PublishedTime = arrLike['PublishedTime']
    ReceivedTime = arrLike['ReceivedTime']
    days = dataInterval(PublishedTime.strip(), ReceivedTime.strip()) 
    return days

def getInterval_new(arrLike, before, after): 
    """
    Args:
    :param arrLike: DataFrame
    :param before: forward time
    :param after: backwar time
    :return: delta days
    """
    before = arrLike[before]
    after = arrLike[after]
    days = dataInterval(after.strip(), before.strip())  
    return days
if __name__ == '__main__':
    df = pd.read_excel('./data/NS_info.xls')
    print(df.head())
    # method 1
    df['TimeInterval'] = df.apply(getInterval, axis=1)
    print(df.head())
    # method 2
    df['TimeInterval'] = df.apply(getInterval_new,axis=1, 
                                  args=('ReceivedTime', 'PublishedTime')) 
	# method 3
    df['TimeInterval'] = df.apply(getInterval_new,axis=1, 
                   **{'before': 'ReceivedTime', 'after': 'PublishedTime'})  
	# method 4
    df['TimeInterval'] = df.apply(getInterval_new,axis=1, before='ReceivedTime', after='PublishedTime') 

4.總結

1.apply方法都是通過傳入一個函數或者lambda表達式對數據進行批量處理

2.apply方法處理的都是一個Series對象

參考鏈接:

1.https://blog.csdn.net/missyougoon/article/details/83301712

2.https://blog.csdn.net/qq_19528953/article/details/79348929

到此這篇關于Python pandas中apply函數簡介以及用法詳解的文章就介紹到這了,更多相關pandas apply函數用法內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • 使用Python抓取模板之家的CSS模板

    使用Python抓取模板之家的CSS模板

    本文給大家介紹的是使用Python抓取模板之家的CSS模板并打包成zip文件的代碼,使用的是單線程,非常簡單實用,這里分享給大家,有相同需求的小伙伴參考下吧。
    2015-03-03
  • python授權加密的幾種常見方案

    python授權加密的幾種常見方案

    文章介紹了幾種提高軟件授權碼安全性的方法,包括使用非對稱加密、硬件綁定、時間限制、HMAC或對稱加密以及使用在線授權服務器,建議企業(yè)級產品采用服務器+本地加密結合的方式,感興趣的朋友一起看看吧
    2025-03-03
  • Python對多個sheet表進行整合實例講解

    Python對多個sheet表進行整合實例講解

    在本篇文章里小編給大家整理的是一篇關于Python對多個sheet表進行整合實例講解內容,有興趣的朋友們可以學習下。
    2021-04-04
  • Python調用ChatGPT的API實現文章生成

    Python調用ChatGPT的API實現文章生成

    最近ChatGPT大火,在3.5版本后開放了接口API,所以很多人開始進行實操,這里我就用python來為大家實現一下,如何調用API并提問返回文章的說明
    2023-03-03
  • 淺析Python中的多進程編程

    淺析Python中的多進程編程

    在這篇文章中,我們將專注于討論Python中的多進程編程,例如進程的創(chuàng)建、管理和同步,以及一些更高級的概念,如進程池,需要的可以參考一下
    2023-07-07
  • python使用turtle庫繪制時鐘

    python使用turtle庫繪制時鐘

    這篇文章主要為大家詳細介紹了python使用turtle庫繪制時鐘,文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們可以參考一下
    2018-06-06
  • 以視頻爬取實例講解Python爬蟲神器Beautiful Soup用法

    以視頻爬取實例講解Python爬蟲神器Beautiful Soup用法

    這篇文章主要以視頻爬取實例來講解Python爬蟲神器Beautiful Soup的用法,Beautiful Soup是一個為Python獲取數據而設計的包,簡潔而強大,需要的朋友可以參考下
    2016-01-01
  • Python機器學習之決策樹

    Python機器學習之決策樹

    這篇文章主要介紹了Python機器學習之決策樹,文中有非常詳細的代碼示例,對正在學習python的小伙伴們有非常好的幫助,需要的朋友可以參考下
    2021-04-04
  • 使用pyscript在網頁中撰寫Python程式的方法

    使用pyscript在網頁中撰寫Python程式的方法

    本文主要介紹了使用pyscript在網頁中撰寫Python程式的方法,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2022-05-05
  • python爬蟲開發(fā)之使用Python爬蟲庫requests多線程抓取貓眼電影TOP100實例

    python爬蟲開發(fā)之使用Python爬蟲庫requests多線程抓取貓眼電影TOP100實例

    這篇文章主要介紹了python爬蟲開發(fā)之使用Python爬蟲庫requests多線程抓取貓眼電影TOP100實例,需要的朋友可以參考下
    2020-03-03

最新評論

娱乐| 成安县| 平度市| 铁力市| 永安市| 蕉岭县| 九龙坡区| 巨鹿县| 遂宁市| 尚义县| 姚安县| 双辽市| 汶上县| 黄梅县| 聂荣县| 盱眙县| 蓬莱市| 汝城县| 象州县| 汉中市| 宁海县| 泗水县| 牡丹江市| 河南省| 祥云县| 恭城| 霍林郭勒市| 灵武市| 甘泉县| 彭州市| 新乡县| 东港市| 昭通市| 易门县| 调兵山市| 高碑店市| 西吉县| 博兴县| 丹阳市| 临桂县| 大兴区|