最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python Pandas的簡單使用教程

 更新時(shí)間:2021年08月16日 15:11:04   作者:橘崽崽啊  
Pandas 是python的一個(gè)數(shù)據(jù)分析包,最初由AQR Capital Management于2008年4月開發(fā),并于2009年底開源出來,目前由專注于Python數(shù)據(jù)包開發(fā)的PyData開發(fā)team繼續(xù)開發(fā)和維護(hù),今天通過本文給大家介紹Python Pandas的簡單使用教程,感興趣的朋友一起看看吧

一、  Pandas簡介

1、Python Data Analysis Library 或 pandas 是基于NumPy 的一種工具,該工具是為了解決數(shù)據(jù)分析任務(wù)而創(chuàng)建的。Pandas 納入了大量庫和一些標(biāo)準(zhǔn)的數(shù)據(jù)模型,提供了高效地操作大型數(shù)據(jù)集所需的工具。pandas提供了大量能使我們快速便捷地處理數(shù)據(jù)的函數(shù)和方法。你很快就會(huì)發(fā)現(xiàn),它是使Python成為強(qiáng)大而高效的數(shù)據(jù)分析環(huán)境的重要因素之一。

2、Pandas 是python的一個(gè)數(shù)據(jù)分析包,最初由AQR Capital Management于2008年4月開發(fā),并于2009年底開源出來,目前由專注于Python數(shù)據(jù)包開發(fā)的PyData開發(fā)team繼續(xù)開發(fā)和維護(hù),屬于PyData項(xiàng)目的一部分。Pandas最初被作為金融數(shù)據(jù)分析工具而開發(fā)出來,因此,pandas為時(shí)間序列分析提供了很好的支持。 Pandas的名稱來自于面板數(shù)據(jù)(panel data)和python數(shù)據(jù)分析(data analysis)。panel data是經(jīng)濟(jì)學(xué)中關(guān)于多維數(shù)據(jù)集的一個(gè)術(shù)語,在Pandas中也提供了panel的數(shù)據(jù)類型。

3、數(shù)據(jù)結(jié)構(gòu):

Series:一維數(shù)組,與Numpy中的一維array類似。二者與Python基本的數(shù)據(jù)結(jié)構(gòu)List也很相近,其區(qū)別是:List中的元素可以是不同的數(shù)據(jù)類型,而Array和Series中則只允許存儲(chǔ)相同的數(shù)據(jù)類型,這樣可以更有效的使用內(nèi)存,提高運(yùn)算效率。

Time- Series:以時(shí)間為索引的Series。

DataFrame:二維的表格型數(shù)據(jù)結(jié)構(gòu)。很多功能與R中的data.frame類似。可以將DataFrame理解為Series的容器。以下的內(nèi)容主要以DataFrame為主。

Panel :三維的數(shù)組,可以理解為DataFrame的容器。

Pandas 有兩種自己獨(dú)有的基本數(shù)據(jù)結(jié)構(gòu)。讀者應(yīng)該注意的是,它固然有著兩種數(shù)據(jù)結(jié)構(gòu),因?yàn)樗廊皇?Python 的一個(gè)庫,所以,Python 中有的數(shù)據(jù)類型在這里依然適用,也同樣還可以使用類自己定義數(shù)據(jù)類型。只不過,Pandas 里面又定義了兩種數(shù)據(jù)類型:Series 和 DataFrame,它們讓數(shù)據(jù)操作更簡單了。

二、Python Pandas的使用

修改列數(shù)據(jù):

df['price']=df['price'].str.replace('人均','') # 刪除多余文字
df['price']=df['price'].str.split("¥").str[-1] # 分割文本串
df['price']=df['price'].str.replace('-','0') # 替換文本
df['price']=df['price'].astype(int) # 文本轉(zhuǎn)整型

把pandas轉(zhuǎn)換int型為str型的方法

切分列數(shù)據(jù):

df['kw']=df['commentlist'].str.split().str[0].str.replace("口味",'')
df['hj']=df['commentlist'].str.split().str[1].str.replace("環(huán)境",'')
df['fw']=df['commentlist'].str.split().str[2].str.replace("服務(wù)",'')

注意:pandas中操作如果不明確指定參數(shù),則不會(huì)修改原數(shù)據(jù),而是返回一個(gè)新對(duì)象。

刪除列數(shù)據(jù):

del df['commentlist']

排序列數(shù)據(jù):

df.sort_values(by=['kw','price'],axis=0,ascending=[False,True],inplace=True) 

注意:排序前先用astype轉(zhuǎn)換正確的類型,如str、int或float

重新設(shè)置索引列標(biāo)簽順序:

df.columns=['類型','店鋪名稱','點(diǎn)評(píng)數(shù)量','星級(jí)','人均消費(fèi)','店鋪地址','口味','環(huán)境','服務(wù)']

打印前幾行數(shù)據(jù):

print(df.loc[:,['店鋪名稱','口味','人均消費(fèi)']].head(6))
# 或者 # print(df.iloc[0:6,[1,6,4]]) # 前6行(整數(shù))
# 但不能是 # print(df.loc[0:6,['店鋪名稱','口味','人均消費(fèi)']]) # 從索引0到索引6的行(對(duì)象)

http://www.fzitv.net/article/155602.htm

綜合示例:

圖例:

結(jié)果:

要求:

(1)對(duì)該數(shù)據(jù)中的comment、price進(jìn)行數(shù)據(jù)清洗整理,‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‫‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬

(2)將commentlist數(shù)據(jù)拆分為“口味”、“環(huán)境”和“服務(wù)”三列后再進(jìn)行數(shù)據(jù)清洗整理,‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‫‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬

(3)去除commentlist列數(shù)據(jù)‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‫‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬

(4)將此數(shù)據(jù)按“口味”降序、“人均消費(fèi)”升序進(jìn)行排序,‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‫‬‪‬‪‬‪‬‪‬‪‬‮‬‫‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‭‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬‪‬‪‬‪‬‪‬‪‬‮‬‪‬‮‬

(5)輸出排序后前6條數(shù)據(jù)中的“店鋪名稱”、“口味”和“人均消費(fèi)”三列數(shù)據(jù)。

代碼:

import pandas as pd 
df=pd.read_csv('spdata.csv',encoding='gbk')  #讀入文件,編碼為gbk # 注意編碼,重要

#對(duì)數(shù)據(jù)進(jìn)行清洗
df['comment']=df['comment'].str.replace('條點(diǎn)評(píng)','')
df['price']=df['price'].str.replace('人均','')
df['price']=df['price'].str.split("¥").str[-1]
df['price']=df['price'].str.replace('-','0')
df['price']=df['price'].astype(int)
df['kw']=df['commentlist'].str.split().str[0].str.replace("口味",'')
df['hj']=df['commentlist'].str.split().str[1].str.replace("環(huán)境",'')
df['fw']=df['commentlist'].str.split().str[2].str.replace("服務(wù)",'')
del df['commentlist']

#按口味降序,人均消費(fèi)升序進(jìn)行排序
df.sort_values(by=['kw','price'],axis=0,ascending=[False,True],inplace=True) 
#重新設(shè)置列索引標(biāo)簽
df.columns=['類型','店鋪名稱','點(diǎn)評(píng)數(shù)量','星級(jí)','人均消費(fèi)','店鋪地址','口味','環(huán)境','服務(wù)']

print(df.loc[:,['店鋪名稱','口味','人均消費(fèi)']].head(6))

方法二:

import pandas as pd
df=pd.read_csv('spdata.csv',encoding='gbk')

df['comment']=df['comment'].str.replace('條點(diǎn)評(píng)','')
df['price']=df['price'].str.replace('人均','').str.replace('¥','').str.replace('-','0').str.replace(' ','').astype(int)
df[['kw','hj','fw']]=df['commentlist'].str.replace('口味','').str.replace('環(huán)境','').str.replace('服務(wù)','').str.split(expand=True).astype(float) # expand將普通的列表轉(zhuǎn)為DataFrame對(duì)象
del df['commentlist']

df.sort_values(by=['kw','price'],axis=0,ascending=[False,True],inplace=True) # 注意inplace=True
df.columns=['類型','店鋪名稱','點(diǎn)評(píng)數(shù)量','星級(jí)','人均消費(fèi)','店鋪地址','口味','環(huán)境','服務(wù)']

print(df[['店鋪名稱','口味','人均消費(fèi)']].head(6))

注意:df.str.split是列表,加了expand=True之后才是DataFrame對(duì)象,或者用.str[x]提取某一列,注意不是df.str.split()[x]而是df.str.split().str[x],前者是對(duì)list(二維)操作,后者是對(duì)DataFrame操作(取某一列)

到此這篇關(guān)于Python Pandas的簡單使用教程的文章就介紹到這了,更多相關(guān)Python Pandas使用內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • 循環(huán)神經(jīng)網(wǎng)絡(luò)TextRNN實(shí)現(xiàn)情感短文本分類任務(wù)

    循環(huán)神經(jīng)網(wǎng)絡(luò)TextRNN實(shí)現(xiàn)情感短文本分類任務(wù)

    這篇文章主要為大家介紹了循環(huán)神經(jīng)網(wǎng)絡(luò)TextRNN實(shí)現(xiàn)情感短文本分類任務(wù)詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪
    2023-04-04
  • 簡單了解Python字典copy與賦值的區(qū)別

    簡單了解Python字典copy與賦值的區(qū)別

    這篇文章主要介紹了簡單了解Python字典copy與賦值區(qū)別,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2020-09-09
  • Python os模塊學(xué)習(xí)筆記

    Python os模塊學(xué)習(xí)筆記

    這篇文章主要介紹了Python os模塊學(xué)習(xí)筆記,本文總結(jié)了OS模塊的常用方法、實(shí)用方法,并給出了兩個(gè)使用實(shí)例,需要的朋友可以參考下
    2015-06-06
  • Python實(shí)現(xiàn)高分辨率圖像導(dǎo)航的代碼

    Python實(shí)現(xiàn)高分辨率圖像導(dǎo)航的代碼

    高分辨率圖像導(dǎo)航是一種技術(shù),它允許用戶在大型圖像中進(jìn)行導(dǎo)航和瀏覽,而無需加載整個(gè)圖像到內(nèi)存中,在本文中,我們將使用30行Python代碼實(shí)現(xiàn)這一功能,我們將使用Python的圖像處理庫和計(jì)算機(jī)視覺庫來加載圖像數(shù)據(jù)并生成高分辨率圖像導(dǎo)航
    2024-03-03
  • Python簡單進(jìn)程鎖代碼實(shí)例

    Python簡單進(jìn)程鎖代碼實(shí)例

    這篇文章主要介紹了Python簡單進(jìn)程鎖代碼實(shí)例,本文講解了線程和進(jìn)程的相關(guān)知識(shí),然后給出了Python的實(shí)現(xiàn)代碼,需要的朋友可以參考下
    2015-04-04
  • Python環(huán)境Pillow( PIL )圖像處理工具使用解析

    Python環(huán)境Pillow( PIL )圖像處理工具使用解析

    這篇文章主要介紹了Python環(huán)境Pillow( PIL )圖像處理工具使用解析,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2019-09-09
  • windows11環(huán)境安裝django項(xiàng)目GNU gettext工具的步驟

    windows11環(huán)境安裝django項(xiàng)目GNU gettext工具的步驟

    Django 框架具有很好的 I18N 和 L10N 的支持,其實(shí)現(xiàn)是基于 GNU 的 gettext,本文主要介紹了windows11環(huán)境安裝django項(xiàng)目GNU gettext工具的步驟,具有一定的參考價(jià)值,感興趣的可以了解一下
    2024-04-04
  • Python制作動(dòng)態(tài)字符畫的源碼

    Python制作動(dòng)態(tài)字符畫的源碼

    python字符畫是一個(gè)簡單有趣的圖畫,它一般由程序制作而成,接下來通過本文給大家分享Python制作動(dòng)態(tài)字符畫的源碼,需要的朋友可以參考下
    2021-08-08
  • 在PyCharm中安裝PyTorch、torchvision和OpenCV詳解

    在PyCharm中安裝PyTorch、torchvision和OpenCV詳解

    這篇文章主要介紹了在PyCharm中安裝PyTorch、torchvision和OpenCV方式,具有很好的參考價(jià)值,希望對(duì)大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2025-04-04
  • 一個(gè)可以套路別人的python小程序?qū)嵗a

    一個(gè)可以套路別人的python小程序?qū)嵗a

    本文通過一段實(shí)例代碼給大家分享一個(gè)可以套路別人的python小程序,非常不錯(cuò),具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2019-04-04

最新評(píng)論

辽宁省| 新竹县| 崇仁县| 建阳市| 苍溪县| 镇原县| 启东市| 扶绥县| 外汇| 乌拉特后旗| 元谋县| 蚌埠市| 安多县| 枞阳县| 罗田县| 沙湾县| 平泉县| 镇江市| 望奎县| 于都县| 清丰县| 法库县| 班玛县| 阳东县| 南岸区| 龙州县| 云霄县| 左权县| 通道| 玛多县| 临沭县| 元氏县| 永川市| 林甸县| 瑞丽市| 抚顺市| 甘孜县| 怀宁县| 尼勒克县| 淳化县| 蒙山县|