最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python使用pandas將表格數據進行處理

 更新時間:2022年08月31日 14:42:05   作者:IT之一小佬  
這篇文章主要介紹了Python使用pandas將表格數據進行處理,文章圍繞主題展開詳細的內容介紹,具有一定的參考價值,感興趣的小伙伴可以參考一下

前言

任務描述:

當前有一份excel表格數據,里面存在缺失值,需要對缺失的數據到es數據庫中進行查找并對其進行把缺失的數據進行補全。

excel表格數據如下所示:

一、構建es庫中的數據

1.1 創(chuàng)建索引

# 創(chuàng)建physical_examination索引
PUT /physical_examination
{
  "settings": {
    "index": {
      "number_of_shards": "1",
      "number_of_replicas": "1"
    }
  },
  "mappings": {
    "properties": {
      "nums": {
        "type": "integer"
      },
      "name": {
        "type": "text"
      },
      "sex": {
        "type": "text"
      },
      "phone": {
        "type": "integer"
      },
      "result": {
        "type": "text"
      }
    }
  }
}

1.2 插入數據

注意:json數據不能格式化換行,否則報錯】

# 向physical_examination索引中添加數據
POST physical_examination/_bulk
{"index":{"_id":"1"}}
{"nums":1,"name":"劉一","sex":"男","phone":1234567891,"result":"優(yōu)秀"}
{"index":{"_id":"2"}}
{"nums":2,"name":"陳二","sex":"男","phone":1234567892,"result":"優(yōu)秀"}
{"index":{"_id":"3"}}
{"nums":3,"name":"張三","sex":"男","phone":1234567893,"result":"優(yōu)秀"}
{"index":{"_id":"4"}}
{"nums":4,"name":"李四","sex":"男","phone":1234567894,"result":"優(yōu)秀"}
{"index":{"_id":"5"}}
{"nums":5,"name":"王五","sex":"男","phone":1234567895,"result":"優(yōu)秀"}

1.3 查詢數據

注意:默認查詢索引下的所有數據】

# 查詢索引中的所有數據
GET physical_examination/_search
{
  "query": {
    "match_all": {}
  }
}

二、對excel表格中的數據處理操作

2.1 導出es查詢的數據

  • 方法一:直接在kibana或postman查詢的結果中進行復制粘貼到一個文檔。
  • 方法二:使用kibana導出數據。
  • 方法三:使用postman導出數據保存到本地。

使用python處理數據,獲取需要的數據。

示例代碼:

# 讀取json中體檢信息
with open('./data/physical_examination.json', 'r', encoding='utf-8') as f:
    data_json = f.read()
print(data_json)
 
# 處理json數據中的異常數據
if 'false' in data_json:
    data_json = data_json.replace('false', "False")
 
data_json = eval(data_json)
print(data_json)
 
print(data_json['hits']['hits'])
print('*' * 100)
 
valid_data = data_json['hits']['hits']
need_data = []
for data in valid_data:
    print(data['_source'])
    need_data.append(data['_source'])
print(need_data)

讀取缺失數據的excel表格,把缺失的數據填補進去。

# 讀取需要填補數據的表格
data_xlsx = pd.read_excel('./data/體檢表.xlsx', sheet_name='Sheet1')
# print(data_xlsx)
 
# 獲取excel表格的行列
row, col = data_xlsx.shape
print(row, col)
 
# 修改表格中的數據
for i in range(row):
    bb = data_xlsx.iloc[i]
    print(bb['姓名'], bb['手機號'])
    if pd.isnull(bb['手機號']):
        bb['手機號'] = '666'
        for cc in need_data:
            if cc['name'] == bb['姓名']:
                bb['手機號'] = cc['phone']
            data_xlsx.iloc[i, 3] = bb['手機號']
    print(bb['姓名'], bb['手機號'])
    print("-" * 100)
print(data_xlsx)

將最終處理好的數據保存在新建的文件中。

# 保存數據到新文件中
data_xlsx.to_excel('./data/new_data.xlsx', sheet_name='Sheet1', index=False, header=True)

完整代碼如下:

import pandas as pd
 
# 讀取json中體檢信息
with open('./data/physical_examination.json', 'r', encoding='utf-8') as f:
    data_json = f.read()
print(data_json)
 
# 處理json數據中的異常數據
if 'false' in data_json:
    data_json = data_json.replace('false', "False")
 
data_json = eval(data_json)
print(data_json)
 
print(data_json['hits']['hits'])
print('*' * 100)
 
valid_data = data_json['hits']['hits']
need_data = []
for data in valid_data:
    print(data['_source'])
    need_data.append(data['_source'])
print(need_data)
 
# 讀取需要填補數據的表格
data_xlsx = pd.read_excel('./data/體檢表.xlsx', sheet_name='Sheet1')
# print(data_xlsx)
 
# 獲取excel表格的行列
row, col = data_xlsx.shape
print(row, col)
 
# 修改表格中的數據
for i in range(row):
    bb = data_xlsx.iloc[i]
    print(bb['姓名'], bb['手機號'])
    if pd.isnull(bb['手機號']):
        bb['手機號'] = '666'
        for cc in need_data:
            if cc['name'] == bb['姓名']:
                bb['手機號'] = cc['phone']
            data_xlsx.iloc[i, 3] = bb['手機號']
    print(bb['姓名'], bb['手機號'])
    print("-" * 100)
print(data_xlsx)
 
# 保存數據到新文件中
data_xlsx.to_excel('./data/new_data.xlsx', sheet_name='Sheet1', index=False, header=True)

運行效果,最終處理好的數據如下所示:

到此這篇關于Python使用pandas將表格數據進行處理的文章就介紹到這了,更多相關pandas表格數據處理內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • python光學仿真相速度和群速度計算理解學習

    python光學仿真相速度和群速度計算理解學習

    從物理學的機制出發(fā),波動模型相對于光線模型,顯然更加接近光的本質;但是從物理學的發(fā)展來說,波動光學旨在解決幾何光學無法解決的問題,可謂光線模型的一種升級
    2021-10-10
  • python批量替換文件名中的共同字符實例

    python批量替換文件名中的共同字符實例

    這篇文章主要介紹了python批量替換文件名中的共同字符實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-03-03
  • Pycharm以root權限運行腳本的方法

    Pycharm以root權限運行腳本的方法

    今天小編就為大家分享一篇Pycharm以root權限運行腳本的方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-01-01
  • Python處理字節(jié)串:struct.pack和struct.unpack使用

    Python處理字節(jié)串:struct.pack和struct.unpack使用

    這篇文章主要介紹了Python處理字節(jié)串:struct.pack和struct.unpack使用方式,具有很好的參考價值,希望對大家有所幫助,如有錯誤或未考慮完全的地方,望不吝賜教
    2024-01-01
  • Pytorch基礎教程之torchserve模型部署解析

    Pytorch基礎教程之torchserve模型部署解析

    torchserve是基于netty網絡框架實現的,底層使用EpollServerSocketChannel服務進行網絡通信,通過epoll多路復用技術實現高并發(fā)網絡連接處理,這篇文章主要介紹了Pytorch基礎教程之torchserve模型部署和推理,需要的朋友可以參考下
    2023-07-07
  • Python用yield from實現異步協程爬蟲的實踐

    Python用yield from實現異步協程爬蟲的實踐

    本文主要介紹了Python用yield from實現異步協程爬蟲的實踐,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2023-01-01
  • Python實現時間序列變化點檢測功能

    Python實現時間序列變化點檢測功能

    平穩(wěn)性是時間序列分析與預測的核心概念,在平穩(wěn)條件下,時間序列的統計特性(如均值)在時間維度上保持不變,僅存在隨機波動,但是時間序列通常會經歷結構性斷裂或變化,本文給大家介紹了Python實現時間序列變化點檢測功能,需要的朋友可以參考下
    2024-09-09
  • Python:slice與indices的用法

    Python:slice與indices的用法

    今天小編就為大家分享一篇Python:slice與indices的用法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-11-11
  • Python制作詞云的方法

    Python制作詞云的方法

    這篇文章主要為大家詳細介紹了Python制作詞云的方法,文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們可以參考一下
    2018-01-01
  • Python使用Flask框架同時上傳多個文件的方法

    Python使用Flask框架同時上傳多個文件的方法

    這篇文章主要介紹了Python使用Flask框架同時上傳多個文件的方法,實例分析了Python中Flask框架操作文件實現上傳的技巧,需要的朋友可以參考下
    2015-03-03

最新評論

南溪县| 敦煌市| 施甸县| 垣曲县| 玉山县| 永吉县| 乐安县| 永善县| 道真| 宜昌市| 林西县| 永济市| 社旗县| 龙川县| 西吉县| 页游| 台州市| 临澧县| 望城县| 新津县| 德格县| 荔浦县| 西平县| 翁源县| 枣庄市| 马鞍山市| 沅江市| 固阳县| 南溪县| 穆棱市| 化州市| 高阳县| 息烽县| 扬州市| 屏边| 万安县| 遵化市| 沂水县| 自治县| 霍邱县| 汤阴县|