解決pandas無法讀取csv文件數(shù)據(jù)的問題
一、前言
我有一個 csv 文件,要做數(shù)據(jù)分析,可是用 pandas 死活讀不出來,差點搞崩潰了。
但打開 csv 文件,發(fā)現(xiàn)里面的內(nèi)容啥的還是蠻正常的

并且以 逗號 分割

二、問題復現(xiàn)
1. 問題
import pandas as pd
df=pd.read_csv('./data/test.csv')
df

2. 通過 on_bad_lines=‘warn’ 跳過異常數(shù)據(jù)

不報錯了,但發(fā)現(xiàn)數(shù)據(jù)錯位了。
3. 沒辦法了 delimiter=‘\t’

數(shù)據(jù)總算對了,看著是沒有錯位
4. 添加 delimiter后,按列無法取值

仔細想想也應該這樣,因為本來分割符就是 ‘,’
5. 沒有辦法回歸最原始的方式
with open(f'{file_path}', newline='',encoding='utf-8') as csvfile:
reader = csv.DictReader(csvfile)
三、總結(jié)
通過本文可見,正確的參數(shù)設置對于使用Pandas讀取CSV文件至關重要。在處理異常數(shù)據(jù)時,合適的參數(shù)選擇和方法應用能有效解決數(shù)據(jù)錯位和取值異常等問題,確保數(shù)據(jù)的準確性和完整性。
以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關文章
Python中字符串,列表與字典的常用拼接方法總結(jié)
有時在數(shù)據(jù)處理時,需要對數(shù)據(jù)進行拼接處理,比如字符串的拼接、列表的拼接等,本文主要是介紹了字符串、列表、字典常用的拼接方法,希望對大家有所幫助2024-02-02
win10系統(tǒng)Anaconda和Pycharm的Tensorflow2.0之CPU和GPU版本安裝教程
這篇文章主要介紹了win10系統(tǒng) Anaconda 和 Pycharm 的 Tensorflow2.0 之 CPU和 GPU 版本安裝教程,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧2019-12-12
python3 pathlib庫Path類方法總結(jié)
這篇文章主要介紹了python3 pathlib庫Path類方法總結(jié),文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下2019-12-12

