Python處理字符串中文(漢字)編碼的實例
更新時間:2024年04月17日 09:02:02 作者:蛋蛋の微笑
這篇文章主要介紹了Python處理字符串中文(漢字)編碼的實例,具有很好的參考價值,希望對大家有所幫助,如有錯誤或未考慮完全的地方,望不吝賜教
Python處理字符串中文(漢字)編碼
在實際開發(fā)中,發(fā)現打印Python打印經常出現亂碼,大部分都是編碼引起
簡單說一下utf-8/ gbk/ unicode編碼之間的相互轉換問題
- utf-8是Unix下的一種通用編碼
- gbk是win環(huán)境下的一種漢字編碼
- unicode是一種二進制編碼
所有的utf-8和gbk編碼都得通過unicode編碼進行轉碼如圖:

首先,我們可以查看自己的字符串是什么編碼格式:
注意:
在Python3 中,需要將strTest轉換成二進制,再獲取編碼格式;
而在2.x時,不需要轉換,之接傳入:print chardet.detect(strTest)
import chardet strTest = "這是一個測試用例" print(chardet.detect(str_test.encode()))
得到輸出結果:

然后根據你的需要轉碼:
如 xxx.decode('utf-8').encode('gbk')
python有兩個函數 decode() 和 encode()
- decode(‘utf-8’) 是從utf-8編碼轉換成unicode編碼,當然括號里也可以寫'gbk'
- encode('gbk') 是將unicode編碼編譯成gbk編碼,當然括號里也可以寫'utf-8'
str_to_gbk = str_test.encode('gbk')
print(chardet.detect(str_to_gbk))![]()
另外,有些時候,我們輸出打印時,會出現中文打印是 \uxxx 等,可以試試以下代碼:
xxx.encode('utf-8').decode('unicode_escape')總結
以上為個人經驗,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關文章
python+selenium實現QQ郵箱自動發(fā)送功能
這篇文章主要為大家詳細介紹了python+selenium實現QQ郵箱自動發(fā)送功能,文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們可以參考一下2019-01-01
Python中SOAP項目的介紹及其在web開發(fā)中的應用
這篇文章主要介紹了Python中的SOAP項目及其在web開發(fā)中的應用,本文來自于IBM官方網站技術文檔,需要的朋友可以參考下2015-04-04

