Linux下將UTF8編碼批量轉(zhuǎn)換成GB2312編碼的方法
UTF8編碼和GB2312編碼是有區(qū)別的,在sqlplus中導(dǎo)入U(xiǎn)TF8編碼的sql腳本就會(huì)出現(xiàn)亂碼錯(cuò)誤,這時(shí)就需要將UTF8編碼轉(zhuǎn)換成GB2312編碼,可是一個(gè)個(gè)的轉(zhuǎn)換十分麻煩,下面小編就教你如何在Linux下將UTF8編碼批量轉(zhuǎn)換成GB2312編碼。

背景
本人在使用oracle的sqlplus批量導(dǎo)入U(xiǎn)TF8編碼的sql腳本時(shí),由于不了解如何設(shè)置讓sqlplus識(shí)別UTF8格式,導(dǎo)致出現(xiàn)亂碼、錯(cuò)行等錯(cuò)誤,而使工作無法繼續(xù),在google無果的情況下只好想辦法轉(zhuǎn)換編碼。
由于文件較多,手動(dòng)轉(zhuǎn)換太麻煩,于是想到用腳本批量轉(zhuǎn)換,幸好網(wǎng)上相關(guān)腳本比較多,實(shí)現(xiàn)起來唯一的麻煩是UTF8的BOM標(biāo)記。
內(nèi)容:
代碼如下:
#!/bin/bash
for loop in `find 。 -type f -name “*.sql” -print`do
echo $loop
mv -f $loop $loop.tmp
dos2unix $loop.tmp
file_check_utf8=‘file_check_utf8.log’
sed -n ‘1l’ $loop.tmp 》$file_check_utf810. if grep ‘^\\357\\273\\277’ $file_check_utf8 》/dev/null 2》&111. then
echo ‘UTF-8 BOM’
sed -n -e ‘1s/^.。。//’ -e ‘w intermediate.txt’ $loop.tmp14. iconv -f UTF-8 -t GB2312 -o $loop intermediate.txt15. rm -rf intermediate.txt
rm -rf $loop.tmp
elif iconv -f UTF-8 -t GB2312 $loop.tmp 》/dev/null 2》&118. then
echo ‘UTF-8’
iconv -f UTF-8 -t GB2312 -o $loop $loop.tmp21. rm -rf $loop.tmp
else
echo ‘ANSI’
mv -f $loop.tmp $loop
fi
rm -rf $file_check_utf8
#模擬unix2dos,要求文本文件最后一行必須有換行符28. sed -n -e ‘s/$/\r/g’ -e ‘w ’$loop.tmp $loop29. mv -f $loop.tmp $loop
done
#!/bin/bash
for loop in `find 。 -type f -name “*.sql” -print`do
echo $loop
mv -f $loop $loop.tmp
dos2unix $loop.tmp
file_check_utf8=‘file_check_utf8.log’
sed -n ‘1l’ $loop.tmp 》$file_check_utf810. if grep ‘^\\357\\273\\277’ $file_check_utf8 》/dev/null 2》&111. then
echo ‘UTF-8 BOM’
sed -n -e ‘1s/^.。。//’ -e ‘w intermediate.txt’ $loop.tmp14. iconv -f UTF-8 -t GB2312 -o $loop intermediate.txt15. rm -rf intermediate.txt
rm -rf $loop.tmp
elif iconv -f UTF-8 -t GB2312 $loop.tmp 》/dev/null 2》&118. then
echo ‘UTF-8’
iconv -f UTF-8 -t GB2312 -o $loop $loop.tmp21. rm -rf $loop.tmp
else
echo ‘ANSI’
mv -f $loop.tmp $loop
fi
rm -rf $file_check_utf8
#模擬unix2dos,要求文本文件最后一行必須有換行符28. sed -n -e ‘s/$/\r/g’ -e ‘w ’$loop.tmp $loop29. mv -f $loop.tmp $loop
done
解釋
1.處理UTF8的BOM,本人沒有找到好的辦法,最后用sed+grep判斷了一下,如果前三個(gè)字節(jié)是\\357\\273\\277,則文件必定是UTF8,用sed去掉這三個(gè)字節(jié)再轉(zhuǎn)換
2.為了避免重復(fù)或者遺漏,腳本中用iconv對(duì)沒有BOM的文件嘗試轉(zhuǎn)換了一把,轉(zhuǎn)換成功說明文件是UTF8,否則說明是ANSI也就是GB2312
3.關(guān)于最后的sed命令,那是因?yàn)楸救说南到y(tǒng)上沒有unix2dos命令,所以進(jìn)行了模擬,目的是為了方便自己在windows下查看和編輯
以上就是Linux下將UTF8編碼批量轉(zhuǎn)換成GB2312編碼的方法介紹了,轉(zhuǎn)換后就能解決亂碼等問題,可使用命令鏡像批量轉(zhuǎn)換,你學(xué)會(huì)了嗎?
相關(guān)文章

集成系統(tǒng)級(jí)Claw模式! Deepin 官宣發(fā)布 25.1 版本
deepin操作系統(tǒng)發(fā)布了最新的 25.1 版本更新,該版本基于 deepin 25 正式版積累的多輪內(nèi)測(cè)成果,在 AI 能力、內(nèi)核版本、桌面環(huán)境、文件管理器以及系統(tǒng)安全等方面進(jìn)行了更新2026-04-13
又一代老硬件退場(chǎng)! Linux 內(nèi)核正式放棄Intel 486 CPU
在過去的幾十年間,CPU 的架構(gòu)已經(jīng)經(jīng)歷了飛速發(fā)展,x86 系列就是其中之一,而 i486 則屬于該系列中的一個(gè),當(dāng)前,i486 的CPU處理器已經(jīng)夠老,從 Linux 7.1 開始將不再有對(duì)2026-04-09
趕緊收藏! 全網(wǎng)最全 Linux 命令總結(jié)
我把 Linux 中最常用、最實(shí)用、最常被問到的命令按照實(shí)際使用場(chǎng)景分類整理,方便你快速查閱和記憶,內(nèi)容覆蓋日常運(yùn)維、開發(fā)調(diào)試、性能分析、文件處理、網(wǎng)絡(luò)、安全、系統(tǒng)管2026-04-08
一分鐘內(nèi)檢查L(zhǎng)inux服務(wù)器性能? 9個(gè)性能檢測(cè)常用的基本命令
今天我們來看看Linux系統(tǒng)中用于性能監(jiān)控的一系列命令,這些命令可以快速查看機(jī)器的負(fù)載情況,詳細(xì)請(qǐng)看下文介紹2026-03-18
從零基礎(chǔ)到精通! 適合高級(jí)用戶的15款Linux發(fā)行版推薦
Linux作為操作系統(tǒng)領(lǐng)域靈活性和可定制性的基石,提供了大量滿足不同用戶需求的發(fā)行版,今天分享適合高級(jí)用戶的15款Linux發(fā)行版2026-03-10
開箱即用? 這4個(gè)高手級(jí)Linux發(fā)行版遠(yuǎn)沒你想象的那么安全易用
如果你正在糾結(jié)用哪個(gè)發(fā)行版?零基礎(chǔ)新手別被“高端”“極客”“聲明式”這些詞沖昏頭腦,先用好用的,再慢慢進(jìn)階2026-03-10
這幾款SSH工具真的夠用了! Linux好用的ssh工具推薦
在Linux上使用SSH,您需要安裝一個(gè)SSH客戶端,今天整理找到的8 款 SSH / 終端工具,從免費(fèi)開源到企業(yè)級(jí)商用,從輕量化命令行到一站式工具箱,每款都做了介紹與對(duì)比,希望能2026-03-09
在Linux系統(tǒng)下有兩種用戶,即高級(jí)用戶root,普通用戶,高級(jí)用戶root可以在系統(tǒng)中做任何事情,普通用戶僅可在Linux系統(tǒng)中做有限的事情,下面我們就來看看切換方法2026-02-28
揭秘當(dāng)前登錄用戶的身份! Linux中使用logname命令的技巧
logname命令就是這樣一個(gè)簡(jiǎn)單但強(qiáng)大的工具,它能幫助我們輕松獲取當(dāng)前登錄用戶的用戶名,今天,我們就來深入探索一下這個(gè)命令的工作原理、使用方法和最佳實(shí)踐2026-02-26
在 Linux 系統(tǒng)中,DNS 緩存是一種將域名和 IP 地址映射關(guān)系緩存在本地的機(jī)制,可以加快域名解析速度,并減輕 DNS 服務(wù)器的負(fù)載2026-02-26



