Windows和Linux下使用Python搭建一個(gè)圖片OCR工具
識(shí)別結(jié)果效果

案例參考圖片

一、安裝系統(tǒng)級(jí)依賴(lài)
Windows 系統(tǒng)
在 Windows 系統(tǒng)下,從 Python 官方網(wǎng)站 下載 Python 3.10 版本安裝包,安裝時(shí)勾選 “Add Python to PATH” 選項(xiàng)。
Linux 系統(tǒng)
在 Linux 系統(tǒng)下,安裝 Python 3.10 及常用開(kāi)發(fā)組件:
sudo apt update sudo apt install -y \ python3.10 \ python3.10-venv \ python3.10-dev \ python3.10-distutils \ python3-pip
這些組件分別用于:
python3.10:Python 解釋器venv:虛擬環(huán)境支持dev / distutils:編譯與打包依賴(lài)pip:Python 包管理工具
二、創(chuàng)建并激活虛擬環(huán)境
1. 創(chuàng)建虛擬環(huán)境
python -m venv paddle_py10
2. 激活虛擬環(huán)境
Windows 系統(tǒng)
paddle_py10\\Scripts\\activate
Linux 系統(tǒng)
source paddle_py10/bin/activate
激活成功后,終端前會(huì)顯示:
(paddle_py10)
三、安裝 PaddlePaddle(CPU 版本)
在虛擬環(huán)境中安裝 PaddlePaddle CPU 版(適用于 Windows 和 Linux):
python -m pip install paddlepaddle -i https://www.paddlepaddle.org.cn/packages/stable/cpu/
說(shuō)明:
- 使用官方國(guó)內(nèi)鏡像,下載速度更快
- 該版本適合 無(wú) GPU / CPU 推理環(huán)境
- 自動(dòng)檢測(cè)操作系統(tǒng)并安裝相應(yīng)版本
四、安裝 PDF 相關(guān)依賴(lài)
1. 安裝 PyMuPDF(PDF 解析)
pip install PyMuPDF
主要用于:
- PDF 頁(yè)面解析
- 文本 / 圖片提取
- PDF 轉(zhuǎn)圖片(OCR 前處理)
2. 安裝 PaddleX(含 OCR 模塊)
pip install "paddlex[ocr]"
功能包括:
- OCR 模型封裝
- 文本檢測(cè) / 識(shí)別
- 表格與版面分析
3. 安裝 ReportLab(PDF 生成)
pip install reportlab
完整代碼
from paddleocr import PaddleOCRVL
from PIL import Image
import numpy as np
pipeline = PaddleOCRVL(
device="cpu"
)
img = Image.open(
"v2-f644e32ef8fb2b15b6dd7218eff5f844_r.jpg"
).convert("RGB")
# resize
max_side = 1024
w, h = img.size
scale = min(max_side / w, max_side / h, 1.0)
img = img.resize((int(w * scale), int(h * scale)))
# 重要一步:PIL → numpy (防止CPU超過(guò)內(nèi)存)
img_np = np.array(img)
output = pipeline.predict(img_np)
for res in output:
res.print()
res.save_to_json(save_path="output")
res.save_to_markdown(save_path="output")

輸出目錄示例(Windows)
(paddle_py10) C:\workspace\output> dir
1768203146_1313.md
1768203146_1313_res.json
輸出目錄示例(Linux)
(paddle_py10) user@machine:/home/user/workspace/output$ tree
├── 1768203146_1313.md
└── 1768203146_1313_res.json
0 directories, 4 files
轉(zhuǎn)PDF和word請(qǐng)參考相關(guān)文章參考:
到此這篇關(guān)于Windows和Linux下使用Python搭建一個(gè)圖片OCR工具的文章就介紹到這了,更多相關(guān)Python圖片OCR內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
- 使用Python開(kāi)發(fā)一個(gè)圖片OCR管理和文章下載工具
- Python使用PaddleOCR實(shí)現(xiàn)PDF/圖片文字識(shí)別與版面還原
- Python使用Tesseract?OCR實(shí)現(xiàn)識(shí)別圖片中的文字
- Python基于OCR實(shí)現(xiàn)圖片識(shí)別翻譯工具功能(附源碼)
- 使用Python的pytesseract庫(kù)開(kāi)發(fā)簡(jiǎn)易OCR圖片文字識(shí)別工具
- Python利用Spire.OCR for Python實(shí)現(xiàn)從圖片中提取文本和坐標(biāo)
- 使用Python實(shí)現(xiàn)pdf轉(zhuǎn)圖片再進(jìn)行OCR識(shí)別
相關(guān)文章
python目標(biāo)檢測(cè)基于opencv實(shí)現(xiàn)目標(biāo)追蹤示例
這篇文章主要為大家介紹了python基于opencv實(shí)現(xiàn)目標(biāo)追蹤示例,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪2022-05-05
Python類(lèi)中方法種類(lèi)與修飾符從基礎(chǔ)到實(shí)戰(zhàn)詳解
在Python面向?qū)ο缶幊讨?方法有不同的種類(lèi)和修飾符,它們各自有著特定的用途和行為,本文將全面解析Python中的各種方法類(lèi)型,并通過(guò)一個(gè)綜合案例幫助你徹底掌握這些概念,需要的朋友可以參考下2025-07-07
Python如何使用BeautifulSoup爬取網(wǎng)頁(yè)信息
這篇文章主要介紹了Python如何使用BeautifulSoup爬取網(wǎng)頁(yè)信息,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下2019-11-11
通過(guò)Python使用saltstack生成服務(wù)器資產(chǎn)清單
人工去對(duì)每一臺(tái)服務(wù)器的硬件信息并記錄早已經(jīng)過(guò)去了,無(wú)論通過(guò)腳本還是自動(dòng)化工具都是可以進(jìn)行一次編寫(xiě)到處抓取的,本文主要使用saltstack作為使用工具,然后利用其提供的APi編寫(xiě)所需的Python腳本2016-03-03
Python用requests庫(kù)爬取返回為空的解決辦法
這篇文章主要介紹了Python用requests庫(kù)爬取返回為空的解決辦法,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來(lái)一起學(xué)習(xí)學(xué)習(xí)吧2021-02-02
Python新手入門(mén)指南之如何極速搭建開(kāi)發(fā)環(huán)境
Python在軟件開(kāi)發(fā)領(lǐng)域占據(jù)重要地位,廣泛應(yīng)用于Web開(kāi)發(fā),數(shù)據(jù)分析,人工智能及自動(dòng)化腳本等領(lǐng)域,本文我們就來(lái)看看如何快速搭建Python開(kāi)發(fā)環(huán)境吧2025-06-06

