最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python調(diào)用百度AI實(shí)現(xiàn)圖片上文字識別功能實(shí)例

 更新時間:2021年09月06日 11:01:35   作者:魚尾努力淦飯  
百度AI功能還是很強(qiáng)大的,百度AI開放平臺真的是測試接口的天堂,免費(fèi)接口很多,當(dāng)然有量的限制,但個人使用是完全夠用的,下面這篇文章主要給大家介紹了關(guān)于Python調(diào)用百度AI實(shí)現(xiàn)圖片上文字識別功能的相關(guān)資料,需要的朋友可以參考下

簡介

Python免費(fèi)調(diào)用百度AI實(shí)現(xiàn)圖片上面的文字識別

步驟

安裝百度AI庫

!pip install baidu-aip

注冊百度AI開放平臺

先注冊百度AI,獲得ID和密鑰。注冊方法可參考:注冊方法 只需走到 “1.6 獲取密鑰” 即可。然后記錄下自己的APP_ID、API_KEY、SECRET_KEY,就可以開始了。

調(diào)用glob庫

glob庫用于獲得指定路徑下的指定后綴的文件,圖片使用的是《數(shù)學(xué)模型》pdf掃描版,部分如下:

import glob
path = "數(shù)學(xué)模型\\"
glob.glob(path+"*.png")

指定文件夾中的指定的.png后綴的文件,全部提取出來了:

選取第一張圖片 “數(shù)學(xué)模型1.png” 做測試:

files = glob.glob(path+"*.png")
file = files[0]

調(diào)用AipOcr庫識別文字

導(dǎo)入AipOcr模塊,這個模塊是用于做文字識別的(OCR即Optical Character Recognition,光學(xué)字符識別)。填入你申請的ID和KEY,client = AipOcr()是固定寫法。先用二進(jìn)制方式rb打開,然后讀取,再調(diào)用百度AI進(jìn)行識別,并將識別結(jié)果存入message變量。

from aip import AipOcr #導(dǎo)入AipOcr模塊,用于做文字識別
import glob

APP_ID = '*********' # 你申請的
API_KEY = '*********'# 你申請的
SECRET_KEY = '*********'# 你申請的
client = AipOcr(APP_ID, API_KEY, SECRET_KEY)

pic = open(file,'rb')# 以二進(jìn)制(rb)打開
img = pic.read() # 讀取
message = client.basicGeneral(img) # 調(diào)用百度AI識別圖片中的文字

查看message參數(shù),結(jié)果如下:

可見,message參數(shù)的結(jié)果為 “大字典” 形式,其中的鍵 words_result 所對應(yīng)的值為一個 “大列表” ,這個列表里又有很多鍵值對,鍵都是words,值就是AI從圖片上識別出來的內(nèi)容。使用語句message['words_result'][0...n]['words']可以篩選出該頁的標(biāo)題:

message['words_result'][1]['words']

for循環(huán)逐行提取:

for words in message['words_result']:
    word = words['words'] # 提取文字
    print(word)

識別效果圖:

識別也不是完美的,有很多識別錯誤與未識別出的文字。當(dāng)然,原圖字體越清晰,識別度越高。

可能會遇到的問題

識別過程中可能會遇到類似識別錯誤(無法識別)問題,原因是未領(lǐng)取免費(fèi)識別次數(shù),解決過程如下:

百度OCR API識別失敗:Open api qps request limit reached 錯誤 解決方法

幾個月前,用Python寫了個小工具,主要是用到了百度的OCR API做了個文字識別的小工具,前面一直能用,然而今天,在使用的時候,報(bào)錯了。
錯誤如下:Open api qps request limit reached

最后終于找到了解決方法,原來,現(xiàn)在要自己去領(lǐng)取免費(fèi)的測試額度了!??!

領(lǐng)取免費(fèi)測試額度的地址:(或者你在你原來那個調(diào)用的那個項(xiàng)目里也可以找到免費(fèi)領(lǐng)取測試額度,見下圖)

https://console.bce.baidu.com/ai/#/ai/ocr/overview/resource/getFree

領(lǐng)取完之后,還是用原來項(xiàng)目的appID,apiKey,secretKey即可。

然后等領(lǐng)取額度到賬后,重新運(yùn)行就行了。

批量操作

批量操作的核心為for循環(huán),txt_file = open('數(shù)學(xué)模型.txt', 'a')指打開名字為“數(shù)學(xué)模型”的文本文件(若不存在則自動新建),模式為添加模式,即'a'模式。添加模式是指,如果文本中已經(jīng)有一些內(nèi)容,則接著往下寫,不會影響原來的內(nèi)容。如果是'w'模式,則會將之前的內(nèi)容全部覆蓋。然后遍歷待處理的圖片,逐個處理:

from aip import AipOcr #導(dǎo)入AipOcr模塊,用于做文字識別
import glob

APP_ID = '*********' # 你申請的
API_KEY = '*********'# 你申請的
SECRET_KEY = '*********'# 你申請的
client = AipOcr(APP_ID, API_KEY, SECRET_KEY)

path = "數(shù)學(xué)模型\\"
files = glob.glob(path+"*.png")

txt_file = open('數(shù)學(xué)模型.txt', 'a')

for file in files:
    pic = open(file,'rb')# 以二進(jìn)制(rb)打開
    img = pic.read() # 讀取
    message = client.basicGeneral(img) # 調(diào)用百度AI識別圖片中的文字
    for words in message['words_result']:
        word = words['words'] # 提取文字
        print(word)

        txt_file.write(word) # 將文字寫入文本文件

txt_file.close() # 關(guān)閉文本文件

總結(jié)

到此這篇關(guān)于Python調(diào)用百度AI實(shí)現(xiàn)圖片上文字識別功能的文章就介紹到這了,更多相關(guān)Python圖片上文字識別內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • Python字符串格式化str.format()方法的實(shí)現(xiàn)

    Python字符串格式化str.format()方法的實(shí)現(xiàn)

    字符串的格式化是一個非常重要的功能,用于創(chuàng)建包含變量值的字符串,本來就來介紹一下Python字符串格式化str.format()方法的實(shí)現(xiàn),感興趣的可以了解一下
    2023-11-11
  • matplotlib之Pyplot模塊繪制三維散點(diǎn)圖使用顏色表示數(shù)值大小

    matplotlib之Pyplot模塊繪制三維散點(diǎn)圖使用顏色表示數(shù)值大小

    在撰寫論文時常常會用到matplotlib來繪制三維散點(diǎn)圖,下面這篇文章主要給大家介紹了關(guān)于matplotlib之Pyplot模塊繪制三維散點(diǎn)圖使用顏色表示數(shù)值大小的相關(guān)資料,文中通過圖文介紹的非常詳細(xì),需要的朋友可以參考下
    2022-08-08
  • python 爬蟲一鍵爬取 淘寶天貓寶貝頁面主圖顏色圖和詳情圖的教程

    python 爬蟲一鍵爬取 淘寶天貓寶貝頁面主圖顏色圖和詳情圖的教程

    今天小編就為大家分享一篇python 爬蟲一鍵爬取 淘寶天貓寶貝頁面主圖顏色圖和詳情圖的教程,具有很好的參考價(jià)值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-05-05
  • python簡單實(shí)現(xiàn)獲取當(dāng)前時間

    python簡單實(shí)現(xiàn)獲取當(dāng)前時間

    最近項(xiàng)目中經(jīng)常需要python去取當(dāng)前的時間,雖然不是很難,但是老是忘記,用一次丟一次,為了能夠更好的記住,我今天特意寫下python 當(dāng)前時間這篇文章,如果你覺的對你有用的話,可以收藏下。
    2016-08-08
  • Python中的pip命令安裝與使用輕松入門教程

    Python中的pip命令安裝與使用輕松入門教程

    pip是Python的包管理工具,用于安裝、卸載和管理第三方庫,本文詳細(xì)介紹了pip的安裝和使用方法,包括檢查pip是否已安裝、手動安裝或升級pip以及pip的基本使用,文中通過代碼介紹的非常詳細(xì),需要的朋友可以參考下
    2024-11-11
  • Python環(huán)境搭建以及Python與PyCharm安裝詳細(xì)圖文教程

    Python環(huán)境搭建以及Python與PyCharm安裝詳細(xì)圖文教程

    PyCharm是一種PythonIDE,帶有一整套可以幫助用戶在使用Python語言開發(fā)時提高其效率的工具,這篇文章主要給大家介紹了關(guān)于Python環(huán)境搭建以及Python與PyCharm安裝的詳細(xì)圖文教程,需要的朋友可以參考下
    2024-03-03
  • 基于python時間處理方法(詳解)

    基于python時間處理方法(詳解)

    下面小編就為大家?guī)硪黄趐ython時間處理方法(詳解)。小編覺得挺不錯的,現(xiàn)在就分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2017-08-08
  • python讀取txt文件并逐行輸出字符串

    python讀取txt文件并逐行輸出字符串

    Python提供了簡單且方便的方法來讀取txt文件,使用open()函數(shù)和readlines()方法逐行輸出文件中的字符串內(nèi)容,我們可以輕松地讀取文件內(nèi)容,并通過循環(huán)遍歷的方式逐行處理,讀取txt文件的方法在各種應(yīng)用場景中非常常見,可以用于數(shù)據(jù)分析、文本處理、日志分析等
    2023-10-10
  • Python通過90行代碼搭建一個音樂搜索工具

    Python通過90行代碼搭建一個音樂搜索工具

    這篇文章主要介紹了Python通過90行代碼搭建一個音樂搜索工具,需要的朋友可以參考下
    2015-07-07
  • 利用Python求解阿基米德分牛問題

    利用Python求解阿基米德分牛問題

    這篇文章主要為大家詳細(xì)介紹了如何利用Python優(yōu)雅地求解阿基米德分牛問題,文中的示例代碼講解詳細(xì),感興趣的小伙伴可以跟隨小編一起了解一下
    2023-03-03

最新評論

财经| 军事| 丰城市| 克什克腾旗| 普兰县| 视频| 定州市| 雷州市| 永清县| 浠水县| 太和县| 沁水县| 木兰县| 潼关县| 阜宁县| 安陆市| 武强县| 遂宁市| 双鸭山市| 普兰店市| 阿尔山市| 越西县| 兰坪| 桐柏县| 洛浦县| 龙川县| 湾仔区| 探索| 馆陶县| 格尔木市| 武乡县| 蚌埠市| 赣榆县| 武清区| 蒲城县| 郁南县| 南川市| 东乡县| 湖口县| 家居| 肥西县|