最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python基于百度API識別并提取圖片中文字

 更新時(shí)間:2021年06月27日 09:54:01   作者:XnCSD  
本文主要實(shí)現(xiàn)了利用百度 AI 開發(fā)平臺的 OCR 文字識別 API 識別并提取圖片中的文字。具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下

利用百度 AI 開發(fā)平臺的 OCR 文字識別 API 識別并提取圖片中的文字。首先需注冊獲取 API 調(diào)用的 ID 和 key,步驟如下:

打開百度AI開放平臺,進(jìn)入控制臺中的文字識別應(yīng)用(需要有百度賬號)。

文字識別

創(chuàng)建一個(gè)應(yīng)用,并進(jìn)入管理應(yīng)用,記下 AppID, API Key, Secrect Key,調(diào)用 API需用到。

管理應(yīng)用

AppID

最后安裝 python 的百度ai接口的的庫

pip install baidu-aip

以下是代碼實(shí)現(xiàn),需將所有識別的圖片放進(jìn)名為 picture 的文件夾。

#!/usr/bin/env python3
# -*- coding: utf-8 -*-
"""
Created on Tue Jun 12 09:37:38 2018
利用百度api實(shí)現(xiàn)圖片文本識別
@author: XnCSD
"""

import glob
from os import path
import os
from aip import AipOcr
from PIL import Image

def convertimg(picfile, outdir):
    '''調(diào)整圖片大小,對于過大的圖片進(jìn)行壓縮
    picfile:    圖片路徑
    outdir:    圖片輸出路徑
    '''
    img = Image.open(picfile)
    width, height = img.size
    while(width*height > 4000000):  # 該數(shù)值壓縮后的圖片大約 兩百多k
        width = width // 2
        height = height // 2
    new_img=img.resize((width, height),Image.BILINEAR)
    new_img.save(path.join(outdir,os.path.basename(picfile)))
    
def baiduOCR(picfile, outfile):
    """利用百度api識別文本,并保存提取的文字
    picfile:    圖片文件名
    outfile:    輸出文件
    """
    filename = path.basename(picfile)
    
    APP_ID = '******' # 剛才獲取的 ID,下同
    API_KEY = '******'
    SECRECT_KEY = '******'
    client = AipOcr(APP_ID, API_KEY, SECRECT_KEY)
    
    i = open(picfile, 'rb')
    img = i.read()
    print("正在識別圖片:\t" + filename)
    message = client.basicGeneral(img)   # 通用文字識別,每天 50 000 次免費(fèi)
    #message = client.basicAccurate(img)   # 通用文字高精度識別,每天 800 次免費(fèi)
    print("識別成功!")
    i.close();
    
    with open(outfile, 'a+') as fo:
        fo.writelines("+" * 60 + '\n')
        fo.writelines("識別圖片:\t" + filename + "\n" * 2)
        fo.writelines("文本內(nèi)容:\n")
        # 輸出文本內(nèi)容
        for text in message.get('words_result'):
            fo.writelines(text.get('words') + '\n')
        fo.writelines('\n'*2)
    print("文本導(dǎo)出成功!")
    print()

if __name__ == "__main__":
    
    outfile = 'export.txt'
    outdir = 'tmp'
    if path.exists(outfile):
        os.remove(outfile)
    if not path.exists(outdir):
        os.mkdir(outdir)
    print("壓縮過大的圖片...")
    // 首先對過大的圖片進(jìn)行壓縮,以提高識別速度,將壓縮的圖片保存與臨時(shí)文件夾中
    for picfile in glob.glob("picture/*"):
        convertimg(picfile, outdir)
    print("圖片識別...")
    for picfile in glob.glob("tmp/*"):
        baiduOCR(picfile, outfile)
        os.remove(picfile)
    print('圖片文本提取結(jié)束!文本輸出結(jié)果位于 %s 文件中。' % outfile)
    os.removedirs(outdir)

到此這篇關(guān)于Python基于百度API識別并提取圖片中文字的文章就介紹到這了,更多相關(guān)Python百度API識別圖片文字內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • Python3實(shí)現(xiàn)二叉樹的最大深度

    Python3實(shí)現(xiàn)二叉樹的最大深度

    這篇文章主要介紹了Python3實(shí)現(xiàn)二叉樹的最大深度, 文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2019-09-09
  • Python編程使用Selenium模擬淘寶登錄實(shí)現(xiàn)過程

    Python編程使用Selenium模擬淘寶登錄實(shí)現(xiàn)過程

    這篇文章主要介紹了Python編程使用Selenium模擬淘寶登錄的實(shí)現(xiàn)過程示例及解析,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步早日升職加薪
    2021-10-10
  • django之用戶、用戶組及權(quán)限設(shè)置方式

    django之用戶、用戶組及權(quán)限設(shè)置方式

    這篇文章主要介紹了django之用戶、用戶組及權(quán)限設(shè)置方式,具有很好的參考價(jià)值,希望對大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2023-05-05
  • 詳解Selenium 元素定位和WebDriver常用方法

    詳解Selenium 元素定位和WebDriver常用方法

    這篇文章主要介紹了詳解Selenium 元素定位和WebDriver常用方法,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2020-12-12
  • Python使用re模塊驗(yàn)證危險(xiǎn)字符

    Python使用re模塊驗(yàn)證危險(xiǎn)字符

    這篇文章主要介紹了如何基于python驗(yàn)證危險(xiǎn)字符,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2020-05-05
  • Python Zipfile模塊進(jìn)行ZIP文件的創(chuàng)建解壓信息獲取和加密等操作

    Python Zipfile模塊進(jìn)行ZIP文件的創(chuàng)建解壓信息獲取和加密等操作

    這篇文章主要為大家介紹了Python Zipfile模塊進(jìn)行ZIP文件的創(chuàng)建解壓信息獲取和加密等操作,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪
    2024-01-01
  • PyTorch預(yù)訓(xùn)練的實(shí)現(xiàn)

    PyTorch預(yù)訓(xùn)練的實(shí)現(xiàn)

    這篇文章主要介紹了PyTorch預(yù)訓(xùn)練的實(shí)現(xiàn),文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2019-09-09
  • 淺談tensorflow使用張量時(shí)的一些注意點(diǎn)tf.concat,tf.reshape,tf.stack

    淺談tensorflow使用張量時(shí)的一些注意點(diǎn)tf.concat,tf.reshape,tf.stack

    這篇文章主要介紹了淺談tensorflow使用張量時(shí)的一些注意點(diǎn)tf.concat,tf.reshape,tf.stack,具有很好的參考價(jià)值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-06-06
  • Python如何把多個(gè)PDF文件合并代碼實(shí)例

    Python如何把多個(gè)PDF文件合并代碼實(shí)例

    這篇文章主要介紹了Python如何把多個(gè)PDF文件合并,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2020-02-02
  • Python安裝Selenium報(bào)錯(cuò)解決之全方位排錯(cuò)指南

    Python安裝Selenium報(bào)錯(cuò)解決之全方位排錯(cuò)指南

    pip是一個(gè)安裝Python包的管理工具,很多功能強(qiáng)大、使用方便的Python框架、插件、工具等,都是通過pip來進(jìn)行安裝的,這篇文章主要給大家介紹了關(guān)于Python安裝Selenium報(bào)錯(cuò)解決之全方位排錯(cuò)的相關(guān)資料,需要的朋友可以參考下
    2024-08-08

最新評論

忻州市| 林口县| 郸城县| 买车| 钦州市| 双柏县| 甘洛县| 格尔木市| 新兴县| 保康县| 霍山县| 柳江县| 彰化市| 郸城县| 日土县| 清水河县| 名山县| 乌兰浩特市| 凤城市| 名山县| 平罗县| 武威市| 平顺县| 岱山县| 溆浦县| 双柏县| 阳春市| 普定县| 云龙县| 涟源市| 奉贤区| 晋州市| 元阳县| 乐山市| 宜阳县| 武夷山市| 宿迁市| 新乐市| 巩义市| 政和县| 东山县|