亚洲乱码中文字幕综合,中国熟女仑乱hd,亚洲精品乱拍国产一区二区三区,一本大道卡一卡二卡三乱码全集资源,又粗又黄又硬又爽的免费视频

Python圖像處理之圖片文字識別功能(OCR)

 更新時間:2019年07月30日 10:10:06   作者:菜市口的少年  
Tesseract 是一個OCR 庫,目前由Google 贊助(Google 也是一家以O(shè)CR 和機器學(xué)習(xí)技術(shù)聞名于世的公司)。這篇文章主要介紹了Python圖像處理之圖片文字識別功能 OCR的相關(guān)知識,需要的朋友可以參考下

OCR與Tesseract介紹

將圖片翻譯成文字一般被稱為光學(xué)文字識別(Optical Character Recognition,OCR)。可以實現(xiàn)OCR 的底層庫并不多,目前很多庫都是使用共同的幾個底層OCR 庫,或者是在上面進(jìn)行定制。

Tesseract 是一個OCR 庫,目前由Google 贊助(Google 也是一家以O(shè)CR 和機器學(xué)習(xí)技術(shù)聞名于世的公司)。Tesseract 是目前公認(rèn)最優(yōu)秀、最精確的開源OCR 系統(tǒng)。

了極高的精確度,Tesseract 也具有很高的靈活性。它可以通過訓(xùn)練識別出任何字體(只要這些字體的風(fēng)格保持不變就可以),也可以識別出任何Unicode 字符。

Tesseract的安裝與使用

Tesseract的Windows安裝包下載地址為: http://digi.bib.uni-mannheim.de/tesseract/tesseract-ocr-setup-4.00.00dev.exe  ,下載后雙擊直接安裝即可。安裝完后,需要將Tesseract添加到系統(tǒng)變量中。在CMD中輸入tesseract -v, 如顯示以下界面,則表示Tesseract安裝完成且添加到系統(tǒng)變量中。

 

Linux 用戶可以通過apt-get 安裝:

$sudo apt-get tesseract-ocr

用Tesseract可以識別格式規(guī)范的文字,主要具有以下特點:

• 使用一個標(biāo)準(zhǔn)字體(不包含手寫體、草書,或者十分“花哨的”字體)
• 雖然被復(fù)印或拍照,字體還是很清晰,沒有多余的痕跡或污點
• 排列整齊,沒有歪歪斜斜的字
• 沒有超出圖片范圍,也沒有殘缺不全,或緊緊貼在圖片的邊緣

下面將給出幾個tesseract識別圖片中文字的例子。

首先是E://figures/other/poems.jpg, 輸入命令 tesseract E://figures/other/poems.jpg E://figures/other/poems.txt, 則會將poems.jpg中的識別文字寫入到poems.txt中,如下圖:

poems.jpg

 

接著是稍微有點傾斜的文字圖片th.jpg,識別情況如下:



 

可以看到識別的情況不如剛才規(guī)范字體的好,但是也能識別圖片中的大部分字母。
最后是識別簡體中文,需要事先安裝簡體中文語言包,下載地址為: https://github.com/tesseract-ocr/tessdata/find/master/chi_sim.traineddata   ,再講chi_sim.traineddata放在C:\Program Files (x86)\Tesseract-OCR\tessdata目錄下。我們以圖片timg.jpg為例:


 

輸入命令:

tesseract E://figures/other/timg.jpg E://figures/other/timg.txt -l chi_sim

識別結(jié)果如下:


 

只識別錯了一個字,識別率還是不錯的。

最后加一句,Tesseract對于彩色圖片的識別效果沒有黑白圖片的效果好。

pytesseract

pytesseract是Tesseract關(guān)于Python的接口,可以使用pip install pytesseract安裝。安裝完后,就可以使用Python調(diào)用Tesseract了,不過,你還需要一個Python的圖片處理模塊,可以安裝pillow.

輸入以下代碼,可以實現(xiàn)同上述Tesseract命令一樣的效果:

import pytesseract
from PIL import Image
pytesseract.pytesseract.tesseract_cmd = 'C://Program Files (x86)/Tesseract-OCR/tesseract.exe'
text = pytesseract.image_to_string(Image.open('E://figures/other/poems.jpg'))
print(text)

運行結(jié)果如下:


總結(jié)

以上所述是小編給大家介紹的Python圖像處理之圖片文字識別功能(OCR),希望對大家有所幫助,如果大家有任何疑問請給我留言,小編會及時回復(fù)大家的。在此也非常感謝大家對腳本之家網(wǎng)站的支持!
如果你覺得本文對你有幫助,歡迎轉(zhuǎn)載,煩請注明出處,謝謝!

相關(guān)文章

  • python cv2截取不規(guī)則區(qū)域圖片實例

    python cv2截取不規(guī)則區(qū)域圖片實例

    今天小編就為大家分享一篇python cv2截取不規(guī)則區(qū)域圖片實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-12-12
  • pytorch 實現(xiàn)二分類交叉熵逆樣本頻率權(quán)重

    pytorch 實現(xiàn)二分類交叉熵逆樣本頻率權(quán)重

    這篇文章主要介紹了pytorch 實現(xiàn)二分類交叉熵逆樣本頻率權(quán)重的操作,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教
    2021-05-05
  • 在Python中操作列表之list.extend()方法的使用

    在Python中操作列表之list.extend()方法的使用

    這篇文章主要介紹了在Python中操作列表之list.extend()方法的使用,是Python入門學(xué)習(xí)中的基礎(chǔ)知識,需要的朋友可以參考下
    2015-05-05
  • 詳解Python+opencv裁剪/截取圖片的幾種方式

    詳解Python+opencv裁剪/截取圖片的幾種方式

    這篇文章主要介紹了詳解Python+opencv裁剪/截取圖片的幾種方式,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2021-04-04
  • Python實現(xiàn)的KMeans聚類算法實例分析

    Python實現(xiàn)的KMeans聚類算法實例分析

    這篇文章主要介紹了Python實現(xiàn)的KMeans聚類算法,結(jié)合實例形式較為詳細(xì)的分析了KMeans聚類算法概念、原理、定義及使用相關(guān)操作技巧,需要的朋友可以參考下
    2018-12-12
  • 詳解Python編程中time模塊的使用

    詳解Python編程中time模塊的使用

    這篇文章主要介紹了詳解Python編程中time模塊的使用,是Python入門學(xué)習(xí)中的基礎(chǔ)知識,需要的朋友可以參考下
    2015-11-11
  • pygame實現(xiàn)彈球游戲流程

    pygame實現(xiàn)彈球游戲流程

    這篇文章主要介紹了pygame實現(xiàn)彈球游戲流程,彈球游戲(Pinball Pro)是安卓手機上排名第一的彈球游戲,真實再現(xiàn)了一直以來最經(jīng)典的彈珠臺游戲的玩法
    2023-01-01
  • Python實現(xiàn)生成指定大小文件的示例詳解

    Python實現(xiàn)生成指定大小文件的示例詳解

    這篇文章主要為大家詳細(xì)介紹了Python如何實現(xiàn)生成指定大小文件,例如txt/圖片/視頻/csv等,文中的示例代碼講解詳細(xì),需要的可以參考下
    2023-08-08
  • python使用代理ip訪問網(wǎng)站的實例

    python使用代理ip訪問網(wǎng)站的實例

    今天小編就為大家分享一篇python使用代理ip訪問網(wǎng)站的實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-05-05
  • OpenCV之理解KNN鄰近算法k-Nearest?Neighbour

    OpenCV之理解KNN鄰近算法k-Nearest?Neighbour

    這篇文章主要為大家介紹了OpenCV之理解KNN鄰近算法k-Nearest?Neighbour,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪
    2023-05-05

最新評論