python使用tesseract-ocr完成驗證碼識別(安裝部分)


一、tesseract-ocr安裝

Ubuntu版本:

1.tesseract-ocr安裝 

sudo apt-get install tesseract-ocr

2.pytesseract安裝 
sudo pip install pytesseract

3.Pillow 安裝 
sudo pip install pillow

其他linux版本(如centos):   

1.tesseract-ocr安裝 

沒找到直接命令安裝,所以需要手動下載安裝包。 
https://github.com/tesseract-ocr/tesseract 
在上述地址中下載最新的tesseract-ocr的安裝包,並解壓。 
通過以下命令安裝: 
(1)cd tesseract-3.04.01

(2)./autogen.sh

(3)./configure 
注意,如果出現error: leptonica not found,需要下載安裝leptonica 
http://www.leptonica.org/download.html

(4)make

(5)make install

(6)ldconfig

2.pytesseract安裝 
sudo pip install pytesseract

3.Pillow 安裝 
sudo pip install pillow

windows版本:

1.tesseract-ocr安裝 
http://digi.bib.uni-mannheim.de/tesseract/tesseract-ocr-setup-3.05.00dev.exe 
下載,並安裝。 
注意:如果是64位的用戶,在安裝的時需要改變安裝目錄,如下圖所示: 
這里寫圖片描述

2.pytesseract安裝 
pip install pytesseract

3.Pillow 安裝 
pip install pillow

二、windows下運行jTessBoxEditor

這是在windows下面運行的工具,主要用來對初始訓練的結果進行參數的調整。

1、安裝jdk1.8(網上找jdk1.8的安裝包,不支持1.7),然后在電腦上配置好java的環境變量

2、下載https://ncu.dl.sourceforge.net/project/vietocr/jTessBoxEditor/jTessBoxEditor-2.0-Beta.zip

3、在文件夾下運行train.bat文件

 


免責聲明!

本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。



 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM