一、tesseract-ocr安裝
Ubuntu版本:
1.tesseract-ocr安裝
sudo apt-get install tesseract-ocr
2.pytesseract安裝
sudo pip install pytesseract
3.Pillow 安裝
sudo pip install pillow
其他linux版本(如centos):
1.tesseract-ocr安裝
沒找到直接命令安裝,所以需要手動下載安裝包。
https://github.com/tesseract-ocr/tesseract
在上述地址中下載最新的tesseract-ocr的安裝包,並解壓。
通過以下命令安裝:
(1)cd tesseract-3.04.01
(2)./autogen.sh
(3)./configure
注意,如果出現error: leptonica not found,需要下載安裝leptonica
http://www.leptonica.org/download.html
(4)make
(5)make install
(6)ldconfig
2.pytesseract安裝
sudo pip install pytesseract
3.Pillow 安裝
sudo pip install pillow
windows版本:
1.tesseract-ocr安裝
http://digi.bib.uni-mannheim.de/tesseract/tesseract-ocr-setup-3.05.00dev.exe
下載,並安裝。
注意:如果是64位的用戶,在安裝的時需要改變安裝目錄,如下圖所示:
2.pytesseract安裝
pip install pytesseract
3.Pillow 安裝
pip install pillow
二、windows下運行jTessBoxEditor
這是在windows下面運行的工具,主要用來對初始訓練的結果進行參數的調整。
1、安裝jdk1.8(網上找jdk1.8的安裝包,不支持1.7),然后在電腦上配置好java的環境變量
2、下載https://ncu.dl.sourceforge.net/project/vietocr/jTessBoxEditor/jTessBoxEditor-2.0-Beta.zip
3、在文件夾下運行train.bat文件