Tesseract OCRを用いた複数画像の一括処理例(Ubuntu 上)

複数の画像ファイルを1度に文字認識させたいとする.対象は png 形式の画像ファイルであり,Ubuntu 上で次のシェルスクリプトを実行する.

for i in *.png; do
  echo $i
  tesseract $i outbase -l jpn --psm 6 2>/dev/null
  nkf -s outbase.txt
  rm -f outbase.txt
done

このスクリプトは,カレントディレクトリ内のすべての png ファイルに対して繰り返し処理を行う.tesseract コマンドの -l jpn は日本語を認識対象の言語として指定し,--psm 6 は画像を1つのまとまったテキストブロックとして扱う設定である.nkf -s は認識結果の文字コードを Shift_JIS に変換して表示する.


概要

金子研究室サポート:次の手順で演習用データをダウンロードする.
wget https://www.kkaneko.jp/lab/vehicle_registration/licenseplate_tile-2018-04-19.tar.gz
tar -xvzf licenseplate_tile-2018-04-19.tar.gz