OpenALPR での学習
【概要】
OpenALPR は、ナンバープレートの文字認識に Tesseract OCR を利用している。特定の国・地域の文字(フォント)に対する認識精度を上げたいときは、その文字のキャラクタタイル画像を用意して OCR を学習(訓練)させる。本ページでは、キャラクタタイルの学習手順を説明する。【目次】
【関連する外部ページ】
OpenALPR Open Source ドキュメント(Creating the Character Tiles)【サイト内の関連情報】
OpenALPR 2.3.0 のインストール(Ubuntu 上)第1章 前準備
- OpenALPR のダウンロード、展開(解凍)が終わっていること
第2章 キャラクタタイルの学習(訓練)
https://doc.openalpr.com/opensource.html の「Creating the Character Tiles」を実施する。
- キャラクタタイル画像をひとそろい準備する
キャラクタタイルとは、1文字ずつ切り出した白黒画像である。学習させたい国・地域のナンバープレート画像を数多く集め、そこから文字を切り出して用意する。同じ文字でも、太さや形がわずかに異なる複数のタイルを集めることで、OCR の学習精度が上がる。
- ImageMagick のインストール(Windows 上)
ImageMagick は画像処理のソフトウェアであり、キャラクタタイル画像の加工に用いる。
- 次の作業を行う
- 画像の加工(画像の幅をそろえる、png 形式にする、白黒画像にする)
- 文字ごとに、加工した画像ファイルへ、その文字を表すファイル名を付ける