OpenALPR での学習

概要

OpenALPR は、ナンバープレートの文字認識に Tesseract OCR を利用している。特定の国・地域の文字(フォント)に対する認識精度を上げたいときは、その文字のキャラクタタイル画像を用意して OCR を学習(訓練)させる。本ページでは、キャラクタタイルの学習手順を説明する。

目次

関連する外部ページ

OpenALPR Open Source ドキュメント(Creating the Character Tiles)

サイト内の関連情報

OpenALPR 2.3.0 のインストール(Ubuntu 上)

第1章 前準備


第2章 キャラクタタイルの学習(訓練)

https://doc.openalpr.com/opensource.html の「Creating the Character Tiles」を実施する。

  1. キャラクタタイル画像をひとそろい準備する

    キャラクタタイルとは、1文字ずつ切り出した白黒画像である。学習させたい国・地域のナンバープレート画像を数多く集め、そこから文字を切り出して用意する。同じ文字でも、太さや形がわずかに異なる複数のタイルを集めることで、OCR の学習精度が上がる。

  2. ImageMagick のインストール(Windows 上)

    ImageMagick は画像処理のソフトウェアであり、キャラクタタイル画像の加工に用いる。

  3. 次の作業を行う
    • 画像の加工(画像の幅をそろえる、png 形式にする、白黒画像にする)
  4. 文字ごとに、加工した画像ファイルへ、その文字を表すファイル名を付ける