光学マーク認識(OMR)サポート
IronOCRはPDF、画像、スキャンされたドキュメントから印刷されたテキストと手書きのテキストを読み取ります。 チェックボックスにチェックが入ったかどうか、塗りつぶされたバブル、選択されたラジオボタンなどのマークはまだ検出されません。 その能力は、IronOCRが提供する文字認識とは異なる技術である光学的マーク認識(OMR)です。
OMRの働き
OMRは、文字や数字を読み取ることなく、フォームの事前定義された領域内のマークの有無を検出します。 次のようなレイアウトに標準的に使用されます。:
- 多肢選択式の試験
- 調査アンケートのチェックボックス
- 投票用紙
- フィードバックフォーム
OCRが文字を返す場所(9)、OMRはブール値を返します。ゾーンが塗りつぶされているか、それともいないかです。 典型的な判断は次の通りです:
- チェックボックスにチェックが入っているか。
- どのバブル(
D)が塗りつぶされているか。 - ラジオボタンが選択されているかどうか。
- ユーザーがペン、鉛筆、その他の非デジタル入力でフォームをどのようにマークしたか。
OMRは、フォームデザインが既知で一貫しており、各マークのための明確に定義されたゾーンがある場合に最適に機能します。
OMRとOCR
この2つの技術は異なる問題を解決し、フォーム処理では一緒に必要とされることがよくあります。
- 目的:OCRはテキストを読み取り、変換します; OMRはマークの存在を検出します。
- 出力:OCRは文字を生成します; OMRは選択された/されていないブール値を生成します。
- 典型的な用途:OCRは請求書、文書、本を扱います; OMRはアンケート、試験、チェックリストを扱います。
- 入力要件:OCRはテキストフォントと手書きを処理します; OMRは、定義されたチェックボックスを持つクリーンなレイアウトが必要です。
- 根本的な技術:OCRは文字分割と言語処理に依存します; OMRは幾何学的領域のスキャンとしきい値処理に依存します。
IronOCRでの現在の状況
IronOCRはOMRを公式にサポートしていません。このライブラリはテキスト認識とレイアウト読み取りに特化しており、マーク検出は異なるパラダイムで、現在直接的には利用可能ではありません。
この機能の需要は顧客のティケットや機能リクエストで着実に増えています。
ロードマップ
IronOCRチームはOMRのための複数の機能リクエストを記録しており、チェックボックスやラジオボタンの検出をライブラリに追加する最良の方法を評価しています。 OMRサポートの開発はロードマップ上にありますが、まだ出荷されていません。

