JPH10261048A - 文字認識装置及び文字認識プログラムを記憶した記憶媒体 - Google Patents
文字認識装置及び文字認識プログラムを記憶した記憶媒体Info
- Publication number
- JPH10261048A JPH10261048A JP9346031A JP34603197A JPH10261048A JP H10261048 A JPH10261048 A JP H10261048A JP 9346031 A JP9346031 A JP 9346031A JP 34603197 A JP34603197 A JP 34603197A JP H10261048 A JPH10261048 A JP H10261048A
- Authority
- JP
- Japan
- Prior art keywords
- font
- character
- dictionary
- characters
- recognition
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Withdrawn
Links
Landscapes
- Character Discrimination (AREA)
Abstract
(57)【要約】
【課題】 認識速度及び認識精度を両立的に向上するこ
とである。 【解決手段】 辞書記憶手段1には複数の互いに種類の
異なるフォント辞書が予め格納され、画像記憶手段2に
は帳票上の印字を光学的に読み取ることにより生成され
たビットマップ形式の画像情報が格納されている。切出
手段3は該画像情報から認識対象文字を順次切り出し、
照合手段4は切り出された認識対象文字と複数のフォン
ト辞書とを照合し、判定手段5は照合結果に基づき認識
対象文字に近似する順に標準文字を選定する。特定手段
6は複数の認識対象文字についての選定結果に基づき、
印刷時に使用されたフォントに近いと推定される少なく
とも1つのフォント辞書を特定し、限定手段7は照合処
理に使用されるフォント辞書を、該特定された少なくと
も1つのフォント辞書に限定する。
とである。 【解決手段】 辞書記憶手段1には複数の互いに種類の
異なるフォント辞書が予め格納され、画像記憶手段2に
は帳票上の印字を光学的に読み取ることにより生成され
たビットマップ形式の画像情報が格納されている。切出
手段3は該画像情報から認識対象文字を順次切り出し、
照合手段4は切り出された認識対象文字と複数のフォン
ト辞書とを照合し、判定手段5は照合結果に基づき認識
対象文字に近似する順に標準文字を選定する。特定手段
6は複数の認識対象文字についての選定結果に基づき、
印刷時に使用されたフォントに近いと推定される少なく
とも1つのフォント辞書を特定し、限定手段7は照合処
理に使用されるフォント辞書を、該特定された少なくと
も1つのフォント辞書に限定する。
Description
【0001】
【発明の属する技術分野】本発明は、文字認識技術に関
し、特に、紙面上に印刷された文字についてのビットマ
ップ形式の画像情報から文字コードを求めるための文字
認識技術に関する。
し、特に、紙面上に印刷された文字についてのビットマ
ップ形式の画像情報から文字コードを求めるための文字
認識技術に関する。
【0002】近年、紙面上に印刷された文字を光学式文
字認識装置により読み取り、その内容をコンピュータシ
ステムにより管理することが多く行われており、文字認
識の高速化、高精度化が要望されている。
字認識装置により読み取り、その内容をコンピュータシ
ステムにより管理することが多く行われており、文字認
識の高速化、高精度化が要望されている。
【0003】
【従来の技術】例えば、フランチャイズ・チェーンスト
ア等においては、本部と各店舗との間で、紙面としての
発注伝票、仕入伝票、納品伝票、その他の帳票(以下、
単に帳票という)をやり取りすることが行われており、
本部においては、各店舗から送られてきた帳票を光学式
文字認識装置により読み取り、コンピュータシステムに
情報として入力して、それぞれの情報を管理することが
行われている。
ア等においては、本部と各店舗との間で、紙面としての
発注伝票、仕入伝票、納品伝票、その他の帳票(以下、
単に帳票という)をやり取りすることが行われており、
本部においては、各店舗から送られてきた帳票を光学式
文字認識装置により読み取り、コンピュータシステムに
情報として入力して、それぞれの情報を管理することが
行われている。
【0004】ここで、業務の効率化のため、各帳票はで
きるだけ統一化されたものが使用されており、また、各
店舗においては、この帳票に必要な文字をコンピュータ
システムを使用してのプリンタによる印刷(プリントア
ウト)により行っている。
きるだけ統一化されたものが使用されており、また、各
店舗においては、この帳票に必要な文字をコンピュータ
システムを使用してのプリンタによる印刷(プリントア
ウト)により行っている。
【0005】一般的な光学式文字認識装置は、画像記憶
手段、辞書記憶手段、切出手段、照合手段及び判定手段
を備えて構成される。画像記憶手段には、スキャナ装置
により複数の帳票が順次光学的に読み取られて生成され
たビットマップ形式の画像情報が格納される。
手段、辞書記憶手段、切出手段、照合手段及び判定手段
を備えて構成される。画像記憶手段には、スキャナ装置
により複数の帳票が順次光学的に読み取られて生成され
たビットマップ形式の画像情報が格納される。
【0006】辞書記憶手段には、複数の互いに種類の異
なる印字フォント毎に、複数の標準文字についての照合
情報及び文字コードを含む情報がそれぞれ設定された複
数のフォント辞書が予め格納されている。
なる印字フォント毎に、複数の標準文字についての照合
情報及び文字コードを含む情報がそれぞれ設定された複
数のフォント辞書が予め格納されている。
【0007】切出手段は、画像記憶手段に格納されたビ
ットマップ形式の画像情報から認識対象文字を順次切り
出す。照合手段は、該切出手段により切り出された認識
対象文字と該辞書記憶手段に格納された複数のフォント
辞書のそれぞれの複数の標準文字とを照合する。
ットマップ形式の画像情報から認識対象文字を順次切り
出す。照合手段は、該切出手段により切り出された認識
対象文字と該辞書記憶手段に格納された複数のフォント
辞書のそれぞれの複数の標準文字とを照合する。
【0008】判定手段は、該照合手段による照合結果に
基づき、該切出手段により切り出された認識対象文字に
近似する単数又は複数の標準文字を選出し、該標準文字
に対応する文字コードを出力する。
基づき、該切出手段により切り出された認識対象文字に
近似する単数又は複数の標準文字を選出し、該標準文字
に対応する文字コードを出力する。
【0009】出力された文字コードは、この文字認識装
置の上位装置としてのコンピュータシステムに入力さ
れ、コンピュータシステムにおいて、必要な処理がなさ
れる。ここで、帳票の印刷に使用される印字フォント
(字形、字体)は、各店舗において使用されているプリ
ンタの機種等により種々多様である。従って、文字認識
に使用するフォント辞書は、種々の文字フォントに対応
して、なるべく多くのフォント辞書を網羅すべく、多数
準備して辞書記憶手段に予め格納されている。
置の上位装置としてのコンピュータシステムに入力さ
れ、コンピュータシステムにおいて、必要な処理がなさ
れる。ここで、帳票の印刷に使用される印字フォント
(字形、字体)は、各店舗において使用されているプリ
ンタの機種等により種々多様である。従って、文字認識
に使用するフォント辞書は、種々の文字フォントに対応
して、なるべく多くのフォント辞書を網羅すべく、多数
準備して辞書記憶手段に予め格納されている。
【0010】
【発明が解決しようとする課題】しかし、多数のフォン
ト辞書を文字認識の照合の比較対象とすると、指数級数
的に比較対象処理が増大するため、処理に長時間を要す
る。一方、処理時間を重視して比較対象に使用するフォ
ント辞書を単に限定すると、認識精度が低下し、満足な
処理性能を得ることができないという問題がある。
ト辞書を文字認識の照合の比較対象とすると、指数級数
的に比較対象処理が増大するため、処理に長時間を要す
る。一方、処理時間を重視して比較対象に使用するフォ
ント辞書を単に限定すると、認識精度が低下し、満足な
処理性能を得ることができないという問題がある。
【0011】特に、コンピュータシステムのオープン化
やダウンサイジングに伴って、店舗等において印字に使
用されるフォントは今後も多種多様化が予想され、益々
問題が深刻化しつつあるため、その改善が急務となって
いる。
やダウンサイジングに伴って、店舗等において印字に使
用されるフォントは今後も多種多様化が予想され、益々
問題が深刻化しつつあるため、その改善が急務となって
いる。
【0012】本発明はこのような点に鑑みてなされたも
のであり、その目的とするところは、認識速度及び認識
精度を両立的に向上することである。
のであり、その目的とするところは、認識速度及び認識
精度を両立的に向上することである。
【0013】
【課題を解決するための手段】図1の原理構成を示すブ
ロック図を参照して説明する。本発明が適用された文字
認識装置は、種類の異なる印字フォント毎に、複数の標
準文字についての照合情報及び文字コードを含む情報が
それぞれ設定された複数のフォント辞書が予め格納され
た辞書記憶手段1と、紙面上に印刷された文字を光学的
に読み取ることにより生成された画像情報が格納された
画像記憶手段2と、画像記憶手段2に格納された画像情
報から認識対象文字を順次切り出す切出手段3と、切出
手段3により切り出された認識対象文字と前記複数のフ
ォント辞書のそれぞれの複数の標準文字とを照合する照
合手段4と、照合手段4による照合結果に基づき、前記
認識対象文字に近似する順に少なくとも1つの標準文字
を選定して認識結果とする判定手段5とを備えている。
ロック図を参照して説明する。本発明が適用された文字
認識装置は、種類の異なる印字フォント毎に、複数の標
準文字についての照合情報及び文字コードを含む情報が
それぞれ設定された複数のフォント辞書が予め格納され
た辞書記憶手段1と、紙面上に印刷された文字を光学的
に読み取ることにより生成された画像情報が格納された
画像記憶手段2と、画像記憶手段2に格納された画像情
報から認識対象文字を順次切り出す切出手段3と、切出
手段3により切り出された認識対象文字と前記複数のフ
ォント辞書のそれぞれの複数の標準文字とを照合する照
合手段4と、照合手段4による照合結果に基づき、前記
認識対象文字に近似する順に少なくとも1つの標準文字
を選定して認識結果とする判定手段5とを備えている。
【0014】さらに、切出手段3により切り出された複
数の認識対象文字についての判定手段5による認識結果
に基づき、前記紙面上に印刷された文字の印刷時に使用
されたフォントに近いと推定される少なくとも1つのフ
ォント辞書を特定する特定手段6とを備えている。
数の認識対象文字についての判定手段5による認識結果
に基づき、前記紙面上に印刷された文字の印刷時に使用
されたフォントに近いと推定される少なくとも1つのフ
ォント辞書を特定する特定手段6とを備えている。
【0015】本発明によると、辞書記憶手段1に格納さ
れた複数のフォント辞書のうち、照合手段4による照合
処理のために使用するフォント辞書を限定(少数化)す
るようにしている。そして、この限定は、複数の認識対
象文字についての判定手段5による認識結果に基づいて
(統計的に処理することにより)行うようにしたから、
限定されたフォント辞書は、認識対象文字の印刷時に使
用されたフォントに近いフォント辞書である確率が高
い。
れた複数のフォント辞書のうち、照合手段4による照合
処理のために使用するフォント辞書を限定(少数化)す
るようにしている。そして、この限定は、複数の認識対
象文字についての判定手段5による認識結果に基づいて
(統計的に処理することにより)行うようにしたから、
限定されたフォント辞書は、認識対象文字の印刷時に使
用されたフォントに近いフォント辞書である確率が高
い。
【0016】従って、照合の比較対象としてのフォント
辞書の数が少なくなるから、認識速度を非常に高速化す
ることができるとともに、限定されたフォント辞書は認
識対象文字の印刷時に使用されたフォントに近いフォン
ト辞書である確率が高いから、認識精度も高くすること
ができる。
辞書の数が少なくなるから、認識速度を非常に高速化す
ることができるとともに、限定されたフォント辞書は認
識対象文字の印刷時に使用されたフォントに近いフォン
ト辞書である確率が高いから、認識精度も高くすること
ができる。
【0017】なお、限定されたフォント辞書の数は単数
又は複数であって良く、複数の場合には、照合手段4は
照合時に特定手段6により認識対象文字の印刷時に使用
されたフォントにより近いと判断されたフォント辞書を
優先的に使用することにより、さらに処理速度を向上で
きる。
又は複数であって良く、複数の場合には、照合手段4は
照合時に特定手段6により認識対象文字の印刷時に使用
されたフォントにより近いと判断されたフォント辞書を
優先的に使用することにより、さらに処理速度を向上で
きる。
【0018】
【発明の実施の形態】以下、本発明の実施の形態を図面
を参照して詳細に説明する。図2は本発明の実施の形態
に係る文字認識装置の概略構成を示す図である。
を参照して詳細に説明する。図2は本発明の実施の形態
に係る文字認識装置の概略構成を示す図である。
【0019】同図において、11は画像メモリ(画像記
憶手段2)であり、画像メモリ11には、図示しないス
キャナ装置(画像読取装置)により複数の帳票が順次光
学的に読み取られて生成されたビットマップ形式の画像
情報12が格納される。
憶手段2)であり、画像メモリ11には、図示しないス
キャナ装置(画像読取装置)により複数の帳票が順次光
学的に読み取られて生成されたビットマップ形式の画像
情報12が格納される。
【0020】13は辞書メモリ(辞書記憶手段1)であ
り、辞書メモリ13には、照合辞書及び照合制御テーブ
ルが予め格納されている。この照合辞書は、複数の互い
に種類の異なる印字フォント毎に、複数の標準文字につ
いての照合情報(文字の特徴等)及び文字コードを含む
情報がそれぞれ設定された複数のフォント辞書(1〜
m)から構成される。
り、辞書メモリ13には、照合辞書及び照合制御テーブ
ルが予め格納されている。この照合辞書は、複数の互い
に種類の異なる印字フォント毎に、複数の標準文字につ
いての照合情報(文字の特徴等)及び文字コードを含む
情報がそれぞれ設定された複数のフォント辞書(1〜
m)から構成される。
【0021】具体的には照合辞書は、図3に示されてい
るように、複数のフォント辞書(識別番号1〜4)のそ
れぞれについて、複数の文字カテゴリ(同図では数字の
0〜9を例示している)に対応して、真のカテゴリコー
ド、固有のカテゴリコード、共有フォント辞書情報がそ
れぞれ設定されてなるデータである。なお、図3の備考
欄は、印字フォント例等を示すもので、実際のデータで
はない。
るように、複数のフォント辞書(識別番号1〜4)のそ
れぞれについて、複数の文字カテゴリ(同図では数字の
0〜9を例示している)に対応して、真のカテゴリコー
ド、固有のカテゴリコード、共有フォント辞書情報がそ
れぞれ設定されてなるデータである。なお、図3の備考
欄は、印字フォント例等を示すもので、実際のデータで
はない。
【0022】文字カテゴリは文字自体を示している。真
のカテゴリコードは文字カテゴリに対応する文字コード
(EBCDICコード等)であり、固有のカテゴリコー
ドはフォント辞書の識別を含むコードを示している。
のカテゴリコードは文字カテゴリに対応する文字コード
(EBCDICコード等)であり、固有のカテゴリコー
ドはフォント辞書の識別を含むコードを示している。
【0023】共有フォント辞書情報は、他のフォント辞
書の文字とデータを共有している場合に、そのフォント
辞書の識別番号が設定されている。例えば、フォント辞
書4において、文字カテゴリ「0」の文字はフォント辞
書2の文字カテゴリ「0」と共有、即ち同じデータであ
ることが図3の備考欄に示されている。また、該備考欄
に示されているように、同じ文字カテゴリでも、フォン
ト辞書が異なることによって、その字体も異なっている
ことが視覚的に理解されよう。
書の文字とデータを共有している場合に、そのフォント
辞書の識別番号が設定されている。例えば、フォント辞
書4において、文字カテゴリ「0」の文字はフォント辞
書2の文字カテゴリ「0」と共有、即ち同じデータであ
ることが図3の備考欄に示されている。また、該備考欄
に示されているように、同じ文字カテゴリでも、フォン
ト辞書が異なることによって、その字体も異なっている
ことが視覚的に理解されよう。
【0024】照合制御テーブルは、照合辞書に基づき、
帳票単位あるいはフィールド単位で必要に応じて作成さ
れるデータテーブルであり、図4に示されているよう
に、複数のフォント辞書(識別番号1〜m)のそれぞれ
について、複数の文字カテゴリ(同図では数字の0〜9
を例示している)に対応して、真のカテゴリコード、固
有のカテゴリコード、共有フォント辞書情報、テンプレ
ートへのポインタ、有効/無効フラグが設定されるデー
タテーブルである。
帳票単位あるいはフィールド単位で必要に応じて作成さ
れるデータテーブルであり、図4に示されているよう
に、複数のフォント辞書(識別番号1〜m)のそれぞれ
について、複数の文字カテゴリ(同図では数字の0〜9
を例示している)に対応して、真のカテゴリコード、固
有のカテゴリコード、共有フォント辞書情報、テンプレ
ートへのポインタ、有効/無効フラグが設定されるデー
タテーブルである。
【0025】文字カテゴリ、真のカテゴリコード、固有
のカテゴリコード及び共有フォント辞書情報について
は、照合辞書のそれと同じである。テンプレートへのポ
インタは、辞書メモリ13には各フォント毎の各文字カ
テゴリ毎に、該文字の特徴を抽出した比較照合用のデー
タである照合情報が格納されており、その格納アドレス
を示すポインタである。
のカテゴリコード及び共有フォント辞書情報について
は、照合辞書のそれと同じである。テンプレートへのポ
インタは、辞書メモリ13には各フォント毎の各文字カ
テゴリ毎に、該文字の特徴を抽出した比較照合用のデー
タである照合情報が格納されており、その格納アドレス
を示すポインタである。
【0026】有効/無効フラグは、各フォント辞書の各
文字カテゴリに対応して、この文字カテゴリを後述する
比較照合処理に使用するか否かが設定されるフラグであ
る。なお、図4の備考欄は、実際のデータではない。こ
の有効/無効フラグのデフォルト値としては、オペレー
タにより特別に指定されない限り、全て「有効」が設定
されている。
文字カテゴリに対応して、この文字カテゴリを後述する
比較照合処理に使用するか否かが設定されるフラグであ
る。なお、図4の備考欄は、実際のデータではない。こ
の有効/無効フラグのデフォルト値としては、オペレー
タにより特別に指定されない限り、全て「有効」が設定
されている。
【0027】この文字認識装置は、オペレータとの対話
により各種のデータの入力を行う機能を備えており、こ
れらの照合辞書のフォント辞書や照合制御テーブル等
は、オペレータが必要に応じて追加し、変更し、削除す
ることができるようになっている。
により各種のデータの入力を行う機能を備えており、こ
れらの照合辞書のフォント辞書や照合制御テーブル等
は、オペレータが必要に応じて追加し、変更し、削除す
ることができるようになっている。
【0028】再び、図2を参照する。14は文字切出部
(切出手段3)であり、文字切出部14は、メモリ15
に予め格納されている処理する帳票についてのフォーマ
ット情報に基づき、画像メモリ11に格納されているビ
ットマップ形式の画像情報の処理すべきフィールド(領
域)を特定し、該フィールドから認識対象文字を順次切
り出す。フォーマット情報は、処理する各帳票につい
て、用紙サイズ、プリンタにより印刷されるフィールド
の位置やサイズ、該帳票についてのその他の書式的な情
報であり、予めメモリ15に格納されている。
(切出手段3)であり、文字切出部14は、メモリ15
に予め格納されている処理する帳票についてのフォーマ
ット情報に基づき、画像メモリ11に格納されているビ
ットマップ形式の画像情報の処理すべきフィールド(領
域)を特定し、該フィールドから認識対象文字を順次切
り出す。フォーマット情報は、処理する各帳票につい
て、用紙サイズ、プリンタにより印刷されるフィールド
の位置やサイズ、該帳票についてのその他の書式的な情
報であり、予めメモリ15に格納されている。
【0029】文字切出部14により順次切り出されたビ
ットマップ形式の文字情報は、特徴抽出部16に送ら
れ、この特徴抽出部16により、該ビットマップ形式の
文字情報から比較対象に使用すべき特徴(線の方向や線
の密度等)が抽出される。
ットマップ形式の文字情報は、特徴抽出部16に送ら
れ、この特徴抽出部16により、該ビットマップ形式の
文字情報から比較対象に使用すべき特徴(線の方向や線
の密度等)が抽出される。
【0030】次いで、照合部(照合手段4)17は、特
徴抽出部16により抽出された特徴と、辞書メモリ13
の照合制御テーブルの複数のフォント辞書のそれぞれの
複数の文字カテゴリ(標準文字)についての特徴(テン
プレート)と比較照合し、認識対象文字と標準文字の類
似度又は相違度を導出する。
徴抽出部16により抽出された特徴と、辞書メモリ13
の照合制御テーブルの複数のフォント辞書のそれぞれの
複数の文字カテゴリ(標準文字)についての特徴(テン
プレート)と比較照合し、認識対象文字と標準文字の類
似度又は相違度を導出する。
【0031】判定部(判定手段5)18は、フォーマッ
ト情報等を参照しつつ照合部17による照合結果(類似
度又は相違度)に基づき、認識対象文字に近似する単数
又は複数の標準文字を選出し、該標準文字に対応する文
字コード(真のカテゴリコード及び固有のカテゴリコー
ド)を認識結果19として出力する。
ト情報等を参照しつつ照合部17による照合結果(類似
度又は相違度)に基づき、認識対象文字に近似する単数
又は複数の標準文字を選出し、該標準文字に対応する文
字コード(真のカテゴリコード及び固有のカテゴリコー
ド)を認識結果19として出力する。
【0032】認識結果19は、この文字認識装置の上位
装置としてのコンピュータシステムに入力され、コンピ
ュータシステムにおいて、必要な処理がなされる。一
方、認識結果19はフォント特定部(特定手段6)20
に送られる。フォント特定部20は、順次送られてくる
認識結果19を蓄積しておき、帳票単位又はフィールド
単位でこの認識結果19を統計的に処理し、帳票に印刷
された文字の印刷時に使用されたフォントに最も近いと
推定されるものから順次候補を導出し、単一又は複数の
フォント辞書を近い順に特定し、該フォント辞書の識別
番号(以下、特定識別番号)を出力する。
装置としてのコンピュータシステムに入力され、コンピ
ュータシステムにおいて、必要な処理がなされる。一
方、認識結果19はフォント特定部(特定手段6)20
に送られる。フォント特定部20は、順次送られてくる
認識結果19を蓄積しておき、帳票単位又はフィールド
単位でこの認識結果19を統計的に処理し、帳票に印刷
された文字の印刷時に使用されたフォントに最も近いと
推定されるものから順次候補を導出し、単一又は複数の
フォント辞書を近い順に特定し、該フォント辞書の識別
番号(以下、特定識別番号)を出力する。
【0033】フォント限定部(特定手段6)21は、こ
の特定識別番号に基づき、辞書メモリ13の照合制御テ
ーブルのフォント辞書のうち、照合部17が比較照合に
使用するフォント辞書として、該特定識別番号に対応す
るものに限定する処理を行う。具体的には、図4に示し
た照合制御テーブルの有効/無効フラグを、該特定識別
番号に対応するフォント辞書については「有効」とし、
該特定識別番号以外の識別番号に対応するフォント辞書
については「無効」に設定する。なお、図1に示した特
定手段6は、フォント特定部20及びフォント限定部2
1に対応している。
の特定識別番号に基づき、辞書メモリ13の照合制御テ
ーブルのフォント辞書のうち、照合部17が比較照合に
使用するフォント辞書として、該特定識別番号に対応す
るものに限定する処理を行う。具体的には、図4に示し
た照合制御テーブルの有効/無効フラグを、該特定識別
番号に対応するフォント辞書については「有効」とし、
該特定識別番号以外の識別番号に対応するフォント辞書
については「無効」に設定する。なお、図1に示した特
定手段6は、フォント特定部20及びフォント限定部2
1に対応している。
【0034】以下、図5乃至図9に示すフローチャート
に従って、本実施の形態の処理を詳細に説明する。図5
を参照する。まず、オペレータは対話処理によって、動
作環境の設定を行う(ST1)、動作環境として設定す
る事項としては、リジェクト発生頻度、フォント特定処
理をフィールド単位で行うか帳票単位で行うかの設定、
フォント特定処理に使用するサンプル数(文字数、帳票
枚数)、フォント限定処理で限定するフォント辞書の数
等の「特定するための条件」、及び帳票の識別(ID)
の有無、オペレータの介入の有無等の「運用モード」、
その他の事項である。
に従って、本実施の形態の処理を詳細に説明する。図5
を参照する。まず、オペレータは対話処理によって、動
作環境の設定を行う(ST1)、動作環境として設定す
る事項としては、リジェクト発生頻度、フォント特定処
理をフィールド単位で行うか帳票単位で行うかの設定、
フォント特定処理に使用するサンプル数(文字数、帳票
枚数)、フォント限定処理で限定するフォント辞書の数
等の「特定するための条件」、及び帳票の識別(ID)
の有無、オペレータの介入の有無等の「運用モード」、
その他の事項である。
【0035】次いで、初めての処理なので、照合制御テ
ーブルに設定されている全てのフォント辞書を照合の対
象とする(ST2)。即ち、照合制御テーブルの有効/
無効フラグを全て「有効」に設定する。
ーブルに設定されている全てのフォント辞書を照合の対
象とする(ST2)。即ち、照合制御テーブルの有効/
無効フラグを全て「有効」に設定する。
【0036】その後、帳票の読み取りをスキャナー装置
に指示し、読み取った結果としてのビットマップ形式の
画像情報12を受け取り、画像メモリ11に格納し、文
字認識処理を行う(ST3)。次いで、フォントの特定
は全て終了したか否かを判断し(ST4)、完了してい
ない場合(NOの場合)には、フォントの特定が帳票単
位か否かを判断する(ST5)。
に指示し、読み取った結果としてのビットマップ形式の
画像情報12を受け取り、画像メモリ11に格納し、文
字認識処理を行う(ST3)。次いで、フォントの特定
は全て終了したか否かを判断し(ST4)、完了してい
ない場合(NOの場合)には、フォントの特定が帳票単
位か否かを判断する(ST5)。
【0037】ST5において、フォントの特定が帳票単
位である場合(YESである場合)には、フォント特定
処理に必要なサンプル数が確保できたか否かを判断し
(ST6)、フォント特定処理に必要なサンプル数が確
保できていないと判断した場合(NOの場合)にはST
3に戻り、フォント特定処理に必要なサンプル数が確保
できていると判断した場合(YESの場合)には、ST
7において、図8に示すフォント特定処理(帳票単位)
を行う。フォント特定処理については後述する。
位である場合(YESである場合)には、フォント特定
処理に必要なサンプル数が確保できたか否かを判断し
(ST6)、フォント特定処理に必要なサンプル数が確
保できていないと判断した場合(NOの場合)にはST
3に戻り、フォント特定処理に必要なサンプル数が確保
できていると判断した場合(YESの場合)には、ST
7において、図8に示すフォント特定処理(帳票単位)
を行う。フォント特定処理については後述する。
【0038】次いで、フォントの特定に成功したか否か
を判断し(ST8)、フォントの特定に成功したと判断
した場合(YESの場合)には、ST9において、図9
に示すフォント限定処理(帳票単位)を行い、ST3に
戻る。フォント限定処理については後述する。
を判断し(ST8)、フォントの特定に成功したと判断
した場合(YESの場合)には、ST9において、図9
に示すフォント限定処理(帳票単位)を行い、ST3に
戻る。フォント限定処理については後述する。
【0039】ST8において、フォントの特定に失敗し
たと判断した場合(NOの場合)には、ST1で指定さ
れた所定枚数の帳票の読み取りが終了したか否かを判断
し(ST10)、所定枚数の読み取りが終了していない
と判断した場合(NOの場合)にはST3に戻り、所定
枚数の読み取りが終了していると判断した場合(YES
の場合)には、その後の処理等のため、ディスプレイ表
示等によりオペレータの介入を促す(ST11)。
たと判断した場合(NOの場合)には、ST1で指定さ
れた所定枚数の帳票の読み取りが終了したか否かを判断
し(ST10)、所定枚数の読み取りが終了していない
と判断した場合(NOの場合)にはST3に戻り、所定
枚数の読み取りが終了していると判断した場合(YES
の場合)には、その後の処理等のため、ディスプレイ表
示等によりオペレータの介入を促す(ST11)。
【0040】ST5において、フォントの特定がフィー
ルド単位であると判断した場合(NOの場合)には、図
6のST12に進む。ST12において、フォントの特
定が完了していないフィールドか否かを判断し、フォン
トの特定が完了しているフィールドであると判断した場
合(NOの場合)にはST17に進む。
ルド単位であると判断した場合(NOの場合)には、図
6のST12に進む。ST12において、フォントの特
定が完了していないフィールドか否かを判断し、フォン
トの特定が完了しているフィールドであると判断した場
合(NOの場合)にはST17に進む。
【0041】ST12において、フォントの特定が完了
していないフィールドであると判断した場合(YESの
場合)には、フォント特定処理に必要なサンプル数が確
保できたか否かを判断し(ST13)、フォント特定処
理に必要なサンプル数が確保できていないと判断した場
合(NOの場合)にはST17に進み、フォント特定処
理に必要なサンプル数が確保できていると判断した場合
(YESの場合)には、ST14において、図8に示す
フォント特定処理(フィールド単位)を行う。フォント
特定処理については後述する。
していないフィールドであると判断した場合(YESの
場合)には、フォント特定処理に必要なサンプル数が確
保できたか否かを判断し(ST13)、フォント特定処
理に必要なサンプル数が確保できていないと判断した場
合(NOの場合)にはST17に進み、フォント特定処
理に必要なサンプル数が確保できていると判断した場合
(YESの場合)には、ST14において、図8に示す
フォント特定処理(フィールド単位)を行う。フォント
特定処理については後述する。
【0042】次いで、フォントの特定に成功したか否か
を判断し(ST15)、フォントの特定に成功したと判
断した場合(YESの場合)には、ST16において、
図9に示すフォント限定処理(フィールド単位)を行
い、ST17に進む。フォント限定処理については後述
する。
を判断し(ST15)、フォントの特定に成功したと判
断した場合(YESの場合)には、ST16において、
図9に示すフォント限定処理(フィールド単位)を行
い、ST17に進む。フォント限定処理については後述
する。
【0043】ST15において、フォントの特定に失敗
したと判断した場合(NOの場合)には、ST1で指定
された所定枚数の帳票の読み取りが終了したか否かを判
断し(ST18)、所定枚数の読み取りが終了していな
いと判断した場合(NOの場合)にはST17に進み、
所定枚数の読み取りが終了していると判断した場合(Y
ESの場合)には、その後の処理等のため、ディスプレ
イ表示等によりオペレータの介入を促す(ST19)。
したと判断した場合(NOの場合)には、ST1で指定
された所定枚数の帳票の読み取りが終了したか否かを判
断し(ST18)、所定枚数の読み取りが終了していな
いと判断した場合(NOの場合)にはST17に進み、
所定枚数の読み取りが終了していると判断した場合(Y
ESの場合)には、その後の処理等のため、ディスプレ
イ表示等によりオペレータの介入を促す(ST19)。
【0044】ST17において、全てのフィールドにつ
いて処理が終了したか否かを判断し、全てのフィールド
について処理が終了していないと判断した場合(NOの
場合)にはST12に戻り、全てのフィールドについて
処理が終了していると判断した場合(YESの場合)に
は、次ぎの帳票について処理すべく、図5のST3に戻
る。
いて処理が終了したか否かを判断し、全てのフィールド
について処理が終了していないと判断した場合(NOの
場合)にはST12に戻り、全てのフィールドについて
処理が終了していると判断した場合(YESの場合)に
は、次ぎの帳票について処理すべく、図5のST3に戻
る。
【0045】図5のST4において、フォントの特定は
全て完了していると判断した場合(YESの場合)に
は、図7のST20に進む。ST20において、リジェ
クトがST1において入力された所定のリジェクト発生
頻度よりも多く発生しているか否かを判断し、リジェク
トが多く発生している場合(YESの場合)には、リジ
ェクトの発生原因を調査及び分析し(ST21)、次い
で、照合対象としているフォント辞書以外のフォント辞
書で認識可能か否かを判断する(ST22)。
全て完了していると判断した場合(YESの場合)に
は、図7のST20に進む。ST20において、リジェ
クトがST1において入力された所定のリジェクト発生
頻度よりも多く発生しているか否かを判断し、リジェク
トが多く発生している場合(YESの場合)には、リジ
ェクトの発生原因を調査及び分析し(ST21)、次い
で、照合対象としているフォント辞書以外のフォント辞
書で認識可能か否かを判断する(ST22)。
【0046】ST22において、照合対象としているフ
ォント辞書以外のフォント辞書で認識可能と判断した場
合(YESの場合)には、フォントの特定が帳票単位で
あるか否かを判断し(ST23)、帳票単位である場合
(YESである場合)には、ST24において、該認識
可能と判断したフォント辞書に限定するため、図9に示
すフォント限定処理(帳票単位)を行い、ST26に進
む。フォント限定処理については後述する。
ォント辞書以外のフォント辞書で認識可能と判断した場
合(YESの場合)には、フォントの特定が帳票単位で
あるか否かを判断し(ST23)、帳票単位である場合
(YESである場合)には、ST24において、該認識
可能と判断したフォント辞書に限定するため、図9に示
すフォント限定処理(帳票単位)を行い、ST26に進
む。フォント限定処理については後述する。
【0047】ST23において、フォントの特定がフィ
ールド単位であると判断した場合(NOの場合)には、
ST25において、該認識可能と判断したフォント辞書
に限定するため、図9に示すフォント限定処理(フィー
ルド単位)を行い、ST26に進む。フォント限定処理
については後述する。
ールド単位であると判断した場合(NOの場合)には、
ST25において、該認識可能と判断したフォント辞書
に限定するため、図9に示すフォント限定処理(フィー
ルド単位)を行い、ST26に進む。フォント限定処理
については後述する。
【0048】ST26において、当該帳票の再読み取り
を行った後に、次ぎの帳票について処理すべく、図5の
ST3に戻る。ST22において、照合対象としている
フォント辞書以外のフォント辞書で認識可能でないと判
断した場合(NOの場合)にはST27に進み、その後
の処理等のため、ディスプレイ表示等によりオペレータ
の介入を促す。
を行った後に、次ぎの帳票について処理すべく、図5の
ST3に戻る。ST22において、照合対象としている
フォント辞書以外のフォント辞書で認識可能でないと判
断した場合(NOの場合)にはST27に進み、その後
の処理等のため、ディスプレイ表示等によりオペレータ
の介入を促す。
【0049】ST20において、リジェクトがST1に
おいて入力された所定のリジェクト発生頻度よりも多く
発生していないと判断した場合(NOの場合)には、次
ぎの帳票について処理すべく、図5のST3に戻る。
おいて入力された所定のリジェクト発生頻度よりも多く
発生していないと判断した場合(NOの場合)には、次
ぎの帳票について処理すべく、図5のST3に戻る。
【0050】図8はフォント特定部20により実行され
るフォント特定処理を示すフローチャートである。同図
において、まず、認識結果(候補1位)及び認識候補
(候補2位〜)に対する固有のカテゴリコードから、各
フォント辞書の出現頻度を帳票単位またはフィールド単
位で集計し、フォント辞書出現頻度テーブル(後に詳述
する)を作成する(ST31)。
るフォント特定処理を示すフローチャートである。同図
において、まず、認識結果(候補1位)及び認識候補
(候補2位〜)に対する固有のカテゴリコードから、各
フォント辞書の出現頻度を帳票単位またはフィールド単
位で集計し、フォント辞書出現頻度テーブル(後に詳述
する)を作成する(ST31)。
【0051】次いで、フォント辞書出現頻度テーブルか
ら、認識結果(候補1位)として出現した複数のフォン
ト辞書を、帳票単位またはフィールド単位で特定し(S
T32)、全ての帳票またはフィールドでフォント辞書
の特定が成功したか否かを判断する(ST33)。
ら、認識結果(候補1位)として出現した複数のフォン
ト辞書を、帳票単位またはフィールド単位で特定し(S
T32)、全ての帳票またはフィールドでフォント辞書
の特定が成功したか否かを判断する(ST33)。
【0052】ST33において、全ての帳票またはフィ
ールドでフォント辞書の特定が成功したと判断した場合
(YESの場合)には、ST35に進む。ST33にお
いて、全ての帳票またはフィールドでフォント辞書の特
定が成功しなかったと判断した場合(NOの場合)に
は、特定不能な各ケースについての認識候補(候補2
位、必要ならば候補3位以降も考慮する)のフォント辞
書出現頻度テーブルやフォント辞書の共有化情報(共有
フォント辞書情報)等を参照し、字形の類似性をみるこ
とにより、いずれのフォント辞書に属するかを特定し
(ST34)、ST35に進む。
ールドでフォント辞書の特定が成功したと判断した場合
(YESの場合)には、ST35に進む。ST33にお
いて、全ての帳票またはフィールドでフォント辞書の特
定が成功しなかったと判断した場合(NOの場合)に
は、特定不能な各ケースについての認識候補(候補2
位、必要ならば候補3位以降も考慮する)のフォント辞
書出現頻度テーブルやフォント辞書の共有化情報(共有
フォント辞書情報)等を参照し、字形の類似性をみるこ
とにより、いずれのフォント辞書に属するかを特定し
(ST34)、ST35に進む。
【0053】ST35において、帳票単位またはフィー
ルド単位で特定したフォント辞書を、その出現頻度順に
ソーティングし、フォント特定の条件(ST1において
入力された特定すべきフォント辞書の数等)から勘案し
て、複数のフォント辞書を優先順位の高い順に、帳票単
位またはフィールド単位に選定して(ST36)、この
処理を終了する。
ルド単位で特定したフォント辞書を、その出現頻度順に
ソーティングし、フォント特定の条件(ST1において
入力された特定すべきフォント辞書の数等)から勘案し
て、複数のフォント辞書を優先順位の高い順に、帳票単
位またはフィールド単位に選定して(ST36)、この
処理を終了する。
【0054】図9はフォント限定部21により実行され
るフォント限定処理を示すフローチャートである。この
フォント限定処理は、認識対象として特定された複数の
フォント辞書を、帳票単位またはフィールド単位の照合
制御テーブルの有効/無効フラグに反映させる処理であ
り(ST41)、全てのフォント辞書のうち照合に使用
しないフォント辞書についての照合制御テーブルの有効
/無効フラグを「無効」に設定し、全てのフォント辞書
のうち照合に使用するフォント辞書についての照合制御
テーブルの有効/無効フラグを「有効」に設定する。
るフォント限定処理を示すフローチャートである。この
フォント限定処理は、認識対象として特定された複数の
フォント辞書を、帳票単位またはフィールド単位の照合
制御テーブルの有効/無効フラグに反映させる処理であ
り(ST41)、全てのフォント辞書のうち照合に使用
しないフォント辞書についての照合制御テーブルの有効
/無効フラグを「無効」に設定し、全てのフォント辞書
のうち照合に使用するフォント辞書についての照合制御
テーブルの有効/無効フラグを「有効」に設定する。
【0055】以下、フォント特定処理(帳票単位)を具
体的に数値を例示して詳細に説明する。図10は1枚の
帳票について活字数字5文字が印字された合計9枚の帳
票を、処理した場合の認識結果(認識候補を含む)の一
例を示している。選定するフォント辞書の数は、この実
施の形態では2種類とする。
体的に数値を例示して詳細に説明する。図10は1枚の
帳票について活字数字5文字が印字された合計9枚の帳
票を、処理した場合の認識結果(認識候補を含む)の一
例を示している。選定するフォント辞書の数は、この実
施の形態では2種類とする。
【0056】図10において、左から「帳票」の欄は各
帳票(1枚目〜9枚目)が示されている。同欄の括弧書
きは、実際に印字に使用されているフォント辞書の識別
を示している。「印字文字」の欄は帳票に実際に印字さ
れた5文字が示されている。「認識結果」の欄は判定部
18による判定の結果、最も類似すると判定された文字
と文字カテゴリが、「認識候補」の欄には類似性が近い
順に2位〜4位までの文字と文字カテゴリが示されてい
る。
帳票(1枚目〜9枚目)が示されている。同欄の括弧書
きは、実際に印字に使用されているフォント辞書の識別
を示している。「印字文字」の欄は帳票に実際に印字さ
れた5文字が示されている。「認識結果」の欄は判定部
18による判定の結果、最も類似すると判定された文字
と文字カテゴリが、「認識候補」の欄には類似性が近い
順に2位〜4位までの文字と文字カテゴリが示されてい
る。
【0057】図11は帳票単位のフォント辞書出現頻度
テーブルの一例を示しており、図10の認識結果(認識
候補を含む)に基づいて、処理した結果を示している。
同図において、認識結果(候補1位)から次ぎのように
判断できる。 (a)フォント1と特定できる帳票は4枚→1、4、
7、9枚目 (b)フォント2と特定できる帳票は3枚→2、5、8
枚目 (c)フォント1なのかフォント4なのか特定しかねる
帳票→3、6枚目 特定不能な(c)については、認識候補(候補2位、必
要ならば候補3位以降も考慮する)のフォント辞書出現
頻度テーブルやフォント辞書の共有化情報等を参照し、
字形の類似性をみることにより、いずれのフォント辞書
に属するかを判断する。つまり、図11からフォント1
とフォント4は互いに字形がよく類似している(一方が
候補1位なら他方が候補2位になっていることが多い)
と判断できるため、帳票3枚目はフォント1、帳票6枚
目はフォント4と特定する。
テーブルの一例を示しており、図10の認識結果(認識
候補を含む)に基づいて、処理した結果を示している。
同図において、認識結果(候補1位)から次ぎのように
判断できる。 (a)フォント1と特定できる帳票は4枚→1、4、
7、9枚目 (b)フォント2と特定できる帳票は3枚→2、5、8
枚目 (c)フォント1なのかフォント4なのか特定しかねる
帳票→3、6枚目 特定不能な(c)については、認識候補(候補2位、必
要ならば候補3位以降も考慮する)のフォント辞書出現
頻度テーブルやフォント辞書の共有化情報等を参照し、
字形の類似性をみることにより、いずれのフォント辞書
に属するかを判断する。つまり、図11からフォント1
とフォント4は互いに字形がよく類似している(一方が
候補1位なら他方が候補2位になっていることが多い)
と判断できるため、帳票3枚目はフォント1、帳票6枚
目はフォント4と特定する。
【0058】なお、上記のような処理によっても特定不
能な場合には、図12に示すような文字カテゴリ単位で
のフォント辞書出現頻度テーブルを作成し、あるいはこ
れを帳票単位かつカテゴリ単位の情報までに細分化した
ものを作成して、これらに基づき、フォント辞書を特定
するようにできる。
能な場合には、図12に示すような文字カテゴリ単位で
のフォント辞書出現頻度テーブルを作成し、あるいはこ
れを帳票単位かつカテゴリ単位の情報までに細分化した
ものを作成して、これらに基づき、フォント辞書を特定
するようにできる。
【0059】以上の結果、帳票単位のフォント辞書を以
下のように特定する。 ・フォント1と特定できる帳票は全部で5枚→1、3、
4、7、9枚目 ・フォント2と特定できる帳票は全部で3枚→2、5、
8枚目 ・フォント4と特定できる帳票は全部で1枚→6枚目 特定すべきフォントの数としては、この実施の形態では
2種類としているため、出現頻度の高い順にフォント1
とフォント2を選定することになる。
下のように特定する。 ・フォント1と特定できる帳票は全部で5枚→1、3、
4、7、9枚目 ・フォント2と特定できる帳票は全部で3枚→2、5、
8枚目 ・フォント4と特定できる帳票は全部で1枚→6枚目 特定すべきフォントの数としては、この実施の形態では
2種類としているため、出現頻度の高い順にフォント1
とフォント2を選定することになる。
【0060】なお、図11及び図12において、「x
x」に対応する欄は、フォント辞書の識別番号(01〜
04)を示している。このように上述した本発明の実施
の形態によると、複数種類の印字フォントを用いて印刷
された複数の帳票を処理する場合に、高精度で且つ高効
率的な文字認識が実現できるため、リジェクトや誤読が
大幅に低減することによる、データ入力/修正に要する
オペレータの負担を大幅に軽減することができる。
x」に対応する欄は、フォント辞書の識別番号(01〜
04)を示している。このように上述した本発明の実施
の形態によると、複数種類の印字フォントを用いて印刷
された複数の帳票を処理する場合に、高精度で且つ高効
率的な文字認識が実現できるため、リジェクトや誤読が
大幅に低減することによる、データ入力/修正に要する
オペレータの負担を大幅に軽減することができる。
【0061】なお、これまでに無い印字フォントが新た
に出現した場合には、これに対応するフォント辞書を照
合辞書内に追加的に登録することができるようになって
おり、このため、今後益々進展すると予想される印字フ
ォントの多様化に柔軟に対応することができる。
に出現した場合には、これに対応するフォント辞書を照
合辞書内に追加的に登録することができるようになって
おり、このため、今後益々進展すると予想される印字フ
ォントの多様化に柔軟に対応することができる。
【0062】
【発明の効果】請求項1に記載の本発明の文字認識装置
によると、複数の文字の認識結果に基づき、複数のフォ
ント辞書のうち、照合処理に使用するフォント辞書を限
定(少数化)するようにしたことから、限定されたフォ
ント辞書は、認識対象文字の印刷時に使用されたフォン
トに近いフォント辞書である確率が高く、認識速度の高
速化、処理の高効率化を実現できるとともに、認識精度
も高くすることができるという効果がある。
によると、複数の文字の認識結果に基づき、複数のフォ
ント辞書のうち、照合処理に使用するフォント辞書を限
定(少数化)するようにしたことから、限定されたフォ
ント辞書は、認識対象文字の印刷時に使用されたフォン
トに近いフォント辞書である確率が高く、認識速度の高
速化、処理の高効率化を実現できるとともに、認識精度
も高くすることができるという効果がある。
【0063】請求項2に記載の本発明の文字認識装置に
よると、請求項1についての前記効果に加えて、実際の
運用時において、処理する紙面のフォーマットの種類や
連続処理する同一フォーマットの紙面の枚数の傾向等に
応じて最適化を図ることができ、文字の認識精度をさら
に高めることができるという効果がある。
よると、請求項1についての前記効果に加えて、実際の
運用時において、処理する紙面のフォーマットの種類や
連続処理する同一フォーマットの紙面の枚数の傾向等に
応じて最適化を図ることができ、文字の認識精度をさら
に高めることができるという効果がある。
【0064】請求項3に記載の本発明の文字認識装置に
よると、請求項1についての前記効果に加えて、印刷時
に使用されたフォントにより近いと推定されるフォント
辞書が優先的に使用されるから、さらに認識速度の高速
化、処理の高効率化を図ることができるという効果があ
る。
よると、請求項1についての前記効果に加えて、印刷時
に使用されたフォントにより近いと推定されるフォント
辞書が優先的に使用されるから、さらに認識速度の高速
化、処理の高効率化を図ることができるという効果があ
る。
【0065】請求項4に記載の本発明の文字認識装置に
よると、請求項1についての前記効果に加えて、特定し
たフォント辞書が実際には印刷時に使用されたフォント
に近くなかった場合に、次に近いと推定されるフォント
辞書にすみやかに変更されるから、フォント辞書の特定
が適正でなかった場合であっても処理効率の低下を最小
限にとどめることができるという効果がある。
よると、請求項1についての前記効果に加えて、特定し
たフォント辞書が実際には印刷時に使用されたフォント
に近くなかった場合に、次に近いと推定されるフォント
辞書にすみやかに変更されるから、フォント辞書の特定
が適正でなかった場合であっても処理効率の低下を最小
限にとどめることができるという効果がある。
【図1】本発明の原理構成を示すブロック図である。
【図2】本発明の実施の形態の全体構成を示すブロック
図である。
図である。
【図3】本発明の実施の形態の照合辞書の構成例を示す
図である。
図である。
【図4】本発明の実施の形態の照合制御テーブルの構成
例を示す図である。
例を示す図である。
【図5】本発明の実施の形態のメイン処理を示すフロー
チャート(その1)である。
チャート(その1)である。
【図6】本発明の実施の形態のメイン処理を示すフロー
チャート(その2)である。
チャート(その2)である。
【図7】本発明の実施の形態のメイン処理を示すフロー
チャート(その3)である。
チャート(その3)である。
【図8】本発明の実施の形態のフォント特定処理を示す
フローチャートである。
フローチャートである。
【図9】本発明の実施の形態のフォント限定処理を示す
フローチャートである。
フローチャートである。
【図10】本発明の実施の形態の認識結果の一例を示す
図である。
図である。
【図11】本発明の実施の形態の帳票単位のフォント辞
書出現頻度テーブルの一例を示す図である。
書出現頻度テーブルの一例を示す図である。
【図12】本発明の実施の形態の文字カテゴリ単位のフ
ォント辞書出現頻度テーブルの一例を示す図である。
ォント辞書出現頻度テーブルの一例を示す図である。
1 辞書記憶手段 2 画像記憶手段 3 切出手段 4 照合手段 5 判定手段 6 特定手段 7 限定手段
Claims (5)
- 【請求項1】 種類の異なる印字フォント毎に、複数の
標準文字についての照合情報及び文字コードを含む情報
がそれぞれ設定された複数のフォント辞書から構成され
る照合辞書手段と、 紙面上に印刷された文字を光学的に読み取ることにより
生成された認識対象文字を順次切り出す切出手段と、 前記切出手段により切り出された認識対象文字と前記複
数のフォント辞書のそれぞれの複数の標準文字とを照合
する照合手段と、 前記照合手段による照合結果に基づき、前記認識対象文
字に近似する順に少なくとも1つの標準文字を選定して
認識結果とする判定手段と、 前記判定手段による認識結果に基づき、前記紙面上に印
刷された文字の印刷時に使用されたフォントに近いと推
定される少なくとも1つのフォント辞書を特定する特定
手段と、 を備えた文字認識装置。 - 【請求項2】 請求項1に記載の文字認識装置におい
て、 前記特定手段は、入力指定された所定字数の認識対象文
字についてあるいは入力指定された所定枚数の前記紙面
上に印刷された認識対象文字についての前記判定手段に
よる認識結果に基づき、前記フォント辞書を特定するよ
うにした文字認識装置。 - 【請求項3】 請求項1に記載の文字認識装置におい
て、 前記特定手段により特定されたフォント辞書が複数であ
る場合には、前記照合手段は、前記紙面上に印刷された
文字の印刷時に使用されたフォントにより近いと推定さ
れるフォント辞書を優先的に使用するようにした文字認
識装置。 - 【請求項4】 請求項1に記載の文字認識装置におい
て、 前記特定手段によりフォント辞書を特定した結果、前記
判定手段が前記認識対象文字に近似する標準文字を選定
できない事態が発生した場合には、前記特定手段は、前
記照合手段が照合に使用しているフォント辞書の次ぎ
に、前記紙面上に印刷された文字の印刷時に使用された
フォントに近いと推定される他の少なくとも1つのフォ
ント辞書を特定するようにした文字認識装置。 - 【請求項5】 複数の互いに種類の異なる印字フォント
毎に、複数の標準文字についての照合情報及び文字コー
ドを含む情報がそれぞれ設定された複数のフォント辞書
から構成される照合辞書手段と、 紙面上に印刷された文字を光学的に読み取ることにより
生成されたビットマップ形式の画像情報から認識対象文
字を順次切り出す切出手段と、 前記切出手段により切り出された認識対象文字と前記複
数のフォント辞書のそれぞれの複数の標準文字とを照合
する照合手段と、 前記照合手段による照合結果に基づき、前記認識対象文
字に近似する順に少なくとも1つの標準文字を選定して
認識結果とする判定手段と、 前記切出手段により切り出された複数の認識対象文字に
ついての前記判定手段による認識結果に基づき、前記紙
面上に印刷された文字の印刷時に使用されたフォントに
近いと推定される少なくとも1つのフォント辞書を特定
する特定手段と、 を有する文字認識プログラムを記憶した記憶媒体。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP9346031A JPH10261048A (ja) | 1997-01-14 | 1997-12-16 | 文字認識装置及び文字認識プログラムを記憶した記憶媒体 |
Applications Claiming Priority (3)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP457497 | 1997-01-14 | ||
| JP9-4574 | 1997-01-14 | ||
| JP9346031A JPH10261048A (ja) | 1997-01-14 | 1997-12-16 | 文字認識装置及び文字認識プログラムを記憶した記憶媒体 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH10261048A true JPH10261048A (ja) | 1998-09-29 |
Family
ID=26338382
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP9346031A Withdrawn JPH10261048A (ja) | 1997-01-14 | 1997-12-16 | 文字認識装置及び文字認識プログラムを記憶した記憶媒体 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH10261048A (ja) |
Cited By (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2020009052A (ja) * | 2018-07-05 | 2020-01-16 | サンネット株式会社 | 画像データテキストデータ変換システム |
| US10817759B2 (en) | 2018-02-26 | 2020-10-27 | Kyocera Document Solutions, Inc. | Image processing apparatus |
| CN115298707A (zh) * | 2020-03-24 | 2022-11-04 | 株式会社东芝 | 信息处理装置、信息处理方法、程序及顺序信息 |
-
1997
- 1997-12-16 JP JP9346031A patent/JPH10261048A/ja not_active Withdrawn
Cited By (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US10817759B2 (en) | 2018-02-26 | 2020-10-27 | Kyocera Document Solutions, Inc. | Image processing apparatus |
| JP2020009052A (ja) * | 2018-07-05 | 2020-01-16 | サンネット株式会社 | 画像データテキストデータ変換システム |
| CN115298707A (zh) * | 2020-03-24 | 2022-11-04 | 株式会社东芝 | 信息处理装置、信息处理方法、程序及顺序信息 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JPH0772906B2 (ja) | 文書認識装置 | |
| US6035062A (en) | Character recognition method and apparatus | |
| US7133556B1 (en) | Character recognition device and method for detecting erroneously read characters, and computer readable medium to implement character recognition | |
| JP2002063197A (ja) | 検索装置、記録媒体およびプログラム | |
| JP3985926B2 (ja) | 文字認識方法、文字認識装置、文書画像処理システム及び記録媒体 | |
| JPH06103402A (ja) | 名刺認識装置 | |
| JPH09179935A (ja) | 文字認識装置およびその制御方法 | |
| JPH08241314A (ja) | 文書ファイリングシステム | |
| JP3788703B2 (ja) | 投票用紙計数仕分け装置および投票用紙計数仕分け装置のプリセット装置およびその方法並びに投票用紙計数仕分け装置のプリセットプログラムを記録した媒体 | |
| JPH0589279A (ja) | 文字認識装置 | |
| JP2574776B2 (ja) | 文字認識方法 | |
| JP2003099709A (ja) | 誤読文字修正方法及び光学的文字認識装置 | |
| JP2931485B2 (ja) | 文字切出し装置及び方法 | |
| JPH11120294A (ja) | 文字認識装置および媒体 | |
| US11128775B2 (en) | Meta information transmission system through printed matter, printing control apparatus, printed matter reading apparatus, method for applying meta information for printed matter, and method for acquiring meta information from printed matter | |
| JPS5975377A (ja) | 文字選択方式 | |
| JP3251704B2 (ja) | 認識処理装置 | |
| JPH0682400B2 (ja) | 文字認識装置 | |
| JPH06236454A (ja) | 文字認識装置 | |
| JP2000137764A (ja) | プリンタ | |
| JPH1021327A (ja) | オンライン手書き文字入力装置及び認識候補通知方法 | |
| JP2002245408A (ja) | 文字列認識装置およびその方法並びにコンピュータプログラム | |
| JPH07282198A (ja) | 活字文字認識装置 | |
| JPH0514953B2 (ja) | ||
| JPH07200737A (ja) | 文字認識方法およびシステム |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| A300 | Application deemed to be withdrawn because no request for examination was validly filed |
Free format text: JAPANESE INTERMEDIATE CODE: A300 Effective date: 20050301 |