JPH08263588A - 文字認識装置 - Google Patents
文字認識装置Info
- Publication number
- JPH08263588A JPH08263588A JP7069251A JP6925195A JPH08263588A JP H08263588 A JPH08263588 A JP H08263588A JP 7069251 A JP7069251 A JP 7069251A JP 6925195 A JP6925195 A JP 6925195A JP H08263588 A JPH08263588 A JP H08263588A
- Authority
- JP
- Japan
- Prior art keywords
- character
- area
- coordinates
- recognition
- unit
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
- 238000001514 detection method Methods 0.000 claims abstract description 31
- 238000013500 data storage Methods 0.000 claims abstract description 19
- 238000010586 diagram Methods 0.000 description 16
- 238000000034 method Methods 0.000 description 16
- 238000004364 calculation method Methods 0.000 description 4
- 239000003607 modifier Substances 0.000 description 4
- 239000000284 extract Substances 0.000 description 2
- 230000003247 decreasing effect Effects 0.000 description 1
- 230000000694 effects Effects 0.000 description 1
- 238000000605 extraction Methods 0.000 description 1
Landscapes
- Character Input (AREA)
Abstract
(57)【要約】
【目的】 高速に適正な認識対象領域を設定することの
できる文字認識装置を提供する。 【構成】 画像データ記憶部1に画像データが記憶され
ると、文字行検出部2は行間を検出し、行位置座標を求
めて文字座標記憶部4に格納する。また、文字切り出し
部3が各行ごとに1文字ずつ切り出して文字位置座標を
求め、文字座標記憶部4に格納する。オペレータが領域
指定部5から認識対象領域の指定を行なうと、認識領域
決定部6は文字座標記憶部4に格納されている座標デー
タの中で、指定された座標に最も近い座標を算出し、認
識領域記憶部7に格納する。領域表示手段8は、認識領
域記憶部7に格納された認識対象領域の座標から領域枠
を生成し、表示部9に画像データと重ねてリアルタイム
で表示させる。また、認識部10は、設定された最終的
な認識対象領域内の文字を認識する。
できる文字認識装置を提供する。 【構成】 画像データ記憶部1に画像データが記憶され
ると、文字行検出部2は行間を検出し、行位置座標を求
めて文字座標記憶部4に格納する。また、文字切り出し
部3が各行ごとに1文字ずつ切り出して文字位置座標を
求め、文字座標記憶部4に格納する。オペレータが領域
指定部5から認識対象領域の指定を行なうと、認識領域
決定部6は文字座標記憶部4に格納されている座標デー
タの中で、指定された座標に最も近い座標を算出し、認
識領域記憶部7に格納する。領域表示手段8は、認識領
域記憶部7に格納された認識対象領域の座標から領域枠
を生成し、表示部9に画像データと重ねてリアルタイム
で表示させる。また、認識部10は、設定された最終的
な認識対象領域内の文字を認識する。
Description
【0001】
【産業上の利用分野】本発明は、文字認識装置に関する
ものであり、特に、ビットマップ画像のうち、オペレー
タの指示に基づいて設定される画像領域内の文字画像を
認識する文字認識装置に関するものである。
ものであり、特に、ビットマップ画像のうち、オペレー
タの指示に基づいて設定される画像領域内の文字画像を
認識する文字認識装置に関するものである。
【0002】
【従来の技術】ビットマップ画像からオペレータが指示
した画像領域内の文字画像を認識する従来の文字認識装
置としては、例えば、特開平4−5779号公報や特開
平5−342620号公報に記載されている技術などが
ある。特開平4−5779号公報に記載された技術で
は、オペレータが入力部により認識対象領域を指定した
とき、その領域内の文字が欠けている場合、境界特徴抽
出部でこれを抽出し、領域変更部で認識対象領域を変更
していた。この認識対象領域の変更の際には、文字が欠
ける辺に平行ないくつかの境界候補線を設定し、各境界
候補線ごとにその境界候補線上の黒画素を計数し、文字
が欠けない境界候補線のうちでもとの辺に最も近いもの
を選択する。このような方法では、オペレータによって
認識対象領域の指定を受けてから画像データをアクセス
することになり、時間がかかる。また、境界候補線の中
に文字が欠けないような候補が存在しない場合について
は、認識対象領域を設定することができないという問題
もあった。
した画像領域内の文字画像を認識する従来の文字認識装
置としては、例えば、特開平4−5779号公報や特開
平5−342620号公報に記載されている技術などが
ある。特開平4−5779号公報に記載された技術で
は、オペレータが入力部により認識対象領域を指定した
とき、その領域内の文字が欠けている場合、境界特徴抽
出部でこれを抽出し、領域変更部で認識対象領域を変更
していた。この認識対象領域の変更の際には、文字が欠
ける辺に平行ないくつかの境界候補線を設定し、各境界
候補線ごとにその境界候補線上の黒画素を計数し、文字
が欠けない境界候補線のうちでもとの辺に最も近いもの
を選択する。このような方法では、オペレータによって
認識対象領域の指定を受けてから画像データをアクセス
することになり、時間がかかる。また、境界候補線の中
に文字が欠けないような候補が存在しない場合について
は、認識対象領域を設定することができないという問題
もあった。
【0003】また、特開平5−342320号公報に記
載されている技術では、オペレータは認識対象領域の1
点を指定し、指定によって表示される枠をオペレータが
変更して、所望の認識対象領域を設定する。この技術で
は、オペレータが枠表示の状態を確認しながら、文字に
枠がかからないように注意しながら、枠の大きさを変更
する必要があり、オペレータに過大な負担を負わせてい
た。
載されている技術では、オペレータは認識対象領域の1
点を指定し、指定によって表示される枠をオペレータが
変更して、所望の認識対象領域を設定する。この技術で
は、オペレータが枠表示の状態を確認しながら、文字に
枠がかからないように注意しながら、枠の大きさを変更
する必要があり、オペレータに過大な負担を負わせてい
た。
【0004】
【発明が解決しようとする課題】本発明は、上述のよう
な問題に鑑みてなされたものであり、オペレータが認識
対象領域を指示する際に、高速に適正な認識対象領域を
設定することのできる文字認識装置を提供することを目
的とするものである。
な問題に鑑みてなされたものであり、オペレータが認識
対象領域を指示する際に、高速に適正な認識対象領域を
設定することのできる文字認識装置を提供することを目
的とするものである。
【0005】
【課題を解決するための手段】本発明は、オペレータの
指示に基づいて設定される画像領域内の文字画像を認識
する文字認識装置において、文字認識の対象となりうる
画像データを記憶する画像記憶手段と、該画像記憶手段
に記憶されている画像データ中の行および1文字あるい
は文字の構成部品ごとの座標に関する座標データを検出
する座標データ検出手段と、前記座標データ検出手段に
より検出された前記座標データを記憶する座標データ記
憶手段と、オペレータによる領域の指定を受け付ける領
域指定手段と、前記座標データ記憶手段に格納されてい
る前記座標データの中で前記領域指定手段で指定された
座標に最も近い座標を算出する認識領域決定手段を有す
ることを特徴とするものである。
指示に基づいて設定される画像領域内の文字画像を認識
する文字認識装置において、文字認識の対象となりうる
画像データを記憶する画像記憶手段と、該画像記憶手段
に記憶されている画像データ中の行および1文字あるい
は文字の構成部品ごとの座標に関する座標データを検出
する座標データ検出手段と、前記座標データ検出手段に
より検出された前記座標データを記憶する座標データ記
憶手段と、オペレータによる領域の指定を受け付ける領
域指定手段と、前記座標データ記憶手段に格納されてい
る前記座標データの中で前記領域指定手段で指定された
座標に最も近い座標を算出する認識領域決定手段を有す
ることを特徴とするものである。
【0006】請求項2に記載の発明では、請求項1に記
載の文字認識装置において、さらに、前記認識領域決定
手段で決定された座標で特定される認識領域の領域枠が
文字画像と接しているか否かを検出する領域枠接触検出
手段と、該領域枠接触検出手段で検出された文字画像と
接する部分の領域枠を文字と重ならないように拡張また
は縮小する領域枠修正手段を具えたことを特徴とするも
のである。
載の文字認識装置において、さらに、前記認識領域決定
手段で決定された座標で特定される認識領域の領域枠が
文字画像と接しているか否かを検出する領域枠接触検出
手段と、該領域枠接触検出手段で検出された文字画像と
接する部分の領域枠を文字と重ならないように拡張また
は縮小する領域枠修正手段を具えたことを特徴とするも
のである。
【0007】
【作用】本発明によれば、画像記憶手段に記憶されてい
る画像データから、座標データ検出手段によって予め行
および1文字あるいは文字の構成部品ごとの座標に関す
る座標データを検出し、座標データ記憶手段に記憶して
おく。オペレータからの領域の指定を受け付けると、認
識領域決定手段は座標データ記憶手段に格納されている
座標データの中で、オペレータから指定された座標に最
も近い座標を算出し、認識領域を決定する。これによ
り、オペレータが認識領域の指定時に文字上の座標を指
定しても、文字に重ならない座標が算出され、認識領域
が設定される。また、認識すべき文字が欠けないような
座標を算出する際には、画像データを参照することな
く、座標データのみを処理対象とすればよく、高速な処
理が可能である。
る画像データから、座標データ検出手段によって予め行
および1文字あるいは文字の構成部品ごとの座標に関す
る座標データを検出し、座標データ記憶手段に記憶して
おく。オペレータからの領域の指定を受け付けると、認
識領域決定手段は座標データ記憶手段に格納されている
座標データの中で、オペレータから指定された座標に最
も近い座標を算出し、認識領域を決定する。これによ
り、オペレータが認識領域の指定時に文字上の座標を指
定しても、文字に重ならない座標が算出され、認識領域
が設定される。また、認識すべき文字が欠けないような
座標を算出する際には、画像データを参照することな
く、座標データのみを処理対象とすればよく、高速な処
理が可能である。
【0008】また、認識領域決定手段で決定された座標
で特定される認識領域の領域枠が、画像データ中の文字
画像と接しているか否かを領域枠接触検出手段で検出
し、もし、認識領域の領域枠が文字画像と接している場
合には、その接する部分の領域枠を文字と重ならないよ
うに、領域枠修正手段で拡張または縮小する。これによ
り、認識すべき文字の一部を欠いて認識領域が設定され
ることはない。また、オペレータが指定した認識領域の
領域枠の近傍に文字と重ならないような領域枠が設定で
きない場合であっても、文字と重なる部分だけ領域枠を
拡張することによって、領域枠の設定が可能となる。な
お、領域枠修正手段は、自動的に領域枠の修正を行なう
構成のほか、オペレータによって拡張又は縮減させるよ
うに構成することも可能である。
で特定される認識領域の領域枠が、画像データ中の文字
画像と接しているか否かを領域枠接触検出手段で検出
し、もし、認識領域の領域枠が文字画像と接している場
合には、その接する部分の領域枠を文字と重ならないよ
うに、領域枠修正手段で拡張または縮小する。これによ
り、認識すべき文字の一部を欠いて認識領域が設定され
ることはない。また、オペレータが指定した認識領域の
領域枠の近傍に文字と重ならないような領域枠が設定で
きない場合であっても、文字と重なる部分だけ領域枠を
拡張することによって、領域枠の設定が可能となる。な
お、領域枠修正手段は、自動的に領域枠の修正を行なう
構成のほか、オペレータによって拡張又は縮減させるよ
うに構成することも可能である。
【0009】
【実施例】図1は、本発明の文字認識装置の第1の実施
例を示すブロック構成図である。図中、1は画像データ
記憶部、2は文字行検出部、3は文字切り出し部、4は
文字座標記憶部、5は領域指定部、6は認識領域決定
部、7は認識領域記憶部、8は領域枠表示部、9は表示
部、10は認識部である。画像データ記憶部1は、認識
を行なう文字画像を含む画像データが格納される。文字
行検出部2は、画像データ記憶部1に格納されている画
像データを参照し、文字行の存在する領域を検出して、
その座標を行位置座標として取得する。文字切り出し部
3は、画像データ記憶部1に格納されている画像データ
を参照し、各文字を切り出して、その座標を文字位置座
標として取得する。このとき、文字行検出部2で検出
し、文字座標記憶部4に記憶され値得る行位置座標を利
用してもよい。文字座標記憶部4は、文字行検出部2お
よび文字切り出し部3で取得した行位置座標および文字
位置座標を記憶する。
例を示すブロック構成図である。図中、1は画像データ
記憶部、2は文字行検出部、3は文字切り出し部、4は
文字座標記憶部、5は領域指定部、6は認識領域決定
部、7は認識領域記憶部、8は領域枠表示部、9は表示
部、10は認識部である。画像データ記憶部1は、認識
を行なう文字画像を含む画像データが格納される。文字
行検出部2は、画像データ記憶部1に格納されている画
像データを参照し、文字行の存在する領域を検出して、
その座標を行位置座標として取得する。文字切り出し部
3は、画像データ記憶部1に格納されている画像データ
を参照し、各文字を切り出して、その座標を文字位置座
標として取得する。このとき、文字行検出部2で検出
し、文字座標記憶部4に記憶され値得る行位置座標を利
用してもよい。文字座標記憶部4は、文字行検出部2お
よび文字切り出し部3で取得した行位置座標および文字
位置座標を記憶する。
【0010】領域指定部5は、少なくともオペレータか
らの認識領域に関する指示を受け付け、指示された座標
を認識領域決定部6に伝える。認識領域決定部6は、文
字座標記憶部4に記憶されている行位置座標および文字
位置座標をもとに、領域指定部5で指定された認識領域
の座標に最も近い行位置座標あるいは文字位置座標を求
め、認識領域を決定する。認識領域記憶部7は、認識領
域決定部6で決定された認識領域を記憶する。
らの認識領域に関する指示を受け付け、指示された座標
を認識領域決定部6に伝える。認識領域決定部6は、文
字座標記憶部4に記憶されている行位置座標および文字
位置座標をもとに、領域指定部5で指定された認識領域
の座標に最も近い行位置座標あるいは文字位置座標を求
め、認識領域を決定する。認識領域記憶部7は、認識領
域決定部6で決定された認識領域を記憶する。
【0011】領域枠表示部8は、認識領域記憶部7に記
憶されている認識領域の情報をもとに、領域枠を表示す
るための情報を生成して表示部9に表示させる。表示部
9は、少なくとも画像データ記憶部1に格納されている
画像データが表示され、領域指定部5でオペレータが認
識領域を指定する際に用いられる。また、領域枠表示部
8で生成された領域枠を画像データと重ねて表示し、決
定された認識領域をオペレータが確認することができ
る。
憶されている認識領域の情報をもとに、領域枠を表示す
るための情報を生成して表示部9に表示させる。表示部
9は、少なくとも画像データ記憶部1に格納されている
画像データが表示され、領域指定部5でオペレータが認
識領域を指定する際に用いられる。また、領域枠表示部
8で生成された領域枠を画像データと重ねて表示し、決
定された認識領域をオペレータが確認することができ
る。
【0012】認識部10は、認識領域記憶部7に記憶さ
れている認識領域の情報に従って、画像データ記憶部1
に格納されている画像データから認識領域の画像を取得
し、その中に含まれている文字画像を認識する。
れている認識領域の情報に従って、画像データ記憶部1
に格納されている画像データから認識領域の画像を取得
し、その中に含まれている文字画像を認識する。
【0013】図2は、文字行検出部2および文字切り出
し部3の一例を示すブロック構成図である。図中、11
は水平方向黒画素数カウント部、12は行間判定部、1
3は垂直方向黒画素数カウント部、14は文字間判定部
である。例えば、文字が横書きで記述されているものと
すれば、行間は水平方向に黒画素がほとんど存在しない
領域として検出することができる。ここでは、画像デー
タを水平方向に走査して射影を得て、行を検出する。文
字行検出部2の水平方向黒画素数カウント部11では、
画像データ記憶部1に格納されている画像データを水平
方向に走査し、各水平ラインごとに黒画素数をカウント
して射影を作成する。行間判定部12は、水平方向黒画
素数カウント部11で作成した射影をもとに、例えば、
所定の閾値と比較したり、あるいは黒画素数の変化など
を調べて、各文字行を検出する。
し部3の一例を示すブロック構成図である。図中、11
は水平方向黒画素数カウント部、12は行間判定部、1
3は垂直方向黒画素数カウント部、14は文字間判定部
である。例えば、文字が横書きで記述されているものと
すれば、行間は水平方向に黒画素がほとんど存在しない
領域として検出することができる。ここでは、画像デー
タを水平方向に走査して射影を得て、行を検出する。文
字行検出部2の水平方向黒画素数カウント部11では、
画像データ記憶部1に格納されている画像データを水平
方向に走査し、各水平ラインごとに黒画素数をカウント
して射影を作成する。行間判定部12は、水平方向黒画
素数カウント部11で作成した射影をもとに、例えば、
所定の閾値と比較したり、あるいは黒画素数の変化など
を調べて、各文字行を検出する。
【0014】同様に、各行中の各文字の間には、黒画素
がほとんど存在しない。文字切り出し部3の垂直方向黒
画素数カウント部13では、文字行検出部2で検出した
各行ごとに、行内の画像データを垂直方向に走査して黒
画素をカウントし、射影を作成する。そして、作成した
垂直方向の射影をもとに、文字間判定部14で文字の間
を判定し、各文字を検出する。」 上述の水平方向黒画
素数カウント部11および垂直方向黒画素数カウント部
13においては、画像データの黒画素数をカウントする
ように構成したが、白画素数をカウントするように構成
しても、同様の検出を行なうことができる。
がほとんど存在しない。文字切り出し部3の垂直方向黒
画素数カウント部13では、文字行検出部2で検出した
各行ごとに、行内の画像データを垂直方向に走査して黒
画素をカウントし、射影を作成する。そして、作成した
垂直方向の射影をもとに、文字間判定部14で文字の間
を判定し、各文字を検出する。」 上述の水平方向黒画
素数カウント部11および垂直方向黒画素数カウント部
13においては、画像データの黒画素数をカウントする
ように構成したが、白画素数をカウントするように構成
しても、同様の検出を行なうことができる。
【0015】図3は、本発明の文字認識装置の第1の実
施例における動作の一例を示すフローチャートである。
S21において、認識を行なおうとする画像データが画
像データ記憶部1に格納され、格納された画像データは
表示部9によりオペレータに可視化される。
施例における動作の一例を示すフローチャートである。
S21において、認識を行なおうとする画像データが画
像データ記憶部1に格納され、格納された画像データは
表示部9によりオペレータに可視化される。
【0016】画像記憶手段9に画像データが格納される
と、S22において、まず文字行検出部2により各文字
行の存在する行位置座標が検出され、文字座標記憶部4
に格納される。例えば、図2に示した構成では、各文字
行の検出は、画像データを水平方向に走査して射影を取
り、黒画素と白画素の境界の座標を見つけることで行位
置座標を得ることができる。また、文字切り出し手段3
が文字座標記憶手段4に格納されている行位置座標を参
照しながら、各行ごとに文字領域を切り出し、切り出し
た文字領域の座標を文字座標記憶部4に格納する。例え
ば、図2に示した構成では、1行分の画像データに対し
て垂直方向の射影を取り、黒画素と白画素の境界の座標
を見つけることで文字位置座標を得ることができる。こ
のようにして文字ごとの位置を示す座標を求めることが
できる。なお、文字行検出部2と文字切り出し部3によ
る座標検出処理は、文字行と文字ごとで同期を取りなが
ら並列的に行なってもよい。
と、S22において、まず文字行検出部2により各文字
行の存在する行位置座標が検出され、文字座標記憶部4
に格納される。例えば、図2に示した構成では、各文字
行の検出は、画像データを水平方向に走査して射影を取
り、黒画素と白画素の境界の座標を見つけることで行位
置座標を得ることができる。また、文字切り出し手段3
が文字座標記憶手段4に格納されている行位置座標を参
照しながら、各行ごとに文字領域を切り出し、切り出し
た文字領域の座標を文字座標記憶部4に格納する。例え
ば、図2に示した構成では、1行分の画像データに対し
て垂直方向の射影を取り、黒画素と白画素の境界の座標
を見つけることで文字位置座標を得ることができる。こ
のようにして文字ごとの位置を示す座標を求めることが
できる。なお、文字行検出部2と文字切り出し部3によ
る座標検出処理は、文字行と文字ごとで同期を取りなが
ら並列的に行なってもよい。
【0017】S23において、オペレータは、表示部9
に表示されている画像データを見ながら、認識を行ない
たい領域の開始点の座標を、領域指定部5のポインティ
ングデバイスなどを用いて設定する。S24において、
領域指定部5により指定された開始点の座標が認識領域
決定部6に入力されると、認識領域決定部6は文字座標
記憶部5に格納されている座標データのうちから、指定
された座標にもっとも近い座標データを距離計算により
抽出し、抽出した座標を開始点の座標として認識領域記
憶部7に出力する。この時点ではまだ認識領域が決定さ
れていないので、S25における認識対象領域の表示は
行なわれない。S26において、最後の座標データか否
かが判定される。まだ終了点の座標が入力されていない
ので、S23へ戻る。
に表示されている画像データを見ながら、認識を行ない
たい領域の開始点の座標を、領域指定部5のポインティ
ングデバイスなどを用いて設定する。S24において、
領域指定部5により指定された開始点の座標が認識領域
決定部6に入力されると、認識領域決定部6は文字座標
記憶部5に格納されている座標データのうちから、指定
された座標にもっとも近い座標データを距離計算により
抽出し、抽出した座標を開始点の座標として認識領域記
憶部7に出力する。この時点ではまだ認識領域が決定さ
れていないので、S25における認識対象領域の表示は
行なわれない。S26において、最後の座標データか否
かが判定される。まだ終了点の座標が入力されていない
ので、S23へ戻る。
【0018】オペレータは認識領域のもう一方の終了点
の座標を指定するため、S23において、表示部9上で
認識対象領域を確認しながら領域指定部5を操作する。
オペレータが領域指定部5を操作しているとき、表示部
9は一定の時間間隔で領域指定部5がそのとき指示して
いる座標を出力する。S24において、認識領域決定部
6は、そのとき領域指定部5で指示している座標を、文
字座標記憶部4に格納されている座標データのうち、指
示されている座標にもっとも近い座標データを距離計算
により抽出し、抽出した座標を終了点の座標として認識
領域記憶部7に出力する。認識領域記憶部7に出力され
た開始点および終了点の座標は、領域枠表示部8によっ
て取得され、認識領域を示す領域枠が生成されて、表示
部9に渡される。表示部9は、S25において、画像デ
ータに重ねて領域枠を表示する。
の座標を指定するため、S23において、表示部9上で
認識対象領域を確認しながら領域指定部5を操作する。
オペレータが領域指定部5を操作しているとき、表示部
9は一定の時間間隔で領域指定部5がそのとき指示して
いる座標を出力する。S24において、認識領域決定部
6は、そのとき領域指定部5で指示している座標を、文
字座標記憶部4に格納されている座標データのうち、指
示されている座標にもっとも近い座標データを距離計算
により抽出し、抽出した座標を終了点の座標として認識
領域記憶部7に出力する。認識領域記憶部7に出力され
た開始点および終了点の座標は、領域枠表示部8によっ
て取得され、認識領域を示す領域枠が生成されて、表示
部9に渡される。表示部9は、S25において、画像デ
ータに重ねて領域枠を表示する。
【0019】このようにして、オペレータが指示しよう
としている認識対象領域は、最終的な座標が入力される
まで、開始点と、そのとき指示されている座標を終了点
とする矩形領域として領域枠表示部8により表示部9に
表示される。このとき、領域枠は、認識領域決定部6に
よって、文字座標記憶部4に格納されている座標データ
のうち、指示されている座標にもっとも近い座標データ
に変更されているので、表示部9に表示される領域枠
は、その開始点と終了点が近くの文字とは重ならないよ
うに表示される。
としている認識対象領域は、最終的な座標が入力される
まで、開始点と、そのとき指示されている座標を終了点
とする矩形領域として領域枠表示部8により表示部9に
表示される。このとき、領域枠は、認識領域決定部6に
よって、文字座標記憶部4に格納されている座標データ
のうち、指示されている座標にもっとも近い座標データ
に変更されているので、表示部9に表示される領域枠
は、その開始点と終了点が近くの文字とは重ならないよ
うに表示される。
【0020】最終的に座標が決定されると、S27に進
み、認識部10は、認識領域記憶部7に格納されている
認識領域座標を参照して、画像データ記憶部1に格納さ
れている画像データのうち、認識領域中の画像に対して
文字認識処理を実行する。
み、認識部10は、認識領域記憶部7に格納されている
認識領域座標を参照して、画像データ記憶部1に格納さ
れている画像データのうち、認識領域中の画像に対して
文字認識処理を実行する。
【0021】上述の動作を具体例を用いて説明する。図
4は、画像データの一例の説明図である。ここでは、具
体例として、図4に示すような画像データが入力され、
画像データ記憶部1に格納されたものとする。図4に示
した具体例では、1行目に「あいうえおかきくけこ」、
2行目に「abcdefghijklmn」、3行目に
「なにぬねのはひふへほ」と横書きで記述されている。
この画像データは、表示部9によりオペレータに対して
表示されている。
4は、画像データの一例の説明図である。ここでは、具
体例として、図4に示すような画像データが入力され、
画像データ記憶部1に格納されたものとする。図4に示
した具体例では、1行目に「あいうえおかきくけこ」、
2行目に「abcdefghijklmn」、3行目に
「なにぬねのはひふへほ」と横書きで記述されている。
この画像データは、表示部9によりオペレータに対して
表示されている。
【0022】図5は、文字行検出部2および文字切り出
し部3によって得られる行位置座標および文字位置座標
の説明図である。文字行検出部2では、このような画像
データを水平方向に走査する。そして、図2に示した構
成では黒画素の数を水平方向黒画素数カウント部11に
よってカウントして射影を作成し、行間判定部12で行
間を判定する。すると、図3において破線で示す座標y
11〜y32が検出される。この座標は、各文字のy座標と
なり、文字座標記憶部4に記憶される。
し部3によって得られる行位置座標および文字位置座標
の説明図である。文字行検出部2では、このような画像
データを水平方向に走査する。そして、図2に示した構
成では黒画素の数を水平方向黒画素数カウント部11に
よってカウントして射影を作成し、行間判定部12で行
間を判定する。すると、図3において破線で示す座標y
11〜y32が検出される。この座標は、各文字のy座標と
なり、文字座標記憶部4に記憶される。
【0023】文字切り出し部3では、行間判定部12で
検出された文字行ごとに、垂直方向に走査し、黒画素を
カウントして射影を作成する。図3に示した例では、文
字切り出し部3で1行目の行位置座標としてy11,y12
が得られているので、この座標間の帯状の画像データを
参照し、垂直方向に黒画素をカウントする。作成された
射影をもとに、文字間判定部14は各文字を切り出し
て、文字位置座標を得る。図3に示した1行目の例で
は、文字位置座標x11〜x1bが得られる。ここでは、各
文字の左端の座標と、行の最右端の文字の右端の座標を
求めている。もちろん、最左端の文字について両端の座
標を求め、他の文字については右端の座標路求めるよう
に構成したり、あるいは、各文字について左端と右端を
求めてもよい。2行目も同様に文字位置座標x21〜x2f
が、3行目は文字位置座標x31〜x3bが、それぞれ求め
られる。このようにして求められた文字位置座標は、各
文字のx座標として文字座標記憶部4に記憶される。こ
のようにして、文字座標記憶部4には、各文字ごとの座
標データとして、x座標として文字位置座標が、また、
y座標として行位置座標が記憶される。
検出された文字行ごとに、垂直方向に走査し、黒画素を
カウントして射影を作成する。図3に示した例では、文
字切り出し部3で1行目の行位置座標としてy11,y12
が得られているので、この座標間の帯状の画像データを
参照し、垂直方向に黒画素をカウントする。作成された
射影をもとに、文字間判定部14は各文字を切り出し
て、文字位置座標を得る。図3に示した1行目の例で
は、文字位置座標x11〜x1bが得られる。ここでは、各
文字の左端の座標と、行の最右端の文字の右端の座標を
求めている。もちろん、最左端の文字について両端の座
標を求め、他の文字については右端の座標路求めるよう
に構成したり、あるいは、各文字について左端と右端を
求めてもよい。2行目も同様に文字位置座標x21〜x2f
が、3行目は文字位置座標x31〜x3bが、それぞれ求め
られる。このようにして求められた文字位置座標は、各
文字のx座標として文字座標記憶部4に記憶される。こ
のようにして、文字座標記憶部4には、各文字ごとの座
標データとして、x座標として文字位置座標が、また、
y座標として行位置座標が記憶される。
【0024】オペレータは、表示部9に表示された画像
データを参照しながら、領域指定部5によって認識領域
の開始点を指示する。いま、領域指定部5により開始点
の座標(X0,Y0)が認識領域決定部6に入力された
とする。すると、認識領域決定部6は文字座標記憶部4
に格納されている座標データで座標(X0,Y0)にも
っとも近い座標データを距離計算により抽出する。抽出
された座標を座標(Xs,Ys)とすれば、この座標を
座標(X0,Y0)の代わりに開始点の座標として認識
領域記憶部7に出力する。例えば、図4において文字
「あ」の左上付近の点を開始点として指定すると、座標
(x11,y11)が開始点の座標として抽出され、認識領
域記憶部7に記憶される。
データを参照しながら、領域指定部5によって認識領域
の開始点を指示する。いま、領域指定部5により開始点
の座標(X0,Y0)が認識領域決定部6に入力された
とする。すると、認識領域決定部6は文字座標記憶部4
に格納されている座標データで座標(X0,Y0)にも
っとも近い座標データを距離計算により抽出する。抽出
された座標を座標(Xs,Ys)とすれば、この座標を
座標(X0,Y0)の代わりに開始点の座標として認識
領域記憶部7に出力する。例えば、図4において文字
「あ」の左上付近の点を開始点として指定すると、座標
(x11,y11)が開始点の座標として抽出され、認識領
域記憶部7に記憶される。
【0025】オペレータは、認識対象領域のもう一方の
終了座標を指定するため、表示部9上で認識対象領域を
確認しながら領域指定部5を操作する。図6は、本発明
の第1の実施例における矩形枠表示の具体例の説明図で
ある。オペレータが領域指定部5を操作しているとき、
座標領域決定部6は一定の時間間隔で領域指定部5がそ
のとき指示している座標(Xi,Yi)を出力する。認
識領域決定部6は、領域指定部5から座標(Xi,Y
i)が指示されている間、文字座標記憶部4に格納され
ている座標データのうちから、座標(Xi,Yi)にも
っとも近い座標データを距離計算により抽出する。抽出
した座標を座標(Xe,Ye)とすれば、この座標を終
了点の座標として認識領域記憶部7に出力する。認識領
域記憶部7に出力された開始点及び終了点の座標をもと
に、領域枠表示部8は領域枠を生成し、表示部9に表示
させる。例えば、図6において、文字「い」や文字
「f」の右下付近に領域指定部5を動かすと、その移動
に伴って破線で示した矩形が領域枠として順次表示され
る。
終了座標を指定するため、表示部9上で認識対象領域を
確認しながら領域指定部5を操作する。図6は、本発明
の第1の実施例における矩形枠表示の具体例の説明図で
ある。オペレータが領域指定部5を操作しているとき、
座標領域決定部6は一定の時間間隔で領域指定部5がそ
のとき指示している座標(Xi,Yi)を出力する。認
識領域決定部6は、領域指定部5から座標(Xi,Y
i)が指示されている間、文字座標記憶部4に格納され
ている座標データのうちから、座標(Xi,Yi)にも
っとも近い座標データを距離計算により抽出する。抽出
した座標を座標(Xe,Ye)とすれば、この座標を終
了点の座標として認識領域記憶部7に出力する。認識領
域記憶部7に出力された開始点及び終了点の座標をもと
に、領域枠表示部8は領域枠を生成し、表示部9に表示
させる。例えば、図6において、文字「い」や文字
「f」の右下付近に領域指定部5を動かすと、その移動
に伴って破線で示した矩形が領域枠として順次表示され
る。
【0026】このようにして、オペレータが指示しよう
としている領域は、最終的な座標が入力されるまで、開
始点の座標(Xs,Ys)と終了点の座標(Xe,Y
e)を対角の座標とする矩形領域として矩形枠表示部8
により表示部9に表示される。最終的に例えば文字
「ひ」の右下付近を終了点として指示すると、図6に実
線で示した認識対象領域が設定される。最終的な座標が
指示されると、そのとき認識領域記憶部7に記憶されて
いる座標(Xs,Ys)および座標(Xe,Ye)が、
最終的に指定された認識対象領域を示す座標となる。そ
して、認識手段18は、認識領域記憶部7に記憶されて
いる認識対象領域を示す座標データを参照して、その領
域内の画像データに対して文字認識を実行する。
としている領域は、最終的な座標が入力されるまで、開
始点の座標(Xs,Ys)と終了点の座標(Xe,Y
e)を対角の座標とする矩形領域として矩形枠表示部8
により表示部9に表示される。最終的に例えば文字
「ひ」の右下付近を終了点として指示すると、図6に実
線で示した認識対象領域が設定される。最終的な座標が
指示されると、そのとき認識領域記憶部7に記憶されて
いる座標(Xs,Ys)および座標(Xe,Ye)が、
最終的に指定された認識対象領域を示す座標となる。そ
して、認識手段18は、認識領域記憶部7に記憶されて
いる認識対象領域を示す座標データを参照して、その領
域内の画像データに対して文字認識を実行する。
【0027】なお、領域指定部5で指定された座標が文
字画像外の場合には、認識領域決定部6は座標データの
変更を行なわず、指示された座標をそのまま認識領域記
憶部7に出力するように構成することも可能である。ま
た、領域指定部5に修飾キーを設け、認識領域決定部6
かこの修飾キーの押下を検出した場合に、指示された座
標をそのまま認識領域記憶部7に出力するように構成す
ることもできる。修飾キーとしては、例えば、“Shi
ft”キーや“Control”キーなどとすることが
できる。
字画像外の場合には、認識領域決定部6は座標データの
変更を行なわず、指示された座標をそのまま認識領域記
憶部7に出力するように構成することも可能である。ま
た、領域指定部5に修飾キーを設け、認識領域決定部6
かこの修飾キーの押下を検出した場合に、指示された座
標をそのまま認識領域記憶部7に出力するように構成す
ることもできる。修飾キーとしては、例えば、“Shi
ft”キーや“Control”キーなどとすることが
できる。
【0028】認識対象領域は矩形に限らず、多角形であ
ってもよい。その場合には、形状に応じた数の座標を指
示するように構成すればよい。さらに、指定する認識対
象領域は1つに限らず、複数指定することができるよう
に構成することも可能である。
ってもよい。その場合には、形状に応じた数の座標を指
示するように構成すればよい。さらに、指定する認識対
象領域は1つに限らず、複数指定することができるよう
に構成することも可能である。
【0029】次に、本発明の文字認識装置の第2の実施
例について説明する。図7は、本発明の第1の実施例に
おいて、領域枠が文字と重なる場合の一例の説明図であ
る。上述の第1の実施例では、オペレータから指示され
た開始点および終了点の座標については、文字座標記憶
部4に記憶されている座標データに従って変更し、文字
と重ならないようにしている。しかし、このようにして
設定された認識対象領域の領域枠は、開始点の座標と終
了点の座標の近く以外の文字と重なる場合がある。図7
は、このような場合を示している。図7には、開始点と
して文字「b」の左上付近を指定し、終了点として文字
「I」の右下付近を指定した場合の領域枠を示してい
る。図7を参照するとわかるように、領域枠の左辺が文
字「な」と、右辺が文字「l」および文字「ひ」と交差
している。
例について説明する。図7は、本発明の第1の実施例に
おいて、領域枠が文字と重なる場合の一例の説明図であ
る。上述の第1の実施例では、オペレータから指示され
た開始点および終了点の座標については、文字座標記憶
部4に記憶されている座標データに従って変更し、文字
と重ならないようにしている。しかし、このようにして
設定された認識対象領域の領域枠は、開始点の座標と終
了点の座標の近く以外の文字と重なる場合がある。図7
は、このような場合を示している。図7には、開始点と
して文字「b」の左上付近を指定し、終了点として文字
「I」の右下付近を指定した場合の領域枠を示してい
る。図7を参照するとわかるように、領域枠の左辺が文
字「な」と、右辺が文字「l」および文字「ひ」と交差
している。
【0030】図7に示す例では、英字部分とひらがなの
部分とで文字間隔が異なるため、図7に示すような認識
対象領域を指定する場合には、従来の認識対象領域の設
定方法のように文字と交差しない矩形領域を設定しよう
とすると、数文字分程度の領域の変更が必要となり、所
望する認識対象領域が設定できない。このような問題を
解決するため、以下に説明する本発明の第2の実施例で
は、このような領域枠と文字画像との重なりを排除する
ように、認識対象領域を変形する例を示している。
部分とで文字間隔が異なるため、図7に示すような認識
対象領域を指定する場合には、従来の認識対象領域の設
定方法のように文字と交差しない矩形領域を設定しよう
とすると、数文字分程度の領域の変更が必要となり、所
望する認識対象領域が設定できない。このような問題を
解決するため、以下に説明する本発明の第2の実施例で
は、このような領域枠と文字画像との重なりを排除する
ように、認識対象領域を変形する例を示している。
【0031】図8は、本発明の文字認識装置の第2の実
施例を示すブロック構成図である。図中、図1と同様の
部分には同じ符号を付して説明を省略する。31は領域
枠接触検出部、32は領域枠修正部である。領域枠接触
検出部31は、認識領域決定部6から出力される認識対
象領域の開始点と終了点の座標から、認識対象領域の領
域枠のデータを生成し、生成した領域枠のデータと画像
データ中の文字画像とが接触するか否かを判定する。こ
の判定は、例えば、領域枠の線分画像データを生成し、
画像データ記憶部1に格納されている画像データとの論
理演算を行なうことによって実行することができる。あ
るいは、文字切り出し部3で各文字の左右の座標が検出
され、文字座標記憶部4に格納されている場合には、領
域枠の線分と各文字が存在する領域との交点計算のみに
よって判定することができる。領域枠修正部32は、領
域枠と文字とが接触している場合、接触している文字の
部分だけ領域枠を拡張する。これにより、接触している
文字がすべて認識対象領域内に含まれるようになる。こ
のとき、文字座標記憶部4に格納されている座標データ
を用いると、高速な処理が可能である。
施例を示すブロック構成図である。図中、図1と同様の
部分には同じ符号を付して説明を省略する。31は領域
枠接触検出部、32は領域枠修正部である。領域枠接触
検出部31は、認識領域決定部6から出力される認識対
象領域の開始点と終了点の座標から、認識対象領域の領
域枠のデータを生成し、生成した領域枠のデータと画像
データ中の文字画像とが接触するか否かを判定する。こ
の判定は、例えば、領域枠の線分画像データを生成し、
画像データ記憶部1に格納されている画像データとの論
理演算を行なうことによって実行することができる。あ
るいは、文字切り出し部3で各文字の左右の座標が検出
され、文字座標記憶部4に格納されている場合には、領
域枠の線分と各文字が存在する領域との交点計算のみに
よって判定することができる。領域枠修正部32は、領
域枠と文字とが接触している場合、接触している文字の
部分だけ領域枠を拡張する。これにより、接触している
文字がすべて認識対象領域内に含まれるようになる。こ
のとき、文字座標記憶部4に格納されている座標データ
を用いると、高速な処理が可能である。
【0032】図9は、本発明の文字認識装置の第2の実
施例における動作の一例を示すフローチャートである。
この第2の実施例における動作は、上述の第1の実施例
とほぼ同様であるので、図9では図3に示したフローチ
ャートと重複する部分についてはS24、S25を除き
省略した。また、S24、S25は図9において破線で
示しており、内容は図3と同じである。
施例における動作の一例を示すフローチャートである。
この第2の実施例における動作は、上述の第1の実施例
とほぼ同様であるので、図9では図3に示したフローチ
ャートと重複する部分についてはS24、S25を除き
省略した。また、S24、S25は図9において破線で
示しており、内容は図3と同じである。
【0033】第1の実施例と同様に、画像データが入力
され、画像データ記憶部1に格納されると、文字行検出
部2および文字切り出し部3によって座標データが抽出
され、文字座標記憶部4に格納される。その後、領域指
定部5からオペレータが開始点および終了点の座標を指
示する。領域指定部5から指示された座標は、認識領域
決定部6において文字座標記憶部4内の座標データと比
較され、指示された座標にもっとも近い座標データが認
識領域決定部から出力される。
され、画像データ記憶部1に格納されると、文字行検出
部2および文字切り出し部3によって座標データが抽出
され、文字座標記憶部4に格納される。その後、領域指
定部5からオペレータが開始点および終了点の座標を指
示する。領域指定部5から指示された座標は、認識領域
決定部6において文字座標記憶部4内の座標データと比
較され、指示された座標にもっとも近い座標データが認
識領域決定部から出力される。
【0034】認識領域決定部6から認識対象領域の開始
点と終了点が出力されると、図9のS41において、領
域枠接触検出部31は開始点と終了点により決まる領域
枠が文字画像と接触しているか否かを検出する。接触し
ていなければ、領域枠修正部32では領域枠の座標に関
するデータを修正せず、認識領域記憶部7へそのまま出
力する。この場合、処理はS25へと進む。
点と終了点が出力されると、図9のS41において、領
域枠接触検出部31は開始点と終了点により決まる領域
枠が文字画像と接触しているか否かを検出する。接触し
ていなければ、領域枠修正部32では領域枠の座標に関
するデータを修正せず、認識領域記憶部7へそのまま出
力する。この場合、処理はS25へと進む。
【0035】領域枠と文字画像との接触があった場合に
は、S42において、領域枠接触検出手段36は接触の
あった文字の座標を検出する。そして、S43におい
て、文字と接触した領域枠が縦方向の線分か横方向の線
分かを判定する。この判定結果は領域枠修正部37へ出
力される。領域枠修正部32は、接触した領域枠が横方
向の線分の場合には、S44において、接触した文字の
高さを算出し、接触している部分の領域枠線を高さ分だ
け領域枠に対して外側に拡張する。すなわち、接触しな
くなるまでの長さを、領域枠の下の線のときにはY座標
方向に加え、上の線のときには減じる方向に、認識対象
領域の局所的な拡張を行なって、新しい領域枠を作成す
る。また、文字と接触した領域枠が縦方向の線分の場合
には、S45において、接触した文字の幅を算出し、接
触している部分の領域枠線を幅の分だけ行行き枠に対し
て外側に拡張する。すなわち、接触しなくなるまでの長
さを、領域枠の右側の線のときにはX座標方向に加え、
左側の線のときには減じる方向に、認識対象領域の局所
的な拡張を行なって、新しい領域枠を作成する。新たに
作成された領域枠は、認識領域記憶部7に格納される。
は、S42において、領域枠接触検出手段36は接触の
あった文字の座標を検出する。そして、S43におい
て、文字と接触した領域枠が縦方向の線分か横方向の線
分かを判定する。この判定結果は領域枠修正部37へ出
力される。領域枠修正部32は、接触した領域枠が横方
向の線分の場合には、S44において、接触した文字の
高さを算出し、接触している部分の領域枠線を高さ分だ
け領域枠に対して外側に拡張する。すなわち、接触しな
くなるまでの長さを、領域枠の下の線のときにはY座標
方向に加え、上の線のときには減じる方向に、認識対象
領域の局所的な拡張を行なって、新しい領域枠を作成す
る。また、文字と接触した領域枠が縦方向の線分の場合
には、S45において、接触した文字の幅を算出し、接
触している部分の領域枠線を幅の分だけ行行き枠に対し
て外側に拡張する。すなわち、接触しなくなるまでの長
さを、領域枠の右側の線のときにはX座標方向に加え、
左側の線のときには減じる方向に、認識対象領域の局所
的な拡張を行なって、新しい領域枠を作成する。新たに
作成された領域枠は、認識領域記憶部7に格納される。
【0036】S46において、すべての接触部分での処
理が終了したか否かを判定し、まだ残っている場合に
は、S43に戻って処理を繰り返す。全ての接触部分の
処理を終了すると、S25に進み、認識対象領域の表示
以降の処理が行なわれる。
理が終了したか否かを判定し、まだ残っている場合に
は、S43に戻って処理を繰り返す。全ての接触部分の
処理を終了すると、S25に進み、認識対象領域の表示
以降の処理が行なわれる。
【0037】図10は、本発明の第2の実施例において
生成される領域枠の具体例の説明図である。いま、図7
に示すような領域枠が認識領域決定部6から出力された
場合を考える。上述のように、図7に示す領域枠は文字
と接触している。領域枠接触検出部31は、領域枠の左
側の縦線が文字「な」の位置で、また、右側の縦線が文
字「l」と文字「ひ」の位置で接触していることを検出
し、領域枠修正部32に伝える。領域枠修正部32は、
まず領域枠の左側の縦線において、文字「な」と接触し
ている部分を、文字「な」と接触しなくなるまで左側に
拡張する。また、領域枠の右側の縦線において、文字
「l」と接触している部分を、文字「l」と接触しなく
なるまで右側に拡張し、同様に、文字「ひ」と接触して
いる部分を文字「ひ」と接触しなくなるまで右側に拡張
する。このような処理によって、図10に示すように、
文字と接触しない認識対象領域を設定することができ
る。
生成される領域枠の具体例の説明図である。いま、図7
に示すような領域枠が認識領域決定部6から出力された
場合を考える。上述のように、図7に示す領域枠は文字
と接触している。領域枠接触検出部31は、領域枠の左
側の縦線が文字「な」の位置で、また、右側の縦線が文
字「l」と文字「ひ」の位置で接触していることを検出
し、領域枠修正部32に伝える。領域枠修正部32は、
まず領域枠の左側の縦線において、文字「な」と接触し
ている部分を、文字「な」と接触しなくなるまで左側に
拡張する。また、領域枠の右側の縦線において、文字
「l」と接触している部分を、文字「l」と接触しなく
なるまで右側に拡張し、同様に、文字「ひ」と接触して
いる部分を文字「ひ」と接触しなくなるまで右側に拡張
する。このような処理によって、図10に示すように、
文字と接触しない認識対象領域を設定することができ
る。
【0038】上述の例では、領域枠と接触した文字を認
識対象として取り込むために、領域枠を拡張する例を示
したが、領域枠と接触した文字を認識対象から除外する
ように、領域枠を縮小することも考えられる。しかし、
このような処理を行なわなくても、認識部10では欠け
た文字は認識できないので、領域枠の修正処理を行なわ
なければ、同様の結果を得ることができる。領域指定部
5に領域枠修正部32における修正処理を行なわない旨
の指示を行なうキーを配置し、このキーをオペレータが
押下した場合には、領域枠の修正処理を行なわないよう
に構成することができる。また、第1の実施例と同様、
例えば、修飾キーをオペレータが押下したことを検出し
て、認識領域決定部6による座標の変更処理を行なわな
いような機能を付加することもできる。この場合、領域
枠修正部32における処理も行なわないようにすること
ができる。
識対象として取り込むために、領域枠を拡張する例を示
したが、領域枠と接触した文字を認識対象から除外する
ように、領域枠を縮小することも考えられる。しかし、
このような処理を行なわなくても、認識部10では欠け
た文字は認識できないので、領域枠の修正処理を行なわ
なければ、同様の結果を得ることができる。領域指定部
5に領域枠修正部32における修正処理を行なわない旨
の指示を行なうキーを配置し、このキーをオペレータが
押下した場合には、領域枠の修正処理を行なわないよう
に構成することができる。また、第1の実施例と同様、
例えば、修飾キーをオペレータが押下したことを検出し
て、認識領域決定部6による座標の変更処理を行なわな
いような機能を付加することもできる。この場合、領域
枠修正部32における処理も行なわないようにすること
ができる。
【0039】なお、上述の第2の実施例では、文字行検
出部2によって行間を検出して文字のy座標を出力して
いる。そのため、認識領域決定部6から出力される領域
枠のうち、上下の枠線は文字と重なることはない。その
ため、領域枠接触検出部31においては左右の縦線のみ
について接触の有無を検出するように構成することがで
きる。もちろん、各文字についてその領域を示す座標を
抽出して文字座標記憶部4に格納するように構成した場
合には、上下の枠線についても処理を行なう必要があ
る。
出部2によって行間を検出して文字のy座標を出力して
いる。そのため、認識領域決定部6から出力される領域
枠のうち、上下の枠線は文字と重なることはない。その
ため、領域枠接触検出部31においては左右の縦線のみ
について接触の有無を検出するように構成することがで
きる。もちろん、各文字についてその領域を示す座標を
抽出して文字座標記憶部4に格納するように構成した場
合には、上下の枠線についても処理を行なう必要があ
る。
【0040】上述の各実施例では、文字が横書きである
ことを前提にして説明した。しかし、本発明はこれに限
らず、縦書きの文書に対しても適用することができる。
その場合には、文字行検出部2は垂直方向に走査して行
間を検出し、文字切り出し部3は水平方向に走査して各
文字を切り出すように構成すればよい。また、横書きと
縦書きを切り換え可能に構成することも可能である。さ
らに、横書き、縦書きに関係なく、各文字を個別に切り
出して各文字領域の座標を抽出するように構成してもよ
い。
ことを前提にして説明した。しかし、本発明はこれに限
らず、縦書きの文書に対しても適用することができる。
その場合には、文字行検出部2は垂直方向に走査して行
間を検出し、文字切り出し部3は水平方向に走査して各
文字を切り出すように構成すればよい。また、横書きと
縦書きを切り換え可能に構成することも可能である。さ
らに、横書き、縦書きに関係なく、各文字を個別に切り
出して各文字領域の座標を抽出するように構成してもよ
い。
【0041】
【発明の効果】以上の説明から明らかなように、本発明
によれば、画像記憶手段に記憶されている画像データか
ら、予め文字に関する座標データを検出し、座標データ
記憶手段に記憶しておき、オペレータから指定された認
識対象領域の座標を変更するようにしたので、オペレー
タが認識対象領域の指定時に文字上の座標を指定して
も、文字に重ならない座標が算出され、認識対象領域が
設定される。また、この認識対象領域の設定の際には、
座標データのみを処理対象として処理を行なうので、高
速な処理が可能であり、オペレータの指示している認識
対象領域をリアルタイムで表示可能である。そのため、
認識対象領域の設定を行なう際の操作性を向上させるこ
とができる。また、所望の認識対象領域を設定する際
に、領域枠が文字と重なる場合には、その部分について
領域枠を拡張することにより、所望の認識対象領域を文
字の欠けを生じることなく効率的に設定することができ
るという効果がある。
によれば、画像記憶手段に記憶されている画像データか
ら、予め文字に関する座標データを検出し、座標データ
記憶手段に記憶しておき、オペレータから指定された認
識対象領域の座標を変更するようにしたので、オペレー
タが認識対象領域の指定時に文字上の座標を指定して
も、文字に重ならない座標が算出され、認識対象領域が
設定される。また、この認識対象領域の設定の際には、
座標データのみを処理対象として処理を行なうので、高
速な処理が可能であり、オペレータの指示している認識
対象領域をリアルタイムで表示可能である。そのため、
認識対象領域の設定を行なう際の操作性を向上させるこ
とができる。また、所望の認識対象領域を設定する際
に、領域枠が文字と重なる場合には、その部分について
領域枠を拡張することにより、所望の認識対象領域を文
字の欠けを生じることなく効率的に設定することができ
るという効果がある。
【図1】 本発明の文字認識装置の第1の実施例を示す
ブロック構成図である。
ブロック構成図である。
【図2】 文字行検出部2および文字切り出し部3の一
例を示すブロック構成図である。
例を示すブロック構成図である。
【図3】 本発明の文字認識装置の第1の実施例におけ
る動作の一例を示すフローチャートである。
る動作の一例を示すフローチャートである。
【図4】 画像データの一例の説明図である。
【図5】 文字行検出部2および文字切り出し部3によ
って得られる行位置座標および文字位置座標の説明図で
ある。
って得られる行位置座標および文字位置座標の説明図で
ある。
【図6】 本発明の第1の実施例における矩形枠表示の
具体例の説明図である。
具体例の説明図である。
【図7】 本発明の第1の実施例において、領域枠が文
字と重なる場合の一例の説明図である。
字と重なる場合の一例の説明図である。
【図8】 本発明の文字認識装置の第2の実施例を示す
ブロック構成図である。
ブロック構成図である。
【図9】 本発明の文字認識装置の第2の実施例におけ
る動作の一例を示すフローチャートである。
る動作の一例を示すフローチャートである。
【図10】 本発明の第2の実施例において生成される
領域枠の具体例の説明図である。
領域枠の具体例の説明図である。
1…画像データ記憶部、2…文字行検出部、3…文字切
り出し部、4…文字座標記憶部、5…領域指定部、6…
認識領域決定部、7…認識領域記憶部、8…領域枠表示
部、9…表示部、10…認識部、31…領域枠接触検出
部、32…領域枠修正部。
り出し部、4…文字座標記憶部、5…領域指定部、6…
認識領域決定部、7…認識領域記憶部、8…領域枠表示
部、9…表示部、10…認識部、31…領域枠接触検出
部、32…領域枠修正部。
Claims (2)
- 【請求項1】 オペレータの指示に基づいて設定される
画像領域内の文字画像を認識する文字認識装置におい
て、文字認識の対象となりうる画像データを記憶する画
像記憶手段と、該画像記憶手段に記憶されている画像デ
ータ中の行および1文字あるいは文字の構成部品ごとの
座標に関する座標データを検出する座標データ検出手段
と、前記座標データ検出手段により検出された前記座標
データを記憶する座標データ記憶手段と、オペレータに
よる領域の指定を受け付ける領域指定手段と、前記座標
データ記憶手段に格納されている前記座標データの中で
前記領域指定手段で指定された座標に最も近い座標を算
出する認識領域決定手段を有することを特徴とする文字
認識装置。 - 【請求項2】 前記認識領域決定手段で決定された座標
で特定される認識領域の領域枠が文字画像と接している
か否かを検出する領域枠接触検出手段と、該領域枠接触
検出手段で検出された文字画像と接する部分の領域枠を
文字と重ならないように拡張または縮小する領域枠修正
手段をさらに具えたことを特徴とする請求項1に記載の
文字認識装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7069251A JPH08263588A (ja) | 1995-03-28 | 1995-03-28 | 文字認識装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7069251A JPH08263588A (ja) | 1995-03-28 | 1995-03-28 | 文字認識装置 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH08263588A true JPH08263588A (ja) | 1996-10-11 |
Family
ID=13397343
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP7069251A Pending JPH08263588A (ja) | 1995-03-28 | 1995-03-28 | 文字認識装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH08263588A (ja) |
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2011076581A (ja) * | 2009-09-04 | 2011-04-14 | Ricoh Co Ltd | 画像処理装置、画像処理システム、画像処理方法、及びプログラム |
| WO2013046512A1 (ja) * | 2011-09-26 | 2013-04-04 | Necカシオモバイルコミュニケーションズ株式会社 | 情報処理端末 |
| CN111563511A (zh) * | 2020-04-30 | 2020-08-21 | 广东小天才科技有限公司 | 一种智能框题的方法、装置、电子设备及存储介质 |
| JP2022104411A (ja) * | 2020-12-28 | 2022-07-08 | 有限責任監査法人トーマツ | 多モデル深層学習による文書のデジタル化アーキテクチャ、文書画像処理プログラム |
-
1995
- 1995-03-28 JP JP7069251A patent/JPH08263588A/ja active Pending
Cited By (6)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2011076581A (ja) * | 2009-09-04 | 2011-04-14 | Ricoh Co Ltd | 画像処理装置、画像処理システム、画像処理方法、及びプログラム |
| US9307109B2 (en) | 2009-09-04 | 2016-04-05 | Ricoh Company, Ltd. | Image processing apparatus, image processing system, and image processing method |
| WO2013046512A1 (ja) * | 2011-09-26 | 2013-04-04 | Necカシオモバイルコミュニケーションズ株式会社 | 情報処理端末 |
| CN111563511A (zh) * | 2020-04-30 | 2020-08-21 | 广东小天才科技有限公司 | 一种智能框题的方法、装置、电子设备及存储介质 |
| CN111563511B (zh) * | 2020-04-30 | 2023-11-14 | 广东小天才科技有限公司 | 一种智能框题的方法、装置、电子设备及存储介质 |
| JP2022104411A (ja) * | 2020-12-28 | 2022-07-08 | 有限責任監査法人トーマツ | 多モデル深層学習による文書のデジタル化アーキテクチャ、文書画像処理プログラム |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JP3756719B2 (ja) | 文書修飾装置及び画像処理装置 | |
| JPH06176188A (ja) | 認識文字の情報作成方法及び装置 | |
| JP2010108389A (ja) | 画像表示装置及びプログラム | |
| JP2000235619A (ja) | 表画像処理装置及びそのプログラム記憶媒体 | |
| JP3795238B2 (ja) | 文書画像処理装置及び文書画像処理方法 | |
| US20100332972A1 (en) | Document processor, document processing method, and computer readable medium | |
| JP2013171309A (ja) | 文字切り出し方法、およびこの方法を用いた文字認識装置およびプログラム | |
| JPH06208625A (ja) | 画像処理方法及び装置 | |
| JP3113747B2 (ja) | 文字認識装置及び文字認識方法 | |
| JP3133797B2 (ja) | 文字認識方法及びその装置 | |
| JP3019897B2 (ja) | 行切出し方法 | |
| JP5650683B2 (ja) | 画像処理装置、画像処理方法および画像処理プログラム | |
| JPH0644406A (ja) | 画像処理方法及び装置 | |
| JPH1153469A (ja) | 文字切り出し装置、光学式文字読取装置及び記録媒体 | |
| JPH0581467A (ja) | 画像処理方法及び装置 | |
| JP2004158041A (ja) | 表画像処理装置及びそのプログラム記憶媒体 | |
| JP2000020641A (ja) | 文字認識システム | |
| JPH0927008A (ja) | 文字認識装置及び方法 | |
| JP2971673B2 (ja) | 情報処理装置及び情報処理方法 | |
| JPH08137987A (ja) | 光学式文字読取装置 | |
| JPH09114918A (ja) | 光学式文字読取装置 | |
| JP3058630B2 (ja) | 図形処理装置 | |
| JPH0962786A (ja) | 文字認識装置 | |
| JPH1011530A (ja) | 画像入出力方法及び装置 | |
| JPH0927007A (ja) | 文字認識装置及び方法 |