JPH0365781A - パターン正規化方式 - Google Patents
パターン正規化方式Info
- Publication number
- JPH0365781A JPH0365781A JP1201393A JP20139389A JPH0365781A JP H0365781 A JPH0365781 A JP H0365781A JP 1201393 A JP1201393 A JP 1201393A JP 20139389 A JP20139389 A JP 20139389A JP H0365781 A JPH0365781 A JP H0365781A
- Authority
- JP
- Japan
- Prior art keywords
- character
- normalized
- pattern
- width
- normalization
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Landscapes
- Character Input (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
[産業上の利用分野]
本発明はパターン正規化方式、詳しくは文字認識の前段
階で行なう認識対象の文字パターンの正規化方式に関す
るものである。
階で行なう認識対象の文字パターンの正規化方式に関す
るものである。
[従来の技術]
従来、認識対象の文字パターンを正規化する場合には、
その矩形文字パターンの上下或いは左右にある白画素部
分を取り除き、縦横それぞれ別に正規化比率を計算して
処理していた。
その矩形文字パターンの上下或いは左右にある白画素部
分を取り除き、縦横それぞれ別に正規化比率を計算して
処理していた。
[発明が解決しようとしている課題]
しかしながら、上述した従来の処理で正規化を行なう、
すなわち、白画素部分を取り除いて縦横それぞれに変倍
すると上下或は左右に片寄った文字・記号等はその情報
が失われてしまうことになり問題があった。
すなわち、白画素部分を取り除いて縦横それぞれに変倍
すると上下或は左右に片寄った文字・記号等はその情報
が失われてしまうことになり問題があった。
例えば、オーバーライン“−”、マイナス記号アンダー
ライン“等はすべて“■” になってしまっていた。また、大文字の“つ”と小文字
のそれとは、従来の正規化処理の後に認識結果では大き
さ情報が失われているために、区別して認識することが
できなかった。
ライン“等はすべて“■” になってしまっていた。また、大文字の“つ”と小文字
のそれとは、従来の正規化処理の後に認識結果では大き
さ情報が失われているために、区別して認識することが
できなかった。
本発明はかかる課題に鑑みなされたものであり、良好な
認識結果を得ることを可能ならしめるパターン正規化方
式を提供しようとするものである。
認識結果を得ることを可能ならしめるパターン正規化方
式を提供しようとするものである。
[課題を解決するための手段]及び[作用]この課題を
解決する本発明のパターン正規化方式は以下に示す構成
を備える。すなわち、文字認識の前処理で行なう切り出
し文字パターンの正規化方式において、正規化対象の文
字記号の位置する行或いは列中の最大高さ或いは幅の一
方を基準辺とし、他辺を注目文字記号パターンのドツト
存在幅とした矩形領域で当該注目文字記号パターンを切
り出し、この切り出された文字記号パターンを正規化す
るとき、正規化サイズに対する前記基準辺の比でもって
注目文字記号パターンの高さ及び幅方向の大きさを変倍
する。
解決する本発明のパターン正規化方式は以下に示す構成
を備える。すなわち、文字認識の前処理で行なう切り出
し文字パターンの正規化方式において、正規化対象の文
字記号の位置する行或いは列中の最大高さ或いは幅の一
方を基準辺とし、他辺を注目文字記号パターンのドツト
存在幅とした矩形領域で当該注目文字記号パターンを切
り出し、この切り出された文字記号パターンを正規化す
るとき、正規化サイズに対する前記基準辺の比でもって
注目文字記号パターンの高さ及び幅方向の大きさを変倍
する。
[実施例]
以下、添付図面に従って本発明に係る実施例を詳細に説
明する。
明する。
第1図は実施例の装置の概略構成図であり、本実施例で
は横書き文書の文字認識を対象にしている。
は横書き文書の文字認識を対象にしている。
先ず、スキャナ等の入力部1より文書画像を読取り、画
像メモリ2に格納する。この画像メモリ2より、文字行
検出部3によって文字行を検出し、文字行バッファ4に
格納する。更に、検出された文字行から最大高さ検出部
5により、文字行の最大高さが求められる。また、文字
行バッファから文字矩形検出部6により文字矩形が検出
され文字矩形バッファ7に格納される。文字矩形が検出
されると文字幅検出部8によって文字の幅が検出され、
一方で検出された文字行の高さと共に文字正規化部9に
入力され、文字の正規化処理が行なわれる。更に、特徴
抽出部10により、正規化された文字の特徴を表すパラ
メータを抽出し、認識部11では既に得られている各文
字の特徴を格納している辞書12と比較することにより
文字の認識を行なう。
像メモリ2に格納する。この画像メモリ2より、文字行
検出部3によって文字行を検出し、文字行バッファ4に
格納する。更に、検出された文字行から最大高さ検出部
5により、文字行の最大高さが求められる。また、文字
行バッファから文字矩形検出部6により文字矩形が検出
され文字矩形バッファ7に格納される。文字矩形が検出
されると文字幅検出部8によって文字の幅が検出され、
一方で検出された文字行の高さと共に文字正規化部9に
入力され、文字の正規化処理が行なわれる。更に、特徴
抽出部10により、正規化された文字の特徴を表すパラ
メータを抽出し、認識部11では既に得られている各文
字の特徴を格納している辞書12と比較することにより
文字の認識を行なう。
第2図は特徴抽出部の処理を示すフローチャートである
。
。
ステップS1では文字行の最大高さhとし、ステップS
2で文字の矩形幅をdとし、このhとdから、ステップ
S3において、これらの最大値をとる方を基準辺Wとす
る。そして、ステップS4において、予め決められてい
る正規化サイズ℃と求められたWにより正規化比率r
= fl / wを決め、このrを文字矩形の縦横それ
ぞれに乗じ、正規化された文字矩形を得る画像正規化処
理をステップS5で行なう。
2で文字の矩形幅をdとし、このhとdから、ステップ
S3において、これらの最大値をとる方を基準辺Wとす
る。そして、ステップS4において、予め決められてい
る正規化サイズ℃と求められたWにより正規化比率r
= fl / wを決め、このrを文字矩形の縦横それ
ぞれに乗じ、正規化された文字矩形を得る画像正規化処
理をステップS5で行なう。
尚、上述した処理の中で、文字列行の検出は公知のもの
を採用するものとしその詳述は割愛する。
を採用するものとしその詳述は割愛する。
第3図に文字矩形の検出結果の一例を示す。各文字矩形
の高さは、その行の最大高さである“h(図示の場合に
は文字r度Jの高さ)”とした。
の高さは、その行の最大高さである“h(図示の場合に
は文字r度Jの高さ)”とした。
すなわち、この最大高さhが、そのまま他の文字の高さ
とした。尚、最大高さhを求める方法として、その注目
前を構成しているドツトの分布を調べればわかる。
とした。尚、最大高さhを求める方法として、その注目
前を構成しているドツトの分布を調べればわかる。
また、各文字の幅であるが、これは各文字を構成してい
るドツトの横方向の存在範囲に一致させた。これもドツ
ト分布より求められる。
るドツトの横方向の存在範囲に一致させた。これもドツ
ト分布より求められる。
今、上述した処理でもってピリオド記号の矩形が第4図
(a)に示すように、高さh、幅dとして決定されたと
する。このhとdとでは、hの方が大きい。そこで、こ
れを正規化サイズβ×βにする場合には、比n/hを正
規化比率とし変倍処理を施す。
(a)に示すように、高さh、幅dとして決定されたと
する。このhとdとでは、hの方が大きい。そこで、こ
れを正規化サイズβ×βにする場合には、比n/hを正
規化比率とし変倍処理を施す。
すなわち、高さに対しては、矩形の高さhに対して正規
化比率fl/hを乗することは勿論、幅d対してもβ/
hを乗じて第4図(b)のような正規化サイズのパター
ンを得る(正規化処理を示す)。パターンの変倍処理自
体はドツト間を補間する処理を施せば良い。
化比率fl/hを乗することは勿論、幅d対してもβ/
hを乗じて第4図(b)のような正規化サイズのパター
ンを得る(正規化処理を示す)。パターンの変倍処理自
体はドツト間を補間する処理を施せば良い。
尚、変倍した後の幅d’ (=axg/h)は、d’
<厄であるので、その左右に(g−d’)/2の空白
部分(白画素からなる)を加え、℃×4の正規化文字矩
形サイズを得た。
<厄であるので、その左右に(g−d’)/2の空白
部分(白画素からなる)を加え、℃×4の正規化文字矩
形サイズを得た。
因に、従来の正規化処理では、注目パターンの上下左右
の空白部分を除いた文字矩形に対して正規化処理を施し
ていた。従って、その正規化処理を施した後のパターン
は第4図(C)のようになり、それがピリオドか否かを
区別がつかなくなる。
の空白部分を除いた文字矩形に対して正規化処理を施し
ていた。従って、その正規化処理を施した後のパターン
は第4図(C)のようになり、それがピリオドか否かを
区別がつかなくなる。
ところが、本実施例の正規化処理によれば、第4図(b
)に示すようになり、上部分に空白部分。
)に示すようになり、上部分に空白部分。
が存在するので、この画像から特徴量を抽出すれば、他
の特別な情報を持たせることなくピリオドとして認識さ
せることが可能となる。
の特別な情報を持たせることなくピリオドとして認識さ
せることが可能となる。
第5図(a)〜(C)はそれぞれオーバーライン、マイ
ナス記号そしてアンダーラインのパターンを正規化サイ
ズに正規化させた状態を示している。図示の様に、各パ
ターンを正規化しても、その正規化サイズ内の各々の特
徴的な位置(特徴量の1つ)は保たれたままになってい
ることがわかる。すなわち、この正規化サイズから特徴
量を抽出することにより文字の認識が可能となる。尚、
第5図(a)〜(C)の場合にも、先の第4図で説明し
たように、縦横の長さを比較し、長いものと正規化サイ
ズとの比によって正規化している。
ナス記号そしてアンダーラインのパターンを正規化サイ
ズに正規化させた状態を示している。図示の様に、各パ
ターンを正規化しても、その正規化サイズ内の各々の特
徴的な位置(特徴量の1つ)は保たれたままになってい
ることがわかる。すなわち、この正規化サイズから特徴
量を抽出することにより文字の認識が可能となる。尚、
第5図(a)〜(C)の場合にも、先の第4図で説明し
たように、縦横の長さを比較し、長いものと正規化サイ
ズとの比によって正規化している。
ところが、縦横の長さが著しく異なる文字図形では、縦
横別の倍率によって正規化を行なうと基の形や位置は、
ゆがんだものとなり、他の文字・記号との区別がつかな
かったりする。例えば、オーバーライン、マイナス記号
、アンダーライン等をこの処理で正規化すると、全て第
5図(d)のようになってしまうが、本実施例の正規化
処理によればこのようなことは発生しない。
横別の倍率によって正規化を行なうと基の形や位置は、
ゆがんだものとなり、他の文字・記号との区別がつかな
かったりする。例えば、オーバーライン、マイナス記号
、アンダーライン等をこの処理で正規化すると、全て第
5図(d)のようになってしまうが、本実施例の正規化
処理によればこのようなことは発生しない。
以上説明したように本実施例によれば、正規化したパタ
ーンは元の特徴量を保ったままにすることが可能となる
ので、文字認識処理における認識効率を向上させるいこ
とが可能となる。
ーンは元の特徴量を保ったままにすることが可能となる
ので、文字認識処理における認識効率を向上させるいこ
とが可能となる。
尚、実施例では認識対象の文書を横書きとして説明した
が、縦書きの場合には、最初にその中で最大幅を検出し
、この最大幅を個々の文字の幅として切り出すようにす
れば良い。
が、縦書きの場合には、最初にその中で最大幅を検出し
、この最大幅を個々の文字の幅として切り出すようにす
れば良い。
[発明の効果コ
以上説明したように本発明によれば、元の特徴量を保っ
たまま正規化されるので、文字の認識率を向上させるこ
とが可能となる。
たまま正規化されるので、文字の認識率を向上させるこ
とが可能となる。
第1図は実施例における文字認識装置のプロッり構成図
、 第2図の正規化部の処理内容を示すフローチャート、 第3図は文字矩形検出に係る原理を示す図、第4図(a
)は実施例の正規化処理による結果を示す図、 第4図(b)は従来の正規化処理の結果を示す図、 第5図(a)〜(c)は実施例の正規化処理による結果
を示す図、 第5図(d)は従来の正規化処理の結果を示す図である
。 図中、1・・・文書画像、2・・・文字行検出処理、3
・・・文字矩形検出処理、4・・・各文字矩形正規化処
理である。 第2図 第3図 第4図 第5図
、 第2図の正規化部の処理内容を示すフローチャート、 第3図は文字矩形検出に係る原理を示す図、第4図(a
)は実施例の正規化処理による結果を示す図、 第4図(b)は従来の正規化処理の結果を示す図、 第5図(a)〜(c)は実施例の正規化処理による結果
を示す図、 第5図(d)は従来の正規化処理の結果を示す図である
。 図中、1・・・文書画像、2・・・文字行検出処理、3
・・・文字矩形検出処理、4・・・各文字矩形正規化処
理である。 第2図 第3図 第4図 第5図
Claims (1)
- 【特許請求の範囲】 文字認識の前処理で行なう切り出し文字パターンの正規
化方式において、 正規化対象の文字記号の位置する行或いは列中の最大高
さ或いは幅の一方を基準辺とし、他辺を注目文字記号パ
ターンのドット存在幅とした矩形領域で当該注目文字記
号パターンを切り出し、この切り出された文字記号パタ
ーンを正規化するとき、正規化サイズに対する前記基準
辺の比でもつて注目文字記号パターンの高さ及び幅方向
の大きさを変倍することを特徴とするパターン正規化方
式。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP1201393A JPH0365781A (ja) | 1989-08-04 | 1989-08-04 | パターン正規化方式 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP1201393A JPH0365781A (ja) | 1989-08-04 | 1989-08-04 | パターン正規化方式 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH0365781A true JPH0365781A (ja) | 1991-03-20 |
Family
ID=16440346
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP1201393A Pending JPH0365781A (ja) | 1989-08-04 | 1989-08-04 | パターン正規化方式 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH0365781A (ja) |
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH07152864A (ja) * | 1991-08-07 | 1995-06-16 | Hokkaido Prefecture | 手書き英数字認識のための図形作成方式 |
-
1989
- 1989-08-04 JP JP1201393A patent/JPH0365781A/ja active Pending
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH07152864A (ja) * | 1991-08-07 | 1995-06-16 | Hokkaido Prefecture | 手書き英数字認識のための図形作成方式 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US5212739A (en) | Noise tolerant optical character recognition system | |
| US20030063802A1 (en) | Image processing method, apparatus and system | |
| WO2007022460A2 (en) | Post-ocr image segmentation into spatially separated text zones | |
| JP2019016350A (ja) | 電子文書における強調テキストの識別 | |
| Liebl et al. | From historical newspapers to machine-readable data: The origami ocr pipeline | |
| WO2011112497A2 (en) | Resolution adjustment of an image that includes text undergoing an ocr process | |
| JPH0410087A (ja) | 基本ライン抽出方法 | |
| JP2000090194A (ja) | 画像処理方法および画像処理装置 | |
| JPS6132187A (ja) | 文字認識方式 | |
| JP3476595B2 (ja) | 画像領域分割方法、および画像2値化方法 | |
| Shyna et al. | BrailleSegNet: A novel methodology for Braille dataset generation and character segmentation | |
| JP3223878B2 (ja) | 文字列照合装置、方法及び記録媒体 | |
| JP4847378B2 (ja) | 画像処理装置、画像処理方法、プログラム及びコンピュータ読取可能な記録媒体 | |
| JP2612383B2 (ja) | 文字認識処理方式 | |
| Wang et al. | A new method of character line extraction from mixed-unformatted document image for Japanese mail address recognition | |
| JP3091278B2 (ja) | 文書認識方式 | |
| JPH0697470B2 (ja) | 文字列抽出装置 | |
| JPH05159062A (ja) | 文書認識装置 | |
| Kathirvalavakumar et al. | Efficient touching text line segmentation in tamil script using horizontal projection | |
| JPH04241074A (ja) | 自動文書清書装置 | |
| JP2962525B2 (ja) | テキストブロック認識方法 | |
| JPH0415776A (ja) | 文字のサイズ情報抽出方法 | |
| Maderlechner et al. | Information extraction from document images using white space and graphics analysis | |
| JPH03210688A (ja) | 行検出装置 | |
| Haralick et al. | Document Structural Decomposition |