JPH0259513B2 - - Google Patents
Info
- Publication number
- JPH0259513B2 JPH0259513B2 JP57234691A JP23469182A JPH0259513B2 JP H0259513 B2 JPH0259513 B2 JP H0259513B2 JP 57234691 A JP57234691 A JP 57234691A JP 23469182 A JP23469182 A JP 23469182A JP H0259513 B2 JPH0259513 B2 JP H0259513B2
- Authority
- JP
- Japan
- Prior art keywords
- result
- character
- recognition
- post
- processing
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Expired
Links
- 238000012805 post-processing Methods 0.000 claims description 23
- 238000000605 extraction Methods 0.000 claims description 3
- 239000000284 extract Substances 0.000 claims description 2
- 238000003672 processing method Methods 0.000 claims 1
- 238000012937 correction Methods 0.000 description 8
- 238000000034 method Methods 0.000 description 7
- 238000012545 processing Methods 0.000 description 5
- 230000006870 function Effects 0.000 description 1
- 238000007429 general method Methods 0.000 description 1
Landscapes
- Character Discrimination (AREA)
Description
【発明の詳細な説明】
(A) 発明の技術分野
本発明は、文字認識装置における後処理方式、
特に認識手段によつて複数個の候補を出力した上
で、その候補の中から真の認識結果を選択する後
処理を行うに当つて、先に認識された結果を辞書
として利用するようにした文字認識装置における
後処理方式に関するものである。
特に認識手段によつて複数個の候補を出力した上
で、その候補の中から真の認識結果を選択する後
処理を行うに当つて、先に認識された結果を辞書
として利用するようにした文字認識装置における
後処理方式に関するものである。
(B) 技術の背景と問題点
従来から、上述の如き後処理を行うに当つて
は、(i)認識対象が例えば住所名や商品名などの如
く限定されている場合には当該住所名などを辞書
としてもち単語単位で後処理を行う方式や、(ii)一
般的な例えば日本語辞書をもち後処理を行う方式
が知られている。
は、(i)認識対象が例えば住所名や商品名などの如
く限定されている場合には当該住所名などを辞書
としてもち単語単位で後処理を行う方式や、(ii)一
般的な例えば日本語辞書をもち後処理を行う方式
が知られている。
しかし、前者の方式の場合には予め限定された
単語の範囲内においてしか使用できないものであ
り、後者の場合には日本語辞書を記憶する大容量
のメモリを必要とすると共に後処理時間がきわめ
て大となる。
単語の範囲内においてしか使用できないものであ
り、後者の場合には日本語辞書を記憶する大容量
のメモリを必要とすると共に後処理時間がきわめ
て大となる。
(C) 発明の目的と構成
本発明は、上記後処理を効率よく行うようにす
ることを目的としており、本発明の文字認識装置
における後処理方式は、認識されるべき文字を入
力する文字入力手段と、該文字の特徴を抽出する
特徴抽出手段と、抽出された特徴を予め登録され
ている辞書の内容と照合して認識結果候補を順次
出力する認識手段とを備えた文字認識装置におい
て、認識結果を修正する後処理機構をもうけると
共に、該後処理機構は、先に認識された結果の複
数個の文字群を文章辞書として保持する結果メモ
リと、新らたに抽出された上記認識結果候補が上
記結果メモリの内容中のいずれかの文字と最長一
致の概念で一致するか否かを調べかつ一致する文
字にもとづいて上記認識結果候補から真の結果を
得る後処理部を有し、先に認識された結果を利用
して新らたに抽出された認識結果候補から真の結
果を得るようにしたことを特徴としている。以下
図面を参照しつつ説明する。
ることを目的としており、本発明の文字認識装置
における後処理方式は、認識されるべき文字を入
力する文字入力手段と、該文字の特徴を抽出する
特徴抽出手段と、抽出された特徴を予め登録され
ている辞書の内容と照合して認識結果候補を順次
出力する認識手段とを備えた文字認識装置におい
て、認識結果を修正する後処理機構をもうけると
共に、該後処理機構は、先に認識された結果の複
数個の文字群を文章辞書として保持する結果メモ
リと、新らたに抽出された上記認識結果候補が上
記結果メモリの内容中のいずれかの文字と最長一
致の概念で一致するか否かを調べかつ一致する文
字にもとづいて上記認識結果候補から真の結果を
得る後処理部を有し、先に認識された結果を利用
して新らたに抽出された認識結果候補から真の結
果を得るようにしたことを特徴としている。以下
図面を参照しつつ説明する。
(D) 発明の実施例
第1図A,Bは一連の日本語文が複数枚の帳票
にわたつて記述されている例、第2図は第1図A
図示の帳票を認識し修正した結果の例、第3図は
第1図B図示の帳票を認識手段によつて認識した
ナマの結果の例、第4図は本発明にもとづいて後
処理された結果例、第5図は本発明の一実施例構
成、第6図は第5図図示の後処理部において実行
される一実施例処理を示す。
にわたつて記述されている例、第2図は第1図A
図示の帳票を認識し修正した結果の例、第3図は
第1図B図示の帳票を認識手段によつて認識した
ナマの結果の例、第4図は本発明にもとづいて後
処理された結果例、第5図は本発明の一実施例構
成、第6図は第5図図示の後処理部において実行
される一実施例処理を示す。
一般に日本語文の場合には、文章内で同一の単
語や表現が繰返して現われることが生じる。本発
明においては、この点を利用するようにしてい
る。今第1図A,Bに示す如き帳票が存在し、こ
れを認識するものとして説明する。そして、第1
図Aに示す帳票が第2図図示の如く認識されたと
する。なお、第2図図示の結果は、本発明にいう
認識手段によつて認識されたナマの結果を表示修
正部によつて修正された正しい結果であるとす
る。
語や表現が繰返して現われることが生じる。本発
明においては、この点を利用するようにしてい
る。今第1図A,Bに示す如き帳票が存在し、こ
れを認識するものとして説明する。そして、第1
図Aに示す帳票が第2図図示の如く認識されたと
する。なお、第2図図示の結果は、本発明にいう
認識手段によつて認識されたナマの結果を表示修
正部によつて修正された正しい結果であるとす
る。
この状態の下で、第1図B図示の帳票を認識す
るに当つて、認識手段によるナマの認識結果が、
第3図図示のものであつた場合を考える。なお各
文字毎に、図示の場合、第1位の候補と第2位の
候補とが得られている。以下候補をK(k)の
如き形で特定するが、これは、第1図B図示の帳
票上の第番目の文字についての第k位の候補で
あることを表わす。また第1図A図示の帳票上の
真の認識結果、即ち第2図に示す認識結果に対し
てDjの如き形で特定するが、これは第2図図示
の認識結果の第j番目の結果を指示する。
るに当つて、認識手段によるナマの認識結果が、
第3図図示のものであつた場合を考える。なお各
文字毎に、図示の場合、第1位の候補と第2位の
候補とが得られている。以下候補をK(k)の
如き形で特定するが、これは、第1図B図示の帳
票上の第番目の文字についての第k位の候補で
あることを表わす。また第1図A図示の帳票上の
真の認識結果、即ち第2図に示す認識結果に対し
てDjの如き形で特定するが、これは第2図図示
の認識結果の第j番目の結果を指示する。
最初K(、1)について、第2図図示の結果
の上で同一の文字が存在するか否かを調べてゆ
く。なお、図示の場合K(、1)は文字「手」
である。該K(、1)の場合にはD10と一致す
る。次にK(、1)とD11との照合を調べると、
この場合には等しくない。したがつてK(、2)
とD11との照合を行う。この場合には等しいの
で、第番目の認識結果は「書」であるものと考
えるようにされる。同様に第番目は「き」とさ
れる。次にK(、1)≠D13でありかつK(、
2)≠D13であることから、一連の処理は第番
目までで終了され、第番目からは新らたに処理
を開始する。つまり、K(、1)と等しいもの
を第2図図示の結果から探す。この場合、K(、
1)については一致するものが存在しないことか
ら、次にK(、2)と同じものを探す。この結
果K(、2)=D100が見出され、またK(、1)
=D101が得られ、第番目の文字は「漢」である
とされる。更にK(、1)=D119となるが、K
(、1)≠D120でかつK(、2)≠D120である
ことから、第番目の文字の修正は行われない。
このようにして、第4図図示の結果が得られる。
の上で同一の文字が存在するか否かを調べてゆ
く。なお、図示の場合K(、1)は文字「手」
である。該K(、1)の場合にはD10と一致す
る。次にK(、1)とD11との照合を調べると、
この場合には等しくない。したがつてK(、2)
とD11との照合を行う。この場合には等しいの
で、第番目の認識結果は「書」であるものと考
えるようにされる。同様に第番目は「き」とさ
れる。次にK(、1)≠D13でありかつK(、
2)≠D13であることから、一連の処理は第番
目までで終了され、第番目からは新らたに処理
を開始する。つまり、K(、1)と等しいもの
を第2図図示の結果から探す。この場合、K(、
1)については一致するものが存在しないことか
ら、次にK(、2)と同じものを探す。この結
果K(、2)=D100が見出され、またK(、1)
=D101が得られ、第番目の文字は「漢」である
とされる。更にK(、1)=D119となるが、K
(、1)≠D120でかつK(、2)≠D120である
ことから、第番目の文字の修正は行われない。
このようにして、第4図図示の結果が得られる。
第5図は本発明の一実施例構成を示している。
図中1は、観測部であつて、第1図A,B図示の
如き帳票を読取る。2は、特徴抽出部(手段)で
あつて、従来公知の如く、各文字毎に当該文字の
特徴を抽出する。3は、認識辞書であつて、標準
文字の特徴とそのカテゴリ名とが格納されてい
る。4は、認識部(手段)であつて、特徴抽出部
2から供給された文字の特徴と認識辞書3から読
出されてくる標準文字の特徴との照合を行い、1
つの文字について第3図図示の例で言えば第1位
候補と第2位候補とを出力する。5は、候補メモ
リであつて、第3図図示の如く、第番目の文字
に対応する候補を夫々格納する。6は、表示修正
制御部であつて、例えば最初の帳票上の文字に関
して、候補メモリ5から各文字毎の複数の候補を
読込んで、表示・修正部7に表示せしめる。また
上記候補にもとづいて得られた真の結果(第2図
図示の如きもの)を結果メモリ(文章辞書)9に
格納する。7は、表示・修正部であつて、認識さ
れつつある文字や候補や修正結果などが表示さ
れ、必要に応じてオペレータによつて正しい文字
を選定したりする機能をもつている。8は、後処
理部であつて、候補メモリ5の内容について結果
メモリ9の内容にもとづいて、第2図ないし第4
図に関連して説明した如き形で後処理を行う。9
は、結果メモリ(文章辞書)であつて、正しい形
で認識された結果が第2図図示の如く格納されて
後処理のために利用させるものである。
図中1は、観測部であつて、第1図A,B図示の
如き帳票を読取る。2は、特徴抽出部(手段)で
あつて、従来公知の如く、各文字毎に当該文字の
特徴を抽出する。3は、認識辞書であつて、標準
文字の特徴とそのカテゴリ名とが格納されてい
る。4は、認識部(手段)であつて、特徴抽出部
2から供給された文字の特徴と認識辞書3から読
出されてくる標準文字の特徴との照合を行い、1
つの文字について第3図図示の例で言えば第1位
候補と第2位候補とを出力する。5は、候補メモ
リであつて、第3図図示の如く、第番目の文字
に対応する候補を夫々格納する。6は、表示修正
制御部であつて、例えば最初の帳票上の文字に関
して、候補メモリ5から各文字毎の複数の候補を
読込んで、表示・修正部7に表示せしめる。また
上記候補にもとづいて得られた真の結果(第2図
図示の如きもの)を結果メモリ(文章辞書)9に
格納する。7は、表示・修正部であつて、認識さ
れつつある文字や候補や修正結果などが表示さ
れ、必要に応じてオペレータによつて正しい文字
を選定したりする機能をもつている。8は、後処
理部であつて、候補メモリ5の内容について結果
メモリ9の内容にもとづいて、第2図ないし第4
図に関連して説明した如き形で後処理を行う。9
は、結果メモリ(文章辞書)であつて、正しい形
で認識された結果が第2図図示の如く格納されて
後処理のために利用させるものである。
第5図図示の後処理部8における処理は、第2
図ないし第4図を参照して説明した所であるが、
より詳細には、第6図図示の一実施例処理の如く
処理が行われる。第6図図示のIは第3図図示の
、…などのナンバに対応し、Jは第2図図示
の1、2、…、120の如きナンバに対応している。
ちなみに、図示ルートは、上記第2位の候補に
もとづいて照合が行われるルートに対応してい
る。
図ないし第4図を参照して説明した所であるが、
より詳細には、第6図図示の一実施例処理の如く
処理が行われる。第6図図示のIは第3図図示の
、…などのナンバに対応し、Jは第2図図示
の1、2、…、120の如きナンバに対応している。
ちなみに、図示ルートは、上記第2位の候補に
もとづいて照合が行われるルートに対応してい
る。
(E) 発明の効果
以上説明した如く、本発明によれば、後処理の
ために持つべき辞書の容量がいわば一連の文章の
単位で足り、一般の日本語辞書をもつことにくら
べて、きわめて小さい容量のもので済む。また、
処理効率もすぐれている。更に単語単位でなく文
章などの単位で修正を行うことが可能となり、後
処理の精度が大きく向上する。
ために持つべき辞書の容量がいわば一連の文章の
単位で足り、一般の日本語辞書をもつことにくら
べて、きわめて小さい容量のもので済む。また、
処理効率もすぐれている。更に単語単位でなく文
章などの単位で修正を行うことが可能となり、後
処理の精度が大きく向上する。
第1図A,Bは一連の日本語文が複数枚の帳票
にわたつて記述されている例、第2図は第1図A
図示の帳票を認識し修正した結果の例、第3図は
第1図B図示の帳票を認識手段によつて認識した
ナマの結果の例、第4図は本発明にもとづいて後
処理された結果例、第5図は本発明の一実施例構
成、第6図は第5図図示の後処理部において実行
される一実施例処理を示す。 図中、1は観測部、2は特徴抽出部、3は認識
辞書、4は認識部、5は候補メモリ、6は表示修
正制御部、7は表示・修正部、8は後処理部、9
は結果メモリ(文章辞書)を表わす。
にわたつて記述されている例、第2図は第1図A
図示の帳票を認識し修正した結果の例、第3図は
第1図B図示の帳票を認識手段によつて認識した
ナマの結果の例、第4図は本発明にもとづいて後
処理された結果例、第5図は本発明の一実施例構
成、第6図は第5図図示の後処理部において実行
される一実施例処理を示す。 図中、1は観測部、2は特徴抽出部、3は認識
辞書、4は認識部、5は候補メモリ、6は表示修
正制御部、7は表示・修正部、8は後処理部、9
は結果メモリ(文章辞書)を表わす。
Claims (1)
- 1 認識されるべき文字を入力する文字入力手段
と、該文字の特徴を抽出する特徴抽出手段と、抽
出された特徴を予め登録されている辞書の内容と
照合して認識結果候補を順次出力する認識手段と
を備えた文字認識装置において、認識結果を修正
する後処理機構をもうけると共に、該後処理機構
は、先に認識された結果の複数個の文字群を文章
辞書として保持する結果メモリと、新らたに抽出
された上記認識結果候補が上記結果メモリの内容
中のいずれかの文字と最長一致の概念で一致する
か否かを調べかつ一致する文字にもとづいて上記
認識結果候補から真の結果を得る後処理部を有
し、先に認識された結果を利用して新らたに抽出
された認識結果候補から真の結果を得るようにし
たことを特徴とする文字認識装置における後処理
方式。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP57234691A JPS59117673A (ja) | 1982-12-24 | 1982-12-24 | 文字認識装置における後処理方式 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP57234691A JPS59117673A (ja) | 1982-12-24 | 1982-12-24 | 文字認識装置における後処理方式 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPS59117673A JPS59117673A (ja) | 1984-07-07 |
| JPH0259513B2 true JPH0259513B2 (ja) | 1990-12-12 |
Family
ID=16974909
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP57234691A Granted JPS59117673A (ja) | 1982-12-24 | 1982-12-24 | 文字認識装置における後処理方式 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS59117673A (ja) |
Families Citing this family (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS62105292A (ja) * | 1985-10-31 | 1987-05-15 | Toshiba Corp | 光学的文字認識装置 |
| JPH07120396B2 (ja) * | 1986-09-11 | 1995-12-20 | 富士通株式会社 | 文書読み取り装置 |
| JP2520289B2 (ja) * | 1988-11-01 | 1996-07-31 | 有限会社池上パテントインキュベーター | 認識方法、認識装置および同装置を有する情報装置 |
-
1982
- 1982-12-24 JP JP57234691A patent/JPS59117673A/ja active Granted
Also Published As
| Publication number | Publication date |
|---|---|
| JPS59117673A (ja) | 1984-07-07 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| USRE26429E (en) | Information retrieval system and method | |
| JPS6359660A (ja) | 情報処理装置 | |
| JPS59117673A (ja) | 文字認識装置における後処理方式 | |
| Prutskov | Algorithmic provision of a universal method for word-form generation and recognition | |
| US6714906B1 (en) | Rapid phase identification method | |
| JPS59229683A (ja) | 認識処理装置 | |
| JPS63138479A (ja) | 文字認識装置 | |
| JPH0438026B2 (ja) | ||
| JP2839515B2 (ja) | 文字読取システム | |
| JPH0355874B2 (ja) | ||
| JPS63103393A (ja) | 単語認識装置 | |
| JPH0226268B2 (ja) | ||
| JPH11120294A (ja) | 文字認識装置および媒体 | |
| JPS61133487A (ja) | 文字認識装置 | |
| JPH0576675B2 (ja) | ||
| JP2637762B2 (ja) | パターン詳細同定方式 | |
| JPS62107390A (ja) | パタ−ン認識装置 | |
| JPH05298489A (ja) | 文字認識方式 | |
| JPH04340686A (ja) | 文字認識後処理用氏名辞書 | |
| JPS6175467A (ja) | 仮名漢字変換方式 | |
| JPH04278664A (ja) | 住所解析処理装置 | |
| JPS62154169A (ja) | かな漢字変換装置の辞書検索方法 | |
| JPH02308384A (ja) | 住所認識装置 | |
| JPS58106663A (ja) | 文字認識装置における修正処理方式 | |
| JPS63298492A (ja) | 文字認識後処理装置 |