JPH0252315B2 - - Google Patents

Info

Publication number
JPH0252315B2
JPH0252315B2 JP56177719A JP17771981A JPH0252315B2 JP H0252315 B2 JPH0252315 B2 JP H0252315B2 JP 56177719 A JP56177719 A JP 56177719A JP 17771981 A JP17771981 A JP 17771981A JP H0252315 B2 JPH0252315 B2 JP H0252315B2
Authority
JP
Japan
Prior art keywords
dictionary
font
characters
accumulator
character
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Expired
Application number
JP56177719A
Other languages
English (en)
Other versions
JPS5878276A (ja
Inventor
Masaki Komya
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Toshiba Corp
Original Assignee
Tokyo Shibaura Electric Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Tokyo Shibaura Electric Co Ltd filed Critical Tokyo Shibaura Electric Co Ltd
Priority to JP56177719A priority Critical patent/JPS5878276A/ja
Publication of JPS5878276A publication Critical patent/JPS5878276A/ja
Publication of JPH0252315B2 publication Critical patent/JPH0252315B2/ja
Granted legal-status Critical Current

Links

Classifications

    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06VIMAGE OR VIDEO RECOGNITION OR UNDERSTANDING
    • G06V30/00Character recognition; Recognising digital ink; Document-oriented image-based pattern recognition
    • G06V30/10Character recognition
    • G06V30/24Character recognition characterised by the processing or recognition method
    • G06V30/242Division of the character sequences into groups prior to recognition; Selection of dictionaries

Landscapes

  • Engineering & Computer Science (AREA)
  • Computer Vision & Pattern Recognition (AREA)
  • Physics & Mathematics (AREA)
  • General Physics & Mathematics (AREA)
  • Multimedia (AREA)
  • Theoretical Computer Science (AREA)
  • Character Input (AREA)
  • Character Discrimination (AREA)

Description

【発明の詳細な説明】 この発明は特に辞書の選択方式を改良した光学
的文字読取装置に関する。
現在、英文ワードプロセツサの入力用の光学的
文字読取装置(以下OCRという)が普及しつつ
ある。しかしながら、従来、上記のようなOCR
で読取れる文字種は、ほとんどの場合OCR用字
体に限られており、通常用いられオフイスフオン
トを使用できるものは少なかつた。また、各種フ
オントを読取れるマルチフオント用OCRは価格
がワードプロセツサに比べて非常に高いためバラ
ンスがとれず、ワードプロセツサの入力用の
OCRとしては不向きであつた。さらに、マルチ
フオント用のOCRを用いた場合、プログラム又
はスイツチによつてフオントを選択する必要があ
つた。
この発明は上記のような事情に鑑みてなされた
もので、予め定められた帳票上の文字に基づき読
取用の辞書の切換えを行ない、複数種のフオント
を読取ることができる光学的文字読取装置を提供
することを目的とする。
以下、図面を参照してこの発明の一実施例を説
明する。第1図はこの発明の一実施例の概略構成
図である。図中、符号1は光電変換部を示してい
る。この光電変換部1は、帳票上の文字を光電変
換し、光電変換された文字パターンとして出力す
る機能を持つている。符号2は認識部を示してい
る。この認識部2は、上記光電変換された文字パ
ターンの認識を行なう機能を持つている。符号3
は辞書インデツクステーブルを示している。この
辞書インデツクステーブル3は、各種フオントに
対応する辞書の対応格納領域の先頭番地を記憶し
ている。符号4はマルチフオント辞書を示してい
る。このマルチフオント辞書4は、複数の各フオ
ント毎に独立した辞書から構成されている。符号
5はアキユムレータを示している。このアキユム
レータ5は、帳票における第1行目の文字につい
て、マルチフオント辞書4における各フオント毎
の辞書における標準パターンとマツチング結果の
類似度値が記憶されるようになつている。
次に、上記実施例の動作を説明する。まず、こ
のOCRで使用される帳票には、第2図に示すよ
うに、帳票の第1行目に、その帳票で使用される
フオントで予め定められた特定の文字配列、この
場合文字列ABCを印字しておく。なお文字のフ
オントの種類には、Courier12,Courier72,
Prestige Elite72,Prestige Pica等がある。そし
て第2行目以下は、同一フオントで自由にデータ
や文章を印字するようにする。
このような帳票における文字は、光電変換部1
で光電変換される。このとき、まず帳票における
第1行目に印字された特定の文字が光電変換され
る。認識部2は、辞書インデツクステーブル3の
内容を参照して、マルムフオント辞書4内の1つ
の辞書から、上記第1行目に印字された文字に対
応する標準パターンを読み出し、この読み出され
た標準パターンと、上記第1行目の光電変換され
た文字パターンとのマツチングを行なう。そし
て、このマツチングの結果であるこの場合第1行
目の3文字の類似度値の和が、アキユムレータ5
に記憶される。さらに、上記同様な動作が、マル
チフオント辞書4における各辞書毎にくり返して
行なわれ、各辞書毎のマツチング結果である上記
3文字の類似度値の和が順次アキユムレータ5に
記憶される。このようにして、アキユムレータ5
に記憶されたマルチフオント辞書4における各辞
書毎の類似度値の和について比較が認識部2で行
なわれる。この際、最も類似度値の和の大きかつ
た辞書がマルチフオント辞書4から選択される。
そして、2行目以降は、選択された辞書により
認識を行なつていく。この場合、途中の行で、認
識不能文字が多発した場合には、その行について
再度辞書の選択を行なう。これは、認識不能文字
数の数、その行における各文字の類似度値に基づ
き辞書の選択を行なうものである。
したがつて、このようなOCRでは次のような
効果を奏する。
(1) 辞書を選択するために必要とする文字が決め
られており、各辞書から読み出してくる標準文
字パターンが限定されているので、辞書の選択
に要する時間が少なくて済む。
(2) 各種フオントのミツクスマルチ辞書を作るの
に比べ、辞書の作成が、各フオント毎の単独の
辞書を寄せ集めたものでよく、また類似文字の
発生も考慮しなくてよいので容易である。
(3) ミツクスマルチ辞書に比較して、高精度の読
取りが可能であり、同時に認識時間の高速化が
可能である。
(4) オペレータは、帳標の第1行目にその時に使
用するタイプヘツドで予め定められた該当する
文字列を印字するだけでよいので負担がかから
ない。
(5) マルチフオント辞書4には、必要なフオント
の辞書のみを組み合わせて構成できるのでオプ
シヨン化が容易に行なえる。
以上述べたようにこの発明によれば、予め定め
られた帳票上の文字に基づき読取用の辞書の切換
えを行ない、複数種のフオントを読取ることがで
きる光学的文字読取装置を提供することができ
る。
【図面の簡単な説明】
第1図はこの発明の一実施例の概略構成図、第
2図は同実施例に使用される帳票を示す図であ
る。 1……光電変換部、2……認識部、3……辞書
インデツクステーブル、4……マルチフオント辞
書、5……アキユムレータ。

Claims (1)

    【特許請求の範囲】
  1. 1 帳票上の文字を光電変換する光電変換部と、
    各フオントに対応した複数の辞書から構成さるる
    マルチフオント辞書と、上記帳票上の特定位置に
    おける特定文字の光電変換された文字パターンに
    ついて上記複数の辞書各々を参照して求められた
    類似度値が各辞書毎に記憶されるアキユムレータ
    と、上記類似度値を求めると共に上記アキユムレ
    ータに記憶された最も高い類似度値に相当する辞
    書を上記マルチフオント辞書から選択し、選択さ
    れた辞書を参照して光電変換された文字パターン
    の認識を行なう認識手段とを具備したことを特徴
    とする光学的文字読取装置。
JP56177719A 1981-11-05 1981-11-05 光学的文字読取装置 Granted JPS5878276A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP56177719A JPS5878276A (ja) 1981-11-05 1981-11-05 光学的文字読取装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP56177719A JPS5878276A (ja) 1981-11-05 1981-11-05 光学的文字読取装置

Publications (2)

Publication Number Publication Date
JPS5878276A JPS5878276A (ja) 1983-05-11
JPH0252315B2 true JPH0252315B2 (ja) 1990-11-13

Family

ID=16035908

Family Applications (1)

Application Number Title Priority Date Filing Date
JP56177719A Granted JPS5878276A (ja) 1981-11-05 1981-11-05 光学的文字読取装置

Country Status (1)

Country Link
JP (1) JPS5878276A (ja)

Families Citing this family (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2574776B2 (ja) * 1986-10-24 1997-01-22 株式会社日立製作所 文字認識方法

Also Published As

Publication number Publication date
JPS5878276A (ja) 1983-05-11

Similar Documents

Publication Publication Date Title
US4669901A (en) Keyboard device for inputting oriental characters by touch
JP3139521B2 (ja) 自動言語決定装置
US5438657A (en) Document processing apparatus for extracting a format from one document and using the extracted format to automatically edit another document
US4228507A (en) Methods and means for reproducing non-alphabetic characters
US4597056A (en) Language translator having circuitry for retrieving full words after single letter input
GB2033633A (en) Ideographic coding
JP2740335B2 (ja) 自動セル属性判定機能を有する表読取装置
JPS60254366A (ja) ワ−ドプロセツサ
JPS5878276A (ja) 光学的文字読取装置
JPS5822767B2 (ja) 和文タイプライタ
JPS63219061A (ja) 文字処理装置
JP3025382B2 (ja) 文書処理装置
JPS6120887B2 (ja)
JP2907947B2 (ja) 光学文字読取システム
JP2819612B2 (ja) 文字変換装置
JPH0346857B2 (ja)
JP2634926B2 (ja) かな漢字変換装置
JPS63136253A (ja) かな漢字変換の入力方式
JPS5951015B2 (ja) 文書作成装置
JPH0514952B2 (ja)
JP3217442B2 (ja) 光学的文字読み取り装置
JP2506714B2 (ja) 手書き風日本語文書出力装置
KR940009451B1 (ko) 한글코드 변환방법
JPH03110563U (ja)
JPS6019236A (ja) 記録装置