JPS5894066A - 文字認識装置 - Google Patents

文字認識装置

Info

Publication number
JPS5894066A
JPS5894066A JP56190500A JP19050081A JPS5894066A JP S5894066 A JPS5894066 A JP S5894066A JP 56190500 A JP56190500 A JP 56190500A JP 19050081 A JP19050081 A JP 19050081A JP S5894066 A JPS5894066 A JP S5894066A
Authority
JP
Japan
Prior art keywords
dictionary
character
slip
characters
read
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP56190500A
Other languages
English (en)
Inventor
Yoshiyuki Yamashita
山下 義征
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Oki Electric Industry Co Ltd
Original Assignee
Oki Electric Industry Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Oki Electric Industry Co Ltd filed Critical Oki Electric Industry Co Ltd
Priority to JP56190500A priority Critical patent/JPS5894066A/ja
Publication of JPS5894066A publication Critical patent/JPS5894066A/ja
Pending legal-status Critical Current

Links

Classifications

    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F18/00Pattern recognition
    • G06F18/20Analysing
    • G06F18/28Determining representative reference patterns, e.g. by averaging or distorting; Generating dictionaries

Landscapes

  • Engineering & Computer Science (AREA)
  • Data Mining & Analysis (AREA)
  • Theoretical Computer Science (AREA)
  • Computer Vision & Pattern Recognition (AREA)
  • Bioinformatics & Cheminformatics (AREA)
  • Bioinformatics & Computational Biology (AREA)
  • Artificial Intelligence (AREA)
  • Evolutionary Biology (AREA)
  • Evolutionary Computation (AREA)
  • Physics & Mathematics (AREA)
  • General Engineering & Computer Science (AREA)
  • General Physics & Mathematics (AREA)
  • Life Sciences & Earth Sciences (AREA)
  • Character Discrimination (AREA)

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 本発明は高速で精度の良い文字認識装置に関するもので
ある。
従来文字認識装置において、手書文字については筆者の
違いによる文字線の傾斜等、又印刷文字については印字
の傾斜による文字線の傾斜等による特徴のばらつきを吸
収するため辞書マスクの複数化の手段により前記特徴の
ばらつきを吸収していた。しかしながら、この手段は識
別を行なう際の抽出した特徴と辞書との照合の時間が辞
書マスクの数に比例して増大し、装置の処理速度の低下
を招いていた。そこで、この欠点を除去するため、文字
サンプルをあらかじめ読取ることにより専用辞書を作成
し、該辞書を使用して文字を認識する装置が提案されて
いる。しかしながら通常の文字認識装置においては、多
数の帳票を連続的に読取ることが多く、手書文字の場合
は帳票毎に筆者が違う場合が多く、又印刷文字の場合は
張票毎に印刷条件が違う場合が多く、前記あらかじめ文
字サンプルを読取ることは事実上不可能な場合が多い。
本発明はこのような従来の欠点を除去する為に、帳票1
枚を単位とし、最初の!文字の読取シ中に各文字線の傾
斜を抽出して、当該帳票専用辞書を作成し、前記I文字
以降の読取シは前記専用辞書を使用して行なうようにし
だもので、その目的とするところは高速で精度の良い文
字認識装置を提供することにある。
第1図は本発明手書文字認識装置における一実施例の構
成図である。図において、1は光電変換部、2は・母タ
ーンレジスタ、3は線幅計算部、4は文字枠検出部、i
は文字枠分割決定部、6はサブ・母ターン抽出部、7は
特徴7トリクス抽出部、8は識別部、9は制御部、lO
はメモリ部、11は文字名出力、12はストローク抽出
部、13は平均角度計算部、14は帳票吸入機構部であ
る。
次に、その動作について述べる。
帳票吸入機構部14は帳票を1枚吸入する度に帳票吸入
信号を制御部9へ送出する。制御部9は帳票吸入信号を
受は取ると、メモリ部10よりあらかじめ用意した、当
該読取り中の帳票専用辞書を作成する為の元になる辞書
(以後元辞書と称する)を読出し識別部8へ送出する。
本発明の実施例において元辞書は水平特徴71・め特徴
7トリクスマスク、左斜め特徴7トリクスマスクについ
てそれぞれ3種類の平均角度に対応するマスクを用意し
た。但し水平特徴7トリクスは水平サブパターンよシ、
垂直特徴マI・リクスは垂直サブ・母ターンより、右斜
め特徴7トリクスは右斜めサブ・母ターンより、左斜め
特徴7トリクスは左斜めサブ・母ターンより夫々抽出す
る特徴7トリクスであり、その抽出方法は後述する。
各特徴7トリクスマスクの3種類とは平均角度がそれぞ
れ、 θ□<−0,25,−0,2s <θ□(:0.25 
、0.25≦θ□の3種類θ、 <−0,25,−0,
25<θ、<0.25 、0.25<θ7の3種類θR
<0.7 、0.7<θ、(1,4、1,4<08の3
種類θ、<−1,4,−1,4<θ、 (−0,7、−
0,7≦θ、の3種類に対応するマスクを用意した。(
平均角度については後述する。) 読取機構にセットされた帳票上の文字は光電変換部1に
おいて2値の量子化されたディノタル電気信号に変換さ
れ、パターンレノスタ2に格納される。それと同時に、
線幅計算部3において入カッeターンの線幅(W)が計
算される。サプノeターン抽出部6は、ノ母ターンレジ
スタについて垂直スキャンを全血行なって、黒ピットの
連続長さと線幅計算部3において計算された線幅との関
係より垂直サブ・ぐターン(vsp)を抽出する。同様
に、水平スキャンにより水平サブツクター/(H4F)
を、右斜め45°スキヤンにより右斜めサブパターン(
H8F)を、左斜め45°スキヤンによシ左斜めサプノ
リ−ン(LSP)を抽出する。第2図は原・ンターンと
各サブ・母ターンの例で(a)は原・ンター7、(b)
は垂直サブパター7 (VSP)、(c)は水平サブパ
ターン(H4F)、(d)は右斜めサブパターン(H8
F) 、(e)は左斜めサブ2やターン(LSP)であ
る。
ストローク抽出部12は各サプノ4’ターンレジスタを
水平又は垂直ス曵ヤンを全血行ない、白点から黒点(文
字線部を黒点とする)、黒点から白点への変化点を検出
し、1列(又は行)前のスキャンにおける変化点個数と
変化点座標と現列(又は行)の変化点個数と変化点座標
の関係よりストロークを抽出し、抽出した各サブ・ぜタ
ー7レノスタ内のストロークの両端点の・やターンレノ
スタで定義すれる2次元座標系における座標(パターン
レノスタの左下を原点とする。)を平均角度計算部13
へ送出する。平均角度計算部13はストローク袖出部1
2において抽出したサツi!ターンレジスタ内のストロ
ークの両端点座標を診照し、各サブパターン毎に平均角
度を計算する。即ち水平サブパターンよシ抽出したスト
ロークの両端点座標を(HXSp、 HYS、) 、 
(HXFJ、 、 HYE、)、但しp=1.・・・P
%  Pはストローク数として、(1)式により平均角
度θ8を計算する。(但しHXE、)HXS、 )同様
に09.θ8.θ、を(2)〜(4)式によシ計算す・
る。但しVYE、)VYSl、  RXEt)RXSt
、  LXEk>LXS、とする。
に 但し上記式中Q、L、にはそれぞれ垂直サブパターン右
斜めサブ・母ターン、左斜めサブパターンより抽出した
ストローク数である。平均角度計算部13は上記式によ
り計算した各サブノやターンの平均角度を制御部9へ送
出する。
文字枠検出部4はパターンレジスタ2内の文字・母ター
ンに外接する文字枠を検出し、その結果を文字枠分割決
定部5へ送る。文字枠分割決定部は検出された文字枠内
をMXNの領域(M、Nは整数、本実施例ではM=N=
5 )に分割するためのX軸、Y軸上の分割点座標を決
定する。ここでX軸は文字枠の水平方向を、Y軸は垂直
方向をそれぞれ示す。
特徴ゴー・リクス抽出部7は、文字枠分割決定部5によ
り決定された分割点座標によりVSP、H8P。
R8P 、 LSPの各サブノEターンレソスタ上の文
字枠領域をMXNの領域に分割し、各領域の黒ビット数
B1.を計数し、線幅Wを使用して式(5)により文字
線長を示す特徴を計算し、MXNX4次元の特徴7トリ
クスを作成する。
L、、 =  B、、 /W      (5)IJ 
      IJ その後、■SP特徴7トリクスは文字枠のY軸方向の長
さ△Yで、H8P特徴7トリクスはX軸方向の長さ△X
で、R8P及びLSP特徴7トリクスは(」十群)/Z
でそれぞれ正規化を行ない最終的にMXNX4次元の特
徴マトリクスを作成する。識別部8は辞書マスク(fj
)と前記抽出された特徴7トリクス(f、)との間に式
(6)で定義される距離(D)を適用し、Dが最小の値
となるような辞書マスクのカテゴリ名を制御部9へ送出
する。制御部9は送られてきたカテゴリ名を文字名出力
11に出゛力する。
D−Σ(fi−、f、 )2(6) 又制御部9は前述平均角度計算部13よシ送出されたθ
□、θ9.θ8.θ、について、前述帳票−人様構部1
4より送出された帳票吸入信号を受けとった後の■文字
(Iは定数、本実施例ではI=10 )の平均をそれぞ
れ計算して、元辞書をメモリ部10より読出し、前記元
辞書のθ□、θ9.θ8.θ、の分類を参照して対応す
るマスクを元辞書より抜き出し1組の辞書として構成し
識別部8へ送出する。故にI文字目以降の文字について
識別部8においては前記平均角度を参照して作成した辞
書を使用する。
このように本発明の実施例においては、帳票を吸入した
後の■文字の認識については元辞書を使用し、■文字目
までの平均の文字線の傾斜を計算して、当該帳票専用の
辞書を作成し、■文字目以降の文字の認識については、
当該帳票の読取シに不必要な辞書マスクを除いた前記新
らたに作成した辞書を使用しているのであらかじめ文字
サンプルの読取シを行なうこと力〈高速な処理を行なう
ことができる。又帳票毎に新らたに辞書を作成している
ので、筆記者が違う又印刷条件が違う帳票を連続的に処
理する場合でも各帳票毎に最適な辞書を作成することが
できる。
以上詳細に説明したように本発明は帳蒙毎に最適な辞書
を作成し、該辞書を使用して文字を認識しているので、
高速で精度の良い認識を行なうことができ、高速で精度
の良い文字認識装置に利用できる効果がある。
【図面の簡単な説明】
第1図は本発明文字認識装置の一実施例の構成図、第2
図は原・やターンと各サブパターンの例を示す図である
。 1・・・光電変換部、2・・・ieターンレジスタ、3
・・・線幅計算部、4・・・文字枠検出部、5・・・文
字枠分割決定部、6・・・サブ・ぐターン抽出部、7・
・・特徴7トリクス抽出部、8・・・識別部、9・・・
制御部、1o・・・メモリ部、11・・・文字名出力、
12・・・ストローク抽出部、13・・・平均角度計算
部、14・・・帳票吸入機構部。

Claims (1)

    【特許請求の範囲】
  1. あらかじめ特徴毎に分類して作成した辞書マスクを、特
    徴毎に数種類用意しておき、帳票上の文字を読取る際に
    、帳票1枚を単位とし最初のI文字(Iは定数)は前記
    あらかじめ用意したすべての辞書マスクを使用して認識
    を行々い、前記■文字の読取中に各文字の各方向のスト
    ローク成分を抽出して文字線の傾斜を抽出し、当該帳票
    上の文字についての特徴毎の分類を決定し、前記あらか
    じめ用意した特徴毎の複数の辞書マスクの中からそれぞ
    れ特徴毎に選択して新らしい辞書を構成し、前記I文字
    以降の文字の認識においては前記新らしく構成した辞書
    を使用して認識することを特徴とする文字認識装置。
JP56190500A 1981-11-30 1981-11-30 文字認識装置 Pending JPS5894066A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP56190500A JPS5894066A (ja) 1981-11-30 1981-11-30 文字認識装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP56190500A JPS5894066A (ja) 1981-11-30 1981-11-30 文字認識装置

Publications (1)

Publication Number Publication Date
JPS5894066A true JPS5894066A (ja) 1983-06-04

Family

ID=16259119

Family Applications (1)

Application Number Title Priority Date Filing Date
JP56190500A Pending JPS5894066A (ja) 1981-11-30 1981-11-30 文字認識装置

Country Status (1)

Country Link
JP (1) JPS5894066A (ja)

Similar Documents

Publication Publication Date Title
Yanikoglu et al. Segmentation of off-line cursive handwriting using linear programming
JPS5894066A (ja) 文字認識装置
JP3090342B2 (ja) 文字列方向判別装置
JPH0410087A (ja) 基本ライン抽出方法
JPH0632070B2 (ja) 文字認識装置
JP3936039B2 (ja) 網がけ領域抽出装置
JPH0664629B2 (ja) 文字認識方式
JP2616995B2 (ja) 文字認識装置
JPS5894064A (ja) 手書文字認識装置
JPH0545992B2 (ja)
JP2827288B2 (ja) 文字認識装置
JPS6227887A (ja) 文字種分離方式
JPH04139593A (ja) 郵便番号認識装置
JPH0632074B2 (ja) 正規化方法
JPS5894065A (ja) 文字認識装置
JP3090928B2 (ja) 文字認識装置
JPS6059488A (ja) 文字認識装置
JPH10162104A (ja) 文字認識装置
JP2918363B2 (ja) 文字分類方法及び文字認識装置
JP2832035B2 (ja) 文字認識装置
JPH0244487A (ja) 光学文字読取装置の7b文字読取方式
JPS62154079A (ja) 文字認識方式
JP2578768B2 (ja) 画像処理方法
JPS60201485A (ja) 手書文字認識装置
JPS6031683A (ja) 手書文字認識装置