JPS58214971A - 特徴抽出処理方式 - Google Patents

特徴抽出処理方式

Info

Publication number
JPS58214971A
JPS58214971A JP57097453A JP9745382A JPS58214971A JP S58214971 A JPS58214971 A JP S58214971A JP 57097453 A JP57097453 A JP 57097453A JP 9745382 A JP9745382 A JP 9745382A JP S58214971 A JPS58214971 A JP S58214971A
Authority
JP
Japan
Prior art keywords
stroke
strokes
series
interest
section
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Granted
Application number
JP57097453A
Other languages
English (en)
Other versions
JPH0247786B2 (ja
Inventor
Akio Shio
昭夫 塩
Takahiko Kawatani
隆彦 川谷
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
NTT Inc
Original Assignee
Nippon Telegraph and Telephone Corp
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Nippon Telegraph and Telephone Corp filed Critical Nippon Telegraph and Telephone Corp
Priority to JP57097453A priority Critical patent/JPS58214971A/ja
Publication of JPS58214971A publication Critical patent/JPS58214971A/ja
Publication of JPH0247786B2 publication Critical patent/JPH0247786B2/ja
Granted legal-status Critical Current

Links

Classifications

    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06VIMAGE OR VIDEO RECOGNITION OR UNDERSTANDING
    • G06V30/00Character recognition; Recognising digital ink; Document-oriented image-based pattern recognition
    • G06V30/10Character recognition
    • G06V30/18Extraction of features or characteristics of the image

Landscapes

  • Engineering & Computer Science (AREA)
  • Computer Vision & Pattern Recognition (AREA)
  • Physics & Mathematics (AREA)
  • General Physics & Mathematics (AREA)
  • Multimedia (AREA)
  • Theoretical Computer Science (AREA)
  • Character Discrimination (AREA)

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 (1)発明の属する分野の説明 本発明は、%−イ做抽出処理方式、特に漢字など構造の
複雑な文字バタンの識別に有効な特徴を抽出する特徴抽
出処理方式に関するものである。
(2)従来の技術の説明 従来よシ手書きカタカナや数字を読み取る光学文字読取
装@ (OCR)が出されているが、これらを、手書き
漢字の様九字種が多く構造の複雑なバタンの認識に適用
することは特徴に含壕れる情報の量からみて困難である
。また手書き漢字の認識を目指す幾つかの方法も提案さ
れているが、それらは文字線の傾き情報などをパタン上
に特徴化し、特徴化されたバタンと標準バタンとの重ね
合せによって入力文字を判定する方法をとっておシ、手
書き漢字の分類用としては有効であるが識別用としては
不十分である。
(3)発明の目的 本発明は、ストロークを情報の単位とし、各ストローク
毎にそのまわシのストロークの情報を集積することを特
徴とし、その目的は手書き漢字の分類に止まらず識別ま
でを特徴とする特徴抽出装置を提供することにある。以
下図面について詳細に訣明する。
(4)発明の構成および作用の説明 第1図は、本発明を含む認識系の構成例であって、1は
走査部、2はバタンメモリ部、3はストローク抽出部、
4はストローク座標メモリ部、5は特徴抽出部、6は識
別部、7は制御部である。
まず走査部1ti、ドキュメント上の文字を走査・光電
変換し2値信号をバタンメモリ部2へ送る。
バタンメモリ部2け、走査部1からの2値信号を1時格
納する誠である。ストローク抽出部3は、バタンメモリ
部2に格納された1文字分の2値バタンから文字線スト
ロークを抽出し、ストローク毎に両端の(”my)座標
を求め、ストローク座標メモリ部4に格納する。次に本
発明の対象である特徴抽出部5Fi、ストローク座標メ
モリ部4に格納された各ストロークの両端の座標をもと
に、各ストロークから上下左右の各方向に存在するスト
ロークの傾きを近い順に求めて1ケまたは、複数個のス
トローク傾き系列を求め、識別部6へ送る。識別部6は
、これをもとに入力文字のカテゴリ名を判定し出力する
。これらの処理は、すべて制御部7が与えるタイミング
信号によシ制御される。
第2図は第1図図示の特徴抽出部5の実施例であって、
51は傾き抽出部、52は傾きテーブル部、53は位置
関係抽出部、54は位置関係マトリクス部、55はスト
ローク傾き系列抽出部、56itストロ一クテーブル部
である。
これらは、制御部7から与えられるタイミング信号によ
り制御されて動作する。まず傾き抽出部51Fi、スト
ローク座標メモリ部4の内容を読みとって傾きを算出し
、傾きテーブル部52に格納する。ここで扱うストロー
クとは、直線と見なせることを基本としておシ、屈曲が
ある時には直線に分割されるようになっており、このこ
とから一般にいうストローク(−筆)と意味を異にする
第3図は、ストロークに分割したパタンの例を示し、「
・」で記している30は特徴点、31〜40は第1〜第
10のストロークを示す。
第4図は、ストローク座標メモリ部4の実施例であり、
アドレス’0’ Kd、出現した総ストローク数N1ま
たアドレス1α1(α=1.2.・・・N)には、アド
レスをストローク番号に対応させて、始端および終端の
座標(gg、yり * (πl、yl)が格納されてい
る。
傾き抽出部51 Kおける傾きの抽出法の一例として、
第5図に示すθ〜7の8種類(22,5°きざみ)の傾
きコードに変換する場合を示す。
と表わすことが出来るから、△2および△Vの値によっ
て傾きコードを求めることができる。
第6図は、傾きテーブル部52の実施例であって、第3
図のバタンから得られる傾きテーブル部の内容を示す。
アドレスTOIKは総ストローク数、アドレス+11以
降には、各ストローク番号に対応した傾きコードが格納
される。例えば、第6図において、アドレス181には
、第3図の第8のストローク38の傾きコード101が
格納される。
位置関係抽出部53は、ストローク座標メモリ部4に曹
かれた各ストロークの両端の座標をもとに、任意の2つ
のストロークの相対的な付価関係(上下関係、左右関係
)を求め、その結果を位置関係マトリクス部54に書き
込む。
位置関係抽出部53における処理のうち、ストローク間
の上下関係を調べる方法について一例を示すと、まず、
任意の2本のストロークが上下関係をもつためには、左
右方向に一定の重なシをもつことが必要である。第7図
(At−の)は、任意の2本のストロークが左右方向に
重なシを持つときの位置関係の変化を模式的に示したも
ので、531は、第i 番目(7)ストローク、532
は第j番目のストロークを示す。第7図(C) 、 (
D)の場合には、無条件に重なりを持つと見なせるが、
第7図囚、(B)の場合には以下の条件を満足する必要
がある。
(条゛件) Qaまたはめβ1−1iμj)次に、左右
方向に重なシをもった一組のストロークの上下関係の決
定法の一例を示す。上下関係は、2本のストロークの重
なシ部分の両端の1座標の大小で決定することができ°
る。第8図は、左右に重なりをもつ一組のストロークの
上下関係を判定する方法の説明図であり、531は第1
番目のストローク、532Vi第j番目のストロークを
示す。
同図において、次の条件を満たすとき、第j番目のスト
ローク532は、第イ蕾目のストローク531の下にあ
ると判定する。
また、次の条件を満たすとき、第j番目のストローク5
32は、第(番目のストローク531の上にある表判定
する。
任意の2本のストロークi、jの上下関係は、以上の様
に求めることができるが、左右関係についても、以上説
明した方法に関し、X方向とV方向を入れ替えた方法に
よって求めることができる。
この様にして得られる任意の2本のストロ−クイ、jの
上下、左右関係は、位置関係マ) IJクス部54のア
ドレス(、/に記録される。位置関係マトリクス部54
は、RAMで構成され、ストo−り1から見たストロー
クjの位置関係を「上」、「下」、「左」、「右」に対
応させた4面のマトリクズで表現する。第9図と第1O
図とに、第3図に示したパタンに対する位置関係マトリ
クス部54の「上」と「下」とに対応するマトリクスの
実施例を示す。
本実施例によれば、第3図第1のストローク31から上
方には第9図から第2、第3のストローク32゜33が
、下方には第10図から第4〜第10のストローク34
〜40が存在することを示している。
ストローク傾き系列抽出部55は、位置関係マトリクス
部54の内容をもとに各ストロークから上、下、左、右
の各方向に見た時に、存在するストロークの番号系列を
求め、さらに傾きテーブル部52の内容を参照して番号
系列を傾き系列に変換し、ストロークテーブル部56に
出力する。任意のストロークから各方向に見たストロー
クの系列は、一般に複数個存在する。例えば、第3図に
示したバタン例において、第1のストローク31から下
方を見ると、第4のストローク34が第1系列、第5、
第6、第7のストローク35 、36 、37が第2系
列、第8のストローク38が第3系列、第9のストロー
ク39が第4系列、第10のストローク40が第5系列
トfx’)、”つの系列が存在する。
次にこれらを求める方法について説明する。処理は、1
−上」、「下」、「左」、「右」の各方向について行な
われるが、各、方向の処理は同様の手順で行なわれるの
で、「下」方向に存在するストロークを求める場合に限
定して説明する。
まず、任意のストロークiを着目ストロークとすると、
着目ストロークの下方にあるストローク番号は、位慣関
係マ) IJクス部54の「下」方向のマトリクスによ
シ求めることができる。第10図に示した「下」方向の
マトリクスの第1番目の1行を MD wa (K1.Km、・・・、に、、・・)( で表わすと、もし、任意のストロークjがストローク(
の下方にあるなら、Kj−1となる0次に、ストローク
jが、着目ストローク(のすぐ下にあるためには、着目
ストロ−クイとストロークjの間に他のストロークが存
在しないことが必要であるから、次の条件を満たす必要
がある。第9図に示した「上」方向のマトリクスの第1
番目の1行をM¥ =(Kl’ *に2’ #・・・、
Kj’、・・暑で表わすとき、条件 Mr!、M′7= (0,O,O,・・・・)  全満
足するならば、ストロークjFi、ストロ−クイのすぐ
下に存在する。
この様にして得られるストロークjを順次着目ストロー
ク1Kffき換えて行くことによシ、ストロークの順序
系列を求めることが出来る。
第3図で示した第1のストローク31を着目ストローク
とした場合を例に、これを説明する。まず、第1のスト
ローク31の下方のストロークの番号jは、第10図の
s=lの1行分 M?た( 0,0.0.1,1.1,1.1,1.1 
)から、 j −4,5,6,7,8,9,10 となる。このうち、/−4,5,8,9,10の場合に
は、MP、M¥ −(o、o、o、o、o、o、o*o
*o、o )とな)、それぞれがストローク31のすぐ
下にあるストロークとなる。
次にこれらストローク(j=4.5,8.9.10 )
を着目ストロークにおきかえ、更にその下のストローク
の存在を調べると、j−5の場合を除いて、M7− (
0,0,0,0,0,0,0,0,0,0)となるから
、これ以上、下にはストロークがないことがわかる。
一方、j−5の場合には、 MY −(0,0,0,0,0,1,1,O,0,0)
≠(0,0,0,0,0゜0.0.0,0,0 ) となるから、  j−6,7のストロークがこの下方向
に存在する。このうち、j−6の場合を調べると、M讐
、MW= (0,0,0,0,0,0,0,0,0,(
1)となシ、ストローク36 (j=6 )がストロー
ク35(j=5 )のすぐ下にくることがわかる。
以上の様な処理により、ストローク31の「下」方向に
は次の5つのストローク番号系列が得られる。
(系列1)1−4 (#  2)   l−5−6−7 (/F3)1−8 (系列4)1−9 (#5)1−10 次に、これらのストローク番号系列をストロークの傾き
系列に変換する方法について説明する。
各ストロークの傾きは、第6図に示した傾きテーブル部
52に格納されている。したがって各スト11−り番号
をアドレスとして傾きテーブル部52の内容を読み出し
、ストロークテーブル部56内の対応するアドレスに書
き込めばよい。
第11図は、第3図のバタンに対応するストロークテー
ブル部56の実施例を模式的に示したもので、561 
ij:着目ストロークの卸き、562 Fi、着目スト
ロークの上方にあるストロークの傾き系列、563F、
を下方にあるストロークの傾き系列、564は左方にあ
るストロークの傾き系列、565Fi右方にあるストロ
ークの傾き系列である。
(5)効果の説明    “ 以上説明したように、本特徴抽出処理方式によれば、ス
トロークを単位として任意の着目ストロークに対し、ま
わりのストローク情報を集積する方式をとっておシ、集
積に際してt、l各漸目ストロークに対し複数の傾き系
列を着目ストロークに近い順に求めることを可能とした
ものであるから、手書き漢字の複雑な構造の記述が可能
であり、かつ相対的な位瞳情報を用いているため入力文
字の位置変動に対しても安定な特徴が得らり、る。
【図面の簡単な説明】
第1図は、本発明を含む認識系の一実施例構成、第2図
は特徴抽出部の実施例、第3図はストロークに分割した
バタン例、第4R1&まストローク座標メモリ部の実施
例、第5図は傾きコードの例、第6図は、傾きテーブル
部の実施例、第7図、框8図は、2本のストロークの位
V関係を示す説明図、第9図、第10図は、位置関係マ
トリクス部の「上」「下」に対応するマトリクスの実施
例、第11図は、ストロークテーブル部の実施例である
。 ■・・・走査部、2・・バタンメモリ部、3 ・ストロ
ーク抽出部、4・・ストローク座標メモリ部、5 ・特
徴抽出部、6・・・識別部、7・・制御部、30・・將
徴点、31〜40・・第1〜第10のストローク、51
・・傾き抽出部、52 ・傾きテーブル部、53・・位
賀関係抽出部、54・・位置関係マトリクス部、55 
 ・ストローク傾き系列抽出部、56・・・ストローク
テーブル部。 特許出願人  日本短信電話公社 代理人弁理士  森 1) 寛 矛1図 72図 す6図 (A)CB)CCン(D) すq 圀 オB@       第10図 す 9 回 牙11図

Claims (2)

    【特許請求の範囲】
  1. (1)黒、白からなる2値の文字バタンを処理してスト
    ロークを抽出し、ストロークの情報をもとに入力バタン
    の属するカテゴリ名を識別するバタン認識方式において
    、上記任意のストロークの傾きを求める手段、任意の2
    本のストロークについて当該2本のストロークの存在位
    置情報から相対的位置関係を求める手段、および任意の
    ストロークを着目ストロークとして上記相対的位置関係
    をもとに当該着目ストロークの予め決められた所定の方
    向に存在するストロークを当該着目ストロークから近い
    順に求めて各方向に存在するストロークの傾き系列を求
    める手段をそなえ、上記ストロークの情報を抽出し、着
    目ストローク毎の上記ストロークの傾き系列を当該着目
    ストローク忙集積するようにしたことを特徴とする特徴
    抽出処理方式。
  2. (2)上記ストロークの傾き系列は、各着目ストローク
    の予め定められた所定の方向毎に複数系列抽出すること
    を特徴とする特許請求の範囲第(1)項記載の特徴抽出
    処理方式。
JP57097453A 1982-06-07 1982-06-07 特徴抽出処理方式 Granted JPS58214971A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP57097453A JPS58214971A (ja) 1982-06-07 1982-06-07 特徴抽出処理方式

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP57097453A JPS58214971A (ja) 1982-06-07 1982-06-07 特徴抽出処理方式

Publications (2)

Publication Number Publication Date
JPS58214971A true JPS58214971A (ja) 1983-12-14
JPH0247786B2 JPH0247786B2 (ja) 1990-10-22

Family

ID=14192721

Family Applications (1)

Application Number Title Priority Date Filing Date
JP57097453A Granted JPS58214971A (ja) 1982-06-07 1982-06-07 特徴抽出処理方式

Country Status (1)

Country Link
JP (1) JPS58214971A (ja)

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS60107709A (ja) * 1983-11-17 1985-06-13 Tdk Corp 磁気ヘツド
JP2014075071A (ja) * 2012-10-05 2014-04-24 Fuji Xerox Co Ltd 情報処理装置及び情報処理プログラム

Citations (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS582984A (ja) * 1981-06-29 1983-01-08 Nec Corp 光学式文字認識装置

Patent Citations (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS582984A (ja) * 1981-06-29 1983-01-08 Nec Corp 光学式文字認識装置

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS60107709A (ja) * 1983-11-17 1985-06-13 Tdk Corp 磁気ヘツド
JP2014075071A (ja) * 2012-10-05 2014-04-24 Fuji Xerox Co Ltd 情報処理装置及び情報処理プログラム

Also Published As

Publication number Publication date
JPH0247786B2 (ja) 1990-10-22

Similar Documents

Publication Publication Date Title
US5142589A (en) Method for repairing images for optical character recognition performing different repair operations based on measured image characteristics
CN107341139A (zh) 一种多媒体处理方法、装置、电子设备及存储介质
KR102203937B1 (ko) 이미지 도면 내 객체 인식 장치
JPS58214971A (ja) 特徴抽出処理方式
CN113408532A (zh) 一种基于多特征提取的药品标签数字识别方法
KR102542174B1 (ko) 디지털 참고서 제공 시스템 및 그 방법
JP4853313B2 (ja) 文字認識装置
JP2001101340A (ja) 文字読取装置および文字認識方法
Yu et al. Convolutional neural networks for figure extraction in historical technical documents
KR102673900B1 (ko) 표 데이터 추출 시스템 및 그 방법
Balasubramanian et al. Information extraction from tabular drawings
JP4763113B2 (ja) 高速ラベリング方式
JPH0353392A (ja) 文字認識装置
CN120765916A (zh) 一种基于rfid和机器视觉结合的多模态无人物资盘点方法
CN116740742A (zh) 非完整框线表格的提取方法、装置、设备及存储介质
Chowdhury et al. Segmentation of printed Bangla characters using structural properties of Bangla script
JP2878772B2 (ja) 光学的文字読取装置
JPH03268181A (ja) 文書読み取り装置
JPH04177483A (ja) パターンマッチング方式
JPH01108691A (ja) キャラクタ画像処理方法
JPH03164885A (ja) 光学式文字読取装置
Gupta et al. in Document Images
JPH06131496A (ja) パターン正規化処理方法
Gao et al. Character recognition in low quality document images using local and global features
Tsai et al. Toward font identification for printed chinese characters