JPH09190497A - 文字認識装置 - Google Patents

文字認識装置

Info

Publication number
JPH09190497A
JPH09190497A JP7327172A JP32717295A JPH09190497A JP H09190497 A JPH09190497 A JP H09190497A JP 7327172 A JP7327172 A JP 7327172A JP 32717295 A JP32717295 A JP 32717295A JP H09190497 A JPH09190497 A JP H09190497A
Authority
JP
Japan
Prior art keywords
character
data
cutout
unit
stroke
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Withdrawn
Application number
JP7327172A
Other languages
English (en)
Inventor
Tsutomu Tabata
努 田畑
Yuji Hayashi
祐史 林
Sayuri Shiozawa
さゆり 塩沢
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Oki Electric Industry Co Ltd
Original Assignee
Oki Electric Industry Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Oki Electric Industry Co Ltd filed Critical Oki Electric Industry Co Ltd
Priority to JP7327172A priority Critical patent/JPH09190497A/ja
Publication of JPH09190497A publication Critical patent/JPH09190497A/ja
Withdrawn legal-status Critical Current

Links

Landscapes

  • Character Input (AREA)
  • Character Discrimination (AREA)
  • Document Processing Apparatus (AREA)

Abstract

(57)【要約】 【課題】 文字認識装置の認識率を向上する。 【解決手段】 文字枠設定部5で設定された文字枠がタ
ブレット1に表示され、前処理/ストロークコード化部
2は、タブレット1から入力されたX,Y座標データ列
に対して直線化処理を行った後、ストロークをコード化
する。1文字枠内ストローク切出し部4は、複数のスト
ロークコードを文字枠単位の切出しデータに分離して出
力する。パターンマッチング部6は、切出しデータに対
するマッチングで文字コードを出力する。その文字コー
ドが、例えば濁点を含み得る文字かどうかが結果文字コ
ード判定部7で判定される。次文字開始ストローク判定
部8は、認識対象の次の文字の切出しデータに、認識対
象文字の濁点のストロークが存在するかどうかを判定
し、存在する場合、再切出し部10はその濁点を統合し
た補正切出しデータを作成してパターンマッチング部6
に与える。

Description

【発明の詳細な説明】
【0001】
【発明の属する技術分野】本発明は、手書き筆記文字を
識別するオンライン文字認識装置等の文字認識装置に関
するものである。
【0002】
【従来の技術】従来、オンライン文字認識装置では、人
間がタブレット等の入力装置にぺンで筆記したストロー
ク(ペンオンからペンオフまでの筆記部分)のデータ
を、順次、コンピュータで処理可能なXY座標データ列
に変換する。そして、オンライン文字認識装置は複数の
ストローク別のXY座標データ列に対して切出し処理を
行い、それらを1文字づつに分離する。さらに、オンラ
イン文字認識装置は、分離結果に対して文字認識処理を
行って文字認識結果の文字コードを得る。文字認識結果
の文字は表示されたり、その文字認識結果の文字コード
が、他の種々の処理に用いられる。文字認識の一般的な
方式としては、パターンマッチング方式がある。このパ
ターンマッチング方式では、筆記入力されたストローク
の座標データ列から特徴点の情報抽出を行う。この抽出
された情報と登録されたパターンの情報とがマッチング
によって比較され、文字コードが特定される。ここで、
登録されたパターンも、予め特徴点が抽出されて登録さ
れたものである。1文字ずつにストローク別の座標デー
タ列を分離する切出し処理は、予め1文字ずつの枠をタ
ブレットに設定表示しておき、筆記者がその枠内に書き
込む方法や、事前に1文字の枠を設定せず、文字記入の
前或いは後に文字の記入領域枠を設定し、領域内のスト
ローク間隔等の情報から1文字の座標データ列を切出す
方法(フリーフォーマット法)がある。これらの方法
は、アプリケーションに応じて使い分けられている。
【0003】
【発明が解決しようとする課題】しかしながら、従来の
オンライン文字認識装置でおいては、次のような課題が
あった。切出し処理で1文字の記入枠や文字領域からは
み出して記入された文字“犬”の部首“ヽ”や文字
“ジ”の半濁点“゛”等は認識されず、“大”や“シ”
と誤認識される。また、例えば句点“、”が“し、”の
ように、同一の1文字の枠に記入された場合にも、誤認
識される。即ち、認識率が低下するという不具合があっ
た。
【0004】
【課題を解決するための手段】第1の発明は、前記課題
を解決するために、座標入力部を介して1文字ずつの文
字記入枠にそれぞれ入力された筆記文字の座標列データ
から、該筆記文字を構成するストロークの特徴点を抽出
し、該特徴点の位置関係に応じてそのストロークをコー
ド化するストロークコード化部と、前記ストロークコー
ド化部の出力データを前記文字記入枠毎に分離すること
で1文字分の切出しデータを作成する切出し部とを備
え、前記切出し部からの切出しデータと予め登録した文
字の登録パターンデータとを比較して該切出しデータに
対応する文字コードを抽出し、前記筆記文字に対する文
字認識処理を行う文字認識装置おいて、次のような構成
にしている。即ち、第1の発明の文字認識装置において
は、前記文字コードが予め登録された文字コードに相当
するかどうかを判定する結果文字コード判定部と、認識
対象文字の次の文字の前記切出しデータ中に、その認識
対象の文字の濁点、半濁点或いは特定の部首に相当する
ものが存在するかどうかを判定する次文字開始ストロー
ク判定部と、前記結果文字コード判定部の判定結果と次
文字開始ストローク判定部の判定結果に基づき、前記ス
トロークコード化部の出力データに対する前記切出し部
の分離位置を補正して新たな前記切出しデータを作成す
る再切出し部とを、設けている。
【0005】第2の発明は、座標入力部を介して1文字
ずつの文字記入枠にそれぞれ入力された筆記文字の座標
列データから、該筆記文字を構成するストロークの特徴
点を抽出し、該特徴点の位置関係に応じてそのストロー
クをコード化するストロークコード化部と、前記ストロ
ークコード化部の出力データを前記文字記入枠毎に分離
することで1文字分の切出しデータを作成する切出し部
とを備え、前記切出し部からの切出しデータと予め登録
した文字の登録パターンデータとを比較して該切出しデ
ータに対応する文字コードを抽出し、前記筆記文字に対
する文字認識処理を行う文字認識装置おいて、次のよう
な構成にしている。即ち、第2の発明の文字認識装置に
おいては、前記切出し部から出力された切出しデータ中
に句読点に相当するデータが存在するかどうかを判定す
る句読点ストローク判定部と、前記句読点ストローク判
定部の判定結果で前記切出しデータ中に句読点に相当す
るデータが存在する場合、該句読点に相当するデータを
1文字分の切出しデータに分離することで前記ストロー
クコード化部の出力データに対する前記切出し部の分離
位置を補正して新たな前記切出しデータを作成する再切
出し部とを、設けている。
【0006】第3の発明は、座標入力部を介して複数文
字記入用の文字記入枠に入力された筆記文字の座標列デ
ータから、該筆記文字を構成するストロークの特徴点を
抽出し、該特徴点の位置関係に応じてそのストロークを
コード化するストロークコード化部と、前記ストローク
コード化部の出力データを前記1文字ずつに分離するこ
とで文字単位の切出しデータを作成する切出し部とを備
え、前記切出し部からの切出しデータと予め登録した文
字の登録パターンデータとを比較して該切出しデータに
対応する文字コードを抽出し、前記筆記文字に対する文
字認識処理を行う文字認識装置おいて、次のような構成
にしている。即ち、第3の発明の文字認識装置おいて
は、前記切出しデータが前記文字記入枠の境界近傍文字
の切出しデータであるかどうかを判定する近傍判定手段
と、前記近傍判定手段の判定結果が前記境界近傍文字の
切出しデータの場合、該切出しデータに対応する前記文
字コードが、予め登録されている文字コードに該当する
かどうかを判定する結果文字コード判定部と、前記文字
記入枠外部のストロークコードに濁点、半濁点或いは特
定の部首の存在するかどうかを判定する領域周辺ストロ
ーク判定部と、前記結果文字コード判定部と領域周辺ス
トローク判定部の判定結果に基づき、前記ストロークコ
ード化部の出力データに対する前記切出し部の分離位置
を補正して新たな前記切出しデータを作成する再切出し
部とを、設けている。
【0007】第1の発明によれば、以上のように文字認
識装置を構成したので、座標入力部を介して1文字ずつ
の文字記入枠にそれぞれ入力された筆記文字の座標列デ
ータから、ストロークコード化部により、筆記文字を構
成するストロークの特徴点が抽出され、その特徴点の位
置関係に応じてそのストロークがコード化される。切出
し部により、ストロークコード化部の出力データが文字
記入枠毎に分離されて切出しデータが作成される。切出
しデータと予め登録した文字の登録パターンデータとが
比較され、文字コードが認識結果として抽出される。こ
こで、結果文字コード判定部により、文字コードが予め
登録された文字コードに相当するかどうかが判定され
る。ここで、濁点を含み得る文字、半濁点を含み得る文
字、または部首の一部が離れて誤記入されやすい文字の
文字コードを予め登録しておけば、この判定で、認識対
象の文字が例えば濁点を含み得る文字、半濁点を含み得
る文字、または部首の一部が離れて誤記入されやすい文
字かどうかが判定できる。一方、認識対象文字の次の文
字の切出しデータ中に、その認識対象の文字の濁点、半
濁点或いは特定の部首に相当するものが存在するかどう
かが、次文字開始ストローク判定部によって判定され
る。再切出し部により、結果文字コード判定部の判定結
果と次文字開始ストローク判定部の判定結果に基づき、
切出しの分離位置が補正され、次の文字記入枠に誤記入
された濁点、半濁点、または部首の一部が認識対象文字
の切り出しデータに統合される。この新たな切出しデー
タと登録パターンとが比較され、正して文字コードが得
られる。
【0008】第2の発明によれば、切出し部から出力さ
れた切出しデータ中に句読点に相当するデータが存在す
るかどうかが、句読点ストローク判定部によって判定さ
れる。句読点ストローク判定部の判定結果で切出しデー
タ中の句読点に相当するデータが存在する場合、再切出
し部により、該句読点に相当するデータが1文字分の切
出しデータに分離される。即ち、誤って同一枠に文字と
共に記入された句読点等が、1文字分の切り出しデータ
として分離されて補正される。再切出し部によって作成
された新たな切出しデータが登録パターンと比較され、
正して文字コードが得られる。
【0009】第3の発明によれば、ストロークコード化
部により、複数文字記入用の文字記入枠に入力された筆
記文字の座標列データから、筆記文字を構成するストロ
ークの特徴点が抽出され、特徴点の位置関係に応じてそ
のストロークがコード化される。ストロークコード化部
の出力データが、切出し部によって1文字ずつに分離さ
れ、切出し部からの切出しデータと予め登録した文字の
登録パターンデータとの比較によって、文字認識結果の
文字コードが抽出される。ここで、近傍判定手段によ
り、対象の切出しデータが前記文字記入枠の境界近傍文
字の切出しデータであるかどうかが判定され、判定結果
が前記境界近傍文字の切出しデータの場合、該切出しデ
ータに対応する前記文字コードが、予め登録されている
文字コードに該当するかどうかが、結果文字コード判定
部によって判定される。一方、文字記入枠外部のストロ
ークコードに濁点、半濁点或いは特定の部首の存在する
かどうかが、領域周辺ストローク判定部によって判定さ
れる。これにより、境界近傍文字の濁点、半濁点、或い
は部首の一部が文字記入枠から外れて記入されたことが
判定される。再切出し部により、結果文字コード判定部
と領域周辺ストローク判定部の判定結果に基づき、切出
しの分離位置が補正され、新たな切出しデータが作成さ
れる。この新たな切出しデータと登録パターンとが比較
され、正して文字コードが得られる。従って、前記課題
を解決できるのである。
【0010】
【発明の実施の形態】第1の実施形態 図1は、本発明の第1の実施形態を示すオンライン文字
認識装置の機能ブロック図である。このオンライン文字
認識装置は、集積回路を用いた個別回路、或いはデジタ
ル・シグナル・プロセッサ(DSP)等のプログラム制
御によって構成されるものであり、ペンタッチ入力され
た文字の位置座標を生成する座標入力部のタブレット1
を有している。タブレット1の出力側が、前処理/スト
ロークコード化部2に接続され、該前処理/ストローク
コード化部2の出力側が、バッファ部3に接続されてい
る。バッファ部3の出力側は、切出し部である1文字枠
内ストローク切出し部4に接続されている。タブレット
1及び1文字枠内ストローク切出し部4には、文字枠設
定部5の出力側が接続されている。1文字枠内ストロー
ク切出し部4の一つの出力側には、パターンマッチング
部6が接続され、パターンマッチング部6の出力側に
は、結果文字コード判定部7が接続されている。
【0011】結果文字コード判定部7の一つの出力側か
ら、認識結果であるJISコード等の文字コードが出力
される構成であり、結果文字コード判定部7のもう一方
の出力側には、次文字開始ストローク判定部8が接続さ
れている。また、1文字枠内ストローク切出し部4のも
う一方の出力側は、前後文字ストロークデータ格納部9
に接続され、該前後文字ストロークデータ格納部9の一
つの出力側も、次文字開始ストローク判定部8に接続さ
れている。次文字開始ストローク判定部8の出力側と前
後文字ストロークデータ格納部9のもう一つの出力側
が、再切出し部10に接続され、該再切出し部10の出
力側が、パターンマッチング部6に接続されている。結
果文字コード判定部7、次文字開始ストローク判定部
8、前後文字ストロークデータ格納部9及び再切出し部
10は、本実施形態の特徴である切出し判定部を形成し
ている。
【0012】図2は、図1のオンライン文字認識装置の
動作を示すフローチャートであり、図3(a),(b)
は、図1のタブレットから入力する文字イメージと認識
結果を示す図である。この図2及び図3(a),(b)
を参照しつつ、図1による文字認識動作を説明する。図
3(a)のように、1文字ずつの文字記入枠が存在する
場合“ジ”という文字を1つの文字記入枠内に記入せ
ず、隣の文字記入枠に濁点の“゛”がはみ出したとき、
文字切出しによって“シ”と“゛”とが別れて切出さ
れ、“シ”と“゛エ”になる。そのため、2文字が誤認
識或いは認識不能になる。この第1の実施形態では、図
2のステップS1〜ステップS8の処理を行い、この文
字切出しの不具合を濁点、半濁点或いは文字の部首を用
いて判断し、1文字の切出しデータを修正して認識す
る。文字枠設定部5で設定された文字枠をタブレット1
が表示し、このタブレット1に対して文字入力が行われ
る。タブレット1に入力された文字イメージは、X,Y
座標データ列に変換され、このX,Y座標データ列が前
処理/ストロークコード化部2へ順次渡される。
【0013】図2のステップS1において、前処理/ス
トロークコード化部2は、タブレット1から与えられた
X,Y座標データ列に対して前処理、つまり文字イメー
ジの不要なノイズを除去して直線化処理を施す。さら
に、前処理/ストロークコード化部2は、前処理結果の
座標データ列から筆記文字の特徴を表す特徴点を抽出
し、該特徴点の位置関係によって、ストロークをコード
化する。つまり、前処理/ストロークコード化部2はス
トローク単位にデータ列を分離し、ストローク種類別に
コード化する処理を施す。これらの処理結果は、例えば
RAM、FIFO等のメモリデバイスで構成されたバッ
ファ部3へ順次格納される。ステップS2において、1
文字枠内ストローク切出し部4は、バッファ部3から位
置(座標)データ及びストロークコードを順次読出し、
それらを文字枠設定部5で設定された1文字枠位置(座
標)単位に切出す。即ち、文字枠切出し処理が行われ
る。文字枠切出し処理の結果得られた位置データ及びス
トロークコード(以下、これらを切出しデータという)
は、前後文字ストロークデータ格納部9に格納される。
前後文字ストロークデータ格納部9は、最新の2文字分
の切出しデータのみを格納する構成であり、新たな切出
しデータが入力されると、2文字前の切出しデータは消
去されるようなっている。ステップS2の次に行なわれ
るステップS3において、パターンマッチング部6は、
1文字枠内ストローク切出し部4で切出された切出しデ
ータの特徴点を抽出し、該抽出された特徴点の情報を予
め収集されたパターンの情報(辞書)とマッチングして
対応する文字コードを出力する。
【0014】ステップS4において、結果文字コード判
定部7はパターンマッチング部6の出力する文字コード
が、予め登録された文字コード群に含まれるか否かを判
定する。ここで、この結果文字コード判定部7での判定
に用いる文字コード群には、濁点を含み得る文字の例え
ば“シ”、半濁点を含み得る文字の“ひ”“ふ”、及び
部首の一部が離れて誤記入されやすい文字の“犬”であ
れば文字の“大”を登録しておく。パターンマッチング
部6の出力する文字コードが、その文字コード群に含ま
れる場合には、その判定結果を次文字開始ストローク判
定部8に与えて、処理を次のステップS5に進ませる。
また、含まれない場合には、ステップS8に進め、パタ
ーンマッチング部6の出力した文字コードを出力する。
ステップS5において、次文字開始ストローク判定部8
は、結果文字コード判定部7の判定結果で文字コード群
に含まれると判定された認識対象の文字の次の切出しデ
ータを前後文字ストロークデータ格納部9から読出し、
該切出しデータ中の開始近傍のストロークコードが濁点
“゛”、半濁点“゜”或いは特定の部首の例えば“犬”
の“ヽ”等に相当するかどうかを判定する。次文字開始
ストローク判定部8の判定結果が、それらの濁点、半濁
点、部首に相当しない場合には、処理をステップS8に
進めて処理を文字認識を終了し、相当する場合には処理
をステップS6に進める。
【0015】ステップS6において、次文字開始ストロ
ーク判定部8は、濁点、半濁点、特定の部首と結果文字
コード判定部7からの文字コードとの対応を判定し、そ
れが例えば“シと“゛”であれば合致しているとして処
理をステップS7に進める。“シ”と“゜”であれば合
致しないものとして処理をステップS8に進め、1文字
の文字認識を終了する。ステップS7において、再切出
し処理部10は、ステップS4で結果文字コード判定部
7によって文字コード群に含まれると判定された認識対
象の文字コードに対応する切出しデータと、その次文字
の切出しデータとを前後文字ストロークデータ格納部9
から読出した後、次文字の切出しデータ中の濁点、半濁
点または特定の部首のストロークデータを分離して、認
識対象文字の切出しデータの結合する。即ち、図3
(b)のように、認識対象文字と次文字の再切出しを実
行する。再切出しの終了後、処理がステップS3に戻る
ことで、再マッチングが行われる。
【0016】以上のように、この第1の実施形態では、
1文字枠内ストローク切出し部4の切出した切出しデー
タをパターンマッチングで文字コードを出力するパター
ンマッチング部6の他に、パターンマッチング部6の出
力する文字コードが、文字コードが予め登録された文字
コードに相当するかどうかを判定する結果文字コード判
定部7と、認識対象文字の次の文字の切出しデータ中
に、その認識対象の文字の濁点、半濁点或いは特定の部
首に相当するものが存在するかどうかを判定する次文字
開始ストローク判定部8と、それら結果文字コード判定
部7と次文字開始ストローク判定部8の判定結果とに基
づき、1文字枠内ストローク切出し部4の分離位置を補
正して新たな切出しデータを作成する再切出し部10と
を、設けている。そのため、1文字ずつ記入枠に記入さ
れるべき文字の“ジ”,“犬”等が、枠からはみ出して
記入された場合にも、正確な文字認識結果を得ることが
でき、認識率が向上する。
【0017】第2の実施形態 図4は、本発明の第2の実施形態を示すオンライン文字
認識装置の機能ブロック図である。このオンライン文字
認識装置も、第1の実施形態と同様に、集積回路を用い
た個別回路或いはDSP等のプログラム制御によって構
成されるものであり、文字の位置座標をペンタッチ入力
するタブレット11を有している。タブレット11の出
力側が、前処理/ストロークコード化部12に接続さ
れ、該前処理/ストロークコード化部12の出力側が、
バッファ部13に接続されている。バッファ部13の出
力側は、切出し部である1文字枠内ストローク切出し部
14に接続されている。タブレット11及び1文字枠内
ストローク切出し部14には、文字枠設定部5の出力側
が接続されている。1文字枠内ストローク切出し部14
の一つの出力側は句読点ストローク判定部16に接続さ
れ、該句読点ストローク判定部16の一つの出力側は、
パターンマッチング部17に接続されている。句読点ス
トローク判定部16のもう一方の出力側は、分離ストロ
ーク格納部18に接続され、この分離ストローク格納部
18の出力側が、再切出し部19に接続されている。再
切出し部19の出力側が、パターンマッチング部17に
接続され、このパターンマッチング部17が文字コード
を出力する構成である。句読点ストローク判定部16と
分離ストローク格納部18と再切出し部19は、本実施
形態の特徴である切出し判定部を構成している。
【0018】図5は、図4のオンライン文字認識装置の
動作を示すフローチャートであり、図6(a),(b)
は、図4のタブレットから入力する文字イメージと認識
結果を示す図である。この図5及び図6(a),(b)
を参照しつつ、図4による文字認識動作を説明する。図
6(a)のように、1文字ずつの記入枠が存在する場
合、“し”という文字のみを字枠内に記入すべきところ
を、同一枠内に句点“、”も記入してしまうと、誤認識
または認識不能に陥る場合がある。この第2の実施形態
では、図5のステップS11〜ステップS16の処理を
行い、この文字切出しの不具合を句読点を用いて判断
し、1文字の切出しデータを修正して認識する。文字枠
設定部15で設定された文字枠をタブレット11が表示
し、このタブレット11に対して文字入力が行われる。
タブレット11に入力された文字イメージはX,Y座標
データ列に変換され、このX,Y座標データ列が前処理
/ストロークコード化部12へ順次渡される。図5のス
テップS11において、前処理/ストロークコード化部
12は、文字イメージのノイズ除去して前処理の直線化
処理を施し、さらに、前処理結果をストローク単位での
データ列分離及びストローク種類別にコード化する処理
を施す。これらの処理結果は、RAM、FIFO等のメ
モリデバイスで構成されたバッファ部13へ順次格納さ
れる。
【0019】ステップS12において、1文字枠内スト
ローク切出し部14は、バッファ部13からの位置(座
標)データ及びストロークコードを順次読出し、それら
を文字枠設定部15で設定された1文字枠位置(座標)
単位に切出す。つまり、第1の実施形態と同様の処理
で、1文字枠単位の切出しデータが出力される。ステッ
プS12に続くステップS13において、句読点ストロ
ーク判定部16は、各切出しデータ内に句読点に相当す
るストロークが存在するかどうかを判定する。句読点に
相当するストロークが存在しない場合には、句読点スト
ローク判定部16は、切出しデータをそのままパターン
マッチング部17に与えて処理をステップS15に進め
る。句読点に相当するストロークが存在する場合には、
句読点ストローク判定部16はそのストロークの位置を
検査し、それが例えば半濁点“゜”の位置であれば、切
出しデータをそのままパターンマッチング部17に与え
て処理をステップS15に進める。ストロークの位置が
例えば読点“。”や句点“、”の位置であれば、句読点
ストローク判定部16はそのストロークデータを切出し
データから分離し、分離ストローク格納部18に格納し
て処理をステップS14に進める。ステップS14にお
いて、再切出し部19は図6(b)のように、分離した
句読点ストロークを1文字の切出しデータとしてパター
ンマッチング部17へ出力する。ステップS15におい
て、パターンマッチング部17は、句読点ストローク判
定部16から与えられた切出しデータまたは再切出し部
19から与えられた切出しデータをマッチングし、ステ
ップS16で文字コードを出力する。
【0020】以上のように、この第2の実施形態では、
1文字枠内ストローク切出し部14の出力する切出しデ
ータ中に句読点に相当するデータが存在するかどうかを
判定する句読点ストローク判定部16と、その切出しデ
ータ中に句読点に相当するデータが存在する場合、それ
を1文字分の切出しデータに分離することで1文字枠内
ストローク切出し部14の分離位置を補正する再切出し
部19とを、設けていそのため、文字記入枠に句読点が
混入した場合でも、誤認識や認識不能が発生せず、認識
率が向上する。
【0021】第3の実施形態 図7は、本発明の第3の実施形態を示すオンライン文字
認識装置の機能ブロック図である。このオンライン文字
認識装置は、第1及び第2の実施形態と同様、集積回路
を用いた個別回路、DSP等のプログラム制御によって
構成されるものであり、文字の位置座標をペンタッチ入
力する座標入力部であるタブレット21を有している。
タブレット21の出力側が、前処理/ストロークコード
化部22に接続され、該前処理/ストロークコード化部
22の出力側が、バッファ部23に接続されている。バ
ッファ部23の一つの出力側は、第1及び第2の実施形
態とは異なる文字領域内文字切出し部24に接続されて
いる。文字領域内文字切出し部24は、前処理/ストロ
ークコード化部22の出力データを1文字ずつに分離し
た切出しデータを作成する切出し部を構成すると共に、
その切出しデータが文字記入枠の境界近傍文字の切出し
データであるかどうかを判定する近傍判定手段を構成し
ている。タブレット21と文字領域内文字切出し部24
とには、文字領域設定部25の出力側が接続されてい
る。文字領域内文字切出し部24の一つの出力側には、
パターンマッチング部26が接続され、パターンマッチ
ング部26の出力側には、結果文字コード判定部27が
接続されている。結果文字コード判定部27の一つの出
力側から、認識結果であるJISコード等の文字コード
が出力される構成であり、結果文字コード判定部27の
もう一方の出力側には、領域周辺ストローク判定部28
が接続されている。バッファ部23のもう一方の出力側
も領域周辺ストローク判定部28に接続されている。ま
た、文字領域内文字切出し部24のもう一方の出力側
が、領域境界近傍切出しデータ格納部29に接続され、
該領域境界近傍切出しデータ格納部29と領域周辺スト
ローク判定部28の出力側が、再切出し部30に接続さ
れている。再切出し部30の出力側が、パターンマッチ
ング部26に接続されている。
【0022】図8は、図7のオンライン文字認識装置の
動作を示すフローチャートであり、図9(a),(b)
は、図7のタブレットから入力する文字イメージと認識
結果を示す図である。この図8及び図9(a),(b)
を参照しつつ、図7による文字認識動作を説明する。図
9(a)のように、複数文字を記入する文字記入枠が存
在する場合に、この記入枠の境界部分で文字“ジ”の濁
点“゛”がはみ出すと、誤認識に陥る。この第2の実施
形態では、図8のステップS21〜ステップS28の処
理を行い、この文字切出しの不具合を濁点、半濁点或い
は文字の部首を用いて判断し、記入枠境界の文字の切出
しデータを修正して認識する。文字領域設定部25で設
定された複数文字記入用の文字記入枠をタブレット21
が表示し、このタブレット21に対して文字入力が行わ
れる。タブレット21に入力された文字イメージは、
X,Y座標データ列に変換され、このX,Y座標データ
列が前処理/ストロークコード化部22へ順次渡され
る。
【0023】図8のステップS21において、前処理/
ストロークコード化部22は、第1及び第2の実施形態
と同様に、文字イメージのノイズ除去して前処理の直線
化処理を施し、さらに、前処理結果をストローク単位で
のデータ列分離及びストローク種類別にコード化する処
理を施す。これらの処理結果は、例えばRAM、FIF
O等のメモリデバイスで構成されたバッファ部23へ順
次格納される。ステップS22において、文字領域内文
字切出し部24は、バッファ部23から位置(座標)デ
ータ及びストロークコードを順次読出し、文字領域設定
部25で設定された文字記入枠内の位置(座標)に相当
する各データを切出す。即ち、一般的にフリーフォーマ
ットと呼ばれるアルゴリズムを用いて、文字領域内文字
切出し部24は文字記入枠内の個々の文字に対応するデ
ータの切出しを行い、得られた切出しデータをパターン
マッチング部26に出力する。ここで、文字領域内文字
切出し部24は、切出しデータが記入枠境界近傍の文字
のものかどうかを判定する。判定の結果、切出しデータ
が境界近傍のものであれば、その切出しデータを領域境
界近傍切出しデータ格納部29に格納すると共に、境界
近傍のものであるという情報を結果文字コード判定部2
7に示す。
【0024】ステップS23において、パターンマッチ
ング部26は、与えられた切出しデータの特徴点を抽出
し、該抽出された特徴点の情報を予め収集されたパター
ンの情報(辞書)とマッチングして対応する文字コード
を順に出力する。ステップS24において、結果文字コ
ード判定部27は文字領域内文字切出し部24からの情
報に基づき、そのときパターンマッチング部26から出
力された文字コードが文字枠境界近傍の文字であるのか
どうかを判定し、判定の結果、その文字コードが境界近
傍文字の文字コードである場合には、処理をステップS
25へ進める。境界近傍文字の文字コードでない場合に
は、ステップS28へ処理を進め、該文字コードを出力
して1文字の認識を終了する。ステップS25におい
て、結果文字コード判定部27は、パターンマッチング
部26の出力する文字コードが、予め登録された文字コ
ード群に含まれるか否かを判定する。ここで、この結果
文字コード判定部27で判定に用いる文字コード群に
は、濁点を含み得る文字の例えば“シ”、半濁点を含み
得る文字の“ひ”“ふ”、及び部首の一部が離れて誤記
入されやすい文字の“犬”であれば文字の“大”等を登
録しておく。パターンマッチング部26の出力する文字
コードが、その文字コード群に含まれる場合には、判定
結果を領域ストローク判定部28に与えて、処理を次の
ステップS26に進ませる。また、含まれない場合に
は、処理をステップS28に進め、文字コードを出力し
て1文字の認識を終了する。
【0025】ステップS26において、領域周辺ストロ
ーク判定部28は、ステップS25で判定対象となった
文字の次のストロークコードを、文字枠外部のデータも
格納しているバッファ部23から読出す。領域周辺スト
ローク判定部28は、バッファ部23から読出したスト
ロークコードが、濁点“゛”、半濁点“゜”或いは特定
の部首の例えば“犬”の“ヽ”等に相当するかどうかを
判定する。領域周辺ストローク判定部28は、判定の結
果、ストロークコードがそれらの濁点、半濁点、部首に
相当しない場合には、処理をステップS28に進めて処
理を文字認識を終了し、相当する場合には第1の実施形
態と同様にストロークコードと判定対象の文字との対応
をとって、処理をステップS27に進める。ステップS
27において、再切出し処理部30は、領域周辺ストロ
ーク判定部28からのストロークコードと、領域境界近
傍切出しデータ格納部24から判定対象文字の切出しデ
ータとを結合し、図9(b)のような濁点、半濁点或い
は特定の部首を取り込んだ新な切出しデータを形成して
パターンマッチング部26へ出力し、処理がステップS
23に戻る。処理がステップS3に戻ることで、再マッ
チングが行われる。
【0026】以上のように、この第3の実施形態では、
前処理/ストロークコード化部22の出力データを1文
字ずつに分離した切出しデータを作成する共に、その切
出しデータが文字記入枠の境界近傍文字の切出しデータ
であるかどうかを判定する文字領域内文字切出し部24
と、境界近傍文字の切出しデータの場合、切出しデータ
に対応する文字コードが、予め登録されている文字コー
ドに該当するかどうかを判定する結果文字コード判定部
27と、文字記入枠外部のストロークコードに濁点、半
濁点或いは特定の部首の存在するかどうかを判定する領
域周辺ストローク判定部28と、結果文字コード判定部
27と領域周辺ストローク判定部28の判定結果に基づ
き、文字領域内文字切出し部24の分離位置を補正して
新たな切出しデータを作成する再切出し部30とを、設
けている。そのため、複数文字記入用の文字記入枠から
はみ出して記入された濁点、半濁点或いは部首がある場
合にも、それを取込んだ文字認識が可能となり、認識率
が向上する。
【0027】なお、本発明は、上記実施形態に限定され
ず種々の変形が可能である。その変形例としては、例え
ば次のようなものがある。 (1) 第1〜第3の実施形態では、タブレット1,1
1,21を用いたオンライン文字認識装置に適用した例
を示しているが、本発明は、OCR装置のように光学的
に文字イメージを読取り、文字を切出して文字認識を行
う装置にも、適用が可能である。 (2) 第1〜第3の実施形態では、文字記入枠を予め
設定した後に、文字イメージを入力する形態を説明して
いるが、切出し或いは文字認識の対象となる文字領域枠
を文字イメージ入力後に設定する場合でも、上記第1〜
第3の実施形態と同様の効果が得られる。
【0028】
【発明の効果】以上詳細に説明したように、第1の発明
によれば、1文字ずつの文字記入枠にそれぞれ入力され
た筆記文字の座標列データから、ストロークをコード化
するストロークコード化部と、切出しデータを作成する
切出し部とを備え、切出しデータと予め登録した文字の
登録パターンデータとの比較で文字コードを抽出して筆
記文字に対する文字認識処理を行う文字認識装置に、結
果文字コード判定部、次文字開始ストローク判定部、及
び再切出し部を設けているので、切出しデータが補正さ
れ、1文字ずつ記入枠に記入されるべき文字の“ジ”,
“犬”等が枠からはみ出して記入された場合にも、正確
な文字認識結果を得ることができ、認識率が向上する。
第2の発明によれば、1文字ずつの文字記入枠にそれぞ
れ入力された筆記文字の座標列データから、ストローク
をコード化するストロークコード化部と、切出しデータ
を作成する切出し部とを備え、切出しデータと予め登録
した文字の登録パターンデータとの比較で文字コードを
抽出して筆記文字に対する文字認識処理を行う文字認識
装置に、句読点ストローク判定部及び再切出し部を設け
ているので、文字記入枠に句読点が混入した場合でもそ
れが分離され、誤認識や認識不能が発生せず、認識率が
向上する。第3の発明によれば、複数文字記入用の文字
記入枠に入力された筆記文字の座標列データから、スト
ロークをコード化するストロークコード化部と、文字単
位の切出しデータを作成する切出し部とを備え、切出し
データと予め登録した文字の登録パターンデータとの比
較で文字コードを抽出して筆記文字に対する文字認識処
理を行う文字認識装置に、近傍判定手段、結果文字コー
ド判定部、領域周辺ストローク判定部、及び再切出し部
を設けているので、複数文字記入用の文字記入枠からは
み出して記入された濁点、半濁点或いは部首がある場合
にも、それを取込んだ切出しデータが得られ、認識率が
向上する
【図面の簡単な説明】
【図1】本発明の第1の実施形態を示すオンライン文字
認識装置の機能ブロック図である。
【図2】図1のオンライン文字認識装置の動作を示すフ
ローチャートである。
【図3】図1のタブレットから入力する文字イメージと
認識結果を示す図である。
【図4】本発明の第2の実施形態を示すオンライン文字
認識装置の機能ブロック図である。
【図5】図4のオンライン文字認識装置の動作を示すフ
ローチャートである。
【図6】図4のタブレットから入力する文字イメージと
認識結果を示す図である。
【図7】本発明の第3の実施形態を示すオンライン文字
認識装置の機能ブロック図である。
【図8】図7のオンライン文字認識装置の動作を示すフ
ローチャートである。
【図9】図7のタブレットから入力する文字イメージと
認識結果を示す図である。
【符号の説明】
1,11,21 タブレット 2,12,22 前処理/ストロークコード化
部 3,13,23 バッファ部 4,14 1文字ストローク切出し部 5,15 文字枠設定部 6,17,26 パターンマッチング部 7,27 結果文字判定部 8 次文字開始ストローク判定部 9 前後文字ストロークデータ格
納部 10,19,30 再切出し部 16 句読点ストローク判定部 18 分離ストローク格納部 24 文字領域内文字切出し部 25 文字領域設定部 28 領域周辺ストローク判定部 29 領域境界近傍切出しデータ格
納部
───────────────────────────────────────────────────── フロントページの続き (51)Int.Cl.6 識別記号 庁内整理番号 FI 技術表示箇所 G06K 9/62 640 9061−5H G06K 9/62 640A 9061−5H G G06F 17/22 G06F 15/20 506A

Claims (3)

    【特許請求の範囲】
  1. 【請求項1】 座標入力部を介して1文字ずつの文字記
    入枠にそれぞれ入力された筆記文字の座標列データか
    ら、該筆記文字を構成するストロークの特徴点を抽出
    し、該特徴点の位置関係に応じてそのストロークをコー
    ド化するストロークコード化部と、 前記ストロークコード化部の出力データを前記文字記入
    枠毎に分離することで1文字分の切出しデータを作成す
    る切出し部とを備え、 前記切出し部からの切出しデータと予め登録した文字の
    登録パターンデータとを比較して該切出しデータに対応
    する文字コードを抽出し、前記筆記文字に対する文字認
    識処理を行う文字認識装置おいて、 前記文字コードが予め登録された文字コードに相当する
    かどうかを判定する結果文字コード判定部と、 認識対象文字の次の文字の前記切出しデータ中に、その
    認識対象の文字の濁点、半濁点或いは特定の部首に相当
    するものが存在するかどうかを判定する次文字開始スト
    ローク判定部と、 前記結果文字コード判定部の判定結果と次文字開始スト
    ローク判定部の判定結果とに基づき、前記ストロークコ
    ード化部の出力データに対する前記切出し部の分離位置
    を補正して新たな前記切出しデータを作成する再切出し
    部とを、 設けたことを特徴とする文字認識装置。
  2. 【請求項2】 座標入力部を介して1文字ずつの文字記
    入枠にそれぞれ入力された筆記文字の座標列データか
    ら、該筆記文字を構成するストロークの特徴点を抽出
    し、該特徴点の位置関係に応じてそのストロークをコー
    ド化するストロークコード化部と、 前記ストロークコード化部の出力データを前記文字記入
    枠毎に分離することで1文字分の切出しデータを作成す
    る切出し部とを備え、 前記切出し部からの切出しデータと予め登録した文字の
    登録パターンデータとを比較して該切出しデータに対応
    する文字コードを抽出し、前記筆記文字に対する文字認
    識処理を行う文字認識装置おいて、 前記切出し部から出力された切出しデータ中に句読点に
    相当するデータが存在するかどうかを判定する句読点ス
    トローク判定部と、 前記句読点ストローク判定部の判定結果で前記切出しデ
    ータ中に句読点に相当するデータが存在する場合、該句
    読点に相当するデータを1文字分の切出しデータに分離
    することで前記ストロークコード化部の出力データに対
    する前記切出し部の分離位置を補正して新たな前記切出
    しデータを作成する再切出し部とを、 設けたことを特徴とする文字認識装置。
  3. 【請求項3】 座標入力部を介して複数文字記入用の文
    字記入枠に入力された筆記文字の座標列データから、該
    筆記文字を構成するストロークの特徴点を抽出し、該特
    徴点の位置関係に応じてそのストロークをコード化する
    ストロークコード化部と、 前記ストロークコード化部の出力データを前記1文字ず
    つに分離する文字単位の切出しデータを作成する切出し
    部とを備え、 前記切出し部からの切出しデータと予め登録した文字の
    登録パターンデータとを比較して該切出しデータに対応
    する文字コードを抽出し、前記筆記文字に対する文字認
    識処理を行う文字認識装置おいて、 前記切出しデータが前記文字記入枠の境界近傍文字の切
    出しデータであるかどうかを判定する近傍判定手段と、 前記近傍判定手段の判定結果が前記境界近傍文字の切出
    しデータの場合、該切出しデータに対応する前記文字コ
    ードが、予め登録されている文字コードに該当するかど
    うかを判定する結果文字コード判定部と、 前記文字記入枠外部のストロークコードに濁点、半濁点
    或いは特定の部首の存在するかどうかを判定する領域周
    辺ストローク判定部と、 前記結果文字コード判定部と領域周辺ストローク判定部
    の判定結果に基づき、前記ストロークコード化部の出力
    データに対する前記切出し部の分離位置を補正して新た
    な前記切出しデータを作成する再切出し部とを、 設けたことを特徴とする文字認識装置。
JP7327172A 1995-12-15 1995-12-15 文字認識装置 Withdrawn JPH09190497A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP7327172A JPH09190497A (ja) 1995-12-15 1995-12-15 文字認識装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP7327172A JPH09190497A (ja) 1995-12-15 1995-12-15 文字認識装置

Publications (1)

Publication Number Publication Date
JPH09190497A true JPH09190497A (ja) 1997-07-22

Family

ID=18196115

Family Applications (1)

Application Number Title Priority Date Filing Date
JP7327172A Withdrawn JPH09190497A (ja) 1995-12-15 1995-12-15 文字認識装置

Country Status (1)

Country Link
JP (1) JPH09190497A (ja)

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2012173959A (ja) * 2011-02-21 2012-09-10 Fuji Xerox Co Ltd 文字認識装置及びプログラム

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2012173959A (ja) * 2011-02-21 2012-09-10 Fuji Xerox Co Ltd 文字認識装置及びプログラム

Similar Documents

Publication Publication Date Title
JP3761937B2 (ja) パターン認識方法及び装置及びコンピュータ制御装置
JPH11272800A (ja) 文字認識装置
JP2003030654A (ja) パターン識別装置、パターン識別方法及びパターン識別用プログラム
JP2006227824A (ja) 図面認識方法および装置
JPH0991371A (ja) 文字表示装置
JPH09274645A (ja) 文字認識方法および装置
JPH0728935A (ja) 文書画像処理装置
JP2984170B2 (ja) オンライン手書き文字認識装置
JP2550012B2 (ja) パタ−ン切り出し及び認識方法
JPH08161426A (ja) 手書き文字ストローク切出し装置
JP2985813B2 (ja) 文字列認識装置および知識データベース学習方法
JPH09223186A (ja) オンライン文字認識装置
JP3365537B2 (ja) オンライン文字認識方法および装置
JPH051512B2 (ja)
JPS60217487A (ja) 文字認識装置
JPH06295356A (ja) オンライン文字認識装置
JP3345469B2 (ja) 単語間隔度演算方法、単語間隔度演算装置、及び文字読取り方法、文字読取り装置
JP3245241B2 (ja) 文字認識装置および方法
JPH09237321A (ja) 手書き文字認識装置
JPH01292586A (ja) 文字認識支援装置
JPH0830717A (ja) 文字認識方法とその装置
JP3138665B2 (ja) 手書き文字認識方式および記録媒体
JPH04337890A (ja) オンライン手書き文字認識装置
JP2972443B2 (ja) 文字認識装置
JP2549831B2 (ja) 文字認識装置の入力パターン・文字列登録方法

Legal Events

Date Code Title Description
A300 Application deemed to be withdrawn because no request for examination was validly filed

Free format text: JAPANESE INTERMEDIATE CODE: A300

Effective date: 20030304