JPH04276888A - 文字読取装置 - Google Patents

文字読取装置

Info

Publication number
JPH04276888A
JPH04276888A JP3037128A JP3712891A JPH04276888A JP H04276888 A JPH04276888 A JP H04276888A JP 3037128 A JP3037128 A JP 3037128A JP 3712891 A JP3712891 A JP 3712891A JP H04276888 A JPH04276888 A JP H04276888A
Authority
JP
Japan
Prior art keywords
character
inclination
section
character string
tilt
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP3037128A
Other languages
English (en)
Inventor
Naoki Maeda
直樹 前田
Yasuhiko Kono
靖彦 河野
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Sumitomo Electric Industries Ltd
Original Assignee
Sumitomo Electric Industries Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Sumitomo Electric Industries Ltd filed Critical Sumitomo Electric Industries Ltd
Priority to JP3037128A priority Critical patent/JPH04276888A/ja
Publication of JPH04276888A publication Critical patent/JPH04276888A/ja
Pending legal-status Critical Current

Links

Landscapes

  • Character Input (AREA)

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】
【0001】
【産業上の利用分野】本発明は、イメージセンサまたは
通信端末を通して文字、記号等(代表して「文字」とい
う)を表わす画像情報を入力し、その画像情報を処理す
ることにより文字を認識する文字読取装置に関するもの
である。
【0002】
【従来の技術】従来より、図3に示すように、原稿に記
載された文字をスキャナにおいて読み取り、ホストコン
ピュータによって自動的に認識し、ディスプレイ(CR
T,LCD等)に表示する技術が開発されているが、文
字認識の前提として原稿上に配列された文字の領域を切
り出す必要がある。
【0003】この手順として、まず文字列を抽出し、文
字列の中から個別文字を切り出すことになる。上記文字
列を抽出するときに、紙面の傾きを求める手法が種々提
案されている。例えば、原稿を細かいブロックに分割し
、各ブロックの左半分、右半分ごとに縦のヒストグラム
を求め、両ヒストグラムの極大あるいは極小どうしをむ
すひ合わせ、文字行の傾きを求める方法である(特開昭
62−281084 号、特開昭63−82588号公
報参照)。また、各文字列を1本の線画像に変換して両
端点の座標をそれぞれ求め、これらの座標を結んだ線分
の傾きの平均値を求める方法も提案されている(「ミッ
クスモード通信のための文字領域の抽出アルゴリズム」
信学論 ’84/11,Vol.J67−D No.1
1, pp1277−1284) 。
【0004】そして、傾きが検出されると、読み取られ
た文字画像を回転させたり、縦方向に画素を少しずつシ
フトさせたりして、正規の配列に変換してから(この作
業を「傾き補正処理」という)、文字の文字切出しと認
識とを行っていた。
【0005】
【発明が解決しようとする課題】上記または上記以外の
何れの傾き補正処理を採用するにしても、傾きが僅かの
、傾き補正の必要のない文字列に対しても、傾き補正処
理を施していた。このため、文字の認識が完了するまで
の処理時間が長くなるという欠点があった。
【0006】そこで、本発明の目的は、上述の技術的課
題を解決し、文字を認識する速度の速い文字読取装置を
提供することにある。
【0007】
【課題を解決するための手段】上記の目的を達成するた
めの請求項記載の文字読取装置は、2値化された画像メ
モリ上の文字画像から文字列を抽出する抽出手段と、抽
出された文字列の傾きを検出する傾き検出手段と、検出
された文字列の傾きを文字列が傾いていても文字の認識
が可能な最大角度として設定されている基準値と比較す
る比較手段と、文字列の傾きが基準値よりも大きな場合
にのみ傾きを補正する傾き補正手段と、文字データに基
づいて1文字ずつ切り出す文字切出し手段と、切り出さ
れた文字を認識する認識手段とを有するものである。
【0008】
【作用】上記の構成によれば、基準値は、文字列が傾い
ていても文字の認識が可能な最大角度に設定されている
ので、抽出された文字列の傾きが基準値よりも大きな場
合にのみ傾きを補正し、それ以外の場合には傾きの補正
を行わないようにすることができる。そして、傾き補正
手段により傾きが補正された場合、および傾きが補正さ
れなかった場合のいずれの場合でも、区別なく文字の切
出し、認識を行う。
【0009】
【実施例】以下実施例を示す添付図面によって詳細に説
明する。図1は、文字画像を記憶する画像記憶部1と、
記憶された文字画像から文字列を抽出する抽出部2と、
抽出された文字列の傾きを検出する傾き検出部3と、検
出された文字列の傾きを基準値と比較する比較部4と、
文字列の傾きが基準値よりも大きな場合にのみ傾きを補
正する傾き補正部5と、文字列に基づいて1文字ずつ切
り出す文字切出し部6と、切り出された文字を認識する
認識部7とを有する文字読取装置を示す。画像記憶部1
以外の部分の機能は、点線で囲んだように1つのマイク
ロコンピュータで実現されるものである。
【0010】画像記憶部1は、文字原稿像を電気信号に
変換する撮像管、固体イメージセンサ等から取得した文
字画像のパターンを記憶するメモリである。抽出部2は
画像パターンに基づき文字列を抽出する部分であり、例
えば文字を構成する黒画素の拡大(1つの画素について
縦方向又は横方向に一定数の画素を連結させて線にする
こと。縦方向および横方向に対して行えばいわゆる黒ベ
タになる)と縮退(上記と逆の操作をいう)とを紙面全
体に対して行って(これを図形融合操作という)、文字
を連結させた黒い連結領域を作り、縦方向に走査して文
字列を抽出する。傾き検出部3は、上記連結領域に細線
化処理を施してそれぞれ細い線(細線)に変換し、一定
以上の長さを有する細線について平均的な傾きを求める
。補正部5は、上記のようにして求めた傾きに対応する
回転(アフィン変換)を加えるか、縦方向に画素を少し
ずつシフトさせて、傾きのない画面に変換する。文字切
出し部6は、上記文字列に含まれる個別文字を抽出する
ものであり、横方向の図形融合操作と縦方向の図形融合
操作とによって得られるそれぞれの結果の共通領域を含
む最小の矩形領域を切り出すものである(以上の構成に
ついては、上記文献信学論 ’84/11,Vol.J
67−D No.11, pp1277−1284  
参照) 。
【0011】比較部4は、傾き検出部3によって検出さ
れた文字列の傾き角αを基準角βと比較する部分である
。ここで基準角βは、文字列の傾きを予め少しずつ変化
させて、傾きの補正を行わずに文字を文字切出して文字
を認識し、文字切出し成功率または文字認識成功率を求
めておき、実用上問題のない傾きの最大角として選定さ
れたものである。比較部4は、α<βならば(図2(a
)参照)、補正部5を飛ばして画像データを文字切出し
部6におくるが、α>βならば(図2(b)参照)、補
正部5に画像データを送り、傾き補正をさせる。
【0012】認識部7は、前記のようにして得られた各
文字ごとのデータに基づいて、文字の特徴量を抽出し、
認識用辞書に記憶された特徴量と比較し一致点の最も多
い文字を候補文字として出力するものである(文字認識
方法は例えば特開昭63−26915号公報参照) 。 以上のように構成したので、抽出された文字列の傾きα
が基準角βよりも大きな場合にのみ傾きを補正し、それ
以外の場合には傾きの補正を行わないようにすることが
できる。そして、傾き補正部5により傾きが補正された
場合、および傾きが補正されなかった場合のいずれの場
合でも、区別なく文字の切出し、認識を行う。したがっ
て、従来のように傾きが小さな場合にも補正していたの
と比べて全体としての処理時間を短縮することができる
【0013】なお本発明は、前記の実施例に限定される
ものではなく、例えば抽出部2の文字列抽出法、傾き検
出部3の傾き検出法、文字切出し部6の文字切出し法、
認識部7の文字認識法は、上記以外の公知の方法を採用
しているものであってもよい。その他、発明の要旨を変
更しない範囲で種々の変更を施すことが可能である。
【0014】
【発明の効果】以上のように本発明の文字読取装置によ
れば、文字列の傾き角が僅かであれば、傾き補正を行わ
ずに画像データを直接文字切出し部に送ることができる
ので、処理速度が向上する。なお、傾き角の大きな場合
は、傾き補正されたデータを文字切出し部に送ることが
できるので文字切出しや認識に失敗することもない。そ
の結果、全体として処理速度が早く、文字認識精度の高
い文字読取装置を実現することができる。
【図面の簡単な説明】
【図1】文字読取装置の構成を示すブロック図である。
【図2】文字列の傾きと基準角との関係を示す図である
【図3】文字読取装置の概念構成を示す斜視図である。
【符号の説明】
1    画像記憶部 2    抽出部 3    傾き検出部 4    比較部 5    傾き補正部 6    文字切出し部 7    認識部

Claims (1)

    【特許請求の範囲】
  1. 【請求項1】2値化された画像メモリ上の文字画像から
    文字列を抽出する抽出手段と、抽出された文字列の傾き
    を検出する傾き検出手段と、検出された文字列の傾きを
    文字列が傾いていても文字の認識が可能な最大角度とし
    て設定されている基準値と比較する比較手段と、文字列
    の傾きが基準値よりも大きな場合にのみ傾きを補正する
    傾き補正手段と、文字列の傾きが基準値よりも大きな場
    合に傾きを補正された文字データまたは文字列の傾きが
    基準値よりも小さな場合に傾きを補正されなかった文字
    データに基づいて1文字ずつ切り出す文字切出し手段と
    、切り出された文字を認識する認識手段とを有すること
    を特徴とする文字読取装置。
JP3037128A 1991-03-04 1991-03-04 文字読取装置 Pending JPH04276888A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP3037128A JPH04276888A (ja) 1991-03-04 1991-03-04 文字読取装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP3037128A JPH04276888A (ja) 1991-03-04 1991-03-04 文字読取装置

Publications (1)

Publication Number Publication Date
JPH04276888A true JPH04276888A (ja) 1992-10-01

Family

ID=12488975

Family Applications (1)

Application Number Title Priority Date Filing Date
JP3037128A Pending JPH04276888A (ja) 1991-03-04 1991-03-04 文字読取装置

Country Status (1)

Country Link
JP (1) JPH04276888A (ja)

Cited By (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH06251199A (ja) * 1993-02-26 1994-09-09 N T T Data Tsushin Kk 文字認識前処理装置
US6115506A (en) * 1997-05-07 2000-09-05 Nec Corporation Character recognition method, character recognition apparatus and recording medium on which a character recognition program is recorded
US6738530B1 (en) 1999-02-23 2004-05-18 Nec Corporation Method of recognizing character in which correction of inclination of character is carried out and apparatus for carrying out this method

Cited By (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH06251199A (ja) * 1993-02-26 1994-09-09 N T T Data Tsushin Kk 文字認識前処理装置
US6115506A (en) * 1997-05-07 2000-09-05 Nec Corporation Character recognition method, character recognition apparatus and recording medium on which a character recognition program is recorded
US6738530B1 (en) 1999-02-23 2004-05-18 Nec Corporation Method of recognizing character in which correction of inclination of character is carried out and apparatus for carrying out this method

Similar Documents

Publication Publication Date Title
JP3727971B2 (ja) 文書処理装置、及び文書処理方法
US7430065B2 (en) Method and system for correcting distortions in image data scanned from bound originals
KR100247970B1 (ko) 문서 영상의 방향 교정방법
JPH03201866A (ja) 圧縮形態のデータを含むデータから画像スキュー角度を決定する方法
JPH05250409A (ja) ページ方向の高速検出
JP2003016440A (ja) 写真抽出方法、装置、プログラムおよび記録媒体
JPH0418351B2 (ja)
EP0766193B1 (en) Optical character reader with skew correction
JPH04276888A (ja) 文字読取装置
JP3303246B2 (ja) 画像処理装置
JPH07230525A (ja) 罫線認識方法及び表処理方法
JPH11288453A (ja) 再生用のスキャン環境における原稿画像のスキュ―角度および黒い境界線を検出する方法およびシステム
US7103220B2 (en) Image processing apparatus, method and program, and storage medium
JPH07121658A (ja) 文字列検出方式
JP2003317107A (ja) 罫線抽出方法及び装置
JP4093970B2 (ja) 画像歪み補正装置、プログラム及び記憶媒体
JP3060248B2 (ja) 表認識装置
JPH11250179A (ja) 文字認識装置および文字認識方法
JP2000011192A (ja) 画像間位置合わせ方法
JP2674475B2 (ja) 文字読取装置
JP3337592B2 (ja) マーク位置検出装置およびマーク位置検出方法
JP4145256B2 (ja) 画像歪み補正装置、プログラム及び記憶媒体
JPH11161739A (ja) 文字認識装置
JP2802132B2 (ja) 画像形成装置
JP2931041B2 (ja) 表内文字認識方法