JPH03149648A - 文書処理装置 - Google Patents
文書処理装置Info
- Publication number
- JPH03149648A JPH03149648A JP1289178A JP28917889A JPH03149648A JP H03149648 A JPH03149648 A JP H03149648A JP 1289178 A JP1289178 A JP 1289178A JP 28917889 A JP28917889 A JP 28917889A JP H03149648 A JPH03149648 A JP H03149648A
- Authority
- JP
- Japan
- Prior art keywords
- information
- character
- image
- processing device
- area
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Landscapes
- Character Discrimination (AREA)
- Document Processing Apparatus (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
[産X上の利用分野1
本発明は、文書上の文字等の情報を自動認識してコード
化し、ファイル化する文書処理装置に関する。
化し、ファイル化する文書処理装置に関する。
[従来の技術]
従来、文古上の情報をファイル化する方法としては、現
在ファクシミリで広く使用されているように、文書上の
情報をドツトイメージの形で読み取り、そのまま圧縮処
理を行なう方法がある。
在ファクシミリで広く使用されているように、文書上の
情報をドツトイメージの形で読み取り、そのまま圧縮処
理を行なう方法がある。
ファクシミリのGmモードでは、A4サイズ(210X
297■■)で、約4Mbitのデータ容量があり、
lO分の1程度に圧縮しても400Kbitにもなる。
297■■)で、約4Mbitのデータ容量があり、
lO分の1程度に圧縮しても400Kbitにもなる。
しかも、m′fE度は8ドツト/ m m程度であるこ
とから、再現しても画質としては、あまり良いとは言え
ない。
とから、再現しても画質としては、あまり良いとは言え
ない。
そこで高速/高画質のファクシミリとしてGIVモード
がある。これはGmモードに比べて、倍の線密度の約1
6ドラ) / m mであるが、データ容1よとしては
4倍の1−6Mbitになってしまい、パーソナルコン
ピュータ等で扱うには記憶容門や処理速度、通信速度の
点で大いに聞題がある。
がある。これはGmモードに比べて、倍の線密度の約1
6ドラ) / m mであるが、データ容1よとしては
4倍の1−6Mbitになってしまい、パーソナルコン
ピュータ等で扱うには記憶容門や処理速度、通信速度の
点で大いに聞題がある。
従って、パーソナルコンピュータ上で扱うファイルとし
て、文書上の文字の部分にOCR(文字認識)処理を施
し、英数字なら1文字当たり8bit、j%7等であれ
ば1文字当たり16bitにコード化してファイル化す
れば、高画質な文字のままでありながら結果的に非常に
大きな圧縮効果を」−げることができる。例えばA4サ
イズ1枚につき約3000の文字があるとすれば、2−
4Kbit〜4.8Kbitで済み、元のイメージ情報
のままのデータ鷲に比べて数100分の1程度の圧縮効
果を有する。
て、文書上の文字の部分にOCR(文字認識)処理を施
し、英数字なら1文字当たり8bit、j%7等であれ
ば1文字当たり16bitにコード化してファイル化す
れば、高画質な文字のままでありながら結果的に非常に
大きな圧縮効果を」−げることができる。例えばA4サ
イズ1枚につき約3000の文字があるとすれば、2−
4Kbit〜4.8Kbitで済み、元のイメージ情報
のままのデータ鷲に比べて数100分の1程度の圧縮効
果を有する。
[発明が解決しようとする課題1
しかしながら、現状のOCRは英文字の場合。
多種多彩なプリンタの普及により、フォントの種類、サ
イズが数千種と増えたことから、漢字の場合には、その
数の多さ、煩雑さ、類似文字の多さにより、認識率の悪
さが聞題であり、最低許容レベルである99.5%を常
時越えるのは困難である。
イズが数千種と増えたことから、漢字の場合には、その
数の多さ、煩雑さ、類似文字の多さにより、認識率の悪
さが聞題であり、最低許容レベルである99.5%を常
時越えるのは困難である。
そこで本発明は、データ圧縮効果が高く、シかもオリジ
ナルに忠実であり、高画質で扱い易いファイール化が可
能な文書処理装置を提供することを目的とする。
ナルに忠実であり、高画質で扱い易いファイール化が可
能な文書処理装置を提供することを目的とする。
[課題を解決する手段]
本発明は、文書上の情報をドツトイメージの形で読み取
り、文字認識処理を施して文字コード情報の形に圧縮し
てファイル化する文書処理装置において、上記文字認識
処理によるコード化が適さない情報を含む領域を他の領
域から区別し、別途処理を施して、イメージ領域として
他の文字コード情報とともにファイル化することを特徴
とする特 *作用] 本発明では、イメージの形で取り込まれた文書」−の情
報に文字認識処理を施し、文字種を確定できた文字だけ
をコード化し、座標情報とフォントサイズ情報を付加し
てファイル化する。そして。
り、文字認識処理を施して文字コード情報の形に圧縮し
てファイル化する文書処理装置において、上記文字認識
処理によるコード化が適さない情報を含む領域を他の領
域から区別し、別途処理を施して、イメージ領域として
他の文字コード情報とともにファイル化することを特徴
とする特 *作用] 本発明では、イメージの形で取り込まれた文書」−の情
報に文字認識処理を施し、文字種を確定できた文字だけ
をコード化し、座標情報とフォントサイズ情報を付加し
てファイル化する。そして。
確定できなかった文字または文字と判定されなかった部
分だけをイメージ領域として限定し、画像処理、圧縮処
理を施して2値化イメージ情報のまま座標情報を付加し
て上記コード化情報と一緒にファイル化する。従って、
文字種の確定した部分は文字コードとフォントサイズと
座標情報とから、元の文字の復元が可能となり、その他
の部分は元のイメージのまま復元されるので圧縮効果が
高く、シかもオリジナルに忠実な形での復元が可能とな
る。
分だけをイメージ領域として限定し、画像処理、圧縮処
理を施して2値化イメージ情報のまま座標情報を付加し
て上記コード化情報と一緒にファイル化する。従って、
文字種の確定した部分は文字コードとフォントサイズと
座標情報とから、元の文字の復元が可能となり、その他
の部分は元のイメージのまま復元されるので圧縮効果が
高く、シかもオリジナルに忠実な形での復元が可能とな
る。
[実施例1
以下、画面を参照して本発明の実施例を詳細に説明する
。
。
第1図は、本実施例の文書処理装置におけるハードウ円
7の概略を示すブロック図である。
7の概略を示すブロック図である。
この文書処理装置は、装置全体の処理および後述する文
書認識、ファイル化等の全ての処理を司るCPUIと、
このCPUIが処理を行うための各種の制御プログラム
やデータを格納したROM2と、画像データをー時格納
したり、CPUIのワークエリアを確保するためのII
AM3と、後述する文書を読み取るための読取fs4と
、オペレータが各種入力等を行うための操作/表示部5
と。
書認識、ファイル化等の全ての処理を司るCPUIと、
このCPUIが処理を行うための各種の制御プログラム
やデータを格納したROM2と、画像データをー時格納
したり、CPUIのワークエリアを確保するためのII
AM3と、後述する文書を読み取るための読取fs4と
、オペレータが各種入力等を行うための操作/表示部5
と。
読取aB4から読み取られてファイル化されたデータを
ファイルするデータファイル部6とを有している。
ファイルするデータファイル部6とを有している。
第2図は、この実施例でファイル化される文書の一例を
示す模式図である。
示す模式図である。
この文fillは、社内等で利用される典型的なもので
あり、会社のマーク等を印刷したヘッダー部分■、写真
や挿入得1の中間調の部分@、大きさの異なる文字部分
O,サイン等の記入文字部分(6)Tを含んでいる。
あり、会社のマーク等を印刷したヘッダー部分■、写真
や挿入得1の中間調の部分@、大きさの異なる文字部分
O,サイン等の記入文字部分(6)Tを含んでいる。
以下、この文1ttをパーソナルコンピュータや通信装
置で扱い易いようファイル化する場合の手順を説明する
。
置で扱い易いようファイル化する場合の手順を説明する
。
第3図は、この手順を示すフローチャートである。
先ず、読取@4により、文書11からの反射光をレンズ
等でCCD等の充電変更素子に結像して多値データとし
て読み取り、RAM3に記憶したイメージデータを、予
めROM2に内蔵されたプログラムに従ってCPUIで
演算/処理する。
等でCCD等の充電変更素子に結像して多値データとし
て読み取り、RAM3に記憶したイメージデータを、予
めROM2に内蔵されたプログラムに従ってCPUIで
演算/処理する。
最初に、像域分離処理を行なう(51)、この処理は、
黒と白に近いデータしか無く、1データ当りの変化率が
激しい2値化処理されるべきと判定される文字領域と、
なだらかに変化し中間的な値のデータが多い中間調処理
されるべきと判定される中間調領域とに分ける処理であ
る。
黒と白に近いデータしか無く、1データ当りの変化率が
激しい2値化処理されるべきと判定される文字領域と、
なだらかに変化し中間的な値のデータが多い中間調処理
されるべきと判定される中間調領域とに分ける処理であ
る。
次に、像域分離処理によって文字領域と判断された部分
に対して、第2図に示す■〜■、■〜■のように1文字
ずつに文字を切り分ける処理を行なう(S2)。
に対して、第2図に示す■〜■、■〜■のように1文字
ずつに文字を切り分ける処理を行なう(S2)。
そして、文字認識処理のために、大きさの異なる文字領
域を同じ大きさに正規化する処理を施す(S3)、ここ
でフォントサイズや座標データが一時記憶される。
域を同じ大きさに正規化する処理を施す(S3)、ここ
でフォントサイズや座標データが一時記憶される。
次に、文学認識処理(S4)により、予めROM2に格
納されている各文字データの特長と類似点を比較し、最
も類似度の高い文字が決定される。
納されている各文字データの特長と類似点を比較し、最
も類似度の高い文字が決定される。
そして、次に文字種決定処理(S5)により、たとえば
■のように、白抜き文字で全体で1つのマークのように
なっている文字や、■のように、rとnと紛られしく類
似度が拮抗していて確定できない文字、あるいは■のよ
うに、サイン等の千古き文字等が一体化された文字、さ
らには■のように、汚れ等のだ−確定不可能な文字が決
定される。
■のように、白抜き文字で全体で1つのマークのように
なっている文字や、■のように、rとnと紛られしく類
似度が拮抗していて確定できない文字、あるいは■のよ
うに、サイン等の千古き文字等が一体化された文字、さ
らには■のように、汚れ等のだ−確定不可能な文字が決
定される。
そして、これらの文字は、前述の像域分離処理(Sl)
において中間調領域と判定された@の中間jLf1分と
一緒にイメージ領域とみなされ、最小面積化処理を施さ
れる(S6)、この最小面積化処理は、上記各イメージ
領域を、矩形の枠によって、M小の面積で囲むものであ
り、°各イメージ領域は、枠の左上と右下の座標ポイン
トを付加されて一時記憶される(S6)。
において中間調領域と判定された@の中間jLf1分と
一緒にイメージ領域とみなされ、最小面積化処理を施さ
れる(S6)、この最小面積化処理は、上記各イメージ
領域を、矩形の枠によって、M小の面積で囲むものであ
り、°各イメージ領域は、枠の左上と右下の座標ポイン
トを付加されて一時記憶される(S6)。
次に、誤差拡散法などの2値化処理やエツジ強調やノイ
ズ除去などの画像処理を施され(S7)、さらにデータ
圧餡処理が行なわれる(Sa)。
ズ除去などの画像処理を施され(S7)、さらにデータ
圧餡処理が行なわれる(Sa)。
そして、S5において文字コードに213換えられたサ
イズ/座標付きのデータと、、36〜S8において最小
面積化および画像処理されて座標データ付きで圧縮され
たイメージデータとを、一緒にファイル化する(59)
。
イズ/座標付きのデータと、、36〜S8において最小
面積化および画像処理されて座標データ付きで圧縮され
たイメージデータとを、一緒にファイル化する(59)
。
現状のファイルとしては、ボストスクリプトファイルが
多くのアプリケーションンフトでサポートされており、
これを用いることが最適である。
多くのアプリケーションンフトでサポートされており、
これを用いることが最適である。
なお、以上述べた像域分離処理、文字認識処理およびフ
ァイル化蔦理等は、記憶手段(ROM2)に予め内蔵さ
れたソフトウェアのアルゴリズムに基き、最近高速化の
著しいcpttiで高速に処理される。
ァイル化蔦理等は、記憶手段(ROM2)に予め内蔵さ
れたソフトウェアのアルゴリズムに基き、最近高速化の
著しいcpttiで高速に処理される。
以上のように、本実施例では、像城分離された文字領域
の中で文字認識処理を施し、確定度が高いと認識された
文字はコード情報に!!き換えてフォントサイズと座標
情報を付加してファイル化し、確定率の低い文字や中間
調領域は最小の大きさの領域を設定してイメージとして
処理を施し。
の中で文字認識処理を施し、確定度が高いと認識された
文字はコード情報に!!き換えてフォントサイズと座標
情報を付加してファイル化し、確定率の低い文字や中間
調領域は最小の大きさの領域を設定してイメージとして
処理を施し。
座標データと共にファイル化することから、ドツトイメ
ージデータのままの領域をできるだけ減らしてファイル
化して、圧縮率を向上でさ、データファイル部6におけ
る記憶容量の縮小を達成できるとともに、ファイルデー
タ通信時における通信時間の短縮を図ることができる。
ージデータのままの領域をできるだけ減らしてファイル
化して、圧縮率を向上でさ、データファイル部6におけ
る記憶容量の縮小を達成できるとともに、ファイルデー
タ通信時における通信時間の短縮を図ることができる。
[9,明の効果]
本発明によれば、文書に文字認識処理を施すことにより
、ドツトイメージデータから文字コードにlき換え、ド
ツトイメージデータのままの領域をできるだけ減らして
ファイル化することができ、単に全体をドツトイメージ
データのまま圧縮してファイル化する場合に比べて大幅
に圧縮効果が得られる。したがって、記憶領域も小さく
て済み、通信時間も大いに短總可能となる。
、ドツトイメージデータから文字コードにlき換え、ド
ツトイメージデータのままの領域をできるだけ減らして
ファイル化することができ、単に全体をドツトイメージ
データのまま圧縮してファイル化する場合に比べて大幅
に圧縮効果が得られる。したがって、記憶領域も小さく
て済み、通信時間も大いに短總可能となる。
また。文字認識できない部分については元のドツトイメ
ージデータのままファイル化するので、オリジナルに忠
実な形での復元が可能となる。
ージデータのままファイル化するので、オリジナルに忠
実な形での復元が可能となる。
第1図は、本発明の一実施例による文書処理装置の概略
を示すブロック図である。 第2wflは、一実施例でファイル化される文書の一例
を示す模式図である。 第3図は、同実施例におけるファイル化処理の手順を示
すフローチャートである。 1−・・CPU。 2−ROM 。 3・−RA M、 4・・・読取部。 5・・・操作/表示部、 6・・・データファイル部。 11・・・文書。 特許出願人 キャノン株式会社 同代理人 川久保 新 − 第1図 目CPUI IROMl IRAMIN取−11攻
−1レフアイjL吉臣l 第2図 −l (ircu′1τ F1o!l dcr+
ved +Oyプ第3図 (終了 )
を示すブロック図である。 第2wflは、一実施例でファイル化される文書の一例
を示す模式図である。 第3図は、同実施例におけるファイル化処理の手順を示
すフローチャートである。 1−・・CPU。 2−ROM 。 3・−RA M、 4・・・読取部。 5・・・操作/表示部、 6・・・データファイル部。 11・・・文書。 特許出願人 キャノン株式会社 同代理人 川久保 新 − 第1図 目CPUI IROMl IRAMIN取−11攻
−1レフアイjL吉臣l 第2図 −l (ircu′1τ F1o!l dcr+
ved +Oyプ第3図 (終了 )
Claims (6)
- (1)文書上の情報をドットイメージの形で読み取り、
文字認識処理を施して文字コード情報の形に圧縮してフ
ァイル化する文書処理装置において、 上記文字認識処理によるコード化が適さない情報を含む
領域を他の領域から区別し、別途処理を施してイメージ
領域として他の文字コード情報とともにファイル化する
ことを特徴とする文書処理装置。 - (2)請求項(1)において、 上記イメージ領域は、上記コード化が適さない情報を所
定形状の枠により最小の大きさで囲んだ領域であること
を特徴とする文書処理装置。 - (3)請求項(1)において、 上記コード化が適さない情報とは、像域分離処理により
抽出された中間調画像情報であることを特徴とする文書
処理装置。 - (4)請求項(1)において、 上記コード化が適さない情報とは、認識不可能な文字情
報であることを特徴とする文書処理装置。 - (5)請求項(1)において、 上記コード化が適さない情報とは、1つの文字として切
り出し不可能な文字情報であることを特徴とする文書処
理装置。 - (6)請求項(1)において、 上記コード化が適さない情報とは、確定度の低い文字情
報または二者択一で確定困難な文字情報であることを特
徴とする文書処理装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP1289178A JPH03149648A (ja) | 1989-11-07 | 1989-11-07 | 文書処理装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP1289178A JPH03149648A (ja) | 1989-11-07 | 1989-11-07 | 文書処理装置 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH03149648A true JPH03149648A (ja) | 1991-06-26 |
Family
ID=17739781
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP1289178A Pending JPH03149648A (ja) | 1989-11-07 | 1989-11-07 | 文書処理装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH03149648A (ja) |
-
1989
- 1989-11-07 JP JP1289178A patent/JPH03149648A/ja active Pending
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US9542752B2 (en) | Document image compression method and its application in document authentication | |
| US5539841A (en) | Method for comparing image sections to determine similarity therebetween | |
| Aradhye | A generic method for determining up/down orientation of text in roman and non-roman scripts | |
| US5410611A (en) | Method for identifying word bounding boxes in text | |
| US6788810B2 (en) | Optical character recognition device and method and recording medium | |
| JP4065460B2 (ja) | 画像処理方法及び装置 | |
| US11694459B2 (en) | On-device partial recognition systems and methods | |
| CN107247950A (zh) | 一种基于机器学习的身份证图像文本识别方法 | |
| JPH07200720A (ja) | 脱落書式文書画像圧縮 | |
| JPH05242292A (ja) | 分離方法 | |
| JPH01253077A (ja) | 文字列検出方法 | |
| CN113887484B (zh) | 一种卡片式文件图像识别方法和装置 | |
| Usilin et al. | Visual appearance based document image classification | |
| JPH08202815A (ja) | 書類の上下方向検知方法及び装置 | |
| CN116758550A (zh) | 表单图像的文本识别方法及其装置、电子设备、存储介质 | |
| JP2644477B2 (ja) | 画像処理方法 | |
| JPS5949671A (ja) | 光学的文字読取装置 | |
| JPS60581A (ja) | 光学式文字・画像入力装置 | |
| US20240062567A1 (en) | Learning Image Generation Apparatus, Learning Image Generation Method, And Non-Transitory Computer-Readable Recording Medium | |
| JP2894111B2 (ja) | 光学式活字文字認識装置における認識結果の総合判定方式 | |
| JPH04348475A (ja) | 画像情報検索方法及びその装置 | |
| JPS594358Y2 (ja) | 文字修正における文字制御装置 | |
| JP2917396B2 (ja) | 文字認識方式 | |
| JPS61107876A (ja) | 画像処理装置 | |
| CN118447134A (zh) | 基于位图的条形码打印方法、装置、设备及存储介质 |