JPH0689276A - 文書処理装置 - Google Patents
文書処理装置Info
- Publication number
- JPH0689276A JPH0689276A JP4239308A JP23930892A JPH0689276A JP H0689276 A JPH0689276 A JP H0689276A JP 4239308 A JP4239308 A JP 4239308A JP 23930892 A JP23930892 A JP 23930892A JP H0689276 A JPH0689276 A JP H0689276A
- Authority
- JP
- Japan
- Prior art keywords
- character
- data
- document
- points
- typeface
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Landscapes
- Character Input (AREA)
- Document Processing Apparatus (AREA)
Abstract
読み取ると共に、これら各文字毎のポイント数および書
体種を各データとして読み取る文字読取部と、各文字毎
のポイント数を認識するポイント数情報テーブル2と、
各文字毎の書体種を認識する書体種情報テーブル3と、
上記の各情報テーブル2・3にて認識された各文字デー
タを文書データとして記憶する文書バッファ4とを備え
て、上記の文書データに対して各種の制御処理を施す文
書処理部とから構成される。 【効果】 これにより、文書データをなす各文字の文字
コードに加えて、各文字毎のポイント数と書体種とをデ
ータとして文書処理部の文書バッファ4に記憶させるこ
とができる。
Description
ムへの応用も可能な日本語ワードプロセッサへの入力、
光ファイルシステムへの入力、あるいはカード作成など
のデータ入力などパーソナルコンピュータへの入力に供
せられる文字読取手段を備えた文書処理装置に関するも
のである。
ter Reader)により原稿の文書データを光学的に読み込
ませ、この文書データに対して各種の制御処理を施す文
書処理装置は、以下のようなプロセスによりデータの処
理を行うようになっている。
してビットイメージを記憶し、このビットイメージを文
字単位に区切り矩形状にすることで、ビットイメージの
散布状況やクセを拾い出す。これにより、マッチング辞
書で文字としての認識を行い文字コードを得る。そし
て、上記の文字コードを送信データ化し、これを文書処
理部へ送信することで、文書処理部にて文書データに対
する各種の制御処理を施す。
ような文書処理装置では、OCRにより読み取りを行う
データは、文字コードのみであるため、文書処理部に送
られてくる送信データには、文字のポイント数や書体種
のデータが含まれていない。このため、文書処理部での
データの受信後、ユーザは文書編集機能を使って文字の
ポイント数や書体種など文字原稿に沿った文書作成をや
り直さなければならないという問題を有している。
は、上記の課題を解決するために、以下の手段を講じて
いる。
ると共に、これら各文字毎のポイント数および書体種を
各データとして読み取る文字読取手段と、文字読取手段
にて読み取った各文字毎のポイント数を認識するポイン
ト数認識手段と、文字読取手段にて読み取った各文字毎
の書体種を認識する書体種認識手段と、上記の各認識手
段にてポイント数および書体種が認識された各文字コー
ドを文書データとして記憶する文書記憶手段とを備えて
いる。
各文字コードを読み取ると共に、各文字毎のポイント数
と書体種との各データを読み取る。そして、この文字読
取手段で読み取ったポイント数、および書体種の各デー
タを、各々、ポイント数認識手段、および書体種認識手
段で認識し、これを文書データとして文書記憶手段に記
憶させる。これにより、原稿の各文字に応じた文字コー
ド、ポイント数、および書体種を各データとして記憶さ
せることができるため、例えば、上記の文書データをプ
リントアウトする際などは、ポイント数および書体種の
各条件設定を省くことで操作性の向上を招来することが
できる。
基づいて説明すれば、以下の通りである。
文字(文書データ)をコード化して読み取る文字読取部
(文字読取手段)と、この文字読取部にて読み取った文
書データに対して各種の制御処理を施す文書処理部とか
ら構成されている。
ず、図示しないOCR(Optical Character Reader)に
より原稿の各文字を光学的にビットイメージとして読み
取る(S1)。尚、上記のOCRは、ビットイメージと
しての文字コードの読み取りに伴い、これら各文字毎の
ポイント数および書体種を各データとして読み取るもの
である。そして、上記のビットイメージに対してマッチ
ング処理を施すべく、ビットイメージの散布状態などか
ら文字として成立するように矩形状の範囲指定を行い最
小単位にビットイメージを区分けする(S2)。
ットイメージの特徴、クセなどからマッチング辞書と照
合していく。その結果、類似度の高い文字の文字コー
ド、ポイント数、書体種などが得られる。尚、マッチン
グは、単独で行うと、言葉として意味がなくなる虞れが
あるので、前後の文字の認識結果を参考にし、特徴情報
を補正強化することで認識率を上げる。また、文字コー
ドは、誤認識の対応策として複数個を出力するものと
し、候補文字リストの中で自立語が形成されるのであれ
ば、第1位の候補にその文字コードを持ってくる処理を
行う(S3)。
立語単位でのポイント数、および書体種を統一すべく、
ポイント数の調整(S4)、および書体種の調整(S
5)を行う。尚、上記ポイント数の調整は、自立語中で
最も大きいポイント数にそろえることで行われ、また、
書体種の調整は、自立語中での多数決あるいは最初に出
てきた書体種にそろえることで行われるものである。
れたポイント数、書体種、文字コードなどを送信データ
として後述する文書処理部に送信して(S6)、以上の
ような文字読取部での処理プロセスを終了する。
例えば「日本の首都は東京である」という文書におい
て、「日本の首都は」が7.5ポイントの教科書体、「東
京」が10.5ポイントのゴシック体、「である」が8ポ
イントの教科書体の場合、その送信フォーマットは、図
3に示すようなフォーマットとして送信されるものであ
る。尚、図3に示すフォーマットは、文字数、候補文字
コード、チェックサムなどを省略した暫定的な例示フォ
ーマットである。
に、文字読取部からの送信データを受信データとして記
憶する受信バッファ1と、受信データにおける各文字毎
のポイント数を認識するポイント数情報テーブル(ポイ
ント数認識手段)2と、受信データにおける各文字毎の
書体種を認識する書体種情報テーブル(書体種認識手
段)3と、上記の各情報テーブル2・3にて認識された
各文字データを文書データとして記憶する文書バッファ
(文書記憶手段)4とを備えている。
セスについて説明する。
れてくるデータを受信して、これを受信データとして受
信バッファ1に記憶する。
ドについては、候補文字の選択処理を施す(S11)。
これは、例えば「日」という文字をOCRで読み取った
場合でも、必ずしも「日」の文字として認識されるとは
限らない。そのため、受信データの文字コードとして幾
つかの候補文字コードが抱き合わせてあり、例えば
「日」の場合では、「白」「臼」「目」などのように、
ユーザが画面上などで適切な文字コードをそれらの候補
から選択し文書バッファ4への入力を行う。
のデータについては、受信バッファ1から取り出したポ
イント数のデータがポイント数情報テーブル2にあるか
否かを検索する(S12)。S12の検索においてポイ
ント数のデータがポイント数情報テーブル2になけれ
ば、その中で最も近いポイント数を選択する。例えば、
ポイント数情報テーブル2に、6.5ポイント、8ポイン
ト、9ポイント、10ポイント、および12ポイントの
5種類のポイント数が登録されている場合、受信バッフ
ァ1から取り出したポイント数のデータが7.5ポイント
なら、それに最も近い8ポイントとして処理が行われ
る。
入力設定状態から、現在幾つのポイント数で入力される
かを文書バッファ4より知り、ポイント数の置き換え処
理で得られたポイント数と照合して、同じであれば、文
書バッファ4への処理が免除される。一方、ポイント数
が異なる場合には、文書バッファ4の入力設定状態をそ
のポイント数に設定する(S13)。尚、この設定は、
次のポイント数、または受信データの最後のデータを処
理するまでは有効であるが、それ以降の処理について
は、受信前のカーソル位置以降のポイント数に影響を及
ぼすため、元のポイント数に自動的に戻るものである。
ータについては、受信バッファ1から取り出した書体種
のデータが書体種情報テーブル3にあるか否かを検索す
る(S14)。S14の検索において書体種のデータが
書体種情報テーブル3になければ、文書処理装置の基本
書体種である明朝体を選択する。例えば、書体種情報テ
ーブル3に、明朝体、ゴシック体、正楷書体、行書体、
および丸ゴシック体の5種類の書体種が登録されている
場合、受信バッファ1から取り出した書体種のデータが
教科書体なら、基本書体種である明朝体として処理が行
われる。
入力設定状態から、現在何の書体種で入力されるかを文
書バッファ4より知り、書体種の置き換え処理で得られ
た書体種と照合して、同じであれば、文書バッファ4へ
の処理が免除される。一方、書体種が異なる場合には、
文書バッファ4の入力設定状態をその書体種に設定する
(S15)。尚、この設定は、次の書体種、または受信
データの最後のデータを処理するまで有効であるが、そ
れ以降の処理については、受信前のカーソル以降の書体
種に影響を及ぼすため、元の書体種に自動的に戻るもの
である。
は、原稿の各文字(文書データ)をコード化して読み取
ると共に、これら各文字毎のポイント数および書体種を
各データとして読み取る文字読取部と、文字読取部から
の送信データを受信データとして記憶し、この受信デー
タに対して各種の制御処理を施す文書処理部とから構成
されている。また、上記の文書処理部は、受信データに
おける各文字毎のポイント数を認識するポイント数情報
テーブル2と、受信データにおける各文字毎の書体種を
認識する書体種情報テーブル3と、上記の各情報テーブ
ル2・3にて認識された各文字データを記憶する文書バ
ッファ4とを備えている。
コードに加えて、各文字毎のポイント数と書体種とをデ
ータとして文書処理部の文書バッファ4に記憶させるこ
とができる。従って、本文書処理装置にプリンタを接続
させて文書データの印刷を行わせるような場合には、原
稿の文書データに応じたポイント数および書体種で自動
的にプリントアウトすることができる。
に、原稿の各文字をコード化して読み取ると共に、これ
ら各文字毎のポイント数および書体種を各データとして
読み取る文字読取手段と、文字読取手段にて読み取った
各文字毎のポイント数を認識するポイント数認識手段
と、文字読取手段にて読み取った各文字毎の書体種を認
識する書体種認識手段と、上記の各認識手段にてポイン
ト数および書体種が認識された各文字コードを文書デー
タとして記憶する文書記憶手段とを備えている構成であ
る。
さ(ポイント数)と書体種とを認識して、これを文書デ
ータとして文書記憶手段に記憶させることができる。従
って、本文書処理装置にプリンタを接続させて文書デー
タの印刷を行わせるような場合には、原稿の文書データ
に応じたポイント数および書体種で自動的にプリントア
ウトすることができ、ひいては、操作性を向上させた便
利な文書処理装置を提供することができるという効果を
奏する。
する文字読取部でのデータ処理プロセスを示すフローチ
ャートである。
説明図である。
ある。
すブロック図である。
Claims (1)
- 【請求項1】原稿の各文字をコード化して読み取ると共
に、これら各文字毎のポイント数および書体種を各デー
タとして読み取る文字読取手段と、 文字読取手段にて読み取った各文字毎のポイント数を認
識するポイント数認識手段と、 文字読取手段にて読み取った各文字毎の書体種を認識す
る書体種認識手段と、 上記の各認識手段にてポイント数および書体種が認識さ
れた各文字コードを文書データとして記憶する文書記憶
手段とを備えていることを特徴とする文書処理装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP4239308A JP3025382B2 (ja) | 1992-09-08 | 1992-09-08 | 文書処理装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP4239308A JP3025382B2 (ja) | 1992-09-08 | 1992-09-08 | 文書処理装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPH0689276A true JPH0689276A (ja) | 1994-03-29 |
| JP3025382B2 JP3025382B2 (ja) | 2000-03-27 |
Family
ID=17042788
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP4239308A Expired - Lifetime JP3025382B2 (ja) | 1992-09-08 | 1992-09-08 | 文書処理装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JP3025382B2 (ja) |
Cited By (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2017098621A (ja) * | 2015-11-18 | 2017-06-01 | 京セラドキュメントソリューションズ株式会社 | 情報出力装置及び情報出力プログラム |
| JP2017222093A (ja) * | 2016-06-15 | 2017-12-21 | 京セラドキュメントソリューションズ株式会社 | 広告出力装置及び広告出力プログラム |
-
1992
- 1992-09-08 JP JP4239308A patent/JP3025382B2/ja not_active Expired - Lifetime
Cited By (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2017098621A (ja) * | 2015-11-18 | 2017-06-01 | 京セラドキュメントソリューションズ株式会社 | 情報出力装置及び情報出力プログラム |
| JP2017222093A (ja) * | 2016-06-15 | 2017-12-21 | 京セラドキュメントソリューションズ株式会社 | 広告出力装置及び広告出力プログラム |
Also Published As
| Publication number | Publication date |
|---|---|
| JP3025382B2 (ja) | 2000-03-27 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US5119437A (en) | Tabular document reader service | |
| US4850026A (en) | Chinese multifont recognition system based on accumulable stroke features | |
| JPS63155386A (ja) | 帳票デ−タ読取装置 | |
| US5905811A (en) | System for indexing document images | |
| US4566039A (en) | Facsimile system | |
| US6535652B2 (en) | Image retrieval apparatus and method, and computer-readable memory therefor | |
| US5224180A (en) | Facsimile apparatus and the method | |
| JPH0689276A (ja) | 文書処理装置 | |
| US5638495A (en) | Printing apparatus | |
| JPH06150061A (ja) | 文書認識装置 | |
| JPH10289226A (ja) | 文字処理装置, 文字処理システム, 文字処理方法およびその方法をコンピュータに実行させるためのプログラムを記録したコンピュータ読み取り可能な記録媒体 | |
| KR20050003075A (ko) | 문자인식기능과 전자사전을 구비하는 휴대통신장치및 문자인식기능을 구비하는 전자사전 | |
| JPH04348475A (ja) | 画像情報検索方法及びその装置 | |
| JP2976990B2 (ja) | 文字認識装置 | |
| JP3217442B2 (ja) | 光学的文字読み取り装置 | |
| JPH05210635A (ja) | 入力装置 | |
| JPH08194772A (ja) | 光学的文字読取り装置 | |
| JPS63155385A (ja) | 光学文字読取装置 | |
| JP2931485B2 (ja) | 文字切出し装置及び方法 | |
| JPS63187367A (ja) | デ−タの登録検索方式 | |
| JPH01117464A (ja) | 通信制御装置 | |
| JP2003303316A (ja) | 文字認識装置、文字認識用辞書およびプログラム | |
| JPS61226883A (ja) | 文字認識装置 | |
| JPH0728945A (ja) | 文字認識装置 | |
| JPH06259594A (ja) | 光学的読取りデータの処理方法及び同装置 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20080121 Year of fee payment: 8 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20090121 Year of fee payment: 9 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20100121 Year of fee payment: 10 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20110121 Year of fee payment: 11 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20120121 Year of fee payment: 12 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20130121 Year of fee payment: 13 |
|
| EXPY | Cancellation because of completion of term | ||
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20130121 Year of fee payment: 13 |