JPH1125084A - 文字列変換装置およびそのプログラム記録媒体 - Google Patents

文字列変換装置およびそのプログラム記録媒体

Info

Publication number
JPH1125084A
JPH1125084A JP9186007A JP18600797A JPH1125084A JP H1125084 A JPH1125084 A JP H1125084A JP 9186007 A JP9186007 A JP 9186007A JP 18600797 A JP18600797 A JP 18600797A JP H1125084 A JPH1125084 A JP H1125084A
Authority
JP
Japan
Prior art keywords
dictionary
character string
field
unknown word
conversion
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Granted
Application number
JP9186007A
Other languages
English (en)
Other versions
JP3728877B2 (ja
Inventor
Toshihiro Kiuchi
俊啓 木内
Eisaku Nakatani
栄作 中谷
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Casio Computer Co Ltd
Original Assignee
Casio Computer Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Casio Computer Co Ltd filed Critical Casio Computer Co Ltd
Priority to JP18600797A priority Critical patent/JP3728877B2/ja
Publication of JPH1125084A publication Critical patent/JPH1125084A/ja
Application granted granted Critical
Publication of JP3728877B2 publication Critical patent/JP3728877B2/ja
Anticipated expiration legal-status Critical
Expired - Fee Related legal-status Critical Current

Links

Landscapes

  • Machine Translation (AREA)
  • Document Processing Apparatus (AREA)
  • Information Retrieval, Db Structures And Fs Structures Therefor (AREA)

Abstract

(57)【要約】 【課題】 入力文字列を漢字変換する際に、ユーザ自身
がどのような分野の文書を作成するかを意識することな
く、専門的な分野の文書であっても効率良く変換する。 【解決手段】 文書処理装置WPは入力文字列に該当す
る表記が一般辞書内に存在しなかった場合に、単漢字変
換や伸縮変換によって当該入力文字列を一般辞書を用い
て逐次変換されたか否かを判別する。逐次変換された場
合にはその文字列を未知語として蓄え、所定種類の未知
語が蓄えられた際にそれをデータベースサーバDBSへ
送信する。データベースサーバDBSはこの未知語が属
する分野を判定し、それに対応する分野別辞書を文書処
理装置WPへ送信する。文書処理装置WPは文書処理装
置WPからダウンロードされた分野別辞書を優先的に使
用してかな漢字変換を行う。

Description

【発明の詳細な説明】
【0001】
【発明の属する技術分野】この発明は、入力文字列を漢
字変換する文字列変換装置およびそのプログラム記録媒
体に関する。
【0002】
【従来の技術】従来、ワードプロセッサ等の文書処理装
置において、通常備えられているかな漢字変換辞書(一
般辞書)を用いてかな漢字変換を行う場合に、建築、医
学、化学、物理等のように専門的な分野の文書ほど、変
換率が極端に悪くなるため、このような専門分野の文書
を作成する際には、入力操作が面倒な単漢字変換や単語
変換等によって対処するようにしていた。あるいはユー
ザ自身が今回作成する文書の分野を判断し、その分野に
合った専門用語辞書を外部記憶媒体から文書処理装置へ
外部供給するようにしていた。
【0003】
【発明が解決しようとする課題】しかしながら、ユーザ
自身がどのような分野の文書を作成するかを常に意識し
なければならず、しかも外部記憶媒体をユーザ自身が保
管し、必要に応じて文書処理装置に装着するという手間
がかかるために、ユーザに大きな負担をかけていた。こ
の発明の課題は、入力文字列を漢字変換する際に、ユー
ザ自身がどのような分野の文書を作成するかを意識する
ことなく、専門的な分野の文書であっても効率良く変換
できるようにすることである。
【0004】
【課題を解決するための手段】この発明の手段は次の通
りである。請求項1記載の発明は、入力文字列を漢字変
換する文字列変換辞書として通常使用されている一般辞
書を記憶する第1の辞書記憶手段と、入力文字列を漢字
変換する文字列変換辞書として、専門分野毎に分類され
た分野別辞書を記憶する第2の辞書記憶手段と、入力文
字列に該当する表記が前記一般辞書に存在しなかった際
に、所定の操作によって当該入力文字列が一般辞書を用
いて逐次変換されたか否かを判別する手段と、この判別
手段によって逐次変換されたことが判別された際に、そ
の文字列を前記一般辞書に対する未知語として記憶する
未知語記憶手段と、この未知語記憶手段の内容に基づい
てその未知語が属する分野を判定し、それに対応する前
記分野別辞書を指定する辞書指定手段とを具備し、前記
辞書指定手段によって指定された分野別辞書を優先的に
使用して文字列変換を行うようにしたものである。な
お、前記辞書指定手段は、前記未知語記憶手段の内容と
分野別辞書の内容とを照合し、未知語に該当する表記が
存在する分野別辞書を指定するようにしてもよい。ま
た、前記辞書指定手段は、前記未知語記憶手段に所定数
の未知語が記憶された場合に、専門的な分野の文書を入
力していると判断すると共に、前記所定数の未知語のう
ち少なくても2以上の未知語が同一分野に属すると判断
した際に、その分野に対応する分野別辞書を指定するよ
うにしてもよい。更に、入力文字列を漢字変換する文字
列変換辞書として通常使用されている一般辞書を備えた
文書処理装置と、専門分野毎に分類された分野別辞書を
記憶管理する辞書管理装置とを備えた通信システムであ
って、前記文書処理装置は、入力文字列に該当する表記
が一般辞書に存在しなかった際に、所定の操作によって
当該入力文字列が一般辞書を用いて逐次変換されたか否
かを判別する判別手段と、この判別手段によって逐次変
換されたことが判別された際に、その文字列を前記一般
辞書に対する未知語として記憶する未知語記憶手段と、
この未知語記憶手段の内容を前記辞書管理装置に送信す
る送信手段とを具備し、前記辞書管理装置は、文書処理
装置から送信されて来た未知語に基づいてその未知語が
属する分野を判定し、それに対応する分野別辞書を指定
する辞書指定手段と、この辞書指定手段によって指定さ
れた分野別辞書を文書処理装置へ送信する送信手段とを
具備し、前記文書処理装置は辞書管理装置から送信され
て来た分野別辞書を優先的に使用して文字列変換を行う
ようにしてもよい。この場合、前記文書処理装置は辞書
管理装置から送信されて来た分野別辞書を記憶する辞書
記憶手段と、この辞書記憶手段に記憶されている分野別
辞書が所定期間使用されなかったか否かを判別する判別
手段と、この判別手段によって所定期間使用されなかっ
たことが判別された際に、前記辞書記憶手段から当該分
野別辞書を削除する削除手段とを具備するものであって
もよい。
【0005】請求項1記載の発明において、入力文字列
に該当する表記が一般辞書に存在しなかった際に、例え
ば、単漢字変換や伸縮変換操作等によって当該入力文字
列が一般辞書を用いて逐次変換されたか否かを判別し、
逐次変換されたことが判別された際に、その文字列は一
般辞書に対する未知語として未知語記憶手段に蓄えられ
る。この未知語記憶手段の内容に基づいてその未知語が
属する分野が判定され、それに対応する分野別辞書が指
定されると、指定された分野別辞書を優先的に使用して
文字列変換が行われる。したがって、入力文字列を漢字
変換する際に、ユーザ自身がどのような分野の文書を作
成するかを意識することなく、専門的な分野の文書であ
っても効率良く変換することができる。
【0006】
【発明の実施の形態】以下、図1〜図12を参照してこ
の発明の一実施形態を説明する。図1はクライアント・
サーバ・システムを示したシステム構成図である。この
システムは、複数台の文書処理装置WPとデータベース
サーバDBSとを構内専用回線を介して接続して成るロ
ーカルエリアネットワークシステムである。ここで、各
文書処理装置WPにはかな漢字変換用として通常使用さ
れる一般辞書を備えているが、専門分野毎に分類された
分野別辞書はデータベースサーバDBS側で記憶管理さ
れており、必要に応じてデータベースサーバDBSは分
野別辞書を文書処理装置WPへダウンロードするように
している。
【0007】図2(A)は文書処理装置WPの全体構成
を示したブロック図である。CPU1はRAM2内にロ
ードされている各種プログラムにしたがってこの文書処
理装置WPの全体動作を制御する中央演算処理装置であ
る。記憶装置3はオペレーティングシステムや各種アプ
リケーションプログラム、データファイル、かな漢字変
換辞書、文字フォントデータ等が予め格納されている記
憶媒体4やその駆動系を有している。この記憶媒体4は
固定的に設けたもの、もしくは着脱自在に装着可能なも
のであり、フロッピーディスク、ハードディスク、光デ
ィスク、RAMカード等の磁気的・光学的記憶媒体、半
導体メモリによって構成されている。また、記憶媒体4
内のプログラムやデータは、必要に応じてCPU1の制
御により、RAM2にロードされる。更に、CPU1は
通信回線等を介して他の機器側から送信されて来たプロ
グラム、データを受信して記憶媒体4に格納したり、他
の機器側に設けられている記憶媒体に格納されているプ
ログラム、データを通信回線等を介して使用することも
できる。そして、CPU1にはその入出力周辺デバイス
である入力装置5、表示装置6、印刷装置7がバスライ
ンを介して接続されており、入出力プログラムにしたが
ってCPU1はそれらの動作を制御する。入力装置5は
文字列データを入力したり、各種コマンドを入力するキ
ーボードの他、マウス等のポインティングデバイスを有
している。表示装置6は多色表示を行う液晶表示装置や
CRT表示装置あるいはプラズマ表示装置等であり、ま
た印刷装置7はフルカラープリンタ装置で、熱転写やイ
ンクジェットなどのノンインパクトプリンタあるいはイ
ンパクトプリンタである。
【0008】図2(B)はRAM2の主要構成を示し、
このRAM2には各種のメモリ領域が割り当てられてい
る。文書メモリ2−1は入力された文字列がかな漢字変
換処理によって確定される毎にその確定文字列が格納さ
れるテキストメモリである。一般辞書メモリ2−2はか
な漢字変換用の辞書として通常使用される一般辞書を記
憶するもので、記憶装置3に常駐されている一般辞書が
このメモリ2−2にロードされる。分野別辞書エリア2
−3はデータベースサーバDBSからダウンロードされ
たかな漢字変換用の専門分野別辞書が格納されるメモリ
領域である。候補バッファ2−4は一般辞書あるいは分
野別辞書を用いてかな漢字変換された際に、その変換結
果を候補文字列として一時記憶するもので、その内容は
表示装置6のテキスト画面に候補表示される。未知語メ
モリ2−5は入力文字列に該当する表記が一般辞書メモ
リ2−2に存在しなかった場合に、単漢字変換や伸縮変
換が指示されて当該入力文字列が一般辞書メモリ2−2
の内容にしたがってかな漢字変換(逐次変換)されたと
きに、その入力文字列(読み)と変換結果(表記)が未
知語として蓄積されるメモリである。ここで、未知語と
は一般辞書メモリ2−2に表記されていない単語であ
り、単漢字変換や伸縮変換によってユーザ自身が作り出
した単語を意味している。この未知語メモリ2−5に格
納された未知語が一定数(例えば10種類)に達した際
に、CPU1はこの未知語メモリ2−5の内容を自己の
ターミナルNo(マシンNo)と共にデータベースサーバD
BSへ送信する。辞書別日時メモリ2−6は専門分野別
辞書毎に日時データを記憶するもので、分野別辞書を用
いてかな漢字変換される毎にその分野別辞書に対応する
日時データを更新するようにしている。
【0009】図3(A)はデータベースサーバDBSの
全体構成を示したブロック図である。このデータベース
サーバDBSはCPU11、RAM12、記憶装置1
3、記憶媒体14、入力装置15、表示装置16を有す
る構成で、記憶装置13、記憶媒体14は上述した文書
処理装置WPの記憶装置3、記憶媒体4と基本的には同
様であるためその説明は省略するが、記憶媒体14には
図3(B)に示すように、未知語管理テーブルUMT、
専門分野別辞書SPD、未知語分野別辞書対応テーブル
COTが格納されており、それらは必要に応じてRAM
12にロードされる。ここで、文書処理装置WPから未
知語データが送信されて来ると、CPU11はこれをR
AM12内の未知語管理テーブルUMTに格納すると共
に、この未知語管理テーブルUMTと専門分野別辞書S
PDとの内容を照合し、未知語に該当する表記が存在す
る専門分野別辞書SPDを判定し、その判定結果を未知
語分野別辞書対応テーブルCOTにセットする。そし
て、この未知語分野別辞書対応テーブルCOTの内容を
解析することにより専門分野別辞書SPDを特定し、特
定した専門分野別辞書SPDを文書処理装置WPへ送信
するようにしている。
【0010】図4は未知語管理テーブルUMTの構成を
示したもので、文書処理装置WPを識別するターミナル
No毎に、未知語管理テーブルUMTはレコードNo(M
1、M2……Mn)、未知語データとしてその読み、表
記を記憶管理する構成となっている。図5は専門分野別
辞書SPDを例示したもので、(A)は物理用語辞書、
(B)は化学用語辞書を示し、各専門分野別辞書SPD
は読み、表記、Ai情報(用例)を記憶する構成となっ
ている。図6は未知語分野別辞書対応テーブルCOTの
構成を示したもので、この未知語分野別辞書対応テーブ
ルCOTはターミナルNo毎に備えられており、その行項
目には未知語情報を指定する未知語管理テーブルUMT
のレコードNoが固定的に記述され、また、その列項目に
は専門分野別辞書SPDを指定する辞書Noが固定的に記
述されており、このレコードNoと辞書Noとから成るマト
リックス上の各交点領域には、未知語がどの分野に属す
るかを判定した判定結果が記述される。この場合、図中
丸印はその判定結果を示している。
【0011】次に、文書処理装置WP、データベースサ
ーバDBSの動作を図7〜図11に示すフローチャート
にしたがって説明する。ここで、これらのフローチャー
トに記述されている各機能を実現するためのプログラム
は、CPU1(11)が読み取り可能なプログラムコー
ドの形態で記憶媒体4に記憶されており、その内容がR
AM2(12)内のワークメモリにロードされている。
図7は文書処理装置WPの全体動作の概要を示したフロ
ーチャートである。先ず、CPU1は入力待ち状態にお
いて(ステップA1)、何んらかの入力があると、入力
解析を行う(ステップA2)。いま、かな入力文字列に
対するかな漢字変換として通常、例えば、文節変換や複
合文節変換等の一括変換が行われる。すると、ステップ
A9に進み一括かな漢字変換処理が実行される。
【0012】図8はこの場合の一括変換処理を示したフ
ローチャートである。先ず、CPU1は一般辞書メモリ
2−2を参照して入力文字列を順次かな漢字変換してゆ
き(ステップB1)、第1候補としてその全てを単語や
複合語等に変換することができたかを調べ(ステップB
2)、第1候補としてその全てを変換することができた
場合には、その変換結果を候補バッファ2−4に格納し
(ステップB5)、また、その一部のみ第1候補として
変換できた場合にも未変換文字列を除き、第1候補とし
て変換された変換結果のみを候補バッファ2−4に格納
する(ステップB5)。いま、第1候補として変換する
ことができなかった未変換文字列が有る場合には、ステ
ップB3に進み、データベースサーバDBSからロード
された専門分野別辞書が1種類でも分野別辞書エリア2
−3に格納されているかを調べる。ここで、分野別辞書
が存在していなければ、ステップB4に進み、未変換文
字列を一般辞書メモリ2−2を参照することによって再
度かな漢字変換し、次候補として変換された変換結果を
候補バッファ2−4に格納する(ステップB5)。
【0013】このように候補バッファ2−4に変換結果
が格納されると、図7のステップA10に進み、候補バ
ッファ2−4の内容が候補表示されるが、その際、一括
変換された結果に、変換誤りが存在する場合には、次候
補変換の他に、単漢字変換や伸縮変換によって誤り箇所
の再変換を指示する。いま、伸縮変換や単漢変換が指示
されると、その箇所がかな文字列に戻されると共に(ス
テップA3、A6)、通常と同様の伸縮漢字変換処理
(ステップA4)や単漢字変換処理(ステップA7)が
実行されるが、その際、伸縮変換された文字列や単漢字
変換された文字列に伸縮変換や単漢字変換が行われたこ
とを示す識別子が付加される(ステップA5、A8)。
そして、その変換結果は候補バッファ2−4に格納され
たのち候補表示される(ステップA10)。いま、図1
2(A)に示すように、図中アンダーラインを付した文
字列が一般辞書を用いてかな漢字変換された変換候補と
する。この場合、この変換誤りを正すために単漢字変換
や伸縮変換が指示されると、当該文字列は仮文字列に戻
される(図12(B)参照)。この状態で単漢字変換や
伸縮変換が指示されると、図12(C)に示すような化
学全部の専門用語に変換されて候補表示される。
【0014】そして、変換確定が指示されると、ステッ
プA11に進み、未知語判定記憶処理が行われる。図9
はこの処理内容を詳述したフローチャートであり、先
ず、候補バッファ2−4内の変換文字列の中に伸縮変換
された文字列が含まれているかを調べると共に(ステッ
プC1)、単漢字変換された文字列が含まれているかを
調べる(ステップC2)。ここで、何れの変換方式で変
換された文字列が無ければ、このフローから抜けるが、
何れか一方の変換方式で変換された文字列が含まれてい
れば、ステップC3に進み、その文字列と同一の文字列
が未知語として既に未知語メモリ2−5内に格納されて
いるかを調べる。これは同一文字列を重複して未知語メ
モリ2−5にセットすることを避けるためであり、同一
文字列が無ければその文字列の読みと表記とを対応付け
て未知語メモリ2−5に格納する(ステップC4)。こ
れによって未知語メモリ2−5に格納された未知語が一
定数越えたかを調べる(ステップC5)。この場合、文
書作成中において、例えば10種類の未知語が蓄積され
ている場合には、一定数越えたものと判断し、未知語メ
モリ2−5の内容を自己のターミナルNoと共にデータベ
ースサーバDBSへ通信回線を介して送信するが(ステ
ップC6)、一定数以下であればステップC6の送信処
理は行われない。そして、図7のステップA12に進
み、候補バッファ2−4の内容を確定文字列として文書
メモリ2−1に格納する処理が行われる。
【0015】一方、未知語メモリ2−5の内容がデータ
ベースサーバDBSへ送信されると、データベースサー
バDBSは図11のフローチャートにしたがった動作を
行う。すなわち、CPU11は文書処理装置WPから送
信されて来た未知語をターミナルNoに対応付けて未知語
管理テーブルUMTに格納する(ステップD1)。そし
て、このターミナルNo領域における未知語管理テーブル
UMTの先頭位置に未知語ポインタをセットしておくと
共に(ステップD2)、専門分野別辞書SPDを順次ア
クセスするための分類別辞書ポインタに初期値をセット
しておく(ステップD3)。この状態において、辞書ポ
インタで指定された専門分野別辞書SPDを未知語ポイ
ンタで指定された未知語に基づいて検索し、当該専門分
野別辞書SPD内にその未知語が含まれているかを判定
する(ステップD4)。この結果、未知語に該当する表
記が専門分野別辞書SPDに存在していれば、未知語分
野別辞書対応テーブルCOTにその判定結果をセットす
る(ステップD5)。ここで、未知語分野別辞書対応テ
ーブルCOTは上述したように未知語に対応するレコー
ドNoが記述されており、その未知語が属する分野別辞書
が検索されると、それに対応する未知語分野別辞書対応
テーブルCOT内の交点領域に分野判定情報がセットさ
れる。そして、次の専門分野別辞書SPDを指定するた
めに辞書ポインタを更新し(ステップD6)、全辞書を
指定したか、つまり辞書終了かを調べ(ステップD
7)、終了でなければステップD4に戻り、上述の動作
を繰り返す。したがって、1つの未知語が複数の辞書内
に存在していれば、各辞書毎に未知語分野別辞書対応テ
ーブルCOT内に分野判定情報がセットされることにな
る。
【0016】このようにして最初の未知語と全辞書との
照合が終ると、未知語管理テーブルUMT内の次の未知
語を指定するために未知語ポインタを更新し(ステップ
D8)、同一のターミナルNoに対応する全ての未知語を
指定し終ったかを調べ(ステップD9)、未知語終了で
なければ、ステップD3に戻り、辞書ポインタに初期値
をセットし、以下、未知語が属する分野を判定するため
の処理を辞書ポインタを更新しながら繰り返す。これに
よって、未知語終了が検出されると、ターミナルNoに対
応する未知語分野別辞書対応テーブルCOTを解析し、
分野別辞書毎に未知語を計数する(ステップD10)。
このようにして辞書毎に求められた計数値に基づいて1
つの辞書内に複数種(例えば3以上)の未知語が含まれ
ているかによって分野別辞書を特定することができたか
を調べる(ステップD11)。ここで、1つでも辞書を
特定することができた場合には、特定された1または2
以上の専門分野別辞書SPDの内容をターミナルNoで指
定される文書処理装置WP側へ送信すると共に、特定さ
れた分野別辞書が複数存在する場合には、各辞書に対応
付けて未知語数(計数値)を送出する(ステップD1
2)。このように特定された辞書に未知語計数値を付加
して送出するのは、文書処理装置WP側において、複数
の分野別辞書のうちどの辞書を優先的に使用してかな漢
字変換を行うかを判断することができるようにするため
である。そして、当該ターミナルNoに対応する未知語管
理テーブルUMTおよび未知語分野別辞書対応テーブル
COTの内容をそれぞれクリアする処理が行われる(ス
テップD13)。なお、辞書を特定することができなか
った場合には、辞書送信処理は行わず未知語管理テーブ
ルUMT、未知語分野別辞書対応テーブルCOTをクリ
アする処理のみが行われる(ステップD13)。
【0017】ここで、データベースサーバDBSから送
信されて来た専門分野別辞書SPDを受信した文書処理
装置WPにおいては、それを自己の分野別辞書エリア2
−3に順次格納してゆく(ステップA13)。このよう
に分野別辞書がダウンロードされている状態において、
一括かな漢字変換が指示されると、図8のステップB1
において、かな漢字変換処理が実行され、その結果、第
1候補として変換されない文字列が存在していなければ
(ステップB2)、分野別辞書がロードされているかを
調べる(ステップB3)、いま、分野別辞書有りが検出
するため、ステップB6に進み、その辞書は現在使用中
かを調べる。ここで、分野別辞書がダウンロードされた
直後であれば、その辞書は使用中ではないので、ステッ
プB10に進み、ダウンロードされた直後の分野別辞書
を用いてかな漢字変換が行われる。この場合、ダウンロ
ードされた分野別辞書が複数存在するときには、各辞書
に付加されている未知語計数値を比較し、その計数値が
多い辞書を用いてかな漢字変換が行われる。そして、変
換された場合には(ステップB11)、その辞書を現在
使用中の分野別辞書として指定しておく(ステップB1
2)。そして、当該辞書に対応する辞書別日時メモリ2
−6内の日時データを更新する処理が行われるが(ステ
ップB13)、この場合、その辞書はダウンロードされ
た直後であるので、現在日時をその辞書に対応付けて辞
書別日時メモリ2−6に書き込まれる。また、上述のよ
うに分類別辞書を用いてかな漢字変換された変換文字列
は、候補バッファ2−4に格納される(ステップB
5)。
【0018】このように使用中辞書が指定された状態に
おいて、再び、この一括かな漢字変換処理に入り、ステ
ップB1、B2、B3からステップB6に進むと、使用
中分野別辞書が有ることが検出されるため、ステップB
7に進み、その使用中分野別辞書を用いてかな漢字変換
処理が行われ、変換された場合には(ステップB8)、
その辞書に対応する辞書別日時メモリ2−6の内容を更
新すると共に(ステップB13)、変換文字列を候補バ
ッファ2−4に格納する(ステップB5)。一方、使用
中の分野別辞書によっても変換することができなかった
場合には、他の分野別辞書が存在するかを調べ(ステッ
プB9)、既にデータベースサーバDBSから自己の文
書処理装置WPにその他の分野別辞書が転送されていれ
ば、ステップB10に進み、ダウンロードされた直後の
分野別辞書が他に有れば、その未知語計数値に基づいて
指定された分野別辞書を用いてかな漢字変換を行い、ま
た、辞書別日時メモリ2−6を参照し、更新日時の分野
別辞書を用いてかな漢字変換を行う。ここで、変換され
た場合には(ステップB11)、その辞書を使用中の辞
書として指定すると共にその辞書に対応する辞書別日時
メモリ2−6内の日時データを更新し、更に変換結果を
候補バッファ2−4に格納する(ステップB12、B1
3、B5)。なお、ステップB11で変換されなかった
ことが検出された場合にはステップB9に進み、他の分
野別辞書が有るかを再度調べる。このようにして各分野
別辞書を上述した優先順位にしたがって順次指定しなが
ら変換処理を行っても、変換することができなかった場
合にはステップB4に進み、一般辞書メモリ2−2を用
いて次候補のかな漢字変換処理を行い、その変換結果を
候補バッファ2−4に格納する。
【0019】以下、同様の動作は文書作成が終了するま
で繰り返される。ここで、文書作成の終了が指示される
と(図7のステップA17)、その文書作成時に得られ
た未知語メモリ2−5の内容をクリアすると共に、使用
中分野別辞書の指定をクリアする(ステップA18)。
また、電源が投入されてその直後であることが検出され
ると(ステップA14)、各種の初期化処理が行われた
のち(ステップA15)、辞書削除処理に移る(ステッ
プA16)。図10はこの辞書削除処理を示したフロー
チャートである。先ず、辞書別日時メモリ2−6の先頭
から1レコード分のデータを読み出し、その日時データ
と現在日時とから経過時間を求め、この経過時間が予め
設定されている一定期間を越えたかを調べる(ステップ
B2)。例えば、最新使用日時から2日(24時間)を
越えたかを調べ、越えていれば、当該辞書を分野別辞書
エリア2−3から削除する(ステップE3)。そして、
全ての辞書を指定し終ったかを調べ(ステップE4)、
全辞書終了までステップE1に戻り、上述の動作が繰り
返される。なお、辞書別日時メモリ2−6内に日時デー
タが設定されていなければ、当該辞書は削除対象外とさ
れる。
【0020】以上のように、このクライアント・サーバ
システムにおいて、各文書処理装置WPには一般辞書が
備えられ、データベースサーバDBSには各種の専門分
野別辞書が備えられており、文書処理装置WP側で一般
辞書を用いてかな漢字変換処理を行った際に、入力文字
列に該当する表記が一般辞書に存在しなかった場合に、
単漢字変換や伸縮変換によって当該入力文字列が一般辞
書を用いて逐次変換されたか否かを判別し、逐次変換さ
れたものであれば、その文字列を一般辞書に対する未知
語として未知語メモリ2−5に蓄えられてゆく。そし
て、この未知語メモリ2−5に所定数分の未知語が蓄え
られた際に、未知語メモリ2−5の内容がデータベース
サーバDBSに送信されると、データベースサーバDB
Sはそれを解析し、その未知語が属する分野を判定す
る。すると、この分野に対応する分野別辞書が文書処理
装置WPへダウンロードされるので、文書処理装置WP
側においてはこの分野別辞書を優先的に使用してかな漢
字変換を行うことができる。つまり、ユーザがどのよう
な分野の文書を入力している場合でも、その入力途中に
おいてその分野が自動的に判断され、豊富な分野別辞書
を記憶管理するデータベースサーバDBSからその分野
に対応する専門分野別辞書が送信されてダウンロードさ
れるため、以降の文書入力からは分野別辞書を優先的に
使用してかな漢字変換されるため、変換効率を落さずに
入力を続けることができる。したがって、ユーザ自身が
どのような分野の文書を作成するかを意識することな
く、専門的な分野の文書であっても効率良く変換するこ
とが可能となる。
【0021】また、データベースサーバDBS側におい
て、未知語が属する分野を判定する際に、未知語と分野
別辞書とを照合するようにしたから、キーワードテーブ
ル等を参照しなくても分野を判定することができると共
に、その判定を確実に行うことができる。また、文書処
理装置WP側において、未知語メモリ2−5内に未知語
が所定数達した際に、その内容をデータベースサーバD
BSへ送信して分野の判定を指示すると共に、分野を判
定する際にはその分野に複数の未知語が含まれているこ
とを条件とするため、分野の判定を確実に行うことがで
きる。更に、文書処理装置WP側においては分野別辞書
の使用状態を常時監視し、一定時間使用されない分野別
辞書を削除するようにしたから、分野別辞書エリア2−
3の膨大化を防ぐことができると共に、辞書の検索スピ
ードを不必要に低下させず、効率良い変換が可能とな
る。
【0022】なお、上述した一実施形態においては、分
野別辞書の使用状態を監視し、一定期間使用されていな
い場合にその辞書を削除するようにしたが、文書入力中
の変換回数を計数し、その計数値が一定回数を越えたこ
とを条件に分野別辞書を削除するようにしてもよい。ま
た、クライアント・サーバシステムについて説明した
が、スタンドアロンタイプの文書処理装置WPにも適用
可能である。この場合、文書処理装置WP自身が分野別
辞書を記憶管理していることが条件となり、現在入力さ
れている文書について分野が特定された場合にその分野
別辞書の検索順位を1番とすることで変換速度を上げる
ことができる。
【0023】
【発明の効果】この発明によれば、ユーザがどのような
分野の文書を入力している場合でも、その入力途中にお
いてその分野が自動的に判定され、それに対応する分野
別辞書を用いて文字列変換を行うことができるので、入
力文字列を漢字変換する際に、ユーザ自身がどのような
分野の文書を作成するかを意識することなく、専門的な
分野の文書であっても効率良く変換することが可能とな
る。
【図面の簡単な説明】
【図1】クライアント・サーバシステムを示したシステ
ム構成図。
【図2】(A)は文書処理装置WPの全体構成を示した
ブロック図、(B)はRAM2の主要構成を示した図。
【図3】(A)はデータベースサーバDBSの全体構成
を示した図、(B)はその主要記憶内容を示した図。
【図4】未知語管理テーブルUMTの構成を示した図。
【図5】専門分野別辞書SPDを例示したもので、
(A)は物理用語辞書、(B)は化学用語辞書を示した
図。
【図6】未知語分野別辞書対応テーブルCOTの構成を
示した図。
【図7】文書処理装置WPの全体動作を示したフローチ
ャート。
【図8】図7のステップA9(一括かな漢字変換処理)
を詳述したフローチャート。
【図9】図7のステップA11(未知語判別記憶処理)
を詳述したフローチャート。
【図10】図7のステップA16(辞書削除処理)を詳
述したフローチャート。
【図11】データベースサーバDBSの動作を示したフ
ローチャート。
【図12】かな漢字変換の具体例を示した図で、(A)
は一般辞書で変換した際に専門用語の変換誤りを例示し
た図、(B)は単漢字変換や伸縮変換を行う際に、変換
誤りの文字列がかな文字列に戻された例を示した図、
(C)は単漢字変換や伸縮変換後の文字列を例示した
図。
【符号の説明】
1、11 CPU 2、12 RAM 2−1 文書メモリ 2−2 一般辞書メモリ 2−3 分野別辞書エリア 2−4 候補バッファ 2−5 未知語メモリ 2−6 辞書別日時メモリ 3、13 記憶装置 4、14 記憶媒体 5 入力装置 6 表示装置 WP 文書処理装置 DBS データベースサーバ UTM 未知語管理テーブル SPD 専門分野別辞書 COT 未知語分野別辞書対応テーブル

Claims (6)

    【特許請求の範囲】
  1. 【請求項1】入力文字列を漢字変換する文字列変換辞書
    として通常使用されている一般辞書を記憶する第1の辞
    書記憶手段と、 入力文字列を漢字変換する文字列変換辞書として、専門
    分野毎に分類された分野別辞書を記憶する第2の辞書記
    憶手段と、 入力文字列に該当する表記が前記一般辞書に存在しなか
    った際に、所定の操作によって当該入力文字列が一般辞
    書を用いて逐次変換されたか否かを判別する手段と、 この判別手段によって逐次変換されたことが判別された
    際に、その文字列を前記一般辞書に対する未知語として
    記憶する未知語記憶手段と、 この未知語記憶手段の内容に基づいてその未知語が属す
    る分野を判定し、それに対応する前記分野別辞書を指定
    する辞書指定手段とを具備し、 前記辞書指定手段によって指定された分野別辞書を優先
    的に使用して文字列変換を行うようにしたことを特徴と
    する文字列変換装置。
  2. 【請求項2】前記辞書指定手段は、前記未知語記憶手段
    の内容と分野別辞書の内容とを照合し、未知語に該当す
    る表記が存在する分野別辞書を指定するようにしたこと
    を特徴とする請求項1記載の文字列変換装置。
  3. 【請求項3】前記辞書指定手段は、前記未知語記憶手段
    に所定数の未知語が記憶された場合に、専門的な分野の
    文書を入力していると判断すると共に、前記所定数の未
    知語のうち少なくても2以上の未知語が同一分野に属す
    ると判断した際に、その分野に対応する分野別辞書を指
    定するようにしたことを特徴とする請求項1記載の文字
    列変換装置。
  4. 【請求項4】入力文字列を漢字変換する文字列変換辞書
    として通常使用されている一般辞書を備えた文書処理装
    置と、専門分野毎に分類された分野別辞書を記憶管理す
    る辞書管理装置とを備えた通信システムであって、 前記文書処理装置は、入力文字列に該当する表記が一般
    辞書に存在しなかった際に、所定の操作によって当該入
    力文字列が一般辞書を用いて逐次変換されたか否かを判
    別する判別手段と、この判別手段によって逐次変換され
    たことが判別された際に、その文字列を前記一般辞書に
    対する未知語として記憶する未知語記憶手段と、この未
    知語記憶手段の内容を前記辞書管理装置に送信する送信
    手段とを具備し、 前記辞書管理装置は、文書処理装置から送信されて来た
    未知語に基づいてその未知語が属する分野を判定し、そ
    れに対応する分野別辞書を指定する辞書指定手段と、こ
    の辞書指定手段によって指定された分野別辞書を文書処
    理装置へ送信する送信手段とを具備し、 前記文書処理装置は辞書管理装置から送信されて来た分
    野別辞書を優先的に使用して文字列変換を行うようにし
    たことを特徴とする請求項1記載の文字列変換装置。
  5. 【請求項5】前記文書処理装置は辞書管理装置から送信
    されて来た分野別辞書を記憶する辞書記憶手段と、この
    辞書記憶手段に記憶されている分野別辞書が所定期間使
    用されなかったか否かを判別する判別手段と、この判別
    手段によって所定期間使用されなかったことが判別され
    た際に、前記辞書記憶手段から当該分野別辞書を削除す
    る削除手段とを具備したことを特徴とする請求項4記載
    の文字列変換装置。
  6. 【請求項6】コンピュータに対して、 入力文字列を漢字変換する文字列変換辞書として一般辞
    書の中に入力文字列に該当する表記が存在しなかった際
    に、所定の操作によって当該入力文字列が一般辞書を用
    いて逐次変換されたか否かを判別する機能と、 逐次変換されたことが判別された際にその文字列が前記
    一般辞書に対する未知語として記憶される未知語記憶手
    段の内容に基づいてその未知語が属する分野を判定し、
    入力文字列を漢字変換する文字列変換辞書として専門分
    野毎に分類された分野別辞書のうち、判定された分野に
    対応する分野別辞書を指定する機能と、 指定された分野別辞書を優先的に使用して文字列変換を
    行う機能を実現させるためのプログラムを記録した記録
    媒体。
JP18600797A 1997-06-27 1997-06-27 文字列変換装置およびそのプログラム記録媒体 Expired - Fee Related JP3728877B2 (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP18600797A JP3728877B2 (ja) 1997-06-27 1997-06-27 文字列変換装置およびそのプログラム記録媒体

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP18600797A JP3728877B2 (ja) 1997-06-27 1997-06-27 文字列変換装置およびそのプログラム記録媒体

Publications (2)

Publication Number Publication Date
JPH1125084A true JPH1125084A (ja) 1999-01-29
JP3728877B2 JP3728877B2 (ja) 2005-12-21

Family

ID=16180746

Family Applications (1)

Application Number Title Priority Date Filing Date
JP18600797A Expired - Fee Related JP3728877B2 (ja) 1997-06-27 1997-06-27 文字列変換装置およびそのプログラム記録媒体

Country Status (1)

Country Link
JP (1) JP3728877B2 (ja)

Cited By (8)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2006023805A (ja) * 2004-07-06 2006-01-26 Mitsubishi Electric Corp 携帯機器
JP2007241382A (ja) * 2006-03-06 2007-09-20 Casio Comput Co Ltd 電子辞書装置及び情報表示制御プログラム
JP2009135716A (ja) * 2007-11-29 2009-06-18 Kyocera Corp 端末装置、サーバ、通信システム及びプログラム
JP2010033139A (ja) * 2008-07-25 2010-02-12 Nec Corp 情報処理装置、電子辞書提供方法及びプログラム
JP2010102444A (ja) * 2008-10-22 2010-05-06 Sharp Corp 辞書検索機能付き文字列変換装置
JP2012194674A (ja) * 2011-03-15 2012-10-11 Omron Corp 文字変換用辞書の更新方法および文字変換用辞書の更新情報作成システム
JP2013232220A (ja) * 2005-06-30 2013-11-14 Google Inc 非標準位置ベーステキスト入力
JP2015170357A (ja) * 2014-03-04 2015-09-28 バイドゥ オンライン ネットワーク テクノロジー(ペキン) カンパニー リミテッド セルラレキシコンをプッシュするための方法及びサーバ

Cited By (11)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US8972444B2 (en) 2004-06-25 2015-03-03 Google Inc. Nonstandard locality-based text entry
US10534802B2 (en) 2004-06-25 2020-01-14 Google Llc Nonstandard locality-based text entry
JP2006023805A (ja) * 2004-07-06 2006-01-26 Mitsubishi Electric Corp 携帯機器
JP2013232220A (ja) * 2005-06-30 2013-11-14 Google Inc 非標準位置ベーステキスト入力
JP2007241382A (ja) * 2006-03-06 2007-09-20 Casio Comput Co Ltd 電子辞書装置及び情報表示制御プログラム
JP2009135716A (ja) * 2007-11-29 2009-06-18 Kyocera Corp 端末装置、サーバ、通信システム及びプログラム
JP2010033139A (ja) * 2008-07-25 2010-02-12 Nec Corp 情報処理装置、電子辞書提供方法及びプログラム
JP2010102444A (ja) * 2008-10-22 2010-05-06 Sharp Corp 辞書検索機能付き文字列変換装置
JP2012194674A (ja) * 2011-03-15 2012-10-11 Omron Corp 文字変換用辞書の更新方法および文字変換用辞書の更新情報作成システム
JP2015170357A (ja) * 2014-03-04 2015-09-28 バイドゥ オンライン ネットワーク テクノロジー(ペキン) カンパニー リミテッド セルラレキシコンをプッシュするための方法及びサーバ
US9916288B2 (en) 2014-03-04 2018-03-13 Baidu Online Network Technology (Beijing) Co., Ltd. Method and server for pushing cellular lexicon

Also Published As

Publication number Publication date
JP3728877B2 (ja) 2005-12-21

Similar Documents

Publication Publication Date Title
CN101206558B (zh) 包括打印作业检索功能的信息处理设备和信息处理方法
EP1411448A2 (en) Data searching apparatus
JPH113338A (ja) 多言語入力システム、多言語入力方法及び多言語入力プログラムを記録した記録媒体
JPH1027089A (ja) コンピュータ操作支援装置
US20090094030A1 (en) Indexing method for quick search of voice recognition results
JPWO2004111876A1 (ja) 検索条件を再利用する検索システムおよび方法
JP3728877B2 (ja) 文字列変換装置およびそのプログラム記録媒体
JP2003131776A (ja) 情報処理装置、文字列入力装置、および確定履歴制御方法
US6963865B2 (en) Method system and program product for data searching
JPH05101102A (ja) 検索装置
JP3489365B2 (ja) 表データ処理装置
JPS60176169A (ja) 文章処理装置
JPH11265378A (ja) 自動情報検索装置及び文書作成支援システム
JPH10187751A (ja) 認識データ処理装置およびそのプログラム記録媒体
JP2000322442A (ja) データベース検索装置およびデータベース検索プログラム記憶媒体
JPH06139278A (ja) 文字コード変換機能を備えた文字列検索装置
JPH10198667A (ja) 文字列変換装置およびそのプログラム記録媒体
JPH10301940A (ja) 情報処理装置及びその方法
JPH0535798A (ja) データベース検索装置
JPH0259963A (ja) 文章データベース処理方式
JP2000250721A (ja) プリンタドライバ方法及びプリンタドライバプログラムを記録した媒体
JP2000057135A (ja) 文書作成装置
SE456284B (sv) Forfarande for hantering av datamengder, t ex resultatet av en fraga mot en databas, och overforing av dessa mellan sinsemellan olika systemenheter med olika adresser, vilka systemenheter krever olika dataformat
JPH0830629A (ja) 文書処理装置
JPH0237466A (ja) 情報処理システム

Legal Events

Date Code Title Description
A977 Report on retrieval

Free format text: JAPANESE INTERMEDIATE CODE: A971007

Effective date: 20040511

A131 Notification of reasons for refusal

Free format text: JAPANESE INTERMEDIATE CODE: A131

Effective date: 20040518

A521 Written amendment

Free format text: JAPANESE INTERMEDIATE CODE: A523

Effective date: 20040624

TRDD Decision of grant or rejection written
A01 Written decision to grant a patent or to grant a registration (utility model)

Free format text: JAPANESE INTERMEDIATE CODE: A01

Effective date: 20050913

A61 First payment of annual fees (during grant procedure)

Free format text: JAPANESE INTERMEDIATE CODE: A61

Effective date: 20050926

R150 Certificate of patent or registration of utility model

Free format text: JAPANESE INTERMEDIATE CODE: R150

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20081014

Year of fee payment: 3

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20091014

Year of fee payment: 4

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20091014

Year of fee payment: 4

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20101014

Year of fee payment: 5

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20101014

Year of fee payment: 5

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20111014

Year of fee payment: 6

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20111014

Year of fee payment: 6

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20121014

Year of fee payment: 7

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20121014

Year of fee payment: 7

FPAY Renewal fee payment (event date is renewal date of database)

Free format text: PAYMENT UNTIL: 20131014

Year of fee payment: 8

LAPS Cancellation because of no payment of annual fees