JPS61184676A - 仮名漢字変換方式 - Google Patents

仮名漢字変換方式

Info

Publication number
JPS61184676A
JPS61184676A JP60024615A JP2461585A JPS61184676A JP S61184676 A JPS61184676 A JP S61184676A JP 60024615 A JP60024615 A JP 60024615A JP 2461585 A JP2461585 A JP 2461585A JP S61184676 A JPS61184676 A JP S61184676A
Authority
JP
Japan
Prior art keywords
word
storage device
kana
dictionary storage
words
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP60024615A
Other languages
English (en)
Inventor
Yoshitoshi Yamauchi
佐敏 山内
Katsuhiko Fujita
克彦 藤田
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Ricoh Co Ltd
Original Assignee
Ricoh Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Ricoh Co Ltd filed Critical Ricoh Co Ltd
Priority to JP60024615A priority Critical patent/JPS61184676A/ja
Publication of JPS61184676A publication Critical patent/JPS61184676A/ja
Pending legal-status Critical Current

Links

Landscapes

  • Machine Translation (AREA)
  • Document Processing Apparatus (AREA)

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 技術分野 本発明は仮名漢字変換方式、詳細には1日本語ワードプ
ロセッサ等のような言語処理技術を用いた仮名漢字変換
方式に関する。
従来技術 従来、日本語ワードプロセッサ等のような日本語処理装
置においては、オペレータが操作する入力装置に入力し
た仮名文字列に対して、仮名と漢字の混在した仮名漢字
の変換を行っている。このような仮名漢字変換方式の中
で、特に漢字単語と漢字単語とを接続して形成する複合
語の処理の問題が大きくなってきている。
特に、特公昭58−4378号公報に開示されているよ
うに、漢字音の組合せにより単語辞書を検索し、単語同
士の合成が可能かどうかの判定手を有し、それの判定結
果により単語同士の合成の確定、非確定を行う方式や、
特開昭56−38665号公報に開示されているように
、単語間同士の結び付きの強さを検定して複合語となり
うるかどうかの判定を行う方式がある。
しかし、これらの方式では判定の仕方が複雑で。
それだけ仮名漢字変換の処理の仕方が複雑化してしまう
欠点があった・ 目     的 本発明はこのような従来技術の欠点を解消し。
より簡単に複合語を形成し、しかも複合語を1つの単語
として扱うことにより、より単純化された仮名漢字変換
方式を提供することを目的とする。
構   成 本発明は上記の目的を達成させるため、入力装置により
入力された仮名文字列を単語辞書記憶装置内で検索する
ことにより単語単位の変換候補を抽出して、漢字と仮名
の混在した仮名漢字に変換する仮名漢字変換方式におい
て、隣接単語の組合せを複合語として抽出し、抽出した
複合語が候補語として有効かどうかの判定を行い、判定
して有効な複合語を1つの単語として扱うことにより仮
名漢字変換を行うことを特徴としたものである。
以下1本発明の実施例に基づいて具体的に説明する。
第1図は本発明を日本語ワードプロセッサに適用したと
きの機能別全体ブロック図である。第1図において、本
実施例はキーボード1、入力文字列バッファ2)仮名漢
字変換制御部3、単語辞書記憶装置4、複合語辞書記憶
装置5、品詞活用表部6、接続重み表部7、評硫器8.
出力文字列バッファ9.陰極総管(CRT)10.文書
ファイル部11、プリンタ12から構成されている。
キーボード1は、入力装置の一例で、ひらがな。
かたかな、アルファベット等の文字、数字、記号等の表
音文字を入力する表音文字キー、仮名漢字変換を指示す
る変換キー等を有する。入力文字列バッファ2はキーボ
ード1から次々に入力される入力仮名文字列を一次的に
蓄積し、仮名漢字変換処理を終了した入力仮名文字列を
部分的に次々と消去する。
仮名漢字変換制御部3は仮名漢字の処理手順のプログラ
ムを記憶するメモリと、入力文字列バッファ2からデー
タを取込んだり、そのデータをもとにして後述の単語、
複合語辞書記憶装置3,4を検索したりしてデータを取
込む際のバッファと。
品詞活用表部6から列(うけ)と行(かかり)の位置の
データを取込んだり、接続重み表部7から該当する接続
重みのデータを取込む際のバッファと。
評価器8から演算した評価値とか第1位候補語(候補語
の中で評価最大の候補語)や第2位候補語を記憶してお
くメモリと、ワークエリアとを含み、後述するように他
の機能の制御をする。
単語辞書記憶装置4は表音文字である入力仮名文字列を
表記するのに必要な表記文字である単語(たとえば、自
立語、付属語、接辞語や助数詞等。
また、動詞、形容詞の活用形すべてを各−単語として扱
う。)の読み、その表記、その品詞、その頻度ランク(
0〜15の16ランク化)、その出力順位学習、複合語
辞書記憶装置5のアドレスもしくはシーケンスナンバー
となるポインタの項目を格納している。頻度ランクFは
その単語の出現頻度をfとすると、F= [Qogaf
)+1  (ただし、〔〕はガウス記号)で表わされる
。ここで、aの値は、実験から経験的に定められるもの
で、6である。
複合語辞書記憶装置5は、単語辞書記憶装置4中に格納
されている単語が複数つらなって1つの概念を表わす複
合語で、隣りどうしの単語の関係を記述している辞書。
例えば、「超高速飛行機」の2つの単語同士の組合せで
ある「超−高速」。
「高速−飛行」、「飛行−機」の組合せで複合語を構成
することを表現する。
この辞書記憶装置5の表現方式はいろいろとあるが、第
1の方式として単語辞書記憶装置4中の各単語のアドレ
スもしくはシーケンシャルナンバーを複合語の構成とな
るように対で記録しておく。
第2の方式として、単語辞書記憶装置4中のポインタ欄
に複合語辞書記憶装置5の対応語の先頭格納アドレスを
記憶しておき、複合語辞書記憶装置5の中には複合語を
形成している後続単語の単語辞書記憶装置4中のアドレ
スもしくはシーケンシャルナンバーを記録しておく。な
お、「超高速飛行機」等のように後続の単語が複数ある
場合は連続して記録しておく。その場合、他の前出単語
に対応する後続単語との境界の識別は先頭の1ビツトを
0と1とを交互に変化させて使用することにより行われ
る。第3の方式として第2の方式のように複合語辞書記
憶装置5の中には後続単語の単語辞書記憶装置4中のア
ドレス等の代りにその単語の読みを格納しておく、他の
前出単語に対応する後続単語の読みとの境界の識別は第
2の方式と同様でよい。本実施例では上記第2の方式で
まず説明し1次に上記第1、第3の方式で説明する。
品詞活用表部6は単語辞書記憶装置4を検索して抽出し
た単語の品詞とその単語の前後に接続する単語の品詞で
もって後述の接続重み表部7の接続重み表の行(かか各
月と列(うけ)の場所を決定するための索引表を格納し
ている。なお、体言系は「かかり」と「うけ」の行番号
1列番号のみが記録しであるが、用言系は語尾をも記録
しである。
接続重み表部7は品詞の行と列とが配置され。
それらの交差部分にマトリックス状に単語間の接続の程
度である重みを示す数値が配置されている。
品詞活用表部6で指定した行番号と列番号との交差部の
数値がそれらの品詞を有する単語間の接続の強さを示す
。その中の数値としては0;接続不可。1;接続するこ
とはあるが非常にまれである。
2;一般的に接続する。3;特に接続が強い。というよ
うに4ランクに設定しである。
評価器8は単語辞書記憶装置4がら抽出した単語のよみ
長、頻度ランク、また、接続重み表部7から抽出した単
語間の接続重み等のパラメータにより、扱っている単語
がその位置にありうる尤らしさを評価する。なお、評価
演算する式の一例としては、 単語の読み長×3+頻度ランク+(接続重み)2=評価
値を用いる。ただし、本実施例では複合語も1つの単語
として取扱かう。
出力文字列バッファ9は評価器8で評価された単語を評
価値順に一時的に蓄積したり、確定した単語を順次確定
順に記憶する。
CRTIOは表示装置の1例で、出力文字列バッファ9
に一時的に蓄積された未確定の単語列で一番評価値の高
い単語例を表示して、オペレータがらの確定かどうかの
確認をつるだめの表示装置である。
文書ファイル部11は、CRTloで確認、修正された
単語列を文書的にファイ゛ル化して蓄積する記憶装置で
ある。
プリンタ12は文書ファイル部11の内容をプリントア
ウトする装置である。
第2図は単語辞書記憶装置4の内容の一部の一例を模式
的に示した図、第3図は複合語辞書記憶装置5の内容の
3種類の実施例で、第3図(a)は前述の第1の方式で
、一点鎖線の部分を除き、左側には、該当単語のポイン
タに相当する複合語辞:J!記憶装置5のアドレスが記
録されており、真中には前出単語の単語辞書記憶装置4
におけるアドレスが記録されており、右側には、その該
当単語の後続単語の単語辞書記憶装置4におけるアドレ
スが記録されている。第3図(b)は前述の第2の方式
で、一点鎖線の部分を除き、境界識別フラグが1ビツト
で左側に記録されており、右側には、後続単語の単語辞
書記憶装置4におけるアドレスが記録されている。第3
図(e)は前述の第3の方式で、一点鎖線の部分を除き
、左側に同じく境界識別フラグが、右側に後続単語の読
みが記憶されている。
第4図は品詞活用表部6の内容の一部を模式的に示した
図で、「うけ」の欄および「かかり」の欄に列番号、行
番号が記録されている。
第5図は接続重み表部7の接続重み表の一例を模式的に
示した図で、行には品詞活用表のかがり番号(行番号)
を示し、列には品詞活用表のうけ番号(列番号)を示し
、それらの番号の行列部には4ランクの接続重みの数値
が格納されている。
第6図は単語および複合語を抽出して評価器・8で評価
値を算出した後の仮名漢字変換制御部3内の候補語用の
バッファの内容を模式的に示した図である。
第7図は本実施例の一例を示すフローチャートである。
次に「最近は多くの兼業農家がいます。」の仮名漢字変
換文を作成する例で説明する。「最近は多くの」までの
解析が進んでいて、その文の末尾の[の」は格助詞の「
の」として切り出されているとする。この時点では品詞
活用表部6の表の格助詞「の」の欄のrがかりJがら接
続重み表部7の行(かかり)番号を指定している状態で
ある。
次に、キーボード1から「けんぎょうのうが・・・」と
次々と入力され、それは、一旦入カ文字列バッファ2に
蓄積される。この人力時には、キーボード1から1文字
入力がある毎に(S20)、記号か文字かの判断がなさ
れ(S21)、文字の場合、n文字たまったかどうかの
判断がなされる(S 22)。
記号の場合は次のプロセスに進行するが、文字の場合、
所定のn文字が入力文字列バッファ2にバッファされる
までは次のプロセスに進行しない。なお、それらの判断
は、仮名漢字変換制御部3で行う。「けんぎようのうか
・・・・Jという具合いにn文字(たとえばn=6)が
入力文字列バッファ2に蓄積されると、「け」、けん」
、「けんぎよう」、「けんぎようの」の種類の文字列の
組である単語辞書検索用の仮名文字列が仮名漢字変換制
御部3で作成される(S23)。仮名漢字変換制御部3
はそれらの検索用仮名文字列の読みに従って単語辞書記
憶装置4を検索しくS 24)、  r毛」、「気」。
「券」、1県」・・・「兼業」、「検校」等の表記文字
の単語を候補語としてあげる。その時、第2図に示され
ているそれらの各単語の品詞、頻度ランク、出力順位、
ポインタ等のデータを取出してバッファする。
次に、複合語辞書記憶装置5のアドレスに対応するポイ
ンタがあるかどうかの判定を仮名漢字変換制御部3は行
う(S25)。
たとえば、表記「検校」の単語のポインタは65535
番で、これは16進表示でFFFFに相当し、この場合
、複合語辞書記憶装置!i5の該当アドレスはないので
、複合語辞書記憶装置5を検索する必要はなく評価処理
に進む。
表記「兼業」の単語のポインタは7533番で、これは
65535番とは異なるので、複合語がある。したがっ
て、仮名漢字変換制御部3は複合語辞書記憶袋[5をそ
のアドレスで検索する(826)。複合語辞書記憶袋W
5のアドレス7533番の位置で、第3図(b)に示し
であるように境界識別フラグに1がたっているのを仮名
漢字変換制御部3は確認し、続いて、フラグが1となっ
ている範囲の内容、すなわち、ここでは後続単語のアド
レス17634番号と23115番地とを取出す。
アドレス17634番地で単語辞書記憶装置4により仮
名漢字変換制御部3が単語を検索すると。
表記「者」の単語を取出す。仮名漢字変換制御部3はそ
のm語の読みrしやJと、入力文字列バッファ2中の[
けんぎようのうかが・・・・」の「けんぎよう」の次の
文字列「のう」と照合する。これは不一致となるので1
次のアドレス23115@の単語を同様に検索すると1
表記「農家」の単語が取出される。同様に、この単語の
読みである「のうか)と入力文字列バッファ2の中の仮
名文字列のrけんぎようjの次の仮名文字列の「けんぎ
よう」の次の仮名文字列「のうか」とが照合される。こ
れは一致するので、この単語の「農家」の品詞である6
4(漢語名詞)と頻度ランクである3と出力順位lとポ
インタ65535とが仮名漢字変換制御部3により単語
辞書記憶装置4より取出されてバッファされる(328
)。
この複合語候補として取出された単語の「農家」は、次
のようにして新たに1つの単語、「兼業農家」として評
価器8で評価される。読み長はr兼業」である前単語と
、「農家」である後続単語の両者の和で8であり、頻度
ランクは両単語の内で低い方で「農家」の頻度ランク3
である。「兼業農家」の複合語の前の単語「の」との接
続重みを検定する場合、仮名漢字変換制御部3は「の」
に接続する単語である「兼業」の品詞が漢語す変名詞で
あることがわかっているから、品詞活用表面6内の表に
したがって接続重み表の列(うけ)番号を取出して接続
重み表部7に転送し、同様に格助詞「の」の行「かかり
」番号をすでに接続重み表部7に転送しであるから、そ
れらの列および行番号から第5図の接続重み表で接続重
み3を仮名漢字変換制御部3は取出す。評価器8は評価
式にしたがフて上記数値を用いて「兼業農家」の評価値
を演算した結果、36となった。
他の単語、たとえば表記r兼業」、「検校」。
1県」、「券」・・・についても、それらの品詞は漢語
す変名詞、漢語名詞、漢語名詞、漢語名詞であり、それ
らの列番号の格助詞「の」の行番号とで第5図から接続
重み3,3,3.3がそれぞれ取出される。
また、それらの頻度ランクは仮名漢字変換制御部3が単
語辞書記憶装置4を仮名文字列から検索した時に明らか
で、「兼業」、「検校」、「県」、「券ノ・・・の頻度
ランクはそれぞれ8,1,11゜15となる。
前述したように表記「兼業」、「検校」を除き。
表記「県」については、複合語「県境」・・・1表記「
券」については複合語「券契」・・・がある。
上記「兼業」と同様にして仮名漢字変換制御部3は複合
語辞書記憶装置5を1次に単語辞書記憶装置4を検索し
て1表記「県境」な「券契」の複合語を形成する。しか
し、これらはすべて入力文字列バッファ2の読みと異な
り、たとえば表記「県境」の読みは「けんざかい」であ
り、比較する仮名文字列の読みは「けんぎよう」で明ら
かに異なる。そのようにして仮名漢字変換制御部3は読
みを比較し、表記「県」、「券」・・・については適当
な複合語はないと判断し、その表記で評価器8で評価値
を下記のように算出する。
表  記 読み長×3+頻度ランク+(接続重み)2=
評価値兼  業  5X3     8      3
2    32兼業農家  8X3    3    
 32   36検  校  5X3    1   
   32    25県    2x3    11
      32    26券   2x3    
5     32   20このようにして、次々と評
価器8で評価値を算出し、仮名漢字変換制御部3の候補
語バッファに第6図のように格納しておく、すなわち、
仮名漢字変換制御部3は、仮名文字列にしたがって単語
辞書記憶装置4を検索して抽出した第2図に示した情報
およびその後、複合語辞書記憶装置5と単語辞書記憶装
置4を検索して形成した有効な複合語の情報を内部の候
補語バッファに格納し、その後、評価器8で算出した評
価値を加える形で候補語バッファに第6図のように格納
する。
このようにして、仮名漢字変換制御部3が単語辞書記憶
装置4.複合語辞書記憶装置5をすべて検索した単語も
しくは複合語について、評価器8による評価値の算出が
終了したとする。仮名漢字変換制御部3は評価値の高い
情報を出力文字列バッファ9に出力し、それには表記「
兼業農家」、「兼業」、「検校」の順位で蓄積される。
ここで、評価値の1番高い単語である「兼業農家」を表
示する語として仮に確定し、行(かかり)番号を指定す
る品詞は接続語の「農家」の漢語名詞を用い。
品詞活用表部6の表から行(かかり)番号を設定する。
こ1:で、仮名漢字変換制御部3は、最優先の単語の評
価値、すなわち、候補語の中の最大の評価値を積算し、
その積算値がある閾値を越えたらトリガ信号を発しく5
40)、このトリガ信号を出力文字列バッファ9が入力
すると、その積算した評価値の単語までの未確定単語列
を確定して(S41)、 それを文書ファイル部11は
所定の記憶位置に記憶する。
もし、トリガ信号が発生しなかった場合には、未だ未確
定のまま、次の仮名文字列の解析に移る。
次に、入力文字列バッファ2内の仮名文字列は1けんぎ
ょうのうかJを削除し「かいます。」となり、この場合
、句読点の記号があるのでn文字なくても被検索文字列
作成に移る(S23)。
上記と同様に、「が」、「がい」、rがいま」。
「かいます」の単語辞書検索用の文字列が仮名漢字変換
制御部3内で作成され、第7図のフローチャートにした
がって上記と同様に仮名漢字変換制御部3が単語辞書記
憶装置4を検索し、「が」(格助詞)、「概」(−字漢
語名詞)、「害」(−字漢語名詞)。
「該」(漢語連体詞)等の単語を候補語としてあげる。
上記と同様の手順によって一番評価値の高い格助詞の「
が」が取出される。
この際、格助詞「が」と先の複合語「兼業農家」との接
続検定は次のように行われる。仮名漢字変換制御部3は
、「兼業農家」の後続文字である「農家」の品詞である
漢語名詞から品詞活用表部6で行番号を取出し、「が」
の品詞である格助詞から品詞活用表部6で列番号を取出
し、その行、列番号から接続重み表部7から接続の重み
3を取出す。これによって、「兼業農家」と格助詞「が
」とは十分接続することがわかる。また、「農家」の漢
語名詞の接続語として一字漢語名詞である「概」、「害
」および漢語連体詞である「該」は接続重み表部で接続
検定のさい、いずれも接続重みが0となっていることか
ら、これらの語は評価器に送られない。
次に補助動詞の[いJが取出され、次の丁寧助動詞の「
ます」が取出されて解析され、句読点によりトリガ信号
が発せられ、それらの変換語が確定され、「最近は多く
の兼業農家がいます。」の仮名漢字変換された文が文書
ファイル11に蓄積される。それをプリントアウトしよ
うとする時にはプリンタ12によりプリントアウトすれ
ばよい。
上記実施例では複合語辞書記憶装置5の構成は第3図(
b)の第2の方式を用いて説明したが、それは第3図(
a)の第1の方式を用いても同様に説明できる。
たとえば、単語辞書記憶装置4に格納されている表記「
兼業」のポインタ7533番を取出し。
複合語辞書記憶装置Sのアドレス7533番地で、2つ
の情報を順次取出す。その1つは11379−1763
4で、この2つのアドレスで単語辞書検索用W14を橋
索すると、「兼業−者」となり。
その読みは「けんぎようしや」となる。その読みと、入
力文字列バッファ2内の仮名文字列の「けんぎようのう
」とを仮名漢字変換制御部3で照会すると明らかに不一
致で、その複合語は無効となる。
次に、他のもう1つの情報であるアドレスの組合せ、1
1379−23115をもとにして単語辞書記憶装置4
を検索すると「兼業−農家」となり、その読みは「けん
ぎようのうか」となる。その読みは入力文字列バッファ
2内の仮名文中列の「けんぎょうのうか」とを仮名漢字
変換制御部3で照合すると明らかに一致し、その複合語
は有効となる。有効となった複合語は1つの単語として
前述のように扱かわれて仮名漢字変換処理に利用される
。
同様に、複合語辞書記憶装置5を第3図(c)の構成に
しても仮名漢字変換処理できる。
たとえば、単語辞書記憶装置4に格納されている「兼業
」のポインタ7533番を取出し、複合語辞書記憶袋に
5のアドレス7533番で、境界識別フラグか「1」と
なっている(第3図(c)参照のこと)部分の読み「し
や」と「のうかjとを取出す、それらの読みと入力文字
列バッファ2内の仮名文字列の「のうか」とを照合すれ
ば[のうかJが後続単語となる。それを仮名漢字変換制
御部3は単語辞書記憶装置4で検索し1表記「農家」を
抽出する。これにより「兼業農家」の複合語が単語とし
て評価される。また、「検校」についてはポインタが6
5535番で複合語となりえず、そのままである、した
がって、「兼業農家」が1つの単語として最優先候補語
となり仮名漢字変換に利用される0本発明は、この他に
も、第3図の一点鎖線で示したように、複合語示書記憶
装置内に頻度ランクの欄を設けておけば、評価値を算出
する際に都合がよい。
次に1本発明の他の実施例を、説明する。
第8図は、第1図における評価器8と仮名漢字変換制御
部の機能ブロック図である。
仮名漢字変換制御部3は、入力文字列バッファ2の入力
文の先頭から辞書引きを行い、それぞれ区切られた読み
に対応する漢字を抽出して、制御部3内の単語バッファ
に格納する。その場合、第1のエリアには読みと漢字情
報を、第2のエリアには品詞の頻度を示す情報を、また
第3のエリアには単語の読みの長さの情報を、第4のエ
リアには単語の品詞情報を、それぞれ格納する。接続重
み表部7は、先行する単語の品詞と当該単語の接続の可
否を、113 II、 112 II、 II I I
I等の重みで表現したテーブルを参照することによって
行い、その結果を評価器8に入力する。評価器8は、入
力された品詞間の接続重みと、制御部3の単語バッファ
第3のエリアから取出した単語の読み長と、第2のエリ
アから取出した品詞の頻度情報とにもとづき、最尤評価
値を演算する。つまり、第8図に示すように、読み長3
1と1品詞ごとの頻度32と、接続重み33とから最尤
評価34を行い、その結果にもとづいて、仮名漢字変換
制御部3で、同音語の判別35を順位学習により行い、
出力文字列バッファ9に出力する。
第9図は、第1図に示す単語辞書記憶装置4の記憶状態
を表す図である。
例えば、いま、「コラショウ」という入力文があった場
合を考える。辞書メモリ2には、第9図(a)、(b)
に示すように、「−こ」、「こう」、「こうしJ、「こ
うしよう」の各々について、読み。
品詞、頻度ランク、表記(漢字)、出力順位等が格納さ
れている。(a)の最上段の「こうしよう」には、名詞
の「校章」、す変名詞の「交渉」、「考証」、「公称」
、「口承」1等があり、また形容動詞の「高尚」がある
。また、(b)の「こう]には、名詞のr甲J、r項」
、接頭語のr高」、接尾語の「項J、「候」等がある。
ここで、頻度ランクとは、品詞の頻度をそれぞれ計算し
、それらの値が所定の範囲内に収まるようにするため、
対数化してΩogANで表わしたものである。Aを種々
変化させることによって、全体の範囲を変更することが
できる。また、出力順位は、同音語の中で出力される順
序を使用者が指定した値、1゜2.3.・・が記憶され
ている。
第10図は、第1図における接続重み表部7に格納する
品詞ごとの接続可否表示テーブルの図である。
第1O図のテーブルでは、縦列に先行する単語の品詞、
横列に当該読みの品詞が、それぞれ配列されており、そ
れらの交点に接続され得る値が示されている。接続され
る値としては、数値の大きい方が接続の可能性が大きい
ことを表わしている。
例えば1名詞の後に助詞の「が」が接続される重みはI
I 31#であるのに対して、名詞の後に名詞が接続さ
れる重みは“1″である。
さて、第1図の評価器8は、下記の式にもとづいて評価
し、選択する。
V=P(1+gf+c’       ・・・−(1)
ここで、P+g+rは係数であって、実験の結果にもと
づいて決定される値である。また、aは読み長、fは品
詞の頻度ランク、Cは接続重みを。
それぞれ示している。ここでは、P =3− g ” 
l 9r =2として計算する。
例えば、「ネダンコウショウ・・・・」という入力があ
り、最初の単語が「値段」と決定された場合、これに接
続される単語は、「コラ」、または「コラショウ」のい
ずれかであるとする。第3図(a)、(b)より、Ql
ftGにそれぞれの値を代入する。先ず、名詞の「校章
」は、Q=5.f=7.c;1であるから、V= (3
X 5)+(I X7)+(lxt)=15+7+1=
23となる。また、す変名詞の「交渉」は、fl=5.
f=11゜c=1であるから、V=(3X 5)+(I
 X 11 )+(I XI)=15+11+1=27
となる。また。
名詞の「甲」は、12=2.f=5.c=1であるから
、 V=(3x 2)+N x 5)+(t x N=
6 +5+1=12となる。なお、Qは第9図の辞書の
読みの数を計数すればよ<、gは同じく第9図の辞書の
頻度ランクの数値を抽出すればよく、またCは第10図
の接続重みテーブルから名詞の後に続く助詞ならば′3
″、す変動間ならば1111#を抽出すればよい。この
結果、ここまででは、す変名詞の「交渉」が、最も評価
値が高く、27であるため、「値段」に接続される単語
として「交渉」を出力することになる。このようにして
、評価器8で算出された最尤評価の最も高い単語(前例
では、「交渉」)と、それに続く出力順位に「考証」。
「公称」、r口承」の単語情報を出力し、これ・らを出
力文字列バッファ9の評価値エリアに格納するとともに
、制御部3内の単語バッファの読みと漢字情報を、出力
文字列バッファ9の品詞別車語群評価値エリアに格納す
る。
次に、仮名漢字変換制御部3では、前回の最尤評価の際
の出力順位を記憶しておき、最も高い評価値の単語を出
力するが、その単語と異なる単語が使用者によって指定
されたときには、その指定された単語を出力するととも
に、記憶しである出力順位を変更する。記憶しである順
位の変更方法としては1例えば、(a)使用者によって
変更指定された単語を第1順位に昇格させる方法、(b
)使用者によって指定された単語の順位を1つだけ上げ
る方法、(c)使用者に指定された単語にフラグを立て
る方法、つまり前回指定があったことのみを表示する方
法等がある。上記(a)の方法では。
同じ使用者が継続してこの装置を使用する場合にはよい
が、使用者が頻繁に変更する場合にはその都度変更指定
の必要があり、使い難い。また(b)の方法では、例え
ば、第9図(a)では、「コラショウ」のす変名詞の第
1順位は「交渉」で、以下、「考証」、「公称」、「口
承」の順序になっているが、ここで使用者から「口承」
が指定されたときには、順位4から順位3に昇格させ、
再度指定されたとき、順位3から順位2に昇格させるの
である。このようにすることにより、使用者が頻繁の変
更してもそれに追従して、使用者による最適な単語のば
らつきを補正することができる。また、上記(C)の方
法では、フラグを立てるのみで、前回指定されたことを
表示するだけであるから、使用者による最適な単語のば
らつきに対して強いという利点がある一方、同一使用者
からは同じ単語に対し繰り返して変更指定を受ける心配
がある。
このようにして順位学習による同音語判別を行った後、
仮名漢字変換制御部3から出力された単語を、出力文字
列バッファ9の優先順エリアに格納する。
効   果 以上、説明したように、本発明によれば、仮名文字列と
複合語の読みとを比較して判定するので、簡単に有効な
複合語を判定することができ、また、複合語を1つの単
語として扱うので、それだけ複合語の処理および仮名漢
字変換が単純化され、処理し易くなる。さらに、単語の
読みの長さと、品詞ごとの使用頻度と、接続重みとによ
り最尤評価を行い、単語の出力順位情報にもとづき所定
の単語を選択するので、常に固定的に同じ単語が出力さ
れることなく、使用者対応に最適な単語を抽出すること
ができ、使用者による選択のばらつきを少なくすること
ができる。
【図面の簡単な説明】
第1図は本発明の一実施例を示す仮名漢字変換装置の全
体ブロック構成図、第2図は第1図の単語辞書記憶装置
の内容の一部を示す図、第3図は第1図の複合語辞書記
憶装置の内容の一部を示す図・第4図は第1図の品詞活
用表部の内容の一部を示す図、第5図は第1図の接続重
み表部の内容の一部を示す図、第6図は評価後の仮名漢
字変換制御部内のバッファの内容を示す図、第7図は第
1図の動作過程を示すフローチャート、第8図は第1図
の評価器および仮名漢字変換制御部の機能ブロック図、
第9図は第、1図の単語辞書記憶装置の記憶状態を示す
図、第10図は第1図の接続重み表部内の接続重みテー
ブルを示す図である。 1:キーボード、2:入力文字列バッファ、3:仮名漢
字変換制御部、4:単語辞書記憶装置、5:複合語辞書
記憶装置、6:品詞活用表部、7:接続重み表部、8:
評価器、9:出力文字列バッファ、LO:CRT、11
:文書ファイル部、12:プリンタ。 ;4.−j−’ 図面の?1111F (内′どfに変更なし)第7図 第   8   図 第9図 (1)    (b) 第   10   図 手続補正書(自発) 昭和60年3月18日 昭和60年 特 許 願第24615 号2)発明の名
称 仮名漢字変換方式 3、 補正をする者 事件との関係 特許出願人 4、代理人 7.1!、 M iE (Q IAI ’f4  ’A
mLT’2rMKMmWe、’4Km’:’J’JIR
手続補正書(自発) 昭8160年5月7日 昭和60年特 許 願第24615 号2)発明の名称
 仮名漢字変換方式 34  補正をする者 事件との関係 特許出願人 4、代理人 5・1. 補正により増加する発明の数  な   し
く1)明Rag第6頁5行の「指示する変換キー等を有
する・」を、「指示する変換キー、同音語判別の結果を
指示するキー等を有する・」に補正する。 (2)明II瞥第7頁11行のrF=CQogafl+
1」を、rF= [Qoga f]+IJに補正する。 (3]明細書第8頁11行〜14行の「なお、「超高速
飛行機」等のように・・・・・に対応する後続単語との
境界の識別は」を、「なお、他の前出単語に対応する後
続単語との境界の識別は」に補正する。 (4)明my第9頁20行の「よみ長、頻度ランク、」
を、「よみ長、品詞ごとの頻度ランク、」に補正する。 (5)明細署第10頁13行の「高い単語例を表示して
、」を、[高い品詞中の出力順位lの単語例を表示して
、」に補正する。 (6)明細書第11頁4行〜7行の「前述の第1の方式
で、一点鎖線の部分を・・・・・・前出単語の単語辞書
記憶装置4における」を1次のように補正する。 「前述の第1の方式で、枠外左側には、該当単語のポイ
ンタが示す複合語辞書記憶装置5のアドレスを参考に示
しているが、実際には記憶は必要ない、実線枠内左側に
は前出単語の単語辞書記憶装[4における」 (7)明細書第17頁19行〜20行の「下記のように
算出する。・・・・(接続重み)2=評価値」を、次の
ように補正する。 「下記のように算出する。 QXp+fXgXc’=V ここでは−P=3# g=1+ r=2としたので。 読み長×3+頻度ランク+(接続重み)2=評価値とな
り、」 (8)明lIIIg第23頁19行の「次に2本発明の
他の実施例を、説明する。」を、[次に、同一品詞内の
単語の出力順決定方法について、具体的に説明する。」
に補正する。 (9)明細番第23頁20行〜第25頁20行の「第8
図は、第1@における・・・・することができる。また
、」を抹消する。 (10)明細書第25頁20行〜第26頁2行の「出力
順位は、・・・・が記憶されている。」を、「出力順位
は、同音語の中で出力される順序を使用者の使用状層に
よって定まっていく値、1,2゜3、・・・が記憶され
ている。」に補正する。 (11)明細書落2G頁3行〜第27頁1行の「第10
図は、第1図における・・・・・・・として計算する。 」を抹消する。 (12)明細1第27頁2行〜第28頁16行の「例え
ば、「ネダンコウショウ・・・・出力順位を変更する。 」を、次のように補正する。 「例えば、「ネダンコウショウ・・・・・・」という入
力があり、最初の単語がr[段」と決定された場合を考
える。辞書メモリ2には、第2図に示すように、「こ」
、「こう]、「こうしJ%「こうしよう」の各々につい
て、読み、品詞、頻度ランク、表記(漢字)、出力順位
等が格納されている。 「こうしよう」には、漢語名詞64の「校章」、漢語す
変名間12の「交#J、「考証」、「公称」、「口承」
1等があり、また形容動詞ダ型14の「高尚」がある、
また、「こう」には、−字漢語名詞65の「甲」、「項
」、漢語接頭語128の「高」。 漢語接尾語164の1項」、「候」等がある。 第2図より、Q、f、cにそれぞれの値を代入する。先
ず1名詞の「校章」は、Q=5.f=7゜c=1である
から、 V=(3X 5)+(I X 11 )+(L
XI)=15+11+1=27となる。また。 −字漢語名詞の「甲」は、Q=2.f=5.c=1であ
ルカラ、V= (3X 2)+(I X 5)+(I 
Xl) =6+5+1=12となるにの結果、ここまで
では、漢語す変名間の「交渉」、「考証」、「公称」、
「口承」が最も評価値が高く、27であるため、「値段
」に接続される単語として「交渉」を出力することにな
る。このようにして、評価器8で算出された最尤評価の
最も高い単語群「交渉」、「考証」、「公称」、「口承
」の単語情報を出力順位の順に出力し、これらを出力文
字列バッファ9の評価値エリアに格納するとともに、制
御部3内の単語バッファの読みと漢字情報を、出力文字
列バッファ9の品詞別車語群評価値エリアに格納する。 次に、出力文字列バッファ9の内容のうち、出力順位1
の「交渉」をCRTIOに転送して表示する。この場合
は、「交渉」が正しい表記として使用者に認められ1次
に進むが、もし、その表示が認められないときには、そ
の単語と異なる単語が使用者によって指定され、記憶し
である出力順位を変更する。」 (13)明細書第29頁4行〜7行の「使用者が頻繁に
・・・第1順位は」を、「使用者が@繁に入替って使用
する場合には、変更指定する確率が多くなり、使い難い
、また、(b)の方法では1例えば、第2図で、「コラ
ショウ」の漢語す変名間の第1順位は」に補正する。 (14)明f4Il書万29頁12行〜第30頁3行の
「使用者が頻繁の・・・格納する。」を次のように補正
する。 「使用者が頻繁に入替ってもあまり追従せず、使用者に
よる最適な使用単語のばらつきを補正することができる
。また、上記(c)の方法では、フラグを立てるのみで
、前回指定されたことを表示するだけであるから、はぼ
(a)の方法に近いが、使用者が頻繁に入替るときには
、殆んど学習効果が無くなる場合もありうる。このよう
にして、順位学習を行った後、仮名漢字変換制御部3か
ら単語辞書記憶装置!4の出力順位の情報を、その内容
に従って書き替える。」 (15)明m書第30頁14行〜16 行+7) rl
lL語ヲ抽出することができ、・・・・ことができる、
」を、「単語を抽出することができる。」に補正する。 (16)明細書第31頁6行〜10行のrフローチャー
ト、第8図は第1図の・・・・である。」を。 [フローチャートである。」に補正する。 (17)第1図および第2@を、別添の図にそれぞれ補
正する。 (18)第8図、第9図および第10図を、削除する。

Claims (5)

    【特許請求の範囲】
  1. (1)表記用の単語に関連する情報を格納している単語
    辞書記憶装置を有し、入力装置により入力された仮名文
    字列をもとに上記単語辞書記憶装置を検索して所定の単
    語を抽出し、抽出した単語の隣接単語との接続検定を行
    うことにより上記仮名文字列を漢字と仮名の混在した仮
    名漢字に変換する仮名漢字変換方式において、複数の漢
    字単語の組合せで形成される複合語に関する情報を格納
    している複合語辞書記憶装置と、上記単語辞書記憶装置
    を検索して抽出した単語の中で複合語に関する情報の有
    無を判別し、該情報に基づいて上記複合語辞書記憶装置
    を検索して得た情報に基づいて複合語を形成し、該複合
    語が仮名漢字変換する候補語として有効であるかどうか
    の検定をする仮名漢字変換制御手段とを含み、該仮名漢
    字変換制御手段は、入力された入力仮名文字列に対し上
    記単語辞書記憶装置を用いて単語の単純な候補出しを行
    い、上記複合語辞書記憶装置を用いて候補出しを行った
    上記単語の隣接単語の検索を行って複合語を形成し、形
    成した上記複合語が有効かどうかの検定を行い、有効と
    された上記複合語を1つの単語候補として加えて仮名漢
    字変換することを特徴とする仮名漢字変換方式。
  2. (2)特許請求の範囲第1項記載の方式において、上記
    単語辞書記憶装置は上記複合語辞書記憶装置のアドレス
    情報を情報として格納し、上記複合語辞書記憶装置は上
    記複合語を形成する接続語の単語が格納されている上記
    単語辞書記憶装置のアドレス情報を情報として格納して
    いることを特徴とする仮名漢字変換方式。
  3. (3)特許請求の範囲第1項記載の方式において、上記
    単語辞書記憶装置は上記複合語辞書記憶装置のアドレス
    情報を情報として格納し、上記複合語辞書記憶装置は上
    記複合語を形成する接続語の単語の読みを格納している
    ことを特徴する仮名漢字変換方式。
  4. (4)特許請求の範囲第1項記載の方式において、上記
    単語辞書記憶装置は上記複合語辞書記憶装置のアドレス
    情報を情報として格納し、上記複合語辞書記憶装置は上
    記複合語を形成する単語が格納されている上記単語辞書
    記憶装置のアドレス情報の組合せで複合語情報として格
    納していることを特徴とする仮名漢字変換方式。
  5. (5)特許請求の範囲第2項ないし第4項のいずれかに
    記載の方式において、上記複合語辞書記憶装置は単語の
    出現頻度をランク化した頻度ランク情報を格納している
    ことを特徴とする仮名漢字変換方式。
JP60024615A 1985-02-12 1985-02-12 仮名漢字変換方式 Pending JPS61184676A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP60024615A JPS61184676A (ja) 1985-02-12 1985-02-12 仮名漢字変換方式

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP60024615A JPS61184676A (ja) 1985-02-12 1985-02-12 仮名漢字変換方式

Publications (1)

Publication Number Publication Date
JPS61184676A true JPS61184676A (ja) 1986-08-18

Family

ID=12143052

Family Applications (1)

Application Number Title Priority Date Filing Date
JP60024615A Pending JPS61184676A (ja) 1985-02-12 1985-02-12 仮名漢字変換方式

Country Status (1)

Country Link
JP (1) JPS61184676A (ja)

Cited By (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH03116360A (ja) * 1989-09-29 1991-05-17 Canon Inc 文字処理装置及びその方法
JPH06266755A (ja) * 1993-03-17 1994-09-22 Nec Corp 自然言語解析装置
US5867812A (en) * 1992-08-14 1999-02-02 Fujitsu Limited Registration apparatus for compound-word dictionary

Cited By (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH03116360A (ja) * 1989-09-29 1991-05-17 Canon Inc 文字処理装置及びその方法
US5867812A (en) * 1992-08-14 1999-02-02 Fujitsu Limited Registration apparatus for compound-word dictionary
JPH06266755A (ja) * 1993-03-17 1994-09-22 Nec Corp 自然言語解析装置

Similar Documents

Publication Publication Date Title
JPS6231467A (ja) 文章作成装置
JPH0578058B2 (ja)
KR20020059555A (ko) 자연어 질의 응답 검색 엔진 및 검색 방법
JPS61184674A (ja) 仮名漢字変換方式
JPH08185396A (ja) 中国語漢字検索方式
JP3537888B2 (ja) かな漢字変換装置
JPS6175467A (ja) 仮名漢字変換方式
JP3187671B2 (ja) 電子辞書表示装置
JP4136055B2 (ja) 類似文字列検索システムおよび記録媒体
JPH01214963A (ja) 辞書引き装置
JPH04290158A (ja) 文書作成装置
JPS6177954A (ja) 仮名漢字変換方式
JPH0785040A (ja) 表記不統一検出方法およびかな漢字変換方法
JP3298288B2 (ja) 文書入力装置
JPH10124503A (ja) 文書処理装置及び文書処理装置制御プログラムを記憶した媒体
JPH02115974A (ja) 言語検索装置
JPH0431142B2 (ja)
JPH0877160A (ja) かな漢字変換方法及び装置
JPS60140460A (ja) カナ漢字変換装置における短縮変換方式
JPS62107372A (ja) 文書作成装置
JPS59186030A (ja) カナ漢字変換処理装置
JPH10154141A (ja) かな漢字変換装置
JPH0744548A (ja) 文書作成装置およびその方法
JPS60136863A (ja) カナ漢字変換装置における短縮変換方式
JPH02292662A (ja) 固有名詞変換機能付き文書処理装置