JPH0630098B2 - かな漢字変換装置 - Google Patents
かな漢字変換装置Info
- Publication number
- JPH0630098B2 JPH0630098B2 JP59194307A JP19430784A JPH0630098B2 JP H0630098 B2 JPH0630098 B2 JP H0630098B2 JP 59194307 A JP59194307 A JP 59194307A JP 19430784 A JP19430784 A JP 19430784A JP H0630098 B2 JPH0630098 B2 JP H0630098B2
- Authority
- JP
- Japan
- Prior art keywords
- kana
- word
- candidate
- input
- clause
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Expired - Lifetime
Links
- 240000000220 Panda oleosa Species 0.000 claims description 24
- 235000016496 Panda oleosa Nutrition 0.000 claims description 24
- 238000006243 chemical reaction Methods 0.000 claims description 12
- 238000012360 testing method Methods 0.000 claims description 5
- 238000000034 method Methods 0.000 description 4
- 238000010586 diagram Methods 0.000 description 3
- 238000012795 verification Methods 0.000 description 2
- 230000000694 effects Effects 0.000 description 1
Landscapes
- Document Processing Apparatus (AREA)
Description
【発明の詳細な説明】 〔技術分野〕 本発明は、カナコードで入力された日本語文章をかな漢
字混じり文に変換して出力する、かな漢字変換装置に関
する。
字混じり文に変換して出力する、かな漢字変換装置に関
する。
従来のかな漢字変換装置(例えば特開昭57−1272
67号公報参照)においては、国語辞書を検索し該当単
語のない場合、あるいは入力ミス等により文法的に誤り
がある場合、かな漢字変換処理すべてがエラーとなる
か、少なくとも該当文節、単語レベルまではエラーとな
っていた。しかし複数文節変換等を行う場合は長いかな
文字列を入力しており、一部の入力ミス等により少なく
とも文節、単語レベルまでエラーとなることは非常に不
経済であった。
67号公報参照)においては、国語辞書を検索し該当単
語のない場合、あるいは入力ミス等により文法的に誤り
がある場合、かな漢字変換処理すべてがエラーとなる
か、少なくとも該当文節、単語レベルまではエラーとな
っていた。しかし複数文節変換等を行う場合は長いかな
文字列を入力しており、一部の入力ミス等により少なく
とも文節、単語レベルまでエラーとなることは非常に不
経済であった。
〔目的〕 本発明は、この様な問題に鑑み、該当単語辞書にない場
合、最低限の対応により残る文字列をできる限り有効に
解析処理し、再入力動作を最低限におさえ、経済的な入
力を可能とするかな漢字変換装置を提供する事を目的と
する。
合、最低限の対応により残る文字列をできる限り有効に
解析処理し、再入力動作を最低限におさえ、経済的な入
力を可能とするかな漢字変換装置を提供する事を目的と
する。
本発明は、 キー入力等により入力されたかな文字列について複数文
節を解析し、かな漢字変換を行なうかな漢字変換装置に
おいて、 前記入力されたかな文字列に基づき辞書を検索して文節
候補を生成する文節候補生成手段と、 該生成された文節候補と、該文節候補の後部であって該
文節候補の属する文節の区切り位置に位置する語との接
続を文法的に解析する文節末語検定手段と、 該文節末語検定手段により前記文節候補と文法的に接続
しないと判定された語を不定語として抜き出し、残りの
前記入力されたかな文字列の解析を続行させる不定語発
生手段と を備えることを特徴とする。
節を解析し、かな漢字変換を行なうかな漢字変換装置に
おいて、 前記入力されたかな文字列に基づき辞書を検索して文節
候補を生成する文節候補生成手段と、 該生成された文節候補と、該文節候補の後部であって該
文節候補の属する文節の区切り位置に位置する語との接
続を文法的に解析する文節末語検定手段と、 該文節末語検定手段により前記文節候補と文法的に接続
しないと判定された語を不定語として抜き出し、残りの
前記入力されたかな文字列の解析を続行させる不定語発
生手段と を備えることを特徴とする。
ここで、以下に本発明の詳細を図示した実施例に基づい
て説明する。
て説明する。
第1図は本発明のかな漢字変換装置の一実施例を示す概
略ブロック図である。図中符号1は、キーボード等によ
るデータ入力部である。このデータ入力部1で入力され
たデータのうち、かなデータのみが、かな文字文章受取
格納部2に蓄積され、データ入力部1による解析開始の
制御情報により、文節候補展開手段3が、かな桁位置1
桁目より、それを基点として、国語辞書検索手段4によ
り、国語辞書5を索引し、文節候補展開手段3が、文節
候補格納部7に文節候補を格納し、この際、文節末とな
る候補の終り桁位置も格納する。そして、基点のかな桁
位置に1を加算し、つぎの基点による解析に入るが、こ
の時、この基点以後に文節末となる桁位置がない場合、
不定語発生手段6により、1桁のかな不定語文節を発生
しこの桁を文節末とする。この際にして、文節候補が展
開され、文節候補バッファ8に格納されたら、文節候補
接合検定手段9が文法チェック部10により、文法情報
をチェックし、文法エラーデータは、文節候補バッファ
8内のデータにエラーフラグを立てる。さらにこの処理
が終了したら、文書候補再編集手段11が文節候補バッ
ファ8のデータに対して、不定語無しで、全体の結合状
態が保てるかを検定し、それが可能であれば、不定語デ
ータをエラーとして文書候補接合検定手段9によりエラ
ーとなったデータと共に削除し、有効データを文節候補
バッファ8に再編成する。
略ブロック図である。図中符号1は、キーボード等によ
るデータ入力部である。このデータ入力部1で入力され
たデータのうち、かなデータのみが、かな文字文章受取
格納部2に蓄積され、データ入力部1による解析開始の
制御情報により、文節候補展開手段3が、かな桁位置1
桁目より、それを基点として、国語辞書検索手段4によ
り、国語辞書5を索引し、文節候補展開手段3が、文節
候補格納部7に文節候補を格納し、この際、文節末とな
る候補の終り桁位置も格納する。そして、基点のかな桁
位置に1を加算し、つぎの基点による解析に入るが、こ
の時、この基点以後に文節末となる桁位置がない場合、
不定語発生手段6により、1桁のかな不定語文節を発生
しこの桁を文節末とする。この際にして、文節候補が展
開され、文節候補バッファ8に格納されたら、文節候補
接合検定手段9が文法チェック部10により、文法情報
をチェックし、文法エラーデータは、文節候補バッファ
8内のデータにエラーフラグを立てる。さらにこの処理
が終了したら、文書候補再編集手段11が文節候補バッ
ファ8のデータに対して、不定語無しで、全体の結合状
態が保てるかを検定し、それが可能であれば、不定語デ
ータをエラーとして文書候補接合検定手段9によりエラ
ーとなったデータと共に削除し、有効データを文節候補
バッファ8に再編成する。
これらの一連の作業が終了すると、文節候補出力手段1
2が、再編成された文節候補バッファ8のデータを、C
RTなどに出力する。
2が、再編成された文節候補バッファ8のデータを、C
RTなどに出力する。
次に第2図のフローチャートを用いて第1図の実施例の
動作をさらに詳細に説明する。
動作をさらに詳細に説明する。
まず、データ入力部1により入力されかな文字文章受取
格納部2に蓄積されているかな文字列の桁位置を示すか
な文字桁位置ポインタ(図示せず)の値が1にセットさ
れる(<1>)。次に、かな文字桁位置ポインタと入力
されたかな文字列の桁数が比較され(<2>)、かな文
字桁位置ポインタの値が、入力かな文字列の値以下なら
<3>の処理となり、入力かな文字列の値よりかな文字
列ポインタの値が大きくなると後述の<10>以下の処
理となる。
格納部2に蓄積されているかな文字列の桁位置を示すか
な文字桁位置ポインタ(図示せず)の値が1にセットさ
れる(<1>)。次に、かな文字桁位置ポインタと入力
されたかな文字列の桁数が比較され(<2>)、かな文
字桁位置ポインタの値が、入力かな文字列の値以下なら
<3>の処理となり、入力かな文字列の値よりかな文字
列ポインタの値が大きくなると後述の<10>以下の処
理となる。
<3>においては、国語辞書検索手段4が国語辞書5を
索引してさらに文節候補展開手段3が文節候補格納部7
に文節候補を格納し、その際、文節末となる候補の終わ
り桁位置も格納する。この点について第3図を用いてさ
らに詳しく説明する。
索引してさらに文節候補展開手段3が文節候補格納部7
に文節候補を格納し、その際、文節末となる候補の終わ
り桁位置も格納する。この点について第3図を用いてさ
らに詳しく説明する。
第3図において30は、データ入力部1より入力された
かな文字列であり、31は、その桁位置に対応した文節
末桁テーブルであり、文末の語が存在する桁位置に対応
した場所にフラグガ立つものである。
かな文字列であり、31は、その桁位置に対応した文節
末桁テーブルであり、文末の語が存在する桁位置に対応
した場所にフラグガ立つものである。
今、例を挙げて説明すると、まず、「わたし」という自
立語が見つけられて、(正確には、わ(輪)という自立
語があるが説明の都合上、わたしでもって説明す
る。)、その後に続く語尾として「は」が見つけられ、
「わたしは」という語が切り出される。そして、この文
節末が正しいか、文節候補展開手段3によって検定さ
れ、今の場合のように文節末として正しい語が続いてい
る場合には対応する桁位置の文節末桁テーブルにフラグ
を立てる。しかし、例えば、「は」の換わりに「ん」が
入力されている場合には、文節末の検定によってこの文
節末の語は正しくないと判定され、文節末桁テーブルに
はフラグはたたない。
立語が見つけられて、(正確には、わ(輪)という自立
語があるが説明の都合上、わたしでもって説明す
る。)、その後に続く語尾として「は」が見つけられ、
「わたしは」という語が切り出される。そして、この文
節末が正しいか、文節候補展開手段3によって検定さ
れ、今の場合のように文節末として正しい語が続いてい
る場合には対応する桁位置の文節末桁テーブルにフラグ
を立てる。しかし、例えば、「は」の換わりに「ん」が
入力されている場合には、文節末の検定によってこの文
節末の語は正しくないと判定され、文節末桁テーブルに
はフラグはたたない。
次に再び第2図のフローチャートに戻り動作の説明を続
ける。<3>の後、次に切り出された自立語等の語幹か
らみて最も近い後方の文節末位置(第3図の例でいうな
ら「は」の位置)に文節末テーブルフラグがたっている
か調べられ(<4>)、もし、フラグが立っていれば、
そのフラグの立っている桁位置に1つ加算した値をかな
文字桁位置ポインタの値とし(<5>),<2>の処理
にもどる。又、<4>の処理においてフラグが立ってい
ない場合には、不定語発生手段6によって1文字の不定
語が発生される(<6>)。すなわち、本来ならフラグ
が立っているべき桁位置にあるかな文字が不定語とされ
る。<6>の後ではかな文字桁位置ポインタの値は、そ
れまでの値(不定語の桁位置を示している。)に+1加
算した値となり(<7>)、さらにその後<2>の処理
にもどる。
ける。<3>の後、次に切り出された自立語等の語幹か
らみて最も近い後方の文節末位置(第3図の例でいうな
ら「は」の位置)に文節末テーブルフラグがたっている
か調べられ(<4>)、もし、フラグが立っていれば、
そのフラグの立っている桁位置に1つ加算した値をかな
文字桁位置ポインタの値とし(<5>),<2>の処理
にもどる。又、<4>の処理においてフラグが立ってい
ない場合には、不定語発生手段6によって1文字の不定
語が発生される(<6>)。すなわち、本来ならフラグ
が立っているべき桁位置にあるかな文字が不定語とされ
る。<6>の後ではかな文字桁位置ポインタの値は、そ
れまでの値(不定語の桁位置を示している。)に+1加
算した値となり(<7>)、さらにその後<2>の処理
にもどる。
又、<2>の処理においてかな文字桁位置ポインタの値
がかな文字列の入力桁数を越えている場合には、次に文
章末の語が文末の語として正しいかどうかが判定され
(<10>)、正しくない場合には文末の語を不定語に
して(<11>)処理を終了し、正しい場合にはそのま
ま終了する。
がかな文字列の入力桁数を越えている場合には、次に文
章末の語が文末の語として正しいかどうかが判定され
(<10>)、正しくない場合には文末の語を不定語に
して(<11>)処理を終了し、正しい場合にはそのま
ま終了する。
第4図は、第1図における文書候補展開手段3により不
定語発生手段6で不定語が候補として発生した例であ
る。例とて比較的ミス入力してしまうケースで「きょう
はてんきが」と入力すべきとろを「きょぅはてんきが」
と入力されてしまった場合をあげている。
定語発生手段6で不定語が候補として発生した例であ
る。例とて比較的ミス入力してしまうケースで「きょう
はてんきが」と入力すべきとろを「きょぅはてんきが」
と入力されてしまった場合をあげている。
ただし、この時使用した国語辞書には、便宜上記入され
ているものだけが登録されているものとする。
ているものだけが登録されているものとする。
この場合は、第2,3文字目の「ょ」と「ぅ」が不定語
として1文字単位に発生している。
として1文字単位に発生している。
これによると、前半の「きょうは」に相当する「きょぅ
は」の解析に失敗しているが、後半の「てんきが」に相
当する部分の解析には、成功している事がわかる。
は」の解析に失敗しているが、後半の「てんきが」に相
当する部分の解析には、成功している事がわかる。
以上説明したように本発明では、生成された文節候補
と、該文節候補の後部であって該文節候補の属する文節
の区切り位置に位置する語との接続を文法的に解析し、
その結果により不定語を抜き出すので、ごく少数の語句
の組み合わせについてのみ調べるだけで不定語が抽出で
き不定語の抽出が簡単かつ、短時間に行なえる。
と、該文節候補の後部であって該文節候補の属する文節
の区切り位置に位置する語との接続を文法的に解析し、
その結果により不定語を抜き出すので、ごく少数の語句
の組み合わせについてのみ調べるだけで不定語が抽出で
き不定語の抽出が簡単かつ、短時間に行なえる。
又、文法的な解析に基づいているので、誤入力の結果、
文法的には接続しない単語の羅列(例えば、「わたし
あ」の様に個々の単語は辞書に有るケース)となった場
合でも不定語の抽出が可能となる。
文法的には接続しない単語の羅列(例えば、「わたし
あ」の様に個々の単語は辞書に有るケース)となった場
合でも不定語の抽出が可能となる。
第1図は本発明のかな漢字変換装置の1実施例の概略を
示す機能ブロック図である。 第2図は第1図の実施例の動作のブロックフローチャー
トである。 第3図は、第2図のブロックフローチャートの一部をさ
らに詳細に説明するための図である。 第4図は本発明の適用された、具体的な文節候補展開例
である。 3……文節候補展開手段 6……不定語発生手段
示す機能ブロック図である。 第2図は第1図の実施例の動作のブロックフローチャー
トである。 第3図は、第2図のブロックフローチャートの一部をさ
らに詳細に説明するための図である。 第4図は本発明の適用された、具体的な文節候補展開例
である。 3……文節候補展開手段 6……不定語発生手段
Claims (1)
- 【請求項1】キー入力等により入力されたかな文字列に
ついて複数文節を解析し、かな漢字変換を行なうかな漢
字変換装置において、 前記入力されたかな文字列に基づき辞書を検索して文節
候補を生成する文節候補生成手段と、 該生成された文節候補と、該文節候補の後部であって該
文節候補の属する文節の区切り位置に位置する語との接
続を文法的に解析する文節末語検定手段と、 該文節末語検定手段により前記文節候補と文法的に接続
しないと判定された語を不定語として抜き出し、残りの
前記入力されたかな文字列の解析を続行させる不定語発
生手段と を備えることを特徴とするかな漢字変換装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP59194307A JPH0630098B2 (ja) | 1984-09-17 | 1984-09-17 | かな漢字変換装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP59194307A JPH0630098B2 (ja) | 1984-09-17 | 1984-09-17 | かな漢字変換装置 |
Related Child Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP7135870A Division JPH0844730A (ja) | 1995-05-08 | 1995-05-08 | かな漢字変換装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPS6172361A JPS6172361A (ja) | 1986-04-14 |
| JPH0630098B2 true JPH0630098B2 (ja) | 1994-04-20 |
Family
ID=16322424
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP59194307A Expired - Lifetime JPH0630098B2 (ja) | 1984-09-17 | 1984-09-17 | かな漢字変換装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH0630098B2 (ja) |
Families Citing this family (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS61267867A (ja) * | 1985-05-23 | 1986-11-27 | Matsushita Electric Ind Co Ltd | 日本語文作成装置 |
| JPH02155073A (ja) * | 1988-12-07 | 1990-06-14 | Matsushita Electric Ind Co Ltd | 未知語認定装置 |
| US6425505B1 (en) | 1999-09-03 | 2002-07-30 | Vesuvius Crucible Company | Pour tube with improved flow characteristics |
Family Cites Families (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS57127267A (en) * | 1981-01-30 | 1982-08-07 | Canon Inc | Character processing system |
| JPS57174764A (en) * | 1981-04-20 | 1982-10-27 | Nippon Telegr & Teleph Corp <Ntt> | Word cutting device |
| JPS58214931A (ja) * | 1982-06-07 | 1983-12-14 | Nippon Telegr & Teleph Corp <Ntt> | 単語切り出し装置 |
| JPS59163628A (ja) * | 1983-03-08 | 1984-09-14 | Toshiba Corp | 文書作成装置 |
-
1984
- 1984-09-17 JP JP59194307A patent/JPH0630098B2/ja not_active Expired - Lifetime
Also Published As
| Publication number | Publication date |
|---|---|
| JPS6172361A (ja) | 1986-04-14 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US7810030B2 (en) | Fault-tolerant romanized input method for non-roman characters | |
| JPH0689302A (ja) | 辞書メモリ | |
| EP0357370B1 (en) | Computer assisted language translating machine | |
| JP4570509B2 (ja) | 読み生成装置、読み生成方法及びコンピュータプログラム | |
| JPS6172361A (ja) | かな漢字変換装置 | |
| JP3353647B2 (ja) | 機械翻訳システム用辞書・ルール学習装置及び機械翻訳システム用辞書・ルール学習プログラムを格納した記憶媒体 | |
| KR20010057775A (ko) | 문장골격을 기반으로 한 자동번역 시스템 및 그 방법 | |
| KR100420474B1 (ko) | 부분문틀을 이용한 장문 번역 장치 및 그 방법 | |
| JPH0844730A (ja) | かな漢字変換装置 | |
| JP3908919B2 (ja) | 形態素解析システムと形態素解析方法 | |
| JP2807236B2 (ja) | 形態素解析方法 | |
| JP2951486B2 (ja) | 漢字変換装置 | |
| Angkawattanawit et al. | Thai Q-Cor: integrating word approximation and soundex for Thai query correction | |
| JPH02105968A (ja) | 日本文誤り自動検定・訂正方式 | |
| JPH01114976A (ja) | 文書処理装置の辞書構造 | |
| JPH10207889A (ja) | 文書校正装置 | |
| JPH0233185B2 (ja) | ||
| JP2895137B2 (ja) | 日本文誤り自動検出および訂正装置 | |
| JPH1063651A (ja) | 中国語入力装置 | |
| JP3084864B2 (ja) | 文章入力装置 | |
| JPH06149872A (ja) | 文章入力装置 | |
| JP2595043B2 (ja) | 日本文誤り自動検定装置 | |
| JP2995717B2 (ja) | 形態素解析方法およびその装置 | |
| JPH08212225A (ja) | 言語判定装置 | |
| JPH11282837A (ja) | 日本語形態素解析装置、日本語形態素解析方法および記録媒体 |