JPS63219070A - 日本語文節間係り受け解析装置 - Google Patents
日本語文節間係り受け解析装置Info
- Publication number
- JPS63219070A JPS63219070A JP62052196A JP5219687A JPS63219070A JP S63219070 A JPS63219070 A JP S63219070A JP 62052196 A JP62052196 A JP 62052196A JP 5219687 A JP5219687 A JP 5219687A JP S63219070 A JPS63219070 A JP S63219070A
- Authority
- JP
- Japan
- Prior art keywords
- dependency
- evaluation
- clauses
- clause
- modification reception
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Landscapes
- Machine Translation (AREA)
- Document Processing Apparatus (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
(発明の属する技術分野)
本発明は、入力装置から読み込まれた日本文の構造を解
析する日本語構文解析方式に関するものである。
析する日本語構文解析方式に関するものである。
(従来の技術)
従来1日本文における係り受け解析としては、いわゆる
句構造文法に従って、各文節の働きを数種〜数十種に分
類し、この分類に従って、■係りの文節は受けの文節よ
り前に置かれる、■係りの文節は受けの文節を1つしか
持ちえない、■係り受けの関係に交叉はない。
句構造文法に従って、各文節の働きを数種〜数十種に分
類し、この分類に従って、■係りの文節は受けの文節よ
り前に置かれる、■係りの文節は受けの文節を1つしか
持ちえない、■係り受けの関係に交叉はない。
という係り受けの一般的な法則を用いて、■係り受けの
関係は規則的・意味的に許される限り最も近い位置にあ
る文節間で成り立つ、という経験的な法則に沿って、各
文節間の係り受けを試行錯誤しながら認定することによ
り、文全体の係り受けパターンを決定する方式がよく知
られている。
関係は規則的・意味的に許される限り最も近い位置にあ
る文節間で成り立つ、という経験的な法則に沿って、各
文節間の係り受けを試行錯誤しながら認定することによ
り、文全体の係り受けパターンを決定する方式がよく知
られている。
この方式では非正規的な係り受け
(例:「半径が5センチの円を書いた」において、「半
径が」は「5センチの」に対するいわゆる主格として働
いている)は対象外として扱わないが。
径が」は「5センチの」に対するいわゆる主格として働
いている)は対象外として扱わないが。
例外処理によって個別に対処するかにしていた。
(発明が解決しようとする問題点)
上述の従来技術が用いている経験的法則■は、非正規的
な係り受け (例:「半径が5センチの円を書いた」において、「半
径が」は「5センチの」に対する、いわゆる主格として
働いている) を認めるためにシステムを変更すると (例:“が″を持つ文節が″の″を持つ文節に係ること
ができるようにする)、 これに伴う副作用が問題となる (例:「〜が〜の〜」というパターンを持つ文では、必
ず「〜が」→「〜の」の係り受けを生じる)。
な係り受け (例:「半径が5センチの円を書いた」において、「半
径が」は「5センチの」に対する、いわゆる主格として
働いている) を認めるためにシステムを変更すると (例:“が″を持つ文節が″の″を持つ文節に係ること
ができるようにする)、 これに伴う副作用が問題となる (例:「〜が〜の〜」というパターンを持つ文では、必
ず「〜が」→「〜の」の係り受けを生じる)。
このため、非正規的な係り受けを認定するためには、認
定しようとする非正規的な表現ごとに例外処理を用意し
なければならず、また、用意したとしてもその例外処理
をどのような条件下で起動するかという制御が難しく、
起動するタイミングを誤れば、不必要な解析の多義を生
じたり、あるいは必要な解析結果が得られなかったりと
いう問題がある。
定しようとする非正規的な表現ごとに例外処理を用意し
なければならず、また、用意したとしてもその例外処理
をどのような条件下で起動するかという制御が難しく、
起動するタイミングを誤れば、不必要な解析の多義を生
じたり、あるいは必要な解析結果が得られなかったりと
いう問題がある。
(発明の目的)
本発明の目的は、上記従来技術の欠点を解決し、日本文
の係り受け解析の精度向上とその制御の簡易化を同時に
実現することにある。
の係り受け解析の精度向上とその制御の簡易化を同時に
実現することにある。
(問題点を解決するための手段)
本発明の上記目的は、日本語の構文を自動的に解析する
システムにおいて、文節を対象に、任意の2文節につい
てその2文節だけを見ると係り受け関係が成立するか否
かを判定し、成立する場合はその係り受けの特殊性に対
する評価値と、係り受けの密接さの尺度としてその2文
節の間に位置する他の文節の特徴に応じて設定する評価
値とを求め、この2つの評価値に基づいて計算したその
2文節間の係り受けに対する評価値を用いて総合的にそ
の2文節間の係り受け成立の可能性を判定することによ
り、非正規的な係り受けであっても、正規的な係り受け
の場合と同等に処理することを特徴とする日本語文節間
係り受け解析方式によって達成される。
システムにおいて、文節を対象に、任意の2文節につい
てその2文節だけを見ると係り受け関係が成立するか否
かを判定し、成立する場合はその係り受けの特殊性に対
する評価値と、係り受けの密接さの尺度としてその2文
節の間に位置する他の文節の特徴に応じて設定する評価
値とを求め、この2つの評価値に基づいて計算したその
2文節間の係り受けに対する評価値を用いて総合的にそ
の2文節間の係り受け成立の可能性を判定することによ
り、非正規的な係り受けであっても、正規的な係り受け
の場合と同等に処理することを特徴とする日本語文節間
係り受け解析方式によって達成される。
(作 用)
本発明においては、従来の方式が文節の特徴に応じて直
接的に係り受けを決定していた点に鑑みて、係り受けの
特殊性に対する評価値と、係り受けの密接さに対する評
価値とを併用することによって、非正規的な係り受けを
容易に認定できるようにするとともに、処理の制御の簡
易化を図っている。
接的に係り受けを決定していた点に鑑みて、係り受けの
特殊性に対する評価値と、係り受けの密接さに対する評
価値とを併用することによって、非正規的な係り受けを
容易に認定できるようにするとともに、処理の制御の簡
易化を図っている。
(実施例)
以下、本発明の一実施例についで図面により説明する。
第1図は本発明を適用した日本語構文解析システムの全
体の基本ブロック図を示したものである。
体の基本ブロック図を示したものである。
入力装置1から入力される単語分割された日本文に対し
、係り受け特殊性評価辞書6を用いる係り受け特殊性評
価処理部2により、文節間の係り受けの有無を、また、
係り受けが成立しうる場合は係り受け属性と係り受けの
特殊性の評価値を求める。
、係り受け特殊性評価辞書6を用いる係り受け特殊性評
価処理部2により、文節間の係り受けの有無を、また、
係り受けが成立しうる場合は係り受け属性と係り受けの
特殊性の評価値を求める。
次に、係り受け密接度評価辞書7を用いる係り受け密接
度評価処理部3により、係り受けが成立しうる文節間の
密接度の評価値を求める。
度評価処理部3により、係り受けが成立しうる文節間の
密接度の評価値を求める。
そして、係り受け認定処理部4で入力文に対する係り受
けのパターンを決定し、2種類の評価値に基づいて各係
り受けパターンの評価値を計算し、この結果を評価値の
順に出力装置5から出力する。
けのパターンを決定し、2種類の評価値に基づいて各係
り受けパターンの評価値を計算し、この結果を評価値の
順に出力装置5から出力する。
第2図は単語分割された入力日本文の例であり、第3図
は係り受け特殊性評価辞書の構成例、第4図は係り受け
特殊性評価処理部の動作例、第5図は係り受け密接度評
価辞書の構成例、第6図は係り受け密接度評価処理部の
動作例、第7図は係り受け認定処理部の動作例、第8図
は係り受け認定処理部の出力例、第9図は係り受け特殊
性評価処理部のフローチャート、 第10図は係り受け密接度評価処理部のフローチャート
、 第11図は係り受け認定処理部のフローチャー1−であ
る。
は係り受け特殊性評価辞書の構成例、第4図は係り受け
特殊性評価処理部の動作例、第5図は係り受け密接度評
価辞書の構成例、第6図は係り受け密接度評価処理部の
動作例、第7図は係り受け認定処理部の動作例、第8図
は係り受け認定処理部の出力例、第9図は係り受け特殊
性評価処理部のフローチャート、 第10図は係り受け密接度評価処理部のフローチャート
、 第11図は係り受け認定処理部のフローチャー1−であ
る。
以下、第2図の例に対する第1図における2〜4の各処
理部の動作を、第3図〜第8図を用いて説明する。
理部の動作を、第3図〜第8図を用いて説明する。
まず、係り受け特殊性評価処理部2の動作は第9図の通
りであり、その動作例を第3図、第4図を用いて説明す
る。
りであり、その動作例を第3図、第4図を用いて説明す
る。
本処理部では、文節を構成する単語の文法情報に対して
、第3図で与えるような係り受け成立の条件を適用する
ことにより、係り受けの成立しうる文節対を調べ、同時
にその係り受け属性と特殊性評価値を全て求める。ここ
で特殊性評価値は、最高点を100とし、小さくなるほ
ど特殊な係り受けであることを表すものとする。
、第3図で与えるような係り受け成立の条件を適用する
ことにより、係り受けの成立しうる文節対を調べ、同時
にその係り受け属性と特殊性評価値を全て求める。ここ
で特殊性評価値は、最高点を100とし、小さくなるほ
ど特殊な係り受けであることを表すものとする。
例えば、第4図に示すように、文節&1と文節Nα2の
文節対にはルールNa302のルールが適用できるので
、係り受け属性は「格関係」となり特殊性評価値は「8
0」となる。
文節対にはルールNa302のルールが適用できるので
、係り受け属性は「格関係」となり特殊性評価値は「8
0」となる。
文節NQ1と文節Nα3の対には適用できるルールがな
いため、係り受けが成立しえない。
いため、係り受けが成立しえない。
以下同様にして、第4図における係り受け属性と特殊性
評価値を得る。
評価値を得る。
次に、係り受け密接度評価処理部3の動作は第10図の
通りであり、その動作例を第5図、第6図を用いて説明
する。
通りであり、その動作例を第5図、第6図を用いて説明
する。
本処理部では、文節を構成する単語の文法情報に第5図
で与えるような条件を適用することにより、係り受け特
殊性評価処理部2で係り受けの可能性ありと判定された
文節対の係り受け密接度を計算する。
で与えるような条件を適用することにより、係り受け特
殊性評価処理部2で係り受けの可能性ありと判定された
文節対の係り受け密接度を計算する。
ここで、係り受けの成立する文節対の密接度評価値は、
初期値を100とし、飛び越す文節に応じて第5図の密
接度評価値に従って減らして行くことにより得る。すな
わち、文節対の密接度評価値が高い文節対はど優先すべ
き係り受けであることを表す。
初期値を100とし、飛び越す文節に応じて第5図の密
接度評価値に従って減らして行くことにより得る。すな
わち、文節対の密接度評価値が高い文節対はど優先すべ
き係り受けであることを表す。
例えば、第6図に示すように、文節Nα1と文節Nα2
の文節対では、その間に位置する文節が何もないので密
接度評価値は100である。
の文節対では、その間に位置する文節が何もないので密
接度評価値は100である。
文節Nα1と文節Nα6の文節対では、その間には文節
N112〜文節Ha 5の4つの文節が位置し、文節N
α2を飛び越す場合に対しては該当するルールがないた
め1文節対の密接度評価値の減点は行なわないが、文節
Nα3を飛び越す場合に対してはルール&503が該当
するため50が、文節&4を飛び越す場合に対してはル
ールNα502が該当するため10がそれぞれ減点され
、最後の文節Nα5を飛び越す場合には該当するルール
がないため減点されず、結局のところ文節Nα1と文節
No、6の文節対の密着度評価値は40となる。
N112〜文節Ha 5の4つの文節が位置し、文節N
α2を飛び越す場合に対しては該当するルールがないた
め1文節対の密接度評価値の減点は行なわないが、文節
Nα3を飛び越す場合に対してはルール&503が該当
するため50が、文節&4を飛び越す場合に対してはル
ールNα502が該当するため10がそれぞれ減点され
、最後の文節Nα5を飛び越す場合には該当するルール
がないため減点されず、結局のところ文節Nα1と文節
No、6の文節対の密着度評価値は40となる。
この結果を比べると、文節勲1の係り先としては、非正
規的な係り受けを生じる文節N112の方が、正規的な
係り受けを生じる文節Nα6よりも望ましいことがわか
る。以下同様にして、第6図における密接度評価値を得
る。
規的な係り受けを生じる文節N112の方が、正規的な
係り受けを生じる文節Nα6よりも望ましいことがわか
る。以下同様にして、第6図における密接度評価値を得
る。
最後に、係り受け認定処理部4の動作は第11図の通り
であり、その動作例を第7図、第8図を用いて説明する
。
であり、その動作例を第7図、第8図を用いて説明する
。
本処理部では、係り受け特殊性評価処理部2で得た特殊
性評価値と係り受け密接度評価処理部3で得た密接度評
価値とを用いて、入力文に対する評価値付きの係り受け
パターンを生成する。ここでは、特殊性評価値と密接度
評価値の単純和をもって各文節対の評価値とすることに
する。
性評価値と係り受け密接度評価処理部3で得た密接度評
価値とを用いて、入力文に対する評価値付きの係り受け
パターンを生成する。ここでは、特殊性評価値と密接度
評価値の単純和をもって各文節対の評価値とすることに
する。
例えば、第7図の示すように、文節Nα1の文節からは
文節Nα2に係る場合と文節Nα6に係る場合とがある
が、この2つを比較すると相対的に文節Na 2に係る
方が評価が高いことがわかる。
文節Nα2に係る場合と文節Nα6に係る場合とがある
が、この2つを比較すると相対的に文節Na 2に係る
方が評価が高いことがわかる。
文節Nα2の文節からは3つの係り売文節がありうるが
、文節Ha 3の文節からは文節NQ6の文節にしか係
ることができないため、文節Nα2の文節からの係り先
は文節Nα3に限定されることになる。
、文節Ha 3の文節からは文節NQ6の文節にしか係
ることができないため、文節Nα2の文節からの係り先
は文節Nα3に限定されることになる。
以下同様にして、文節対の係り受けを展開し、第8図の
ような結果を得る。
ような結果を得る。
なお、第8図における評価値は、各係り受けパターンを
構成する文節対の特殊性評価値と密接度評価値を合計し
たものである(この図の例では、係り元となる文節が文
節Nα1〜文節Nα5の5つであるため、評価値の最高
点は1000である)。
構成する文節対の特殊性評価値と密接度評価値を合計し
たものである(この図の例では、係り元となる文節が文
節Nα1〜文節Nα5の5つであるため、評価値の最高
点は1000である)。
(発明の効果)
以上説明したように、本発明によると、処理の制御を簡
単に保ったまま日本語の非正規的な係り受けであっても
認定できるため、日本文を解析するシステムにおける入
力日本文に対する許容度を高めることができる。
単に保ったまま日本語の非正規的な係り受けであっても
認定できるため、日本文を解析するシステムにおける入
力日本文に対する許容度を高めることができる。
第1図は本発明を適用した日本語構文解析システムの基
本ブロック図、 第2図は単語分割された入力日本文の例、第3図は係り
受け特殊性評価辞書の構成例、第4図は係り受け特殊性
評価処理部の構成°例、第5図は係り受け密接度評価辞
書の構成例。 第6図は係り受け密接度評価処理部の動作例、第7図は
係り受け認定処理部の動作例、第8図は係り受け認定処
理部の出力例、第9図は係り受け特殊性評価処理部のフ
ローチャート、 第10図は係り受け密接度評価処理部のフローチャート
、 第11図は係り受け認定処理部のフローチャートである
。 1・・・入力装置、 2 ・・・係り受け特殊性評価処理部、3 ・・・係り
受け密接度評価処理部、4・・・係り受け認定処理部。 5 ・・・出力装置、 6・・・係り受け特殊性評価辞書、 7・・・係り受け密接度評価辞書− 特許出願人 日本電信電話株式会社 第1図 第2図 第3図 (注意)(◆11):任意の単語の後接続を許すことを
表すl−−:文節全体として見たときの活用形が何であ
ってもよいことを表す7連体形:文節全体として見たと
きの活用形が連体形であることを表す第4図 第5図 (注意)(十m):任意の単語の後接続を許すことを示
す第6図 第7図 第8図 第9図 終り 第11図 終り
本ブロック図、 第2図は単語分割された入力日本文の例、第3図は係り
受け特殊性評価辞書の構成例、第4図は係り受け特殊性
評価処理部の構成°例、第5図は係り受け密接度評価辞
書の構成例。 第6図は係り受け密接度評価処理部の動作例、第7図は
係り受け認定処理部の動作例、第8図は係り受け認定処
理部の出力例、第9図は係り受け特殊性評価処理部のフ
ローチャート、 第10図は係り受け密接度評価処理部のフローチャート
、 第11図は係り受け認定処理部のフローチャートである
。 1・・・入力装置、 2 ・・・係り受け特殊性評価処理部、3 ・・・係り
受け密接度評価処理部、4・・・係り受け認定処理部。 5 ・・・出力装置、 6・・・係り受け特殊性評価辞書、 7・・・係り受け密接度評価辞書− 特許出願人 日本電信電話株式会社 第1図 第2図 第3図 (注意)(◆11):任意の単語の後接続を許すことを
表すl−−:文節全体として見たときの活用形が何であ
ってもよいことを表す7連体形:文節全体として見たと
きの活用形が連体形であることを表す第4図 第5図 (注意)(十m):任意の単語の後接続を許すことを示
す第6図 第7図 第8図 第9図 終り 第11図 終り
Claims (1)
- 日本語の構文を自動的に解析するシステムにおいて、1
個以上の単語から成るひとまとまりの表現(文節)を対
象に、任意の2文節についてその2文節だけを見ると係
り受け関係が成立するか否かを判定し、成立する場合は
その係り受けの特殊性に対する評価値と、係り受けの密
接さの尺度としてその2文節の間に位置する他の文節の
特徴に応じて設定する評価値とを求め、この2つの評価
値に基づいて計算したその2文節間の係り受けに対する
評価値を用いて総合的にその2文節間の係り受け成立の
可能性を判定することにより、非正規的な係り受けであ
っても、正規的な係り受けの場合と同等に処理すること
を特徴とする日本語文節間係り受け解析方式。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP62052196A JPH0769914B2 (ja) | 1987-03-09 | 1987-03-09 | 日本語文節間係り受け解析装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP62052196A JPH0769914B2 (ja) | 1987-03-09 | 1987-03-09 | 日本語文節間係り受け解析装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPS63219070A true JPS63219070A (ja) | 1988-09-12 |
| JPH0769914B2 JPH0769914B2 (ja) | 1995-07-31 |
Family
ID=12908038
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP62052196A Expired - Lifetime JPH0769914B2 (ja) | 1987-03-09 | 1987-03-09 | 日本語文節間係り受け解析装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH0769914B2 (ja) |
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH03168864A (ja) * | 1989-11-29 | 1991-07-22 | Canon Inc | 文字処理装置 |
| JPH03179551A (ja) * | 1989-12-07 | 1991-08-05 | Canon Inc | 文字処理装置 |
| JPH041847A (ja) * | 1990-04-19 | 1992-01-07 | Nec Corp | かな漢字変換装置 |
| JPH07306856A (ja) * | 1995-05-29 | 1995-11-21 | Canon Inc | 文字処理装置及びその方法 |
-
1987
- 1987-03-09 JP JP62052196A patent/JPH0769914B2/ja not_active Expired - Lifetime
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH03168864A (ja) * | 1989-11-29 | 1991-07-22 | Canon Inc | 文字処理装置 |
| JPH03179551A (ja) * | 1989-12-07 | 1991-08-05 | Canon Inc | 文字処理装置 |
| JPH041847A (ja) * | 1990-04-19 | 1992-01-07 | Nec Corp | かな漢字変換装置 |
| JPH07306856A (ja) * | 1995-05-29 | 1995-11-21 | Canon Inc | 文字処理装置及びその方法 |
Also Published As
| Publication number | Publication date |
|---|---|
| JPH0769914B2 (ja) | 1995-07-31 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| CN112100986B (zh) | 语音文本聚类方法和装置 | |
| US8775158B2 (en) | Data processing device, data processing method, and data processing program | |
| US8099281B2 (en) | System and method for word-sense disambiguation by recursive partitioning | |
| Doyle et al. | A character-level LSTM network model for tokenizing the Old Irish text of the Würzburg glosses on the Pauline Epistles | |
| CN109872718A (zh) | 语音数据的答案获取方法及装置、存储介质、计算机设备 | |
| JPH0769914B2 (ja) | 日本語文節間係り受け解析装置 | |
| CN109871528A (zh) | 语音数据的语义识别方法及装置、存储介质、计算机设备 | |
| JP2504449B2 (ja) | 日本語文節間係り受け解析装置 | |
| JPS63219071A (ja) | 日本語文節間係り受け解析装置 | |
| JP3222173B2 (ja) | 日本語構文解析システム | |
| JP2770555B2 (ja) | 自然言語解析システム | |
| Rajasekar et al. | Automatic Correction of Disfluencies in Tamil Disfluent Text: A Rule-Based Approach | |
| JPH03259376A (ja) | 日本語長文分割支援装置 | |
| JP2704945B2 (ja) | 重複表現処理装置 | |
| KR20250041293A (ko) | 사용자의 발화 의도를 파악하여 사용자 질문에 대한 응답을 제공하는 방법 및 장치 | |
| JPH05143640A (ja) | 日本語構文解析システム | |
| JPH01171058A (ja) | 文章処理装置 | |
| KR20220089137A (ko) | 학습용 대화 시스템 및 방법 | |
| JPH09185623A (ja) | 言語処理装置及び方法 | |
| JPH04112229A (ja) | 高精度数値計算プログラム生成方式 | |
| JPS63219072A (ja) | 日本語文節間係り受け解析装置 | |
| JPH0477955A (ja) | 日本語複文解析装置 | |
| JPH03160561A (ja) | 日本語文書推敲支援装置 | |
| JPH01287771A (ja) | 形態素解析装置 | |
| JPH02226364A (ja) | 構文解析装置 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| EXPY | Cancellation because of completion of term |