JPH0765001A - 自然言語解析方法 - Google Patents

自然言語解析方法

Info

Publication number
JPH0765001A
JPH0765001A JP5207944A JP20794493A JPH0765001A JP H0765001 A JPH0765001 A JP H0765001A JP 5207944 A JP5207944 A JP 5207944A JP 20794493 A JP20794493 A JP 20794493A JP H0765001 A JPH0765001 A JP H0765001A
Authority
JP
Japan
Prior art keywords
analysis
morpheme
natural language
error
unit
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP5207944A
Other languages
English (en)
Inventor
Satoshi Shirai
諭 白井
Akio Yokoo
昭男 横尾
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
NTT Inc
Original Assignee
Nippon Telegraph and Telephone Corp
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Nippon Telegraph and Telephone Corp filed Critical Nippon Telegraph and Telephone Corp
Priority to JP5207944A priority Critical patent/JPH0765001A/ja
Publication of JPH0765001A publication Critical patent/JPH0765001A/ja
Pending legal-status Critical Current

Links

Landscapes

  • Machine Translation (AREA)

Abstract

(57)【要約】 【目的】 形態素解析誤りおよび構文解析誤りを低コス
トで、かつ短時間で修正する。 【構成】 キー単語検出部11は、形態素解析部で得ら
れた形態素解析結果を入力し、制御テーブル6を調べる
ことにより、キー単語とそれに対するルールを得る。パ
ターン照合部12は、ルールの誤りパターンと形態素解
析結果を照合し、ルールの文節と形態素解析結果の文節
を対応付け、構成が一致するか否かを判定する。形態素
置換部13は、構成が一致した場合、前記ルールの正し
いパターンに従って形態素解析結果を修正する。

Description

【発明の詳細な説明】
【0001】
【産業上の利用分野】本発明は、自然言語により表現さ
れる入力文に含まれる単語を認定し、入力文の形態素解
析および構文木を作成することにより入力文の構文解析
を行なう自然言語解析方法に関する。
【0002】
【従来の技術】従来の一般的な自然言語解析方法におい
ては、形態素解析処理の結果に誤りが含まれる場合、形
態素解析処理を改造することによりその誤りを防止して
いた。
【0003】以下、日本語の形態素解析を例に取ると、
たとえば、「畜産物価格安定法」という複合語は、隣り
合うすべての2漢字の表記が単語になりうるため形態素
解析が困難な例として知られている。接頭語・接尾語の
認定を強化すると「畜産・物/価格/安定・法」(・は
接頭語または接尾語の境界、/は単語境界を示す)のよ
うに形態素解析が可能になる(宮崎正弘「日本文音声出
力のための言語処理に関する研究(東京工業大学学位論
文,昭和61年)」に記載)が、その反面、「現代用
語」が「現・代用・語」のように誤って認定されるとい
う副作用が生じている。
【0004】また、従来の一般的な自然言語解析方法に
おいては、構文解析処理の結果に誤りが含まれる場合、
構文解析処理を改造することによりその誤りを防止して
いた。
【0005】以下、日本語の構文解析を例に取ると、た
とえば、「半径が5センチの円を描け。」という文にお
いては、一般に「半径が→描け」「5センチの→円を」
「円を→描け」という係り受け関係が認定されるが、正
しくは「半径が→5センチの」とならなければならな
い。しかしながら、これを認定するようにすると「彼が
屋根の赤い家に住んでいる。」のような文において、こ
とごとく構文解析に失敗するようになるという副作用が
生じるため、このような場合は「〜が〜の」のまとまり
があっても解析失敗のまま放置されている。
【0006】なお、形態素解析および構文解析の基本的
な方法に関しては、たとえば、長尾真監修「日本語情報
処理(電子通信学会刊,昭和60年3月)」の記載が参
考になる。
【0007】
【発明が解決しようとする課題】上述の一般的な自然言
語解析方法は、解析処理の中に例外的な事項に対処する
仕掛けを構築する必要がある。形態素解析処理または構
文解析処理を改良するには、その処理に精通したシステ
ム開発者が誤りを分析して処理の方式上の問題点を見い
だし、問題点に対して個別に処理を改良するとともに、
解析誤りが生じる入力文以外に対して悪い副作用が生じ
ないことを十分に確認しておく必要がある。このため、
改良には開発者側から見ればコストがかさむという問題
があるばかりか、利用者側から見ても形態素解析誤りま
たは構文解析誤りが回避されるようになるまで長期間待
たされるという問題がある。
【0008】本発明の目的は、従来の技術における上述
のような問題点を解消し、形態素解析誤りを低コスト
で、かつ短時間で修正することが可能な自然言語解析方
法を提供することにある。
【0009】本発明の他の目的は、従来の技術における
上述のような問題点を解消し、構文解析誤りを低コスト
で、かつ短時間で修正することが可能な自然言語解析方
法を提供することにある。
【0010】
【課題を解決するための手段】本発明の自然言語解析方
法は、形態素解析に誤りが生じた場合、形態素解析結果
のうち誤りを含む部分付近の単語認定パターンとそれに
対する正しい単語認定パターンをペアにしてテーブルに
登録しておき、形態素解析結果と一致する、誤りを含む
単語認定パターンが前記テーブルに登録されているかど
うか調べ、登録されていれば前記形態素解析結果を該単
語認定パターンに対応する正しい単語認定パターンに置
換する。
【0011】本発明の他の自然言語解析方法は、構文解
析に誤りが生じた場合、誤りを生じた構文木の各文節に
ついて単語構成と、該構文解析後の文節の係り方と、該
構文木の修正後の文節の係り方をテーブルに登録してお
き、作成された構文木の文節と文節の係り方をそれぞれ
前記テーブルの単語構成と構文解析後の文節の係り方と
照合し、これらが全ての文節について一致すれば前記テ
ーブル中の修正後の文節の係り方に従って、前記の作成
された構文木を修正する。
【0012】
【作用】本発明の自然言語解析方法は、形態素解析誤り
に対して、誤りを含む単語認定パターンとそれに対する
正しい単語認定パターンをテーブルに登録しておき、テ
ーブルに従って形態素解析誤りを自動的に修正するもの
である。
【0013】また、本発明の他の自然言語解析方法は、
構文解析誤りに対して、誤りを生じた構文木の各文節に
ついて構文解析後の文節の係り方と、該構文木の修正後
の文節の係り方をテーブルに登録しておき、テーブルに
従って構文解析誤りを自動的に修正するものである。
【0014】
【実施例】次に、本発明の実施例について図面を用いて
説明する。
【0015】図1は、本発明の第1の実施例の自然言語
解析システムの基本構成を示すブロック図である。本自
然言語解析システムは、自然言語の文を入力するための
入力部1と、形態素辞書5を用いて入力文を単語分割す
る形態素解析部2と、形態素解析部2で得られた形態素
解析結果から、制御テーブル6に従って単語分割の修正
を行なう形態素修正部3と、形態素修正部3による形態
素解析の修正結果を出力する出力部4で構成されてい
る。
【0016】図2は図1中の形態素修正部3の処理を示
す流れ図である。
【0017】キー単語検出部11は、形態素解析部2で
得られた形態素解析結果を入力し、制御テーブル6を調
べることにより、キー単語とそれに対するルールを得
る。パターン照合部12は、該ルールの誤りパターンと
形態素解析結果を照合し、該ルールの文節と形態素解析
結果の文節を対応付け、構成が一致するか否かを判定す
る。形態素置換部13は、構成が一致した場合、前記ル
ールの正しいパターンに従って形態素解析結果を修正す
る。
【0018】次に、上述のように構成された本実施例の
自然言語解析システムの動作を、自然言語が日本語であ
る場合について、図3と図4に示す入力例を用いて説明
する。表1はこの場合の制御テーブル6を示している。
【0019】
【表1】 図3(1)に示す入力文「現代用語を収集する。」は入
力部1から入力された後、形態素解析部2で形態素辞書
5を用いて、図3(2)に示すように、文節1と文節2
に単語分割される。この形態素解析結果は形態素修正部
3に入力される。形態素修正部3では、まず、キー単語
検出部11が制御テーブル6を調べることにより、「代
用」に対するルール101を得る。次に、パターン照合
部12が、上述のルール101の誤りパターンと形態素
解析結果とを照合する。すなわち、「代用」に含まれる
ルール101の文節B1と文節1を対応付け、構成が一
致するか否かを判定する。この場合は一致するので、形
態素置換部13に進み、ルール101の正しいパターン
に従って形態素解析結果を図3(3)の形態素修正結果
のように修正する。
【0020】図4(1)に示す入力文「用語を収集した
いものだ。」の場合、形態素解析部2において、図4
(2)に示すように、文節1と文節2と文節3に単語分
割される。この形態素解析結果を受け取ったキー単語検
出部11は、制御テーブル6を調べることにより、「い
も」に対するルール201を得る。パターン照合部12
は、ルール201の誤りパターンと図4(2)の形態素
解析結果を照合し、ルール201の文節B1と文節2、
ルール201の文節B2と文節3を対応付け、これらの
構成が一致するので、形態素解析結果を形態素置換部1
3でルール201の正しいパターンに従って図4(3)
の形態素修正結果のように修正する。
【0021】もし、入力文が上述の例と類似の「収集し
たいもだ」の場合、形態素解析により「収集し(サ変動
詞)/た(助動詞・過去)」と「いも(名詞)/だ(助
動詞・断定)」に解析されたとすると、ルール201の
誤りパターンの文節B1は一致するが、文節B2は一致
しないため、修正は行なわれない。
【0022】図5は、本発明の第2の実施例の自然言語
解析システムの基本構成を示すブロック図である。本自
然言語解析システムは、自然言語の文を入力するための
入力部21と、形態素辞書26を用いて入力文を単語分
割する形態素解析部22と、形態素解析部22で得られ
た形態素解析結果から構文辞書27を用いて構文解析を
行ない構文木を作成する構文解析部23と、形態素解析
部22で得られた単語情報および構文解析部23で得ら
れた構文木から、制御テーブル28に従って構文木の修
正を行なう構文木修正部24と、形態素解析部22によ
る形態素解析結果と構文木修正部24による構文木修正
結果を出力する出力部25で構成されている。
【0023】図6は図5中の構文木修正部24の処理を
示す流れ図である。
【0024】キー単語検出部31は、構文木解析部23
で得られた構文木解析結果を入力し、キー単語を検出
し、制御テーブル28を調べて該キー単語に対するルー
ルを得る。パターン照合部32は上述のルールの文節と
解析結果の文節を対応づけ、構成が一致するか否かを判
定し、一致すれば木構造をたどり、前記ルールの文節に
対する構文解析後の係り方と文節の係り方を順に照合す
る。構文木置換部33は、構文木の文節と係り方がそれ
ぞれ制御テーブル28の単語構成と解析後の文節の係り
方に全て一致すれば制御テーブル28の修正後の文節の
係り方に従って構文解析結果を修正する。
【0025】次に、上述のように構成された本実施例の
自然言語解析システムの動作を、自然言語が日本語であ
る場合について、図8に示す入力例を用いて説明する。
表2はこの場合の制御テーブル28を示している。ま
た、図7(1),(2)は表2中の解析後の係り方、修
正後の係り方を図示したものである。
【0026】
【表2】 図8(1)に示す入力文「半径が5センチの円を描
け。」の場合、形態素解析部22において図8(2)の
形態素解析結果に示すように単語分割され、次に構文解
析部23において図8(3)の構文解析結果のように構
文木が作成される。この解析結果を受け取った構文木修
正部24では、まず、キー単語検出部31が制御テーブ
ル28を調べて、助詞「が」に対するルール301を得
る。次に、パターン照合部32が、上述のルール301
の文節の単語構成と、構文木を構成する文節を照合す
る。すなわち、まず、「が」が含まれるルール301の
文節B1と形態系解析結果の文節1を対応付け、構成が
一致するか否かを判定する。この場合は一致するので、
木構造をたどり、ルール301の文節B1に対する解析
後の係り方と文節1の係り方を照合し、どちらも「格」
であるのでこれも一致する。以下、文節B4と文節4、
文節B3と文節3、文節B2と文節2の単語構成、およ
び係り方を順に照合し、すべてが一致するとして照合を
完了する。次に、構文木置換部33では、ルール301
の修正後の係り方に従って、図8(3)の構文解析結果
の構文木に対し、文節1の係り方を文節2に格として、
また、文節2の係り方を文節3に埋め込みとして設定す
ることにより、図8(4)の構文木修正結果に示す構文
木を得る。
【0027】なお、本実施例の「半径が5センチの円を
描け。」に類似する「〜が〜の〜」の表現として、たと
えば「彼が屋根の赤い家に住んでいる。」のような文が
考えられるが、文節1に相当する「彼が」や文節2に相
当する「屋根の」は、いずれも、制御テーブル28の対
応する文節の単語構成のB1やB2と一致しないため、
このような場合は構文木修正は行なわれない。
【0028】
【発明の効果】以上説明したように本発明は、以下に示
すような効果がある。 (1)請求項1の発明は、誤りを含む単語認定パターン
とそれに対する正しい単語認定パターンをテーブルに登
録しておき、テーブルに従って形態素解析誤りを自動的
に修正することにより、低コストで、かつ短時間で形態
素解析誤りを修正できるという顕著な効果があり、ま
た、特定の形態素解析誤りをねらい打ちにして修正する
ため、他の文に対する副作用を生じにくいという効果も
ある。 (2)請求項2の発明は、構文解析誤りに対して、誤り
を生じた構文木の各文節について構文解析後の文節の係
り方と、該構文木の修正後の文節の係り方をテーブルに
登録しておき、テーブルに従って構文解析誤りを自動的
に修正することにより、低コストで、かつ短時間で構文
解析誤りを修正できるという顕著な効果があり、また、
特定の構文解析誤りをねらい打ちにして修正するため、
他の文に対する副作用を生じにくいという効果もある。
【図面の簡単な説明】
【図1】本発明の第1の実施例の自然言語解析システム
の基本構成を示すブロック図である。
【図2】形態素修正部3の処理を示す図である。
【図3】入力文と、それに対応する形態素解析結果と形
態素修正結果の例を示す図である。
【図4】入力文と、それに対応する形態素解析結果と形
態素修正結果の他の例を示す図である。
【図5】本発明の第2の実施例の自然言語解析システム
の基本構成を示すブロック図である。
【図6】構文木修正部24の処理を示す図である。
【図7】表2について解析後の係り方と修正後の係り方
を示す図である。
【図8】入力文と、それに対応する形態素解析結果、構
文解析結果、構文木修正結果を示す図である。
【符号の説明】
1 入力部 2 形態素解析部 3 形態素修正部 4 出力部 5 形態素辞書 6 制御テーブル 11 キー単語検出部 12 パターン照合部 13 形態素置換部 21 入力部 22 形態素解析部 23 構文解析部 24 構文木修正部 25 出力部 26 形態素辞書 27 構文辞書 28 制御テーブル 31 キー単語検出部 32 パターン照合部 33 構文木置換部

Claims (2)

    【特許請求の範囲】
  1. 【請求項1】 自然言語により表現される入力文に含ま
    れる単語を認定することにより入力文の形態素解析を行
    なう自然言語解析方法において、 形態素解析に誤りが生じた場合、形態素解析結果のうち
    誤りを含む部分付近の単語認定パターンとそれに対する
    正しい単語認定パターンをペアにしてテーブルに登録し
    ておき、 形態素解析結果と一致する、誤りを含む単語認定パター
    ンが前記テーブルに登録されているかどうか調べ、登録
    されていれば前記形態素解析結果を該単語認定パターン
    に対応する正しい単語認定パターンに置換することを特
    徴とする自然言語解析方法。
  2. 【請求項2】 自然言語により表現される入力文に含ま
    れる単語を認定し、この結果に基づいて構文木を作成す
    ることにより入力文の構造解析を行なう自然言語解析方
    法において、 構文解析に誤りが生じた場合、誤りを生じた構文木の各
    文節について単語構成と、該構文解析後の文節の係り方
    と、該構文木の修正後の文節の係り方をテーブルに登録
    しておき、 作成された構文木の文節と文節の係り方をそれぞれ前記
    テーブルの単語構成と構文解析後の文節の係り方と照合
    し、これらが全ての文節について一致すれば前記テーブ
    ル中の修正後の文節の係り方に従って、前記の作成され
    た構文木を修正することを特徴とする自然言語解析方
    法。
JP5207944A 1993-08-23 1993-08-23 自然言語解析方法 Pending JPH0765001A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP5207944A JPH0765001A (ja) 1993-08-23 1993-08-23 自然言語解析方法

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP5207944A JPH0765001A (ja) 1993-08-23 1993-08-23 自然言語解析方法

Publications (1)

Publication Number Publication Date
JPH0765001A true JPH0765001A (ja) 1995-03-10

Family

ID=16548128

Family Applications (1)

Application Number Title Priority Date Filing Date
JP5207944A Pending JPH0765001A (ja) 1993-08-23 1993-08-23 自然言語解析方法

Country Status (1)

Country Link
JP (1) JPH0765001A (ja)

Similar Documents

Publication Publication Date Title
US20040260533A1 (en) Method and apparatus for converting an expression using key words
GB2234614A (en) Machine translation apparatus
JPH07325828A (ja) 文法チェックシステム
US20060015320A1 (en) Selection and use of nonstatistical translation components in a statistical machine translation framework
JPH07282055A (ja) 文解析方法および装置
KR20090061158A (ko) 번역 시스템에서 오류 보정 패턴을 이용한 번역 오류 수정방법 및 장치
JP2000089786A (ja) 音声認識結果の修正方法および装置
JP3856515B2 (ja) 文書校正装置
JP2757731B2 (ja) 文書解析装置
JPH09114831A (ja) 文章校正装置
JP2770555B2 (ja) 自然言語解析システム
JP3197110B2 (ja) 自然言語解析装置および機械翻訳装置
JP2908460B2 (ja) 誤認識修正方法及び装置
JP2002297585A (ja) 英文名詞句の区分方法,英文構文情報生成方法および装置
JP3132058B2 (ja) 文章検査装置
JPS6344276A (ja) 生成文法自動生成装置
JPH06259467A (ja) 機械翻訳装置
JPS63163956A (ja) 文書作成・校正支援装置
JPH052601A (ja) 日本語処理の前処理装置
JP2995717B2 (ja) 形態素解析方法およびその装置
JPH10240736A (ja) 形態素解析装置
JPH07105215A (ja) 句構造抽出装置および構文チェック装置
JPH09223143A (ja) 文書情報処理装置
JPH01265359A (ja) 文章解析方式
JPS5899829A (ja) 誤り文字検出・修正支援装置