JPS6231467A - 文章作成装置 - Google Patents
文章作成装置Info
- Publication number
- JPS6231467A JPS6231467A JP60170028A JP17002885A JPS6231467A JP S6231467 A JPS6231467 A JP S6231467A JP 60170028 A JP60170028 A JP 60170028A JP 17002885 A JP17002885 A JP 17002885A JP S6231467 A JPS6231467 A JP S6231467A
- Authority
- JP
- Japan
- Prior art keywords
- conversion
- information
- input
- kana
- sentence
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Classifications
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F17/00—Digital computing or data processing equipment or methods, specially adapted for specific functions
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F3/00—Input arrangements for transferring data to be processed into a form capable of being handled by the computer; Output arrangements for transferring data from processing unit to output unit, e.g. interface arrangements
- G06F3/01—Input arrangements or combined input and output arrangements for interaction between user and computer
- G06F3/018—Input/output arrangements for oriental characters
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F40/00—Handling natural language data
- G06F40/20—Natural language analysis
- G06F40/279—Recognition of textual entities
- G06F40/284—Lexical analysis, e.g. tokenisation or collocates
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F40/00—Handling natural language data
- G06F40/20—Natural language analysis
- G06F40/205—Parsing
- G06F40/211—Syntactic parsing, e.g. based on context-free grammar [CFG] or unification grammars
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F40/00—Handling natural language data
- G06F40/40—Processing or translation of natural language
- G06F40/53—Processing of non-Latin text
Landscapes
- Engineering & Computer Science (AREA)
- Theoretical Computer Science (AREA)
- General Engineering & Computer Science (AREA)
- Physics & Mathematics (AREA)
- General Physics & Mathematics (AREA)
- Computational Linguistics (AREA)
- General Health & Medical Sciences (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Artificial Intelligence (AREA)
- Human Computer Interaction (AREA)
- Data Mining & Analysis (AREA)
- Databases & Information Systems (AREA)
- Mathematical Physics (AREA)
- Software Systems (AREA)
- Machine Translation (AREA)
- Document Processing Apparatus (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
〔発明の技術分野〕
本発明は、読み情報を仮名漢字変換してなる複数の同音
異義語の中から適切な訳語(訳語句)を効果的に選択す
ることのできる文章作成装置に関する。
異義語の中から適切な訳語(訳語句)を効果的に選択す
ることのできる文章作成装置に関する。
近時、日本語ワードプロセッサが広く普及している。こ
の種の文章作成装置では、文章を形成する読みの情報を
単語、文節、連文節等の単位で入力し、これを仮名漢字
変換辞書を参照して仮名漢字混じりの文字列に変換して
いる。
の種の文章作成装置では、文章を形成する読みの情報を
単語、文節、連文節等の単位で入力し、これを仮名漢字
変換辞書を参照して仮名漢字混じりの文字列に変換して
いる。
ところが、日本語には種々の同音異義語が存在する為、
上記仮名漢字変換処理において複数の変換候補(訳語、
訳語句)が得られることが多い。
上記仮名漢字変換処理において複数の変換候補(訳語、
訳語句)が得られることが多い。
そこで従来では、専ら次候補キー等を用いて変換目的と
する訳語(訳語句)を選択するようにしている。
する訳語(訳語句)を選択するようにしている。
然し乍ら、この同音具@語の選択処理は非常に煩わしい
。そこで例えば、順次選択された同音異義語を装置内で
頻度学習し、出現頻度の高い訳語(訳語句)を第1候補
として出力するような工夫が行われている。また同じ訳
語(訳語句)が繰返し用いられることが多いことから、
最終選択された訳語(訳語句)を第1候補として出力す
るような工夫が行われている。
。そこで例えば、順次選択された同音異義語を装置内で
頻度学習し、出現頻度の高い訳語(訳語句)を第1候補
として出力するような工夫が行われている。また同じ訳
語(訳語句)が繰返し用いられることが多いことから、
最終選択された訳語(訳語句)を第1候補として出力す
るような工夫が行われている。
このような工夫は、同音異義語の選択操作の回数を少な
くする上で大きく貢献している。
くする上で大きく貢献している。
ところが、例えば「記者が帰社する。」等のように、1
つの文章中で複数の同音異義語を用いる場合も多々ある
。このような場合には、その都度、同音異義語の選択操
作が必要となり、前述した工夫がかえって煩わしさを招
来することになる。
つの文章中で複数の同音異義語を用いる場合も多々ある
。このような場合には、その都度、同音異義語の選択操
作が必要となり、前述した工夫がかえって煩わしさを招
来することになる。
そこで7、曙械翻訳技術に見られるような構文解析処理
を導入して上1fflした同音異義語の選択を行うこと
が考えられている。ところがこの構文解析処理は、1つ
の文を解析処理対象として行われる為、入力単位を単語
や文節等として仮名漢字変換処理する文章作成装置への
適用が困難であった。
を導入して上1fflした同音異義語の選択を行うこと
が考えられている。ところがこの構文解析処理は、1つ
の文を解析処理対象として行われる為、入力単位を単語
や文節等として仮名漢字変換処理する文章作成装置への
適用が困難であった。
一方、新しい文章作成装置として、所謂べた入力された
読み情報を順次仮名漢字変換処理することが試みられて
いる。然し乍ら実際には、装置内部における組合せ処理
データ量の制限等から、その一時の入力文字数を制限し
たり、またその入力文の先頭から単語や文節の区切りを
自動検出し、その検出単位毎に仮名漢字変換処理するよ
うに()ている。
読み情報を順次仮名漢字変換処理することが試みられて
いる。然し乍ら実際には、装置内部における組合せ処理
データ量の制限等から、その一時の入力文字数を制限し
たり、またその入力文の先頭から単語や文節の区切りを
自動検出し、その検出単位毎に仮名漢字変換処理するよ
うに()ている。
この為、1文がべた入力されても、その全体が単語や文
節等の単位に細かく分割されて仮名漢字変換処理される
ので、その全体に亙る構文的な特徴を捕えた解析処理を
行うことが困難であった。
節等の単位に細かく分割されて仮名漢字変換処理される
ので、その全体に亙る構文的な特徴を捕えた解析処理を
行うことが困難であった。
しかも構文解析を行う為には、1文の入力の完了を持つ
ことが必要である。この為、文の入力からその変換処理
結果を得るまでの応答が悪いと云う不具合があった。
ことが必要である。この為、文の入力からその変換処理
結果を得るまでの応答が悪いと云う不具合があった。
これ故、文章を考えながら読み情報を入力して文章を作
成するような場合、その入力イメージ(作成文章イメー
ジ)を捕え難いと云う問題も生じた。
成するような場合、その入力イメージ(作成文章イメー
ジ)を捕え難いと云う問題も生じた。
本発明はこのような事情を考慮してなされたもので、そ
の目的とするところは、仮名漢字変換結果の応答時間遅
れや処理データエリアの増大を招くことなく、意味的に
適切な訳語(訳語句)を変換候補として得て、その同音
異義語の選択操作の煩わしさを大幅に軽減することので
きる実用性の高い文章作成装置を提供することにある。
の目的とするところは、仮名漢字変換結果の応答時間遅
れや処理データエリアの増大を招くことなく、意味的に
適切な訳語(訳語句)を変換候補として得て、その同音
異義語の選択操作の煩わしさを大幅に軽減することので
きる実用性の高い文章作成装置を提供することにある。
本発明は、文章の読み情報を入力して仮名漢字混じりの
文章情報に変換する文章作成装置において、 入力された読み情報を、例えば単語や文節等の所定の変
換単位で順次仮名漢字混じりの文字情報に変換し、複数
の変換候補が1qられたときには優先順位の高い変換候
補を出力するようにし、一方、上記読み情報の入力に対
する、例えば句読点や、括弧、段落、改行等の文終端を
示す特殊情報の入力をトリガとして、上記変換処理され
た文章の構文解析を行い、前記変換処理された文章中の
同音異義語が存在する候補の中で池の語との間で係り受
け関係にない候補を選択し、この係り受け関係にない候
補の変換候補順位を下げてその変換候補の出力を制御す
るようにしたものである。
文章情報に変換する文章作成装置において、 入力された読み情報を、例えば単語や文節等の所定の変
換単位で順次仮名漢字混じりの文字情報に変換し、複数
の変換候補が1qられたときには優先順位の高い変換候
補を出力するようにし、一方、上記読み情報の入力に対
する、例えば句読点や、括弧、段落、改行等の文終端を
示す特殊情報の入力をトリガとして、上記変換処理され
た文章の構文解析を行い、前記変換処理された文章中の
同音異義語が存在する候補の中で池の語との間で係り受
け関係にない候補を選択し、この係り受け関係にない候
補の変換候補順位を下げてその変換候補の出力を制御す
るようにしたものである。
かくして本発明によれば、出現頻度情報や前選択情報等
に従って入力読み情報が所定の変換処理単位毎に順次仮
名漢字変換されて出力表示されるので、その変換結果の
応答時間遅れを招くことがなく、また装置内の処理デー
タエリアの増大を招くこともない。
に従って入力読み情報が所定の変換処理単位毎に順次仮
名漢字変換されて出力表示されるので、その変換結果の
応答時間遅れを招くことがなく、また装置内の処理デー
タエリアの増大を招くこともない。
しかも文終端の情報が入力された時点で、それまでに変
換処理された文章の構文を解析し、この解析結果に従っ
て他の詔との間で係り受け関係にない同音異義語の変換
候補順位を下げるので、不本意な同音異義語の変換出力
が効果的に阻止される。この結果、同音異義語の選択操
作の必要回数を大幅に低減することが可能となり、その
操作性(文章作成性)の向上を図ることが可能となる。
換処理された文章の構文を解析し、この解析結果に従っ
て他の詔との間で係り受け関係にない同音異義語の変換
候補順位を下げるので、不本意な同音異義語の変換出力
が効果的に阻止される。この結果、同音異義語の選択操
作の必要回数を大幅に低減することが可能となり、その
操作性(文章作成性)の向上を図ることが可能となる。
以下、図面を参照して本発明の一実施例につき説明する
。
。
第1図は実施例装置の概略構成図である。
入力装置1は、例えば仮名キーボードからなり、この入
力装置1を操作して文章作成に供する読み情報が仮名文
字列として入力される。尚、ここでは仮名人力する例に
つき説明するが、読み情報をローマ字入力するものであ
っても良く、また音声入力するものであっても良い。ま
たこの入力装置1から、文終端を示す句読点や括弧1段
落、改行等の情報も入力される。
力装置1を操作して文章作成に供する読み情報が仮名文
字列として入力される。尚、ここでは仮名人力する例に
つき説明するが、読み情報をローマ字入力するものであ
っても良く、また音声入力するものであっても良い。ま
たこの入力装置1から、文終端を示す句読点や括弧1段
落、改行等の情報も入力される。
しかして入力装W1から入力された読み情報(仮名文字
列)は、入力メモリ2に蓄えられた後、この入力メモリ
2から変換制御部3に読出される。
列)は、入力メモリ2に蓄えられた後、この入力メモリ
2から変換制御部3に読出される。
そして上記読み情報は、基本的には変換制御部3の制御
の下で、単語または文節等の所定の処理単位毎に切出さ
れ、仮名漢字変換部4による仮名漢字変換処理に供せら
れる。
の下で、単語または文節等の所定の処理単位毎に切出さ
れ、仮名漢字変換部4による仮名漢字変換処理に供せら
れる。
仮名漢字変換部4は、単語辞書メモリ5に予め格納され
た仮名漢字変換の辞書情報を用い、前記所定の処理単位
の入力読み情報に対する仮名漢字変換結果を求めている
。尚、同音異義語の存在により同一の読みに対する変換
候補が複数個ある場合、仮名漢字変換部4は学習辞書メ
モリ6に学習登録されている各変換候補に対する出現頻
度情報や前選択情報等を参照して、優先順位が第1位の
変換候補をその変換結果として選択している。
た仮名漢字変換の辞書情報を用い、前記所定の処理単位
の入力読み情報に対する仮名漢字変換結果を求めている
。尚、同音異義語の存在により同一の読みに対する変換
候補が複数個ある場合、仮名漢字変換部4は学習辞書メ
モリ6に学習登録されている各変換候補に対する出現頻
度情報や前選択情報等を参照して、優先順位が第1位の
変換候補をその変換結果として選択している。
この仮名漢字変換処理にあっては、適宜活用語尾変化の
検定や付属語に対する検定が行われることは云うまでも
ない。またこの仮名漢字変換処理結果に応じて、前記学
習辞書メモリ6に登録される頻度情報等が随時学習更新
される。
検定や付属語に対する検定が行われることは云うまでも
ない。またこの仮名漢字変換処理結果に応じて、前記学
習辞書メモリ6に登録される頻度情報等が随時学習更新
される。
このようにして順次変換処理された仮名漢字混じりの変
換結果は出力メモリ7に蓄えられ、出力装置8にて順次
表示出力される。
換結果は出力メモリ7に蓄えられ、出力装置8にて順次
表示出力される。
しかして前記変換制御部3は、前記入力装置1から文終
端の情報が入力されたとき、出力メモリ1に格納された
変換候補の列からなる1つの文章情報を構文解析し、各
変換候補間の係り受け関係を調べている。そして同音異
義語(次候補)を持つ変換候補が、他の語との間で係り
受け関係を持たない場合、これを不適切な変換候補であ
るとして、その変換候補順位を下げている。この結果、
他の語との間で係り受け関係を持つ他の変換候補が、そ
の読み情報に対する変換結果として再選択され、前記出
力メモリ7に格納された先の変換結果が虐替えられる。
端の情報が入力されたとき、出力メモリ1に格納された
変換候補の列からなる1つの文章情報を構文解析し、各
変換候補間の係り受け関係を調べている。そして同音異
義語(次候補)を持つ変換候補が、他の語との間で係り
受け関係を持たない場合、これを不適切な変換候補であ
るとして、その変換候補順位を下げている。この結果、
他の語との間で係り受け関係を持つ他の変換候補が、そ
の読み情報に対する変換結果として再選択され、前記出
力メモリ7に格納された先の変換結果が虐替えられる。
ところで前記単語辞書メモリ5は、例えば第2図に示す
ように単語の読み情報を見出しAとし、その仮名漢字混
じり表記の変換候補B、品詞情報C1分類コードD、結
合コードEを分類登録して構成される。尚、Fはその格
納アドレス情報である。
ように単語の読み情報を見出しAとし、その仮名漢字混
じり表記の変換候補B、品詞情報C1分類コードD、結
合コードEを分類登録して構成される。尚、Fはその格
納アドレス情報である。
ここで読み見出しAに対する変換候補B、およびその品
詞情報Cは、例えば従来一般的な文節指定形式の変換処
理で用いられる辞書のデータ形式と同じものである。
詞情報Cは、例えば従来一般的な文節指定形式の変換処
理で用いられる辞書のデータ形式と同じものである。
しかして分類コードDおよび結合コードEは、前述した
構文検定に使用されるものである。
構文検定に使用されるものである。
分類コードDは、単語の意味的な性質を簡単に割当てた
もので、例えばここでは゛人゛′に関する情報を(a)
、″“組織・法人”に関する情報を(b)、“乗物゛′
に関する情報をくC)、そして°“場所゛′に関する情
報を(d)としている。また語尾「する」を付加するこ
とによって動詞化するす変名間に関しては、(S)なる
分類コードを与えるようにしている。
もので、例えばここでは゛人゛′に関する情報を(a)
、″“組織・法人”に関する情報を(b)、“乗物゛′
に関する情報をくC)、そして°“場所゛′に関する情
報を(d)としている。また語尾「する」を付加するこ
とによって動詞化するす変名間に関しては、(S)なる
分類コードを与えるようにしている。
また結合コードEは、主として動詞(動詞化したす変名
間)に関するものであり、その動詞がと宋シ のような分類コードを持つ名詞と、いかなる虻助詞を伴
って結び付くか、等の情報を示している。
間)に関するものであり、その動詞がと宋シ のような分類コードを持つ名詞と、いかなる虻助詞を伴
って結び付くか、等の情報を示している。
例えば「発車する」なる動詞の場合、その結合コードが
「(C)が(d)をJとして与えられるから、「“乗物
パが“場所パを発車する」として結合することが示され
る。尚、[(a)が(a。
「(C)が(d)をJとして与えられるから、「“乗物
パが“場所パを発車する」として結合することが示され
る。尚、[(a)が(a。
b、d)を」なる結合コードは、括弧内の要素a。
b、dがそれぞれ結合可能であることを示している。
次に前記変換制御部3の詳細な動作につき説明する。
第3図は変換制御部3の動作シーケンスの一例を示すも
のである。
のである。
変換制御部3は、前記入力装置1から文字情報が入力さ
れると(ステップa)、先ずその入力文字コードを入力
メモリ2にスタックする(ステップb)。
れると(ステップa)、先ずその入力文字コードを入力
メモリ2にスタックする(ステップb)。
そしてその入力文字コードが、例えば文終端を示す句読
点であるか、仮名漢字変換処理の区切り単位を示す文節
指定の情報であるか、或いは読み情報を示す仮名文字コ
ードであるかを判定している(ステップc、d)。
点であるか、仮名漢字変換処理の区切り単位を示す文節
指定の情報であるか、或いは読み情報を示す仮名文字コ
ードであるかを判定している(ステップc、d)。
この判定結果に従って、■入力文字コードが仮名文字コ
ードの場合には、文字人力(ステップa)とその入力文
字コードの入力メモリ2へのスタック(ステップb)が
繰返し行われる。
ードの場合には、文字人力(ステップa)とその入力文
字コードの入力メモリ2へのスタック(ステップb)が
繰返し行われる。
そして■入力文字コードが句読点である場合、および■
文節指定の情報である場合には、上記入力メモリ2にス
タックされた入力文字コード列に対する仮名−漢字変換
処理を実行する(ステップe)。
文節指定の情報である場合には、上記入力メモリ2にス
タックされた入力文字コード列に対する仮名−漢字変換
処理を実行する(ステップe)。
この仮名漢字変換処理の実行は、上記入力文字コード列
を仮名漢字変換部4に与えることにより行われる。
を仮名漢字変換部4に与えることにより行われる。
しかして仮名漢字変換部4が単語辞書メモリ5を参照し
て、その入力文字コード列(読み情報)に対する変換結
果を得ると、変換制御部3は次に学習辞書メモリ6に格
納された頻度情報に従ってその出力優先順位を決定する
(ステップf)。この出力優先順位の決定は、同一の読
み情報に対する変換候補が複数個存在する場合、仮名漢
字変換部4に指令を与えて行われるものである。そして
それらの各変換候補に対する過去の出現頻度情報や最後
に選択された変換候補の情報等に基いて、出力優先順位
の最も高い変換候補を、その読み情報(入力文字コード
列)に対する変換結果として選択することにより行われ
る。
て、その入力文字コード列(読み情報)に対する変換結
果を得ると、変換制御部3は次に学習辞書メモリ6に格
納された頻度情報に従ってその出力優先順位を決定する
(ステップf)。この出力優先順位の決定は、同一の読
み情報に対する変換候補が複数個存在する場合、仮名漢
字変換部4に指令を与えて行われるものである。そして
それらの各変換候補に対する過去の出現頻度情報や最後
に選択された変換候補の情報等に基いて、出力優先順位
の最も高い変換候補を、その読み情報(入力文字コード
列)に対する変換結果として選択することにより行われ
る。
このようにして求められた変換結果が出力メモリ7に転
送され、出力装置8にて出力表示される(ステップg)
。
送され、出力装置8にて出力表示される(ステップg)
。
そして変換制御部3は、その処理単位(文節)の仮名漢
字変換処理が終了し、変換結果が出力メモリ7に格納さ
れたことから、前記入力メモリ2に格納された入力文字
コード列を消去しくステップh)、次の文字コードの入
力に備える。
字変換処理が終了し、変換結果が出力メモリ7に格納さ
れたことから、前記入力メモリ2に格納された入力文字
コード列を消去しくステップh)、次の文字コードの入
力に備える。
しかる後、上記の如く変換処理された入力文字コード列
の最後の入力文字コードが句読点であったか否かを確認
するくステップ1)。この確認処理にて、■入力文字コ
ードが前述した文節の区切りを示す情報であった場合に
は前述した処理を再度繰返す。従って文節単位で入力さ
れる文字コード列は、その都度、仮名漢字変換処理され
ることになる。また■その最後の入力文字コードが句読
点であった場合には、以下に示す処理を実行する。
の最後の入力文字コードが句読点であったか否かを確認
するくステップ1)。この確認処理にて、■入力文字コ
ードが前述した文節の区切りを示す情報であった場合に
は前述した処理を再度繰返す。従って文節単位で入力さ
れる文字コード列は、その都度、仮名漢字変換処理され
ることになる。また■その最後の入力文字コードが句読
点であった場合には、以下に示す処理を実行する。
尚、この最後に入力された文字ニー、ドが句読点である
か否かの確認処理は、例えば前述した処理ステップCで
入力文字コードが句読点であると判定されたときにフラ
グを立て、このフラグを参照する等して行われる。
か否かの確認処理は、例えば前述した処理ステップCで
入力文字コードが句読点であると判定されたときにフラ
グを立て、このフラグを参照する等して行われる。
しかして、最後に入力された文字コードが句読点であり
、今までに入力された文字コード列に対する文の区切り
が示されたとき、前記出力メモリ7には、各文節の変換
結果によって示される1つの文章情報が得られることに
なる。そこで変換制御部3は前記出力メモリ7に順に格
納された各文節の変換結果の情報を読出し、その文頭を
検索する(ステップj)。そしてこの文頭から順に、各
変換結果にそれぞれ対陣した前記分類コードDと結合コ
ードEを求め、その構文を解析する(ステップk)。
、今までに入力された文字コード列に対する文の区切り
が示されたとき、前記出力メモリ7には、各文節の変換
結果によって示される1つの文章情報が得られることに
なる。そこで変換制御部3は前記出力メモリ7に順に格
納された各文節の変換結果の情報を読出し、その文頭を
検索する(ステップj)。そしてこの文頭から順に、各
変換結果にそれぞれ対陣した前記分類コードDと結合コ
ードEを求め、その構文を解析する(ステップk)。
この構文解析は、各変換結果の結合コードEに従って他
の語の分類コードDを参照し、その結合条件を満してい
るか否かを調べることによって行われる。この構文解析
によって、出力メモリ7に得られた変換結果が他の変換
結果との間で所定の係り受け関係を満しているか否かが
判定されることになる。
の語の分類コードDを参照し、その結合条件を満してい
るか否かを調べることによって行われる。この構文解析
によって、出力メモリ7に得られた変換結果が他の変換
結果との間で所定の係り受け関係を満しているか否かが
判定されることになる。
そして係り受けの結合性のない変換候補が見出された場
合には、その変換候補が変換結果として不適切なもので
あると判定され、その出力優先順位が下げられる。この
出力優先順位の変更によって同音異義語の関係にある他
の変換候補が、最優先順位の変換候補として求められる
ので、この変換候補に対しても同様にしてその係り受け
関係の結合性を調べる。
合には、その変換候補が変換結果として不適切なもので
あると判定され、その出力優先順位が下げられる。この
出力優先順位の変更によって同音異義語の関係にある他
の変換候補が、最優先順位の変換候補として求められる
ので、この変換候補に対しても同様にしてその係り受け
関係の結合性を調べる。
このような処理によって複数の同音異義語の中から、他
の語との間で係り受け関係を満すものが選択される(ス
テップβ)。この係り受け関係を満す変換候補が複数個
存在する場合には、その中で最も優先順位の高いものが
選択されることは云うまでもない。
の語との間で係り受け関係を満すものが選択される(ス
テップβ)。この係り受け関係を満す変換候補が複数個
存在する場合には、その中で最も優先順位の高いものが
選択されることは云うまでもない。
しかして係り受け関係を満さなかった変換結果に代えて
求められた新たな変換候補は、出力メモリ7に転送され
た該当変換結果と入替えられる。
求められた新たな変換候補は、出力メモリ7に転送され
た該当変換結果と入替えられる。
この結果、係り受け結合性を満す変換結果のみからなる
文章情報が出力メモリ7に得られることになる。この文
章情報が出力装置8にて表示される(ステップm)。
文章情報が出力メモリ7に得られることになる。この文
章情報が出力装置8にて表示される(ステップm)。
このようにして出力表示された文章情報に対し、必要が
あれば変換候補に対する次候補選択処理が従来装置と同
様に行われる。尚、上述した係り受け結合性の処理によ
って、係り受けの不適切な変換候補が訂正されているこ
とから、多くの場合、適切な変換処理結果が得られる。
あれば変換候補に対する次候補選択処理が従来装置と同
様に行われる。尚、上述した係り受け結合性の処理によ
って、係り受けの不適切な変換候補が訂正されているこ
とから、多くの場合、適切な変換処理結果が得られる。
従ってこのような場合には、そのまま次の文章の作成作
業に進むことが可能となる。
業に進むことが可能となる。
第4図乃至第6図は本装置による文章作成処理の具体例
を示すものである。
を示すものである。
今、入力装置1から「きしやが」なる読み情報を入力し
、これに続いて文節変換を指示すると、上記読み情報は
仮名漢字変換部4に与えられて仮名漢字変換される。
、これに続いて文節変換を指示すると、上記読み情報は
仮名漢字変換部4に与えられて仮名漢字変換される。
この場合、第2図に示すように「きしヤ」なる読みに対
する変換候補が「貴社、記者、帰社、汽車」と4つ存在
することから、その頻度情報が参照される。
する変換候補が「貴社、記者、帰社、汽車」と4つ存在
することから、その頻度情報が参照される。
そして単語辞書メモリ5には、例えば頻度値の高いもの
から順にその変換候補が並替え制御されて格納されてい
るものとすると、この場合には「貴社」なる表記がその
変換結果として求められる。この変換処理情報は出力メ
モリ7に格納され、出力装置8にて第4図(a)に示す
ように「貴社が」として表示される。
から順にその変換候補が並替え制御されて格納されてい
るものとすると、この場合には「貴社」なる表記がその
変換結果として求められる。この変換処理情報は出力メ
モリ7に格納され、出力装置8にて第4図(a)に示す
ように「貴社が」として表示される。
しかる後、「どうきようを」なる読み情報を入力し、文
節変換を指示すると、この場合には同音具!1語が存在
しないことから、その変換結果が直接的に「東京」とし
て求められる。この変換結果は、出力メモリ7に先に格
納された情報に加えて該出力メモリ7に格納される。こ
の結果、出力表示装置8には、第4図(b)に示すよう
に「貴社が東京を」なる表示が得られることになる。
節変換を指示すると、この場合には同音具!1語が存在
しないことから、その変換結果が直接的に「東京」とし
て求められる。この変換結果は、出力メモリ7に先に格
納された情報に加えて該出力メモリ7に格納される。こ
の結果、出力表示装置8には、第4図(b)に示すよう
に「貴社が東京を」なる表示が得られることになる。
続いて「はうもんした」なる読み情報を入力し、文略端
を示す「読点:。」を入力すると、「はうもん」なる読
みに対する変換結果が「訪問」として求められると同時
に、上記文略端の情報入力をトリガとして文章の構文解
析が行われる。
を示す「読点:。」を入力すると、「はうもん」なる読
みに対する変換結果が「訪問」として求められると同時
に、上記文略端の情報入力をトリガとして文章の構文解
析が行われる。
この構文解析は、出力メモリ7に格納された文節単位の
変換候補の全てを変換制御部3に読出し、各変換候補の
同音異義語を求めると共に、それらの変換候補の分類コ
ードDと結合コードEとに従ってそれらの間の係り受け
結合関係を調べることにより行われる。
変換候補の全てを変換制御部3に読出し、各変換候補の
同音異義語を求めると共に、それらの変換候補の分類コ
ードDと結合コードEとに従ってそれらの間の係り受け
結合関係を調べることにより行われる。
この例の場合には、出力メモリ7から読出された情報に
従って、例えば第5図に示す如き変換候補の情報を得る
。尚、第5図において、「#」と「*」との間に示され
る変換候補は、互いに同音異義語の関係にあることを示
している。
従って、例えば第5図に示す如き変換候補の情報を得る
。尚、第5図において、「#」と「*」との間に示され
る変換候補は、互いに同音異義語の関係にあることを示
している。
しかして複数の同音異義語関係にある変換候補と、これ
に核助詞を介して結合される他の変換候補との間の関係
は、第6図に示されるようになる。
に核助詞を介して結合される他の変換候補との間の関係
は、第6図に示されるようになる。
ここでその分類コードDと、結合コードEとに従ってそ
の係り受け関係の成立性を調べると、「訪問」なる変換
候補の結合コードから、「訪問した」なる詔が 「(a)が(a、b、d)を訪問した」なる係り受け関
係しか取り得ないことがわかる。
の係り受け関係の成立性を調べると、「訪問」なる変換
候補の結合コードから、「訪問した」なる詔が 「(a)が(a、b、d)を訪問した」なる係り受け関
係しか取り得ないことがわかる。
この結果、
「(a)が東京を訪問した」
なる係り受け関係が成立することが解析され、更に「貴
社」の分類コードDが(b)であることから、 「貴社が東京を訪問した」 なる係り受け結合が成立しないことがわかる。そしてこ
の場合には、分類コードDが(a)である「記者」なる
変換候補だけが係り受け関係を満すことが見出され、 「記者が東京を訪問した」 なる構文解析結果が得られることになる。このような構
文解析処理によって、先に求められた変換候補「貴社」
の出力優先順位が下げられ、これに替えて「記者」なる
変換候補によって変換結果が、第4図(C)に示すよう
に晦正されることになる。
社」の分類コードDが(b)であることから、 「貴社が東京を訪問した」 なる係り受け結合が成立しないことがわかる。そしてこ
の場合には、分類コードDが(a)である「記者」なる
変換候補だけが係り受け関係を満すことが見出され、 「記者が東京を訪問した」 なる構文解析結果が得られることになる。このような構
文解析処理によって、先に求められた変換候補「貴社」
の出力優先順位が下げられ、これに替えて「記者」なる
変換候補によって変換結果が、第4図(C)に示すよう
に晦正されることになる。
このようにして、文終端の情報入力としてその変換処理
された文章の構文が解析され、所定の係り受け関係を満
す変換候補が選択されることになる。
された文章の構文が解析され、所定の係り受け関係を満
す変換候補が選択されることになる。
従って本装置によれば、同音異!!語が存在する変換候
補は、その出現頻度情報等に従って選択されつつ、他の
語との係り受け関係に従って選択修正されるので、適切
な変換結果を効率良く得ることが可能となる。これ故、
オペレータによる同音異義詔の選択操作回数を大幅に少
なくすることができ、文章作成効率の向上を図るこが可
能となる。
補は、その出現頻度情報等に従って選択されつつ、他の
語との係り受け関係に従って選択修正されるので、適切
な変換結果を効率良く得ることが可能となる。これ故、
オペレータによる同音異義詔の選択操作回数を大幅に少
なくすることができ、文章作成効率の向上を図るこが可
能となる。
しかも入力した読み情報に対する変換結果が応答性良く
得られ、1文の入力が終了した時点で係り受け関係の不
本意な変換候補が修正されるので、文章作成作業が容易
である等の効果が奏せられる。
得られ、1文の入力が終了した時点で係り受け関係の不
本意な変換候補が修正されるので、文章作成作業が容易
である等の効果が奏せられる。
尚、本発明は上述した実施例に限定されるものではない
。ここでは文節単位で仮名漢字変換処理 −を行
ったが、2文節や3文節等の連続した処理単位毎に仮名
漢字変換処理を行うようにしても良い。
。ここでは文節単位で仮名漢字変換処理 −を行
ったが、2文節や3文節等の連続した処理単位毎に仮名
漢字変換処理を行うようにしても良い。
またべた入力された情報を内部的に分かち書き処理し、
これを順次仮名漢字変換処理を行うものであっても良い
。更には、読み情報の入力形態も前述したように仮名人
力に限定されないことは云うまでもない。要するに本発
明はその要旨を逸脱しない範囲で種々変形して実施する
ことができる。
これを順次仮名漢字変換処理を行うものであっても良い
。更には、読み情報の入力形態も前述したように仮名人
力に限定されないことは云うまでもない。要するに本発
明はその要旨を逸脱しない範囲で種々変形して実施する
ことができる。
第1図は本発明の一実施例装置の概略構成図、第2図は
単語辞書メモリの構成例を示す図、第3図は変換制御部
の制御シーケンスの例を示す図、第4図乃至第6図は本
装置における文章作成処理の具体例を示す図である。 1・・・入力装置、2・・・入力メモリ、3・・・変換
制御部、4・・・仮名漢字変換部、5・・・単語辞書メ
モ1ハロ・・・学習辞書メモリ、7・・・出力メモ1ハ
8・・・出力装置。 出願人代理人 弁理士 鈴江武彦 第1図
単語辞書メモリの構成例を示す図、第3図は変換制御部
の制御シーケンスの例を示す図、第4図乃至第6図は本
装置における文章作成処理の具体例を示す図である。 1・・・入力装置、2・・・入力メモリ、3・・・変換
制御部、4・・・仮名漢字変換部、5・・・単語辞書メ
モ1ハロ・・・学習辞書メモリ、7・・・出力メモ1ハ
8・・・出力装置。 出願人代理人 弁理士 鈴江武彦 第1図
Claims (3)
- (1)文章の読み情報を入力して仮名漢字混じりの文章
情報に変換する文章作成装置において、入力された読み
情報を所定の変換単位で順次仮名漢字混じりの文字情報
に変換する手段と、読み情報の入力に対する文終端を示
す特殊情報の入力をトリガとして、上記変換処理された
文章の構文解析を行う手段と、上記変換処理された文章
中の同音異義語が存在する候補の中で他の語との間で係
り受け関係にない候補を選択する手段と、この係り受け
関係にない候補の変換候補順位を下げて前記読み情報に
対する仮名漢字混じりの文章情報を得る手段とを具備し
たことを特徴とする文章作成装置。 - (2)読み情報を仮名漢字混じりの文字情報に変換する
手段は、読み情報を単語または文節を処理単位として変
換処理し、複数の変換候補が得られたときには優先順位
の高い変換候補を出力するものである特許請求の範囲第
1項記載の文章作成装置。 - (3)読み情報の入力に対する文終端を示す特殊情報は
、句読点の情報や、括弧、段落、改行等の情報からなる
ものである特許請求の範囲第1項記載の文章作成装置。
Priority Applications (4)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP60170028A JPS6231467A (ja) | 1985-08-01 | 1985-08-01 | 文章作成装置 |
| KR1019860003287A KR900005899B1 (ko) | 1985-08-01 | 1986-04-28 | 문장작성장치 |
| US06/889,761 US4777600A (en) | 1985-08-01 | 1986-07-28 | Phonetic data-to-kanji character converter with a syntax analyzer to alter priority order of displayed kanji homonyms |
| CN86105459A CN1008016B (zh) | 1985-08-01 | 1986-07-31 | 输入处理系统 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP60170028A JPS6231467A (ja) | 1985-08-01 | 1985-08-01 | 文章作成装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPS6231467A true JPS6231467A (ja) | 1987-02-10 |
| JPH0433069B2 JPH0433069B2 (ja) | 1992-06-02 |
Family
ID=15897261
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP60170028A Granted JPS6231467A (ja) | 1985-08-01 | 1985-08-01 | 文章作成装置 |
Country Status (4)
| Country | Link |
|---|---|
| US (1) | US4777600A (ja) |
| JP (1) | JPS6231467A (ja) |
| KR (1) | KR900005899B1 (ja) |
| CN (1) | CN1008016B (ja) |
Cited By (3)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS6470865A (en) * | 1987-09-11 | 1989-03-16 | Brother Ind Ltd | Language processor based upon voice input |
| JPH0336662A (ja) * | 1989-07-03 | 1991-02-18 | Ricoh Co Ltd | 自然言語処理方式 |
| CN103365427A (zh) * | 2012-03-31 | 2013-10-23 | 联想(北京)有限公司 | 一种对输入内容进行调整的方法及电子设备 |
Families Citing this family (45)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US5201042A (en) * | 1986-04-30 | 1993-04-06 | Hewlett-Packard Company | Software process and tools for development of local language translations of text portions of computer source code |
| US5551049A (en) * | 1987-05-26 | 1996-08-27 | Xerox Corporation | Thesaurus with compactly stored word groups |
| JPH0731677B2 (ja) * | 1987-09-29 | 1995-04-10 | シャープ株式会社 | 文書作成・校正支援装置 |
| JP2527817B2 (ja) * | 1989-07-14 | 1996-08-28 | シャープ株式会社 | 主題連想装置および単語連想装置 |
| JP2836159B2 (ja) * | 1990-01-30 | 1998-12-14 | 株式会社日立製作所 | 同時通訳向き音声認識システムおよびその音声認識方法 |
| US5255355A (en) * | 1990-10-10 | 1993-10-19 | Fuji Xerox Co., Ltd. | Document processor |
| JPH0594436A (ja) * | 1990-10-10 | 1993-04-16 | Fuji Xerox Co Ltd | 文書処理装置 |
| US5488719A (en) * | 1991-12-30 | 1996-01-30 | Xerox Corporation | System for categorizing character strings using acceptability and category information contained in ending substrings |
| US5309566A (en) * | 1992-02-04 | 1994-05-03 | International Business Machines Corporation | System and method for character translation |
| KR100291372B1 (ko) * | 1992-05-29 | 2001-06-01 | 이데이 노부유끼 | 전자 사전 장치 |
| US5448474A (en) * | 1993-03-03 | 1995-09-05 | International Business Machines Corporation | Method for isolation of Chinese words from connected Chinese text |
| JPH07114558A (ja) * | 1993-10-19 | 1995-05-02 | Fujitsu Ltd | 漢字変換訂正処理方式 |
| US5619563A (en) * | 1994-12-19 | 1997-04-08 | Lucent Technologies Inc. | Mnemonic number dialing plan |
| JP2817776B2 (ja) * | 1995-05-25 | 1998-10-30 | 日本電気株式会社 | 単語変換装置 |
| US5893133A (en) * | 1995-08-16 | 1999-04-06 | International Business Machines Corporation | Keyboard for a system and method for processing Chinese language text |
| US7590224B1 (en) | 1995-09-15 | 2009-09-15 | At&T Intellectual Property, Ii, L.P. | Automated task classification system |
| US5675707A (en) * | 1995-09-15 | 1997-10-07 | At&T | Automated call router system and method |
| US5764851A (en) * | 1996-07-24 | 1998-06-09 | Industrial Technology Research Institute | Fast speech recognition method for mandarin words |
| US6094634A (en) * | 1997-03-26 | 2000-07-25 | Fujitsu Limited | Data compressing apparatus, data decompressing apparatus, data compressing method, data decompressing method, and program recording medium |
| US5999950A (en) * | 1997-08-11 | 1999-12-07 | Webtv Networks, Inc. | Japanese text input method using a keyboard with only base kana characters |
| US6064957A (en) * | 1997-08-15 | 2000-05-16 | General Electric Company | Improving speech recognition through text-based linguistic post-processing |
| JPH1186434A (ja) * | 1997-09-11 | 1999-03-30 | Sony Corp | 記録装置、記録方法、及びダビング装置 |
| US6490563B2 (en) | 1998-08-17 | 2002-12-03 | Microsoft Corporation | Proofreading with text to speech feedback |
| JP2000298667A (ja) * | 1999-04-15 | 2000-10-24 | Matsushita Electric Ind Co Ltd | 構文情報による漢字変換装置 |
| JP2001043221A (ja) * | 1999-07-29 | 2001-02-16 | Matsushita Electric Ind Co Ltd | 中国語単語分割装置 |
| US7085720B1 (en) | 1999-11-05 | 2006-08-01 | At & T Corp. | Method for task classification using morphemes |
| US8392188B1 (en) | 1999-11-05 | 2013-03-05 | At&T Intellectual Property Ii, L.P. | Method and system for building a phonotactic model for domain independent speech recognition |
| US6681206B1 (en) | 1999-11-05 | 2004-01-20 | At&T Corporation | Method for generating morphemes |
| US7286984B1 (en) * | 1999-11-05 | 2007-10-23 | At&T Corp. | Method and system for automatically detecting morphemes in a task classification system using lattices |
| US20030182113A1 (en) * | 1999-11-22 | 2003-09-25 | Xuedong Huang | Distributed speech recognition for mobile communication devices |
| JP2001331272A (ja) * | 2000-05-24 | 2001-11-30 | Alps Electric Co Ltd | 文字入力装置 |
| US6941266B1 (en) | 2000-11-15 | 2005-09-06 | At&T Corp. | Method and system for predicting problematic dialog situations in a task classification system |
| US6751591B1 (en) | 2001-01-22 | 2004-06-15 | At&T Corp. | Method and system for predicting understanding errors in a task classification system |
| US20030023426A1 (en) * | 2001-06-22 | 2003-01-30 | Zi Technology Corporation Ltd. | Japanese language entry mechanism for small keypads |
| US7136803B2 (en) * | 2001-09-25 | 2006-11-14 | Apple Computer, Inc. | Japanese virtual dictionary |
| US7315982B2 (en) | 2003-02-26 | 2008-01-01 | Xerox Corporation | User-tailorable romanized Chinese text input systems and methods |
| US7299181B2 (en) * | 2004-06-30 | 2007-11-20 | Microsoft Corporation | Homonym processing in the context of voice-activated command systems |
| US8374862B2 (en) * | 2006-08-30 | 2013-02-12 | Research In Motion Limited | Method, software and device for uniquely identifying a desired contact in a contacts database based on a single utterance |
| US8175248B2 (en) | 2007-01-29 | 2012-05-08 | Nuance Communications, Inc. | Method and an apparatus to disambiguate requests |
| CN102262524A (zh) * | 2010-05-27 | 2011-11-30 | 鼎亿数码科技(上海)有限公司 | 基于无线输入设备的声音识别输入方法及实现装置 |
| WO2012160601A1 (ja) * | 2011-05-24 | 2012-11-29 | 三菱電機株式会社 | 文字入力装置およびそれを備えたカーナビゲーション装置 |
| US8977555B2 (en) * | 2012-12-20 | 2015-03-10 | Amazon Technologies, Inc. | Identification of utterance subjects |
| CN103943109A (zh) * | 2014-04-28 | 2014-07-23 | 深圳如果技术有限公司 | 一种将语音转换为文字的方法及装置 |
| JP6070809B1 (ja) * | 2015-12-03 | 2017-02-01 | 国立大学法人静岡大学 | 自然言語処理装置及び自然言語処理方法 |
| CN105913682B (zh) * | 2016-06-27 | 2018-08-21 | 重庆交通大学 | 基于rfid技术的智能反向寻车方法及系统 |
Citations (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5979339A (ja) * | 1982-10-29 | 1984-05-08 | Toshiba Corp | 仮名・漢字変換方式 |
Family Cites Families (6)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5924452B2 (ja) * | 1980-09-22 | 1984-06-09 | 株式会社日立製作所 | 日本文入力装置 |
| JPS57201926A (en) * | 1981-06-05 | 1982-12-10 | Hitachi Ltd | "kanji" selecting method for "kanji" input device |
| JPS5840684A (ja) * | 1981-09-04 | 1983-03-09 | Hitachi Ltd | 自然言語間の自動翻訳方式 |
| US4544276A (en) * | 1983-03-21 | 1985-10-01 | Cornell Research Foundation, Inc. | Method and apparatus for typing Japanese text using multiple systems |
| JPS603017A (ja) * | 1983-06-17 | 1985-01-09 | Ricoh Co Ltd | カナ漢字変換処理装置 |
| JPS60124774A (ja) * | 1983-12-09 | 1985-07-03 | Ricoh Co Ltd | 同音語判別装置 |
-
1985
- 1985-08-01 JP JP60170028A patent/JPS6231467A/ja active Granted
-
1986
- 1986-04-28 KR KR1019860003287A patent/KR900005899B1/ko not_active Expired
- 1986-07-28 US US06/889,761 patent/US4777600A/en not_active Expired - Fee Related
- 1986-07-31 CN CN86105459A patent/CN1008016B/zh not_active Expired
Patent Citations (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5979339A (ja) * | 1982-10-29 | 1984-05-08 | Toshiba Corp | 仮名・漢字変換方式 |
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS6470865A (en) * | 1987-09-11 | 1989-03-16 | Brother Ind Ltd | Language processor based upon voice input |
| JPH0336662A (ja) * | 1989-07-03 | 1991-02-18 | Ricoh Co Ltd | 自然言語処理方式 |
| CN103365427A (zh) * | 2012-03-31 | 2013-10-23 | 联想(北京)有限公司 | 一种对输入内容进行调整的方法及电子设备 |
| US9613311B2 (en) | 2012-03-31 | 2017-04-04 | Beijing Lenovo Software Ltd. | Receiving voice/speech, replacing elements including characters, and determining additional elements by pronouncing a first element |
Also Published As
| Publication number | Publication date |
|---|---|
| CN86105459A (zh) | 1987-06-17 |
| KR870002521A (ko) | 1987-03-31 |
| KR900005899B1 (ko) | 1990-08-13 |
| US4777600A (en) | 1988-10-11 |
| JPH0433069B2 (ja) | 1992-06-02 |
| CN1008016B (zh) | 1990-05-16 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JPH0433069B2 (ja) | ||
| JPH05303590A (ja) | 自動翻訳装置 | |
| JPS62197864A (ja) | 言語情報提供装置 | |
| JP2715419B2 (ja) | 翻訳装置 | |
| JP3353873B2 (ja) | 機械翻訳装置 | |
| JPH01126767A (ja) | 辞書参照装置 | |
| JP3253311B2 (ja) | 言語処理装置および言語処理方法 | |
| JPH0719254B2 (ja) | カナ漢字変換装置 | |
| JPH08241315A (ja) | 文書処理装置の単語登録機構 | |
| JPH07104863B2 (ja) | かな漢字変換装置 | |
| JPH0816910B2 (ja) | 言語解析装置 | |
| JPS60112175A (ja) | 仮名漢字変換装置における略称語変換方式 | |
| JPS60140460A (ja) | カナ漢字変換装置における短縮変換方式 | |
| JPH086950A (ja) | キーワード翻訳機能付き機械翻訳装置 | |
| JPH01300378A (ja) | 翻訳処理装置 | |
| JPS61169961A (ja) | ユ−ザ辞書を備えた文字処理装置 | |
| JPH0232460A (ja) | 文書処理装置 | |
| JPH0635964A (ja) | 機械翻訳装置 | |
| JPH04205645A (ja) | かな漢字変換装置及びかな漢字変換方法 | |
| JPH0736885A (ja) | 文書作成装置の文字情報変換制御方法及び同装置 | |
| JPH06332938A (ja) | 自然言語解析装置および機械翻訳装置 | |
| JPH0695330B2 (ja) | 文書作成装置 | |
| JPS63316157A (ja) | 文章の類義表現変換装置 | |
| JPH0798702A (ja) | 文書作成装置 | |
| JPH1173413A (ja) | 機械翻訳装置および機械翻訳処理プログラムを記録したコンピュータ読み取り可能な記録媒体 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| EXPY | Cancellation because of completion of term |