JPS62165267A - 音声ワ−ドプロセツサ装置 - Google Patents
音声ワ−ドプロセツサ装置Info
- Publication number
- JPS62165267A JPS62165267A JP61008461A JP846186A JPS62165267A JP S62165267 A JPS62165267 A JP S62165267A JP 61008461 A JP61008461 A JP 61008461A JP 846186 A JP846186 A JP 846186A JP S62165267 A JPS62165267 A JP S62165267A
- Authority
- JP
- Japan
- Prior art keywords
- kana
- connection
- kana character
- character strings
- kanji
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Landscapes
- Machine Translation (AREA)
- Document Processing Apparatus (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
技術分野
本発明は、音声入力により文章を作成する音声ワードプ
ロセッサ装置に関するが、音声入力のみならず、光学的
文字読取装置や通常のキーボード入力により文章を作成
するワードプロセッサ装置にも応用可能である。
ロセッサ装置に関するが、音声入力のみならず、光学的
文字読取装置や通常のキーボード入力により文章を作成
するワードプロセッサ装置にも応用可能である。
災米技生
特開昭60−39238号公報には、音声入力文章作成
方式として音声認識部から得られるカナ文字列候補に対
して、ある候補文字の先行接続可能性と後方接続可能性
を各々の統計テーブルA。
方式として音声認識部から得られるカナ文字列候補に対
して、ある候補文字の先行接続可能性と後方接続可能性
を各々の統計テーブルA。
Bを参照して評価し、接続可能な候補カナ文字列に対し
て形態素解析を施してカナ漢字変換を行って文章を作成
する方法が述べられているが、システム構築上の簡素化
(特にメモリ量の削減)および統計処理の精密化および
速度向上のためには、前記統計テーブルを1つにし、か
つ、統計情報として日本語におけるカナ文字の出現頻度
を考慮したカナ文字列接続頻度を用いる方がテーブルに
必要なメモリー量の削減と、高速処理が可能となる。
て形態素解析を施してカナ漢字変換を行って文章を作成
する方法が述べられているが、システム構築上の簡素化
(特にメモリ量の削減)および統計処理の精密化および
速度向上のためには、前記統計テーブルを1つにし、か
つ、統計情報として日本語におけるカナ文字の出現頻度
を考慮したカナ文字列接続頻度を用いる方がテーブルに
必要なメモリー量の削減と、高速処理が可能となる。
また、カナ漢字変換部におけるカナ文字列間の接続可能
性をチェックする際に、カナ文字単独の出現頻度情報を
格納した統計テーブルと、2つのカナ文字間の接続可能
性(接続頻度)を格納したもう一つの統計テーブルとを
参照しつつ候補カナ文字列を評価する方法があるが、こ
れら2つの統計テーブルは前述したようにまとめて1つ
にすることが可能であり、またシステム構築上、メモリ
量の削減や処理スピードの向上のためにもその方が望ま
しい。
性をチェックする際に、カナ文字単独の出現頻度情報を
格納した統計テーブルと、2つのカナ文字間の接続可能
性(接続頻度)を格納したもう一つの統計テーブルとを
参照しつつ候補カナ文字列を評価する方法があるが、こ
れら2つの統計テーブルは前述したようにまとめて1つ
にすることが可能であり、またシステム構築上、メモリ
量の削減や処理スピードの向上のためにもその方が望ま
しい。
l−一」在
本発明は、上述のごとき実情に鑑みてなされたもので、
特に、音声入力によって文章を作成する音声ワードプロ
セッサ装置において、音声認識部での認識結果から得ら
れる上位複数候補の組合せから成るカナ文字列における
接続可能性をチェックする統計テーブルを日本語文章に
おけるカナ文字列出現頻度およびカナ文字列連鎖情報を
まとめて1つにして格納しておき、前方及び/または後
方接続を前記統計テーブルを参照することによりカナ文
字列候補を削減した後、接続可能性の高いカナ系列から
優先的に形態素解析を実行しつつカナ漢字変換処理を行
うことにより、統計テーブルの簡略化と処理速度の向上
を図る手段を提供することを目的としてなされたもので
ある。
特に、音声入力によって文章を作成する音声ワードプロ
セッサ装置において、音声認識部での認識結果から得ら
れる上位複数候補の組合せから成るカナ文字列における
接続可能性をチェックする統計テーブルを日本語文章に
おけるカナ文字列出現頻度およびカナ文字列連鎖情報を
まとめて1つにして格納しておき、前方及び/または後
方接続を前記統計テーブルを参照することによりカナ文
字列候補を削減した後、接続可能性の高いカナ系列から
優先的に形態素解析を実行しつつカナ漢字変換処理を行
うことにより、統計テーブルの簡略化と処理速度の向上
を図る手段を提供することを目的としてなされたもので
ある。
構 成
本発明は、上記目的を達成するために、未知入力音声を
認識する音声認識部と、該音声認識部から出力される認
識結果の上位複数候補カナ文字列とそれらの類似度を格
納する格納手段、上位カナ候補列間の接続をチェックす
る統計テーブルと、カナ文字列の接続可能性の高い候補
文字列を選択保持する選択保持手段と、選択保持したカ
ナ文字列を漢字カナ混じり文に変換するカナ漢字変換手
段を有する音声ワードプロセッサ装置において。
認識する音声認識部と、該音声認識部から出力される認
識結果の上位複数候補カナ文字列とそれらの類似度を格
納する格納手段、上位カナ候補列間の接続をチェックす
る統計テーブルと、カナ文字列の接続可能性の高い候補
文字列を選択保持する選択保持手段と、選択保持したカ
ナ文字列を漢字カナ混じり文に変換するカナ漢字変換手
段を有する音声ワードプロセッサ装置において。
日本語のカナ文字列間の接続可能性をチェックする統計
テーブルをカナ文字単独の出現頻度とカナ文字列間の接
続確率情報とから作成して1つにまとめたことを特徴と
したものである。以下、本発明の実施例に基づいて説明
する。
テーブルをカナ文字単独の出現頻度とカナ文字列間の接
続確率情報とから作成して1つにまとめたことを特徴と
したものである。以下、本発明の実施例に基づいて説明
する。
第1図は、本発明による音声ワードプロセッサ装置の一
実施例を説明するための電気的ブロック図で、図中、1
は音声入力用マイクロフォン、2は音声認識部、3はカ
ナ漢字変換部、4は文書編集部、5は制御部、6は文書
出力用のプリンター。
実施例を説明するための電気的ブロック図で、図中、1
は音声入力用マイクロフォン、2は音声認識部、3はカ
ナ漢字変換部、4は文書編集部、5は制御部、6は文書
出力用のプリンター。
7は認識結果表示部である。
マイクロフォン1により入力された音声は、認識結果部
2で特徴パラメータに変換された後、予め蓄えられてい
る標準パターンとのマツチングが行われ、通常、複数の
カナ文字列がそれらの類似度と共に保持され、前記カナ
文字の並びとしてカナ文字列が形成され、カナ同士の接
続状態や形態素解析、文法チェック等を行いながら、カ
ナ漢字変換部3で漢字カナ混じり文に変換され1文書編
集部4にて適切な形式に編集される。制御部5では、前
記文書編集部4で編集した文書を表示部7に表示すると
ともに、必要な時には、プリンター6にハードコピーす
ることができる。
2で特徴パラメータに変換された後、予め蓄えられてい
る標準パターンとのマツチングが行われ、通常、複数の
カナ文字列がそれらの類似度と共に保持され、前記カナ
文字の並びとしてカナ文字列が形成され、カナ同士の接
続状態や形態素解析、文法チェック等を行いながら、カ
ナ漢字変換部3で漢字カナ混じり文に変換され1文書編
集部4にて適切な形式に編集される。制御部5では、前
記文書編集部4で編集した文書を表示部7に表示すると
ともに、必要な時には、プリンター6にハードコピーす
ることができる。
第2図は、第1図における音声認識部2と、カナ漢字変
換部3の構成をより詳しく説明するためのブロック図で
、図中、21は前処理部、22は特微分析部、23は認
識処理部、24は標準パターン格納部、25は認識結果
候補保持部、31はカナ文字列接続評価部、32は統計
テーブル、33はカナ文字列選択部、34は単語辞書格
納部。
換部3の構成をより詳しく説明するためのブロック図で
、図中、21は前処理部、22は特微分析部、23は認
識処理部、24は標準パターン格納部、25は認識結果
候補保持部、31はカナ文字列接続評価部、32は統計
テーブル、33はカナ文字列選択部、34は単語辞書格
納部。
35はカナ漢字変換部、36は漢字辞書格納部、37は
カナ文字列ルート評価部である。
カナ文字列ルート評価部である。
マイクロフォン1から入力された音声は、前処理部21
で高域強調、低域通過フィルタを通過後。
で高域強調、低域通過フィルタを通過後。
AD変換され、特微分析部22にて、バンドパスフィル
タ分桁やLPG分析等により一定周期毎に音声特有の特
徴パラメータに変換される。#M$パターン格納部24
には単音節や単語等の種型パターンが予め同様の特徴パ
ラメータ系列として格納されており、認識部23にて入
力音声パターンとの照合が行われる。その際、認識結果
を複数候補のカナ文字列およびそれらの類似度を候補保
持部25に保持しておく。次に音声認識部2で得られた
候補を基に各カナ文字列間の接続可能性を後述する統計
テーブル32を参照しながら、接続評価部31にてチェ
ックを行い、接続しないカナ文字列を除外する。更に、
単語辞書34を参照しながら接続評価部31で残された
カナ文字列を形態素解析し、カナ文字列を選択する。カ
ナ漢字変換部35では、カナ文字列選択部33で選択さ
れたカナ文字列に対して、漢字辞書36を参照しながら
カナ漢字変換を行い、漢字カナ混じり文を作成する。最
後にルート評価部37は、カナ漢字変換部35までに有
効な結果が得られなかった場合に、別の配列ルートに戻
って再度変換を行う。
タ分桁やLPG分析等により一定周期毎に音声特有の特
徴パラメータに変換される。#M$パターン格納部24
には単音節や単語等の種型パターンが予め同様の特徴パ
ラメータ系列として格納されており、認識部23にて入
力音声パターンとの照合が行われる。その際、認識結果
を複数候補のカナ文字列およびそれらの類似度を候補保
持部25に保持しておく。次に音声認識部2で得られた
候補を基に各カナ文字列間の接続可能性を後述する統計
テーブル32を参照しながら、接続評価部31にてチェ
ックを行い、接続しないカナ文字列を除外する。更に、
単語辞書34を参照しながら接続評価部31で残された
カナ文字列を形態素解析し、カナ文字列を選択する。カ
ナ漢字変換部35では、カナ文字列選択部33で選択さ
れたカナ文字列に対して、漢字辞書36を参照しながら
カナ漢字変換を行い、漢字カナ混じり文を作成する。最
後にルート評価部37は、カナ漢字変換部35までに有
効な結果が得られなかった場合に、別の配列ルートに戻
って再度変換を行う。
第3図は、第2図に示した統計テーブル32の作成方法
を説明するための図であり1図中、8はカナ出現頻度テ
ーブル、9はカナ列連鎖確率テーブル、10は掛算器、
32は前記8と9の掛算処理により作成したカナ列出現
連鎖頻度テーブル(統計テーブル)である。
を説明するための図であり1図中、8はカナ出現頻度テ
ーブル、9はカナ列連鎖確率テーブル、10は掛算器、
32は前記8と9の掛算処理により作成したカナ列出現
連鎖頻度テーブル(統計テーブル)である。
カナ出現頻度テーブル8は、日本語の文章中に出現する
カナ文字の頻度を表わし、カナ列連鎖確率テーブル9は
、カナ2文字の連鎖確率を表わす。
カナ文字の頻度を表わし、カナ列連鎖確率テーブル9は
、カナ2文字の連鎖確率を表わす。
例えば、第3図のカナ列連鎖確率テーブル9において、
「アーテ」、「アーイ」、「アーク」のカナ文字が連鎖
する確率は各々0.02,0.01゜0.01である。
「アーテ」、「アーイ」、「アーク」のカナ文字が連鎖
する確率は各々0.02,0.01゜0.01である。
前記8と9の値の掛算により、統計テーブル32を作成
するが、例えば、[アーイ」が連鎖する頻度は、(「ア
」が出現する頻度100)x (rアーイ」の連鎖確率
0.01)X(「イ」が出現する頻度50)=50のよ
うに求められる。
するが、例えば、[アーイ」が連鎖する頻度は、(「ア
」が出現する頻度100)x (rアーイ」の連鎖確率
0.01)X(「イ」が出現する頻度50)=50のよ
うに求められる。
第4図は統計テーブルを自立語と付属語あるいは単語と
単音節間の連鎖確率に基づいて作成した他の実現例を示
す図であり、音声入力と認識、変換処理を単語と単音節
との区切り毎に行う場合にこの種の統計テーブルを引用
することができる。
単音節間の連鎖確率に基づいて作成した他の実現例を示
す図であり、音声入力と認識、変換処理を単語と単音節
との区切り毎に行う場合にこの種の統計テーブルを引用
することができる。
なお、第3図に示した統計テーブルはカナ文字列間の連
鎖確率を表すものであるが、本発明は、これに限定され
るものではなく、第4図に示したような、文章中の全ゆ
る区切り単位間の接続連鎖確率を表わす統計テーブルに
適用可能である。
鎖確率を表すものであるが、本発明は、これに限定され
るものではなく、第4図に示したような、文章中の全ゆ
る区切り単位間の接続連鎖確率を表わす統計テーブルに
適用可能である。
効 果
以上の説明から明らかなように、本発明によるカナ列の
出現連鎖を考慮した統計テーブルは、日本語におけるカ
ナ文字の出現頻度テーブルと、カナ文字間の連鎖確率テ
ーブルを1つにまとめたものであり、前述したように、
カナ文字列間の接続評価を1つのテーブルのみを参照す
ることにより行えるので、処理の高速化とテーブルを格
納するためのメモリ量の削減に効果がある。
出現連鎖を考慮した統計テーブルは、日本語におけるカ
ナ文字の出現頻度テーブルと、カナ文字間の連鎖確率テ
ーブルを1つにまとめたものであり、前述したように、
カナ文字列間の接続評価を1つのテーブルのみを参照す
ることにより行えるので、処理の高速化とテーブルを格
納するためのメモリ量の削減に効果がある。
第1図は、本発明による音声ワードプロセッサ装置の一
実施例を説明するための電気的ブロック線図、第2図は
、第1図に示した音声認識部2及びカナ漢字変換部3の
詳細電気回路図、第3図は、第2図に示した統計テーブ
ル32の作成方法の一例を説明するための図、第4図は
、統計テーブルを連鎖確率に基づいて作成した他の実施
例を示す図である。 1・・・音声入力用マイクロフォン、2・・・音声認識
部、3・・・カナ漢字変換部、4・・・文書編集部、5
・・・制御部、6・・・プリンター、7・・・認識結果
表示部、21・・・前処理部、22・・・特微分析部、
23・・・認識処理部、24・・・標章パターン格納部
、25・・・認識結果候補保持部、31・・・カナ文字
列接続評価部、32・・・統計テーブル、33・・・カ
ナ文字列選択部、34・・・単語辞書格納部、35・・
・カナ漢字変換部。 36・・・漢字辞書格納部、37・・・カナ文字列ルー
ト評価部。 特許出願人 株式会社 リコー 第 l 図 ・第 2 図 第 41A 第3図
実施例を説明するための電気的ブロック線図、第2図は
、第1図に示した音声認識部2及びカナ漢字変換部3の
詳細電気回路図、第3図は、第2図に示した統計テーブ
ル32の作成方法の一例を説明するための図、第4図は
、統計テーブルを連鎖確率に基づいて作成した他の実施
例を示す図である。 1・・・音声入力用マイクロフォン、2・・・音声認識
部、3・・・カナ漢字変換部、4・・・文書編集部、5
・・・制御部、6・・・プリンター、7・・・認識結果
表示部、21・・・前処理部、22・・・特微分析部、
23・・・認識処理部、24・・・標章パターン格納部
、25・・・認識結果候補保持部、31・・・カナ文字
列接続評価部、32・・・統計テーブル、33・・・カ
ナ文字列選択部、34・・・単語辞書格納部、35・・
・カナ漢字変換部。 36・・・漢字辞書格納部、37・・・カナ文字列ルー
ト評価部。 特許出願人 株式会社 リコー 第 l 図 ・第 2 図 第 41A 第3図
Claims (3)
- (1)、未知入力音声を認識する音声認識部と、該音声
認識部から出力される認識結果の上位複数候補カナ文字
列とそれらの類似度を格納する格納手段と、上位カナ候
補列間の接続をチェックする統計テーブルと、カナ文字
列の接続可能性の高い候補文字列を選択保持する選択保
持手段と、選択保持したカナ文字列を漢字カナ混じり文
に変換するカナ漢字変換手段とを有する音声ワードプロ
セッサ装置において、日本語のカナ文字列間の接続可能
性をチェックする統計テーブルをカナ文字単独の出現頻
度とカナ文字列間の接続確率情報とから作成して1つに
まとめたことを特徴とする音声ワードプロセッサ装置。 - (2)、文章中の自立語と付属語間、付属語と付属語間
、自立語と自立語間の接続可能性を各々の出現頻度と両
者間の接続確率情報とから出現連鎖頻度テーブルを作成
して1つのテーブルにまとめたことを特徴とする特許請
求の範囲第(1)項に記載の音声ワードプロセッサ装置
。 - (3)、文章中の自立語または付属語と句読点との接続
可能性を自立語または付属語、句読点の出現頻度と、そ
れらの間の接続確率情報とから出現連鎖頻度テーブルを
作成し、1つのテーブルにまとめたことを特徴とする特
許請求の範囲第(1)項記載の音声ワードプロセッサ装
置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP61008461A JPS62165267A (ja) | 1986-01-17 | 1986-01-17 | 音声ワ−ドプロセツサ装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP61008461A JPS62165267A (ja) | 1986-01-17 | 1986-01-17 | 音声ワ−ドプロセツサ装置 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPS62165267A true JPS62165267A (ja) | 1987-07-21 |
Family
ID=11693768
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP61008461A Pending JPS62165267A (ja) | 1986-01-17 | 1986-01-17 | 音声ワ−ドプロセツサ装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS62165267A (ja) |
Cited By (7)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH03116360A (ja) * | 1989-09-29 | 1991-05-17 | Canon Inc | 文字処理装置及びその方法 |
| JPH03116359A (ja) * | 1989-09-29 | 1991-05-17 | Canon Inc | 文字処理装置及びその方法 |
| JPH03116361A (ja) * | 1989-09-29 | 1991-05-17 | Canon Inc | 文字処理装置 |
| JPH03129458A (ja) * | 1989-07-03 | 1991-06-03 | Ricoh Co Ltd | 自然言語処理方式 |
| JPH0535722A (ja) * | 1991-07-31 | 1993-02-12 | Sharp Corp | 学習単語決定方法 |
| JPH06266755A (ja) * | 1993-03-17 | 1994-09-22 | Nec Corp | 自然言語解析装置 |
| WO2003028010A1 (en) * | 2001-09-25 | 2003-04-03 | Motorola, Inc. | Text-to-speech native coding in a communication system |
-
1986
- 1986-01-17 JP JP61008461A patent/JPS62165267A/ja active Pending
Cited By (8)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH03129458A (ja) * | 1989-07-03 | 1991-06-03 | Ricoh Co Ltd | 自然言語処理方式 |
| JPH03116360A (ja) * | 1989-09-29 | 1991-05-17 | Canon Inc | 文字処理装置及びその方法 |
| JPH03116359A (ja) * | 1989-09-29 | 1991-05-17 | Canon Inc | 文字処理装置及びその方法 |
| JPH03116361A (ja) * | 1989-09-29 | 1991-05-17 | Canon Inc | 文字処理装置 |
| JPH0535722A (ja) * | 1991-07-31 | 1993-02-12 | Sharp Corp | 学習単語決定方法 |
| JPH06266755A (ja) * | 1993-03-17 | 1994-09-22 | Nec Corp | 自然言語解析装置 |
| WO2003028010A1 (en) * | 2001-09-25 | 2003-04-03 | Motorola, Inc. | Text-to-speech native coding in a communication system |
| US6681208B2 (en) | 2001-09-25 | 2004-01-20 | Motorola, Inc. | Text-to-speech native coding in a communication system |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JP3196868B2 (ja) | テキストをインデックス及び検索するための関連ワード形態の限定状態トランスジューサ | |
| JP2002117027A (ja) | 感情情報抽出方法および感情情報抽出プログラムの記録媒体 | |
| JPH08263478A (ja) | 中国語簡繁体字文書変換装置 | |
| JP2828692B2 (ja) | 情報検索装置 | |
| JP2681663B2 (ja) | 日本文訂正候補文字抽出方法 | |
| JP2821143B2 (ja) | 形態素分解装置 | |
| JP3353769B2 (ja) | 文字認識装置、文字認識方法、文字認識プログラム記録媒体 | |
| JPH02103662A (ja) | 文分割方式 | |
| JPS62224859A (ja) | 日本語処理方式 | |
| JPS61233862A (ja) | かな漢字変換装置 | |
| JPS61177575A (ja) | 日本語文章作成装置 | |
| JP3048793B2 (ja) | 文字変換装置 | |
| JPH01114976A (ja) | 文書処理装置の辞書構造 | |
| JP2729342B2 (ja) | 仮名漢字変換方法および装置 | |
| JPH01281561A (ja) | 日本文訂正候補文字抽出方法 | |
| JPS60207948A (ja) | カナ漢字変換処理装置 | |
| JP3084864B2 (ja) | 文章入力装置 | |
| JPH0262659A (ja) | 日本文訂正候補文字抽出装置 | |
| JPS60105037A (ja) | 音声入力文章作成方式 | |
| JPH01118961A (ja) | 翻訳装置 | |
| JPH04372047A (ja) | 仮名漢字変換装置 | |
| JPH0241560A (ja) | 未登録語処理方式 | |
| JPH03225462A (ja) | ローマ字漢字変換装置 | |
| JPS61177574A (ja) | 日本語文章作成装置 | |
| JPS6039238A (ja) | 音声入力文章作成方式 |