JPS63229496A - 音声認識用パタ−ン更新方式 - Google Patents
音声認識用パタ−ン更新方式Info
- Publication number
- JPS63229496A JPS63229496A JP62063405A JP6340587A JPS63229496A JP S63229496 A JPS63229496 A JP S63229496A JP 62063405 A JP62063405 A JP 62063405A JP 6340587 A JP6340587 A JP 6340587A JP S63229496 A JPS63229496 A JP S63229496A
- Authority
- JP
- Japan
- Prior art keywords
- pattern
- word
- words
- speech recognition
- recognition
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
止1
本発明は、音声認識用パターン更新方式、より詳細には
、不特定話者の単語音声を認識する音声認識装置におけ
る標準パターンの更新方式に関する。
、不特定話者の単語音声を認識する音声認識装置におけ
る標準パターンの更新方式に関する。
0」
従来、不特定話者を対象とした単語音声認識装置におい
て、認識率の向上を図るための話者適応化の手法の一つ
として1発声者のパターンを用いて予め(2録されてい
る標準パターンの更新を行なう方式があるが、更新後の
パターンが不良であったりすると、かえって認識率の低
下を招く場合や。
て、認識率の向上を図るための話者適応化の手法の一つ
として1発声者のパターンを用いて予め(2録されてい
る標準パターンの更新を行なう方式があるが、更新後の
パターンが不良であったりすると、かえって認識率の低
下を招く場合や。
誤認識が発生する度にパターンを更新することは煩雑で
あり、使い易い認識装置をユーザーに提供する観点から
は問題点が多い。
あり、使い易い認識装置をユーザーに提供する観点から
は問題点が多い。
目 了り
本発明は、上述のごとき実情に鑑みてなされたもので、
音声認識装置、特に、不特定話者の発声する単語音声認
識装置において、予め登録格納されている認識対象語の
標準パターンに対し、認識装置を使用する話者の発声パ
ターンを用いて、予め格納されている不特定話者用の標
準パターンを改変することなく追加、更新等の操作を施
すことにより認識装置の性能を使用者に適応させて認識
率を向上させることを目的としてなされたものである。
音声認識装置、特に、不特定話者の発声する単語音声認
識装置において、予め登録格納されている認識対象語の
標準パターンに対し、認識装置を使用する話者の発声パ
ターンを用いて、予め格納されている不特定話者用の標
準パターンを改変することなく追加、更新等の操作を施
すことにより認識装置の性能を使用者に適応させて認識
率を向上させることを目的としてなされたものである。
構成
本発明は、上記目的を達成するために、不特定話者の単
語音声を認識する音声L!!識装置において。
語音声を認識する音声L!!識装置において。
予め登録されている不特定話者用の単語標準パターンに
対し、ある話者が発声した単語が一定回数以上誤認識を
起こした場合には、誤認識単語に対応する登録されてい
る標準パターンを改変することなく認識対象からはずし
、新たに話者の発声パターンを登録追加すること、或い
は、認識対象となる単語セット中の類似単語を予めリス
トアップしておき、話者が認識モードに入る前に、類似
昨語を全て発声して不特定話者用の標準パターンに追加
登録しておくことを特徴としたものである。
対し、ある話者が発声した単語が一定回数以上誤認識を
起こした場合には、誤認識単語に対応する登録されてい
る標準パターンを改変することなく認識対象からはずし
、新たに話者の発声パターンを登録追加すること、或い
は、認識対象となる単語セット中の類似単語を予めリス
トアップしておき、話者が認識モードに入る前に、類似
昨語を全て発声して不特定話者用の標準パターンに追加
登録しておくことを特徴としたものである。
以下、本発明の実施例に基づいて説明する。
第1図は、本発明の一実施例を説明するためのブロック
線図で、図中、1は音声入力部、2は特徴抽出部、3は
登@/認識モード切り換え部、4は標準パターン格納部
、5は単語音声認識部、6は認識結果出力部で、音声入
力部1より入力された単語音声は、特徴抽出部2でバン
ドパスフィルタ群による分析やLPG分析を経て、特徴
パラメータの時系列に変換される。モード切り換え部3
ではスイッチSWが登録モード31にあるときは、単語
標準パターンの登録を行ない、標準パターン登録部4に
格納する。また、スイッチSWが認識モード32にある
ときには、標準パターン格納部4より標準パターンを引
用し、単語認識部5にて未知入力音声とのパターンマツ
チングを行ない、最も類似したパターンから1つ選択し
1M!!P識結果出力部6にて出力する。
線図で、図中、1は音声入力部、2は特徴抽出部、3は
登@/認識モード切り換え部、4は標準パターン格納部
、5は単語音声認識部、6は認識結果出力部で、音声入
力部1より入力された単語音声は、特徴抽出部2でバン
ドパスフィルタ群による分析やLPG分析を経て、特徴
パラメータの時系列に変換される。モード切り換え部3
ではスイッチSWが登録モード31にあるときは、単語
標準パターンの登録を行ない、標準パターン登録部4に
格納する。また、スイッチSWが認識モード32にある
ときには、標準パターン格納部4より標準パターンを引
用し、単語認識部5にて未知入力音声とのパターンマツ
チングを行ない、最も類似したパターンから1つ選択し
1M!!P識結果出力部6にて出力する。
第2図は、本発明における標準パターンの更新方法を説
明するためのブロック図で、図中、7は誤認識カウント
部、8は更新モード切り換え判定部、41は更新パター
ン格納部、Cは更新モード切り換え制御(1号で、その
他、第1図に示した実施例と同様の作用をする部分には
第1図の場合と同一の参照番号が付しである。第2図に
おいて。
明するためのブロック図で、図中、7は誤認識カウント
部、8は更新モード切り換え判定部、41は更新パター
ン格納部、Cは更新モード切り換え制御(1号で、その
他、第1図に示した実施例と同様の作用をする部分には
第1図の場合と同一の参照番号が付しである。第2図に
おいて。
モード切り換え部3のスイッチSWが認識モード32に
ある時は、音声入力部1より入力された未知人力音声は
、特微分析部2を経て、単語認識部5で認識が行なわれ
るが、その際、誤認識が生じた場合に、発声パターンが
不良の場合と不特定話者用の標準パターン4が不良の場
合の2通りが考えられる。しかし、同一単語を複数回発
声しても依然として誤認識を生ずる場合には発声パター
ンの不良と考えるよりも、標準パターン自体が話者の発
声パターンと大きく異なっていると考える方が妥当であ
る。このような観点から、ある一定回数以上、同−単語
が誤った場合には、モード切り換え部3への制御信号C
を送信し、スイッチSWを更新モード31に切り換えて
パターンの更新を行なう、その際、従来在る不特定話者
用の標準パターンを消去するのではなく、新たに話者の
パターンを追加登録する。そして、再びスイッチSWを
認識モード32に切り換えた時には、更新パターン41
を優先的にアクセスし、更新パターンに対応する不特定
話者用標準パターンをアクセスしない措置をとる。これ
により、不特定用のパターンを改変することなく話者に
適用した標準パターンの更新を行なうことが可能となる
。
ある時は、音声入力部1より入力された未知人力音声は
、特微分析部2を経て、単語認識部5で認識が行なわれ
るが、その際、誤認識が生じた場合に、発声パターンが
不良の場合と不特定話者用の標準パターン4が不良の場
合の2通りが考えられる。しかし、同一単語を複数回発
声しても依然として誤認識を生ずる場合には発声パター
ンの不良と考えるよりも、標準パターン自体が話者の発
声パターンと大きく異なっていると考える方が妥当であ
る。このような観点から、ある一定回数以上、同−単語
が誤った場合には、モード切り換え部3への制御信号C
を送信し、スイッチSWを更新モード31に切り換えて
パターンの更新を行なう、その際、従来在る不特定話者
用の標準パターンを消去するのではなく、新たに話者の
パターンを追加登録する。そして、再びスイッチSWを
認識モード32に切り換えた時には、更新パターン41
を優先的にアクセスし、更新パターンに対応する不特定
話者用標準パターンをアクセスしない措置をとる。これ
により、不特定用のパターンを改変することなく話者に
適用した標準パターンの更新を行なうことが可能となる
。
第3図は、認識に先立ち、認識対象となる単語セット中
の類似単語を予めリストアップしておき、話者がそれら
の類似単語−欄表の音声を発声して不特定話者用の標準
パターンに追加登録する方式を説明するための図であり
、図中、9は標準パターン格納部4の認識対象単語−欄
から導かれる類似m語一様表であり、これはディスプレ
イ10を通して話者に表示できるようになっている。認
識モードに入る前に、話者はディスプレイ1,0に示さ
れる類似単語を発声し、標準パターン追加べ)緑部41
に登録し、スイッチSWを認識モード32に切り換えた
後、認識を行なう。その際、追加登録部41の追加パタ
ーンを優先してアクセスすることは第2図に示した実施
例の場合と同様である。
の類似単語を予めリストアップしておき、話者がそれら
の類似単語−欄表の音声を発声して不特定話者用の標準
パターンに追加登録する方式を説明するための図であり
、図中、9は標準パターン格納部4の認識対象単語−欄
から導かれる類似m語一様表であり、これはディスプレ
イ10を通して話者に表示できるようになっている。認
識モードに入る前に、話者はディスプレイ1,0に示さ
れる類似単語を発声し、標準パターン追加べ)緑部41
に登録し、スイッチSWを認識モード32に切り換えた
後、認識を行なう。その際、追加登録部41の追加パタ
ーンを優先してアクセスすることは第2図に示した実施
例の場合と同様である。
第4図は、第3図の類似単語−欄表9の類似単語同士を
作成する場合の実施例を説明するための図であり1図中
、データ(DEETA)とデルタ(DERUTA) 、
訂正(TEESEE)と形成(KEESEIE)、こく
(KOKU)と6(110にU)は音韻の異なり数に基
づき、各々単語間距離を2.0.1.0.1.0と定義
する。このように、認識対象語中の単語間距離が一定値
(例えば2.0)以下となる単語の組をリストアップす
る方法が考えられる。
作成する場合の実施例を説明するための図であり1図中
、データ(DEETA)とデルタ(DERUTA) 、
訂正(TEESEE)と形成(KEESEIE)、こく
(KOKU)と6(110にU)は音韻の異なり数に基
づき、各々単語間距離を2.0.1.0.1.0と定義
する。このように、認識対象語中の単語間距離が一定値
(例えば2.0)以下となる単語の組をリストアップす
る方法が考えられる。
第5図は、第3図の類似単語−欄表9の類似単語−欄を
作成する他の実施例を説明するための図つまり単語間の
コンフユージヨンマトリックスの一例を示す図であり、
図中、認識対象単語の番号を1,2.・・・、 N (
Nは単語数)とし、n番目とm番目の単語間のコンフユ
ージヨンの値をp<ntm)とする。全く、単語間にコ
ンフユージヨンが無い場合には単位行列(対角成分が全
て1で他の成分が全てO)となるが、一般的には類似単
語同士のペアではO<p(n、m)<1の値をとる。し
たがって、p(n、m)の値がある閾値Th以上となる
(p(n、m)≧Th)単語のペア(π、冨)(E (
(n 、m)l p (n 、m)≧Th)を全て選択
する方法も考えられる。
作成する他の実施例を説明するための図つまり単語間の
コンフユージヨンマトリックスの一例を示す図であり、
図中、認識対象単語の番号を1,2.・・・、 N (
Nは単語数)とし、n番目とm番目の単語間のコンフユ
ージヨンの値をp<ntm)とする。全く、単語間にコ
ンフユージヨンが無い場合には単位行列(対角成分が全
て1で他の成分が全てO)となるが、一般的には類似単
語同士のペアではO<p(n、m)<1の値をとる。し
たがって、p(n、m)の値がある閾値Th以上となる
(p(n、m)≧Th)単語のペア(π、冨)(E (
(n 、m)l p (n 、m)≧Th)を全て選択
する方法も考えられる。
このように、簡単な手続きで標準パターンを改変するこ
となく、話者の音声を追加登録することができるので、
話者に適応した標準パターンを作成することができ、従
って、認識率を大幅に向上させることができる。また、
従来、標準パターンの更新時に存在したような特定の話
者のみにパターンが適応してしまう弊害を生ずることな
く、他の話者に対しても同様の手続きをふむことにより
、パターンを適応させ認識率を向上させることができる
。
となく、話者の音声を追加登録することができるので、
話者に適応した標準パターンを作成することができ、従
って、認識率を大幅に向上させることができる。また、
従来、標準パターンの更新時に存在したような特定の話
者のみにパターンが適応してしまう弊害を生ずることな
く、他の話者に対しても同様の手続きをふむことにより
、パターンを適応させ認識率を向上させることができる
。
効−1
以上の説明から明らかなように、本発明によると、不特
定話者用の単語音声認識装置を使用する際に、話者の発
声パターンを用いて標準パターンを消去することなく、
パターンを追加更新し・、また類似単語を認識対象語中
から予めリストアップして話者の音声を追加登録してお
くことにより、元の不特定話者用の標準パターンを改変
することなく話者の発声パターンに適用させることがで
きる。換言すれば、特定の話者の使用に対しても予め登
録されている不特定話者の標準パターンに改変する必要
が無いため、標準パターンが特定ユーザーだけに適用し
て他のユーザーには不適応となる弊害を生ずることなく
、全ゆるユーザーに対して適用可能な標準パターンを提
供して認識を向上させることができる。
定話者用の単語音声認識装置を使用する際に、話者の発
声パターンを用いて標準パターンを消去することなく、
パターンを追加更新し・、また類似単語を認識対象語中
から予めリストアップして話者の音声を追加登録してお
くことにより、元の不特定話者用の標準パターンを改変
することなく話者の発声パターンに適用させることがで
きる。換言すれば、特定の話者の使用に対しても予め登
録されている不特定話者の標準パターンに改変する必要
が無いため、標準パターンが特定ユーザーだけに適用し
て他のユーザーには不適応となる弊害を生ずることなく
、全ゆるユーザーに対して適用可能な標準パターンを提
供して認識を向上させることができる。
第1図乃至第3図は、それぞれ本発明によるパターン更
新方式の実施例を説明するためのブロック線図、第4図
及び第5図は、それぞれ類似単語の一欄表を作成する作
成方法を説明するための図である。 1・・・音声入力部、2・・・特徴抽出部、3・・・登
録/認識モード切り換え部、4・・・標準パターン格納
部。 5・・・単語音声認識部、6・・・認識結果出力部、7
・・・誤認識カウント部、8・・・更新モード切り換え
判定部、9・・・類似単語−欄表、10・・ディスプレ
ー。 ゛、2−
新方式の実施例を説明するためのブロック線図、第4図
及び第5図は、それぞれ類似単語の一欄表を作成する作
成方法を説明するための図である。 1・・・音声入力部、2・・・特徴抽出部、3・・・登
録/認識モード切り換え部、4・・・標準パターン格納
部。 5・・・単語音声認識部、6・・・認識結果出力部、7
・・・誤認識カウント部、8・・・更新モード切り換え
判定部、9・・・類似単語−欄表、10・・ディスプレ
ー。 ゛、2−
Claims (4)
- (1)不特定話者の単語音声を認識する音声認識装置に
おいて、予め登録されている不特定話者用の単語標準パ
ターンに対し、ある話者が発声した単語が一定回数以上
誤認識を起こした場合には、誤認識単語に対応する登録
されている標準パターンを改変することなく認識対象か
らはずし、新たに話者の発声パターンを登録追加するこ
とを特徴とする音声認識用パターン更新方式。 - (2)、認識対象となる単語セット中の類似単語を予め
リストアップしておき、話者が認識モードに入る前に、
類似単語を全て発声して不特定話者用の標準パターンに
追加登録しておくことを特徴とする音声認識用パターン
更新方式。 - (3)、認識対象となる単語セット中の類似単語のリス
トアップ方法として、単語中のカナ系列間の距離または
音素系列間の距離が一定の閾値以下となるものを選択す
ることを特徴とする特許請求の範囲第(2)項に記載の
音声認識用パターン更新方式。 - (4)、認識対象となる単語セット中の類似単語のリス
トアップ方法として、認識装置を過去に使用した誤認識
結果から求めた単語間のコンフュージョン・マトリック
スに基づいて、マトリックスの要素の値がある閾値以上
となる単語ペアを選択することを特徴とする特許請求の
範囲第(2)項に記載の音声認識用パターン更新方式。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP62063405A JPS63229496A (ja) | 1987-03-18 | 1987-03-18 | 音声認識用パタ−ン更新方式 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP62063405A JPS63229496A (ja) | 1987-03-18 | 1987-03-18 | 音声認識用パタ−ン更新方式 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPS63229496A true JPS63229496A (ja) | 1988-09-26 |
Family
ID=13228360
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP62063405A Pending JPS63229496A (ja) | 1987-03-18 | 1987-03-18 | 音声認識用パタ−ン更新方式 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS63229496A (ja) |
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2007105409A1 (ja) * | 2006-02-27 | 2007-09-20 | Nec Corporation | 標準パタン適応装置、標準パタン適応方法および標準パタン適応プログラム |
-
1987
- 1987-03-18 JP JP62063405A patent/JPS63229496A/ja active Pending
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2007105409A1 (ja) * | 2006-02-27 | 2007-09-20 | Nec Corporation | 標準パタン適応装置、標準パタン適応方法および標準パタン適応プログラム |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US6925154B2 (en) | Methods and apparatus for conversational name dialing systems | |
| JP2000122691A (ja) | 綴り字読み式音声発話の自動認識方法 | |
| US20020091522A1 (en) | System and method for hybrid voice recognition | |
| JPH10133684A (ja) | 音声認識中に代替ワードを選択する方法及びシステム | |
| JPH10133685A (ja) | 連続音声認識中にフレーズを編集する方法及びシステム | |
| JPH0225517B2 (ja) | ||
| JPH10187184A (ja) | 認識された音声を修正するときに認識されたワードを選択する方法及びシステム | |
| JPH1168920A (ja) | 音声電話番号設定装置 | |
| JPS645320B2 (ja) | ||
| WO2021082084A1 (zh) | 音频信号处理方法及装置 | |
| JP2002196789A (ja) | 音声対話装置 | |
| JPS6281699A (ja) | 音声ワ−プロ装置における辞書作成及び更新方法 | |
| JPH01152851A (ja) | 音声ダイアリング装置 | |
| JPH02208700A (ja) | 音声認識装置 | |
| JP3192324B2 (ja) | 特定話者用単語音声認識装置 | |
| JPS6126678B2 (ja) | ||
| JP2004117771A (ja) | 音声認識用辞書作成方法、音声認識方法、音声認識用辞書作成装置、音声認識装置、音声認識プログラム及び音声認識システム | |
| KR19990081664A (ko) | 음성 인식 전화기의 음성 인식 방법 | |
| JPS6073592A (ja) | 特定話者用音声認識装置 | |
| JPH05265482A (ja) | 情報処理装置 | |
| JPS60212799A (ja) | 音声認識装置 | |
| JPH01154198A (ja) | 単音節音声登録方式 | |
| TW449734B (en) | Keyword spotting method for mandarin speech without using filler models | |
| HK40019544B (zh) | 一种音频信号处理方法及装置 | |
| JPH09198078A (ja) | 音声認識装置 |