JPS60225197A - 音声認識装置 - Google Patents
音声認識装置Info
- Publication number
- JPS60225197A JPS60225197A JP59080524A JP8052484A JPS60225197A JP S60225197 A JPS60225197 A JP S60225197A JP 59080524 A JP59080524 A JP 59080524A JP 8052484 A JP8052484 A JP 8052484A JP S60225197 A JPS60225197 A JP S60225197A
- Authority
- JP
- Japan
- Prior art keywords
- pattern
- input
- specific number
- registered
- recognition device
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
- 230000005236 sound signal Effects 0.000 claims description 9
- 230000015654 memory Effects 0.000 description 19
- 238000000605 extraction Methods 0.000 description 6
- 238000003909 pattern recognition Methods 0.000 description 4
- 238000010586 diagram Methods 0.000 description 3
- 230000000694 effects Effects 0.000 description 3
- 238000001514 detection method Methods 0.000 description 2
- 239000003292 glue Substances 0.000 description 2
- 206010011224 Cough Diseases 0.000 description 1
- 239000003795 chemical substances by application Substances 0.000 description 1
- 239000000284 extract Substances 0.000 description 1
- 238000010606 normalization Methods 0.000 description 1
- 238000001228 spectrum Methods 0.000 description 1
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
(イ)産業上の利用分野
本発明は、音声信号を含む人力信号からその1′!l声
信号の始端と終端を検出して’a’ )110)人力・
://−ンを得る大カバクーン作成手段を備λ/、−f
″l均tig gD装置に関する。
信号の始端と終端を検出して’a’ )110)人力・
://−ンを得る大カバクーン作成手段を備λ/、−f
″l均tig gD装置に関する。
く口)従来技術
g声認識装殻は、第1図に示′4如く人力・〜J1・′
・音声信号から抽出したバシメ〜クサノプルク11かt
。
・音声信号から抽出したバシメ〜クサノプルク11かt
。
なる人カバターンを得る入カバターン11成丁段(1)
と、予め複数の音声についての登イノパターンを夫々貯
えた登録パターンメモリ(2)と、咳メ(。
と、予め複数の音声についての登イノパターンを夫々貯
えた登録パターンメモリ(2)と、咳メ(。
リ(2)からの各登録パターンと上記入カバターン作成
手段(1)からの入カバターンとを比較して最も誤差の
小さな登録パターンのバ声をこの時の人力バク−、・の
音声と認識してその認識結果Rを出力するパターン認識
回路(3)とからなるものT゛ある。
手段(1)からの入カバターンとを比較して最も誤差の
小さな登録パターンのバ声をこの時の人力バク−、・の
音声と認識してその認識結果Rを出力するパターン認識
回路(3)とからなるものT゛ある。
断様な音声に′!識装置は、その人カバターン作成手段
に於いて、音声の特徴をいかに正確に係荘しブー人カバ
ターンを作成できるかに依って、その認識率が左右され
るのである。
に於いて、音声の特徴をいかに正確に係荘しブー人カバ
ターンを作成できるかに依って、その認識率が左右され
るのである。
而して、K声信号は音声を通゛畠マイクロフォンにて入
力する事に依って得られるものであるのC,この入カバ
ターン作成手段に於いては、このマイクロッォンにて得
られる信すから11声信号の時間領域を検出リーる必要
があり、従来はマイクロッA′、から得られる信号の波
高値か一定の閾値を越えた領域を庁声イu号として抽出
していた。
力する事に依って得られるものであるのC,この入カバ
ターン作成手段に於いては、このマイクロッォンにて得
られる信すから11声信号の時間領域を検出リーる必要
があり、従来はマイクロッA′、から得られる信号の波
高値か一定の閾値を越えた領域を庁声イu号として抽出
していた。
しかしながら、第2図に示寸如く、マイクUiフォンか
らの信号には閾値vthを越えるa声信写■の他にも話
者の周辺の周囲H音、その他の電気的ね・H「信号Nが
含まれる事となるので、実際の111” 13号の時間
領域T(V)外に/J−、l; ル14値vth@越え
るRe信号Nにて音声(1号のa、4間領域の検出誤り
T(V+N)が発生する不都合があった。従ってこの場
合には、パターン作成回路は雑音信号から抽出したパラ
メータに基づいて人カバターンを作成し工しようので、
従来の音声認識装置はこれを認識する事となり、誤認識
を招く原因となっていた。
らの信号には閾値vthを越えるa声信写■の他にも話
者の周辺の周囲H音、その他の電気的ね・H「信号Nが
含まれる事となるので、実際の111” 13号の時間
領域T(V)外に/J−、l; ル14値vth@越え
るRe信号Nにて音声(1号のa、4間領域の検出誤り
T(V+N)が発生する不都合があった。従ってこの場
合には、パターン作成回路は雑音信号から抽出したパラ
メータに基づいて人カバターンを作成し工しようので、
従来の音声認識装置はこれを認識する事となり、誤認識
を招く原因となっていた。
(ハ)発明の目的
本発明は上述の点に鑑みてなされ、誤認識の解消金回っ
たhP認識装置を提供するものである。
たhP認識装置を提供するものである。
(ニ)発明の構成
本発明の音声認識装置は、音声イδ号を含む入力信号か
ら抽出したパラメータサンプル列の内の連続した特定数
サンプルを各登録くクーンの先頭部分の特定数サンプル
と比較して 定の閾値より小なる誤差が得られた時の入
力信号σ5特定数サンプ奮 ルを音声領域の始点部分と判定して入カバターンを作成
する入カバターン作成手段を備えたものである。
ら抽出したパラメータサンプル列の内の連続した特定数
サンプルを各登録くクーンの先頭部分の特定数サンプル
と比較して 定の閾値より小なる誤差が得られた時の入
力信号σ5特定数サンプ奮 ルを音声領域の始点部分と判定して入カバターンを作成
する入カバターン作成手段を備えたものである。
(ホ)実施例
第3図に本発明の音声認識装置にJflいられる人カバ
ターン作成手段を示しており、同図に於いて、(10)
は音声信号を含む入力信刀v + Nを周波数分析して
周波数スペクトルからなるパラメータサンプル列を抽出
するパラメータ抽出回路であり、そのナンブリング周波
数はlomseca度に設定されている。(11月ま該
パラメータ抽出回路(10)から得られるバラメー・タ
サンプルを1ザンノルづつジットし℃例えば5す〉・プ
ル分の人力部分パターンを貯える入力部分シフトレソス
タ。(12)は該5フトレンスタ(11)のソフト出力
を入力信号全体にわたる数100υンプル、即ち数秒分
貯える為の・シフトレンスタ構成のバッフ7メモリであ
る。 (13)は複数の各登録べ4′−7を構成する周
波数スベリトルからなるパラメータサンプルの先頭部分
の例えは連続した5ザンノル分だけの先頭パターンを夫
々格納した登録先頭パターンメモリ、(14)は逆にそ
の末尾部分例えは連続した5カ〉プル分たけの末尾パタ
ーンを夫々格納した登録末16パターン71:りである
。(15)はこれ等各メモリ(13)、(14)の読み
出し制御を行なう部分パターン読み出し制御部、(16
)は該読め出し制御部(15)から得られる先頭又は末
尾の各パターンと4=記人力部分シブトし〉′スタ(1
1)に格納された入力部分パターンとを比較演算する比
較回路であり、この比較誤差が一定の許宥範囲内にある
時は、この旨の検出18号を出力Vる。(17)は音声
時間領域決定回路であり、イニンヤル状態の音声の始点
検出上−1′では」−2部う)パターン読み出し制御部
を登録先頭パターンメモリ読み出し状態とし、上記比較
回路(15)から検出信号を受けた時の上記バッファメ
モリ(11)の始点シ〉ノルのサンプル番号を記憶する
と共に、F記部分パターン読み出し制御B11を登録末
尾バ//−ンメモリ読み出し状態に変更せしめる。そし
て該回路(17)は次にF記比較回路(15)〆1・ら
検出イ(1号を受けた時の」二記比較回路(16)の終
点ナンブルのシンプル番号を記憶するのである。(18
)は」−記バ/フγメモリ(12)に格納された入力信
号全体にわたる→ノ7.lルの出力制御をイiなうシー
ト回路であり、ト記行声時間領域決定回路(17)に記
憶された始点“リン、lル番号から終点ナンプル番号ま
でのベラメータナンノル列のみを出力す゛る。(19)
は該ケート回路(18)から得られる音声16号■の時
間領域に属するパラメータサンプル列を入カバターンP
、ヒして格納する入カバターンメモリである。
ターン作成手段を示しており、同図に於いて、(10)
は音声信号を含む入力信刀v + Nを周波数分析して
周波数スペクトルからなるパラメータサンプル列を抽出
するパラメータ抽出回路であり、そのナンブリング周波
数はlomseca度に設定されている。(11月ま該
パラメータ抽出回路(10)から得られるバラメー・タ
サンプルを1ザンノルづつジットし℃例えば5す〉・プ
ル分の人力部分パターンを貯える入力部分シフトレソス
タ。(12)は該5フトレンスタ(11)のソフト出力
を入力信号全体にわたる数100υンプル、即ち数秒分
貯える為の・シフトレンスタ構成のバッフ7メモリであ
る。 (13)は複数の各登録べ4′−7を構成する周
波数スベリトルからなるパラメータサンプルの先頭部分
の例えは連続した5ザンノル分だけの先頭パターンを夫
々格納した登録先頭パターンメモリ、(14)は逆にそ
の末尾部分例えは連続した5カ〉プル分たけの末尾パタ
ーンを夫々格納した登録末16パターン71:りである
。(15)はこれ等各メモリ(13)、(14)の読み
出し制御を行なう部分パターン読み出し制御部、(16
)は該読め出し制御部(15)から得られる先頭又は末
尾の各パターンと4=記人力部分シブトし〉′スタ(1
1)に格納された入力部分パターンとを比較演算する比
較回路であり、この比較誤差が一定の許宥範囲内にある
時は、この旨の検出18号を出力Vる。(17)は音声
時間領域決定回路であり、イニンヤル状態の音声の始点
検出上−1′では」−2部う)パターン読み出し制御部
を登録先頭パターンメモリ読み出し状態とし、上記比較
回路(15)から検出信号を受けた時の上記バッファメ
モリ(11)の始点シ〉ノルのサンプル番号を記憶する
と共に、F記部分パターン読み出し制御B11を登録末
尾バ//−ンメモリ読み出し状態に変更せしめる。そし
て該回路(17)は次にF記比較回路(15)〆1・ら
検出イ(1号を受けた時の」二記比較回路(16)の終
点ナンブルのシンプル番号を記憶するのである。(18
)は」−記バ/フγメモリ(12)に格納された入力信
号全体にわたる→ノ7.lルの出力制御をイiなうシー
ト回路であり、ト記行声時間領域決定回路(17)に記
憶された始点“リン、lル番号から終点ナンプル番号ま
でのベラメータナンノル列のみを出力す゛る。(19)
は該ケート回路(18)から得られる音声16号■の時
間領域に属するパラメータサンプル列を入カバターンP
、ヒして格納する入カバターンメモリである。
尚、この入カバターンメモリ(18)の入カバターンを
各登録パターンと同サンプル数に11−規化jイ・場合
には、L記両登録部分バクーンメモリ(13)、(14
)に格納する登録部分パターンは各登録パターンを正規
化する前の状態のパンメータサンプル列にて構成するの
が好ましい。−・ノJ、入力及び登釘バ々−ンの両方と
もサンプル数の正規化を心安としない音声認識装置の場
合には」二記両登録部分2ターンメモリ(13)、(1
4)を個別に設ける事な穴径縁パターンメモリに格納芒
れている各今録パ′ノーンの先頭あるいは末尾部分のパ
ラメータ抽出回路を読み出して用いればよい。
各登録パターンと同サンプル数に11−規化jイ・場合
には、L記両登録部分バクーンメモリ(13)、(14
)に格納する登録部分パターンは各登録パターンを正規
化する前の状態のパンメータサンプル列にて構成するの
が好ましい。−・ノJ、入力及び登釘バ々−ンの両方と
もサンプル数の正規化を心安としない音声認識装置の場
合には」二記両登録部分2ターンメモリ(13)、(1
4)を個別に設ける事な穴径縁パターンメモリに格納芒
れている各今録パ′ノーンの先頭あるいは末尾部分のパ
ラメータ抽出回路を読み出して用いればよい。
L述の如き本発明装置に用いる人カバターン作威手段に
於いてζツ、入力信号の抽出回路(10)から得られメ
モリ(11)にある時の特定数のパラメータサンプル列
が比較回路(16)に依って各登録先頭パターンメモリ
(13)の先頭パターンに基づいてパターン認識する事
に依って音声の時間領域の始点を知り、次に同しく比較
回路<16>に依って各登録末尾バター7メモリ(14
)の末尾パターンに基づい″(バ々−〉認識する事に依
って計−の時間領域の終点を知る事ができ、正確な音声
の時間領域に基づく入力音声バクーンが入カバターンメ
モリ(19)lこ貯えられる串となる。即ち、H音信号
は上記いずれのパターン認識に依−)ても訂容範囲内で
類似するはずほなく、音声信号だけがパターン認識に応
答できるのである。
於いてζツ、入力信号の抽出回路(10)から得られメ
モリ(11)にある時の特定数のパラメータサンプル列
が比較回路(16)に依って各登録先頭パターンメモリ
(13)の先頭パターンに基づいてパターン認識する事
に依って音声の時間領域の始点を知り、次に同しく比較
回路<16>に依って各登録末尾バター7メモリ(14
)の末尾パターンに基づい″(バ々−〉認識する事に依
って計−の時間領域の終点を知る事ができ、正確な音声
の時間領域に基づく入力音声バクーンが入カバターンメ
モリ(19)lこ貯えられる串となる。即ち、H音信号
は上記いずれのパターン認識に依−)ても訂容範囲内で
類似するはずほなく、音声信号だけがパターン認識に応
答できるのである。
くべ) 発明の効果
本発明の音声認識装置は以上の説明から明らかな如く、
音声信号を含む入力fハシjlン2ベシメ〜り→ノング
ル列を各登録音声パターンの先頭部分のり/プル列にエ
バターン認識して音声領域の先頭部を !検出し、これ
に依って音声パターンを作成するスカバター7作成回路
を備えたものであるので、雑g゛信号が除去された入カ
バターンを用いて、こJ′(を認kla処理する事がで
きる。従つ−(、雑音値うjの存在による大カバ〃−ン
の歪がないので誤認識を解消し℃高いJ!l識率を得る
事ができる。
音声信号を含む入力fハシjlン2ベシメ〜り→ノング
ル列を各登録音声パターンの先頭部分のり/プル列にエ
バターン認識して音声領域の先頭部を !検出し、これ
に依って音声パターンを作成するスカバター7作成回路
を備えたものであるので、雑g゛信号が除去された入カ
バターンを用いて、こJ′(を認kla処理する事がで
きる。従つ−(、雑音値うjの存在による大カバ〃−ン
の歪がないので誤認識を解消し℃高いJ!l識率を得る
事ができる。
第1図は音声認識装置の概略構成図、第2図(プ計、4
を波形図、第3図は本発明の音声認識装置に用いる人カ
バターン作成手段の構成図”Cある。 (10) パラメータ抽出回路、<11) 人力部分シ
フ1−レンスタ、〈12) ハ7ファメー℃す、(13
)登録先頭パターンメモリ、(14) 登5ノ末尾ぐ9
−ンメモリ、(17〉 音声時間ffi域決定回路。 (18〉 ゲート回路、(19)・入カバターンメモリ
。 出願人 三洋電機株式会社 代理人 jt理−■ 佐野静人 第2図
を波形図、第3図は本発明の音声認識装置に用いる人カ
バターン作成手段の構成図”Cある。 (10) パラメータ抽出回路、<11) 人力部分シ
フ1−レンスタ、〈12) ハ7ファメー℃す、(13
)登録先頭パターンメモリ、(14) 登5ノ末尾ぐ9
−ンメモリ、(17〉 音声時間ffi域決定回路。 (18〉 ゲート回路、(19)・入カバターンメモリ
。 出願人 三洋電機株式会社 代理人 jt理−■ 佐野静人 第2図
Claims (1)
- 【特許請求の範囲】 <1)音声信号から抽出したパンメータリンプル列から
なる入カバターンを予しめ貯えられた複数の音声につい
王の各登録パターンと比較し工、−の時の音声信写の音
声を認識する#声認議装置に於いて、音声信号を含む入
力信号から抽出したパラメータサンプル列の内の連続し
た特定数サンプルを上記各登録パターンを構成憚るパラ
メータサンプル列の先頭部う〕の連続した特定数刃ンブ
ルと比較して一定の閾値より小なる誤差が得られた時の
1:記入力信号の特定数サンプルを身重イ8号の先頭の
特定数リンプルと判定し、この特定数→;′ンノル以降
のパラメータサンプル列に基づいて音声信号の入カバタ
ーンを作成する入カバターンf′11&f段を備えた#
■を特徴とした音声認識装置。 (2)ヒ記入カバターン作成手段は、上記先頭の特定数
サンプル以降の人力信号の連続した特定数ナンブルを−
に記名登録パターンを構成するパラメータサンプル列の
末尾部分の連続した特定数ナンヅルと比較して一定の@
値より1JVIJる誤差が得られた時の入力信号の特定
数リンプルをi’f j’・(8号の末尾サンプルと判
定し、先頭の特定数り・プルからこの末尾サンプルに至
る入力(Jυの・;、・メータサンプル列に基ついて音
声信1j−の人カバターンを作成する事を特徴とする特
i?i’ 請求の範囲第1項記載の音声認識装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP59080524A JPS60225197A (ja) | 1984-04-20 | 1984-04-20 | 音声認識装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP59080524A JPS60225197A (ja) | 1984-04-20 | 1984-04-20 | 音声認識装置 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPS60225197A true JPS60225197A (ja) | 1985-11-09 |
Family
ID=13720702
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP59080524A Pending JPS60225197A (ja) | 1984-04-20 | 1984-04-20 | 音声認識装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS60225197A (ja) |
Citations (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS59121099A (ja) * | 1982-12-28 | 1984-07-12 | 株式会社東芝 | 音声区間検出装置 |
-
1984
- 1984-04-20 JP JP59080524A patent/JPS60225197A/ja active Pending
Patent Citations (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS59121099A (ja) * | 1982-12-28 | 1984-07-12 | 株式会社東芝 | 音声区間検出装置 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| CN107274916B (zh) | 基于声纹信息对音频/视频文件进行操作的方法及装置 | |
| JPS5862699A (ja) | 音声認識装置 | |
| CN109410664B (zh) | 一种发音纠正方法及电子设备 | |
| JPS5854400B2 (ja) | 音声認識装置 | |
| KR100330905B1 (ko) | 음향 또는 음성의 패턴 인식을 이용한 완구의 동작 제어 방법 | |
| CN109271480B (zh) | 一种语音搜题方法及电子设备 | |
| CN107945807B (zh) | 基于静音游程的语音识别方法及其系统 | |
| JP2000122678A (ja) | 音声認識機器制御装置 | |
| CN114024789A (zh) | 一种基于工作模式的语音播放方法和一种智能家居设备 | |
| JP2844592B2 (ja) | 離散単語音声認識装置 | |
| JP2882792B2 (ja) | 標準パターン作成方式 | |
| CN115148208B (zh) | 音频数据处理方法、装置、芯片及电子设备 | |
| JPH04324499A (ja) | 音声認識装置 | |
| KR100677224B1 (ko) | 안티워드 모델을 이용한 음성인식 방법 | |
| JP2882791B2 (ja) | パターン比較方式 | |
| JPS63278100A (ja) | 音声認識装置 | |
| JPS6194095A (ja) | 音声認識装置 | |
| JP2864511B2 (ja) | 話者識別方式と装置 | |
| KR940005044B1 (ko) | 음성 인식장치 및 그의 음성 등록방법 | |
| KR100206799B1 (ko) | 화자 인식형 캠코더 | |
| JPS61260299A (ja) | 音声認識装置 | |
| JPH01161299A (ja) | 音声認識システム | |
| JPS6250837B2 (ja) | ||
| JPH0640274B2 (ja) | 音声認識装置 | |
| JPH0316038B2 (ja) |