JPH0412478B2 - - Google Patents
Info
- Publication number
- JPH0412478B2 JPH0412478B2 JP57133431A JP13343182A JPH0412478B2 JP H0412478 B2 JPH0412478 B2 JP H0412478B2 JP 57133431 A JP57133431 A JP 57133431A JP 13343182 A JP13343182 A JP 13343182A JP H0412478 B2 JPH0412478 B2 JP H0412478B2
- Authority
- JP
- Japan
- Prior art keywords
- feature pattern
- distance
- speech
- feature
- monosyllabic
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Expired
Links
- 238000001514 detection method Methods 0.000 claims description 8
- 238000012935 Averaging Methods 0.000 claims description 2
- 238000005070 sampling Methods 0.000 description 4
- 238000010586 diagram Methods 0.000 description 3
- 230000003595 spectral effect Effects 0.000 description 3
- 238000000034 method Methods 0.000 description 1
- 238000001228 spectrum Methods 0.000 description 1
- 230000002123 temporal effect Effects 0.000 description 1
Description
【発明の詳細な説明】
本発明は音声の認識を行なう単音節音声認識装
置に関するものである。
置に関するものである。
従来より考案されている単音節音声認識装置
は、入力音声を子音部分と母音部分に区分し、各
部分の時間的な中央部の平均的特徴パターンを用
いて入力音声を認識するように構成されている。
しかし、子音部分のパターンは時間的に非定常な
場合が多いことは一般的によく知られており、子
音部分の識別に前述した平均的特徴パターンを用
いると、子音の非定常な特徴が不明瞭になる。そ
こで、特に子音部分の識別には、子音区間内の複
数フレームを特徴パターンを用いることが望まし
い。なお、フレームとは特徴パターンを発生する
ために、入力音声データを一定時間毎にサンプリ
ングする際の各サプリング時点のことをいう。
は、入力音声を子音部分と母音部分に区分し、各
部分の時間的な中央部の平均的特徴パターンを用
いて入力音声を認識するように構成されている。
しかし、子音部分のパターンは時間的に非定常な
場合が多いことは一般的によく知られており、子
音部分の識別に前述した平均的特徴パターンを用
いると、子音の非定常な特徴が不明瞭になる。そ
こで、特に子音部分の識別には、子音区間内の複
数フレームを特徴パターンを用いることが望まし
い。なお、フレームとは特徴パターンを発生する
ために、入力音声データを一定時間毎にサンプリ
ングする際の各サプリング時点のことをいう。
一方、音声区間内の全フレームのもつ特徴パタ
ーンを用いて入力音声の認識を行う装置も、従来
から単音節音声認識装置として考案されている。
このような装置は、前記の装置の欠点を補うこと
はできるが、母音部分に関しては比較的長時間
(例えば、百数+msec程度)に渡つて特徴パター
ンが安定しており、前記音声区間の全フレームの
特徴パターンを用いて入力音声の認識を行うこと
は、必要以上の時間を費す結果となり、認識に要
する時間を短縮するためにも、前述の如く平均的
特徴パターンを用いて認識を行うことが望まし
い。
ーンを用いて入力音声の認識を行う装置も、従来
から単音節音声認識装置として考案されている。
このような装置は、前記の装置の欠点を補うこと
はできるが、母音部分に関しては比較的長時間
(例えば、百数+msec程度)に渡つて特徴パター
ンが安定しており、前記音声区間の全フレームの
特徴パターンを用いて入力音声の認識を行うこと
は、必要以上の時間を費す結果となり、認識に要
する時間を短縮するためにも、前述の如く平均的
特徴パターンを用いて認識を行うことが望まし
い。
本発明は上記欠点に鑑み、単音節音声に対して
先ず母音部分と確信できる部分、即ち音声区間の
語尾の数フレーム手前の数フレームに関して特徴
パターンを平均して平均的特徴パターンを求め、
次に語頭から順次特徴パターンを求めて前記平均
的特徴パターンとの距離を計算し、前記距離が前
記閾値よりも小さくなるフレームが数フレーム続
いた時点、或いは前記距離が前記閾値よりも小さ
くなるフレームが連続して数フレーム続いた時点
で、特徴パターンを求める分析を終了し、既に求
められた特徴パターンを用いて入力音声の認識を
行うことにより、認識に要する時間を短縮し、ハ
ードウエアに要求される処理の高速化を軽減する
ことのできる単音節音声認識装置を提供するもの
である。
先ず母音部分と確信できる部分、即ち音声区間の
語尾の数フレーム手前の数フレームに関して特徴
パターンを平均して平均的特徴パターンを求め、
次に語頭から順次特徴パターンを求めて前記平均
的特徴パターンとの距離を計算し、前記距離が前
記閾値よりも小さくなるフレームが数フレーム続
いた時点、或いは前記距離が前記閾値よりも小さ
くなるフレームが連続して数フレーム続いた時点
で、特徴パターンを求める分析を終了し、既に求
められた特徴パターンを用いて入力音声の認識を
行うことにより、認識に要する時間を短縮し、ハ
ードウエアに要求される処理の高速化を軽減する
ことのできる単音節音声認識装置を提供するもの
である。
以下、本発明の一実施例について図面を参照し
ながら説明する。
ながら説明する。
第1図は本発明の一実施例における単音節音声
認識装置のブロツク図である。
認識装置のブロツク図である。
第1図において、1は音声区間検出部で、単音
節音声入力aの語頭と語尾に対応した時点を検出
して、語頭及び語尾検出信号を出力する。2は音
声保持部で、音声区間検出部1から送出された語
頭検出信号を得た時点から語尾検出信号を得る時
点までの間の単音節音声入力aのデータを保持す
る。3は平均的特徴パターン発生部で、音声保持
部2で保持されている音声データのうち、語尾の
検出時点よりも数フレーム(数サンプリング時
点)手前、例えば10フレーム手前の時点より、
数フレーム分(数サンプリング時点分)例えば5
フレーム分の音声データに対して、一定時間毎に
サンプリングして特徴パターンを求め、それらを
平均して平均的特徴パターンを発生して出力す
る。4は特徴パターン発生部で、音声保持部2で
保持されている音声データを、語頭から順次一定
時間毎にサンプリングして特徴パターンを発生し
て出力する。5は特徴パターン保持部で、特徴パ
ターン発生部4の出力である特徴パターンを保持
する。6は特徴パターン間距離計算部で、平均的
特徴パターン発生部3から送出された平均的特徴
パターンと、特徴パターン発生部4から送出され
た特徴パターンとの距離を計算し、求められた距
離を出力する。7は閾値判定部で、特徴パターン
間距離計算部6の出力である距離と予め定めた閾
値とを比較して大小判定を行い、距離が閾値より
も小さい時、計数増加信号を出力する。8は計数
部で、閾値判定部の出力である計数増加信号を得
る毎に計数値を1増加させ、計数値が予め定めた
値になつた時点で、特徴パターン発生部4に特徴
パターンの発生を終了させる特徴パターン発生終
了信号を出力すると同時に、特徴パターン保持部
5に保持している特徴パターンを出力させる特徴
パターン出力命令信号を出力する。9は音声識別
部で、特徴パターン保持部5の出力を用いて入力
音声の識別を行い、単音節音声認識結果bを出力
する。
節音声入力aの語頭と語尾に対応した時点を検出
して、語頭及び語尾検出信号を出力する。2は音
声保持部で、音声区間検出部1から送出された語
頭検出信号を得た時点から語尾検出信号を得る時
点までの間の単音節音声入力aのデータを保持す
る。3は平均的特徴パターン発生部で、音声保持
部2で保持されている音声データのうち、語尾の
検出時点よりも数フレーム(数サンプリング時
点)手前、例えば10フレーム手前の時点より、
数フレーム分(数サンプリング時点分)例えば5
フレーム分の音声データに対して、一定時間毎に
サンプリングして特徴パターンを求め、それらを
平均して平均的特徴パターンを発生して出力す
る。4は特徴パターン発生部で、音声保持部2で
保持されている音声データを、語頭から順次一定
時間毎にサンプリングして特徴パターンを発生し
て出力する。5は特徴パターン保持部で、特徴パ
ターン発生部4の出力である特徴パターンを保持
する。6は特徴パターン間距離計算部で、平均的
特徴パターン発生部3から送出された平均的特徴
パターンと、特徴パターン発生部4から送出され
た特徴パターンとの距離を計算し、求められた距
離を出力する。7は閾値判定部で、特徴パターン
間距離計算部6の出力である距離と予め定めた閾
値とを比較して大小判定を行い、距離が閾値より
も小さい時、計数増加信号を出力する。8は計数
部で、閾値判定部の出力である計数増加信号を得
る毎に計数値を1増加させ、計数値が予め定めた
値になつた時点で、特徴パターン発生部4に特徴
パターンの発生を終了させる特徴パターン発生終
了信号を出力すると同時に、特徴パターン保持部
5に保持している特徴パターンを出力させる特徴
パターン出力命令信号を出力する。9は音声識別
部で、特徴パターン保持部5の出力を用いて入力
音声の識別を行い、単音節音声認識結果bを出力
する。
以下、上記のように構成された装置の動作を具
体的に説明する。
体的に説明する。
まず遮断周波数5KHzで低域濾波された入力音
声を標本化周波数10kHzでA/D変換し、離散的
信号について音声区間検出部1により、例えばエ
ネルギーレベルを用いて語頭を検出し、音声保持
部2で語頭に応答した時点から離散信号の保持を
開始し、音声区間検出部1により語尾を検出した
時点で離散的信号の保持を終了する。次に平均的
特徴パターン発生部3では、例えば時間幅12.8m
secのハミング窓を6.4msecずつずらしながら
(この時、フレーム周期は6.4msecとなる)音声
保持部2で保持されている離散的信号に付加する
とともに、語尾から70.4msec(語尾フレームから
10フレーム)手前の時点から、語尾から32msec
手前の時点までの、5フレーム分の離散的信号に
関して14次のPARCOR係数を求めて、それらを
平均して平均的特徴パターンを発生し、特徴パタ
ーン間距離計算部6に出力する。一方特徴パター
ン発生部4では、平均的特徴パターン発生部3と
同様に、例えば時間幅12.8msecの前記ハミング
窓を6.4msecずつずらしながら、音声保持部2で
保持されている離散的信号に付加して、語頭から
順次前記PARCOR係数をフレーム周期6.4msec
で発生し、特徴パターン保持部5と特徴パターン
間距離計算部6に出力する。そして特徴パターン
保持部5では、6.4msec毎に特徴パターン発生部
4で発生される特徴パターンを保持する。一方特
徴パターン間距離計算部6では、平均的特徴パタ
ーンとしてのPAPCOR係数と6.4msec毎に得ら
れる特徴パターンとしてのPARCOR係数との、
例えばユークリツド距離を計算し、計算結果を閾
値判定部7に出力する。次に閾値判定部7では、
例えば閾値を0.2として、閾値よりもユークリツ
ド距離値が小さくなつた時、計数部8の計数を1
増加させる計数増加信号を出力する。計数増加信
号が印加されると計数部8では、例えば計数値が
5になつた時、特徴パターン発生部4に特徴パタ
ーン発生を終了させる特徴パターン発生終了信号
を出力すると同時に、特徴パターン保持部5で保
持している特徴パターンを音声識別部9に出力さ
せる特徴パターン出力命令信号を特徴パターン保
持部5に出力する。音声識別部9では、この様に
して得られた前記特徴パターンを用いて単音節音
声入力aの識別を行い、単音節音声認識結果bを
出力することができる。
声を標本化周波数10kHzでA/D変換し、離散的
信号について音声区間検出部1により、例えばエ
ネルギーレベルを用いて語頭を検出し、音声保持
部2で語頭に応答した時点から離散信号の保持を
開始し、音声区間検出部1により語尾を検出した
時点で離散的信号の保持を終了する。次に平均的
特徴パターン発生部3では、例えば時間幅12.8m
secのハミング窓を6.4msecずつずらしながら
(この時、フレーム周期は6.4msecとなる)音声
保持部2で保持されている離散的信号に付加する
とともに、語尾から70.4msec(語尾フレームから
10フレーム)手前の時点から、語尾から32msec
手前の時点までの、5フレーム分の離散的信号に
関して14次のPARCOR係数を求めて、それらを
平均して平均的特徴パターンを発生し、特徴パタ
ーン間距離計算部6に出力する。一方特徴パター
ン発生部4では、平均的特徴パターン発生部3と
同様に、例えば時間幅12.8msecの前記ハミング
窓を6.4msecずつずらしながら、音声保持部2で
保持されている離散的信号に付加して、語頭から
順次前記PARCOR係数をフレーム周期6.4msec
で発生し、特徴パターン保持部5と特徴パターン
間距離計算部6に出力する。そして特徴パターン
保持部5では、6.4msec毎に特徴パターン発生部
4で発生される特徴パターンを保持する。一方特
徴パターン間距離計算部6では、平均的特徴パタ
ーンとしてのPAPCOR係数と6.4msec毎に得ら
れる特徴パターンとしてのPARCOR係数との、
例えばユークリツド距離を計算し、計算結果を閾
値判定部7に出力する。次に閾値判定部7では、
例えば閾値を0.2として、閾値よりもユークリツ
ド距離値が小さくなつた時、計数部8の計数を1
増加させる計数増加信号を出力する。計数増加信
号が印加されると計数部8では、例えば計数値が
5になつた時、特徴パターン発生部4に特徴パタ
ーン発生を終了させる特徴パターン発生終了信号
を出力すると同時に、特徴パターン保持部5で保
持している特徴パターンを音声識別部9に出力さ
せる特徴パターン出力命令信号を特徴パターン保
持部5に出力する。音声識別部9では、この様に
して得られた前記特徴パターンを用いて単音節音
声入力aの識別を行い、単音節音声認識結果bを
出力することができる。
第2図、第3図及び第4図は、それぞれ「ア」、
「サ」、「タ」なる単音節音声に関して、音声区間
の前半部分と前記平均的特徴パターンとのユーク
リツド距離を求めた計算結果であり、“FRAME”
は各音節に関するフレーム番号を示し、“DIST”
は前記ユークリツド距離値を示す。またこれらの
図において、閾値を0.2とし、計数値が5となつ
た場合のフレームに下線を引いてある。語頭より
下線を施したフレームまで、即ち「ア」(第2図)
の場合は語頭より5フレーム分、「サ」(第3図)
の場合は語頭より20フレーム分、「タ」(第4図)
の場合は語頭より15フレーム分を特徴パターンと
するので、語頭から語尾までの全フレームの特徴
パターンとする場合に比べて、特徴パターンの量
も少なく、したがつて、装置に要求される記憶容
量が少なくなるばかりでなく、入力音声の識別に
関する処理量が少なくなるので、より短時間で認
識結果を得ることができる。
「サ」、「タ」なる単音節音声に関して、音声区間
の前半部分と前記平均的特徴パターンとのユーク
リツド距離を求めた計算結果であり、“FRAME”
は各音節に関するフレーム番号を示し、“DIST”
は前記ユークリツド距離値を示す。またこれらの
図において、閾値を0.2とし、計数値が5となつ
た場合のフレームに下線を引いてある。語頭より
下線を施したフレームまで、即ち「ア」(第2図)
の場合は語頭より5フレーム分、「サ」(第3図)
の場合は語頭より20フレーム分、「タ」(第4図)
の場合は語頭より15フレーム分を特徴パターンと
するので、語頭から語尾までの全フレームの特徴
パターンとする場合に比べて、特徴パターンの量
も少なく、したがつて、装置に要求される記憶容
量が少なくなるばかりでなく、入力音声の識別に
関する処理量が少なくなるので、より短時間で認
識結果を得ることができる。
第5図、第6図及び第7図は、それぞれ「ア」、
「サ」、「タ」なる単音節音声に関して、閾値を
0.2、計数値を5とした場合の線形予測によるス
ペクトル包絡の時間変化を表したものであり、各
音節の子音部分のスペクトル的特徴及び母音部分
のスペクトル的特徴が簡潔に把握できる。
「サ」、「タ」なる単音節音声に関して、閾値を
0.2、計数値を5とした場合の線形予測によるス
ペクトル包絡の時間変化を表したものであり、各
音節の子音部分のスペクトル的特徴及び母音部分
のスペクトル的特徴が簡潔に把握できる。
以上のように本実施例によれば、単音節音声a
の語頭から特徴パターン発生部4により特徴パタ
ーンを求めるとともに、単音節音声aの語尾から
平均的特徴パターン発生部3により平均的特徴パ
ターンを求め、その語に特徴パターンと平均的特
徴パターンとの距離を特徴パターン間距離計算部
6により求め、閾値判定部7により距離があらか
じめ定められた閾値0.2よりも小さくなるフレー
ムが5回連続して続いた時点で特徴パターンを求
める分析動作を終了し、特徴パターン保持部5の
特徴パターンから音声識別部9により音声の認識
を行なうことにより、短時間で音声認識を行なう
ことができる。
の語頭から特徴パターン発生部4により特徴パタ
ーンを求めるとともに、単音節音声aの語尾から
平均的特徴パターン発生部3により平均的特徴パ
ターンを求め、その語に特徴パターンと平均的特
徴パターンとの距離を特徴パターン間距離計算部
6により求め、閾値判定部7により距離があらか
じめ定められた閾値0.2よりも小さくなるフレー
ムが5回連続して続いた時点で特徴パターンを求
める分析動作を終了し、特徴パターン保持部5の
特徴パターンから音声識別部9により音声の認識
を行なうことにより、短時間で音声認識を行なう
ことができる。
また本実施例では、特徴パターンとして
PARCOR係数を用い、特徴パターン間距離を尺
度としてユークリツド距離を用いたが、特徴パタ
ーンとしては例えばフイルタバンクの出力を用い
るなど、入力音声の特徴を表現しうるものであれ
ば良く、また距離尺度も例えば市街距離やcosh
尺度など種々の距離尺度を用いた場合でも有効で
ある。
PARCOR係数を用い、特徴パターン間距離を尺
度としてユークリツド距離を用いたが、特徴パタ
ーンとしては例えばフイルタバンクの出力を用い
るなど、入力音声の特徴を表現しうるものであれ
ば良く、また距離尺度も例えば市街距離やcosh
尺度など種々の距離尺度を用いた場合でも有効で
ある。
更に、閾値判定部7で特徴パターン間距離が閾
値よりも小さくない場合には、計数部8の計数値
をクリアする計数値クリア信号を、また閾値判定
部7から計数部8に出力して閾値判定部7で特徴
パターン間距離が閾値よりも小さい場合には計数
部8の計数値を1増加させる計数値増加信号を、
閾値判定部7から計数部8に出力することとすれ
ば、前記閾値よりも小さい前記パターン間距離の
フレームが前記計数値に対応したフレーム数だけ
連続した時点までの特徴パターンを用いることに
より、単音節音声入力の識別を行うようにしても
よい。
値よりも小さくない場合には、計数部8の計数値
をクリアする計数値クリア信号を、また閾値判定
部7から計数部8に出力して閾値判定部7で特徴
パターン間距離が閾値よりも小さい場合には計数
部8の計数値を1増加させる計数値増加信号を、
閾値判定部7から計数部8に出力することとすれ
ば、前記閾値よりも小さい前記パターン間距離の
フレームが前記計数値に対応したフレーム数だけ
連続した時点までの特徴パターンを用いることに
より、単音節音声入力の識別を行うようにしても
よい。
以上のように本発明は子音部分の様に時間的に
非定常な特徴パターンを持つ部分では非定常部分
の特徴パターンをすべて得るとともに、母音部分
の様に子音部に比べて定常でしかも継続時間の長
い部分については特徴パターンのすべてを求めな
いように構成することにより、特徴パターンを発
生させる分析時間を短縮できるだけでなく、音声
識別の認識時間も短縮でき、更に音声識別におい
て識別に必要な標準パターンの量も減少させるこ
とができ、装置の要求される処理の高速性を緩和
させると同時に記憶容量も少なくすることがで
き、その工業的価値は大なるものがある。
非定常な特徴パターンを持つ部分では非定常部分
の特徴パターンをすべて得るとともに、母音部分
の様に子音部に比べて定常でしかも継続時間の長
い部分については特徴パターンのすべてを求めな
いように構成することにより、特徴パターンを発
生させる分析時間を短縮できるだけでなく、音声
識別の認識時間も短縮でき、更に音声識別におい
て識別に必要な標準パターンの量も減少させるこ
とができ、装置の要求される処理の高速性を緩和
させると同時に記憶容量も少なくすることがで
き、その工業的価値は大なるものがある。
第1図は本発明の一実施例における単音節音声
認識装置のブロツク図、第2図、第3図及び第4
図は特徴パターンと平均的特徴パターンとのユー
クリツド距離の計算結果を示した図、第5図、第
6図及び第7図は線形予測によるスペクトル包絡
の波形図である。 1……音声保持部、2……音声区間検出部、3
……平均的特徴パターン発生部、4……特徴パタ
ーン発生部、5……特徴パターン保持部、6……
特徴パターン間距離計算部、7……閾値判定部、
8……計数部、9……音声識別部。
認識装置のブロツク図、第2図、第3図及び第4
図は特徴パターンと平均的特徴パターンとのユー
クリツド距離の計算結果を示した図、第5図、第
6図及び第7図は線形予測によるスペクトル包絡
の波形図である。 1……音声保持部、2……音声区間検出部、3
……平均的特徴パターン発生部、4……特徴パタ
ーン発生部、5……特徴パターン保持部、6……
特徴パターン間距離計算部、7……閾値判定部、
8……計数部、9……音声識別部。
Claims (1)
- 【特許請求の範囲】 1 単音節音声区間を検出する音声区間検出手段
と、検出された単音節音声を保持する音声保持手
段と、 前記音声保持手段が保持している単音節音声か
ら一定周期ごとに音声特徴パターンを発生する特
徴パターン発生手段と、 前記音声保持手段が保持している単音節音声の
語尾から特定の複数フレームの特徴パターンを平
均して平均的特徴パターンを発生する平均的特徴
パターン発生手段と、 前記平均的特徴パターンと前記音声特徴パター
ンとの特徴パターン間の距離を順次計算する特徴
パターン間距離計算手段と、 前記特徴パターン間の距離を予め定めた閾値と
比較してその大小を判定する閾値判定手段と、 前記特徴パターン間の距離が前記閾値よりも小
さいフレームの数を計数し、計数値が予め定めた
値になつた時点で信号を発生する計数手段と、 前記計数手段の発生した前記信号を到来まで前
記特徴パターン発生手段の発生する一定周期ごと
の特徴パターンを保持する特徴パターン保持手段
と、 前記特徴パターン保持手段の特徴パターンを用
いて入力単音節音声を識別する音声識別手段とを
具備し、 前記音声区間検出手段で検出された単音節音声
区間の語頭から、順次、前記特徴パターン間距離
計算手段が距離を求め、この距離を前記閾値判定
手段が前記閾値との大小を判定し、この閾値判定
手段が小さいと判断したフレーム数を前記計数手
段が計数し、この計数手段で計数されたフレーム
数が予め設定された前記閾値に達したことによつ
て前記信号を発生した場合には、その時点までの
特徴パターンを用いて入力単音節音声の認識を行
なうように構成した単音節音声認識装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP57133431A JPS5923398A (ja) | 1982-07-29 | 1982-07-29 | 単音節音声認識装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP57133431A JPS5923398A (ja) | 1982-07-29 | 1982-07-29 | 単音節音声認識装置 |
Related Child Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP3017534A Division JPH04211299A (ja) | 1991-02-08 | 1991-02-08 | 単音節音声認識装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPS5923398A JPS5923398A (ja) | 1984-02-06 |
| JPH0412478B2 true JPH0412478B2 (ja) | 1992-03-04 |
Family
ID=15104609
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP57133431A Granted JPS5923398A (ja) | 1982-07-29 | 1982-07-29 | 単音節音声認識装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS5923398A (ja) |
Families Citing this family (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH04211299A (ja) * | 1991-02-08 | 1992-08-03 | Matsushita Electric Ind Co Ltd | 単音節音声認識装置 |
-
1982
- 1982-07-29 JP JP57133431A patent/JPS5923398A/ja active Granted
Also Published As
| Publication number | Publication date |
|---|---|
| JPS5923398A (ja) | 1984-02-06 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| CN103886871B (zh) | 语音端点的检测方法和装置 | |
| JP3162994B2 (ja) | 音声のワードを認識する方法及び音声のワードを識別するシステム | |
| US4821325A (en) | Endpoint detector | |
| US6216103B1 (en) | Method for implementing a speech recognition system to determine speech endpoints during conditions with background noise | |
| Zhao et al. | A processing method for pitch smoothing based on autocorrelation and cepstral F0 detection approaches | |
| JP2000310993A (ja) | 音声検出装置 | |
| JPS60200300A (ja) | 音声の始端・終端検出装置 | |
| JPH04211299A (ja) | 単音節音声認識装置 | |
| JPS5923398A (ja) | 単音節音声認識装置 | |
| JP2666296B2 (ja) | 音声認識装置 | |
| JPH0222399B2 (ja) | ||
| JP2891259B2 (ja) | 音声区間検出装置 | |
| JP3032215B2 (ja) | 有音検出装置及びその方法 | |
| Funada | A method for the extraction of spectral peaks and its application to fundamental frequency estimation of speech signals | |
| JP2557497B2 (ja) | 男女声の識別方法 | |
| JPS59149400A (ja) | 音声入力装置 | |
| JP2901976B2 (ja) | パターン照合予備選択方式 | |
| JPS63257797A (ja) | 音声始端検出装置 | |
| JPH0398098A (ja) | 音声認識装置 | |
| KR20010046522A (ko) | 피치 정보를 이용한 실시간 음성 검출 장치 및 그 방법 | |
| JPH0217118B2 (ja) | ||
| JP4576612B2 (ja) | 音声認識方法および音声認識装置 | |
| JPH03290700A (ja) | 有音検出装置 | |
| JPS597399A (ja) | 単音節音声認識装置 | |
| Ahmad et al. | An isolated speech endpoint detector using multiple speech features |