JPH0654440B2 - 音声認識におけるマツチング方法 - Google Patents

音声認識におけるマツチング方法

Info

Publication number
JPH0654440B2
JPH0654440B2 JP61156409A JP15640986A JPH0654440B2 JP H0654440 B2 JPH0654440 B2 JP H0654440B2 JP 61156409 A JP61156409 A JP 61156409A JP 15640986 A JP15640986 A JP 15640986A JP H0654440 B2 JPH0654440 B2 JP H0654440B2
Authority
JP
Japan
Prior art keywords
pattern
standard
syllable
unit
matching
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Expired - Lifetime
Application number
JP61156409A
Other languages
English (en)
Other versions
JPS6311998A (ja
Inventor
隆夫 渡辺
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
NEC Corp
Original Assignee
NEC Corp
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by NEC Corp filed Critical NEC Corp
Priority to JP61156409A priority Critical patent/JPH0654440B2/ja
Publication of JPS6311998A publication Critical patent/JPS6311998A/ja
Publication of JPH0654440B2 publication Critical patent/JPH0654440B2/ja
Anticipated expiration legal-status Critical
Expired - Lifetime legal-status Critical Current

Links

Description

【発明の詳細な説明】 (産業上の利用分野) 本発明は音声認識におけるマッチング方法に関し、特
に、パタンマッチングにより認識を行う技術の改良を図
った音声認識におけるマッチング方法に関する。
(従来の技術) 音声認識の方法として、認識すべきパタンをあらかじめ
標準パタンとして登録しておき、認識時に入力される未
知パタンを標準パタンと比較し最も類似性の高いものを
認識結果として決定するパタンマッチング法は従来から
広く用いられている。
このような標準パタンによる方法は、認識対象のカテゴ
リ数が増加するに従って標準パタンの登録の負担が増加
し、同時に標準パタンを保持するための記憶量も増加す
る。このような問題を解決するため、音声をより細かな
ユニットの結合とみなし、標準パタンをユニット毎に用
意しこれらユニット標準パタンを連結することにより標
準パタンを生成する方法が試みられている。
音節はこのようなユニットとして典型的なものであり、
日本語の場合には約100種類の音節の連結により任意
の音声を生成することが可能である。
パタンマッチング法では、認識精度を向上させるため、
各カテゴリ1個の標準パタンだけでなく複数個の標準パ
タンを用いることが一般に有効である。しかしながら、
上記のようなユニット標準パタンを用いる場合には、ユ
ニット標準パタンの個数を増やすと連結のしかたは著し
く増加する。例えば「カワサキ」という単語を考えた場
合、各音節ごとに5個の音節標準パタン(ユニット標準
パタン)を用意しただけでも連結のしかたは5通りと
なりマッチングの処理量は膨大なものとなる。連結単語
音声認識で用いられている2段DPDynamic Programi
ng,動的計画法)マッチング法と呼ばれる方法を適用す
ると(この場合各音節が単語とみなされる)、この処理
量は大幅に削減されるがそれでも処理量は依然として大
きい。なお、2段DPマッチング法の詳細アルゴリズム
に関しては“日経エレクトロニクス,昭58.No.1
1,Vol.4,PP.171−207”に詳述されている。
(発明が解決しようとする問題点) 上述した如く従来のこの種の音声認識におけるマッチン
グ方法は、ユニット標準パタンの個数に対応して連結数
が著しく増加しパタンマッチングにおける処理量が膨大
化することが避けられないという欠点がある。
本発明の目的は上述した欠点を除去し、複数のユニット
標準パタンを利用しても処理量の増加をもたらすことの
ない音声認識におけるマッチング方法を提供することに
ある。
(発明の構成) 本発明の方法は、標識パタンとのパタンマッチングによ
り入力された音声を認識する音声認識におけるマッチン
グ方法において、音声を構成するユニットごとに複数個
の標準パタンを有し前記複数個のユニット標準パタンか
ら選択されたものを連結することにより得られたパタン
と入力されたパタンとのマッチングを行い、かつ前記ユ
ニット標準パタンの選択は入力パタンとユニット標準パ
タンとを予備的に比較することによって行われる手段を
備えて構成される。
(作用) 本発明の作用を、単語音声認識において標準パタンのユ
ニットを音節とした場合を例にとって説明する。
入力された単語音声パタンは、音声分析(FFT分析,LP
C分析等)により特徴ベクトルの系列A={a(j),j=
1,…,J}と表わされるものとする。また認識対象と
なる単語はおのおの音節シンボルの系列として表わされ
るものとする。これをS={s(p),p=1,…,P}と
表わす。
音節標準パタンは認識に先立って登録されており、入力
パタンと同様に特徴ベクトルの系列として表わされるも
のとする。これをBm,k={bm,k(i),i=1,…,
I}と表わす。Bm,kは音節mの第k番目の標準パタン
を表わす。
問題は入力パタンAと音節シンボル系列Sとの類似度を
求めることである。各音節の標準パタン数K(m)が1で
あるときは音節の標準パタンを音節シンボル系列の順に
連結することによって単語標準パタンを生成することが
容易にできる。
この場合には、代表的なパタンマッチング法として広く
実用に供されている動的計画法を利用した時間軸正規化
マッチング法、いわゆるDPマッチング法(“日本音響
学会誌,Vol.27,No.9,P.483”)を適用することがで
きる。
K(m)が2以上の場合には、上記のようにして生成しう
る単語標準パタンは複数個となり単語マッチングの処理
量が増加する。これに対し各音節毎にK(m)個の音節標
準パタンのうちから最も入力パタンに類似していると思
われるものをとり出してこれらを連結することにすれ
ば、生成される単語標準パタンは1つであり、処理量は
大幅に減少できる。
このような方法としては、入力音声のうち、ある音節の
存在する可能性のある区間を適当に切り出し、この区間
で各音節標準パタンとの類似度を求める方法いわゆる音
節セグメンテーション(Segmentation)がある。
第2図は本発明における音節セグメンテーションの原理
図である。第2図は、例として2音節長の単語「りく」
の単語標準パタンを生成する場合をとり、入力パタンの
区間Aと「り」の標準パタンとの類似度および区間Bと
「く」の標準パタンとの類似度をそれぞれ求めればよい
ことを示している。このとき類似度として2つのパタン
の包含関係を表わす値、例えば、特願昭60−153217に示
される方法において用いられている値Δを用いることが
できる。
区間A,Bを求めるには、振巾パタンの特徴を利用する
方法や単純に入力区間を等分する方法など任意のものが
可能である。第1図では、入力区間〔S,E〕を2つに
等分する点Xを求め、適当な許容限度εを用いて、A=
〔S,X+ε〕B=〔X−ε,E〕として与えている。
〔実施例〕
次に図面を参照して本発明を詳細に説明する。
第1図は本発明の一実施例を示すブロック図である。第
1図において、入力パタンバッファ1の内容は単語辞書
5の各単語とのパタンマッチングが行われる。音節セグ
メンテーション処理部2は、バッファ1の入力パタンを
単語辞書5に記憶されている単語を仮説して各音節に対
応する区間を求める。音節標準パタン選択部3では、処
理部2で求められた各音節区間のパタンについて、標準
パタンバッファ6中の各音節標準パタン(但し音節名
が、仮説された単語内の対応する音節と一致するもの)
との比較を行い最も類似している音節標準パタンを連結
標準パタンバッファ7へ出力する。連結標準パタンバッ
ファ7には、選択部3で決定された音節標準パタンを連
結したパタンが単語標準パタンとして格納される。
単語マッチング部4は、パタンバッファ1上の入力パタ
ンとパタンバッファ7上の単語標準パタンとのマッチン
グを行い類似度を出力する。
以上の例において、セグメンテーション処理部2は、単
純に音節数で等分したもの、単語に固有の情報(無声部
を含むエネルギーの山がある等)を利用したもの等任意
のものが使用可能である。標準パタン選択部3も、入力
パタンの部分パタンと標準パタンの類似性を判定できる
ものであれば任意のものが可能であるが、効率の改善が
本発明の利点であるので計算の容易なものである程よ
い。特願昭60−153217で述べられている方法は
その一例である。単語マッチング部4も任意のものが可
能であるが、DPマッチング法が認識精度の点で優れて
いることはよく知られており、この場合には最も適切で
ある。
(発明の効果) 以上述べたように本発明によれば、複数のユニット標準
パタンを用いながら処理量の増加をもたらすことなくマ
ッチングを行うことが可能となるので、認識精度と効率
とを著しく改善したパタンマッチングを実現することが
できる音声認識におけるマッチング方法が実現できると
いう効果がある。
【図面の簡単な説明】
第1図は本発明の一実施例を示すブロック図、第2図は
本発明における音節セグメンテーションの原理図であ
る。 1……入力パタンバッファ、2……セグメンテーション
処理部、3……標準パタン選択部、4……単語マッチン
グ部、5……単語辞書、6……標準パタンバッファ、7
……連結標準パタンバッファ。

Claims (1)

    【特許請求の範囲】
  1. 【請求項1】標識パタンとのパタンマッチングにより入
    力された音声を認識する音声認識におけるマッチング方
    法において、音声を構成するユニットごとに複数個のユ
    ニット標準パタンを有し前記複数個のユニット標準パタ
    ンから選択されたものを連結することにより得られたパ
    タンと入力されたパタンとのマッチングを行い、かつ前
    記ユニット標準パタンの選択は入力パタンとユニット標
    準パタンとを予備的に比較することによって行なうもの
    であることを特徴とする音声認識におけるマッチング方
    法。
JP61156409A 1986-07-02 1986-07-02 音声認識におけるマツチング方法 Expired - Lifetime JPH0654440B2 (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP61156409A JPH0654440B2 (ja) 1986-07-02 1986-07-02 音声認識におけるマツチング方法

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP61156409A JPH0654440B2 (ja) 1986-07-02 1986-07-02 音声認識におけるマツチング方法

Publications (2)

Publication Number Publication Date
JPS6311998A JPS6311998A (ja) 1988-01-19
JPH0654440B2 true JPH0654440B2 (ja) 1994-07-20

Family

ID=15627114

Family Applications (1)

Application Number Title Priority Date Filing Date
JP61156409A Expired - Lifetime JPH0654440B2 (ja) 1986-07-02 1986-07-02 音声認識におけるマツチング方法

Country Status (1)

Country Link
JP (1) JPH0654440B2 (ja)

Also Published As

Publication number Publication date
JPS6311998A (ja) 1988-01-19

Similar Documents

Publication Publication Date Title
JP2815579B2 (ja) 音声認識における単語候補削減装置
JPS58130393A (ja) 音声認識装置
JPS5972496A (ja) 単音識別装置
JPS6332397B2 (ja)
JPH0654440B2 (ja) 音声認識におけるマツチング方法
JP2966002B2 (ja) 音声認識装置
JP3378547B2 (ja) 音声認識方法及び装置
JPH1097270A (ja) 音声認識装置
JP3438293B2 (ja) 音声認識における単語テンプレートの自動作成方法
Lee Incremental network generation in word recognition
JPS62275300A (ja) 連続音声認識方法
JPH0211919B2 (ja)
JPH0619497A (ja) 音声認識方法
JP2862306B2 (ja) 音声認識装置
Zhou et al. Multisegment multiple VQ codebooks-based speaker independent isolated-word recognition using unbiased mel cepstrum
JPH0554678B2 (ja)
JP2951332B2 (ja) 音声認識における文節候補削減方式
JPS6312000A (ja) 音声認識装置
JPS62217297A (ja) 単語音声認識装置
JP2655637B2 (ja) 音声パターン照合方式
JPS63148299A (ja) 単語音声認識方法および装置
JPH071434B2 (ja) 標準パタン作成方式
JPS6076800A (ja) 音声認識方式
JPS62178999A (ja) 音声認識装置
JPS62160499A (ja) 音声認識装置