JPS6053997A - 音素判別法 - Google Patents

音素判別法

Info

Publication number
JPS6053997A
JPS6053997A JP58163536A JP16353683A JPS6053997A JP S6053997 A JPS6053997 A JP S6053997A JP 58163536 A JP58163536 A JP 58163536A JP 16353683 A JP16353683 A JP 16353683A JP S6053997 A JPS6053997 A JP S6053997A
Authority
JP
Japan
Prior art keywords
phoneme
unit
standard pattern
procedure
buzz
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP58163536A
Other languages
English (en)
Inventor
昌克 星見
二矢田 勝行
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Panasonic Holdings Corp
Original Assignee
Matsushita Electric Industrial Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Matsushita Electric Industrial Co Ltd filed Critical Matsushita Electric Industrial Co Ltd
Priority to JP58163536A priority Critical patent/JPS6053997A/ja
Publication of JPS6053997A publication Critical patent/JPS6053997A/ja
Pending legal-status Critical Current

Links

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 産業上の利用分野 本発明は音声認識における音素判別法に関するものであ
る。
従来例の構成とその問題点 入力音声を音素単位に分けて音素の組合せとして認識し
く音素認識とよぶ)音素単位で表記された単記辞書との
類似度をめて認識結果を出力する従来の単語認識システ
ムのブロック図を第1図に示す。
まず、あらかじめ多数話者の音声を10m5の分析区間
毎に音響分析部1によってフィルタバンクを用いて分析
し、得られたスペクトル情報をもとに特徴抽出部2によ
って特徴パラメータをめる。この特徴パラメータから/
a/、10/等の母音や、/m/、/b/等の子音に代
表される音素毎又は音素グループ毎に標準パターンを作
成して標準パターン登録部6に登録しておく。次に、入
力された不特定話者の音声を、同様に分析区間毎に音響
分析部1によって分析し、特徴抽出部2によって特徴パ
ラメータをめる。この特徴パラメータと標準パターン登
録部5の標準パターンを用いてセグメンテーション部3
において母音と子音の区切り作業(以下セグメンテーシ
ョンと呼ぶ)を行なう。この結果をもとに、音素判別部
4において、標準パターン登録部6の標準・くターンと
照合することによって、最も類似度の高い標準ノ:ター
ンに該当する音素をその区間における音素と決定する。
最後に、この結果作成した音素の時系列(以下音素系列
と呼ぶ)を単語認識部6に送り、同様に音素系列で表現
された単語辞書7と最も類似度の大きい項目に該当する
単語を認識結果として出力する。
本構成において音素判別部4で音素の判別を行う場合、
従来では、子音区間と判定された区間についてフレーム
毎に音素の特徴を示す特徴パラメータをめあらかじめ用
意されている各音素まだは音素群の標準パターンと比較
してフレーム毎に子音分類を折力う。この結果を子音分
類ツリーに適用して条件の一致したものを認識された子
音とする。
この従来の方法によると音素/r/はスペクトルが前後
の母音との間で連続的に変化するために特徴をとらえに
くく、イくワーの時間的変動も激しく有声破裂音に誤認
識されやすいという問題がある。
発明の目的 本発明は、以上のような従来の問題点を解決するだめに
なされたもので、語中の有声破裂音群(/b/、/d/
、/g/)と/r/のグループから有声破裂音群と/r
/とを精度良く簡単に分離する方法を提供することを目
的とする。
発明の構成 一般的に有声破裂音/b/、/d/、/g/のスペクト
ルパターンの特徴は最初に低周波数域の大きい単純なス
ペクトルのバズバ一部とそれにつづきスペクトルが急激
に変化する破裂部の2つの部分に分けられ、そのパター
ンは前後の音素により影響を受けない。一方/r/は前
後の母音の影響を受けて連続的に変化するのが特徴であ
る。したがって有声破裂音(/b/、/4/、/g/と
/r/を分離する時にバズバ一部の有無に注目して判定
することが出来る。
本発明は上記特徴に注目してなされたもので、多数話者
の発声した音声を分析し、有声破裂音の特徴であるバズ
バーと/r/の標準・くターンを予め準備する手順と、
入力音声について音素ごとにセグメンテーションされた
区間に対して音素認識を行い、/b/ 、/a/、/g
/ 、/r/からなるグループを抽出する手順と、前記
グループに対してフレーム毎に前記標準パターンと比較
して・くズバーか/r/かを判定する手順と、前記手順
により得られたバズバー検出フレーム数とセグメンテー
ションにより得られた持続時間フレーム数との2つの情
報を用いることにより有声破裂音と/r/とを識別する
手順とを少なくとも有することを特徴とする音素判別法
である。
実施例の説明 以下に本発明の実施例を図面を用いて説明する。
第2図に本発明の一実施例である音声認識システムのブ
ロック図を示す。
本実施例では、バズバ一部の有無と音素の持続時間情報
により語中の/b/ 、/d/と/r/を分離する例に
よって説明する。図において1は音響分析部で、分析区
間毎に入力音声を分析する。
2は特徴抽出部で、特徴パラメータをめる。3はセグメ
ンテーション部で、特徴抽出部2で得られた特徴パラメ
ータを用いてセグメンテーションを行なう。5は標準パ
ターン登録部で音素毎又は音素グループ毎に作成された
標準パターンを登録しておく。4は音素判別部で本実施
例の特徴となる部分である。8は音素候補検出部であり
セグメンテーションされた区間毎に音素候補を決定する
9は判別関数部で、有声破裂音C/b/、/b/)と/
r/をフレーム毎に判定する部分である。1゜は判別部
で/b/、/C1/と/r/を分離する。
11は音素系列作成部で、判別部10で1(すられた結
果と音素候補検出部8で得られた結果を用いて入力音声
の音素系列を作成する。6は単語認識部、7は単語辞書
で音素系列作成部11で得られた音素系列と単語辞書7
と比較し最も類似度の大きい単語を認識結果とする。
次に本実施例の動作説明をする。まず、あらかじめ多数
話者の音声を10mgの分析区間毎に音響分析部1と特
徴抽出部2により音素のスペクトルの特徴を表わすパラ
メータとしてLPGケダストラム係数C1”Cn(ただ
しnは正の整数)をめる。この特徴パラメータから/&
/、10/等の母音や/m/、/r/等の子音に加え、
有声破裂音の特徴であるバズバ一部の標準パターンを作
成し、標準パターン登録部6に登録しておく。
次に、入力された不特定話者の音声を、同様に分析区間
毎に音響分析部1によって分析し、特徴抽出部2によっ
て特徴パラメータをめる。この特徴パラメータと標準パ
ターン登録部5の標準パターンを用いてセグメンテーシ
ョン部3において母音と子音の区切り作業(以下セグメ
ンテーションと呼ぶ)を行なう。この結果をもとに、音
素候補検出部8において、標準パターン登録部6の標準
パターンと照合することによって、最も類似度の高い標
準パターンに該当する音素をその区間における音素と決
定する。
音素候補検出部8で/b/、/d/、/r/に認識され
た音素グループについて判別関数部9で線形判別関数F
Xの値がめられる。線形判別関数FXは、 と表わすことができる。このn個の荷重和で表わされる
線形判別関数が最適の判別をするだめのai(i=1〜
n)の値は上記標準パターン登録部6に格納された標準
パターン・データを使用してFisher比最大化条件
からめることが出来、とのalと、入力音声のLPOケ
プヌトラム係数であるc4とにより線形判別関数FXの
値がめられる。
判別関数部9では、多数データから/b/、/C1/と
/r/の線形判別関数FXの値の分布をめ、/b/、/
(1/と/r/を分離するいき値を予め定めておき、こ
のいき値と」二記入力音声についてめられたFXO値と
を比較することにより、対象としているフレームがバズ
バーであるか否かを判定する。前記判別関数部9の結果
に基づき判別部1oで、有声破裂音/b/、/a/と/
r/とが持続時間が異なることを利用して、/b/、/
(1/と/r/の分離を行う。
第3図に/b/、/6/、第4図に/r/の持続時間と
バズバーの分布図を示す。図において横軸は音素の持続
時間であるフレーム数、縦軸に線形判別関数でバズバー
であると判定されたフレーム数をとシ図中の数字は出現
音素個数を表わしている。図から明らかなように/b/
、/(1/のようなバズバ一部をもつ音素はバズバーの
判定フレーム数も多く、また音素の持続時間も/r/よ
りは長い。
このような性質を利用して、第5図に示す、持続時間と
バズバーの検出フレーム数により2次元の判別図を作成
し、判別部10に予め格納しておく。第6図において斜
線部人は/r/の領域を示し、その他の部分Bは/b/
 、/C1/の領域を示す。判別部10では判別関数部
9で得られたバズバー検出フレーム数と、先ニセグメン
テーション部3で得られた音素の持続フレーム数を第5
図の判別図にあてはめて/b/、/C1/と/r/とを
分離する。
前記/b/、/(1/、及び/r/と、音素候補検出部
8で得られた他の音素の認識結果から、音素系列作成部
11で音素系列を作成する。
この音素系列と、単語辞書7に格納されている音素系列
とを単語認識部6で比較し類似度の最も大きい単語を認
識結果とする。
本実施例を用いて212単語セットを発話した男10名
のデータを用いて評価した。その結果を表に示す。
表 認識結果 この結果かられかるように、/b/、/d/及び/r/
ともに9o%近い認識率を得ることができた。
なお上記実施例は有声破裂音として/b/。
/d/′の場合について述べたが、/g/の場合にも同
様にして/r/と明確に分離することができる。
発明の効果 以上要するに本発明は、多数話者の発声した音声を分析
し、有声破裂音の特徴であるバズバーと/r/の標準パ
ターンを予め準備する手順と、入力音声について音素ご
とにセグメンテーションされた区間に対して音素認識を
行い、/ b / 、/d/。
/g/、/r/からなるグループを抽出する手順と、前
記グループに対してフレーム毎に前記標準パターンと比
較してバズバーか/r/かを判定する手順と、前記手順
により得られたバズバー検出フレーム数とセグメンテー
ションにより得られた持続時間フレーム数との2つの情
報を用いることにより有声破裂音と/r/とを識別する
手順とを少なくとも有することを特徴とする音素判別法
を提供するもので、従来判別が困難であった/r/と有
声破裂音間の識別を比較的高い確率でかつ簡単に行うこ
とができる利点を有する。
【図面の簡単な説明】
第1図は従来の音声認識システムのブロック図、第2図
は本発明の一実施例である音声認識システムのブロック
図、第3図は/b/、/(1/の音素の持続フレーム数
とバズバー検出フレーム数の分布図、第4図は/r/の
音素の持続フレーム数とバズバー検出フレーム数の分布
図、第5図は持続フレーム数とバズバー検出フレーム数
からなる判別図である。 1・・・・・音響分析部、2・・・・・特徴抽出部、3
・・・・・セグメンテーション部、4・・・・・音素判
別部、6・・・・・・標準パターン登録部、6・・・・
・・単語認識部、7・・・・・・単語辞書、8・・・・
・・音素候補検出部、9・・・・・・判別関数部、10
・・・・・・判別部、11・・・・音素系列作成部。 代理人の氏名 弁理士 中 尾 敏 男 ほか1名第 
1 @ 訳諏#本 第2図 藺3g疋編秀、

Claims (1)

    【特許請求の範囲】
  1. 多数話者の発声した音声を分析し、有声破裂音の特徴で
    あるバズバーと/r/の標準パターンを予め準備する手
    順と、入力音声について音素ごとにセグメンテーション
    された区間に対して音素認識を行い、/b/、/d/、
    /g/、/r/から力るグループを抽出する手順と、前
    記グループに対してフレーム毎に前記標準パターンと比
    較してバズバーか/r/かを判定する手順と、前記手順
    により得られたバズバー検出フレーム数とセグメンテー
    ショ/により得られた持続時間フレーム数との2つの情
    報を用いることにより有声破裂音と/r/とを識別する
    手順とを少なくとも有することを特徴とする音素判別法
JP58163536A 1983-09-05 1983-09-05 音素判別法 Pending JPS6053997A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP58163536A JPS6053997A (ja) 1983-09-05 1983-09-05 音素判別法

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP58163536A JPS6053997A (ja) 1983-09-05 1983-09-05 音素判別法

Publications (1)

Publication Number Publication Date
JPS6053997A true JPS6053997A (ja) 1985-03-28

Family

ID=15775741

Family Applications (1)

Application Number Title Priority Date Filing Date
JP58163536A Pending JPS6053997A (ja) 1983-09-05 1983-09-05 音素判別法

Country Status (1)

Country Link
JP (1) JPS6053997A (ja)

Similar Documents

Publication Publication Date Title
JPS5972496A (ja) 単音識別装置
Kamble et al. Emotion recognition for instantaneous Marathi spoken words
JPS6053997A (ja) 音素判別法
JP2744622B2 (ja) 破裂子音識別方式
JPS61180297A (ja) 話者照合装置
Elghonemy et al. Speaker independent isolated Arabic word recognition system
JPS6336678B2 (ja)
JPH0316040B2 (ja)
JPH0120440B2 (ja)
JPH06100918B2 (ja) 音声認識装置
JPH0217039B2 (ja)
JPS6069695A (ja) 語頭子音のセグメンテ−ション法
JPH026078B2 (ja)
JPH01260499A (ja) 子音認識法
JPS6293000A (ja) 音声認識方法
JPS6363920B2 (ja)
JPS6136797A (ja) 音声セグメンテ−シヨン法
JPS6292999A (ja) 音声認識装置
JPS63247799A (ja) 音声認識装置
JPH0114600B2 (ja)
JPS5958498A (ja) 音声認識装置
JPS6363919B2 (ja)
JPS63220297A (ja) 子音のセグメンテ−シヨン・分類法
JPS62166400A (ja) 音声ワ−ドプロセツサ装置
JPS6148000A (ja) 連続音声認識方式