JPH02287398A - 音声認識方式及び音声認識装置 - Google Patents

音声認識方式及び音声認識装置

Info

Publication number
JPH02287398A
JPH02287398A JP10852089A JP10852089A JPH02287398A JP H02287398 A JPH02287398 A JP H02287398A JP 10852089 A JP10852089 A JP 10852089A JP 10852089 A JP10852089 A JP 10852089A JP H02287398 A JPH02287398 A JP H02287398A
Authority
JP
Japan
Prior art keywords
data
speech recognition
recognition
voice
sum
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP10852089A
Other languages
English (en)
Inventor
Junichiro Fujimoto
潤一郎 藤本
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Ricoh Co Ltd
Original Assignee
Ricoh Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Ricoh Co Ltd filed Critical Ricoh Co Ltd
Priority to JP10852089A priority Critical patent/JPH02287398A/ja
Publication of JPH02287398A publication Critical patent/JPH02287398A/ja
Pending legal-status Critical Current

Links

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 致夏公立 本発明は、音声認識方式及び音声認識装置に関する。
従JJI 利用者があらかじめ音声を登録してから使う、いわゆる
特定話者音声認識装置ではトレーニングによって、でき
た標準パターンの質が認識能力を左右する。標準パター
ンの作成時と認識時では発声の違いがないか、標準パタ
ーンにノイズ等がついて、異常なパターンとして登録さ
れているのではないかということが非常に重要である。
例えば、特開昭59−201141号公報に示されるよ
うに、登録する時に、自分が登録の為に発声した声を聞
返しながら正常かどうかを判断するものである。この方
法は正常な標準パターンを登録するのには有効である。
しかし、長い単語をそのまま登録する場合や、それを短
く省略して登録しておく場合がある。例えば、「ムステ
ィスラフ・ロストロボーヴイッチ」と言う単語を「ムス
テイス」とか「ロスドロ」のように登録した場合、何日
か後にはどの様な登録の仕方をしたのか分からなくなっ
てしまうことが多い。仮に、「ムスティスラフ・ロスト
ロポーヴイッチノと言ってみて。
正確に認識しない時は標準パターンとしての登録の仕方
が違っているのか、それとも、登録の仕方は合っている
が、誤認識したものかの判断がつかず、利用者が正確に
認識させる為にはどのようにしたらよいのかがわからな
くなってしまう。
そこで特開昭57−86979号公報のように音声を録
音しておく方法もあるが、音声認識の目的以外に大きな
メモリーや再生の為の装置が必要となってくる。
また、次に考えられることは、音声認識用の標準パター
ンを使って登録時の音を再現することであるが、a準パ
ターンのデータ量を少なくする為に2値化処理したデー
タを使う方法「ファジィパターンマツチングを用いた不
特定話者単語音声認識」 (第10回 情報理論とその
応用シンポジウム 予稿集 1987  Nov、19
−21.p。
475〜480)で認識するような場合にこのパターン
から音声を再現するにはデータ量が少なすぎるという欠
点があった。
且−一孜 本発明は、上述のごとき欠点を解決するためになされた
もので、登録時の音声を示し、利用者に登録時の発声を
思い出させることにより認識精度を向上させることにあ
る。
特に、2値化処理したデータを使う方法が使われている
場合に、登録されているデータに音声の情報量を付加す
るような音声認識方法及び音声認識装置を提供すること
を目的としてなされたものである。
復−一或 本発明は、上記目的を達成するために、(1)音声を周
波数分析して2値化し1次に、標準パターンを作成し、
さらに、2値化する前のデータから周波数の高域、低域
の成分の分布情報を付加して特徴パターンとして用いる
音声認識方式において1周波数分析器のインパルス応答
波形を保持する部分を有し、該波形を音声認識に用いる
ために保持したデータの分布情報に従って各周波数成分
のレベルを補正した後、それらの和を出力して可聴音と
なす部分を備えた音声認識方式であること。
或いは、(2)前記請求項1項に記載の音声認識方式を
用いた音声認識装置であることを特徴としたものである
。以下1本発明の実施例に基づいて説明する。
第1図は、本発明による音声認識方式及びその方式を用
いた音声認識装置の一実施例を説明するための構成図で
、図中、1は音響/1を気信号変換器、2は音声分析部
、3は辞書部、4は認識部。
5は出力部、6は再生部、7は電気/音響信号変換器で
ある。
第1図は、音響/電気信号変換器1と、音声分析部2と
、標準パターンが格納されている辞書部3と、認識部4
と、再生部6と、出力部5と、電気/音響信号変換器7
とからなり、スイッチによって辞書の登録モードと認識
モードが選択できるようになっている。この方式は特定
話者方式と呼ばれている認識装置の利用者があらかじめ
自分の音声で装置をトレーニングしてから使うものを想
定しており、トレーニングが不用な不特定話者音声認識
装置では辞書の登録モードはいらない。どちらの方式で
あっても、本発明は使えるが、ここでは先に述べたよう
に特定話者音声認識方式について説明する。
第2図は、音11I!/電気信号変換器と、音声分析部
を示す図で1図中、8はマイクアンプ、9はフィルタ、
10は整流器、11は最小自乗直線化装置、12は2値
化装置である。音響/電気信号変換器1として一般的な
のはマイクロフォンである。
その出力をマイクアンプ8にて増幅し、フィルタ群9へ
印加せしめる。このフィルタ群9は共振先鋭度のゆるや
かなバンドパスフィルタが15個並入られているが、そ
の共振先鋭度や個数、特性には大した意味はない。通常
、150〜15000Hzがカバーされる程度の帯域を
持つように配置しておくことが望ましい。各フィルター
の出力を整流器10により整流して周波数jl@にレベ
ルの大きさとして記録してパターンを作っていく。
次に、このパターンから周波数の高域、低域の成分の分
布情報をとって2値化するやり方を第3図(a)〜(c
)に従って説明する。整流して周波数順に並べたパター
ンは(a)のようになっている。ただし、(3)では1
5個のデータがディスクリートに並ぶべきであるが、こ
こでは便宜上15個を連続量として表しである。このデ
ータで最小自乗直線を引いて直線分を各データから差引
くことで、(b)が得られる。音声データに音源特性を
補正する為に最小自乗直線を引くやり方は、「音響学会
音声研究会資料」 (三輪、城戸著 579−24.1
979)その他に詳しく述べられている。(b)の中の
正側の山のピークを中心にして「1」とし、他をrQJ
として2値化パターンを作ると(c)が得られる。つま
り、2値化した15個のデータとなるわけである。この
時の最小自乗直線の傾きが正であるか負であるかをそれ
ぞれrQJ、「1」で表現して15個のデータのつぎに
16番目のデータとしてつける。
第4図は再生部を示す図である。メモリー1からメモリ
ー15には先に周波数分析した時の15個のバンドパス
フィルターのインパルス応答波形がサンプルされて格納
されている。図の上方の1ahから15 c hは音声
認識用のデータの信号に対応しており、これを掛けるこ
とによってこのバンドパスフィルターに音声認識用にデ
ータに示される大きさのインパルスが入力された時の出
力を得ることができる。このような15個のバンドパス
フィルターの出力の和をとることによって認識用のデー
タに記録された音声を再現することができ、これを聞取
ることができる。メモリー1からメモリー15のデータ
は一定の時間長しかないので、これを繰返して掛は算器
に印加せしめると良い。
このほか!3!識部、出力部はとくに本発明では限定す
るものではなく、例えば認識にはDPマツチングのよう
なものでもよい。しかし、2値化データの情報付加に有
効であることから、前述の文献「ファジィパターンマツ
チングを用いた不特定話者単語音声認識」に述べられて
いる方法に従うと。
さらに有効である。出力部は信号増幅の為のアンプとス
ピーカ等で構成されるのが普通である。
効二一−スー 以上の説明から明らかなように1本発明によると、−度
失った音源の情報を近似的に付加して音声を再生できる
ため、音声認識用の辞書に登録された声を聞直すことが
できるようになった。このため音声の登録時の自分の発
声のしかたや登録内容を思い出すことができ、認識させ
やすいL!2m装置を実現することができるようになっ
た。
ここでは認識精度を向上させる為に登録時の発声を思い
だすことを例にして本発明を述べてきたが、これは発声
を思いだす為だけではなく、認識装置が認識した結果を
可聴な信号として出力させて、利用者に提供する為にも
使える。
【図面の簡単な説明】
第1図は1本発明による音声認識方式及びその方式を用
いた音声認識装置の一実施例を説明するための構成図、
第2図は、音響/電気信号変換器と音声分析部を示す図
、第3図(a)〜(Q)は、2値化の方法を説明するた
めの図、第4図は、再生部を示す図である。 1・・・音響/電気信号変換器、2・・・音声分析部、
3・・・辞書部、4・・・認識部、5・・・出力部、6
・・・再生部、7・・・電気/音響信号変換器。

Claims (1)

  1. 【特許請求の範囲】 1、音声を周波数分析して2値化し、次に、標準パター
    ンを作成し、さらに、2値化する前のデータから周波数
    の高域、低域の成分の分布情報を付加して特徴パターン
    として用いる音声認識方式において、周波数分析器のイ
    ンパルス応答波形を保持する部分を有し、該波形を音声
    認識に用いるために保持したデータの分布情報に従って
    各周波数成分のレベルを補正した後、それらの和を出力
    して可聴音となす部分を備えたことを特徴とする音声認
    識方式。 2、前記請求項1項に記載の音声認識方式を用いたこと
    を特徴とする音声認識装置。
JP10852089A 1989-04-27 1989-04-27 音声認識方式及び音声認識装置 Pending JPH02287398A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP10852089A JPH02287398A (ja) 1989-04-27 1989-04-27 音声認識方式及び音声認識装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP10852089A JPH02287398A (ja) 1989-04-27 1989-04-27 音声認識方式及び音声認識装置

Publications (1)

Publication Number Publication Date
JPH02287398A true JPH02287398A (ja) 1990-11-27

Family

ID=14486882

Family Applications (1)

Application Number Title Priority Date Filing Date
JP10852089A Pending JPH02287398A (ja) 1989-04-27 1989-04-27 音声認識方式及び音声認識装置

Country Status (1)

Country Link
JP (1) JPH02287398A (ja)

Similar Documents

Publication Publication Date Title
EP0737351B1 (en) Method and system for detecting and generating transient conditions in auditory signals
JPS5862699A (ja) 音声認識装置
JPH02287398A (ja) 音声認識方式及び音声認識装置
JPS63149699A (ja) 音声入出力装置
JPH02178698A (ja) 音声認識装置及びこれを用いた電話機
JPS59137999A (ja) 音声認識装置
JPS6194095A (ja) 音声認識装置
JPH02212898A (ja) 音声認識方式
JPH02212897A (ja) 音声認識方式
JPS5912479A (ja) 発音練習装置
JP2975808B2 (ja) 音声認識装置
JP4146949B2 (ja) 音声処理装置
JP2008286921A (ja) キーワード抽出装置、キーワード抽出方法及びそのプログラム、記録媒体
JPS6287998A (ja) 音声認識装置
JP2013228459A (ja) 音声聴取装置とその方法とプログラム
JPH0562343A (ja) 雑音除去装置
JPH02212900A (ja) 音声認識方式
JPH0331275B2 (ja)
JPH02212899A (ja) 音声認識方式
JPH06138895A (ja) 音声認識装置
JPH10307595A (ja) 入力音声抽出方法および入力音声抽出装置
JPH0416899A (ja) 音声認識装置
JPH02123398A (ja) 音声入力型シンセサイザ
JPS60198598A (ja) 音声認識方式
JPS63213897A (ja) 話者認識装置における辞書更新方式