JP2010020102A - 音声認識装置、音声認識方法及びコンピュータプログラム - Google Patents
音声認識装置、音声認識方法及びコンピュータプログラム Download PDFInfo
- Publication number
- JP2010020102A JP2010020102A JP2008180515A JP2008180515A JP2010020102A JP 2010020102 A JP2010020102 A JP 2010020102A JP 2008180515 A JP2008180515 A JP 2008180515A JP 2008180515 A JP2008180515 A JP 2008180515A JP 2010020102 A JP2010020102 A JP 2010020102A
- Authority
- JP
- Japan
- Prior art keywords
- word
- recognition
- rejection
- speech
- dictionary
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Images
Classifications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/08—Speech classification or search
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/02—Feature extraction for speech recognition; Selection of recognition unit
- G10L2015/025—Phonemes, fenemes or fenones being the recognition units
Landscapes
- Engineering & Computer Science (AREA)
- Computational Linguistics (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Physics & Mathematics (AREA)
- Acoustics & Sound (AREA)
- Multimedia (AREA)
- Document Processing Apparatus (AREA)
- Machine Translation (AREA)
Abstract
【解決手段】単語辞書13cに登録してある認識単語に棄却単語を付与する場合、音声分析部10aは、複数の棄却単語候補のそれぞれに対する複数の音声データのそれぞれから特徴パラメータを抽出する。音声照合部10bは、音声分析部10aによって抽出された特徴パラメータと、単語モデル生成部10cによって生成された各認識単語の単語モデルとの尤度を算出する。結果判定部10dは、各特徴パラメータに対して、尤度が最も高い単語モデルを認識結果とする。棄却単語生成部10eは、各特徴パラメータに対する認識結果に基づいて、棄却単語候補毎に、棄却単語を登録したい認識単語が認識結果であった発声数を計数し、計数した発声数が最も多い棄却単語候補を、前記認識単語に対応する棄却単語として単語辞書13cに登録する。
【選択図】図3
Description
るハードウェアによって本願に開示する音声認識装置を実現してもよい。
以下に、本願に開示する音声認識装置を、実施形態1を示す図面に基づいて詳述する。図1は実施形態1の音声認識装置の構成を示すブロック図である。本実施形態1の音声認識装置1は、例えば公知のパーソナルコンピュータであり、制御部10、ROM(Read Only Memory)11、RAM(Random Access Memory)12、ハードディスクドライバ(以下、HDDという)13、操作部14、表示部15等を備え、これらのハードウェア各部はそれぞれバス1aを介して相互に接続されている。
って読み出してHDD13に格納させてもよい。また、音声認識装置1がインターネットのようなネットワークとの接続が可能な通信部(図示せず)を備える場合には、ネットワークを介して外部の装置から各種情報をダウンロードしてHDD13に格納させてもよい。
表示部15は、液晶ディスプレイ又はCRTディスプレイ等であり、制御部10からの指示に従って、音声認識装置1の動作状態、操作部14を介して入力された情報、ユーザに対して通知すべき情報等を表示する。
者の類似度を表す尤度を算出する。音声照合部10bは、音声分析部10aから送出されてくる特徴パラメータのそれぞれについて、算出した各認識単語の単語モデルとの尤度を結果判定部10dへ送出する。結果判定部10dは、各音声信号の特徴パラメータ毎に、尤度が最も高い単語モデルを決定し、決定した単語モデルが得られる認識単語を認識結果とし、各特徴パラメータの認識結果を棄却単語生成部10eへ送出する。
上述した処理を行なうことにより、棄却単語生成部10eは、図2(a)に示す単語辞書13cから、図4に示すような単語辞書13cを生成することができる。なお、図4に示す単語辞書13cは、図2(a)に示す単語辞書13cに対して棄却単語を追加して構成されてもよく、新たな単語辞書13cとして生成されてもよい。
棄却単語の単語モデルのそれぞれとを照合し、両者の類似度を表す尤度を算出する。音声照合部10bは、認識単語及び棄却単語の単語モデルに対して算出した尤度を結果判定部10dへ送出する。
、棄却単語生成部10eは、認識単語「いち」と認識した発声数が所定数(例えば、50)以上であった全ての棄却単語候補を棄却単語として登録する構成であれば、「あいちけん」、「よっかいち」、「いちづける」の全てを認識単語「いち」の棄却単語として単語辞書13cに登録する。
以下に、実施形態2に係る音声認識装置について説明する。なお、本実施形態2の音声認識装置は、上述した実施形態1で説明した図1に示す音声認識装置1と同様の構成によって実現することができるので、同様の構成については同一の符号を付して説明を省略する。
と認識単語「おきなか」の単語モデルとの尤度のうちで、最も高い尤度の特徴パラメータを特定してRAM12に記憶させる。具体的には、結果判定部10dは、音声照合部10bから送出されてくる尤度のそれぞれを、既にRAM12に記憶されている尤度と比較する。結果判定部10dは、RAM12に記憶させた尤度よりも高い尤度を音声照合部10bから取得した場合、RAM12に記憶してある尤度及び特徴パラメータを、新たに取得した尤度及び特徴パラメータに更新する。
析部10a)は、読み出したファイル名の音声データファイルに記憶されている音声データのうちの1つを読み出し(S32)、読み出した音声データから特徴パラメータを抽出する(S33)。
制御部10は、算出した尤度が最高値であると判断した場合(S35:YES)、この尤度が得られた特徴パラメータをRAM12に記憶させる(S36)。制御部10は、算出した尤度が最高値でないと判断した場合(S35:NO)、ステップS36の処理をスキップする。
以下に、実施形態3に係る音声認識装置について説明する。なお、本実施形態3の音声認識装置は、上述した実施形態1で説明した図1に示す音声認識装置1と同様の構成によって実現することができるので、同様の構成については同一の符号を付して説明を省略する。
音声信号から特徴量を抽出する抽出手段と、複数の認識単語を記憶する単語辞書と、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力する照合手段とを備える音声認識装置において、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記照合手段は、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出し、算出した類似度が高い単語が棄却単語であるか否かを判断し、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果としないように構成してあることを特徴とする音声認識装置。
棄却単語を付加すべき認識単語に対する複数の棄却単語候補のそれぞれについて複数の音声信号を前記抽出手段に入力する手段を備え、
前記抽出手段は、入力された複数の音声信号のそれぞれから特徴量を抽出するように構成してあり、
前記照合手段は、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度に基づく認識結果を出力するように構成してあり、
前記照合手段が出力した認識結果に基づいて、それぞれの棄却単語候補毎に、前記棄却単語を付加すべき認識単語が認識結果として出力された音声信号の数を計数する計数手段と、
該計数手段が計数した数が多い棄却単語候補を、前記棄却単語を付加すべき認識単語に対する棄却単語として前記単語辞書に記憶させる登録手段と
を備えることを特徴とする付記1に記載の音声認識装置。
前記登録手段は、前記計数手段が計数した数が所定数以上である棄却単語候補を、前記
棄却単語を付加すべき認識単語に対する棄却単語として前記単語辞書に記憶させるように構成してあることを特徴とする付記2に記載の音声認識装置。
前記登録手段は、前記棄却単語候補の一部を、前記棄却単語を付加すべき認識単語に対する棄却単語として前記単語辞書に記憶させるように構成してあることを特徴とする付記2又は3に記載の音声認識装置。
棄却単語を付加すべき認識単語に対する複数の棄却単語候補のそれぞれについて複数の音声信号を前記抽出手段に入力する手段を備え、
前記抽出手段は、入力された複数の音声信号のそれぞれから特徴量を抽出するように構成してあり、
前記照合手段は、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度に基づく認識結果を出力するように構成してあり、
前記照合手段が算出した、前記棄却単語を付加すべき認識単語との類似度が高い音声信号から音響モデルを生成する手段と、
生成した音響モデルを、前記認識単語に対する棄却単語として前記単語辞書に記憶させる登録手段と
を備えることを特徴とする付記1に記載の音声認識装置。
音声信号から特徴量を抽出して記憶部に記憶する抽出手段と、複数の認識単語を記憶する単語辞書と、前記抽出手段によって前記記憶部に記憶された特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力する照合手段とを備える音声認識装置において、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記照合手段は、前記抽出手段によって前記記憶部に記憶された特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出し、算出した類似度が高い単語が棄却単語であるか否かを判断し、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果としないように構成してあることを特徴とする音声認識装置。
複数の認識単語を記憶する単語辞書を有する音声認識装置が、音声信号から特徴量を抽出し、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力する音声認識方法において、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記音声認識装置が、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出するステップと、
前記音声認識装置が、算出した類似度が高い単語が棄却単語であるか否かを判断するステップと、
前記音声認識装置が、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果としないステップと
を有することを特徴とする音声認識方法。
複数の認識単語を記憶する単語辞書を有するコンピュータに、音声信号から特徴量を抽出し、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力させるためのコンピュータプログラムにおいて、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記コンピュータに、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出させるステップと、
前記コンピュータに、算出した類似度が高い単語が棄却単語であるか否かを判断させるステップと、
前記コンピュータに、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果とさせないステップと
を有することを特徴とするコンピュータプログラム。
10 制御部
10a 音声分析部(抽出手段)
10b 音声照合部(照合手段)
10e 棄却単語生成部(計数手段、登録手段)
13 HDD
13c 単語辞書
Claims (7)
- 音声信号から特徴量を抽出する抽出手段と、複数の認識単語を記憶する単語辞書と、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力する照合手段とを備える音声認識装置において、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記照合手段は、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出し、算出した類似度が高い単語が棄却単語であるか否かを判断し、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果としないように構成してあることを特徴とする音声認識装置。 - 棄却単語を付加すべき認識単語に対する複数の棄却単語候補のそれぞれについて複数の音声信号を前記抽出手段に入力する手段を備え、
前記抽出手段は、入力された複数の音声信号のそれぞれから特徴量を抽出するように構成してあり、
前記照合手段は、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度に基づく認識結果を出力するように構成してあり、
前記照合手段が出力した認識結果に基づいて、それぞれの棄却単語候補毎に、前記棄却単語を付加すべき認識単語が認識結果として出力された音声信号の数を計数する計数手段と、
該計数手段が計数した数が多い棄却単語候補を、前記棄却単語を付加すべき認識単語に対する棄却単語として前記単語辞書に記憶させる登録手段と
を備えることを特徴とする請求項1に記載の音声認識装置。 - 前記登録手段は、前記計数手段が計数した数が所定数以上である棄却単語候補を、前記棄却単語を付加すべき認識単語に対する棄却単語として前記単語辞書に記憶させるように構成してあることを特徴とする請求項2に記載の音声認識装置。
- 前記登録手段は、前記棄却単語候補の一部を、前記棄却単語を付加すべき認識単語に対する棄却単語として前記単語辞書に記憶させるように構成してあることを特徴とする請求項2又は3に記載の音声認識装置。
- 棄却単語を付加すべき認識単語に対する複数の棄却単語候補のそれぞれについて複数の音声信号を前記抽出手段に入力する手段を備え、
前記抽出手段は、入力された複数の音声信号のそれぞれから特徴量を抽出するように構成してあり、
前記照合手段は、前記抽出手段が抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度に基づく認識結果を出力するように構成してあり、
前記照合手段が算出した、前記棄却単語を付加すべき認識単語との類似度が高い音声信号から音響モデルを生成する手段と、
生成した音響モデルを、前記認識単語に対する棄却単語として前記単語辞書に記憶させる登録手段と
を備えることを特徴とする請求項1に記載の音声認識装置。 - 複数の認識単語を記憶する単語辞書を有する音声認識装置が、音声信号から特徴量を抽
出し、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力する音声認識方法において、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記音声認識装置が、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出するステップと、
前記音声認識装置が、算出した類似度が高い単語が棄却単語であるか否かを判断するステップと、
前記音声認識装置が、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果としないステップと
を有することを特徴とする音声認識方法。 - 複数の認識単語を記憶する単語辞書を有するコンピュータに、音声信号から特徴量を抽出し、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語のそれぞれとの類似度を算出し、算出した類似度が高い認識単語を認識結果として出力させるためのコンピュータプログラムにおいて、
前記単語辞書は、前記認識単語に対応させて、該認識単語を認識結果から除外するか否かを規定する棄却単語を記憶する構成としてあり、
前記コンピュータに、抽出した特徴量を用いて前記音声信号と前記単語辞書に記憶してある認識単語及び棄却単語のそれぞれとの類似度を算出させるステップと、
前記コンピュータに、算出した類似度が高い単語が棄却単語であるか否かを判断させるステップと、
前記コンピュータに、棄却単語であると判断した場合、該棄却単語に対応して前記単語辞書に記憶してある認識単語を認識結果とさせないステップと
を有することを特徴とするコンピュータプログラム。
Priority Applications (3)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP2008180515A JP5200712B2 (ja) | 2008-07-10 | 2008-07-10 | 音声認識装置、音声認識方法及びコンピュータプログラム |
| US12/433,077 US8271282B2 (en) | 2008-07-10 | 2009-04-30 | Voice recognition apparatus, voice recognition method and recording medium |
| CN2009101369756A CN101625864B (zh) | 2008-07-10 | 2009-04-30 | 声音识别装置和声音识别方法 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP2008180515A JP5200712B2 (ja) | 2008-07-10 | 2008-07-10 | 音声認識装置、音声認識方法及びコンピュータプログラム |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JP2010020102A true JP2010020102A (ja) | 2010-01-28 |
| JP5200712B2 JP5200712B2 (ja) | 2013-06-05 |
Family
ID=41505941
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP2008180515A Expired - Fee Related JP5200712B2 (ja) | 2008-07-10 | 2008-07-10 | 音声認識装置、音声認識方法及びコンピュータプログラム |
Country Status (3)
| Country | Link |
|---|---|
| US (1) | US8271282B2 (ja) |
| JP (1) | JP5200712B2 (ja) |
| CN (1) | CN101625864B (ja) |
Cited By (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2015520410A (ja) * | 2012-04-27 | 2015-07-16 | インタラクティブ・インテリジェンス・インコーポレイテッド | 音声認識に対する負例(アンチワード)に基づく性能改善 |
| JP2019039965A (ja) * | 2017-08-22 | 2019-03-14 | アルパイン株式会社 | 音声認識システム |
Families Citing this family (14)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US8156119B2 (en) * | 2009-01-19 | 2012-04-10 | Microsoft Corporation | Smart attribute classification (SAC) for online reviews |
| JP5494468B2 (ja) * | 2010-12-27 | 2014-05-14 | 富士通株式会社 | 状態検出装置、状態検出方法および状態検出のためのプログラム |
| JP5824829B2 (ja) * | 2011-03-15 | 2015-12-02 | 富士通株式会社 | 音声認識装置、音声認識方法及び音声認識プログラム |
| JP5799733B2 (ja) * | 2011-10-12 | 2015-10-28 | 富士通株式会社 | 認識装置、認識プログラムおよび認識方法 |
| KR20140060040A (ko) | 2012-11-09 | 2014-05-19 | 삼성전자주식회사 | 디스플레이장치, 음성취득장치 및 그 음성인식방법 |
| US9886947B2 (en) * | 2013-02-25 | 2018-02-06 | Seiko Epson Corporation | Speech recognition device and method, and semiconductor integrated circuit device |
| CN104143329B (zh) * | 2013-08-19 | 2015-10-21 | 腾讯科技(深圳)有限公司 | 进行语音关键词检索的方法及装置 |
| US20180026148A1 (en) * | 2016-07-20 | 2018-01-25 | Northrop Grumman Systems Corporation | Photovoltaic solar cell with backside resonant waveguide |
| KR102596430B1 (ko) * | 2016-08-31 | 2023-10-31 | 삼성전자주식회사 | 화자 인식에 기초한 음성 인식 방법 및 장치 |
| JP6821393B2 (ja) * | 2016-10-31 | 2021-01-27 | パナソニック株式会社 | 辞書修正方法、辞書修正プログラム、音声処理装置及びロボット |
| JP6705410B2 (ja) * | 2017-03-27 | 2020-06-03 | カシオ計算機株式会社 | 音声認識装置、音声認識方法、プログラム及びロボット |
| US10572586B2 (en) * | 2018-02-27 | 2020-02-25 | International Business Machines Corporation | Technique for automatically splitting words |
| CN116723793A (zh) * | 2021-01-13 | 2023-09-08 | 豪夫迈·罗氏有限公司 | 基于语音分析的自动生理和病理评定 |
| CN113066489B (zh) * | 2021-03-16 | 2024-10-29 | 深圳地平线机器人科技有限公司 | 语音交互方法、装置、计算机可读存储介质及电子设备 |
Citations (8)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH01179198A (ja) * | 1988-01-08 | 1989-07-17 | Ricoh Co Ltd | リジェクト方式 |
| JP2002358097A (ja) * | 2001-06-01 | 2002-12-13 | Mitsubishi Electric Corp | 音声認識装置 |
| JP2002372988A (ja) * | 2001-06-14 | 2002-12-26 | Nec Corp | 認識辞書作成装置及び棄却辞書及び棄却辞書の生成方法 |
| JP2005092310A (ja) * | 2003-09-12 | 2005-04-07 | Kddi Corp | 音声キーワード認識装置 |
| JP2005196047A (ja) * | 2004-01-09 | 2005-07-21 | Canon Inc | 電子装置および入力設定方法 |
| JP2005234236A (ja) * | 2004-02-19 | 2005-09-02 | Canon Inc | 音声認識装置、音声認識方法、記憶媒体およびプログラム |
| JP3724649B2 (ja) * | 2002-11-11 | 2005-12-07 | 松下電器産業株式会社 | 音声認識用辞書作成装置および音声認識装置 |
| JP2007004052A (ja) * | 2005-06-27 | 2007-01-11 | Nissan Motor Co Ltd | 音声対話装置及び音声理解結果生成方法 |
Family Cites Families (24)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| CA2015410C (en) * | 1989-05-17 | 1996-04-02 | Chin H. Lee | Speech recognition employing key word modeling and non-key word modeling |
| JP2983364B2 (ja) | 1992-01-23 | 1999-11-29 | 沖電気工業株式会社 | 隠れマルコフモデルと音声信号との類似度計算方法 |
| JPH0776880B2 (ja) | 1993-01-13 | 1995-08-16 | 日本電気株式会社 | パターン認識方法および装置 |
| US6076054A (en) * | 1996-02-29 | 2000-06-13 | Nynex Science & Technology, Inc. | Methods and apparatus for generating and using out of vocabulary word models for speaker dependent speech recognition |
| CA2191392C (en) * | 1996-11-27 | 2002-07-16 | Vishwa Nath Gupta | Method and apparatus for reducing false rejection in a speech recognition system |
| JPH10171488A (ja) | 1996-12-11 | 1998-06-26 | Canon Inc | 音声認識方法及び装置及び記憶媒体 |
| US6016470A (en) * | 1997-11-12 | 2000-01-18 | Gte Internetworking Incorporated | Rejection grammar using selected phonemes for speech recognition system |
| US6243677B1 (en) * | 1997-11-19 | 2001-06-05 | Texas Instruments Incorporated | Method of out of vocabulary word rejection |
| US6195634B1 (en) * | 1997-12-24 | 2001-02-27 | Nortel Networks Corporation | Selection of decoys for non-vocabulary utterances rejection |
| JP3790038B2 (ja) | 1998-03-31 | 2006-06-28 | 株式会社東芝 | サブワード型不特定話者音声認識装置 |
| JP3105863B2 (ja) | 1998-04-02 | 2000-11-06 | 日本電気ロボットエンジニアリング株式会社 | 音声認識雑音除去方式 |
| JP2000020089A (ja) * | 1998-07-07 | 2000-01-21 | Matsushita Electric Ind Co Ltd | 音声認識方法及びその装置、並びに音声制御システム |
| US6192337B1 (en) * | 1998-08-14 | 2001-02-20 | International Business Machines Corporation | Apparatus and methods for rejecting confusible words during training associated with a speech recognition system |
| US7016827B1 (en) * | 1999-09-03 | 2006-03-21 | International Business Machines Corporation | Method and system for ensuring robustness in natural language understanding |
| US6778959B1 (en) * | 1999-10-21 | 2004-08-17 | Sony Corporation | System and method for speech verification using out-of-vocabulary models |
| JP2001147698A (ja) | 1999-11-22 | 2001-05-29 | Hitachi Ltd | 音声認識用疑似単語生成方法及び音声認識装置 |
| US6535850B1 (en) * | 2000-03-09 | 2003-03-18 | Conexant Systems, Inc. | Smart training and smart scoring in SD speech recognition system with user defined vocabulary |
| US7272561B2 (en) | 2000-07-13 | 2007-09-18 | Asahi Kasei Kabushiki Kaisha | Speech recognition device and speech recognition method |
| EP1215654B1 (en) * | 2000-12-13 | 2006-05-24 | Sony Deutschland GmbH | Method for recognizing speech |
| US7392188B2 (en) * | 2003-07-31 | 2008-06-24 | Telefonaktiebolaget Lm Ericsson (Publ) | System and method enabling acoustic barge-in |
| JP4301102B2 (ja) * | 2004-07-22 | 2009-07-22 | ソニー株式会社 | 音声処理装置および音声処理方法、プログラム、並びに記録媒体 |
| JP4539313B2 (ja) | 2004-12-01 | 2010-09-08 | 日本電気株式会社 | 音声認識辞書作成システム、音声認識辞書作成方法、音声認識システムおよびロボット |
| US7640160B2 (en) * | 2005-08-05 | 2009-12-29 | Voicebox Technologies, Inc. | Systems and methods for responding to natural language speech utterance |
| JP4845118B2 (ja) * | 2006-11-20 | 2011-12-28 | 富士通株式会社 | 音声認識装置、音声認識方法、および、音声認識プログラム |
-
2008
- 2008-07-10 JP JP2008180515A patent/JP5200712B2/ja not_active Expired - Fee Related
-
2009
- 2009-04-30 CN CN2009101369756A patent/CN101625864B/zh not_active Expired - Fee Related
- 2009-04-30 US US12/433,077 patent/US8271282B2/en not_active Expired - Fee Related
Patent Citations (8)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH01179198A (ja) * | 1988-01-08 | 1989-07-17 | Ricoh Co Ltd | リジェクト方式 |
| JP2002358097A (ja) * | 2001-06-01 | 2002-12-13 | Mitsubishi Electric Corp | 音声認識装置 |
| JP2002372988A (ja) * | 2001-06-14 | 2002-12-26 | Nec Corp | 認識辞書作成装置及び棄却辞書及び棄却辞書の生成方法 |
| JP3724649B2 (ja) * | 2002-11-11 | 2005-12-07 | 松下電器産業株式会社 | 音声認識用辞書作成装置および音声認識装置 |
| JP2005092310A (ja) * | 2003-09-12 | 2005-04-07 | Kddi Corp | 音声キーワード認識装置 |
| JP2005196047A (ja) * | 2004-01-09 | 2005-07-21 | Canon Inc | 電子装置および入力設定方法 |
| JP2005234236A (ja) * | 2004-02-19 | 2005-09-02 | Canon Inc | 音声認識装置、音声認識方法、記憶媒体およびプログラム |
| JP2007004052A (ja) * | 2005-06-27 | 2007-01-11 | Nissan Motor Co Ltd | 音声対話装置及び音声理解結果生成方法 |
Cited By (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2015520410A (ja) * | 2012-04-27 | 2015-07-16 | インタラクティブ・インテリジェンス・インコーポレイテッド | 音声認識に対する負例(アンチワード)に基づく性能改善 |
| JP2019039965A (ja) * | 2017-08-22 | 2019-03-14 | アルパイン株式会社 | 音声認識システム |
Also Published As
| Publication number | Publication date |
|---|---|
| CN101625864A (zh) | 2010-01-13 |
| CN101625864B (zh) | 2011-11-09 |
| JP5200712B2 (ja) | 2013-06-05 |
| US8271282B2 (en) | 2012-09-18 |
| US20100010813A1 (en) | 2010-01-14 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JP5200712B2 (ja) | 音声認識装置、音声認識方法及びコンピュータプログラム | |
| JP5957269B2 (ja) | 音声認識サーバ統合装置および音声認識サーバ統合方法 | |
| EP1936606B1 (en) | Multi-stage speech recognition | |
| EP2048655B1 (en) | Context sensitive multi-stage speech recognition | |
| CN110706714B (zh) | 说话者模型制作系统 | |
| US12462788B2 (en) | Instantaneous learning in text-to-speech during dialog | |
| EP1701338B1 (en) | Speech recognition method | |
| JP4897040B2 (ja) | 音響モデル登録装置、話者認識装置、音響モデル登録方法及び音響モデル登録処理プログラム | |
| JP5315976B2 (ja) | 音声認識装置、音声認識方法、および、プログラム | |
| JP2007047412A (ja) | 認識文法モデル作成装置、認識文法モデル作成方法、および、音声認識装置 | |
| JP2011039468A (ja) | 電子辞書で音声認識を用いた単語探索装置及びその方法 | |
| JP2001312293A (ja) | 音声認識方法およびその装置、並びにコンピュータ読み取り可能な記憶媒体 | |
| WO2006093092A1 (ja) | 会話システムおよび会話ソフトウェア | |
| JP5152020B2 (ja) | 音声認識装置及び音声認識方法 | |
| JP4749990B2 (ja) | 音声認識装置 | |
| JP2012137580A (ja) | 音声認識装置,および音声認識プログラム | |
| KR20260052323A (ko) | 호출어 인식 학습 장치 및 방법 | |
| JP3841342B2 (ja) | 音声認識装置および音声認識プログラム | |
| JP2008083165A (ja) | 音声認識処理プログラム及び音声認識処理方法 | |
| JP2008286930A (ja) | 音声対話装置 | |
| JP5152016B2 (ja) | 音声認識用辞書作成装置及び音声認識用辞書作成方法 | |
| JP2001013983A (ja) | 音声合成を用いた音声認識装置および音声認識方法 | |
| JP2000315095A (ja) | 音声認識装置、音声認識方法及び音声認識制御プログラムを記録した記録媒体 | |
| JP2014066916A (ja) | 音声合成装置 | |
| JP2008281901A (ja) | 音声対話装置 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| A621 | Written request for application examination |
Free format text: JAPANESE INTERMEDIATE CODE: A621 Effective date: 20110418 |
|
| A977 | Report on retrieval |
Free format text: JAPANESE INTERMEDIATE CODE: A971007 Effective date: 20120426 |
|
| A131 | Notification of reasons for refusal |
Free format text: JAPANESE INTERMEDIATE CODE: A131 Effective date: 20120522 |
|
| A521 | Request for written amendment filed |
Free format text: JAPANESE INTERMEDIATE CODE: A523 Effective date: 20120719 |
|
| TRDD | Decision of grant or rejection written | ||
| A01 | Written decision to grant a patent or to grant a registration (utility model) |
Free format text: JAPANESE INTERMEDIATE CODE: A01 Effective date: 20130115 |
|
| A61 | First payment of annual fees (during grant procedure) |
Free format text: JAPANESE INTERMEDIATE CODE: A61 Effective date: 20130128 |
|
| R150 | Certificate of patent or registration of utility model |
Ref document number: 5200712 Country of ref document: JP Free format text: JAPANESE INTERMEDIATE CODE: R150 Free format text: JAPANESE INTERMEDIATE CODE: R150 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20160222 Year of fee payment: 3 |
|
| LAPS | Cancellation because of no payment of annual fees |