JPH08123805A - 音声認識方法とその装置 - Google Patents

音声認識方法とその装置

Info

Publication number
JPH08123805A
JPH08123805A JP6255212A JP25521294A JPH08123805A JP H08123805 A JPH08123805 A JP H08123805A JP 6255212 A JP6255212 A JP 6255212A JP 25521294 A JP25521294 A JP 25521294A JP H08123805 A JPH08123805 A JP H08123805A
Authority
JP
Japan
Prior art keywords
sentence
constituent elements
finite state
generating
state automaton
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Withdrawn
Application number
JP6255212A
Other languages
English (en)
Inventor
Yasuhiro Komori
康弘 小森
Yasunori Ohora
恭則 大洞
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Canon Inc
Original Assignee
Canon Inc
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Canon Inc filed Critical Canon Inc
Priority to JP6255212A priority Critical patent/JPH08123805A/ja
Publication of JPH08123805A publication Critical patent/JPH08123805A/ja
Withdrawn legal-status Critical Current

Links

Landscapes

  • Machine Translation (AREA)
  • Document Processing Apparatus (AREA)

Abstract

(57)【要約】 【目的】 音声認識のための最適な認識文法構成を生成
して、その認識文法構成を利用することで誤認識の少な
い音声認識方法とその装置を提供する。 【構成】 文テンプレート生成し、前記文テンプレート
に基づき音声認識を行う音声認識方法であって、文の構
成要素を状態とする前記文の構成を記述した有限状態オ
ートマトンネットワークに基づき、前記構成要素の可能
な組み合わせの文を生成する生成工程(ステップS10
2)と、前記構成要素の可能な組み合わせの文から、文
として正しくない組み合わせの文を抽出する抽出工程
(ステップS104、S105)と、前記抽出工程で抽
出された文として正しくない組み合わせの文の中で、正
しくない構成要素間に対応する前記有限状態オートマト
ンネットワークのリンクを除去するリンク除去工程(ス
テップS106)とを備える。

Description

【発明の詳細な説明】
【0001】
【産業上の利用分野】本発明は、音声認識方法とその装
置、特に、音声認識のための音声認識文法ネットワーク
の生成方法に関するものである。
【0002】
【従来の技術】従来の音声認識のための文法定義方法
は、例えば以下に示す各文、温泉の説明を示せ。温泉を
示せ。神社の説明を示せ。
【0003】神社を示せ。を認識対象とする文法を記述
する場合には、認識処理の計算量の観点から、(温泉|
神社)[の説明]を示せ。のように示していた。ここ
で、(a|b)はaまたはb,[c]はcが省略可能を
示す。
【0004】
【発明が解決しようとする課題】しかしながら、本記述
方法は直観的にはわかりにくいという問題が生じてい
た。 また、直観的にわかりやすく文法を記述すると以
下のようになり、(温泉|神社)(の|を)[説明を]
示せ。 温泉を説明を示せ 温泉の示せ 神社を説明を示せ 神社の示せ のような非文を受け付けてしまう問題が生じており、こ
れらが誤認識を増加させる問題になっている。
【0005】一般に、音声認識においては、認識対象を
文法で記述したネットワークを用いてマッチングを行っ
ている。この文法の記述において、認識処理の観点から
は、認識対象をすべて受理し、できるだけコンパクトな
ネットワークを作成する文法を記述し、無駄な計算量を
省き、またできるだけ簡単にしかもわかりやすい単位で
文法を記述することが望まれる。
【0006】しかしながら、一般には、認識対象を全て
受理し、コンパクトなネットワークを作成する文法を記
述すると、記述が複雑でわかりにくくなったり、受理し
なくても良い認識対象をも受理してしまうことになり、
誤認識の原因になっていた。本発明は、上記従来例に鑑
みてなされたもので、音声認識のための最適な認識文法
構成を生成して、その認識文法構成を利用することで誤
認識の少ない音声認識方法とその装置を提供することを
目的とする。
【0007】
【課題を解決するための手段】上記目的を達成するた
め、本発明の画像入力方法とその装置は以下の構成を備
える。即ち、文テンプレート生成し、前記文テンプレー
トに基づき音声認識を行う音声認識方法であって、文の
構成要素を状態とする前記文の構成を記述した有限状態
オートマトンネットワークに基づき、前記構成要素の可
能な組み合わせの文を生成する生成工程と、前記構成要
素の可能な組み合わせの文から、文として正しくない組
み合わせの文を抽出する抽出工程と、前記抽出工程で抽
出された文として正しくない組み合わせの文の中で、正
しくない構成要素間に対応する前記有限状態オートマト
ンネットワークのリンクを除去するリンク除去工程とを
備える。
【0008】また、別の発明は、文テンプレート生成
し、前記文テンプレートに基づき音声認識を行う音声認
識装置であって、文の構成要素を状態とする前記文の構
成を記述した有限状態オートマトンネットワークに基づ
き、前記構成要素の可能な組み合わせの文を生成する生
成手段と、前記構成要素の可能な組み合わせの文から、
文として正しくない組み合わせの文を抽出する抽出手段
と、前記抽出手段で抽出された文として正しくない組み
合わせの文の中で、正しくない構成要素間に対応する前
記有限状態オートマトンネットワークのリンクを除去す
るリンク除去手段とを備える。
【0009】
【作用】以上の構成において、文の構成要素を状態とす
る前記文の構成を記述した有限状態オートマトンネット
ワークに基づき、前記構成要素の可能な組み合わせの文
を生成する生成工程と、前記構成要素の可能な組み合わ
せの文から、文として正しくない組み合わせの文を抽出
し、前記抽出された文として正しくない組み合わせの文
の中で、正しくない構成要素間に対応する前記有限状態
オートマトンネットワークのリンクを除去する。
【0010】また、別の発明は、抽出手段が、文の構成
要素を状態とする前記文の構成を記述した有限状態オー
トマトンネットワークに基づき、前記構成要素の可能な
組み合わせの文を生成し、前記構成要素の可能な組み合
わせの文から、文として正しくない組み合わせの文を抽
出し、前記抽出された文として正しくない組み合わせの
文の中で、正しくない構成要素間に対応する前記有限状
態オートマトンネットワークのリンクを除去する。
【0011】
【実施例】図1は、本発明に係る一実施例の音声認識処
理の流れを示す図である。以下各ステップ毎に詳細に説
明する。ステップS101では、直観で記述しやすい文
法を記述する。上述したように 、(a|b): a又はb [c] : cは省略可能 と定義すると、一文法例として、 ”(温泉|神社)(の|を)[説明 を]示せ” が記述される。同様に、本音声認識で使用する各種文法
を記述する。
【0012】尚、この記述は、例えば、BNF(Backus
-Nour form)のような形式の記述でもよい。ステップS
102では、記述された文法を空ノード(null-node)
のないネットワークで実現する。図2に、上記の一文法
に対応するネットワーク表現の一例を示す。
【0013】ステップS103では、このネットワーク
で受理可能な文を生成する。図3に上記の一文法に対応
する受理可能な文を示す。ステップS104では、ステ
ップS103で生成した受理可能な文から、意味を成す
正しい文を選択する。図3に上記の一文法に対応する意
味を成す正しい文を選択した例を示す。丸印が選択した
文である。
【0014】ステップS105では、ステップS104
で選択されなかった正しくない文に関して、接続の正し
くない位置にマークをつける。図4は、この処理の一例
を示し、接続の正しくない位置に(x)マークをつけて
いる。ステップS106では、ステップS105で接続
の正しくない位置につけられたマークに対応するリンク
をネットワークから取り除く。図5は、この処理例を示
しており、5aは、ステップS105でマークされた接
続の正しくない位置に対応するネットワークのリンク
に、xマークを付けた様子を示している。5bは、この
マークのついたリンクを削除した様子を示している。
【0015】以上説明した処理を実行することにより、
音声認識のための正しい文法ネットワークを獲得するこ
とができる。尚、ステップS103〜S106のネット
ワークの生成〜更新を全接続の正しくない部分に対し一
度に行っても、すこしづつ、逐次的に対応するネットワ
ークの生成〜更新を行ってもよい。
【0016】図6は、本実施例の音声認識装置の構成の
一例を示す図である。205は、マイクロフォンを内蔵
して音声を電気信号に変換する音声入力部、202は、
入力した音声信号と、本実施例の認識用文法ネットワー
クを生成するプログラムや、入力した音声の認識処理を
行うプログラムを格納するメモリ、201は、認識結果
などを表示するデイスプレイ、203と204はそれぞ
れ、認識用文法ネットワークのデータ生成や認識コマン
ドを入力するキーボードである。200は、音声認識装
置全体を制御するCPUであり、前述のメモリ202に
格納されたプログラムを読み出して実行する。
【0017】尚、本発明は、複数の機器から構成される
システムに適用しても、1つの機器から成る装置に適用
しても良い。また、本発明はシステム或は装置にプログ
ラムを供給することによって達成される場合にも適用で
きることはいうまでもない。以上説明したように、本実
施例の音声認識装置では、音声認識に用いられる言語処
理のネットワークの誤った部分を修正することにより、
無駄なリンクの計算も削減され、これによる誤認識も減
少し、高性能な音声認識を実現することができる。
【0018】尚、今まで音声認識に本実施例の認識用文
法ネットワークを生成方法を適用した例を示してきた
が、これは、文章パタンを入力して認識する文章認識に
も適用できることは言うまでもない。
【0019】
【発明の効果】以上説明したように本発明によれば、音
声認識のための最適な認識文法構成を生成して、その認
識文法構成を利用することで音声の誤認識を少なくする
ことができる。
【図面の簡単な説明】
【図1】本実施例の音声認識装置における認識用文法ネ
ットワークを生成する処理のフローチャートである。
【図2】認識用文法ネットワークの構成の一例を示す図
である。
【図3】認識用文法ネットワークで受理可能な文構成の
一例を示す図である。
【図4】接続の正しくない文構成の一例を示す図であ
る。
【図5】認識用文法ネットワークから接続の正しくない
リンクを削除する様子を示す図である。
【図6】本実施例の音声認識装置の構成を示す図であ
る。
───────────────────────────────────────────────────── フロントページの続き (51)Int.Cl.6 識別記号 庁内整理番号 FI 技術表示箇所 8420−5L G06F 15/38 V

Claims (8)

    【特許請求の範囲】
  1. 【請求項1】 文テンプレート生成し、前記文テンプレ
    ートに基づき音声認識を行う音声認識方法であって、 文の構成要素を状態とする前記文の構成を記述した有限
    状態オートマトンネットワークに基づき、前記構成要素
    の可能な組み合わせの文を生成する生成工程と、 前記構成要素の可能な組み合わせの文から、文として正
    しくない組み合わせの文を抽出する抽出工程と、 前記抽出工程で抽出された文として正しくない組み合わ
    せの文の中で、正しくない構成要素間に対応する前記有
    限状態オートマトンネットワークのリンクを除去するリ
    ンク除去工程とを備えることを特徴とする音声認識方
    法。
  2. 【請求項2】 前記生成工程はさらに、文をBNF(Ba
    ckus-Nour form)のような形式で記述するBNF記述工
    程と、 前記BNF記述工程で記述されたBNF形式の文に基づ
    き、文の構成要素を状態とする前記文の構成を記述した
    有限状態オートマトンネットワークを生成する有限状態
    オートマトンネットワーク生成工程とを備え、 前記有限状態オートマトンネットワーク生成工程で生成
    された有限状態オートマトンネットワークに基づき、前
    記構成要素の可能な組み合わせの文を生成することを特
    徴とする請求項1に記載の音声認識方法。
  3. 【請求項3】 前記文の構成要素は、単語を含むことを
    特徴とする請求項1に記載の音声認識方法。
  4. 【請求項4】 前記文の構成要素は、音素を含むことを
    特徴とする請求項1に記載の音声認識方法。
  5. 【請求項5】 文テンプレート生成し、前記文テンプレ
    ートに基づき音声認識を行う音声認識装置であって、 文の構成要素を状態とする前記文の構成を記述した有限
    状態オートマトンネットワークに基づき、前記構成要素
    の可能な組み合わせの文を生成する生成手段と、 前記構成要素の可能な組み合わせの文から、文として正
    しくない組み合わせの文を抽出する抽出手段と、 前記抽出手段で抽出された文として正しくない組み合わ
    せの文の中で、正しくない構成要素間に対応する前記有
    限状態オートマトンネットワークのリンクを除去するリ
    ンク除去手段とを備えることを特徴とする音声認識装
    置。
  6. 【請求項6】 前記生成手段はさらに、文をBNF(Ba
    ckus-Nour form)のような形式で記述するBNF記述手
    段と、 前記BNF記述手段で記述されたBNF形式の文に基づ
    き、文の構成要素を状態とする前記文の構成を記述した
    有限状態オートマトンネットワークを生成する有限状態
    オートマトンネットワーク生成手段とを備え、 前記有限状態オートマトンネットワーク生成手段で生成
    された有限状態オートマトンネットワークに基づき、前
    記構成要素の可能な組み合わせの文を生成することを特
    徴とする請求項5に記載の音声認識装置。
  7. 【請求項7】 前記文の構成要素は、単語を含むことを
    特徴とする請求項5に記載の音声認識装置。
  8. 【請求項8】 前記文の構成要素は、音素を含むことを
    特徴とする請求項5に記載の音声認識装置。
JP6255212A 1994-10-20 1994-10-20 音声認識方法とその装置 Withdrawn JPH08123805A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP6255212A JPH08123805A (ja) 1994-10-20 1994-10-20 音声認識方法とその装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP6255212A JPH08123805A (ja) 1994-10-20 1994-10-20 音声認識方法とその装置

Publications (1)

Publication Number Publication Date
JPH08123805A true JPH08123805A (ja) 1996-05-17

Family

ID=17275582

Family Applications (1)

Application Number Title Priority Date Filing Date
JP6255212A Withdrawn JPH08123805A (ja) 1994-10-20 1994-10-20 音声認識方法とその装置

Country Status (1)

Country Link
JP (1) JPH08123805A (ja)

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2006011271A (ja) * 2004-06-29 2006-01-12 Canon Inc 音声認識文法作成装置及びその制御方法
JP2013127677A (ja) * 2011-12-16 2013-06-27 Fujitsu Ltd テキスト編集装置、テキスト編集方法およびテキスト編集プログラム

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2006011271A (ja) * 2004-06-29 2006-01-12 Canon Inc 音声認識文法作成装置及びその制御方法
JP2013127677A (ja) * 2011-12-16 2013-06-27 Fujitsu Ltd テキスト編集装置、テキスト編集方法およびテキスト編集プログラム

Similar Documents

Publication Publication Date Title
JP2848458B2 (ja) 言語翻訳システム
US7974843B2 (en) Operating method for an automated language recognizer intended for the speaker-independent language recognition of words in different languages and automated language recognizer
EP0840288B1 (en) Method and system for editing phrases during continuous speech recognition
JP2006351028A (ja) 音声認識中に可変数の代替ワードを表示する方法及びシステム
JP2008309856A (ja) 音声認識装置及び会議システム
JPH10511196A (ja) 情報処理システム
TWI420510B (zh) 可調整記憶體使用空間之語音辨識系統與方法
JP2002132287A (ja) 音声収録方法および音声収録装置および記憶媒体
JP3104661B2 (ja) 日本語文章作成装置
US20170270923A1 (en) Voice processing device and voice processing method
JP4837887B2 (ja) ユーザ・グループに固有のパターン処理システム
JPH08123805A (ja) 音声認識方法とその装置
JP2005234236A (ja) 音声認識装置、音声認識方法、記憶媒体およびプログラム
JP4220151B2 (ja) 音声対話装置
KR100404852B1 (ko) 언어모델적응기능을가진음성인식장치및그제어방법
JP6991409B2 (ja) 情報処理装置、プログラム及び情報処理方法
JP6805431B2 (ja) 音声認識装置
JP3603008B2 (ja) 音声合成処理装置
JP2004021028A (ja) 音声対話装置及び音声対話プログラム
JP2000099084A (ja) 音声認識方法及びその装置
WO2019142447A1 (ja) 情報処理装置および情報処理方法
JP3818154B2 (ja) 音声認識方法
JPH08110790A (ja) 音声認識装置
JP2002116789A (ja) データ変換システム、データ認識システム、データ加工システム、およびプログラムを記憶した記憶媒体
JPH0654503B2 (ja) パタ−ン認識装置

Legal Events

Date Code Title Description
A300 Application deemed to be withdrawn because no request for examination was validly filed

Free format text: JAPANESE INTERMEDIATE CODE: A300

Effective date: 20020115