JPH0462595B2 - - Google Patents

Info

Publication number
JPH0462595B2
JPH0462595B2 JP59128628A JP12862884A JPH0462595B2 JP H0462595 B2 JPH0462595 B2 JP H0462595B2 JP 59128628 A JP59128628 A JP 59128628A JP 12862884 A JP12862884 A JP 12862884A JP H0462595 B2 JPH0462595 B2 JP H0462595B2
Authority
JP
Japan
Prior art keywords
distance
words
consonants
vowels
speech recognition
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Expired - Lifetime
Application number
JP59128628A
Other languages
English (en)
Other versions
JPS617890A (ja
Inventor
Yuriko Ishigaki
Yasuo Sato
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Fujitsu Ltd
Original Assignee
Fujitsu Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Fujitsu Ltd filed Critical Fujitsu Ltd
Priority to JP59128628A priority Critical patent/JPS617890A/ja
Publication of JPS617890A publication Critical patent/JPS617890A/ja
Publication of JPH0462595B2 publication Critical patent/JPH0462595B2/ja
Granted legal-status Critical Current

Links

Description

【発明の詳細な説明】 〔産業上の利用分野〕 本発明は音声認識装置に識別せしめるべき単語
の種類の決定に際して、該音声認識装置に入力さ
れることが予定される単語相互間での誤認識を生
ずることを避けるため、事前に当該する単語を認
識対象単語とすることの適否を判定するシステム
に関するものである。
〔従来の技術〕
音声認識装置における音声認識の手法は、入力
された音声信号から線形予測係数やフーリエスペ
クトル係数などの特徴パラメータを抽出して、こ
れを予め用意しておいた辞書中に収納してある単
語等の既知の特徴パラメータと比較してその距離
が近いものを選び出すことにより特定すると云う
方式が採られるのが普通である。
前記、辞書に収納される特徴パラメータは特定
話者を対象とするものと不特定話者を対象とする
ものとでは若干異なり、前者の場合、音声認識装
置を使用する特定の者が認識対象となる全単語等
について予め音声入力したものを処理して得られ
たそれぞれの単語等の特徴パラメータを辞書中に
収納しておくことにより比較的容易に目的を達せ
られるが、後者では、音声の個人差により変動を
考慮しなければならないなどの条件もあつて前も
つて多数の音声サンプルを用いて調べることによ
り、標準となるべき特徴パラメータを定めて辞書
中に格納する必要があるなど特定話者を対象とす
る場合に比して困難な条件が多い。
この様な音声認識装置において、認識対象とな
る単語の中に例えば「イチカワ」と「イシカワ」
の様に発音の似たものがあると、これらはその特
徴パラメータも似ているので、これらを辞書中に
予め登録しておいた特徴パラメータと比較すると
き誤認識を生じ易いと云う問題点があつた。特に
不特定話者を対象とする音声認識である場合に
は、音声入力の個人差による変動を考慮して判定
の際の近似の度合を決める必要があるからその幅
を広くせざるを得ず、従つて、紛らわしい単語間
の識別は非常に困難なものとなる。
従来、音声認識装置における上述の様な誤認識
の問題については、現実のシステムにおいて実際
に音声を入力して誤認識を生じ易い単語が発見さ
れたとき、これを他の単語に変えるか他の呼び方
に変えるなどの方法によつて解決していた。
〔発明が解決しようとする問題点〕
しかし、不特定話者を対象とする音声認識の場
合や、特定話者を対象とする場合であつても対象
となる単語の数が多く設定される場合には、単語
間の誤認識を完全に防止するのは容易ではなく、
認識精度の高い装置を実現するためにはデバツグ
に長時間を有すると云う問題点があつた。
本発明はかかる従来の問題点に鑑み、音声認識
装置によつて識別せしめるべき単語を定めると
き、単語間での誤認識の発生の可能性を事前に迅
速に検査することの出来る手段を提供することを
目的としている。
〔問題点を解決するための手段〕
そしてこの目的は本発明によれば特許請求の範
囲に記載のとおり、音声認識の対象となる単語を
音節文字で入力する手段を設けると共に、メモリ
内にすべての母音について他の母音との間の距離
となる数値を対応せしめたテーブルと、すべての
子音について他の子音との間の距離となる数値を
対応せしめたテーブルとを設け、音声認識の対象
となる単語の内の任意の2個の単語ごとに、単語
を構成する各音節文字を母音と子音との音素に分
解して、2個の単語間の対応する位置の文字ごと
に母音間の距離と子音間の距離とを前記テーブル
により求めて、その各々の値の和を文字間の距離
とすることにより単語間の類似性を検査すること
を特徴とする音声認識対象単語検査方式により達
成される。
〔作用〕
上記音声認識対象単語検査方式は音声認識装置
によつて認識せしめようとする単語について、そ
の音節を母音と子音とに分解し、予め用意してお
いたメモリ上のテーブルを検索することにより異
なる単語間の対応する音節の母音間および子音間
の距離を求めてこれらの和を当該音節間の距離と
成し、この様にして求めた各音節間の距離によつ
て、当該単語間の距離を検査している。そして、
検査の結果、単語間の距離が極端に小さいものに
ついては、誤認識を発生する可能性があるので、
一方の単語を変更するなどの調整を行なうことに
より、音声認識の際の誤動作の発生を未然に防止
している。
〔実施例〕
第1図は本発明の1実施例を示す機能ブロツク
図であつて、1はキーボード、2は入力制御部、
3,4はレジスタ、5は距離測定部、6はメモ
リ、7は文字と音素の対応テーブル、8は母音間
距離テーブル、9は子音間距離テーブル、10は
出力部、11はプリンタを表わしている。
第1図において、検査対象の音声認識用予定単
語をキーボード1からかな文字で入力すると、こ
れらは一応メモリ6内に格納される。このとき使
用されるかなによる表記はかな文字46音と濁音、
鼻濁音、半濁音、促音、撥音、拗音、外来語の
“スイ”、“テイ”などおよびこれらの長音274種の
中から選択された文字によつて行なわれる。
次に入力制御部2はメモリ6に格納された単誤
の中から2個を選び出してそれぞれレジスタ3お
よびレジスタ4に格納するが、このとき、入力制
御部2は文字と音素の対応テーブル7を参照して
かな表記されている各文字を音素に分解してそれ
ぞれ母音と子音の組み合わせからなる音節として
格納する。
距離測定部5はこれらの単語間の対応する音節
の母音同士、子音同士について、母音間距離テー
ブル8、子音間距離テーブル9を参照してそれぞ
れの距離を求め、1つの音節ごとにその母音間の
距離と子音間の距離の和を計算してその値を当該
音節の距離とすることにより該当する単語間の距
離を求める。
この様にしてメモリ6に格納されている各単語
のすべての組み合わせについて単語間の距離が算
出されると出力部10は予め指定されている数値
以内の値の距離である2単語をその距離の値と共
に出力する。利用者は出力された単語についてそ
の一方を変更したり呼び方を変えるなどして、メ
モリ6内に格納されている単語の内の該当するも
のを修正して再び検査をすれば良い。
第2図は音素間の距離を求めるテーブルの例を
示す図でaは母音間距離テーブルを表わしていて
第1図の8に相当し、bは子音間距離テーブルを
表わしていて第1図の9に相当する。
第2図において、同じ音素間(例えばaとa、
iとi等)は距離が0であることを示しており、
na、nb等はそれぞれ音素間の距離である数値を示
している。音素間の距離は音声学的に求めたもの
を使用するかまたは音声学的に求めた値に更に使
用する音声認識装置の特性値(音声分析の手法や
使用するフイルタの特性等により異なる)を加味
して設定した値を使用する。
〔発明の効果〕
以上詳細に説明したように本発明の方式によれ
ば、音声認識を行なうべき単語の設定に際し、予
め、単語間の距離を測定して誤認識の可能性のあ
る単語間の調整を行なうことが出来るから、認識
精度の高い音声認識システムを容易に得ることが
出来る利点があり、また音節を母音と子音とに分
解して距離を求める方式を採つているので小さな
テーブルで良い(例えば「かな」同士での距離を
求めるテーブルを作ろうとすると「かな」の表記
が前述のように274種あるのでその組み合わせが
膨大な数となるが本発明の方式では母音12種と子
音36種のそれぞれについて距離テーブルを作成し
ている)からテーブルとして必要なメモリ量は僅
少であり経済的な実現が可能であつて効果は大き
い。
【図面の簡単な説明】
第1図は本発明の1実施例を示す機能ブロツク
図、第2図は音素間の距離を求めるテーブルの例
を示す図である。 1……キーボード、2……入力制御部、3,4
……レジスタ、5……距離測定部、6……メモ
リ、7……文字と音素の対応テーブル、8……母
音間距離テーブル、9……子音間距離テーブル、
10……出力部、11……プリンタ。

Claims (1)

  1. 【特許請求の範囲】 1 音声認識の対象となる単語を音節文字で入力
    する手段を設けると共に、メモリ内にすべての母
    音について他の母音との間の距離となる数値を対
    応せしめたテーブルと、すべての子音について他
    の子音との間の距離となる数値を対応せしめたテ
    ーブルとを設け、音声認識の対象となる単語の内
    の任意の2個の単語ごとに、単語を構成する各音
    節文字を母音と子音との音素に分解して、2個の
    単語間の対応する位置の文字ごとに母音間の距離
    と子音間の距離とを前記テーブルにより求めて、
    その各々の値の和を文字間の距離とすることによ
    り単語間の類似性を検査することを特徴とする音
    声認識対象単語検査方式。 2 母音間の距離および子音間の距離であるテー
    ブル上の数値は、音声学的分析によつて求められ
    た値に音声認識を行なう特定の装置の特性値を加
    味して設定したものである特許請求の範囲第1項
    記載の音声認識対象単語検査方式。
JP59128628A 1984-06-22 1984-06-22 音声認識対象単語検査方式 Granted JPS617890A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP59128628A JPS617890A (ja) 1984-06-22 1984-06-22 音声認識対象単語検査方式

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP59128628A JPS617890A (ja) 1984-06-22 1984-06-22 音声認識対象単語検査方式

Publications (2)

Publication Number Publication Date
JPS617890A JPS617890A (ja) 1986-01-14
JPH0462595B2 true JPH0462595B2 (ja) 1992-10-06

Family

ID=14989501

Family Applications (1)

Application Number Title Priority Date Filing Date
JP59128628A Granted JPS617890A (ja) 1984-06-22 1984-06-22 音声認識対象単語検査方式

Country Status (1)

Country Link
JP (1) JPS617890A (ja)

Families Citing this family (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH067347B2 (ja) * 1985-07-25 1994-01-26 シャープ株式会社 音声認識装置
US6434521B1 (en) * 1999-06-24 2002-08-13 Speechworks International, Inc. Automatically determining words for updating in a pronunciation dictionary in a speech recognition system

Also Published As

Publication number Publication date
JPS617890A (ja) 1986-01-14

Similar Documents

Publication Publication Date Title
KR900009170B1 (ko) 규칙합성형 음성합성시스템
KR101056080B1 (ko) 음운 기반의 음성 인식 시스템 및 방법
KR960701431A (ko) 음성-대화식 언어 명령 방법 및 장치(Method and apparatus for voice-interactive language instruction)
Alotaibi Investigating spoken Arabic digits in speech recognition setting
Droua-Hamdani et al. Speaker-independent ASR for modern standard Arabic: effect of regional accents
Etman et al. American dialect identification using phonotactic and prosodic features
Randolph Syllable-based constraints on properties of English sounds
Picone et al. Automatic text alignment for speech system evaluation
Czap et al. Intensity feature for speech stress detection
JPS617890A (ja) 音声認識対象単語検査方式
Cooper et al. Grammatical control of a phonological rule: Palatalization.
Azmi et al. Syllable-based automatic arabic speech recognition in noisy-telephone channel
Alotaibi et al. A new look at the automatic mapping between Arabic distinctive phonetic features and acoustic cues
Adda-Decker et al. Pronunciation variants across systems, languages and speaking style
Wang et al. A novel method for automatic tonal and non-tonal language classification
Marshall et al. Stress and vowel duration effects on syllable recognition
Liu et al. Acoustic and phonetic confusions in accented speech recognition.
Ma et al. Context-dependent acoustic models for Chinese speech recognition
Selouani et al. Adaptation of foreign accented speakers in native Arabic ASR systems
Wang et al. Automatic Tonal and Non-Tonal Language Classification and Language Identification Using Prosodic Information.
Lee et al. Modeling cross-morpheme pronunciation variations for korean large vocabulary continuous speech recognition.
JP3299170B2 (ja) 音声登録認識装置
Pellegrini et al. Experimental detection of vowel pronunciation variants in Amharic.
JPH0574838B2 (ja)
Catanghal et al. Computer Discriminative Acoustic Tool for Reading Enhancement and Diagnostic: Development and Pilot Test

Legal Events

Date Code Title Description
EXPY Cancellation because of completion of term