JP2951332B2 - 音声認識における文節候補削減方式 - Google Patents

音声認識における文節候補削減方式

Info

Publication number
JP2951332B2
JP2951332B2 JP63051252A JP5125288A JP2951332B2 JP 2951332 B2 JP2951332 B2 JP 2951332B2 JP 63051252 A JP63051252 A JP 63051252A JP 5125288 A JP5125288 A JP 5125288A JP 2951332 B2 JP2951332 B2 JP 2951332B2
Authority
JP
Japan
Prior art keywords
phrase
phoneme
word
feature
unit
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Expired - Fee Related
Application number
JP63051252A
Other languages
English (en)
Other versions
JPH01224799A (ja
Inventor
均 岩見田
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Fujitsu Ltd
Original Assignee
Fujitsu Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Fujitsu Ltd filed Critical Fujitsu Ltd
Priority to JP63051252A priority Critical patent/JP2951332B2/ja
Publication of JPH01224799A publication Critical patent/JPH01224799A/ja
Application granted granted Critical
Publication of JP2951332B2 publication Critical patent/JP2951332B2/ja
Anticipated expiration legal-status Critical
Expired - Fee Related legal-status Critical Current

Links

Description

【発明の詳細な説明】 [概要] 大語彙の文節音声認識を行う場合に認識の対象となる
有効な候補を予め選択して削減する文節音声認識におけ
る文節候補削減方式に関し、 単語辞書の単語から特徴を抽出して、単語を組み合わ
せて作成した文節における処理量を少なくする音声認識
における文節候補削減方式を提供することを目的とし、 文節を認識単位とする音声認識装置における文節候補
削減方式において,認識の対象となる全ての単語を含む
単語辞書中の各単語について,その単語を含む文節を発
声した時に現れることが確実に予想される特徴音韻を単
語特徴音韻抽出部において抽出し,単語特徴音韻抽出部
で抽出した,単語数より少ない種類の単語特徴音韻を文
節特徴音韻合成部において組み合わせて文節としての特
徴を合成し,入力音声を分析部で分析してその出力から
入力音声の特徴音韻を入力音韻抽出部により抽出し,文
節特徴音韻合成部で合成した文節特徴と,入力音韻抽出
部で抽出した入力音声の音韻に基づいて文節候補選択部
により音声認識の照合処理に有効な文節候補を選択する
よう構成する。
[産業上の利用分野] 本発明は、大語彙の文節音声認識を行う場合に認識の
対象となる有効な候補を予め選択して削減する文節音声
認識における文節候補削減方式に関する。
近年、音声認識装置は各種の用途に用いられ、文書を
音声入力により作成したり、装置への指示を音声で行う
場合等に有用である。そのような場合、単に音声を単語
単位で認識せずにより長い単位である文節により認識す
ることが望まれ、それも大語彙の文節音声を認識するこ
とが要望されている。ところが、そのためには認識対象
となる文節が膨大な量になって、認識処理に要する時間
が長くなりその改善が望まれている。
[従来の技術] 第3図に従来例の構成図を示す。
第3図に示す構成は本出願と同一の出願人が開発した
音声認識における単語候補削減装置(特願昭62−53066
号)を文節音声認識に適用した構成を示す。
図において、単語辞書30には認識の対象となる文節を
構成するすべての単語がその音韻ラベルネットワークと
ともに格納されている。音韻ラベルネットワークは、各
子音や母音を示す音韻ラベルを単語の音声を表現するよ
うに関係づけるものであり、第4図にその例を示す。第
4図には、日本語の単語(文節でもある)の“しかし”
の音韻ラベルネットワークを例示するものであり、図に
おいて“#”は単語境界、“SH"は“シ”の子音部、
“I"は無声化しない母音の“イ”、“i"は無声化した母
音の“イ”、“K"は“カ”の子音部、“A"は母音の
“ア”を示すそれぞれの音韻ラベルである。このように
ネットワーク表現を用いて無声化という音声変形現象を
表現したものである。
文節合成部31は、単語辞書30から可能なすべての文節
を合成する。
文節特徴音韻抽出部32では、各合成された文節につい
て、特徴音韻を抽出する。すなわち、各文節ごとにそれ
より確実にあらわれると事前に予想される特徴的な音韻
を抽出する。
一方、入力音声は分析部35で短時間周波数分析され短
時間スペクトル時系列データ(スペクトルパターンとい
う)を発生し、次の入力特徴音韻抽出部34では、分析部
35の出力データから特徴音韻を検出する。その特徴音韻
は、大きいパワーで発音される音韻が容易かつ確実に検
出されるので、これを特徴的な音韻として抽出し、文節
候補選択部33に供給する。
文節候補選択部33において、入力特徴音韻抽出部34で
抽出された各特徴的な音韻と文節特徴音韻抽出部32から
得られた各文節の特徴音韻との間で相関をとって、音声
認識の照合処理に有効な文節を選択する。この文節候補
選択部33における処理は各文節の特徴音韻と入力音声か
ら抽出された特徴音韻とが類似しているものを文節音声
認識の照合を行う時の候補となる文節として選択する。
なお、照合動作は入力音声のスペクトルパターンと候補
である音韻ラベルネットワークから合成したスペクトル
パターンとの類似度(または距離)を求めて最も近似す
る文節を検出して出力するものであり、その際に入力パ
ターンと照合候補となる文節の時間軸のずれの補正にDP
法(ダイナミック・プログラミング・マッチング)を利
用する照合法が高性能な処理方式として使用される。
[発明が解決しようとする課題] 上記した従来例の構成によれば、単語辞書から可能な
すべての文節を合成するので、文節数が莫大であるため
に、処理量に伴う処理時間が膨大になるという問題があ
った。
本発明は単語辞書の単語から特徴を抽出して、単語を
組み合わせて作成した文節における処理量を少なくする
音声認識における文節候補削減方式を提供することを目
的とする。
[課題を解決するための手段] 本発明の原理的構成図を第1図に示す。
第1図において、10は単語辞書、11は各単語の特徴音
韻を抽出する単語特徴音韻抽出部、12は単語を組み合わ
せてそれぞれの特徴音韻を組み合わせた文節特徴音韻合
成部、13は照合に用いる文節の候補を選択する文節候補
選択部、14は入力音声を分析した出力から音韻を抽出す
る入力音韻抽出部、15は分析部を表す。
本発明は、単語辞書の単語の特徴的な音韻を抽出し、
単語を組み合わせた文節の特徴となる音韻を単語の特徴
音韻の組み合わせにより合成して文節候補選択部に入力
し、入力音声の特徴となる音韻と比較してそれにすべて
が含まれる特徴音韻を有する文節を照合の候補として選
択する。
[作用] 第1図の単語辞書10の各単語にはそれぞれの品詞と活
用形が格納されており、単語特徴音韻抽出部11において
予めその単語を含む文節を発声した時に確実に現れると
予想される特徴的な音韻を抽出する。
各単語について特徴音韻が抽出されると、文節特徴音
韻合成部13は各単語を決められた規則により単語を組み
合わせて文節を合成した時の特徴音韻を抽出する。この
抽出は単語の特徴音韻を組み合わせることにより行われ
る。
一方、入力音声について分析部15において従来と同様
の方法で音声を分析し、その分析出力から更に入力音声
の音韻の候補を抽出する。
入力音韻抽出部14で抽出した音韻(候補を含む)と文
節特徴音韻合成部12で合成した多数の文節の特徴音韻と
が文節候補選択部13に供給され、入力音韻の候補にすべ
ての特徴音韻が含まれる文節が照合用に使用される文節
候補として選択され、含まれない特徴音韻を含む文節は
照合用の候補として採用しない。
[実施例] 本発明の実施例の構成図を第2図に示す。
第2図において、20は単語辞書、21は特徴音韻ルール
格納部、22は単語特徴音韻抽出部、23は単語特徴音韻パ
ターン保持部、24は文節モデル格納部、25は文節特徴音
韻合成部、26は文節特徴音韻パターン保持部、27は選択
部、28は文節候補生成部、29は入力音韻抽出部、40は分
析部を表す。
第2図おいて、単語辞書20には認識の対象となるすべ
ての単語を含んでいる。各単語には品詞と活用形が記述
され、単語の音韻ラベルネットワークも記述されてい
る。
単語特徴音韻抽出部22では特徴音韻ルールにしたがっ
て単語辞書の各単語について、その単語を含む文節を発
声した場合に確実に現れると予想される特徴的な音韻を
抽出する。したがって、例えば活用語尾は確実に現れる
とは限らないのでそこから特徴的な音韻は抽出されにく
い。例えば、「ARUKU(あるく)」の場合、「KU」は活
用により変化(「あるかない」のように)するので、
「ARU」から特徴音韻が抽出される。
また、例えば、単語「SHIKASHI(しかし)」の場合、
Iは無声化し発声されない場合があるのでこれは特徴的
な音韻ではなく、この単語の特徴音韻パターンは「SH,
A,SH」である。
特徴音韻ルール格納部21には特徴的音韻を抽出するた
めのルールが格納されている。(無声化して発声されな
い音韻は特徴音韻とはならない等の規則)。
こうして各単語の特徴音韻パターンが抽出されて単語
特徴音韻パターン保持部23に格納される。
次に、文節特徴音韻合成部25では文節モデル格納部24
に記述された文節モデルにしたがって、各単語の品詞情
報に基づいてその単語の特徴音韻パターンと組み合わせ
ることができる他の単語の特徴音韻パターンとを組み合
わせて、文節特徴音韻を合成する。文節モデル格納部24
の内容としては、例えば、「名詞+助詞」、「動詞+助
動詞+助詞」等である。また、文節特徴音韻合成部25の
合成は、組み合わせの対象となる単語特徴音韻パターン
保持部23を直列に接続して行う。
文節特徴音韻合成部25で合成した出力は文節特徴音韻
パターン保持部26に格納される。
入力音声は分析部40において短時間周波数分析が行わ
れ、その結果は入力音韻抽出部29に供給されて、入力音
韻候補を抽出する。ここでは、分析データに基づいて強
い音韻を検出して、音韻のパターンを作成する。例え
ば、「しかし」と発声した場合は、「(SH,S),I,(K,
T,P),A,(SH,S)」となる。ここで、括弧内はそのどち
らかをとることを意味する。
選択部27は、文節特徴音韻パターン保持部26の中の各
パターンについて、それが入力音韻抽出部29から供給さ
れた入力音声の音韻候補の中にすべて含まれているか調
べて、すべて含まれている文節特徴音韻パターンだけを
選択する。例えば、入力音声が上記の例のように「(S
H,S),I,(K,T,P),A,(SH,S)」の場合、文節特徴音韻
パターンのうち、「SH,A,SH」や「S,A,SH」などが選択
される。
文節候補生成部28は選択部27で選択された文節特徴音
韻パターンを合成している元の単語特徴音韻パターン
を、文節特徴音韻パターン保持部26を参照することによ
り検出し、さらにその単語特徴音韻パターンが得られた
元の単語を、単語特徴音韻パターン保持部23を参照する
ことにより検出する。検出された単語を合成することに
より、文節候補を生成する。
例えば、選択された文節特徴音韻パターンが「SH,A,S
H」であった場合、それを合成している単語特徴パター
ンは「SH,A,SH」だけであり、その単語特徴音韻パター
ンが得られる単語は「SHIKASHI(しかし)」や、「SHIT
ASHII(したしい)」である。さらに、そこから文節を
合成し、「SHIKASHI」、「SHTASHII(親しい)」、「SH
ITASHIKU(親しく)」などが文節候補となる。
文節候補となる各文節の情報は、認識装置の照合部に
おいて入力音声の分析データと従来技術により照合され
て認識が行われることはいうまでもない。
[発明の効果] 本発明によれば、従来のように可能な文節をすべて合
成してから文節候補を選択することなく単語のレベルで
特徴を抽出しておき、その種類を少なくしてから文節を
合成するので、選択の対象となる文節数を少なくするこ
とができ、候補選択の処理を高速化できる。
【図面の簡単な説明】
第1図は本発明の原理的構成図、第2図は本発明の実施
例の構成図、第3図は従来例の構成図、第4図は音韻ラ
ベルネットワークの説明図である。 第1図中、 10:単語辞書 11:単語特徴音韻抽出部 12:文節特徴音韻合成部 13:文節候補選択部 14:入力音韻抽出部 15:分析部
───────────────────────────────────────────────────── フロントページの続き (56)参考文献 特開 昭62−32499(JP,A) 特開 昭63−85697(JP,A) 特開 昭61−238099(JP,A) 特開 昭60−33599(JP,A) 特開 昭63−220298(JP,A) 特開 昭58−87599(JP,A) 特開 昭61−256396(JP,A) 特開 昭61−62167(JP,A) 特公 平5−67040(JP,B2) (58)調査した分野(Int.Cl.6,DB名) G10L 3/00 - 9/20

Claims (1)

    (57)【特許請求の範囲】
  1. 【請求項1】文節を認識単位とする音声認識装置におけ
    る文節候補削減方式において、 認識の対象となる全ての単語を含む単語辞書中の各単語
    について,その単語を含む文節を発声した時に現れるこ
    とが確実に予想される特徴音韻を単語特徴音韻抽出部に
    おいて抽出し, 単語特徴音韻抽出部で抽出した,単語数より少ない種類
    の単語特徴音韻を文節特徴音韻合成部において組み合わ
    せて文節としての特徴を合成し, 入力音声を分析部で分析してその出力から入力音声の特
    徴音韻を入力音韻抽出部により抽出し, 文節特徴音韻合成部で合成した文節特徴と,入力音韻抽
    出部で抽出した入力音声の音韻に基づいて文節候補選択
    部により音声認識の照合処理に有効な文節候補を選択す
    ることを特徴とする音声認識における文節候補削減方
    式。
JP63051252A 1988-03-04 1988-03-04 音声認識における文節候補削減方式 Expired - Fee Related JP2951332B2 (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP63051252A JP2951332B2 (ja) 1988-03-04 1988-03-04 音声認識における文節候補削減方式

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP63051252A JP2951332B2 (ja) 1988-03-04 1988-03-04 音声認識における文節候補削減方式

Publications (2)

Publication Number Publication Date
JPH01224799A JPH01224799A (ja) 1989-09-07
JP2951332B2 true JP2951332B2 (ja) 1999-09-20

Family

ID=12881761

Family Applications (1)

Application Number Title Priority Date Filing Date
JP63051252A Expired - Fee Related JP2951332B2 (ja) 1988-03-04 1988-03-04 音声認識における文節候補削減方式

Country Status (1)

Country Link
JP (1) JP2951332B2 (ja)

Family Cites Families (4)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS5887599A (ja) * 1981-11-20 1983-05-25 株式会社ピーエフーユー 音声単語認識装置
JPS6162167A (ja) * 1984-09-03 1986-03-31 Matsushita Electric Ind Co Ltd 日本語文章作成装置
JPS61238099A (ja) * 1985-04-15 1986-10-23 日本電信電話株式会社 単語音声認識装置
JPS61256396A (ja) * 1985-05-10 1986-11-13 株式会社日立製作所 音声認識装置

Also Published As

Publication number Publication date
JPH01224799A (ja) 1989-09-07

Similar Documents

Publication Publication Date Title
US7155390B2 (en) Speech information processing method and apparatus and storage medium using a segment pitch pattern model
US8073677B2 (en) Speech translation apparatus, method and computer readable medium for receiving a spoken language and translating to an equivalent target language
JP4302788B2 (ja) 音声合成用の基本周波数テンプレートを収容する韻律データベース
US7089186B2 (en) Speech information processing method, apparatus and storage medium performing speech synthesis based on durations of phonemes
US6510410B1 (en) Method and apparatus for recognizing tone languages using pitch information
EP0688011B1 (en) Audio output unit and method thereof
JP2815579B2 (ja) 音声認識における単語候補削減装置
KR101424193B1 (ko) 타 언어권 화자음성에 대한 음성인식 시스템의 성능 향상을위한 비직접적 데이터 기반 발음변이 모델링 시스템 및방법
Kohonen et al. Microprocessor implementation of a large vocabulary speech recognizer and phonetic typewriter for Finish and Japanese
Kayte et al. A Marathi Hidden-Markov Model Based Speech Synthesis System
Mehra et al. Improving word recognition in speech transcriptions by decision-level fusion of stemming and two-way phoneme pruning
Azim et al. Large vocabulary Arabic continuous speech recognition using tied states acoustic models
Greibus et al. The phoneme set influence for Lithuanian speech commands recognition accuracy
JP3378547B2 (ja) 音声認識方法及び装置
Azeem Designing a model for speech synthesis using HMM
JP3234371B2 (ja) 音声合成用音声持続時間処理方法及びその装置
JP3034554B2 (ja) 日本語文章読上げ装置及び方法
JP3110025B2 (ja) 発声変形検出装置
JPH01224799A (ja) 音声認識における文節候補削減方式
Sosimi et al. Standard yorubá context dependent tone identification using multi-class support vector machine (msvm)
JP2862306B2 (ja) 音声認識装置
Anandhakumar et al. Improved Adaptive Instance Normalization for StarGANv2-VC
JP2888847B2 (ja) 文章読み上げ装置とその方法及び言語処理装置とその方法
DESSAI et al. Review of syllable based text to speech systems: Strategies for enhancing naturalness for Devanagari languages
JPH1130994A (ja) 音声認識方法および装置ならびに音声認識プログラムを記録した記録媒体

Legal Events

Date Code Title Description
LAPS Cancellation because of no payment of annual fees