JPS61163395A - 規則型音声認識合成装置 - Google Patents
規則型音声認識合成装置Info
- Publication number
- JPS61163395A JPS61163395A JP60004249A JP424985A JPS61163395A JP S61163395 A JPS61163395 A JP S61163395A JP 60004249 A JP60004249 A JP 60004249A JP 424985 A JP424985 A JP 424985A JP S61163395 A JPS61163395 A JP S61163395A
- Authority
- JP
- Japan
- Prior art keywords
- data
- speech
- phoneme
- phonemes
- synthesis
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
- 230000015572 biosynthetic process Effects 0.000 claims description 45
- 238000003786 synthesis reaction Methods 0.000 claims description 45
- 230000008878 coupling Effects 0.000 claims description 21
- 238000010168 coupling process Methods 0.000 claims description 21
- 238000005859 coupling reaction Methods 0.000 claims description 21
- 238000006243 chemical reaction Methods 0.000 description 6
- 238000000034 method Methods 0.000 description 5
- 230000011218 segmentation Effects 0.000 description 5
- 230000002194 synthesizing effect Effects 0.000 description 5
- 238000010586 diagram Methods 0.000 description 3
- 230000006870 function Effects 0.000 description 3
- 241000981595 Zoysia japonica Species 0.000 description 2
- 238000001914 filtration Methods 0.000 description 2
- 230000000694 effects Effects 0.000 description 1
- 239000000284 extract Substances 0.000 description 1
- 239000000203 mixture Substances 0.000 description 1
- 230000001105 regulatory effect Effects 0.000 description 1
- 238000001308 synthesis method Methods 0.000 description 1
Landscapes
- Image Processing (AREA)
- Fittings On The Vehicle Exterior For Carrying Loads, And Devices For Holding Or Mounting Articles (AREA)
- Interconnected Communication Systems, Intercoms, And Interphones (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
(産業上の利用分野)
本発明は、音声認識及び音声合成の機能を有し、音声に
より情報の入出力を行なう装置に関し、特に規則型音声
認識処理及び規則型音声合成処理を行なう規則型音声認
識合成装置に関する。
より情報の入出力を行なう装置に関し、特に規則型音声
認識処理及び規則型音声合成処理を行なう規則型音声認
識合成装置に関する。
(従来技術とその問題点)
従来入力として与えられる文字列を音素に対するホルマ
ント等の合成データおよび韻律規則等の合成規則を用い
て音声波形に変換する規則型音声合成方式が知られてい
る (例えば、D、 H,Klatt“Klattal
k Iext−to−5peach Conversi
on System″ICASSP Meeting1
982 )。また逆に入力として与えられる音声を音素
記号列等の文字列に変換する規則型音声認識方式が知ら
れている(例えば、新美康永著r音声認識」共立出版昭
和55年5月発行)。
ント等の合成データおよび韻律規則等の合成規則を用い
て音声波形に変換する規則型音声合成方式が知られてい
る (例えば、D、 H,Klatt“Klattal
k Iext−to−5peach Conversi
on System″ICASSP Meeting1
982 )。また逆に入力として与えられる音声を音素
記号列等の文字列に変換する規則型音声認識方式が知ら
れている(例えば、新美康永著r音声認識」共立出版昭
和55年5月発行)。
しかしながら、前記の規則型音声合成と音声認識の両方
を行なおうとすると、従来はそれぞれの装置を別々に用
意しなければならず規模が大きくなるという問題があっ
た。
を行なおうとすると、従来はそれぞれの装置を別々に用
意しなければならず規模が大きくなるという問題があっ
た。
そこで、本発明の目的は、規則型の音声合成と音声認識
とが行なえ、しかも比較的小規模な装置の提供にある。
とが行なえ、しかも比較的小規模な装置の提供にある。
(問題点を解決するための手段)
前述の問題点を解決するために本願の第一の発明が提供
する規則型音声認識合成装置は、音素に固有の特徴パラ
メータ値と音素間の調音結合係数とからなる共有データ
を記憶する手段と、入力として与えられる文字列を前記
共有データを用いて音声に変換する手段と、入力として
与えられる音声を前記共有データを用いて音素記号列に
変換する手段とを有することを特徴とする。
する規則型音声認識合成装置は、音素に固有の特徴パラ
メータ値と音素間の調音結合係数とからなる共有データ
を記憶する手段と、入力として与えられる文字列を前記
共有データを用いて音声に変換する手段と、入力として
与えられる音声を前記共有データを用いて音素記号列に
変換する手段とを有することを特徴とする。
同じく前述の問題点を解決するために本願の第2の発明
が提供する規則型音声認識合成装置は、音素に固有の特
徴パラメータ値と音素間の調音結合係数とからなる共有
データを記憶する手段と、韻律規則データを記憶する手
段と、入力として与えられる文字列を前記共有データと
前記韻律規則データとを用いて音声に変換する手段と、
入力として与えられる音声を前記共有データと前記韻律
規則データとを用いて音素記号列に変換する手段とを有
することを特徴とする。
が提供する規則型音声認識合成装置は、音素に固有の特
徴パラメータ値と音素間の調音結合係数とからなる共有
データを記憶する手段と、韻律規則データを記憶する手
段と、入力として与えられる文字列を前記共有データと
前記韻律規則データとを用いて音声に変換する手段と、
入力として与えられる音声を前記共有データと前記韻律
規則データとを用いて音素記号列に変換する手段とを有
することを特徴とする。
(作用)
一般に、規則的音声合成(音素列−音声変換)システム
と音素を認識単位とする音声認識(音声−音素変換)シ
ステムとでは、音素に対するホルマント周波数値(ホル
マントターゲツト値)、あるいは音素と音素とが結合す
る際にホルマントパラメータ等が変形を受ける程度を表
わす調音結合係数等共通に用いるデータが存在する0周
知の如く、規則型音声では入力音素列に従って該音素の
ホルマントターゲツト値を読み出した後に調音結合係数
に従ってホルマントターゲツト値を調整して合成パラメ
ータ値を生成する。一方、音声認識においては入力音声
から抽出されたホルマント周波数値に対して調音結合係
数を用いて調音結合による影響の補償を行なった後に、
各音素に対するホルマントターゲツト値と比較すること
により音素の認識を行なう。
と音素を認識単位とする音声認識(音声−音素変換)シ
ステムとでは、音素に対するホルマント周波数値(ホル
マントターゲツト値)、あるいは音素と音素とが結合す
る際にホルマントパラメータ等が変形を受ける程度を表
わす調音結合係数等共通に用いるデータが存在する0周
知の如く、規則型音声では入力音素列に従って該音素の
ホルマントターゲツト値を読み出した後に調音結合係数
に従ってホルマントターゲツト値を調整して合成パラメ
ータ値を生成する。一方、音声認識においては入力音声
から抽出されたホルマント周波数値に対して調音結合係
数を用いて調音結合による影響の補償を行なった後に、
各音素に対するホルマントターゲツト値と比較すること
により音素の認識を行なう。
同様に韻律パラメータである音素の時間長やピッチパラ
メータに関する制御データ(韻律規則データ)も音声認
識処理と音声合成処理で共通に用いることができるもの
が存在する。例えば各音素の時間長データは規則型音声
合成の際は当然必要であるが、音声認識においても入力
音声のセグメンテーションを行なう際に音素の時間長デ
ータを用いて音素境界の検索範囲に制限を設けることに
よりセグメンテーションの誤り率を少なくすることがで
きることは明らかである。きらに、ピッチパラメータに
関しては、ピッチパターンが単語境界等の境界あるいは
アクセント核のある時点において入力されたステップ波
形をローパスフィルタリングすることにより近似できる
ことが知られており、規則型音声合成に用いることがで
きるだけでなく、前記ローパスフィルタに対応する逆フ
ィルタを用いて入力音声から抽出きれたピッチパターン
をフィルタリングすることにより単語境界やアクセント
核位置の情報が得られ音声認識データとして用いること
ができることは明らかである。
メータに関する制御データ(韻律規則データ)も音声認
識処理と音声合成処理で共通に用いることができるもの
が存在する。例えば各音素の時間長データは規則型音声
合成の際は当然必要であるが、音声認識においても入力
音声のセグメンテーションを行なう際に音素の時間長デ
ータを用いて音素境界の検索範囲に制限を設けることに
よりセグメンテーションの誤り率を少なくすることがで
きることは明らかである。きらに、ピッチパラメータに
関しては、ピッチパターンが単語境界等の境界あるいは
アクセント核のある時点において入力されたステップ波
形をローパスフィルタリングすることにより近似できる
ことが知られており、規則型音声合成に用いることがで
きるだけでなく、前記ローパスフィルタに対応する逆フ
ィルタを用いて入力音声から抽出きれたピッチパターン
をフィルタリングすることにより単語境界やアクセント
核位置の情報が得られ音声認識データとして用いること
ができることは明らかである。
従って、前記フィルタの係数等のピッチ制御データは音
声合成および認識で共通位使用できる。
声合成および認識で共通位使用できる。
本発明は、以上に述べた事実より規則型の音声合成と音
声認識において共通に用いることのできるデータを共有
することにより、規則型の音声合成と音声認識の両方を
同一の装置で行なう規則型音声認識合成装置の小規模化
を行なうものである。
声認識において共通に用いることのできるデータを共有
することにより、規則型の音声合成と音声認識の両方を
同一の装置で行なう規則型音声認識合成装置の小規模化
を行なうものである。
(実施例)
以下、本発明の実施例について図面を参照して説明する
。
。
第1図は本願の第1の発明の一実施例を示すブロック図
である。規則型音声認識処理が行なわれる場合には、ま
ず、音声波形入力端子3を介して規則型音声認識処理部
1内の分析回路11に音声波形が入力される0分析回路
11では前記音声波形からホルマント周波数、平均振巾
値、有声無声デー夕等が抽出され分析データとしてセグ
メンテーション回路12に出力される。セグメンテーシ
ョン回路12は、前記分析データに従って音素の境界を
音素の特徴パラメータ値メモリ7に予め記憶字れている
各音素に対するホルマント周波数、振巾データ、有声無
声データを参照して検出するとともに、境界内の音素の
大分類を行ない境界データ、大分類データを前記分析デ
ータとともに調音結合補償回路13および調音結合メモ
リ8に出力する。
である。規則型音声認識処理が行なわれる場合には、ま
ず、音声波形入力端子3を介して規則型音声認識処理部
1内の分析回路11に音声波形が入力される0分析回路
11では前記音声波形からホルマント周波数、平均振巾
値、有声無声デー夕等が抽出され分析データとしてセグ
メンテーション回路12に出力される。セグメンテーシ
ョン回路12は、前記分析データに従って音素の境界を
音素の特徴パラメータ値メモリ7に予め記憶字れている
各音素に対するホルマント周波数、振巾データ、有声無
声データを参照して検出するとともに、境界内の音素の
大分類を行ない境界データ、大分類データを前記分析デ
ータとともに調音結合補償回路13および調音結合メモ
リ8に出力する。
調音結合メモリ8は、前記境界データおよび大分類デー
タにしたがって調音結合係数を調音結合補償回路13に
出力する。調音結合補償回路13は、前記分析データの
一部であるホルマント周波数値を前記境界データおよび
前記調音結合係数値に従って変更し、新ホルマントデー
タとして、前記境界データ、大分類データ、他の分析デ
ータとともに音素識別回路14に出力する。音素識別回
路14は、前記新ホルマントデータ、境界データ、大分
類データ、分析データに従い音声の特徴パラメータ値メ
モリ7より出力きれる各音素の特徴パラメータ値を比較
データとして用いることにより各境界内の音素の識別を
行ない、識別の結果である音素記号を音素記号出力端子
4から出力する。
タにしたがって調音結合係数を調音結合補償回路13に
出力する。調音結合補償回路13は、前記分析データの
一部であるホルマント周波数値を前記境界データおよび
前記調音結合係数値に従って変更し、新ホルマントデー
タとして、前記境界データ、大分類データ、他の分析デ
ータとともに音素識別回路14に出力する。音素識別回
路14は、前記新ホルマントデータ、境界データ、大分
類データ、分析データに従い音声の特徴パラメータ値メ
モリ7より出力きれる各音素の特徴パラメータ値を比較
データとして用いることにより各境界内の音素の識別を
行ない、識別の結果である音素記号を音素記号出力端子
4から出力する。
一方、規則型音声合成処理が行なわれる場合には、まず
、文字列が文字列入力端子5を介して規則型音声合成処
理部2内の音素変換回路21に入力きれる。音素変換回
路21は、前記文字列を境界記号、アクセント記号等を
含む音素記号列に変換し時間長規則回路22、音素の特
徴パラメータ値メモリ7、調音結合係数メモリ8番こ出
力する。時間長規則回路22は、前記音素記号列に従っ
て各音素に対する時間長データを生成し、前記音素記号
列とともに編集合成回路23に出力する。音素の特徴パ
ラメータ値メモリ7は、前記音素記号列に従って該音素
の特徴パラメータ値を編集合成回路23に出力する。ま
た、調音結合係数メモリ8は、前記音素記号列に従って
該調音結合係数を編集合成回路23に出力する。
、文字列が文字列入力端子5を介して規則型音声合成処
理部2内の音素変換回路21に入力きれる。音素変換回
路21は、前記文字列を境界記号、アクセント記号等を
含む音素記号列に変換し時間長規則回路22、音素の特
徴パラメータ値メモリ7、調音結合係数メモリ8番こ出
力する。時間長規則回路22は、前記音素記号列に従っ
て各音素に対する時間長データを生成し、前記音素記号
列とともに編集合成回路23に出力する。音素の特徴パ
ラメータ値メモリ7は、前記音素記号列に従って該音素
の特徴パラメータ値を編集合成回路23に出力する。ま
た、調音結合係数メモリ8は、前記音素記号列に従って
該調音結合係数を編集合成回路23に出力する。
編集合成回路23は、前記時間長データ、調音結合係数
を用いて前記音素の特徴パラメータ値を結合し合成パラ
メータ値の編集合成を行ない、前記音素記号列、時間長
データとともにピッチバタン生成回路24に出力する。
を用いて前記音素の特徴パラメータ値を結合し合成パラ
メータ値の編集合成を行ない、前記音素記号列、時間長
データとともにピッチバタン生成回路24に出力する。
ピッチバタン生成回路24は、前記音素記号列および時
間長データに従ってピッチパラメータ値を生成し、前記
合成パラメータ値とともに音声合成回路25に出力する
。音声合成回路25は、前記合成パラメータ値およびピ
ッチパラメータ値を用いて合成波形を生成し、合成波形
出力端子6を介して出力する。
間長データに従ってピッチパラメータ値を生成し、前記
合成パラメータ値とともに音声合成回路25に出力する
。音声合成回路25は、前記合成パラメータ値およびピ
ッチパラメータ値を用いて合成波形を生成し、合成波形
出力端子6を介して出力する。
第2図は本願の第2の発明の一実施例を示すブロック図
である。本実施例の第1図実施例との相違は、ピッチ規
則、時間長規則等の韻律規則に関する制御データ(韻律
規則データ)を記憶する韻律規則データメモリ9を有し
、規則型音声認識処理および規則型合成処理の両方で共
通に用いることにあり、その他の動作は第1図実施例と
同じである。
である。本実施例の第1図実施例との相違は、ピッチ規
則、時間長規則等の韻律規則に関する制御データ(韻律
規則データ)を記憶する韻律規則データメモリ9を有し
、規則型音声認識処理および規則型合成処理の両方で共
通に用いることにあり、その他の動作は第1図実施例と
同じである。
規則型音声認識処理が行なわれる場合には、まず、音声
波形入力端子3を介して規則型音声認識処理部1内の分
析回路に入力される。分析回路11では前記音声波形か
らホルマント周波数、平均振巾値、有声無声データピッ
チ周波数等が抽出され分析データとしてセグメンテーシ
ョン回路12に出力される。セグメンテーション回路1
2は、前記分析データに従って音素の境界を韻律規則デ
ータメモリから出力されるピッチ制御データおよび音素
の特徴パラメータ値メモ9番こ予め記憶されている各音
素に対するホルマント周波数、振巾データ、有声無声デ
ータを参照して検出するとともに、境界内の音素の大分
類を行ない境界データ、大分類データを前記分析データ
とともに調音結合補償回路13および調音結合メモリ8
に出力する。
波形入力端子3を介して規則型音声認識処理部1内の分
析回路に入力される。分析回路11では前記音声波形か
らホルマント周波数、平均振巾値、有声無声データピッ
チ周波数等が抽出され分析データとしてセグメンテーシ
ョン回路12に出力される。セグメンテーション回路1
2は、前記分析データに従って音素の境界を韻律規則デ
ータメモリから出力されるピッチ制御データおよび音素
の特徴パラメータ値メモ9番こ予め記憶されている各音
素に対するホルマント周波数、振巾データ、有声無声デ
ータを参照して検出するとともに、境界内の音素の大分
類を行ない境界データ、大分類データを前記分析データ
とともに調音結合補償回路13および調音結合メモリ8
に出力する。
調音結合メモリ8は、前記境界データおよび大分類デー
タに従って調音結合係数を調音結合補償回路13に出力
する。調音結合補償回路13は、前記分析データの一部
であるホルマント周波数値を前記境界データおよび前記
調音結合係数値に従って変更し、新ホルマントデータと
して、前記境界データ、大分類データ、他の分析データ
とともに音素識別回路14に出力する。音素識別回路1
4は、前2新ホルマントデータ、境界データ、大分類デ
ータ、分析データに従い、音声の特徴パラメータ値メモ
リ7より出力される各音素の特徴パラメータ値および韻
律規則データメモリ9より出力きれる各音素に対する時
間長データを比較データとして用いることにより各境界
内の音素の識別を行ない、識別結果である音素記号を音
素記号出力端子4から出力する。
タに従って調音結合係数を調音結合補償回路13に出力
する。調音結合補償回路13は、前記分析データの一部
であるホルマント周波数値を前記境界データおよび前記
調音結合係数値に従って変更し、新ホルマントデータと
して、前記境界データ、大分類データ、他の分析データ
とともに音素識別回路14に出力する。音素識別回路1
4は、前2新ホルマントデータ、境界データ、大分類デ
ータ、分析データに従い、音声の特徴パラメータ値メモ
リ7より出力される各音素の特徴パラメータ値および韻
律規則データメモリ9より出力きれる各音素に対する時
間長データを比較データとして用いることにより各境界
内の音素の識別を行ない、識別結果である音素記号を音
素記号出力端子4から出力する。
一方、規則型音声合成処理が行なわれる場合には、まず
、文字列が文字列入力端子5を介して規則型音声合成処
理部2内の音素変換回路に入力される。音素変換回路2
1は前記文字列を境界信号、アクセント記号等を含む音
素記号列に変換し時間長規則回路22、音素の特徴パラ
メータ値メモリ7、調音結合係数メモリ8に出力する0
時間長規則回路22は、前記音素記号列および韻律規則
データメモリ9より出力される該音素の時間長データに
従って各音素に対する時間長データを生成し、前記音素
記号列とともに編集合成回路23に出力する。音素の特
徴パラメータ値メモリ7は、前記音素記号列に従って音
素の特徴パラメータ値を編集合成回路23に出力する。
、文字列が文字列入力端子5を介して規則型音声合成処
理部2内の音素変換回路に入力される。音素変換回路2
1は前記文字列を境界信号、アクセント記号等を含む音
素記号列に変換し時間長規則回路22、音素の特徴パラ
メータ値メモリ7、調音結合係数メモリ8に出力する0
時間長規則回路22は、前記音素記号列および韻律規則
データメモリ9より出力される該音素の時間長データに
従って各音素に対する時間長データを生成し、前記音素
記号列とともに編集合成回路23に出力する。音素の特
徴パラメータ値メモリ7は、前記音素記号列に従って音
素の特徴パラメータ値を編集合成回路23に出力する。
また、調音結合係数メモリ8は、前記音素記号列に従っ
て該調音結合係数を編集合成回路に出力する。
て該調音結合係数を編集合成回路に出力する。
編集合成回路23は、前記時間長データ、調音結合係数
を用いて前記音素の特徴パラメータ値を結合し合成パラ
メータ値の編集合成を行ない、前記音素記号列、時間長
データとともにピッチバタン生成回路24番と出力する
。ピッチバタン生成回路24は、前記音素記号列、時間
長データおよび韻律規則データメモリ9より出力される
ピッチ制御データに従ってピッチパラメータ値を生成し
、前記合成パラメータ値とともに音声合成回路25に出
力する。音声合成回路25は、前記合成パラメータ値お
よびピッチパラメータ値を用いて合成波形を生成し、合
成波形出力端子6を介して出力する。
を用いて前記音素の特徴パラメータ値を結合し合成パラ
メータ値の編集合成を行ない、前記音素記号列、時間長
データとともにピッチバタン生成回路24番と出力する
。ピッチバタン生成回路24は、前記音素記号列、時間
長データおよび韻律規則データメモリ9より出力される
ピッチ制御データに従ってピッチパラメータ値を生成し
、前記合成パラメータ値とともに音声合成回路25に出
力する。音声合成回路25は、前記合成パラメータ値お
よびピッチパラメータ値を用いて合成波形を生成し、合
成波形出力端子6を介して出力する。
以上の実施例に於ては音声合成処理と音声認識処理を同
時には行なわないものとしたが、前記音素の特徴パラメ
ータ値メモリ7、調音結合係数メモリ8および韻律規則
データメモリ9を時分割で使用することにより、前記音
声認識処理および音声合成処理を同時に行なえる本発明
の規則型音声認識合成装置が実現できることは明らかで
ある。
時には行なわないものとしたが、前記音素の特徴パラメ
ータ値メモリ7、調音結合係数メモリ8および韻律規則
データメモリ9を時分割で使用することにより、前記音
声認識処理および音声合成処理を同時に行なえる本発明
の規則型音声認識合成装置が実現できることは明らかで
ある。
(発明の効果)
以上述べた如く、本願の第1の発明では、規制型の音声
合成と音声認識を同一の装置で行なう際に、音素に対す
る特徴パラメータ値および調音結合係数を記憶するメモ
リを規制型音声合成処理と音声認識処理とで共有するこ
とにより装置の小規模化の効果を挙げている。また、本
願の第2の発明では、特徴パラメー久値および調音結合
係数並びに韻律規則データを記憶するメモリを規制型音
声合成処理と音声認識処理とで共有することにより、装
置の小規模化の効果を同様に挙げている。
合成と音声認識を同一の装置で行なう際に、音素に対す
る特徴パラメータ値および調音結合係数を記憶するメモ
リを規制型音声合成処理と音声認識処理とで共有するこ
とにより装置の小規模化の効果を挙げている。また、本
願の第2の発明では、特徴パラメー久値および調音結合
係数並びに韻律規則データを記憶するメモリを規制型音
声合成処理と音声認識処理とで共有することにより、装
置の小規模化の効果を同様に挙げている。
第1図及び第2図は本願の第1及び第2の発明の実施例
をそれぞれ示すブロック図である。 1・・・規則型音声認識処理部、2・・・規則型音声合
成処理部、3・・・音声波形入力端子、4・・・音素記
号出力端子、5・・・文字列入力端子、6・・・合成波
形出力端子。 手続補正書(方式) 60.5.20 昭和 年 月 日 2、発明の名称 規則型音声認識合成装置 3、補正をする者 事件との関係 出願人 東京都港区芝五丁目33番1号 (423) 日本電気株式会社 代表者 関本忠弘 4、代理人 〒108東京都港区芝五丁目37番8号住友三田ビル(
連絡先 日本電気株式会社特許部) 6、補正の対象 明細書の発明の詳細な説明の欄 7、補正の内容
をそれぞれ示すブロック図である。 1・・・規則型音声認識処理部、2・・・規則型音声合
成処理部、3・・・音声波形入力端子、4・・・音素記
号出力端子、5・・・文字列入力端子、6・・・合成波
形出力端子。 手続補正書(方式) 60.5.20 昭和 年 月 日 2、発明の名称 規則型音声認識合成装置 3、補正をする者 事件との関係 出願人 東京都港区芝五丁目33番1号 (423) 日本電気株式会社 代表者 関本忠弘 4、代理人 〒108東京都港区芝五丁目37番8号住友三田ビル(
連絡先 日本電気株式会社特許部) 6、補正の対象 明細書の発明の詳細な説明の欄 7、補正の内容
Claims (2)
- (1)音素に固有の特徴パラメータ値と音素間の調音結
合係数とからなる共有データを記憶する手段と、入力と
して与えられる文字列を前記共有データを用いて音声に
変換する手段と、入力として与えられる音声を前記共有
データを用いて音素記号列に変換する手段とを有するこ
とを特徴とする規則型音声認識合成装置。 - (2)音素に固有の特徴パラメータ値と音素間の調音結
合係数とからなる共有データを記憶する手段と、韻律規
則データを記憶する手段と、入力として与えられる文字
列を前記共有データと前記韻律規則データとを用いて音
声に変換する手段と、入力として与えられる音声を前記
共有データと前記韻律規則データとを用いて音素記号列
に変換する手段とを有することを特徴とする規則型音声
認識合成装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP60004249A JPS61163395A (ja) | 1985-01-14 | 1985-01-14 | 規則型音声認識合成装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP60004249A JPS61163395A (ja) | 1985-01-14 | 1985-01-14 | 規則型音声認識合成装置 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPS61163395A true JPS61163395A (ja) | 1986-07-24 |
Family
ID=11579258
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP60004249A Pending JPS61163395A (ja) | 1985-01-14 | 1985-01-14 | 規則型音声認識合成装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS61163395A (ja) |
Citations (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5763467A (en) * | 1980-10-03 | 1982-04-16 | Seiko Instr & Electronics Ltd | Voice inputting/outputting watch |
| JPS57188100A (en) * | 1981-05-15 | 1982-11-18 | Nippon Telegraph & Telephone | Voice recognition/synthesization system |
-
1985
- 1985-01-14 JP JP60004249A patent/JPS61163395A/ja active Pending
Patent Citations (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5763467A (en) * | 1980-10-03 | 1982-04-16 | Seiko Instr & Electronics Ltd | Voice inputting/outputting watch |
| JPS57188100A (en) * | 1981-05-15 | 1982-11-18 | Nippon Telegraph & Telephone | Voice recognition/synthesization system |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| Childers et al. | Voice conversion: Factors responsible for quality | |
| JPH031200A (ja) | 規則型音声合成装置 | |
| CN117636842B (zh) | 基于韵律情感迁移的语音合成系统及方法 | |
| JP2002268660A (ja) | テキスト音声合成方法および装置 | |
| Yadav et al. | Prosodic mapping using neural networks for emotion conversion in Hindi language | |
| US7089187B2 (en) | Voice synthesizing system, segment generation apparatus for generating segments for voice synthesis, voice synthesizing method and storage medium storing program therefor | |
| JPS5827200A (ja) | 音声認識装置 | |
| Schwartz et al. | Diphone synthesis for phonetic vocoding | |
| JPH0215080B2 (ja) | ||
| Damper | Speech technology—implications for biomedical engineering | |
| Gujarathi et al. | Gaussian filter-based speech segmentation algorithm for Gujarati language | |
| US5649058A (en) | Speech synthesizing method achieved by the segmentation of the linear Formant transition region | |
| JP3622990B2 (ja) | 音声合成装置及び方法 | |
| Wong | On understanding the quality problems of LPC speech | |
| JPS5972494A (ja) | 規則合成方式 | |
| CN1629933B (zh) | 用于语音合成的设备、方法和转换器 | |
| JPS6097396A (ja) | 音声合成装置 | |
| JPS6295595A (ja) | 音声応答方式 | |
| JP2003066983A (ja) | 音声合成装置および音声合成方法、並びに、プログラム記録媒体 | |
| JPS5915996A (ja) | 音声合成装置 | |
| JPS61236597A (ja) | 規則型音声認識合成装置 | |
| JPH11224096A (ja) | 音声合成方法及び音声合成装置 | |
| JPS60144799A (ja) | 自動通訳装置 | |
| Sassi et al. | A text-to-speech system for Arabic using neural networks | |
| Shirai et al. | Pitch contour control in Japanese conversational speech |