JPH09179576A - 音声合成方法 - Google Patents
音声合成方法Info
- Publication number
- JPH09179576A JPH09179576A JP7333322A JP33332295A JPH09179576A JP H09179576 A JPH09179576 A JP H09179576A JP 7333322 A JP7333322 A JP 7333322A JP 33332295 A JP33332295 A JP 33332295A JP H09179576 A JPH09179576 A JP H09179576A
- Authority
- JP
- Japan
- Prior art keywords
- voice
- information
- unit
- synthesis
- synthesizing
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Abstract
(57)【要約】
【課題】テキスト音声合成において合成音声の声質を任
意に変更することができる音声合成方法を提供する。 【解決手段】合成単位セット記憶部13に記憶された複
数の音声合成単位の情報から選択された情報106を音
声信号生成部12で接続することによって合成音声信号
107を生成するに際し、音声入力部21から音声信号
201を入力し、この音声信号に従って音声分析部23
で複数の音声合成単位の情報204を生成して合成単位
セット記憶部13に記憶し、これを用いて合成音声信号
107を生成する。
意に変更することができる音声合成方法を提供する。 【解決手段】合成単位セット記憶部13に記憶された複
数の音声合成単位の情報から選択された情報106を音
声信号生成部12で接続することによって合成音声信号
107を生成するに際し、音声入力部21から音声信号
201を入力し、この音声信号に従って音声分析部23
で複数の音声合成単位の情報204を生成して合成単位
セット記憶部13に記憶し、これを用いて合成音声信号
107を生成する。
Description
【0001】
【発明の属する技術分野】本発明はテキスト音声合成シ
ステムにおいて、音韻記号列、ピッチおよび音韻継続時
間長などの情報から合成音声信号を生成する音声合成方
法に関する。
ステムにおいて、音韻記号列、ピッチおよび音韻継続時
間長などの情報から合成音声信号を生成する音声合成方
法に関する。
【0002】
【従来の技術】任意の文章(テキスト)から人工的に音
声信号を作り出すことをテキスト音声合成という。通
常、テキスト音声合成システムは、図12に示されるよ
うに言語処理部10、音韻処理部11および音声信号生
成部12の3つの構成要素からなる。
声信号を作り出すことをテキスト音声合成という。通
常、テキスト音声合成システムは、図12に示されるよ
うに言語処理部10、音韻処理部11および音声信号生
成部12の3つの構成要素からなる。
【0003】入力されたテキスト101は、まず言語処
理部10において形態素解析や構文解析などが行われ、
次に韻律処理部11においてアクセントやイントネーシ
ョンの処理が行われて、音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報が出
力される。最後に、音声信号生成部12において合成単
位セット記憶部13に記憶されている音節、音素および
1ピッチ区間などの基本となる小さな単位(音声合成単
位)の特徴パラメータを音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報に従
って選択し、これらをピッチや継続時間長を制御して接
続することにより合成音声信号107を生成する。
理部10において形態素解析や構文解析などが行われ、
次に韻律処理部11においてアクセントやイントネーシ
ョンの処理が行われて、音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報が出
力される。最後に、音声信号生成部12において合成単
位セット記憶部13に記憶されている音節、音素および
1ピッチ区間などの基本となる小さな単位(音声合成単
位)の特徴パラメータを音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報に従
って選択し、これらをピッチや継続時間長を制御して接
続することにより合成音声信号107を生成する。
【0004】このようにして生成される合成音声の声質
(個人性)は、主に音声合成単位である特徴パラメータ
によって決定される。このため、テキスト音声合成にお
いて複数の異なる声質の音声を合成する必要がある場合
は、図13に示されるようにそれぞれの声質に対応する
複数の合成単位セット記憶部13,14を用意し、これ
らを切替えて使用することによって異なる声質の合成音
声信号107を生成している。
(個人性)は、主に音声合成単位である特徴パラメータ
によって決定される。このため、テキスト音声合成にお
いて複数の異なる声質の音声を合成する必要がある場合
は、図13に示されるようにそれぞれの声質に対応する
複数の合成単位セット記憶部13,14を用意し、これ
らを切替えて使用することによって異なる声質の合成音
声信号107を生成している。
【0005】一方、複数の合成単位セットを記憶するこ
となく様々な声質の音声を合成する方法としては、ピッ
チパターンを変化させる方法や、合成音声信号にフィル
タをかけることによって音質を変化させる方法などがあ
る。
となく様々な声質の音声を合成する方法としては、ピッ
チパターンを変化させる方法や、合成音声信号にフィル
タをかけることによって音質を変化させる方法などがあ
る。
【0006】前者のピッチパターンを変化させる方法
は、図14に示されるように韻律処理部15にピッチ平
均値情報109を入力してピッチパターンの平均値を変
えることによって声の高さを変えたり、抑揚の大きさ情
報110を入力してピッチの変化の幅を変えることによ
って抑揚の強さを変えるものである。後者のフィルタを
用いる方法は、図15に示されるようにフィルタ特性情
報111に従って特性を制御できるフィルタ部16によ
って合成音声信号107の低域や高域を強調することで
合成音声の音質を変えるものである。
は、図14に示されるように韻律処理部15にピッチ平
均値情報109を入力してピッチパターンの平均値を変
えることによって声の高さを変えたり、抑揚の大きさ情
報110を入力してピッチの変化の幅を変えることによ
って抑揚の強さを変えるものである。後者のフィルタを
用いる方法は、図15に示されるようにフィルタ特性情
報111に従って特性を制御できるフィルタ部16によ
って合成音声信号107の低域や高域を強調することで
合成音声の音質を変えるものである。
【0007】
【発明が解決しようとする課題】上記のような従来の音
声合成方法では、任意の声質の合成音声を生成できない
という問題がある。すなわち、複数の合成単位セットを
記憶する方法では、合成単位セットの数を増やすことに
よって複数種類の声質の音声を合成することが可能とな
るが、任意の声質の音声を合成することは実質的に不可
能であり、また多数の合成単位セットを記憶することは
必要なメモリ容量が増大してコスト高となるという問題
がある。
声合成方法では、任意の声質の合成音声を生成できない
という問題がある。すなわち、複数の合成単位セットを
記憶する方法では、合成単位セットの数を増やすことに
よって複数種類の声質の音声を合成することが可能とな
るが、任意の声質の音声を合成することは実質的に不可
能であり、また多数の合成単位セットを記憶することは
必要なメモリ容量が増大してコスト高となるという問題
がある。
【0008】また、ピッチパターンを変化させる方法で
は、イントネーションやアクセントは変化しても、本質
的には合成音声の声質、すなわち個人性までも変化させ
ることはできない。フィルタによって合成音声の声質を
変化させる場合、声が明るくなる/暗くなるという程度
の変化は可能であるが、やはり個人性を変化させること
はできない。個人性の情報は、単にホルマントの振幅だ
けでなく、ホルマントの中心周波数や幅などにも存在す
るためである。
は、イントネーションやアクセントは変化しても、本質
的には合成音声の声質、すなわち個人性までも変化させ
ることはできない。フィルタによって合成音声の声質を
変化させる場合、声が明るくなる/暗くなるという程度
の変化は可能であるが、やはり個人性を変化させること
はできない。個人性の情報は、単にホルマントの振幅だ
けでなく、ホルマントの中心周波数や幅などにも存在す
るためである。
【0009】本発明は、上記の問題点を解決すべくなさ
れたもので、テキスト音声合成において合成音声の声質
を任意に変更することができる音声合成方法を提供する
ことを目的とする。
れたもので、テキスト音声合成において合成音声の声質
を任意に変更することができる音声合成方法を提供する
ことを目的とする。
【0010】
【課題を解決するための手段】上記の課題を解決するた
め、本発明は複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、音声信号および声質情報の少なく
とも一方に従って、合成音声信号の生成に必要な複数の
音声合成単位の情報を生成または加工するようにしたも
のであり、具体的には次の態様をとることを特徴とす
る。
め、本発明は複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、音声信号および声質情報の少なく
とも一方に従って、合成音声信号の生成に必要な複数の
音声合成単位の情報を生成または加工するようにしたも
のであり、具体的には次の態様をとることを特徴とす
る。
【0011】(1)音声信号を入力し、この音声信号に
従って複数の音声合成単位の情報を生成する。このよう
にして音声信号に従って生成された音声合成単位の情報
を記憶しておき、これを用いて合成音声信号を生成すれ
ば、合成音声の声質は音声信号を入力した話者の声質と
同じとなるので、話者が変わることによって合成音声の
声質が変化することになる。
従って複数の音声合成単位の情報を生成する。このよう
にして音声信号に従って生成された音声合成単位の情報
を記憶しておき、これを用いて合成音声信号を生成すれ
ば、合成音声の声質は音声信号を入力した話者の声質と
同じとなるので、話者が変わることによって合成音声の
声質が変化することになる。
【0012】(2)音声信号を入力し、この音声信号に
従って予め記憶した複数の音声合成単位の情報を加工す
る。このように既存の音声合成単位の情報を入力された
音声信号に従って加工し、これを用いて合成音声信号を
生成すれば、やはり合成音声の声質は音声信号を入力し
た話者の声質と同じとなり、話者が変わることによって
合成音声の声質が変化する。
従って予め記憶した複数の音声合成単位の情報を加工す
る。このように既存の音声合成単位の情報を入力された
音声信号に従って加工し、これを用いて合成音声信号を
生成すれば、やはり合成音声の声質は音声信号を入力し
た話者の声質と同じとなり、話者が変わることによって
合成音声の声質が変化する。
【0013】(3)声質情報を入力し、この声質情報に
従って予め記憶した複数の音声合成単位の情報を加工す
る。ここで、声質情報とは合成音声の声質を指定する情
報である。この声質情報に従って既存の音声合成単位の
情報を加工し、これを用いて合成音声信号を生成すれ
ば、合成音声の声質は声質情報に従って変化することに
なる。
従って予め記憶した複数の音声合成単位の情報を加工す
る。ここで、声質情報とは合成音声の声質を指定する情
報である。この声質情報に従って既存の音声合成単位の
情報を加工し、これを用いて合成音声信号を生成すれ
ば、合成音声の声質は声質情報に従って変化することに
なる。
【0014】(4)音声信号および声質情報を入力し、
音声信号によって複数の音声合成単位の情報を生成する
と共に、声質情報に従って複数の音声合成単位の情報を
加工する。このように音声合成単位の情報を音声信号に
従って生成した後、声質情報に従った加工を行い、これ
を用いて合成音声信号を生成すれば、合成音声の声質は
入力された音声信号および声質情報の両方に従ってさら
に多彩に変化する。
音声信号によって複数の音声合成単位の情報を生成する
と共に、声質情報に従って複数の音声合成単位の情報を
加工する。このように音声合成単位の情報を音声信号に
従って生成した後、声質情報に従った加工を行い、これ
を用いて合成音声信号を生成すれば、合成音声の声質は
入力された音声信号および声質情報の両方に従ってさら
に多彩に変化する。
【0015】(5)音声信号および声質情報を入力し、
これらの音声信号および声質情報に従って予め記憶した
複数の音声合成単位の情報を加工する。この場合も、合
成音声の声質は入力された音声信号および声質情報の両
方に従って多彩に変化することになる。
これらの音声信号および声質情報に従って予め記憶した
複数の音声合成単位の情報を加工する。この場合も、合
成音声の声質は入力された音声信号および声質情報の両
方に従って多彩に変化することになる。
【0016】(6)複数の声質情報を記憶し、この声質
情報に従って予め記憶した音声合成単位の情報を加工す
る。このようにすると、複数の声質に対応した合成単位
の情報を記憶しておく場合よりも少ないメモリ容量で、
複数種類の声質の合成音声が得られる。
情報に従って予め記憶した音声合成単位の情報を加工す
る。このようにすると、複数の声質に対応した合成単位
の情報を記憶しておく場合よりも少ないメモリ容量で、
複数種類の声質の合成音声が得られる。
【0017】(7)複数の声質情報を記憶し、これら複
数の声質情報を補間することによって生成された声質情
報に従って音声合成単位の情報を加工する。このように
すると、複数の声質情報によって与えられる複数の声質
を混ぜたような多彩な声質の合成音声が得られる。
数の声質情報を補間することによって生成された声質情
報に従って音声合成単位の情報を加工する。このように
すると、複数の声質情報によって与えられる複数の声質
を混ぜたような多彩な声質の合成音声が得られる。
【0018】本発明においては、複数の音声合成単位の
情報を加工する際に、全ての音声合成単位について行っ
てもよいが、声質の情報が主として含まれる母音を含む
音声合成単位についてのみ加工を行うようにしてもよ
い。また、音声合成単位の情報の加工は、例えば振幅の
マッピングと周波数のマッピングの少なくとも一方をス
ペクトル情報に対して行われる。
情報を加工する際に、全ての音声合成単位について行っ
てもよいが、声質の情報が主として含まれる母音を含む
音声合成単位についてのみ加工を行うようにしてもよ
い。また、音声合成単位の情報の加工は、例えば振幅の
マッピングと周波数のマッピングの少なくとも一方をス
ペクトル情報に対して行われる。
【0019】
(第1の実施形態)図1に、本発明の第1の音声合成方
法を適用した第1の実施形態に係る音声合成装置の構成
を示す。この音声合成装置は、言語処理部10、音韻処
理部11、音声信号生成部12および合成単位セット記
憶部13を有する図12に示した従来の音声合成装置
に、音声入力部21、音声認識部22および音声分析部
23が追加された構成となっている。
法を適用した第1の実施形態に係る音声合成装置の構成
を示す。この音声合成装置は、言語処理部10、音韻処
理部11、音声信号生成部12および合成単位セット記
憶部13を有する図12に示した従来の音声合成装置
に、音声入力部21、音声認識部22および音声分析部
23が追加された構成となっている。
【0020】この音声合成装置の基本動作は、従来と同
様である。すなわち、入力されたテキスト101は、ま
ず言語処理部10において形態素解析や構文解析などが
行われ、次に言語処理部10からの解析結果102に基
づき韻律処理部11においてアクセントやイントネーシ
ョンの処理が行われて、音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報が出
力される。そして、音声信号生成部12において合成単
位セット記憶部13に記憶されている音節、音素および
1ピッチ区間などの基本となる小さな単位(音声合成単
位)の特徴パラメータが音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報に従
って選択され、これらがピッチや継続時間長の制御がな
された後に接続されることにより、合成音声信号107
が生成される。
様である。すなわち、入力されたテキスト101は、ま
ず言語処理部10において形態素解析や構文解析などが
行われ、次に言語処理部10からの解析結果102に基
づき韻律処理部11においてアクセントやイントネーシ
ョンの処理が行われて、音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報が出
力される。そして、音声信号生成部12において合成単
位セット記憶部13に記憶されている音節、音素および
1ピッチ区間などの基本となる小さな単位(音声合成単
位)の特徴パラメータが音韻記号列103、音韻継続時
間長104およびピッチパターン105などの情報に従
って選択され、これらがピッチや継続時間長の制御がな
された後に接続されることにより、合成音声信号107
が生成される。
【0021】次に、本実施形態の特徴的な構成について
説明すると、まず音声入力部21は例えば話者の発生し
た音声をマイクロフォンにより電気信号に変換し、さら
に増幅などの適当な処理を経て音声信号201として出
力するように構成されるか、または外部機器から供給さ
れた音声信号をそのままあるいは適当な処理を施して入
力する構成となっている。
説明すると、まず音声入力部21は例えば話者の発生し
た音声をマイクロフォンにより電気信号に変換し、さら
に増幅などの適当な処理を経て音声信号201として出
力するように構成されるか、または外部機器から供給さ
れた音声信号をそのままあるいは適当な処理を施して入
力する構成となっている。
【0022】音声認識部22は、音声入力部21から入
力された音声信号201と音韻記号との対応付けを行う
と同時に、入力された音声信号201に対応する音韻記
号で示される音韻に対応する区間を決定して、音韻記号
202および音韻境界時刻情報203を出力する。
力された音声信号201と音韻記号との対応付けを行う
と同時に、入力された音声信号201に対応する音韻記
号で示される音韻に対応する区間を決定して、音韻記号
202および音韻境界時刻情報203を出力する。
【0023】音声分析部23は、音声認識部22から入
力される音韻境界時刻情報203と音韻記号202に従
って、音声入力部21からの音声合成単位となる区間の
音声信号201を分析して、音声合成単位の特徴パラメ
ータ204を出力する。
力される音韻境界時刻情報203と音韻記号202に従
って、音声入力部21からの音声合成単位となる区間の
音声信号201を分析して、音声合成単位の特徴パラメ
ータ204を出力する。
【0024】そして、音声分析部23から出力される特
徴パラメータ204が音声合成単位の情報として合成単
位セット記憶部13に記憶される。特徴パラメータの例
としては、LPC係数と残差波形の対などがある。ま
た、この他にもホルマントやケプストラムなどの様々な
パラメータを用いることも可能である。
徴パラメータ204が音声合成単位の情報として合成単
位セット記憶部13に記憶される。特徴パラメータの例
としては、LPC係数と残差波形の対などがある。ま
た、この他にもホルマントやケプストラムなどの様々な
パラメータを用いることも可能である。
【0025】以上のような構成の音声合成装置におい
て、本実施形態では音声入力部21により予め全ての音
声合成単位を含む音声信号201を入力して、全ての音
声合成単位の特徴パラメータを合成単位セット記憶部1
3に記憶させた後に、テキスト合成処理を行う。この場
合、合成音声信号107をスピーカにより再生して得ら
れる合成音声の声質は、合成単位セットを生成するため
に音声入力部21により入力された音声と同様の声質と
なる。合成音声の声質を変えたい場合は、目標とする声
質の話者の音声を用いて再び音声合成単位セットを生成
し直せば良い。
て、本実施形態では音声入力部21により予め全ての音
声合成単位を含む音声信号201を入力して、全ての音
声合成単位の特徴パラメータを合成単位セット記憶部1
3に記憶させた後に、テキスト合成処理を行う。この場
合、合成音声信号107をスピーカにより再生して得ら
れる合成音声の声質は、合成単位セットを生成するため
に音声入力部21により入力された音声と同様の声質と
なる。合成音声の声質を変えたい場合は、目標とする声
質の話者の音声を用いて再び音声合成単位セットを生成
し直せば良い。
【0026】このように、本実施形態によるとテキスト
音声合成において音声入力部21により音声信号を入力
する話者の声質に合わせた任意の声質の合成音声を生成
することができる。
音声合成において音声入力部21により音声信号を入力
する話者の声質に合わせた任意の声質の合成音声を生成
することができる。
【0027】(第2の実施形態)図2に、本発明の音声
合成方法を適用した第2の実施形態に係る音声合成装置
の構成を示す。図2において、図1と同じ参照番号を付
した要素は図1と同じ機能を有するものとして説明を省
略する。
合成方法を適用した第2の実施形態に係る音声合成装置
の構成を示す。図2において、図1と同じ参照番号を付
した要素は図1と同じ機能を有するものとして説明を省
略する。
【0028】本実施形態は、話者が発声すべき音韻記号
を呈示する音韻呈示部28を設け、この音韻呈示部28
により呈示された音韻記号で示される音韻を話者が発声
することによって音声入力部21から入力される音声信
号を音声分析部23に入力するようにしたものである。
音韻呈示部28は、例えば音韻記号をディスプレイで可
視表示するものであってもよいし、またスピーカを通し
て音声で呈示するものを用いることも可能である。
を呈示する音韻呈示部28を設け、この音韻呈示部28
により呈示された音韻記号で示される音韻を話者が発声
することによって音声入力部21から入力される音声信
号を音声分析部23に入力するようにしたものである。
音韻呈示部28は、例えば音韻記号をディスプレイで可
視表示するものであってもよいし、またスピーカを通し
て音声で呈示するものを用いることも可能である。
【0029】本実施形態によると、第1の実施形態と同
様の効果が得られるほか、音声分析部23では音声入力
部21から入力される音声信号の音韻が分かっているた
め、図1における音声認識部22を除いた構成とするこ
とができる。音声認識装置の認識率が現状では未だ十分
に高くないことを考えると、本実施形態は合成単位セッ
ト記憶部13に記憶する合成単位セットの信頼性を高め
る上で有効である。
様の効果が得られるほか、音声分析部23では音声入力
部21から入力される音声信号の音韻が分かっているた
め、図1における音声認識部22を除いた構成とするこ
とができる。音声認識装置の認識率が現状では未だ十分
に高くないことを考えると、本実施形態は合成単位セッ
ト記憶部13に記憶する合成単位セットの信頼性を高め
る上で有効である。
【0030】(第3の実施形態)図3に、本発明の音声
合成方法を適用した第3の実施形態に係る音声合成装置
の構成を示す。図3において、図1と同じ参照番号を付
した要素は図1と同じ機能を有するものとして説明を省
略する。
合成方法を適用した第3の実施形態に係る音声合成装置
の構成を示す。図3において、図1と同じ参照番号を付
した要素は図1と同じ機能を有するものとして説明を省
略する。
【0031】本実施形態では、図1の構成に加えてスペ
クトル比較部24、合成単位情報変換部25およびもう
一つの合成単位セット記憶部27が設けられている。第
1の合成単位セット記憶部26には予め定められた音声
合成単位の特徴パラメータが記憶されており、この特徴
パラメータを加工することによって声質を変換した特徴
パラメータが第2の合成単位セット記憶部27に記憶さ
れる。
クトル比較部24、合成単位情報変換部25およびもう
一つの合成単位セット記憶部27が設けられている。第
1の合成単位セット記憶部26には予め定められた音声
合成単位の特徴パラメータが記憶されており、この特徴
パラメータを加工することによって声質を変換した特徴
パラメータが第2の合成単位セット記憶部27に記憶さ
れる。
【0032】スペクトル比較部24は、音声入力部21
からの音声信号201を音声分析部23で分析して得ら
れる特徴パラメータ204のスペクトルパラメータのパ
ワースペクトルと、第1の合成単位セット記憶部26に
記憶されている特徴パラメータ205の中のスペクトル
パラメータのパワースペクトルとを比較して、変換パラ
メータ206を出力する。合成単位情報変換部25は、
スペクトル比較部24からの変換パラメータ206に基
づいて特徴パラメータ207を変換することにより、声
質を変換した音声合成単位の特徴パラメータ208を出
力し、これを第2の合成単位セット記憶部27に記憶す
る。
からの音声信号201を音声分析部23で分析して得ら
れる特徴パラメータ204のスペクトルパラメータのパ
ワースペクトルと、第1の合成単位セット記憶部26に
記憶されている特徴パラメータ205の中のスペクトル
パラメータのパワースペクトルとを比較して、変換パラ
メータ206を出力する。合成単位情報変換部25は、
スペクトル比較部24からの変換パラメータ206に基
づいて特徴パラメータ207を変換することにより、声
質を変換した音声合成単位の特徴パラメータ208を出
力し、これを第2の合成単位セット記憶部27に記憶す
る。
【0033】合成単位情報変換部25の処理は、例えば
スペクトルパラメータに対する周波数や振幅のマッピン
グによって実現することができる。この場合、スペクト
ル比較部24は周波数や振幅のマッピング関数を変換パ
ラメータ206として出力する。fを周波数とすると、
特徴パラメータ205の中のパワースペクトルs(f)
から特徴パラメータ204の中のパワースペクトルs′
(f)への変換は、次式で表される。
スペクトルパラメータに対する周波数や振幅のマッピン
グによって実現することができる。この場合、スペクト
ル比較部24は周波数や振幅のマッピング関数を変換パ
ラメータ206として出力する。fを周波数とすると、
特徴パラメータ205の中のパワースペクトルs(f)
から特徴パラメータ204の中のパワースペクトルs′
(f)への変換は、次式で表される。
【0034】 s′(f)=m(s(ω(f))) (1) ただし、ω( )は周波数のマッピングを表す関数であ
り、m( )は振幅のマッピングを表す関数である。
り、m( )は振幅のマッピングを表す関数である。
【0035】例えば、s(f),s′(f)が図4
(a),(b)でそれぞれ表されるとする。ここでF
1 ,F2 ,F′1 ,F′2 はホルマント周波数であり、
P1 ,P2,P′1 ,P′2 は対応するホルマントのパ
ワーである。この場合、変換パラメータ206に対応す
る周波数のマッピング関数ω( )はそれぞれF1 を
F′1に、F2 をF′2 にマッピングするような関数で
あり、振幅のマッピング関数m( )はそれぞれP1 を
P′1 に、P2 をP′2 にマッピングするような関数で
ある。これらの関数ω( )およびm( )の例を図5
(a),(b)にそれぞれ示す。
(a),(b)でそれぞれ表されるとする。ここでF
1 ,F2 ,F′1 ,F′2 はホルマント周波数であり、
P1 ,P2,P′1 ,P′2 は対応するホルマントのパ
ワーである。この場合、変換パラメータ206に対応す
る周波数のマッピング関数ω( )はそれぞれF1 を
F′1に、F2 をF′2 にマッピングするような関数で
あり、振幅のマッピング関数m( )はそれぞれP1 を
P′1 に、P2 をP′2 にマッピングするような関数で
ある。これらの関数ω( )およびm( )の例を図5
(a),(b)にそれぞれ示す。
【0036】本実施形態において、音声合成単位情報変
換部25での特徴パラメータの変換については、例えば
全ての音声合成単位について対応する変換パラメータを
求めて、各特徴パラメータ毎に異なる変換を行うことも
可能であり、また音声合成単位を幾つかのクラスに分類
して1つのクラスに対しては共通の変換パラメータを求
めて変換を行うことも可能である。例えば、複数のパワ
ースペクトルsi (f),(i=1,2,3,…,N)
を対応するパワースペクトルs′i (f),(i=1,
2,3,…,N)に変換する共通のマッピング関数ω
( ),m( )は、公知の最適化手法を用いて次式で
表される変換の誤差関数E(ω,m)を最小化すること
によって求められる。
換部25での特徴パラメータの変換については、例えば
全ての音声合成単位について対応する変換パラメータを
求めて、各特徴パラメータ毎に異なる変換を行うことも
可能であり、また音声合成単位を幾つかのクラスに分類
して1つのクラスに対しては共通の変換パラメータを求
めて変換を行うことも可能である。例えば、複数のパワ
ースペクトルsi (f),(i=1,2,3,…,N)
を対応するパワースペクトルs′i (f),(i=1,
2,3,…,N)に変換する共通のマッピング関数ω
( ),m( )は、公知の最適化手法を用いて次式で
表される変換の誤差関数E(ω,m)を最小化すること
によって求められる。
【0037】
【数1】
【0038】ただし、fsはサンプリング周波数であ
る。なお、声質の情報は主に母音に含まれるため、母音
を含む音声合成単位についてのみ特徴パラメータの変換
を行い、その他の合成単位については変換を行わずにそ
のまま用いることによって声質を変換することも可能で
ある。このようにすれば、合成単位情報変換部25での
処理量を減らすことができる。
る。なお、声質の情報は主に母音に含まれるため、母音
を含む音声合成単位についてのみ特徴パラメータの変換
を行い、その他の合成単位については変換を行わずにそ
のまま用いることによって声質を変換することも可能で
ある。このようにすれば、合成単位情報変換部25での
処理量を減らすことができる。
【0039】また、合成単位情報変換部25において次
式のような変換を行うことも可能である。 s′(f)=g(f)s(ω(f)) (3) これは、振幅の変換を関数g(f)との積で実現した例
である。
式のような変換を行うことも可能である。 s′(f)=g(f)s(ω(f)) (3) これは、振幅の変換を関数g(f)との積で実現した例
である。
【0040】本実施形態では、第1の合成単位セット記
憶部26に予め記憶されていた音声合成単位セットと、
声質を変換することによって生成され第2の合成単位セ
ット記憶部27に記憶された音声合成単位セットのいず
れも、音声信号生成部12で音声合成単位の特徴パラメ
ータ106として使用することができる。従って、合成
音声の声質を指定する声質選択情報108に従って第1
の合成単位セット記憶部26と第2の合成単位セット記
憶部27とを切り替えて用いることにより、多様な声質
で音声合成を行うことが可能である。
憶部26に予め記憶されていた音声合成単位セットと、
声質を変換することによって生成され第2の合成単位セ
ット記憶部27に記憶された音声合成単位セットのいず
れも、音声信号生成部12で音声合成単位の特徴パラメ
ータ106として使用することができる。従って、合成
音声の声質を指定する声質選択情報108に従って第1
の合成単位セット記憶部26と第2の合成単位セット記
憶部27とを切り替えて用いることにより、多様な声質
で音声合成を行うことが可能である。
【0041】また、本実施形態を第2の実施形態と同様
に音韻呈示部を設けて音声認識部を用いない構成に変形
することも可能である。 (第4の実施形態)図6に、本発明の音声合成方法を適
用した第4の実施形態に係る音声合成装置の構成を示
す。図6において、図3と同じ参照番号を付した要素は
図3と同じ機能を有するものとして説明を省略する。
に音韻呈示部を設けて音声認識部を用いない構成に変形
することも可能である。 (第4の実施形態)図6に、本発明の音声合成方法を適
用した第4の実施形態に係る音声合成装置の構成を示
す。図6において、図3と同じ参照番号を付した要素は
図3と同じ機能を有するものとして説明を省略する。
【0042】第3の実施形態では、予め声質を変換した
音声合成単位セットを作って記憶したが、本実施形態で
は声質情報を変換パラメータの形で記憶しておき、音声
合成の際、その都度特徴パラメータの変換を行って音声
信号生成部に供給するようにしたものである。
音声合成単位セットを作って記憶したが、本実施形態で
は声質情報を変換パラメータの形で記憶しておき、音声
合成の際、その都度特徴パラメータの変換を行って音声
信号生成部に供給するようにしたものである。
【0043】すなわち、本実施形態では図3における声
質を変換した音声合成単位セットを記憶するための第2
の合成単位セット記憶部27を除去し、代りに変換パラ
メータ記憶部32が設けられている。この変換パラメー
タ記憶部32は、スペクトル比較部24で得られた変換
パラメータ308を記憶しており、音声合成を行う際に
使用する音声合成単位に対応した変換パラメータ206
を出力する。合成単位情報変換部25は、この変換パラ
メータ206に基づき特徴パラメータ207を変換して
特徴パラメータ208を出力し、音声信号生成部12に
供給する。
質を変換した音声合成単位セットを記憶するための第2
の合成単位セット記憶部27を除去し、代りに変換パラ
メータ記憶部32が設けられている。この変換パラメー
タ記憶部32は、スペクトル比較部24で得られた変換
パラメータ308を記憶しており、音声合成を行う際に
使用する音声合成単位に対応した変換パラメータ206
を出力する。合成単位情報変換部25は、この変換パラ
メータ206に基づき特徴パラメータ207を変換して
特徴パラメータ208を出力し、音声信号生成部12に
供給する。
【0044】本実施形態によると、図3における声質変
換した音声合成単位を記憶する合成単位セット記憶部2
7のメモリ量より変換パラメータ記憶部32のメモリ量
が格段に小さくて済むことから、第3の実施形態と比較
して音声合成装置に必要なメモリ量を削減することがで
きる。
換した音声合成単位を記憶する合成単位セット記憶部2
7のメモリ量より変換パラメータ記憶部32のメモリ量
が格段に小さくて済むことから、第3の実施形態と比較
して音声合成装置に必要なメモリ量を削減することがで
きる。
【0045】(第5の実施形態)図7に、本発明の音声
合成方法を適用した第4の実施形態に係る音声合成装置
の構成を示す。図7において、図3と同じ参照番号を付
した要素は図3と同じ機能を有するものとして説明を省
略する。
合成方法を適用した第4の実施形態に係る音声合成装置
の構成を示す。図7において、図3と同じ参照番号を付
した要素は図3と同じ機能を有するものとして説明を省
略する。
【0046】本実施形態では、声質入力部31、変換パ
ラメータ生成部30、変換パラメータ記憶部36および
変換パラメータ入出力部37が設けられている。声質入
力部31は、ユーザが分かる尺度で合成音声の質をどの
ように変換するかを指定する声質情報301を出力す
る。ユーザが分かる尺度とは、例えば「明るい声で/暗
い声で」、「太い声で/細い声で」、「子供の声で/大
人の声で」などがあり、この他にも様々な尺度がある。
変換パラメータ生成部30は、声質情報301に従って
声質変換を行うように変換パラメータ302を生成す
る。
ラメータ生成部30、変換パラメータ記憶部36および
変換パラメータ入出力部37が設けられている。声質入
力部31は、ユーザが分かる尺度で合成音声の質をどの
ように変換するかを指定する声質情報301を出力す
る。ユーザが分かる尺度とは、例えば「明るい声で/暗
い声で」、「太い声で/細い声で」、「子供の声で/大
人の声で」などがあり、この他にも様々な尺度がある。
変換パラメータ生成部30は、声質情報301に従って
声質変換を行うように変換パラメータ302を生成す
る。
【0047】変換パラメータ記憶部36は、変換パラメ
ータ302および変換パラメータ入出力部37より入力
された変換パラメータ310を記憶し、声質選択情報3
06に従って変換パラメータ309を出力する。変換パ
ラメータ入出力部37は、記憶されている変換パラメー
タ311を外部に出力したり、あるいは外部から変換パ
ラメータ310を入力するものであり、例えば磁気記憶
装置、CD−ROMなどの記憶装置、またはネットワー
クなどとのインタフェースによって実現されるものであ
る。
ータ302および変換パラメータ入出力部37より入力
された変換パラメータ310を記憶し、声質選択情報3
06に従って変換パラメータ309を出力する。変換パ
ラメータ入出力部37は、記憶されている変換パラメー
タ311を外部に出力したり、あるいは外部から変換パ
ラメータ310を入力するものであり、例えば磁気記憶
装置、CD−ROMなどの記憶装置、またはネットワー
クなどとのインタフェースによって実現されるものであ
る。
【0048】このように本実施形態によれば、声質入力
部31からの種々の方法の指示により入力された声質情
報301に基づいて変換パラメータ生成部30で生成さ
れた変換パラメータ302を用いて所望の声質の音声を
合成することが可能であるとともに、生成された変換パ
ラメータ302を変換パラメータ記憶部36に記憶し、
外部との変換パラメータの入出力が可能な構成とするこ
とによって、生成した変換パラメータを他のユーザに提
供したり、逆に他のユーザが生成した変換パラメータを
用いて声質変換を行うことも可能である。
部31からの種々の方法の指示により入力された声質情
報301に基づいて変換パラメータ生成部30で生成さ
れた変換パラメータ302を用いて所望の声質の音声を
合成することが可能であるとともに、生成された変換パ
ラメータ302を変換パラメータ記憶部36に記憶し、
外部との変換パラメータの入出力が可能な構成とするこ
とによって、生成した変換パラメータを他のユーザに提
供したり、逆に他のユーザが生成した変換パラメータを
用いて声質変換を行うことも可能である。
【0049】(第6の実施形態)図8に、本発明の音声
合成方法を適用した第6の実施形態に係る音声合成装置
の構成を示す。図8において、図1および図7と同じ参
照番号を付した要素は図1および図7と同じ機能を有す
るものとして説明を省略する。
合成方法を適用した第6の実施形態に係る音声合成装置
の構成を示す。図8において、図1および図7と同じ参
照番号を付した要素は図1および図7と同じ機能を有す
るものとして説明を省略する。
【0050】本実施形態は、入力音声に対して声質の変
化のさせ方を指定することにより、所望の声質の合成素
片セットを生成するものである。すなわち、音声入力部
21から入力される音声信号101を音声分析部23で
分析して得られる特徴パラメータ204を合成単位情報
変換部25に入力し、声質入力部31から入力される声
質情報301に基づいて、変換パラメータ生成部30で
生成された変換パラメータ302に従って合成単位情報
変換部25で声質を変換した音声合成単位の特徴パラメ
ータ208を生成し、これを合成単位セット記憶部13
に記憶する。
化のさせ方を指定することにより、所望の声質の合成素
片セットを生成するものである。すなわち、音声入力部
21から入力される音声信号101を音声分析部23で
分析して得られる特徴パラメータ204を合成単位情報
変換部25に入力し、声質入力部31から入力される声
質情報301に基づいて、変換パラメータ生成部30で
生成された変換パラメータ302に従って合成単位情報
変換部25で声質を変換した音声合成単位の特徴パラメ
ータ208を生成し、これを合成単位セット記憶部13
に記憶する。
【0051】このように本実施形態によれば、音声合成
単位の特徴パラメータ204を音声信号201に従って
生成した後、声質情報301に従った加工を行い、これ
を用いて合成音声信号107を生成することにより、合
成音声の声質を入力された音声信号201および声質情
報301の両方に従って多彩に変化させることができ
る。
単位の特徴パラメータ204を音声信号201に従って
生成した後、声質情報301に従った加工を行い、これ
を用いて合成音声信号107を生成することにより、合
成音声の声質を入力された音声信号201および声質情
報301の両方に従って多彩に変化させることができ
る。
【0052】(第7の実施形態)図9に、本発明の音声
合成方法を適用した第7の実施形態に係る音声合成装置
の構成を示す。図9において、図2および図7と同じ参
照番号を付した要素は図2および図7と同じ機能を有す
るものとして説明を省略する。
合成方法を適用した第7の実施形態に係る音声合成装置
の構成を示す。図9において、図2および図7と同じ参
照番号を付した要素は図2および図7と同じ機能を有す
るものとして説明を省略する。
【0053】本実施形態は、第1の合成単位セット記憶
部26に予め記憶されている音声合成単位の特徴パラメ
ータ207を合成単位情報変換部25で入力された音声
信号201の声質に近くなるように変換を行った後に、
この変換された特徴パラメータ303に対して、もう一
つの合成単位情報変換部33において声質入力部31か
らの声質情報301により指定した声質変換を行うこと
によって、所望の声質の合成素片セットである特徴パラ
メータ208を生成し、第2の合成単位セット記憶部2
7に記憶するようにしたものである。従って、本実施形
態によっても第6の実施形態と同様に、合成音声の声質
を入力された音声信号201および声質情報301の両
方に従って多彩に変化させることができる。
部26に予め記憶されている音声合成単位の特徴パラメ
ータ207を合成単位情報変換部25で入力された音声
信号201の声質に近くなるように変換を行った後に、
この変換された特徴パラメータ303に対して、もう一
つの合成単位情報変換部33において声質入力部31か
らの声質情報301により指定した声質変換を行うこと
によって、所望の声質の合成素片セットである特徴パラ
メータ208を生成し、第2の合成単位セット記憶部2
7に記憶するようにしたものである。従って、本実施形
態によっても第6の実施形態と同様に、合成音声の声質
を入力された音声信号201および声質情報301の両
方に従って多彩に変化させることができる。
【0054】(第8の実施形態)図10に、本発明の音
声合成方法を適用した第8の実施形態に係る音声合成装
置の構成を示す。図10において、図3と同じ参照番号
を付した要素は図3と同じ機能を有するものとして説明
を省略する。
声合成方法を適用した第8の実施形態に係る音声合成装
置の構成を示す。図10において、図3と同じ参照番号
を付した要素は図3と同じ機能を有するものとして説明
を省略する。
【0055】変換パラメータ記憶部36は予め幾つかの
声質に対応する変換パラメータを記憶しており、声質選
択情報306に従って選択された変換パラメータ302
を出力する。本実施形態によれば、予め複数の声質に対
応する音声合成単位セットを記憶しておくよりも少ない
メモリ量で同様の声質変換を実現することができる。ま
た、本実施形態の変形として声質に対応するサンプル音
声を記憶して、それらの音声を呈示できる構成とし、声
質を選択させることも可能である。
声質に対応する変換パラメータを記憶しており、声質選
択情報306に従って選択された変換パラメータ302
を出力する。本実施形態によれば、予め複数の声質に対
応する音声合成単位セットを記憶しておくよりも少ない
メモリ量で同様の声質変換を実現することができる。ま
た、本実施形態の変形として声質に対応するサンプル音
声を記憶して、それらの音声を呈示できる構成とし、声
質を選択させることも可能である。
【0056】(第9の実施形態)図11に、本発明の音
声合成方法を適用した第9の実施形態に係る音声合成装
置の構成を示す。図11において、図10と同じ参照番
号を付した要素は図10と同じ機能を有するものとして
説明を省略する。
声合成方法を適用した第9の実施形態に係る音声合成装
置の構成を示す。図11において、図10と同じ参照番
号を付した要素は図10と同じ機能を有するものとして
説明を省略する。
【0057】変換パラメータ記憶部34は声質選択情報
305に従って複数の変換パラメータ312を選択して
出力する。変換パラメータ補間部35は、これら複数の
変換パラメータ312について重み係数307に従って
補間を行って変換パラメータ302を出力する。本実施
形態によれば、予め変換パラメータが記憶されている幾
つかの声質を任意の割合で混ぜ合わせたような声質の音
声を合成することが可能である。
305に従って複数の変換パラメータ312を選択して
出力する。変換パラメータ補間部35は、これら複数の
変換パラメータ312について重み係数307に従って
補間を行って変換パラメータ302を出力する。本実施
形態によれば、予め変換パラメータが記憶されている幾
つかの声質を任意の割合で混ぜ合わせたような声質の音
声を合成することが可能である。
【0058】
【発明の効果】以上説明したように、本発明の音声合成
方法によれば、音声信号や声質情報を入力し、音声信号
の声質と同様の声質の音声、あるいは声質情報で指定さ
れた声質の音声を合成することが可能であり、テキスト
音声合成において合成音声の声質を任意に変更すること
ができる。
方法によれば、音声信号や声質情報を入力し、音声信号
の声質と同様の声質の音声、あるいは声質情報で指定さ
れた声質の音声を合成することが可能であり、テキスト
音声合成において合成音声の声質を任意に変更すること
ができる。
【図1】本発明の第1の実施形態に係る音声合成装置の
構成を示すブロック図
構成を示すブロック図
【図2】本発明の第2の実施形態に係る音声合成装置の
構成を示すブロック図
構成を示すブロック図
【図3】本発明の第3の実施形態に係る音声合成装置の
構成を示すブロック図
構成を示すブロック図
【図4】同実施形態における入力音声を分析して得られ
る特徴パラメータおよび記憶されている特徴パラメータ
中のスペクトルのパワースペクトルの例を示す図
る特徴パラメータおよび記憶されている特徴パラメータ
中のスペクトルのパワースペクトルの例を示す図
【図5】同実施形態における変換パラメータに対応する
周波数および振幅のマッピング関数の例を示す図
周波数および振幅のマッピング関数の例を示す図
【図6】本発明の第4の実施形態に係る音声合成装置の
構成を示すブロック図
構成を示すブロック図
【図7】本発明の第5の実施形態に係る音声合成装置の
構成を示すブロック図のブロック図
構成を示すブロック図のブロック図
【図8】本発明の第6の実施形態に係る音声合成装置の
構成を示すブロック図のブロック図
構成を示すブロック図のブロック図
【図9】本発明の第7の実施形態に係る音声合成装置の
構成を示すブロック図のブロック図
構成を示すブロック図のブロック図
【図10】本発明の第8の実施形態に係る音声合成装置
の構成を示すブロック図のブロック図
の構成を示すブロック図のブロック図
【図11】本発明の第9の実施形態に係る音声合成装置
の構成を示すブロック図のブロック図
の構成を示すブロック図のブロック図
【図12】従来の音声合成装置の構成を示すブロック図
【図13】従来の複数の音声合成単位セットを記憶する
ことによって合成音声の声質を変える音声合成装置の構
成を示すブロック図
ことによって合成音声の声質を変える音声合成装置の構
成を示すブロック図
【図14】従来のピッチパターンを変化させることによ
って合成音声の声質を変える音声合成装置の構成を示す
ブロック図
って合成音声の声質を変える音声合成装置の構成を示す
ブロック図
【図15】従来のフィルタによって声質を変える音声合
成装置の構成を示すブロック図
成装置の構成を示すブロック図
10…言語処理部 11…韻律処理部 12…音声信号生成部 13,14…合成単位セット記憶部 15…韻律処理部 16…フィルタ部 21…音声入力部 22…音声認識部 23…音声分析部 24…スペクトル比較部 25…合成単位情報変換部 26,27…合成単位セット記憶部 28…音韻呈示部 30…変換パラメータ生成部 31…音声入力部 32…変換パラメータ記憶部 33…合成単位情報変換部 34…変換パラメータ記憶部 35…変換パラメータ補間部 36…変換パラメータ記憶部 37…変換パラメータ入出力部 101…入力テキスト 102…解析データ 103…音韻記号列 104…音韻継続時間長 105…ピッチパターン 106…音声合成単位の特徴パラメータ 107…合成音声信号 108…声質変換情報 201…音声信号 202…音韻記号 203…音韻境界時刻情報 204,205…特徴パラメータ 206…変換パラメータ 207,208…特徴パラメータ 301…声質情報 302…変換パラメータ 303…特徴パラメータ 305,306…声質選択情報 307…重み係数 308,309,310,311,312…変換パラメ
ータ
ータ
───────────────────────────────────────────────────── フロントページの続き (72)発明者 押切 正浩 神奈川県川崎市幸区小向東芝町1番地 株 式会社東芝研究開発センター内 (72)発明者 天田 皇 神奈川県川崎市幸区小向東芝町1番地 株 式会社東芝研究開発センター内 (72)発明者 山下 明延 神奈川県川崎市幸区小向東芝町1番地 株 式会社東芝研究開発センター内
Claims (7)
- 【請求項1】複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、 音声信号を入力し、この音声信号に従って複数の音声合
成単位の情報を生成することを特徴とする音声合成方
法。 - 【請求項2】複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、 音声信号を入力し、この音声信号に従って予め記憶した
複数の音声合成単位の情報を加工することを特徴とする
音声合成方法。 - 【請求項3】複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、 声質情報を入力し、この声質情報に従って予め記憶した
複数の音声合成単位の情報を加工することを特徴とする
音声合成方法。 - 【請求項4】複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、 音声信号および声質情報を入力し、前記音声信号によっ
て複数の音声合成単位の情報を生成すると共に、前記声
質情報に従って複数の音声合成単位の情報を加工するこ
とを特徴とする音声合成方法。 - 【請求項5】複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、 音声信号および声質情報を入力し、これらの音声信号お
よび声質情報に従って予め記憶した複数の音声合成単位
の情報を加工することを特徴とする音声合成方法。 - 【請求項6】複数の音声合成単位の情報から選択された
情報を接続することによって合成音声信号を生成する音
声合成方法において、 複数の声質情報を記憶し、この声質情報に従って予め記
憶した音声合成単位の情報を加工することを特徴とする
音声合成方法。 - 【請求項7】記憶した複数の音声合成単位の情報から選
択された情報を接続することによって合成音声信号を生
成する音声合成方法において、 複数の声質情報を記憶し、これら複数の声質情報を補間
することによって生成された声質情報に従って音声合成
単位の情報を加工することを特徴とする音声合成方法。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7333322A JPH09179576A (ja) | 1995-12-21 | 1995-12-21 | 音声合成方法 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7333322A JPH09179576A (ja) | 1995-12-21 | 1995-12-21 | 音声合成方法 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH09179576A true JPH09179576A (ja) | 1997-07-11 |
Family
ID=18264820
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP7333322A Pending JPH09179576A (ja) | 1995-12-21 | 1995-12-21 | 音声合成方法 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH09179576A (ja) |
Cited By (6)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2001209400A (ja) * | 2000-01-24 | 2001-08-03 | Denso Corp | 音声合成装置及び音声案内システム |
| JP2006301059A (ja) * | 2005-04-18 | 2006-11-02 | Denso Corp | 音声出力システム |
| JP2010032978A (ja) * | 2008-07-31 | 2010-02-12 | Hitachi Ltd | 音声メッセージ作成装置及び方法 |
| JP2020160341A (ja) * | 2019-03-27 | 2020-10-01 | ダイコク電機株式会社 | 動画出力システム |
| JP2020161121A (ja) * | 2019-03-27 | 2020-10-01 | ダイコク電機株式会社 | 動画出力システム |
| CN115691466A (zh) * | 2022-09-07 | 2023-02-03 | 问问智能信息科技有限公司 | 语音合成方法、装置、电子设备和存储介质 |
-
1995
- 1995-12-21 JP JP7333322A patent/JPH09179576A/ja active Pending
Cited By (6)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2001209400A (ja) * | 2000-01-24 | 2001-08-03 | Denso Corp | 音声合成装置及び音声案内システム |
| JP2006301059A (ja) * | 2005-04-18 | 2006-11-02 | Denso Corp | 音声出力システム |
| JP2010032978A (ja) * | 2008-07-31 | 2010-02-12 | Hitachi Ltd | 音声メッセージ作成装置及び方法 |
| JP2020160341A (ja) * | 2019-03-27 | 2020-10-01 | ダイコク電機株式会社 | 動画出力システム |
| JP2020161121A (ja) * | 2019-03-27 | 2020-10-01 | ダイコク電機株式会社 | 動画出力システム |
| CN115691466A (zh) * | 2022-09-07 | 2023-02-03 | 问问智能信息科技有限公司 | 语音合成方法、装置、电子设备和存储介质 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US8195464B2 (en) | Speech processing apparatus and program | |
| JPH031200A (ja) | 規則型音声合成装置 | |
| US20190130894A1 (en) | Text-based insertion and replacement in audio narration | |
| JPH08110789A (ja) | 波形の連結及び部分的重複化による音声合成方法 | |
| US20020049594A1 (en) | Speech synthesis | |
| Takano et al. | A Japanese TTS system based on multiform units and a speech modification algorithm with harmonics reconstruction | |
| JP3281266B2 (ja) | 音声合成方法及び装置 | |
| JP2001242882A (ja) | 音声合成方法及び音声合成装置 | |
| KR101016978B1 (ko) | 소리 신호 합성 방법, 컴퓨터 판독가능 저장 매체 및 컴퓨터 시스템 | |
| JP5175422B2 (ja) | 音声合成における時間幅を制御する方法 | |
| JP4451665B2 (ja) | 音声を合成する方法 | |
| US7130799B1 (en) | Speech synthesis method | |
| JP2001034284A (ja) | 音声合成方法及び装置、並びに文音声変換プログラムを記録した記録媒体 | |
| JP3081300B2 (ja) | 残差駆動型音声合成装置 | |
| JP3394281B2 (ja) | 音声合成方式および規則合成装置 | |
| JPH05281984A (ja) | 音声合成方法および装置 | |
| JPH11109992A (ja) | 音声素片データベースの作成方法、音声合成方法、音声素片データベース、音声素片データベース作成装置および音声合成装置 | |
| JP2987089B2 (ja) | 音声素片作成方法および音声合成方法とその装置 | |
| JP2577372B2 (ja) | 音声合成装置および方法 | |
| JP3241582B2 (ja) | 韻律制御装置及び方法 | |
| JP2703253B2 (ja) | 音声合成装置 | |
| JP2008058379A (ja) | 音声合成システム及びフィルタ装置 | |
| KR20060027645A (ko) | 감정정보 음색변환 장치 및 그 방법 | |
| JP2956936B2 (ja) | 音声合成装置の発声速度制御回路 | |
| JP3310217B2 (ja) | 音声合成方法とその装置 |