JPS6186799A - 音声合成装置 - Google Patents

音声合成装置

Info

Publication number
JPS6186799A
JPS6186799A JP20702584A JP20702584A JPS6186799A JP S6186799 A JPS6186799 A JP S6186799A JP 20702584 A JP20702584 A JP 20702584A JP 20702584 A JP20702584 A JP 20702584A JP S6186799 A JPS6186799 A JP S6186799A
Authority
JP
Japan
Prior art keywords
word
memory
data
word data
utterance
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP20702584A
Other languages
English (en)
Inventor
奥埜 一幸
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Toshiba Tec Corp
Original Assignee
Tokyo Electric Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Tokyo Electric Co Ltd filed Critical Tokyo Electric Co Ltd
Priority to JP20702584A priority Critical patent/JPS6186799A/ja
Publication of JPS6186799A publication Critical patent/JPS6186799A/ja
Pending legal-status Critical Current

Links

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 [産業上の利用分野] 本発明は入力された文書データを構成する各単語データ
をシンセサイザにて音声信号に変換して発声させる音声
合成装置に係わり、特に、必要に応じて隣接する単語デ
ータを連続発声できる音声合成装置に関する。
[従来の技術] 伝送路を介して外部から入力された英語等の文書データ
をシンセサイザにて音声信号へ変換してスピーカからこ
の文書デ;りに対応す音声を発声させる音声合成装置は
、例えば次のように構成されている。すなわち、各単語
データ毎にこの単語データに対応する発声周波数値、音
声波形の周波数成分値、各周波数の継続時間値等の音声
分析データを記憶する音声メモリがROM等の記憶部に
形成されている。また、入力した文書データを各単語デ
ータ間に介挿されたスペース記号等を利用して各単語デ
ータに分解し、この単語データに対応する音声分析デー
タを前記単語メモリから順次読出し次のシンセサイザに
送出する1チツプのマイクロコンピュータ等で構成され
た音声制御部が設けられている。そして、シンセサイザ
は、各単語データの音声分析データが入力されると、こ
の音声分析データの上述した多値に基づいて実際の音声
信号を合成してスピーカへ送出する。すると、スピーカ
から入力した文書データに対応する音声が発声される。
[発明が解決しようとする問題点] しかしながら、上記のように構成された音声合成装置に
おいては次のような問題があった。すなわち、一般に上
記音声制御部は1つの単語データに対する音声発声の終
了を各音声分析データの最後に付加された終了信号を検
出することによって判断している。そして、この終了信
号を検出した時刻から一定のポーズ時間が経過した後、
次の単語データの処理を開始する。したがって、第9図
(a)に示すように、3個の単語データが連続した場合
、発声された各単語間に上述のポーズ時間Toが生じる
。このポーズ時間Toは通常の言葉を発声している場合
は各単語を聞き分けるために不可欠である。
しかし、例えば数字等の合成単語を発音する場合は上記
ポーズ時fllTaが存在すると反対に聞きずらく、言
葉が不自然になる。具体例を示すと、第9図(b)に示
すように[the  fortyone]を発声させる
と、[the]と[f。
rty]との間の他に[forty]と[one]との
間にポーズ時間Toが挿入されることになる。
なお、上記の問題を回避するためには、数字等の全ての
合成単語に対して1つの単語として音声分析データを算
出して前述の音声メモリに記憶させればよいが、すべて
の合成単語の音声分析データを記憶すると、ROM等に
形成された音声メモリの記憶容量が増大して、装置全体
が非常に高価になる問題が生じる。
本発明はこのような事情に基づいてなされたものであり
、その目的とするところは、合成単語等のように隣接す
る単語データどうしを連続発声する必要のある場合は、
発声された音声間に存在するポーズ時間を除去すること
により、ROM等の記憶容量を増加することなく、より
聞取りやすく、より自然に聞こえる音声合成装置を提供
することにある。
[問題点を解決するための手段] 本発明の音声合成装置は、各単語データに対応する各発
声時間を記憶する発声時間メモリと、各単語データの発
声開始時刻からの経過時間を計時する計時手段と、先に
発声する単語データを記憶する第1の単語メモリと、こ
の第1の単語メモリに記憶された単語データの次に発声
する単語データを記憶する第2の単語メモリとを設け、
これ等第1および第2の単語メモリに記憶された一対の
単語データを連続発声すると判断された場合、第1の単
語メモリに記憶された単語データに対する音声の発声中
に計時手段にて計時された経過時間が発生時間メモリに
記憶された前記発声中の単語データに対応する発声時間
の終了直前になったときに第2の単語メモリに記憶され
た単語データに対応する音声発声を開始するようにした
ものである。
[作用] このように構成された音声合成装置であれば、外部から
入力された文書データを構成する各単語データが第1お
よび第2の単語メモリに順次格納され、この第1および
第2の単語メモリに格納された隣接する単語データが連
続発声されるべき単語データであった場合、第1の単語
メモリに記憶された単語データに対する音声の発声終了
直前に第2の単語メモリに記憶された単語データに対応
する音声発声が開始される。したがって、これ等2個の
単語は連続して聞こえることになる。
[実施例] 以下本発明の一実施例を図面を用いて説明する。
第1図は実施例の音声合成装置を示すブロック構成図で
ある。すなわち、図中1は各種記憶部。
I10ボート等を内蔵し、各種演算処理を実行するマイ
クロプロセッサで形成された音声制御部であり、この音
声制御部1に発声時間メモリが形成されたROM2.入
力した各音声分析データを実際の音声信号に変換するシ
ンセサイザ3および前記発声時間を計時するカウンタ4
が接続されている。このカウンタ4には外部からクロッ
ク信号CLKが入力し、出力信号が割込信号INTとし
て音声制御部1へ送出される。また、シンセサイザ3に
は各単語データに対応する音声分析データを記憶したR
OMで形成された音声メモリ5およびローパスフィルタ
6を介してスピーカ7が接続されている。
前記ROM2内に形成された発声時間メモリRO1には
、第2図に示すように、アスキーコード等の各文字コー
ドの組合わせで表示された各単語データに対して、イン
デックスIND、この単語データに対応する音声の発声
時間に相当する数字N、およびこの単語データに対応す
る音声分析データを格納した前記音声メモリ5内のアド
レスAがそれぞれ記憶されている。
また、音声メモリ5内には、第3図に示すように、各ア
ドレスAに対して各単語データに対応する発声周波数値
、音声波形の周波数成分値、各周波数の継続時間値等の
音声分析データDが記憶されている。
さらに、音声制御部1内のRAM等で形成された記憶部
には、第4図に示すように、外部からI10ボートを介
して入力された文書データを一時記憶するデータバッフ
PRAIの他に、先に発声する単語データに関するデー
タを格納する第1の単語メモリRA2.次に発声する単
語データに関するデータを格納する第2の単語メモリR
A3゜および第1および第2の単語メモリRA2.RA
3に格納された一対の単語データが連続発声されること
を示す連続発声フラグを格納するフラグ領域RA4が形
成されている。前記各単語メモリRA2.RAa内には
、それぞれ該当単語データの発声時間メモリRO1から
読出した発声時間を示す数Nt 、N2を格納する領域
RA5.RA6、およびアドレスAl、A2を格納する
領域RA7゜RASが形成されている。
しかして、この音声合成装置の電源が投入され各種の初
期処理が終了すると、前記音声制御部1は第5図の流れ
図に従って音声発声処理を実行するように構成されてい
る。すなわち、初期処理が終了すると、Plにて第6図
に示す文書データ処理を実行する。第6図において、ま
ず記憶部の第2の単語メモリRA3に格納されている次
に発声すべき単語データの領域RA6の発声時間を示す
数N2および領域RA8のアドレスA2を読出して第1
の単語メモリRA2の発声時間およびアドレスを格納す
る領域RA5.RA7にそれぞれ格納する。次に、デー
タバッファRA1からその次に発声すべき単語データを
読出してこの単語データを第2図に示す発声時間メモリ
ROIへ送り、この発声時間メモリRO1内を検索して
該当単語データの発声時間を示す数NおよびアドレスA
を読出し第2の単語メモリRA3の各領域RA6および
RASへ格納する。第1および第2の単語メモリRA2
.RA3への各単語データの各発声時間Nl、N2およ
び各アドレスAt 、A2の格納が終了すると、各単語
メモリに格納された一対の単語データが連続発声される
べきか否かを、例えば、単語データ間に挿入された[−
]、又は文章の流れ等にて判断する。そして、連続発声
すべき単語データであると判断したときのみ、フラグ領
域RA4の連続発声フラグを1に設定する。
なお、データバッファRA1への各単語データの格納は
割込み処理にて実施する。すなわち、外部から伝送路を
介して文書データが110ポートへ入力されると、この
文書データに含まれるスペース記号、[、]記号、[、
]記号等を検出して各単語データに分解してデータバッ
ファRAIへ順次格納していく。
第5図のメインルーチンのPlにて文書データ処理が終
了すると、第1の単語メモリRA2の領域RA5に格納
された発声時間を示す数N1をカウンタ4へ設定し、領
域RA7に格納されたアドレスA1をシンセサイザ3へ
送出する。アドレスA五を受信したシンセサイザ3は、
そのアドレスA1を音声メモリ5へ送出し、該当アドレ
スA1に格納されている音声分析データDを読出してこ
の音声分析データDに対応する音声信号の出力準備を行
なう。
次にP2にてフラグ領域RA4の内容を調べ、連続発声
フラグが1に設定されていない場合、シンセサイザ3か
ら音声信号がローパスフィルタ6へ送出中でないことを
確認した後、シンセサイザ3へ音声信号出力開始指令を
送出すると共に、カウンタ4ヘカウントダウン開始指令
を送出する。
すると、シンセサイザ3からローパスフィルタ6を介し
てスピーカ7へ音声信号が入力され、スピーカ7から第
1の単語メモリRA2に格納された単語データに対応す
る音声が発声される。同時にクロック信号CLKの入力
に同期してカウンタ4に設定された発声時間を示す数N
のカウント数Kが減算されていく。そして、カウント値
KがOになった時点で音声制御部1へ割込み信号INT
が入力される。この割込み信号INTが入力されると第
1の単語メモリRA2に格納された単語データに対する
音声の発声が終了したと判断して、予め定められたポー
ズIIf!flToの経過を持って、Plへ戻り次の単
語データの発声準備を行なう。
P2にてフラグ領域RA4の連続発声フラグが1に設定
されていた場合、第1および第1の単語メモリRA2.
RA3に格納された2つの単語データは連続発声される
と判断して、前述と同様にシンセサイザ3へ音声信号出
力開始指令を送出すると共に、カウンタ4へカウントダ
ウン開始指令を送出する。そして、カウンタ4のカウン
ト値Kが、発声時間終了直前の時間を示す0近傍の特定
値KMに達したことを検出すると、終了間際の発声動作
を直ちに停止する。そして、連続発声フラグをOに解除
したのち、ポーズ時間Toをおかずに直ちにPlへ戻る
。
このように構成された音声合成装置であれば、第7図(
a)(b)に示すように、第1の単語メモリRA2およ
び第2の単語メモリRA3に格納された互いに隣接する
一対の単語データが連続発声を行なうべきでないと判断
されると、連続発声フラグが0に解除され、第1の単語
の発声と第2の単語の発声との間にポーズ時間Toが挿
入される。一方、連続発声されるべきと判断されると、
連続発声フラグが1に設定され、第1の単語の発声と第
2の単語の発声との間のポーズ時f!ITnが除去され
ると共に、第1の単語の発声の最終部分がカットされ、
直ちに第2の単語の発声が開始される。
第8図の具体例で示すと、[this  is]におけ
る第1の単語[this]の発声と第2の単語[i S
 ]の発声との間には正規のポーズFRBToが挿入さ
れる。一方、合成単語[fortyone]における第
1の単語[fOrtV]の発声と第2の単語[one]
の発声との間にはポーズ時間Toが存在しないのみなら
ず、[fortylの[y]の最後の子音が消されて[
one]の最初の子音または母音が発声される。したが
って、[fOrt”l/  One]の合成単語が聞取
りやすく、異和感なく、ごく自然に聞こえる。
また、このようにプログラム制御することによって音声
合成装置全体が特に高価になることはない。
[発明の効果] 以上説明したように本発明によれば、合成単語等のよう
に隣接する単語データどうしを連続発声する必要のある
場合は、発声された音声間に存在するポーズ時間を除去
するようにしている。したがって、ROM等の記憶容l
を増加することなく、より聞取りやすく、より自然に聞
こえる音声合成装置を提供できる。
【図面の簡単な説明】
第1図は本発明の一実施例に係わる音声合成装置を示す
ブロック構成図、第2図は同装置のROMに形成された
発声時間メモリを示す図、第3図は同装置の音声メモリ
を示す図、第4図は同装置の音声制御部に形成されたメ
モリを示す図、第5図および第6図は同装置の動作を示
す流れ図、第7図および第8図は同装置にて発声された
各音声を示す図、第9図は従来の音声合成装置にて発声
された各音声を示す図である。 1・・・音声制御部、2・・・ROM、3・・・シンセ
サイザ、5・・・音声メモリ、6・・・ローパスフィル
タ、7・・・スピーカ、ROl・・・発声時間メモリ、
RAl・・・データバッファ、RA2・・・第1の単語
メモリ、RAS・・・第2の単語メモリ、RA4・・・
フラグ領域。 出願人代理人 弁理士 鈴江武彦 第1図 第2図 ブ 第3図 第4図 第6図 第7図 (a) (b) 第8図 (a) (b) (a) (b)

Claims (1)

    【特許請求の範囲】
  1. 外部から入力された複数の単語データで構成された文章
    データの各単語データに対応する音声分析データを記憶
    部に形成された音声メモリから順次読出してシンセサイ
    ザにて音声信号に変換して前記文章データに対応する音
    声をスピーカから出力する音声合成装置において、前記
    各単語データに対応する各発声時間を記憶する発声時間
    メモリと、前記各単語データの発声開始時刻からの経過
    時間を計時する計時手段と、先に発声する単語データを
    記憶する第1の単語メモリと、この第1の単語メモリに
    記憶された単語データの次に発声する単語データを記憶
    する第2の単語メモリと、これ等第1および第2の単語
    メモリに記憶された一対の単語データを連続発声するか
    否かを判断する判断手段と、この判断手段が前記一対の
    単語データを連続発声すると判断したとき、前記第1の
    単語メモリに記憶された単語データに対する音声の発声
    中に前記計時手段にて計時された経過時間が前記発生時
    間メモリに記憶された前記発声中の単語データに対応す
    る発声時間の終了直前になったときに前記第2の単語メ
    モリに記憶された単語データに対応する音声発声を開始
    する手段とを備えたことを特徴とする音声合成装置。
JP20702584A 1984-10-04 1984-10-04 音声合成装置 Pending JPS6186799A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP20702584A JPS6186799A (ja) 1984-10-04 1984-10-04 音声合成装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP20702584A JPS6186799A (ja) 1984-10-04 1984-10-04 音声合成装置

Publications (1)

Publication Number Publication Date
JPS6186799A true JPS6186799A (ja) 1986-05-02

Family

ID=16532955

Family Applications (1)

Application Number Title Priority Date Filing Date
JP20702584A Pending JPS6186799A (ja) 1984-10-04 1984-10-04 音声合成装置

Country Status (1)

Country Link
JP (1) JPS6186799A (ja)

Similar Documents

Publication Publication Date Title
KR102779903B1 (ko) 운율적 특징들로부터 파라메트릭 보코더 파라미터들을 예측하기
US4685135A (en) Text-to-speech synthesis system
GB2296349A (en) Maintaining order of input data events
JP3354339B2 (ja) 日本語処理装置
JPS5950076B2 (ja) 音声出力機器
JP2612030B2 (ja) 文章読み上げ装置
Olabe et al. Real time text-to-speech conversion system for spanish
JPS633320B2 (ja)
JPH0116160Y2 (ja)
Savino et al. Acoustic cues for classifying communicative intentions in dialogue systems
JPS58134371A (ja) 日本語入力装置
JPH054676B2 (ja)
WO2000031727A1 (en) Optimization device for optimizing a vocabulary of a speech recognition device
JPS58112134A (ja) 音声発生装置付電子式計算機
JPS6027433B2 (ja) 日本語情報入力装置
JPH0143319B2 (ja)
JPH0143320B2 (ja)
JPS6328318B2 (ja)
JPH051494B2 (ja)
JPS62103724A (ja) 文書作成装置
JPS5949594B2 (ja) 音声出力機器
JPS58198100A (ja) 接続休止時間の修正方式
JPS6153699A (ja) 音声認識装置
JPS58223194A (ja) 日本語音声入力方式
Carney Computers, literacy and the English writing system