JPS5913040B2 - 音声合成装置 - Google Patents
音声合成装置Info
- Publication number
- JPS5913040B2 JPS5913040B2 JP49060736A JP6073674A JPS5913040B2 JP S5913040 B2 JPS5913040 B2 JP S5913040B2 JP 49060736 A JP49060736 A JP 49060736A JP 6073674 A JP6073674 A JP 6073674A JP S5913040 B2 JPS5913040 B2 JP S5913040B2
- Authority
- JP
- Japan
- Prior art keywords
- accent
- type
- word
- information
- accent type
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Expired
Links
Description
【発明の詳細な説明】
本発明は音声合成装置の制御情報の作成装置、特にアク
セント情報の作成装置に関するものである。
セント情報の作成装置に関するものである。
10音声応答の実用化につれて、従来の録音編集方式の
欠点として、応答できる語数(単語の種類、普通これを
語葉という)が少ないことが指摘されはじめた。
欠点として、応答できる語数(単語の種類、普通これを
語葉という)が少ないことが指摘されはじめた。
この要求されている実例を分析してみると、大多数の場
合は、全く任意にどんな内容で15も応答できることが
要求されているのではなくて、応答すべき内容のわく組
みは比較的少数の文形に限定され、そのわく組内の一部
にでてくる単語、とくに情報を伝えるべき単語、たとえ
ば個有名詞である人名・地名・会社名や日付・金額とい
つたものを任意に入れ換えて応答できればよいというこ
とがわかつた。すなわち実用上音声サービスに支障をき
たさないようにするためには、任意の単語、それも主と
して人名・地名・会社名などの名詞(固有名詞)句を合
成できることが必要である。
合は、全く任意にどんな内容で15も応答できることが
要求されているのではなくて、応答すべき内容のわく組
みは比較的少数の文形に限定され、そのわく組内の一部
にでてくる単語、とくに情報を伝えるべき単語、たとえ
ば個有名詞である人名・地名・会社名や日付・金額とい
つたものを任意に入れ換えて応答できればよいというこ
とがわかつた。すなわち実用上音声サービスに支障をき
たさないようにするためには、任意の単語、それも主と
して人名・地名・会社名などの名詞(固有名詞)句を合
成できることが必要である。
ところで任意の単語を合成できるようにするためには、
単語の数がほぼ無限であるから、合成するための制御情
報を、情報圧縮して記憶しておくという方式をとること
はできず、入力情報(たとえばカナ文字表記)から、一
般的な変換装置によつて、制御情報を作り出す必要があ
る。
単語の数がほぼ無限であるから、合成するための制御情
報を、情報圧縮して記憶しておくという方式をとること
はできず、入力情報(たとえばカナ文字表記)から、一
般的な変換装置によつて、制御情報を作り出す必要があ
る。
この装置をさらに詳しく分解すると日本語の場合一般的
にいつて次の(1)〜(4)の手段に分けられる。
にいつて次の(1)〜(4)の手段に分けられる。
(1)入力として与えられた単語の文字的な表記15(
たとえばカナ文字またはローマ字表記など)から、その
単語のアクセント型を決定する手段。(2)入力として
与えられた単語の表記を、その合・ウ成の単位として使
用する音声的な単位(たとえば、音素・単音節・音韻連
鎖など)に区分し、決定されたアクセント型から、その
各単位毎の時間長(持続時間)を決定する手段。
たとえばカナ文字またはローマ字表記など)から、その
単語のアクセント型を決定する手段。(2)入力として
与えられた単語の表記を、その合・ウ成の単位として使
用する音声的な単位(たとえば、音素・単音節・音韻連
鎖など)に区分し、決定されたアクセント型から、その
各単位毎の時間長(持続時間)を決定する手段。
(3)決定された持続時間とアクセント型から、単語の
アクセントを物理的に決定するピツチ周期パタンを求め
る手段。
アクセントを物理的に決定するピツチ周期パタンを求め
る手段。
(4)上記の音声的な諸情報を、それぞれの合成方式に
適した形の完全な制御情報に変換する手段。
適した形の完全な制御情報に変換する手段。
本発明は上記1)における単語のアクセント型、特に東
京方言のアクセント型を決定するアクセント情報の作成
装置を提供するものである。以下、本装置に使われる原
理について説明する。
京方言のアクセント型を決定するアクセント情報の作成
装置を提供するものである。以下、本装置に使われる原
理について説明する。
ただし、合成の単位としては、小さい方から列挙して、
(a)音素(各種子音と各種母音)(b)単音節(子音
+母音もしくは母音のみという構造(普通これをCとV
とかく)をもつもので、概略カナ文字一字の表記に対応
する)(c)音韻連鎖(母音十子音+母音もしくは母音
+母音という構造(普通これをVlCV2とVlV2と
かく)をもつもの)、などが考えられるが、以下の説明
では、合成された音声の品質と必要とする音声素片の記
憶容量とのかねあい、および日本語の特徴からいつて、
実用上もつとも有用な単音節を単位として以下の具体的
な説明をすすめてゆく。さて、東京方言においては、N
音節(正確にはN拍と言うが以下一般的慣用に従つてN
音節と言う)の単語にはN+1種類のアクセント型があ
りうる。
(a)音素(各種子音と各種母音)(b)単音節(子音
+母音もしくは母音のみという構造(普通これをCとV
とかく)をもつもので、概略カナ文字一字の表記に対応
する)(c)音韻連鎖(母音十子音+母音もしくは母音
+母音という構造(普通これをVlCV2とVlV2と
かく)をもつもの)、などが考えられるが、以下の説明
では、合成された音声の品質と必要とする音声素片の記
憶容量とのかねあい、および日本語の特徴からいつて、
実用上もつとも有用な単音節を単位として以下の具体的
な説明をすすめてゆく。さて、東京方言においては、N
音節(正確にはN拍と言うが以下一般的慣用に従つてN
音節と言う)の単語にはN+1種類のアクセント型があ
りうる。
日本語のアクセントは声の高低の変化であられされる。
アクセント型Mは声が高い所から低い所へ主観的に変化
する位置(アクセント核という)であられす。位置は核
の直前の音節が語頭から何番目かで表現する方法と語尾
から何番目かで表現する方法がある。以下では後者によ
り表現するものとする。M=1はその単語の後に助詞「
ガ」「ノ」が付いた時にその助詞の前に核の来る型、M
=0は「ガ」「ノ」がついても核のあられれない型であ
る。またM−0を平板型、M\0を起伏型と言い、さら
に起伏型でM=Nのものを頭高型と言う。東京方言では
、頭から1番目と2番目で声の高低が必らず変り、また
、高から低への変化は一つの単語の中では最大1つしか
ない。そこで頭高型では語頭から二音節目以降はすべて
低となる。また頭高型以外は語頭の一音節は必らず低で
、二音節目から核の来る直前の音節まではすべて高、核
の後はすべて低となる。従つてアクセント核の位置がわ
かれば各音節のアクセントレベルはすべて自動的に指定
される性質がある。アクセントとそれに対応するピツチ
周期の変化のパタンは音声を一つのまとまつたパタンと
して聞きやすくすることが第一の効果であり、東京方言
においては意味の区別は二義的になつている。
アクセント型Mは声が高い所から低い所へ主観的に変化
する位置(アクセント核という)であられす。位置は核
の直前の音節が語頭から何番目かで表現する方法と語尾
から何番目かで表現する方法がある。以下では後者によ
り表現するものとする。M=1はその単語の後に助詞「
ガ」「ノ」が付いた時にその助詞の前に核の来る型、M
=0は「ガ」「ノ」がついても核のあられれない型であ
る。またM−0を平板型、M\0を起伏型と言い、さら
に起伏型でM=Nのものを頭高型と言う。東京方言では
、頭から1番目と2番目で声の高低が必らず変り、また
、高から低への変化は一つの単語の中では最大1つしか
ない。そこで頭高型では語頭から二音節目以降はすべて
低となる。また頭高型以外は語頭の一音節は必らず低で
、二音節目から核の来る直前の音節まではすべて高、核
の後はすべて低となる。従つてアクセント核の位置がわ
かれば各音節のアクセントレベルはすべて自動的に指定
される性質がある。アクセントとそれに対応するピツチ
周期の変化のパタンは音声を一つのまとまつたパタンと
して聞きやすくすることが第一の効果であり、東京方言
においては意味の区別は二義的になつている。
アクセントとそれに対応するピツチによつて制御されな
い合成音声は一音節毎に「ひろい聞き」することが必要
であり、非常に聞きづらい。そこで、任意の単語を良品
質に合成するためには、良好なピツチパタン情報が必要
であり、ピツチパタン情報を作り出すにはその単語のつ
づりからアクセント型の決定が必要である。そこで、実
用的見地からアクセント型を決める手順を知るために、
数千個のサンプルについて分析検討を行なつた。
い合成音声は一音節毎に「ひろい聞き」することが必要
であり、非常に聞きづらい。そこで、任意の単語を良品
質に合成するためには、良好なピツチパタン情報が必要
であり、ピツチパタン情報を作り出すにはその単語のつ
づりからアクセント型の決定が必要である。そこで、実
用的見地からアクセント型を決める手順を知るために、
数千個のサンプルについて分析検討を行なつた。
以下の説明では比較的使用頻度の高い固有名詞、特に企
業名と人名についての例を取り上げて分析の手順と結果
を説明する。先ず、たとえば企業名におけるアクセント
型の実態を分析するために、職業別電話帳より無作為に
企業名を数千個取り出す。次にこの企業名をその構成語
に分割し(たとえば「日立製作所]ならば「日立」と「
製作所」)、全体(以下複合語と呼ぶ。前例では「日立
製作所」)と各構成語すべてについてアクセント型を主
感的に判断し、音節単位の表記法(カナ文字にほぼ対応
する表記で、「ギア」などは一つの単位と見なす)とし
てローマ字で表記した複合語と構成語の各々にそのアク
セント型および音節数とをつけてデータとする。人名の
場合も同様であるが、構成語としては姓と名の二つの種
類がある。次に、これらのデータより、企業名と人名別
に各々複合語と構成語別に(人名では姓と名は別々に)
音節数とアクセント型の関係を調べる。
業名と人名についての例を取り上げて分析の手順と結果
を説明する。先ず、たとえば企業名におけるアクセント
型の実態を分析するために、職業別電話帳より無作為に
企業名を数千個取り出す。次にこの企業名をその構成語
に分割し(たとえば「日立製作所]ならば「日立」と「
製作所」)、全体(以下複合語と呼ぶ。前例では「日立
製作所」)と各構成語すべてについてアクセント型を主
感的に判断し、音節単位の表記法(カナ文字にほぼ対応
する表記で、「ギア」などは一つの単位と見なす)とし
てローマ字で表記した複合語と構成語の各々にそのアク
セント型および音節数とをつけてデータとする。人名の
場合も同様であるが、構成語としては姓と名の二つの種
類がある。次に、これらのデータより、企業名と人名別
に各々複合語と構成語別に(人名では姓と名は別々に)
音節数とアクセント型の関係を調べる。
この表より、企業名では複合語では3型(M−3)と4
型(M−4)が多いが人名ではよりバラツキが多いとい
うように、名詞の種類によりそのアクセント型の性質が
異なることがわかる。すなわち企業名型の名詞では構成
語間の結合が強く構成語のもつアクセント型が消えやす
く、構成語のアクセント型に関係なく複合語としてのア
クセント型が決まりやすい傾向があるのに対し、人名型
の名詞では、構成語のアクセント型により複合語のアク
セント型が異なる弱い結合をすることが予想される。そ
こで人名型の名詞では構成語と複合語のアクセント型の
関係を表にまとめ観測することにより結合の法則を見い
出すことができる。人名では、(イ)姓が頭高型(はじ
めの音節の後に核がある)のものは複合語は頭高型であ
る、(口)名が平板型(アクセント核がないもの)では
姓のアクセント)核の位置が保たれる、(ハ)姓が頭高
型以外の起伏型で、名も起伏型(アクセント核のあるも
の)では名の核の位置が保たれる、という法則が見出さ
れた。さて、東京方言では、アクセント核の位置が撥音
「ン」や促音「ツ」の直後には来ないということが知ら
れている。このような音韻上の構成とアクセント核の位
置を知るために、アクセント核の前一音節、後二音節の
組み合せと核の位置の関係の一覧表を作り、ありえない
組み合せや例外的に割合の少ない組み合せをさがし、音
韻構造の影響法則を求める。すなわち音韻構造による変
型規則である。この結果、前述の撥音「ン」と促音「ツ
」の他に長母音([ア一」など)や二重母音([アイ」
など)の後にも核が来ない(核の位置が一音節分一つ前
にずれる)ことがわかつた。この規則を逆に当てはめ、
もとのデータのアクセント型でこれらの規則により変形
されたものと考えられるアクセント型を元の型にもどし
、再び音節数とアクセント型の分布表を作りなおす。こ
の表より企業型の名詞で3型が圧倒的に多いことがわか
る。そこで、企業型の名詞の場合は3型以外の型となる
ものの型の決定手順と、人名型の名詞の場合には構成語
の型の決定手順の推定が必要となる。そこで次に「意味
」の要素を分析する。実用的見地からできるだけ型式的
に意味を処理できるように、先ず各構成語をさらに細か
く分割する。たとえば、[製作所」は「製作」と「所」
に、「花子」は「花」と「子」のように分ける。これら
を要素語と呼ぶことにする。要素語の種類をすべて調べ
、出現回数の多いものから、それが語頭に来る場合、語
中に来る場合および語尾に来る場合について各各アクセ
ント型の分布を調べる。この結果特定のいくつかの要素
語は、それが語尾に来るときにその属している語のアク
セント型を特定のものにしやすいものがあることがわか
つた。語尾に来る要素語を語尾と呼ぶこととする。たと
えば「組」が語尾である会社名は「0」型となるし、「
社」が語尾につく会社名は「2」型になる。人名の例で
はその構成語の音節数と語尾からその構成語のアクセン
ト型が定まる。たとえば名前で「ヘイ」や「ペイ」の語
尾をもつものは3音節名では頭高型だが4音節以上の名
前では「O」型となる。以上に述べた分析手順とその結
果より、固有名詞のアクセント型を推定するためには実
用上は次の手続きをふんで行けばよい。(1)単語の種
類(たとえば人名か企業名か)によつて構成語間の結合
の度合を定める。
型(M−4)が多いが人名ではよりバラツキが多いとい
うように、名詞の種類によりそのアクセント型の性質が
異なることがわかる。すなわち企業名型の名詞では構成
語間の結合が強く構成語のもつアクセント型が消えやす
く、構成語のアクセント型に関係なく複合語としてのア
クセント型が決まりやすい傾向があるのに対し、人名型
の名詞では、構成語のアクセント型により複合語のアク
セント型が異なる弱い結合をすることが予想される。そ
こで人名型の名詞では構成語と複合語のアクセント型の
関係を表にまとめ観測することにより結合の法則を見い
出すことができる。人名では、(イ)姓が頭高型(はじ
めの音節の後に核がある)のものは複合語は頭高型であ
る、(口)名が平板型(アクセント核がないもの)では
姓のアクセント)核の位置が保たれる、(ハ)姓が頭高
型以外の起伏型で、名も起伏型(アクセント核のあるも
の)では名の核の位置が保たれる、という法則が見出さ
れた。さて、東京方言では、アクセント核の位置が撥音
「ン」や促音「ツ」の直後には来ないということが知ら
れている。このような音韻上の構成とアクセント核の位
置を知るために、アクセント核の前一音節、後二音節の
組み合せと核の位置の関係の一覧表を作り、ありえない
組み合せや例外的に割合の少ない組み合せをさがし、音
韻構造の影響法則を求める。すなわち音韻構造による変
型規則である。この結果、前述の撥音「ン」と促音「ツ
」の他に長母音([ア一」など)や二重母音([アイ」
など)の後にも核が来ない(核の位置が一音節分一つ前
にずれる)ことがわかつた。この規則を逆に当てはめ、
もとのデータのアクセント型でこれらの規則により変形
されたものと考えられるアクセント型を元の型にもどし
、再び音節数とアクセント型の分布表を作りなおす。こ
の表より企業型の名詞で3型が圧倒的に多いことがわか
る。そこで、企業型の名詞の場合は3型以外の型となる
ものの型の決定手順と、人名型の名詞の場合には構成語
の型の決定手順の推定が必要となる。そこで次に「意味
」の要素を分析する。実用的見地からできるだけ型式的
に意味を処理できるように、先ず各構成語をさらに細か
く分割する。たとえば、[製作所」は「製作」と「所」
に、「花子」は「花」と「子」のように分ける。これら
を要素語と呼ぶことにする。要素語の種類をすべて調べ
、出現回数の多いものから、それが語頭に来る場合、語
中に来る場合および語尾に来る場合について各各アクセ
ント型の分布を調べる。この結果特定のいくつかの要素
語は、それが語尾に来るときにその属している語のアク
セント型を特定のものにしやすいものがあることがわか
つた。語尾に来る要素語を語尾と呼ぶこととする。たと
えば「組」が語尾である会社名は「0」型となるし、「
社」が語尾につく会社名は「2」型になる。人名の例で
はその構成語の音節数と語尾からその構成語のアクセン
ト型が定まる。たとえば名前で「ヘイ」や「ペイ」の語
尾をもつものは3音節名では頭高型だが4音節以上の名
前では「O」型となる。以上に述べた分析手順とその結
果より、固有名詞のアクセント型を推定するためには実
用上は次の手続きをふんで行けばよい。(1)単語の種
類(たとえば人名か企業名か)によつて構成語間の結合
の度合を定める。
(2)結合が強い場合は語尾が例外的なものかどうかを
調べ例外のものであるときは表引きにより型を推定し、
それ以外のときは3型と推定する。
調べ例外のものであるときは表引きにより型を推定し、
それ以外のときは3型と推定する。
(3)結合が弱い場合は、構成語について語尾より型を
各々推定後結合規醜イ)〜(ハ)のうち適合する条件の
ものをあてはめ複合語の型を推定する。(4)音韻構造
による変形規則をあてはめる。このような手続を行なう
手段を音声合成装置の制御部にもたせることによつて、
このような手段を持たない音声合成装置では得られない
聞きやすい音声を得ることができる。すなわち、このよ
うな手段を持たない音声合成装置により作り出された音
声は、一つの意味をもつたまとまりである単語を形成し
ているという情報をもつていないため、どこからどこま
でが一つのまとまりかを一音一音聞きながら判断して行
かなければならず非常に聞きづらい。いわば句読点やス
ペースの全くないカタカナ書きの文章を読む場合と同じ
ような状態になる。これに比ベアグセット型を推定する
手段をもつ装置では句読点やスペースがついた漢字カナ
まじり文を読むことに対応するような聞きやすい音声と
なる。このような音声合成装置を提供しようというのが
本発明の目的である。本発明の一実施例である装置の概
略を第1図にプロツク図として示す。
各々推定後結合規醜イ)〜(ハ)のうち適合する条件の
ものをあてはめ複合語の型を推定する。(4)音韻構造
による変形規則をあてはめる。このような手続を行なう
手段を音声合成装置の制御部にもたせることによつて、
このような手段を持たない音声合成装置では得られない
聞きやすい音声を得ることができる。すなわち、このよ
うな手段を持たない音声合成装置により作り出された音
声は、一つの意味をもつたまとまりである単語を形成し
ているという情報をもつていないため、どこからどこま
でが一つのまとまりかを一音一音聞きながら判断して行
かなければならず非常に聞きづらい。いわば句読点やス
ペースの全くないカタカナ書きの文章を読む場合と同じ
ような状態になる。これに比ベアグセット型を推定する
手段をもつ装置では句読点やスペースがついた漢字カナ
まじり文を読むことに対応するような聞きやすい音声と
なる。このような音声合成装置を提供しようというのが
本発明の目的である。本発明の一実施例である装置の概
略を第1図にプロツク図として示す。
音節に対応するコード列であられされた合成しようとす
る名詞とその種類をあられすコードからなる入力指令4
が音声合成装置の制御情報作成部11に加えられる。メ
モリ12には名詞の種類毎に語尾とその語尾の持つアク
セント型上の特徴を記述した表が入つている。制御情報
作成部11は入力指令4のつづりの語尾を調ベメモリ1
2中の語尾と一致するものがあるときは、その語尾の持
つアクセント型上の特徴と入力指令とよりその入力指令
4の合成しようとしている単語アクセント型を推定し、
音韻により変形規則を適用してアクセント型を決定する
。さらに制御情報作成部11はこのアクセント型と入力
のつづりよりその単語の各音節の時間長を定め、この時
間長とアクセント型よりピツチ制御情報を作り出し、つ
づりと各音節の時間長とピッチ制御情報の3種を制御情
報として音声合成部3を制御し音声5を出力する。第2
図は本発明をさらに詳しく説明するための図で、アクセ
ント型をもとに作られるピツチ情報6と時間情報7およ
び音韻情報アドレス8を用いて音声を合成する装置のプ
ロツク図である。
る名詞とその種類をあられすコードからなる入力指令4
が音声合成装置の制御情報作成部11に加えられる。メ
モリ12には名詞の種類毎に語尾とその語尾の持つアク
セント型上の特徴を記述した表が入つている。制御情報
作成部11は入力指令4のつづりの語尾を調ベメモリ1
2中の語尾と一致するものがあるときは、その語尾の持
つアクセント型上の特徴と入力指令とよりその入力指令
4の合成しようとしている単語アクセント型を推定し、
音韻により変形規則を適用してアクセント型を決定する
。さらに制御情報作成部11はこのアクセント型と入力
のつづりよりその単語の各音節の時間長を定め、この時
間長とアクセント型よりピツチ制御情報を作り出し、つ
づりと各音節の時間長とピッチ制御情報の3種を制御情
報として音声合成部3を制御し音声5を出力する。第2
図は本発明をさらに詳しく説明するための図で、アクセ
ント型をもとに作られるピツチ情報6と時間情報7およ
び音韻情報アドレス8を用いて音声を合成する装置のプ
ロツク図である。
合成すべき入力指令4がシステム制御部1に入力され、
システム制御部1内の制御情報作成部11のアクセント
情報作成部11−aにより作り出されたアクセント情報
9をもとに制御情報作成部11−b〜dで各々作られる
ピツチ情報6、時間情報7および音韻情報アドレス8が
音声合成部3に与えられる。音声合成部3は与えられた
諸情報群に従つて音韻情報メモリ2中に収録されている
音声素片をつなぎあわせて音声を合成して行く。音韻情
報メモリ2内には音声素片が音節毎にまとめられて入つ
ており、先頭のアドレスが指定されるとその音節に属し
ている素片が頭より順次読み出される。すべての素片は
一定長になつており、一定番地ずつ加えて行けば次の素
片のアドレスが定まる。ピツチ情報6は合成される音声
の素片の長さを指定する情報で素片毎に与える。時間情
報7は音節の持続時間を指定する情報で、その音節の持
続時間が終ると次の時間情報と音韻情報アドレスを要求
し次の音節の合成に移る。次に本発明の主体であるアク
セント情報9とピツチ情報6の作成手順についてより詳
しく述べる。
システム制御部1内の制御情報作成部11のアクセント
情報作成部11−aにより作り出されたアクセント情報
9をもとに制御情報作成部11−b〜dで各々作られる
ピツチ情報6、時間情報7および音韻情報アドレス8が
音声合成部3に与えられる。音声合成部3は与えられた
諸情報群に従つて音韻情報メモリ2中に収録されている
音声素片をつなぎあわせて音声を合成して行く。音韻情
報メモリ2内には音声素片が音節毎にまとめられて入つ
ており、先頭のアドレスが指定されるとその音節に属し
ている素片が頭より順次読み出される。すべての素片は
一定長になつており、一定番地ずつ加えて行けば次の素
片のアドレスが定まる。ピツチ情報6は合成される音声
の素片の長さを指定する情報で素片毎に与える。時間情
報7は音節の持続時間を指定する情報で、その音節の持
続時間が終ると次の時間情報と音韻情報アドレスを要求
し次の音節の合成に移る。次に本発明の主体であるアク
セント情報9とピツチ情報6の作成手順についてより詳
しく述べる。
なお、第2図では説明をわかりやすくするためにアクセ
ント情報9は制御情報作成部11−aから11−bへ送
られるように表現してあるが、実際は記憶部12を経由
してうけわたされることは以下の説明に述べる通りであ
る。第2図のシステム制御部1をより詳しく書いたもの
が第3図である。
ント情報9は制御情報作成部11−aから11−bへ送
られるように表現してあるが、実際は記憶部12を経由
してうけわたされることは以下の説明に述べる通りであ
る。第2図のシステム制御部1をより詳しく書いたもの
が第3図である。
第3図において各種の処理部16〜26と制御部10は
マイクロプロセツサよりなり、相互にデータバス14と
割込線2本13−1と13−2により結びついている。
相互の呼び出しは割込みと各処理部に決められたデータ
バス上のデイバイス番号によりなされ各処理部は専用の
メモリを持ち処理手順が用意されている。また、メモリ
12は共通のメモリとなつている。入力処理部16は中
央から音声を合成出力する要請があると制御部10に問
い合わせ、処理可能であれば入出力制御部16を受付け
可能の状態にし、合成すべき内容を受け付けメモリ12
−aの所定の位置に記録する。内容は種類Sとカナ文字
に対応するコード列L,,・・・・・・・・・,LNで
表現されており、入力コード数をカウントすることによ
り、合成すべき単語の音節数Nも知ることができ、その
結果もメモリ12−aに記録される。入力が終ると入力
処理部16は受信終了を制御部10に知らせる。制御部
10は合成すべき単語の種類Sが人名か会社名を示して
いるかにより人名主処理部17か会社名主処理部18を
起動する。種類Sが会社名を示している場合、そのSの
情報を語尾検出処理部19にわたし語尾検出処理部19
を起動する。語尾検出処理部19は会社用語尾表を検索
し、一致したものがある時は、その語尾の要求するアク
セント型Mを表より知り、メモリ12−aに出力し、ま
た一致する語尾がない場合は3型をアクセント型Mとし
て再び会社名主処理部18に制御がわたされる。会社名
処理部18は、次に音韻変形処理部20を起動する。音
韻変形処理部20はメモリ12−a中のつづ?Ll,・
・・・・・・・・,LNとアクセント型とから、アクセ
ント核の直前の音節が促音や撥音、長母音の二番目の母
音かを判断し、その場合はMを1つ増しM+1を新たに
アクセント型Mとしてメモリ12−aに記録する。種類
Sが人名を示している場合は、人名主処理部17はコー
ド列Ll,・・・・・・・・・,LNより姓と名を分け
、それぞれのつづりと姓か名かの情報を語尾検出処理部
19にわたし語尾検出処理部19を起動する。語尾検出
処理部19は姓用および各用語尾表を検索し、一致した
ものがあるときは、その表に従つてアクセント型を定め
、ない場合は3型として人名主処理部17に制御をわた
す。人名主処理部17は姓または名の語尾検出によるア
クセント型推定が各々終ると、音韻変形処理部20を起
動し、音韻情報による変形を行なう。人名主処理部17
は姓と名のアクセント型の推定が終了すると前述の結合
規則(イ)〜(ハ)に従つて人名全体を一つの単語とみ
なしたときのアクセント型を推定する。会社名主処理部
18または人名主処理部17はアクセント型の推定が終
了すると制御部10に制御をわたす。このとき最終的に
推定されたアクセント型Mはメモリ12−a中にコード
列Ll,・・・・・・・・・,LNとコード数Nと共に
記録されている。ピツチ情報6はコード数Nとアクセン
ト型Mに組み合せ毎にあらかじめ表の型でメモリ12b
に記録されており、制御部10はピツチ情報処理部21
を起動し、ピツチ情報処理部21はアクセント型Mとコ
ード数Nとより索表により必要なピツチ情報の位置Pを
知りその結果をメモリ12−bの所定の位置に格納し、
制御部10に制御をわたす。ピツチ情報送出処理部22
は、合成器3からのピツチ情報送出要求を受けると制御
部10に対し送出可能かどうかを問い合わせ、可能な場
合はメモI月2−b中のピツチ情報の位置Pを手掛りに
ピツチ情報をメモリ12−bより読み出し送出する。一
方時間情報処理部23と音韻情報アドレス処理部25は
人名主処理部17または会社名主処理部18でのアクセ
ント型の判定が終了するとメモI月2−a中のピツチ情
報処理部21と同時に起動され、コード列Ll,・・・
・・・・・・,LNに対応する音節時間長をメモl月2
−c中の表より索表により定め同じくメモリ12−c中
の所定の位置に格納する。音韻情報アドレス処理部25
はメモリ12−a中のコード列Ll,・・・・・・・・
・,LNに対応する音韻情報アドレスをメモリ12−d
中の表より索表により定め、同じくメモl月2−d中の
所定の位置に格納する。
マイクロプロセツサよりなり、相互にデータバス14と
割込線2本13−1と13−2により結びついている。
相互の呼び出しは割込みと各処理部に決められたデータ
バス上のデイバイス番号によりなされ各処理部は専用の
メモリを持ち処理手順が用意されている。また、メモリ
12は共通のメモリとなつている。入力処理部16は中
央から音声を合成出力する要請があると制御部10に問
い合わせ、処理可能であれば入出力制御部16を受付け
可能の状態にし、合成すべき内容を受け付けメモリ12
−aの所定の位置に記録する。内容は種類Sとカナ文字
に対応するコード列L,,・・・・・・・・・,LNで
表現されており、入力コード数をカウントすることによ
り、合成すべき単語の音節数Nも知ることができ、その
結果もメモリ12−aに記録される。入力が終ると入力
処理部16は受信終了を制御部10に知らせる。制御部
10は合成すべき単語の種類Sが人名か会社名を示して
いるかにより人名主処理部17か会社名主処理部18を
起動する。種類Sが会社名を示している場合、そのSの
情報を語尾検出処理部19にわたし語尾検出処理部19
を起動する。語尾検出処理部19は会社用語尾表を検索
し、一致したものがある時は、その語尾の要求するアク
セント型Mを表より知り、メモリ12−aに出力し、ま
た一致する語尾がない場合は3型をアクセント型Mとし
て再び会社名主処理部18に制御がわたされる。会社名
処理部18は、次に音韻変形処理部20を起動する。音
韻変形処理部20はメモリ12−a中のつづ?Ll,・
・・・・・・・・,LNとアクセント型とから、アクセ
ント核の直前の音節が促音や撥音、長母音の二番目の母
音かを判断し、その場合はMを1つ増しM+1を新たに
アクセント型Mとしてメモリ12−aに記録する。種類
Sが人名を示している場合は、人名主処理部17はコー
ド列Ll,・・・・・・・・・,LNより姓と名を分け
、それぞれのつづりと姓か名かの情報を語尾検出処理部
19にわたし語尾検出処理部19を起動する。語尾検出
処理部19は姓用および各用語尾表を検索し、一致した
ものがあるときは、その表に従つてアクセント型を定め
、ない場合は3型として人名主処理部17に制御をわた
す。人名主処理部17は姓または名の語尾検出によるア
クセント型推定が各々終ると、音韻変形処理部20を起
動し、音韻情報による変形を行なう。人名主処理部17
は姓と名のアクセント型の推定が終了すると前述の結合
規則(イ)〜(ハ)に従つて人名全体を一つの単語とみ
なしたときのアクセント型を推定する。会社名主処理部
18または人名主処理部17はアクセント型の推定が終
了すると制御部10に制御をわたす。このとき最終的に
推定されたアクセント型Mはメモリ12−a中にコード
列Ll,・・・・・・・・・,LNとコード数Nと共に
記録されている。ピツチ情報6はコード数Nとアクセン
ト型Mに組み合せ毎にあらかじめ表の型でメモリ12b
に記録されており、制御部10はピツチ情報処理部21
を起動し、ピツチ情報処理部21はアクセント型Mとコ
ード数Nとより索表により必要なピツチ情報の位置Pを
知りその結果をメモリ12−bの所定の位置に格納し、
制御部10に制御をわたす。ピツチ情報送出処理部22
は、合成器3からのピツチ情報送出要求を受けると制御
部10に対し送出可能かどうかを問い合わせ、可能な場
合はメモI月2−b中のピツチ情報の位置Pを手掛りに
ピツチ情報をメモリ12−bより読み出し送出する。一
方時間情報処理部23と音韻情報アドレス処理部25は
人名主処理部17または会社名主処理部18でのアクセ
ント型の判定が終了するとメモI月2−a中のピツチ情
報処理部21と同時に起動され、コード列Ll,・・・
・・・・・・,LNに対応する音節時間長をメモl月2
−c中の表より索表により定め同じくメモリ12−c中
の所定の位置に格納する。音韻情報アドレス処理部25
はメモリ12−a中のコード列Ll,・・・・・・・・
・,LNに対応する音韻情報アドレスをメモリ12−d
中の表より索表により定め、同じくメモl月2−d中の
所定の位置に格納する。
制御部10はピツチ情報処理部21と時間情報処理部2
3および音韻情報アドレス処理部25での処理がすべて
終了していることが確認されている状態でのみ合成部3
からの各々の情報の送出要求に応じる。この場合には合
成部3からの要求に従いピツチ情報に関してはピツチ情
報送出部22から、時間情報に関しては時間情報送出部
24から、音韻情報アドレスに関しては音韻情報アドレ
ス送出部26より各々制御情報を送り出す。音韻の持続
時間長の値を図4に示す。
3および音韻情報アドレス処理部25での処理がすべて
終了していることが確認されている状態でのみ合成部3
からの各々の情報の送出要求に応じる。この場合には合
成部3からの要求に従いピツチ情報に関してはピツチ情
報送出部22から、時間情報に関しては時間情報送出部
24から、音韻情報アドレスに関しては音韻情報アドレ
ス送出部26より各々制御情報を送り出す。音韻の持続
時間長の値を図4に示す。
以上の実施例に説明したように、本発明により、任意の
固有名詞の音声を、その名詞のつづりから合成すること
が可能となつた。
固有名詞の音声を、その名詞のつづりから合成すること
が可能となつた。
我々の実験によれば、本発明により約9割の名詞が正し
いアクセントにより音声合成される。また残りの1割も
十分に使用に耐えるアクセント感が与えられ、聞きやす
い任意の固有名詞を含む音声による応答が可能となつた
。以上に説明した例は、説明の便宜上1つの合成部の制
御法について述べたが、各処理部は常に働いているわけ
ではない。
いアクセントにより音声合成される。また残りの1割も
十分に使用に耐えるアクセント感が与えられ、聞きやす
い任意の固有名詞を含む音声による応答が可能となつた
。以上に説明した例は、説明の便宜上1つの合成部の制
御法について述べたが、各処理部は常に働いているわけ
ではない。
従つてある合成部用の情報について処理を行なつていな
い間は他の合成部用の情報の処理が可能であり、多数の
合成部を制御する多重制御も可能であることは言うまで
もない
い間は他の合成部用の情報の処理が可能であり、多数の
合成部を制御する多重制御も可能であることは言うまで
もない
第1図は本発明の一実施例のプロツク図、第2図は第1
図をさらに詳しく説明した音声合成装置のプロツク図、
第3図は第2図の一部をより詳しく説明するための図、
第4図は音韻の持続時間長の値を示すための図である。 1・・・・・・システム制御部、2・・・・・・音韻情
報メモリ、3・・・・・・音声合成部、4・・・・・・
入力指令、5・・・・・・出力音声、6・・・・・・ピ
ツチ情報、7・・・・・・時間情報、8・・・・・・音
韻情報アドレス、9・・・・・・アクセント情報、10
・・・・・・制御部、11・・・・・・制御晴報作成部
、11a・・・・・・アクセント情報作成部、11−b
・・・・・・ピッチ情報作成部、11−c・−・・・時
間情報作成部、11−d・・・・・・音韻情報アドレス
作成部、12・・・・・・メモリ、12−a・・・・・
・アクセント情報作成用メモリ、12−a−2・・・・
・・語尾表メモリ、12−b・・・・・・ピツチ情報作
成用メモリ、12−c・・・・・・時間情報作成用メモ
リ、12−d・・・・・・音韻情報アドレス作成用メモ
リ、13・・・・・・割込線、13−1・・・・・・制
御部への割込線、13−1・・・・・・各処理部への割
込線、14・・・・・・データバス、15・・・・・・
入出力制御部、16・・・・・・入力処理部、17・・
・・・・人名主処理部、18・・・・・・会社名主処理
部、19・・・・・・語尾検出処理部、20・・・・・
・音韻変形処理部、21・・・・・・ピツチ情報処理部
、22・・・・・・ピツチ情報送出処理部、23・・・
・・・時間情報処理部、24・・・・・・時間情報送出
部、25・・・・・・音韻情報アドレス処理部、26・
・・・・・音韻情報アドレス送出部。
図をさらに詳しく説明した音声合成装置のプロツク図、
第3図は第2図の一部をより詳しく説明するための図、
第4図は音韻の持続時間長の値を示すための図である。 1・・・・・・システム制御部、2・・・・・・音韻情
報メモリ、3・・・・・・音声合成部、4・・・・・・
入力指令、5・・・・・・出力音声、6・・・・・・ピ
ツチ情報、7・・・・・・時間情報、8・・・・・・音
韻情報アドレス、9・・・・・・アクセント情報、10
・・・・・・制御部、11・・・・・・制御晴報作成部
、11a・・・・・・アクセント情報作成部、11−b
・・・・・・ピッチ情報作成部、11−c・−・・・時
間情報作成部、11−d・・・・・・音韻情報アドレス
作成部、12・・・・・・メモリ、12−a・・・・・
・アクセント情報作成用メモリ、12−a−2・・・・
・・語尾表メモリ、12−b・・・・・・ピツチ情報作
成用メモリ、12−c・・・・・・時間情報作成用メモ
リ、12−d・・・・・・音韻情報アドレス作成用メモ
リ、13・・・・・・割込線、13−1・・・・・・制
御部への割込線、13−1・・・・・・各処理部への割
込線、14・・・・・・データバス、15・・・・・・
入出力制御部、16・・・・・・入力処理部、17・・
・・・・人名主処理部、18・・・・・・会社名主処理
部、19・・・・・・語尾検出処理部、20・・・・・
・音韻変形処理部、21・・・・・・ピツチ情報処理部
、22・・・・・・ピツチ情報送出処理部、23・・・
・・・時間情報処理部、24・・・・・・時間情報送出
部、25・・・・・・音韻情報アドレス処理部、26・
・・・・・音韻情報アドレス送出部。
Claims (1)
- 1 文字コード列化した単語を入力する手段と、前記入
力された文字コード列化した単語により音声合成に必要
な情報を作成する音声情報作成手段と、前記音声情報作
成手段の出力に基づいて音声を合成する手段とを有する
音声合成装置において、前記音声情報作成手段は、(1
)文字コード列化した単語の語尾に対応したアクセント
型を記憶しておく記憶手段と、(2)前記入力された文
字コード列化した単語の語尾と前記記憶手段に記憶され
ている文字コード列化した単語の語尾とを比較し、前記
入力された文字コード列化した単語の語尾が記憶されて
いる文字コード列化した単語の語尾と一致すれば対応す
るアクセント型を指定し、一致しなければ所定のアクセ
ント型を指定する信号を出力するアクセント型指定手段
と、(3)前記アクセント型指定手段の出力により定ま
る前記入力された文字コード列化した単語のアクセント
核の位置の直前の文字コードが、所定のものであれば前
記指定されたアクセント型を所定値に変換出力し、所定
のものでなければ前記指定されたアクセント型をそのま
ま出力するアクセント型修正手段と、を有することを特
徴とする音声合成装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP49060736A JPS5913040B2 (ja) | 1974-05-31 | 1974-05-31 | 音声合成装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP49060736A JPS5913040B2 (ja) | 1974-05-31 | 1974-05-31 | 音声合成装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPS50153806A JPS50153806A (ja) | 1975-12-11 |
| JPS5913040B2 true JPS5913040B2 (ja) | 1984-03-27 |
Family
ID=13150832
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP49060736A Expired JPS5913040B2 (ja) | 1974-05-31 | 1974-05-31 | 音声合成装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPS5913040B2 (ja) |
Families Citing this family (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5688200A (en) * | 1979-12-20 | 1981-07-17 | Nippon Electric Co | Accent pattern generator |
| JPS58134697A (ja) * | 1982-02-05 | 1983-08-10 | 日本電気株式会社 | 波形編集型音声合成装置 |
Family Cites Families (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS5246443B2 (ja) * | 1971-09-30 | 1977-11-25 |
-
1974
- 1974-05-31 JP JP49060736A patent/JPS5913040B2/ja not_active Expired
Also Published As
| Publication number | Publication date |
|---|---|
| JPS50153806A (ja) | 1975-12-11 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| Brown et al. | Questions of intonation | |
| US7177795B1 (en) | Methods and apparatus for semantic unit based automatic indexing and searching in data archive systems | |
| EP1267326B1 (en) | Artificial language generation | |
| US5850629A (en) | User interface controller for text-to-speech synthesizer | |
| US6876967B2 (en) | Speech complementing apparatus, method and recording medium | |
| JP2003005789A (ja) | 文字処理装置および方法 | |
| Pitt et al. | Design of speech-based devices: a practical guide | |
| JPS6050600A (ja) | 規則合成方式 | |
| JPH06282290A (ja) | 自然言語処理装置およびその方法 | |
| JP3371761B2 (ja) | 氏名読み音声合成装置 | |
| JPH0962286A (ja) | 音声合成装置および音声合成方法 | |
| JP5098932B2 (ja) | 歌詞データ表示装置、歌詞データ表示方法、歌詞データ表示プログラム | |
| JP3201329B2 (ja) | 音声合成装置 | |
| JPH09325787A (ja) | 音声合成方法、音声合成装置、文章への音声コマンド組み込み方法、及び装置 | |
| Amrouche et al. | BAC TTS Corpus: Rich Arabic Database for Speech Synthesis | |
| Williams | Word stress assignment in a text-to-speech synthesis system for British English | |
| JPS60142464A (ja) | 音声入力による文章作成システム | |
| JP3414326B2 (ja) | 音声合成用辞書登録装置及び方法 | |
| JP2580566B2 (ja) | 音声合成装置 | |
| JPS6024630A (ja) | 制御情報付きカナ文字列形成方式 | |
| CN1048341C (zh) | 模糊汉字变换装置 | |
| JPH04162098A (ja) | 規則音声合成装置 | |
| Hain | A hybrid approach for grapheme-to-phoneme conversion based on a combination of partial string matching and a neural network | |
| Heggtveit et al. | Intonation modelling with a lexicon of natural F0 contours. | |
| JP2000010579A (ja) | 音声合成装置及びコンピュータ可読記録媒体 |