JPS62293472A - 音声翻訳装置 - Google Patents

音声翻訳装置

Info

Publication number
JPS62293472A
JPS62293472A JP61137504A JP13750486A JPS62293472A JP S62293472 A JPS62293472 A JP S62293472A JP 61137504 A JP61137504 A JP 61137504A JP 13750486 A JP13750486 A JP 13750486A JP S62293472 A JPS62293472 A JP S62293472A
Authority
JP
Japan
Prior art keywords
network
translation
recognition
voice
speech
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP61137504A
Other languages
English (en)
Inventor
Akihiro Kimura
晋太 木村
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Fujitsu Ltd
Original Assignee
Fujitsu Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Fujitsu Ltd filed Critical Fujitsu Ltd
Priority to JP61137504A priority Critical patent/JPS62293472A/ja
Publication of JPS62293472A publication Critical patent/JPS62293472A/ja
Pending legal-status Critical Current

Links

Landscapes

  • Machine Translation (AREA)

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 3、発明の詳細な説明 〔概9〕 認識ネットワークを用いた連続音声飴識装電と、該Wk
ネットワークと飾・じ意味内容を有し、発音記号を付加
された他言語の音声合成ネットワークを用いた連続音声
合成袋Lノと、上記認識ネットワークおよび音声合成ネ
ットワーク間の意味関係を記述したネットワーク7mマ
トリクスをそなえ、^速に翻訳処理を実行するようにし
た音声翻訳装いが開示されている。
〔産業上の利用分野〕
本発明は音声翻訳装置に係り、ある言語の意味のある連
続音声を他の言語の連続音声に変換(翻訳)する場合の
、高速翻訳処理装置に関する。
〔従来の技術〕
いまだ音声翻訳装置なるものは実現されていないが、現
時点で従来技術の組み合わせによって実現可能と思われ
る音声翻訳装置を従来技術として述べる。
音声翻訳装置の実現に必要な技術は、q)連続音声認識
技術、■自動翻訳技術、および■連1z?音声合成技術
の3つである。この3技術を組み合わせて音声翻訳装置
を構成すると第5図のようになる。
(以下日本語から英語への翻訳の例を用いる。)■ 連
続音声認識技術 連続音声認識部では、連続的に発声された音声をvi繊
しテキスト (文字列)に変換する。ブラックボードモ
デル、ネットワークモデル、階層モデルなど音声認識に
必要な情報や知識を処理するためのシステム構成法が提
案され研究が進められている。
一般に連続音声認識では、認識に必要な全ての情報を音
声信号に求めるのではなく、語い論、構文論、および意
味論などの言語に関する予め分かつている知識も利用す
る。音声信号には認識に必要な情報の全てが會まれてい
ると考えないのが一般的であり、また音声信号のみを利
用した認識技術の困難さが広く認められている。
例えばネットワークモデルを採用した連続音声認識装置
では、次のように知識を利用して認識が行われる。音声
認識が行われる状況の知識により、まず人間が話す可能
性のある語いが制限される。
例えば、ある場合は小学校1年の国語の教科書に出てく
る語い、またある場合は飛行機の航突券購入に関する語
いというふうに語いの制限が行われる。現在の連続音声
&jAM&装置では数百から千単語程度が上限となって
いる。これを語い知識による制限と呼ぶ。つぎに単語の
品詞の知識により、連続音声中で隣接できる単語が制限
される。たとえば、′ながい”という形容詞と1を”と
いう助詞が接続することは普通ありえない。これを構文
知識による制限と呼ぶ。さらに単語の意味の知識によシ
、隣接できる単語が制限される。たとえば、′ながい水
′″は形容詞と名詞の接続なので構文(品詞のつながり
)は正しいが、意味的には許されない。
これを意味知識による制限と呼ぶ。これら単語、構文、
および意味に関する知識(制限)を用いて、ある状況に
おける意味の通った文章のセットを規定することができ
る。たとえば、′私”、′あなた”。
2は2.′少年#ご少女”、′少年2.2です1.2だ
”。
2だりた2 というδ合いで、日本語の構文と意味の知
識を用いて意味の通った文!?作ると以下のようになる
。
私は少年です。
私は少年だった。あなたは少年だ。
私は少女です。
私は少女だった。あなたは少女だ。
私は少年だ。
あなたは少年です。あなたは少年だった。
私は少女だ。
あなたは少女です。あなたけ少女だった。(等)つぎの
文章は構文的に可能だが意味的に許されない。
私はあなたです。 少年は少女です。  (等)つぎの
文5iLは意味的にも構文的にも許されない。
ですわたしあなた。
少年はです。はだった。(等) 音声&g識装盾では意味の連つた文章のみを対象とする
。ネットワークモデルを用いた連続音声認識装置では、
上記したような意味の曲うた文章をすべて装置内に記憶
する代わりに、第2図のような単語ネットワークを記憶
し、記憶領域の削減をはかっている。連続音声認識装置
は単語ネットワーク上の一つのバスによって構成される
意味の通った文章を認識できる。
単語ネットワーク内の各単語と実際の音声信号との照合
法としては、動的#i両画法利用した単語スポツティン
グ床、人工知能的手法を利用したトップダウン番ボトム
アップ制御による単詔探索法などを利用することができ
る。ここでは詳Miけ省略する。
■ 自動翻訳技術 自動翻訳部では、例えば日本語から英語に翻訳する場合
は、日本語のテキスト (文字列)を英語のテキストに
変換する。自動翻訳の処理は、日本語解析と英語生成の
2つの処理から成っている。
まず、日本語解析では、日本語のテキストを単語(形態
t、)に分解し、構文知識によって各単語の品詞が決定
され、つづいて文章の意味が解析される。つぎに、英語
生成では、解析された日本語文章の意味に従って英語の
構文細繊や単語の意味知識を用いて文型及び単語が選択
され英文が生成される。
自動翻訳装置はすでに実用化が始まりつつあり、音声翻
訳装置に利用できる技術が多く蓄積されている。
■ 連続音声合成技術 連続音声合成部では、与えられたテキストに人間の発声
に関する知識を適用し人工音声を自動的の強弱e長短な
どを決定する韻律処理と、テキスト (文字列)を発音
記号に直すという音韻処理と、決定された韻律と発音記
号から音声信号を合成す情報をテキスト内に見出しそれ
を信号生成部に通知する。音該如理では、ある文字列が
どのように発音されるかというその’):’ il!に
特有の発音の知識に従って、テキストを発音記号列にf
倭し、それを信号生成処理に通知する。たとえばtas
teのaの発音は(ei)であるがtaxのaの発音は
〔融〕である・ier+じ文字でもまわりの文字の文脈
によつて発音が異なってくる。又useという飴は2使
う“という動詞の場合は(ju:z)と発音するが、′
使用2という名詞の場合は(ju:s)と発音する。こ
れらをここでけ発音の知識と呼ぶ。
信号生成処理では、−律情報と発音記号を用いて人工音
声を合成する。背戸合成法には、現在音声波形のピッチ
周波数(波形繰り返し周波数)を制御し、強弱の情報は
合成音声波形の振幅を制御する。また発音記号は音声波
形のスペクトル包絡特性を制御する。
〔発明が解決しようとする問題点〕
以上述べた、従来技術q)連続音声合成技術、■自動翻
訳技術、および■連続音声合成技術を組み合わせた音声
翻訳装置では、各ステップで複雑な処理(構文処理、意
味処理、韻律処理など)が音声入力時に起動されること
になる。また、自動翻訳処理で構文処理や意味処理を行
った結果から英語テキストを生成しており、連続音声合
成部で品詞や、!味による発音の違いを処理するために
再び構文処理や意味処理をするのけ処理時間の無駄であ
る。このように従来技術を組み合わせるだけでは実時間
音声翻訳の実現が困難である。
本発明の目的は、従来の問題点である音声入力時の膨大
な処理量を減らした実時間音声翻訳装置を提供すること
にある。
〔問題点を解決するための手段〕
本発明は、!続音声入力部に入力される文章の制限が予
め与えられていることに注目し、音声入力時に予想され
る翻訳作業を音声入力前に全て一括処理しておくという
思想に基づいている。音声入力に先立って、自動翻訳部
や人間の翻訳専門家が認識ネットワークを翻訳ネットワ
ークに変声すると共に両ネットワーク間の関係を表した
変換マトリクスを作成し、さらに連続音声合成部の韻律
処理および音韻処理で翻訳ネットワークの単語上に韻律
記号および発音記号を付加した音声合成ネットワークを
作成しておく。音声入力時には、認識ネットワーク上の
パスに、変換マトリクスkm用することKよって音声合
成用の発音・韻律記号を一気に得ることができ、実時間
音声翻訳が実現できる。
〔作用〕
よシ具体的に例を用いて以下説明する。第3図の認識ネ
ットワークと意味等価な英語の翻訳ネットワークは第4
図のようなものとなる。ここではすでに音韻処理によっ
て発音記号を付加した音声合成ネットワークになってい
る。(〔〕内が発音記号を示す。)ここで、xi”−x
4、およびy1〜y4は、各々認識ネットワークおよび
翻BR,−音声合成ネットワーク内の枝分かれ部分に対
応している。例えば、認識ネットワークのxlがOの時
は2あなた”、xlが1の時は”私” が各々認識され
たことを示す。
文章の!1!!!識結果が″あなたは少女だった°の場
合、連続音声V!識装置で得られる認識結果は(xl。
x2. x3. X4)=(010,1,0)という形
である。
また、翻訳・音声合成ネットワークにおいては、同様I
C’ You were a girl’という合成音
が必要な場合、(yl、 y2. y3. y4) =
 C0,0+ 1.0)という命令を与えればよい。(
この場合y2は0でもlでもよい) 両ネットワークの関係金示す変換式は次式のようになる
。式l中のマトリクスを変声マトリクスと呼ぶ。
↑ 1侯マトリクス 例えば、ここで”私は少年だった”という文章を認識し
た場合、連続音声合成部れの認識結果は(xi、 x2
. X31 x4) = (111,II O)である
。式lにこれを代入すると(yl、y2.y3.y4)
=(1゜1、1. ])  が得られ、これに従って音
声合成ネットワークをたどると(a+  waz  a
  bり1〕という発音記号が即座に得られる。
〔実施例〕 第1図は本発明のl実施例の音声翻訳装置のブロック図
である。
図中、lは認識ネットワーク記憶部であり、連続音声!
li!識のため認識ネットワークを保持するもの、2は
ネットワーク変換部であり、上記した第3図図示の如き
認識ネットワークを第4図図示の如き翻訳・音声合成ネ
ットワークに変換するもの、3は翻訳・音声合成ネット
ワーク記憶部であり、発音記号を付加された他言語の翻
訳・音声合成ネットワークを保持するもの、4は変換マ
トリクス記憶部であシ、認識ネットワークと翻訳・音声
合成ネットワーク間の意味関係を記述したネットワーク
変換マ) +7クスを保持するもの、5け連続音声認識
部であり、入力音声を認識し、認識ネットワークにおけ
るネットワーク経路値を出力するもの、6はマトリクス
演算部であり、連続音声認識部より出力されるネットワ
ーク経路値について、ネットワーク変換マトリクスを用
いて対応する他言語の翻訳・音声合成ネットワークのネ
ットワーク経路値に変換するもの、7は翻訳・M声合成
ネットワーク探索部であり、マトリクス演g部から出力
される2・ットワーク経路値を用いて@1訳・音声合成
ネットワークを探索し発音記号を得るもの、8は連続音
声合成部であり、翻訳・音声合成ネット探索部から出力
される発音記号にしたがって音声合成を行なうものであ
る。
実施例の動作は以下の通りである。
まず、音声入力に先立って、認識ネットワーク記憶部l
に格納されているネットワークが翻訳処理と音韻処理を
行うネットワーク変換部2で翻訳・音声合成ネットワー
クに変換され翻訳・音声合成ネットワーク記憶部3に格
納される。このときネットワーク変換部2で7換マトリ
クスが作成されこれが変換マトリクス記憶部4に格納さ
れる。
一方音声入力時には遅続音声關識部5で音声が認識され
、認識ネットワーク上のどのバスを逆ったかが出力され
る。マ) I+クス演算部6では、変換マトリクス記憶
部4の変換マトリクスと連続音声認識部5の認識結果か
ら上記した式1を用いて翻訳結果を求める。翻訳・音声
合成ネットワーク探索部7ではマ) IJクス演算部6
で得られた翻訳結果を用いて音声合成ネットワークを探
索し翻訳イ4辷果に対応する発f記号を得る。連続音声
合成部8では得られた発音記号だ従って従来法によって
韻律処理を行い音声合成を行う。
〔発明の効呆〕
本発明によれば、連続好声認識部にネットワークモデル
を用いる限り高速で正確な音声翻訳装置を提供すること
ができる。
【図面の簡単な説明】
第1図は本発明の1実施例の音声翻訳装置のブロック図
、 第2図は単語ネットワークの例を示す図、第3Mは認識
ネットワークの例を示す図、第4図は翻訳・音声合成ネ
ットワークの例を示す図、 第5図は音声翻訳装置の例を示す図である。 第1図において、lは認識ネットワーク記ti部、2は
ネットワーク変換部、3は翻訳・音声合成ネットワーク
記憶部、4は変換マトリクス記憶部、5は連#!f声認
識部、6はマトリクス演算部、7は翻叙・音声合成ネッ
トワーク探索部、8け連続音声合成部である。 、パ≦二一−一1、 代理人 弁理士  井 桁 貞′(−1゛・ご;・、パ
/ ゝ・−二+:/

Claims (1)

  1. 【特許請求の範囲】 連続音声認識のための認識ネットワークを保持する認識
    ネットワーク記憶部と、 上記認識ネットワークと同じ意味内容を有し、発音記号
    を付加された他言語の翻訳、音声合成ネットワークを保
    持する翻訳・音声合成ネットワーク記憶部と、 上記認識ネットワークと上記翻訳・音声合成ネットワー
    ク間の意味関係を記述したネットワーク変換マトリクス
    を保持する変換マトリクス記憶部と、 入力音声を認識し、上記認識ネットワークにおけるネッ
    トワーク経路値を出力する連続音声認識部と、 上記連続音声認識部より出力されるネットワーク経路値
    について、上記ネットワーク変換マトリクスを用いて対
    応する上記他言語の翻訳・音声合成ネットワークのネッ
    トワーク経路値に変換するマトリクス演算部と、 上記マトリクス演算部から出力されるネットワーク経路
    値を用いて上記翻訳・音声合成ネットワークを探索し発
    音記号を得る翻訳・音声合成ネットワーク探索部と、 上記翻訳・音声合成ネットワーク探索部から出力される
    発音記号にしたがって音声合成を行なう連続音声合成部
    とを有することを特徴とする音声翻訳装置。
JP61137504A 1986-06-13 1986-06-13 音声翻訳装置 Pending JPS62293472A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP61137504A JPS62293472A (ja) 1986-06-13 1986-06-13 音声翻訳装置

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP61137504A JPS62293472A (ja) 1986-06-13 1986-06-13 音声翻訳装置

Publications (1)

Publication Number Publication Date
JPS62293472A true JPS62293472A (ja) 1987-12-21

Family

ID=15200210

Family Applications (1)

Application Number Title Priority Date Filing Date
JP61137504A Pending JPS62293472A (ja) 1986-06-13 1986-06-13 音声翻訳装置

Country Status (1)

Country Link
JP (1) JPS62293472A (ja)

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH027168A (ja) * 1988-02-05 1990-01-11 Advanced Prod & Technol Inc 音声言語翻訳機
JPH0844384A (ja) * 1994-07-26 1996-02-16 Nec Corp 連続単語音声認識装置

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH027168A (ja) * 1988-02-05 1990-01-11 Advanced Prod & Technol Inc 音声言語翻訳機
JPH0844384A (ja) * 1994-07-26 1996-02-16 Nec Corp 連続単語音声認識装置

Similar Documents

Publication Publication Date Title
JPH11249677A (ja) 音声合成装置の韻律制御方法
Labied et al. Moroccan Dialect “Darija” automatic speech recognition: a survey
KR100669241B1 (ko) 화행 정보를 이용한 대화체 음성합성 시스템 및 방법
Kayte et al. Di-phone-based concatenative speech synthesis systems for marathi language
JPS6318458A (ja) 感情情報抽出装置
KR0146549B1 (ko) 한국어 텍스트/음성 변환 방법
JP3446342B2 (ja) 自然言語処理方法および音声合成装置
JP2002123281A (ja) 音声合成装置
JPH0229797A (ja) テキスト音声変換装置
JP2721018B2 (ja) 音声規則合成装置
JPS62119591A (ja) 文章読上げ装置
Rajih Mohammed et al. English-Arabic phonetic dataset construction
KR940022312A (ko) 기계번역장치 및 방법
KR0180650B1 (ko) 음성합성기의 한국어 문장분석방법
JPH03196198A (ja) 音声規則合成装置
JPH04350699A (ja) テキスト音声合成装置
JPH0760378B2 (ja) 文章読み上げ装置
KR960030079A (ko) 의존문법을 후향 언어모델로 사용하는 한국어 연속음성 인식장치 및 방법과 그를 이용한 자동통역시스템
JPH0323500A (ja) テキスト音声合成装置
JPH02308194A (ja) 外国語学習装置
McAllister The structural design of the cstr text-to-speech system.
JPS63140329A (ja) 文章読み上げ方式
JPH04284568A (ja) 韓国語テキスト音声変換方法および装置
JPS6326723A (ja) 文章読み上げ装置
JPH05298364A (ja) 発音記号生成方式