JPH10111700A - 音声圧縮符号化方法および音声圧縮符号化装置 - Google Patents
音声圧縮符号化方法および音声圧縮符号化装置Info
- Publication number
- JPH10111700A JPH10111700A JP8258833A JP25883396A JPH10111700A JP H10111700 A JPH10111700 A JP H10111700A JP 8258833 A JP8258833 A JP 8258833A JP 25883396 A JP25883396 A JP 25883396A JP H10111700 A JPH10111700 A JP H10111700A
- Authority
- JP
- Japan
- Prior art keywords
- encoding
- error signal
- secondary error
- speech
- frequency
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Classifications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L19/00—Speech or audio signals analysis-synthesis techniques for redundancy reduction, e.g. in vocoders; Coding or decoding of speech or audio signals, using source filter models or psychoacoustic analysis
- G10L19/02—Speech or audio signals analysis-synthesis techniques for redundancy reduction, e.g. in vocoders; Coding or decoding of speech or audio signals, using source filter models or psychoacoustic analysis using spectral analysis, e.g. transform vocoders or subband vocoders
- G10L19/0212—Speech or audio signals analysis-synthesis techniques for redundancy reduction, e.g. in vocoders; Coding or decoding of speech or audio signals, using source filter models or psychoacoustic analysis using spectral analysis, e.g. transform vocoders or subband vocoders using orthogonal transformation
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L25/00—Speech or voice analysis techniques not restricted to a single one of groups G10L15/00 - G10L21/00
- G10L25/27—Speech or voice analysis techniques not restricted to a single one of groups G10L15/00 - G10L21/00 characterised by the analysis technique
Landscapes
- Engineering & Computer Science (AREA)
- Physics & Mathematics (AREA)
- Spectroscopy & Molecular Physics (AREA)
- Computational Linguistics (AREA)
- Signal Processing (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Acoustics & Sound (AREA)
- Multimedia (AREA)
- Compression, Expansion, Code Conversion, And Decoders (AREA)
Abstract
量を削減すると共に,メモリ量の低減を図れる音声圧縮
符号化方法および音声圧縮符号化装置を提供する。 【解決手段】 雑音源情報を抽出・符号化する際に,フ
レームまたはサブフレームからピッチ情報およびスペク
トル包絡情報から生成されるピッチ成分音声を除いた成
分である二次誤差信号を抽出し,符号化することによっ
て雑音源情報の抽出・符号化を行う。
Description
応答システム,ボイスメール等に適用される音声圧縮符
号化装置に関し,より詳細には,アナログ音声波形を入
力してディジタル音声波形に変換した後,該ディジタル
音声波形を所定の符号化方式で符号化することにより,
データ量を圧縮する音声圧縮符号化装置に関する。
るチャンネル容量の拡大や,マルチメディア通信におけ
る膨大な情報の蓄積・伝送の必要性から,実用的な低ビ
ットレート音声符号化に対する要求が高まっている。
して,留守番電話のための音声符号化手法の開発も望ま
れている。
音声符号化方式では,CELP(Code Excit
ed Linear Prediction codi
ngsystem)方式が主流になっている。このCE
LP方式は,線形予測に基づく音声のAR(Auto−
Regressive:自己回帰)モデルに基づいた符
号化方式である。
レームまたはサブフレームと呼ばれる単位に分割し,そ
れぞれの単位についてスペクトル包絡を表すLPC(L
inear Prediction Coding:線
形予測)係数と,そのピッチ情報を表すピッチラグと,
音源情報である雑音源情報と,利得とを抽出し,それぞ
れ符号化を行い,格納または伝送するものである。
復元し,雑音源情報にピッチ情報を加えることによって
励振源信号を生成し,この励振源信号をLPC係数で構
成される線形予測合成フィルタに通し,合成音声を得る
ものである。
来のCELP方式では,10kbpsの低ビットレート
において,良好な音声を得ることができるという利点を
有する反面,それぞれのパラメータの符号化過程におけ
る演算量が多いという問題点があった。
符号化については,符号化された励振源信号を線形予測
合成フィルタに通した合成音声を生成し,原音声と比較
する必要があるが,フィルタ演算には多くの演算を必要
とするため,全ての励振源信号をフィルタに通すのは非
現実的であるという問題点があった。
信号の符号帳を持ち,符号帳に属する各符号ベクトルと
スペクトル包絡とから二次誤差信号を合成し,入力信号
から得られた二次誤差信号と比較し,そのひずみが最小
となる符号を選択することによって符号化を行っている
ため,符号帳探索のための演算量および符号帳を蓄える
ためのメモリ量が多くなるという問題点もあった。
する従来技術として,例えば,フィルタ演算を行って比
較するのではなく,近似的に原音声との比較を行うこと
のできるパラメータによって絞り込むという予備選択手
法が提案されている。
当する雑音ベクトルを蓄えているのが一般的であり,そ
の構成を工夫することにより,演算量を削減する方法も
提案されている。具体的には,雑音ベクトルをビット数
だけ持ち,それらの和や差で雑音源を表すVSELP
(Vector Sum Excited Linea
r Prediction coding)方式がその
一例である。
号化に対する要求から,上記従来のCELP方式におけ
る演算量を削減する方法(予備選択手法,VSELP方
式等)の他にも,それらとは異なる方法で演算量を削減
可能なものが要望されている。
て,CELP方式の符号化の過程において,演算量を削
減すると共に,メモリ量の低減を図れる音声圧縮符号化
方法および音声圧縮符号化装置を提供することを目的と
する。
めに,請求項1に係る音声圧縮符号化方法は,アナログ
音声波形を入力してディジタル音声波形に変換する第1
の工程と,前記ディジタル音声波形を所定の符号化方式
で符号化する第2の工程と,前記符号化された音声波形
を蓄積する第3の工程と,前記蓄積されたディジタル音
声波形を取り出して復号化する第4の工程と,前記復号
化されたディジタル音声波形をアナログ音声波形に変換
する第5の工程と,を有する音声圧縮符号化方法におい
て,前記第2の工程が,前記ディジタル音声波形をフレ
ームまたはサブフレームと呼ばれる単位に分割するフレ
ーム分割工程と,前記分割したフレームまたはサブフレ
ームの単位のそれぞれについて,スペクトル包絡を表す
スペクトル包絡情報,ピッチ情報および音源情報である
雑音源情報を抽出し,符号化する抽出・符号化工程と,
を含み,前記第4の工程が,符号化された前記スペクト
ル包絡情報,ピッチ情報および雑音源情報を復元する復
元工程と,前記復元した雑音源情報およびピッチ情報か
ら励振源信号を生成する励振源信号生成工程と,前記励
振源信号と前記復元したスペクトル包絡情報から合成音
声を生成する合成音声生成工程と,を含み,さらに,前
記抽出・符号化工程が,前記雑音源情報を抽出・符号化
する際に,前記フレームまたはサブフレームから前記ピ
ッチ情報および前記スペクトル包絡情報から生成される
ピッチ成分音声を除いた成分である二次誤差信号を抽出
し,符号化することによって前記雑音源情報の抽出・符
号化を行うものである。
は,請求項1記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号を符号化する際
に,前記二次誤差信号を周波数領域に変換した後,変換
領域における係数を符号化することにより,前記二次誤
差信号の符号化を行うものである。
は,請求項2記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号を周波数領域に
変換する際に,離散コサイン変換を用いるものである。
は,請求項2記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号を周波数領域に
変換する際に,離散フーリエ変換を用いるものである。
は,請求項2記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号を周波数領域に
変換する際に,K−L(Karhunen−Loev
e)変換を用いるものである。
は,請求項2記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記変換領域における係数を符号
化する際に,前記二次誤差信号の周波数領域におけるス
ペクトル強度最大のものからあらかじめ定められた数の
周波数を選定し,前記選定された周波数および前記選定
された周波数のスペクトル係数を符号化することによっ
て,前記二次誤差信号の符号とするものである。
は,請求項1記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号の強度最大のも
のからあらかじめ定められた数のサンプル位置を選定
し,前記選定されたサンプル位置および前記選定された
サンプル位置の強度を符号化することによって,前記二
次誤差信号の符号とするものである。
は,請求項1記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号の強度最大のも
のから幾つかのサンプル位置を選定し,前記選定された
サンプル位置および前記選定されたサンプル位置の振幅
を符号化したものと,前記二次誤差信号の周波数領域に
おけるスペクトル強度最大のものから幾つかの周波数を
選定し,前記選定された周波数および前記選定された周
波数のスペクトル係数を符号化したものとによって,前
記二次誤差信号の符号とするものである。
は,請求項2記載の音声圧縮符号化方法において,前記
抽出・符号化工程が,前記二次誤差信号の強度最大のも
のからあらかじめ定められた数のサンプル位置を選定
し,前記選定されたサンプル位置および前記選定された
サンプル位置の振幅を符号化したものと,前記二次誤差
信号の周波数領域におけるスペクトル強度最大のものか
らあらかじめ定められた周波数を選定し,前記選定され
た周波数および前記選定された周波数のスペクトル係数
を符号化したものとによって,前記二次誤差信号の符号
とするものである。
法は,請求項2記載の音声圧縮符号化方法において,前
記抽出・符号化工程が,前記二次誤差信号の強度最大の
ものから幾つかのサンプル位置を選定し,前記選定され
たサンプル位置および前記選定されたサンプル位置の振
幅を符号化したものと,前記二次誤差信号の周波数領域
におけるスペクトル強度最大のものから幾つかの周波数
を選定し,前記選定された周波数および前記選定された
周波数のスペクトル係数を符号化したものとを用い,さ
らに選定数の合計数をあらかじめ定めた数にし,復号音
声のひずみが最も小さくなるように組み合わせを選択す
ることによって,前記二次誤差信号の符号とするもので
ある。
法は,請求項2記載の音声圧縮符号化方法において,前
記第4の工程が,前記符号化後の二次誤差信号である雑
音源情報を時間軸に戻した量子化二次誤差信号に乱数を
加える工程を含むものである。
法は,請求項2記載の音声圧縮符号化方法において,前
記第4の工程が,前記符号化後の二次誤差信号である雑
音源情報を時間軸に戻した量子化二次誤差信号に1/f
ゆらぎを加える工程を含むものである。
置は,アナログ音声波形を入力してディジタル音声波形
に変換するA/D変換手段と,前記ディジタル音声波形
を所定の符号化方式で符号化する音声符号化手段と,前
記符号化された音声波形を蓄積する蓄積手段と,前記蓄
積手段から前記符号化されたディジタル音声波形を取り
出して復号化する音声復号化手段と,前記復号化された
ディジタル音声波形をアナログ音声波形に変換するD/
A変換手段と,を備えた音声圧縮符号化装置において,
前記音声符号化手段が,前記ディジタル音声波形をフレ
ームまたはサブフレームと呼ばれる単位に分割するフレ
ーム分割手段と,前記分割したフレームまたはサブフレ
ームの単位のそれぞれについて,スペクトル包絡を表す
スペクトル包絡情報,ピッチ情報および音源情報である
雑音源情報を抽出し,符号化する抽出・符号化手段と,
を含み,前記音声復号化手段が,符号化された前記スペ
クトル包絡情報,ピッチ情報および雑音源情報を復元す
る復元手段と,前記復元した雑音源情報およびピッチ情
報から励振源信号を生成する励振源信号生成手段と,前
記励振源信号と前記復元したスペクトル包絡情報から合
成音声を生成する合成音声生成手段と,を含み,さら
に,前記抽出・符号化手段が,前記雑音源情報を抽出・
符号化する際に,前記フレームまたはサブフレームから
前記ピッチ情報および前記スペクトル包絡情報から生成
されるピッチ成分音声を除いた成分である二次誤差信号
を抽出し,符号化することによって前記雑音源情報の抽
出・符号化を行うものである。
置は,請求項13記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号を符号化す
る際に,前記二次誤差信号を周波数領域に変換した後,
変換領域における係数を符号化することにより,前記二
次誤差信号の符号化を行うものである。
置は,請求項14記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号を周波数領
域に変換する際に,離散コサイン変換を用いるものであ
る。
置は,請求項14記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号を周波数領
域に変換する際に,離散フーリエ変換を用いるものであ
る。
置は,請求項14記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号を周波数領
域に変換する際に,K−L(Karhunen−Loe
ve)変換を用いるものである。
置は,請求項14記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記変換領域における係数を
符号化する際に,前記二次誤差信号の周波数領域におけ
るスペクトル強度最大のものからあらかじめ定められた
数の周波数を選定し,前記選定された周波数および前記
選定された周波数のスペクトル係数を符号化することに
よって,前記二次誤差信号の符号とするものである。
置は,請求項13記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号の強度最大
のものからあらかじめ定められた数のサンプル位置を選
定し,前記選定されたサンプル位置および前記選定され
たサンプル位置の強度を符号化することによって,前記
二次誤差信号の符号とするものである。
置は,請求項13記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号の強度最大
のものから幾つかのサンプル位置を選定し,前記選定さ
れたサンプル位置および前記選定されたサンプル位置の
振幅を符号化したものと,前記二次誤差信号の周波数領
域におけるスペクトル強度最大のものから幾つかの周波
数を選定し,前記選定された周波数および前記選定され
た周波数のスペクトル係数を符号化したものとによっ
て,前記二次誤差信号の符号とするものである。
置は,請求項14記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号の強度最大
のものからあらかじめ定められた数のサンプル位置を選
定し,前記選定されたサンプル位置および前記選定され
たサンプル位置の振幅を符号化したものと,前記二次誤
差信号の周波数領域におけるスペクトル強度最大のもの
からあらかじめ定められた周波数を選定し,前記選定さ
れた周波数および前記選定された周波数のスペクトル係
数を符号化したものとによって,前記二次誤差信号の符
号とするものである。
置は,請求項14記載の音声圧縮符号化装置において,
前記抽出・符号化手段が,前記二次誤差信号の強度最大
のものから幾つかのサンプル位置を選定し,前記選定さ
れたサンプル位置および前記選定されたサンプル位置の
振幅を符号化したものと,前記二次誤差信号の周波数領
域におけるスペクトル強度最大のものから幾つかの周波
数を選定し,前記選定された周波数および前記選定され
た周波数のスペクトル係数を符号化したものとを用い,
さらに選定数の合計数をあらかじめ定めた数にし,復号
音声のひずみが最も小さくなるように組み合わせを選択
することによって,前記二次誤差信号の符号とするもの
である。
置は,請求項14記載の音声圧縮符号化装置において,
前記音声復号化手段が,前記符号化後の二次誤差信号で
ある雑音源情報を時間軸に戻した量子化二次誤差信号に
乱数を加えるものである。
置は,請求項14記載の音声圧縮符号化装置において,
前記音声復号化手段が,前記符号化後の二次誤差信号で
ある雑音源情報を時間軸に戻した量子化二次誤差信号に
1/fゆらぎを加えるものである。
法および音声圧縮符号化装置について,〔実施の形態
1〕,〔実施の形態2〕,〔実施の形態3〕,〔実施の
形態4〕,〔実施の形態5〕,〔実施の形態6〕,〔実
施の形態7〕の順で,図面を参照して詳細に説明する。
音声圧縮符号化装置100の概略構成図を示す。音声圧
縮符号化装置100は,アナログ信号(アナログ音声波
形)を入力してディジタル信号(ディジタル音声波形)
に変換するA/D変換手段としてのA/D変換部101
と,A/D変換部101からディジタル信号を入力し
て,圧縮符号化する音声符号化手段としての音声符号化
部102と,圧縮符号化された圧縮符号化信号を蓄積す
る蓄積手段としての蓄積部103と,圧縮符号化信号を
伸長復号する音声復号化手段としての音声復号化部10
4と,復号化されたディジタル信号をアナログ信号に変
換するD/A変換手段としてのD/A変換部105と,
から構成される。
成図を示し,入力したディジタル信号をあらかじめ定め
られたサンプル数のフレーム単位に分割し,フレーム信
号を出力するフレーム分割器201と,フレーム分割器
201で分割したフレーム(フレーム信号)から,フレ
ーム単位でスペクトル包絡を表すスペクトル包絡情報を
抽出して符号化するスペクトル包絡抽出器202と,フ
レーム分割器201で分割したフレームをさらにあらか
じめ定められたサンプル数のサブフレーム単位に分割
し,サブフレーム信号を出力するサブフレーム分割器2
03と,スペクトル包絡抽出器202で抽出したスペク
トル包絡情報を用いて,サブフレーム分割器203で分
割したサブフレームからピッチ情報を抽出して符号化す
るピッチ情報抽出器204と,ピッチ情報とサブフレー
ム信号とを入力し,二次誤差信号を算出する二次誤差信
号算出器205と,二次誤差信号とスペクトル包絡情報
とから音源情報である雑音源情報を抽出して符号化する
雑音源抽出器206と,から構成される。
る。図1において,アナログ音声入力装置(図示せず)
から入力されたアナログ信号(アナログ音声波形)はA
/D変換部101によってディジタル信号に変換され
る。ここで,アナログ音声入力装置としては,例えば,
マイクロフォンや,CDプレーヤ,カセットデッキ等が
挙げられる。
102に送られ,図2に示すように,フレーム分割器2
01によってあらかじめ定められたサンプル数(例え
ば,240サンプル)のフレームと呼ばれる単位に分割
される。このフレームはフレーム信号としてスペクトル
包絡抽出器202およびサブフレーム分割器203に出
力される。
ム信号からスペクトル包絡情報を抽出して符号化し,ピ
ッチ情報抽出器204および二次誤差信号算出器205
へ出力する。スペクトル包絡情報としては,例えば,線
形予測分析に基づく線形予測係数,PARCOR係数,
LSP係数等が挙げられる。またスペクトル包絡情報の
符号化には,ベクトル量子化や,スカラー量子化,分割
ベクトル量子化,多段ベクトル量子化,予測量子化,あ
るいはそれらの複数の量子化の組み合わせが挙げられ
る。
ーム分割器201からフレーム信号を入力し,該フレー
ム信号をあらかじめ定められたサンプル数(例えば,6
0サンプル)に分割し,サブフレーム信号として出力す
る。
4において,スペクトル包絡抽出器202によって抽出
されたスペクトル包絡情報を用いて,ピッチ情報が抽出
され,符号化される。ピッチ情報抽出には,CELP方
式で用いられる適応符号帳探索,あるいはフーリエ変
換,ウェーブレット変換等のスペクトル包絡情報から求
める方法が適用できる。また,上記適応符号帳探索に
は,聴覚重みづけフィルタを用いる場合もある。なお,
聴覚重みづけフィルタは,前述した線形予測係数から構
成することができる。
ーム信号から,ピッチ情報抽出器204で抽出したピッ
チ成分(ピッチ情報)の影響を取り除いた成分(これを
二次誤差信号と呼ぶ)を算出し,雑音源抽出器206へ
出力する。
信号を入力すると,この二次誤差信号を直接符号化し,
符号化した二次誤差信号(量子化二次誤差信号と呼ぶ)
を雑音源情報として出力する。ここで,雑音源抽出器2
06で二次誤差信号を符号化する方法としては,二次誤
差信号の強度最大のものからあらかじめ定められた数の
サンプル位置を選定し,選定されたサンプル位置および
選定されたサンプル位置の強度を符号化することによっ
て,二次誤差信号を符号化する方法を適用する。これに
よって比較的演算量を少なくすることができる。
は,CELP音声符号化に属する符号化方法である。従
来のCELP方式では,二次誤差信号の符号帳を持ち,
符号帳に属する各符号ベクトルとスペクトル包絡情報と
から二次誤差信号を合成し,入力信号から得られた二次
誤差信号と比較し,そのひずみが最小となる符号を選択
することによって符号化を行っている。因みに,この探
索においては聴覚重みづけフィルタを用いることができ
る。
トで高品質の音声圧縮符号化技術であるものの,符号帳
探索のための演算量および符号帳を蓄えるためのメモリ
量の多さが問題となっている。これに対して,実施の形
態1では,二次誤差信号そのものを符号化するため,演
算量を削減でき,また符号帳を記憶する必要がないた
め,低メモリ量のCELP方式を提供することができ
る。
ィジタル信号からスペクトル包絡情報,ピッチ情報およ
び雑音源情報を抽出して符号化し,これらを量子化信号
として出力する。これらの量子化信号は,圧縮符号化信
号として蓄積部103によって蓄積される。
圧縮符号化信号(量子化信号)は,必要に応じて,音声
復号化部104によって読み出されて復号化(復元)さ
れ,D/A変換部105でアナログ信号(アナログ音声
波形)に変換される。
されたスペクトル包絡情報,ピッチ情報および雑音源情
報を復元し,復元した雑音源情報およびピッチ情報から
励振源信号を生成し,該励振源信号と復元したスペクト
ル包絡情報から復号音声(合成音声)を生成して,D/
A変換部105に出力する。
号帳を持たないため,符号帳に必要なメモリ量が削減で
き,さらにフィルタ計算を用いた符号帳探索を行わない
ため,演算量が削減できる。
符号化装置は,二次誤差信号を符号化する際に,二次誤
差信号を周波数領域に変換した後,変換領域における係
数を符号化することにより,二次誤差信号の符号化とす
るものである。
しては,例えば,離散コサイン変換,離散フーリエ変
換,K−L(Karhunen−Loeve)変換を用
いることができる。周波数領域は,少ないパラメータで
音声信号の特徴を表すことができるため,多くの音声処
理に用いられている。また,周波数領域への変換は,例
えば,FFT(高速フーリエ変換)を用いる等のように
低演算量で変換可能なものが知られている。したがっ
て,二次誤差信号を周波数領域に変換し,変換係数を符
号化することにより,演算量を大幅に削減することが可
能である。
1の概略ブロック図を示す。なお,基本的な構成および
動作は,図1および図2で示した実施の形態1の音声圧
縮符号化装置と同様に付き,ここでは異なる部分のみを
説明する。
誤差信号算出器205から入力した二次誤差信号を離散
コサイン変換によって周波数領域に変換する離散コサイ
ン変換器302と,離散コサイン変換器302から周波
数領域の係数(DCT係数)を入力し,該係数を符号化
する係数符号化器303と,から構成される。
おける係数(周波数領域の係数)を符号化する際に,二
次誤差信号の周波数領域におけるスペクトル強度最大の
ものからあらかじめ定められた数(例えば,2)の周波
数を選定し,選定された周波数を符号化すると共に,そ
の周波数のスペクトル係数(強度)も量子化強度として
符号化する。符号化(量子化)の方法としては,例え
ば,振幅を対数変換し,その大きさ(強度)に対応させ
てあらかじめ設定した範囲に相当する符号を与える。こ
の場合,選択された周波数に与えられた番号,強度の属
する範囲に与えられた符号である量子化強度,および係
数の符号(+/−)が二次誤差信号に対応する符号(す
なわち,雑音源情報)となる。
実施の形態1と同様に蓄積部103に蓄積される。
は,蓄積部103から雑音源情報として,周波数に与え
られた番号,量子化強度および係数の符号(+/−)を
入力し,これらの雑音源情報から二次誤差信号を復元す
る必要があるため,離散コサイン係数を復元する構成お
よび離散コサイン係数から二次誤差信号を復元する構成
を追加する必要がある。
4の一部構成を示し,図示の如く,符号化された係数を
入力して元の係数に復元する係数復元器401と,復元
した係数を周波数領域から時間領域に戻す逆離散コサイ
ン変換器402とを備えている。音声復号化部104で
は,蓄積部103から雑音源情報を入力すると,係数復
元器401においてこれらの符号から各係数を復元し,
さらに逆離散コサイン変換器402によって周波数領域
から時間領域に戻し,量子化二次誤差信号として復元す
る。なお,符号化側で,ピッチ情報抽出に適応符号帳探
索を用いる場合には,符号から各係数を復元し,時間領
域に戻し,さらにスペクトル包絡情報を用いた線形予測
逆フィルタ(図示せず)で残差領域に変換することによ
り,通常のCELPにおける雑音符号ベクトルとして用
いることも可能である。
施の形態1の効果に加えて,音声波形の特徴である周波
数特徴を符号化するので,少ないビット数で二次誤差信
号を符号化することができる。また,離散コサイン変換
は高速フーリエ変換によって高速かつ低演算量で実現す
ることが可能であるので,さらに低演算量の符号化が可
能となる。
際に,二次誤差信号の周波数領域におけるスペクトル強
度最大のものからあらかじめ定められた数の周波数を選
定し,選定された周波数および選定された周波数のスペ
クトル係数を符号化することによって,二次誤差信号を
符号化しているので,低演算量で二次誤差信号の符号化
を行うことができる。
換方法として,離散コサイン変換を用いたが,離散フー
リエ変換またはK−L(Karhunen−Loev
e)変換を用いても良く,同様に少ないビット数で二次
誤差信号を符号化することができる。
符号化装置は,二次誤差信号を符号化する際に,二次誤
差信号の強度最大のものから幾つかのサンプル位置を選
定し,選定されたサンプル位置および選定されたサンプ
ル位置の振幅を符号化したものと,二次誤差信号の周波
数領域におけるスペクトル強度最大のものから幾つかの
周波数を選定し,選定された周波数および選定された周
波数のスペクトル係数を符号化したものとによって,二
次誤差信号を符号化するものである。
1の概略ブロック図を示す。なお,基本的な構成および
動作は,図1および図2で示した実施の形態1の音声圧
縮符号化装置と同様に付き,ここでは異なる部分のみを
説明する。
誤差信号を入力し,二次誤差信号の強度最大のものから
N1個のサンプルを選択し,その位置および強度を符号
化する係数符号化器502aを有した時間領域符号化器
502と,二次誤差信号を入力し,周波数領域変換器5
03aで二次誤差信号を周波数領域に変換し,係数符号
化器503bで周波数の強度最大のものからN2個の周
波数を選択し,その周波数のスペクトル係数を符号化す
る周波数領域符号化器503と,時間領域符号化器50
2および周波数領域符号化器503から送られてきたN
1+N2個の符号のうち,時間領域からM1個,周波数
領域からM2個を,M1とM2との和があらかじめ定め
たM個となるように選択する係数選択器504と,から
構成される。
02において,二次誤差信号の最大強度のものからN1
個のサンプルを選択し,その位置およびその強度を符号
化し,係数選択器504へ送る。
て,先ず,二次誤差信号を周波数領域に変換し,強度再
度のものからN2個の周波数を選択し,その周波数およ
びスペクトル係数を符号化し,係数選択器504へ送
る。
502および周波数領域符号化器503から送られてき
たN1+N2個の符号のうち,時間領域からM1個,周
波数領域からM2個を,M1とM2との和があらかじめ
定めたM個となるように選択し,選択結果を二次誤差信
号の符号化したデータ(雑音源情報)として出力する。
間領域の特徴と周波数領域の特徴との双方を組み合わせ
て符号化するため,実施の形態1または実施の形態2と
比較して,同ビットレートで高音質の復号音声を得るこ
とができる。
符号化装置は,実施の形態3の音声圧縮符号化装置と同
様の構成において,二次誤差信号の強度最大のものから
あらかじめ定められた数のサンプル位置を選定し,選定
されたサンプル位置および選定されたサンプル位置の振
幅を符号化したものと,二次誤差信号の周波数領域にお
けるスペクトル強度最大のものからあらかじめ定められ
た周波数を選定し,選定された周波数および選定された
周波数のスペクトル係数を符号化したものとによって,
二次誤差信号を符号化するものである。
雑音源抽出器501において,時間領域符号化器502
で選択するサンプル数N1と周波数領域符号化器503
で選択するサンプル数N2とを固定し,かつ,M=N1
+N2に設定した場合に相当する。
様に時間領域の特徴と周波数領域の特徴との双方を組み
合わせて符号化するため,実施の形態1または実施の形
態2と比較して,同ビットレートで高音質の復号音声を
得ることができる。
符号化装置は,実施の形態3の音声圧縮符号化装置と同
様の構成において,二次誤差信号の強度最大のものから
幾つかのサンプル位置を選定し,選定されたサンプル位
置および選定されたサンプル位置の振幅を符号化したも
のと,二次誤差信号の周波数領域におけるスペクトル強
度最大のものから幾つかの周波数を選定し,選定された
周波数および選定された周波数のスペクトル係数を符号
化したものとを用い,さらに選定数の合計数をあらかじ
め定めた数にし,復号音声のひずみが最も小さくなるよ
うに組み合わせを選択することによって,二次誤差信号
を符号化するものである。換言すれば,復号音声のひず
みが最小となるように時間領域の係数および周波数領域
の係数の数を調整するものである。
雑音源抽出器501において,係数選択器504で,サ
ンプル数M1,M2の組み合わせてとして考えられる全
ての組み合わせについて,入力音声とのひずみを算出
し,そのひずみが最も小さくなるM1とM2とを選択
し,その値に相当する符号を用いて二次誤差信号の符号
とする。なお,この場合にはM1とM2の組み合わせを
表現するための情報の符号化する必要があるが,例え
ば,Mが2とか,3といった値の場合,サブフレーム当
たり2ビット程度の増加で良い。
様に時間領域の特徴と周波数領域の特徴との双方を組み
合わせて符号化するため,実施の形態1または実施の形
態2と比較して,同ビットレートで高音質の復号音声を
得ることができる。
復号音声のひずみが最小となるように時間領域の係数お
よび周波数領域の係数の数を調整するので,ビットレー
トを増やすことなく,さらに高音質の復号音声を得るこ
とができる。
符号化装置は,実施の形態2と同様に,二次誤差信号を
符号化する際に,二次誤差信号を周波数領域に変換した
後,変換領域における係数を符号化することにより,二
次誤差信号の符号化とすることに加えて,さらに,雑音
源情報を復元する際に,復号側(本発明の音声復号化手
段)で,雑音源情報(符号化後の二次誤差信号)を時間
軸に戻した量子化二次誤差信号とした後,乱数を加える
ものである。なお,基本的な構成および動作は,実施の
形態2の音声圧縮符号化装置と同様に付き,ここでは異
なる部分のみを説明する。
4の一部構成を示し,図示の如く,符号化された係数を
入力して元の係数に復元する係数復元器601と,復元
した係数を周波数領域から時間領域に戻す逆離散コサイ
ン変換器602と,量子化二次誤差信号に乱数を加える
ための白色雑音付加器603と,を備えている。なお,
ここでは,白色雑音を加えることによって乱数を与える
例を示すが,特にこれに限定するものではなく,他の方
法であっても良い。
る。音声復号化部104では,蓄積部103から雑音源
情報を入力すると,係数復元器601においてこれらの
符号から各係数を復元し,さらに逆離散コサイン変換器
602によって周波数領域から時間領域に戻し,量子化
二次誤差信号に復元する。続いて,白色雑音付加器60
3で,量子化二次誤差信号に白色雑音を与えることによ
り乱数を加え,雑音付加量子化二次誤差信号として出力
する。
二次誤差信号を符号化する際に,二次誤差信号を周波数
領域に変換した後,強度が最大のものだけを残して符号
化した場合でも,それ以外のスペクトル成分が含まれる
ことが多い。したがって,実施の形態6に示すように,
復元側(音声復号化部104)で,量子化二次誤差信号
に乱数を加えることにより,実施の形態1〜実施の形態
5と比較して,より自然な復号音声を得ることができる
ようになる。
符号化装置は,実施の形態2と同様に,二次誤差信号を
符号化する際に,二次誤差信号を周波数領域に変換した
後,変換領域における係数を符号化することにより,二
次誤差信号の符号化とすることに加えて,さらに,雑音
源情報を復元する際に,復号側(本発明の音声復号化手
段)で,雑音源情報(符号化後の二次誤差信号)を時間
軸に戻した量子化二次誤差信号とした後,1/fゆらぎ
を加えるものである。なお,基本的な構成および動作
は,実施の形態2の音声圧縮符号化装置と同様に付き,
ここでは異なる部分のみを説明する。
4の一部構成を示し,図示の如く,符号化された係数を
入力して元の係数に復元する係数復元器701と,復元
した係数を周波数領域から時間領域に戻す逆離散コサイ
ン変換器702と,量子化二次誤差信号に1/fゆらぎ
を加えるための1/fゆらぎ付加器703と,を備えて
いる。
る。音声復号化部104では,蓄積部103から雑音源
情報を入力すると,係数復元器701においてこれらの
符号から各係数を復元し,さらに逆離散コサイン変換器
702によって周波数領域から時間領域に戻し,量子化
二次誤差信号に復元する。続いて,1/fゆらぎ付加器
703で,量子化二次誤差信号に1/fゆらぎを与える
ことにより乱数を加え,1/fゆらぎ付加量子化二次誤
差信号として出力する。
二次誤差信号を符号化する際に,例えば,二次誤差信号
を周波数領域に変換した後,強度が最大のものだけを残
して符号化した場合でも,それ以外のスペクトル成分が
含まれることが多い。したがって,実施の形態7に示す
ように,復元側(音声復号化部104)で,量子化二次
誤差信号に1/fゆらぎを加えることにより,実施の形
態1〜実施の形態5と比較して,より自然な復号音声を
得ることができるようになる。
符号化方法(請求項1)は,雑音源情報を抽出・符号化
する際に,フレームまたはサブフレームからピッチ情報
およびスペクトル包絡情報から生成されるピッチ成分音
声を除いた成分である二次誤差信号を抽出し,符号化す
ることによって雑音源情報の抽出・符号化を行うため,
CELP方式の符号化の過程において,演算量を削減す
ると共に,メモリ量の低減を図ることができる。
項2)は,請求項1記載の音声圧縮符号化方法におい
て,二次誤差信号を符号化する際に,二次誤差信号を周
波数領域に変換した後,変換領域における係数を符号化
することにより,二次誤差信号の符号化を行うため,換
言すれば,周波数特徴を符号化するため,少ないビット
数で二次誤差信号を符号化することができる。
項3)は,請求項2記載の音声圧縮符号化方法におい
て,二次誤差信号を周波数領域に変換する際に,離散コ
サイン変換を用いるため,高速かつ低演算量で符号化を
行うことができる。
項4)は,請求項2記載の音声圧縮符号化方法におい
て,二次誤差信号を周波数領域に変換する際に,離散フ
ーリエ変換を用いるため,高速かつ低演算量で符号化を
行うことができる。
項5)は,請求項2記載の音声圧縮符号化方法におい
て,二次誤差信号を周波数領域に変換する際に,K−L
(Karhunen−Loeve)変換を用いるため,
高速かつ低演算量で符号化を行うことができる。
項6)は,請求項2記載の音声圧縮符号化方法におい
て,変換領域における係数を符号化する際に,二次誤差
信号の周波数領域におけるスペクトル強度最大のものか
らあらかじめ定められた数の周波数を選定し,選定され
た周波数および選定された周波数のスペクトル係数を符
号化することによって,二次誤差信号の符号とするた
め,周波数領域の係数の符号化を比較的低演算量で実現
できる。
項7)は,請求項2記載の音声圧縮符号化方法におい
て,二次誤差信号の強度最大のものからあらかじめ定め
られた数のサンプル位置を選定し,選定されたサンプル
位置および選定されたサンプル位置の強度を符号化する
ことによって,二次誤差信号の符号とするため,周波数
領域の係数の符号化を比較的低演算量で実現できる。
項8)は,請求項1記載の音声圧縮符号化方法におい
て,二次誤差信号の強度最大のものから幾つかのサンプ
ル位置を選定し,選定されたサンプル位置および選定さ
れたサンプル位置の振幅を符号化したものと,二次誤差
信号の周波数領域におけるスペクトル強度最大のものか
ら幾つかの周波数を選定し,選定された周波数および選
定された周波数のスペクトル係数を符号化したものとに
よって,二次誤差信号の符号とするため,換言すれば,
時間領域の特徴と周波数領域の特徴との双方を組み合わ
せて符号化するため,同ビットレートで高音質の復号音
声を得ることができる。
項9)は,請求項2記載の音声圧縮符号化方法におい
て,二次誤差信号の強度最大のものからあらかじめ定め
られた数のサンプル位置を選定し,選定されたサンプル
位置および選定されたサンプル位置の振幅を符号化した
ものと,二次誤差信号の周波数領域におけるスペクトル
強度最大のものからあらかじめ定められた周波数を選定
し,選定された周波数および選定された周波数のスペク
トル係数を符号化したものとによって,二次誤差信号の
符号とするため,換言すれば,時間領域の特徴と周波数
領域の特徴との双方を組み合わせて符号化するため,同
ビットレートで高音質の復号音声を得ることができる。
項10)は,請求項2記載の音声圧縮符号化方法におい
て,二次誤差信号の強度最大のものから幾つかのサンプ
ル位置を選定し,選定されたサンプル位置および選定さ
れたサンプル位置の振幅を符号化したものと,二次誤差
信号の周波数領域におけるスペクトル強度最大のものか
ら幾つかの周波数を選定し,選定された周波数および選
定された周波数のスペクトル係数を符号化したものとを
用い,さらに選定数の合計数をあらかじめ定めた数に
し,復号音声のひずみが最も小さくなるように組み合わ
せを選択することによって,二次誤差信号の符号とする
ため,ビットレートを増やすことなく,高音質の復号音
声を得ることができる。
項11)は,請求項2記載の音声圧縮符号化方法におい
て,符号化後の二次誤差信号である雑音源情報を時間軸
に戻した量子化二次誤差信号に乱数を加えるため,より
自然な復号音声を得ることができる。
項12)は,請求項2記載の音声圧縮符号化方法におい
て,符号化後の二次誤差信号である雑音源情報を時間軸
に戻した量子化二次誤差信号に1/fゆらぎを加えるた
め,より自然な復号音声を得ることができる。
項13)は,音声符号化手段が,ディジタル音声波形を
フレームまたはサブフレームと呼ばれる単位に分割する
フレーム分割手段と,分割したフレームまたはサブフレ
ームの単位のそれぞれについて,スペクトル包絡を表す
スペクトル包絡情報,ピッチ情報および音源情報である
雑音源情報を抽出し,符号化する抽出・符号化手段と,
を含み,音声復号化手段が,符号化されたスペクトル包
絡情報,ピッチ情報および雑音源情報を復元する復元手
段と,復元した雑音源情報およびピッチ情報から励振源
信号を生成する励振源信号生成手段と,励振源信号と復
元したスペクトル包絡情報から合成音声を生成する合成
音声生成手段と,を含み,さらに,抽出・符号化手段
が,雑音源情報を抽出・符号化する際に,フレームまた
はサブフレームからピッチ情報およびスペクトル包絡情
報から生成されるピッチ成分音声を除いた成分である二
次誤差信号を抽出し,符号化することによって雑音源情
報の抽出・符号化を行うため,CELP方式の符号化の
過程において,演算量を削減すると共に,メモリ量の低
減を図ることができる。
項14)は,請求項13記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号を符号化する
際に,二次誤差信号を周波数領域に変換した後,変換領
域における係数を符号化することにより,二次誤差信号
の符号化を行うため,換言すれば,周波数特徴を符号化
するため,少ないビット数で二次誤差信号を符号化する
ことができる。
項15)は,請求項14記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号を周波数領域
に変換する際に,離散コサイン変換を用いるため,高速
かつ低演算量で符号化を行うことができる。
項16)は,請求項14記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号を周波数領域
に変換する際に,離散フーリエ変換を用いるため,高速
かつ低演算量で符号化を行うことができる。
項17)は,請求項14記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号を周波数領域
に変換する際に,K−L(Karhunen−Loev
e)変換を用いるため,高速かつ低演算量で符号化を行
うことができる。
項18)は,請求項14記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,変換領域における係数を符
号化する際に,二次誤差信号の周波数領域におけるスペ
クトル強度最大のものからあらかじめ定められた数の周
波数を選定し,選定された周波数および選定された周波
数のスペクトル係数を符号化することによって,二次誤
差信号の符号とするため,周波数領域の係数の符号化を
比較的低演算量で実現できる。
項19)は,請求項13記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号の強度最大の
ものからあらかじめ定められた数のサンプル位置を選定
し,選定されたサンプル位置および選定されたサンプル
位置の強度を符号化することによって,二次誤差信号の
符号とするため,周波数領域の係数の符号化を比較的低
演算量で実現できる。
項20)は,請求項13記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号の強度最大の
ものから幾つかのサンプル位置を選定し,選定されたサ
ンプル位置および選定されたサンプル位置の振幅を符号
化したものと,二次誤差信号の周波数領域におけるスペ
クトル強度最大のものから幾つかの周波数を選定し,選
定された周波数および選定された周波数のスペクトル係
数を符号化したものとによって,二次誤差信号の符号と
するため,換言すれば,時間領域の特徴と周波数領域の
特徴との双方を組み合わせて符号化するため,同ビット
レートで高音質の復号音声を得ることができる。
項21)は,請求項14記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号の強度最大の
ものからあらかじめ定められた数のサンプル位置を選定
し,選定されたサンプル位置および選定されたサンプル
位置の振幅を符号化したものと,二次誤差信号の周波数
領域におけるスペクトル強度最大のものからあらかじめ
定められた周波数を選定し,選定された周波数および選
定された周波数のスペクトル係数を符号化したものとに
よって,二次誤差信号の符号とするため,換言すれば,
時間領域の特徴と周波数領域の特徴との双方を組み合わ
せて符号化するため,同ビットレートで高音質の復号音
声を得ることができる。
項22)は,請求項14記載の音声圧縮符号化装置にお
いて,抽出・符号化手段が,二次誤差信号の強度最大の
ものから幾つかのサンプル位置を選定し,選定されたサ
ンプル位置および選定されたサンプル位置の振幅を符号
化したものと,二次誤差信号の周波数領域におけるスペ
クトル強度最大のものから幾つかの周波数を選定し,選
定された周波数および選定された周波数のスペクトル係
数を符号化したものとを用い,さらに選定数の合計数を
あらかじめ定めた数にし,復号音声のひずみが最も小さ
くなるように組み合わせを選択することによって,二次
誤差信号の符号とするため,ビットレートを増やすこと
なく,高音質の復号音声を得ることができる。
項23)は,請求項14記載の音声圧縮符号化装置にお
いて,音声復号化手段が,符号化後の二次誤差信号であ
る雑音源情報を時間軸に戻した量子化二次誤差信号に乱
数を加えるため,より自然な復号音声を得ることができ
る。
項24)は,請求項14記載の音声圧縮符号化装置にお
いて,音声復号化手段が,符号化後の二次誤差信号であ
る雑音源情報を時間軸に戻した量子化二次誤差信号に1
/fゆらぎを加えるため,より自然な復号音声を得るこ
とができる。
図である。
である。
である。
ブロック図である。
である。
ブロック図である。
ブロック図である。
Claims (24)
- 【請求項1】 アナログ音声波形を入力してディジタル
音声波形に変換する第1の工程と,前記ディジタル音声
波形を所定の符号化方式で符号化する第2の工程と,前
記符号化された音声波形を蓄積する第3の工程と,前記
蓄積されたディジタル音声波形を取り出して復号化する
第4の工程と,前記復号化されたディジタル音声波形を
アナログ音声波形に変換する第5の工程と,を有する音
声圧縮符号化方法において,前記第2の工程が,前記デ
ィジタル音声波形をフレームまたはサブフレームと呼ば
れる単位に分割するフレーム分割工程と,前記分割した
フレームまたはサブフレームの単位のそれぞれについ
て,スペクトル包絡を表すスペクトル包絡情報,ピッチ
情報および音源情報である雑音源情報を抽出し,符号化
する抽出・符号化工程と,を含み,前記第4の工程が,
符号化された前記スペクトル包絡情報,ピッチ情報およ
び雑音源情報を復元する復元工程と,前記復元した雑音
源情報およびピッチ情報から励振源信号を生成する励振
源信号生成工程と,前記励振源信号と前記復元したスペ
クトル包絡情報から合成音声を生成する合成音声生成工
程と,を含み,さらに,前記抽出・符号化工程が,前記
雑音源情報を抽出・符号化する際に,前記フレームまた
はサブフレームから前記ピッチ情報および前記スペクト
ル包絡情報から生成されるピッチ成分音声を除いた成分
である二次誤差信号を抽出し,符号化することによって
前記雑音源情報の抽出・符号化を行うことを特徴とする
音声圧縮符号化方法。 - 【請求項2】 請求項1記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号を符
号化する際に,前記二次誤差信号を周波数領域に変換し
た後,変換領域における係数を符号化することにより,
前記二次誤差信号の符号化を行うことを特徴とする音声
圧縮符号化方法。 - 【請求項3】 請求項2記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号を周
波数領域に変換する際に,離散コサイン変換を用いるこ
とを特徴とする音声圧縮符号化方法。 - 【請求項4】 請求項2記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号を周
波数領域に変換する際に,離散フーリエ変換を用いるこ
とを特徴とする音声圧縮符号化方法。 - 【請求項5】 請求項2記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号を周
波数領域に変換する際に,K−L(Karhunen−
Loeve)変換を用いることを特徴とする音声圧縮符
号化方法。 - 【請求項6】 請求項2記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記変換領域における
係数を符号化する際に,前記二次誤差信号の周波数領域
におけるスペクトル強度最大のものからあらかじめ定め
られた数の周波数を選定し,前記選定された周波数およ
び前記選定された周波数のスペクトル係数を符号化する
ことによって,前記二次誤差信号の符号とすることを特
徴とする音声圧縮符号化方法。 - 【請求項7】 請求項1記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号の強
度最大のものからあらかじめ定められた数のサンプル位
置を選定し,前記選定されたサンプル位置および前記選
定されたサンプル位置の強度を符号化することによっ
て,前記二次誤差信号の符号とすることを特徴とする音
声圧縮符号化方法。 - 【請求項8】 請求項1記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号の強
度最大のものから幾つかのサンプル位置を選定し,前記
選定されたサンプル位置および前記選定されたサンプル
位置の振幅を符号化したものと,前記二次誤差信号の周
波数領域におけるスペクトル強度最大のものから幾つか
の周波数を選定し,前記選定された周波数および前記選
定された周波数のスペクトル係数を符号化したものとに
よって,前記二次誤差信号の符号とすることを特徴とす
る音声圧縮符号化方法。 - 【請求項9】 請求項2記載の音声圧縮符号化方法にお
いて,前記抽出・符号化工程が,前記二次誤差信号の強
度最大のものからあらかじめ定められた数のサンプル位
置を選定し,前記選定されたサンプル位置および前記選
定されたサンプル位置の振幅を符号化したものと,前記
二次誤差信号の周波数領域におけるスペクトル強度最大
のものからあらかじめ定められた周波数を選定し,前記
選定された周波数および前記選定された周波数のスペク
トル係数を符号化したものとによって,前記二次誤差信
号の符号とすることを特徴とする音声圧縮符号化方法。 - 【請求項10】 請求項2記載の音声圧縮符号化方法に
おいて,前記抽出・符号化工程が,前記二次誤差信号の
強度最大のものから幾つかのサンプル位置を選定し,前
記選定されたサンプル位置および前記選定されたサンプ
ル位置の振幅を符号化したものと,前記二次誤差信号の
周波数領域におけるスペクトル強度最大のものから幾つ
かの周波数を選定し,前記選定された周波数および前記
選定された周波数のスペクトル係数を符号化したものと
を用い,さらに選定数の合計数をあらかじめ定めた数に
し,復号音声のひずみが最も小さくなるように組み合わ
せを選択することによって,前記二次誤差信号の符号と
することを特徴とする音声圧縮符号化方法。 - 【請求項11】 請求項2記載の音声圧縮符号化方法に
おいて,前記第4の工程が,前記符号化後の二次誤差信
号である雑音源情報を時間軸に戻した量子化二次誤差信
号に乱数を加える工程を含むことを特徴とする音声圧縮
符号化方法。 - 【請求項12】 請求項2記載の音声圧縮符号化方法に
おいて,前記第4の工程が,前記符号化後の二次誤差信
号である雑音源情報を時間軸に戻した量子化二次誤差信
号に1/fゆらぎを加える工程を含むことを特徴とする
音声圧縮符号化方法。 - 【請求項13】 アナログ音声波形を入力してディジタ
ル音声波形に変換するA/D変換手段と,前記ディジタ
ル音声波形を所定の符号化方式で符号化する音声符号化
手段と,前記符号化された音声波形を蓄積する蓄積手段
と,前記蓄積手段から前記符号化されたディジタル音声
波形を取り出して復号化する音声復号化手段と,前記復
号化されたディジタル音声波形をアナログ音声波形に変
換するD/A変換手段と,を備えた音声圧縮符号化装置
において,前記音声符号化手段が,前記ディジタル音声
波形をフレームまたはサブフレームと呼ばれる単位に分
割するフレーム分割手段と,前記分割したフレームまた
はサブフレームの単位のそれぞれについて,スペクトル
包絡を表すスペクトル包絡情報,ピッチ情報および音源
情報である雑音源情報を抽出し,符号化する抽出・符号
化手段と,を含み,前記音声復号化手段が,符号化され
た前記スペクトル包絡情報,ピッチ情報および雑音源情
報を復元する復元手段と,前記復元した雑音源情報およ
びピッチ情報から励振源信号を生成する励振源信号生成
手段と,前記励振源信号と前記復元したスペクトル包絡
情報から合成音声を生成する合成音声生成手段と,を含
み,さらに,前記抽出・符号化手段が,前記雑音源情報
を抽出・符号化する際に,前記フレームまたはサブフレ
ームから前記ピッチ情報および前記スペクトル包絡情報
から生成されるピッチ成分音声を除いた成分である二次
誤差信号を抽出し,符号化することによって前記雑音源
情報の抽出・符号化を行うことを特徴とする音声圧縮符
号化装置。 - 【請求項14】 請求項13記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
を符号化する際に,前記二次誤差信号を周波数領域に変
換した後,変換領域における係数を符号化することによ
り,前記二次誤差信号の符号化を行うことを特徴とする
音声圧縮符号化装置。 - 【請求項15】 請求項14記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
を周波数領域に変換する際に,離散コサイン変換を用い
ることを特徴とする音声圧縮符号化装置。 - 【請求項16】 請求項14記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
を周波数領域に変換する際に,離散フーリエ変換を用い
ることを特徴とする音声圧縮符号化装置。 - 【請求項17】 請求項14記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
を周波数領域に変換する際に,K−L(Karhune
n−Loeve)変換を用いることを特徴とする音声圧
縮符号化装置。 - 【請求項18】 請求項14記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記変換領域にお
ける係数を符号化する際に,前記二次誤差信号の周波数
領域におけるスペクトル強度最大のものからあらかじめ
定められた数の周波数を選定し,前記選定された周波数
および前記選定された周波数のスペクトル係数を符号化
することによって,前記二次誤差信号の符号とすること
を特徴とする音声圧縮符号化装置。 - 【請求項19】 請求項13記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
の強度最大のものからあらかじめ定められた数のサンプ
ル位置を選定し,前記選定されたサンプル位置および前
記選定されたサンプル位置の強度を符号化することによ
って,前記二次誤差信号の符号とすることを特徴とする
音声圧縮符号化装置。 - 【請求項20】 請求項13記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
の強度最大のものから幾つかのサンプル位置を選定し,
前記選定されたサンプル位置および前記選定されたサン
プル位置の振幅を符号化したものと,前記二次誤差信号
の周波数領域におけるスペクトル強度最大のものから幾
つかの周波数を選定し,前記選定された周波数および前
記選定された周波数のスペクトル係数を符号化したもの
とによって,前記二次誤差信号の符号とすることを特徴
とする音声圧縮符号化装置。 - 【請求項21】 請求項14記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
の強度最大のものからあらかじめ定められた数のサンプ
ル位置を選定し,前記選定されたサンプル位置および前
記選定されたサンプル位置の振幅を符号化したものと,
前記二次誤差信号の周波数領域におけるスペクトル強度
最大のものからあらかじめ定められた周波数を選定し,
前記選定された周波数および前記選定された周波数のス
ペクトル係数を符号化したものとによって,前記二次誤
差信号の符号とすることを特徴とする音声圧縮符号化装
置。 - 【請求項22】 請求項14記載の音声圧縮符号化装置
において,前記抽出・符号化手段が,前記二次誤差信号
の強度最大のものから幾つかのサンプル位置を選定し,
前記選定されたサンプル位置および前記選定されたサン
プル位置の振幅を符号化したものと,前記二次誤差信号
の周波数領域におけるスペクトル強度最大のものから幾
つかの周波数を選定し,前記選定された周波数および前
記選定された周波数のスペクトル係数を符号化したもの
とを用い,さらに選定数の合計数をあらかじめ定めた数
にし,復号音声のひずみが最も小さくなるように組み合
わせを選択することによって,前記二次誤差信号の符号
とすることを特徴とする音声圧縮符号化装置。 - 【請求項23】 請求項14記載の音声圧縮符号化装置
において,前記音声復号化手段が,前記符号化後の二次
誤差信号である雑音源情報を時間軸に戻した量子化二次
誤差信号に乱数を加えることを特徴とする音声圧縮符号
化装置。 - 【請求項24】 請求項14記載の音声圧縮符号化装置
において,前記音声復号化手段が,前記符号化後の二次
誤差信号である雑音源情報を時間軸に戻した量子化二次
誤差信号に1/fゆらぎを加えることを特徴とする音声
圧縮符号化装置。
Priority Applications (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP25883396A JP3878254B2 (ja) | 1996-06-21 | 1996-09-30 | 音声圧縮符号化方法および音声圧縮符号化装置 |
| US08/877,710 US5943644A (en) | 1996-06-21 | 1997-06-18 | Speech compression coding with discrete cosine transformation of stochastic elements |
Applications Claiming Priority (5)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP16215196 | 1996-06-21 | ||
| JP8-162151 | 1996-08-13 | ||
| JP21356696 | 1996-08-13 | ||
| JP8-213566 | 1996-08-13 | ||
| JP25883396A JP3878254B2 (ja) | 1996-06-21 | 1996-09-30 | 音声圧縮符号化方法および音声圧縮符号化装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPH10111700A true JPH10111700A (ja) | 1998-04-28 |
| JP3878254B2 JP3878254B2 (ja) | 2007-02-07 |
Family
ID=27321959
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP25883396A Expired - Fee Related JP3878254B2 (ja) | 1996-06-21 | 1996-09-30 | 音声圧縮符号化方法および音声圧縮符号化装置 |
Country Status (2)
| Country | Link |
|---|---|
| US (1) | US5943644A (ja) |
| JP (1) | JP3878254B2 (ja) |
Families Citing this family (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US6411228B1 (en) | 2000-09-21 | 2002-06-25 | International Business Machines Corporation | Apparatus and method for compressing pseudo-random data using distribution approximations |
| DE60029147T2 (de) * | 2000-12-29 | 2007-05-31 | Nokia Corp. | Qualitätsverbesserung eines audiosignals in einem digitalen netzwerk |
| JP3887598B2 (ja) * | 2002-11-14 | 2007-02-28 | 松下電器産業株式会社 | 確率的符号帳の音源の符号化方法及び復号化方法 |
| KR101403340B1 (ko) * | 2007-08-02 | 2014-06-09 | 삼성전자주식회사 | 변환 부호화 방법 및 장치 |
| CN107871492B (zh) * | 2016-12-26 | 2020-12-15 | 珠海市杰理科技股份有限公司 | 音乐合成方法和系统 |
Family Cites Families (15)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US5261027A (en) * | 1989-06-28 | 1993-11-09 | Fujitsu Limited | Code excited linear prediction speech coding system |
| US5091945A (en) * | 1989-09-28 | 1992-02-25 | At&T Bell Laboratories | Source dependent channel coding with error protection |
| US5448683A (en) * | 1991-06-24 | 1995-09-05 | Kokusai Electric Co., Ltd. | Speech encoder |
| US5432883A (en) * | 1992-04-24 | 1995-07-11 | Olympus Optical Co., Ltd. | Voice coding apparatus with synthesized speech LPC code book |
| FI95085C (fi) * | 1992-05-11 | 1995-12-11 | Nokia Mobile Phones Ltd | Menetelmä puhesignaalin digitaaliseksi koodaamiseksi sekä puhekooderi menetelmän suorittamiseksi |
| US5457783A (en) * | 1992-08-07 | 1995-10-10 | Pacific Communication Sciences, Inc. | Adaptive speech coder having code excited linear prediction |
| JP3343965B2 (ja) * | 1992-10-31 | 2002-11-11 | ソニー株式会社 | 音声符号化方法及び復号化方法 |
| FR2700632B1 (fr) * | 1993-01-21 | 1995-03-24 | France Telecom | Système de codage-décodage prédictif d'un signal numérique de parole par transformée adaptative à codes imbriqués. |
| EP0654909A4 (en) * | 1993-06-10 | 1997-09-10 | Oki Electric Ind Co Ltd | PREDICTIVE LINEAR ENCODER-ENCODER WITH CODES EXCITATION. |
| EP1104913A3 (en) * | 1993-08-26 | 2006-04-12 | The Regents Of The University Of California | CNN Bionic eye or other topographic sensory organs or combinations of same |
| KR960009530B1 (en) * | 1993-12-20 | 1996-07-20 | Korea Electronics Telecomm | Method for shortening processing time in pitch checking method for vocoder |
| FI98163C (fi) * | 1994-02-08 | 1997-04-25 | Nokia Mobile Phones Ltd | Koodausjärjestelmä parametriseen puheenkoodaukseen |
| US5602961A (en) * | 1994-05-31 | 1997-02-11 | Alaris, Inc. | Method and apparatus for speech compression using multi-mode code excited linear predictive coding |
| JP3183074B2 (ja) * | 1994-06-14 | 2001-07-03 | 松下電器産業株式会社 | 音声符号化装置 |
| JPH08272395A (ja) * | 1995-03-31 | 1996-10-18 | Nec Corp | 音声符号化装置 |
-
1996
- 1996-09-30 JP JP25883396A patent/JP3878254B2/ja not_active Expired - Fee Related
-
1997
- 1997-06-18 US US08/877,710 patent/US5943644A/en not_active Expired - Fee Related
Also Published As
| Publication number | Publication date |
|---|---|
| US5943644A (en) | 1999-08-24 |
| JP3878254B2 (ja) | 2007-02-07 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US6427135B1 (en) | Method for encoding speech wherein pitch periods are changed based upon input speech signal | |
| US8862463B2 (en) | Adaptive time/frequency-based audio encoding and decoding apparatuses and methods | |
| JP3747492B2 (ja) | 音声信号の再生方法及び再生装置 | |
| EP1353323B1 (en) | Method, device and program for coding and decoding acoustic parameter, and method, device and program for coding and decoding sound | |
| JP3344962B2 (ja) | オーディオ信号符号化装置、及びオーディオ信号復号化装置 | |
| US7599833B2 (en) | Apparatus and method for coding residual signals of audio signals into a frequency domain and apparatus and method for decoding the same | |
| JP3357795B2 (ja) | 音声符号化方法および装置 | |
| JPH07261800A (ja) | 変換符号化方法、復号化方法 | |
| JP2001507822A (ja) | スピーチ信号のエンコード方法 | |
| JP3878254B2 (ja) | 音声圧縮符号化方法および音声圧縮符号化装置 | |
| JP2000132193A (ja) | 信号符号化装置及び方法、並びに信号復号装置及び方法 | |
| JP2004302259A (ja) | 音響信号の階層符号化方法および階層復号化方法 | |
| JP3916934B2 (ja) | 音響パラメータ符号化、復号化方法、装置及びプログラム、音響信号符号化、復号化方法、装置及びプログラム、音響信号送信装置、音響信号受信装置 | |
| JP4578145B2 (ja) | 音声符号化装置、音声復号化装置及びこれらの方法 | |
| JP2796408B2 (ja) | 音声情報圧縮装置 | |
| JPH08234795A (ja) | 音声符号化装置 | |
| JPH10340098A (ja) | 信号符号化装置 | |
| JP4327420B2 (ja) | オーディオ信号符号化方法、及びオーディオ信号復号化方法 | |
| JP2002073097A (ja) | Celp型音声符号化装置とcelp型音声復号化装置及び音声符号化方法と音声復号化方法 | |
| JPH05232996A (ja) | 音声符号化装置 | |
| JP3715417B2 (ja) | 音声圧縮符号化装置,音声圧縮符号化方法およびその方法の各工程をコンピュータに実行させるためのプログラムを記録したコンピュータ読み取り可能な記録媒体 | |
| JP3010655B2 (ja) | 圧縮符号化装置及び方法、並びに復号装置及び方法 | |
| JPH10124093A (ja) | 音声圧縮符号化方法および装置 | |
| JP2002169595A (ja) | 固定音源符号帳及び音声符号化/復号化装置 | |
| JPH0786952A (ja) | 音声の予測符号化方法 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| A131 | Notification of reasons for refusal |
Free format text: JAPANESE INTERMEDIATE CODE: A131 Effective date: 20040217 |
|
| A521 | Request for written amendment filed |
Free format text: JAPANESE INTERMEDIATE CODE: A523 Effective date: 20040419 |
|
| A02 | Decision of refusal |
Free format text: JAPANESE INTERMEDIATE CODE: A02 Effective date: 20040615 |
|
| A521 | Request for written amendment filed |
Free format text: JAPANESE INTERMEDIATE CODE: A523 Effective date: 20040810 |
|
| A521 | Request for written amendment filed |
Free format text: JAPANESE INTERMEDIATE CODE: A523 Effective date: 20061005 |
|
| A61 | First payment of annual fees (during grant procedure) |
Free format text: JAPANESE INTERMEDIATE CODE: A61 Effective date: 20061102 |
|
| R150 | Certificate of patent or registration of utility model |
Free format text: JAPANESE INTERMEDIATE CODE: R150 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20101110 Year of fee payment: 4 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20111110 Year of fee payment: 5 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20111110 Year of fee payment: 5 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20121110 Year of fee payment: 6 |
|
| LAPS | Cancellation because of no payment of annual fees |