JPH09509035A - オーディオ/ビデオタイミング不一致管理 - Google Patents

オーディオ/ビデオタイミング不一致管理

Info

Publication number
JPH09509035A
JPH09509035A JP8518525A JP51852596A JPH09509035A JP H09509035 A JPH09509035 A JP H09509035A JP 8518525 A JP8518525 A JP 8518525A JP 51852596 A JP51852596 A JP 51852596A JP H09509035 A JPH09509035 A JP H09509035A
Authority
JP
Japan
Prior art keywords
buffer
segment
time
video
decoder
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Ceased
Application number
JP8518525A
Other languages
English (en)
Inventor
サイモン ブランチャード
Original Assignee
フィリップス エレクトロニクス ネムローゼ フェンノートシャップ
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by フィリップス エレクトロニクス ネムローゼ フェンノートシャップ filed Critical フィリップス エレクトロニクス ネムローゼ フェンノートシャップ
Publication of JPH09509035A publication Critical patent/JPH09509035A/ja
Ceased legal-status Critical Current

Links

Classifications

    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/20Servers specifically adapted for the distribution of content, e.g. VOD servers; Operations thereof
    • H04N21/23Processing of content or additional data; Elementary server operations; Server middleware
    • H04N21/234Processing of video elementary streams, e.g. splicing of video streams or manipulating encoded video stream scene graphs
    • H04N21/23406Processing of video elementary streams, e.g. splicing of video streams or manipulating encoded video stream scene graphs involving management of server-side video buffer
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/10Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
    • H04N19/134Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or criterion affecting or controlling the adaptive coding
    • H04N19/146Data rate or code amount at the encoder output
    • H04N19/152Data rate or code amount at the encoder output by measuring the fullness of the transmission buffer
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/20Servers specifically adapted for the distribution of content, e.g. VOD servers; Operations thereof
    • H04N21/23Processing of content or additional data; Elementary server operations; Server middleware
    • H04N21/234Processing of video elementary streams, e.g. splicing of video streams or manipulating encoded video stream scene graphs
    • H04N21/23424Processing of video elementary streams, e.g. splicing of video streams or manipulating encoded video stream scene graphs involving splicing one content stream with another content stream, e.g. for inserting or substituting an advertisement
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/20Servers specifically adapted for the distribution of content, e.g. VOD servers; Operations thereof
    • H04N21/23Processing of content or additional data; Elementary server operations; Server middleware
    • H04N21/24Monitoring of processes or resources, e.g. monitoring of server load, available bandwidth, upstream requests
    • H04N21/2401Monitoring of the client buffer
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/20Servers specifically adapted for the distribution of content, e.g. VOD servers; Operations thereof
    • H04N21/23Processing of content or additional data; Elementary server operations; Server middleware
    • H04N21/242Synchronisation processes, e.g. processing of PCR [Programme Clock References]
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/40Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
    • H04N21/43Processing of content or additional data, e.g. demultiplexing additional data from a digital video stream; Elementary client operations, e.g. monitoring of home network or synchronising decoder's clock; Client middleware
    • H04N21/4302Content synchronisation processes, e.g. decoder synchronisation
    • H04N21/4307Synchronising the rendering of multiple content streams or additional data on devices, e.g. synchronisation of audio on a mobile phone with the video output on the TV screen
    • H04N21/43072Synchronising the rendering of multiple content streams or additional data on devices, e.g. synchronisation of audio on a mobile phone with the video output on the TV screen of multiple content streams on the same device
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/40Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
    • H04N21/43Processing of content or additional data, e.g. demultiplexing additional data from a digital video stream; Elementary client operations, e.g. monitoring of home network or synchronising decoder's clock; Client middleware
    • H04N21/439Processing of audio elementary streams
    • H04N21/4392Processing of audio elementary streams involving audio buffer management
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/40Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
    • H04N21/43Processing of content or additional data, e.g. demultiplexing additional data from a digital video stream; Elementary client operations, e.g. monitoring of home network or synchronising decoder's clock; Client middleware
    • H04N21/44Processing of video elementary streams, e.g. splicing a video clip retrieved from local storage with an incoming video stream or rendering scenes according to encoded video stream scene graphs
    • H04N21/44004Processing of video elementary streams, e.g. splicing a video clip retrieved from local storage with an incoming video stream or rendering scenes according to encoded video stream scene graphs involving video buffer management, e.g. video decoder buffer or video display buffer
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/80Generation or processing of content or additional data by content creator independently of the distribution process; Content per se
    • H04N21/83Generation or processing of protective or descriptive data associated with content; Content structuring
    • H04N21/845Structuring of content, e.g. decomposing content into time segments
    • H04N21/8456Structuring of content, e.g. decomposing content into time segments by decomposing the content in the time domain, e.g. in time segments
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N19/00Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
    • H04N19/50Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04NPICTORIAL COMMUNICATION, e.g. TELEVISION
    • H04N21/00Selective content distribution, e.g. interactive television or video on demand [VOD]
    • H04N21/80Generation or processing of content or additional data by content creator independently of the distribution process; Content per se
    • H04N21/85Assembly of content; Generation of multimedia applications
    • H04N21/854Content authoring
    • H04N21/8541Content authoring involving branching, e.g. to different story endings

Landscapes

  • Engineering & Computer Science (AREA)
  • Multimedia (AREA)
  • Signal Processing (AREA)
  • Business, Economics & Management (AREA)
  • Marketing (AREA)
  • Compression Or Coding Systems Of Tv Signals (AREA)

Abstract

(57)【要約】 インタリーブされたディジタルビデオ信号セグメントを符号化し、1つのシステムストリーム(ビデオSTDに加えてオーディオSTD)を形成する方法を提供する。前記セグメントのシームレスな結合を可能にするために、ビデオシステム層バッファローディングの制御を、ビデオ層バッファのローディング(VBV占有値)に関係させる。第1画像をデコーダバッファから読み出すべき時点における理想的な調和から始め、前記第1画像をシステム層バッファから読み出す時点を、セグメントの予測される期間と、セグメントの最終フレームを読み出すべき時点とによって規定される量によって調節する。この調節は、前記理想的な調和から始めに得られたセグメントタイミング値の可能性のあるオーバラップを回避する。この技術は、ビデオクリップの実時間における結合を、最小の視覚的不連続によって行う必要がある対話型マルチメディア用途に対して、特に用途を有する。

Description

【発明の詳細な説明】 オーディオ/ビデオタイミング不一致管理 本発明はオーディオ及びビデオ信号の符号化に関するものであり、特にオンザ フライ式に一緒に接合し得るオーディオ及びビデオ資料のセグメントの生成に関 するものである。 通常は、2つのビデオクリップを順に再生する必要がある場合に、デコーダを 第2クリップの復号化前に開始状態にリセットする必要がある。このリセット期 間中、ユーザはスクリーン上に固定された第1クリップの最終フレームを、それ に付随する可聴音を消して見ることになる。この停止状態の期間に応じて、この 中断は、ユーザにとって邪魔になる恐れがある。 従って、1つのクリップの終了個所と次のクリップの開始個所との間の遷移が デコーダに認識されないようにビデオクリップをシームレスに接合する必要があ る。このことは、ユーザの観点からすると、視聴フレームレートに知覚できる変 化がなくて、しかもオーディオが中断せずに連続することを意味する。シームレ スビデオのアプリケーションは多数ある。CD−i透視の例に、コンピュータ生 成キャラクタ用のホト−リアルバックグラウンドを用いるものがある。この技法 の使用例ではアニメーションのキャラクタをMPEG符号化ビデオ系列の前に走 行させる。他の例として、視聴者が利用可能な他のシナリオを選択することによ って映画の筋の展開を変えることのてきる対話式映画のような一連のキャラクタ −ユーザインタラクションがある。ユーザが対話式映画にて選択を行う筋書の分 岐点はシームレス個所に現われるようにすべきであり、そのようにしないと、ユ ーザは鑑賞中の映画に関連する疑惑のサスペンスを失うことになる。 ビデオ信号のセグメントを符号化するのに、デコーダの再初期設定を必要とし ない方法は、本出願人による1994年12月2日出願の“ビデオ編集バッファ の管理”なる名称の英国特許出願第9424436.5号に開示されている。こ の方法では、デコーダのバッファレベルを目標値に定めて、各ビデオクリップの 終了時におけるデコーダバッファの占有値に一貫性を持たせると共に連続するク リップをデコーダバッファにオーバフロー又はアンダーフローを生じることなく 直接接合し得るように各セグメントの開始点を予測し得るようにする。 上述した方法は、ビデオフレームの系列にとっては好適であるも、この方法は 通常ビデオフレームに付随する他の情報、例えばオーディオサウンドトラックに ついては何等考慮していない。ビデオ信号は一般に他の情報と一緒にシステムス トリームと称される単一のストリーム内にインタリーブされ、このストリームは デコーダ/ディスプレイ装置に与えられるデータ(例えば、コンパクトディスク から読取られるデータストリーム又はケーブルネットワークを経て伝送されるデ ータストリーム)を構成する。一般的に、ビデオの伝送を受け取る時間がオーデ ィオ信号を受け取る時間と等しくないため、シームレスに結合することができる インタリーブされたセグメントを形成しようとすることによって問題が生じる。 次のクリップを開始すべき時点を予測しようとすると、このタイミングの相違は 、現在のクリップの復号化を完了する前に次のクリップの復号化が始まることを 示すようなエラー状態を発生する恐れがある。 したがって本発明の目的は、このようなタイミングの重なりを回避し、デコー ダバッファのオーバフローまたはアンダフローを回避すると同時に、システムス トリームセグメントのシームレスな結合を提供することである。 本発明によれば、符号化段と、エンコーダバッファと、符号化されたビデオ信 号を少なくとも1つの他の信号とインタリーブしてシステムストリームを形成す る手段とを有するエンコーダ装置において、2つまたはそれ以上のビデオフレー ムを各々含むセグメントの形態において、ディジタルビデオ信号を符号化する方 法であって、各々のセグメントに関して、予め決められた符号化計画にしたがっ てセグメントのフレームを連続的に符号化するステップと、符号化されたフレー ムを前記バッファ中に読み出すステップと、符号化されたセグメントを前記バッ ファから実際的に一定のビットレートにおいて読み出すステップと、前記バッフ ァの出力信号を1つまたはそれ以上のタイムスタンプと共にシステムストリーム 中にインタリーブするステップとを具える前記方法において、 前記エンコーダバッファの占有値を、前のセグメントの最終フレームを前記バ ッファ中に読み出した瞬間において第1の予め決められたレベルを有するように 制御し、この占有レベルがデコーダバッファ占有レベルと関係し、前記方法が、 − デコーダバッファを前記一定のビットレートにおいて空から前記デコーダバ ッファ占有レベルにまで満たすために必要な時間tを得るステップと、 − 現在のセグメントに関する期間deltaを予測するステップと、 − 現在のセグメントの最終フレームを前記デコーダバッファから読み出すべき 時点の時間値を予測するステップと、 − (t+delta)によって与えられる時間値が、前記現在のセグメントの 最終フレームを前記デコーダバッファから読み出すべき時点の時間値に近いが、 より大きくなるまで、tの値を減少するステップと、 − 開始されたセグメントのローディング後にtの減少値によって与えられる時 間において前記デコーダバッファからセグメントの第1フレームを読み出すべき ことを示すセグメントのシステムストリーム中にタイムスタンプを挿入するステ ップとを具えることを特徴とする方法が提供される。 現在のセグメントの最終フレームを前記デコーダバッファから読み出すべき時 点の時間値を、前記セグメントの持続時間を計算し、時間の項における前記デコ ーダバッファの最大容量を減算することによって予測することができる。好適に は、(現在のセグメントの最終フレームを前記デコーダバッファから読み出すべ き時点の)この時間値を、インタリーブされた別々のストリームの各々に関して 予測し、最も大きい値を、すべてのストリームに関するtの減少値の誘導に使用 する。 起こりそうもないが、理論的には可能性がある(後に説明するような)アンダ フロー状態を防止するために、前記エンコーダは、予め決められたデコーダバッ ファ占有レベルに到達するまで、符号化されるフレームの寸法を制限してもよい 。 後に説明するように、デコーダが受信されたセグメントの復号化を開始すべき 時点の誘導は、システムストリームレベルにおけるセグメントの滑らかな結合を 可能にし、この開始時間をストリーム長に応じて調節することによって、上述し た可能性のある重なりの問題が回避される。また、デコーダバッファ目標レベル は、前記エンコーダバッファの内容を基礎として計算されたレベルであるため、 前記デコーダバッファを復号化を始める前にできるかぎり満たす必要がある慣例 的な技術は回避される。 好適には、共通デコーダバッファレベル(および、したがって最初のタイムス タンプが位置するtの初期値)を与える。これは、第1セグメントの画像の符号 化に使用されるビットの目標数を設定し、前記セグメントの終端における前記エ ンコーダバッファ占有レベルに達するような符号化中の画像当たりのビット割り 当てを制御可能に変化させることによって達成される。 後に説明するように、デコーダバッファレベルを決定するために、好適には、 最大エンコーダバッファ占有レベルを、第1セグメントの最終画像をエンコーダ バッファ中に読み出した後の1フレーム周期の、エンコーダの最大レベルと、エ ンコーダバッファ占有レベルとの差として規定されるデコーダバッファ占有レベ ルによって指定する。 本発明は、各々のセグメントが2つまたはそれ以上のビデオフレームを具える 映像セグメントの符号化用に形成され、セグメントの連続するフレームを受けて これらを予め決められた符号化計画にしたがって符号化するために構成された符 号化段と、前記符号化段から連続する符号化されたフレームを受けるために結合 され、符号化されたセグメントを実際的に一定のビットレートにおいて出力する ように構成されたバッファと、前記バッファ出力および少なくとも1つの他の信 号を受けるために結合され、これらをシステムストリーム中にインタリーブする ように構成されたマルチプレクサとを具えるディジタルビデオ信号エンコーダ装 置において、前記符号化段を、制御しうる可変のビット数におけるセグメントの 映像を符号化し、セグメントの最終映像が前記エンコーダバッファ中に読み出さ れる時点における予め決められたエンコーダバッファ占有値を発生し、前記セグ メントの持続時間の予測値および、前記セグメントの最終フレームをデコーダバ ッファから読み出すべき時点の時間値を発生することができるようにし、前記マ ルチプレクサを、前記セグメントのデコーダバッファへのローディングが開始さ れた後の前記予め決められた時間値において前記デコーダバッファからセグメン トの第1フレームを読み出すべきことを示すセグメントのシステムストリーム中 にタイムスタンプを挿入するように構成したことを特徴とするディジタルビデオ 信号エンコーダ装置も提供する。 次に本発明を図面を参照し説明する。 図1は2つのビデオクリップの接合部におけるエンコーダ及びデコーダバッフ ァの内容を示し、 図2はデコーダビデオバッファの占有値とシステムバッファの占有値との関係 を示し、 図3〜図5は通常のシステムで、しかも目標としたクリップの最初と最後にお けるデコーダビデオバッファの内容及びシステムバッファの内容をそれぞれ示し 、 図6及び図7は目標としたオーディオクリップの最初と最後におけるオーディ オバッファの内容をそれぞれ示し、 図8及び図9はエンコーダ及びデコーダ装置をそれぞれ概略的に示し、 図10は、多重化対を目標とするオーディオ/ビデオに関するMPEG ST D状態曲線を示し、 図11は、MPEG VBVと、オーディオおよびビデオSTDバッファ占有 値とに関する開始の状態を示し、 図12は、図11のオーディオおよびビデオSTDバッファ占有値に関する最 終状態を示し、 図13は、オーディオおよびビデオフレーム間の時間値における差を示す。 以下の説明はMPEG標準規格に従って作動するエンコーダ及びデコーダに関 するものであり、以後これらの標準規格による通常の用語を用いるものとする。 しかし、本発明の用途がMPEG標準規格に制約されないことは当業者に明らか である。 いずれの符号化標準規格も、エンコーダ及びデコーダを如何にして互いにイン タフェースさせるかのモデルを用いて開発する必要がある。エンコーダは作動し 続けるので、エンコーダはこれがデコーダを決してイリーガルな状態にしないよ うに、デコーダにて起ることをモデル化する必要がある。同様に、デコーダはエ ンコーダにて用いられるモデルと同じものをサポートして、このエンコーダがリ ーガル状態に留まり、しかも出力を所定のエンコーダへ発生する必要がある。M PEGはこうした規則に従うものである。 先ず、シームレスに接合し得るビデオデータだけのセグメントの生成法につき 考察する。このセグメント生成の好適な方法は本出願人による前記英国特許願第 9424436.5号に記載されており、この方法を以下図1を参照して手短に 説明する。図1は時間tに対するバッファの占有値Bの特性を示したものであり 、これは1つのビデオフレーム(画像)系列Aが終了して、別のビデオフレーム 系列Bが開始するときに起生するエンコーダ及びデコーダのバッファ状態を示し ている。LAは系列Aの最終画像を示し、FBは系列Bの第1画像を示す。系列 Aから系列Bへのデータの転送変化をバッファ占有ラインの太さの変化で示し、 鎖線は系列Aからの画像を示す。或る時間txにて、系列Aに対する全てのデー タが転送し終り、VBV(ビデオバッファリング検証装置−MPEGデコーダモ デル)はBxビットの占有値を有する。この時点からバッファへ転送される全て のデータは系列Bに対するものとなる。なお、系列Aの終了後にバッファ内には まだ幾つかの画像を存在するが、これらの画像はバッファがB1ビットの占有値 を有する時点までには全て除去される。 エンコーダは、それがVBVバッファに所定の占有値を達成させるようとする 際に、目標設定として既知のプロセスを実行する。この目標設定のプロセス中に 、エンコーダはそれが符号化した第1画像をバッファに格納する際に、VBVバ ッファが所定の目標占有値を有するようにする。これは第1画像の大きさに上限 値を定める。符号化の実行終了時にエンコーダは、次の系列に対する第1画像が バッファから除去される直前の時点、つまり図1の時点BxにおけるVBV占有 値を目標に定める。エンコーダはそれが画像を符号化する際に、最終画像又は最 後の数画像の大きさを変えることによってこの状態を目標設定する。 図1に示す例では、エンコーダは状態Btを目標設定する。この状態は新規の 系列の第1画像が除去される直前の時点におけるVBVバッファの占有値を示す 。エンコーダが動作する際、このエンコーダは一般にデコーダとは直接係わりが ないため、VBVバッファ状態への及びそれからの変換というよりもむしろ、そ の出力バッファに基いて画像の大きさを管理する。従って、下記の記載はBtc及 びBlcに関するものである(図1の上部のエンコーダ占有値参照)。 開始状態を目標に定める場合に、エンコーダはそれが第1画像を取り入れる時 点にそのバッファに所定の占有値をとらせるものとする。このバッファ占有値が Btcビットであり、これは前の系列の終了時点からの残留ビットを表わす。こう した残留ビットの存在はBtビットとすべき第1画像の最大の大きさを制限し、 時間ttcの後に全てのビットが除去されるまでの後の画像の大きさに影響を及ぼ し続ける。 エンコーダの観点からして、開始状態で目標を定めることは極めて簡単なこと であり、これはエンコーダの初期占有値を通常の空の開始状態と云うよりむしろ Btcビットに設定するだけで済むからである。 エンコーダの処理が或る系列の終りに近づくと、このエンコーダは最終画像を バッファ内に格納する際に占有値がBlcビットに増加するような大きさにその最 終画像の大きさを定めることにより点Blcを目標に定めようとする。エンコーダ は、最終画像に対する大きさだけを大きくしようとする場合には品質の極めて劣 る画像を生成することになる。こうしたことをなくすために、エンコーダには最 終GOP(画像のグループ)に対する目標ビット数及びGOP内のK個の各画像 に対する目標ビット数を持たせて、エンコーダが漸次正しい状態に近づくように するのが好適である。 システム層について考察するに、これはマルチプレクサがビデオ、オーディオ 及び他の基本ストリームを1つのシステムストリームに合成する際に生成される 。システムストリームはインタリーブされた基本ストリーム及びタイミング情報 をシステムクロックレファレンス(SCR)、プレゼンテーションタイムスタン プ(PTS)及びデコーディングタイムスタンプ(DTS)の形態にて包含する 。 マルチプレクサの作動は、データをシステムストリームからデコーダのバッフ ァへ、これらのバッファが決して完全には空にならないような十分な速さで、し かも前記バッファが決してオーバフローしないような速度にて転送することにあ る。MPEG標準規格はディジタル記憶媒体(DSM)からデコーダへのデータ の転送をモデル化するのに用いられるシステム目標デコーダ(STD)と称する バッファを規定している。このバッファの目的は、データをインイリーブするた めに、デコーダへのデータの転送がバースト単位で行われるも、デコーダのパフ ォーマンスモデルが一定のビットレートを呈すると云うことをマスクすることに ある。ビデオ及びオーディオストリームを多重化するための通常の戦略は、例え ばSTDバッファをできるだけいっぱいに満たすことによって開始する。こうし て作った最終パックのSCRは適当な値に設定され、この時点にバッファから第 1画像が除去されるようにする。次に、前のパックのSCRが正しい値に設定さ れ、これはこれらのSCRがやがて前記最終パックの先頭に達するからである。 最終的に、バッファは基本ストリームからのデータが全て消費されるまでできる だけいっぱいの状態に維持される。 多重動作は多少複雑となり、これはマルチプレクサが多重ストリームとジャッ グルしなければならないからである。又、マルチプレクサはそれが目標プラット ホームを規定しているので、システムストリームの明細を満たすのに必要とされ るいずれの追加の特徴も支援する必要がある。 STDバッファは図2に示すようにVBVバッファを囲むものと想定すること ができる。この図はSTDとVBVとの関係を簡単に示したものである。図2に はVBVバッファを囲むSTDバッファの占有値(太線)を示してある。ここで 注意すべき点は、STDバッファの占有値の線の傾斜がVBVの線の傾斜よりも 大きいことである。これはDSMのビットレートが符号化ビデオ信号のビットレ ートよりも速いからである。Qで示した時間にはSTDにデータが転送されない ことも明らかである。こうしたことが起る理由は、DSMの帯域幅が他の基本ス トリームによって引継がれるか、或いはバッファ管理が行われるためにマルチプ レクサがデータをSTDへ転送しなくしたりするからである。 図3は通常の、即ち目標設定しないストリームの復号化開始時にVBV及びS TDの占有値がどのようになるかを示したグラフである。このグラフでは判り易 くするために、画像が2つのバッファから除去される時間(システム−ティック )を互いに同期をとって示してある。VBVはデータ転送開始時間のコンセプト を有さず、VBV遅延に基づく画像除去時間のコンセプトを有するだけである。 グラフを並べるために、この図ではVBVのサンプル時間に一定のオフセットを 与えてある。 図3から明らかなように、マルチプレクサ及びエンコーダはクリップの開始時 には同じような戦略に従う。即ち、それらのバッファには上述したように第1画 像が除去される前はできるだけ多くのデータが満たされている。この場合に、S TDバッファの占有値を示す線が常にVBVの占有値を包含していることも明ら かである。この規則に対する例外は開始期間にあり、これはDSMのデータ速度 がVBVのデータ速度よりも速くて、STDへの伝送がVBVの後に開始するか らである。 互いに鎖状につなぐことのできるシステムストリームの生成に転じるに、先ず ビデオデータを包含しているシームレスのシステムストリームの生成につき考察 する。図1に戻るに、系列Aの終了時点から全てのビットを除去するのにかかる 時間は、系列Aのデータ転送が終了する時点にバッファ内にどれだけ多くの画像 があるかに依存する。この時間はソース資料及び使用するエンコーダに依存する 。従って、時間txにおけるバッファの占有値はクリップ毎に変化する。このた めに、マルチプレクサは、通常計算に利用できる情報、即ちビットレートや、フ レームレートや、Btがどのようなものであるかに基づいてtx及びBtがどのよ うになるのかを計算することができない。 上述した全ての未知の問題を回避するために、系列Aの転送が終了する際にバ ッファにおけるデータが、Btビットを一定の速度で転送するのに要する時間を 十分にカバーするようにする。このようにすると、多重ストリームの開始時にBt ビットを転送する最大時間を次のように設定し得ることを認識した。即ち、 tt=Bt/R (1) ここに、ttは図1に示したような時間であり、Rは転送速度である。 この時間はマルチプレクサにとって重要であり、その理由はこの時点にてSC Rの時間を設定することができるからであり、又この時点は第1画像をSTDバ ッファから除去すべき時点である。従って、マルチプレクサはSTDバッファを 少なくともBtビットに満たすべくセットされ、且つSCRをセットして、この 時点にて第1画像が除去されるようにする。なお、この点は第1画像を除去する 時点にバッファにできるだけ多くのデータを満たしておく通常の技法とは相違す る。 ここで注意すべきことは、STDバッファの方がVBVバッファよりも大きい と云うことにある。 条件付きのシステムパラメータの場合には、STDバッファを最大40Kバイ トのVBVの大きさに比べて46Kバイトまでとすることができる。この特別な スペースがあるために、マルチプレクサは種々の基本ストリームを1つのシステ ムストリーム内にインタリーブして、デコーダへのまばらな転送をなくすことが できる。 図4は目標設定した多重動作の開始時にVBV及びSTDバッファの状態がど のようになるのかを示すグラフである。このグラフは図3と同様に時間tに対す る占有値B(ビット)をシステムティック(クロックパルス)の形態にて示した ものである。なお、VBV及びSTDバッファの占有値は第1画像がバッファか ら除去される時点に同じとなる。この時点からSTDバッファの占有値はVBV バッファのそれに追いつき始め、これはデータ転送速度が速いからである。 マルチプレクサはSTDバッファの終了状態までは制御しない。この終了状態 はエンコーダによって制御されるバッファ内にまだ存在する画像の大きさに依存 する。好ましくは、マルチプレクサがデータをSTDにできるだけ早く転送して 、SCRのオーバラップとして既知の問題、つまり最初のクリップからの全ての データが転送し終わらない時にデータが次のクリップに対する期限となることに 対処するようにする。このようなことに対して提案されているマルチプレクサ戦 略は、データがどんなに小さくてもSTDバッファがデータを受入れることがで きる時は常にデータパケットを作製することにある。 図5はクリップの終了時におけるVBV及びSTDの状態を示すグラフである 。これから明らかなように、STDへのデータの転送はVBVへの転送前に終了 する。これはSTDバッファの方が大きく、しかも受信するビットレートが速い からである。クリップの終了に向けて2つのグラフは再び収束する。これは双方 のバッファへのデータ転送が終了して、これらのデータがクリップの端部を成す 画像だけを含む時点である。こうした端部画像をバッファから除去するのに要す る時間は、そのクリップの第1画像を除去する前にバッファを次のクリップから のデータで満たすのに利用できる時間である。この充填時間を図1に時間ttと して示してある。 オーディオ信号について考察すると、オーディオ信号に対してはVBVバッフ ァに等価なものは存在せず、シームレスオーディオの生成はビデオの場合よりも 遙かに簡単である。その理由は、オーディオ信号は一定のビットレートで符号化 されるからである。換言するに、同じように符号化される全てのオーディオフレ ームは同じ大きさ(1バイト以内)であるが、ビデオフレームの大きさはフレー ムのタイプ及び複雑性に依存して変化するからである。しかし、マルチプレクサ はSTDのバッファ状態を、第1オーディオフレームがビデオフレームと同様に 除去される時点に目標設定することができる。 図6は目標オーディオ多重処理の開始のグラフを示す。この場合には、マルチ プレクサはSTDの状態を第1オーディオフレームが除去される時点に2048 バイト(16384ビット)に目標設定する。充填時間は図1のttに相当し、 同じような特性を有し、この時間はデータ転送の終了時のバッファ内のオーディ オフレームにより表わされる時間より大きくしてはならない。マルチプレクサが その目標値に到達し、第1オーディオフレームが除去される場合には、STDの バッファをできるだけいっぱいの状態に維持する戦略をそのままとる。グラフの 大きな増大傾斜はオーディオパケットの転送を表わす。この場合におけるオーデ ィオパケットは約2Kバイトの大きさとする。これは、そのケットがCD−i再 生に対して約2KバイトのCD−iセクタと多重されているからである。 図7はオーディオクリップの終了時にSTDに起生する状態を示している。デ ータ転送の終了時にバッファ内のオーディオフレームを示す占有値の規則正しい 段階的な減少が開始する。これらの残留オーディオフレームは1つのオーディオ クリップの終了から次のオーディオクリップへの切り換えをマスクする。これら の残留オーディオフレームはフレーム数に依存する有限時間継続するが、図6か ら明らかなように、STDのバッファをその目標値に充填するのに要する時間は 残留フレームによりマスクされる時間に比べて遙かに短いために、DSMのビッ トレートがオーディオビットレートよりも相当高いものと仮定すると、STDの アンダーフローは生じなくなる。実験の結果、オーディオ信号に対しては、ST Dのバッファをフル状態の約50%に目標設定すると容認できる結果が得られる ことを確かめた。 図8はそれぞれビデオ信号V及びオーディオ信号A用の別個のエンコーダ段1 0,12を有するエンコーダ装置を示す。ビデオ信号内のフレームを(例えば、 系列の第1画像及び最終画像に対する相対位置により)識別するフレーム基準信 号FC用の他の入力端子が目標設定段14に接続され、この目標設定段は系列の 画像に対するビット割当を指定する。なお、オーディオエンコーダには対応する 目標設定段は存在しない。これは上述したように、符号化されたオーディオフレ ームの大きさが一定であるために不要である。 各エンコーダ段10,12からの出力は図示のようにそれぞれのバッファ16 ,18に供給される(実際にはこれらのバッファはそれぞれのエンコーダ段の一 部を構成する)。ビデオエンコーダ段10の出力から目標設定段14への帰還路 20により、設定目標が符号化したグループ内の1画像当りの所要バット数にな ったかどうかを検査することができる。 バッファされた出力はマルチプレクサ22によりインタリーブされる。このマ ルチプレクサはタイムスタンプも挿入して単一データストリームDS(システム ストリーム)を形成し、次いでこのストリームをデコーダに伝送するか、又はコ ンパクトディスクのような適当な媒体に記憶することができる。 デコーダ(図9)では、デマルチプレクサ24が入力ストリームを監視する検 出器26を参照して、ストリームDSをビットチャネル及びオーディオチャネル に分離する。分離したビデオ及びストリームはそれぞれのバッファ28,30へ 供給され、そこからそれぞれのデコーダ段32,34に供給され、復号化されて 出力信号Vout,Aoutを出力する。これらのバッファは実際にはそれぞれのデコ ーダ段の一部を構成するが、これらはSTDモデルを明瞭に示すために分離して 示してある。 前記マルチプレクサは、異なったストリームをインタリーブするため、すべて のDSMバンド幅を、特定のある1つのストリームに使用することはできない。 したがって、Btビットに達するバッファ状態に対して選択される時間は、スト リームの数が増加するにしたがって増加する。これは、上述したSCRオーバラ ップの現象を招く恐れがある、可能性がある問題である。SCRオーバラップは 、それ自体を以下のように示す。delta値(見積もられる持続時間値)を、 次のクリップの始端におけるSCRに用いる場合、これらは、前記最終クリップ の終端におけるSCRより小さいことが分かる。すなわち、次のクリップに関す るデータは、現在のクリップのすべてのデータが伝送される前に伝送される。こ れは、明らかに不可能な状況であり、システムクラッシュを引き起こす。 前記マルチプレクサは、データの第1の伝送と、バッファをBtビットに形成 するパケットの伝送との間の時間がtt秒より短くなるように各々のストリーム を検査することによってSCRオーバラップを防止することができる。前記マル チプレクサが、時間ttを越えたことを見つけると、SCRオーバラップが生じ たかもしれないことを知り、監視されたシステムにおいて、適切なエラーメッセ ージをユーザに示すことができる。 基本的なストリームのビットレートの和が、DSMのビットレートより大きい 場合、SCRオーバラップが生じる恐れがある。しかしながら、この場合におい て、多重化は、どんな方法でも不可能であり、マルチプレクサは、再び適切なエ ラーメッセージを出すべきである。 Btに達した時点におけるSCRを設定するマルチプレクサの基本的なアルゴ リズムが間違っている場合、またはマルチプレクサがBtを間違って判断した場 合、SCRオーバラップが生じる恐れがある。 満たされるまでの時間の増加とともに、ストリームの数が増加し、伝送をより 早く開始しなければならないため、多重化されたクリップの開始SCRは減少す る。したがって、データ値をこの開始SCRに用いる場合、SCRオーバラップ を発生するほど小さいかもしれない。 ビットレートおよびSTDバッファの容量は、ストリーム間で異なり、したが って、すべてのデータがDSMからSTDに伝送される時間は異なる。例えば、 オーディオSTDバッファは、CSPSの場合においては小さいので、伝送は実 時間に近い。これは、同様の長さのオーディオおよびビデオストリームを共に多 重化した場合、オーディオパックが最終ビデオパックの終端以上に延長し、最終 SCRが増加することを意味する。このため、ストリームの数が増加するため、 すなわち開始SCRが減少し、終端SCRが増加するため、多重化されたストリ ームの両端において問題が生じる。 多重化動作の終わりにおいて、マルチプレクサは、可能性のあるSCRオーバ ラップを、以下のように抑制することができる。マルチプレクサは、入力ストリ ームを検査することによって、クリップに対するdelta値をどの程度にすべ きかを知っているため、この値をクリップの第1SCRに用いることができ、そ れ自身でループになっているクリップと類似する。マルチプレクサは、最も小さ い次に可能性があるSCRがどの程度なのかも知っている。パッチされたSCR (第1SCRにdelta値を加えたもの)と、次に可能性があるSCRとの比 較を行う。パッチされたSCRが、次に可能性があるSCRより小さいことが分 かった場合、SCRオーバラップが生じる。 シームレスなシステム層クリップを発生するオーディオおよびビデオの組み合 わせを、目的のオーディオ/ビデオ多重化対に関するSTD状態曲線を示す図1 0の参照とともに説明する。2つの形式のストリームに関するSTDグラフの異 なった性質に注意されたい。画像形式の変更(例えば、I画像がB画像より大き い)または画像における複雑さの変化の結果、ビデオSTDグラフは、画像の寸 法において極めて不規則に反射が変化する。他方では、オーディオSTDグラフ は、すべてのオーディオフレームが一定のサイズである(1バイト以内)ため、 極めて規則的に反射する。 図11において、ビデオSTD状態と、その対応するVBV状態と、オーディ オSTD状態とに関する曲線を示す。ビデオSTD状態は、この場合において、 第1画像がバッファから除去された時点において目標となるVBV状態に達して いないことは明らかである。マルチプレクサが、SCRオーバラップを与えるよ うに計算しているため、これが生じる。すなわち、充填時間が増加し、VBVの 開始状態に対するSTD開始状態を得た場合、クリップの開始におけるSCRは 小さすぎてしまう。 マルチプレクサは、クリップ全体の最終SCRがなにかを予測し、SCRオー バラップが生じる前に開始SCRをどの程度負にできるかを見つけることによっ て最大充填時間を計算する。すなわち、delta値を用いる前に開始SCRが どの程度負にできるかが、クリップの終端におけるより小さいSCRを与える。 最終SCRを、各々のストリームがどのくらい長く続くかを計算し、STDに 一時記憶することができる(時間として表した)データの量から減算することに よって予測する。STDに一時記憶されたデータによって表される時間は、丁度 、STDサイズを基本的なストリームビットレートで割った値である。理解され るように、オーディオに関して、オーディオフレームのサイズが既知であり、バ ッファは、整数個のフレームを含んでいるに違いないため、バッファ時間に対す るより精度の高い予測を行うことができる。もちろんこれをビデオに用いること は、フレームサイズが変化するため、できない。 最終SCRを各々のストリームに関して計算し、最も大きいものを使用する。 実際には、オーディオおよびビデオストリームが同じ長さの場合、最大最終SC Rは、ほとんど常にオーディオストリームからのものになる。これは、ビデオデ ータレートがオーディオデータレートに近い起こりそうもない場合において、変 化するかもしれない。 STD状態がVBV状態に追いつく前のストリーム中の極めて大きい画像がバ ッファアンダフローを生じるかもしれないため、マルチプレクサが、開始VBV 状態に達しない開始STD状態の発生を許可することによるポテンシャル問題が 存在する。これは、実際には起こりそうもないが、理論的には可能性があり、こ の問題を克服する方法は、エンコーダがクリップの開始において発生する画像の サイズを抑制することである。 上述した方法は、存在するクリップの最終SCRの見積もりにおいて適度な精 度を提供するが、個々の用途に応じて常に十分な精度とすることはできないこを 指摘すべきである。マルチプレクサがクリップを通過するのを一度だけしか発見 できない多重化動作によってパック割り当てが影響されるため、不正確さが生じ る恐れがある。この理由のため、精度を必要とするユーザは、マルチプレクサを 2回使用すべきであり、いくつかのパラメータの2度目の変更(例えば、オーデ ィオの短縮または目標の減少)は、オーバラップしないSCRを得る。変化する クリップの自動化発生の方法は、2段階の方法であり、上述した最良推測方法を 使用する第1の段階と、この第1の段階の結果に基づいて行う必要がある他の変 更を考慮した第2の段階とである。 ここで、クリップの終端におけるオーディオおよびビデオSTD状態を示す図 12を参照し、オーディオSTDに対するデータの伝送が、ビデオSTDに対す る伝送の終了後に延びてることに注意されたい。したがって、オーディオは、終 了SCRを制御するストリームである。上述したように、マルチプレクサは、デ ータをSTDにできるだけ早く伝送することによって、最終SCRを減少させよ うとすることができる。このための適切な技術は、多重化動作の終了において最 適値より小さいパケットを形成することである。 ここでタイムスタンプに戻ると、マルチプレクサが制御できない唯一のタイム スタンプは、パックが伝送される時点におけるSCRである。他のタイムスタン プ(PTSおよびDTS)は、ユーザが、第1フレームのPTSをなににすべき かを判断するときに設定される。上述した方法にによって発生されたクリップを デコーダに対してシームレスに見せるために、タイムスタンプを線型的に増加す るように見せる必要がある。すなわち、デコーダが見るタイムスタンプにおいて 、急激な段階の変化があってはならない。これは、次のクリップにおけるすべて のタイムスタンプにdelta値を用いることによって、これらが、現在のクリ ップがより長かった場合に現れる値を有するようにして達成される。 delta値を、デコーダがこのdeltaを見る前に用いる必要がある。こ の値を、例えば、 − クリップをデコーダに送る前のアプリケーション、 − クリップをデコーダに送る前のドライバ、 − ビデオデータをセットトップボックスに対して電話線に送る前の遠隔サー バのCPUにおいて用いることができる。 delta値は、(存在していた)現在のクリップの最終フレーム後のフレー ムのPTSと、次のクリップの第1フレームのPTSとの差であり、次式によっ て要約される。 Δ=PTSlast+PTSstep+PTSfirst (2) ここで、 PTSlastは、現在のクリップの最終フレームのPTSである。 PTSstepは、隣接するPTSにおける増分である。 PTSfirstは、次のクリップの第1フレームのPTSである。 互いに同期したMPEGオーディオおよびビデオのシームレスなクリップの再 生することが望ましく、双方のデータ形式のタイムスタンプに用いられる1つの delta値とすることができる。これは、MPEGシステム層がSCRによっ て表される時間が、双方の形式のデータストリームに対して同じレートにおいて 増加する効果によるものである。データ値が異なる場合、タイムスタンプが離れ 離れになってしまうため、同期が失われてしまう。オーディオおよびビデオに関 するフレームサイズと、したがってPTSstepとは異なることから、delta 値をどのように計算するかの問題を、以下に論考する。 ビデオに用いる場合、”フレームレート”という言葉がよく知られており、例 えば、PALに関して25Hzで、NTSCに関して29.97Hzである。し かしながら、MPEG符号化オーディオは、レイヤIに関しては384標本、レ イヤIIおよびIIIに関しては1152標本から成るフレームに分割もされている 。これらは、集めた場合、MPEGオーディオストリームを構成する独立したブ ロックを形成する。デコーダに所望の出力を発生させるために、整数個のフレー ムを受ける必要があり、オーディオのフレームを半分送るとグリッチが引き起こ されるか、ことによるとシステムクラッシュが引き起こされる。MPEGのある クリップに関して、そこに含まれるオーディオおよびビデオフレームによって占 められる時間は通常異なるため、これは問題を生じる。5秒の長さのオーディオ およびビデオを示す図13を考えると、異なる理由が明らかになるであろう。 図13は、整数個のオーディオおよびビデオフレームを表す2つのブロックを 示す。各ブロック内のフレーム数は、ブロック関する時間ができるだけ5秒に近 くなるような数である。オーディオおよびビデオのタイミング間の差を最小にす るために、好適にはマルチプレクサを、個々のストリーム部分を選択できるよう に構成する。すなわち、完全なオーディオまたはビデオを選択することを強制し ない。このようにして、個々の開始および終了を、オーディオおよびビデオクリ ップ長の全体的な差が最小となるように選択することができる。 例として、図13のデータが、ループになっていることが望まれるシステムフ ァイル内に含まれ、ビデオまたはオーディオから計算されたdelta値を有す る場合、なにが起こるかを考える。 ビデオdelta値を最初に選択し、このビデオdelta値をビデオデータ に用いると、ループ内のビデオフレームレートが一様になる。しかしながら、こ のデータ値(5.0秒)をオーディオブロックに使用した場合、タイムスタンプ は、ループの開始において、終端におけるタイムスタンプと同じにパッチされる 。これは、明らかにうまくいかず、オーディオフレーム数を191に減少する必 要性を導き、以下の結果を与える。 しかしながら、オーディオの開始におけるタイムスタンプを終端のタイムスタン プの5秒前にパッチすることによって、10.6msのエラーが生じ、これは、 オーディオフレームの40.6%である。この不一致によって、オーディオがル ープの終端から開始までの10.6msの間、無音になる。 ここでオーディオdelta値に戻り、これを使用することによって、オーデ ィオフレームレートは維持される。しかしながら、ビデオに関するパッチされた タイムスタンプと、フレームレートが一定の場合のタイムスタンプとの間には1 5.5msの差が存在し、これは、ビデオフレームの38.8%である。この差 によって、クリップの最終フレームは15.5ms間停止する。しかしながら、 このフレームは、画面上に依然として存在する。 上述したことは、フレーム長が異なる問題に対する完全な解決法が存在しない ことを示し、オーディオ無音または停止ビデオフレームのいずれかが生じるが、 停止の期間を、上述したようにファイル全体でなく基本的なストリーム部分を選 択することによって、最小化することができる。これら2つの内では、ユーザが 、極めて目立つオーディオ無音に比べて気づきにくいため、停止ビデオフレーム の方が好適である。この理由のため、同期したオーディオおよびビデオをループ しようとする場合、オーディオをdelta値に対する駆動データ形式として使 用することを提案する。 以上の説明から、他の様々な変更は当業者に明らかである。このような変更に は、オーディオ及び/又はビット信号の編集方法および装置並びにその構成要素 において既知であって、ここに記載した特徴に代えて、又はそれに加えて使用し 得る他の特徴が含まれる。特許請求の範囲は構成要素の組合せとして記載してあ るが、本発明で解決すべき技術的な問題の一部又は全部を解決するか、しないか に拘らず、本明細書に開示した新規な構成又は構成要素の組合せも本発明の範囲 に含まれるものである。

Claims (1)

  1. 【特許請求の範囲】 1. 符号化段と、エンコーダバッファと、符号化されたビデオ信号を少なくと も1つの他の信号とインタリーブしてシステムストリームを形成する手段とを有 するエンコーダ装置において、2つまたはそれ以上のビデオフレームを各々含む セグメントの形態において、ディジタルビデオ信号を符号化する方法であって、 各々のセグメントに関して、 − 予め決められた符号化計画にしたがってセグメントのフレームを連続的 に符号化するステップと、 − 符号化されたフレームを前記バッファ中に読み出すステップと、 − 符号化されたセグメントを前記バッファから実際的に一定のビットレー トにおいて読み出すステップと、 − 前記バッファの出力信号を1つまたはそれ以上のタイムスタンプと共に システムストリーム中にインタリーブするステップとを具える方法において、 前記エンコーダバッファの占有値を、前のセグメントの最終フレームを前記 バッファ中に読み出した瞬間において第1の予め決められたレベルを有するよう に制御し、この占有レベルがデコーダバッファ占有レベルと関係し、 − デコーダバッファを前記一定のビットレートにおいて空から前記デコー ダバッファ占有レベルにまで満たすために必要な時間tを得るステップと、 − 現在のセグメントに関する期間deltaを予測するステップと、 − 現在のセグメントの最終フレームを前記デコーダバッファから読み出す べき時点の時間値を予測するステップと、 − (t+delta)によって与えられる時間値が、前記現在のセグメン トの最終フレームを前記デコーダバッファから読み出すべき時点の時間値に近い が、より大きくなるまで、tの値を減少するステップと、 − 開始されたセグメントのローディング後にtの減少値によって与えられ る時間において前記デコーダバッファからセグメントの第1フレームを読み出す べきことを示すセグメントのシステムストリーム中にタイムスタンプを挿入する ステップとを具えることを特徴とする方法。 2. 請求の範囲1に記載の方法において、現在のセグメントの最終フレームを 前記デコーダバッファから読み出すべき時点を、前記セグメントの持続時間を計 算し、時間の項における前記デコーダバッファの最大容量を減算することによっ て予測することを特徴とする方法。 3. 請求の範囲1に記載の方法において、現在のセグメントの最終フレームを 前記デコーダバッファから読み出すべき時点の時間値を、インタリーブされた各 々のストリームに関して予測し、最も大きい値を、すべてのストリームに関する 前記減少値の誘導に使用することを特徴とする方法。 4. 請求の範囲1に記載の方法において、前記第1セグメントの画像を符号化 するために使用されるビットの目標数を、前記エンコーダバッファ占有レベルに 達するように制御的に変化させることを特徴とする方法。 5. 請求の範囲1に記載の方法において、最大エンコーダバッファ占有レベル を指定し、前記デコーダバッファ占有レベルを、前記最大レベルと、前記第1セ グメントの最終画像を前記エンコーダバッファに読み込んだ1フレーム周期後の エンコーダバッファ占有レベルとの差として規定したことを特徴とする方法。 6. 請求の範囲1に記載の方法において、セグメントの画像を、MPEG標準 に従って符号化することを特徴とする方法。 7. 各々のセグメントが2つまたはそれ以上のビデオフレームを具える映像セ グメントの符号化用に形成され、 セグメントの連続するフレームを受けてこれらを予め決められた符号化計画 にしたがって符号化するために構成された符号化段と、 前記符号化段から連続する符号化されたフレームを受けるために結合され、 符号化されたセグメントを実際的に一定のビットレートにおいて出力するように 構成されたバッファと、 前記バッファ出力および少なくとも1つの他の信号を受けるために結合され 、これらをシステムストリーム中にインタリーブするように構成されたマルチプ レクサとを具えるディジタルビデオ信号エンコーダ装置において、 前記符号化段を、制御しうる可変のビット数におけるセグメントの映像を符 号化し、セグメントの最終映像が前記エンコーダバッファ中に読み出される時点 における予め決められたエンコーダバッファ占有値を発生し、前記セグメントの 持続時間の予測値および、前記セグメントの最終フレームをデコーダバッファか ら読み出すべき時点の時間値を発生することができるようにし、前記マルチプレ クサを、前記セグメントのデコーダバッファへのローディングが開始された後の 前記予め決められた時間値において前記デコーダバッファからセグメントの第1 フレームを読み出すべきことを示すセグメントのシステムストリーム中にタイム スタンプを挿入するように構成したことを特徴とするディジタルビデオ信号エン コーダ装置。 8. 請求の範囲7に記載の装置において、連続するデータフレームを受け、こ れらを前記予め決められた符号化計画に従って符号化する他の符号化段と、前記 他の符号化段から連続する符号化データフレームを受けるために結合され、実際 的に一定のビットレートにおいて符号化データを出力するように構成された他の バッファとを具え、前記マルチプレクサによって受けられた少なくとも1つの他 の信号を前記他のバッファから出力することを特徴とする方法。 9. 請求の範囲1に記載の方法によって符号化された複数のセグメントを具え るディジタルビデオ映像信号であって、少なくとも1つの他の信号をシステムス トリーム中にインタリーブされた符号化データのストリームを具え、前記システ ムストリームが、開始されたセグメントのローディング後にtの減少値によって 与えられる時間において前記デコーダバッファから個々のセグメントの第1フレ ームを読み出すべきことを示す前記タイムスタンプを、各セグメントごとに含む ことを特徴とする信号。 10. 請求の範囲9に記載のビデオ映像信号のような信号を保持する光ディス ク。
JP8518525A 1994-12-02 1995-11-24 オーディオ/ビデオタイミング不一致管理 Ceased JPH09509035A (ja)

Applications Claiming Priority (3)

Application Number Priority Date Filing Date Title
GB9424429A GB9424429D0 (en) 1994-12-02 1994-12-02 Audio/video timing discrepancy management
GB9424429.0 1994-12-02
PCT/IB1995/001052 WO1996017490A2 (en) 1994-12-02 1995-11-24 Audio/video timing discrepancy management

Publications (1)

Publication Number Publication Date
JPH09509035A true JPH09509035A (ja) 1997-09-09

Family

ID=10765370

Family Applications (1)

Application Number Title Priority Date Filing Date
JP8518525A Ceased JPH09509035A (ja) 1994-12-02 1995-11-24 オーディオ/ビデオタイミング不一致管理

Country Status (8)

Country Link
US (1) US5793431A (ja)
EP (1) EP0742992B1 (ja)
JP (1) JPH09509035A (ja)
CN (1) CN1092916C (ja)
BR (1) BR9506692A (ja)
DE (1) DE69527508T2 (ja)
GB (1) GB9424429D0 (ja)
WO (1) WO1996017490A2 (ja)

Families Citing this family (33)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US5913031A (en) * 1994-12-02 1999-06-15 U.S. Philips Corporation Encoder system level buffer management
US6011598A (en) * 1996-03-28 2000-01-04 Sanyo Electric Co., Ltd. Decoding start controller, decoder, and decoding system
JP3668556B2 (ja) * 1996-06-13 2005-07-06 ソニー株式会社 ディジタル信号符号化方法
KR100308704B1 (ko) * 1996-07-04 2001-10-19 모리시타 요이찌 다중화 데이터 생성 장치, 부호화 데이터 재생 장치, 클럭 변환 장치, 다중화 데이터 생성 방법, 부호화 데이터 재생 방법 및 클럭 변환 방법
USRE38875E1 (en) * 1996-07-05 2005-11-15 Matsushita Electric Industrial Co., Ltd. Method for display time stamping and synchronization of multiple video objects planes
GB9700956D0 (en) * 1997-01-17 1997-03-05 Digi Media Vision Ltd Improvements in or relating to switching between compressed bitstreams
US5982436A (en) * 1997-03-28 1999-11-09 Philips Electronics North America Corp. Method for seamless splicing in a video encoder
GB2328099B (en) 1997-08-08 2002-07-03 British Broadcasting Corp Processing coded video
EP0911827B1 (en) * 1997-10-21 2011-11-30 Sony Corporation Recording and/or reproduction apparatus, file management method and providing medium
US6049569A (en) * 1997-12-09 2000-04-11 Philips Electronics N.A. Corporation Method and apparatus for encoding digital video bit streams with seamless splice points and method and apparatus for splicing such digital video bit streams
JP3305999B2 (ja) * 1997-12-26 2002-07-24 日本ビクター株式会社 画像圧縮ストリーム編集装置及びその方法
US6269120B1 (en) * 1998-03-23 2001-07-31 International Business Machines Corporation Method of precise buffer management for MPEG video splicing
EP1095520A2 (en) * 1998-06-29 2001-05-02 Limt Technology AB Method and apparatus for splicing data streams
US6904089B1 (en) * 1998-12-28 2005-06-07 Matsushita Electric Industrial Co., Ltd. Encoding device and decoding device
US6480539B1 (en) 1999-09-10 2002-11-12 Thomson Licensing S.A. Video encoding method and apparatus
EP1085767B1 (en) 1999-09-20 2011-08-10 Panasonic Corporation An encoding/recording device that suspends encoding for video data and sampling for an audio signal in response to a recording pause instruction so as to allow data recorded before and after recording pause to be continuously reproduced
GB2357674B (en) * 1999-10-26 2003-12-10 Snell & Wilcox Ltd Compressed bitstreams
WO2001052554A1 (en) * 2000-01-10 2001-07-19 Koninklijke Philips Electronics N.V. Method of setting a system time clock at the start of an mpeg sequence
JP4410375B2 (ja) 2000-03-31 2010-02-03 パナソニック株式会社 画像信号再生装置および画像信号再生方法
EP1148503A1 (en) * 2000-04-08 2001-10-24 Deutsche Thomson-Brandt Gmbh Method and apparatus for recording on a storage medium or replaying from a storage medium data packets of a transport stream
US7050460B1 (en) * 2000-04-14 2006-05-23 Ati International Srl Method and apparatus for multiplexing data streams using time constraints
PT1504445E (pt) * 2002-04-25 2008-11-24 Landmark Digital Services Llc Emparelhamento de padrões áudio robusto e invariante
JP4902935B2 (ja) * 2003-05-08 2012-03-21 ソニー株式会社 情報処理装置、情報処理方法、プログラム、及び記録媒体
US20050172091A1 (en) * 2004-01-29 2005-08-04 Rotithor Hemant G. Method and an apparatus for interleaving read data return in a packetized interconnect to memory
US7400653B2 (en) * 2004-06-18 2008-07-15 Dolby Laboratories Licensing Corporation Maintaining synchronization of streaming audio and video using internet protocol
KR101226178B1 (ko) * 2007-03-27 2013-01-24 삼성전자주식회사 비디오 데이터 디스플레이 방법 및 장치
DE102007045741A1 (de) * 2007-06-27 2009-01-08 Siemens Ag Verfahren und Vorrichtung zum Codieren und Decodieren von Multimediadaten
JP2011511554A (ja) * 2008-01-30 2011-04-07 ヒューレット−パッカード デベロップメント カンパニー エル.ピー. ビデオデータをストリーミングするための方法
EP2403248B1 (en) * 2009-02-27 2018-07-04 Fujitsu Limited Moving picture encoding device, moving picture encoding method, and moving picture encoding computer program
US8483286B2 (en) 2010-10-27 2013-07-09 Cyberlink Corp. Batch processing of media content
CN103152607B (zh) * 2013-01-10 2016-10-12 上海思华科技股份有限公司 视频超快速粗编方法
WO2017019674A1 (en) 2015-07-28 2017-02-02 Dolby Laboratories Licensing Corporation Audio discontinuity detection and correction
CN116132685B (zh) * 2022-09-20 2024-12-31 杭州海康威视数字技术股份有限公司 图像编解码方法、装置及存储介质

Family Cites Families (6)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
GB9001295D0 (en) * 1990-01-19 1990-03-21 British Broadcasting Corp Buffer resynchronisation
US5486864A (en) * 1993-05-13 1996-01-23 Rca Thomson Licensing Corporation Differential time code method and apparatus as for a compressed video signal
US5561466A (en) * 1993-06-23 1996-10-01 Nec Corporation Video and audio data multiplexing into ATM cells with no dummy cell used and ATM cell demultiplexing
JPH0730589A (ja) * 1993-07-06 1995-01-31 Canon Inc データ送信装置
WO1995022233A1 (en) * 1994-02-11 1995-08-17 Newbridge Networks Corporation Method of dynamically compensating for variable transmission delays in packet networks
US5534944A (en) * 1994-07-15 1996-07-09 Matsushita Electric Corporation Of America Method of splicing MPEG encoded video

Also Published As

Publication number Publication date
EP0742992A4 (ja) 1996-12-11
CN1144030A (zh) 1997-02-26
EP0742992B1 (en) 2002-07-24
DE69527508T2 (de) 2003-03-20
EP0742992A1 (en) 1996-11-20
BR9506692A (pt) 1997-11-18
WO1996017490A3 (en) 1996-08-29
WO1996017490A2 (en) 1996-06-06
US5793431A (en) 1998-08-11
GB9424429D0 (en) 1995-01-18
CN1092916C (zh) 2002-10-16
DE69527508D1 (de) 2002-08-29

Similar Documents

Publication Publication Date Title
US5793431A (en) Audio/video discrepancy management
US5913031A (en) Encoder system level buffer management
KR100239837B1 (ko) 오디오 및/또는 비디오 신호 전송방법 및 장치
JP3605826B2 (ja) ビデオおよびオーディオ信号処理システムにおける補助情報のための合理的入力バッファの回路配列
US7412149B2 (en) Trick mode generation in video streaming
US6327421B1 (en) Multiple speed fast forward/rewind compressed video delivery system
JP3405034B2 (ja) ディジタル信号多重化方法及び装置、並びにディジタル信号記録媒体
US6345122B1 (en) Compressed picture data editing apparatus and method
JP2001513606A (ja) 符号化ビデオの処理
JP3758677B2 (ja) エンコーダシステムのレベルバッファ管理
JP3762430B2 (ja) データパケットを伝送する方法および装置
JP2004505513A5 (ja)
JP2004505513A (ja) ネットワークフィードの固定タイムスロットに圧縮されたローカルビデオセグメントをスプライシングすること
US5677980A (en) Decoder for compressed digital signal
JP3758676B2 (ja) ビデオ編集用バッファの管理
JP2004056809A (ja) データバッファの同期システム
KR101014664B1 (ko) 복수의 데이터 스트림 간의 연속 재생을 보장하는 재생방법 및 그 재생 장치
US7333711B2 (en) Data distribution apparatus and method, and data distribution system
EP0869679A2 (en) Encoding, decoding and editing
JPH0730886A (ja) 画像および音声信号処理方法とその装置
US20050249202A1 (en) Information processing device and method, program, and recording medium
JP3248669B2 (ja) 多重化方法及び多重化装置
JPH09312656A (ja) 伝送装置およびその方法
JPH09261604A (ja) ディジタル信号符号化方法および装置、ディジタル信号伝送方法および装置、並びに記録媒体
JP4608831B2 (ja) データ多重化装置およびデータ多重化方法

Legal Events

Date Code Title Description
A131 Notification of reasons for refusal

Free format text: JAPANESE INTERMEDIATE CODE: A131

Effective date: 20041221

A601 Written request for extension of time

Free format text: JAPANESE INTERMEDIATE CODE: A601

Effective date: 20050322

A602 Written permission of extension of time

Free format text: JAPANESE INTERMEDIATE CODE: A602

Effective date: 20050509

A521 Request for written amendment filed

Free format text: JAPANESE INTERMEDIATE CODE: A523

Effective date: 20050621

A01 Written decision to grant a patent or to grant a registration (utility model)

Free format text: JAPANESE INTERMEDIATE CODE: A01

Effective date: 20050809

A045 Written measure of dismissal of application [lapsed due to lack of payment]

Free format text: JAPANESE INTERMEDIATE CODE: A045

Effective date: 20060110