WO2017105097A1 - 머지 후보 리스트를 이용한 비디오 복호화 방법 및 비디오 복호화 장치 - Google Patents
머지 후보 리스트를 이용한 비디오 복호화 방법 및 비디오 복호화 장치 Download PDFInfo
- Publication number
- WO2017105097A1 WO2017105097A1 PCT/KR2016/014695 KR2016014695W WO2017105097A1 WO 2017105097 A1 WO2017105097 A1 WO 2017105097A1 KR 2016014695 W KR2016014695 W KR 2016014695W WO 2017105097 A1 WO2017105097 A1 WO 2017105097A1
- Authority
- WO
- WIPO (PCT)
- Prior art keywords
- merge candidate
- intra
- coding unit
- prediction
- current block
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Ceased
Links
Images
Classifications
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/102—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or selection affected or controlled by the adaptive coding
- H04N19/103—Selection of coding mode or of prediction mode
- H04N19/11—Selection of coding mode or of prediction mode among a plurality of spatial predictive coding modes
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/102—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or selection affected or controlled by the adaptive coding
- H04N19/103—Selection of coding mode or of prediction mode
- H04N19/105—Selection of the reference unit for prediction within a chosen coding or prediction mode, e.g. adaptive choice of position and number of pixels used for prediction
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/102—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or selection affected or controlled by the adaptive coding
- H04N19/103—Selection of coding mode or of prediction mode
- H04N19/109—Selection of coding mode or of prediction mode among a plurality of temporal predictive coding modes
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/134—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or criterion affecting or controlling the adaptive coding
- H04N19/136—Incoming video signal characteristics or properties
- H04N19/137—Motion inside a coding unit, e.g. average field, frame or block difference
- H04N19/139—Analysis of motion vectors, e.g. their magnitude, direction, variance or reliability
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/134—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or criterion affecting or controlling the adaptive coding
- H04N19/157—Assigned coding mode, i.e. the coding mode being predefined or preselected to be further used for selection of another element or parameter
- H04N19/159—Prediction type, e.g. intra-frame, inter-frame or bidirectional frame prediction
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/169—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding
- H04N19/17—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object
- H04N19/176—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object the region being a block, e.g. a macroblock
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/189—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the adaptation method, adaptation tool or adaptation type used for the adaptive coding
- H04N19/196—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the adaptation method, adaptation tool or adaptation type used for the adaptive coding being specially adapted for the computation of encoding parameters, e.g. by averaging previously computed encoding parameters
- H04N19/198—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the adaptation method, adaptation tool or adaptation type used for the adaptive coding being specially adapted for the computation of encoding parameters, e.g. by averaging previously computed encoding parameters including smoothing of a sequence of encoding parameters, e.g. by averaging, by choice of the maximum, minimum or median value
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/44—Decoders specially adapted therefor, e.g. video decoders which are asymmetric with respect to the encoder
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
- H04N19/513—Processing of motion vectors
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
- H04N19/56—Motion estimation with initialisation of the vector search, e.g. estimating a good candidate to initiate a search
Definitions
- the present disclosure relates to a video decoding method and a video decoding apparatus, and proposes a method and apparatus for performing inter prediction using a merge candidate list including a temporal neighboring block and a spatial neighboring block.
- the image data is encoded by a codec according to a predetermined data compression standard, for example, the Moving Picture Expert Group (MPEG) standard, and then stored in a recording medium in the form of a bitstream or transmitted through a communication channel.
- MPEG Moving Picture Expert Group
- a prediction technique is a technique of encoding data of a current block by using a block having information similar to a current block in an image. If the data of the current block is directly encoded, since the amount of data generated by the encoding is relatively large, only the difference information between the data of the other block already encoded and the data of the current block is encoded, and the data generated by the encoding is transmitted or stored. It is.
- Information generated by encoding data of a current block through a prediction technique may be defined as prediction information.
- information indicating another block used for encoding the current block is also coded as prediction information and transmitted or stored.
- the process of determining the other block used to encode the current block is preceded.
- the current block is predicted using information having a similar propensity as the current block, neighboring samples that are spatially adjacent to the current block in the current image are used, or neighboring blocks that are spatially adjacent to each other, are temporally different from each other. Collocated Blocks within are used.
- the sample value of the current block may be determined using neighboring sample values spatially adjacent to the current block.
- motion information of a current block is determined using prediction information of neighboring blocks such as a neighboring block or a collocated block.
- the sample value of the current block may be determined using the sample value of the reference block indicated by the motion information of the current block.
- the range of information to be referred to as information may vary.
- a merge candidate list is used to determine neighboring blocks to be used for inter prediction.
- the motion information of the current block may be determined by using one piece of motion information among at least one candidate block included in the merge candidate list.
- An object of the present invention is to provide a method for effectively determining a merge candidate list to be used in a video encoding apparatus, a decoding apparatus, and inter prediction.
- a video encoding method includes determining whether an intra merge candidate may be included in a merge candidate list; If the intra merge candidate can be included in a merge candidate list, determining a merge candidate list including at least one of an inter merge candidate of the current block and the intra merge candidate; Generating prediction samples of the current block by using the prediction candidate selected from the generated merge candidate list; And reconstructing the current block by using prediction samples of the current block and residual samples of the current block.
- the intermerge candidate may include at least one of a neighboring block spatially adjacent to the current block and a collocated block positioned corresponding to the position of the current block within a temporally adjacent picture of the current block.
- the prediction block is determined by the motion information of the block, and the intra merge candidate may be a prediction block determined by using neighboring samples spatially adjacent to the current block.
- the video decoding apparatus determines whether an intra merge candidate may be included in a merge candidate list, and when the intra merge candidate may be included in a merge candidate list,
- a merge candidate list determiner configured to determine a merge candidate list including at least one of an inter merge candidate and the intra merge candidate;
- a decoder configured to generate prediction samples of the current block by using the prediction candidate selected from the generated merge candidate list, and reconstruct the current block by using the prediction samples of the current block and the residual samples of the current block. It may include.
- a video candidate list including at least one of an inter merge candidate and an intra merge candidate of the current block is determined. step; Generating a merge candidate index indicating the prediction candidate selected to generate prediction samples of the current block among the generated merge candidate lists; And encoding the residual samples and the merge candidate index between the prediction samples of the current block and the current block, and generating a bitstream including the encoded information.
- a computer-readable recording medium includes: determining whether an intra merge candidate may be included in a merge candidate list; If the intra merge candidate can be included in a merge candidate list, determining a merge candidate list including at least one of an inter merge candidate of the current block and the intra merge candidate; Generating prediction samples of the current block by using the prediction candidate selected from the generated merge candidate list; And reconstructing the current block by using the prediction samples of the current block and the residual samples of the current block, in which the computer program for implementing the video decoding method is recorded.
- the computer-readable recording medium may include a merge candidate including at least one of an inter merge candidate and an intra merge candidate of the current block when the intra merge candidate is included in the merge candidate list. Determining a list; Generating a merge candidate index indicating the prediction candidate selected to generate prediction samples of the current block among the generated merge candidate lists; And encoding the residual samples and the merge candidate index between the prediction samples of the current block and the current block, and generating a bitstream including the encoded information. It may be a recorded recording medium.
- FIG. 1A is a block diagram of a video decoding apparatus, according to an embodiment.
- 1B is a flowchart of a video decoding method according to an embodiment.
- FIG. 2A is a block diagram of a video encoding apparatus, according to an embodiment.
- 2B is a flowchart of a video encoding method, according to an embodiment.
- 3A illustrates inter merge candidates that may be included in a merge candidate list.
- 3B and 3C illustrate intra merge candidates that may be included in a merge candidate list according to one embodiment.
- FIG. 4 illustrates a merge candidate list including an inter merge candidate and an intra merge candidate according to an embodiment.
- FIG 5 illustrates an inter merge candidate list including an inter merge candidate and an intra merge candidate list including an intra merge candidate according to an embodiment.
- 6A, 6B and 6C illustrate intra merge candidate lists in which weighted averaged prediction sample values of an inter merge candidate and an intra merge candidate are included as inter-intra merge candidates, according to an embodiment.
- FIG. 7 illustrates a merge candidate list including an inter merge candidate and an inter-intra merge candidate according to an embodiment.
- FIG 8 illustrates an intra merge candidate list including an inter merge candidate, an intra merge candidate, and an inter-intra merge candidate, according to an embodiment.
- FIG 9 illustrates syntax for signaling intra merge information according to an embodiment.
- FIG. 10 illustrates a process of determining at least one coding unit by dividing a current coding unit according to an embodiment.
- FIG. 11 is a diagram illustrating a process of dividing a coding unit having a non-square shape and determining at least one coding unit according to an embodiment.
- FIG. 12 illustrates a process of splitting a coding unit based on at least one of block shape information and split shape information, according to an embodiment.
- FIG. 13 illustrates a method of determining a predetermined coding unit among odd number of coding units according to an embodiment.
- FIG. 14 illustrates an order in which a plurality of coding units are processed when a current coding unit is divided and a plurality of coding units are determined according to an embodiment.
- FIG. 15 illustrates a process of determining that a current coding unit is divided into odd coding units when the coding units cannot be processed in a predetermined order, according to an embodiment.
- 16 is a diagram illustrating a process of determining at least one coding unit by dividing a first coding unit according to an embodiment.
- FIG. 17 illustrates that a form in which a second coding unit may be split is limited when the second coding unit having a non-square shape determined by splitting the first coding unit satisfies a predetermined condition according to an embodiment. .
- FIG. 18 illustrates a process of splitting a coding unit having a square shape when split information cannot be divided into four square coding units according to an embodiment.
- FIG. 19 illustrates that a processing order between a plurality of coding units may vary according to a splitting process of coding units, according to an embodiment.
- 20 is a diagram illustrating a process of determining a depth of a coding unit as a shape and a size of a coding unit change when a coding unit is recursively divided and a plurality of coding units are determined according to an embodiment.
- FIG. 21 illustrates a depth index and a part index (PID) for classifying coding units, which may be determined according to shapes and sizes of coding units, according to an embodiment.
- PID part index
- FIG. 22 illustrates that a plurality of coding units are determined according to a plurality of predetermined data units included in a picture according to an embodiment.
- FIG. 23 illustrates a processing block serving as a reference for determining a determination order of reference coding units included in a picture, according to an embodiment.
- a video encoding method includes determining whether an intra merge candidate may be included in a merge candidate list; If the intra merge candidate can be included in a merge candidate list, determining a merge candidate list including at least one of an inter merge candidate of the current block and the intra merge candidate; Generating prediction samples of the current block by using the prediction candidate selected from the generated merge candidate list; And reconstructing the current block by using prediction samples of the current block and residual samples of the current block.
- the intermerge candidate may include at least one of a neighboring block spatially adjacent to the current block and a collocated block positioned corresponding to the position of the current block within a temporally adjacent picture of the current block.
- the prediction block is determined by the motion information of the block, and the intra merge candidate may be a prediction block determined by using neighboring samples spatially adjacent to the current block.
- the video decoding apparatus determines whether an intra merge candidate may be included in a merge candidate list, and when the intra merge candidate may be included in a merge candidate list,
- a merge candidate list determiner configured to determine a merge candidate list including at least one of an inter merge candidate and the intra merge candidate;
- a decoder configured to generate prediction samples of the current block by using the prediction candidate selected from the generated merge candidate list, and reconstruct the current block by using the prediction samples of the current block and the residual samples of the current block. It may include.
- a video candidate list including at least one of an inter merge candidate and an intra merge candidate of the current block is determined. step; Generating a merge candidate index indicating the prediction candidate selected to generate prediction samples of the current block among the generated merge candidate lists; And encoding the residual samples and the merge candidate index between the prediction samples of the current block and the current block, and generating a bitstream including the encoded information.
- part refers to a hardware component, such as software, FPGA or ASIC, and “part” plays certain roles. However, “part” is not meant to be limited to software or hardware.
- the “unit” may be configured to be in an addressable storage medium and may be configured to play one or more processors.
- a “part” refers to components such as software components, object-oriented software components, class components, and task components, processes, functions, properties, procedures, Subroutines, segments of program code, drivers, firmware, microcode, circuits, data, databases, data structures, tables, arrays and variables.
- the functionality provided within the components and “parts” may be combined into a smaller number of components and “parts” or further separated into additional components and “parts”.
- the "image” may be a static image such as a still image of a video or may represent a dynamic image such as a video, that is, the video itself.
- sample means data to be processed as data allocated to a sampling position of an image.
- pixel values and transform coefficients on a transform region may be samples in an image of a spatial domain.
- a unit including the at least one sample may be defined as a block.
- FIGS. 1 to 23 a video encoding apparatus, a video decoding apparatus, a video encoding method, and a video decoding method according to an embodiment will be described with reference to FIGS. 1 to 23.
- a method and apparatus for performing inter prediction using a merge candidate list determined according to an embodiment with reference to FIGS. 1 to 9 will be described below, and a data unit of an image according to an embodiment will be described with reference to FIGS. 10 to 23. The method of determination is described below.
- FIG. 1A is a block diagram of a video decoding apparatus 100 according to an embodiment.
- the video decoding apparatus 100 may include a merge candidate list determiner 110 and a decoder 120.
- the merge candidate list determiner 110 and the decoder 120 may operate as separate processors or may be operated under the control of a central processor.
- the video decoding apparatus 100 may include a memory or storage for storing data received from the outside and data generated by the merge candidate list determiner 110 and the decoder 120. It may further include.
- the video decoding apparatus 100 may perform inter prediction according to a skip mode or a merge mode.
- the merge candidate list determiner 110 may determine a merge candidate list including at least one merge candidate in order to perform inter prediction according to a skip mode or a merge mode.
- the merge candidate included in the merge candidate list may be a collocated block positioned corresponding to the position of the current block in the neighboring block spatially adjacent to the current block and the temporally adjacent picture of the current block.
- a block may be a prediction block determined based on motion information of at least one block.
- a prediction block determined by motion information of at least one of a neighbor block and a collocated block is referred to as an "inter merge candidate".
- an "intra merge candidate” is proposed as a concept as opposed to an “inter merge candidate”.
- a prediction block determined using neighboring samples spatially adjacent to the current block may be used as a merge candidate.
- this merge candidate is referred to herein as an "intra merge candidate”.
- An inter merge candidate is exemplified below with reference to FIG. 3A, and an intra merge candidate is illustrated with reference to FIGS. 3B and 3C.
- the merge candidate list determiner 110 may determine whether the intra merge candidate may be included in the merge candidate list.
- the merge candidate list determiner 110 may include at least one of an inter merge candidate and an intra merge candidate of the current block when the intra merge candidate may be included in the merge candidate list.
- the decoder 12 may generate prediction samples of the current block by using the prediction candidate selected from the merge candidate list generated by the merge candidate list determiner 110.
- the decoder 12 may reconstruct the current block by using the prediction samples of the current block and the residual samples of the current block.
- 1B is a flowchart of a video decoding method according to an embodiment.
- the video decoding apparatus 100 may determine whether the intra merge candidate may be included in the merge candidate list.
- the video decoding apparatus 100 may obtain intra merge information indicating whether an intra merge candidate may be included in a merge candidate list when performing inter prediction in a skip mode or a merge mode, from a bitstream. Can be.
- the video decoding apparatus 100 may perform entropy decoding on the bitstream to obtain a prediction mode flag for the current block.
- the prediction mode flag indicates a prediction mode other than intra prediction
- the video decoding apparatus 100 may parse a skip flag for the current block from the bitstream.
- the video decoding apparatus 100 when the skip flag indicates inter prediction according to the skip mode, the video decoding apparatus 100 no longer parses the merge flag from the bitstream. However, when the skip flag does not indicate inter prediction according to the skip mode, the video decoding apparatus 100 may further parse the merge flag from the bitstream. When the merge flag indicates inter prediction according to the merge mode, the video decoding apparatus 100 may further parse intra merge information from the bitstream.
- the video decoding apparatus 100 may further parse intra merge information from the bitstream.
- the video decoding apparatus 100 may include a merge candidate including at least one of an inter merge candidate and an intra merge candidate of the current block. The list can be determined.
- the video decoding apparatus 100 may select the intra merge candidate of the current block.
- the merge candidate list not including may be determined. That is, a merge candidate list including only inter merge candidates may be determined.
- the video decoding apparatus 100 may determine a merge candidate list including at least one of an inter merge candidate and an intra merge candidate of the current block. You can decide.
- the video decoding apparatus 100 may generate prediction samples of the current block by using the prediction candidate selected from the merge candidate list generated in operation S140.
- the intermerge candidate may be a prediction block determined by motion information of at least one of a neighboring block and a collocated block spatially adjacent to the current block.
- the collocated block may be a block located in a temporally adjacent picture of the current block, corresponding to the position of the current block in the current image. Accordingly, the motion information of the current block is predicted using the motion information of at least one block of the neighboring block and the collocated block of the current block, and the sample values of the reference block indicated by the predicted motion information are used to predict the motion information of the current block. Prediction samples can be determined.
- the prediction block according to the inter merge candidate may be a block including prediction sample values determined using the sample value of the reference block.
- An intra merge candidate may be a prediction block determined using neighboring samples spatially adjacent to the current block.
- a block including sample values located outside the current block and determined using the sample values of the samples adjacent to the outermost samples in the current block is determined as a prediction block, and the prediction block is included in the merge candidate list as an intra merge candidate. May be included.
- an intra merge candidate may be determined using neighboring samples spatially adjacent to a current block in a predetermined number of directions.
- an intra merge candidate may be determined by using a predetermined number of neighboring neighboring samples determined from a direction indicated by a most probable mode (MPM) index obtained from a bitstream.
- the MPM index may indicate one intra prediction mode among a predetermined number of intra prediction modes that may be used for intra prediction of the current block.
- the predetermined number of intra prediction modes may include an intra prediction mode of a neighboring block and a specific intra prediction mode.
- inter-intra merge includes samples determined as a weighted average value of an intra merge candidate determined by using neighboring samples spatially adjacent to a current block and a predicted sample value according to at least one inter merge candidate. Determine as a candidate and include the inter-intra merge candidate in the merge candidate list.
- the video decoding apparatus 100 may obtain a merge candidate index indicating one candidate from the merge candidate list from the bitstream.
- the video decoding apparatus 100 may generate prediction samples of the current block by using the prediction candidate indicated by the merge candidate index in the merge candidate list.
- the video decoding apparatus 100 may determine an inter merge candidate list including at least one inter merge candidate, and determine an intra merge candidate list including at least one intra merge candidate.
- the intra merge candidate list may further include an inter-intra merge candidate.
- the video decoding apparatus 100 may generate prediction samples of the current block by using the prediction candidate selected from the inter merge candidate list and the intra merge candidate list.
- prediction samples may be determined using a merge candidate index indicating one of the candidates of the inter merge candidate list and the candidates of the intra merge candidate list.
- the video decoding apparatus 100 may determine one merge candidate list including at least one of an inter merge candidate, an intra merge candidate, and an inter-intra merge candidate.
- One merge candidate list may further include an inter-intra merge candidate. Accordingly, the video decoding apparatus 100 may generate prediction samples of the current block by using the prediction candidate selected from one merge candidate list. In this case, prediction samples may be determined using a merge candidate index indicating one of merge candidates included in one merge candidate list.
- a merge candidate list including at least one of an inter merge candidate, an intra merge candidate, and an inter-intra merge candidate is illustrated.
- the video decoding apparatus 100 may generate prediction samples of the current block by using the prediction candidate indicated by the merge candidate index in the merge candidate list.
- the video decoding apparatus 100 may obtain motion vector differential (mvd) information from a bitstream when inter prediction is performed according to an inter merge candidate.
- the video decoding apparatus 100 may determine one candidate from the merge candidate list based on the obtained merge candidate index. If the determined candidate is an inter-merge candidate, the prediction direction (L0 or L1), reference index, motion vector predictor (motion) of the current block using the prediction direction (L0 or L1), reference index, and motion vector of the candidate block. vector predictor; mvp).
- the motion vector of the current block may be determined by adding the motion vector predictor mvp and the motion vector difference value. Sample values of the reference block indicated by the motion vector of the current block may be determined as prediction sample values according to the inter merge candidates of the current block.
- the video decoding apparatus 100 may obtain intra prediction mode information indicating an intra prediction direction from a bitstream when inter prediction is performed according to an intra merge candidate.
- the video decoding apparatus 100 may determine prediction sample values according to intra merge candidates of the current block by using neighboring sample values indicated by the intra prediction mode.
- the neighboring samples according to the intra merge candidates will be described later with reference to FIG. 3B, and the intra prediction direction and the intra prediction mode will be described later with reference to FIG. 3C.
- the video decoding apparatus 100 may reconstruct the current block by using the prediction samples of the current block and the residual samples of the current block.
- the video decoding apparatus 100 may perform entropy decoding on the bitstream to parse the residual signal of the blocks according to the block scan order and the scan order of the samples in the block to obtain the residual signal of the current block.
- the video decoding apparatus 100 may reconstruct residual samples of the spatial region of the current block by performing inverse quantization and inverse transformation on the residual signals of the current block.
- the video decoding apparatus 100 may reconstruct the samples of the current block by adding the residual samples of the reconstructed current block to the prediction samples of the current block determined by performing inter prediction.
- the video decoding apparatus 100 may reconstruct the current image by reconstructing samples for each block.
- FIG. 2A is a block diagram of a video encoding apparatus 200 according to an embodiment.
- the video encoding apparatus 200 includes an inter predictor 210 and an encoder 220.
- the inter predictor 210 and the encoder 220 may operate as separate processors or may be operated by the control of a central processor.
- the video encoding apparatus 200 may include a memory or storage for storing data generated during the encoding process and data generated by the inter predictor 210 and the encoder 220. It may further include.
- the video encoding apparatus 200 may perform inter prediction according to a skip mode or a merge mode.
- the inter prediction unit 210 may determine a merge candidate list including at least one merge candidate to perform inter prediction according to a skip mode or a merge mode.
- the inter prediction unit 210 may determine a merge candidate list including at least one of the inter merge candidate and the intra merge candidate of the current block.
- the merge candidate list used to perform inter prediction in the skip mode or the merge mode may include at least one of an inter merge candidate, an intra merge candidate, and an inter-intra merge candidate as a merge candidate.
- the inter-merge code according to an embodiment may include a prediction block determined by motion information of at least one of a neighboring block and a collocated block of the current block.
- the intra merge candidate according to an embodiment may include a prediction block determined using neighboring samples spatially adjacent to the current block.
- the inter-intra merge candidate according to an embodiment may include a prediction block that takes a weighted average value of the prediction sample value according to the inter merge candidate and the prediction sample value according to the intra merge candidate as a prediction sample value.
- the inter prediction unit 210 may generate a merge candidate index indicating a prediction candidate selected to generate prediction samples of the current block from the merge candidate list.
- the encoder 220 may encode the residual samples and the merge candidate index between the prediction samples of the current block, the current block, and generate a bitstream including the encoded information.
- 2B is a flowchart of a video encoding method, according to an embodiment.
- the video encoding apparatus 200 may include at least one of the inter merge candidate and the intra merge candidate of the current block.
- the merge candidate list including one may be determined.
- the video encoding apparatus 200 may determine a merge candidate index indicating a prediction candidate selected to generate prediction samples of the current block among the merge candidate lists generated in operation s230, and encode a value representing the merge candidate index. Can be.
- the inter merge candidate, the intra merge candidate, and the inter-intra merge candidate used in the video encoding apparatus 200 may be the inter merge candidate or intra merge candidate described in the video decoding apparatus 100 according to various embodiments. Since they correspond to the inter-intra merge candidates, duplicate descriptions are omitted.
- the video encoding apparatus 200 may determine an inter merge candidate list including at least one inter merge candidate, and determine an intra merge candidate list including at least one intra merge candidate.
- the intra merge candidate list may further include an inter-intra merge candidate.
- the video encoding apparatus 200 may generate prediction samples of the current block by using the prediction candidate selected from the inter merge candidate list and the intra merge candidate list.
- the video encoding apparatus 200 may encode a merge candidate index indicating one of the candidates of the inter merge candidate list and the candidates of the intra merge candidate list.
- the video encoding apparatus 200 may determine one merge candidate list including at least one inter merge candidate and at least one intra merge candidate.
- One merge candidate list may further include an inter-intra merge candidate. Accordingly, the video encoding apparatus 200 may generate prediction samples of the current block by using the prediction candidate selected from one merge candidate list. In this case, the video encoding apparatus 200 may encode a merge candidate index indicating one of merge candidates included in one merge candidate list.
- the video encoding apparatus 200 may perform inter prediction based on candidates included in a merge candidate list, and compare rate-distortion (RD) costs generated by inter prediction for each candidate.
- the video encoding apparatus 200 may select a merge candidate generating a minimum RD cost among candidates, and determine a merge candidate index indicating the selected merge candidate among merge candidates included in the merge candidate list. .
- the video encoding apparatus 200 may encode residual samples and a merge candidate index between the prediction samples of the current block and the current block. For example, entropy encoding may be performed on residual samples and a merge candidate index of the current block, and a bitstream including bits generated by encoding may be generated.
- the video encoding apparatus 200 may perform transform and quantization on samples of the current block to generate quantized transform coefficients of the samples, and inverse quantization and inverse transform on the quantized transform coefficients, thereby performing a spatial domain. It is possible to restore samples of.
- the video encoding apparatus 200 may determine residual samples that are a difference value between the predicted samples of the current block and the reconstructed samples of the current block determined according to the prediction mode.
- the video encoding apparatus 200 may selectively determine whether an intra merge candidate is included in the merge candidate list. Accordingly, the video encoding apparatus 200 may generate intra merge information indicating whether an intra merge candidate is included in the merge candidate list. The video encoding apparatus 200 may encode intra merge information, and may encode the merge candidate index when the intra merge candidate is included in the merge candidate list.
- the video encoding apparatus 200 may further encode a prediction mode flag for the current block.
- a prediction mode flag indicating whether or not the prediction mode of the current block is an intra prediction mode may be further encoded.
- the video encoding apparatus 200 further encodes a merge flag indicating whether the current block is predicted to the skip mode or the merge flag indicating whether the current block is predicted to the skip mode. can do.
- the video encoding apparatus 200 when the current block is predicted according to the skip mode, the video encoding apparatus 200 encodes a skip mode flag indicating that the skip mode is predicted, and further encodes only an index indicating a neighboring block to refer to the motion information. In addition, the information on the merge mode may not be encoded any more. However, when the current block is predicted according to the skip mode, the video encoding apparatus 200 may encode a skip mode flag indicating that the skip mode is not, and further encode a merge flag indicating whether the merge mode is predicted as the merge mode. . When inter prediction according to a merge mode is performed for the current block, the video encoding apparatus 200 may further encode a merge mode flag indicating that the merge mode is predicted, and additionally intra merge information and merge candidate index information.
- the video encoding apparatus 200 may further encode motion vector differential (mvd) information when inter prediction is performed according to an inter merge candidate.
- the video encoding apparatus 200 may determine the motion vector predictor of the current block by using the motion vector of the candidate block. Accordingly, motion vector difference information, which is a difference value between the motion vector and the motion vector predictor of the current block, may be determined.
- the sample values of the reference block indicated by the motion vector of the current block may be determined as prediction sample values according to the inter merge candidates of the current block, and difference values between the prediction samples and the reconstructed samples of the current block may be encoded as residual information. .
- the video encoding apparatus 200 may further encode intra prediction mode information indicating an intra prediction direction when inter prediction is performed according to an intra merge candidate.
- the video encoding apparatus 200 may determine prediction sample values according to intra merge candidates of the current block by using neighboring sample values indicated by the intra prediction mode.
- the neighboring samples according to the intra merge candidates will be described later with reference to FIG. 3B, and the intra prediction direction and the intra prediction mode will be described later with reference to FIG. 3C.
- a merge candidate to be referred to in inter prediction of a current block not only the motion information of the neighboring block or the collocated block of the current block, but also the current block
- neighboring sample values spatially adjacent to the merge candidate list it is possible to accurately and effectively predict the current block.
- 3A illustrates inter merge candidates that may be included in a merge candidate list.
- the video decoding apparatus 100 may determine a merge mode list to perform inter prediction according to a skip mode or a merge mode with respect to the current block 300.
- Sample values of the block may be determined as sample values of the current block 300.
- the prediction direction (L0 or L1), the reference index, and the motion vector predictor of the current block are determined using the prediction direction (L0 or L1), the reference index, and the motion vector of the candidate block determined from the merge mode list.
- the motion vector of the current block 300 may be determined by summing the motion vector predictor and the motion vector difference information. Accordingly, the sample values of the reference block indicated by the prediction direction (L0 or L1), the reference index, and the motion vector of the current block are determined as the prediction sample values of the current block, and the prediction block values and the residual sample values are added to the current block. Sample values of 300 may be determined.
- a process of determining another block used to encode the current block is preceded.
- a temporally different image located at a position similar to a neighboring block spatially adjacent to the current block within the current image or a point where the current block is located within the current image. Blocks within may be used.
- the merge candidate list may include at least one inter merge candidate.
- the inter merge candidates are adjacent to the neighboring blocks A0 310, A1 312, B0 314, B1 316, and B2 318 that are spatially adjacent to the current block, and within the temporally adjacent picture of the current block. It may include at least one block of the collocated block Col 320 positioned corresponding to the position of the current block.
- the neighboring block A0 310 is a sample adjacent to the outside in the lower left diagonal direction of the sample located at the lower left corner among the samples of the current block 300 among the blocks adjacent to the outside of the current block 300. It may be a block including a.
- the neighboring block A1 312 may be a block including a sample adjacent to the left outer side of the sample located at the lower left corner among the samples of the current block 300 among the blocks adjacent to the outside of the current block 300. .
- the neighboring block B0 314 includes a sample adjacent to the outside in the upper right diagonal direction of the sample located at the top right corner among the samples of the current block 300 among the blocks adjacent to the outside of the current block 300. It may be a block.
- the neighboring block B1 316 may be a block including a sample adjacent to the upper outer side of the sample located at the upper right corner among the samples of the current block 300 among the blocks adjacent to the outside of the current block 300. .
- the neighboring block B2 318 includes a sample adjacent to the outside in the upper left diagonal direction of the sample located at the upper left corner among the samples of the current block 300 among the blocks adjacent to the outside of the current block 300. It may be a block.
- the collocated block Col 320 is a block existing in a position corresponding to the current block 300 in the current image among blocks in an image (collected image) temporally different from the current image including the current block. Can be. For example, among the blocks of the collocated image, the same position block including a point corresponding to the coordinate of the current block 300 within the current image is selected, and is externally disposed in a diagonal direction to the lower right corner of the selected block. Adjacent block H may be determined as collocated block 320. However, when valid motion information is not defined for the block H, a block including a point located at the center of the same position block may be determined as the collocated block 320.
- the current block 300 may be a coding unit (CU) or may be a sub-block determined in the coding unit for prediction of the coding unit.
- CU coding unit
- 3B and 3C illustrate intra merge candidates that may be included in a merge candidate list according to one embodiment.
- the intra merge candidate may include a prediction block including a prediction sample determined using neighboring samples spatially adjacent to the current block 350.
- Peripheral samples may be selected from among the already reconstructed samples adjacent to the outside of the current block 300.
- the surrounding samples are P (-1, -1) and P (2N And -1, -1), and may include samples positioned horizontally between P (-1, -1) and P (2N-1, -1).
- the surrounding samples include P (-1, -1) and P (-1, 2N-1), and are vertically aligned between P (-1, -1) and P (-1, 2N-1). It may include samples located to.
- the current block 350 may be a coding unit (CU) or may be a sub block determined in a coding unit for transformation of a coding unit (CU).
- CU coding unit
- CU sub block determined in a coding unit for transformation of a coding unit
- neighboring samples that may be referred to for intra prediction of the current block may vary. That is, depending on the prediction direction, the referenced samples among the peripheral samples listed horizontally from P (-1, -1) to P (2N-1, -1) are different, and P (-1, -1) to P The samples referenced among the peripheral samples listed vertically up to (-1, 2N-1) may vary.
- intra prediction modes that can be adopted in the intra prediction direction are shown in FIG. 3C.
- Each arrow indicates a prediction direction pointing to a neighboring sample for reference from the current block, and each number represents an index corresponding to the intra prediction mode.
- non-directional modes examples include planner mode and DC mode.
- the intra prediction mode index 0 indicates a planner mode
- the intra prediction mode index 1 indicates a DC mode.
- the prediction value is determined so that the gradation according to the change of the surrounding sample values is reflected in the prediction sample.
- the prediction sample values may gradually increase or decrease as the coordinates of the prediction samples increase.
- current prediction sample values may be uniformly determined as an average value of the surrounding samples surrounding the current block 350.
- the directional mode is a prediction mode according to the prediction direction that matches the intra prediction mode indexes 2 to 34 illustrated in FIG. 3C. That is, the prediction sample values of the current block 35 may also be determined according to the tendency of the sample values located in a specific arrow direction among the surrounding samples of the current block 350. To this end, by taking a sample value located in the prediction direction among the neighboring samples of the current block 35, the prediction sample value for the samples located in the direction within the current block 35 may be determined. A prediction block including these prediction sample values may also be determined.
- the video decoding apparatus 100 may use a predetermined number of predetermined intra prediction modes to determine an intra merge candidate.
- the planar mode (intra prediction mode index 0), DC mode (intra prediction mode index 1), vertical mode (intra prediction mode index 26), and horizontal mode (intra prediction mode index) among the intra prediction modes illustrated in FIG. 3C.
- a prediction block according to one intra mode among four intra modes including 10) may be used as an intra merge candidate.
- the video decoding apparatus 100 may use a prediction block according to an intra prediction mode determined based on an intra mode of a neighboring block or a previous picture as an intra merge candidate.
- a prediction block according to an MPM index indicating one of intra prediction modes of neighboring blocks may be used as an intra merge candidate.
- the video decoding apparatus 100 may determine a merge candidate list including at least one intra merge candidate when inter prediction is possible using a merge candidate list including an intra merge candidate. 4, 5, 6a, 6b, 6c, 7, and 8, a merge candidate list according to various embodiments is described in detail.
- 'MVm' (m is an integer) represents inter merge candidates
- 'IPMn' (n is an integer) represents intra merge candidates
- 'IPMn & MVm' represents an inter-intra merge candidate in which an intra merge candidate 'IPMn' and an inter merge candidate 'MVm' are synthesized.
- the inter-intra merge candidate 'IPMn & MVm' may be determined as a weighted average value of the prediction value according to the intra merge candidate 'IPMn' and the prediction value according to the inter merge candidate 'MVm'.
- FIG. 4 illustrates a merge candidate list including an inter merge candidate and an intra merge candidate according to an embodiment.
- the video decoding apparatus 100 when the video decoding apparatus 100 performs inter prediction in a skip mode or a merge mode, the video decoding apparatus 100 may include merge candidate lists 400 and 450 including at least one inter merge candidate and at least one intra merge candidate. You can decide.
- the video decoding apparatus 100 generates a merge candidate list 400 including inter merge candidates MV1, MV2, MV3, ... MVm, and intra merge candidate IPM1, IPM2 in the merge candidate list 400. , ..., IPMn can be added.
- the video decoding apparatus 100 determines a merge candidate list 400 including inter merge candidates MV1, MV2, MV3, ... MVm, and intra merge candidates between inter merge candidates of the merge candidate list 400.
- the merge candidate list 400 may be determined by adding IPM1, IPM2, ..., IPMn one by one.
- the video decoding apparatus 100 may perform inter prediction using one candidate indicated by the merge candidate index among the inter merge candidates and the intra merge candidates included in the merge candidate list 400 or 450.
- the video encoding apparatus 200 also generates a merge candidate list 400 or 450 including inter-merge candidates MV1, MV2, MV3, ... MVm in order to perform inter prediction in a skip mode or a merge mode.
- Intra-merge candidates IPM1, IPM2, ..., IPMn may be added to the merge candidate list 400 or 450.
- the video encoding apparatus 200 may encode a merge candidate index indicating one candidate used for inter prediction among inter merge candidates and intra merge candidates included in the merge candidate list 400 or 450.
- FIG 5 illustrates an inter merge candidate list including an inter merge candidate and an intra merge candidate list including an intra merge candidate according to an embodiment.
- the video decoding apparatus 100 when the video decoding apparatus 100 performs inter prediction in a skip mode or a merge mode, the video decoding apparatus 100 may include an inter merge candidate list 500 including at least one inter merge candidate and at least one intra merge candidate.
- the intra merge candidate list 550 may be determined.
- the video decoding apparatus 100 may determine the inter merge candidate list 500 including the inter merge candidates MV1, MV2, MV3, MV4. In addition, when inter prediction using an intra merge candidate is possible, the video decoding apparatus 100 may determine an intra merge candidate list 550 including intra merge candidates IPM1, IPM2, IPM3, IPM4, ..., IPMn. have.
- the video decoding apparatus 100 performs inter prediction by using one candidate indicated by the merge candidate index among the inter merge candidates included in the inter merge candidate list 500 and the intra merge candidates included in the intra merge candidate list 550. Can be done.
- the video encoding apparatus 200 determines an inter merge candidate list 500 including inter merge candidates MV1, MV2, MV3, MV4, ... MVm, and intra
- the intra merge candidate list 550 including the merge candidates IPM1, IPM2, IPM3, IPM4,..., And IPMn may be determined.
- the video encoding apparatus 200 may select a merge candidate index indicating one candidate used for inter prediction among the inter merge candidates included in the inter merge candidate list 500 and the intra merge candidates included in the intra merge candidate list 550. Can be encoded.
- 6A, 6B and 6C illustrate intra merge candidate lists in which weighted averaged prediction sample values of an inter merge candidate and an intra merge candidate are included as inter-intra merge candidates, according to an embodiment.
- a merge candidate list 610 including at least one inter-intra merge candidate obtained by combining an inter merge candidate and an intra merge candidate. , 630 or 650).
- Combinations of inter merge candidates and intra merge candidates for generating inter-intra merge candidates may vary.
- one of the at least one intra merge candidate and one inter merge candidate may be synthesized to determine at least one inter-intra merge candidate.
- one candidate of at least one inter merge candidate and one intra merge candidate may be synthesized to determine at least one inter-intra merge candidate.
- at least one inter-merge candidate may be determined by combining one of the at least one inter merge candidate and one of the at least one intra merge candidate.
- the video decoding apparatus 100 may determine the intermerge candidate list 600 including the intermerge candidates MV1, MV2, MV3, MV4.
- an intra merge candidate of one of intra merge candidates IPM1, IPM2, IPM3, IPM4, ..., IPMn and one inter merge candidate MV1 are synthesized to inter-intra merge Candidates IPM1 & MV1, IPM2 & MV1, IPM3 & MV1, IPM4 & MV1, ..., IPMn & MV1 can be determined.
- the video decoding apparatus 100 may determine an intra merge candidate list 610 including at least one of inter-intra merge candidates IPM1 & MV1, IPM2 & MV1, IPM3 & MV1, IPM4 & MV1, ..., IPMn & MV1.
- the video decoding apparatus 100 may determine the inter merge candidate list 620 including the inter merge candidates MV1, MV2, MV3, MV4.
- the video decoding apparatus 100 may determine one inter merge candidate among one of the inter merge candidates MV1, MV2, MV3, MV4, ..., MVm and one intra merge candidate IPM1.
- the video decoding apparatus 100 may determine an intra merge candidate list 630 including at least one of inter-intra merge candidates IPM1 & MV1, IPM2 & MV2, IPM3 & MV3, IPM4 & MV4, ..., IPMn & MVn.
- the video decoding apparatus 100 may determine the inter merge candidate list 640 including the inter merge candidates MV1, MV2, MV3, MV4. In addition, when inter prediction using an intra merge candidate is possible, the video decoding apparatus 100 may select one of the inter merge candidates MV1, MV2, MV3, MV4,. Intra-merge candidates IPM1 & MV1, IPM2 & MV1, IPM1 & MV2, IPM2 & MV2, ..., IPMn & MVm can be determined by synthesizing intra merge candidates of one of IPM3, IPM4, ..., IPMn.
- the video decoding apparatus 100 may determine an intra merge candidate list 650 including at least one of inter-intra merge candidates IPM1 & MV1, IPM2 & MV1, IPM1 & MV2, IPM2 & MV2, ..., IPMn & MVm.
- the prediction value according to one inter-intra merge candidate may be determined as a weighted average value of the prediction value according to the inter merge candidate and the prediction value according to the intra merge candidate.
- the weight for the weighted average may be equally set or different from the weight of the prediction value according to the intermerging candidate and the weight of the prediction value according to the intra merge candidate.
- a weight for an inter merge candidate and a weight for an intra merge candidate for determining an inter-intra merge candidate may be determined using encoding modes of neighboring blocks.
- the weight value of the intra merge candidate may be determined according to the intra prediction mode of the neighboring block used when determining the intra merge candidate.
- the weight value of the intra merge candidate may be determined according to the inter partition mode of the neighboring block.
- the weight value of the intra merge candidate may be determined according to the quantization parameter of the neighboring block used when determining the intra merge candidate.
- the intra merge candidate is determined according to the depth (division level, number of divisions) or the size of the coding unit, the size of the prediction unit if the neighboring block is a prediction unit, or the size of the transformation unit if the neighboring block is a transformation unit.
- the weight value of may be determined.
- the weight of the inter merge candidate may be determined as a value for normalization of the weighted sum.
- a method of combining an inter merge candidate and an intra merge candidate that is possible to determine a prediction value according to an inter-intra merge candidate is not limited to the above-described method.
- the video decoding apparatus 100 may include a merge candidate index among inter-merge candidates included in the inter merge candidate list 600, 620, or 640 and inter-intra merge candidates included in the intra merge candidate list 610, 630, or 650. Inter prediction may be performed using one candidate indicated.
- the video encoding apparatus 200 may generate an inter merge candidate list 600, 620, or 640 including inter merge candidates MV1, MV2, MV3, MV4. And an intra merge candidate list 610, 630, or 650 that includes an inter-intra merge candidate.
- the video encoding apparatus 200 is used for inter prediction among inter-merge candidates included in the intermerge candidate list 600, 620, or 640 and inter-intra merge candidates included in the intra-merge candidate list 610, 630, or 650.
- the merge candidate index indicating one candidate can be encoded.
- FIG. 7 illustrates a merge candidate list including an inter merge candidate and an inter-intra merge candidate according to an embodiment.
- the video decoding apparatus 100 when the video decoding apparatus 100 performs inter prediction in a skip mode or a merge mode, the video decoding apparatus 100 may include a merge candidate list 700 including at least one inter merge candidate and at least one inter-intra merge candidate. You can decide.
- the video decoding apparatus 100 when the inter prediction using the intra merge candidate is possible, includes the inter merge candidates MV1, MV2, MV3, MV4 ... MVm, inter-intra merge candidates IPM1 & MV1, IPM2 & MV1, IPM1 & MV2, and IPM2 & MV2.
- the merge candidate list 700 including IPMn & MVm may be determined.
- the video decoding apparatus 100 may perform inter prediction using one candidate indicated by the merge candidate index among the inter merge candidates and the inter-intra merge candidates included in the merge candidate list 700.
- the video encoding apparatus 200 when the inter prediction using the intra merge candidate is possible, includes the inter merge candidates MV1, MV2, MV3, MV4 ... MVm, inter-intra merge candidates IPM1 & MV1, IPM2 & MV1, IPM1 & MV2, IPM2 & MV2,
- the merge candidate list 700 including the IPMn & MVm can be determined.
- the video encoding apparatus 200 may encode a merge candidate index indicating one candidate used for inter prediction among inter merge candidates and inter-intra merge candidates included in the merge candidate list 700.
- FIG 8 illustrates an intra merge candidate list including an inter merge candidate, an intra merge candidate, and an inter-intra merge candidate, according to an embodiment.
- the video decoding apparatus 100 may use a merge candidate list including an inter merge candidate, an intra merge candidate, and an intra-intra merge candidate when inter prediction using an intra merge candidate is possible.
- the video decoding apparatus 100 when the video decoding apparatus 100 may perform inter prediction using an intra merge candidate in a skip mode or a merge mode, the video decoding apparatus 100 includes inter merge candidates MV1, MV2, MV3, ..., MVm.
- the intra merge candidate list 810 and the intra merge candidate list 810 including at least one intra merge candidate IPM1 and IPM2 and at least one inter-intra merge candidate IPM1 & MV1 and IPM2 & MV2 may be determined.
- the video decoding apparatus 100 may include one candidate indicated by the merge candidate index among the inter merge candidates included in the inter merge candidate list 810 and the intra merge candidates included in the intra merge candidate list 800 and the intra-intra merge candidates. Inter prediction may be performed using.
- the video encoding apparatus 200 may include an inter merge candidate list 810 including inter merge candidates MV1, MV2, MV3, ..., MVm when inter prediction using an intra merge candidate is possible in a skip mode or a merge mode.
- intra merge candidate list 800 including intra merge candidates IPM1, IPM2 and inter-intra merge candidates IPM1 & MV1, IPM2 & MV2.
- the video encoding apparatus 200 may select one candidate used for inter prediction from the inter merge candidate included in the inter merge candidate list 810 and the intra merge candidate included in the merge candidate list 800 and the inter-intra merge candidate.
- the merge candidate index indicated can be encoded.
- the intra merge candidates IPM1, IPM2, ..., IPMn, inter merge candidate MV1, Merge candidate list 850 including MV2, ..., MVm and inter-intra merge candidates IPM1 & MV1, IPM2 & MV1, ..., IPMn & MVm can be determined.
- the video decoding apparatus 100 may perform inter prediction by using one candidate indicated by the merge candidate index among the inter merge candidate, the intra merge candidate, and the inter-intra merge candidate included in the merge candidate list 850.
- the video encoding apparatus 200 may use intra merge candidates IPM1, IPM2, ..., IPMn, inter merge candidates MV1, MV2, ... when inter prediction using an intra merge candidate is possible in a skip mode or a merge mode.
- Merge candidate list 850 including MVm and inter-intra merge candidates IPM1 & MV1, IPM2 & MV1, ..., IPMn & MVm can be determined.
- the video encoding apparatus 200 may encode a merge candidate index indicating one candidate used for inter prediction among the inter merge candidate, the intra merge candidate, and the inter-intra merge candidate included in the merge candidate list 850.
- the merge candidate index may be defined according to the order of the inter merge candidate, the intra merge candidate, and the inter-intra merge candidate included in the merge candidate lists shown in FIGS. 4, 5, 6a, 6b, 6c, 7, and 8. It is not necessarily limited to the order in which the drawings are drawn.
- the priority between the inter merge candidate, the intra merge candidate, and the inter-intra merge candidate may be predetermined. For example, since it is a merge candidate list for performing inter prediction in a skip mode or a merge mode, an inter merge candidate may be preferentially included in the merge candidate list, and a merge candidate index having a high priority may be assigned to the inter merge candidate. .
- the merge candidate list may be included in the order of at least one inter merge candidate, at least one intra merge candidate, and at least one inter-intra merge candidate, at least one inter merge candidate, and at least one inter-intra merge candidate.
- the merge candidate list may be included in the order of at least one intra merge candidate.
- the video encoding apparatus 200 may set a priority to the inter prediction mode using the intra merge candidate, rather than the intra prediction mode.
- FIG 9 illustrates syntax for signaling intra merge information according to an embodiment.
- the video decoding apparatus 100 may parse the skip flag, the merge flag, and the intra merge information from the bitstream according to the syntax illustrated in FIG. 9.
- the video decoding apparatus 100 may parse the skip flag 'cu_skip_flag [] []' from the coding unit syntax 'coding_unit ()' to determine whether the current coding unit is predicted to the skip mode. have. When the current coding unit is not predicted in the skip mode, the video decoding apparatus 100 parses the intra skip flag 'intra_skip_flag [] []' with the coding unit syntax 'coding_unit ()' to convert the current coding unit into the intra skip mode. It can be determined whether it was predicted.
- the video decoding apparatus 100 calls the prediction unit syntax 'prediction_unit ()', and the prediction unit syntax 'prediction_unit ()' By parsing the merge candidate index 'merge_idx [] []' from the merge candidate list, one candidate indicated by the merge candidate index 'merge_idx [] []' may be selected from the merge candidate list when decoding in the skip mode or the intra skip mode.
- prediction values according to neighboring blocks indicated by the merge candidate index may be reconstructed as sample values of the current coding unit.
- the video decoding apparatus 100 calls the prediction unit syntax 'prediction_unit ()' when it is not in the skip mode or the intra skip mode, and merges from the prediction unit syntax 'prediction_unit ()' when decoding in the inter mode.
- the flag 'merge_flag [] []' may be parsed to determine whether to decode the current prediction unit into an inter merge mode using only an inter merge candidate.
- the intra merge flag 'intra_merge_flag [] []' may be further parsed to determine whether to decode into a merge mode that may use an intra merge candidate for the current prediction unit.
- the video decoding apparatus 100 When the intra merge candidate is available, the video decoding apparatus 100 further parses the merge candidate index 'merge_idx [] []' from the prediction unit syntax 'prediction_unit ()', and then merges the merge candidate index 'in the merge candidate list. One candidate pointed to by merge_idx [] [] 'can be selected.
- the candidate indicated by the merge candidate index may be any one of an inter merge candidate, an intra merge candidate, and an inter-intra merge candidate.
- the motion vector of the current block is not defined as a prediction result for the current block.
- the motion vector of the current block should be referred to, but the motion vector of the current block becomes unavailable. Therefore, the video decoding apparatus 100 according to an embodiment determines a prediction block of a current block by performing prediction on the current block in an inter mode or intra skip mode using an intra merge candidate, and then predicts a motion vector of the next block.
- the motion vector of the current block can be set as a zero vector or a motion vector of a neighboring block.
- the block includes data such as a coding unit, a sub-block of the coding unit, and a maximum coding unit. It may be a unit.
- the sub block may be a prediction unit which is a block determined by dividing a coding unit to perform prediction on a coding unit, or a transformation unit determined by dividing a coding unit to perform transformation and quantization on the coding unit. .
- FIG. 10 illustrates a process of determining, by the video decoding apparatus 100, at least one coding unit by dividing a current coding unit according to an embodiment.
- the video decoding apparatus 100 may determine a shape of a coding unit by using block shape information, and may determine in which form the coding unit is divided by using split shape information. That is, the method of dividing the coding unit indicated by the segmentation form information may be determined according to which block form the block form information used by the video decoding apparatus 100 indicates.
- the video decoding apparatus 100 may use block shape information indicating that a current coding unit is square. For example, the video decoding apparatus 100 may determine whether to split a square coding unit, to split vertically, to split horizontally, or to split into four coding units according to the split type information.
- the decoder 1030 may have the same size as the current coding unit 1000 according to the split shape information indicating that the block shape information is not divided.
- the split coding units 1010a may not be divided, or the split coding units 1010b, 1010c, 1010d, and the like may be determined based on split type information indicating a predetermined division method.
- the video decoding apparatus 100 determines two coding units 1010b that split the current coding unit 1000 in the vertical direction based on split shape information indicating that the video decoding apparatus 100 is split in the vertical direction. Can be.
- the video decoding apparatus 100 may determine two coding units 1010c obtained by dividing the current coding unit 1000 in the horizontal direction, based on the split type information indicating the split in the horizontal direction.
- the video decoding apparatus 100 may determine four coding units 1010d obtained by dividing the current coding unit 1000 in the vertical direction and the horizontal direction based on the split type information indicating that the video decoding apparatus 100 is split in the vertical direction and the horizontal direction.
- the divided form in which the square coding unit may be divided should not be limited to the above-described form and may include various forms represented by the divided form information. Certain division forms in which a square coding unit is divided will be described in detail with reference to various embodiments below.
- FIG. 11 illustrates a process of determining, by the video decoding apparatus 100, at least one coding unit by dividing a coding unit having a non-square shape by the video decoding apparatus 100.
- the video decoding apparatus 100 may use block shape information indicating that a current coding unit is a non-square shape.
- the video decoding apparatus 100 may determine whether to divide the current coding unit of the non-square according to the segmentation type information or to split it by a predetermined method. Referring to FIG. 11, when the block shape information of the current coding unit 1100 or 1150 indicates a non-square shape, the video decoding apparatus 100 may not split the current coding unit 1100 according to the split shape information.
- coding units 1110a, 1120b, 1130a, 1130b, 1130c, 1170a which do not divide the coding units 1110 or 1160 having the same size as that of 1150, or are divided based on the split type information indicating a predetermined division method.
- 1170b, 1180a, 1180b, and 1180c may be determined.
- a predetermined division method in which a non-square coding unit is divided will be described in detail with reference to various embodiments below.
- the video decoding apparatus 100 may determine a shape in which a coding unit is divided by using split shape information.
- the split shape information may include the number of at least one coding unit generated by splitting the coding unit. Can be represented.
- the video decoding apparatus 100 may determine a current coding unit 1100 or 1150 based on split shape information. By splitting, two coding units 1120a, 11420b, or 1170a and 1170b included in the current coding unit may be determined.
- the video decoding apparatus 100 may determine the current coding unit 1100 or 1150 of the non-square shape.
- the current coding unit may be split in consideration of the position of the long side. For example, the video decoding apparatus 100 splits the current coding unit 1100 or 1150 in a direction of dividing a long side of the current coding unit 1100 or 1150 in consideration of the shape of the current coding unit 1100 or 1150. To determine a plurality of coding units.
- the video decoding apparatus 100 may determine an odd number of coding units included in the current coding unit 1100 or 1150. For example, when the split type information indicates that the current coding unit 1100 or 1150 is divided into three coding units, the video decoding apparatus 100 may divide the current coding unit 1100 or 1150 into three coding units 1130a. , 1130b, 1130c, 1180a, 1180b, and 1180c. According to an embodiment, the video decoding apparatus 100 may determine an odd number of coding units included in the current coding unit 1100 or 1150, and not all sizes of the determined coding units may be the same.
- the size of a predetermined coding unit 1130b or 1180b among the determined odd coding units 1130a, 1130b, 1130c, 1180a, 1180b, and 1180c may be different from other coding units 1130a, 1130c, 1180a, and 1180c. May have That is, a coding unit that may be determined by dividing the current coding unit 1100 or 1150 may have a plurality of types, and in some cases, odd number of coding units 1130a, 1130b, 1130c, 1180a, 1180b, and 1180c. Each may have a different size.
- the video decoding apparatus 100 may determine an odd number of coding units included in the current coding unit 1100 or 1150.
- the video decoding apparatus 100 may set a predetermined limit on at least one coding unit among odd-numbered coding units generated by splitting.
- the video decoding apparatus 100 is a coding unit positioned at the center of three coding units 1130a, 1130b, 1130c, 1180a, 1180b, and 1180c generated by splitting a current coding unit 1100 or 1150.
- the decoding process for (1130b, 1180b) may be different from other coding units 1130a, 1130c, 1180a, and 1180c.
- the video decoding apparatus 100 restricts the coding units 1130b and 1180b from being no longer divided or only a predetermined number of times. You can limit it to split.
- FIG. 12 illustrates a process of splitting a coding unit by the video decoding apparatus 100 based on at least one of block shape information and split shape information, according to an embodiment.
- the video decoding apparatus 100 may determine to split or not split the first coding unit 1200 having a square shape into coding units based on at least one of block shape information and split shape information.
- the video decoding apparatus 100 splits the first coding unit 1200 in the horizontal direction to thereby split the second coding unit. 1210 may be determined.
- the first coding unit, the second coding unit, and the third coding unit used according to an embodiment are terms used to understand a before and after relationship between the coding units.
- the first coding unit is split, the second coding unit may be determined.
- the third coding unit may be determined.
- the relationship between the first coding unit, the second coding unit, and the third coding unit used is based on the above-described feature.
- the video decoding apparatus 100 may determine to divide or not split the determined second coding unit 1210 into coding units based on at least one of block shape information and split shape information. Referring to FIG. 12, the video decoding apparatus 100 may determine a second coding unit 1210 having a non-square shape determined by dividing the first coding unit 1200 based on at least one of block shape information and split shape information. It may be divided into at least one third coding unit 1220a, 1220b, 1220c, 1220d, or the like, or may not split the second coding unit 1210.
- the video decoding apparatus 100 may obtain at least one of block shape information and split shape information, and the video decoding apparatus 100 may determine the first coding unit 1200 based on at least one of the obtained block shape information and split shape information. ) May be divided into a plurality of second coding units (eg, 1210) of various types, and the second coding unit 1210 may be configured to perform first encoding based on at least one of block shape information and split shape information.
- the unit 1200 may be divided according to the divided manner.
- the second The coding unit 1210 may also be divided into third coding units (eg, 1220a, 1220b, 1220c, 1220d, etc.) based on at least one of block shape information and split shape information of the second coding unit 1210. have. That is, the coding unit may be recursively divided based on at least one of the partition shape information and the block shape information associated with each coding unit.
- a square coding unit may be determined in a non-square coding unit, and a coding unit of a square shape may be recursively divided to determine a coding unit of a non-square shape.
- a predetermined coding unit eg, located in the middle of odd-numbered third coding units 1220b, 1220c, and 1220d determined by dividing a second coding unit 1210 having a non-square shape
- Coding units or coding units having a square shape may be recursively divided.
- the third coding unit 1220c having a square shape which is one of odd third coding units 1220b, 1220c, and 1220d, may be divided in a horizontal direction and divided into a plurality of fourth coding units.
- the fourth coding unit 1240 having a non-square shape which is one of the plurality of fourth coding units, may be divided into a plurality of coding units.
- the fourth coding unit 1240 having a non-square shape may be divided into odd coding units 1250a, 1250b, and 1250c.
- the video decoding apparatus 100 splits each of the third coding units 1220a, 1220b, 1220c, 1220d, etc. into coding units based on at least one of block shape information and split shape information, or performs second encoding. It may be determined that the unit 1210 is not divided. According to an embodiment, the video decoding apparatus 100 may divide the second coding unit 1210 having a non-square shape into an odd number of third coding units 1220b, 1220c, and 1220d. The video decoding apparatus 100 may place a predetermined limit on a predetermined third coding unit among odd third coding units 1220b, 1220c, and 1220d.
- the video decoding apparatus 100 may be limited to the number of coding units 1220c positioned in the middle of the odd number of third coding units 1220b, 1220c, and 1220d, or may be divided by a set number of times. It can be limited to.
- the video decoding apparatus 100 may include a coding unit positioned at the center of odd-numbered third coding units 1220b, 1220c, and 1220d included in a second coding unit 1210 having a non-square shape.
- the 1220c is no longer divided, or is limited to being divided into a predetermined division form (for example, only divided into four coding units or divided into a form corresponding to the divided form of the second coding unit 1210), or It can be limited to dividing only by the number of times (eg, dividing only n times, n> 0).
- the above limitation on the coding unit 1220c located in the center is merely a mere embodiment and should not be construed as being limited to the above-described embodiments, and the coding unit 1220c located in the center may be different from the coding units 1220b and 1220d. ), It should be interpreted as including various restrictions that can be decoded.
- the video decoding apparatus 100 may obtain at least one of block shape information and split shape information used to split a current coding unit at a predetermined position in the current coding unit.
- FIG. 13 illustrates a method for the video decoding apparatus 100 to determine a predetermined coding unit from an odd number of coding units, according to an exemplary embodiment.
- at least one of the block shape information and the split shape information of the current coding unit 1300 may be a sample of a predetermined position (for example, located at the center of a plurality of samples included in the current coding unit 1300). Sample 1340).
- a predetermined position in the current coding unit 1300 from which at least one of such block shape information and split shape information may be obtained should not be interpreted as being limited to the center position shown in FIG. 13, and the current coding unit 1300 is located at the predetermined position.
- the video decoding apparatus 100 may obtain at least one of block shape information and split shape information obtained from a predetermined position, and determine that the current coding unit is divided or not divided into coding units having various shapes and sizes.
- the video decoding apparatus 100 may select one coding unit from among them. Methods for selecting one of a plurality of coding units may vary, which will be described below through various embodiments.
- the video decoding apparatus 100 may divide a current coding unit into a plurality of coding units and determine a coding unit of a predetermined position.
- FIG. 13 illustrates a method for the video decoding apparatus 100 to determine a coding unit of a predetermined position from an odd number of coding units, according to an embodiment.
- the video decoding apparatus 100 may use information indicating the position of each of the odd coding units to determine a coding unit located in the middle of the odd coding units. Referring to FIG. 13, the video decoding apparatus 100 may determine an odd number of coding units 1320a, 1320b, and 1320c by dividing the current coding unit 1300. The video decoding apparatus 100 may determine the center coding unit 1320b by using information about the positions of the odd number of coding units 1320a, 1320b, and 1320c. For example, the video decoding apparatus 100 determines the positions of the coding units 1320a, 1320b, and 1320c based on information indicating the positions of predetermined samples included in the coding units 1320a, 1320b, and 1320c.
- the coding unit 1320b positioned at may be determined. Specifically, the video decoding apparatus 100 is based on the information indicating the position of the samples 1330a, 1330b, 1330c in the upper left of the coding units 1320a, 1320b, 1320c of the coding units 1320a, 1320b, 1320c. By determining the position, the coding unit 1320b positioned in the center may be determined.
- the information indicating the positions of the samples 1330a, 1330b, and 1330c in the upper left included in the coding units 1320a, 1320b, and 1320c, respectively may be located in the pictures of the coding units 1320a, 1320b, and 1320c. Or it may include information about the coordinates. According to an embodiment, the information indicating the positions of the samples 1330a, 1330b, and 1330c in the upper left included in the coding units 1320a, 1320b, and 1320c, respectively, may be included in the coding units 1320a and 1320b in the current coding unit 1300.
- the video decoding apparatus 100 may directly use information about the position or coordinates in the pictures of the coding units 1320a, 1320b, and 1320c, or may obtain information about the width or height of the coding unit corresponding to the difference between the coordinates. By using this, the coding unit 1320b located in the center can be determined.
- the information indicating the position of the sample 1330a at the upper left of the upper coding unit 1320a may indicate (xa, ya) coordinates, and the sample 1330b at the upper left of the middle coding unit 1320b.
- the information indicating the position of) may indicate the (xb, yb) coordinates, and the information indicating the position of the sample 1330c on the upper left of the lower coding unit 1320c may indicate the (xc, yc) coordinates.
- the video decoding apparatus 100 may determine the center coding unit 1320b using the coordinates of the samples 1330a, 1330b, and 1330c in the upper left included in the coding units 1320a, 1320b, and 1320c, respectively.
- a coding unit 1320b including (xb, yb), which is the coordinate of the sample 1330b located in the center May be determined as a coding unit located in the middle of the coding units 1320a, 1320b, and 1320c determined by splitting the current coding unit 1300.
- the coordinates indicating the positions of the samples 1330a, 1330b, and 1330c at the upper left may indicate coordinates indicating the absolute positions in the picture, and further, the positions of the samples 1330a at the upper left of the upper coding unit 1320a.
- the (dxb, dyb) coordinate which is information indicating the relative position of the upper left sample 1330b of the middle coding unit 1320b, and the relative position of the upper left sample 1330c of the lower coding unit 1320c.
- Information (dxc, dyc) coordinates can also be used.
- the method of determining the coding unit of a predetermined position by using the coordinates of the sample as information indicating the position of the sample included in the coding unit should not be interpreted to be limited to the above-described method, and various arithmetic operations that can use the coordinates of the sample are available. It should be interpreted in a way.
- the video decoding apparatus 100 may divide the current coding unit 1300 into a plurality of coding units 1320a, 1320b, and 1320c, and may determine a predetermined reference among the coding units 1320a, 1320b, and 1320c. According to the coding unit can be selected. For example, the video decoding apparatus 100 may select coding units 1320b having different sizes from among coding units 1320a, 1320b, and 1320c.
- the video decoding apparatus 100 may have (xa, ya) coordinates, which are information indicating a position of a sample 1330a at the upper left of the upper coding unit 1320a, and a sample at the upper left of the center coding unit 1320b.
- Coding unit 1320a using (xb, yb) coordinates indicating information of position of (1330b) and (xc, yc) coordinates indicating information of sample 1330c on the upper left of lower coding unit 1320c. 1320b, 1320c) may determine the width or height of each.
- the video decoding apparatus 100 uses (xa, ya), (xb, yb), and (xc, yc), which are coordinates indicating the positions of the coding units 1320a, 1320b, and 1320c, to encode the units 1320a, 1320b, and 1320c. ) Each size can be determined.
- the video decoding apparatus 100 may determine the width of the upper coding unit 1320a as xb-xa and the height as yb-ya. According to an embodiment, the video decoding apparatus 100 may determine the width of the central coding unit 1320b as xc-xb and the height as yc-yb. According to an embodiment, the video decoding apparatus 100 may determine the width or height of the lower coding unit using the width or height of the current coding unit, and the width and height of the upper coding unit 1320a and the center coding unit 1320b. .
- the video decoding apparatus 100 may determine a coding unit having a different size from other coding units based on the width and the height of the determined coding units 1320a, 1320b, and 1320c. Referring to FIG. 13, the video decoding apparatus 100 may determine a coding unit 1320b as a coding unit having a predetermined position while having a size different from that of the upper coding unit 1320a and the lower coding unit 1320c. However, the above-described video decoding apparatus 100 determines a coding unit having a different size from other coding units by using the size of the coding unit determined based on the sample coordinates to determine the coding unit at a predetermined position. In this regard, various processes of determining a coding unit at a predetermined position by comparing the sizes of coding units determined according to predetermined sample coordinates may be used.
- the position of the sample to be considered for determining the position of the coding unit should not be interpreted as being limited to the upper left side described above, but may be interpreted that information on the position of any sample included in the coding unit may be used.
- the video decoding apparatus 100 may select a coding unit of a predetermined position from odd number of coding units determined by dividing the current coding unit in consideration of the shape of the current coding unit. For example, if the current coding unit has a non-square shape having a width greater than the height, the video decoding apparatus 100 may determine the coding unit at a predetermined position in the horizontal direction. That is, the video decoding apparatus 100 may determine one of the coding units having different positions in the horizontal direction and place a restriction on the corresponding coding unit. If the current coding unit has a non-square shape having a height greater than the width, the video decoding apparatus 100 may determine a coding unit of a predetermined position in the vertical direction. That is, the video decoding apparatus 100 may determine one of the coding units having different positions in the vertical direction to limit the corresponding coding unit.
- the video decoding apparatus 100 may use information indicating the positions of each of the even coding units in order to determine the coding unit of the predetermined position among the even coding units.
- the video decoding apparatus 100 may determine an even number of coding units by dividing a current coding unit and determine a coding unit of a predetermined position by using information about the positions of the even coding units.
- a detailed process for this may be a process corresponding to a process of determining a coding unit of a predetermined position (for example, a middle position) among the odd number of coding units described above with reference to FIG.
- a predetermined value for a coding unit of a predetermined position in the splitting process is determined to determine a coding unit of a predetermined position among the plurality of coding units.
- Information is available.
- the video decoding apparatus 100 may determine block shape information and a split shape stored in a sample included in a middle coding unit in a splitting process in order to determine a coding unit positioned in a center among coding units having a plurality of current coding units split. At least one of the information may be used.
- the video decoding apparatus 100 may split the current coding unit 1300 into a plurality of coding units 1320a, 1320b, and 1320c based on at least one of block shape information and split shape information.
- a coding unit 1320b positioned in the center of the plurality of coding units 1320a, 1320b, and 1320c may be determined.
- the video decoding apparatus 100 may determine a coding unit 1320b positioned in the middle in consideration of a position where at least one of block shape information and split shape information is obtained.
- At least one of the block shape information and the split shape information of the current coding unit 1300 may be obtained from a sample 1340 positioned in the center of the current coding unit 1300, and the block shape information and the split shape information may be obtained.
- the coding unit 1320b including the sample 1340 is a coding unit positioned at the center. You can decide.
- the information used to determine the coding unit located in the middle should not be interpreted as being limited to at least one of the block type information and the split type information, and various types of information may be used in the process of determining the coding unit located in the center. Can be.
- predetermined information for identifying a coding unit of a predetermined position may be obtained from a predetermined sample included in the coding unit to be determined.
- the video decoding apparatus 100 may divide a current coding unit 1300 into a plurality of coding units (eg, divided into a plurality of coding units 1320a, 1320b, and 1320c) determined by splitting the current coding unit 1300.
- Block shape information obtained from a sample at a predetermined position (for example, a sample located in the center of the current coding unit 1300) in the current coding unit 1300 to determine a coding unit located in the center of the coding units; At least one of the partition type information may be used. .
- the video decoding apparatus 100 may determine the sample of the predetermined position in consideration of the block block form of the current coding unit 1300, and the video decoding apparatus 100 may determine that the current coding unit 1300 is divided and determined.
- a coding unit 1320b including a sample from which predetermined information (for example, at least one of block shape information and split shape information) may be obtained may be determined.
- predetermined information for example, at least one of block shape information and split shape information
- the video decoding apparatus 100 may determine a sample 1340 positioned in the center of the current coding unit 1300 as a sample from which predetermined information may be obtained.
- the 100 may set a predetermined limit in the decoding process of the coding unit 1320b including the sample 1340.
- the position of the sample from which the predetermined information can be obtained should not be interpreted as being limited to the above-described position, but may be interpreted as samples of arbitrary positions included in the coding unit 1320b to be determined for the purpose of limitation.
- a position of a sample from which predetermined information may be obtained may be determined according to the shape of the current coding unit 1300.
- the block shape information may determine whether the shape of the current coding unit is square or non-square, and determine the position of a sample from which the predetermined information may be obtained according to the shape.
- the video decoding apparatus 100 may be positioned on a boundary that divides at least one of the width and the height of the current coding unit in half using at least one of the information on the width and the height on the current coding unit.
- the sample may be determined as a sample from which predetermined information can be obtained.
- the video decoding apparatus 100 may select one of samples adjacent to a boundary that divides the long side of the current coding unit in half. May be determined as a sample from which information may be obtained.
- the video decoding apparatus 100 when the video decoding apparatus 100 divides a current coding unit into a plurality of coding units, at least one of block shape information and split shape information may be used to determine a coding unit of a predetermined position among the plurality of coding units. You can use one.
- the video decoding apparatus 100 may obtain at least one of block shape information and split shape information from a sample at a predetermined position included in a coding unit, and the video decoding apparatus 100 may split the current coding unit.
- the generated plurality of coding units may be divided using at least one of split shape information and block shape information obtained from a sample of a predetermined position included in each of the plurality of coding units.
- the coding unit may be recursively split using at least one of block shape information and split shape information obtained from a sample of a predetermined position included in each coding unit. Since the recursive division process of the coding unit has been described above with reference to FIG. 12, a detailed description thereof will be omitted.
- the video decoding apparatus 100 may determine at least one coding unit by dividing a current coding unit, and determine a predetermined block (eg, current coding unit) in order of decoding the at least one coding unit. Can be determined according to
- FIG. 14 illustrates an order in which a plurality of coding units are processed when the video decoding apparatus 100 determines a plurality of coding units by dividing a current coding unit.
- the video decoding apparatus 100 determines the second coding units 1410a and 1410b by dividing the first coding unit 1400 in the vertical direction according to the block shape information and the split shape information.
- the second coding units 1430a and 1430b may be determined by dividing the 1400 in the horizontal direction, or the second coding units 1450a, 1450b, 1450c and 1450d by dividing the first coding unit 1400 in the vertical and horizontal directions. Can be determined.
- the video decoding apparatus 100 may determine an order such that the second coding units 1410a and 1410b determined by dividing the first coding unit 1400 in the vertical direction are processed in the horizontal direction 1410c. .
- the video decoding apparatus 100 may determine a processing order of the second coding units 1430a and 1430b determined by dividing the first coding unit 1400 in the horizontal direction, in the vertical direction 1430c.
- the video decoding apparatus 100 processes the coding units for positioning the second coding units 1450a, 1450b, 1450c, and 1450d determined by dividing the first coding unit 1400 in the vertical direction and the horizontal direction, in one row.
- the coding units positioned in the next row may be determined according to a predetermined order (for example, raster scan order or z scan order 1450e).
- the video decoding apparatus 100 may recursively split coding units.
- the video decoding apparatus 100 may determine a plurality of coding units 1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, and 1450d by dividing the first coding unit 1400.
- Each of the determined coding units 1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, and 1450d may be recursively divided.
- the method of dividing the plurality of coding units 1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, and 1450d may correspond to a method of dividing the first coding unit 1400. Accordingly, the plurality of coding units 1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, and 1450d may be independently divided into a plurality of coding units. Referring to FIG. 14, the video decoding apparatus 100 may determine the second coding units 1410a and 1410b by dividing the first coding unit 1400 in the vertical direction, and further, respectively, the second coding units 1410a and 1410b. It can be decided to split independently or not.
- the video decoding apparatus 100 may divide the second coding unit 1410a on the left side into horizontal units and divide the second coding unit 1420a and 1420b on the right side, and the second coding unit 1410b on the right side. ) May not be divided.
- the processing order of coding units may be determined based on a split process of the coding units.
- the processing order of the divided coding units may be determined based on the processing order of the coding units immediately before being split.
- the video decoding apparatus 100 may independently determine the order in which the third coding units 1420a and 1420b determined by splitting the second coding unit 1410a on the left side are processed independently of the second coding unit 1410b on the right side. Since the second coding unit 1410a on the left is divided in the horizontal direction to determine the third coding units 1420a and 1420b, the third coding units 1420a and 1420b may be processed in the vertical direction 1420c.
- the third coding unit included in the second coding unit 1410a on the left side corresponds to the horizontal direction 1410c
- the right coding unit 1410b may be processed.
- FIG. 15 illustrates a process of determining that a current coding unit is divided into an odd number of coding units when the video decoding apparatus 100 cannot process the coding units in a predetermined order, according to an embodiment.
- the video decoding apparatus 100 may determine that the current coding unit is divided into odd coding units based on the obtained block shape information and the split shape information.
- a first coding unit 1500 having a square shape may be divided into second coding units 1510a and 1510b having a non-square shape, and each of the second coding units 1510a and 1510b may be independently formed.
- the video decoding apparatus 100 may determine a plurality of third coding units 1520a and 1520b by dividing the left coding unit 1510a in the horizontal direction among the second coding units, and may include the right coding unit 1510b. ) May be divided into an odd number of third coding units 1520c, 1520d, and 1520e.
- the video decoding apparatus 100 determines whether the third coding units 1520a, 1520b, 1520c, 1520d, and 1520e may be processed in a predetermined order to determine whether there are oddly divided coding units. You can decide. Referring to FIG. 15, the video decoding apparatus 100 may recursively divide a first coding unit 1500 to determine third coding units 1520a, 1520b, 1520c, 1520d, and 1520e.
- the video decoding apparatus 100 may include a first coding unit 1500, a second coding unit 1510a and 1510b, or a third coding unit 1520a, 1520b, 1520c, based on at least one of block shape information and split shape information.
- the order in which the plurality of coding units included in the first coding unit 1500 are processed may be a predetermined order (for example, a z-scan order 1530), and the video decoding apparatus ( 100 may determine whether the third coding unit 1520c, 1520d, and 1520e determined by splitting the right second coding unit 1510b into an odd number satisfies a condition in which the right coding unit 1510b is processed in the predetermined order.
- the video decoding apparatus 100 may satisfy a condition that the third coding units 1520a, 1520b, 1520c, 1520d, and 1520e included in the first coding unit 1500 may be processed in a predetermined order. And whether the at least one of the width and the height of the second coding unit 1510a, 1510b is divided in half according to the boundary of the third coding unit 1520a, 1520b, 1520c, 1520d, or 1520e.
- the third coding units 1520a and 1520b which are determined by dividing the height of the left second coding unit 1510a by the non-square form in half, satisfy the condition, but the right second coding unit 1510b is 3.
- the third coding units 1520c, 1520d, and 1520e determined by dividing into two coding units does not divide the width or height of the right second coding unit 1510b in half
- the third coding units 1520c, 1520d, 1520e may be determined not to satisfy the condition, and the video decoding apparatus 100 determines that the scan order is disconnected in the case of dissatisfaction with the condition, and the right second coding unit 1510b is determined based on the determination result. It may be determined to be divided into an odd number of coding units.
- the video decoding apparatus 100 when the video decoding apparatus 100 is divided into an odd number of coding units, the video decoding apparatus 100 may set a predetermined restriction on a coding unit of a predetermined position among the divided coding units. Since the above has been described through the embodiments, a detailed description thereof will be omitted.
- FIG. 16 illustrates a process of determining, by the video decoding apparatus 100, at least one coding unit by dividing the first coding unit 1600 according to an embodiment.
- the video decoding apparatus 100 may divide the first coding unit 1600 based on at least one of the obtained block shape information and split shape information.
- the first coding unit 1600 having a square shape may be divided into coding units having four square shapes, or may be divided into a plurality of coding units having a non-square shape.
- the video decoding apparatus 100 may determine the first coding unit. 1600 may be divided into a plurality of non-square coding units.
- the video decoding apparatus 100 may form a square first coding unit 1600. ) May be divided into second coding units 1610a, 1610b, and 1610c determined by being split in the vertical direction as odd coding units, or second coding units 1620a, 1620b, and 1620c by splitting into the horizontal direction.
- the video decoding apparatus 100 may process the second coding units 1610a, 1610b, 1610c, 1620a, 1620b, and 1620c included in the first coding unit 1600 in a predetermined order.
- the condition is whether the at least one of the width and height of the first coding unit 1600 is divided in half according to the boundary of the second coding unit (1610a, 1610b, 1610c, 1620a, 1620b, 1620c). It is related to whether or not.
- a boundary between second coding units 1610a, 1610b, and 1610c which is determined by dividing a square first coding unit 1600 in a vertical direction, divides the width of the first coding unit 1600 in half.
- the first coding unit 1600 may be determined to not satisfy a condition that may be processed in a predetermined order.
- the boundary of the second coding units 1620a, 1620b, and 1620c which is determined by dividing the first coding unit 1600 having a square shape in the horizontal direction, does not divide the width of the first coding unit 1600 in half,
- the one coding unit 1600 may be determined as not satisfying a condition that may be processed in a predetermined order. In case of such a condition dissatisfaction, the video decoding apparatus 100 may determine that the scan order is disconnected, and determine that the first coding unit 1600 is divided into odd coding units based on the determination result.
- the video decoding apparatus 100 when the video decoding apparatus 100 is divided into an odd number of coding units, the video decoding apparatus 100 may set a predetermined restriction on a coding unit of a predetermined position among the divided coding units. Since the above has been described through the embodiments, a detailed description thereof will be omitted.
- the video decoding apparatus 100 may determine coding units of various types by dividing the first coding unit.
- the video decoding apparatus 100 may split a first coding unit 1600 having a square shape and a first coding unit 1630 or 1650 having a non-square shape into various coding units. .
- FIG. 17 illustrates that the second coding unit is split when the video coding apparatus 100 according to an embodiment satisfies a predetermined condition when a second coding unit having a non-square shape determined by splitting the first coding unit 1700 is satisfied. It shows that the form that can be limited.
- the video decoding apparatus 100 may convert the first coding unit 1700 having a square shape into a second coding unit 1710a having a non-square shape based on at least one of the obtained block shape information and the split shape information. 1710b, 1720a, and 1720b.
- the second coding units 1710a, 1710b, 1720a, and 1720b may be split independently. Accordingly, the video decoding apparatus 100 determines whether to split or not split into a plurality of coding units based on at least one of block shape information and split shape information associated with each of the second coding units 1710a, 1710b, 1720a, and 1720b. Can be.
- the video decoding apparatus 100 divides the left second coding unit 1710a of the non-square shape, determined by dividing the first coding unit 1700 in the vertical direction, into a horizontal direction, and then uses the third coding unit ( 1712a, 1712b) can be determined.
- the video decoding apparatus 100 divides the left second coding unit 1710a in the horizontal direction
- the right second coding unit 1710b may have the same horizontal direction as the direction in which the left second coding unit 1710a is divided. It can be limited to not be divided into.
- the right second coding unit 1710b is divided in the same direction and the third coding units 1714a and 1714b are determined, the left second coding unit 1710a and the right second coding unit 1710b are respectively horizontally aligned.
- the third coding units 1712a, 1712b, 1714a, and 1714b may be determined by being split independently. However, this means that the video decoding apparatus 100 divides the first coding unit 1700 into four square second coding units 1730a, 1730b, 1730c, and 1730d based on at least one of the block shape information and the split shape information. This is the same result as one, which can be inefficient in terms of video decoding.
- the video decoding apparatus 100 splits a second coding unit 1720a or 1720b of a non-square shape determined by dividing the first coding unit 11300 in a horizontal direction into a third coding unit. (1722a, 1722b, 1724a, 1724b) can be determined.
- a third coding unit (1722a, 1722b, 1724a, 1724b)
- the video decoding apparatus 100 divides one of the second coding units (for example, the upper second coding unit 1720a) in the vertical direction
- another video coding unit for example, the lower end
- the coding unit 1720b may restrict the upper second coding unit 1720a from being split in the vertical direction in the same direction as the split direction.
- FIG. 18 illustrates a process of splitting a coding unit having a square shape by the video decoding apparatus 100 when the split shape information cannot be divided into four square coding units.
- the video decoding apparatus 100 divides the first coding unit 1800 based on at least one of the block shape information and the split shape information to divide the second coding units 1810a, 1810b, 1820a, 1820b, and the like. You can decide.
- the split type information may include information about various types in which a coding unit may be split, but the information on various types may not include information for splitting into four coding units having a square shape.
- the video decoding apparatus 100 may not split the first coding unit 1800 having a square shape into four second coding units 1830a, 1830b, 1830c, and 1830d having four square shapes.
- the video decoding apparatus 100 may determine the second coding unit 1810a, 1810b, 1820a, 1820b, or the like having a non-square shape, based on the split shape information.
- the video decoding apparatus 100 may independently split second non-square second coding units 1810a, 1810b, 1820a, 1820b, and the like.
- Each of the second coding units 1810a, 1810b, 1820a, 1820b, etc. may be divided in a predetermined order through a recursive method, which is based on at least one of the block shape information and the split shape information 1800. ) May be a division method corresponding to the division method.
- the video decoding apparatus 100 may determine the third coding units 1812a and 1812b having a square shape by dividing the left second coding unit 1810a in the horizontal direction, and the right second coding unit 1810b The third coding units 1814a and 1814b having a square shape may be determined by being split in the horizontal direction. Furthermore, the video decoding apparatus 100 may divide the left second coding unit 1810a and the right second coding unit 1810b in the horizontal direction to determine the third coding units 1816a, 1816b, 1816c, and 1816d having a square shape. have. In this case, the coding unit may be determined in the same form as that in which the first coding unit 1800 is divided into four second coding units 1830a, 1830b, 1830c, and 1830d.
- the video decoding apparatus 100 may determine the third coding units 1822a and 1822b having a square shape by dividing the upper second coding unit 1820a in the vertical direction, and the lower second coding unit 1820b. ) May be divided in a vertical direction to determine third coding units 1824a and 1824b having a square shape. Furthermore, the video decoding apparatus 100 may divide the upper second coding unit 1820a and the lower second coding unit 1820b in the vertical direction to determine the third coding units 1822a, 1822b, 1824a, and 1824b having a square shape. have. In this case, the coding unit may be determined in the same form as that in which the first coding unit 1800 is divided into four second coding units 1830a, 1830b, 1830c, and 1830d.
- FIG. 19 illustrates that a processing order between a plurality of coding units may vary according to a splitting process of coding units, according to an embodiment.
- the video decoding apparatus 100 may divide the first coding unit 1900 based on the block shape information and the split shape information.
- the block shape information indicates a square shape and the split shape information indicates that the first coding unit 1900 is split in at least one of a horizontal direction and a vertical direction
- the video decoding apparatus 100 may determine the first coding unit 1900.
- a second coding unit eg, 1910a, 1910b, 1920a, 1920b, 1930a, 1930b, 1930c, 1930d, etc.
- non-square-type second coding units 1910a, 1910b, 1920a, and 1920b which are determined by dividing the first coding unit 1900 only in the horizontal direction or the vertical direction, respectively, may include block shape information and split shape information for each. It can be divided independently based on.
- the video decoding apparatus 100 divides the second coding units 1910a and 1910b generated by splitting the first coding unit 1900 in the vertical direction in the horizontal direction, respectively, to generate the third coding unit 1916a, 1916b, 1916c and 1916d, and the second coding units 1920a and 1920b generated by dividing the first coding unit 1900 in the horizontal direction are divided in the horizontal direction, respectively, and the third coding units 1926a, 1926b and 1926c. 1926d). Since the splitting process of the second coding units 1910a, 1910b, 1920a, and 1920b has been described above with reference to FIG. 17, a detailed description thereof will be omitted.
- the video decoding apparatus 100 may process coding units in a predetermined order. Features of the processing of coding units according to a predetermined order have been described above with reference to FIG. 14, and thus detailed descriptions thereof will be omitted. Referring to FIG. 19, the video decoding apparatus 100 splits a first coding unit 1900 having a square shape to form three square third coding units 1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, and 1926d. ) Can be determined.
- the video decoding apparatus 100 processes the processing sequence of the third coding units 1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, and 1926d according to a form in which the first coding unit 1900 is divided. You can decide.
- the video decoding apparatus 100 determines the third coding units 1916a, 1916b, 1916c, and 1916d by dividing the second coding units 1910a and 1910b generated by dividing in the vertical direction, respectively, in the horizontal direction.
- the video decoding apparatus 100 may first process the third coding units 1916a and 1916b included in the left second coding unit 1910a in the vertical direction, and then include the right second coding unit 1910b.
- the third coding units 1916a, 1916b, 1916c, and 1916d may be processed according to an order 1917 of processing the third coding units 1916c and 1916d in the vertical direction.
- the video decoding apparatus 100 determines the third coding units 1926a, 1926b, 1926c, and 1926d by dividing the second coding units 1920a and 1920b generated by splitting in the horizontal direction in the vertical direction.
- the video decoding apparatus 100 may first process the third coding units 1926a and 1926b included in the upper second coding unit 1920a in the horizontal direction, and then include the lower coding unit 1920b.
- the third coding units 1926a, 1926b, 1926c, and 1926d may be processed according to an order 1927 of processing the third coding units 1926c and 1926d in the horizontal direction.
- second coding units 1910a, 1910b, 1920a, and 1920b may be divided, respectively, and square third coding units 1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, and 1926d may be determined. have.
- the second coding units 1910a and 1910b determined by dividing in the vertical direction and the second coding units 1920a and 1920b determined by dividing in the horizontal direction are divided into different forms, but are determined after the third coding unit 1916a.
- the first coding unit 1900 is divided into coding units having the same type.
- the video decoding apparatus 100 recursively splits the coding unit through a different process based on at least one of the block shape information and the split shape information, and as a result, the video decoding apparatus 100 determines a plurality of coding units having the same shape. Coding units may be processed in different orders.
- 20 is a diagram illustrating a process of determining a depth of a coding unit as a shape and a size of a coding unit change when a coding unit is recursively divided and a plurality of coding units are determined according to an embodiment.
- the video decoding apparatus 100 may determine a depth of a coding unit according to a predetermined criterion.
- the predetermined criterion may be the length of the long side of the coding unit.
- the depth of the current coding unit is greater than the depth of the coding unit before the split. It can be determined that the depth is increased by n.
- a coding unit having an increased depth is expressed as a coding unit of a lower depth.
- the video decoding apparatus 100 may have a square shape, based on block shape information indicating a square shape (for example, block shape information may indicate '0: SQUARE').
- the first coding unit 2000 may be divided to determine a second coding unit 2002, a third coding unit 2004, and the like of a lower depth.
- the size of the square shape of the first encoding unit (2000) if it 2Nx2N, the first second encoding unit (2002) is determined by dividing the width and height of 1 to 1/2 of the encoding unit (2000) have a size of NxN Can be.
- the third coding unit 2004 determined by dividing the width and the height of the second coding unit 2002 into half sizes may have a size of N / 2 ⁇ N / 2.
- the width and height of the third coding unit 2004 correspond to 1/2 2 times of the first coding unit 2000.
- the case where the depth of the first encoding unit (2000) the first depth D of the encoding unit (2000) 1 1/2 times the second encoding unit (2002) of the width and height may be in the D + 1, the first encoding
- the depth of the third coding unit 2004 that is 1/2 2 times the width and the height of the unit 2000 may be D + 2.
- block shape information indicating a non-square shape (e.g., block shape information indicates that the height is a non-square longer than the width '1: NS_VER' or the width is a non-square longer than the height).
- 2 may indicate NS_HOR ', and the video decoding apparatus 100 may split the first coding unit 2010 or 2020 having a non-square shape to form the second coding unit 2012 or 2022 of the lower depth.
- the third coding unit 2014 or 2024 may be determined.
- the video decoding apparatus 100 may determine a second coding unit (for example, 2002, 2012, 2022, etc.) by dividing at least one of a width and a height of the Nx2N-sized first coding unit 2010. That is, the video decoding apparatus 100 may divide the first coding unit 2010 in the horizontal direction to determine the second coding unit 2002 having the NxN size or the second coding unit 2022 having the NxN / 2 size.
- the second coding unit 2012 having a size of N / 2 ⁇ N may be determined by splitting in the horizontal direction and the vertical direction.
- the video decoding apparatus 100 determines at least one of a width and a height of a 2N ⁇ N first coding unit 2020 to determine a second coding unit (eg, 2002, 2012, 2022, etc.). It may be. That is, the video decoding apparatus 100 may divide the first coding unit 2020 in the vertical direction to determine a second coding unit 2002 having an NxN size or a second coding unit 2012 having an N / 2xN size.
- the second coding unit 2022 having the size of NxN / 2 may be determined by splitting in the horizontal direction and the vertical direction.
- the video decoding apparatus 100 determines at least one of a width and a height of the NxN-sized second coding unit 2002 to determine a third coding unit (eg, 2004, 2014, 2024, etc.). It may be. That is, the video decoding apparatus 100 determines the third coding unit 2004 having the size of N / 2 ⁇ N / 2 by dividing the second coding unit 2002 in the vertical direction and the horizontal direction, or N / 2 2 xN / 2 size. The third coding unit 2014 may be determined or the third coding unit 2024 having a size of N / 2 ⁇ N / 2 2 may be determined.
- a third coding unit eg, 2004, 2014, 2024, etc.
- the video decoding apparatus 100 splits at least one of a width and a height of the N / 2xN sized second coding unit 2012 to a third coding unit (eg, 2004, 2014, 2024, etc.). May be determined. That is, the video decoding apparatus 100 divides the second coding unit 2012 in the horizontal direction, so that the third coding unit 2004 having the size of N / 2 ⁇ N / 2 or the third coding unit having the size of N / 2 ⁇ N / 2 2 ( 2024 may be determined or divided into vertical and horizontal directions to determine a third coding unit 2014 having a size of N / 2 2 xN / 2.
- a third coding unit eg, 2004, 2014, 2024, etc.
- the video decoding apparatus 100 splits at least one of a width and a height of the NxN / 2 sized second coding unit 2014 to form a third coding unit (eg, 2004, 2014, 2024, etc.). May be determined. That is, the video decoding apparatus 100 divides the second coding unit 2012 in the vertical direction to form a third coding unit 2004 having a size of N / 2 ⁇ N / 2 or a third coding unit having a size of N / 2 2 xN / 2.
- the third coding unit 2024 having a size of N / 2 ⁇ N / 2 2 may be determined by determining (2014) or dividing it in the vertical direction and the horizontal direction.
- the video decoding apparatus 100 may divide a square coding unit (for example, 2000, 2002, 2004) in a horizontal direction or a vertical direction.
- the first coding unit 2000 having a size of 2Nx2N is divided in the vertical direction to determine the first coding unit 2010 having the size of Nx2N, or the first coding unit 2020 having a size of 2NxN is determined by splitting in the horizontal direction.
- the depth of the coding unit determined by splitting the first coding unit 2000, 2002 or 2004 having a size of 2N ⁇ 2N into the horizontal or vertical direction is determined. May be the same as the depth of the first coding unit 2000, 2002, or 2004.
- it may correspond to 1/2 2 times the third encoding unit (2014 or 2024), the width and height of a first encoding unit (2010 or 2020) of the.
- the depth of the first coding unit 2010 or 2020 is D
- the depth of the second coding unit 2012 or 2014 that is 1/2 the width and height of the first coding unit 2010 or 2020 may be D + 1.
- the depth of the first encoding unit (2010 or 2020) 1/2 2 times the third encoding unit (2014 or 2024) of the width and height may be a D + 2.
- FIG. 21 illustrates a depth index and a part index (PID) for classifying coding units, which may be determined according to shapes and sizes of coding units, according to an embodiment.
- PID part index
- the video decoding apparatus 100 may determine a second coding unit having various types by dividing the first coding unit 2100 having a square shape. Referring to FIG. 21, the video decoding apparatus 100 divides the first coding unit 2100 in at least one of a vertical direction and a horizontal direction according to the split type information to thereby obtain the second coding units 2102a, 2102b, 2104a, 2104b, 2106a, 2106b, 2106c, 2106d). That is, the video decoding apparatus 100 may determine the second coding units 2102a, 2102b, 2104a, 2104b, 2106a, 2106b, 2106c, and 2106d based on the split shape information of the first coding unit 2100.
- the second coding units 2102a, 2102b, 2104a, 2104b, 2106a, 2106b, 2106c, and 2106d which are determined according to split shape information about the first coding unit 2100 having a square shape, have a long side length. Depth can be determined based on this. For example, since the length of one side of the first coding unit 2100 having a square shape and the length of the long side of the second coding units 2102a, 2102b, 2104a, and 2104b having a non-square shape are the same, the first coding unit ( 2100 and the depths of the non-square second coding units 2102a, 2102b, 2104a, and 2104b may be regarded as D.
- the video decoding apparatus 100 divides the first coding unit 2100 into four square coding units 2106a, 2106b, 2106c, and 2106d based on the split form information
- the video decoding apparatus 100 divides the first coding unit into a square form. Since the length of one side of the two coding units 2106a, 2106b, 2106c, and 2106d is 1/2 times the length of one side of the first coding unit 2100, the depths of the second coding units 2106a, 2106b, 2106c, and 2106d are determined. May be a depth of D + 1 that is one depth lower than D, which is a depth of the first coding unit 2100.
- the video decoding apparatus 100 divides a first coding unit 2110 having a height greater than a width in a horizontal direction according to split shape information, thereby performing a plurality of second coding units 2112a, 2112b, 2114a, 2114b and 2114c).
- the video decoding apparatus 100 divides a first coding unit 2120 having a width greater than a height in a vertical direction according to split shape information, thereby performing a plurality of second coding units 2122a, 2122b, 2124a, 2124b, 2124c).
- the second coding units 2112a, 2112b, 2114a, 2114b, 2116a, 2116b, 2116c, and 2116d that are determined according to split shape information about the first coding unit 2110 or 2120 having a non-square shape may be used. Depth may be determined based on the length of the long side. For example, since the length of one side of the second coding units 2112a and 2112b having a square shape is 1/2 times the length of one side of the first coding unit 2110 having a non-square shape having a height greater than the width, the square is square.
- the depths of the second coding units 2102a, 2102b, 2104a, and 2104b of the form are D + 1, which is one depth lower than the depth D of the first coding unit 2110 of the non-square form.
- the video decoding apparatus 100 may divide the non-square first coding unit 2110 into odd second coding units 2114a, 2114b, and 2114c based on the split shape information.
- the odd numbered second coding units 2114a, 2114b, and 2114c may include non-square second coding units 2114a and 2114c and square shape second coding units 2114b.
- the length of the long side of the second coding units 2114a and 2114c of the non-square shape and the length of one side of the second coding unit 2114b of the square shape is 1 / time of the length of one side of the first coding unit 2110.
- the depths of the second coding units 2114a, 2114b, and 2114c may be a depth of D + 1 that is one depth lower than the depth D of the first coding unit 2110.
- the video decoding apparatus 100 corresponds to the above-described method of determining depths of coding units related to the first coding unit 2110, and is related to the first coding unit 2120 having a non-square shape having a width greater than the height. Depth of coding units may be determined.
- the video decoding apparatus 100 may determine the size ratio between the coding units.
- the index can be determined based on this.
- a coding unit 2114b positioned at the center of odd-numbered split coding units 2114a, 2114b, and 2114c may have the same width as the other coding units 2114a and 2114c but have different heights. It may be twice the height of the fields 2114a and 2114c. That is, in this case, the coding unit 2114b positioned in the center may include two of the other coding units 2114a and 2114c.
- the video decoding apparatus 100 may determine whether odd-numbered split coding units are not the same size based on whether there is a discontinuity of an index for distinguishing the split coding units.
- the video decoding apparatus 100 may determine whether the video decoding apparatus 100 is divided into a specific division type based on a value of an index for dividing the plurality of coding units determined by dividing from the current coding unit. Referring to FIG. 21, the video decoding apparatus 100 determines an even number of coding units 2112a and 2112b by dividing a first coding unit 2110 having a height greater than a width, or an odd number of coding units 2114a and 2114b. , 2114c). The video decoding apparatus 100 may use an index (PID) indicating each coding unit to distinguish each of the plurality of coding units. According to an embodiment, the PID may be obtained from a sample (eg, an upper left sample) at a predetermined position of each coding unit.
- a sample eg, an upper left sample
- the video decoding apparatus 100 may determine a coding unit of a predetermined position among coding units determined by splitting by using an index for dividing coding units. According to an embodiment of the present disclosure, when the split type information of the first coding unit 2110 having a height greater than the width is divided into three coding units, the video decoding apparatus 100 may decode the first coding unit 2110. It may be divided into three coding units 2114a, 2114b, and 2114c. The video decoding apparatus 100 may allocate an index for each of three coding units 2114a, 2114b, and 2114c. The video decoding apparatus 100 may compare the indices of the respective coding units to determine the coding unit among the oddly divided coding units.
- the video decoding apparatus 100 encodes a coding unit 2114b having an index corresponding to a center value among the indices based on the indexes of the coding units, and encodes the center position among the coding units determined by splitting the first coding unit 2110. It can be determined as a unit. According to an embodiment, when the video decoding apparatus 100 determines an index for dividing the divided coding units, when the coding units are not the same size, the video decoding apparatus 100 may determine the index based on the size ratio between the coding units. . Referring to FIG.
- a coding unit 2114b generated by dividing a first coding unit 2110 may include coding units 2114a and 2114c having the same width but different heights as other coding units 2114a and 2114c. It can be twice the height.
- the index (PID) of the coding unit 2114b positioned in the center is 1, the coding unit 2114c positioned in the next order may be 3 having an index increased by 2.
- the video decoding apparatus 100 may determine that the video decoding apparatus 100 is divided into a plurality of coding units including a coding unit having a different size from other coding units.
- the video decoding apparatus 100 may have a shape that is different in size from coding units having different coding units (for example, middle coding units) at a predetermined position among the odd coding units.
- the current coding unit can be divided by.
- the video decoding apparatus 100 may determine a coding unit having a different size by using an index (PID) for the coding unit.
- PID index
- the above-described index, the size or position of the coding unit of the predetermined position to be determined are specific to explain an embodiment and should not be construed as being limited thereto. Various indexes and positions and sizes of the coding unit may be used. Should be interpreted.
- the video decoding apparatus 100 may use a predetermined data unit at which recursive division of coding units begins.
- FIG. 22 illustrates that a plurality of coding units are determined according to a plurality of predetermined data units included in a picture according to an embodiment.
- the predetermined data unit may be defined as a data unit in which a coding unit starts to be recursively divided using at least one of block shape information and split shape information. That is, it may correspond to the coding unit of the highest depth used in the process of determining a plurality of coding units for dividing the current picture.
- a predetermined data unit will be referred to as a reference data unit.
- the reference data unit may represent a predetermined size and shape.
- the reference coding unit may include samples of M ⁇ N. M and N may be the same as each other, and may be an integer represented by a multiplier of two. That is, the reference data unit may represent a square or non-square shape, and then may be divided into integer coding units.
- the video decoding apparatus 100 may divide the current picture into a plurality of reference data units. According to an embodiment, the video decoding apparatus 100 may divide a plurality of reference data units for dividing a current picture using split information for each reference data unit. The division process of the reference data unit may correspond to the division process using a quad-tree structure.
- the video decoding apparatus 100 may predetermine the minimum size of the reference data unit included in the current picture. Accordingly, the video decoding apparatus 100 may determine a reference data unit having various sizes having a minimum size or more, and determine at least one coding unit by using block shape information and split shape information based on the determined reference data unit. You can decide.
- the video decoding apparatus 100 may use a reference coding unit 2200 having a square shape, or may use a reference coding unit 2202 of a non-square shape.
- the shape and size of the reference coding unit may include various data units (eg, a sequence, a picture, a slice, and a slice segment) that may include at least one reference coding unit. slice segment, maximum coding unit, etc.).
- the video decoding apparatus 100 may obtain at least one of information on a shape of a reference coding unit and information on a size of a reference coding unit from each bitstream.
- a process of determining at least one coding unit included in the reference coding unit 2200 having a square shape has been described above by splitting the current coding unit 300 of FIG. 10, and refers to the reference coding unit 2200 having a non-square shape. Since the process of determining at least one coding unit included in the above is described above through the process of splitting the current coding unit 1100 or 1150 of FIG. 11, a detailed description thereof will be omitted.
- the video decoding apparatus 100 may determine the size and shape of the reference coding unit in order to determine the size and shape of the reference coding unit according to some data unit predetermined based on a predetermined condition.
- a predetermined condition eg, data having a size less than or equal to a slice
- the various data units eg, sequence, picture, slice, slice segment, maximum coding unit, etc.
- an index for identifying the size and shape of the reference coding unit may be obtained for each slice, slice segment, maximum coding unit, and the like.
- the video decoding apparatus 100 may determine the size and shape of the reference data unit for each data unit satisfying the predetermined condition by using the index.
- the index may be obtained and used. In this case, at least one of the size and shape of the reference coding unit corresponding to the index indicating the size and shape of the reference coding unit may be predetermined.
- the video decoding apparatus 100 selects at least one of the predetermined size and shape of the reference coding unit according to the index, thereby selecting at least one of the size and shape of the reference coding unit included in the data unit that is the reference for obtaining the index. You can decide.
- the video decoding apparatus 100 may use at least one reference coding unit included in one maximum coding unit. That is, at least one reference coding unit may be included in the maximum coding unit for dividing an image, and the coding unit may be determined through a recursive division process of each reference coding unit. According to an embodiment, at least one of the width and the height of the maximum coding unit may correspond to an integer multiple of at least one of the width and the height of the reference coding unit. According to an embodiment, the size of the reference coding unit may be a size obtained by dividing the maximum coding unit n times according to a quad tree structure.
- the video decoding apparatus 100 may determine the reference coding unit by dividing the maximum coding unit n times according to the quad tree structure, and according to various embodiments, at least one of the block shape information and the split shape information according to various embodiments. Can be divided based on.
- FIG. 23 is a diagram of a processing block serving as a reference for determining a determination order of a reference coding unit included in a picture 2300, according to an exemplary embodiment.
- the video decoding apparatus 100 may determine at least one processing block for dividing a picture.
- the processing block is a data unit including at least one reference coding unit for dividing an image, and the at least one reference coding unit included in the processing block may be determined in a specific order. That is, the determination order of at least one reference coding unit determined in each processing block may correspond to one of various types of order in which the reference coding unit may be determined, and the reference coding unit determination order determined in each processing block. May be different per processing block.
- the order of determination of the reference coding units determined for each processing block is raster scan, Z-scan, N-scan, up-right diagonal scan, and horizontal scan. It may be one of various orders such as a horizontal scan, a vertical scan, etc., but the order that may be determined should not be construed as being limited to the scan orders.
- the video decoding apparatus 100 may obtain information about the size of the processing block and determine the size of at least one processing block included in the image.
- the video decoding apparatus 100 may determine the size of at least one processing block included in the image by obtaining information about the size of the processing block from the bitstream.
- the size of such a processing block may be a predetermined size of a data unit indicated by the information about the size of the processing block.
- the video decoding apparatus 100 may obtain information about a size of a processing block from a bitstream for each specific data unit.
- the information about the size of the processing block may be obtained from the bitstream in data units such as an image, a sequence, a picture, a slice, and a slice segment. That is, the video decoding apparatus 100 may obtain information about the size of the processing block from the bitstream for each of the various data units, and the video decoding apparatus 100 may divide the picture using the obtained information about the size of the processing block.
- a size of at least one processing block can be determined, and the size of the processing block can be an integer multiple of the reference coding unit.
- the video decoding apparatus 100 may determine the sizes of the processing blocks 2302 and 2312 included in the picture 2300. For example, the video decoding apparatus 100 may determine the size of the processing block based on the information about the size of the processing block obtained from the bitstream. Referring to FIG. 23, the video decoding apparatus 100 may increase the horizontal sizes of the processing blocks 2302 and 2312 to four times the horizontal size of the reference coding unit and four times the vertical size of the reference coding unit, according to an exemplary embodiment. You can decide. The video decoding apparatus 100 may determine an order in which at least one reference coding unit is determined in at least one processing block.
- the video decoding apparatus 100 may determine each processing block 2302 and 2312 included in the picture 2300 based on the size of the processing block, and include the processing block 2302 and 2312 in the processing block 2302 and 2312.
- a determination order of at least one reference coding unit may be determined.
- the determination of the reference coding unit may include the determination of the size of the reference coding unit.
- the video decoding apparatus 100 may obtain information about a determination order of at least one reference coding unit included in at least one processing block from a bitstream, and based on the obtained determination order The order in which at least one reference coding unit is determined may be determined.
- the information about the determination order may be defined in an order or direction in which reference coding units are determined in the processing block. That is, the order in which the reference coding units are determined may be independently determined for each processing block.
- the video decoding apparatus 100 may obtain information on a determination order of a reference coding unit from a bitstream for each specific data unit.
- the video decoding apparatus 100 may obtain information about a determination order of a reference coding unit from a bitstream for each data unit such as an image, a sequence, a picture, a slice, a slice segment, and a processing block. Since the information about the determination order of the reference coding unit indicates the determination order of the reference coding unit in the processing block, the information about the determination order may be obtained for each specific data unit including an integer number of processing blocks.
- the video decoding apparatus 100 may determine at least one reference coding unit based on the determined order according to an embodiment.
- the video decoding apparatus 100 may obtain information on a reference coding unit determination order from the bitstream as information related to the processing blocks 2302 and 2312, and the video decoding apparatus 100 may process the processing.
- An order of determining at least one reference coding unit included in blocks 2302 and 2312 may be determined, and at least one reference coding unit included in the picture 2300 may be determined according to the determination order of the coding units.
- the video decoding apparatus 100 may determine determination orders 2304 and 2314 of at least one reference coding unit associated with each processing block 2302 and 2312. For example, when information about the determination order of the reference coding unit is obtained for each processing block, the reference coding unit determination order associated with each processing block 2302 and 2312 may be different for each processing block.
- the reference coding unit included in the processing block 2302 may be determined according to the raster scan order.
- the reference coding unit determination order 2314 associated with the other processing block 2312 is the reverse order of the raster scan order
- the reference coding units included in the processing block 2312 may be determined according to the reverse order of the raster scan order.
- the video decoding apparatus 100 may decode at least one determined reference coding unit according to an embodiment.
- the video decoding apparatus 100 may decode an image based on the reference coding unit determined through the above-described embodiment.
- the method of decoding the reference coding unit may include various methods of decoding an image.
- the video decoding apparatus 100 may obtain and use block shape information indicating a shape of a current coding unit or split shape information indicating a method of dividing a current coding unit from a bitstream.
- Block type information or split type information may be included in a bitstream associated with various data units.
- the video decoding apparatus 100 may include a sequence parameter set, a picture parameter set, a video parameter set, a slice header, and a slice segment header. block type information or segmentation type information included in a segment header) may be used.
- the video decoding apparatus 100 may obtain and use syntax corresponding to block type information or split type information from the bitstream from the bitstream for each maximum coding unit, reference coding unit, and processing block.
- the above-described embodiments of the present invention can be written as a program that can be executed in a computer, and can be implemented in a general-purpose digital computer that operates the program using a computer-readable recording medium.
- the computer-readable recording medium may include a storage medium such as a magnetic storage medium (eg, a ROM, a floppy disk, a hard disk, etc.) and an optical reading medium (eg, a CD-ROM, a DVD, etc.).
Landscapes
- Engineering & Computer Science (AREA)
- Multimedia (AREA)
- Signal Processing (AREA)
- Computing Systems (AREA)
- Theoretical Computer Science (AREA)
- Compression Or Coding Systems Of Tv Signals (AREA)
Abstract
일 실시예에 따라, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하고, 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하고, 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하고, 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 비디오 부호화 방법이 제안된다.
Description
본 개시는 비디오 복호화 방법 및 비디오 복호화 장치에 관한 것으로, 시간적 주변 블록과 공간적 주변 블록을 포함하는 머지 후보 리스트를 이용하여 인터 예측을 수행하는 방법 및 장치를 제안한다.
영상 데이터는 소정의 데이터 압축 표준, 예를 들면 MPEG(Moving Picture Expert Group) 표준에 따른 코덱에 의하여 부호화된 후 비트스트림의 형태로 기록매체에 저장되거나 통신 채널을 통해 전송된다.
고해상도 또는 고화질 영상 컨텐트를 재생, 저장할 수 있는 하드웨어의 개발 및 보급에 따라, 고해상도 또는 고화질 영상 컨텐트를 효과적으로 부호화 또는 복호화 하는 코덱(codec)의 필요성이 증대하고 있다. 부호화된 영상 컨텐트는 복호화됨으로써 재생될 수 있다. 최근에는 이러한 고해상도 또는 고화질 영상 컨텐트를 효과적으로 압축하기 위한 방법들이 실시되고 있다. 예를 들면, 부호화 하려는 영상을 임의적 방법으로 분할하거나, 데이터를 조작하 과정을 통해 영상 압축 기술이 효과적으로 구현될 수 있도록 제안되고 있다.
시간적으로 연속되는 영상들을 포함하는 비디오를 부호화하기 위해서 가장 널리 사용되는 기법은 예측 기법이다. 비디오 부호화/복호화 기술에서 예측 기법이란, 영상 내의 현재 블록과 유사한 성향을 가지는 정보를 가지는 블록을 이용하여 현재 블록의 데이터를 부호화하는 기법이다. 현재 블록의 데이터를 직접 부호화한다면 부호화로 인해 생성되는 데이터량이 상대적으로 많기 때문에, 이미 부호화된 다른 블록의 데이터와 현재 블록의 데이터 사이의 차이 정보만을 부호화하고, 부호화로 인해 생성된 데이터를 전송 또는 저장하는 것이다.
예측 기법을 통해 현재 블록의 데이터를 부호화하여 생성된 정보를, 예측 정보라 정의할 수 있다. 이 때, 현재 블록을 부호화하는데 이용된 다른 블록을 가리키는 정보도 예측 정보로서 부호회되어 전송 또는 저장된다.
예측 기법에서는, 현재 블록을 부호화하는데 이용된 다른 블록을 결정하는 과정이 선행된다. 예측 기법에 따르면 현재 블록과 유사한 성향을 가지는 정보를 이용하여 현재 블록이 예측되기 때문에, 현재 영상 내에서 현재 블록에 공간적으로 인접하는 이웃 샘플이 이용되거나, 공간적으로 인접하는 이웃 블록, 시간적으로 다른 영상 내의 콜로케이티드 블록(Collocated Block)이 이용된다.
예측 기법 중에서 인트라 예측 기법에 따르면, 현재 블록에 공간적으로 인접하는 이웃 샘플값을 이용하여 현재 블록의 샘플값이 결정될 수 있다.
또 다른 예측 기법으로서 인터 예측 기법에 따르면, 이웃 블록 또는 콜로케이티드 블록와 같은 주변 블록의 예측 정보를 이용하여 현재 블록의 움직임 정보가 결정된다. 현재 블록의 움직임 정보가 가리키는 참조 블록의 샘플값을 이용하여 현재 블록의 샘플값이 결정될 수 있다.
인터 예측 기법 중에서 스킵 모드(SKIP mode), 머지 모드(MERGE mode), AMVP 모드(Advanced Motion Vector Prediction mode) 중 어느 모드인지 여부에 따라, 이웃 블록 또는 콜로케이티드 블록의 예측 정보 중에서 현재 블록의 예측 정보로서 참조할 정보의 범위가 달라질 수 있다.
특히 스킵 모드 또는 머지 모드의 경우, 인터 예측에 이용될 주변 블록을 결정하기 위해 머지 후보 리스트(Merge Candidate List)가 이용된다. 머지 후보 리스트에 포함된 적어도 하나의 후보 블록 중에서 하나의 움직임 정보를 이용하여, 현재 블록의 움직임 정보가 결정될 수 있다.
본 개시에서 해결하고자 하는 기술적 과제는, 비디오 부호화 장치 또는 복호화 장치, 인터 예측에서 이용될 머지 후보 리스트를 효과적으로 결정하는 방법을 제공하는데 있다.
본 개시에서 제안하는 일 실시예에 따른 비디오 부호화 방법은, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하는 단계; 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계; 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계; 및 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 단계를 포함할 수 있다. 상기 인터 머지 후보는, 상기 현재 블록에 공간적으로 인접하는 주변 블록 및 상기 현재 블록의 시간적으로 인접하는 픽처 내에서 상기 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록이고, 상기 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록일 수 있다.
본 개시에서 제안하는 일 실시예에 따른 비디오 복호화 장치는, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하고, 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 머지 후보 리스트 결정부; 및 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하고, 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 복호화부를 포함할 수 있다.
본 개시에서 제안하는 일 실시예에 따른 비디오 부호화 방법은, 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계; 상기 생성된 머지 후보 리스트 중에서 상기 현재 블록의 예측 샘플들을 생성하기 위해 선택된 예측 후보를 가리키는 머지 후보 인덱스를 생성하는 단계; 상기 현재 블록의 예측 샘플들과 상기 현재 블록 간의 잔차 샘플들 및 상기 머지 후보 인덱스를 부호화하고, 상기 부호화된 정보를 포함하는 비트스트림을 생성하는 단계를 포함할 수 있다.
본 개시에서 제안하는 일 실시예에 따른 컴퓨터에 의해 판독 가능한 기록매체는, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하는 단계; 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계; 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계; 및 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 단계를 포함하는 비디오 복호화 방법을 구현하기 위한 컴퓨터 프로그램이 기록된 기록매체일 수 있다.
본 개시에서 제안하는 일 실시예에 따른 컴퓨터에 의해 판독 가능한 기록매체는, 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계; 상기 생성된 머지 후보 리스트 중에서 상기 현재 블록의 예측 샘플들을 생성하기 위해 선택된 예측 후보를 가리키는 머지 후보 인덱스를 생성하는 단계; 상기 현재 블록의 예측 샘플들과 상기 현재 블록 간의 잔차 샘플들 및 상기 머지 후보 인덱스를 부호화하고, 상기 부호화된 정보를 포함하는 비트스트림을 생성하는 단계를 포함하는 비디오 부호화 방법을 구현하기 위한 컴퓨터 프로그램이 기록된 기록매체일 수 있다.
도 1a은 일 실시예에 따른 비디오 복호화 장치의 블록도를 도시한다.
도 1b은 일 실시예에 따른 비디오 복호화 방법의 흐름도를 도시한다.
도 2a은 일 실시예에 따른 비디오 부호화 장치의 블록도를 도시한다.
도 2b은 일 실시예에 따른 비디오 부호화 방법의 흐름도를 도시한다.
도 3a은 머지 후보 리스트에 포함될 수 있는 인터 머지 후보들을 도시한다.
도 3b 및 3c는 일 실시예에 따라 머지 후보 리스트에 포함될 수 있는 인트라 머지 후보들을 도시한다.
도 4는 일 실시예에 따라 인터 머지 후보와 인트라 머지 후보가 동시에 포함된 머지 후보 리스트를 도시한다.
도 5는 일 실시예에 따라 인터 머지 후보가 포함된 인터 머지 후보 리스트와 인트라 머지 후보가 포함된 인트라 머지 후보 리스트를 도시한다.
도 6a, 6b 및 6c은 일 실시예에 따라 인터 머지 후보와 인트라 머지 후보의 가중평균된 예측 샘플값이 인터-인트라 머지 후보로서 포함된 인트라 머지 후보 리스트를 도시한다.
도 7은 일 실시예에 따라 인터 머지 후보와 인터-인트라 머지 후보가 포함된 머지 후보 리스트를 도시한다.
도 8은 일 실시예에 따라 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보가 포함된 인트라 머지 후보 리스트를 도시한다.
도 9는 일 실시예에 따라 인트라 머지 정보를 시그널링하기 위한 신택스를 도시한다.
도 10은 일 실시예에 따라 현재 부호화 단위가 분할되어 적어도 하나의 부호화 단위가 결정되는 과정을 도시한다.
도 11은 일 실시예에 따라 비-정사각형의 형태인 부호화 단위가 분할되어 적어도 하나의 부호화 단위가 결정되는 과정을 도시한다.
도 12는 일 실시예에 따라 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위가 분할되는 과정을 도시한다.
도 13은 일 실시예에 따라 홀수개의 부호화 단위들 중 소정의 부호화 단위가 결정되는 방법을 도시한다.
도 14는 일 실시예에 따라 현재 부호화 단위가 분할되어 복수개의 부호화 단위들이 결정되는 경우, 복수개의 부호화 단위들이 처리되는 순서를 도시한다.
도 15는 일 실시예에 따라 소정의 순서로 부호화 단위가 처리될 수 없는 경우, 현재 부호화 단위가 홀수개의 부호화 단위로 분할되는 것으로 결정되는 과정을 도시한다.
도 16은 일 실시예에 따라 제1 부호화 단위가 분할되어 적어도 하나의 부호화 단위가 결정되는 과정을 도시한다.
도 17은 일 실시예에 따라 제1 부호화 단위가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위가 소정의 조건을 만족하는 경우, 제2 부호화 단위가 분할될 수 있는 형태가 제한되는 것을 도시한다.
도 18은 일 실시예에 따라 분할 형태 정보가 4개의 정사각형 형태의 부호화 단위로 분할하는 것을 나타낼 수 없는 경우, 정사각형 형태의 부호화 단위가 분할되는 과정을 도시한다
도 19는 일 실시예에 따라 복수개의 부호화 단위들 간의 처리 순서가 부호화 단위의 분할 과정에 따라 달라질 수 있음을 도시한 것이다.
도 20은 일 실시예에 따라 부호화 단위가 재귀적으로 분할되어 복수개의 부호화 단위가 결정되는 경우, 부호화 단위의 형태 및 크기가 변함에 따라 부호화 단위의 심도가 결정되는 과정을 도시한다.
도 21은 일 실시예에 따라 부호화 단위들의 형태 및 크기에 따라 결정될 수 있는 심도 및 부호화 단위 구분을 위한 인덱스(part index, 이하 PID)를 도시한다.
도 22는 일 실시예에 따라 픽쳐에 포함되는 복수개의 소정의 데이터 단위에 따라 복수개의 부호화 단위들이 결정된 것을 도시한다.
도 23은 일 실시예에 따라 픽쳐에 포함되는 기준 부호화 단위의 결정 순서를 결정하는 기준이 되는 프로세싱 블록을 도시한다.
본 개시에서 제안하는 일 실시예에 따른 비디오 부호화 방법은, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하는 단계; 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계; 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계; 및 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 단계를 포함할 수 있다. 상기 인터 머지 후보는, 상기 현재 블록에 공간적으로 인접하는 주변 블록 및 상기 현재 블록의 시간적으로 인접하는 픽처 내에서 상기 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록이고, 상기 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록일 수 있다.
본 개시에서 제안하는 일 실시예에 따른 비디오 복호화 장치는, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하고, 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 머지 후보 리스트 결정부; 및 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하고, 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 복호화부를 포함할 수 있다.
본 개시에서 제안하는 일 실시예에 따른 비디오 부호화 방법은, 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계; 상기 생성된 머지 후보 리스트 중에서 상기 현재 블록의 예측 샘플들을 생성하기 위해 선택된 예측 후보를 가리키는 머지 후보 인덱스를 생성하는 단계; 상기 현재 블록의 예측 샘플들과 상기 현재 블록 간의 잔차 샘플들 및 상기 머지 후보 인덱스를 부호화하고, 상기 부호화된 정보를 포함하는 비트스트림을 생성하는 단계를 포함할 수 있다.
본 명세서에서 개시된 실시예의 이점 및 특징, 그리고 그것들을 달성하는 방법은 첨부되는 도면과 함께 후술되어 있는 실시예들을 참조하면 명확해질 것이다. 그러나 본 개시에서 제안하고자 하는 실시예는 이하에서 개시되는 실시예들에 한정되는 것이 아니라 서로 다른 다양한 형태로 구현될 수 있으며, 단지 본 실시예들은 당해 기술분야에서 통상의 지식을 가진 자에게 실시예들의 범주를 완전하게 알려주기 위해 제공되는 것일 뿐이다.
본 명세서에서 사용되는 용어에 대해 간략히 설명하고, 개시된 실시예에 대해 구체적으로 설명하기로 한다.
본 명세서에서 사용되는 용어는 개시된 실시예들의 기능을 고려하면서 가능한 현재 널리 사용되는 일반적인 용어들을 선택하였으나, 이는 관련 분야에 종사하는 기술자의 의도 또는 판례, 새로운 기술의 출현 등에 따라 달라질 수 있다. 또한, 특정한 경우는 출원인이 임의로 선정한 용어도 있으며, 이 경우 해당되는 명세서의 상세한 설명 부분에서 상세히 그 의미를 기재할 것이다. 따라서 본 개시에서 사용되는 용어는 단순한 용어의 명칭이 아닌, 그 용어가 가지는 의미와 본 명세서의 전반에 걸친 내용을 토대로 정의되어야 한다.
본 명세서에서의 단수의 표현은 문맥상 명백하게 단수인 것으로 특정하지 않는 한, 복수의 표현을 포함한다.
명세서 전체에서 어떤 부분이 어떤 구성요소를 "포함"한다고 할 때, 이는 특별히 반대되는 기재가 없는 한 다른 구성요소를 제외하는 것이 아니라 다른 구성요소를 더 포함할 수 있음을 의미한다. 또한, 명세서에서 사용되는 "부"라는 용어는 소프트웨어, FPGA 또는 ASIC과 같은 하드웨어 구성요소를 의미하며, "부"는 어떤 역할들을 수행한다. 그렇지만 "부"는 소프트웨어 또는 하드웨어에 한정되는 의미는 아니다. "부"는 어드레싱할 수 있는 저장 매체에 있도록 구성될 수도 있고 하나 또는 그 이상의 프로세서들을 재생시키도록 구성될 수도 있다. 따라서, 일 예로서 "부"는 소프트웨어 구성요소들, 객체지향 소프트웨어 구성요소들, 클래스 구성요소들 및 태스크 구성요소들과 같은 구성요소들과, 프로세스들, 함수들, 속성들, 프로시저들, 서브루틴들, 프로그램 코드의 세그먼트들, 드라이버들, 펌웨어, 마이크로 코드, 회로, 데이터, 데이터베이스, 데이터 구조들, 테이블들, 어레이들 및 변수들을 포함한다. 구성요소들과 "부"들 안에서 제공되는 기능은 더 작은 수의 구성요소들 및 "부"들로 결합되거나 추가적인 구성요소들과 "부"들로 더 분리될 수 있다.
이하, "영상"은 비디오의 정지영상와 같은 정적 이미지이거나 동영상, 즉 비디오 그 자체와 같은 동적 이미지를 나타낼 수 있다.
이하 "샘플"은, 영상의 샘플링 위치에 할당된 데이터로서 프로세싱 대상이 되는 데이터를 의미한다. 예를 들어, 공간영역의 영상에서 픽셀값, 변환 영역 상의 변환 계수들이 샘플들일 수 있다. 이러한 적어도 하나의 샘플들을 포함하는 단위를 블록이라고 정의할 수 있다.
아래에서는 첨부한 도면을 참고하여 실시예에 대하여 본 발명이 속하는 기술 분야에서 통상의 지식을 가진 자가 용이하게 실시할 수 있도록 상세히 설명한다. 그리고 도면에서 본 발명을 명확하게 설명하기 위해서 설명과 관계없는 부분은 생략한다.
이하 도 1 내지 도 23을 참조하여 일 실시예에 따른 비디오 부호화 장치 및 비디오 복호화 장치, 비디오 부호화 방법 및 비디오 복호화 방법이 상술된다. 도 1 내지 도 9를 참조하여 일 실시예에 따라 결정된 머지 후보 리스트를 이용하여 인터 예측을 수행하는 방법 및 장치가 후술되고, 도 10 내지 도 23을 참조하여 일 실시예에 따른 영상의 데이터 단위를 결정하는 방법이 후술된다.
이하 도 1a 내지 도 9를 참조하여 본 명세서에서 개시된 일 실시예에 따라 영상의 블록을 부호화하거나 복호화하기 위해 인터 예측을 수행하는 방법 및 장치가 상술된다.
도 1a은 일 실시예에 따른 비디오 복호화 장치(100)의 블록도를 도시한다.
일 실시예에 따른 비디오 복호화 장치(100)는 머지 후보 리스트 결정부(110) 및 복호화부(120)를 포함할 수 있다. 일 실시예에 따른 비디오 복호화 장치(100)는 머지 후보 리스트 결정부(110) 및 복호화부(120)는 개별적인 프로세서로서 작동하거나, 중앙 프로세서의 제어에 의해 작동될 수 있다. 또한, 도 1a에 도시되지 않았지만, 비디오 복호화 장치(100)는, 외부로부터 수신한 데이터와, 머지 후보 리스트 결정부(110) 및 복호화부(120)에 의해 생성된 데이터를 저장하기 위한 메모리 또는 스토리지를 더 포함할 수 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 스킵 모드 또는 머지 모드에 따른 인터 예측을 수행할 수 있다. 일 실시예에 따른 머지 후보 리스트 결정부(110)는, 스킵 모드 또는 머지 모드에 따른 인터 예측을 수행하기 위해, 적어도 하나의 머지 후보를 포함하는 머지 후보 리스트를 결정할 수 있다.
일 실시예에 따라 머지 후보 리스트에 포함되는 머지 후보는, 현재 블록에 공간적으로 인접하는 이웃 블록 및 현재 블록의 시간적으로 인접하는 픽처 내에서 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 기초하여 결정되는 예측 블록일 수 있다. 본 명세서에서는, 이웃 블록 및 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록이, "인터 머지 후보"라고 지칭된다.
본 명세서에서는, "인터 머지 후보"와 대비되는 개념으로서 "인트라 머지 후보"가 제안된다. 일 실시예에 따르면 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록이 머지 후보로서 사용될 수 있다. 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록이 머지 후보로 사용되는 경우, 본 명세서에서는 이러한 머지 후보가 "인트라 머지 후보"라 지칭된다.
추후 도 3a을 참조하여 인터 머지 후보를 예시하고, 도 3b 및 3c를 참조하여 인트라 머지 후보를 예시한다.
일 실시예에 따른 머지 후보 리스트 결정부(110)는, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정할 수 있다. 머지 후보 리스트 결정부(110)는, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함할 수 있다.
일 실시예에 따른 복호화부(12)는, 머지 후보 리스트 결정부(110)에서 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여, 현재 블록의 예측 샘플들을 생성할 수 있다. 복호화부(12)는, 현재 블록의 예측 샘플들과 현재 블록의 잔차 샘플들을 이용하여, 현재 블록을 복원할 수 있다.
이하 도 1b를 참조하여 일 실시예에 따른 비디오 복호화 장치(100)의 구체적인 동작을 상술한다.
도 1b은 일 실시예에 따른 비디오 복호화 방법의 흐름도를 도시한다.
단계 s130에서, 비디오 복호화 장치(100)는, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정할 수 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 스킵 모드 또는 머지 모드로 인터 예측을 수행할 때, 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 나타내는 인트라 머지 정보를, 비트스트림으로부터 획득할 수 있다.
예를 들어, 비디오 복호화 장치(100)는 비트스트림에 대해 엔트로피 복호화를 수행하여, 현재 블록를 위한 예측 모드 플래그를 획득할 수 있다. 예측 모드 플래그가 인트라 예측이 아닌 예측 모드를 가리키는 경우에, 비디오 복호화 장치(100)는 비트스트림으로부터 현재 블록를 위한 스킵 플래그를 파싱할 수 있다.
예를 들어, 스킵 플래그가 스킵 모드에 따른 인터 예측을 나타내는 경우에 비디오 복호화 장치(100)는 비트스트림으로부터 머지 플래그를 더 이상 파싱하지 않는다. 다만, 스킵 플래그가 스킵 모드에 따른 인터 예측을 나타내지 않는 경우에 비디오 복호화 장치(100)는 비트스트림으로부터 머지 플래그를 더 파싱할 수 있다. 머지 플래그가 머지 모드에 따른 인터 예측을 나타낼 때, 비디오 복호화 장치(100)는 비트스트림으로부터 인트라 머지 정보를 더 파싱할 수 있다.
다른 예로, 스킵 플래그가 스킵 모드에 따른 인터 예측을 나타내는 경우 및 머지 플래그가 머지 모드에 따른 인터 예측을 나타내는 경우에, 비디오 복호화 장치(100)는 비트스트림으로부터 인트라 머지 정보를 더 파싱할 수 있다.
일 실시예에 따른 인트라 머지 정보에 따라 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 비디오 복호화 장치(100)는, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정할 수 있다.
일 실시예에 따른 인트라 머지 정보에 따라, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하는 인트라 머지 후보가 머지 후보 리스트에 포함될 수 없는 경우에, 비디오 복호화 장치(100)는, 현재 블록의 인트라 머지 후보를 포함하지 않는 머지 후보 리스트를 결정할 수 있다. 즉, 인터 머지 후보만을 포함하는 머지 후보 리스트가 결정될 수 있다.
일 실시예에 따라 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 단계 s140에서 비디오 복호화 장치(100)는, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정할 수 있다. 단계 s150에서 비디오 복호화 장치(100)는, 단계 s140에서 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다.
일 실시예에 따른 인터 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 블록 및 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록일 수 있다. 콜로케이티드 블록은, 현재 영상 내에서 현재 블록의 위치에 대응하여, 현재 블록의 시간적으로 인접하는 픽처 내에 위치하는 블록일 수 있다. 따라서, 현재 블록의 주변 블록 및 콜로케이티드 블록 중 적어도 하나의 블록의 움직임 정보를 이용하여, 현재 블록의 움직임 정보를 예측하고, 예측된 움직임 정보가 가리키는 참조 블록의 샘플값들을 이용하여 현재 블록의 예측 샘플들을 결정할 수 있다. 따라서 인터 머지 후보에 따른 예측 블록은, 상기 참조 블록의 샘플값을 이용하여 결정된 예측 샘플값들을 포함하는 블록일 수 있다.
일 실시예에 따른 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록일 수 있다. 현재 블록의 외부에 위치하면서 현재 블록 내의 최외곽 샘플들에 인접하는 샘플들의 샘플값을 이용하여 결정된 샘플값들을 포함하는 블록이 예측 블록으로 결정되고, 이러한 예측 블록이 인트라 머지 후보로서 머지 후보 리스트에 포함될 수 있다.
예를 들어, 현재 블록에 공간적으로 소정 개수의 소정 방향으로 인접하는 주변 샘플들을 이용하여, 인트라 머지 후보가 결정될 수 있다. 다른 예로, 비트스트림으로부터 획득된 MPM (most probable mode) 인덱스가 가리키는 방향으로부터 결정되는 소정 개수의 소정 방향으로 인접하는 주변 샘플들을 이용하여, 인트라 머지 후보가 결정될 수 있다. 예를 들어 MPM 인덱스는, 현재 블록의 인트라 예측을 위해 이용될 수 있는 소정 개수의 인트라 예측 모드들 중에서 하나의 인트라 예측 모드를 가리킬 수 있다. 소정 개수의 인트라 예측 모드들은 주변 블록의 인트라 예측 모드와 특정 인트라 예측 모드를 포함할 수 있다.
또 다른 예로, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 인트라 머지 후보에 따른 샘플값과, 적어도 하나의 인터 머지 후보에 따른 예측 샘플값의 가중평균값으로 결정된 샘플들을, 인터-인트라 머지 후보로서 결정하고, 머지 후보 리스트에 인터-인트라 머지 후보를 포함시킬 수 있다.
비디오 복호화 장치(100)는, 머지 후보 리스트 중에서 하나의 후보를 가리키는 머지 후보 인덱스를, 비트스트림으로부터 획득할 수 있다. 비디오 복호화 장치(100)는, 머지 후보 리스트 중에서 머지 후보 인덱스가 가리키는 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 적어도 하나의 인터 머지 후보를 포함하는 인터 머지 후보 리스트를 결정하고, 적어도 하나의 인트라 머지 후보를 포함하는 인트라 머지 후보 리스트를 결정할 수 있다. 인트라 머지 후보 리스트는 인터-인트라 머지 후보를 더 포함할 수도 있다. 이에 따라 일 실시예에 따른 비디오 복호화 장치(100)는, 인터 머지 후보 리스트 및 인트라 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다. 이 경우, 인터 머지 후보 리스트의 후보들과 인트라 머지 후보 리스트의 후보들 중 하나를 가리키는 머지 후보 인덱스를 이용하여, 예측 샘플들을 결정할 수 있다.
다른 실시예에 따른 비디오 복호화 장치(100)는, 인터 머지 후보와 인트라 머지 후보 및 인터-인트라 머지 후보 중 적어도 하나를 포함하는 하나의 머지 후보 리스트를 결정할 수 있다. 하나의 머지 후보 리스트는 인터-인트라 머지 후보를 더 포함할 수도 있다. 이에 따라 비디오 복호화 장치(100)는, 하나의 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다. 이 경우, 하나의 머지 후보 리스트에 포함된 머지 후보들 중에서 하나를 가리키는 머지 후보 인덱스를 이용하여, 예측 샘플들을 결정할 수 있다.
추후 도 4, 5, 6a, 6b, 6c, 7 및 8을 참조하여, 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 예시한다.
비디오 복호화 장치(100)는, 머지 후보 리스트 중에서 머지 후보 인덱스가 가리키는 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 인터 머지 후보에 따라 인터 예측을 수행하는 경우, 비트스트림으로부터 움직임 벡터 차분(mvd; motion vector differential) 정보를 획득할 수 있다. 비디오 복호화 장치(100)는, 획득된 머지 후보 인덱스에 기초하여, 머지 후보 리스트 중에서 하나의 후보를 결정할 수 있다. 결정된 후보가 인터 머지 후보인 경우에, 후보 블록의 예측 방향 (L0 또는 L1), 참조 인덱스, 움직임 벡터를 이용하여, 현재 블록의 예측 방향 (L0 또는 L1), 참조 인덱스, 움직임 벡터 프리딕터(motion vector predictor; mvp)를 각각 결정할 수 있다. 움직임 벡터 프리딕터(mvp)와 움직임 벡터 차분값을 합하여, 현재 블록의 움직임 벡터가 결정될 수 있다. 현재 블록의 움직임 벡터가 가리키는 참조 블록의 샘플값들을 현재 블록의 인터 머지 후보에 따른 예측 샘플값들로서 결정할 수 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 인트라 머지 후보에 따라 인터 예측을 수행하는 경우에는, 비트스트림으로부터 인트라 예측 방향을 나타내는 인트라 예측 모드 정보를 획득할 수 있다. 비디오 복호화 장치(100)는, 인트라 예측 모드가 가리키는 주변 샘플값들을 이용하여 현재 블록의 인트라 머지 후보에 따른 예측 샘플값들을 결정할 수 있다. 인트라 머지 후보에 따른 주변 샘플들은 도 3b를 참조하여 후술하고, 인트라 예측 방향 및 인트라 예측 모드에 대해서는 도 3c를 참조하여 후술한다.
단계 s160에서, 비디오 복호화 장치(100)는 현재 블록의 예측 샘플들과 현재 블록의 잔차 샘플들을 이용하여, 현재 블록을 복원할 수 있다. 비디오 복호화 장치(100)는 비트스트림에 대해 엔트로피 복호화를 수행하여, 블록들의 잔차 신호를 블록 스캔 순서 및 블록 내의 샘플들의 스캔 순서에 따라 파싱하여, 현재 블록의 잔차 신호를 획득할 수 있다. 비디오 복호화 장치(100)는, 현재 블록의 잔차 신호들에 대해 역양자화 및 역변환을 수행하여 현재 블록의 공간 영역의 잔차 샘플들을 복원할 수 있다.
비디오 복호화 장치(100)는 인터 예측을 수행하여 결정한 현재 블록의 예측 샘플들에 복원된 현재 블록의 잔차 샘플들을 더함으로써, 현재 블록의 샘플들을 복원할 수 있다. 비디오 복호화 장치(100)는 블록들마다 샘플들을 복원하여 현재 영상을 복원할 수 있다.
도 2a은 일 실시예에 따른 비디오 부호화 장치(200)의 블록도를 도시한다.
일 실시예에 따른 비디오 부호화 장치(200)는, 인터 예측부(210) 및 부호화부(220)를 포함한다. 일 실시예에 따른 비디오 부호화 장치(200)는 인터 예측부(210) 및 부호화부(220)는 개별적인 프로세서로서 작동하거나, 중앙 프로세서의 제어에 의해 작동될 수 있다. 또한, 도 2a에 도시되지 않았지만, 비디오 부호화 장치(200)는, 부호화 과정에서 생성되는 데이터와, 인터 예측부(210) 및 부호화부(220)에 의해 생성된 데이터를 저장하기 위한 메모리 또는 스토리지를 더 포함할 수 있다.
일 실시예에 따른 비디오 부호화 장치(200)는, 스킵 모드 또는 머지 모드에 따른 인터 예측을 수행할 수 있다. 일 실시예에 따른 인터 예측부(210)는, 스킵 모드 또는 머지 모드에 따른 인터 예측을 수행하기 위해, 적어도 하나의 머지 후보를 포함하는 머지 후보 리스트를 결정할 수 있다.
일 실시예에 따른 인터 예측부(210)는, 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정할 수 있다.
일 실시예에 따라 스킵 모드 또는 머지 모드로 인터 예측을 수행하기 위해 이용되는 머지 후보 리스트는, 머지 후보로서 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보 중 적어도 하나를 포함할 수 있다. 앞서 정의한 바와 같이 일 실시예에 따른 인터 머지 부호는, 현재 블록의 이웃 블록 및 콜로케이티드 블록 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록을 포함할 수 있다. 또한, 일 실시예에 따른 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록을 포함할 수 있다. 일 실시예에 따른 인터-인트라 머지 후보는, 인터 머지 후보에 따른 예측 샘플값과 인트라 머지 후보에 따른 예측 샘플값의 가중 평균값을 예측 샘플값으로 취하는 예측 블록을 포함할 수 있다.
일 실시예에 따른 인터 예측부(210)는, 머지 후보 리스트 중에서 현재 블록의 예측 샘플들을 생성하기 위해 선택된 예측 후보를 가리키는 머지 후보 인덱스를 생성할 수 있다.
일 실시예에 따른 부호화부(220)는, 현재 블록의 예측 샘플들과 현재 블록 간의 잔차 샘플들 및 머지 후보 인덱스를 부호화하고, 부호화된 정보를 포함하는 비트스트림을 생성할 수 있다.
이하 도 2b를 참조하여 일 실시예에 따른 비디오 부호화 장치(200)의 구체적인 동작을 상술한다.
도 2b은 일 실시예에 따른 비디오 부호화 방법의 흐름도를 도시한다.
단계 s230에서, 비디오 부호화 장치(200)는, 스킵 모드 또는 머지 모드로 인터 예측을 수행할 때, 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정할 수 있다. 단계 s240에서, 비디오 부호화 장치(200)는 단계 s230에서 생성된 머지 후보 리스트 중에서 현재 블록의 예측 샘플들을 생성하기 위해 선택된 예측 후보를 가리키는 머지 후보 인덱스를 결정하고, 머지 후보 인덱스를 나타내는 값을 부호화할 수 있다.
일 실시예에 따른 비디오 부호화 장치(200)에서 사용되는 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보는, 앞서 다양한 실시예에 따른 비디오 복호화 장치(100)에서 설명한 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보와 각각 상응하므로, 중복되는 설명은 생략한다.
일 실시예에 따른 비디오 부호화 장치(200)는, 적어도 하나의 인터 머지 후보를 포함하는 인터 머지 후보 리스트를 결정하고, 적어도 하나의 인트라 머지 후보를 포함하는 인트라 머지 후보 리스트를 결정할 수 있다. 인트라 머지 후보 리스트는 인터-인트라 머지 후보를 더 포함할 수도 있다. 이에 따라 일 실시예에 따른 비디오 부호화 장치(200)는, 인터 머지 후보 리스트 및 인트라 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다. 이 경우 비디오 부호화 장치(200)는, 인터 머지 후보 리스트의 후보들과 인트라 머지 후보 리스트의 후보들 중 하나를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
다른 실시예에 따른 비디오 부호화 장치(200)는, 적어도 하나의 인터 머지 후보와 적어도 하나의 인트라 머지 후보를 포함하는 하나의 머지 후보 리스트를 결정할 수 있다. 하나의 머지 후보 리스트는 인터-인트라 머지 후보를 더 포함할 수도 있다. 이에 따라 비디오 부호화 장치(200)는, 하나의 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 현재 블록의 예측 샘플들을 생성할 수 있다. 이 경우 비디오 부호화 장치(200)는, 하나의 머지 후보 리스트에 포함된 머지 후보들 중에서 하나를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
일 실시예에 따른 비디오 부호화 장치(200)는 머지 후보 리스트에 포함된 후보에 기초하여 인터 예측을 수행하고, 후보마다 인터 예측에 의해 발생하는 RD(rate-distortion) 코스트를 비교할 수 있다. 일 실시예에 따른 비디오 부호화 장치(200)는, 후보들 중에서 최소의 RD 코스트를 발생시키는 머지 후보를 선택하고, 머지 후보 리스트에 포함되는 머지 후보들 중에서 상기 선택된 머지 후보를 가리키는 머지 후보 인덱스를 결정할 수 있다.
단계 s250에서, 비디오 부호화 장치(200)는, 현재 블록의 예측 샘플들과 현재 블록 간의 잔차 샘플들 및 머지 후보 인덱스를 부호화할 수 있다. 예를 들어, 현재 블록의 잔차 샘플들과 머지 후보 인덱스에 대해 각각 엔트로피 부호화를 수행하고, 부호화하여 생성된 비트들을 포함하는 비트스트림을 생성할 수 있다. 또한, 비디오 부호화 장치(200)는, 현재 블록의 샘플들에 대해 변환 및 양자화를 수행하여 샘플들의 양자화된 변환 계수들을 생성하고, 양자화된 변환 계수들에 대해 역양자화 및 역변환을 수행하여, 공간 영역의 샘플들을 복원할 수 있다. 비디오 부호화 장치(200)는, 예측 모드에 따라 결정된 현재 블록의 예측 샘플들과 현재 블록의 복원된 샘플들 간의 차분 값인 잔차 샘플들을 결정할 수 있다.
또한 비디오 부호화 장치(200)는, 인트라 머지 후보가 머지 후보 리스트에 포함되는지 여부를 선택적으로 결정할 수도 있다. 이에 따라 비디오 부호화 장치(200)는, 인트라 머지 후보가 머지 후보 리스트에 포함되는지 여부를 나타내는 인트라 머지 정보를 생성할 수도 있다. 비디오 부호화 장치(200)는, 인트라 머지 정보를 부호화하고, 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 머지 후보 인덱스를 부호화할 수 있다.
또한, 비디오 부호화 장치(200)는 현재 블록를 위한 예측 모드 플래그를 더 부호화할 수 있다. 현재 블록의 예측 모드가 인트라 예측 모드인지 아닌지 여부를 나타내는 예측 모드 플래그를 더 부호화할 수 있다. 또한, 현재 블록의 예측 모드가 인트라 예측 모드가 아닌 경우에, 비디오 부호화 장치(200)는 현재 블록이 스킵 모드로 예측되는지 여부를 나타내는 스킵 플래그 또는 머지 모드로 예측되는지 여부를 나타내는 머지 플래그를 더 부호화할 수 있다.
예를 들어, 현재 블록이 스킵 모드에 따라 예측되는 경우에, 비디오 부호화 장치(200)는 스킵 모드로 예측됨을 나타내는 스킵 모드 플래그를 부호화하고, 움직임 정보를 참조할 주변 블록을 가리키는 인덱스만 더 부호화할 뿐, 머지 모드에 대한 정보는 더 이상 부호화하지 않을 수 있다. 하지만, 현재 블록이 스킵 모드에 따라 예측되는 경우에, 비디오 부호화 장치(200)는 스킵 모드가 아님을 나타내는 스킵 모드 플래그를 부호화하고, 머지 모드로 예측되는지 여부를 나타내는 머지 플래그를 더 부호화할 수 있다. 현재 블록을 위해 머지 모드에 따른 인터 예측이 수행될 때, 비디오 부호화 장치(200)는 머지 모드로 예측됨을 나타내는 머지 모드 플래그와, 추가적으로 인트라 머지 정보 및 머지 후보 인덱스 정보를 더 부호화할 수 있다.
일 실시예에 따른 비디오 부호화 장치(200)는, 인터 머지 후보에 따라 인터 예측을 수행하는 경우, 움직임 벡터 차분(mvd; motion vector differential) 정보를 더 부호화할 수 있다. 비디오 부호화 장치(200)는, 머지 후보 리스트 중에서 인터 머지 후보가 선택되는 경우에, 후보 블록의 움직임 벡터를 이용하여, 현재 블록의 움직임 벡터 프리딕터를 결정할 수 있다. 따라서, 현재 블록의 움직임 벡터와 움직임 벡터 프리딕터 간의 차이값인 움직임 벡터 차분 정보가 결정될 수 있다. 현재 블록의 움직임 벡터가 가리키는 참조 블록의 샘플값들을 현재 블록의 인터 머지 후보에 따른 예측 샘플값들로 결정하고, 예측 샘플들과 현재 블록의 복원 샘플들 간의 차이값들이 잔차 정보로서 부호화될 수 있다.
일 실시예에 따른 비디오 부호화 장치(200)는, 인트라 머지 후보에 따라 인터 예측을 수행하는 경우에는, 인트라 예측 방향을 나타내는 인트라 예측 모드 정보를 더 부호화할 수 있다. 비디오 부호화 장치(200)는, 인트라 예측 모드가 가리키는 주변 샘플값들을 이용하여 현재 블록의 인트라 머지 후보에 따른 예측 샘플값들을 결정할 수 있다. 인트라 머지 후보에 따른 주변 샘플들은 도 3b를 참조하여 후술하고, 인트라 예측 방향 및 인트라 예측 모드에 대해서는 도 3c를 참조하여 후술한다.
본 개시에서 제안한 비디오 부호화 장치(200) 또는 비디오 복호화 장치(100)에 따르면, 현재 블록의 인터 예측에서 참조될 머지 후보로서, 현재 블록의 이웃 블록 또는 콜로케이티드 블록의 움직임 정보 뿐만 아니라, 현재 블록에 공간적으로 인접하는 이웃 샘플값들도 머지 후보 리스트에 포함시킴으로써, 현재 블록을 정확하고 효과적으로 예측할 수 있다.
도 3a은 머지 후보 리스트에 포함될 수 있는 인터 머지 후보들을 도시한다.
비디오 복호화 장치(100)는, 현재 블록(300)에 대해 스킵 모드 또는 머지 모드에 따른 인터 예측을 수행하기 위해, 머지 모드 리스트가 결정될 수 있다.
스킵 모드의 경우, 머지 모드 리스트 중에서 결정된 후보 블록의 예측 방향(L0 또는 L1), 참조 인덱스 및 움직임 벡터를 이용하여 각각 결정된 현재 블록의 예측 방향(L0 또는 L1), 참조 인덱스 및 움직임 벡터가 가리키는 참조 블록의 샘플값들이 현재 블록(300)의 샘플값들로 결정될 수 있다.
머지 모드의 경우, 머지 모드 리스트 중에서 결정된 후보 블록의 예측 방향(L0 또는 L1), 참조 인덱스 및 움직임 벡터를 이용하여, 현재 블록의 예측 방향(L0 또는 L1), 참조 인덱스 및 움직임 벡터 프리딕터가 결정되고, 움직임 벡터 프리딕터와 움직임 벡터 차분 정보를 합산하여 현재 블록(300)의 움직임 벡터가 결정될 수 있다. 이에 따라, 현재 블록의 예측 방향(L0 또는 L1), 참조 인덱스 및 움직임 벡터가 가리키는 참조 블록의 샘플값들이 현재 블록의 예측 샘플값들로 결정되고, 예측 샘플값들과 잔차 샘플값들을 더하여 현재 블록(300)의 샘플값들이 결정될 수 있다.
따라서 인터 예측 기법에서는, 현재 블록을 부호화하는데 이용된 다른 블록을 결정하는 과정이 선행된다. 일반적으로 현재 블록과 유사한 성향을 가지는 블록이 이용되기 때문에, 현재 영상 내에서 현재 블록에 공간적으로 인접하는 주변 블록이나, 현재 영상 내에서 현재 블록이 위치하는 지점과 유사한 지점에 위치하는 시간적으로 다른 영상 내의 블록이 이용될 수 있다.
일 실시예에 따른 머지 후보 리스트는 적어도 하나의 인터 머지 후보를 포함할 수 있다. 인터 머지 후보는, 현재 블록에 공간적으로 인접하는 이웃 블록 A0(310), A1(312), B0(314), B1(316), B2(318)과, 현재 블록의 시간적으로 인접하는 픽처 내에서 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록 Col(320) 중 적어도 하나의 블록을 포함할 수 있다.
구체적으로, 이웃 블록 A0(310)은 현재 블록(300)의 외부에 인접하는 블록들 중에서, 현재 블록(300)의 샘플들 중 좌하측 코너에 위치한 샘플의 좌하측 대각 방향으로 외부에 인접하는 샘플을 포함하는 블록일 수 있다.
이웃 블록 A1(312)은 현재 블록(300)의 외부에 인접하는 블록들 중에서, 현재 블록(300)의 샘플들 중 좌하측 코너에 위치한 샘플의 좌측 외부에 인접하는 샘플을 포함하는 블록일 수 있다.
이웃 블록 B0(314)은 현재 블록(300)의 외부에 인접하는 블록들 중에서, 현재 블록(300)의 샘플들 중 우상측 코너에 위치한 샘플의 우상측 대각 방향으로 외부에 인접하는 샘플을 포함하는 블록일 수 있다.
이웃 블록 B1(316)은 현재 블록(300)의 외부에 인접하는 블록들 중에서, 현재 블록(300)의 샘플들 중 우상측 코너에 위치한 샘플의 상측 외부에 인접하는 샘플을 포함하는 블록일 수 있다.
이웃 블록 B2(318)은 현재 블록(300)의 외부에 인접하는 블록들 중에서, 현재 블록(300)의 샘플들 중 좌상측 코너에 위치한 샘플의 좌상측 대각 방향으로 외부에 인접하는 샘플을 포함하는 블록일 수 있다.
콜로케이티드 블록 Col(320)은, 현재 블록을 포함하는 현재 영상과 시간적으로 다른 영상(콜로케이티드 영상) 내의 블록들 중에서, 현재 영상 내에서 현재 블록(300)에 대응되는 위치에 존재하는 블록일 수 있다. 예를 들어, 콜로케이티드 영상의 블록들 중에서, 현재 영상 내에서 현재 블록(300)의 좌표에 대응하는 지점을 포함하는 동일 위치 블록이 선택되고, 선택된 블록의 우측 하단 코너에 대각 방향으로 외부에 인접하는 블록 H가 콜로케이티드 블록(320)으로 결정될 수 있다. 다만, 블록 H에 대해 유효한 움직임 정보가 정의되지 않는 경우에, 동일 위치 블록의 중앙에 위치하는 지점을 포함하는 블록이 콜로케이티드 블록(320)으로 결정될 수 있다.
이 때, 현재 블록(300)은 부호화 단위(Coding Unit; CU)일 수 있고, 또는 부호화 단위의 예측을 위해 부호화 단위 내에서 결정되는 서브 블록일 수 있다.
도 3b 및 3c는 일 실시예에 따라 머지 후보 리스트에 포함될 수 있는 인트라 머지 후보들을 도시한다.
일 실시예에 따르면, 인트라 머지 후보는 현재 블록(350)에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 샘플을 포함하는 예측 블록을 포함할 수 있다.
주변 샘플들은, 현재 블록(300)의 외부에 인접하는 이미 복원된 샘플들 중에서 선택될 수 있다. 현재 블록(350)의 좌상측 코너의 샘플을 p(0,0), 정사각형인 현재 블록(350)의 높이 또는 너비가 N일 때, 주변 샘플들은 P(-1, -1) 및 P(2N-1, -1)을 포함하며, P(-1, -1) 및 P(2N-1, -1) 사이에 수평으로 일렬로 위치하는 샘플들을 포함할 수 있다. 또한, 주변 샘플들은 P(-1, -1) 및 P(-1, 2N-1)을 포함하며, P(-1, -1) 및 P(-1, 2N-1) 사이에 수직으로 일렬로 위치하는 샘플들을 포함할 수 있다.
이 때, 현재 블록(350)은 부호화 단위(CU)일 수 있고, 또는 부호화 단위(Coding Unit; CU)의 변환을 위해 부호화 단위 내에서 결정되는 서브 블록일 수 있다.
인트라 예측의 예측 방향에 따라 현재 블록의 인트라 예측을 위해 참조할 수 있는 주변 샘플들이 달라질 수 있다. 즉, 예측 방향에 따라, P(-1, -1)로부터 P(2N-1, -1)까지 수평으로 나열된 주변 샘플들 중에서 참조되는 샘플들이 달라지고, P(-1, -1)로부터 P(-1, 2N-1)까지 수직으로 나열된 주변 샘플들 중에서 참조되는 샘플들이 달라질 수 있다.
일 실시예에 따르면, 인트라 예측 방향으로 채택 가능한 인트라 예측 모드들이 도 3c에 도시되어 있다. 각 화살표는 현재 블록으로부터 참조하기 위한 주변 샘플을 가리키는 예측 방향을 의미하며, 각 숫자는 인트라 예측 모드에 대응되는 인덱스를 나타낸다.
화살표와 같이 특정한 예측 방향이 매칭되는 인트라 예측 모드를 방향성 모드(Angular mode)라 지칭하고, 특정한 예측 방향이 매칭되지 않는 인트라 예측 모드를 비방향성 모드(Non-angular mode)라 지칭한다.
비방향성 모드의 예로서, 플래너 모드와 DC 모드가 있다. 도 3c에서 인트라 예측 모드 인덱스 0은 플래너 모드를 나타내고, 인트라 예측 모드 인덱스 1은 DC 모드를 나타낸다.
플래너 모드에 따르면, 현재 블록(350)을 둘러싼 주변 샘플들의 좌표 변화에 따라 주변 샘플 값들도 점차적으로 변화할 때, 주변 샘플 값들의 변화에 따른 그라데이션이 예측 샘플에 반영되도록 예측값이 결정된다. 따라서, 주변 샘플 값들의 그라데이션과 유사하게, 예측 샘플들의 좌표가 증가함에 따라 예측 샘플값들이 점차적으로 증감될 수 있다. DC 모드에 따르면, 현재 블록(350)을 둘러싼 주변 샘플들의 평균값으로 현재 예측 샘플값들이 균일하게 결정될 수 있다.
방향성 모드는 도 3c에서 도시된 인트라 예측 모드 인덱스 2 내지 34에 매칭되는 예측 방향에 따른 예측 모드이다. 즉, 현재 블록(350)의 주변 샘플들 중에서 특정 화살표 방향에 위치하는 샘플값들의 경향에 따라, 현재 블록(35)의 예측 샘플값들도 결정될 수 있다. 이를 위해, 현재 블록(35)의 주변 샘플들 중에서 예측 방향에 위치하는 샘플값을 취하여, 현재 블록(35) 내에서 해당 방향에 위치하는 샘플들을 위한 예측 샘플값이 결정될 수 있다. 이러한 예측 샘플값들을 포함하는 예측 블록도 결정될 수 있다.
예를 들어, 비디오 복호화 장치(100)는 인트라 머지 후보를 결정하기 위해 소정 개수의 소정 인트라 예측 모드를 이용할 수도 있다. 구체적인 예로, 도 3c에 예시된 인트라 예측 모드들 중에서 플래너 모드(인트라 예측 모드 인덱스 0), DC모드(인트라 예측 모드 인덱스 1), 수직 모드(인트라 예측 모드 인덱스 26), 수평 모드(인트라 예측 모드 인덱스 10)를 포함하는 4개의 인트라 모드들 중에서 하나의 인트라 모드에 따른 예측 블록이 인트라 머지 후보로 이용될 수 있다.
다른 예로, 비디오 복호화 장치(100)는 주변 블록 또는 이전 픽처의 인트라 모드에 기초하여 결정된 인트라 예측 모드에 따른 예측 블록이 인트라 머지 후보로 이용될 수 있다. 구체적인 예로 주변 블록들의 인트라 예측 모드들 중 하나를 가리키는 MPM 인덱스에 따른 예측 블록이 인트라 머지 후보로 이용될 수도 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 인트라 머지 후보를 포함하는 머지 후보 리스트를 이용하여 인터 예측이 가능한 경우에, 적어도 하나의 인트라 머지 후보를 포함하는 머지 후보 리스트를 결정할 수 있다. 이하 도 4, 5, 6a, 6b, 6c, 7 및 8를 참조하여, 다양한 실시예에 따른 머지 후보 리스트가 상술된다. 도면에 기재된 표기 중 'MVm'(m은 정수)는 인터 머지 후보들을 나타내고, 'IPMn'(n은 정수)은 인트라 머지 후보들을 나타낸다. 'IPMn&MVm'은 인트라 머지 후보 'IPMn'과 인터 머지 후보 'MVm'가 합성된 인터-인트라 머지 후보를 나타낸다. 예를 들어, 인터-인트라 머지 후보 'IPMn&MVm'는 인트라 머지 후보 'IPMn'에 따른 예측값과 인터 머지 후보 'MVm'에 따른 예측값의 가중평균값으로 결정될 수 있다.
도 4는 일 실시예에 따라 인터 머지 후보와 인트라 머지 후보가 동시에 포함된 머지 후보 리스트를 도시한다.
일 실시예에 비디오 복호화 장치(100)는 스킵 모드 또는 머지 모드로 인터 예측을 수행하는 경우에, 적어도 하나의 인터 머지 후보와 적어도 하나의 인트라 머지 후보를 포함하는 머지 후보 리스트(400, 450)를 결정할 수 있다.
예를 들어, 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, ... MVm를 포함하는 머지 후보 리스트(400)을 생성하고, 머지 후보 리스트(400)에 인트라 머지 후보 IPM1, IPM2, ..., IPMn을 추가할 수 있다. 또는, 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, ... MVm를 포함하는 머지 후보 리스트(400)를 결정하고, 머지 후보 리스트(400)의 인터 머지 후보들 사이에 인트라 머지 후보 IPM1, IPM2, ..., IPMn을 하나씩 추가함으로써, 머지 후보 리스트(400)를 결정할 수도 있다.
비디오 복호화 장치(100)는, 머지 후보 리스트(400 또는 450)에 포함된 인터 머지 후보 및 인트라 머지 후보 중에서 머지 후보 인덱스가 가리키는 하나의 후보를 이용하여 인터 예측을 수행할 수 있다.
또한, 비디오 부호화 장치(200)도, 스킵 모드 또는 머지 모드로 인터 예측을 수행하기 위해, 인터 머지 후보 MV1, MV2, MV3, ... MVm를 포함하는 머지 후보 리스트(400 또는 450)을 생성하고, 머지 후보 리스트(400 또는 450)에 인트라 머지 후보 IPM1, IPM2, ..., IPMn을 추가할 수 있다. 비디오 부호화 장치(200)는, 머지 후보 리스트(400 또는 450)에 포함된 인터 머지 후보 및 인트라 머지 후보 중에서 인터 예측을 위해 이용되는 하나의 후보를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
도 5는 일 실시예에 따라 인터 머지 후보가 포함된 인터 머지 후보 리스트와 인트라 머지 후보가 포함된 인트라 머지 후보 리스트를 도시한다.
일 실시예에 비디오 복호화 장치(100)는 스킵 모드 또는 머지 모드로 인터 예측을 수행하는 경우에, 적어도 하나의 인터 머지 후보를 포함하는 인터 머지 후보 리스트(500)와, 적어도 하나의 인트라 머지 후보를 포함하는 인트라 머지 후보 리스트(550)를 결정할 수 있다.
예를 들어, 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, MV4... MVm를 포함하는 인터 머지 후보 리스트(500)를 결정할 수 있다. 또한, 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 비디오 복호화 장치(100)는 인트라 머지 후보 IPM1, IPM2, IPM3, IPM4, ..., IPMn를 포함하는 인트라 머지 후보 리스트(550)를 결정할 수도 있다.
비디오 복호화 장치(100)는, 인터 머지 후보 리스트(500)에 포함된 인터 머지 후보 및 인트라 머지 후보 리스트(550)에 포함된 인트라 머지 후보 중에서 머지 후보 인덱스가 가리키는 하나의 후보를 이용하여 인터 예측을 수행할 수 있다.
또한, 비디오 부호화 장치(200)는 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인터 머지 후보 MV1, MV2, MV3, MV4... MVm를 포함하는 인터 머지 후보 리스트(500)를 결정하고, 인트라 머지 후보 IPM1, IPM2, IPM3, IPM4, ..., IPMn를 포함하는 인트라 머지 후보 리스트(550)를 결정할 수 있다. 비디오 부호화 장치(200)는, 인터 머지 후보 리스트(500)에 포함된 인터 머지 후보 및 인트라 머지 후보 리스트(550)에 포함된 인트라 머지 후보 중에서 인터 예측에 이용된 하나의 후보를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
도 6a, 6b 및 6c은 일 실시예에 따라 인터 머지 후보와 인트라 머지 후보의 가중평균된 예측 샘플값이 인터-인트라 머지 후보로서 포함된 인트라 머지 후보 리스트를 도시한다.
일 실시예에 비디오 복호화 장치(100)는 스킵 모드 또는 머지 모드로 인터 예측을 수행하는 경우에, 인터 머지 후보와 인트라 머지 후보를 합성한 인터-인트라 머지 후보를 적어도 하나 포함하는 머지 후보 리스트(610, 630 또는 650)를 결정할 수 있다.
인터-인트라 머지 후보를 생성하기 위한 인터 머지 후보와 인트라 머지 후보의 조합은 다양할 수 있다. 예를 들어, 적어도 하나의 인트라 머지 후보 중 하나의 후보와 하나의 인터 머지 후보가 합성되어 적어도 하나의 인터-인트라 머지 후보가 결정될 수 있다. 다른 예로, 적어도 하나의 인터 머지 후보 중 하나의 후보와 하나의 인트라 머지 후보가 합성되어 적어도 하나의 인터-인트라 머지 후보가 결정될 수 있다. 또 다른 예로, 적어도 하나의 인터 머지 후보 중 하나의 후보와 적어도 하나의 인트라 머지 후보 중 하나의 후보가 합성되어 적어도 하나의 인터-인트라 머지 후보가 결정될 수 있다.
구체적인 예로, 도 6a에서 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, MV4... MVm를 포함하는 인터 머지 후보 리스트(600)를 결정할 수 있다. 또한, 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인트라 머지 후보 IPM1, IPM2, IPM3, IPM4, ..., IPMn 중 하나의 인트라 머지 후보와 하나의 인터 머지 후보 MV1를 합성하여 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, IPM3&MV1, IPM4&MV1, ..., IPMn&MV1를 결정할 수 있다. 비디오 복호화 장치(100)는, 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, IPM3&MV1, IPM4&MV1, ..., IPMn&MV1를 중 적어도 하나를 포함하는 인트라 머지 후보 리스트(610)를 결정할 수 있다.
다른 구체적인 예로, 도 6b에서 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, MV4... MVm를 포함하는 인터 머지 후보 리스트(620)를 결정할 수 있다. 또한, 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, MV4, ..., MVm 중 하나의 인터 머지 후보와 하나의 인트라 머지 후보 IPM1를 합성하여 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV2, IPM3&MV3, IPM4&MV4, ..., IPMn&MVn를 결정할 수 있다. 비디오 복호화 장치(100)는, 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV2, IPM3&MV3, IPM4&MV4, ..., IPMn&MVn를 중 적어도 하나를 포함하는 인트라 머지 후보 리스트(630)를 결정할 수 있다.
또 다른 구체적인 예로, 도 6c에서 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, MV4... MVm를 포함하는 인터 머지 후보 리스트(640)를 결정할 수 있다. 또한, 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 비디오 복호화 장치(100)는 인터 머지 후보 MV1, MV2, MV3, MV4, ..., MVm 중 하나의 인터 머지 후보와 인트라 머지 후보 IPM1, IPM2, IPM3, IPM4, ..., IPMn 중 하나의 인트라 머지 후보를 합성하여 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, IPM1&MV2, IPM2&MV2, ..., IPMn&MVm를 결정할 수 있다. 비디오 복호화 장치(100)는, 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, IPM1&MV2, IPM2&MV2, ..., IPMn&MVm를 중 적어도 하나를 포함하는 인트라 머지 후보 리스트(650)를 결정할 수 있다.
예를 들어, 하나의 인터-인트라 머지 후보에 따른 예측값은, 인터 머지 후보에 따른 예측값과 인트라 머지 후보에 따른 예측값의 가중평균값으로 결정될 수 있다. 가중평균을 위한 가중치는 인터 머지 후보에 따른 예측값에 대한 가중치와 인트라 머지 후보에 따른 예측값의 가중치를 동일하게 설정하거나, 상이하게 설정할 수도 있다.
일 실시예에 따른 비디오 복호화 장치(100)는, 인터-인트라 머지 후보를 결정하기 위한 인터 머지 후보에 대한 가중치와 인트라 머지 후보에 대한 가중치는 각각 주변 블록의 부호화 모드를 이용하여 결정될 수 있다.
구체적인 예로, 인트라 머지 후보를 결정할 때 이용되는 주변 블록의 인트라 예측 모드에 따라 인트라 머지 후보의 가중치 값이 결정될 수 있다. 주변 블록이 인터 모드로 예측된 경우에는 주변 블록의 인터 파티션 모드에 따라 인트라 머지 후보의 가중치 값이 결정될 수도 있다.
또 다른 예로, 인트라 머지 후보를 결정할 때 이용되는 주변 블록의 양자화 파라미터에 따라 인트라 머지 후보의 가중치 값이 결정될 수도 있다.
또는, 주변 블록이 부호화 단위일 때는 부호화 단위의 심도(분할 레벨, 분할 횟수) 또는 크기, 주변 블록이 예측 단위라면 예측 단위의 크기 또는 주변 블록이 변환 단위라면 변환 단위의 크기에 따라, 인트라 머지 후보의 가중치 값이 결정될 수도 있다.
인트라 머지 후보의 가중치값이 주변 블록의 부호화 모드에 따라 결정되고 나면, 인터 머지 후보의 가중치는 가중합의 정규화를 위한 값으로 결정될 수 있다.
다만, 인터-인트라 머지 후보에 따른 예측값을 결정하기 위해 가능한 인터 머지 후보와 인트라 머지 후보의 조합 방법은 앞서 예시한 방법에 제한되지 않음에 유의하여야 한다.
비디오 복호화 장치(100)는, 인터 머지 후보 리스트(600, 620 또는 640)에 포함된 인터 머지 후보 및 인트라 머지 후보 리스트(610, 630 또는 650)에 포함된 인터-인트라 머지 후보 중에서 머지 후보 인덱스가 가리키는 하나의 후보를 이용하여 인터 예측을 수행할 수 있다.
또한, 비디오 부호화 장치(200)는 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인터 머지 후보 MV1, MV2, MV3, MV4... MVm를 포함하는 인터 머지 후보 리스트(600, 620 또는 640)를 결정하고, 인터-인트라 머지 후보를 포함하는 인트라 머지 후보 리스트(610, 630 또는 650)를 결정할 수 있다. 비디오 부호화 장치(200)는, 인터 머지 후보 리스트(600, 620 또는 640)에 포함된 인터 머지 후보 및 인트라 머지 후보 리스트(610, 630 또는 650)에 포함된 인터-인트라 머지 후보 중에서 인터 예측에 이용된 하나의 후보를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
도 7은 일 실시예에 따라 인터 머지 후보와 인터-인트라 머지 후보가 포함된 머지 후보 리스트를 도시한다.
일 실시예에 비디오 복호화 장치(100)는 스킵 모드 또는 머지 모드로 인터 예측을 수행하는 경우에, 적어도 하나의 인터 머지 후보와 적어도 하나의 인터-인트라 머지 후보를 포함하는 머지 후보 리스트(700)를 결정할 수 있다.
구체적인 예로, 비디오 복호화 장치(100)는 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인터 머지 후보 MV1, MV2, MV3, MV4... MVm와, 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, IPM1&MV2, IPM2&MV2, ..., IPMn&MVm를 포함하는 머지 후보 리스트(700)를 결정할 수 있다.
비디오 복호화 장치(100)는, 머지 후보 리스트(700)에 포함된 인터 머지 후보 및 인터-인트라 머지 후보 중에서 머지 후보 인덱스가 가리키는 하나의 후보를 이용하여 인터 예측을 수행할 수 있다.
또한, 비디오 부호화 장치(200)는 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인터 머지 후보 MV1, MV2, MV3, MV4... MVm와, 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, IPM1&MV2, IPM2&MV2, ..., IPMn&MVm를 포함하는 머지 후보 리스트(700)를 결정할 수 있다. 비디오 부호화 장치(200)는, 머지 후보 리스트(700)에 포함된 인터 머지 후보 및 인터-인트라 머지 후보 중에서 인터 예측에 이용된 하나의 후보를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
도 8은 일 실시예에 따라 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보가 포함된 인트라 머지 후보 리스트를 도시한다.
일 실시예에 따른 비디오 복호화 장치(100)는 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보를 포함하는 머지 후보 리스트를 이용할 수도 있다.
구체적인 예로, 도 8에서 비디오 복호화 장치(100)는 스킵 모드 또는 머지 모드로 인트라 머지 후보를 이용하는 인터 예측을 수행할 수 있는 경우에, 인터 머지 후보 MV1, MV2, MV3, ..., MVm를 포함하는 인터 머지 후보 리스트(810)와 적어도 하나의 인트라 머지 후보 IPM1, IPM2 및 적어도 하나의 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV2를 포함하는 인트라 머지 후보 리스트(810)를 결정할 수 있다.
비디오 복호화 장치(100)는, 인터 머지 후보 리스트(810)에 포함된 인터 머지 후보 및 인트라 머지 후보 리스트(800)에 포함된 인트라 머지 후보 및 인터-인트라 머지 후보 중에서 머지 후보 인덱스가 가리키는 하나의 후보를 이용하여 인터 예측을 수행할 수 있다.
또한, 비디오 부호화 장치(200)는 스킵 모드 또는 머지 모드로 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인터 머지 후보 MV1, MV2, MV3, ..., MVm를 포함하는 인터 머지 후보 리스트(810)와 인트라 머지 후보 IPM1, IPM2 및 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV2를 포함하는 인트라 머지 후보 리스트(800)를 결정할 수 있다. 비디오 부호화 장치(200)는, 인터 머지 후보 리스트(810)에 포함된 인터 머지 후보 및 머지 후보 리스트(800)에 포함된 인트라 머지 후보 및 인터-인트라 머지 후보 중에서 인터 예측에 이용된 하나의 후보를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
다른 구체적인 예로, 비디오 복호화 장치(100)는 스킵 모드 또는 머지 모드로 인트라 머지 후보를 이용하는 인터 예측을 수행할 수 있는 경우에, 인트라 머지 후보 IPM1, IPM2, ..., IPMn, 인터 머지 후보 MV1, MV2, ..., MVm와 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, ..., IPMn&MVm를 포함하는 머지 후보 리스트(850)를 결정할 수 있다.
비디오 복호화 장치(100)는, 머지 후보 리스트(850)에 포함된 인터 머지 후보, 인트라 머지 후보 및 인터-인트라 머지 후보 중에서 머지 후보 인덱스가 가리키는 하나의 후보를 이용하여 인터 예측을 수행할 수 있다.
또한, 비디오 부호화 장치(200)는 스킵 모드 또는 머지 모드로 인트라 머지 후보를 이용하는 인터 예측이 가능한 경우에, 인트라 머지 후보 IPM1, IPM2, ..., IPMn, 인터 머지 후보 MV1, MV2, ..., MVm와 인터-인트라 머지 후보 IPM1&MV1, IPM2&MV1, ..., IPMn&MVm를 포함하는 머지 후보 리스트(850)를 결정할 수 있다. 비디오 부호화 장치(200)는, 머지 후보 리스트(850)에 포함된 인터 머지 후보, 인트라 머지 후보 및 인터-인트라 머지 후보 중에서 인터 예측에 이용된 하나의 후보를 가리키는 머지 후보 인덱스를 부호화할 수 있다.
이상, 도 4, 5, 6a, 6b, 6c, 7 및 8을 참조하여, 다양한 실시예에 따라 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보를 포함하는 머지 후보 리스트를 결정하는 방법을 상술하였다. 다만, 본 실시예에 개시된 실시예들은 이해를 돕기 위한 구체적인 예일 뿐 본 명세서에서 제안하는 기술의 범주가 이에 제한되어 해석되어서는 아니될 것이다.
또한, 도 4, 5, 6a, 6b, 6c, 7 및 8에 도시된 머지 후보 리스트들에 포함되는 인터 머지 후보, 인트라 머지 후보 및 인터-인트라 머지 후보의 순서에 따라 머지 후보 인덱스가 정의될 수 있는데, 반드시 도면에 그려진 순서로 제한되는 것은 아니다.
일 실시예에 따르면 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보 간의 우선순위는 미리 정해져 있을 수도 있다. 예를 들어, 스킵 모드 또는 머지 모드로 인터 예측을 수행하기 위한 머지 후보 리스트이므로, 인터 머지 후보가 우선적으로 머지 후보 리스트에 포함되며, 인터 머지 후보에 우선순위가 높은 머지 후보 인덱스가 할당될 수도 있다.
구체적인 예로, 적어도 하나의 인터 머지 후보, 적어도 하나의 인트라 머지 후보, 적어도 하나의 인터-인트라 머지 후보의 순으로 머지 후보 리스트에 포함되거나, 적어도 하나의 인터 머지 후보, 적어도 하나의 인터-인트라 머지 후보, 적어도 하나의 인트라 머지 후보의 순으로 머지 후보 리스트에 포함될 수 있다.
다른 예로, 제1 인터 머지 후보, 제1 인트라 머지 후보, 제1 인터-인트라 머지 후보, 제2 인터 머지 후보, 제2 인트라 머지 후보, 제2 인터-인트라 머지 후보, ...의 순으로 머지 후보 리스트에 포함되거나, 제1 인터 머지 후보, 제1 인터-인트라 머지 후보, 제1 인트라 머지 후보, 제2 인터 머지 후보, 제2 인터-인트라 머지 후보, 제2 인트라 머지 후보, ...의 순으로 머지 후보 리스트에 포함될 수 있다.
또한, 비디오 부호화 장치(200)가 예측 모드를 결정함에 있어서도, 인트라 예측 모드보다, 인트라 머지 후보를 이용하는 인터 예측 모드에 우선순위를 설정할 수도 있다.
도 9는 일 실시예에 따라 인트라 머지 정보를 시그널링하기 위한 신택스를 도시한다.
비디오 복호화 장치(100)는, 도 9에 도시된 신택스에 따라 비트스트림으로부터 스킵 플래그, 머지 플래그, 인트라 머지 정보를 파싱할 수 있다.
예를 들어, 비디오 복호화 장치(100)는, 코딩 유닛 신택스 'coding_unit( )'로부터 스킵 플래그 'cu_skip_flag[][]'를 파싱하여 현재 부호화 단위(coding unit)가 스킵 모드로 예측되었는지 여부를 결정할 수 있다. 현재 부호화 단위가 스킵 모드로 예측되지 않은 경우에 비디오 복호화 장치(100)는, 코딩 유닛 신택스 'coding_unit( )'로 인트라 스킵 플래그 'intra_skip_flag[][]'를 파싱하여 현재 부호화 단위가 인트라 스킵 모드로 예측되었는지 여부를 결정할 수 있다.
현재 부호화 단위가 스킵 모드로 예측 모드로 복호화되거나 인트라 예측 모드로 복호화되는 경우에, 비디오 복호화 장치(100)는 프리딕션 유닛 신택스 'prediction_unit()'를 호출하고, 프리딕션 유닛 신택스 'prediction_unit()'로부터 머지 후보 인덱스 'merge_idx[][]'를 파싱하여, 스킵 모드 또는 인트라 스킵 모드로 복호화할 때 머지 후보 리스트에서 머지 후보 인덱스 'merge_idx[][]'가 가리키는 하나의 후보를 선택할 수 있다.
스킵 모드 또는 인트라 스킵 모드로 예측되는 경우에 잔차 데이터가 파싱되지 않으므로, 머지 후보 인덱스가 가리키는 주변 블록에 따른 예측값들이 그대로 현재 부호화 단위의 샘플값으로 복원될 수 있다.
또한, 비디오 복호화 장치(100)는 스킵 모드 또는 인트라 스킵 모드가 아닌 경우에 프리딕션 유닛 신택스 'prediction_unit()'를 호출하고, 인터 모드로 복호화하는 경우에 프리딕션 유닛 신택스 'prediction_unit()'로부터 머지 플래그 'merge_flag[][]'를 파싱하여 현재 예측 단위(prediction unit)를 인터 머지 후보만을 이용하는 인터 머지 모드로 복호화하는지 여부를 결정할 수 있다. 인터 머지 모드로 복호화하지 않는 경우에 인트라 머지 플래그 'intra_merge_flag[][]'를 더 파싱하여, 현재 예측 단위에 대해 인트라 머지 후보를 이용할 수 있는 머지 모드로 복호화하는지 여부를 결정할 수 있다. 인트라 머지 후보가 이용가능한 경우에, 비디오 복호화 장치(100)는, 프리딕션 유닛 신택스 'prediction_unit()'로부터 머지 후보 인덱스 'merge_idx[][]'를 더 파싱하여, 머지 후보 리스트에서 머지 후보 인덱스 'merge_idx[][]'가 가리키는 하나의 후보를 선택할 수 있다. 이 때 인트라 머지 후보가 이용가능하므로, 머지 후보 인덱스가 가리키는 후보는 인터 머지 후보, 인트라 머지 후보, 인터-인트라 머지 후보 중 어느 하나일 수 있다.
또한 비디오 복호화 장치(100)가 인트라 머지 후보를 이용하는 인터 모드 또는 인트라 스킵 모드로 현재 블록에 대해 예측을 수행한 경우에, 현재 블록에 대한 예측 결과로서 현재 블록의 움직임 벡터가 정의되지는 않는다. 이 경우, 다음 블록을 위한 움직임 벡터 예측을 수행할 때 현재 블록의 움직임 벡터가 참조되어야 하는데 현재 블록의 움직임 벡터가 이용가능하지 않은 상태가 된다. 따라서, 일 실시예에 따른 비디오 복호화 장치(100)는, 인트라 머지 후보를 이용하는 인터 모드 또는 인트라 스킵 모드로 현재 블록에 대해 예측을 수행하여 현재 블록의 예측 블록을 결정한 후에, 다음 블록의 움직임 벡터 예측을 위한 현재 블록의 움직임 벡터를 영벡터(zero vector)로 설정하거나, 주변 블록의 움직임 벡터로 설정할 수도 있다.
이상 도 1 내지 9를 참조하여 상술한 비디오 복호화 장치(100)가 수행하는 동작 및 비디오 부호화 장치(200)가 수행하는 동작에서, 블록은 부호화 단위, 부호화 단위의 서브 블록, 최대 부호화 단위 등의 데이터 단위일 수 있다. 예를 들어, 서브 블록은, 부호화 단위에 대해 예측을 수행하기 위해 부호화 단위를 분할하여 결정된 블록인 예측 단위, 부호화 단위에 대해 변환 및 양자화를 수행하기 위해 부호화 단위를 분할하여 결정된 변환 단위 등일 수 있다.
이하, 도 10 내지 도 23을 참조하여 일 실시예에 따른 영상의 데이터 단위를 결정하는 방법이 상술된다.
도 10은 일 실시예에 따라 비디오 복호화 장치(100)가 현재 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보를 이용하여 부호화 단위의 형태를 결정할 수 있고, 분할 형태 정보를 이용하여 부호화 단위가 어떤 형태로 분할되는지를 결정할 수 있다. 즉, 비디오 복호화 장치(100)가 이용하는 블록 형태 정보가 어떤 블록 형태를 나타내는지에 따라 분할 형태 정보가 나타내는 부호화 단위의 분할 방법이 결정될 수 있다.
일 실시예에 따라, 비디오 복호화 장치(100)는 현재 부호화 단위가 정사각형 형태임을 나타내는 블록 형태 정보를 이용할 수 있다. 예를 들어 비디오 복호화 장치(100)는 분할 형태 정보에 따라 정사각형의 부호화 단위를 분할하지 않을지, 수직으로 분할할지, 수평으로 분할할지, 4개의 부호화 단위로 분할할지 등을 결정할 수 있다. 도 10을 참조하면, 현재 부호화 단위(1000)의 블록 형태 정보가 정사각형의 형태를 나타내는 경우, 복호화부(1030)는 분할되지 않음을 나타내는 분할 형태 정보에 따라 현재 부호화 단위(1000)와 동일한 크기를 가지는 부호화 단위(1010a)를 분할하지 않거나, 소정의 분할방법을 나타내는 분할 형태 정보에 기초하여 분할된 부호화 단위(1010b, 1010c, 1010d 등)를 결정할 수 있다.
도 10을 참조하면 비디오 복호화 장치(100)는 일 실시예에 따라 수직방향으로 분할됨을 나타내는 분할 형태 정보에 기초하여 현재 부호화 단위(1000)를 수직방향으로 분할한 두개의 부호화 단위(1010b)를 결정할 수 있다. 비디오 복호화 장치(100)는 수평방향으로 분할됨을 나타내는 분할 형태 정보에 기초하여 현재 부호화 단위(1000)를 수평방향으로 분할한 두개의 부호화 단위(1010c)를 결정할 수 있다. 비디오 복호화 장치(100)는 수직방향 및 수평방향으로 분할됨을 나타내는 분할 형태 정보에 기초하여 현재 부호화 단위(1000)를 수직방향 및 수평방향으로 분할한 네개의 부호화 단위(1010d)를 결정할 수 있다. 다만 정사각형의 부호화 단위가 분할될 수 있는 분할 형태는 상술한 형태로 한정하여 해석되어서는 안되고, 분할 형태 정보가 나타낼 수 있는 다양한 형태가 포함될 수 있다. 정사각형의 부호화 단위가 분할되는 소정의 분할 형태들은 이하에서 다양한 실시예를 통해 구체적으로 설명하도록 한다.
도 11은 일 실시예에 따라 비디오 복호화 장치(100)가 비-정사각형의 형태인 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위가 비-정사각형 형태임을 나타내는 블록 형태 정보를 이용할 수 있다. 비디오 복호화 장치(100)는 분할 형태 정보에 따라 비-정사각형의 현재 부호화 단위를 분할하지 않을지 소정의 방법으로 분할할지 여부를 결정할 수 있다. 도 11을 참조하면, 현재 부호화 단위(1100 또는 1150)의 블록 형태 정보가 비-정사각형의 형태를 나타내는 경우, 비디오 복호화 장치(100)는 분할되지 않음을 나타내는 분할 형태 정보에 따라 현재 부호화 단위(1100 또는 1150)와 동일한 크기를 가지는 부호화 단위(1110 또는 1160)를 분할하지 않거나, 소정의 분할방법을 나타내는 분할 형태 정보에 따라 기초하여 분할된 부호화 단위(1120a, 1120b, 1130a, 1130b, 1130c, 1170a, 1170b, 1180a, 1180b, 1180c)를 결정할 수 있다. 비-정사각형의 부호화 단위가 분할되는 소정의 분할 방법은 이하에서 다양한 실시예를 통해 구체적으로 설명하도록 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 분할 형태 정보를 이용하여 부호화 단위가 분할되는 형태를 결정할 수 있고, 이 경우 분할 형태 정보는 부호화 단위가 분할되어 생성되는 적어도 하나의 부호화 단위의 개수를 나타낼 수 있다. 도 11를 참조하면 분할 형태 정보가 두개의 부호화 단위로 현재 부호화 단위(1100 또는 1150)가 분할되는 것을 나타내는 경우, 비디오 복호화 장치(100)는 분할 형태 정보에 기초하여 현재 부호화 단위(1100 또는 1150)를 분할하여 현재 부호화 단위에 포함되는 두개의 부호화 단위(1120a, 11420b, 또는 1170a, 1170b)를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)가 분할 형태 정보에 기초하여 비-정사각형의 형태의 현재 부호화 단위(1100 또는 1150)를 분할하는 경우, 비-정사각형의 현재 부호화 단위(1100 또는 1150)의 긴 변의 위치를 고려하여 현재 부호화 단위를 분할할 수 있다. 예를 들면, 비디오 복호화 장치(100)는 현재 부호화 단위(1100 또는 1150)의 형태를 고려하여 현재 부호화 단위(1100 또는 1150)의 긴 변을 분할하는 방향으로 현재 부호화 단위(1100 또는 1150)를 분할하여 복수개의 부호화 단위를 결정할 수 있다.
일 실시예에 따라, 분할 형태 정보가 홀수개의 블록으로 부호화 단위를 분할하는 것을 나타내는 경우, 비디오 복호화 장치(100)는 현재 부호화 단위(1100 또는 1150)에 포함되는 홀수개의 부호화 단위를 결정할 수 있다. 예를 들면, 분할 형태 정보가 3개의 부호화 단위로 현재 부호화 단위(1100 또는 1150)를 분할하는 것을 나타내는 경우, 비디오 복호화 장치(100)는 현재 부호화 단위(1100 또는 1150)를 3개의 부호화 단위(1130a, 1130b, 1130c, 1180a, 1180b, 1180c)로 분할할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위(1100 또는 1150)에 포함되는 홀수개의 부호화 단위를 결정할 수 있으며, 결정된 부호화 단위들의 크기 모두가 동일하지는 않을 수 있다. 예를 들면, 결정된 홀수개의 부호화 단위(1130a, 1130b, 1130c, 1180a, 1180b, 1180c) 중 소정의 부호화 단위(1130b 또는 1180b)의 크기는 다른 부호화 단위(1130a, 1130c, 1180a, 1180c)들과는 다른 크기를 가질 수도 있다. 즉, 현재 부호화 단위(1100 또는 1150)가 분할되어 결정될 수 있는 부호화 단위는 복수의 종류의 크기를 가질 수 있고, 경우에 따라서는 홀수개의 부호화 단위(1130a, 1130b, 1130c, 1180a, 1180b, 1180c)가 각각 서로 다른 크기를 가질 수도 있다.
일 실시예에 따라 분할 형태 정보가 홀수개의 블록으로 부호화 단위가 분할되는 것을 나타내는 경우, 비디오 복호화 장치(100)는 현재 부호화 단위(1100 또는 1150)에 포함되는 홀수개의 부호화 단위를 결정할 수 있고, 나아가 비디오 복호화 장치(100)는 분할하여 생성되는 홀수개의 부호화 단위들 중 적어도 하나의 부호화 단위에 대하여 소정의 제한을 둘 수 있다. 도 11을 참조하면 비디오 복호화 장치(100)는 현재 부호화 단위(1100 또는 1150)가 분할되어 생성된 3개의 부호화 단위(1130a, 1130b, 1130c, 1180a, 1180b, 1180c)들 중 중앙에 위치하는 부호화 단위(1130b, 1180b)에 대한 복호화 과정을 다른 부호화 단위(1130a, 1130c, 1180a, 1180c)와 다르게 할 수 있다. 예를 들면, 비디오 복호화 장치(100)는 중앙에 위치하는 부호화 단위(1130b, 1180b)에 대하여는 다른 부호화 단위(1130a, 1130c, 1180a, 1180c)와 달리 더 이상 분할되지 않도록 제한하거나, 소정의 횟수만큼만 분할되도록 제한할 수 있다.
도 12는 일 실시예에 따라 비디오 복호화 장치(100)가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위를 분할하는 과정을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 정사각형 형태의 제1 부호화 단위(1200)를 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 일 실시예에 따라 분할 형태 정보가 수평 방향으로 제1 부호화 단위(1200)를 분할하는 것을 나타내는 경우, 비디오 복호화 장치(100)는 제1 부호화 단위(1200)를 수평 방향으로 분할하여 제2 부호화 단위(1210)를 결정할 수 있다. 일 실시예에 따라 이용되는 제1 부호화 단위, 제2 부호화 단위, 제3 부호화 단위는 부호화 단위 간의 분할 전후 관계를 이해하기 위해 이용된 용어이다. 예를 들면, 제1 부호화 단위를 분할하면 제2 부호화 단위가 결정될 수 있고, 제2 부호화 단위가 분할되면 제3 부호화 단위가 결정될 수 있다. 이하에서는 이용되는 제1 부호화 단위, 제2 부호화 단위 및 제3 부호화 단위의 관계는 상술한 특징에 따르는 것으로 이해될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 결정된 제2 부호화 단위(1210)를 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다. 도 12를 참조하면 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1200)를 분할하여 결정된 비-정사각형의 형태의 제2 부호화 단위(1210)를 적어도 하나의 제3 부호화 단위(1220a, 1220b, 1220c, 1220d 등)로 분할하거나 제2 부호화 단위(1210)를 분할하지 않을 수 있다. 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 획득할 수 있고 비디오 복호화 장치(100)는 획득한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1200)를 분할하여 다양한 형태의 복수개의 제2 부호화 단위(예를 들면, 1210)를 분할할 수 있으며, 제2 부호화 단위(1210)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1200)가 분할된 방식에 따라 분할될 수 있다. 일 실시예에 따라, 제1 부호화 단위(1200)가 제1 부호화 단위(1200)에 대한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제2 부호화 단위(1210)로 분할된 경우, 제2 부호화 단위(1210) 역시 제2 부호화 단위(1210)에 대한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제3 부호화 단위(예를 들면, 1220a, 1220b, 1220c, 1220d 등)으로 분할될 수 있다. 즉, 부호화 단위는 부호화 단위 각각에 관련된 분할 형태 정보 및 블록 형태 정보 중 적어도 하나에 기초하여 재귀적으로 분할될 수 있다. 따라서 비-정사각형 형태의 부호화 단위에서 정사각형의 부호화 단위가 결정될 수 있고, 이러한 정사각형 형태의 부호화 단위가 재귀적으로 분할되어 비-정사각형 형태의 부호화 단위가 결정될 수도 있다. 도 12를 참조하면, 비-정사각형 형태의 제2 부호화 단위(1210)가 분할되어 결정되는 홀수개의 제3 부호화 단위(1220b, 1220c, 1220d) 중 소정의 부호화 단위(예를 들면, 가운데에 위치하는 부호화 단위 또는 정사각형 형태의 부호화 단위)는 재귀적으로 분할될 수 있다. 일 실시예에 따라 홀수개의 제3 부호화 단위(1220b, 1220c, 1220d) 중 하나인 정사각형 형태의 제3 부호화 단위(1220c)는 수평 방향으로 분할되어 복수개의 제4 부호화 단위로 분할될 수 있다. 복수개의 제4 부호화 단위 중 하나인 비-정사각형 형태의 제4 부호화 단위(1240)는 다시 복수개의 부호화 단위들로 분할될 수 있다. 예를 들면, 비-정사각형 형태의 제4 부호화 단위(1240)는 홀수개의 부호화 단위(1250a, 1250b, 1250c)로 다시 분할될 수도 있다.
부호화 단위의 재귀적 분할에 이용될 수 있는 방법에 대하여는 다양한 실시예를 통해 후술하도록 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제3 부호화 단위(1220a, 1220b, 1220c, 1220d 등) 각각을 부호화 단위들로 분할하거나 제2 부호화 단위(1210)를 분할하지 않는 것으로 결정할 수 있다. 비디오 복호화 장치(100)는 일 실시예에 따라 비-정사각형 형태의 제2 부호화 단위(1210)를 홀수개의 제3 부호화 단위(1220b, 1220c, 1220d)로 분할할 수 있다. 비디오 복호화 장치(100)는 홀수개의 제3 부호화 단위(1220b, 1220c, 1220d) 중 소정의 제3 부호화 단위에 대하여 소정의 제한을 둘 수 있다. 예를 들면 비디오 복호화 장치(100)는 홀수개의 제3 부호화 단위(1220b, 1220c, 1220d) 중 가운데에 위치하는 부호화 단위(1220c)에 대하여는 더 이상 분할되지 않는 것으로 제한하거나 또는 설정 가능한 횟수로 분할되어야 하는 것으로 제한할 수 있다. 도 12를 참조하면, 비디오 복호화 장치(100)는 비-정사각형 형태의 제2 부호화 단위(1210)에 포함되는 홀수개의 제3 부호화 단위(1220b, 1220c, 1220d)들 중 가운데에 위치하는 부호화 단위(1220c)는 더 이상 분할되지 않거나, 소정의 분할 형태로 분할(예를 들면 4개의 부호화 단위로만 분할하거나 제2 부호화 단위(1210)가 분할된 형태에 대응하는 형태로 분할)되는 것으로 제한하거나, 소정의 횟수로만 분할(예를 들면 n회만 분할, n>0)하는 것으로 제한할 수 있다. 다만 가운데에 위치한 부호화 단위(1220c)에 대한 상기 제한은 단순한 실시예들에 불과하므로 상술한 실시예들로 제한되어 해석되어서는 안되고, 가운데에 위치한 부호화 단위(1220c)가 다른 부호화 단위(1220b, 1220d)와 다르게 복호화 될 수 있는 다양한 제한들을 포함하는 것으로 해석되어야 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위를 분할하기 위해 이용되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 현재 부호화 단위 내의 소정의 위치에서 획득할 수 있다.
도 13은 일 실시예에 따라 비디오 복호화 장치(100)가 홀수개의 부호화 단위들 중 소정의 부호화 단위를 결정하기 위한 방법을 도시한다. 도 13을 참조하면, 현재 부호화 단위(1300)의 블록 형태 정보 및 분할 형태 정보 중 적어도 하나는 현재 부호화 단위(1300)에 포함되는 복수개의 샘플 중 소정 위치의 샘플(예를 들면, 가운데에 위치하는 샘플(1340))에서 획득될 수 있다. 다만 이러한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나가 획득될 수 있는 현재 부호화 단위(1300) 내의 소정 위치가 도 13에서 도시하는 가운데 위치로 한정하여 해석되어서는 안되고, 소정 위치에는 현재 부호화 단위(1300)내에 포함될 수 있는 다양한 위치(예를 들면, 최상단, 최하단, 좌측, 우측, 좌측상단, 좌측하단, 우측상단 또는 우측하단 등)가 포함될 수 있는 것으로 해석되어야 한다. 비디오 복호화 장치(100)는 소정 위치로부터 획득되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 획득하여 현재 부호화 단위를 다양한 형태 및 크기의 부호화 단위들로 분할하거나 분할하지 않는 것으로 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위가 소정의 개수의 부호화 단위들로 분할된 경우 그 중 하나의 부호화 단위를 선택할 수 있다. 복수개의 부호화 단위들 중 하나를 선택하기 위한 방법은 다양할 수 있으며, 이러한 방법들에 대한 설명은 이하의 다양한 실시예를 통해 후술하도록 한다.
일 실시예에 따라 비디오 복호화 장치(100) 는 현재 부호화 단위를 복수개의 부호화 단위들로 분할하고, 소정 위치의 부호화 단위를 결정할 수 있다.
도 13은 일 실시예에 따라 비디오 복호화 장치(100)가 홀수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위한 방법을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 홀수개의 부호화 단위들 중 가운데에 위치하는 부호화 단위를 결정하기 위하여 홀수개의 부호화 단위들 각각의 위치를 나타내는 정보를 이용할 수 있다. 도 13을 참조하면, 비디오 복호화 장치(100)는 현재 부호화 단위(1300)를 분할하여 홀수개의 부호화 단위들(1320a, 1320b, 1320c)을 결정할 수 있다. 비디오 복호화 장치(100)는 홀수개의 부호화 단위들(1320a, 1320b, 1320c)의 위치에 대한 정보를 이용하여 가운데 부호화 단위(1320b)를 결정할 수 있다. 예를 들면 비디오 복호화 장치(100)는 부호화 단위들(1320a, 1320b, 1320c)에 포함되는 소정의 샘플의 위치를 나타내는 정보에 기초하여 부호화 단위들(1320a, 1320b, 1320c)의 위치를 결정함으로써 가운데에 위치하는 부호화 단위(1320b)를 결정할 수 있다. 구체적으로, 비디오 복호화 장치(100)는 부호화 단위들(1320a, 1320b, 1320c)의 좌측 상단의 샘플(1330a, 1330b, 1330c)의 위치를 나타내는 정보에 기초하여 부호화 단위(1320a, 1320b, 1320c)의 위치를 결정함으로써 가운데에 위치하는 부호화 단위(1320b)를 결정할 수 있다.
일 실시예에 따라 부호화 단위(1320a, 1320b, 1320c)에 각각 포함되는 좌측 상단의 샘플(1330a, 1330b, 1330c)의 위치를 나타내는 정보는 부호화 단위(1320a, 1320b, 1320c)의 픽쳐 내에서의 위치 또는 좌표에 대한 정보를 포함할 수 있다. 일 실시예에 따라 부호화 단위(1320a, 1320b, 1320c)에 각각 포함되는 좌측 상단의 샘플(1330a, 1330b, 1330c)의 위치를 나타내는 정보는 현재 부호화 단위(1300)에 포함되는 부호화단위(1320a, 1320b, 1320c)들의 너비 또는 높이를 나타내는 정보를 포함할 수 있고, 이러한 너비 또는 높이는 부호화 단위(1320a, 1320b, 1320c)의 픽쳐 내에서의 좌표 간의 차이를 나타내는 정보에 해당할 수 있다. 즉, 비디오 복호화 장치(100)는 부호화 단위(1320a, 1320b, 1320c)의 픽쳐 내에서의 위치 또는 좌표에 대한 정보를 직접이용하거나 좌표간의 차이값에 대응하는 부호화 단위의 너비 또는 높이에 대한 정보를 이용함으로써 가운데에 위치하는 부호화 단위(1320b)를 결정할 수 있다.
일 실시예에 따라, 상단 부호화 단위(1320a)의 좌측 상단의 샘플(1330a)의 위치를 나타내는 정보는 (xa, ya) 좌표를 나타낼 수 있고, 가운데 부호화 단위(1320b)의 좌측 상단의 샘플(1330b)의 위치를 나타내는 정보는 (xb, yb) 좌표를 나타낼 수 있고, 하단 부호화 단위(1320c)의 좌측 상단의 샘플(1330c)의 위치를 나타내는 정보는 (xc, yc) 좌표를 나타낼 수 있다. 비디오 복호화 장치(100)는 부호화 단위(1320a, 1320b, 1320c)에 각각 포함되는 좌측 상단의 샘플(1330a, 1330b, 1330c)의 좌표를 이용하여 가운데 부호화 단위(1320b)를 결정할 수 있다. 예를 들면, 좌측 상단의 샘플(1330a, 1330b, 1330c)의 좌표를 오름차순 또는 내림차순으로 정렬하였을 때, 가운데에 위치하는 샘플(1330b)의 좌표인 (xb, yb)를 포함하는 부호화 단위(1320b)를 현재 부호화 단위(1300)가 분할되어 결정된 부호화 단위(1320a, 1320b, 1320c) 중 가운데에 위치하는 부호화 단위로 결정할 수 있다. 다만 좌측 상단의 샘플(1330a, 1330b, 1330c)의 위치를 나타내는 좌표는 픽쳐 내에서의 절대적인 위치를 나타내는 좌표를 나타낼 수 있고, 나아가 상단 부호화 단위(1320a)의 좌측 상단의 샘플(1330a)의 위치를 기준으로, 가운데 부호화 단위(1320b)의 좌측 상단의 샘플(1330b)의 상대적 위치를 나타내는 정보인 (dxb, dyb)좌표, 하단 부호화 단위(1320c)의 좌측 상단의 샘플(1330c)의 상대적 위치를 나타내는 정보인 (dxc, dyc)좌표를 이용할 수도 있다. 또한 부호화 단위에 포함되는 샘플의 위치를 나타내는 정보로서 해당 샘플의 좌표를 이용함으로써 소정 위치의 부호화 단위를 결정하는 방법이 상술한 방법으로 한정하여 해석되어서는 안되고, 샘플의 좌표를 이용할 수 있는 다양한 산술적 방법으로 해석되어야 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위(1300)를 복수개의 부호화 단위(1320a, 1320b, 1320c)로 분할할 수 있고, 부호화 단위(1320a, 1320b, 1320c)들 중 소정의 기준에 따라 부호화 단위를 선택할 수 있다. 예를 들면, 비디오 복호화 장치(100)는 부호화 단위(1320a, 1320b, 1320c) 중 크기가 다른 부호화 단위(1320b)를 선택할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 상단 부호화 단위(1320a)의 좌측 상단의 샘플(1330a)의 위치를 나타내는 정보인 (xa, ya) 좌표, 가운데 부호화 단위(1320b)의 좌측 상단의 샘플(1330b)의 위치를 나타내는 정보인 (xb, yb) 좌표, 하단 부호화 단위(1320c)의 좌측 상단의 샘플(1330c)의 위치를 나타내는 정보인 (xc, yc) 좌표를 이용하여 부호화 단위(1320a, 1320b, 1320c) 각각의 너비 또는 높이를 결정할 수 있다. 비디오 복호화 장치(100)는 부호화 단위(1320a, 1320b, 1320c)의 위치를 나타내는 좌표인 (xa, ya), (xb, yb), (xc, yc)를 이용하여 부호화 단위(1320a, 1320b, 1320c) 각각의 크기를 결정할 수 있다.
일 실시예에 따라, 비디오 복호화 장치(100)는 상단 부호화 단위(1320a)의 너비를 xb-xa로 결정할 수 있고 높이를 yb-ya로 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 가운데 부호화 단위(1320b)의 너비를 xc-xb로 결정할 수 있고 높이를 yc-yb로 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 하단 부호화 단위의 너비 또는 높이는 현재 부호화 단위의 너비 또는 높이와 상단 부호화 단위(1320a) 및 가운데 부호화 단위(1320b)의 너비 및 높이를 이용하여 결정할 수 있다. 비디오 복호화 장치(100)는 결정된 부호화 단위(1320a, 1320b, 1320c)의 너비 및 높이에 기초하여 다른 부호화 단위와 다른 크기를 갖는 부호화 단위를 결정할 수 있다. 도 13을 참조하면, 비디오 복호화 장치(100)는 상단 부호화 단위(1320a) 및 하단 부호화 단위(1320c)의 크기와 다른 크기를 가지는 가운데 부호화 단위(1320b)를 소정 위치의 부호화 단위로 결정할 수 있다. 다만 상술한 비디오 복호화 장치(100)가 다른 부호화 단위와 다른 크기를 갖는 부호화 단위를 결정하는 과정은 샘플 좌표에 기초하여 결정되는 부호화 단위의 크기를 이용하여 소정 위치의 부호화 단위를 결정하는 일 실시예에 불과하므로, 소정의 샘플 좌표에 따라 결정되는 부호화 단위의 크기를 비교하여 소정 위치의 부호화 단위를 결정하는 다양한 과정이 이용될 수 있다.
다만 부호화 단위의 위치를 결정하기 위하여 고려하는 샘플의 위치는 상술한 좌측 상단으로 한정하여 해석되어서는 안되고 부호화 단위에 포함되는 임의의 샘플의 위치에 대한 정보가 이용될 수 있는 것으로 해석될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위의 형태를 고려하여, 현재 부호화 단위가 분할되어 결정되는 홀수개의 부호화 단위들 중 소정 위치의 부호화 단위를 선택할 수 있다. 예를 들면, 현재 부호화 단위가 너비가 높이보다 긴 비-정사각형 형태라면 비디오 복호화 장치(100)는 수평 방향에 따라 소정 위치의 부호화 단위를 결정할 수 있다. 즉, 비디오 복호화 장치(100)는 수평 방향으로 위치를 달리 하는 부호화 단위들 중 하나를 결정하여 해당 부호화 단위에 대한 제한을 둘 수 있다. 현재 부호화 단위가 높이가 너비보다 긴 비-정사각형 형태라면 비디오 복호화 장치(100)는 수직 방향에 따라 소정 위치의 부호화 단위를 결정할 수 있다. 즉, 비디오 복호화 장치(100)는 수직 방향으로 위치를 달리 하는 부호화 단위들 중 하나를 결정하여 해당 부호화 단위에 대한 제한을 둘 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 짝수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여 짝수개의 부호화 단위들 각각의 위치를 나타내는 정보를 이용할 수 있다. 비디오 복호화 장치(100)는 현재 부호화 단위를 분할하여 짝수개의 부호화 단위들을 결정할 수 있고 짝수개의 부호화 단위들의 위치에 대한 정보를 이용하여 소정 위치의 부호화 단위를 결정할 수 있다. 이에 대한 구체적인 과정은 도 13에서 상술한 홀수개의 부호화 단위들 중 소정 위치(예를 들면, 가운데 위치)의 부호화 단위를 결정하는 과정에 대응하는 과정일 수 있으므로 생략하도록 한다.
일 실시예에 따라, 비-정사각형 형태의 현재 부호화 단위를 복수개의 부호화 단위로 분할한 경우, 복수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여 분할 과정에서 소정 위치의 부호화 단위에 대한 소정의 정보를 이용할 수 있다. 예를 들면 비디오 복호화 장치(100)는 현재 부호화 단위가 복수개로 분할된 부호화 단위들 중 가운데에 위치하는 부호화 단위를 결정하기 위하여 분할 과정에서 가운데 부호화 단위에 포함된 샘플에 저장된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있다.
도 13을 참조하면 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 현재 부호화 단위(1300)를 복수개의 부호화 단위들(1320a, 1320b, 1320c)로 분할할 수 있으며, 복수개의 부호화 단위들(1320a, 1320b, 1320c) 중 가운데에 위치하는 부호화 단위(1320b)를 결정할 수 있다. 나아가 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나가 획득되는 위치를 고려하여, 가운데에 위치하는 부호화 단위(1320b)를 결정할 수 있다. 즉, 현재 부호화 단위(1300)의 블록 형태 정보 및 분할 형태 정보 중 적어도 하나는 현재 부호화 단위(1300)의 가운데에 위치하는 샘플(1340)에서 획득될 수 있으며, 상기 블록 형태 정보 및 상기 분할 형태 정보 중 적어도 하나에 기초하여 현재 부호화 단위(1300)가 복수개의 부호화 단위들(1320a, 1320b, 1320c)로 분할된 경우 상기 샘플(1340)을 포함하는 부호화 단위(1320b)를 가운데에 위치하는 부호화 단위로 결정할 수 있다. 다만 가운데에 위치하는 부호화 단위로 결정하기 위해 이용되는 정보가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나로 한정하여 해석되어서는 안되고, 다양한 종류의 정보가 가운데에 위치하는 부호화 단위를 결정하는 과정에서 이용될 수 있다.
일 실시예에 따라 소정 위치의 부호화 단위를 식별하기 위한 소정의 정보는, 결정하려는 부호화 단위에 포함되는 소정의 샘플에서 획득될 수 있다. 도 13을 참조하면, 비디오 복호화 장치(100)는 현재 부호화 단위(1300)가 분할되어 결정된 복수개의 부호화 단위들(1320a, 1320b, 1320c) 중 소정 위치의 부호화 단위(예를 들면, 복수개로 분할된 부호화 단위 중 가운데에 위치하는 부호화 단위)를 결정하기 위하여 현재 부호화 단위(1300) 내의 소정 위치의 샘플(예를 들면, 현재 부호화 단위(1300)의 가운데에 위치하는 샘플)에서 획득되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있다. . 즉, 비디오 복호화 장치(100)는 현재 부호화 단위(1300)의 블록 블록 형태를 고려하여 상기 소정 위치의 샘플을 결정할 수 있고, 비디오 복호화 장치(100)는 현재 부호화 단위(1300)가 분할되어 결정되는 복수개의 부호화 단위(1320a, 1320b, 1320c)들 중, 소정의 정보(예를 들면, 블록 형태 정보 및 분할 형태 정보 중 적어도 하나)가 획득될 수 있는 샘플이 포함된 부호화 단위(1320b)를 결정하여 소정의 제한을 둘 수 있다. 도 13을 참조하면 일 실시예에 따라 비디오 복호화 장치(100)는 소정의 정보가 획득될 수 있는 샘플로서 현재 부호화 단위(1300)의 가운데에 위치하는 샘플(1340)을 결정할 수 있고, 비디오 복호화 장치(100)는 이러한 샘플(1340)이 포함되는 부호화 단위(1320b)를 복호화 과정에서의 소정의 제한을 둘 수 있다. 다만 소정의 정보가 획득될 수 있는 샘플의 위치는 상술한 위치로 한정하여 해석되어서는 안되고, 제한을 두기 위해 결정하려는 부호화 단위(1320b)에 포함되는 임의의 위치의 샘플들로 해석될 수 있다.
일 실시예에 따라 소정의 정보가 획득될 수 있는 샘플의 위치는 현재 부호화 단위(1300)의 형태에 따라 결정될 수 있다. 일 실시예에 따라 블록 형태 정보는 현재 부호화 단위의 형태가 정사각형인지 또는 비-정사각형인지 여부를 결정할 수 있고, 형태에 따라 소정의 정보가 획득될 수 있는 샘플의 위치를 결정할 수 있다. 예를 들면, 비디오 복호화 장치(100)는 현재 부호화 단위의 너비에 대한 정보 및 높이에 대한 정보 중 적어도 하나를 이용하여 현재 부호화 단위의 너비 및 높이 중 적어도 하나를 반으로 분할하는 경계 상에 위치하는 샘플을 소정의 정보가 획득될 수 있는 샘플로 결정할 수 있다. 또다른 예를 들면, 비디오 복호화 장치(100)는 현재 부호화 단위에 관련된 블록 형태 정보가 비-정사각형 형태임을 나타내는 경우, 현재 부호화 단위의 긴 변을 반으로 분할하는 경계에 인접하는 샘플 중 하나를 소정의 정보가 획득될 수 있는 샘플로 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위를 복수개의 부호화 단위로 분할한 경우, 복수개의 부호화 단위들 중 소정 위치의 부호화 단위를 결정하기 위하여, 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 부호화 단위에 포함된 소정 위치의 샘플에서 획득할 수 있고, 비디오 복호화 장치(100)는 현재 부호화 단위가 분할되어 생성된 복수개의 부호화 단위들을 복수개의 부호화 단위 각각에 포함된 소정 위치의 샘플로부터 획득되는 분할 형태 정보 및 블록 형태 정보 중 적어도 하나를 이용하여 분할할 수 있다. 즉, 부호화 단위는 부호화 단위 각각에 포함된 소정 위치의 샘플에서 획득되는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용하여 재귀적으로 분할될 수 있다. 부호화 단위의 재귀적 분할 과정에 대하여는 도 12를 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위를 분할하여 적어도 하나의 부호화 단위를 결정할 수 있고, 이러한 적어도 하나의 부호화 단위가 복호화되는 순서를 소정의 블록(예를 들면, 현재 부호화 단위)에 따라 결정할 수 있다.
도 14는 일 실시예에 따라 비디오 복호화 장치(100)가 현재 부호화 단위를 분할하여 복수개의 부호화 단위들을 결정하는 경우, 복수개의 부호화 단위들이 처리되는 순서를 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보에 따라 제1 부호화 단위(1400)를 수직 방향으로 분할하여 제2 부호화 단위(1410a, 1410b)를 결정하거나 제1 부호화 단위(1400)를 수평 방향으로 분할하여 제2 부호화 단위(1430a, 1430b)를 결정하거나 제1 부호화 단위(1400)를 수직 방향 및 수평 방향으로 분할하여 제2 부호화 단위(1450a, 1450b, 1450c, 1450d)를 결정할 수 있다.
도 14를 참조하면, 비디오 복호화 장치(100)는 제1 부호화 단위(1400)를 수직 방향으로 분할하여 결정된 제2 부호화 단위(1410a, 1410b)를 수평 방향(1410c)으로 처리되도록 순서를 결정할 수 있다. 비디오 복호화 장치(100)는 제1 부호화 단위(1400)를 수평 방향으로 분할하여 결정된 제2 부호화 단위(1430a, 1430b)의 처리 순서를 수직 방향(1430c)으로 결정할 수 있다. 비디오 복호화 장치(100)는 제1 부호화 단위(1400)를 수직 방향 및 수평 방향으로 분할하여 결정된 제2 부호화 단위(1450a, 1450b, 1450c, 1450d)를 하나의 행에 위치하는 부호화 단위들이 처리된 후 다음 행에 위치하는 부호화 단위들이 처리되는 소정의 순서(예를 들면, 래스터 스캔 순서((raster scan order) 또는 z 스캔 순서(z scan order)(1450e) 등)에 따라 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 부호화 단위들을 재귀적으로 분할할 수 있다. 도 14를 참조하면, 비디오 복호화 장치(100)는 제1 부호화 단위(1400)를 분할하여 복수개의 부호화 단위들(1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, 1450d)을 결정할 수 있고, 결정된 복수개의 부호화 단위들(1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, 1450d) 각각을 재귀적으로 분할할 수 있다. 복수개의 부호화 단위들(1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, 1450d)을 분할하는 방법은 제1 부호화 단위(1400)를 분할하는 방법에 대응하는 방법이 될 수 있다. 이에 따라 복수개의 부호화 단위들(1410a, 1410b, 1430a, 1430b, 1450a, 1450b, 1450c, 1450d)은 각각 독립적으로 복수개의 부호화 단위들로 분할될 수 있다. 도 14를 참조하면 비디오 복호화 장치(100)는 제1 부호화 단위(1400)를 수직 방향으로 분할하여 제2 부호화 단위(1410a, 1410b)를 결정할 수 있고, 나아가 제2 부호화 단위(1410a, 1410b) 각각을 독립적으로 분할하거나 분할하지 않는 것으로 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 좌측의 제2 부호화 단위(1410a)를 수평 방향으로 분할하여 제3 부호화 단위(1420a, 1420b)로 분할할 수 있고, 우측의 제2 부호화 단위(1410b)는 분할하지 않을 수 있다.
일 실시예에 따라 부호화 단위들의 처리 순서는 부호화 단위의 분할 과정에 기초하여 결정될 수 있다. 다시 말해, 분할된 부호화 단위들의 처리 순서는 분할되기 직전의 부호화 단위들의 처리 순서에 기초하여 결정될 수 있다. 비디오 복호화 장치(100)는 좌측의 제2 부호화 단위(1410a)가 분할되어 결정된 제3 부호화 단위(1420a, 1420b)가 처리되는 순서를 우측의 제2 부호화 단위(1410b)와 독립적으로 결정할 수 있다. 좌측의 제2 부호화 단위(1410a)가 수평 방향으로 분할되어 제3 부호화 단위(1420a, 1420b)가 결정되었으므로 제3 부호화 단위(1420a, 1420b)는 수직 방향(1420c)으로 처리될 수 있다. 또한 좌측의 제2 부호화 단위(1410a) 및 우측의 제2 부호화 단위(1410b)가 처리되는 순서는 수평 방향(1410c)에 해당하므로, 좌측의 제2 부호화 단위(1410a)에 포함되는 제3 부호화 단위(1420a, 1420b)가 수직 방향(1420c)으로 처리된 후에 우측 부호화 단위(1410b)가 처리될 수 있다. 상술한 내용은 부호화 단위들이 각각 분할 전의 부호화 단위에 따라 처리 순서가 결정되는 과정을 설명하기 위한 것이므로, 상술한 실시예에 한정하여 해석되어서는 안되고, 다양한 형태로 분할되어 결정되는 부호화 단위들이 소정의 순서에 따라 독립적으로 처리될 수 있는 다양한 방법으로 이용되는 것으로 해석되어야 한다.
도 15는 일 실시예에 따라 비디오 복호화 장치(100)가 소정의 순서로 부호화 단위가 처리될 수 없는 경우, 현재 부호화 단위가 홀수개의 부호화 단위로 분할되는 것임을 결정하는 과정을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 획득된 블록 형태 정보 및 분할 형태 정보에 기초하여 현재 부호화 단위가 홀수개의 부호화 단위들로 분할되는 것을 결정할 수 있다. 도 15를 참조하면 정사각형 형태의 제1 부호화 단위(1500)가 비-정사각형 형태의 제2 부호화 단위(1510a, 1510b)로 분할될 수 있고, 제2 부호화 단위(1510a, 1510b)는 각각 독립적으로 제3 부호화 단위(1520a, 1520b, 1520c, 1520d, 1520e)로 분할될 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 제2 부호화 단위 중 좌측 부호화 단위(1510a)는 수평 방향으로 분할하여 복수개의 제3 부호화 단위(1520a, 1520b)를 결정할 수 있고, 우측 부호화 단위(1510b)는 홀수개의 제3 부호화 단위(1520c, 1520d, 1520e)로 분할할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 제3 부호화 단위들(1520a, 1520b, 1520c, 1520d, 1520e)이 소정의 순서로 처리될 수 있는지 여부를 판단하여 홀수개로 분할된 부호화 단위가 존재하는지를 결정할 수 있다. 도 15를 참조하면, 비디오 복호화 장치(100)는 제1 부호화 단위(1500)를 재귀적으로 분할하여 제3 부호화 단위(1520a, 1520b, 1520c, 1520d, 1520e)를 결정할 수 있다. 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여, 제1 부호화 단위(1500), 제2 부호화 단위(1510a, 1510b) 또는 제3 부호화 단위(1520a, 1520b, 1520c, 1520d, 1520e)가 분할되는 형태 중 홀수개의 부호화 단위로 분할되는지 여부를 결정할 수 있다. 예를 들면, 제2 부호화 단위(1510a, 1510b) 중 우측에 위치하는 부호화 단위가 홀수개의 제3 부호화 단위(1520c, 1520d, 1520e)로 분할될 수 있다. 제1 부호화 단위(1500)에 포함되는 복수개의 부호화 단위들이 처리되는 순서는 소정의 순서(예를 들면, z-스캔 순서(z-scan order)(1530))가 될 수 있고, 비디오 복호화 장치(100)는 우측 제2 부호화 단위(1510b)가 홀수개로 분할되어 결정된 제3 부호화 단위(1520c, 1520d, 1520e)가 상기 소정의 순서에 따라 처리될 수 있는 조건을 만족하는지를 판단할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 제1 부호화 단위(1500)에 포함되는 제3 부호화 단위(1520a, 1520b, 1520c, 1520d, 1520e)가 소정의 순서에 따라 처리될 수 있는 조건을 만족하는지를 결정할 수 있으며, 상기 조건은 제3 부호화 단위(1520a, 1520b, 1520c, 1520d, 1520e)의 경계에 따라 제2 부호화 단위(1510a, 1510b)의 너비 및 높이 중 적어도 하나를 반으로 분할되는지 여부와 관련된다. 예를 들면 비-정사각형 형태의 좌측 제2 부호화 단위(1510a)의 높이를 반으로 분할하여 결정되는 제3 부호화 단위(1520a, 1520b)는 조건을 만족하지만, 우측 제2 부호화 단위(1510b)를 3개의 부호화 단위로 분할하여 결정되는 제3 부호화 단위(1520c, 1520d, 1520e)들의 경계가 우측 제2 부호화 단위(1510b)의 너비 또는 높이를 반으로 분할하지 못하므로 제3 부호화 단위(1520c, 1520d, 1520e)는 조건을 만족하지 못하는 것으로 결정될 수 있고, 비디오 복호화 장치(100)는 이러한 조건 불만족의 경우 스캔 순서의 단절(disconnection)로 판단하고, 판단 결과에 기초하여 우측 제2 부호화 단위(1510b)는 홀수개의 부호화 단위로 분할되는 것으로 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 홀수개의 부호화 단위로 분할되는 경우 분할된 부호화 단위들 중 소정 위치의 부호화 단위에 대하여 소정의 제한을 둘 수 있으며, 이러한 제한 내용 또는 소정 위치 등에 대하여는 다양한 실시예를 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
도 16은 일 실시예에 따라 비디오 복호화 장치(100)가 제1 부호화 단위(1600)를 분할하여 적어도 하나의 부호화 단위를 결정하는 과정을 도시한다. 일 실시예에 따라 비디오 복호화 장치(100)는 획득한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1600)를 분할할 수 있다. 정사각형 형태의 제1 부호화 단위(1600)는 4개의 정사각형 형태를 가지는 부호화 단위로 분할되거나 또는 비-정사각형 형태의 복수개의 부호화 단위로 분할할 수 있다. 예를 들면 도 16을 참조하면, 블록 형태 정보가 제1 부호화 단위(1600)는 정사각형임을 나타내고 분할 형태 정보가 비-정사각형의 부호화 단위로 분할됨을 나타내는 경우 비디오 복호화 장치(100)는 제1 부호화 단위(1600)를 복수개의 비-정사각형의 부호화 단위들로 분할할 수 있다. 구체적으로, 분할 형태 정보가 제1 부호화 단위(1600)를 수평 방향 또는 수직 방향으로 분할하여 홀수개의 부호화 단위를 결정하는 것을 나타내는 경우, 비디오 복호화 장치(100)는 정사각형 형태의 제1 부호화 단위(1600)을 홀수개의 부호화 단위들로서 수직 방향으로 분할되어 결정된 제2 부호화 단위(1610a, 1610b, 1610c) 또는 수평 방향으로 분할되어 결정된 제2 부호화 단위(1620a, 1620b, 1620c)로 분할할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 제1 부호화 단위(1600)에 포함되는 제2 부호화 단위(1610a, 1610b, 1610c, 1620a, 1620b, 1620c)가 소정의 순서에 따라 처리될 수 있는 조건을 만족하는지를 결정할 수 있으며, 상기 조건은 제2 부호화 단위(1610a, 1610b, 1610c, 1620a, 1620b, 1620c)의 경계에 따라 제1 부호화 단위(1600)의 너비 및 높이 중 적어도 하나를 반으로 분할되는지 여부와 관련된다. 도 16를 참조하면 정사각형 형태의 제1 부호화 단위(1600)를 수직 방향으로 분할하여 결정되는 제2 부호화 단위(1610a, 1610b, 1610c)들의 경계가 제1 부호화 단위(1600)의 너비를 반으로 분할하지 못하므로 제1 부호화 단위(1600)는 소정의 순서에 따라 처리될 수 있는 조건을 만족하지 못하는 것으로 결정될 수 있다. 또한 정사각형 형태의 제1 부호화 단위(1600)를 수평 방향으로 분할하여 결정되는 제2 부호화 단위(1620a, 1620b, 1620c)들의 경계가 제1 부호화 단위(1600)의 너비를 반으로 분할하지 못하므로 제1 부호화 단위(1600)는 소정의 순서에 따라 처리될 수 있는 조건을 만족하지 못하는 것으로 결정될 수 있다. 비디오 복호화 장치(100)는 이러한 조건 불만족의 경우 스캔 순서의 단절(disconnection)로 판단하고, 판단 결과에 기초하여 제1 부호화 단위(1600)는 홀수개의 부호화 단위로 분할되는 것으로 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 홀수개의 부호화 단위로 분할되는 경우 분할된 부호화 단위들 중 소정 위치의 부호화 단위에 대하여 소정의 제한을 둘 수 있으며, 이러한 제한 내용 또는 소정 위치 등에 대하여는 다양한 실시예를 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라, 비디오 복호화 장치(100)는 제1 부호화 단위를 분할하여 다양한 형태의 부호화 단위들을 결정할 수 있다.
도 16을 참조하면, 비디오 복호화 장치(100)는 정사각형 형태의 제1 부호화 단위(1600), 비-정사각형 형태의 제1 부호화 단위(1630 또는 1650)를 다양한 형태의 부호화 단위들로 분할할 수 있다.
도 17은 일 실시예에 따라 비디오 복호화 장치(100)가 제1 부호화 단위(1700)가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위가 소정의 조건을 만족하는 경우 제2 부호화 단위가 분할될 수 있는 형태가 제한되는 것을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 획득한 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 정사각형 형태의 제1 부호화 단위(1700)를 비-정사각형 형태의 제2 부호화 단위(1710a, 1710b, 1720a, 1720b)로 분할하는 것으로 결정할 수 있다. 제2 부호화 단위(1710a, 1710b, 1720a, 1720b)는 독립적으로 분할될 수 있다. 이에 따라 비디오 복호화 장치(100)는 제2 부호화 단위(1710a, 1710b, 1720a, 1720b) 각각에 관련된 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 복수개의 부호화 단위로 분할하거나 분할하지 않는 것을 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 수직 방향으로 제1 부호화 단위(1700)가 분할되어 결정된 비-정사각형 형태의 좌측 제2 부호화 단위(1710a)를 수평 방향으로 분할하여 제3 부호화 단위(1712a, 1712b)를 결정할 수 있다. 다만 비디오 복호화 장치(100)는 좌측 제2 부호화 단위(1710a)를 수평 방향으로 분할한 경우, 우측 제2 부호화 단위(1710b)는 좌측 제2 부호화 단위(1710a)가 분할된 방향과 동일하게 수평 방향으로 분할될 수 없도록 제한할 수 있다. 만일 우측 제2 부호화 단위(1710b)가 동일한 방향으로 분할되어 제3 부호화 단위(1714a, 1714b)가 결정된 경우, 좌측 제2 부호화 단위(1710a) 및 우측 제2 부호화 단위(1710b)가 수평 방향으로 각각 독립적으로 분할됨으로써 제3 부호화 단위(1712a, 1712b, 1714a, 1714b)가 결정될 수 있다. 하지만 이는 비디오 복호화 장치(100)가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1700)를 4개의 정사각형 형태의 제2 부호화 단위(1730a, 1730b, 1730c, 1730d)로 분할한 것과 동일한 결과이며 이는 비디오 복호화 측면에서 비효율적일 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 수평 방향으로 제1 부호화 단위(11300)가 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위(1720a 또는 1720b)를 수직 방향으로 분할하여 제3 부호화 단위(1722a, 1722b, 1724a, 1724b)를 결정할 수 있다. 다만 비디오 복호화 장치(100)는 제2 부호화 단위 중 하나(예를 들면 상단 제2 부호화 단위(1720a))를 수직 방향으로 분할한 경우, 상술한 이유에 따라 다른 제2 부호화 단위(예를 들면 하단 부호화 단위(1720b))는 상단 제2 부호화 단위(1720a)가 분할된 방향과 동일하게 수직 방향으로 분할될 수 없도록 제한할 수 있다.
도 18은 일 실시예에 따라 분할 형태 정보가 4개의 정사각형 형태의 부호화 단위로 분할하는 것을 나타낼 수 없는 경우, 비디오 복호화 장치(100)가 정사각형 형태의 부호화 단위를 분할하는 과정을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1800)를 분할하여 제2 부호화 단위(1810a, 1810b, 1820a, 1820b 등)를 결정할 수 있다. 분할 형태 정보에는 부호화 단위가 분할될 수 있는 다양한 형태에 대한 정보가 포함될 수 있으나, 다양한 형태에 대한 정보에는 정사각형 형태의 4개의 부호화 단위로 분할하기 위한 정보가 포함될 수 없는 경우가 있다. 이러한 분할 형태 정보에 따르면, 비디오 복호화 장치(100)는 정사각형 형태의 제1 부호화 단위(1800)를 4개의 정사각형 형태의 제2 부호화 단위(1830a, 1830b, 1830c, 1830d)로 분할하지 못한다. 분할 형태 정보에 기초하여 비디오 복호화 장치(100)는 비-정사각형 형태의 제2 부호화 단위(1810a, 1810b, 1820a, 1820b 등)를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 비-정사각형 형태의 제2 부호화 단위(1810a, 1810b, 1820a, 1820b 등)를 각각 독립적으로 분할할 수 있다. 재귀적인 방법을 통해 제2 부호화 단위(1810a, 1810b, 1820a, 1820b 등) 각각이 소정의 순서대로 분할될 수 있으며, 이는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 제1 부호화 단위(1800)가 분할되는 방법에 대응하는 분할 방법일 수 있다.
예를 들면 비디오 복호화 장치(100)는 좌측 제2 부호화 단위(1810a)가 수평 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1812a, 1812b)를 결정할 수 있고, 우측 제2 부호화 단위(1810b)가 수평 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1814a, 1814b)를 결정할 수 있다. 나아가 비디오 복호화 장치(100)는 좌측 제2 부호화 단위(1810a) 및 우측 제2 부호화 단위(1810b) 모두 수평 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1816a, 1816b, 1816c, 1816d)를 결정할 수도 있다. 이러한 경우 제1 부호화 단위(1800)가 4개의 정사각형 형태의 제2 부호화 단위(1830a, 1830b, 1830c, 1830d)로 분할된 것과 동일한 형태로 부호화 단위가 결정될 수 있다.
또 다른 예를 들면 비디오 복호화 장치(100)는 상단 제2 부호화 단위(1820a)가 수직 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1822a, 1822b)를 결정할 수 있고, 하단 제2 부호화 단위(1820b)가 수직 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1824a, 1824b)를 결정할 수 있다. 나아가 비디오 복호화 장치(100)는 상단 제2 부호화 단위(1820a) 및 하단 제2 부호화 단위(1820b) 모두 수직 방향으로 분할되어 정사각형 형태의 제3 부호화 단위(1822a, 1822b, 1824a, 1824b)를 결정할 수도 있다. 이러한 경우 제1 부호화 단위(1800)가 4개의 정사각형 형태의 제2 부호화 단위(1830a, 1830b, 1830c, 1830d)로 분할된 것과 동일한 형태로 부호화 단위가 결정될 수 있다.
도 19는 일 실시예에 따라 복수개의 부호화 단위들 간의 처리 순서가 부호화 단위의 분할 과정에 따라 달라질 수 있음을 도시한 것이다.
일 실시예에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보에 기초하여 제1 부호화 단위(1900)를 분할할 수 있다. 블록 형태 정보가 정사각형 형태를 나타내고, 분할 형태 정보가 제1 부호화 단위(1900)가 수평 방향 및 수직 방향 중 적어도 하나의 방향으로 분할됨을 나타내는 경우, 비디오 복호화 장치(100)는 제1 부호화 단위(1900)를 분할하여 제2 부호화 단위(예를 들면, 1910a, 1910b, 1920a, 1920b, 1930a, 1930b, 1930c, 1930d 등)를 결정할 수 있다. 도 19를 참조하면 제1 부호화 단위1900)가 수평 방향 또는 수직 방향만으로 분할되어 결정된 비-정사각형 형태의 제2 부호화 단위(1910a, 1910b, 1920a, 1920b)는 각각에 대한 블록 형태 정보 및 분할 형태 정보에 기초하여 독립적으로 분할될 수 있다. 예를 들면 비디오 복호화 장치(100)는 제1 부호화 단위(1900)가 수직 방향으로 분할되어 생성된 제2 부호화 단위(1910a, 1910b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1916a, 1916b, 1916c, 1916d)를 결정할 수 있고, 제1 부호화 단위(1900)가 수평 방향으로 분할되어 생성된 제2 부호화 단위(1920a, 1920b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1926a, 1926b, 1926c, 1926d)를 결정할 수 있다. 이러한 제2 부호화 단위(1910a, 1910b, 1920a, 1920b)의 분할 과정은 도 17과 관련하여 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 소정의 순서에 따라 부호화 단위를 처리할 수 있다. 소정의 순서에 따른 부호화 단위의 처리에 대한 특징은 도 14과 관련하여 상술하였으므로 자세한 설명은 생략하도록 한다. 도 19를 참조하면 비디오 복호화 장치(100)는 정사각형 형태의 제1 부호화 단위(1900)를 분할하여 4개의 정사각형 형태의 제3 부호화 단위(1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, 1926d)를 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 제1 부호화 단위(1900)가 분할되는 형태에 따라 제3 부호화 단위(1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, 1926d)의 처리 순서를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 수직 방향으로 분할되어 생성된 제2 부호화 단위(1910a, 1910b)를 수평 방향으로 각각 분할하여 제3 부호화 단위(1916a, 1916b, 1916c, 1916d)를 결정할 수 있고, 비디오 복호화 장치(100)는 좌측 제2 부호화 단위(1910a)에 포함되는 제3 부호화 단위(1916a, 1916b)를 수직 방향으로 먼저 처리한 후, 우측 제2 부호화 단위(1910b)에 포함되는 제3 부호화 단위(1916c, 1916d)를 수직 방향으로 처리하는 순서(1917)에 따라 제3 부호화 단위(1916a, 1916b, 1916c, 1916d)를 처리할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 수평 방향으로 분할되어 생성된 제2 부호화 단위(1920a, 1920b)를 수직 방향으로 각각 분할하여 제3 부호화 단위(1926a, 1926b, 1926c, 1926d)를 결정할 수 있고, 비디오 복호화 장치(100)는 상단 제2 부호화 단위(1920a)에 포함되는 제3 부호화 단위(1926a, 1926b)를 수평 방향으로 먼저 처리한 후, 하단 제2 부호화 단위(1920b)에 포함되는 제3 부호화 단위(1926c, 1926d)를 수평 방향으로 처리하는 순서(1927)에 따라 제3 부호화 단위(1926a, 1926b, 1926c, 1926d)를 처리할 수 있다.
도 19를 참조하면, 제2 부호화 단위(1910a, 1910b, 1920a, 1920b)가 각각 분할되어 정사각형 형태의 제3 부호화 단위(1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, 1926d)가 결정될 수 있다. 수직 방향으로 분할되어 결정된 제2 부호화 단위(1910a, 1910b) 및 수평 방향으로 분할되어 결정된 제2 부호화 단위(1920a, 1920b)는 서로 다른 형태로 분할된 것이지만, 이후에 결정되는 제3 부호화 단위(1916a, 1916b, 1916c, 1916d, 1926a, 1926b, 1926c, 1926d)에 따르면 결국 동일한 형태의 부호화 단위들로 제1 부호화 단위(1900)가 분할된 결과가 된다. 이에 따라 비디오 복호화 장치(100)는 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 상이한 과정을 통해 재귀적으로 부호화 단위를 분할함으로써 결과적으로 동일한 형태의 부호화 단위들을 결정하더라도, 동일한 형태로 결정된 복수개의 부호화 단위들을 서로 다른 순서로 처리할 수 있다.
도 20은 일 실시예에 따라 부호화 단위가 재귀적으로 분할되어 복수개의 부호화 단위가 결정되는 경우, 부호화 단위의 형태 및 크기가 변함에 따라 부호화 단위의 심도가 결정되는 과정을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 부호화 단위의 심도를 소정의 기준에 따라 결정할 수 있다. 예를 들면 소정의 기준은 부호화 단위의 긴 변의 길이가 될 수 있다. 비디오 복호화 장치(100)는 현재 부호화 단위의 긴 변의 길이가 분할되기 전의 부호화 단위의 긴 변의 길이보다 2n (n>0) 배로 분할된 경우, 현재 부호화 단위의 심도는 분할되기 전의 부호화 단위의 심도보다 n만큼 심도가 증가된 것으로 결정할 수 있다. 이하에서는 심도가 증가된 부호화 단위를 하위 심도의 부호화 단위로 표현하도록 한다.
도 20을 참조하면, 일 실시예에 따라 정사각형 형태임을 나타내는 블록 형태 정보(예를 들면 블록 형태 정보는 ′0: SQUARE′를 나타낼 수 있음)에 기초하여 비디오 복호화 장치(100)는 정사각형 형태인 제1 부호화 단위(2000)를 분할하여 하위 심도의 제2 부호화 단위(2002), 제3 부호화 단위(2004) 등을 결정할 수 있다. 정사각형 형태의 제1 부호화 단위(2000)의 크기를 2Nx2N이라고 한다면, 제1 부호화 단위(2000)의 너비 및 높이를 1/21배로 분할하여 결정된 제2 부호화 단위(2002)는 NxN의 크기를 가질 수 있다. 나아가 제2 부호화 단위(2002)의 너비 및 높이를 1/2크기로 분할하여 결정된 제3 부호화 단위(2004)는 N/2xN/2의 크기를 가질 수 있다. 이 경우 제3 부호화 단위(2004)의 너비 및 높이는 제1 부호화 단위(2000)의 1/22배에 해당한다. 제1 부호화 단위(2000)의 심도가 D인 경우 제1 부호화 단위(2000)의 너비 및 높이의 1/21배인 제2 부호화 단위(2002)의 심도는 D+1일 수 있고, 제1 부호화 단위(2000)의 너비 및 높이의 1/22배인 제3 부호화 단위(2004)의 심도는 D+2일 수 있다.
일 실시예에 따라 비-정사각형 형태를 나타내는 블록 형태 정보(예를 들면 블록 형태 정보는, 높이가 너비보다 긴 비-정사각형임을 나타내는 ′1: NS_VER′ 또는 너비가 높이보다 긴 비-정사각형임을 나타내는 ′2: NS_HOR′를 나타낼 수 있음)에 기초하여, 비디오 복호화 장치(100)는 비-정사각형 형태인 제1 부호화 단위(2010 또는 2020)를 분할하여 하위 심도의 제2 부호화 단위(2012 또는 2022), 제3 부호화 단위(2014 또는 2024) 등을 결정할 수 있다.
비디오 복호화 장치(100)는 Nx2N 크기의 제1 부호화 단위(2010)의 너비 및 높이 중 적어도 하나를 분할하여 제2 부호화 단위(예를 들면, 2002, 2012, 2022 등)를 결정할 수 있다. 즉, 비디오 복호화 장치(100)는 제1 부호화 단위(2010)를 수평 방향으로 분할하여 NxN 크기의 제2 부호화 단위(2002) 또는 NxN/2 크기의 제2 부호화 단위(2022)를 결정할 수 있고, 수평 방향 및 수직 방향으로 분할하여 N/2xN 크기의 제2 부호화 단위(2012)를 결정할 수도 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 2NxN 크기의 제1 부호화 단위(2020) 의 너비 및 높이 중 적어도 하나를 분할하여 제2 부호화 단위(예를 들면, 2002, 2012, 2022 등)를 결정할 수도 있다. 즉, 비디오 복호화 장치(100)는 제1 부호화 단위(2020)를 수직 방향으로 분할하여 NxN 크기의 제2 부호화 단위(2002) 또는 N/2xN 크기의 제2 부호화 단위(2012)를 결정할 수 있고, 수평 방향 및 수직 방향으로 분할하여 NxN/2 크기의 제2 부호화 단위(2022)를 결정할 수도 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 NxN 크기의 제2 부호화 단위(2002) 의 너비 및 높이 중 적어도 하나를 분할하여 제3 부호화 단위(예를 들면, 2004, 2014, 2024 등)를 결정할 수도 있다. 즉, 비디오 복호화 장치(100)는 제2 부호화 단위(2002)를 수직 방향 및 수평 방향으로 분할하여 N/2xN/2 크기의 제3 부호화 단위(2004)를 결정하거나 N/22xN/2 크기의 제3 부호화 단위(2014)를 결정하거나 N/2xN/22 크기의 제3 부호화 단위(2024)를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 N/2xN 크기의 제2 부호화 단위(2012)의 너비 및 높이 중 적어도 하나를 분할하여 제3 부호화 단위(예를 들면, 2004, 2014, 2024 등)를 결정할 수도 있다. 즉, 비디오 복호화 장치(100)는 제2 부호화 단위(2012)를 수평 방향으로 분할하여 N/2xN/2 크기의 제3 부호화 단위(2004) 또는 N/2xN/22 크기의 제3 부호화 단위(2024)를 결정하거나 수직 방향 및 수평 방향으로 분할하여 N/22xN/2 크기의 제3 부호화 단위(2014)를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 NxN/2 크기의 제2 부호화 단위(2014)의 너비 및 높이 중 적어도 하나를 분할하여 제3 부호화 단위(예를 들면, 2004, 2014, 2024 등)를 결정할 수도 있다. 즉, 비디오 복호화 장치(100)는 제2 부호화 단위(2012)를 수직 방향으로 분할하여 N/2xN/2 크기의 제3 부호화 단위(2004) 또는 N/22xN/2 크기의 제3 부호화 단위(2014)를 결정하거나 수직 방향 및 수평 방향으로 분할하여 N/2xN/22크기의 제3 부호화 단위(2024)를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 정사각형 형태의 부호화 단위(예를 들면, 2000, 2002, 2004)를 수평 방향 또는 수직 방향으로 분할할 수 있다. 예를 들면, 2Nx2N 크기의 제1 부호화 단위(2000)를 수직 방향으로 분할하여 Nx2N 크기의 제1 부호화 단위(2010)를 결정하거나 수평 방향으로 분할하여 2NxN 크기의 제1 부호화 단위(2020)를 결정할 수 있다. 일 실시예에 따라 심도가 부호화 단위의 가장 긴 변의 길이에 기초하여 결정되는 경우, 2Nx2N 크기의 제1 부호화 단위(2000, 2002 또는 2004)가 수평 방향 또는 수직 방향으로 분할되어 결정되는 부호화 단위의 심도는 제1 부호화 단위(2000, 2002 또는 2004)의 심도와 동일할 수 있다.
일 실시예에 따라 제3 부호화 단위(2014 또는 2024)의 너비 및 높이는 제1 부호화 단위(2010 또는 2020)의 1/22배에 해당할 수 있다. 제1 부호화 단위(2010 또는 2020)의 심도가 D인 경우 제1 부호화 단위(2010 또는 2020)의 너비 및 높이의 1/2배인 제2 부호화 단위(2012 또는 2014)의 심도는 D+1일 수 있고, 제1 부호화 단위(2010 또는 2020)의 너비 및 높이의 1/22배인 제3 부호화 단위(2014 또는 2024)의 심도는 D+2일 수 있다.
도 21은 일 실시예에 따라 부호화 단위들의 형태 및 크기에 따라 결정될 수 있는 심도 및 부호화 단위 구분을 위한 인덱스(part index, 이하 PID)를 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 정사각형 형태의 제1 부호화 단위(2100)를 분할하여 다양한 형태의 제2 부호화 단위를 결정할 수 있다. 도 21를 참조하면, 비디오 복호화 장치(100)는 분할 형태 정보에 따라 제1 부호화 단위(2100)를 수직 방향 및 수평 방향 중 적어도 하나의 방향으로 분할하여 제2 부호화 단위(2102a, 2102b, 2104a, 2104b, 2106a, 2106b, 2106c, 2106d)를 결정할 수 있다. 즉, 비디오 복호화 장치(100)는 제1 부호화 단위(2100)에 대한 분할 형태 정보에 기초하여 제2 부호화 단위(2102a, 2102b, 2104a, 2104b, 2106a, 2106b, 2106c, 2106d)를 결정할 수 있다.
일 실시예에 따라 정사각형 형태의 제1 부호화 단위(2100)에 대한 분할 형태 정보에 따라 결정되는 제2 부호화 단위(2102a, 2102b, 2104a, 2104b, 2106a, 2106b, 2106c, 2106d)는 긴 변의 길이에 기초하여 심도가 결정될 수 있다. 예를 들면, 정사각형 형태의 제1 부호화 단위(2100)의 한 변의 길이와 비-정사각형 형태의 제2 부호화 단위(2102a, 2102b, 2104a, 2104b)의 긴 변의 길이가 동일하므로, 제1 부호화 단위(2100)와 비-정사각형 형태의 제2 부호화 단위(2102a, 2102b, 2104a, 2104b)의 심도는 D로 동일하다고 볼 수 있다. 이에 반해 비디오 복호화 장치(100)가 분할 형태 정보에 기초하여 제1 부호화 단위(2100)를 4개의 정사각형 형태의 제2 부호화 단위(2106a, 2106b, 2106c, 2106d)로 분할한 경우, 정사각형 형태의 제2 부호화 단위(2106a, 2106b, 2106c, 2106d)의 한 변의 길이는 제1 부호화 단위(2100)의 한 변의 길이의 1/2배 이므로, 제2 부호화 단위(2106a, 2106b, 2106c, 2106d)의 심도는 제1 부호화 단위(2100)의 심도인 D보다 한 심도 하위인 D+1의 심도일 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 높이가 너비보다 긴 형태의 제1 부호화 단위(2110)를 분할 형태 정보에 따라 수평 방향으로 분할하여 복수개의 제2 부호화 단위(2112a, 2112b, 2114a, 2114b, 2114c)로 분할할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 너비가 높이보다 긴 형태의 제1 부호화 단위(2120)를 분할 형태 정보에 따라 수직 방향으로 분할하여 복수개의 제2 부호화 단위(2122a, 2122b, 2124a, 2124b, 2124c)로 분할할 수 있다.
일 실시예에 따라 비-정사각형 형태의 제1 부호화 단위(2110 또는 2120)에 대한 분할 형태 정보에 따라 결정되는 제2 부호화 단위(2112a, 2112b, 2114a, 2114b, 2116a, 2116b, 2116c, 2116d)는 긴 변의 길이에 기초하여 심도가 결정될 수 있다. 예를 들면, 정사각형 형태의 제2 부호화 단위(2112a, 2112b)의 한 변의 길이는 높이가 너비보다 긴 비-정사각형 형태의 제1 부호화 단위(2110)의 한 변의 길이의 1/2배이므로, 정사각형 형태의 제2 부호화 단위(2102a, 2102b, 2104a, 2104b)의 심도는 비-정사각형 형태의 제1 부호화 단위(2110)의 심도 D보다 한 심도 하위의 심도인 D+1이다.
나아가 비디오 복호화 장치(100)가 분할 형태 정보에 기초하여 비-정사각형 형태의 제1 부호화 단위(2110)를 홀수개의 제2 부호화 단위(2114a, 2114b, 2114c)로 분할할 수 있다. 홀수개의 제2 부호화 단위(2114a, 2114b, 2114c)는 비-정사각형 형태의 제2 부호화 단위(2114a, 2114c) 및 정사각형 형태의 제2 부호화 단위(2114b)를 포함할 수 있다. 이 경우 비-정사각형 형태의 제2 부호화 단위(2114a, 2114c)의 긴 변의 길이 및 정사각형 형태의 제2 부호화 단위(2114b)의 한 변의 길이는 제1 부호화 단위(2110)의 한 변의 길이의 1/2배 이므로, 제2 부호화 단위(2114a, 2114b, 2114c)의 심도는 제1 부호화 단위(2110)의 심도인 D보다 한 심도 하위인 D+1의 심도일 수 있다. 비디오 복호화 장치(100)는 제1 부호화 단위(2110)와 관련된 부호화 단위들의 심도를 결정하는 상기 방식에 대응하는 방식으로, 너비가 높이보다 긴 비-정사각형 형태의 제1 부호화 단위(2120)와 관련된 부호화 단위들의 심도를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 분할된 부호화 단위들의 구분을 위한 인덱스(PID)를 결정함에 있어서, 홀수개로 분할된 부호화 단위들이 서로 동일한 크기가 아닌 경우, 부호화 단위들 간의 크기 비율에 기초하여 인덱스를 결정할 수 있다. 도 21를 참조하면, 홀수개로 분할된 부호화 단위들(2114a, 2114b, 2114c) 중 가운데에 위치하는 부호화 단위(2114b)는 다른 부호화 단위들(2114a, 2114c)와 너비는 동일하지만 높이가 다른 부호화 단위들(2114a, 2114c)의 높이의 두 배일 수 있다. 즉, 이 경우 가운데에 위치하는 부호화 단위(2114b)는 다른 부호화 단위들(2114a, 2114c)의 두 개를 포함할 수 있다. 따라서, 스캔 순서에 따라 가운데에 위치하는 부호화 단위(2114b)의 인덱스(PID)가 1이라면 그 다음 순서에 위치하는 부호화 단위(2114c)는 인덱스가 2가 증가한 3일수 있다. 즉 인덱스의 값의 불연속성이 존재할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 이러한 분할된 부호화 단위들 간의 구분을 위한 인덱스의 불연속성의 존재 여부에 기초하여 홀수개로 분할된 부호화 단위들이 서로 동일한 크기가 아닌지 여부를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위로부터 분할되어 결정된 복수개의 부호화 단위들을 구분하기 위한 인덱스의 값에 기초하여 특정 분할 형태로 분할된 것인지를 결정할 수 있다. 도 21를 참조하면 비디오 복호화 장치(100)는 높이가 너비보다 긴 직사각형 형태의 제1 부호화 단위(2110)를 분할하여 짝수개의 부호화 단위(2112a, 2112b)를 결정하거나 홀수개의 부호화 단위(2114a, 2114b, 2114c)를 결정할 수 있다. 비디오 복호화 장치(100)는 복수개의 부호화 단위 각각을 구분하기 위하여 각 부호화 단위를 나타내는 인덱스(PID)를 이용할 수 있다. 일 실시예에 따라 PID는 각각의 부호화 단위의 소정 위치의 샘플(예를 들면, 좌측 상단 샘플)에서 획득될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 부호화 단위의 구분을 위한 인덱스를 이용하여 분할되어 결정된 부호화 단위들 중 소정 위치의 부호화 단위를 결정할 수 있다. 일 실시예에 따라 높이가 너비보다 긴 직사각형 형태의 제1 부호화 단위(2110)에 대한 분할 형태 정보가 3개의 부호화 단위로 분할됨을 나타내는 경우 비디오 복호화 장치(100)는 제1 부호화 단위(2110)를 3개의 부호화 단위(2114a, 2114b, 2114c)로 분할할 수 있다. 비디오 복호화 장치(100)는 3개의 부호화 단위(2114a, 2114b, 2114c) 각각에 대한 인덱스를 할당할 수 있다. 비디오 복호화 장치(100)는 홀수개로 분할된 부호화 단위 중 가운데 부호화 단위를 결정하기 위하여 각 부호화 단위에 대한 인덱스를 비교할 수 있다. 비디오 복호화 장치(100)는 부호화 단위들의 인덱스에 기초하여 인덱스들 중 가운데 값에 해당하는 인덱스를 갖는 부호화 단위(2114b)를, 제1 부호화 단위(2110)가 분할되어 결정된 부호화 단위 중 가운데 위치의 부호화 단위로서 결정할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 분할된 부호화 단위들의 구분을 위한 인덱스를 결정함에 있어서, 부호화 단위들이 서로 동일한 크기가 아닌 경우, 부호화 단위들 간의 크기 비율에 기초하여 인덱스를 결정할 수 있다. 도 21를 참조하면, 제1 부호화 단위(2110)가 분할되어 생성된 부호화 단위(2114b)는 다른 부호화 단위들(2114a, 2114c)와 너비는 동일하지만 높이가 다른 부호화 단위들(2114a, 2114c)의 높이의 두 배일 수 있다. 이 경우 가운데에 위치하는 부호화 단위(2114b)의 인덱스(PID)가 1이라면 그 다음 순서에 위치하는 부호화 단위(2114c)는 인덱스가 2가 증가한 3일수 있다. 이러한 경우처럼 균일하게 인덱스가 증가하다가 증가폭이 달라지는 경우, 비디오 복호화 장치(100)는 다른 부호화 단위들과 다른 크기를 가지는 부호화 단위를 포함하는 복수개의 부호화 단위로 분할된 것으로 결정할 수 있다, 일 실시예에 따라 분할 형태 정보가 홀수개의 부호화 단위로 분할됨을 나타내는 경우, 비디오 복호화 장치(100)는 홀수개의 부호화 단위 중 소정 위치의 부호화 단위(예를 들면 가운데 부호화 단위)가 다른 부호화 단위와 크기가 다른 형태로 현재 부호화 단위를 분할할 수 있다. 이 경우 비디오 복호화 장치(100)는 부호화 단위에 대한 인덱스(PID)를 이용하여 다른 크기를 가지는 가운데 부호화 단위를 결정할 수 있다. 다만 상술한 인덱스, 결정하고자 하는 소정 위치의 부호화 단위의 크기 또는 위치는 일 실시예를 설명하기 위해 특정한 것이므로 이에 한정하여 해석되어서는 안되며, 다양한 인덱스, 부호화 단위의 위치 및 크기가 이용될 수 있는 것으로 해석되어야 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 부호화 단위의 재귀적인 분할이 시작되는 소정의 데이터 단위를 이용할 수 있다.
도 22는 일 실시예에 따라 픽쳐에 포함되는 복수개의 소정의 데이터 단위에 따라 복수개의 부호화 단위들이 결정된 것을 도시한다.
일 실시예에 따라 소정의 데이터 단위는 부호화 단위가 블록 형태 정보 및 분할 형태 정보 중 적어도 하나를 이용하여 재귀적으로 분할되기 시작하는 데이터 단위로 정의될 수 있다. 즉, 현재 픽쳐를 분할하는 복수개의 부호화 단위들이 결정되는 과정에서 이용되는 최상위 심도의 부호화 단위에 해당할 수 있다. 이하에서는 설명 상 편의를 위해 이러한 소정의 데이터 단위를 기준 데이터 단위라고 지칭하도록 한다.
일 실시예에 따라 기준 데이터 단위는 소정의 크기 및 형태를 나타낼 수 있다. 일 실시예에 따라, 기준 부호화 단위는 MxN의 샘플들을 포함할 수 있다. 여기서 M 및 N은 서로 동일할 수도 있으며, 2의 승수로 표현되는 정수일 수 있다. 즉, 기준 데이터 단위는 정사각형 또는 비-정사각형의 형태를 나타낼 수 있으며, 이후에 정수개의 부호화 단위로 분할될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 픽쳐를 복수개의 기준 데이터 단위로 분할할 수 있다. 일 실시예에 따라 비디오 복호화 장치(100)는 현재 픽쳐를 분할하는 복수개의 기준 데이터 단위를 각각의 기준 데이터 단위에 대한 분할 정보를 이용하여 분할할 수 있다. 이러한 기준 데이터 단위의 분할 과정은 쿼드 트리(quad-tree)구조를 이용한 분할 과정에 대응될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 픽쳐에 포함되는 기준 데이터 단위가 가질 수 있는 최소 크기를 미리 결정할 수 있다. 이에 따라, 비디오 복호화 장치(100)는 최소 크기 이상의 크기를 갖는 다양한 크기의 기준 데이터 단위를 결정할 수 있고, 결정된 기준 데이터 단위를 기준으로 블록 형태 정보 및 분할 형태 정보를 이용하여 적어도 하나의 부호화 단위를 결정할 수 있다.
도 22를 참조하면, 비디오 복호화 장치(100)는 정사각형 형태의 기준 부호화 단위(2200)를 이용할 수 있고, 또는 비-정사각형 형태의 기준 부호화 단위(2202)를 이용할 수도 있다. 일 실시예에 따라 기준 부호화 단위의 형태 및 크기는 적어도 하나의 기준 부호화 단위를 포함할 수 있는 다양한 데이터 단위(예를 들면, 시퀀스(sequence), 픽쳐(picture), 슬라이스(slice), 슬라이스 세그먼트(slice segment), 최대부호화단위 등)에 따라 결정될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보 중 적어도 하나를 상기 다양한 데이터 단위마다 비트스트림으로부터 획득할 수 있다. 정사각형 형태의 기준 부호화 단위(2200)에 포함되는 적어도 하나의 부호화 단위가 결정되는 과정은 도 10의 현재 부호화 단위(300)가 분할되는 과정을 통해 상술하였고, 비-정사각형 형태의 기준 부호화 단위(2200)에 포함되는 적어도 하나의 부호화 단위가 결정되는 과정은 도 11의 현재 부호화 단위(1100 또는 1150)가 분할되는 과정을 통해 상술하였으므로 자세한 설명은 생략하도록 한다.
일 실시예에 따라 비디오 복호화 장치(100)는 소정의 조건에 기초하여 미리 결정되는 일부 데이터 단위에 따라 기준 부호화 단위의 크기 및 형태를 결정하기 위하여, 기준 부호화 단위의 크기 및 형태를 식별하기 위한 인덱스를 이용할 수 있다. 즉, 비디오 복호화 장치(100)는 비트스트림으로부터 상기 다양한 데이터 단위(예를 들면, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 최대부호화단위 등) 중 소정의 조건(예를 들면 슬라이스 이하의 크기를 갖는 데이터 단위)을 만족하는 데이터 단위로서 슬라이스, 슬라이스 세그먼트, 최대부호화 단위 등 마다, 기준 부호화 단위의 크기 및 형태의 식별을 위한 인덱스만을 획득할 수 있다. 비디오 복호화 장치(100)는 인덱스를 이용함으로써 상기 소정의 조건을 만족하는 데이터 단위마다 기준 데이터 단위의 크기 및 형태를 결정할 수 있다. 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보를 상대적으로 작은 크기의 데이터 단위마다 비트스트림으로부터 획득하여 이용하는 경우, 비트스트림의 이용 효율이 좋지 않을 수 있으므로, 기준 부호화 단위의 형태에 대한 정보 및 기준 부호화 단위의 크기에 대한 정보를 직접 획득하는 대신 상기 인덱스만을 획득하여 이용할 수 있다. 이 경우 기준 부호화 단위의 크기 및 형태를 나타내는 인덱스에 대응하는 기준 부호화 단위의 크기 및 형태 중 적어도 하나는 미리 결정되어 있을 수 있다. 즉, 비디오 복호화 장치(100)는 미리 결정된 기준 부호화 단위의 크기 및 형태 중 적어도 하나를 인덱스에 따라 선택함으로써, 인덱스 획득의 기준이 되는 데이터 단위에 포함되는 기준 부호화 단위의 크기 및 형태 중 적어도 하나를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 하나의 최대 부호화 단위에 포함하는 적어도 하나의 기준 부호화 단위를 이용할 수 있다. 즉, 영상을 분할하는 최대 부호화 단위에는 적어도 하나의 기준 부호화 단위가 포함될 수 있고, 각각의 기준 부호화 단위의 재귀적인 분할 과정을 통해 부호화 단위가 결정될 수 있다. 일 실시예에 따라 최대 부호화 단위의 너비 및 높이 중 적어도 하나는 기준 부호화 단위의 너비 및 높이 중 적어도 하나의 정수배에 해당할 수 있다. 일 실시예에 따라 기준 부호화 단위의 크기는 최대부호화단위를 쿼드 트리 구조에 따라 n번 분할한 크기일 수 있다. 즉, 비디오 복호화 장치(100)는 최대부호화단위를 쿼드 트리 구조에 따라 n 번 분할하여 기준 부호화 단위를 결정할 수 있고, 다양한 실시예들에 따라 기준 부호화 단위를 블록 형태 정보 및 분할 형태 정보 중 적어도 하나에 기초하여 분할할 수 있다.
도 23은 일 실시예에 따라 픽쳐(2300)에 포함되는 기준 부호화 단위의 결정 순서를 결정하는 기준이 되는 프로세싱 블록을 도시한다.
일 실시예에 따라 비디오 복호화 장치(100)는 픽쳐를 분할하는 적어도 하나의 프로세싱 블록을 결정할 수 있다. 프로세싱 블록이란, 영상을 분할하는 적어도 하나의 기준 부호화 단위를 포함하는 데이터 단위로서, 프로세싱 블록에 포함되는 적어도 하나의 기준 부호화 단위는 특정 순서대로 결정될 수 있다. 즉, 각각의 프로세싱 블록에서 결정되는 적어도 하나의 기준 부호화 단위의 결정 순서는 기준 부호화 단위가 결정될 수 있는 다양한 순서의 종류 중 하나에 해당할 수 있으며, 각각의 프로세싱 블록에서 결정되는 기준 부호화 단위 결정 순서는 프로세싱 블록마다 상이할 수 있다. 프로세싱 블록마다 결정되는 기준 부호화 단위의 결정 순서는 래스터 스캔(raster scan), Z 스캔(Z-scan), N 스캔(N-scan), 우상향 대각 스캔(up-right diagonal scan), 수평적 스캔(horizontal scan), 수직적 스캔(vertical scan) 등 다양한 순서 중 하나일 수 있으나, 결정될 수 있는 순서는 상기 스캔 순서들에 한정하여 해석되어서는 안 된다.
일 실시예에 따라 비디오 복호화 장치(100)는 프로세싱 블록의 크기에 대한 정보를 획득하여 영상에 포함되는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있다. 비디오 복호화 장치(100)는 프로세싱 블록의 크기에 대한 정보를 비트스트림으로부터 획득하여 영상에 포함되는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있다. 이러한 프로세싱 블록의 크기는 프로세싱 블록의 크기에 대한 정보가 나타내는 데이터 단위의 소정의 크기일 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 비트스트림으로부터 프로세싱 블록의 크기에 대한 정보를 특정의 데이터 단위마다 획득할 수 있다. 예를 들면 프로세싱 블록의 크기에 대한 정보는 영상, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트 등의 데이터 단위로 비트스트림으로부터 획득될 수 있다. 즉 비디오 복호화 장치(100)는 상기 여러 데이터 단위마다 비트스트림으로부터 프로세싱 블록의 크기에 대한 정보를 획득할 수 있고 비디오 복호화 장치(100)는 획득된 프로세싱 블록의 크기에 대한 정보를 이용하여 픽쳐를 분할하는 적어도 하나의 프로세싱 블록의 크기를 결정할 수 있으며, 이러한 프로세싱 블록의 크기는 기준 부호화 단위의 정수배의 크기일 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 픽쳐(2300)에 포함되는 프로세싱 블록(2302, 2312)의 크기를 결정할 수 있다. 예를 들면, 비디오 복호화 장치(100)는 비트스트림으로부터 획득된 프로세싱 블록의 크기에 대한 정보에 기초하여 프로세싱 블록의 크기를 결정할 수 있다. 도 23을 참조하면, 비디오 복호화 장치(100)는 일 실시예에 따라 프로세싱 블록(2302, 2312)의 가로크기를 기준 부호화 단위 가로크기의 4배, 세로크기를 기준 부호화 단위의 세로크기의 4배로 결정할 수 있다. 비디오 복호화 장치(100)는 적어도 하나의 프로세싱 블록 내에서 적어도 하나의 기준 부호화 단위가 결정되는 순서를 결정할 수 있다.
일 실시예에 따라, 비디오 복호화 장치(100)는 프로세싱 블록의 크기에 기초하여 픽쳐(2300)에 포함되는 각각의 프로세싱 블록(2302, 2312)을 결정할 수 있고, 프로세싱 블록(2302, 2312)에 포함되는 적어도 하나의 기준 부호화 단위의 결정 순서를 결정할 수 있다. 일 실시예에 따라 기준 부호화 단위의 결정은 기준 부호화 단위의 크기의 결정을 포함할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 비트스트림으로부터 적어도 하나의 프로세싱 블록에 포함되는 적어도 하나의 기준 부호화 단위의 결정 순서에 대한 정보를 획득할 수 있고, 획득한 결정 순서에 대한 정보에 기초하여 적어도 하나의 기준 부호화 단위가 결정되는 순서를 결정할 수 있다. 결정 순서에 대한 정보는 프로세싱 블록 내에서 기준 부호화 단위들이 결정되는 순서 또는 방향으로 정의될 수 있다. 즉, 기준 부호화 단위들이 결정되는 순서는 각각의 프로세싱 블록마다 독립적으로 결정될 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 특정 데이터 단위마다 기준 부호화 단위의 결정 순서에 대한 정보를 비트스트림으로부터 획득할 수 있다. 예를 들면, 비디오 복호화 장치(100)는 기준 부호화 단위의 결정 순서에 대한 정보를 영상, 시퀀스, 픽쳐, 슬라이스, 슬라이스 세그먼트, 프로세싱 블록 등의 데이터 단위로마다 비트스트림으로부터 획득할 수 있다. 기준 부호화 단위의 결정 순서에 대한 정보는 프로세싱 블록 내에서의 기준 부호화 단위 결정 순서를 나타내므로, 결정 순서에 대한 정보는 정수개의 프로세싱 블록을 포함하는 특정 데이터 단위 마다 획득될 수 있다.
비디오 복호화 장치(100)는 일 실시예에 따라 결정된 순서에 기초하여 적어도 하나의 기준 부호화 단위를 결정할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 비트스트림으로부터 프로세싱 블록(2302, 2312)과 관련된 정보로서, 기준 부호화 단위 결정 순서에 대한 정보를 획득할 수 있고, 비디오 복호화 장치(100)는 상기 프로세싱 블록(2302, 2312)에 포함된 적어도 하나의 기준 부호화 단위를 결정하는 순서를 결정하고 부호화 단위의 결정 순서에 따라 픽쳐(2300)에 포함되는 적어도 하나의 기준 부호화 단위를 결정할 수 있다. 도 23을 참조하면, 비디오 복호화 장치(100)는 각각의 프로세싱 블록(2302, 2312)과 관련된 적어도 하나의 기준 부호화 단위의 결정 순서(2304, 2314)를 결정할 수 있다. 예를 들면, 기준 부호화 단위의 결정 순서에 대한 정보가 프로세싱 블록마다 획득되는 경우, 각각의 프로세싱 블록(2302, 2312)과 관련된 기준 부호화 단위 결정 순서는 프로세싱 블록마다 상이할 수 있다. 프로세싱 블록(2302)과 관련된 기준 부호화 단위 결정 순서(2304)가 래스터 스캔(raster scan)순서인 경우, 프로세싱 블록(2302)에 포함되는 기준 부호화 단위는 래스터 스캔 순서에 따라 결정될 수 있다. 이에 반해 다른 프로세싱 블록(2312)과 관련된 기준 부호화 단위 결정 순서(2314)가 래스터 스캔 순서의 역순인 경우, 프로세싱 블록(2312)에 포함되는 기준 부호화 단위는 래스터 스캔 순서의 역순에 따라 결정될 수 있다.
비디오 복호화 장치(100)는 일 실시예에 따라, 결정된 적어도 하나의 기준 부호화 단위를 복호화할 수 있다. 비디오 복호화 장치(100)는 상술한 실시예를 통해 결정된 기준 부호화 단위에 기초하여 영상을 복호화 할 수 있다. 기준 부호화 단위를 복호화 하는 방법은 영상을 복호화 하는 다양한 방법들을 포함할 수 있다.
일 실시예에 따라 비디오 복호화 장치(100)는 현재 부호화 단위의 형태를 나타내는 블록 형태 정보 또는 현재 부호화 단위를 분할하는 방법을 나타내는 분할 형태 정보를 비트스트림으로부터 획득하여 이용할 수 있다. 블록 형태 정보 또는 분할 형태 정보는 다양한 데이터 단위와 관련된 비트스트림에 포함될 수 있다. 예를 들면, 비디오 복호화 장치(100)는 시퀀스 파라미터 세트(sequence parameter set), 픽쳐 파라미터 세트(picture parameter set), 비디오 파라미터 세트(video parameter set), 슬라이스 헤더(slice header), 슬라이스 세그먼트 헤더(slice segment header)에 포함된 블록 형태 정보 또는 분할 형태 정보를 이용할 수 있다. 나아가, 비디오 복호화 장치(100)는 최대 부호화 단위, 기준 부호화 단위, 프로세싱 블록마다 비트스트림으로부터 블록 형태 정보 또는 분할 형태 정보에 대응하는 신택스를 비트스트림으로부터 획득하여 이용할 수 있다.
이제까지 다양한 실시예들을 중심으로 살펴보았다. 본 발명이 속하는 기술 분야에서 통상의 지식을 가진 자는 본 발명이 본 발명의 본질적인 특성에서 벗어나지 않는 범위에서 변형된 형태로 구현될 수 있음을 이해할 수 있을 것이다. 그러므로 개시된 실시예들은 한정적인 관점이 아니라 설명적인 관점에서 고려되어야 한다. 본 발명의 범위는 전술한 설명이 아니라 특허청구범위에 나타나 있으며, 그와 동등한 범위 내에 있는 모든 차이점은 본 발명에 포함된 것으로 해석되어야 할 것이다.
한편, 상술한 본 발명의 실시예들은 컴퓨터에서 실행될 수 있는 프로그램으로 작성가능하고, 컴퓨터로 읽을 수 있는 기록매체를 이용하여 상기 프로그램을 동작시키는 범용 디지털 컴퓨터에서 구현될 수 있다. 상기 컴퓨터로 읽을 수 있는 기록매체는 마그네틱 저장매체(예를 들면, 롬, 플로피 디스크, 하드디스크 등), 광학적 판독 매체(예를 들면, 시디롬, 디브이디 등)와 같은 저장매체를 포함한다.
Claims (15)
- 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하는 단계;상기 인트라 머지 후보가 상기 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계;상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계; 및상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 단계를 포함하고,상기 인터 머지 후보는, 상기 현재 블록에 공간적으로 인접하는 주변 블록 및 상기 현재 블록의 시간적으로 인접하는 픽처 내에서 상기 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록이고,상기 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록인 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서,상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하는 단계는, 상기 인트라 머지 후보가 상기 머지 후보 리스트에 포함될 수 있는지 여부를 나타내는 인트라 머지 정보를, 비트스트림으로부터 획득하는 단계를 포함하고,상기 머지 후보 리스트를 결정하는 단계는, 상기 인트라 머지 정보에 따라 상기 인트라 머지 후보가 상기 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법
- 제1항에 있어서, 상기 머지 후보 리스트를 결정하는 단계는,적어도 하나의 인터 머지 후보에 따른 예측 샘플값과 상기 인트라 머지 후보에 따른 예측 샘플값의 가중평균값으로 결정된 샘플들을 포함하는 예측 블록을, 인터-인트라 머지 후보로서 결정하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계는,적어도 하나의 인터 머지 후보를 포함하는 인터 머지 후보 리스트를 결정하는 단계; 및적어도 하나의 인트라 머지 후보를 포함하는 인트라 머지 후보 리스트를 결정하는 단계를 포함하고,상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계는, 상기 인터 머지 후보 리스트 및 상기 인트라 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계는,적어도 하나의 인터 머지 후보와 적어도 하나의 인트라 머지 후보를 포함하는 하나의 머지 후보 리스트를 결정하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서, 상기 비디오 복호화 방법은,상기 인트라 머지 정보에 따라 상기 현재 블록에 공간적으로 인접하는 주변 샘플들이 상기 머지 후보 리스트에 포함될 수 없는 경우에, 상기 현재 블록의 상기 인트라 머지 후보를 포함하지 않는 머지 후보 리스트를 결정하는 단계를 더 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서, 상기 머지 후보 리스트를 결정하는 단계는,상기 인트라 머지 후보를, 상기 현재 블록에 공간적으로 소정 개수의 소정 방향으로 인접하는 주변 샘플들을 이용하여 결정하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서, 상기 머지 후보 리스트를 결정하는 단계는,상기 인트라 머지 후보를, 상기 비트스트림으로부터 획득된 MPM (most probable mode) 인덱스가 가리키는 방향으로부터 결정되는 소정 개수의 소정 방향으로 인접하는 주변 샘플들을 이용하여 결정하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 제1항에 있어서, 상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계는,상기 머지 후보 리스트 중에서 하나의 후보를 가리키는 머지 후보 인덱스를, 상기 비트스트림으로부터 획득하는 단계; 및상기 생성된 머지 후보 리스트 중에서 상기 머지 후보 인덱스가 가리키는 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 단계를 포함하는 것을 특징으로 하는 비디오 복호화 방법.
- 비디오 복호화 장치에 있어서,인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는지 여부를 결정하고, 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 머지 후보 리스트 결정부; 및상기 생성된 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하고, 상기 현재 블록의 예측 샘플들과 상기 현재 블록의 잔차 샘플들을 이용하여, 상기 현재 블록을 복원하는 복호화부를 포함하고,상기 인터 머지 후보는, 상기 현재 블록에 공간적으로 인접하는 주변 블록 및 상기 현재 블록의 시간적으로 인접하는 픽처 내에서 상기 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록이고,상기 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록인 것을 특징으로 하는 비디오 복호화 장치.
- 제10항에 있어서, 상기 머지 후보 리스트 결정부는,상기 인트라 머지 후보가 상기 머지 후보 리스트에 포함될 수 있는지 여부를 나타내는 인트라 머지 정보를 비트스트림으로부터 획득하고, 상기 인트라 머지 정보에 따라 상기 인트라 머지 후보가 머지 후보 리스트에 포함될 수 있는 경우에, 상기 현재 블록의 인터 머지 후보와 상기 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 것을 특징으로 하는 비디오 복호화 장치.
- 제10항에 있어서, 상기 머지 후보 리스트 결정부는,적어도 하나의 인터 머지 후보의 샘플값과 적어도 하나의 인트라 머지 후보의 샘플값의 가중평균값으로 결정된 샘플들을 포함하는 예측 블록을, 인터-인트라 머지 후보로서 결정하는 것을 특징으로 하는 비디오 복호화 장치.
- 제10항에 있어서, 상기 머지 후보 리스트 결정부는,적어도 하나의 인터 머지 후보를 포함하는 인터 머지 후보 리스트를 결정하고, 적어도 하나의 인트라 머지 후보를 포함하는 인트라 머지 후보 리스트를 결정하고,상기 복호화부는, 상기 인터 머지 후보 리스트 및 상기 인트라 머지 후보 리스트 중에서 선택된 예측 후보를 이용하여 상기 현재 블록의 예측 샘플들을 생성하는 것을 특징으로 하는 비디오 복호화 장치.
- 인트라 머지 후보가 머지 후보 리스트에 포함되는 경우에, 현재 블록의 인터 머지 후보와 인트라 머지 후보 중 적어도 하나를 포함하는 머지 후보 리스트를 결정하는 단계;상기 생성된 머지 후보 리스트 중에서 상기 현재 블록의 예측 샘플들을 생성하기 위해 선택된 예측 후보를 가리키는 머지 후보 인덱스를 생성하는 단계;상기 현재 블록의 예측 샘플들과 상기 현재 블록 간의 잔차 샘플들 및 상기 머지 후보 인덱스를 부호화하고, 상기 부호화된 정보를 포함하는 비트스트림을 생성하는 단계를 포함하고,상기 인터 머지 후보는, 상기 현재 블록에 공간적으로 인접하는 주변 블록 및 상기 현재 블록의 시간적으로 인접하는 픽처 내에서 상기 현재 블록의 위치에 대응하여 위치하는 콜로케이티드 블록(collocated block) 중 적어도 하나의 블록의 움직임 정보에 의해 결정되는 예측 블록이고,상기 인트라 머지 후보는, 현재 블록에 공간적으로 인접하는 주변 샘플들을 이용하여 결정되는 예측 블록인 것을 특징으로 하는 비디오 부호화 방법.
- 제14항에 있어서,상기 머지 후보 리스트를 결정하는 단계는,상기 인트라 머지 후보가 상기 머지 후보 리스트에 포함되는지 여부를 나타내는 인트라 머지 정보를 생성하는 단계를 포함하고,상기 적어도 하나의 인터 머지 후보의 샘플값과 상기 인트라 머지 후보의 샘플값의 가중평균값으로 결정된 샘플들을 포함하는 예측 블록을, 인터-인트라 머지 후보로서 결정하는 것을 특징으로 하는 비디오 부호화 방법.
Priority Applications (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| KR1020187010758A KR20180085714A (ko) | 2015-12-17 | 2016-12-15 | 머지 후보 리스트를 이용한 비디오 복호화 방법 및 비디오 복호화 장치 |
| US15/780,047 US10666936B2 (en) | 2015-12-17 | 2016-12-15 | Video decoding method and video decoding apparatus using merge candidate list |
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| US201562268784P | 2015-12-17 | 2015-12-17 | |
| US62/268,784 | 2015-12-17 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| WO2017105097A1 true WO2017105097A1 (ko) | 2017-06-22 |
Family
ID=59057026
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| PCT/KR2016/014695 Ceased WO2017105097A1 (ko) | 2015-12-17 | 2016-12-15 | 머지 후보 리스트를 이용한 비디오 복호화 방법 및 비디오 복호화 장치 |
Country Status (3)
| Country | Link |
|---|---|
| US (1) | US10666936B2 (ko) |
| KR (1) | KR20180085714A (ko) |
| WO (1) | WO2017105097A1 (ko) |
Cited By (9)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2019103542A1 (ko) * | 2017-11-23 | 2019-05-31 | 엘지전자 주식회사 | 인트라 예측 모드 기반 영상 처리 방법 및 이를 위한 장치 |
| CN109963155A (zh) * | 2017-12-23 | 2019-07-02 | 华为技术有限公司 | 图像块的运动信息的预测方法、装置及编解码器 |
| WO2020072224A1 (en) * | 2018-10-06 | 2020-04-09 | Tencent America Llc. | Method and apparatus for video coding |
| EP3643060A1 (en) * | 2017-06-23 | 2020-04-29 | Qualcomm Incorporated | Combination of inter-prediction and intra-prediction in video coding |
| US20210314602A1 (en) * | 2018-09-17 | 2021-10-07 | Mediatek Inc. | Methods and Apparatuses of Combining Multiple Predictors for Block Prediction in Video Coding Systems |
| EP3849184A4 (en) * | 2018-11-08 | 2021-12-01 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | PROCESS FOR CODING / DECODING IMAGE SIGNALS AND DEVICE FOR THEREFORE |
| US20220264141A1 (en) * | 2016-12-05 | 2022-08-18 | Lg Electronics Inc. | Method and device for decoding image in image coding system |
| US11595673B2 (en) * | 2018-06-27 | 2023-02-28 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US11870988B2 (en) | 2018-07-30 | 2024-01-09 | Samsung Electronics Co., Ltd. | Method and apparatus for image encoding, and method and apparatus for image decoding |
Families Citing this family (26)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2016085229A1 (ko) * | 2014-11-27 | 2016-06-02 | 주식회사 케이티 | 비디오 신호 처리 방법 및 장치 |
| US11032550B2 (en) * | 2016-02-25 | 2021-06-08 | Mediatek Inc. | Method and apparatus of video coding |
| CN117395394A (zh) * | 2017-03-22 | 2024-01-12 | 韩国电子通信研究院 | 使用参考块的预测方法和装置 |
| US11172203B2 (en) * | 2017-08-08 | 2021-11-09 | Mediatek Inc. | Intra merge prediction |
| CN111819851B (zh) * | 2018-01-30 | 2024-08-20 | 夏普株式会社 | 用于使用预测运动向量起点对视频编码执行运动向量预测的系统和方法 |
| KR102822660B1 (ko) | 2018-04-04 | 2025-06-18 | 닛폰 호소 교카이 | 예측 화상 보정 장치, 화상 부호화 장치, 화상 복호 장치, 및 프로그램 |
| US11470356B2 (en) * | 2018-04-17 | 2022-10-11 | Mediatek Inc. | Method and apparatus of neural network for video coding |
| CN112602324B (zh) | 2018-06-22 | 2024-07-23 | Op方案有限责任公司 | 块水平几何划分 |
| JP7395518B2 (ja) * | 2018-06-30 | 2023-12-11 | オッポ広東移動通信有限公司 | マージモードに基づくインター予測方法及び装置 |
| RU2768956C1 (ru) * | 2018-09-28 | 2022-03-25 | ДжейВиСиКЕНВУД Корпорейшн | Устройство декодирования изображения, способ декодирования изображения, устройство кодирования изображения и способ кодирования изображения |
| KR102332528B1 (ko) * | 2018-10-10 | 2021-12-01 | 삼성전자주식회사 | 움직임 벡터 차분값을 이용한 비디오 부호화 및 복호화 방법, 및 움직임 정보의 부호화 및 복호화 장치 |
| US11652984B2 (en) * | 2018-11-16 | 2023-05-16 | Qualcomm Incorporated | Position-dependent intra-inter prediction combination in video coding |
| US20200162737A1 (en) | 2018-11-16 | 2020-05-21 | Qualcomm Incorporated | Position-dependent intra-inter prediction combination in video coding |
| US20200169757A1 (en) * | 2018-11-23 | 2020-05-28 | Mediatek Inc. | Signaling For Multi-Reference Line Prediction And Multi-Hypothesis Prediction |
| US11172214B2 (en) * | 2018-12-21 | 2021-11-09 | Qualcomm Incorporated | Derivation of processing area for parallel processing in video coding |
| WO2020141915A1 (ko) * | 2019-01-01 | 2020-07-09 | 엘지전자 주식회사 | 히스토리 기반 모션 벡터 예측을 기반으로 비디오 신호를 처리하기 위한 방법 및 장치 |
| CN113647104B (zh) | 2019-01-28 | 2025-01-07 | Op方案有限责任公司 | 在以自适应区域数量进行的几何分区中的帧间预测 |
| CN120499377A (zh) | 2019-01-28 | 2025-08-15 | Op方案有限责任公司 | 具有区域数自适应的几何划分的形状自适应离散余弦变换 |
| WO2020262901A1 (ko) * | 2019-06-24 | 2020-12-30 | 엘지전자 주식회사 | 영상 디코딩 방법 및 그 장치 |
| WO2020262902A1 (ko) | 2019-06-24 | 2020-12-30 | 엘지전자 주식회사 | 쌍 예측을 적용하는 영상 디코딩 방법 및 그 장치 |
| CA3253483A1 (en) * | 2019-12-12 | 2026-03-02 | Lg Electronics Inc. | Filtering-based image coding device and method |
| JP7448349B2 (ja) * | 2019-12-17 | 2024-03-12 | シャープ株式会社 | 動画像復号装置 |
| KR20230043747A (ko) * | 2021-09-24 | 2023-03-31 | 주식회사 케이티 | 비디오 신호 부호화/복호화 방법, 그리고 비트스트림을 저장한 기록 매체 |
| WO2023046955A1 (en) * | 2021-09-27 | 2023-03-30 | Interdigital Vc Holdings France, Sas | Template-based syntax element prediction |
| EP4676032A1 (en) * | 2024-07-02 | 2026-01-07 | InterDigital CE Patent Holdings, SAS | Method and apparatus for encoding/decoding with intra merge prediction mode |
| WO2026010467A1 (ko) * | 2024-07-05 | 2026-01-08 | 한국전자통신연구원 | 영상 부호화/복호화를 위한 방법, 장치 및 기록 매체 |
Citations (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2014003367A1 (ko) * | 2012-06-26 | 2014-01-03 | 엘지전자 주식회사 | 영상 복호화 방법 및 이를 이용하는 장치 |
| JP2015180075A (ja) * | 2011-09-23 | 2015-10-08 | ケィティ、コーポレーションKt Corporation | マージ候補ブロック誘導方法及びこのような方法を用いる装置 |
| KR20150122106A (ko) * | 2011-11-28 | 2015-10-30 | 에스케이텔레콤 주식회사 | 개선된 머지를 이용한 영상 부호화/복호화 방법 및 장치 |
| JP5823628B2 (ja) * | 2011-11-07 | 2015-11-25 | インフォブリッジ ピーティーイー. エルティーディー. | マージリスト構築方法 |
| KR20150138309A (ko) * | 2013-04-04 | 2015-12-09 | 퀄컴 인코포레이티드 | 3 차원(3d)비디오 코딩을 위한 진보된 병합 모드 |
Family Cites Families (13)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US9143795B2 (en) | 2011-04-11 | 2015-09-22 | Texas Instruments Incorporated | Parallel motion estimation in video coding |
| JP5364219B1 (ja) * | 2011-12-16 | 2013-12-11 | パナソニック株式会社 | 動画像符号化方法、および動画像符号化装置 |
| CN108377393A (zh) * | 2012-03-22 | 2018-08-07 | 联发科技股份有限公司 | 编码视频数据的方法以及装置 |
| WO2013189257A1 (en) * | 2012-06-20 | 2013-12-27 | Mediatek Inc. | Method and apparatus of bi-directional prediction for scalable video coding |
| US20140071235A1 (en) * | 2012-09-13 | 2014-03-13 | Qualcomm Incorporated | Inter-view motion prediction for 3d video |
| EP2974313B1 (en) * | 2013-03-12 | 2018-07-11 | HFI Innovation Inc. | Inter-layer motion vector scaling for scalable video coding |
| EP2988509A4 (en) * | 2013-04-17 | 2016-10-05 | Samsung Electronics Co Ltd | MULTI-VIEW VIDEO CODING METHOD WITH ANTICIPATED SYNTHESIS FORECAST AND DEVICE THEREFOR AND MULTIPLE VIDEO VIDEO CODING METHOD AND DEVICE THEREFOR |
| US20160134891A1 (en) * | 2013-04-23 | 2016-05-12 | Samsung Electronics Co., Ltd. | Multi-viewpoint video encoding method using viewpoint synthesis prediction and apparatus for same, and multi-viewpoint video decoding method and apparatus for same |
| US20150271515A1 (en) * | 2014-01-10 | 2015-09-24 | Qualcomm Incorporated | Block vector coding for intra block copy in video coding |
| US9756354B2 (en) * | 2014-03-17 | 2017-09-05 | Qualcomm Incorporated | Block vector predictor for intra block copying |
| US10432928B2 (en) * | 2014-03-21 | 2019-10-01 | Qualcomm Incorporated | Using a current picture as a reference for video coding |
| US10412387B2 (en) * | 2014-08-22 | 2019-09-10 | Qualcomm Incorporated | Unified intra-block copy and inter-prediction |
| US9854237B2 (en) * | 2014-10-14 | 2017-12-26 | Qualcomm Incorporated | AMVP and merge candidate list derivation for intra BC and inter prediction unification |
-
2016
- 2016-12-15 KR KR1020187010758A patent/KR20180085714A/ko not_active Withdrawn
- 2016-12-15 US US15/780,047 patent/US10666936B2/en not_active Expired - Fee Related
- 2016-12-15 WO PCT/KR2016/014695 patent/WO2017105097A1/ko not_active Ceased
Patent Citations (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2015180075A (ja) * | 2011-09-23 | 2015-10-08 | ケィティ、コーポレーションKt Corporation | マージ候補ブロック誘導方法及びこのような方法を用いる装置 |
| JP5823628B2 (ja) * | 2011-11-07 | 2015-11-25 | インフォブリッジ ピーティーイー. エルティーディー. | マージリスト構築方法 |
| KR20150122106A (ko) * | 2011-11-28 | 2015-10-30 | 에스케이텔레콤 주식회사 | 개선된 머지를 이용한 영상 부호화/복호화 방법 및 장치 |
| WO2014003367A1 (ko) * | 2012-06-26 | 2014-01-03 | 엘지전자 주식회사 | 영상 복호화 방법 및 이를 이용하는 장치 |
| KR20150138309A (ko) * | 2013-04-04 | 2015-12-09 | 퀄컴 인코포레이티드 | 3 차원(3d)비디오 코딩을 위한 진보된 병합 모드 |
Cited By (38)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US12604028B2 (en) * | 2016-12-05 | 2026-04-14 | Lg Electronics Inc. | Method for image decoding/encoding, and method of transmitting data for an image |
| US12096020B2 (en) * | 2016-12-05 | 2024-09-17 | Lg Electronics Inc. | Method and device for decoding image in image coding system |
| US20220264141A1 (en) * | 2016-12-05 | 2022-08-18 | Lg Electronics Inc. | Method and device for decoding image in image coding system |
| EP3643060A1 (en) * | 2017-06-23 | 2020-04-29 | Qualcomm Incorporated | Combination of inter-prediction and intra-prediction in video coding |
| US12052428B2 (en) | 2017-06-23 | 2024-07-30 | Qualcomm Incorporated | Combination of inter-prediction and intra-prediction in video coding |
| EP4376406A1 (en) * | 2017-06-23 | 2024-05-29 | QUALCOMM Incorporated | Combination of inter-prediction and intra-prediction in video coding |
| WO2019103542A1 (ko) * | 2017-11-23 | 2019-05-31 | 엘지전자 주식회사 | 인트라 예측 모드 기반 영상 처리 방법 및 이를 위한 장치 |
| US11297326B2 (en) | 2017-12-23 | 2022-04-05 | Huawei Technologies Co., Ltd. | Method and apparatus for predicting motion information of picture block, encoder, and decoder |
| CN109963155A (zh) * | 2017-12-23 | 2019-07-02 | 华为技术有限公司 | 图像块的运动信息的预测方法、装置及编解码器 |
| CN109963155B (zh) * | 2017-12-23 | 2023-06-06 | 华为技术有限公司 | 图像块的运动信息的预测方法、装置及编解码器 |
| EP3731526A4 (en) * | 2017-12-23 | 2020-12-30 | Huawei Technologies Co., Ltd. | METHOD AND DEVICE FOR PREDICTING MOVEMENT INFORMATION OF AN IMAGE BLOCK, AND CODEC |
| US12088819B2 (en) | 2017-12-23 | 2024-09-10 | Huawei Technologies Co., Ltd. | Method and apparatus for predicting motion information of picture block, encoder, and decoder |
| US12289460B2 (en) * | 2018-06-27 | 2025-04-29 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US20240129502A1 (en) * | 2018-06-27 | 2024-04-18 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US11595673B2 (en) * | 2018-06-27 | 2023-02-28 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US20230291920A1 (en) * | 2018-06-27 | 2023-09-14 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US20250287026A1 (en) * | 2018-06-27 | 2025-09-11 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US11882300B2 (en) | 2018-06-27 | 2024-01-23 | Avago Technologies International Sales Pte. Limited | Low complexity affine merge mode for versatile video coding |
| US11882246B2 (en) | 2018-07-30 | 2024-01-23 | Samsung Electronics Co., Ltd. | Method and apparatus for image encoding, and method and apparatus for image decoding |
| US11870988B2 (en) | 2018-07-30 | 2024-01-09 | Samsung Electronics Co., Ltd. | Method and apparatus for image encoding, and method and apparatus for image decoding |
| US11997311B2 (en) * | 2018-09-17 | 2024-05-28 | Hfi Innovation Inc. | Methods and apparatuses of combining multiple predictors for block prediction in video coding systems |
| US20210314602A1 (en) * | 2018-09-17 | 2021-10-07 | Mediatek Inc. | Methods and Apparatuses of Combining Multiple Predictors for Block Prediction in Video Coding Systems |
| CN111919440B (zh) * | 2018-10-06 | 2023-03-24 | 腾讯美国有限责任公司 | 用于视频解码的方法、装置和计算机可读介质 |
| CN111919440A (zh) * | 2018-10-06 | 2020-11-10 | 腾讯美国有限责任公司 | 用于视频编码的方法和装置 |
| WO2020072224A1 (en) * | 2018-10-06 | 2020-04-09 | Tencent America Llc. | Method and apparatus for video coding |
| US10764601B2 (en) | 2018-10-06 | 2020-09-01 | Tencent America LLC | Method and apparatus for video coding |
| KR20200124749A (ko) * | 2018-10-06 | 2020-11-03 | 텐센트 아메리카 엘엘씨 | 비디오 코딩을 위한 방법 및 장치 |
| KR102461780B1 (ko) | 2018-10-06 | 2022-11-01 | 텐센트 아메리카 엘엘씨 | 비디오 코딩을 위한 방법 및 장치 |
| US11909955B2 (en) | 2018-11-08 | 2024-02-20 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | Image signal encoding/decoding method and apparatus therefor |
| RU2766152C1 (ru) * | 2018-11-08 | 2022-02-08 | Гуандун Оппо Мобайл Телекоммьюникейшнз Корп., Лтд. | Способ и устройство для кодирования/декодирования сигнала изображения |
| JP2022505874A (ja) * | 2018-11-08 | 2022-01-14 | オッポ広東移動通信有限公司 | ビデオ信号の符号化/復号化方法及び前記方法のための装置 |
| EP3849184A4 (en) * | 2018-11-08 | 2021-12-01 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | PROCESS FOR CODING / DECODING IMAGE SIGNALS AND DEVICE FOR THEREFORE |
| US11252405B2 (en) | 2018-11-08 | 2022-02-15 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | Image signal encoding/decoding method and apparatus therefor |
| EP4221204A1 (en) * | 2018-11-08 | 2023-08-02 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | Image signal encoding/decoding method and apparatus therefor |
| US12413706B2 (en) | 2018-11-08 | 2025-09-09 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | Image signal encoding/decoding method and apparatus therefor |
| JP7182705B2 (ja) | 2018-11-08 | 2022-12-02 | オッポ広東移動通信有限公司 | ビデオ信号の符号化/復号化方法及び前記方法のための装置 |
| CN116347069B (zh) * | 2018-11-08 | 2026-03-24 | Oppo广东移动通信有限公司 | 视频信号编码/解码方法以及用于所述方法的设备 |
| CN116347069A (zh) * | 2018-11-08 | 2023-06-27 | Oppo广东移动通信有限公司 | 视频信号编码/解码方法以及用于所述方法的设备 |
Also Published As
| Publication number | Publication date |
|---|---|
| US10666936B2 (en) | 2020-05-26 |
| US20180359470A1 (en) | 2018-12-13 |
| KR20180085714A (ko) | 2018-07-27 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| WO2017105097A1 (ko) | 머지 후보 리스트를 이용한 비디오 복호화 방법 및 비디오 복호화 장치 | |
| WO2017122997A1 (ko) | 영상 부호화 방법 및 장치와 영상 복호화 방법 및 장치 | |
| WO2017090993A1 (ko) | 비디오 복호화 방법 및 그 장치 및 비디오 부호화 방법 및 그 장치 | |
| WO2018070550A1 (ko) | 픽처 외곽선의 부호화 단위를 부호화 또는 복호화하는 방법 및 장치 | |
| WO2018124653A1 (ko) | 인트라 예측에서 참조 샘플을 필터링하는 방법 및 장치 | |
| WO2017135759A1 (ko) | 크로마 다중 변환에 의한 비디오 복호화 방법 및 장치, 크로마 다중 변환에 의한 비디오 부호화 방법 및 장치 | |
| WO2017142326A1 (ko) | 비디오 부호화 방법 및 장치, 그 복호화 방법 및 장치 | |
| WO2018070554A1 (ko) | 루마 블록 및 크로마 블록을 부호화 또는 복호화하는 방법 및 장치 | |
| WO2011090314A2 (en) | Method and apparatus for encoding and decoding motion vector based on reduced motion vector predictor candidates | |
| WO2019009584A1 (ko) | 다중 코어 변환에 의한 비디오 복호화 방법 및 장치, 다중 코어 변환에 의한 비디오 부호화 방법 및 장치 | |
| WO2017142335A1 (ko) | 비디오 복호화 방법 및 그 장치 및 비디오 부호화 방법 및 그 장치 | |
| WO2017105141A1 (ko) | 영상을 부호화/복호화 하는 방법 및 그 장치 | |
| WO2017142319A1 (ko) | 영상 부호화 방법 및 장치와 영상 복호화 방법 및 장치 | |
| WO2018012893A1 (ko) | 영상을 부호화/복호화 하는 방법 및 그 장치 | |
| WO2018066927A1 (ko) | 인터 예측 모드 기반 영상 처리 방법 및 이를 위한 장치 | |
| WO2020184847A1 (ko) | Dmvr 및 bdof 기반의 인터 예측 방법 및 장치 | |
| WO2017090961A1 (ko) | 비디오 부호화 방법 및 장치, 비디오 복호화 방법 및 장치 | |
| WO2018105759A1 (ko) | 영상 부호화/복호화 방법 및 이를 위한 장치 | |
| WO2017091007A1 (ko) | 영상 부호화 방법 및 장치, 영상 복호화 방법 및 장치 | |
| WO2017142262A1 (ko) | 적응적인 블록 파티셔닝 방법 및 장치 | |
| WO2017091016A1 (ko) | 비디오 복호화 방법 및 장치, 그 부호화 방법 및 장치 | |
| WO2021141477A1 (ko) | 머지 후보들의 최대 개수 정보를 포함하는 시퀀스 파라미터 세트를 이용한 영상 부호화/복호화 방법, 장치 및 비트스트림을 전송하는 방법 | |
| WO2017082636A1 (ko) | 영상을 부호화/복호화 하는 방법 및 그 장치 | |
| WO2018194189A1 (ko) | 영상을 부호화/복호화 하는 방법 및 그 장치 | |
| WO2017138761A1 (ko) | 비디오 부호화 방법 및 장치, 비디오 복호화 방법 및 장치 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| 121 | Ep: the epo has been informed by wipo that ep was designated in this application |
Ref document number: 16876039 Country of ref document: EP Kind code of ref document: A1 |
|
| ENP | Entry into the national phase |
Ref document number: 20187010758 Country of ref document: KR Kind code of ref document: A |
|
| NENP | Non-entry into the national phase |
Ref country code: DE |
|
| 122 | Ep: pct application non-entry in european phase |
Ref document number: 16876039 Country of ref document: EP Kind code of ref document: A1 |