ES2946901T3 - Método y dispositivo de predicción de imágenes - Google Patents
Método y dispositivo de predicción de imágenes Download PDFInfo
- Publication number
- ES2946901T3 ES2946901T3 ES15902849T ES15902849T ES2946901T3 ES 2946901 T3 ES2946901 T3 ES 2946901T3 ES 15902849 T ES15902849 T ES 15902849T ES 15902849 T ES15902849 T ES 15902849T ES 2946901 T3 ES2946901 T3 ES 2946901T3
- Authority
- ES
- Spain
- Prior art keywords
- unit
- motion
- prediction
- control points
- image
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Active
Links
- 238000000034 method Methods 0.000 title abstract description 105
- 230000033001 locomotion Effects 0.000 claims abstract description 446
- 239000013598 vector Substances 0.000 claims abstract description 186
- PXFBZOLANLWPMH-UHFFFAOYSA-N 16-Epiaffinine Natural products C1C(C2=CC=CC=C2N2)=C2C(=O)CC2C(=CC)CN(C)C1C2CO PXFBZOLANLWPMH-UHFFFAOYSA-N 0.000 claims abstract description 109
- 238000003384 imaging method Methods 0.000 claims abstract 2
- 230000008569 process Effects 0.000 description 31
- 230000006870 function Effects 0.000 description 16
- 230000009466 transformation Effects 0.000 description 9
- 238000005516 engineering process Methods 0.000 description 8
- 238000012545 processing Methods 0.000 description 8
- 238000010586 diagram Methods 0.000 description 6
- 238000004891 communication Methods 0.000 description 3
- 238000012360 testing method Methods 0.000 description 3
- 238000011161 development Methods 0.000 description 2
- 230000009286 beneficial effect Effects 0.000 description 1
- 230000005540 biological transmission Effects 0.000 description 1
- 230000006835 compression Effects 0.000 description 1
- 238000007906 compression Methods 0.000 description 1
- 230000008878 coupling Effects 0.000 description 1
- 238000010168 coupling process Methods 0.000 description 1
- 238000005859 coupling reaction Methods 0.000 description 1
- 238000013461 design Methods 0.000 description 1
- 230000000694 effects Effects 0.000 description 1
- 239000000463 material Substances 0.000 description 1
- 239000011159 matrix material Substances 0.000 description 1
- 239000000203 mixture Substances 0.000 description 1
- 230000003287 optical effect Effects 0.000 description 1
- 230000008520 organization Effects 0.000 description 1
- 238000012805 post-processing Methods 0.000 description 1
Classifications
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
- H04N19/573—Motion compensation with multiple frame prediction using two or more reference frames in a given prediction direction
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/102—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or selection affected or controlled by the adaptive coding
- H04N19/103—Selection of coding mode or of prediction mode
- H04N19/105—Selection of the reference unit for prediction within a chosen coding or prediction mode, e.g. adaptive choice of position and number of pixels used for prediction
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/134—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the element, parameter or criterion affecting or controlling the adaptive coding
- H04N19/136—Incoming video signal characteristics or properties
- H04N19/137—Motion inside a coding unit, e.g. average field, frame or block difference
- H04N19/139—Analysis of motion vectors, e.g. their magnitude, direction, variance or reliability
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/169—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding
- H04N19/17—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object
- H04N19/172—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object the region being a picture, frame or field
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/10—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding
- H04N19/169—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding
- H04N19/17—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object
- H04N19/176—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using adaptive coding characterised by the coding unit, i.e. the structural portion or semantic portion of the video signal being the object or the subject of the adaptive coding the unit being an image region, e.g. an object the region being a block, e.g. a macroblock
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
- H04N19/513—Processing of motion vectors
- H04N19/517—Processing of motion vectors by encoding
- H04N19/52—Processing of motion vectors by encoding by predictive encoding
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
- H04N19/527—Global motion vector estimation
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N19/00—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals
- H04N19/50—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding
- H04N19/503—Methods or arrangements for coding, decoding, compressing or decompressing digital video signals using predictive coding involving temporal prediction
- H04N19/51—Motion estimation or motion compensation
- H04N19/537—Motion estimation other than block-based
- H04N19/54—Motion estimation other than block-based using feature points or meshes
Landscapes
- Engineering & Computer Science (AREA)
- Multimedia (AREA)
- Signal Processing (AREA)
- Compression Or Coding Systems Of Tv Signals (AREA)
- Image Analysis (AREA)
- Magnetic Resonance Imaging Apparatus (AREA)
- Apparatus For Radiation Diagnosis (AREA)
Abstract
Un método y dispositivo de predicción de imágenes. El método comprende: adquirir una primera unidad de referencia de una unidad de imagen, en el que la unidad de imagen y la primera unidad de referencia usan el mismo modelo afín para adquirir imágenes de predicción respectivas; adquirir información de movimiento sobre unidades básicas de compensación de movimiento en al menos dos posiciones preestablecidas en la primera unidad de referencia; y de acuerdo con la información de movimiento, adquirir información de movimiento sobre una unidad básica de compensación de movimiento de la unidad de imagen. Por lo tanto, la información de movimiento sobre la primera unidad de referencia del mismo modelo afín se utiliza en la multiplexación, que puede adquirir con mayor precisión un vector de movimiento de la unidad de imagen actual, mantener la complejidad de la codificación y decodificación al tiempo que mejora la precisión de la predicción y mejora la codificación y rendimiento de decodificación. (Traducción automática con Google Translate, sin valor legal)
Description
DESCRIPCIÓN
Método y dispositivo de predicción de imágenes
Campo técnico
La presente invención se refiere al campo del procesamiento de imágenes de vídeo, y en particular a un método y dispositivo de predicción de imágenes.
Antecedentes de la invención
Con el rápido desarrollo de las tecnologías de Internet y el incremento de la riqueza de la cultura material y espiritual de las personas, existen cada vez más demandas en la Internet por la aplicación de vídeos, especialmente para aplicación de vídeos de alta definición. No obstante, un video de alta definición tiene una cantidad muy grande de datos. Para transmitir un vídeo de alta definición en la Internet con un ancho de banda limitado, el primer problema que se tiene que resolver es la compresión y codificación del vídeo de alta definición. Actualmente, existen dos organizaciones internacionales dedicadas al desarrollo de las normas de codificación de vídeo, es decir, el Grupo de Expertos de Imágenes en Movimiento (MPEG) de la Organización Internacional de Normalización (ISO)/Comisión Electrotécnica Internacional (CEI) y el Grupo de Expertos en Codificación de Vídeo (VCEG) de la Unión Internacional de Telecomunicaciones-Sector de Normalización de las Telecomunicaciones (UIT-T). El MPEG, creado en 1986, se encarga de desarrollar normas relacionadas en el campo de la multimedia, que se aplican principalmente al almacenamiento, la radiodifusión televisiva, la transmisión de medios en Internet o redes inalámbricas, y similares. El UIT-T desarrolla principalmente normas de codificación de vídeo para el campo de la comunicación de vídeo en tiempo real, como la videotelefonía, las videoconferencias y otras aplicaciones.
En las décadas pasadas, las normas de codificación de vídeo internacional para diversas aplicaciones se han desarrollado con éxito, principalmente incluyendo: la norma MPEG-1 para discos compactos de vídeo (VCD), la norma MPEG-2 para disco de vídeo digital (DVD) y la difusión de vídeo digital (DVB), la norma H.261, la norma H.263, y la norma H.264 para videoconferencias, la norma MPEG-4 que permite la codificación de objetos en cualquier forma, y la última norma de Codificación de vídeo de Alta Eficiencia (HEVC).
En comparación con la última norma de codificación de vídeo HEVC, para una secuencia que incluye movimientos de rotación y acercamiento-alejamiento, una tecnología de predicción de compensación de movimiento con un campo de vector de movimiento con base en cambios lineales puede mejorar significativamente el rendimiento de la codificación. En una tecnología de predicción de compensación de movimiento existente basada en una transformación afín, después que se obtiene un parámetro de transformación afín de un bloque de imagen, se necesita calcular un vector de movimiento de cada punto en el bloque de imagen, y la predicción de compensación de movimiento necesita realizarse de acuerdo con el vector de movimiento del punto, a fin de obtener una señal de predicción de compensación de movimiento de cada punto.
Un modelo de movimiento con base en transformación afín es un método para codificar de manera efectiva los movimientos de rotación y acercamiento-alejamiento. Un vector de movimiento de cada píxel en un bloque de imagen que se va a procesar puede derivarse mediante el uso de vectores de movimiento de cuatro vértices del bloque. Para movimientos que incluyen únicamente rotación y acercamiento-alejamiento, se puede obtener un modelo de transformación afín mediante la obtención de únicamente vectores cualesquiera dos puntos de control en de movimiento de un bloque de imagen a procesar. Un parámetro de modelo de transformación afín se calcula mediante el uso de un vector de movimiento del punto de control, a fin de obtener un vector de movimiento de cada punto de píxel en el bloque actual. Un costo de distorsión de velocidad de un modo de predicción de movimiento afín se compara con un costo de distorsión de velocidad de un modo de predicción entre tramas en la norma de codificación de vídeo. Si el costo de distorsión de velocidad del modo de predicción de movimiento afín es más pequeño, el modo de predicción de movimiento afín se utiliza para codificar el bloque de imagen a procesar. Dicho bloque se denomina como un bloque de predicción de movimiento afín y una unidad de predicción correspondiente se denomina como una unidad de predicción de movimiento afín. Además, información de movimiento de los cuatro vértices del bloque de predicción de movimiento afín e información de movimiento de una posición central se almacenan en una unidad básica con un tamaño de 4x4. Un valor de vector de movimiento de la posición central es un valor promedio de los valores de vector de movimiento de los dos puntos de control. La información de movimiento incluye un vector de movimiento, un índice de trama de referencia, una dirección de predicción, y similares.
Para mejorar la eficiencia de la codificación, información de movimiento de un bloque adyacente del bloque de imagen a procesar puede reutilizarse directamente como información de movimiento de un punto de control en el bloque de imagen a procesar, sin requerir la realización adicional de búsqueda de movimiento mediante el uso de un vector de movimiento del bloque adyacente como un punto de inicio de búsqueda y para codificar una diferencia de vector de movimiento, reduciendo los bits consumidos para codificar la diferencia del vector de movimiento. Dicho método tiene un requerimiento relativamente alto en la precisión de la información del vector de movimiento del bloque adyacente reutilizado para el bloque actual, pero la precisión de la información del vector de movimiento del
bloque adyacente no puede ser garantizada en la técnica anterior. En consecuencia, no se puede mejorar la eficiencia de la codificación.
HUANG, HAN Y OTROS: " Control-Point Representation and Differential Coding Affine-Motion Compensation ", TRANSACCIONES IEEE EN CIRCUITOS Y SISTEMAS PARA TECNOLOGÍA DE VÍDEO, vol. 23, núm. 10, 31 de octubre de 2013 (2013-10-31), XP011528531 divulga que los vectores de movimiento en los puntos de control se pueden predecir y, por lo tanto, codificar de manera eficiente, lo que lleva a un rendimiento general mejorado al explotar la correlación espacial entre bloques de codificación adyacentes (ver Breve descripción de la invención). El documento WO 01/15456 A1 divulga un método de estimación de movimiento de vídeo para determinar el movimiento dominante en una imagen de vídeo (ver Breve descripción de la invención).
KUMAR S Y OTROS: " Global motion estimation in frequency and spatial domain ", ACÚSTICA, PROCESAMIENTO DEL HABLA Y SEÑAL, 2004. ACTAS. (ICASSP'04). CONFERENCIA INTERNACIONAL DEL IEEE EN MONTREAL, QUEBEC, CANADÁ DEL 17-21 DE MAYO DE 2004, PISCATAWAY, NJ, EE. UU., IEEE, PISCATAWAY, NJ, EE. UU., vol. 3, 17 de mayo de 2004 (2004-05-17), páginas 333-336, XP010718194, ISBN: 978-0-7803-8484-2 divulga un algoritmo de estimación de movimiento global rápido y robusto con base en una estrategia de refinamiento de grueso a fino de dos pasos, que es capaz de medir movimientos grandes (ver Breve descripción de la invención). MATHEW R Y OTROS: " Quad-Tree Motion Modeling With Leaf Merging ", TRANSACCIONES IEEE EN CIRCUITOS Y SISTEMAS PARA TECNOLOGÍA DE VÍDEO, INSTITUTO DE INGENIEROS ELÉCTRICOS Y ELECTRÓNICOS, EE. UU., vol. 20, núm. 10, 1 de octubre de 2010 (2010-10-01), páginas 1331-1345, XP011318748, ISSN: 1051-8215 divulga cómo se puede incorporar el paso de fusión en representaciones de movimiento de árbol cuaternario para una variedad de contextos de modelado de movimiento (ver Breve descripción de la invención).
Breve descripción de la invención
La presente invención proporciona un dispositivo de predicción de imágenes para mejorar la eficiencia de la codificación.
La palabra "invención", tal como se utiliza en la presente descripción, se refiere al concepto inventivo tal como lo entiende el solicitante en el momento de presentar la solicitud de patente. La materia para la que se solicita la protección se define en las reivindicaciones adjuntas. Todas las apariciones siguientes de la palabra "modalidad(des)", si se refieren a diferentes combinaciones de características de las definidas por las reivindicaciones independientes, se refieren a ejemplos que se divulgaron originalmente, pero que no representan modalidades de la presente invención reivindicada; estos ejemplos todavía se muestran solo con fines ilustrativos. De acuerdo con los ejemplos del método y dispositivo de predicción de imágenes, la información de movimiento de la primera unidad de referencia que utiliza un mismo modelo de predicción de movimiento afín se reutiliza y, por lo tanto, se obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia vector de movimiento. Y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Breve descripción de las figuras
Para describir las soluciones técnicas en las modalidades de la presente invención de manera más clara, lo siguiente describe brevemente los dibujos acompañantes que se requieren para describir las modalidades de la técnica anterior. Aparentemente, los dibujos acompañantes en la siguiente descripción muestran simplemente algunas modalidades de la presente invención, y un experto en la técnica aún puede derivar otros dibujos a partir de estos dibujos acompañantes sin esfuerzos creativos.
La Figura 1 es un diagrama de flujo esquemático de un método de predicción de imágenes de acuerdo con una modalidad de la presente invención;
La Figura 2 es un diagrama esquemático de unidades de predicción candidatas de acuerdo con una modalidad de la presente invención;
La Figura 3 es un diagrama esquemático de un bloque de imagen afín y puntos de control de acuerdo con una modalidad de la presente invención;
La Figura 4 es otro diagrama de flujo esquemático de un método de predicción de imágenes de acuerdo con una modalidad de la presente invención;
La Figura 5 es un diagrama de bloques esquemático de un dispositivo de predicción de imágenes de acuerdo con una modalidad de la presente invención;
La Figura 6 es otro diagrama de bloques esquemático de un dispositivo de predicción de imágenes de acuerdo con una modalidad de la presente invención;
La Figura 7 es otro diagrama de bloques esquemático de un dispositivo de predicción de imágenes de acuerdo
con una modalidad de la presente invención; y
La Figura 8 es otro diagrama de bloques esquemático de un dispositivo de predicción de imágenes de acuerdo con una modalidad de la presente invención.
Descripción de las modalidades
Lo siguiente describe de manera clara y completa las soluciones técnicas en las modalidades de la presente invención con referencia a los dibujos acompañantes en las modalidades de la presente invención. Aparentemente, las modalidades descritas son algunas, pero no todas las modalidades de la presente invención. Todas las otras modalidades obtenidas por un experto en la técnica basada en las modalidades de la presente invención sin esfuerzos creativos deberán caer dentro del alcance de protección de la presente invención.
Debe entenderse que, en las modalidades de la presente invención, se utiliza un modelo afín de rotación y acercamiento-alejamiento con base en dos puntos de control en cada unidad de predicción (cuatro parámetros), o se puede utilizar un modelo afín de rotación y acercamiento-alejamiento con base en tres puntos de control en cada unidad de predicción (seis parámetros), o un modelo afín en perspectiva con base en cuatro puntos de control en cada unidad de predicción (ocho parámetros) o similar, y no se impone ninguna limitación al respecto.
Debe entenderse que, una unidad básica de compensación de movimiento es una unidad mínima para realizar la compensación de movimiento, y la unidad tiene información de movimiento uniforme. En las modalidades de la presente invención, se utiliza un punto de píxel como una unidad básica de compensación de movimiento, o se puede utilizar una matriz de píxeles o similar como una unidad básica de compensación de movimiento, y no se impone ninguna limitación al respecto.
Debe entenderse que, en un modelo afín de cuatro parámetros, a partir de la información de movimiento de cualquiera de dos unidades básicas de compensación de movimiento, se puede interpolar la información de movimiento de todas las unidades de compensación de movimiento en una unidad de predicción de movimiento afín en la cual están ubicadas las dos unidades básicas de compensación de movimiento. Preferentemente, se puede obtener información de movimiento de interpolación más precisa al seleccionar unidades básicas de compensación de movimiento en cualquiera de los dos puntos de esquina de la unidad en la unidad de predicción de movimiento afín. Una posición del punto de esquina de la unidad es un punto en el cual convergen dos lados adyacentes de la unidad de predicción de movimiento afín, es decir, una primera unidad de referencia. Por ejemplo, si la unidad de predicción de movimiento afín es un triángulo, los puntos de esquina de la unidad son tres vértices del triángulo; si la unidad de predicción de movimiento afín es un cuadrángulo, los puntos de esquina de la unidad son cuatro vértices del cuadrángulo, y así sucesivamente. En las modalidades, para facilidad de la descripción, las unidades básicas de compensación de movimiento de las cuales se interpola la información de movimiento de todas las unidades de compensación de movimiento en la unidad de predicción de movimiento afín se denominan como puntos de control. Una modalidad de la presente invención proporciona un método de predicción de imágenes, el cual se implementa por un decodificador. El método específicamente incluye los siguientes pasos:
obtener una primera unidad de referencia de una unidad de imagen, donde las imágenes predichas respectivas se obtienen para la unidad de imagen y la primera unidad de referencia mediante el uso de un mismo modelo afín;
obtener información de movimiento de las unidades básicas de compensación de movimiento en dos o más posiciones preestablecidas en la primera unidad de referencia; y
obtener información de movimiento de una unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con la información de movimiento.
De acuerdo con el método y dispositivo de predicción de imágenes en esta modalidad de la presente invención, se reutiliza la información de movimiento de la primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, se obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin una búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de la codificación y decodificación.
Preferentemente, la posición preestablecida es una posición de punto de esquina de la unidad en la primera unidad de referencia, y la posición de punto de esquina es un punto en el cual convergen dos lados adyacentes de la primera unidad de referencia.
Preferentemente, por ejemplo, la obtención de la información de movimiento de las unidades básicas de compensación de movimiento en dos o más posiciones preestablecidas en la primera unidad de referencia incluye: obtener información de movimiento de unidades básicas de compensación de movimiento en tres posiciones preestablecidas en la primera unidad de referencia; y de manera correspondiente, la obtención de información de
movimiento de una unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con la información de movimiento incluye: obtener una dirección de predicción, un índice de trama de referencia y un vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con direcciones de predicción, índices de trama de referencia y vectores de movimiento de las unidades básicas de compensación de movimiento en las tres posiciones preestablecidas en la primera unidad de referencia.
La obtención de una dirección de predicción, un índice de trama de referencia y un vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con las direcciones de predicción, índices de trama de referencia y vectores de movimiento de las unidades básicas de compensación de movimiento en las tres posiciones preestablecidas en la primera unidad de referencia puede ser:
asignar una misma dirección de predicción a la unidad básica de compensación de movimiento de la unidad de imagen y unidades básicas de compensación de movimiento en dos posiciones preestablecidas en la primera unidad de referencia; asignar un mismo índice de trama de referencia a la unidad básica de compensación de movimiento de la unidad de imagen y las unidades básicas de compensación de movimiento en las dos posiciones preestablecidas en la primera unidad de referencia; y obtener el vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen por medio de interpolación de acuerdo con los vectores de movimiento de las unidades básicas de compensación de movimiento en las tres posiciones preestablecidas en la primera unidad de referencia.
La obtención del vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen por medio de interpolación de acuerdo con los vectores de movimiento de las unidades básicas de compensación de movimiento en las tres posiciones preestablecidas en la primera unidad de referencia se implementa de la siguiente manera:
donde x y y son respectivamente las coordenadas horizontal y vertical de la unidad básica de compensación de movimiento de la unidad de imagen, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x1 y x2 , y x3 y y1 , y2 , y y3 , son respectivamente las coordenadas horizontal y vertical de las unidades básicas de compensación de movimiento en las tres posiciones preestablecidas en la primera unidad de referencia, y vx1 , vx2 , y vx3 y vy1 , vy2 y vy3 son vectores de movimiento horizontales y verticales correspondientes.
Las fórmulas anteriores que son utilizadas para obtener el vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen por medio de interpolación son fórmulas comunes que se utilizan para completar la interpolación de acuerdo con la información de movimiento de las unidades básicas de compensación de movimiento en cualquier posición preestablecida seleccionada en la primera unidad de referencia.
En una modalidad específica, las fórmulas pueden simplificarse para diferentes escenarios de aplicación de acuerdo con la particularidad de las posiciones preestablecidas seleccionadas. Por ejemplo, en una modalidad específica de la presente invención, los puntos de esquina de la unidad izquierda superior, izquierda inferior y derecha superior en la unidad son seleccionados como las posiciones preestablecidas, y las fórmulas se simplifican para:
donde x y y son respectivamente las coordenadas horizontal y vertical de un punto de píxel en un bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x1, x2 , y x3 y y1, y2 , y y3 son respectivamente coordenadas horizontal y vertical de tres puntos de control en una unidad de predicción de movimiento afín, y vx1, vx2 , y vx3 y vy1, vy2 , y vy3 son vectores de movimiento horizontales y verticales correspondientes.
De manera alternativa, por ejemplo, el método incluye:
obtener información de movimiento de unidades básicas de compensación de movimiento en dos posiciones preestablecidas en la primera unidad de referencia; y de manera correspondiente, la obtención de la información de movimiento de una unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con la información de movimiento incluye: obtener una dirección de predicción, un índice de trama de referencia, y un vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con direcciones de predicción, índices de trama de referencia y vectores de movimiento de las unidades básicas de compensación de movimiento en las dos posiciones preestablecidas en la primera unidad de referencia.
La obtención del vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen por medio de interpolación de acuerdo con los vectores de movimiento de las unidades básicas de compensación de movimiento en las dos posiciones preestablecidas en la primera unidad de referencia se implementa de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical de la unidad básica de compensación de movimiento de la unidad de imagen, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x1 y x2, y y1 y y2 son respectivamente coordenadas horizontal y vertical de las unidades básicas de compensación de movimiento en las dos posiciones preestablecidas en la primera unidad de referencia, y vx1 y vx2 y vy1 y vy2 son vectores de movimiento horizontales y verticales correspondientes.
Las fórmulas anteriores que se utilizan para obtener el vector de movimiento de la unidad básica de compensación de movimiento de la unidad de imagen por medio de interpolación son fórmulas comunes que se utilizan para completar la interpolación de acuerdo con información de movimiento de las unidades básicas de compensación de movimiento en cualquiera posiciones preestablecidas y seleccionadas en la primera unidad de referencia. En una modalidad específica, las fórmulas pueden simplificarse para diferentes escenarios de aplicación de acuerdo con la particularidad de las posiciones preestablecidas seleccionadas. Por ejemplo, en una modalidad específica de la presente invención, los puntos de esquina de la unidad izquierda superior y derecha superior en la unidad son seleccionados como las posiciones preestablecidas, y las fórmulas son simplificadas para:
donde x y y son respectivamente las coordenadas horizontal y vertical de un punto de píxel en un bloque a procesar, vx y vy son vectores de movimiento horizontales y verticales correspondientes, y xc, y x1, y y0 , y y1 son respectivamente las coordenadas horizontal y vertical de dos puntos de control en una unidad de predicción de movimiento afín, donde y0 es igual a y1, y vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontales y verticales correspondientes.
Además, la presente invención proporciona un método de predicción de imágenes aplicado a un proceso de codificación. El método de predicción de imágenes aplicado a un proceso de codificación es el mismo que el método de predicción de imágenes anterior aplicado a un proceso de decodificación. Por lo tanto, se puede obtener un mismo efecto de mejorar el rendimiento de codificación.
Lo siguiente describe implementaciones específicas de la presente invención mediante el uso de ejemplos específicos.
La Figura 1 es un diagrama de flujo esquemático de un método de predicción de imágenes de acuerdo con una modalidad de la presente invención. El método mostrado en la Figura 1 puede realizarse por un dispositivo de decodificación, tal como un decodificador.
Específicamente, tal como se muestra en la Figura 1, el método 1000 incluye los siguientes pasos.
S1100. Leer un flujo de bits y analizar el flujo de bits para obtener un elemento de sintaxis, donde el elemento de sintaxis se usa para determinar si un bloque de imagen a procesar reutiliza información de movimiento de modelo afín de un bloque adyacente. Cuando se determina que el bloque de imagen a procesar reutiliza la información de movimiento del modelo afín del bloque adyacente, el proceso avanza al paso S1200.
S1200. Determinar una unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar.
Un primer método de implementación específico 1210 del paso incluye los siguientes pasos:
51211. Determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar.
Como se muestra en la Figura 2, en esta modalidad de la presente invención, las unidades de predicción en las cuales respectivamente se localizan bloques 4x4 en cinco posiciones A, B, C, D y E que están espacialmente adyacentes al bloque de imagen a procesar. Debe entenderse que, alternativamente, se pueden seleccionar algunas de las posiciones A, B, C, D y E, o las unidades de predicción en las cuales se localizan otros bloques adyacentes en el dominio de tiempo al bloque de imagen a procesar pueden seleccionarse para formar el conjunto, y no se les impone ninguna limitación.
51212. Comprobar, en el orden preestablecido, si una unidad de predicción en el conjunto es una unidad de predicción de movimiento afín.
El orden preestablecido es un orden que está predeterminado en un protocolo mediante los lados de codificación y decodificación y se mantiene consistente con los lados de codificación y decodificación. En esta modalidad de la presente invención, el orden preestablecido es A, B, C, D y E. Debe entenderse que, alternativamente, el orden preestablecido puede ser B, D, A, E, y C, u otro orden, y no se les impone ninguna limitación.
51213. Si se encuentra que la unidad de predicción es una unidad de predicción de movimiento afín, detener la
comprobación y utilizar la unidad de predicción como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar.
Un segundo método de implementación específico 1220 del paso incluye los siguientes pasos.
51221. Determinar un conjunto de unidades de predicción candidatas para un bloque de imagen a procesar.
Además de la misma forma de determinación del conjunto que en S1211, el método puede incluir: eliminar una unidad de predicción de movimiento no afín en el conjunto del conjunto. Por ejemplo, el conjunto determinado mediante el uso de la forma de determinación de S1211 incluye las unidades de predicción en las cuales se localizan A, B, C, D y E, y las unidades de predicción en las cuales se localizan C y D no son unidades de predicción afín. Por lo tanto, C y D son eliminadas del conjunto, y el conjunto determinado de unidades de predicción candidatas incluye unidades de predicción en las cuales se localizan A, B, y E.
De manera alternativa, el método puede incluir: limitar una capacidad del conjunto, y eliminar, del conjunto, una unidad de predicción candidata cuyo orden de comprobación se ubica detrás de una cantidad permitida de unidades de predicción candidatas. Por ejemplo, la cantidad de unidades de predicción candidatas en el conjunto se establece a un máximo de 2, y un conjunto que está con un orden de comprobación y que se determina mediante el uso de la forma de determinación de S1211 de acuerdo con el orden de comprobación de S1212 es A, D, C, E y B. Por lo tanto, C, E y B se eliminan del conjunto, y el conjunto determinado de unidades de predicción candidatas incluye unidades de predicción en las cuales se localizan A y D. Debe entenderse que, la capacidad del conjunto puede establecerse a 3 o 4, o puede no estar limitada en caso que la capacidad caiga dentro de un rango que sea mayor que 0, pero menor o igual a una cantidad máxima de unidades de predicción candidatas determinadas mediante el uso de la forma de determinación de S1211.
De manera alternativa, las dos formas de determinación establecidas anteriores pueden usarse en combinación. 51222. Leer el flujo de bits y analizar el flujo de bits para obtener un elemento de sintaxis, donde el elemento de sintaxis se utiliza para indicar la información de índice de la unidad de predicción de movimiento afín que está en el conjunto de unidades de predicción candidatas y que se utiliza como una referencia para el bloque de imagen a procesar.
51223. Determinar, de acuerdo con la información de índice, una unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar.
Por ejemplo, si el conjunto de unidades de predicción candidatas incluye dos unidades de predicción candidatas A y B, un índice de A es 0 y un índice de B es 1. El flujo de bits se lee y analiza para obtener la información de índice. Si la información de índice es 0, la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar es una unidad de predicción en la cual se localiza A; si la información de índice es 1, la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar es una unidad de predicción en la cual se localiza B.
S1300. Obtener información de posición e información de movimiento de puntos de control en la unidad de predicción de movimiento afín.
Un primer método de implementación específico 1310 del paso incluye: seleccionar cualquiera tres puntos de control de cuatro puntos de control en la unidad de predicción de movimiento afín, y obtener información de posición, información de vector de movimiento, direcciones de predicción e índices de trama de referencia de los tres puntos de control. Debido a que todos los puntos de píxel en una misma unidad de predicción de movimiento afín tienen una misma dirección de predicción y un mismo índice de trama de referencia, las direcciones de predicción y los índices de trama de referencia de todos los puntos de control también son los mismos.
Un segundo método de implementación específico 1320 del paso incluye: seleccionar dos puntos de control cualquiera, los cuales pueden denominarse como primer y segundo puntos de control, de cuatro puntos de control en la unidad de predicción de movimiento afín, y obtener información de posición, información de vector de movimiento, direcciones de predicción e índices de trama de referencia de los dos puntos de control; y después seleccionar cualquier punto de control, el cual puede denominarse como un tercer punto de control, de los dos puntos de control restantes, y obtener información de posición del tercer punto de control. La información de vector de movimiento del tercer punto de control puede derivarse de acuerdo con el primer y segundo puntos de control en la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del tercer punto de control, vx y vy son vectores de movimiento horizontal y vertical correspondientes x1 y x2 , y y1 y y2 son respectivamente coordenadas horizontal y vertical del primer y segundo puntos de control, y vx1 y vx2 , y vy1 y vy2 son vectores de movimiento horizontales y verticales correspondientes.
Debido a que todos los puntos de píxel en una misma unidad de predicción de movimiento afín tienen una misma dirección de predicción y un mismo índice de trama de referencia, las direcciones de predicción y los índices de trama de referencia de todos los puntos de control también son los mismos. El tercer punto de control tiene una misma dirección de predicción e índice de trama de referencia que los del primer y segundo puntos de control. De acuerdo con cualquiera de las dos implementaciones específicas anteriores, después del paso S1300, se obtiene información de movimiento e información de posición de al menos tres puntos de control.
Como se muestra en la Figura 3, en esta modalidad de la presente invención, los puntos de control representados por tres vértices: vértices izquierdo superior (x2 , y2), derecho superior (x3, y3), e izquierdo inferior (x4, y4) se seleccionan de una unidad de predicción de movimiento afín en la cual se localiza un bloque adyacente A del bloque de imagen a procesar. En esta modalidad, x2 es igual a x4, y y2 es igual a y3.
Debe entenderse que el punto de control es seleccionado aleatoriamente, y no se les impone ninguna limitación. S1400. Obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados anteriores. Un primer método de implementación específico 1410 del paso incluye los siguientes pasos:
51411. Debido a que las direcciones de predicción y los índices de trama de referencia de todos los puntos de control son los mismos, la dirección de predicción y el índice de trama de referencia de cualquiera de los puntos de control, son asignados al punto de píxel en el bloque de imagen a procesar. De manera alternativa, el flujo de bits puede analizarse para obtener información de trama de referencia del bloque de imagen a procesar, donde la información de trama de referencia incluye una dirección de predicción y un índice de trama de referencia. 51412. Obtener, de acuerdo con la información de posición y los vectores de movimiento obtenidos en S1300 de los tres puntos de control cualquiera, un vector de movimiento del punto de píxel en el bloque de imagen a procesar. Esto se implementa de la siguiente manera:
donde x y y son respectivamente las coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x1 y x2 , y x3 y y1 y y2 y y3 son respectivamente coordenadas horizontal y vertical de los tres puntos de control cualquiera en la unidad de predicción de movimiento afín, y vx1 y vx2, y vx3 y vy1 y vy2 y vy3 son vectores de movimiento horizontales y verticales correspondientes.
Un segundo método de implementación específico 1420 del paso incluye los siguientes pasos.
51421. Debido a que las direcciones de predicción y los índices de trama de referencia de todos los puntos de control son los mismos, la dirección de predicción y el índice de trama de referencia de cualquiera de los puntos de control son asignados al punto de píxel en el bloque de imagen a procesar. De manera alternativa, el flujo de bits puede analizarse para obtener información de trama de referencia del bloque de imagen a procesar, donde la información de trama de referencia incluye una dirección de predicción y un índice de trama de referencia.
51422. Como se muestra en la Figura 3, obtener, de acuerdo con la información de posición y vectores de
movimiento obtenidos en S1300 de los tres puntos de control cualquiera, vectores de movimiento de dos puntos de control cualquiera en el bloque de imagen a procesar. Esto se implementa de la siguiente manera:
donde x0 y x1 y y0 y y1 son respectivamente las coordenadas horizontal y vertical de los dos puntos de control en el bloque de imagen a procesar, y0 es igual a y1 , vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontales y verticales correspondientes, x2 y x3 , y x4 y y2 y y3 y y4 son respectivamente coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción de movimiento afín, y vx2 y vx3, y vx4 y vy2 y vy3 y vy4son vectores de movimiento horizontales y verticales correspondientes.
S1423. Obtener, de acuerdo con los vectores de movimiento obtenidos en S1422 de los puntos de control, un vector de movimiento del punto de píxel en el bloque de imagen a procesar. Esto se implementa de la siguiente manera:
donde x y y son respectivamente las coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x0 y x1 , y y0 y y1 son respectivamente coordenadas horizontal y vertical de dos puntos de control en el bloque de imagen a procesar, donde y0 es igual a vy1 , y vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontales y verticales correspondientes.
Un tercer método de implementación específico 1430 del paso incluye los siguientes pasos.
51431. Debido a que las direcciones de predicción y los índices de trama de referencia de todos los puntos de control son los mismos, la dirección de predicción y el índice de trama de referencia de cualquiera de los puntos de control son asignados al punto de píxel en el bloque de imagen que- se-a procesar. De manera alternativa, el flujo de bits puede analizarse para obtener información de trama de referencia del bloque de imagen a procesar, donde la información de trama de referencia incluye una dirección de predicción y un índice de trama de referencia.
51432. Como se muestra en la Figura 3, obtener, de acuerdo con la información de posición y los vectores de movimiento obtenidos en S1400 de los tres puntos de control cualquiera, vectores de movimiento de dos puntos de control cualquiera en el bloque de imagen a procesar. Esto se implementa de la siguiente manera:
donde x0 y x1 y y0 y y1 son respectivamente las coordenadas horizontal y vertical de los dos puntos de control en el bloque de imagen a procesar, y0 es igual a y1, vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontal y vertical correspondientes, x2, x3, y x4 y y2, y3 y y4 son respectivamente coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción de movimiento afín, y vx2, vx3, y vx4 y vy2, vy3 y vy4 son vectores de movimiento horizontales y verticales correspondientes.
S1433. Analizar el flujo de bits para obtener un residual de los vectores de movimiento de los dos puntos de control en el bloque de imagen a procesar, y agregar el residual a los vectores de movimiento obtenidos en S1432
de los dos puntos de control, para obtener vectores de movimiento actualizados de los dos puntos de control en el bloque de imagen a procesar. Debido a la adición del residual, los vectores de movimiento actualizados son más precisos.
S1434. Obtener, de acuerdo con los vectores de movimiento obtenidos en S1433 de los dos puntos de control, un vector de movimiento del punto de píxel en el bloque de imagen a procesar. Esto se implementa de la siguiente manera:
donde x y y son respectivamente las coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x0 y x1 , y y0 y y1 son respectivamente coordenadas horizontal y vertical de dos puntos de control en el bloque de imagen a procesar, donde y0 es igual a y1, y vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontales y verticales correspondientes. S1500. Realizar compensación de movimiento de acuerdo con la dirección de predicción, el índice de trama de referencia, y el vector de movimiento que se obtienen, para encontrar un valor predicho del punto de píxel en el bloque de imagen a procesar, donde valores predichos de todos los puntos de píxel forman una imagen predicha de la imagen a procesar.
Debe entenderse que, en esta modalidad de la presente invención, primero, segundo, tercero y cuarto están únicamente destinados a distinguir los puntos de píxel, pero no se deben interpretar como una limitación en el alcance de protección de la presente invención. Por ejemplo, un primer punto de control también se puede denominar como un segundo punto de control, y un segundo punto de control puede ser un primer punto de control, y así sucesivamente.
Debe entenderse que números de secuencia de los procesos anteriores no significan secuencias de realización. Las secuencias de realización de los procesos deben determinarse de acuerdo con funciones y lógica interna de los procesos, y no se deben interpretar como una limitación en los procesos de implementación de esta modalidad de la presente invención.
Además, debe entenderse que, un método para obtener una imagen predicha mediante el uso de un modelo de transformación afín de 6 parámetros o modelo de transformación afín de 8 parámetros es esencialmente el mismo que un método para obtener una imagen predicha mediante el uso de un modelo de transformación afín de 4 parámetros. Por brevedad, los detalles no se describen en la presente descripción.
Específicamente, un lado de decodificación reutiliza información de movimiento de la unidad de predicción de movimiento afín mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Para mostrar mejor los efectos benéficos de la presente invención, se realiza una comparación de rendimiento entre esta modalidad de la presente invención y un método de predicción mediante el uso de un modelo de transformación afín con base en dos puntos de control en la técnica anterior con respecto a una configuración de codificación de acceso aleatorio y una configuración de codificación de bajo retraso. Un valor negativo indica un porcentaje del rendimiento de codificación mejorado, y un valor positivo indica un porcentaje del rendimiento de codificación deteriorado.
Tabla 1 Secuencia afín
Se puede aprender que, bajo las condiciones de prueba de una baja tasa de bits de acceso aleatorio, una baja tasa de bits de acceso aleatorio, una baja tasa de bits de un retraso bajo, y una alta tasa de bits de un retraso bajo, la presente invención respectivamente reduce una tasa de bits por 2,7 %, 2,1 %, 5,7 %, y 4,3 % cuando la complejidad básicamente permanece sin cambios, mejorando de esta manera la eficiencia de la codificación.
Lo anterior describe el método de predicción de imágenes, implementado en el lado de la decodificación, de acuerdo con esta modalidad de la presente invención en detalle con referencia a la Figuras1 a Figura 3, y lo siguiente describe un método de predicción de imágenes, implementado en un lado de la codificación, de acuerdo con una modalidad de la presente invención en detalle con referencia a las figuras 2 a 4. Se debe observar que, operaciones relacionadas del lado de la codificación esencialmente son consistentes con las del lado de la decodificación. Para evitar la repetición, los detalles no se describen en la presente descripción.
La Figura 4 es otro diagrama de flujo esquemático de un método de predicción de imágenes 2000 de acuerdo con una modalidad de la presente invención. El método mostrado en la Figura 4 puede realizarse por un dispositivo de codificación, tal como un codificador.
Específicamente, tal como se muestra en la Figura 4, el método 2000 incluye los siguientes pasos.
S2100. Determinar una unidad de predicción de movimiento afín que se utiliza como una referencia para un bloque de imagen a procesar.
Un primer método de implementación específico 2110 del paso incluye los siguientes pasos.
S2111. Determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar.
Como se muestra en la Figura 2, en esta modalidad de la presente invención, para formar el conjunto se seleccionan unidades de predicción en las cuales respectivamente se localizan bloques 4x4 en cinco posiciones A, B, C, D y E que son espacialmente adyacentes al bloque de imagen a procesar. Debe entenderse que, de manera alternativa, algunas de las posiciones A, B, C, D y E pueden seleccionarse, o unidades de predicción en las cuales se localizan otros bloques adyacentes en el dominio de tiempo al bloque de imagen a procesar pueden seleccionarse para
formar el conjunto, y no se les impone ninguna limitación.
52112. Comprobar, en el orden preestablecido, si una unidad de predicción en el conjunto es una unidad de predicción de movimiento afín.
El orden preestablecido es un orden que está predeterminado en un protocolo mediante los lados de codificación y decodificación y se mantiene consistente entre los lados de codificación y decodificación. En esta modalidad de la presente invención, el orden preestablecido es A, B, C, D y E. Debe entenderse que, de manera alternativa, el orden preestablecido puede ser B, D, A, E, y C, u otro orden, y no se les impone ninguna limitación.
52113. Si se encuentra que la unidad de predicción es una unidad de predicción de movimiento afín, detener la comprobación y utilizar la unidad de predicción como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar.
52114. Si ninguna de las unidades de predicción candidata es una unidad de predicción de movimiento afín, codificar un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el bloque de imagen a procesar no reutiliza la información de predicción afín de un bloque adyacente, y detener la realización de un paso posterior; de otra manera, seguir realizando un paso posterior.
Un segundo método de implementación específico 2120 del paso incluye los siguientes pasos:
52121. Determinar un conjunto de unidades de predicción candidatas para un bloque de imagen a procesar.
Además de la misma forma de determinación del conjunto que aquella en S2111, el método puede incluir, además: eliminar del conjunto un bloque de unidad de predicción no afín en el conjunto. Por ejemplo, el conjunto determinado mediante el uso de la forma de determinación de S1211 incluye las unidades de predicción en las cuales se localizan A, B, C, D y E, y las unidades de predicción en las cuales se localizan C y D no son unidades de predicción afín. Por lo tanto, C y D se eliminan del conjunto, y el conjunto determinado de unidades de predicción candidatas incluyen las unidades de predicción en las cuales se localizan A, B, y E.
De manera alternativa, el método puede incluir: limitar una capacidad del conjunto y eliminar, del conjunto, una unidad de predicción candidata cuyo orden de comprobación se clasifica detrás de una cantidad permitida de unidades de predicción candidatas. Por ejemplo, la cantidad de unidades de predicción candidatas en el conjunto se establece a un máximo de 2, y un conjunto que se determina mediante el uso de la forma de determinación de S2111 de acuerdo con el orden de comprobación de S2112 es A, D, C, E y B. Por lo tanto, C, E y B se eliminan del conjunto, y el conjunto determinado de unidades de predicción candidatas incluye unidades de predicción en las cuales se localizan A y D. Debe entenderse que, la capacidad del conjunto puede establecerse a 3 o 4, o puede no estar limitado en caso que la capacidad caiga dentro de un rango que sea mayor que 0 pero menor o igual a una cantidad máxima de unidades de predicción candidatas determinadas mediante el uso de la forma de determinación de S2111.
De manera alternativa, las dos formas de determinación establecidas anteriores pueden usarse en combinación. 52122. Si ninguna de las unidades de predicción candidatas es una unidad de predicción de movimiento afín, codificar un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el bloque de imagen a procesar no reutiliza la información de predicción afín de un bloque adyacente, y detener la realización de un paso posterior; si al menos una de las unidades de predicción candidatas es una unidad de predicción de movimiento afín, seguir realizando un paso posterior.
52123. Asignar un valor de índice a cada unidad de predicción candidata en el conjunto de unidades de predicción candidatas. Una unidad de predicción candidata indicada por cada valor de índice se predetermina en un protocolo por los lados de codificación y decodificación y se mantiene consistente con los lados de codificación y decodificación.
52124. Atravesar todas las unidades de predicción candidatas en el conjunto de unidades de predicción candidatas, y realizar el procesamiento de acuerdo con pasos posteriores S2200 a S2400, para obtener una imagen de predicción del bloque de imagen a procesar, y completar la codificación para el bloque de imagen a procesar; y comparar las ganancias de codificación hechas por los vectores de predicción candidatos seleccionados, y seleccionar una unidad de predicción candidata con la mayor ganancia de codificación como una unidad de predicción de movimiento afín referida por un bloque de imagen a procesar.
Por ejemplo, si el conjunto de unidades de predicción candidatas incluye dos unidades de predicción candidatas A y B, un índice de A es 0 y un índice de B es 1. Si una ganancia que se obtiene mediante el uso de A como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar, para completar un paso de procesamiento posterior, obtener la imagen predicha del bloque de imagen a procesar, y la codificación completa para el bloque de imagen a procesar es la más grande, A es la unidad de predicción de movimiento afín referida por
el bloque de imagen a procesar; de otra manera, B es la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar.
Debe entenderse que, para mejorar una velocidad de codificación, el paso S2124 puede reemplazarse con un algoritmo rápido. Por ejemplo, algunas, pero no todas las unidades de predicción candidatas en el conjunto de unidades de predicción candidatas pueden seleccionarse para ser atravesadas. De manera alternativa, todo el proceso de codificación del bloque de imagen a procesar no se completa, y después que se obtienen las imágenes predichas, de acuerdo con la precisión de las imágenes predichas, una unidad de predicción que puede ser utilizada para obtener una imagen predicha más precisa se utiliza como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar.
S2200. Obtener información de posición e información de movimiento de puntos de control en la unidad de predicción de movimiento afín. Este paso es consistente con S1300, y los detalles no se describen en la presente descripción.
S2300. Obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados anteriores. Este paso es consistente con S1400, y los detalles no se describen en la presente descripción nuevamente.
S2400. Ejecutar compensación de movimiento de acuerdo con una dirección de predicción, un índice de trama de referencia, y un vector de movimiento que se obtienen, para encontrar un valor predicho del punto de píxel en el bloque de imagen a procesar, donde valores predichos de todos los puntos de píxel forman la imagen predicha de la imagen a procesar. Este paso es consistente con S1500, y los detalles no se describen en la presente descripción nuevamente.
S2500. Comparar el rendimiento de codificación de la codificación que se completa mediante el uso de la imagen predicha obtenida mediante el uso de los pasos S2100 a S2400 con el rendimiento de codificación de la codificación que se completa mediante el uso de una imagen predicha obtenida mediante el uso de otros métodos, y seleccionar un método en el cual se obtiene una mayor ganancia de codificación, como un método para codificar una imagen predicha.
Debe entenderse que, para mejorar una velocidad de codificación, el paso S2500 también puede reemplazarse con un algoritmo rápido descrito en S2124, y los detalles no se describen en la presente descripción nuevamente.
S2600. Si el método para obtener una imagen predicha mediante el uso de los pasos S2100 a S2400 se utiliza en S2500 codificar un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el bloque de imagen a procesar obtiene la imagen predicha mediante el uso del método para obtener una imagen predicha mediante el uso de los pasos S2100 a S2400, y codificar otro elemento de sintaxis, donde el elemento de sintaxis se utiliza para indicar información de índice de la unidad de predicción seleccionada en S2124.
Debe entenderse que, el método de predicción de imágenes en la modalidad de la presente invención, como una tecnología de predicción, también puede ser combinada técnicamente con otra tecnología de predicción en la técnica anterior, tal como una tecnología que utiliza múltiples tramas de referencia para predicción, y no se le impone una limitación.
Específicamente, el lado de la codificación reutiliza información de movimiento de una primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, la precisión de la predicción se mejora y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Lo siguiente describe en detalle un dispositivo de decodificación de acuerdo con una modalidad de la presente invención con referencia a la Figura 5. Como se muestra en la Figura 5, el dispositivo de decodificación 10 incluye: un primer módulo de obtención 11, configurado para obtener una unidad de predicción de movimiento afín de una unidad de imagen;
un segundo módulo de obtención 12, configurado para obtener información de posición e información de movimiento de la unidad de predicción de movimiento afín; y
un tercer módulo de obtención 13, configurado para obtener información de movimiento de la unidad de imagen de acuerdo con la información de posición y la información de movimiento.
Específicamente, el lado de la codificación reutiliza información de movimiento de una primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin una búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora
la precisión de la predicción y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
En esta modalidad de la presente invención, opcionalmente, se lee un flujo de bits y se analiza para obtener un elemento de sintaxis, donde el elemento de sintaxis se usa para determinar si un bloque de imagen a procesar reutiliza información de movimiento de modelo afín de un bloque adyacente. Cuando se determina que el bloque de imagen a procesar reutiliza la información de movimiento del modelo afín del bloque adyacente, el proceso continúa.
En esta modalidad de la presente invención, opcionalmente, el hecho de que el primer módulo de obtención 11 esté específicamente configurado para determinar la unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar incluye: determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, comprobar, en el orden preestablecido, si una unidad de predicción en el conjunto es una unidad de predicción de movimiento afín, y si se encuentra que la unidad de predicción es una unidad de predicción de movimiento afín, detener la comprobación y utilizar la unidad de predicción como la unidad de predicción de movimiento afín requerida por el bloque de imagen a procesar; o determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, leer el flujo de bits y analizar el flujo de bits para obtener el elemento de sintaxis, donde el elemento de sintaxis se usa para indicar información de índice de la unidad de predicción de movimiento afín que está en el conjunto de unidades de predicción candidatas y que se utiliza como una referencia para el bloque de imagen a procesar, y determinar, de acuerdo con la información de índice, la unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar.
En esta modalidad de la presente invención, opcionalmente, el hecho de que el segundo módulo de obtención 12 esté configurado específicamente para obtener información de posición e información de movimiento de los puntos de control en la unidad de predicción de movimiento afín incluye: seleccionar tres puntos de control cualquiera de cuatro puntos de control en la unidad de predicción de movimiento afín y obtener la información de posición, información de vector de movimiento, direcciones de predicción e índices de trama de referencia de los tres puntos de control; o seleccionar los dos puntos de control cualquiera, que pueden denominarse como primer y segundo puntos de control, de cuatro puntos de control en la unidad de predicción de movimiento afín y obtener información de posición, información de vector de movimiento, direcciones de predicción e índices de trama de referencia de los dos puntos de control , y luego seleccionar cualquier punto de control, que puede denominarse como tercer punto de control, de los dos puntos de control restantes y obtener información de posición del tercer punto de control. La información del vector de movimiento del tercer punto de control se puede derivar de acuerdo con el primer y segundo puntos de control de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del tercer punto de control, vx y vy son vectores de movimiento horizontal y vertical correspondientes y x1 y x2 , y y1 y y2 son respectivamente coordenadas horizontal y vertical del primer y segundo puntos de control, donde y1 es igual a y2 , y vx1 y vx2 y vy1 y vy2 son vectores de movimiento horizontales y verticales correspondientes.
Debido a que todos los puntos de píxel en una misma unidad de predicción de movimiento afín tienen una misma dirección de predicción y un mismo índice de trama de referencia, las direcciones de predicción y los índices de trama de referencia de todos los puntos de control también son los mismos. El tercer punto de control tiene una misma dirección de predicción e índice de trama de referencia que los del primer y segundo puntos de control.
En esta modalidad de la presente invención, opcionalmente, el hecho de que el tercer módulo de obtención 13 está específicamente configurado para obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados incluye: asignar una dirección de predicción y un índice de trama de referencia de cualquiera de los puntos de control al punto de píxel en el bloque de imagen a procesar; o analizar el flujo de bits para obtener información de trama de referencia del bloque de imagen a procesar, donde la información de trama de referencia incluye una dirección de predicción y un índice de trama de referencia.
En este ejemplo, opcionalmente, el hecho de que el tercer módulo de obtención 13 está específicamente configurado para obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados anteriores incluye: obtener, de acuerdo con la información de posición obtenida y los vectores de movimiento de los tres puntos
de control cualquiera, un vector de movimiento del punto de píxel en el bloque de imagen a procesar. Esto se implementa de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x1, x2 y x3 , y y1, y2 y y3 son respectivamente coordenadas horizontal y vertical de los tres puntos de control cualquiera, en la unidad de predicción de movimiento afín, y vx1, vx2 y vx3 , y vy1, vy2 y vy3 son vectores de movimiento horizontales y verticales correspondientes.
De manera alternativa, vectores de movimiento de dos puntos de control cualquiera en el bloque de imagen a procesar se obtienen de acuerdo con la información de posición obtenida y vectores de movimiento de los tres puntos de control cualquiera. Esto se implementa en la siguiente manera:
donde x0 y x1 y y0 y y1 son respectivamente las coordenadas horizontal y vertical de los dos puntos de control en el bloque de imagen a procesar, y0 es igual a y1 , vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontal y vertical correspondientes, x2, x3 , y x4 y y2, y3 y y4 son respectivamente coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción de movimiento afín, y vx2, vx3 , y vx4 y vy2, vy3 y vy4 son vectores de movimiento horizontales y verticales correspondientes.
Un vector de movimiento del punto de píxel en el bloque de imagen a procesar se obtiene de acuerdo con los vectores de movimiento obtenidos de los dos puntos de control. Esto se implementa en la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x0 y x1 , y y0 y y1 son respectivamente coordenadas horizontal y vertical de los dos puntos de control, en el bloque de imagen a procesar, donde y0 es igual a y1 y vx0 y vx1, y vx0 y vy1 son vectores de movimiento horizontales y verticales correspondientes. De manera alternativa, los vectores de movimiento de cualquier punto de control en el bloque de imagen a procesar se obtienen de acuerdo con la información de posición obtenida y los vectores de movimiento de los tres puntos de control cualquiera. Esto se implementa de la siguiente manera:
donde X0 y xi y y0 y yi son respectivamente las coordenadas horizontal y vertical de los dos puntos de control en el bloque de imagen a procesar, y0 es igual a y1, vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontal y vertical correspondientes, x2, x3, y x4 y y2, y3 y y4 son respectivamente coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción de movimiento afín, y vx2, vx3, y vx4 y vy2, vy3 y vy4 son vectores de movimiento horizontales y verticales correspondientes.
El flujo de bits se analiza para obtener un residual de los vectores de movimiento de los dos puntos de control en el bloque de imagen a procesar, y el residual se añade a los vectores de movimiento obtenidos de los dos puntos de control, para obtener vectores de movimiento actualizados de los dos puntos de control en el bloque de imagen a procesar.
Un vector de movimiento del punto de píxel en el bloque de imagen a procesar se obtiene de acuerdo con los vectores de movimiento obtenidos de los dos puntos de control. Esto se implementa de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x0 y x1, y y0 y y1 son respectivamente coordenadas horizontal y vertical de los dos puntos de control, en el bloque de imagen a procesar, donde y0 es igual a y1 y vx0 y vx1, y vy0 y vy1 son vectores de movimiento horizontales y verticales correspondientes. En esta modalidad de la presente invención, opcionalmente, el tercer módulo de obtención 13 está específicamente configurado para realizar compensación de movimiento de acuerdo con la dirección de predicción, el índice de trama de referencia, y el vector de movimiento que se obtienen, para encontrar un valor predicho del punto de píxel en el bloque de imagen a procesar. Los valores predichos de todos los puntos de píxel forman una imagen predicha de la imagen a procesar.
Debe entenderse que el dispositivo de codificación 10 de acuerdo con esta modalidad de la presente invención de manera correspondiente puede realizar el método de predicción de imágenes 1000 en la modalidad de la presente invención, y lo anterior, así como otras operaciones y funciones de los módulos del dispositivo de codificación 10 son utilizados por separado para implementar el procedimiento correspondiente del método en la Figura 1. Por brevedad, los detalles no se describen en la presente descripción.
Por lo tanto, el dispositivo de decodificación en esta modalidad de la presente invención reutiliza información de movimiento de una primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Lo siguiente describe en detalle un dispositivo de codificación de acuerdo con una modalidad de la presente invención con referencia a la Figura 6. Como se muestra en la Figura 6, el dispositivo de codificación 20 incluye: un primer módulo de obtención 21, configurado para obtener una unidad de predicción de movimiento afín de una unidad de imagen;
un segundo módulo de obtención 22, configurado para obtener información de posición e información de movimiento de la unidad de predicción de movimiento afín; y
un tercer módulo de obtención 23, configurado para obtener información de movimiento de la unidad de imagen
de acuerdo con la información de posición y la información de movimiento.
Específicamente, el lado de la codificación reutiliza la información de movimiento de una primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, la precisión de la predicción se mejora y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
En esta modalidad de la presente invención, opcionalmente, el hecho de que el primer módulo de obtención 21 esté específicamente configurado para determinar la unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar incluye: determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, comprobar, en el orden preestablecido, si una unidad de predicción en el conjunto es una unidad de predicción de movimiento afín, y si se encuentra que la unidad de predicción es una unidad de predicción de movimiento afín, dejar de comprobar y utilizar la unidad de predicción como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar, o si ninguna de las unidades de predicción candidatas es una unidad de predicción de movimiento afín, codificar un elemento de sintaxis, donde el elemento de sintaxis se utiliza para indicar que el bloque de imagen a procesar no reutiliza la información de predicción afín de un bloque adyacente, y dejar de realizar un paso posterior; de otra manera, seguir realizando un paso posterior; o determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, si ninguna de las unidades de predicción candidatas es una unidad de predicción de movimiento afín, codificar un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el bloque de imagen a procesar no reutiliza la información de predicción afín de un bloque adyacente, y dejar de realizar un paso posterior; de otra manera, seguir realizando un paso posterior, y asignar un valor de índice a cada unidad de predicción candidata en el conjunto de unidades de predicción candidatas. Una unidad de predicción candidata representada por cada valor de índice es predeterminado en un protocolo por los lados de codificación y decodificación y se mantiene consistente con los lados de decodificación. Todas las unidades de predicción candidatas se recorren para obtener una imagen predicha del bloque de imagen a procesar, y completar la codificación para el bloque de imagen a procesar. Las ganancias de codificación hechas por los vectores de predicción candidatos seleccionados se comparan, y una unidad de predicción candidata con la mayor ganancia de codificación es seleccionada como una unidad de predicción de movimiento afín referida por un bloque de imagen a procesar.
En esta modalidad de la presente invención, opcionalmente, el segundo módulo de obtención 22 está específicamente configurado para obtener información de posición e información de movimiento de puntos de control en la unidad de predicción de movimiento afín. Una función del módulo es la misma que la del segundo módulo de obtención 12, y los detalles no se describen en la presente descripción nuevamente.
En este ejemplo, opcionalmente, el tercer módulo de obtención 23 está específicamente configurado para obtener información de movimiento de un punto de píxel en un bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados anteriores. Una función del módulo es la misma que la del tercer módulo de obtención 13, y los detalles no se describen en la presente descripción nuevamente.
En esta modalidad de la presente invención, opcionalmente, el tercer módulo de obtención 23 está específicamente configurado para realizar compensación de movimiento de acuerdo con la dirección de predicción, el índice de trama de referencia, y el vector de movimiento que se obtienen, para encontrar un valor predicho del punto de píxel en el bloque de imagen a procesar. Los valores predichos de todos los puntos de píxel forman una imagen predicha de la imagen a procesar. Una función del módulo es la misma que la del tercer módulo de obtención 13, y los detalles no se describen en la presente descripción nuevamente.
En esta modalidad de la presente invención, opcionalmente, el rendimiento de codificación que se completa mediante el uso de la imagen predicha obtenida por este dispositivo se compara con el rendimiento de codificación que se completa mediante el uso de una imagen predicha obtenida mediante el uso de otros dispositivos, y un dispositivos mediante el cual se obtiene la mayor ganancia de codificación es seleccionado como un dispositivo para codificar una imagen predicha.
En esta modalidad de la presente invención, opcionalmente, si se utiliza la imagen predicha obtenida mediante el uso de este dispositivo, se codifica un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el método para obtener una imagen predicha mediante el uso de este dispositivo se usa y se codifica otro elemento de sintaxis, donde el elemento de sintaxis se usa para indicar información de índice de la unidad de predicción seleccionada.
Debe entenderse que el dispositivo de codificación 20, de acuerdo con esta modalidad de la presente invención, de manera correspondiente puede realizar el método de predicción de imágenes 2000 en la modalidad de la presente invención, y lo anterior, así como otras operaciones y/o funciones de los módulos del dispositivo de codificación 20 son utilizados por separado para implementar el procedimiento correspondiente del método en la Figura 4. Por
brevedad, los detalles no se describen en la presente descripción.
Por lo tanto, el dispositivo de codificación en esta modalidad de la presente invención reutiliza la información de movimiento de una primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, la precisión de la predicción se mejora y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Como se muestra en la Figura 7, una modalidad de la presente invención además proporciona un dispositivo de decodificación 30, incluyendo un procesador 31, una memoria 32, y un sistema de bus 33. El procesador 31 y la memoria 32 se conectan mediante el uso del sistema de bus 33, la memoria 32 se configura para almacenar una instrucción, y el procesador 31 se configura para realizar la instrucción almacenada en la memoria 32. La memoria 32 del dispositivo de decodificación 30 almacena el código de programa, y el procesador 31 puede invocar el código de programa almacenado en la memoria 32 para realizar las siguientes operaciones: obtener una primera unidad de referencia de una unidad de imagen, donde las imágenes predichas respectivas se obtienen para la unidad de imagen y la primera unidad de referencia mediante el uso de un mismo modelo afín; obtener información de movimiento de unidades básicas de compensación de movimiento en dos o más posiciones preestablecidas en la primera unidad de referencia; y obtener información de movimiento de una unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con la información de movimiento.
Por lo tanto, el dispositivo de decodificación en esta modalidad de la presente invención reutiliza la información de movimiento de la primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin una búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Debe entenderse que, en esta modalidad de la presente invención, el procesador 31 puede ser una unidad de procesamiento central (CPU), y el procesador 31 además puede ser otro procesador de propósito general, un procesador de señal digital (DSP), un circuito integrado de aplicación específica (ASIC), una matriz de puerta programable en campo (FPGA) u otro dispositivo lógico programable, una puerta discreta o dispositivo lógico de transistor, un componente de hardware discreto, o similar. El procesador de propósito general puede ser un microprocesador o el procesador puede ser cualquier procesador convencional y similar.
La memoria 32 puede incluir una memoria de solo lectura y una memoria de acceso aleatorio y puede proporcionar una instrucción y datos para el procesador 31. Una parte de la memoria 32 además puede incluir una memoria de acceso aleatorio no volátil. Por ejemplo, la memoria 32 además puede almacenar la información del tipo de dispositivo.
El sistema de bus 33, además de un bus de datos, puede incluir un bus de alimentación, un bus de control, un bus de señal de estado, y similar. No obstante, para propósitos de tener una clara descripción, diversos tipos de buses en la Figura están marcados como el sistema de bus 33.
Durante la implementación, cada paso de los métodos anteriores puede implementarse por un circuito lógico integrado de hardware en el procesador 31 o por una instrucción en una forma de software. Los pasos de los métodos divulgados con referencia a las modalidades de la presente invención pueden ser directamente realizados y completados mediante el uso de un procesador de hardware, o pueden ser realizados y completados mediante el uso de una combinación de módulos de hardware y software en el procesador. El módulo de software puede estar ubicado en un medio de almacenamiento maduro en el campo, tal como una memoria de acceso aleatorio, una memoria flash, una memoria de solo lectura, una memoria de solo lectura programable, una memoria programable y borrable eléctricamente, o un registro. El medio de almacenamiento está ubicado en la memoria 32, y el procesador 31 lee información en la memoria 32 y completa los pasos en los métodos anteriores en combinación con el hardware del procesador 31. Para evitar la repetición, los detalles no se describen en la presente descripción nuevamente.
Opcionalmente, en una modalidad, el procesador 31 está específicamente configurado para: leer un flujo de bits y analizar el flujo de bits para obtener un elemento de sintaxis, donde el elemento de sintaxis se utiliza para determinar si un bloque de imagen a procesar reutiliza información de movimiento de modelo afín de un bloque adyacente. Cuando se determina que el bloque de imagen a procesar reutiliza la información de movimiento del modelo afín del bloque adyacente, el proceso continúa.
Opcionalmente, en una modalidad, el hecho de que el procesador 31 esté específicamente configurado para determinar una unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar incluye: determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, comprobar, en el orden preestablecido, si una unidad de predicción en el conjunto es una unidad de
predicción de movimiento afín, y en caso que se encuentre que la unidad de predicción es una unidad de predicción de movimiento afín, dejar de comprobar y utilizar la unidad de predicción como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar; o determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, leer el flujo de bits y analizar el flujo de bits para obtener un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar información de índice de la unidad de predicción de movimiento afín que está en el conjunto de unidades de predicción candidatas y que se utiliza como una referencia para el bloque de imagen a procesar, y determinar, de acuerdo con la información de índice, la unidad de predicción de movimiento afín que se utiliza como una referencia para el bloque de imagen a procesar.
Opcionalmente, en una modalidad, el hecho de que el procesador 31 esté específicamente configurado para obtener información de posición e información de movimiento de puntos de control en la unidad de predicción de movimiento afín incluye: seleccionar cualquiera de los tres puntos de control de los cuatro puntos de control en la unidad de predicción de movimiento afín, y obtener información de posición, información de vector de movimiento, direcciones de predicción e índices de trama de referencia de los tres puntos de control; o seleccionar dos puntos de control cualquiera, los cuales pueden denominarse como primer y segundo puntos de control, de los cuatro puntos de control en la unidad de predicción de movimiento afín y obtener información de posición, información de vector de movimiento, direcciones de predicción e índices de trama de referencia de los dos puntos de control, y después seleccionar cualquier punto de control, el cual puede denominarse como un tercer punto de control, de los dos puntos de control restantes, y obtener información de posición del tercer punto de control. La información de vector de movimiento del tercer punto de control puede derivarse de acuerdo con el primer y segundo puntos de control en la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del tercer punto de control, y1 es igual a y2, vx y vy son vectores de movimiento horizontal y vertical correspondientes X1 y X2, y y1 y y2 son respectivamente coordenadas horizontal y vertical del primer y segundo puntos de control, y vx1 y vx2 , y vy1 y vy2 son vectores de movimiento horizontales y verticales correspondientes.
Debido a que todos los puntos de píxel en una misma unidad de predicción de movimiento afín tienen una misma dirección de predicción y un mismo índice de trama de referencia, las direcciones de predicción y los índices de trama de referencia de todos los puntos de control también son los mismos. El tercer punto de control tiene una misma dirección de predicción y el índice de trama de referencia que los del primer y segundo puntos de control.
Opcionalmente, en una modalidad, el hecho de que el procesador 31 esté específicamente configurado para obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados anteriores incluye: asignar una dirección de predicción y un índice de trama de referencia de cualquiera de los puntos de control al punto de píxel en el bloque de imagen a procesar; o analizar el flujo de bits para obtener información de trama de referencia del bloque de imagen a procesar, donde la información de trama de referencia incluye una dirección de predicción y un índice de trama de referencia.
Opcionalmente, en una modalidad, el hecho de que el procesador 31 esté específicamente configurado para obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control seleccionados anteriores incluye: obtener, de acuerdo con la información de posición obtenida y los vectores de movimiento de los tres puntos de control cualquiera, un vector de movimiento del punto de píxel en el bloque de imagen que-se- a procesar. Esto se implementa de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a
procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, xi, X2 y X3, y yi, y2 y y3 son respectivamente coordenadas horizontal y vertical de los tres puntos de control cualquiera, en la unidad de predicción de movimiento afín, y y0 es igual a vx1, vx2 y vx3, y vy1, vy2 y vy3 son vectores de movimiento horizontales y verticales correspondientes.
De manera alternativa, los vectores de movimiento de dos puntos de control cualquiera en el bloque de imagen a procesar se obtienen de acuerdo con la información de posición obtenida y los vectores de movimiento de los tres puntos de control cualquiera. Esto se implementa en la siguiente manera:
donde x0 y x1 y y0 y y1 son respectivamente las coordenadas horizontal y vertical de los dos puntos de control en el bloque de imagen a procesar, y0 es igual a y1, vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontal y vertical correspondientes, x2, x3, y x4 y y2, y3 y y4 son respectivamente coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción de movimiento afín, y vx2, vx3, y vx4 y vy2, vy3 y vy4 son vectores de movimiento horizontales y verticales correspondientes.
Un vector de movimiento del punto de píxel en el bloque de imagen a procesar se obtiene de acuerdo con los vectores de movimiento obtenidos de los dos puntos de control. Esto se implementa de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del punto de píxel en el bloque de imagen, vx y vy son vectores de movimiento horizontal y vertical correspondientes, x0 , y x1, y y0 , y y1, y0 , y1 son respectivamente coordenadas horizontal y vertical de los dos puntos de control, en el bloque de imagen a procesar, donde y0 es igual a y1, y vx0 y vx1, y vy0 y, vy1 son vectores de movimiento horizontales y verticales correspondientes.
De manera alternativa, vectores de movimiento de dos puntos de control cualquiera en el bloque de imagen a procesar se obtienen de acuerdo con la información de posición obtenida y vectores de movimiento de los tres puntos de control cualquiera. Esto se implementa de la siguiente manera:
donde x0 y x1 y y0 y y1 son respectivamente las coordenadas horizontal y vertical de los dos puntos de control en el bloque de imagen a procesar, y0 es igual a y1, vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontal y vertical correspondientes, x2, x3, y x4 y y2, y3 y y4 son respectivamente coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción de movimiento afín, y vx2, vx3, y vx4 y vy2, vy3 y vy4 son vectores de movimiento horizontales y verticales correspondientes.
El flujo de bits se analiza para obtener un residual de los vectores de movimiento de los dos puntos de control en el bloque de imagen a procesar, y el residual se añade a los vectores de movimiento obtenidos de los dos puntos de control, para obtener vectores de movimiento actualizados de los dos puntos de control en el bloque de imagen a
procesar.
Un vector de movimiento del punto de píxel en el bloque de imagen a procesar se obtiene de acuerdo con los vectores de movimiento obtenidos de los dos puntos de control.
Esto se implementa de la siguiente manera:
donde x y y son respectivamente coordenadas horizontal y vertical del punto de píxel en el bloque de imagen a procesar, vx y vy son vectores de movimiento horizontal y vertical correspondientes, xc, y x1, y y0, y y1, son respectivamente coordenadas horizontal y vertical de los dos puntos de control, en el bloque de imagen a procesar, donde y0 es igual a y1, y vx0 y vx1, y vy0 y, vy1 son vectores de movimiento horizontales y verticales correspondientes. Opcionalmente, en una modalidad, el procesador 31 específicamente está configurado para: realizar compensación de movimiento de acuerdo con la dirección de predicción, el índice de trama de referencia, y el vector de movimiento que se obtienen, para encontrar un valor predicho del punto de píxel en el bloque de imagen a procesar. Los valores predichos de todos los puntos de píxel forman una imagen predicha de la imagen a procesar.
Debe entenderse que el dispositivo de decodificación 30 de acuerdo con esta modalidad de la presente invención puede corresponder al dispositivo de decodificación 10 en la modalidad de la presente invención, y puede corresponder a una entidad principal correspondiente que realiza el método 1000 en la modalidad de la presente invención. Lo anterior, así como otras operaciones y/o funciones de los módulos del dispositivo de decodificación 30 se utilizan por separado para implementar el procedimiento correspondiente del método en la Figura 1. Por brevedad los detalles no se describen en la presente descripción.
Por lo tanto, el dispositivo de decodificación en esta modalidad de la presente invención reutiliza información de movimiento de la primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Como se muestra en la Figura 8, una modalidad de la presente invención además proporciona un dispositivo de codificación 40, incluyendo un procesador 41, una memoria 42, y un sistema de bus 43. El procesador 41 y la memoria 42 se conectan mediante el uso del sistema de bus 43, la memoria 42 se configura para almacenar una instrucción, y el procesador 41 se configura para realizar la instrucción almacenada en la memoria 42. La memoria 42 del dispositivo de decodificación 40 almacena el código de programa, y el procesador 41 puede invocar el código de programa almacenado en la memoria 42 para realizar las siguientes operaciones: obtener una primera unidad de referencia de una unidad de imagen, donde las imágenes predichas respectivas se obtienen para la unidad de imagen y la primera unidad de referencia mediante el uso de un mismo modelo afín; obtener información de movimiento de unidades básicas de compensación de movimiento en dos o más posiciones preestablecidas en la primera unidad de referencia; y obtener información de movimiento de una unidad básica de compensación de movimiento de la unidad de imagen de acuerdo con la información de movimiento.
Por lo tanto, el dispositivo de codificación en esta modalidad de la presente invención reutiliza información de movimiento de la primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional de un vector de movimiento de alta precisión. De esta manera, se mejora la precisión de la predicción y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Debe entenderse que, en esta modalidad de la presente invención, el procesador 41 puede ser una unidad de procesamiento central, y el procesador 41 además puede ser otro procesador de propósito general, un procesador de señal digital, un circuito integrado de aplicación específica, una matriz de puerta programable en campo u otro dispositivo lógico programable, una puerta discreta o dispositivo lógico de transistor, un componente de hardware discreto, o similar. El procesador de propósito general puede ser un microprocesador o el procesador puede ser cualquier procesador convencional y similar.
La memoria 42 puede incluir una memoria de solo lectura y una memoria de acceso aleatorio y puede proporcionar una instrucción y datos para el procesador 41. Una parte de la memoria 42 además puede incluir una memoria de acceso aleatorio no volátil. Por ejemplo, la memoria 42 puede además almacenar la información de tipo de dispositivo.
El sistema de bus 43, además de un bus de datos, puede incluir un bus de alimentación, un bus de control, un bus de señal de estado, y similar. No obstante, para propósitos de una descripción clara, diversos tipos de buses en la Figura están marcados como el sistema de bus 43.
Durante la implementación, cada paso de los métodos anteriores puede implementarse por un circuito lógico integrado de hardware en el procesador 41 o mediante una instrucción en una forma de software. Los pasos de los métodos divulgados con referencia a las modalidades de la presente invención pueden ser directamente realizados y completados mediante el uso de un procesador de hardware, o pueden ser realizados y completados mediante el uso de una combinación de módulos de hardware y software en el procesador. El módulo de software puede estar ubicado en un medio de almacenamiento maduro en el campo, tal como una memoria de acceso aleatorio, una memoria flash, una memoria de solo lectura, una memoria de solo lectura programable, una memoria programable y borrable eléctricamente, o un registro. El medio de almacenamiento está ubicado en la memoria 42, y el procesador 41 lee información en la memoria 42 y completa los pasos en los métodos anteriores en combinación con hardware del procesador 41. Para evitar la repetición, los detalles no se describen en la presente descripción nuevamente.
Opcionalmente, en una modalidad, el hecho de que el procesador 41 esté específicamente configurado para determinar una unidad de predicción de movimiento afín que se utiliza como una referencia para un bloque de imagen a procesar incluye: determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, comprobar, en el orden preestablecido, si una unidad de predicción en el conjunto es una unidad de predicción de movimiento afín, y en caso que se encuentre que la unidad de predicción es una unidad de predicción de movimiento afín, dejar de comprobar y utilizar la unidad de predicción como la unidad de predicción de movimiento afín referida por el bloque de imagen a procesar; o si ninguna de las unidades de predicción candidatas es una unidad de predicción de movimiento afín, codificar un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el bloque de imagen a procesar no reutiliza la información de predicción afín de un bloque adyacente, y dejar de realizar un paso posterior; de otra manera, seguir realizando un paso posterior; o determinar un conjunto de unidades de predicción candidatas para el bloque de imagen a procesar, si ninguna de las unidades de predicción candidatas es una unidad de predicción de movimiento afín, codificar un elemento de sintaxis, donde el elemento de sintaxis se utiliza para indicar que el bloque de imagen a procesar no reutiliza la información de predicción afín de un bloque adyacente, y dejar de realizar un paso posterior; de otra manera, seguir realizando un paso posterior, y asignar un valor de índice a cada unidad de predicción candidata en el conjunto de unidades de predicción candidatas. Una unidad de predicción candidata representada por cada valor de índice se predetermina en un protocolo mediante los lados de codificación y decodificación y se mantiene consistente en los lados de codificación y decodificación. Todas las unidades de predicción candidatas en el conjunto de unidades de predicción candidatas se recorren para obtener una imagen predicha del bloque de imagen a procesar, y completar la codificación para el bloque de imagen a procesar. Las ganancias de codificación hechas por vectores de predicción candidatos seleccionados se comparan, y una unidad de predicción candidata con una mayor ganancia de codificación es seleccionada como una unidad de predicción de movimiento afín referida por un bloque de imagen a procesar.
Opcionalmente, en una modalidad, el procesador 41 está específicamente configurado para obtener información de posición e información de movimiento de puntos de control en la unidad de predicción de movimiento afín. Una función del módulo es la misma que la del procesador 31, y los detalles no se describen en la presente descripción nuevamente.
Opcionalmente, en una modalidad, el procesador 41 está específicamente configurado para obtener información de movimiento de un punto de píxel en el bloque de imagen de acuerdo con la información de posición e información de movimiento de los tres puntos de control seleccionados. Una función del módulo es la misma que la del procesador 31, y los detalles no se describen en la presente descripción nuevamente.
Opcionalmente, en una modalidad, el procesador 41 está específicamente configurado para realizar compensación de movimiento de acuerdo con la dirección de predicción, el índice de trama de referencia, y el vector de movimiento que se obtienen, para encontrar un valor predicho del punto de píxel en el bloque de imagen a procesar. Los valores predichos de todos los puntos de píxel forman una imagen predicha de la imagen a procesar. Una función del módulo es la misma que la del procesador 31, y los detalles no se describen en la presente descripción nuevamente.
Opcionalmente, en una modalidad, el procesador 41 está específicamente configurado para: comparar el rendimiento de codificación que se completa mediante el uso de la imagen predicha obtenida por este dispositivo con el rendimiento de codificación que se completa mediante el uso de una imagen predicha obtenida mediante el uso de otro dispositivo, y seleccionar un dispositivo a través del cual se obtiene una mayor ganancia de codificación, como un dispositivo para codificar una imagen predicha.
Opcionalmente, en una modalidad, el procesador 41 está específicamente configurado para: si se utiliza la imagen predicha obtenida mediante el uso de este dispositivo, codificar un elemento de sintaxis, donde el elemento de sintaxis se usa para indicar que el método para obtener una imagen predicha mediante el uso de este dispositivo se utiliza y codificar otro elemento de sintaxis, donde el elemento de sintaxis se usa para indicar la información de índice de la unidad de predicción seleccionada.
Debe entenderse que el dispositivo de codificación 40, de acuerdo con esta modalidad de la presente invención puede corresponder al dispositivo de codificación 20 en la modalidad de la presente invención, y puede corresponder a una entidad principal correspondiente que realiza el método 2000 en la modalidad de la presente invención. Lo anterior, así como otras operaciones y/o funciones de los módulos del dispositivo de codificación 40 son utilizados por separado para implementar el procedimiento correspondiente del método en la Figura 4. Por brevedad, los detalles no se describen en la presente descripción,
Por lo tanto, el dispositivo de codificación en esta modalidad de la presente invención reutiliza información de movimiento de una primera unidad de referencia mediante el uso de un mismo modelo de predicción de movimiento afín, y, por lo tanto, obtiene un vector de movimiento más preciso de una unidad de imagen actual sin codificar ni decodificar una diferencia de vector de movimiento y sin búsqueda adicional por un vector de movimiento de alta precisión. De esta manera, la precisión de la predicción se mejora y se mantiene la complejidad de la codificación y decodificación, mejorando de esta manera el rendimiento de codificación y decodificación.
Debe entenderse que "una modalidad" mencionada en toda la especificación significa que características, estructuras o rasgos particulares relacionados con la modalidad están incluidos en al menos una modalidad de la presente invención. Por lo tanto, "en una modalidad" que aparece en la especificación no se refiere a una misma modalidad. Además, estas características, estructuras y rasgos particulares se pueden combinar en una o más modalidades mediante el uso de cualquier forma apropiada.
Debe entenderse que los números de secuencia de los procesos anteriores no significan las secuencias de ejecución en diversas modalidades de la presente invención. Las secuencias de ejecución de los procesos deben determinarse de acuerdo con las funciones y la lógica interna de los procesos, y no se debe interpretar como una limitación en los procesos de implementación de las modalidades de la presente invención.
Además, los términos "sistema" y "red" se pueden utilizar de manera intercambiable en esta especificación. Debe entenderse que el término "y/o" en esta especificación describe únicamente una relación de asociación para describir objetos asociados y representa que pueden existir tres relaciones. Por ejemplo, A y/o B pueden representar los siguientes tres casos: únicamente existe A, A y B, y únicamente existe B. Además, el carácter "/" en esta especificación generalmente indica una relación de "o" entre los objetos asociados.
Debe entenderse que, en las modalidades de esta solicitud, "B" correspondiendo a "A" indican que B está asociado con A, y B puede determinarse de acuerdo con A. Sin embargo, además debe entenderse que la determinación de A de acuerdo con B no significa que B se determine de acuerdo con A únicamente; es decir, B también puede determinarse de acuerdo con A y/u otra información.
Un experto en la técnica puede tener conocimiento de que, en combinación con los ejemplos descritos en las modalidades divulgadas en esta especificación, las unidades y pasos de algoritmo pueden ser implementados mediante hardware electrónico, software informático, o una combinación de los mismos. Para describir claramente la capacidad de intercambio entre el hardware y el software, lo anterior generalmente ha descrito composiciones y pasos de cada ejemplo de acuerdo con las funciones. Ya sea que las funciones sean realizadas mediante hardware o software, esto depende de las aplicaciones particulares y la condiciones de restricción del diseño de las soluciones técnicas. Un experto en la técnica puede utilizar diferentes métodos para implementar las funciones descritas para cada aplicación particular, pero no se debe considerar que la implementación va más allá del alcance de la presente invención.
Claramente puede entenderse por un experto en la técnica que, para el propósito de una descripción breve y conveniente, para un proceso de trabajo detallado del sistema, aparato y unidad anterior, se puede hacer referencia a un proceso correspondiente en las modalidades del método anterior y los detalles no se describen en la presente descripción nuevamente.
En las diversas modalidades proporcionadas en esta solicitud, debe entenderse que el sistema, aparato y método divulgados pueden ser implementados en otras maneras. Por ejemplo, la modalidad del aparato descrito es simplemente un ejemplo. Por ejemplo, la división de unidad es simplemente la división de función lógica y puede ser otra división en la implementación real. Por ejemplo, una pluralidad de unidades o componentes se puede combinar o integrar en otro sistema, o algunos rasgos pueden ser ignorados o no realizados. Además, los acoplamientos mutuos o acoplamientos directos o conexiones de comunicación desplegadas o analizadas se pueden implementar mediante el uso de algunas interfaces. Los acoplamientos indirectos o conexiones de comunicación entre los aparatos o unidades se pueden implementar en forma electrónica, mecánica o de otro tipo.
Las unidades descritas como partes separadas pueden o no estar físicamente separadas, y las partes visualizadas como unidades pueden o no ser unidades físicas, pueden estar ubicadas en una posición, o pueden estar distribuidas en una pluralidad de unidades de red. Algunas o todas las unidades pueden seleccionarse de acuerdo con los requerimientos reales para lograr los objetivos de las soluciones de las modalidades.
Además, las unidades funcionales en las modalidades de la presente invención pueden estar integradas en una unidad de procesamiento, o cada una de las unidades puede existir físicamente sola, o dos o más unidades pueden estar integradas en una unidad.
Cuando la unidad integrada se implementa en la forma de una unidad funcional de software y se vende o se utiliza como un producto independiente, la unidad integrada puede almacenarse en un medio de almacenamiento legible por ordenador. Con base en dicho entendimiento, las soluciones técnicas de la presente invención esencialmente, o la parte que contribuye a la técnica anterior, o algunas de las soluciones técnicas pueden implementarse en una forma de un producto de software. El producto de software es almacenado en un medio de almacenamiento, e incluye varias instrucciones para ordenarle a un dispositivo informático (el cual puede ser un ordenador personal, un servidor o un dispositivo de red) que ejecute todos o algunos de los pasos de los métodos descritos en las modalidades de la presente invención. El medio de almacenamiento anterior incluye: cualquier medio que pueda almacenar un código de programa, tal como una unidad USB flash, un disco duro removible, una memoria de solo lectura (ROM), una memoria de acceso aleatorio (RAM), un disco magnético, o un disco óptico.
Claims (2)
1. Un dispositivo de predicción de imágenes, que comprende:
un primer módulo de obtención (11), configurado para obtener una unidad de predicción de movimiento afín de una unidad de imagen;
un segundo módulo de obtención (12), configurado para obtener información de posición e información de movimiento de tres puntos de control en la unidad de predicción de movimiento afín;
un tercer módulo de obtención (13), configurado para obtener información de movimiento de un punto de píxel en la unidad de imagen de acuerdo con la información de posición y la información de movimiento de los tres puntos de control en la unidad de predicción de movimiento afín;
caracterizado porque
el tercer módulo de obtención (13) está configurado para:
(1) obtener vectores de movimiento de dos puntos de control en la unidad de imagen de acuerdo con la información de posición obtenida y vectores de movimiento de los tres puntos de control en la unidad de predicción de movimiento afín;
(1a). obtener, mediante el análisis de un flujo de bits, residuales de los vectores de movimiento de los dos puntos de control en la unidad de imagen; obtener vectores de movimiento actualizados de los dos puntos de control en la unidad de imagen sumando los residuales de los vectores de movimiento de los dos puntos de control en la unidad de imagen a los vectores de movimiento obtenidos de los dos puntos de control en la unidad de imagen; y
(2) obtener un vector de movimiento de un punto de píxel de la unidad de imagen de acuerdo con los vectores de movimiento actualizados de los dos puntos de control en la unidad de imagen;
en donde la obtención de un vector de movimiento del punto de píxel de la unidad de imagen de acuerdo con los vectores de movimiento actualizados obtenidos de los dos puntos de control en la unidad de imagen, se implementa de la siguiente manera:
en donde x y y representan respectivamente las coordenadas horizontal y vertical de un punto de píxel en la unidad de imagen, vx y vy son vectores de movimiento horizontales y verticales correspondientes del punto de píxel en la unidad de imagen, y xc, y x1, y y0, y y1 representan respectivamente las coordenadas horizontal y vertical de dos puntos de control en la unidad de imagen, en donde y0 es igual a y1 , y vx0 y vx1 y vy0 y vy1 son vectores de movimiento horizontales y verticales correspondientes de los dos puntos de control en la unidad de imagen; y
en donde la obtención de vectores de movimiento de dos puntos de control en la unidad de imagen de acuerdo con la información de posición obtenida y los vectores de movimiento de los tres puntos de control en la unidad de predicción de movimiento afín, se implementa de la siguiente manera:
donde X0 y X1 y y0 y y1 son respectivamente coordenadas horizontal y vertical de los dos puntos de control en la unidad de imagen, y0 es igual a y1, vx0 y vx1 y vy0 y vy1 son los vectores de movimiento horizontal y vertical correspondientes de los dos puntos de control en la unidad de imagen, X2 , X3, y X4 y y2, y3, y y4 son respectivamente las coordenadas horizontal y vertical de los tres puntos de control en la unidad de predicción afín, y vx2 , vx3, y vx4 y vy2 , vy3, y vy4 son vectores de movimiento horizontal y vertical correspondientes de los tres puntos de control en la unidad de predicción afín.
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| CN201510543542.8A CN105163116B (zh) | 2015-08-29 | 2015-08-29 | 图像预测的方法及设备 |
| PCT/CN2015/100091 WO2017036045A1 (zh) | 2015-08-29 | 2015-12-31 | 图像预测的方法及设备 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| ES2946901T3 true ES2946901T3 (es) | 2023-07-28 |
Family
ID=54803857
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| ES15902849T Active ES2946901T3 (es) | 2015-08-29 | 2015-12-31 | Método y dispositivo de predicción de imágenes |
Country Status (22)
| Country | Link |
|---|---|
| US (5) | US10880543B2 (es) |
| EP (2) | EP3331242B1 (es) |
| JP (2) | JP6669855B2 (es) |
| KR (4) | KR102408277B1 (es) |
| CN (3) | CN108965869B (es) |
| AU (5) | AU2015407876B2 (es) |
| BR (3) | BR122020023970B1 (es) |
| DK (1) | DK3331242T3 (es) |
| ES (1) | ES2946901T3 (es) |
| FI (1) | FI3331242T3 (es) |
| HR (1) | HRP20230509T1 (es) |
| HU (1) | HUE063094T2 (es) |
| LT (1) | LT3331242T (es) |
| MX (3) | MX2021003044A (es) |
| MY (1) | MY200856A (es) |
| PL (1) | PL3331242T3 (es) |
| PT (1) | PT3331242T (es) |
| RU (3) | RU2693904C1 (es) |
| SG (3) | SG11201800920QA (es) |
| SI (1) | SI3331242T1 (es) |
| WO (1) | WO2017036045A1 (es) |
| ZA (3) | ZA202109388B (es) |
Families Citing this family (78)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| CN108965869B (zh) | 2015-08-29 | 2023-09-12 | 华为技术有限公司 | 图像预测的方法及设备 |
| CN109274974B (zh) | 2015-09-29 | 2022-02-11 | 华为技术有限公司 | 图像预测的方法及装置 |
| US20190158870A1 (en) * | 2016-01-07 | 2019-05-23 | Mediatek Inc. | Method and apparatus for affine merge mode prediction for video coding system |
| CN107046645B9 (zh) * | 2016-02-06 | 2020-08-14 | 华为技术有限公司 | 图像编解码方法及装置 |
| US20190068989A1 (en) * | 2016-02-25 | 2019-02-28 | Kt Corporation | Video signal processing method and device |
| WO2017147765A1 (en) * | 2016-03-01 | 2017-09-08 | Mediatek Inc. | Methods for affine motion compensation |
| EP3414900B1 (en) * | 2016-03-15 | 2025-08-06 | HFI Innovation Inc. | Method and apparatus of video coding with affine motion compensation |
| WO2017156705A1 (en) * | 2016-03-15 | 2017-09-21 | Mediatek Inc. | Affine prediction for video coding |
| KR102638991B1 (ko) | 2016-03-24 | 2024-02-21 | 엘지전자 주식회사 | 비디오 코딩 시스템에서 인터 예측 방법 및 장치 |
| JP2019519972A (ja) * | 2016-05-05 | 2019-07-11 | ヴィド スケール インコーポレイテッド | イントラコーディングのための制御点ベースのイントラ方向表現 |
| EP3457694A4 (en) * | 2016-05-24 | 2019-05-22 | Huawei Technologies Co., Ltd. | IMAGE FORECASTING METHOD AND ASSOCIATED DEVICE |
| US11089323B2 (en) * | 2016-05-28 | 2021-08-10 | Mediatek Inc. | Method and apparatus of current picture referencing for video coding |
| US10631002B2 (en) | 2016-09-30 | 2020-04-21 | Qualcomm Incorporated | Frame rate up-conversion coding mode |
| CN108271023B (zh) * | 2017-01-04 | 2021-11-19 | 华为技术有限公司 | 图像预测方法和相关设备 |
| US10701390B2 (en) | 2017-03-14 | 2020-06-30 | Qualcomm Incorporated | Affine motion information derivation |
| US11184636B2 (en) * | 2017-06-28 | 2021-11-23 | Sharp Kabushiki Kaisha | Video encoding device and video decoding device |
| US11082721B2 (en) | 2017-09-07 | 2021-08-03 | Lg Electronics Inc. | Method and apparatus for entropy-encoding and entropy-decoding video signal |
| CN109510991B (zh) * | 2017-09-15 | 2021-02-19 | 浙江大学 | 一种运动矢量导出方法及装置 |
| EP3468195A1 (en) | 2017-10-05 | 2019-04-10 | Thomson Licensing | Improved predictor candidates for motion compensation |
| CN117354539A (zh) * | 2017-10-27 | 2024-01-05 | 松下电器(美国)知识产权公司 | 编码装置、解码装置、生成装置、发送装置和存储介质 |
| CN109729352B (zh) | 2017-10-27 | 2020-07-21 | 华为技术有限公司 | 确定仿射编码块的运动矢量的方法和装置 |
| US11889100B2 (en) * | 2017-11-14 | 2024-01-30 | Qualcomm Incorporated | Affine motion vector prediction in video coding |
| US20190208211A1 (en) * | 2018-01-04 | 2019-07-04 | Qualcomm Incorporated | Generated affine motion vectors |
| CN108449599B (zh) * | 2018-03-23 | 2021-05-18 | 安徽大学 | 一种基于面透射变换的视频编码与解码方法 |
| NZ769216A (en) | 2018-03-25 | 2022-04-29 | B1 Institute Image Technology Inc | Image encoding/decoding method and device |
| KR20250020687A (ko) * | 2018-04-01 | 2025-02-11 | 광동 오포 모바일 텔레커뮤니케이션즈 코포레이션 리미티드 | 어파인 움직임 예측에 기반한 영상 코딩 방법 및 그 장치 |
| JP7088606B2 (ja) | 2018-04-02 | 2022-06-21 | エスゼット ディージェイアイ テクノロジー カンパニー リミテッド | 動画処理方法、画像処理装置、プログラム、符号化デバイス、及び復号化デバイス |
| KR102817113B1 (ko) * | 2018-04-13 | 2025-06-05 | 엘지전자 주식회사 | 비디오 처리 시스템에서 인터 예측 방법 및 장치 |
| WO2019199106A1 (ko) * | 2018-04-14 | 2019-10-17 | 엘지전자 주식회사 | 영상 코딩 시스템에서 인터 예측에 따른 영상 디코딩 방법 및 장치 |
| WO2019199152A1 (ko) * | 2018-04-14 | 2019-10-17 | 엘지전자 주식회사 | 어파인 예측을 이용하여 비디오 신호를 처리하는 방법 및 장치 |
| KR102568712B1 (ko) * | 2018-06-18 | 2023-08-22 | 엘지전자 주식회사 | 어파인 모션 예측을 사용하여 비디오 신호를 처리하기 위한 방법 및 장치 |
| CN110620932B (zh) | 2018-06-19 | 2022-11-08 | 北京字节跳动网络技术有限公司 | 依赖模式的运动矢量差精度集 |
| CN110876282B (zh) * | 2018-07-02 | 2022-10-18 | 华为技术有限公司 | 运动矢量预测方法以及相关装置 |
| CN120614463A (zh) * | 2018-07-02 | 2025-09-09 | Lg电子株式会社 | 视频信号解码和编码方法及存储介质 |
| WO2020010741A1 (zh) | 2018-07-11 | 2020-01-16 | 华为技术有限公司 | 视频编码器、视频解码器及相应方法 |
| US11051025B2 (en) | 2018-07-13 | 2021-06-29 | Tencent America LLC | Method and apparatus for video coding |
| WO2020038232A1 (zh) * | 2018-08-21 | 2020-02-27 | 华为技术有限公司 | 一种图像块的运动信息的预测方法及装置 |
| CN120075463A (zh) * | 2018-08-27 | 2025-05-30 | 松下电器(美国)知识产权公司 | 编码装置、解码装置和存储介质 |
| CN117528115A (zh) | 2018-08-27 | 2024-02-06 | 华为技术有限公司 | 一种视频图像预测方法及装置 |
| WO2020047132A1 (en) | 2018-08-29 | 2020-03-05 | Vid Scale, Inc. | Adaptive motion vector precision for affine motion model based video coding |
| CN116647696A (zh) * | 2018-09-06 | 2023-08-25 | Lg电子株式会社 | 图像解码方法、图像编码方法、存储介质和发送方法 |
| CN110891176B (zh) * | 2018-09-10 | 2023-01-13 | 华为技术有限公司 | 基于仿射运动模型的运动矢量预测方法及设备 |
| HUE060426T2 (hu) * | 2018-09-10 | 2023-02-28 | Lg Electronics Inc | Kép kódolás affin mozgás predikció alapján affin MVP jelölt lista használatával |
| JP7212150B2 (ja) | 2018-09-19 | 2023-01-24 | 北京字節跳動網絡技術有限公司 | 適応動きベクトル解像度によるアフィンモードへの構文の使用 |
| TWI846733B (zh) * | 2018-09-23 | 2024-07-01 | 大陸商北京字節跳動網絡技術有限公司 | 涉及仿射運動的一般應用 |
| WO2020058959A1 (en) * | 2018-09-23 | 2020-03-26 | Beijing Bytedance Network Technology Co., Ltd. | Motion vector derivation for sub-block in affine mode |
| WO2020058953A1 (en) * | 2018-09-23 | 2020-03-26 | Beijing Bytedance Network Technology Co., Ltd. | Simplified spatial-temporal motion vector prediction |
| CN110971899B (zh) * | 2018-10-01 | 2021-06-01 | 华为技术有限公司 | 一种确定运动信息的方法、帧间预测方法及装置 |
| CN111083484B (zh) | 2018-10-22 | 2024-06-28 | 北京字节跳动网络技术有限公司 | 基于子块的预测 |
| CN111083489B (zh) | 2018-10-22 | 2024-05-14 | 北京字节跳动网络技术有限公司 | 多次迭代运动矢量细化 |
| WO2020085953A1 (en) * | 2018-10-25 | 2020-04-30 | Huawei Technologies Co., Ltd. | An encoder, a decoder and corresponding methods for inter prediction |
| CN119743590A (zh) * | 2018-10-29 | 2025-04-01 | 华为技术有限公司 | 一种视频图像预测方法及装置 |
| CN111436227B (zh) * | 2018-11-12 | 2024-03-29 | 北京字节跳动网络技术有限公司 | 在视频处理中使用组合帧间-帧内预测 |
| CN113170105B (zh) * | 2018-11-16 | 2024-11-05 | 北京字节跳动网络技术有限公司 | 基于历史的仿射参数继承 |
| WO2020103852A1 (en) | 2018-11-20 | 2020-05-28 | Beijing Bytedance Network Technology Co., Ltd. | Difference calculation based on patial position |
| WO2020103877A1 (en) | 2018-11-20 | 2020-05-28 | Beijing Bytedance Network Technology Co., Ltd. | Coding and decoding of video coding modes |
| WO2020114515A1 (en) * | 2018-12-08 | 2020-06-11 | Beijing Bytedance Network Technology Co., Ltd. | Reducing the in-ctu storage required by affine inheritance |
| KR102387873B1 (ko) | 2018-12-13 | 2022-04-18 | 베이징 다지아 인터넷 인포메이션 테크놀로지 컴퍼니 리미티드 | 구축된 아핀 병합 후보들을 도출하기 위한 방법 |
| CN113196750B (zh) * | 2018-12-14 | 2024-07-12 | 北京字节跳动网络技术有限公司 | Mv位置的高准确度 |
| CN111355961B (zh) * | 2018-12-24 | 2023-11-03 | 华为技术有限公司 | 一种帧间预测的方法和装置 |
| EP3902257A4 (en) * | 2018-12-27 | 2022-01-05 | Guangdong Oppo Mobile Telecommunications Corp., Ltd. | CODING PREDICTION PROCESS AND APPARATUS, AND COMPUTER RECORDING MEDIA |
| CN120980252A (zh) | 2019-01-31 | 2025-11-18 | 北京字节跳动网络技术有限公司 | 对称运动矢量差编解码模式的快速算法 |
| WO2020156516A1 (en) | 2019-01-31 | 2020-08-06 | Beijing Bytedance Network Technology Co., Ltd. | Context for coding affine mode adaptive motion vector resolution |
| WO2020156576A1 (en) | 2019-02-02 | 2020-08-06 | Beijing Bytedance Network Technology Co., Ltd. | Multi-hmvp for affine |
| WO2020169109A1 (en) | 2019-02-22 | 2020-08-27 | Beijing Bytedance Network Technology Co., Ltd. | Sub-table for history-based affine mode |
| KR20210142610A (ko) * | 2019-03-05 | 2021-11-25 | 브이아이디 스케일, 인크. | Affine 모션 모델 유도 방법 |
| KR102635518B1 (ko) | 2019-03-06 | 2024-02-07 | 베이징 바이트댄스 네트워크 테크놀로지 컴퍼니, 리미티드 | 변환된 단예측 후보의 사용 |
| CN113992916B (zh) | 2019-03-25 | 2023-06-27 | Oppo广东移动通信有限公司 | 图像分量预测方法、编码器、解码器以及存储介质 |
| PH12021552704A1 (en) * | 2019-04-25 | 2022-03-07 | Op Solutions Llc | Efficient coding of global motion vectors |
| CN113676735A (zh) * | 2019-09-23 | 2021-11-19 | 杭州海康威视数字技术股份有限公司 | 编解码方法方法、装置及设备 |
| WO2020242350A2 (en) | 2019-09-30 | 2020-12-03 | Huawei Technologies Co., Ltd. | Usage of dct based interpolation filter and enhanced bilinear interpolation filter in affine motion compensation |
| WO2020251416A2 (en) | 2019-09-30 | 2020-12-17 | Huawei Technologies Co., Ltd. | Affine motion model restrictions reducing number of fetched reference lines during processing of one block row with enhanced interpolation filter |
| CN114450958B (zh) | 2019-09-30 | 2023-08-22 | 华为技术有限公司 | 用于减小增强插值滤波器的内存带宽的仿射运动模型限制 |
| KR102779596B1 (ko) | 2019-09-30 | 2025-03-10 | 후아웨이 테크놀러지 컴퍼니 리미티드 | Dct 기반 보간 필터의 사용 |
| EP4078966A4 (en) | 2020-01-07 | 2023-06-21 | Huawei Technologies Co., Ltd. | MOTION VECTOR RANGE DERIVATION FOR IMPROVED INTERPOLATION FILTER |
| CN113068041B (zh) * | 2021-03-12 | 2022-02-08 | 天津大学 | 一种智能仿射运动补偿编码方法 |
| CN114584792B (zh) * | 2021-10-13 | 2025-08-19 | 同济大学 | 点预测中定期更新点矢量的值的数据编码解码方法及装置 |
| KR20250168650A (ko) * | 2023-04-07 | 2025-12-02 | 광동 오포 모바일 텔레커뮤니케이션즈 코포레이션 리미티드 | 인코딩/디코딩 방법, 인코더, 디코더, 비트스트림 및 저장매체 |
Family Cites Families (26)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| GB9920256D0 (en) * | 1999-08-26 | 1999-10-27 | Wave Limited M | Motion estimation and compensation in video compression |
| WO2002037859A2 (en) * | 2000-11-03 | 2002-05-10 | Compression Science | Video data compression system |
| US7616782B2 (en) * | 2004-05-07 | 2009-11-10 | Intelliview Technologies Inc. | Mesh based frame processing and applications |
| KR101278224B1 (ko) * | 2004-09-21 | 2013-06-24 | 유클리드 디스커버리스, 엘엘씨 | 비디오 데이터를 처리하기 위한 장치 및 방법 |
| US8693540B2 (en) * | 2005-03-10 | 2014-04-08 | Qualcomm Incorporated | Method and apparatus of temporal error concealment for P-frame |
| CN100486336C (zh) * | 2006-09-21 | 2009-05-06 | 上海大学 | 基于h.264压缩域运动对象实时分割方法 |
| KR101366242B1 (ko) * | 2007-03-29 | 2014-02-20 | 삼성전자주식회사 | 움직임 모델 파라메터의 부호화, 복호화 방법 및 움직임모델 파라메터를 이용한 영상의 부호화, 복호화 방법 및장치 |
| WO2009096721A2 (en) * | 2008-01-29 | 2009-08-06 | Electronics And Telecommunications Research Institute | Method and apparatus for encoding and decoding video signal using motion compensation based on affine transformation |
| KR101003105B1 (ko) * | 2008-01-29 | 2010-12-21 | 한국전자통신연구원 | 어파인 변환 기반의 움직임 보상을 이용한 비디오 부호화 및 복호화 방법 및 장치 |
| CN101605256A (zh) * | 2008-06-12 | 2009-12-16 | 华为技术有限公司 | 一种视频编解码的方法及装置 |
| RU2421814C2 (ru) * | 2009-02-20 | 2011-06-20 | Корпорация "САМСУНГ ЭЛЕКТРОНИКС Ко., Лтд." | Способ формирования составного изображения |
| WO2011013253A1 (ja) * | 2009-07-31 | 2011-02-03 | 株式会社 東芝 | 幾何変換動き補償予測を用いる予測信号生成装置、動画像符号化装置及び動画像復号化装置 |
| US8411750B2 (en) * | 2009-10-30 | 2013-04-02 | Qualcomm Incorporated | Global motion parameter estimation using block-based motion vectors |
| CN101771878B (zh) * | 2010-01-14 | 2011-05-25 | 广西大学 | 面向全景视频编码的自适应选择全局运动估计方法 |
| JP5686018B2 (ja) * | 2010-05-21 | 2015-03-18 | 株式会社Jvcケンウッド | 画像符号化装置、画像符号化方法および画像符号化プログラム |
| CN103026707B (zh) * | 2010-07-21 | 2016-11-09 | 杜比实验室特许公司 | 使用用于视频编码的高级运动模型的参考处理 |
| US9503720B2 (en) | 2012-03-16 | 2016-11-22 | Qualcomm Incorporated | Motion vector coding and bi-prediction in HEVC and its extensions |
| EP2842334B1 (en) | 2012-07-05 | 2019-02-20 | MediaTek Inc. | Method and apparatus of unified disparity vector derivation for 3d video coding |
| CN104704827B (zh) | 2012-11-13 | 2019-04-12 | 英特尔公司 | 用于下一代视频的内容自适应变换译码 |
| WO2016008157A1 (en) * | 2014-07-18 | 2016-01-21 | Mediatek Singapore Pte. Ltd. | Methods for motion compensation using high order motion model |
| CN104539966B (zh) * | 2014-09-30 | 2017-12-22 | 华为技术有限公司 | 图像预测方法及相关装置 |
| CN104363451B (zh) * | 2014-10-27 | 2019-01-25 | 华为技术有限公司 | 图像预测方法及相关装置 |
| CN109005407B (zh) * | 2015-05-15 | 2023-09-01 | 华为技术有限公司 | 视频图像编码和解码的方法、编码设备和解码设备 |
| CN107925758B (zh) * | 2015-08-04 | 2022-01-25 | Lg 电子株式会社 | 视频编译系统中的帧间预测方法和设备 |
| US10582215B2 (en) * | 2015-08-07 | 2020-03-03 | Lg Electronics Inc. | Inter prediction method and apparatus in video coding system |
| CN108965869B (zh) * | 2015-08-29 | 2023-09-12 | 华为技术有限公司 | 图像预测的方法及设备 |
-
2015
- 2015-08-29 CN CN201810596855.3A patent/CN108965869B/zh active Active
- 2015-08-29 CN CN201810596891.XA patent/CN108600749B/zh active Active
- 2015-08-29 CN CN201510543542.8A patent/CN105163116B/zh active Active
- 2015-12-31 SG SG11201800920QA patent/SG11201800920QA/en unknown
- 2015-12-31 DK DK15902849.7T patent/DK3331242T3/da active
- 2015-12-31 KR KR1020217022988A patent/KR102408277B1/ko active Active
- 2015-12-31 FI FIEP15902849.7T patent/FI3331242T3/fi active
- 2015-12-31 SI SI201531945T patent/SI3331242T1/sl unknown
- 2015-12-31 JP JP2018505411A patent/JP6669855B2/ja active Active
- 2015-12-31 AU AU2015407876A patent/AU2015407876B2/en active Active
- 2015-12-31 RU RU2018110829A patent/RU2693904C1/ru active
- 2015-12-31 BR BR122020023970-0A patent/BR122020023970B1/pt active IP Right Grant
- 2015-12-31 LT LTEPPCT/CN2015/100091T patent/LT3331242T/lt unknown
- 2015-12-31 SG SG10202106076VA patent/SG10202106076VA/en unknown
- 2015-12-31 HR HRP20230509TT patent/HRP20230509T1/hr unknown
- 2015-12-31 MX MX2021003044A patent/MX2021003044A/es unknown
- 2015-12-31 EP EP15902849.7A patent/EP3331242B1/en active Active
- 2015-12-31 WO PCT/CN2015/100091 patent/WO2017036045A1/zh not_active Ceased
- 2015-12-31 PT PT159028497T patent/PT3331242T/pt unknown
- 2015-12-31 BR BR122020023963-8A patent/BR122020023963B1/pt active IP Right Grant
- 2015-12-31 KR KR1020207021446A patent/KR102281830B1/ko active Active
- 2015-12-31 PL PL15902849.7T patent/PL3331242T3/pl unknown
- 2015-12-31 SG SG10202106074TA patent/SG10202106074TA/en unknown
- 2015-12-31 MX MX2021003042A patent/MX2021003042A/es unknown
- 2015-12-31 EP EP23172262.0A patent/EP4274226A1/en active Pending
- 2015-12-31 RU RU2019117128A patent/RU2714362C2/ru active
- 2015-12-31 ES ES15902849T patent/ES2946901T3/es active Active
- 2015-12-31 MX MX2018002414A patent/MX380622B/es unknown
- 2015-12-31 KR KR1020217022989A patent/KR102408278B1/ko active Active
- 2015-12-31 BR BR112018003653-6A patent/BR112018003653B1/pt active IP Right Grant
- 2015-12-31 KR KR1020187006066A patent/KR102138931B1/ko active Active
- 2015-12-31 HU HUE15902849A patent/HUE063094T2/hu unknown
- 2015-12-31 MY MYPI2018700440A patent/MY200856A/en unknown
-
2018
- 2018-02-27 US US15/906,418 patent/US10880543B2/en active Active
-
2019
- 2019-09-12 AU AU2019229381A patent/AU2019229381B2/en active Active
-
2020
- 2020-01-23 RU RU2020102708A patent/RU2020102708A/ru unknown
- 2020-02-27 JP JP2020031922A patent/JP7237874B2/ja active Active
- 2020-12-07 US US17/114,329 patent/US11368678B2/en active Active
-
2021
- 2021-06-10 AU AU2021203875A patent/AU2021203875A1/en not_active Abandoned
- 2021-08-06 AU AU2021212122A patent/AU2021212122B2/en active Active
- 2021-08-06 AU AU2021212103A patent/AU2021212103B2/en active Active
- 2021-11-23 ZA ZA2021/09388A patent/ZA202109388B/en unknown
- 2021-11-23 ZA ZA2021/09389A patent/ZA202109389B/en unknown
-
2022
- 2022-05-27 US US17/827,398 patent/US11979559B2/en active Active
- 2022-09-19 ZA ZA2022/10346A patent/ZA202210346B/en unknown
-
2024
- 2024-04-02 US US18/624,948 patent/US12192449B2/en active Active
- 2024-11-26 US US18/960,910 patent/US20250203065A1/en active Pending
Also Published As
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| ES2946901T3 (es) | Método y dispositivo de predicción de imágenes | |
| ES2900232T3 (es) | Método de codificación y decodificación de imágenes de vídeo, dispositivo de codificación y dispositivo de decodificación | |
| ES2626823T3 (es) | Procedimiento y dispositivo para optimizar la codificación/descodificación de desplazamientos de compensación para un conjunto de muestras reconstruidas de una imagen | |
| ES2988737T3 (es) | Procedimiento y aparato de codificación/decodificación de datos de imagen | |
| JP5351020B2 (ja) | バーチャルリファレンスピクチャを使用した方法及び装置 | |
| CN104333760B (zh) | 三维图像编码方法和三维图像解码方法及相关装置 | |
| TW201919402A (zh) | 視訊圖像編碼和解碼的方法、裝置及設備 | |
| JP7791141B2 (ja) | クロマイントラ予測方法および装置、並びにコンピュータ記憶媒体 | |
| CN112291566B (zh) | H.264视频编码方法、装置及存储设备 | |
| JP7828382B2 (ja) | 情報処理方法及び装置、設備、記憶媒体 | |
| RU2808688C2 (ru) | Способ и устройство предсказания изображения | |
| RU2809673C2 (ru) | Способ и устройство предсказания изображения | |
| BR122025007191A2 (pt) | Método de decodificação de imagens, método de codificação de imagens, meio de armazenamento digital não transitório legível por computador e método para transmitir dados para informações de imagem | |
| BR122025007190A2 (pt) | Método de decodificação de imagens, método de codificação de imagens, meio de armazenamento digital não transitório legível por computador e método para transmitir dados para informações de imagem | |
| BR112017024467B1 (pt) | Método de codificação de imagem de vídeo, método de decodificação de imagem de vídeo, dispositivo de codificação, e dispositivo de decodificação |
























