ES2344123T3 - Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. - Google Patents
Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. Download PDFInfo
- Publication number
- ES2344123T3 ES2344123T3 ES06795862T ES06795862T ES2344123T3 ES 2344123 T3 ES2344123 T3 ES 2344123T3 ES 06795862 T ES06795862 T ES 06795862T ES 06795862 T ES06795862 T ES 06795862T ES 2344123 T3 ES2344123 T3 ES 2344123T3
- Authority
- ES
- Spain
- Prior art keywords
- content
- elements
- source
- candidate
- candidate content
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Active
Links
Classifications
-
- G—PHYSICS
- G11—INFORMATION STORAGE
- G11B—INFORMATION STORAGE BASED ON RELATIVE MOVEMENT BETWEEN RECORD CARRIER AND TRANSDUCER
- G11B27/00—Editing; Indexing; Addressing; Timing or synchronising; Monitoring; Measuring tape travel
- G11B27/10—Indexing; Addressing; Timing or synchronising; Measuring tape travel
- G11B27/19—Indexing; Addressing; Timing or synchronising; Measuring tape travel by using information detectable on the record carrier
- G11B27/28—Indexing; Addressing; Timing or synchronising; Measuring tape travel by using information detectable on the record carrier by using information signals recorded by the same method as the main recording
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/60—Information retrieval; Database structures therefor; File system structures therefor of audio data
- G06F16/63—Querying
- G06F16/632—Query formulation
- G06F16/634—Query by example, e.g. query by humming
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/60—Information retrieval; Database structures therefor; File system structures therefor of audio data
- G06F16/63—Querying
- G06F16/638—Presentation of query results
- G06F16/639—Presentation of query results using playlists
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/60—Information retrieval; Database structures therefor; File system structures therefor of audio data
- G06F16/68—Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/60—Information retrieval; Database structures therefor; File system structures therefor of audio data
- G06F16/68—Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually
- G06F16/683—Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually using metadata automatically derived from the content
Landscapes
- Engineering & Computer Science (AREA)
- Theoretical Computer Science (AREA)
- Physics & Mathematics (AREA)
- General Engineering & Computer Science (AREA)
- Databases & Information Systems (AREA)
- Data Mining & Analysis (AREA)
- Multimedia (AREA)
- General Physics & Mathematics (AREA)
- Library & Information Science (AREA)
- Mathematical Physics (AREA)
- Management Or Editing Of Information On Record Carriers (AREA)
- Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
- Indexing, Searching, Synchronizing, And The Amount Of Synchronization Travel Of Record Carriers (AREA)
- Automatic Analysis And Handling Materials Therefor (AREA)
Abstract
Procedimiento para generar de manera automática una lista de reproducción de elementos de contenido candidatos que tienen características similares a características de un elemento de contenido fuente, en el que el elemento de contenido fuente y/o los elementos de contenido candidatos comprenden múltiples características, siendo las múltiples características representativas de diferentes partes del elemento de contenido fuente y/o los elementos de contenido candidatos, comprendiendo el procedimiento las etapas de: comparar las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que son similares al elemento de contenido fuente; y añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato, y los elementos de contenido candidatos identificados que van a añadirse a la lista de reproducción comprenden al menos un elemento de contenido candidato que tiene la distancia más pequeña.
Description
Procedimiento y aparato para generar de manera
automática una lista de reproducción mediante comparación por
segmento de características.
La presente invención se refiere a un
procedimiento y aparato para generar de manera automática una lista
de reproducción de elementos de contenido, por ejemplo canciones. En
particular, se refiere a la generación automática de lista de
reproducción de elementos de contenido similares a un elemento de
contenido fuente.
Los dispositivos de consumo multimedia están en
expansión en cuanto a potencia de procesamiento y pueden
proporcionar a los usuarios características más avanzadas de
exploración, navegación y recuperación de contenido multimedia. Se
espera que, debido al aumento de las capacidades de almacenamiento y
los anchos de banda de conexión, los consumidores tendrán acceso a
bases de datos enormes de elementos de contenido. Por tanto, existe
una demanda cada vez mayor para proporcionar sistemas de
exploración, navegación y recuperación eficaces para ayudar al
usuario.
Hay muchos sistemas conocidos para la
recuperación de elementos de contenido y para la generación
automática de listas de reproducción. Algunos de estos sistemas
funcionan para seleccionar elementos de contenido a partir de una
extensa base de datos basándose en su similitud con un determinado
elemento de contenido fuente (o de referencia). En tales sistemas,
todos los elementos de contenido almacenados en la base de datos se
analizan previamente y sus características representativas se
almacenan en una base de datos de metadatos. El usuario suministra
un elemento de contenido fuente (que tiene una clasificación,
asociada al mismo) y el sistema recupera entonces elementos de
contenido similares comparando el grado de similitud entre las
respectivas características representativas (o similitud entre las
clasificaciones de los respectivos elementos de contenido). Sin
embargo, estos sistemas conocidos no recuperan todos los elementos
de contenido que el usuario consideraría similares al elemento de
contenido fuente.
El documento US 5.918.223 da a conocer un
sistema que realiza análisis y comparación de archivos de datos de
audio basándose en el contenido de los archivos de datos. El
análisis de los datos de audio produce un conjunto de valores
números (un vector de características) que puede usarse para
clasificar y ordenar la similitud entre archivos de audio
individuales almacenados normalmente en una base de datos multimedia
o en la World Wide Web. El análisis también facilita la descripción
de clases de archivos de audio definidas por los usuarios,
basándose en un análisis de un conjunto de archivos de audio que
forman parte de una clase definida por los usuarios. El sistema
puede encontrar sonidos dentro de un sonido más largo, permitiendo
segmentar una grabación de audio de manera automática en una serie
de segmentos de audio más cortos.
El documento US2002/0181711 A1 da a conocer un
procedimiento y aparato informáticos para determinar similitud
musical generando una firma agrupada de K medias (en vez de una
gaussiana) y una firma de compás para cada pieza musical. El compás
de la música se incluye en la posterior medición de distancia.
El documento US 2003/0183064 A1 da a conocer un
sistema de reproducción secuencial configurado para seleccionar
cada canción secuencial basándose en características de un segmento
final de cada canción precedente. Las canciones se seleccionan
basándose en las características del tema global de la selección, en
caso de haberlo, y también basándose en una correspondencia musical
entre canciones. La correspondencia puede basarse en el ritmo de
cada canción, las notas y acordes de cada canción, y otras
características musicales de las canciones. Se caracteriza el
segmento final de cada canción seleccionada, y el primer segmento de
una canción candidata que satisface los criterios de selección
globales se compara con esta caracterización para determinar una
correspondencia. Si el primer segmento de la canción candidata no
concuerda con el segmento final de la canción seleccionada
previamente, se encuentra otra canción candidata que satisfaga los
criterios de selección globales, y el primer segmento de esta nueva
canción candidata se compara con la caracterización. Este proceso
continúa hasta que se identifica una canción candidata adecuada, o
hasta que se supera un tiempo límite. Opcionalmente se proporcionan
piezas de transición para facilitar una transición suave entre
canciones.
La presente invención pretende proporcionar un
procedimiento que mejore la calidad percibida de la lista de
reproducción generada.
Esto se consigue, según un aspecto de la
presente invención, mediante un procedimiento para generar de manera
automática una lista de reproducción de elementos de contenido
candidatos que tienen características similares a características
de un elemento de contenido fuente, comprendiendo el procedimiento
las etapas de: comparar al menos una característica del elemento de
contenido fuente con al menos una característica de los elementos
de contenido candidatos para identificar elementos específicos de
dichos elementos de contenido candidatos que sean similares al
elemento de contenido fuente; y añadir los elementos de contenido
candidatos identificados a la lista de reproducción, en el que la
al menos una característica del elemento de contenido fuente y/o la
al menos una característica de los elementos de contenido candidatos
comprenden múltiples características, siendo las múltiples
características representativas de diferentes partes del elemento de
contenido fuente y/o los elementos de contenido candidatos. Las
múltiples características del elemento de contenido fuente y/o de
los elementos de contenido candidatos se comparan con al menos una
característica del elemento de contenido fuente o de los elementos
de contenido candidatos determinando las distancias entre las
características. Durante la generación de la lista de reproducción,
la distancia entre el elemento de contenido fuente y cualquiera de
los elementos de contenido candidatos viene dada por el valor más
pequeño de las distancias determinadas para dicho par de elemento de
contenido fuente-elemento de contenido
candidato.
Esto se consigue también, según otro aspecto de
la presente invención, mediante un aparato para generar de manera
automática una lista de reproducción de elementos de contenido
candidatos que tienen características similares a características
de un elemento de contenido fuente, en el que el elemento de
contenido fuente y/o los elementos de contenido candidatos
comprenden múltiples características, siendo las múltiples
características representativas de diferentes partes del elemento
de contenido fuente y/o los elementos de contenido candidatos,
comprendiendo el generador:
- un comparador para comparar las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que sean similares al elemento de contenido fuente; y
- un compilador para añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candi- dato.
\vskip1.000000\baselineskip
Por ejemplo, una pieza de composición de
elemento de contenido de audio puede tener tres partes distintivas:
clásica, voz y pop. Usando un clasificador conocido, esto se
clasificaría estrictamente como uno de clásico, voz o pop. Como
resultado, una lista de reproducción generada sólo podría contener
canciones candidatas de esta única clase y/o sólo podría contener
canciones candidatas cuya única clase sea similar a la clase de la
canción fuente (por ejemplo una canción candidata con una parte de
pop no puede incluirse para una canción fuente de clase pop si la
canción candidata también tiene una parte de clásico y sólo se usa
esta parte de clásico para comparar las dos canciones). Para
superar esto, según una realización de la presente invención, se
mantiene un registro, en el caso del ejemplo anterior,
características de cada parte (tres conjuntos de características):
un conjunto extraído de la parte de clásico, un conjunto de la parte
de voz y un conjunto de la parte de pop y, en la base de datos, el
contenido está asociado con los tres conjuntos de características.
Esto significa que el clasificador clasificará una canción de este
tipo como clásico, voz y pop. Por consiguiente, si el contenido del
elemento de contenido varía en gran medida, estará representado por
un número mayor de vectores de características que representarán de
manera más precisa las características del contenido en oposición a
los sistemas existentes que intentaría representar las
características con un único vector de características. Esto da
como resultado una lista de reproducción mejorada de elementos de
contenido
similares.
similares.
Las características pueden ser una única
característica, por ejemplo un valor que representa el tempo o una
clasificación, o puede ser un vector de características. El
procedimiento puede extraer la característica a partir de un
elemento de contenido o de una etiqueta de metadatos o una entrada
de base de datos asociada con el elemento de contenido.
En una realización preferida, cada uno de la
pluralidad de elementos de contenido candidatos y el elemento de
contenido fuente se segmentan en una pluralidad de tramas; y se
extrae al menos un vector de características de cada trama para
proporcionar los múltiples vectores de características del elemento
de contenido.
La segmentación proporciona una etapa de
preprocesamiento y el vector de características puede extraerse
usando un clasificador existente. Por tanto, no se requiere ninguna
modificación del clasificador.
\vskip1.000000\baselineskip
Para una comprensión más completa de la presente
invención, se hace referencia, a modo de ejemplo, a la siguiente
descripción tomada junto con los dibujos adjuntos, en los que:
la figura 1 ilustra etapas del procedimiento
según una primera realización de la presente invención;
la figura 2 ilustra las etapas del procedimiento
según una segunda realización de la presente invención; y
la figura 3 ilustra gráficamente la distribución
de los vectores de características extraídos según una tercera
realización de la presente invención.
Con la finalidad de describir las realizaciones,
sólo se describirá la extracción de vectores de características del
contenido de audio del elemento de contenido. Sin embargo, puede
apreciarse que el procedimiento podría aplicarse para la extracción
de características del resto del contenido del elemento de
contenido. El elemento de contenido puede comprender un archivo de
contenidos multimedia analógico o digital, pistas musicales,
canciones y similares.
El procedimiento según una primera realización
se describirá ahora con referencia a la figura 1. El audio x
entrante se segmenta en primer lugar en tramas x_{m} de longitud
elegida de manera arbitraria, etapa 101. La longitud de las tramas
puede tener la misma longitud predeterminada o puede variarse de
manera aleatoria. Para cada segmento de audio (o trama) x_{m}, se
extrae un vector de características usando técnicas conocidas, etapa
103 y se almacena en una base de datos de características, etapa
105.
Sea M \geq 1 el número de segmentos en el
elemento de contenido candidato (canción) y K \geq 1 el número de
segmentos en el elemento de contenido fuente (canción). Además, sea
F_{s,k} y F_{j,m} los vectores de características
correspondientes al k-ésimo y al m-ésimo segmento de las canciones
fuente y candidata, respectivamente. Después, durante la generación
de la lista de reproducción, la distancia D(F_{s}, F_{j})
entre la canción fuente segmentada (indicada por s) y la canción
candidata segmentada (indicada por j) viene dada por
Pueden seleccionarse varias canciones candidatas
que satisfacen los criterios de distancia predeterminados. Éstas
pueden incluirse en la lista de reproducción con orden de distancia
ascendente, por ejemplo. El usuario puede entonces seleccionar las
(digamos 30) primeras coincidencias para crear la lista de
reproducción. Alternativamente, puede predeterminarse un umbral
máximo para D(F_{s}, F_{j}) y sólo se seleccionan para
lista de reproducción aquellos elementos de contenido (canciones)
que tienen distancias por debajo del umbral.
En la segunda realización, se consigue la
segmentación comparando el cambio instantáneo en el vector de
características. Un sencillo esquema de esta realización se muestra
en la figura 2. Esto se consigue promediando de manera continua,
etapa 205, el vector de características extraído en la etapa 201
hasta que el cambio instantáneo en las estadísticas de
característica supera un determinado umbral T, en la etapa 203.
Siempre que sucede esto, se ajusta un límite de segmentación, se
reinicializa la memoria intermedia de promediado 207 y se escribe
el vector de características del segmento en la base de datos de
características, etapa 209. Este procedimiento se repite hasta que
se alcanza el final de la canción. La ventaja de este enfoque es que
proporciona un mejor equilibrio entre el número de características
por canción y la representatividad de las características. El
cambio instantáneo puede calcularse de diversas formas. Algunos
ejemplos de cambio instantáneo son un cambio en la media local,
monitorización del desvío, etc.
De nuevo, tal como se describió con referencia a
la primera realización, pueden seleccionarse varias canciones
candidatas que satisfagan criterios de distancia predeterminados
para generar la lista de reproducción.
En una tercera realización, se extraen vectores
de características y se determinan vectores de características
representativos analizando la distribución de los vectores. Un
sencillo ejemplo de una distribución de este tipo se muestra en la
figura 3.
En este caso, las características F1, F2 y F3 se
consideran representativas. De este modo no se requiere una
segmentación de las canciones. El procedimiento según esta
realización simplemente mira las estadísticas y toma los máximos
locales como características representativas. Si hay varios máximos
locales, se extraen múltiples características representativas. Si
sólo hay un máximo, entonces la canción sólo tendrá una
característica representativa.
De nuevo, tal como se describió con referencia a
la primera realización, pueden seleccionarse varias canciones
candidatas que satisfacen criterios de distancia predeterminados
para generar la lista de reproducción. Como resultado, en este
procedimiento puede obtenerse una aleatorización de la lista de
reproducción eligiendo de manera aleatoria a partir de las
características representativas. De este modo puede conseguirse una
lista de reproducción aleatorizada más precisa (sin ruido).
Aunque las realizaciones preferidas de la
presente invención se han ilustrado en los dibujos adjuntos y se han
descrito en la descripción detallada anterior, se entenderá que la
invención no está limitada a las realizaciones dadas a conocer, sino
que son posibles numerosas modificaciones sin alejarse del alcance
de la invención según se expone en las siguientes
reivindicaciones.
Claims (8)
1. Procedimiento para generar de manera
automática una lista de reproducción de elementos de contenido
candidatos que tienen características similares a características
de un elemento de contenido fuente, en el que el elemento de
contenido fuente y/o los elementos de contenido candidatos
comprenden múltiples características, siendo las múltiples
características representativas de diferentes partes del elemento de
contenido fuente y/o los elementos de contenido candidatos,
comprendiendo el procedimiento las etapas de:
- comparar las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que son similares al elemento de contenido fuente; y
- añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato, y los elementos de contenido candidatos identificados que van a añadirse a la lista de reproducción comprenden al menos un elemento de contenido candidato que tiene la distancia más pequeña.
2. Procedimiento según la reivindicación 1, que
comprende además las etapas de:
- segmentar cada uno de la pluralidad de elementos de contenido candidatos y/o el elemento de contenido fuente en una pluralidad de tramas (101);
- extraer al menos una característica de cada trama para proporcionar las múltiples características del elemento (102) de contenido.
3. Procedimiento según la reivindicación 2, en
el que las tramas tienen una longitud predeterminada.
4. Procedimiento según la reivindicación 3, en
el que cada trama tiene la misma longitud.
5. Procedimiento según la reivindicación 2, en
el que la segmentación se basa en el contenido de los elementos de
contenido candidatos y/o el elemento de contenido fuente.
6. Procedimiento según la reivindicación 2, en
el que los límites de dicha pluralidad de tramas se determina
mediante los cambios instantáneos en las características de dichos
elementos de contenido candidatos y/o el elemento de contenido
fuente.
7. Aparato para generar de manera automática una
lista de reproducción de elementos de contenido candidatos que
tienen características similares a características de un elemento de
contenido fuente, en el que el elemento de contenido fuente y/o los
elementos de contenido candidatos comprenden múltiples
características, siendo las múltiples características
representativas de diferentes partes del elemento de contenido
fuente y/o los elementos de contenido candidatos, comprendiendo el
generador:
- un comparador para compara las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que sean similares al elemento de contenido fuente; y
- un compilador para añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato, y los elementos de contenido candidatos identificados que van a añadirse a la lista de reproducción comprenden al menos un elemento de contenido candidato que tiene la distancia más pequeña.
8. Producto de programa informático que
comprende una pluralidad de partes de código de programa para llevar
a cabo el procedimiento según una cualquiera de las reivindicaciones
1 a 6.
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| EP05109015 | 2005-09-29 | ||
| EP05109015 | 2005-09-29 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| ES2344123T3 true ES2344123T3 (es) | 2010-08-18 |
Family
ID=37719136
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| ES06795862T Active ES2344123T3 (es) | 2005-09-29 | 2006-09-01 | Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. |
Country Status (8)
| Country | Link |
|---|---|
| US (1) | US20080235267A1 (es) |
| EP (1) | EP1932154B1 (es) |
| JP (1) | JP2009510509A (es) |
| CN (1) | CN101278350B (es) |
| AT (1) | ATE464642T1 (es) |
| DE (1) | DE602006013666D1 (es) |
| ES (1) | ES2344123T3 (es) |
| WO (1) | WO2007036817A1 (es) |
Families Citing this family (9)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US8914384B2 (en) * | 2008-09-08 | 2014-12-16 | Apple Inc. | System and method for playlist generation based on similarity data |
| US20110225496A1 (en) * | 2010-03-12 | 2011-09-15 | Peter Jeffe | Suggested playlist |
| US20150242750A1 (en) * | 2014-02-24 | 2015-08-27 | Google Inc. | Asymmetric Rankers for Vector-Based Recommendation |
| US9978374B2 (en) | 2015-09-04 | 2018-05-22 | Google Llc | Neural networks for speaker verification |
| US11328010B2 (en) * | 2017-05-25 | 2022-05-10 | Microsoft Technology Licensing, Llc | Song similarity determination |
| CA3082744A1 (en) * | 2017-12-09 | 2019-06-13 | Shubhangi Mahadeo Jadhav | System and method for recommending visual-map based playlists |
| EP3716262B1 (en) * | 2018-10-19 | 2025-09-17 | Sony Group Corporation | Information processing device, information processing method, and information processing program |
| US11574248B2 (en) | 2020-04-02 | 2023-02-07 | Rovi Guides, Inc. | Systems and methods for automated content curation using signature analysis |
| US11238287B2 (en) * | 2020-04-02 | 2022-02-01 | Rovi Guides, Inc. | Systems and methods for automated content curation using signature analysis |
Family Cites Families (27)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US621673A (en) * | 1899-03-21 | Clipper | ||
| JPH0430382A (ja) * | 1990-05-24 | 1992-02-03 | Mazda Motor Corp | 車両用音響装置 |
| US5283819A (en) * | 1991-04-25 | 1994-02-01 | Compuadd Corporation | Computing and multimedia entertainment system |
| AU4279893A (en) * | 1992-04-10 | 1993-11-18 | Avid Technology, Inc. | A method and apparatus for representing and editing multimedia compositions |
| US5437050A (en) * | 1992-11-09 | 1995-07-25 | Lamb; Robert G. | Method and apparatus for recognizing broadcast information using multi-frequency magnitude detection |
| JPH07219970A (ja) * | 1993-12-20 | 1995-08-18 | Xerox Corp | 加速フォーマットでの再生方法及び再生装置 |
| US5701452A (en) * | 1995-04-20 | 1997-12-23 | Ncr Corporation | Computer generated structure |
| US5918223A (en) | 1996-07-22 | 1999-06-29 | Muscle Fish | Method and article of manufacture for content-based analysis, storage, retrieval, and segmentation of audio information |
| JPH10134549A (ja) * | 1996-10-30 | 1998-05-22 | Nippon Columbia Co Ltd | 楽曲検索装置 |
| US6819863B2 (en) * | 1998-01-13 | 2004-11-16 | Koninklijke Philips Electronics N.V. | System and method for locating program boundaries and commercial boundaries using audio categories |
| US6216173B1 (en) * | 1998-02-03 | 2001-04-10 | Redbox Technologies Limited | Method and apparatus for content processing and routing |
| JP3964979B2 (ja) * | 1998-03-18 | 2007-08-22 | 株式会社ビデオリサーチ | 楽曲識別方法及び楽曲識別システム |
| US6845398B1 (en) * | 1999-08-02 | 2005-01-18 | Lucent Technologies Inc. | Wireless multimedia player |
| US8326584B1 (en) * | 1999-09-14 | 2012-12-04 | Gracenote, Inc. | Music searching methods based on human perception |
| US6901362B1 (en) * | 2000-04-19 | 2005-05-31 | Microsoft Corporation | Audio segmentation and classification |
| US6910035B2 (en) * | 2000-07-06 | 2005-06-21 | Microsoft Corporation | System and methods for providing automatic classification of media entities according to consonance properties |
| US7065416B2 (en) * | 2001-08-29 | 2006-06-20 | Microsoft Corporation | System and methods for providing automatic classification of media entities according to melodic movement properties |
| US7031980B2 (en) | 2000-11-02 | 2006-04-18 | Hewlett-Packard Development Company, L.P. | Music similarity function based on signal analysis |
| JP2002175685A (ja) * | 2000-12-06 | 2002-06-21 | Alpine Electronics Inc | オーディオシステム |
| US7432940B2 (en) * | 2001-10-12 | 2008-10-07 | Canon Kabushiki Kaisha | Interactive animation of sprites in a video production |
| US6785645B2 (en) * | 2001-11-29 | 2004-08-31 | Microsoft Corporation | Real-time speech and music classifier |
| US6933432B2 (en) * | 2002-03-28 | 2005-08-23 | Koninklijke Philips Electronics N.V. | Media player with “DJ” mode |
| JP4228581B2 (ja) * | 2002-04-09 | 2009-02-25 | ソニー株式会社 | オーディオ機器、オーディオデータの管理方法及びそのためのプログラム |
| US6987221B2 (en) * | 2002-05-30 | 2006-01-17 | Microsoft Corporation | Auto playlist generation with multiple seed songs |
| AUPS270902A0 (en) * | 2002-05-31 | 2002-06-20 | Canon Kabushiki Kaisha | Robust detection and classification of objects in audio using limited training data |
| US20060080356A1 (en) * | 2004-10-13 | 2006-04-13 | Microsoft Corporation | System and method for inferring similarities between media objects |
| US7826708B2 (en) * | 2004-11-02 | 2010-11-02 | Microsoft Corporation | System and method for automatically customizing a buffered media stream |
-
2006
- 2006-09-01 WO PCT/IB2006/053057 patent/WO2007036817A1/en not_active Ceased
- 2006-09-01 EP EP06795862A patent/EP1932154B1/en not_active Not-in-force
- 2006-09-01 US US12/067,991 patent/US20080235267A1/en not_active Abandoned
- 2006-09-01 DE DE602006013666T patent/DE602006013666D1/de active Active
- 2006-09-01 JP JP2008532912A patent/JP2009510509A/ja active Pending
- 2006-09-01 CN CN2006800361319A patent/CN101278350B/zh not_active Expired - Fee Related
- 2006-09-01 ES ES06795862T patent/ES2344123T3/es active Active
- 2006-09-01 AT AT06795862T patent/ATE464642T1/de not_active IP Right Cessation
Also Published As
| Publication number | Publication date |
|---|---|
| WO2007036817A1 (en) | 2007-04-05 |
| EP1932154B1 (en) | 2010-04-14 |
| JP2009510509A (ja) | 2009-03-12 |
| EP1932154A1 (en) | 2008-06-18 |
| US20080235267A1 (en) | 2008-09-25 |
| ATE464642T1 (de) | 2010-04-15 |
| DE602006013666D1 (de) | 2010-05-27 |
| CN101278350A (zh) | 2008-10-01 |
| CN101278350B (zh) | 2011-05-18 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US7715934B2 (en) | Identification of input files using reference files associated with nodes of a sparse binary tree | |
| US7295977B2 (en) | Extracting classifying data in music from an audio bitstream | |
| Ramanathan et al. | An intelligent music player based on emotion recognition | |
| ES2976722T3 (es) | Verificación de locutores independientemente del texto en un sistema operativo multimedia usando aprendizaje profundo en formas de onda sin procesar | |
| ES2344123T3 (es) | Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. | |
| US11664015B2 (en) | Method for searching for contents having same voice as voice of target speaker, and apparatus for executing same | |
| Kamal et al. | A classification based approach to the prediction of song popularity | |
| Fiebrink et al. | Feature Selection Pitfalls and Music Classification. | |
| Jao et al. | Music annotation and retrieval using unlabeled exemplars: correlation and sparse codes | |
| Prétet et al. | Learning to rank music tracks using triplet loss | |
| Prashanthi et al. | Music genre categorization using machine learning algorithms | |
| JP2023501010A (ja) | TextRankに基づくアプリケーション選好テキストの分類方法 | |
| Abidin et al. | Local binary pattern with random forest for acoustic scene classification | |
| ES2391261T3 (es) | Método y aparato para recuperar información importante | |
| Varghese et al. | A novel video genre classification algorithm by keyframe relevance | |
| US10489450B1 (en) | Selecting soundtracks | |
| Poonia et al. | Music genre classification using machine learning: A comparative study | |
| KR101520572B1 (ko) | 음악에 대한 복합 의미 인식 방법 및 그 장치 | |
| Pathania et al. | Classification of music genre using machine learning | |
| Das et al. | Double coated vgg16 architecture: An enhanced approach for genre classification of spectrographic representation of musical pieces | |
| Wang et al. | Playing with tagging: A real-time tagging music player | |
| WO2023245026A1 (en) | Systems and methods for classifying music from heterogenous audio sources | |
| Li et al. | Guest editorial: special section on music data mining | |
| Agarwal et al. | Urban sound classification using machine learning and neural networks | |
| Pei et al. | Instrumentation analysis and identification of polyphonic music using beat-synchronous feature integration and fuzzy clustering |