ES2344123T3 - Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. - Google Patents

Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. Download PDF

Info

Publication number
ES2344123T3
ES2344123T3 ES06795862T ES06795862T ES2344123T3 ES 2344123 T3 ES2344123 T3 ES 2344123T3 ES 06795862 T ES06795862 T ES 06795862T ES 06795862 T ES06795862 T ES 06795862T ES 2344123 T3 ES2344123 T3 ES 2344123T3
Authority
ES
Spain
Prior art keywords
content
elements
source
candidate
candidate content
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Active
Application number
ES06795862T
Other languages
English (en)
Inventor
Javier F. Aprea
Aweke N. Lemma
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Koninklijke Philips NV
Original Assignee
Koninklijke Philips Electronics NV
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Koninklijke Philips Electronics NV filed Critical Koninklijke Philips Electronics NV
Application granted granted Critical
Publication of ES2344123T3 publication Critical patent/ES2344123T3/es
Active legal-status Critical Current
Anticipated expiration legal-status Critical

Links

Classifications

    • GPHYSICS
    • G11INFORMATION STORAGE
    • G11BINFORMATION STORAGE BASED ON RELATIVE MOVEMENT BETWEEN RECORD CARRIER AND TRANSDUCER
    • G11B27/00Editing; Indexing; Addressing; Timing or synchronising; Monitoring; Measuring tape travel
    • G11B27/10Indexing; Addressing; Timing or synchronising; Measuring tape travel
    • G11B27/19Indexing; Addressing; Timing or synchronising; Measuring tape travel by using information detectable on the record carrier
    • G11B27/28Indexing; Addressing; Timing or synchronising; Measuring tape travel by using information detectable on the record carrier by using information signals recorded by the same method as the main recording
    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/60Information retrieval; Database structures therefor; File system structures therefor of audio data
    • G06F16/63Querying
    • G06F16/632Query formulation
    • G06F16/634Query by example, e.g. query by humming
    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/60Information retrieval; Database structures therefor; File system structures therefor of audio data
    • G06F16/63Querying
    • G06F16/638Presentation of query results
    • G06F16/639Presentation of query results using playlists
    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/60Information retrieval; Database structures therefor; File system structures therefor of audio data
    • G06F16/68Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually
    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/60Information retrieval; Database structures therefor; File system structures therefor of audio data
    • G06F16/68Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually
    • G06F16/683Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually using metadata automatically derived from the content

Landscapes

  • Engineering & Computer Science (AREA)
  • Theoretical Computer Science (AREA)
  • Physics & Mathematics (AREA)
  • General Engineering & Computer Science (AREA)
  • Databases & Information Systems (AREA)
  • Data Mining & Analysis (AREA)
  • Multimedia (AREA)
  • General Physics & Mathematics (AREA)
  • Library & Information Science (AREA)
  • Mathematical Physics (AREA)
  • Management Or Editing Of Information On Record Carriers (AREA)
  • Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
  • Indexing, Searching, Synchronizing, And The Amount Of Synchronization Travel Of Record Carriers (AREA)
  • Automatic Analysis And Handling Materials Therefor (AREA)

Abstract

Procedimiento para generar de manera automática una lista de reproducción de elementos de contenido candidatos que tienen características similares a características de un elemento de contenido fuente, en el que el elemento de contenido fuente y/o los elementos de contenido candidatos comprenden múltiples características, siendo las múltiples características representativas de diferentes partes del elemento de contenido fuente y/o los elementos de contenido candidatos, comprendiendo el procedimiento las etapas de: comparar las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que son similares al elemento de contenido fuente; y añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato, y los elementos de contenido candidatos identificados que van a añadirse a la lista de reproducción comprenden al menos un elemento de contenido candidato que tiene la distancia más pequeña.

Description

Procedimiento y aparato para generar de manera automática una lista de reproducción mediante comparación por segmento de características.
Campo de la invención
La presente invención se refiere a un procedimiento y aparato para generar de manera automática una lista de reproducción de elementos de contenido, por ejemplo canciones. En particular, se refiere a la generación automática de lista de reproducción de elementos de contenido similares a un elemento de contenido fuente.
Antecedentes de la invención
Los dispositivos de consumo multimedia están en expansión en cuanto a potencia de procesamiento y pueden proporcionar a los usuarios características más avanzadas de exploración, navegación y recuperación de contenido multimedia. Se espera que, debido al aumento de las capacidades de almacenamiento y los anchos de banda de conexión, los consumidores tendrán acceso a bases de datos enormes de elementos de contenido. Por tanto, existe una demanda cada vez mayor para proporcionar sistemas de exploración, navegación y recuperación eficaces para ayudar al usuario.
Hay muchos sistemas conocidos para la recuperación de elementos de contenido y para la generación automática de listas de reproducción. Algunos de estos sistemas funcionan para seleccionar elementos de contenido a partir de una extensa base de datos basándose en su similitud con un determinado elemento de contenido fuente (o de referencia). En tales sistemas, todos los elementos de contenido almacenados en la base de datos se analizan previamente y sus características representativas se almacenan en una base de datos de metadatos. El usuario suministra un elemento de contenido fuente (que tiene una clasificación, asociada al mismo) y el sistema recupera entonces elementos de contenido similares comparando el grado de similitud entre las respectivas características representativas (o similitud entre las clasificaciones de los respectivos elementos de contenido). Sin embargo, estos sistemas conocidos no recuperan todos los elementos de contenido que el usuario consideraría similares al elemento de contenido fuente.
El documento US 5.918.223 da a conocer un sistema que realiza análisis y comparación de archivos de datos de audio basándose en el contenido de los archivos de datos. El análisis de los datos de audio produce un conjunto de valores números (un vector de características) que puede usarse para clasificar y ordenar la similitud entre archivos de audio individuales almacenados normalmente en una base de datos multimedia o en la World Wide Web. El análisis también facilita la descripción de clases de archivos de audio definidas por los usuarios, basándose en un análisis de un conjunto de archivos de audio que forman parte de una clase definida por los usuarios. El sistema puede encontrar sonidos dentro de un sonido más largo, permitiendo segmentar una grabación de audio de manera automática en una serie de segmentos de audio más cortos.
El documento US2002/0181711 A1 da a conocer un procedimiento y aparato informáticos para determinar similitud musical generando una firma agrupada de K medias (en vez de una gaussiana) y una firma de compás para cada pieza musical. El compás de la música se incluye en la posterior medición de distancia.
El documento US 2003/0183064 A1 da a conocer un sistema de reproducción secuencial configurado para seleccionar cada canción secuencial basándose en características de un segmento final de cada canción precedente. Las canciones se seleccionan basándose en las características del tema global de la selección, en caso de haberlo, y también basándose en una correspondencia musical entre canciones. La correspondencia puede basarse en el ritmo de cada canción, las notas y acordes de cada canción, y otras características musicales de las canciones. Se caracteriza el segmento final de cada canción seleccionada, y el primer segmento de una canción candidata que satisface los criterios de selección globales se compara con esta caracterización para determinar una correspondencia. Si el primer segmento de la canción candidata no concuerda con el segmento final de la canción seleccionada previamente, se encuentra otra canción candidata que satisfaga los criterios de selección globales, y el primer segmento de esta nueva canción candidata se compara con la caracterización. Este proceso continúa hasta que se identifica una canción candidata adecuada, o hasta que se supera un tiempo límite. Opcionalmente se proporcionan piezas de transición para facilitar una transición suave entre canciones.
Sumario de la invención
La presente invención pretende proporcionar un procedimiento que mejore la calidad percibida de la lista de reproducción generada.
Esto se consigue, según un aspecto de la presente invención, mediante un procedimiento para generar de manera automática una lista de reproducción de elementos de contenido candidatos que tienen características similares a características de un elemento de contenido fuente, comprendiendo el procedimiento las etapas de: comparar al menos una característica del elemento de contenido fuente con al menos una característica de los elementos de contenido candidatos para identificar elementos específicos de dichos elementos de contenido candidatos que sean similares al elemento de contenido fuente; y añadir los elementos de contenido candidatos identificados a la lista de reproducción, en el que la al menos una característica del elemento de contenido fuente y/o la al menos una característica de los elementos de contenido candidatos comprenden múltiples características, siendo las múltiples características representativas de diferentes partes del elemento de contenido fuente y/o los elementos de contenido candidatos. Las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos se comparan con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características. Durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato.
Esto se consigue también, según otro aspecto de la presente invención, mediante un aparato para generar de manera automática una lista de reproducción de elementos de contenido candidatos que tienen características similares a características de un elemento de contenido fuente, en el que el elemento de contenido fuente y/o los elementos de contenido candidatos comprenden múltiples características, siendo las múltiples características representativas de diferentes partes del elemento de contenido fuente y/o los elementos de contenido candidatos, comprendiendo el generador:
un comparador para comparar las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que sean similares al elemento de contenido fuente; y
un compilador para añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candi- dato.
\vskip1.000000\baselineskip
Por ejemplo, una pieza de composición de elemento de contenido de audio puede tener tres partes distintivas: clásica, voz y pop. Usando un clasificador conocido, esto se clasificaría estrictamente como uno de clásico, voz o pop. Como resultado, una lista de reproducción generada sólo podría contener canciones candidatas de esta única clase y/o sólo podría contener canciones candidatas cuya única clase sea similar a la clase de la canción fuente (por ejemplo una canción candidata con una parte de pop no puede incluirse para una canción fuente de clase pop si la canción candidata también tiene una parte de clásico y sólo se usa esta parte de clásico para comparar las dos canciones). Para superar esto, según una realización de la presente invención, se mantiene un registro, en el caso del ejemplo anterior, características de cada parte (tres conjuntos de características): un conjunto extraído de la parte de clásico, un conjunto de la parte de voz y un conjunto de la parte de pop y, en la base de datos, el contenido está asociado con los tres conjuntos de características. Esto significa que el clasificador clasificará una canción de este tipo como clásico, voz y pop. Por consiguiente, si el contenido del elemento de contenido varía en gran medida, estará representado por un número mayor de vectores de características que representarán de manera más precisa las características del contenido en oposición a los sistemas existentes que intentaría representar las características con un único vector de características. Esto da como resultado una lista de reproducción mejorada de elementos de contenido
similares.
Las características pueden ser una única característica, por ejemplo un valor que representa el tempo o una clasificación, o puede ser un vector de características. El procedimiento puede extraer la característica a partir de un elemento de contenido o de una etiqueta de metadatos o una entrada de base de datos asociada con el elemento de contenido.
En una realización preferida, cada uno de la pluralidad de elementos de contenido candidatos y el elemento de contenido fuente se segmentan en una pluralidad de tramas; y se extrae al menos un vector de características de cada trama para proporcionar los múltiples vectores de características del elemento de contenido.
La segmentación proporciona una etapa de preprocesamiento y el vector de características puede extraerse usando un clasificador existente. Por tanto, no se requiere ninguna modificación del clasificador.
\vskip1.000000\baselineskip
Breve descripción de los dibujos
Para una comprensión más completa de la presente invención, se hace referencia, a modo de ejemplo, a la siguiente descripción tomada junto con los dibujos adjuntos, en los que:
la figura 1 ilustra etapas del procedimiento según una primera realización de la presente invención;
la figura 2 ilustra las etapas del procedimiento según una segunda realización de la presente invención; y
la figura 3 ilustra gráficamente la distribución de los vectores de características extraídos según una tercera realización de la presente invención.
Descripción detallada de realizaciones preferidas
Con la finalidad de describir las realizaciones, sólo se describirá la extracción de vectores de características del contenido de audio del elemento de contenido. Sin embargo, puede apreciarse que el procedimiento podría aplicarse para la extracción de características del resto del contenido del elemento de contenido. El elemento de contenido puede comprender un archivo de contenidos multimedia analógico o digital, pistas musicales, canciones y similares.
El procedimiento según una primera realización se describirá ahora con referencia a la figura 1. El audio x entrante se segmenta en primer lugar en tramas x_{m} de longitud elegida de manera arbitraria, etapa 101. La longitud de las tramas puede tener la misma longitud predeterminada o puede variarse de manera aleatoria. Para cada segmento de audio (o trama) x_{m}, se extrae un vector de características usando técnicas conocidas, etapa 103 y se almacena en una base de datos de características, etapa 105.
Sea M \geq 1 el número de segmentos en el elemento de contenido candidato (canción) y K \geq 1 el número de segmentos en el elemento de contenido fuente (canción). Además, sea F_{s,k} y F_{j,m} los vectores de características correspondientes al k-ésimo y al m-ésimo segmento de las canciones fuente y candidata, respectivamente. Después, durante la generación de la lista de reproducción, la distancia D(F_{s}, F_{j}) entre la canción fuente segmentada (indicada por s) y la canción candidata segmentada (indicada por j) viene dada por
1
Pueden seleccionarse varias canciones candidatas que satisfacen los criterios de distancia predeterminados. Éstas pueden incluirse en la lista de reproducción con orden de distancia ascendente, por ejemplo. El usuario puede entonces seleccionar las (digamos 30) primeras coincidencias para crear la lista de reproducción. Alternativamente, puede predeterminarse un umbral máximo para D(F_{s}, F_{j}) y sólo se seleccionan para lista de reproducción aquellos elementos de contenido (canciones) que tienen distancias por debajo del umbral.
En la segunda realización, se consigue la segmentación comparando el cambio instantáneo en el vector de características. Un sencillo esquema de esta realización se muestra en la figura 2. Esto se consigue promediando de manera continua, etapa 205, el vector de características extraído en la etapa 201 hasta que el cambio instantáneo en las estadísticas de característica supera un determinado umbral T, en la etapa 203. Siempre que sucede esto, se ajusta un límite de segmentación, se reinicializa la memoria intermedia de promediado 207 y se escribe el vector de características del segmento en la base de datos de características, etapa 209. Este procedimiento se repite hasta que se alcanza el final de la canción. La ventaja de este enfoque es que proporciona un mejor equilibrio entre el número de características por canción y la representatividad de las características. El cambio instantáneo puede calcularse de diversas formas. Algunos ejemplos de cambio instantáneo son un cambio en la media local, monitorización del desvío, etc.
De nuevo, tal como se describió con referencia a la primera realización, pueden seleccionarse varias canciones candidatas que satisfagan criterios de distancia predeterminados para generar la lista de reproducción.
En una tercera realización, se extraen vectores de características y se determinan vectores de características representativos analizando la distribución de los vectores. Un sencillo ejemplo de una distribución de este tipo se muestra en la figura 3.
En este caso, las características F1, F2 y F3 se consideran representativas. De este modo no se requiere una segmentación de las canciones. El procedimiento según esta realización simplemente mira las estadísticas y toma los máximos locales como características representativas. Si hay varios máximos locales, se extraen múltiples características representativas. Si sólo hay un máximo, entonces la canción sólo tendrá una característica representativa.
De nuevo, tal como se describió con referencia a la primera realización, pueden seleccionarse varias canciones candidatas que satisfacen criterios de distancia predeterminados para generar la lista de reproducción. Como resultado, en este procedimiento puede obtenerse una aleatorización de la lista de reproducción eligiendo de manera aleatoria a partir de las características representativas. De este modo puede conseguirse una lista de reproducción aleatorizada más precisa (sin ruido).
Aunque las realizaciones preferidas de la presente invención se han ilustrado en los dibujos adjuntos y se han descrito en la descripción detallada anterior, se entenderá que la invención no está limitada a las realizaciones dadas a conocer, sino que son posibles numerosas modificaciones sin alejarse del alcance de la invención según se expone en las siguientes reivindicaciones.

Claims (8)

1. Procedimiento para generar de manera automática una lista de reproducción de elementos de contenido candidatos que tienen características similares a características de un elemento de contenido fuente, en el que el elemento de contenido fuente y/o los elementos de contenido candidatos comprenden múltiples características, siendo las múltiples características representativas de diferentes partes del elemento de contenido fuente y/o los elementos de contenido candidatos, comprendiendo el procedimiento las etapas de:
comparar las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que son similares al elemento de contenido fuente; y
añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato, y los elementos de contenido candidatos identificados que van a añadirse a la lista de reproducción comprenden al menos un elemento de contenido candidato que tiene la distancia más pequeña.
2. Procedimiento según la reivindicación 1, que comprende además las etapas de:
segmentar cada uno de la pluralidad de elementos de contenido candidatos y/o el elemento de contenido fuente en una pluralidad de tramas (101);
extraer al menos una característica de cada trama para proporcionar las múltiples características del elemento (102) de contenido.
3. Procedimiento según la reivindicación 2, en el que las tramas tienen una longitud predeterminada.
4. Procedimiento según la reivindicación 3, en el que cada trama tiene la misma longitud.
5. Procedimiento según la reivindicación 2, en el que la segmentación se basa en el contenido de los elementos de contenido candidatos y/o el elemento de contenido fuente.
6. Procedimiento según la reivindicación 2, en el que los límites de dicha pluralidad de tramas se determina mediante los cambios instantáneos en las características de dichos elementos de contenido candidatos y/o el elemento de contenido fuente.
7. Aparato para generar de manera automática una lista de reproducción de elementos de contenido candidatos que tienen características similares a características de un elemento de contenido fuente, en el que el elemento de contenido fuente y/o los elementos de contenido candidatos comprenden múltiples características, siendo las múltiples características representativas de diferentes partes del elemento de contenido fuente y/o los elementos de contenido candidatos, comprendiendo el generador:
un comparador para compara las múltiples características del elemento de contenido fuente y/o de los elementos de contenido candidatos con al menos una característica del elemento de contenido fuente o de los elementos de contenido candidatos determinando las distancias entre las características, para identificar elementos específicos de dichos elementos de contenido candidatos que sean similares al elemento de contenido fuente; y
un compilador para añadir los elementos de contenido candidatos identificados a la lista de reproducción, caracterizado porque durante la generación de la lista de reproducción, la distancia entre el elemento de contenido fuente y cualquiera de los elementos de contenido candidatos viene dada por el valor más pequeño de las distancias determinadas para dicho par de elemento de contenido fuente-elemento de contenido candidato, y los elementos de contenido candidatos identificados que van a añadirse a la lista de reproducción comprenden al menos un elemento de contenido candidato que tiene la distancia más pequeña.
8. Producto de programa informático que comprende una pluralidad de partes de código de programa para llevar a cabo el procedimiento según una cualquiera de las reivindicaciones 1 a 6.
ES06795862T 2005-09-29 2006-09-01 Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas. Active ES2344123T3 (es)

Applications Claiming Priority (2)

Application Number Priority Date Filing Date Title
EP05109015 2005-09-29
EP05109015 2005-09-29

Publications (1)

Publication Number Publication Date
ES2344123T3 true ES2344123T3 (es) 2010-08-18

Family

ID=37719136

Family Applications (1)

Application Number Title Priority Date Filing Date
ES06795862T Active ES2344123T3 (es) 2005-09-29 2006-09-01 Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas.

Country Status (8)

Country Link
US (1) US20080235267A1 (es)
EP (1) EP1932154B1 (es)
JP (1) JP2009510509A (es)
CN (1) CN101278350B (es)
AT (1) ATE464642T1 (es)
DE (1) DE602006013666D1 (es)
ES (1) ES2344123T3 (es)
WO (1) WO2007036817A1 (es)

Families Citing this family (9)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US8914384B2 (en) * 2008-09-08 2014-12-16 Apple Inc. System and method for playlist generation based on similarity data
US20110225496A1 (en) * 2010-03-12 2011-09-15 Peter Jeffe Suggested playlist
US20150242750A1 (en) * 2014-02-24 2015-08-27 Google Inc. Asymmetric Rankers for Vector-Based Recommendation
US9978374B2 (en) 2015-09-04 2018-05-22 Google Llc Neural networks for speaker verification
US11328010B2 (en) * 2017-05-25 2022-05-10 Microsoft Technology Licensing, Llc Song similarity determination
CA3082744A1 (en) * 2017-12-09 2019-06-13 Shubhangi Mahadeo Jadhav System and method for recommending visual-map based playlists
EP3716262B1 (en) * 2018-10-19 2025-09-17 Sony Group Corporation Information processing device, information processing method, and information processing program
US11574248B2 (en) 2020-04-02 2023-02-07 Rovi Guides, Inc. Systems and methods for automated content curation using signature analysis
US11238287B2 (en) * 2020-04-02 2022-02-01 Rovi Guides, Inc. Systems and methods for automated content curation using signature analysis

Family Cites Families (27)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US621673A (en) * 1899-03-21 Clipper
JPH0430382A (ja) * 1990-05-24 1992-02-03 Mazda Motor Corp 車両用音響装置
US5283819A (en) * 1991-04-25 1994-02-01 Compuadd Corporation Computing and multimedia entertainment system
AU4279893A (en) * 1992-04-10 1993-11-18 Avid Technology, Inc. A method and apparatus for representing and editing multimedia compositions
US5437050A (en) * 1992-11-09 1995-07-25 Lamb; Robert G. Method and apparatus for recognizing broadcast information using multi-frequency magnitude detection
JPH07219970A (ja) * 1993-12-20 1995-08-18 Xerox Corp 加速フォーマットでの再生方法及び再生装置
US5701452A (en) * 1995-04-20 1997-12-23 Ncr Corporation Computer generated structure
US5918223A (en) 1996-07-22 1999-06-29 Muscle Fish Method and article of manufacture for content-based analysis, storage, retrieval, and segmentation of audio information
JPH10134549A (ja) * 1996-10-30 1998-05-22 Nippon Columbia Co Ltd 楽曲検索装置
US6819863B2 (en) * 1998-01-13 2004-11-16 Koninklijke Philips Electronics N.V. System and method for locating program boundaries and commercial boundaries using audio categories
US6216173B1 (en) * 1998-02-03 2001-04-10 Redbox Technologies Limited Method and apparatus for content processing and routing
JP3964979B2 (ja) * 1998-03-18 2007-08-22 株式会社ビデオリサーチ 楽曲識別方法及び楽曲識別システム
US6845398B1 (en) * 1999-08-02 2005-01-18 Lucent Technologies Inc. Wireless multimedia player
US8326584B1 (en) * 1999-09-14 2012-12-04 Gracenote, Inc. Music searching methods based on human perception
US6901362B1 (en) * 2000-04-19 2005-05-31 Microsoft Corporation Audio segmentation and classification
US6910035B2 (en) * 2000-07-06 2005-06-21 Microsoft Corporation System and methods for providing automatic classification of media entities according to consonance properties
US7065416B2 (en) * 2001-08-29 2006-06-20 Microsoft Corporation System and methods for providing automatic classification of media entities according to melodic movement properties
US7031980B2 (en) 2000-11-02 2006-04-18 Hewlett-Packard Development Company, L.P. Music similarity function based on signal analysis
JP2002175685A (ja) * 2000-12-06 2002-06-21 Alpine Electronics Inc オーディオシステム
US7432940B2 (en) * 2001-10-12 2008-10-07 Canon Kabushiki Kaisha Interactive animation of sprites in a video production
US6785645B2 (en) * 2001-11-29 2004-08-31 Microsoft Corporation Real-time speech and music classifier
US6933432B2 (en) * 2002-03-28 2005-08-23 Koninklijke Philips Electronics N.V. Media player with “DJ” mode
JP4228581B2 (ja) * 2002-04-09 2009-02-25 ソニー株式会社 オーディオ機器、オーディオデータの管理方法及びそのためのプログラム
US6987221B2 (en) * 2002-05-30 2006-01-17 Microsoft Corporation Auto playlist generation with multiple seed songs
AUPS270902A0 (en) * 2002-05-31 2002-06-20 Canon Kabushiki Kaisha Robust detection and classification of objects in audio using limited training data
US20060080356A1 (en) * 2004-10-13 2006-04-13 Microsoft Corporation System and method for inferring similarities between media objects
US7826708B2 (en) * 2004-11-02 2010-11-02 Microsoft Corporation System and method for automatically customizing a buffered media stream

Also Published As

Publication number Publication date
WO2007036817A1 (en) 2007-04-05
EP1932154B1 (en) 2010-04-14
JP2009510509A (ja) 2009-03-12
EP1932154A1 (en) 2008-06-18
US20080235267A1 (en) 2008-09-25
ATE464642T1 (de) 2010-04-15
DE602006013666D1 (de) 2010-05-27
CN101278350A (zh) 2008-10-01
CN101278350B (zh) 2011-05-18

Similar Documents

Publication Publication Date Title
US7715934B2 (en) Identification of input files using reference files associated with nodes of a sparse binary tree
US7295977B2 (en) Extracting classifying data in music from an audio bitstream
Ramanathan et al. An intelligent music player based on emotion recognition
ES2976722T3 (es) Verificación de locutores independientemente del texto en un sistema operativo multimedia usando aprendizaje profundo en formas de onda sin procesar
ES2344123T3 (es) Procedimiento y aparato para generar de manera automatica una lista de reproduccion mediante comparacion por segmento de caracteristicas.
US11664015B2 (en) Method for searching for contents having same voice as voice of target speaker, and apparatus for executing same
Kamal et al. A classification based approach to the prediction of song popularity
Fiebrink et al. Feature Selection Pitfalls and Music Classification.
Jao et al. Music annotation and retrieval using unlabeled exemplars: correlation and sparse codes
Prétet et al. Learning to rank music tracks using triplet loss
Prashanthi et al. Music genre categorization using machine learning algorithms
JP2023501010A (ja) TextRankに基づくアプリケーション選好テキストの分類方法
Abidin et al. Local binary pattern with random forest for acoustic scene classification
ES2391261T3 (es) Método y aparato para recuperar información importante
Varghese et al. A novel video genre classification algorithm by keyframe relevance
US10489450B1 (en) Selecting soundtracks
Poonia et al. Music genre classification using machine learning: A comparative study
KR101520572B1 (ko) 음악에 대한 복합 의미 인식 방법 및 그 장치
Pathania et al. Classification of music genre using machine learning
Das et al. Double coated vgg16 architecture: An enhanced approach for genre classification of spectrographic representation of musical pieces
Wang et al. Playing with tagging: A real-time tagging music player
WO2023245026A1 (en) Systems and methods for classifying music from heterogenous audio sources
Li et al. Guest editorial: special section on music data mining
Agarwal et al. Urban sound classification using machine learning and neural networks
Pei et al. Instrumentation analysis and identification of polyphonic music using beat-synchronous feature integration and fuzzy clustering