BRPI0112901B1 - métodos para reconhecer uma amostra de áudio, e, sistema de computador para realizar o mesmo - Google Patents

métodos para reconhecer uma amostra de áudio, e, sistema de computador para realizar o mesmo Download PDF

Info

Publication number
BRPI0112901B1
BRPI0112901B1 BRPI0112901A BR0112901A BRPI0112901B1 BR PI0112901 B1 BRPI0112901 B1 BR PI0112901B1 BR PI0112901 A BRPI0112901 A BR PI0112901A BR 0112901 A BR0112901 A BR 0112901A BR PI0112901 B1 BRPI0112901 B1 BR PI0112901B1
Authority
BR
Brazil
Prior art keywords
fingerprint
file
sample
fingerprints
sound
Prior art date
Application number
BRPI0112901A
Other languages
English (en)
Other versions
BR0112901A (pt
Inventor
Avery Li-Chun Wang
Julius O Smith Iii
Original Assignee
Landmark Digital Services Llc
Shazam Entertainment Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Landmark Digital Services Llc, Shazam Entertainment Ltd filed Critical Landmark Digital Services Llc
Publication of BR0112901A publication Critical patent/BR0112901A/pt
Publication of BRPI0112901B1 publication Critical patent/BRPI0112901B1/pt

Links

Classifications

    • GPHYSICS
    • G11INFORMATION STORAGE
    • G11BINFORMATION STORAGE BASED ON RELATIVE MOVEMENT BETWEEN RECORD CARRIER AND TRANSDUCER
    • G11B20/00Signal processing not specific to the method of recording or reproducing; Circuits therefor
    • G11B20/10Digital recording or reproducing
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L19/00Speech or audio signals analysis-synthesis techniques for redundancy reduction, e.g. in vocoders; Coding or decoding of speech or audio signals, using source filter models or psychoacoustic analysis
    • G10L19/018Audio watermarking, i.e. embedding inaudible data in the audio signal
    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/60Information retrieval; Database structures therefor; File system structures therefor of audio data
    • G06F16/63Querying
    • G06F16/632Query formulation
    • G06F16/634Query by example, e.g. query by humming
    • GPHYSICS
    • G06COMPUTING OR CALCULATING; COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/60Information retrieval; Database structures therefor; File system structures therefor of audio data
    • G06F16/68Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually
    • G06F16/683Retrieval characterised by using metadata, e.g. metadata not derived from the content or metadata generated manually using metadata automatically derived from the content
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/26Speech to text systems
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L17/00Speaker identification or verification techniques
    • G10L17/26Recognition of special voice characteristics, e.g. for use in lie detectors; Recognition of animal voices
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L25/00Speech or voice analysis techniques not restricted to a single one of groups G10L15/00 - G10L21/00
    • G10L25/48Speech or voice analysis techniques not restricted to a single one of groups G10L15/00 - G10L21/00 specially adapted for particular use
    • G10L25/51Speech or voice analysis techniques not restricted to a single one of groups G10L15/00 - G10L21/00 specially adapted for particular use for comparison or discrimination
    • G10L25/54Speech or voice analysis techniques not restricted to a single one of groups G10L15/00 - G10L21/00 specially adapted for particular use for comparison or discrimination for retrieval
    • GPHYSICS
    • G11INFORMATION STORAGE
    • G11BINFORMATION STORAGE BASED ON RELATIVE MOVEMENT BETWEEN RECORD CARRIER AND TRANSDUCER
    • G11B27/00Editing; Indexing; Addressing; Timing or synchronising; Monitoring; Measuring tape travel
    • G11B27/10Indexing; Addressing; Timing or synchronising; Measuring tape travel
    • G11B27/19Indexing; Addressing; Timing or synchronising; Measuring tape travel by using information detectable on the record carrier
    • G11B27/28Indexing; Addressing; Timing or synchronising; Measuring tape travel by using information detectable on the record carrier by using information signals recorded by the same method as the main recording

Landscapes

  • Engineering & Computer Science (AREA)
  • Physics & Mathematics (AREA)
  • Multimedia (AREA)
  • Theoretical Computer Science (AREA)
  • Health & Medical Sciences (AREA)
  • Audiology, Speech & Language Pathology (AREA)
  • Human Computer Interaction (AREA)
  • Acoustics & Sound (AREA)
  • Computational Linguistics (AREA)
  • Data Mining & Analysis (AREA)
  • Databases & Information Systems (AREA)
  • General Engineering & Computer Science (AREA)
  • General Physics & Mathematics (AREA)
  • Library & Information Science (AREA)
  • Signal Processing (AREA)
  • Mathematical Physics (AREA)
  • Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
  • Soundproofing, Sound Blocking, And Sound Damping (AREA)
  • Electrophonic Musical Instruments (AREA)
  • Tone Control, Compression And Expansion, Limiting Amplitude (AREA)
  • Two-Way Televisions, Distribution Of Moving Picture Or The Like (AREA)
  • Management Or Editing Of Information On Record Carriers (AREA)

Abstract

"métodos de comparar uma amostra de mídia e de áudio e um arquivo de mídia e de áudio, de caracterizar uma amostra de áudio, de reconhecer uma amostra de mídia e de criar um índice de base de dados de pelo menos um arquivo de áudio em uma base de dados, dispositivo de armazenamento de programa acessível por um computador e sistema de reconhecimento de uma amostra de mídia". um método de reconhecimento de uma amostra de áudio localiza um arquivo de áudio que coincide de forma mais próxima com a amostra de áudio de uma base de dados indexando um conjunto grande de gravações originais. cada arquivo de áudio indexado é representado no índice de base de dados por um conjunto de pontos de tempo de marco e impressões digitais associadas. os marcos ocorrem em locais reproduzíveis dentro do arquivo, enquanto que as impressões digitais representam as características do sinal em ou perto dos pontos de tempo do marco. para realizar o reconhecimento, os marcos e as impressões digitais são computadas para a amostra desconhecida e utilizados para recuperar impressões digitais coincidentes da base de dados. para cada arquivo contendo impressões digitais coincidentes, os marcos são comparados com os marcos da amostra nos quais as mesmas impressões digitais foram computadas. se um grande número de marcos correspondentes forem relacionados de forma linear, isso é, se as impressões digitais equivalentes da amostra e arquivo recuperado possuírem a mesma evolução no tempo, então o arquivo é identificado com a amostra. o método pode ser utilizado para qualquer tipo de som ou música, e é particularmente efetivo para sinais de áudio sujeitos a distorção linear e não linear tal como ruido de fundo, artefatos de compressão, ou interrupções de transmissão. a amostra pode ser identificada em um momento proporcional ao logaritmo do número de registros na base de dados; de acordo com a energia computacional suficiente, o reconhecimento pode ser realizado quase que em tempo real à medida que o som está sendo amostrado.

Description

“MÉTODO PARA RECONHECER UMA AMOSTRA DE ÁUDIO, E, SISTEMA DE COMPUTADOR PARA REALIZAR O MESMO” CAMPO DA INVENÇÃO A presente invenção diz, em geral, a respeito de recuperação de informação com base em conteúdo. Mais particularmente, a presente invenção diz respeito a reconhecimento de um sinal de áudio, incluindo som ou música, o qual seja altamente distorcido ou contém um alto nível de ruído.
FUNDAMENTOS DA TÉCNICA Há uma necessidade crescente por reconhecimento automático de música ou de outros sinais de áudio gerados a partir de uma variedade de fontes. Por exemplo, donos de obras protegidas pela lei de direito autoral ou anunciantes estão interessados em obter dados na frequência de difusão de seu material. Serviços de rastreamento de músicas fornecem listas de reprodução das maiores estações de rádio nos grandes mercados. Consumidores gostariam de identificar músicas ou propagandas difundidas no rádio, de tal maneira que eles pudessem comprar produtos musicais ou outros produtos e serviços novos e interessantes. Qualquer espécie de reconhecimento de som sob demanda ou contínuo é ineficiente e trabalhoso quando é realizado por seres humanos. Um método automatizado de reconhecimento de música ou som fornecería, desse modo, um benefício significativo aos consumidores, artistas e a uma variedade de indústrias. À medida que o paradigma de distribuição de músicas muda de compras em lojas para tê-las baixadas através da Internet, é perfeitamente viável ligar o reconhecimento de música implementado por computador diretamente com a compra pela Internet ou outros serviços à base da Internet.
Tradicionalmente, reconhecimento de músicas tocadas na rádio era realizado pela coincidência de estações de rádio e de horários nos quais as músicas eram tocadas com listas de reprodução providas ou pelas estações de rádio ou a partir de fontes de terceiros. Tal método é limitado inerentemente a apenas as estações de rádio para as quais a informação encontra-se disponível.
Outros métodos baseiam-se no embutimento de códigos inaudíveis dentro dos sinais radiodifimdidos. Os sinais embutidos são decodificados no receptor para extrair informação de identificação sobre o sinal radiodifundido. A desvantagem deste método é que os dispositivos de decodificação especiais são necessários para identificação de sinais, e apenas aquelas músicas com códigos embutidos podem ser identificadas.
Qualquer reconhecimento de áudio em larga escala exige algum tipo de recuperação de áudio com base em conteúdo, na qual um sinal radiodifundido não identificado é comparado com uma base de dados de tais sinais conhecidos para identificar os sinais da base de dados similares ou idênticos. Notar que a recuperação de áudio com base em conteúdo é diferente de uma recuperação de áudio existente pelos mecanismos de busca na rede, nos quais apenas o texto de metadados cercando ou associado com os arquivos de áudio é buscado. Além disso, vale notar que enquanto reconhecimento de fala é útil para a conversão de sinais de voz em texto que pode, a seguir, ser indexado e buscado usando técnicas bem conhecidas, não é aplicável à grande maioria de sinais de áudio que contêm músicas e sons. De alguma forma, recuperação da informação de áudio é análoga à recuperação de informação com base em texto provida pelos mecanismos de busca. De outra forma, contudo, reconhecimento de áudio não é análogo: sinais de áudio não apresentam entidades facilmente identificáveis, tais como palavras que fornecem identificadores para a busca e indexação. Como tal, esquemas de recuperação de áudio corrente indexam os sinais de áudio por características de percepção computadas que representam várias qualidades ou características do sinal.
Uma recuperação de áudio com base em conteúdo é tipicamente efetuada analisando-se um sinal de consulta “query” para obter um número de características representativas, e posteriormente, aplicando-se uma medida de similaridade com as características derivadas para a localização dos arquivos de base de dados que são mais similares ao referido sinal de consulta “query”. A similaridade dos objetos recebidos é necessariamente um reflexo daquelas características de percepção selecionadas. Numerosos métodos de recuperação com base em conteúdo estão disponíveis na técnica. Por exemplo, patente US No. 5.210.820, expedida para Kenyon, revela um método de reconhecimento de sinal, no qual sinais recebidos são processados e amostrados para se obter valores de sinal em cada ponto de amostragem. Os momentos estatísticos dos valores amostrados são então computados para gerar um vetor de característica que pode ser comparado com os identificadores dos sinais armazenados para recuperar sinais similares. As patentes US Nos. 4.450.531 e 4.843.562, ambas expedidas para Kenyon et al., revelam métodos de classificação de informação radiodifundida similares, em que correlações cruzadas são computadas entre os sinais não identificados e os sinais de referência armazenados.
Um sistema para a recuperação de documentos de áudio pela similaridade acústica é descrito em J. T. Foote, “Content-Based Retrieval of Music and Audio”, em C.-C. J. Kuo et al., editor, Multimedia Storage and Archiving Systems II, Proc. ofSPIE, volume 3.229, páginas 138 a 147, 1997. Vetores de característica são calculados por parametrização de cada arquivo de áudio em coeficientes “cepstral” de escala “mel”, e uma árvore de quantização é criada a partir dos dados de parametrização. Para realizar uma consulta, um sinal desconhecido é parametrizado para se obter vetores de característica que são então ordenadas em nós de folha da árvore. Um histograma é coletado para cada nó de folha, gerando assim um vetor N-dimensional que representa o sinal desconhecido. A distância entre dois destes vetores é indicativa da similaridade entre dois arquivos de som. No método em questão, o esquema de quantização supervisionado aprende a distinguir características de áudio, enquanto ignorando variações não importantes, com base em classes às quais os dados de treinamento estão designados por um ser humano. Dependendo do sistema de classificação, diferentes características acústicas são escolhidas como importantes. Assim, tal método é mais adequado para encontrar similaridades entre músicas e ordenar músicas em classes do que ele é para reconhecer música.
Um método para a análise, armazenamento, recuperação, bem como segmentação, com base em conteúdo, de informação de áudio é descrito na patente US No. 5.918.223, expedida para Blum et al. Nesse método, uma série de características acústicas, tais como sonoridade, grave, passo, brilho, largura de banda, e coeficientes “cepstral” de frequência “Mel”, são medidos em intervalos de tempo periódicos de cada arquivo. As medições estatísticas daquelas características são recolhidas e combinadas para formar um vetor de característica. Os arquivos de dados de áudio dentro de uma base de dados são recuperados com base na similaridade de seus vetores de característica para o vetor de característica de um arquivo não identificado.
Um problema ‘chave’ de todos os métodos de reconhecimento de áudio acima da técnica anterior é que os mesmos tendem a falhar quando os sinais a serem reconhecidos são sujeitos a distorção linear e não linear causadas por, por exemplo, ruído de fundo, erros e quedas de transmissão, interferência, filtragem limitada de banda, quantização, deformação no tempo, e compressão digital de qualidade de voz. Naqueles métodos da técnica anterior, quando uma amostra de som distorcida é processada para se obter características acústicas, só uma fração das características derivadas para a gravação original são achadas. O vetor de característica resultante é, portanto, não muito similar ao vetor de característica da gravação original, e é improvável que reconhecimento correto possa ser realizado. Continua a permanecer uma necessidade de um sistema de reconhecimento de som que se comporte bem sob condições de ruído e distorção elevados.
Um outro problema com os métodos da técnica anterior é que os mesmos exigem muita computação e não escalonam bem. Reconhecimento em tempo real é, desta maneira, não possível utilizando os métodos da técnica anterior com bases de dados enormes. Em tais sistemas, é inviável se ter uma base de dados que possua mais de poucas centenas ou milhares de gravações. O tempo de busca nos métodos da técnica anterior tendem a crescer de forma linear com o tamanho da base de dados, tomando o escalonamento de milhões de gravações de músicas economicamente inviável. Tais métodos de Kenyon também necessitam de grandes bancos de hardware de processamento de sinal digital especializados. Métodos comerciais existentes têm frequentemente exigências rígidas para a amostra de entrada, para que a mesma seja capaz de executar o reconhecimento. Por exemplo, eles exigem que a música inteira ou pelo menos 30 segundos da música sejam amostrados ou, ainda, exigem que a música seja amostrada desde o início. Eles também apresentam dificuldade em reconhecer múltiplas músicas misturadas uma com a outra em uma única corrente. Todas essas desvantagens tomam os métodos da técnica anterior inviáveis para uso em muitas aplicações práticas.
OBJETIVOS E VANTAGENS
Por conseguinte, é um objetivo principal da presente invenção o de fornecer um método de reconhecimento de um sinal de áudio sujeito a um alto nível de mído e distorção. É um objetivo adicional da invenção o de fornecer um método de reconhecimento que possa ser realizado em tempo real com base em apenas uns poucos segundos do sinal a ser identificado. É um outro objetivo da invenção o de fornecer um método de reconhecimento que possa reconhecer músicas com base em amostras de quase qualquer lugar dentro da música, não apenas do começo. É um objetivo adicional da invenção o de fornecer um método de reconhecimento que não requeira que amostras de música sejam codificadas ou correlacionadas com listas de música ou estações de rádio em particular. É um objetivo adicional da invenção o de fornecer um método de reconhecimento que possa reconhecer cada uma das múltiplas gravações de música misturadas uma com a outra em uma única corrente. É um outro objetivo da invenção o de fornecer um sistema de reconhecimento de música no qual a música desconhecida possa ser fornecida para o sistema a partir de qualquer ambiente por qualquer método virtualmente conhecido.
SUMÁRIO
Esses objetivos e vantagens são alcançados por um método de reconhecimento de uma amostra de mídia, tal como uma amostra de áudio, de acordo com um índice de base de dados de um grande número de arquivos de mídia conhecidos.Tal índice de base de dados contém impressões digitais que representam características em localizações particulares dos arquivos de mídia indexados. A amostra de mídia desconhecida é identificada com uni arquivo de mídia na base de dados (o arquivo de mídia vencedor), cujas localizações relativas de impressões digitais mais próximas coincidem com as localizações relativas das impressões digitais da amostra, No caso de arquivos de áudio, a evolução no tempo de impressões digitais do arquivo vencedor coincide com a evolução no tempo das impressões digitais na amostra. O método é preferencialmente implementado num sistema de computador distribuído e contém as seguintes etapas; determinar um conjunto de impressões digitais em localizações particulares da amostra; localizar as referidas impressões digitais que coincidem no índice de base de dados; gerar correspondências entre as localizações na amostra e as localizações no arquivo possuindo impressões digitais equivalentes; e identificar arquivos de mídia para os quais um número significativo das correspondências são substancialmente relacionadas ünearmenie. O arquivo tendo o maior número de correspondências relacionadas linearmcnte é tido como o arquivo dc mídia vencedor. Um método de identificação de arquivos com um grande número de correspondências é o de realizar o equivalente à varredura para uma linha diagonal no diagrama de dispersão gerado a partir dos pares de correspondências. Numa modalidade, a identificação dos arquivos de mídia com um grande número de correspondências lineares envolve a busca de apenas um primeiro subconjunto dos arquivos de mídia. Os arquivos no primeiro subconjunto têm uma probabilidade maior de serem identificados do que os arquivos que não estão no primeiro subconjunto. A probabilidade de identificação é preferencialmente baseada em frequência empírica ou medidas de recência de identificações anteriores, juntamente com projeções a priori de frequência de identificação. Se nenhum arquivo de mídia for identificado no primeiro subconjunto, então o segundo subconjunto, o qual contém o resto dos arquivos, é buscado. Altemativamente, os arquivos podem ser classificados por probabilidade e buscados na ordem da classificação. Tal busca é encerrada quando um arquivo é localizado.
De preferência, as localizações particulares dentro das amostras são computadas de maneira a serem reproduzíveis na dependência da amostra. Tais localizações computáveis reproduzivelmente são chamadas de “marcos”. As ditas impressões digitais são, preferencialmente, valores numéricos. Numa modalidade, cada impressão digital representa um número de características da amostra de mídia em cada localização, ou desviam ligeiramente da localização. O método é, particularmente, útil para reconhecer amostras de áudio, em cujo o caso as localizações particulares são pontos de tempo dentro da amostra de áudio. Tais pontos de tempo ocorrem, por exemplo, na máxima local de normas Lp espectrais da amostra de áudio. Impressões digitais podem ser computadas por qualquer análise da amostra de áudio, e são, de preferência, invariáveis a prolongamento de tempo da amostra. Os exemplos de impressões digitais incluem impressões digitais de fatia espectral, impressões digitais de múltiplas fatias, coeficientes LPC, coeficientes “cepstral”, e componentes de frequência de picos de espectrograma. A presente invenção também provê um sistema para implementar o método acima, contendo um: objeto de marco para computar as localizações particulares, objeto de impressão digital para computar as impressões digitais, índice de base de dados que contém as localizações do arquivo e as impressões digitais para os arquivos de mídia, e objeto de análise. O dito objeto de análise implementa o método ao localizar impressões digitais coincidentes no índice de base de dados, gerar correspondências, e analisar as correspondências para selecionar o arquivo de mídia vencedor.
Também está fornecido um dispositivo de armazenamento de programa acessível por um computador, consubstanciando, de modo tangível, um programa de instruções executáveis pelo computador para realizar etapas do método para o método acima.
Adicionalmente, a invenção provê um método de criação de um índice de um número de arquivos de áudio em uma base de dados, contendo as seguintes etapas: computar um conjunto de impressões digitais em localizações particulares de cada arquivo; e armazenar as impressões digitais, localizações e identificadores dos arquivos em uma memória. Uma impressão digital, uma localização, e um identificador correspondentes estão associados na memória na forma de uma tríplice. Preferencialmente, as localizações, que podem ser pontos de tempo dentro do arquivo de áudio, são computadas na dependência do arquivo e são reproduzíveis. Por exemplo, aqueles pontos de tempo podem ocorrer numa máxima local de normas Lp espectrais do arquivo de áudio. Em alguns casos, cada impressão digital, que é de preferência um valor numérico, representa um número de características daquele arquivo perto da localização particular. As impressões digitais podem ser computadas a partir de qualquer análise ou processamento de sinal digital do arquivo de áudio. Exemplos das impressões digitais incluem impressões digitais de fatia espectral, impressões digitais de múltiplas fatias, coeficientes LPC, coeficientes “cepstral”, como também os componentes de frequência de picos de espectrograma, e os picos de espectrograma conectados.
Finalmente, a invenção propicia métodos para identificação de amostras de áudio incorporando impressões digitais invariáveis a prolongamento de tempo e várias buscas hierárquicas.
BREVE DESCRIÇÃO DAS FIGURAS
Figura 1 é um fluxograma de um método da invenção para o reconhecimento de uma amostra de som;
Figura 2 é um diagrama de bloco de um sistema de computador distribuído exemplar para implementar o método da Figura 1;
Figura 3 é um fluxograma de um método de construção de um índice de base de dados de arquivos de som utilizado no método da Figura 1;
Figura 4 ilustra, de maneira esquemática, marcos e impressões digitais computados para uma amostra de som;
Figura 5 é um gráfico de normas L4 para uma amostra de som, ilustrando a seleção de marcos;
Figura 6 é um fluxograma de uma modalidade alternativa para construir um índice de base de dados de arquivos de som utilizados no método da Figura 1;
Figuras 7A, 7B e 7C ilustram um espectrograma com pontos salientes e pontos salientes conectados indicados;
Figuras 8A, 8B e 8C ilustram conjuntos de índice, uma lista de índice, e uma lista de índice principal do método da Figura 3;
Figuras 9A, 9B e 9C ilustram uma lista de índice, uma lista de candidatos, uma lista de dispersão do método da Figura 1;
Figuras 10A e 10B são diagramas de dispersão que ilustram a identificação correta e falta de identificação, respectivamente, de uma amostra de som desconhecida.
DESCRIÇÃO DETALHADA A presente invenção fornece um método para reconhecimento de uma amostra de mídia exógena, de acordo com uma base de dados contendo um grande número de arquivos de mídia conhecidos. Ela também fornece um método para gerar um índice de base de dados, que possibilita a busca eficiente utilizando o método de reconhecimento da invenção. Enquanto que a discussão a seguir se refere, basicamente, a dados de áudio, deve-se compreender que o método da presente invenção pode ser aplicado a qualquer tipo de amostras de mídia e arquivos de mídia, incluindo, mas não limitado a, texto, áudio, vídeo, imagem e quaisquer combinações de multimídia de tipos de mídias individuais. No caso de áudio, a presente invenção é particularmente útil para reconhecer amostras que contenham altos níveis de distorção linear e não linear causados, por exemplo, por ruído de fundo, erros e quedas de transmissão, interferência, filtragem limitada de banda, quantização, deformação no tempo, e compressão digital da qualidade de voz. Como será aparente a partir da descrição abaixo, a invenção funciona sob tais condições, já que pode reconhecer corretamente um sinal distorcido mesmo se apenas uma pequena fração das características computadas sobreviverem à distorção. Qualquer tipo de áudio, incluindo som, voz, música ou ainda combinações de tipos, pode ser reconhecido pela presente invenção. Exemplos de amostras de áudio incluem música gravada, programas de radiodifusão, e propagandas.
Como usada aqui, uma amostra de mídia exógena constitui um segmento de dado de mídia de qualquer tamanho obtido de uma variedade de fontes como descrito abaixo. Para o reconhecimento ser executado, a amostra deve ser uma capitulação de parte de um arquivo de mídia indexada em uma base de dados usada pela presente invenção. O arquivo de mídia indexado pode ser tido como uma gravação original, e a amostra como uma versão distorcida e/ou abreviada ou uma capitulação da gravação original. Tipicamente, a amostra corresponde a apenas uma pequena parte do arquivo indexado. Por exemplo, o reconhecimento pode ser executado num segmento de dez segundos de uma música com cinco minutos indexada na base de dados. Muito embora o termo “arquivo” seja usado para descrever a entidade indexada, a entidade pode estar em qualquer formato para o qual os valores necessários (infra descritos) podem ser obtidos. Adicionalmente, não há nenhuma necessidade de se armazenar ou ter acesso ao arquivo depois que os valores são obtidos.
Um diagrama de blocos que ilustra, conceitualmente, as etapas gerais de um método 10 da presente invenção é exibido na figura 1. As etapas individuais são descritas em maiores detalhes abaixo. O método identifica um arquivo de mídia vencedor, um arquivo de mídia cujas localizações relativas de impressões digitais características mais próximas coincidem com aquelas localizações relativas das mesmas impressões digitais da dita amostra exógena. Após uma amostra exógena ser capturada na etapa 12, marcos e impressões digitais são computados na etapa 14. Os ditos marcos ocorrem em localizações particulares, por exemplo, pontos de tempo, dentro da amostra. A localização dentro da amostra dos marcos é preferencialmente determinada pela amostra propriamente dita, isto é, é dependente das qualidades da amostra, e pode ser reproduzida. A saber, os mesmos marcos são computados para o mesmo sinal toda vez que o processo é repetido. Para cada marco, uma impressão digital caracterizando uma ou mais características da amostra em ou perto do marco é obtida. A proximidade de uma característica com um marco é definida pelo método de impressão digital utilizado. Em alguns casos, uma característica é considerada próxima de um marco se ela corresponder claramente ao marco e não a um marco anterior ou subsequente. Em outros casos, tais características correspondem a múltiplos marcos adjacentes. Por exemplo, impressões digitais de texto podem ser sequências de palavras, impressões digitais de áudio podem ser componentes espectrais, e impressões digitais de imagem podem ser valores de pixel RGB. Duas modalidades gerais da etapa 14 estão descritas abaixo, uma na qual os marcos e impressões digitais são computados sequencialmente, e uma na qual eles são computados simultaneamente.
Na etapa 16, as impressões digitais de amostras são utilizadas para recuperar conjuntos de impressões digitais coincidentes armazenadas em um índice de base de dados 18,em que as impressões digitais coincidentes estão associadas com marcos e identificadores de um conjunto de arquivos de mídia. O conjunto de valores de identificadores e marcos de arquivo recuperados são, então, usados para gerar pares de correspondência (etapa 20) contendo marcos de amostra (computados na etapa 14) e marcos de arquivo recuperados, em que as mesmas impressões digitais foram computadas. Os pares de correspondência resultantes são, em seguida, ordenados por um identificador de música, gerando conjuntos de correspondências entre os marcos de amostra e marcos de arquivo para cada arquivo aplicável. Cada conjunto é varrido para o alinhamento entre os marcos de arquivo e marcos de amostra. Ou seja, correspondências lineares nos pares de marcos são identificadas, e o conjunto é marcado de acordo com o número de pares que estão relacionados linearmente. Uma correspondência linear ocorre quando um grande número de correspondentes localizações de amostras e localizações de arquivos puderem ser descritas, substancialmente, com a mesma equação linear, dentro de uma tolerância permitida. Por exemplo, se inclinações de um número de equações descrevendo um conjunto de pares de correspondência variarem em +1-5%, então o conjunto de correspondências na íntegra é considerado como estando relacionado linearmente. Naturalmente, qualquer tolerância adequada pode ser selecionada. O identificador do conjunto com a marcação mais alta, a saber, com o maior número de correspondências relacionadas linearmente, é o identificador de arquivo vencedor, que se encontra localizado e retomado na etapa 22.
Como descrito adicionalmente abaixo, reconhecimento pode ser realizado com um componente de tempo proporcional ao logaritmo do número de entradas na base de dados. Reconhecimento pode ser feito, essencialmente, em tempo real, mesmo com uma base de dados muito grande. I.e., uma amostra pode ser reconhecida, à medida que ela está sendo obtida, com um retardo de tempo pequeno. O método pode identificar um som com base em segmentos de 5-10 segundos e mesmo tão baixo quanto de 1-3 segundos. Numa modalidade preferida, a análise dos marcos e impressões digitais, etapa 14, é realizada em tempo real, à medida que a amostra está sendo capturada na etapa 12. Consultas em base de dados (etapa 16) são realizadas, à medida que as impressões digitais de amostras se tomam disponíveis, e os resultados de correspondências estão acumulados e são varridos, periodicamente, para as correspondências lineares. Assim, todas as etapas do método ocorrem de forma simultânea, e não do modo linear sequencial como sugerido na figura 1. Note-se que o método é em parte análogo a um mecanismo de busca de texto: usuário submete uma amostra de consulta,e arquivo coincidente indexado na base de dados de som é retomado. O referido método é tipicamente implementado como software que roda em um sistema de computador, com etapas individuais que são mais eficaz/eficientemente implementadas como módulos de software independentes. Consequentemente, um sistema que implementa a presente invenção pode ser considerado como consistindo em um objeto de marco e de impressão digital, uma base de dados indexada, e um objeto de análise para a busca do índice de base de dados, correspondências de computação, e a identificação do arquivo vencedor. No caso de marco e impressão digital sequencial, o objeto de marco e impressão digital pode ser considerado como sendo objetos distintos de marco e impressão digital. Código de instrução de computador para aqueles objetos diferentes é armazenado em uma memória de um ou mais computadores e é executado por um ou mais processadores do computador. Numa modalidade, os objetos de código estão agrupados em um único sistema de computador, tal como um computador pessoal com base em Intel ou outra estação de trabalho. Numa modalidade preferencial, tal método é implementado por intermédio de um agrupamento “cluster” conectado em redes de unidades de processamento central (CPUs), nas quais diferentes objetos de software são executados por diferentes processadores com o propósito de distribuir a carga computacional. Altemativamente, cada uma das CPUs pode ter uma cópia de todos os objetos de software, permitindo uma rede homogênea de elementos configurados de forma idêntica. Nessa última configuração, cada CPU tem um subconjunto do índice de base de dados eé responsável pela busca de seu próprio subconjunto de arquivos de mídia. A despeito da invenção não ser limitada a qualquer sistema de hardware particular, um exemplo de uma modalidade preferida de um sistema de computador distribuído 30 é ilustrado de forma esquemática na figura 2. O sistema 30 contém um grupo de processadores com base em Linux 32a a 32f conectado por uma arquitetura de barramento de multiprocessamento 34 ou por um protocolo de rede tal como o protocolo de computação de grupo Beowulf, ou uma mistura dos dois. Num arranjo deste tipo, o índice de base de dados é, preferencialmente, armazenado na memória de acesso randômico (RAM) em pelo menos um nó 32a no grupo, garantindo que a busca de impressão digital ocorra muito rapidamente. Os nós de computação que correspondem a outros objetos, tais como nós de marco 32c e 32f, nós de impressão digital 32b e 32e, e nó de varredura de alinhamento 32d, não exigem uma RAM tão grande como o nó ou nós 32a suportando o índice de base de dados. O número dos nós de computação designados para cada objeto pode ser, desta forma, escalonado de acordo com a necessidade, de tal forma que nenhum objeto único se tome um afundamento. A rede computacional é, por conseguinte, altamente paralelizável e pode processar, adicionalmente, múltiplas consultas de reconhecimento de sinal simultâneas sendo distribuídas entre recursos computacionais disponíveis. Note-se que isso toma possíveis as aplicações nas quais grandes números de usuários podem solicitar o reconhecimento e receber resultados quase que em tempo real.
Numa modalidade alternativa, determinados objetos dos objetos funcionais são acoplados de modo mais justo, enquanto permanecem acoplados de maneira menos justa a outros objetos. Por exemplo, o objeto de marco e de impressão digital pode residir numa localização fisicamente separada do resto dos objetos computacionais. Um exemplo disto é a associação justa dos objetos de marco e impressão digital com o processo de captura de sinal. Neste arranjo, o objeto de marco e de impressão digital pode ser incorporado como hardware adicional ou software adicional embutido, por exemplo, num telefone móvel, num navegador de Protocolo de Aplicação Sem Fio (WAP), assistente digital pessoal (PDA), ou outro terminal remoto, tal como terminal de cliente de um mecanismo de busca de áudio. Em um serviço de busca de áudio com base na Internet, tal como um serviço de identificação de conteúdo, o objeto de marco e impressão digital pode ser incorporado no aplicativo de navegador do cliente como um conjunto conectado de instruções de software ou um módulo phtg-in de software, tal como uma biblioteca de ligação dinâmica da Microsoft (DLL), Nestas modalidades, a captura de sinal combinado, objeto de marco e impressão digital, constitui o terminal de cliente do serviço. O terminal de cliente envia um sumário extraído de característica da amostra de sinal capturado contendo pares de marcos e impressões digitais para o terminal de servidor, que realiza o reconhecimento. Envio desse sumário extraído de característica ao servidor, ao invés do sinal capturado cru, é vantajoso visto que a quantidade de dados é muito reduzida, frequentemente por um fator de 500 ou mais. Tal informação pode ser enviada em tempo real através de um canal lateral de baixa largura de banda juntamente com ou ao invés de, por exemplo, uma corrente de áudio transmitida ao servidor. Isso permite a realização da invenção através de redes de comunicações públicas, as quais oferecem larguras de banda de dimensões relativamente pequenas para cada usuário. O método será, agora, descrito em detalhes,, com referência às amostras de áudio e arquivos de áudio indexados numa base de dados de som, O método consiste de dois componentes amplos, construção de índice de base de dados de som e reconhecimento de amostra.
Construção de índice de Base de Dados Antes do reconhecimento de som poder ser efetuado, um índice de base de dados de som, o qual pode ser buscado, deve ser construído. Como usada aqui, uma base de dados é qualquer coleção indexada de dados, e não está limitada a bases de dados comercialmente disponíveis. No índice de base de dados, elementos relacionados de dados são associados uns com os outros. e elementos individuais podem ser usados para recuperar os dados associados. O índice de base de dados de som contém um conjunto de índices para cada arquivo ou gravação na coleção selecionada ou biblioteca de gravações, que podem incluir fala, música, propagandas, assinaturas de som, ou outros sons. Cada gravação também possui um identificador único, sound_ID. A base de dados de som propriamente dita não armazena necessariamente os arquivos de áudio para cada gravação, mas sound_ID pode ser utilizado para recuperar os arquivos de áudio de outro lugar. Espera-se que o índice da base de dados de som seja muito grande, contendo índices para milhões ou, até mesmo, bilhões de arquivos. As novas gravações são de preferência acrescentadas de maneira incrementai ao índice de base de dados.
Um diagrama em blocos de um método preferencial 40 para a construção do índice de base de dados de som que pode ser buscado de acordo com uma primeira modalidade é ilustrado na figura 3. Nessa modalidade, os marcos são primeiro computados, e então impressões digitais são computadas em ou perto dos marcos. Como será evidente para aquele versado na técnica, os métodos alternativos podem ser concebidos para a construção do índice de base de dados. Em particular, muitas das etapas listadas abaixo são opcionais, mas servem para a geração de um índice de base de dados que é mais eficientemente buscada. Enquanto a eficiência de busca é importante para reconhecimento de som em tempo real a partir de grandes bases de dados, pequenas bases de dados podem ser buscadas de modo relativamente rápido mesmo se elas não tiverem sido ordenadas de forma otimizada.
Para indexar a base de dados de som, cada gravação na coleção é submetida a uma análise de marco e impressão digital que gera um conjunto de índice para cada arquivo de áudio. A figura 4 ilustra de forma esquemática um segmento de uma gravação de som para o qual marcos (LM) e impressões digitais (FP) foram computados.Aqueles marcos ocorrem em pontos de tempo específicos do som e têm valores em desvio de unidades de tempo a partir do começo do arquivo, enquanto aquelas impressões digitais caracterizam o som em ou perto de um marco em particular. Assim, nessa modalidade, cada marco para um arquivo em particular é singular, enquanto a mesma impressão digital pode ocorrer várias vezes dentro de um arquivo único ou múltiplos arquivos.
Na etapa 42, cada gravação de som é marcada usando métodos para encontrar localizações distintivas e reproduzíveis dentro da gravação de som. Um algoritmo de marco preferido é capaz de marcar os mesmos pontos de tempo dentro de uma gravação de som, independentemente da presença de ruído e outra distorção linear e não linear. Alguns dos métodos de marcação são conceitualmente independentes do processo de impressão digital infra descrito, porém pode ser escolhido para otimizar o desempenho do último. A marcação resulta numa lista de pontos de tempo {landmarkk} dentro da gravação de som em que impressões digitais são subsequentemente calculadas. Um bom esquema de marcação marca cerca de 5-10 marcos por segundo de gravação de som; é óbvio que a densidade de marcação depende da quantidade de atividade dentro da gravação de som.
Uma variedade de técnicas é possível para computar os marcos, todas das quais estão dentro do escopo da presente invenção. Estes processos técnicos específicos utilizados para implementar os esquemas de marcação da invenção são conhecidos na técnica e não serão discutidos em detalhes. Uma técnica de marcação simples, conhecida como Norma de Energia, é calcular a potência instantânea a cada ponto de tempo possível na gravação e selecionar a máxima local. Uma forma de se fazer isso é calcular o envelope ao retificar e filtrar a forma de onda diretamente. Outro jeito é calcular a transformada de Hilbert (quadratura) do sinal e empregar a soma das magnitudes quadradas da transformada de Hilbert e o sinal original. O método da Norma de Energia de marcação é ótimo para se encontrar transientes no sinal de som. Norma de Energia é, na realidade, um caso especial daquela Norma Lp Espectral mais geral na qual p = 2. A Norma Lp Espectral geral é calculada toda vez ao longo do sinal de som pelo cálculo de um espectro de tempo curto, por exemplo, por meio de uma Transformada Rápida de Fourier (FFT) de Janela Hanning. Uma modalidade preferida utiliza uma taxa de amostragem de 8000 Hz, um tamanho de quadro de FFT de 1024 amostras, e um passo de 64 amostras para cada fatia de tempo. Norma Lp para cada fatia de tempo é então calculada como a soma da pésüna energia dos valores absolutos dos componentes espectrais, opcionalmente seguida pela retirada da raiz da pésuna. Como antes, os marcos são escolhidos como a máxima local dos valores resultantes ao longo do tempo. Um exemplo do método da Norma Lp Espectral é ilustrado na figura 5, um gráfico da norma L4 como uma função do tempo para um sinal de som em particular. As linhas tracejadas na máxima local indicam a localização dos marcos escolhidos.
Quando p=°°, a norma L©° é efetivamente a norma máxima. A saber, o valor da norma é o valor absoluto do componente espectral maior na fatia espectral. Essa norma resulta em marcos robustos e bom desempenho de reconhecimento geral, e é preferida para música tonal.
Altemativamente, marcos espectrais de “múltiplas fatias” podem ser calculados pela retirada da soma de pésuna energias de valores absolutos de componentes espectrais através de múltiplas fatias de tempo em desvios fixos ou variáveis um do outro, ao invés de uma única fatia. O encontro da máxima local dessa soma estendida permite a otimização da colocação das impressões digitais de múltiplas fatias, descritas abaixo.
Uma vez que marcos tenham sido computados, uma impressão digital é computada em cada ponto de tempo do marco na gravação na etapa 44. A impressão digital é geralmente um valor ou um conjunto de valores que resume um conjunto de características na gravação em ou perto do ponto de tempo. Numa modalidade atualmente preferida, cada impressão digital é um valor numérico único que é uma função “hashed” de múltiplas características. Tipos possíveis de impressões digitais incluem as impressões digitais de fatia espectral, impressões digitais de múltiplas fatias, coeficientes LPC, bem como coeficientes “cepstral”. Naturalmente, qualquer tipo de impressão digital que caracteriza o sinal ou as características do sinal perto de um marco está dentro do escopo da presente invenção. Impressões digitais podem ser computadas por qualquer tipo de processamento de sinal digital ou análise de frequência do sinal.
Para gerar impressões digitais de fatia espectral, uma análise de frequência é realizada nas proximidades de cada ponto de tempo de marco para extrair vários picos espectrais do topo. Um valor simples de impressão digital é apenas o valor de frequência único do pico espectral mais forte. O uso de um pico simples como este resulta num reconhecimento surpreendentemente bom na presença de ruído; não obstante, as impressões digitais de fatia espectral de frequência única tendem a gerar mais esquemas falso positivos do que outros esquemas de impressão digital visto que eles não são singulares. O número de falso positivos pode ser reduzido usando-se impressões digitais consistindo em uma função dos dois ou três picos espectrais mais fortes. Entretanto, pode haver uma suscetibilidade mais elevada a ruído se o segundo pico espectral mais forte não for suficientemente forte o bastante para distingui-lo de seus competidores na presença de ruído. Em outros termos, o valor da impressão digital calculada pode não ser suficientemente robusto para ser reproduzível de maneira confiável. Independentemente disso, o desempenho desse caso também é bom.
Para levar vantagem da evolução no tempo de muitos sons, um conjunto de intervalos de tempo é determinado acrescentando-se um conjunto de desvios de tempo para um ponto de tempo do marco. Em cada intervalo de tempo resultante, a impressão digital de fatia espectral é calculada. O conjunto resultante da informação de impressão digital é então combinado para formar uma impressão digital de múltiplos tons ou de múltiplas fatias. Cada impressão digital de múltiplas fatias é muito mais singular do que a impressão digital da fatia espectral única, pois a mesma rastreia evolução temporal, resultando em menos falsa coincidências na busca de índice de base de dados descrita abaixo.
Experimentos indicam que devido à sua singularidade aumentada, impressões digitais de múltiplas fatias computadas a partir do pico espectral singular mais forte em cada um dentre os dois intervalos de tempo resultam em computação muito mais rápida (cerca de 100 vezes mais rápida) na busca de índice de base de dados subsequente, porém com alguma degradação numa porcentagem de reconhecimento na presença de ruído significativo.
Altemativamente,ao invés de utilizar um desvio fixo ou desvios fixos a partir de um dado intervalo de tempo, para calcular uma impressão digital de múltiplas fatias, desvios variáveis podem ser usados. O desvio variável para a fatia escolhida é o desvio para o próximo marco, ou um marco em uma certa faixa de desvio a partir do marco de “âncora” para a impressão digital. Nesse caso, a diferença de tempo entre os marcos também é codificada na impressão digital, juntamente com a informação de múltiplas frequências. Pela adição de mais dimensões às impressões digitais, as mesmas se tomam singulares e têm uma menor chance de falsa coincidência.
Além de componentes espectrais, outras características espectrais podem ser extraídas e usadas como impressões digitais. Análise de codificação preditiva linear (LPC) extrai as características linearmente previsíveis de um sinal, tais como picos espectrais, bem como a forma espectral. LPC é bastante conhecida na arte de processamento de sinal digital. Para a presente invenção, coeficientes LPC de fatias de forma de onda ancorados nas posições de marco podem ser utilizados como impressões digitais por “hashing” dos coeficientes LPC quantizados em um valor de índice.
Aqueles coeficientes “cepstral” são úteis como uma medida de periodicidade e podem ser usados para caracterizar sinais que são harmônicos, tais como vozes ou muitos instrumentos musicais. A análise “cepstral” é bem conhecida na técnica de processamento de sinal digital. Para fins da presente invenção, um número de coeficientes “cepstral” são “hashed” juntos num índice e utilizados como uma impressão digital.
Uma modalidade alternativa 50, em que os marcos e impressões digitais são computados simultaneamente, é mostrada na figura 6. As etapas 42 e44 da figura 3 são substituídas pelas etapas 52, 54 e 56. Como descrito abaixo, uma função multidimensional é computada a partir da gravação de som na etapa 52, e marcos (54) e impressões digitais (56) são extraídos da função.
Em uma implementação da modalidade da figura 6, os marcos e impressões digitais são computados a partir de um espectrograma da gravação do som. Um espectrograma é uma análise de tempo-frequência de uma gravação de som na qual quadros em janelas e quadros sobrepostos de amostras de som são analisados espectralmente, tipicamente usando uma Transformada Rápida de Fourier (FFT). Como antes, uma modalidade preferida utiliza uma taxa de amostragem de 8000 Hz, um tamanho de quadro de FFT de 1024 amostras, e um passo de 64 amostras para cada intervalo de tempo. Um exemplo de um espectrograma é ilustrado na figura 7A. O tempo está no eixo horizontal, e a frequência está no eixo vertical. Cada quadro de FFT sequencial é empilhado verticalmente em intervalos espaçados de forma homogênea correspondentes ao longo do eixo do tempo. Uma representação do espectrograma demonstra a densidade de energia em cada ponto de tempo-frequência; áreas mais escuras no gráfico representam uma maior densidade de energia. Espectrogramas são bem conhecidos na técnica de processamento de sinal de áudio. Para a presente invenção, marcos e impressões digitais podem ser obtidos de pontos salientes tais como na máxima local do espectrograma, circulada no espectrograma da figura 7B. Por exemplo, coordenadas de tempo e de frequência de cada pico são obtidas, o tempo considerado como sendo o marco, e a frequência utilizada para a computação da impressão digital correspondente. Este marco de pico de espectrograma é semelhante à norma L°°, na qual o valor máximo absoluto da norma determina a localização do marco. No espectrograma, todavia, a busca máxima local ocorre através de partes do plano de tempo-frequência, ao invés de através de todo o intervalo de tempo.
Nesse contexto, o conjunto dos pontos salientes que resulta da análise de extração de ponto de uma gravação de som é referido como sendo uma constelação. Para uma constelação que consiste numa máxima local, uma análise preferida é a de selecionar pontos que são a energia máxima do plano tempo-frequência através de uma vizinhança ao redor de cada ponto selecionado. Por exemplo, um ponto na coordenada (/,„/„) é selecionado se for o ponto de energia máxima dentro de um retângulo com os cantos (t0-T, ,f„+F)t (U+T, f„‘F) e (1,,+T, f(>+F) i.e. um retângulo com lados de comprimento 2T e 2F, com T e F escolhidos para proporcionar um número apropriado de pontos de constelação. As junções do retângulo também poderão variar em tamanho de acordo com o valor de frequência. Obviamente, qualquer forma da região pode ser usada. O critério de energia máxima também pode ser ponderado tal que um pico de energia de tempo-frequência competidor seja inversamente ponderado de acordo com uma métrica de distância no plano tempo-frequência, ou seja, pontos mais distantes têm menor ponderação. Por exemplo, a energia pode ser ponderada como _________S(tj)_________ I + Cr (/-/„)'+ C((f - f,)2' onde $(Uf) é o valor ao quadrado da magnitude do espectrograma no ponto (t, f), e C, e Cf sâo valores positivos (não necessariamente constantes). Outras funções de distância-ponderação são possíveis. As restrições de seleção máxima local podem ser aplicadas a outros esquemas (a saber, não máximos) de extração de característica de ponto saliente, e estão dentro do escopo da invenção.
Tal método resulta em pares de valores que são muito similares à impressão digital espectral de frequência única descrita acima, com muitas das mesmas propriedades. O método tempo-frequência do espectrograma gera mais pares de marco/impressão digital do que o método de frequência singular, mas também poderá resultar em muitas falsa coincidências naquele estágio de coincidência descrito abaixo. Contudo, o mesmo provê marcação e impressão digital mais robustos do que a impressão digital espectral de frequência única, já que ruído dominante na amostra de som pode não se estender para todas as partes do espectro em cada fatia. Isto é, existem, muito provavelmente, alguns pares de marco e impressão digital em partes do espectro que não são afetados pelo ruído dominante.
Esse método de marcação e impressão digital do espectrograma é um caso especial dos métodos de análise das características que computam uma função multidimensional do sinal do som, no qual uma das dimensões é o tempo, e localizam pontos salientes nos valores de função. Os pontos salientes podem ser a máxima local, a mínima local, cruzamentos pelo ‘zero’, ou outras características distintivas. Os marcos são tomados como sendo as coordenadas de tempo dos pontos salientes, e já as impressões digitais correspondentes são computadas a partir de pelo menos uma das coordenadas remanescentes. Por exemplo, a(s) coordenada(s) de não tempo do ponto saliente multidimensional podem ser “hashed” juntas para formar uma impressão digital funcional multidimensional. O método de desvio variável descrito acima para as impressões digitais espectrais de múltiplas fatias pode ser aplicado ao espectrograma ou a outras impressões digitais de função multidimensional. Nesse caso, os pontos numa constelação são conectados entre si para formar os pontos conectados, como ilustrado no espectrograma exibido na figura 7C. Cada ponto na referida constelação serve como um ponto de ancoragem definindo o tempo de marco, e os valores de coordenadas restantes dos outros pontos são combinados para formar a impressão digital conectada. Os pontos que estão mais pertos um do outro, por exemplo, como definidos abaixo, são conectados juntos para formar impressões digitais de característica agregada mais complexas que podem ser mais facilmente distinguidas e buscadas. Como ocorre com aquelas impressões digitais espectrais de múltiplas fatias, o objetivo de combinar uma informação a partir de múltiplos pontos salientes conectados numa única impressão digital é o de criar uma maior diversidade dos valores de impressão digital possíveis, com isto diminuindo a probabilidade de falsa coincidência, isto é, diminuindo a probabilidade de que a mesma impressão digital descreva duas amostras de música diferentes.
Em princípio, cada um dos pontos salientes N pode ser conectado a cada outro ponto, num esquema de conexão de dois pontos, produzindo cerca de N2/2 combinações. Similarmente, para uma conexão de ponto K, o número de combinações possíveis resultantes de uma constelação é da ordem de NK, A fim de se evitar uma explosão combinatória como esta, é desejável restringir a vizinhança dos pontos que estão conectados juntos. Um modo de realizar uma restrição como esta é definir uma “zona alvo” para cada ponto de ancoragem. * Um ponto de ancoragem é, então, conectado com pontos em sua zona alvo. E possível selecionar um subconjunto de pontos dentro da zona alvo para a sua conexão - nem todo ponto precisa ser conectado. Por exemplo, apenas os pontos associados com os picos mais fortes na zona alvo podem ser conectados. Uma zona alvo pode ter uma forma fixa ou variar de acordo com características do ponto de ancoragem. Um exemplo simples de uma zona alvo de um ponto de ancoragem para uma constelação de pico de espectrograma é o conjunto de pontos {t,f) na faixa do espectrograma, de tal forma que t esteja no intervalo [t„+L, /„+L+Vf], onde L é o trajeto para o futuro eWéa largura da zona alvo. Neste esquema,todas as frequências são permitidas na zona alvo.E ou Wpodem ser variáveis, por exemplo, se um mecanismo de controle de taxa for usado para modular o número de combinações de conexão sendo produzidas. De maneira alternativa, restrições de frequência podem ser implementadas, por exemplo, por restrição da zona alvo, tal que a frequência/esteja no intervalo [f„-Ft f,+F\. onde F é um parâmetro de limitação. Uma das vantagens de uma restrição de frequência é que, em psico-acústica, é sabido que melodias tendem a concordar melhor quando sequências de notas têm frequências que estão próximas entre si. Uma restrição deste tipo pode possibilitar mais desempenho de reconhecimento “psico-acusticamente realístico”, muito embora modelagem psico-acústica não seja necessariamente um objetivo da invenção. Também é possível considerar a regra oposta, em que/é escolhido do lado de fora da região \f„-F, f,+F]. Isso força a conexão dos pontos que são diferentes uns dos outros em frequência, possivelmente evitando casos nos quais os artefatos de extração de constelação produzam sequências de obturação de pontos de tempo-frequência que estão próximos em tempo e tenham a mesma frequência, Como ocorre com os outros parâmetros de localidade, F não é necessariamente uma constante e pode, por exemplo, ser uma função de /„.
Quando incluindo coordenadas de tempo de pontos salientes de não ancoragem nos valores de impressão digital, os valores de tempo relativos devem ser usados para permitir que as impressões digitais sejam invariáveis no tempo. Por exemplo, dita impressão digital pode ser uma função de (i) valores de coordenada de não tempo e/ou (ii) diferença(s) dos valores de coordenada de tempo correspondentes dos pontos salientes. A(s) diferençais) de tempo podem ser consideradas, por exemplo, com relação ao ponto de ancoragem ou como diferenças sucessivas entre pontos salientes sequenciais no conjunto conectado. Os valores de coordenadas e diferenças podem ser empacotados em campos de bit eoncatenados para formar a impressão digital “hashed”. Como será aparente aqueles versados na técnica, muitas outras formas de conjuntos de mapeamento de valores de coordenadas em um valor de impressão digital existem e estão dentro do escopo da presente invenção.
Uma instanciaçao concreta desse esquema utiliza os picos de espectrograma conectados N> 1 com coordenadas (f*,/*), £=1,..., Λ£ Então, (i) o tempo // do primeiro pico é tomado como o tempo do marco, e (ii) as diferenças de tempo Δί* = f* - £=2,..., Nf mais as frequências /*, £=1,..., N, dos picos conectados são “hashed” juntos para formar um valor de impressão digital. A dita impressão digital pode ser computada a partir de todos ou a partir de um subconjunto de todas as coordenadas disponíveis Δ/* e/*. Por exemplo, algumas ou todas as coordenadas de diferença de tempo podem ser omitidas se desejado.
Outra vantagem da utilização de múltiplos pontos para formar a impressão digital é que codificação da impressão digital pode ser feita invariável com relação a prolongamento de tempo, por exemplo, quando uma gravação de som é reproduzida numa velocidade diferente daquela velocidade de gravação original. Essa vantagem se aplica a ambos os métodos de espectrograma e de intervalo de tempo. Note-se que num sinal de tempo prolongado, diferenças de tempo e frequência possuem uma relação alternada (por exemplo, diminuindo a diferença de tempo entre dois pontos por um fator de dois dobros da frequência). Esse método aproveita a vantagem desse fato pela combinação de diferenças de tempo e frequências de um modo que remova o prolongamento de tempo a partir da impressão digital.
Por exemplo, em um caso de pico de espectrograma de ponto N com os valores de coordenadas (tít /*), N, os valores intermediários disponíveis a serem “hashed” numa impressão digital são Δτ* = ft - //, /:=2,..., /V, c fu, N. Os valores intermediários podem então se tornarem invariáveis com relação ao prolongamento do tempo considerando-se uma das frequências como uma frequência de referência, digamos//, e formando (i) quoeiemes com as frequências remanescentes e (ii) produtos com as diferenças de tempo.
Por exemplo, valores intermediários podem ser gk=fi/fi, /:=2,.... M e .¾ = Aíifit /.-2,..., N, Se a amostra for acelerada por um fator de a, então a frequência f\ se toma oífn e a diferença de tempo Δί* se toma Δ/*/α, de tal modo que gk = OLjí/aff =fi/j/, e, ainda, .¾ = (Δί*/α) (cifi) = Atifi. Esses novos valores intermediários são então combinados usando uma função para formar um valor de impressão digital “hashed’' que é independente do prolongamento de tempo. Por exemplo, os valores gk e .¾ podem ser “hashed” ao empacotá-los em campos de bits co n cate nados.
Alternativamente, ao invés de uma frequência de referência, uma diferença de tempo de referência pode ser utilizada, por exemplo, At2. Neste caso, os novos valores intermediários são calculados como (i) quocientes Atk/At2 com as diferenças de tempo remanescentes e (ii) produtos At^fk com as frequências. Este caso é equivalente ao uso de uma frequência de referência, visto que os valores resultantes podem ser formados a partir dos produtos e quocienies dos valores g* e s* acima. As alternâncias das razões de frequência podem ser empregadas igualmente de forma eficiente; somas e diferenças dos valores logarítmicos dos valores intermediários originais também podem ser substituídos pelos produtos e diferenças, respectivamente. Qualquer valor de impressão digital independente dc prolongamento de tempo obtido por aquelas comutações, substituições e permutas de operações matemáticas se encontram dentro do escopo da invenção, Adicionalmente, as múltiplas frequências de referência ou as diferenças de tempo de referência, que também relativizam as diferenças de tempo, podem ser utilizadas. O uso de múltiplas frequências de referência ou diferenças de tempo de referência é equivalente ao uso de uma única referência, pois o mesmo resultado pode ser alcançado por manipulação aritmética dos valores g* e ,¾.
Retornando às figuras 3 e 6, análises de marcação e impressão digital por qualquer um dos métodos acima resultam num conjunto de índices para cada sound_lD, conforme ilustrado na figura 8A. Um conjunto de índices para uma dada gravação de som é uma lista de pares de valores (i.e., impressão digital, marco). Cada gravação indexada possui tipicamente na ordem de mil pares (impressão digital, marco) em seu conjunto de índices. Naquela primeira modalidade descrita acima, na qual as ditas técnicas de marcação e impressão digital são essencialmente independentes, as mesmas podem ser tratadas como módulos separados e iniercambiáveis. Dependendo do sistema, qualidade de sinal, ou tipo de som a ser reconhecido, um dentre um número de módulos de marcação ou de impressão digital diferentes podem ser empregados. De fato, já que o conjunto de índices é constituído simplesmente de pares de valores, é possível e frequentemente preferível utilizar múltiplos esquemas de marcação e impressão digital simultaneamente. Por exemplo, um esquema de marcação e impressão digital pode ser bom na detecção de padrões de tons únicos, mas ruim na identificação de percussão, ao passo que um algoritmo diferente pode ter os atributos opostos. O uso de múltiplas estratégias de marcação/impressão digital resulta numa faixa mais robusta e mais rica do referido desempenho de reconhecimento. Diferentes técnicas de impressão digital podem ser utilizadas juntas reservando-se determinadas faixas de valores de impressão digital para certos tipos de impressões digitais. Por exemplo, num valor de impressão digital de 32 bits, os primeiros 3 bits podem ser utilizados para especificar quais dos 8 esquemas de impressão digital os seguintes 29 bits estão codificando.
Após conjuntos de índices serem gerados para cada gravação de som a ser indexada na base de dados de som, um índice de base de dados que pode ser buscado é construído de tal maneira a permitir uma busca rápida (isto é, tempo de registro “log”). Isto é efetuado na etapa 46 pela construção de uma lista de tríplices (impressão digital, marco, sound_ID) obtida por anexação da sound_ID correspondente a cada dueto dentro de cada conjunto de índices. Todas as ditas tríplices para todas as gravações de som são coletadas em uma grande lista de índice, um exemplo da qual é ilustrado na figura 8B. A fim de otimizar o processo de busca subsequente, a lista de tríplices é então ordenada de acordo com a impressão digital. Algoritmos de ordenação rápidos são bem conhecidos na técnica e extensivamente discutidos em D.E. Knuth, The Art of Computer Programming, Vol. 3: Sorting and Searching, Reading, Massachusetts: Addison-Wesley, 1998, incorporado aqui por referência. Algoritmos de ordenação de alto desempenho podem ser utilizados para ordenar a lista em registro “log” N tempo N, onde Néo número de entradas na lista.
Uma vez que a lista de índice é ordenada, ela é adicionalmente processada na etapa 48 pela segmentação, de tal maneira que cada impressão digital singular na lista seja coletada em uma nova lista de índice principal, um exemplo da qual é ilustrado na figura 8C. Cada entrada na lista de índice principal contém um valor de impressão digital e um apontador para uma lista de pares (marco, sound_ID). Dependendo do número e caractere das gravações indexadas,uma dada impressão digital pode aparecer centenas de vezes ou mais dentro de toda a coleção. O rearranjo da lista de índice em uma lista de índice principal é opcional, mas economiza memória, já que cada valor de impressão digital aparece apenas uma vez. Isto também acelera a busca de base de dados subsequente, visto que o número efetivo de entradas na lista é muito reduzido para uma lista de valores únicos. Altemativamente, a lista de índice principal pode ser construída pela inserção de cada tríplice em uma árvore B. Existem outras possibilidades de construção da lista de índice principal, como é sabido dos versados na técnica. A lista de índice principal é preferencialmente mantida na memória do sistema, tal como a DRAM, para acesso rápido durante o dito reconhecimento de sinal. A lista de índice principal pode ser mantida naquela memória de um único nó dentro do sistema, conforme ilustrada na figura 2. Altemativamente, a lista de índice principal pode ser fragmentada em pedaços distribuídos entre múltiplos nós computacionais. De preferência, o índice de base de dados de som supra referido é a lista de índice principal ilustrada na figura 8C. O índice de base de dados de som é, de preferência, constmído fora de linha e atualizado de forma incrementai, à medida que novos sons são incorporados ao sistema de reconhecimento. Para a atualização da lista, novas impressões digitais podem ser inseridas na localização apropriada na lista de índice principal. Se novas gravações contiverem impressões digitais existentes, os pares correspondentes (marco, sound_ID) são adicionados a listas existentes para aquelas impressões digitais.
Sistema de Reconhecimento Usando a lista de índice principal gerada como descrita acima, reconhecimento de som é efetuado numa amostra de som exógena, tipicamente, suprida por um usuário interessado na identificação da amostra. Por exemplo, o usuário ouve uma nova música no rádio e gostaria de saber o nome do artista e título da música. A amostra pode surgir a partir de qualquer tipo de ambiente, tal como, uma radiodifusão, boate, bar, submarino, arquivo de som, segmento de transmissão “streaming” de áudio, ou sistema estéreo, e podem conter ruído de fundo, interrupções ou vozes falando. O usuário pode armazenar a amostra de áudio num dispositivo de armazenagem, tal como uma secretária eletrônica, arquivo de computador, gravador, ou sistema de correio de voz de telefone ou telefone móvel antes de fomecê-la para o sistema para reconhecimento. Com base na configuração do sistema e restrições impostas pelo usuário, a amostra de áudio é fornecida para o sistema de reconhecimento da presente invenção a partir de qualquer número de fontes analógicas ou digitais, tais como, sistema estéreo, televisão, aparelho tocador de CD, radiodifusão, secretária eletrônica, telefone, telefone móvel, difusão de “streaming” na Internet, FTP, arquivo de computador, como um anexo do e-mail, ou qualquer outro meio adequado de transmissão de tal material gravado. Dependendo da fonte, a amostra pode estar na forma de ondas acústicas, ondas de rádio, uma corrente PCM de áudio digital, uma corrente de áudio digital comprimida (tal como Dolby Digital ou MP3) ou uma difusão de “streaming” na Internet. O usuário interage com o sistema de reconhecimento através de uma interface padrão tal como um telefone, telefone móvel, navegador da rede ou e-mail. A amostra pode ser capturada pelo sistema e processada em tempo real, ou ela pode ser reproduzida para processamento a partir de um som capturado previamente (por exemplo, de um arquivo de som). Durante captura, a amostra de áudio é amostrada digitalmente e enviada para o sistema por um dispositivo de amostragem, tal como o microfone. Dependendo do método de captura, a dita amostra fica provavelmente sujeita à degradação adicional devido às limitações do canal ou dispositivo de captura de som.
Uma vez que o sinal de som foi convertido em forma digital, o mesmo é processado para reconhecimento. Como ocorre com a construção de conjuntos de índices para arquivos de base de dados, os marcos e impressões digitais são calculados para a amostra usando o mesmo algoritmo que foi usado para o processamento da base de dados de gravação de som. O método opera, de forma otimizada, se o processamento de uma rendição altamente distorcida de um arquivo de som original resultar em um conjunto idêntico ou similar de pares de marco e impressão digital como fora obtido para a gravação original. O conjunto de índices resultante para a amostra de som é um conjunto de pares de valores analisados, (impressão digital, marco), ilustrados na figura 9A.
Dados os pares para a amostra de som, o índice de base de dados é buscado para localizar, potencialmente, arquivos coincidentes. A busca é feita como a seguir: cada par (impressão digitalk, marcok) no conjunto de índices da amostra desconhecida é processado pela busca por impressão digitalk na lista de índice principal. Algoritmos de busca rápida numa lista ordenada são bem conhecidos na técnica e extensivamente discutidos em D.E. Knuth, The Art of Computer Programming, Vol. 3: Sorting and Searching, Reading, Massachusetts: Addison-Wesley, 1998. Se impressão digitalk for encontrada na lista de índice principal, então sua lista correspondente de par coincidente (marco*j, sound_IDj) é copiada e aumentada com o marcok para formar um conjunto de tríplices da forma (marcok, marco*j, sound_IDj). Nessa notação, um asterisco (*) indica um marco de um dos arquivos indexados na base de dados, ao passo que um marco sem um asterisco se refere à amostra. Em alguns casos, é preferencial que as impressões digitais coincidentes não sejam necessariamente idênticas, mas sim similares; por exemplo, elas poderão diferir dentro de um limiar previamente determinado. Impressões digitais coincidentes, se idênticas ou similares, são referidas como equivalentes. O sound_IDj na tríplice corresponde ao arquivo tendo o marco com asterisco. Assim, cada tríplice contém dois marcos distintos, um no índice de base de dados e um na amostra, em que as impressões digitais equivalentes foram computadas. Esse processo é repetido para todos k variando pelo conjunto de índices da amostra de entrada. Todas tríplices resultantes são coletadas numa grande lista candidata, exibida na figura 9B. A lista candidata é assim chamada, pois contém sound_IDs dos arquivos de som, que, em virtude de suas impressões digitais coincidentes, são candidatas para identificação com a amostra de som exógena.
Após a lista candidata ser compilada, a mesma é adicionalmente processada pela segmentação de acordo com sound_ID. Um modo conveniente de se fazer isso é o de ordenar a lista candidata por sound_ID ou inseri-la em uma árvore B. Um grande número de algoritmos de ordenação está disponível na técnica, conforme discutido acima. O resultado deste processo é uma lista de sound_IDs candidatas, cada uma das quais tem uma lista de dispersão de pares de amostra e pontos de tempo do marco de arquivo com o referido sound_ID opcionalmente retirado, (marcot, marco*j), como ilustrado na figura 9C. Cada lista de dispersão contém, assim, um conjunto de marcos correspondentes, que correspondem em virtude de eles serem caracterizados por valor de impressão digital equivalente. A lista de dispersão para cada sound_ID candidata é, a seguir, analisada para determinar se tal sound_ID é uma coincidência para a amostra. Uma etapa de limitação opcional pode ser utilizada primeiro para eliminar um número potencialmente grande de candidatas que possuem listas de dispersão muito pequenas. Claramente, as candidatas possuindo apenas uma entrada em suas listas de dispersão, isto é, apenas uma impressão digital em comum com a amostra, não coincidem com dita amostra. Qualquer número limiar adequado maior do que ou igual a um pode ser utilizado.
Uma vez que aquele número final de candidatas é determinado, a candidata vencedora é localizada. Se o algoritmo seguinte não localiza uma candidata vencedora, então uma mensagem de falha é retomada. Uma perspicácia chave no referido processo de coincidência é que a evolução no tempo em sons coincidentes deve seguir uma correspondência linear, assumindo que as bases de tempo em ambos os lados estão estáveis. Isto é quase sempre verdadeiro, a menos que um dos sons tenha sido deformado intencionalmente de forma não linear ou sujeito a equipamento de reprodução defeituoso tal como um toca-fitas com um problema de velocidade de oscilação. Assim, os pares de marcos corretos (marcon, marco*n) na lista de dispersão de um dado sound_ID deve ter uma correspondência linear da forma marco *n = m*marcon + desvio, onde m é a inclinação, que deve ser perto de um; marcon é o ponto de tempo dentro da amostra exógena; marco*n é o ponto de tempo correspondente dentro da gravação de som indexada pelo sound_ID; e o desvio é o desvio em tempo na gravação de som correspondendo ao começo da amostra de som exógena. Pares de marcos que podem ser encaixados com a equação acima para valores particulares de m e desvio são relatados como sendo relacionados linearmente. Obviamente, o conceito de ser relacionado linearmente é válido somente para mais de um par de marcos correspondentes. Observa-se que tal relação linear identifica o arquivo de som correto com alta probabilidade, enquanto exclui os pares de marcos afastados que não possuem qualquer significado. Enquanto é possível que dois sinais distintos contenham um número de impressões digitais idênticas, é muito improvável que tais impressões digitais tenham as mesmas evoluções no tempo relativas. A exigência por correspondências lineares é uma característica chave da presente invenção, e provê um reconhecimento melhor significativamente do que técnicas que simplesmente contam o número total de características em comum ou medem a similaridade entre as características. De fato, devido a esse aspecto da invenção, os sons podem ser reconhecidos, mesmo se menos de 1% das impressões digitais da gravação original aparecer na amostra de som exógena, isto é, se a amostra de som for muito curta ou se for significativamente distorcida.
Oproblema de determinar se há uma coincidência para a amostra exógena é, assim, reduzido ao equivalente de encontrar uma linha diagonal com inclinação perto de um dentro de uma representação de dispersão dos pontos de marcos de uma dada lista de dispersão. Duas representações de dispersão de amostra são ilustradas nas figuras 10A e 10B, com marcos de arquivo de som no eixo horizontal e marcos de amostra de som exógena no eixo vertical. Na figura 10A, uma linha diagonal de inclinação aproximadamente igual a um é identificada, indicando que a música na verdade coincide com a amostra, isto é, que o arquivo de som constitui um arquivo vencedor. A interceptação no eixo horizontal indica o desvio naquele arquivo de áudio em que a amostra começa. Nenhuma linha diagonal estatisticamente significante é encontrada no diagrama de dispersão da figura 10B, indicando que aquele arquivo de som não é uma coincidência para aquela amostra exógena.
Existem muitas formas de se encontrar uma linha diagonal em um diagrama de dispersão, todas das quais estão dentro do escopo da presente invenção. Deve-se entender que a frase “localizar uma linha diagonal” refere-se a todos os métodos que são equivalentes à localização de uma linha diagonal sem produzir explicitamente uma linha diagonal. Um método preferido inicia subtraindo-se m*marcon de ambos os lados da equação acima para resultar em (marco*n - m*marcon) = desvio.
Assumindo-se que m é aproximadamente igual a um, a saber, assumindo-se que não haja prolongamento de tempo, chega-se em (marco*n - marcon) = desvio. O problema de encontrar diagonal é então reduzido ao encontrar múltiplos pares de marcos para um dado sound_ID que agrupa perto do mesmo valor de desvio. Isso pode ser realizado facilmente pela subtração de um marco a partir do outro e coleta de um histograma dos valores de desvio resultantes. O histograma pode ser preparado ordenando-se os valores de desvio resultantes usando um algoritmo de ordenação rápido ou mediante criação de entradas de compartimento “bin” com contadores e inserção numa árvore B. Compartimento de desvio vencedor no histograma contém o número mais alto de pontos. Este compartimento é referido aqui como o pico do histograma. Posto que o desvio deve ser positivo se o sinal de som exógeno estiver totalmente contido dentro do arquivo de som de biblioteca correto, os pares de marcos que resultam em um desvio negativo podem ser excluídos. De forma similar, os desvios além do terminal do arquivo também podem ser excluídos. O número de pontos no compartimento de desvio vencedor do histograma é notado para cada sound_ID de qualificação. Esse número se toma a marcação para cada gravação de som. A gravação de som na lista candidata com a marcação mais alta é escolhida como a vencedora. O sound_ID vencedor é reportado para um usuário como descrito abaixo para sinalizar o sucesso da identificação. Para impedir a falsa identificação, uma marcação limiar mínima pode ser utilizada para se obter o sucesso do processo de identificação. Se nenhum som da biblioteca tiver uma marcação que exceda o limiar, então não há reconhecimento, e o usuário é então informado.
Se o sinal de som exógeno contiver múltiplos sons, então cada som individual pode ser reconhecido. Nesse caso, múltiplos vencedores estão localizados na varredura de alinhamento. Não é necessário saber que o sinal de som contém múltiplos vencedores, visto que a varredura de alinhamento localizará mais do que um sound_ID com uma marcação que é muito maior do que as marcações restantes. O método de impressão digital usado exibe, de preferência, boa superposição linear, tal que as impressões digitais individuais possam, enfim, ser extraídas. Por exemplo, um método de impressão digital de espectrograma exibe superposição linear.
Se a amostra de som tiver sido submetida a prolongamento de tempo, então a inclinação não é identicamente igual a um. O resultado de se assumir uma unidade de inclinação numa amostra prolongada no tempo (ao se assumir que as impressões digitais são invariáveis ao prolongamento do tempo) é que os valores de desvio computados não são iguais. Um jeito de se abordar isto e acomodar o prolongamento de tempo moderado é aumentar o tamanho dos “bins” de desvio, isto é, considerar uma faixa de desvios como sendo igual. Em geral, se os pontos não caírem numa linha reta, então os valores de desvio computados são significativamente diferentes, e um leve aumento no tamanho dos “bins” de desvio não resulta num úmero significativo de falso positivos.
Outras estratégias de encontrar linha são possíveis. Por exemplo, uma transformada Radon ou Hough, descrita em T. Risse, “Hough Transform for Line Recognition”, Computer Vision and hnage Processing, 46, 327-345, 1989, que são bem conhecidas nas técnicas de pesquisa de visão e gráficos de máquina, pode ser utilizada. Na transformada Hough, cada ponto do diagrama de dispersão se projeta numa linha no espaço (inclinação, desvio). O conjunto de pontos no diagrama de dispersão é, desta forma, projetado no espaço duplo de linhas na transformada Hough. Picos na transformada Hough correspondem a interseções das linhas de parâmetro. O pico global de uma transformada como esta de um dado diagrama de dispersão indica o mais alto número de linhas de interseção na transformada Hough, e assim o mais alto número de pontos co-lineares. Para se permitir uma variação de velocidade de 5%, por exemplo, a construção da transformada Hough pode ser limitada à região onde parâmetro de inclinação varia entre 0,95 e 1,05, economizando, assim, algum esforço de computação.
Busca Hierárquica Além da etapa de limitação que elimina candidatas com listas de dispersão muito pequenas, aperfeiçoamentos adicionais na eficiência podem ser realizados. Em um aperfeiçoamento como este, o índice de base de dados é segmentado em pelo menos duas partes de acordo com a probabilidade de ocorrência, e apenas os arquivos de som com a mais elevada probabilidade de coincidência da amostra são inicialmente buscados. A divisão pode ocorrer em vários estágios do processo. Por exemplo, lista de índice principal (figura 8C) pode ser segmentada em duas ou mais partes, tal que as etapas 16 e 20 sejam primeiramente realizadas em um dos segmentos. Em outras palavras, arquivos correspondentes a impressões digitais coincidentes são recuperados a partir de apenas uma fração do índice de base de dados, e uma lista de dispersão é gerada a partir desta fração. Se um arquivo de som vencedor não for localizado, então o processo é repetido no restante do índice de base de dados. Em uma outra implementação, todos os arquivos são recuperados a partir do índice de base de dados, mas a varredura em linha diagonal é feita separadamente nos diferentes segmentos.
Usando essa técnica, a varredura em linha diagonal, uma parte intensiva em termos de computação do método, é realizada primeiro em um pequeno subconjunto dos arquivos de som no índice de base de dados. Visto que a varredura em linha diagonal apresenta um componente de tempo que é aproximadamente linear com relação ao número de arquivos de som sendo varridos, realização de uma busca hierárquica como tal é altamente vantajosa. Por exemplo, assuma que o índice de base de dados de som contém impressões digitais representando 1.000.000 arquivos de som, mas que somente cerca de 1000 arquivos coincidem com as consultas de amostra com alta frequência, por exemplo, 95% das consultas são para 1000 arquivos, enquanto apenas 5% das consultas são para 999.000 arquivos restantes. Assumindo-se uma dependência linear do custo computacional no número de arquivos, o custo é proporcional a 1000, 95% do tempo, e proporcional a 999.000, apenas 5% do tempo. O custo médio é, por conseguinte, proporcional a cerca de 50.900. Uma busca hierárquica dessa forma resulta aproximadamente num fator de 20 economias na carga de computação. Obviamente, o índice de base de dados pode ser segmentado em mais de 2 níveis de hierarquia, por exemplo, um grupo de novos lançamentos, um grupo de músicas recém lançadas, e um grupo de músicas mais antigas e menos populares.
Conforme descrito acima, a busca é primeiro executada em um primeiro subconjunto de arquivos de som, os arquivos de maior probabilidade e, então, somente se a primeira busca falhar, ela é executada em um segundo subconjunto contendo os arquivos remanescentes. Falha da varredura em linha diagonal ocorre se o número de pontos em cada compartimento de desvio não atingir um valor limiar predeterminado. Altemativamente, ambas buscas podem ser realizadas em paralelo (simultaneamente). Se o arquivo de som correto for localizado em uma busca do primeiro subconjunto, então um sinal é enviado para encerrar a busca do segundo subconjunto. Se o arquivo de som correto não for localizado na primeira busca, então a segunda busca continua até que um arquivo vencedor seja localizado. Essas duas implementações diferentes envolvem compensações de esforço e tempo de computação. Aquela primeira implementação é mais eficiente em termos de computação, mas introduz uma latência leve se a primeira busca falhar, enquanto dita segunda implementação desperdiça esforço de computação se o arquivo vencedor estiver no primeiro subconjunto mas minimiza a latência se não estiver. O objetivo de segmentar a lista é o de estimar a probabilidade de um arquivo de som ser o alvo de uma consulta e o de limitar a busca a tais arquivos mais prováveis de coincidirem com a amostra da consulta. Existem várias formas possíveis de se designar probabilidades e de ordenar as músicas na base de dados, todas das quais se encontram dentro do escopo da presente invenção. De preferência, probabilidades são designadas com base na recência ou na frequência de serem identificadas como o arquivo de som vencedor. A recência é uma medida útil, particularmente para músicas populares, uma vez que os interesses musicais mudam muito rapidamente com o tempo, à medida que novas músicas são lançadas. Após as marcações de probabilidades serem computadas, classificações são designadas aos arquivos, e a lista auto ordena pela classificação. A lista ordenada é então segmentada em dois ou mais subconjuntos para busca. Menor subconjunto pode conter um número de arquivos predeterminado. Por exemplo, se a classificação localizar um arquivo dentro do topo, digamos, os 1000 primeiros arquivos, então o arquivo é colocado na menor busca e mais rápida. Altemativamente, os pontos de corte para os dois subconjuntos podem ser ajustados dinamicamente. Por exemplo, todos arquivos com uma marcação excedendo um valor limiar particular podem ser colocados dentro do primeiro subconjunto, e desse modo o número de arquivos em cada subconjunto muda de forma contínua.
Um jeito particular de computar a probabilidade é incrementar uma marcação do arquivo de som por um, cada vez que o mesmo é identificado como uma coincidência para a amostra da consulta. Para levar a recência em consideração, todas daquelas marcações são reduzidas periodicamente de modo descendente, de modo que consultas mais recentes tenham um efeito mais forte na classificação do que consultas mais antigas. Por exemplo, todas marcações podem ser ajustadas descendentemente por um fator de multiplicação constante no momento de cada consulta, resultando em uma diminuição exponencial da marcação se não for atualizada. Dependendo do número de arquivos na base de dados, que pode ser facilmente de um milhão, esse método pode requerer a atualização de um grande número de marcações em cada consulta, tomando a mesma potencialmente indesejável. Altemativamente, as marcações podem ser ajustadas de forma descendente em intervalos relativamente infrequentes, tais como uma vez por dia. O resultado da ordenação do ajuste menos frequente é efetivamente similar, mas não tão idêntico, à ordenação resultante do ajuste com cada consulta. Contudo, a carga de computação para atualizar as classificações é muito menor.
Uma leve variação desse ajuste de recência, que preserva mais exatamente a marcação de recência, é adicionar uma atualização de marcação exponencialmente crescente d ao arquivo de som vencedor mediante consulta “query”, onde té a quantidade de tempo que passou desde a última atualização global. Todas as marcações são então ajustadas para baixo pela divisão por aT em cada atualização global, onde Té o tempo total que passou desde a última atualização global. Nesta variação, a é um fator de recência que é superior a um.
Em adição à classificação descrita acima, algum conhecimento a priori pode ser introduzido para auxiliar a semear a listagem. Por exemplo, novos lançamentos devem ter números mais altos de consultas do que músicas antigas. Assim, novos lançamentos podem ser colocados automaticamente no primeiro subconjunto contendo sons com uma maior probabilidade de coincidir consultas. Isso pode ser executado independentemente do algoritmo de auto-classificação descrito acima. Se a característica de autoclassificação também for utilizada, novos lançamentos podem ser designados com classificações iniciais que colocam as mesmas em algum lugar dentro do primeiro subconjunto. Os novos lançamentos podem ser semeados no topo da lista, no fundo da lista de músicas de maior probabilidade, ou em algum lugar entre os mesmos. Para os fins da busca, a localização inicial não importa, já que a classificação converge com o tempo para refletir o verdadeiro nível de interesse.
Em uma modalidade alternativa, a busca é realizada na ordem das classificações de recência e é encerrada quando uma marcação sound_ID excede um valor limiar predeterminado. Isso é equivalente ao método acima, no qual cada segmento contém um sound_ID apenas. Experimentos ilustram que a marcação de um som vencedor é muito mais alta do que marcações de todos os outros arquivos de som, e, dessa forma, um limiar adequado pode ser escolhido com a experimentação mínima. Uma forma de se implementar essa modalidade é a de classificar todos os sound_IDs no índice de base de dados de acordo com a recência, com um desempate arbitrário no caso de marcações idênticas. Uma vez que cada classificação de recência é singular, existe um mapeamento de um para um entre a marcação de recência e aquele sound_ID. A classificação pode então ser usada, em vez do sound_ID, quando ordenando por sound_ID para formar a lista de sound_IDs candidatas e listas de dispersão associadas (figura 9C). Os números das classificações podem ser limitados ao índice quando a lista de índice de tríplices (impressão digital, marco, sound_ID) é gerada e antes da lista de índice ser ordenada numa lista de índice principal. A classificação então toma o lugar daquele sound_ID. Altemativamente, uma função de busca e de substituição pode ser utilizada para substituir o sound_ID com a classificação. À medida que ditas classificações são atualizadas, novas classificações são mapeadas nas classificações antigas, desde que a integridade de mapeamento seja mantida.
Altemativamente, as classificações podem ser limitadas depois no processo. Uma vez que as listas de dispersão são criadas, uma classificação pode ser associada com cada sound_ID. Os conjuntos são então ordenados por classificação. Nessa implementação, só os apontadores das listas de dispersão precisam ser modificados; o agrupamento nas listas de dispersão não precisa ser repetido. A vantagem de uniões posteriores é que todo o índice de base de dados não precisa ser recriado toda vez que as classificações são atualizadas.
Note-se que a classificação na lista de popularidade pode por si só ser de interesse como um objeto de valor econômico. Isto é, tal classificação reflete o desejo dos consumidores de obter uma identificação de uma amostra de música desconhecida. Em muitos casos, a consulta é criada por um desejo de se comprar uma gravação da música. De fato, se a informação demográfica sobre o usuário é conhecida, então os esquemas de classificação alternativos podem ser implementados para cada grupo demográfico desejado. Um grupo demográfico de usuário pode ser obtido daquela informação de perfil solicitada quando o usuário se inscreve no serviço de reconhecimento. Isso também pode ser determinado dinamicamente por técnicas de filtragem colaborativa padrão.
Em um sistema em tempo real, o som é fornecido ao sistema de reconhecimento de maneira incrementai ao longo do tempo, possibilitando o reconhecimento canalizado. Neste caso, é possível processar o dado que entra em segmentos e atualizar o conjunto de índices de amostra de modo incrementai. Após cada período de atualização, o conjunto de índices recém aumentado é utilizado para recuperar gravações de som da biblioteca candidata utilizando as etapas de busca e varredura acima. Tal índice de base de dados é buscado para impressões digitais que coincidem com impressões digitais de amostras recém obtidas, e as novas tríplices (marcok, marco*j, sound_IDj) são geradas. Novos pares são acrescentados às listas de dispersão, e os histogramas são aumentados. A vantagem de dita abordagem é que se dados suficientes forem coletados para identificar gravação de som de modo não ambíguo, por exemplo, se o número de pontos num compartimento de desvio de um dos arquivos de som exceder um limiar alto ou exceder a próxima marcação de arquivo de som mais alta, então a aquisição de dados pode ser encerrada e resultado anunciado.
Uma vez que o som correto tem sido identificado, o resultado é reportado para um usuário ou o sistema por qualquer método adequado. Por exemplo, o resultado pode ser reportado por um impresso de computador, e-mail, página de resultado de busca na rede, mensagem de texto SMS (serviço de envio de mensagens curtas) para um telefone móvel, anotação de voz gerada por computador através de um telefone, ou postagem do resultado em um site da rede ou conta da Internet que o usuário possa acessar depois. Os resultados reportados podem incluir informação de identificação do som tal como o nome do artista de uma música; o nome do compositor, e atributos de gravação (por exemplo, intérpretes, regentes, “venue”) de uma peça clássica; a companhia e o produto de um anúncio; ou quaisquer outros identificadores adequados. Ademais, informação biográfica, informação sobre concertos na cercania, e outra informação de interesse para fãs podem ser providas; hyperlinks para tais dados podem ser providos. Os resultados relatados também podem incluir a marcação absoluta do arquivo de som ou sua marcação em comparação com o próximo mais elevado arquivo marcado.
Um resultado útil do método de reconhecimento é que isto não confunde duas rendições diferentes do mesmo som. Por exemplo, diferentes execuções da mesma peça de música clássica não são consideradas as mesmas, mesmo se um ser humano não conseguir detectar uma diferença entre as duas. Isso é pelo fato de ser altamente improvável que os pares de marco/impressão digital e evolução delas no tempo coincidam exatamente para duas execuções diferentes. Numa modalidade atual, os pares de marco/impressão digital devem estar em cerca de 10 ms um do outro para que uma correspondência linear seja identificada. Como resultado, reconhecimento automático efetuado pela invenção toma possível que a execução/trilha sonora adequada e o artista/legenda sejam creditados em todos os casos.
Implementação Exemplar Uma implementação preferencial da invenção, reconhecí mento de áudio de janela deslizante contínua, está descrita abaixo. Um microfone ou outra fonte de som é eontinuamente amostrado num armazenamento temporário “buffer” para obter um registro dos N segundos anteriores do som. O conteúdo do armazenamento temporário do som é periodicamente analisado para garantir a identidade do conteúdo do som. O armazenamento temporário do som pode ter um tamanho fixo ou pode crescer em termo de tamanho à medida que o som é amostrado, referido aqui como segmentos sequencialmente crescentes daquela amostra de áudio. Um relatório é feito para indicar a presença de gravações de som identificadas. Por exemplo, um arquivo de registro "log” pode ser coletado, ou uma exibição pode ser mostrada em um dispositivo indicando informações sobre a música, tal como o título, o artista, a arte da capa do álbum, letras, ou informações de compra. Para evitar redundância, um relatório pode ser criado apenas quando a identidade do som reconhecido mudar, por exemplo, depois de uma mudança do programa num juke-box. Um dispositivo desse tipo pode ser usado para criar uma lista de músicas tocadas a partir de qualquer corrente de som (rádio, rádio “streaming” pela Internet, microfone escondido, chamada telefônica, etc.). Além da identidade musical, informação tal como o tempo de reconhecimento pode ser registrado. Se dita informação de localização estiver disponível (por exemplo, via GPS), tal informação também pode ser registrada.
Para realizar a identificação, cada “buffer” pode ser identificado cie novo, Altemativamente, parâmetros de som podem ser extraídos, por exemplo, em impressões digitais ou outras formas extraídas de característica intermediária, earmazenados em um segundo “buffer”. Novas impressões digitais podem ser adicionadas à frente do segundo "buffer”, com as impressões digitais amigas sendo descartadas do terminal do “buffer”. A vantagem de um esquema do tipo “buffer” de rolagem como este é que a mesma análise não precisa ser efetuada de modo redundante em segmentos de sobreposição antigos de amostras de som, economizando desta forma esforço de computação. O processo de identificação é periodicamente feito sobre o conteúdo do “buffer” de rolagem de impressão digital. No caso de um dispositivo portátil pequeno, a análise de impressão digital pode ser efetuada no dispositivo e os resultados transmitidos para um servidor de reconhecimento que usa um canal de dados de largura de banda relativamente baixa, já que a corrente de impressão digital não é muito intensa em termos de dados. Aquele “buffer” de rolagem de impressão digital pode ser mantido no dispositivo portátil e transferido para o servidor de reconhecimento a cada vez, ou pode ser mantido no servidor de reconhecimento, caso no qual uma sessão de reconhecimento contínua é armazenada temporariamente no servidor.
Num sistema de reconhecimento de “buffer” de rolagem desse tipo, novas gravações de sons podem ser reconhecidas tão logo a informação suficiente estiver disponível para reconhecimento. Informação suficiente pode ocupar menos do que o comprimento do “buffer”. Por exemplo, se uma música distintiva puder ser reconhecida unicamente após um segundo de reprodução, e o sistema tiver uma periodicidade de reconhecimento de um segundo, então a música pode ser reconhecida imediatamente, embora o “buffer” possa ter uma duração de 15-30 segundos.Por outro lado,se uma música menos distintiva exigir mais segundos de amostra para reconhecê-la, o sistema deve aguardar um período mais longo antes de declarar, enfim, a identidade da música. Nesse esquema de reconhecimento de janela deslizante, músicas são reconhecidas assim que elas puderem ser identificadas. ✓ E importante notar que, enquanto a presente invenção tem sido descrita no contexto de um sistema e um método de reconhecimento totalmente funcional, os versados na técnica irão apreciar que o mecanismo da invenção é capaz de ser distribuído na forma de meio legível por computador de instruções em várias formas, e que a invenção é aplicável igualmente, independentemente do tipo particular da mídia que porta sinal usado para efetuar de fato a distribuição.
Exemplos de tais dispositivos acessíveis por computador incluem memória de computador (RAM ou ROM), discos flexíveis, e CD-ROMs, assim como uma mídia tipo transmissão tal como enlaces de comunicações digitais e analógicas.

Claims (28)

1. Método para reconhecer uma amostra de áudio, caracterizado pelo fato de compreender as etapas de: (a) para a amostra, gerar pares de marcos/impressões digitais de amostras, em que cada marco ocorre em uma localização particular no tempo dentro da amostra de áudio, a localização sendo computada na dependência do conteúdo da amostra de áudio, e em que cada impressão digital caracteriza uma ou mais características da amostra de áudio na ou perto da localização particular; (b) para cada um de um ou mais arquivos de áudio, gerar uma lista de pares de correspondência de marco; (c) identificar correspondências substancialmente lineares entre os respectivos pares de marcos/impressões digitais de amostras e os pares de marcos/impressões digitais de arquivos gerados previamente; e (d) identificar um arquivo vencedor, tal como aquele que possui um número significativo de correspondências substancialmcnte lineares.
2. Método de acordo com a reivindicação 1, caracterizado pelo fato de incluir um estágio de geração de impressão digital de arquivo, no qual para cada um dentre um ou mais arquivos de áudio, pares de marcos/impressões digitais de arquivos são gerados, em que cada marco ocorre numa localização particular no tempo dentro do arquivo de áudio, a localização sendo computada na dependência do conteúdo do arquivo de áudio, e em que cada impressão digital caracteriza urna ou mais características do arquivo de áudio na ou perto da localização particular.
3. Método de acordo com a reivindicação 1 ou 2, caracterizado pelo fato de cada impressão digital representar um número de características do áudio em cada localização de marco, ou desviar levemente da localização.
4. Método de acordo com qualquer uma das reivindicações I a 3, caracterizado pelo fato de cada impressão digital ser computada por meio de um método de modo que seja invariável a prolongamento de tempo da amostra.
5. Método de acordo com qualquer uma das reivindicações 1 a 4, caracterizado pelo fato de cada impressão digital ser calculada como uma de uma impressão digital de fatia espectral, uma impressão digital de múltiplas fatias, um coeficiente LPC, um coeficiente “cepstral”, e um componente de frequência de picos de espectrograma.
6. Método de acordo com a reivindicação 5, caracterizado pelo fato de que uma impressão digital de fatia espectral é calculada num conjunto de desvios de tempo para um ponto de tempo do marco.
7. Método de acordo com qualquer uma das reivindicações 1 a 6, caracterizado pelo fato de que a posição de cada marco é identificada usando um método de formação de marcos que encontra as localizações distintivas e reproduzíveis dentro da gravação de som.
8. Método de acordo com a reivindicação 7, caracterizado pelo fato de que o método de formação de marcos usa uma norma Lp espectral para calcular a energia instantânea em cada ponto de tempo possível na gravação e seleciona máxima local como os marcos.
9. Método de acordo com a reivindicação 7 ou 8, caracterizado pelo fato de que um ou mais marco(s) éum marco de múltiplas fatias derivado de componentes espectrais através de múltiplos intervalos de tempo em desvios fixos ou variáveis um do outro.
10. Método de acordo com qualquer uma das reivindicações 1 a 9, caracterizado pelo fato de os pares de marcos/impressões digitais de arquivos estarem armazenados numa base de dados, cada arquivo dentro da base de dados sendo indexado por impressões digitais daquele arquivo.
11. Método de acordo com a reivindicação 10, caracterizado pelo fato de que os índices são ordenados de acordo com a impressão digital.
12. Método de acordo com a reivindicação 11, caracterizado pelo fato de uma lista de índice principal ser compilada tendo uma entrada para cada impressão digital única e apontador para uma lista de marcos correspondentes.
13. Método de acordo com qualquer uma das reivindicações 10 a 12, caracterizado pelo fato de cada arquivo ser identificado por um sound_ID, e a base de dados armazenar uma pluralidade de impressões digitais, marcos, tríplices de sound_ID.
14. Método de acordo com qualquer uma das reivindicações 1 a 13, caracterizado pelo fato de que o arquivo, com os pares de correspondência mais significativos estatisticamente e relacionados linearmente, é selecionado como o arquivo vencedor.
15. Método de acordo com qualquer uma das reivindicações 1 a 14, caracterizado pelo fato de que uma correspondência linear entre amostra e marcos de arquivo (marcon, marco*n) ocorre quando um par de marco/impressão digital de amostra coincide com um par de marco/impressão digital de arquivo dentro de uma faixa de tolerância.
16. Método de acordo com qualquer uma das reivindicações 1 a 15, caracterizado pelo fato de que uma correspondência linear entre um par de marco/impressão digital de amostra e um par de marco/impressão digital de arquivo ocorre quando as respectivas impressões digitais são coincididas e os respectivos marcos são relacionados por uma relação linear.
17. Método de acordo com a reivindicação 16, caracterizado pelo fato de que tais impressões digitais são coincididas quando elas forem idênticas ou diferirem dentro de uma tolerância previamente determinada.
18. Método de acordo com a reivindicação 16 ou reivindicação 17, caracterizado pelo fato de que uma correspondência linear ocorre se o par de amostra/marco de arquivo (marcon, marco*n) dentro da lista está relacionado de acordo com a relação: marco*n = m*marcOn + desvio.
19. Método de acordo com qualquer uma das reivindicações 1 a 18, caracterizado pelo fato de que a amostra está na forma de ondas acústicas, ondas de rádio, uma corrente PCM de áudio digital, uma corrente comprimida de áudio digital, ou uma difusão de “streaming” pela Internet.
20. Método de acordo com qualquer uma das reivindicações 1 a 19, caracterizado pelo fato de que ditas impressões digitais de amostras estão armazenadas num “buffer” de rolagem.
21. Método de acordo com a reivindicação 20, caracterizado pelo fato de que a etapa de identificar pode ser executada periodicamente sobre os conteúdos do “buffer” de rolagem de impressão digital.
22. Método de acordo com a reivindicação 20 ou reivindicação 21, caracterizado pelo fato de a etapa de identificar poder ser executada assim que informação suficiente esteja disponível no “buffer” para reconhecimento.
23. Método de acordo com qualquer uma das reivindicações 1 a 22, caracterizado pelo fato de a etapa de identificar ser primeiro realizada num subconjunto de arquivos, e caso nenhum arquivo vencedor seja identificado no primeiro subconjunto, um segundo subconjunto contendo os arquivos restantes é buscado.
24. Método de acordo com a reivindicação 23, caracterizado pelo fato de que o primeiro subconjunto contém arquivos que possuem uma maior probabilidade a priori ou empírica de serem identificados do que os arquivos que não estão no primeiro subconjunto.
25. Método de acordo com a reivindicação 1, caracterizado pelo fato de tal etapa de identificar correspondências lineares compreender localizar uma linha em diagonal dentro de um diagrama de dispersão de tais localizações correspondentes formando-se diferenças entre tais localizações correspondentes e calculando-se um pico de um histograma de tais diferenças.
26. Método de acordo com a reivindicação 1, caracterizado pelo fato de a etapa de identificar um arquivo vencedor compreender adicionahnente prover um indicador de um desvio a uma localização no dito arquivo vencedor onde o número significativo de correspondências ocorrem.
27. Método de acordo com a reivindicação 1, caracterizado pelo fato de que as ditas etapas (a) até (d) do método são realizadas em um servidor, e em que o dito método compreende ainda as etapas de: em resposta a uma solicitação de um cliente, retransmitir pelo menos uma porção da amostra de áudio para o servidor; e em resposta ao dito servidor, identificar um arquivo vencedor, respondendo ao dito cliente consequentemente.
28. Sistema de computador para realizar um método conforme definido em qualquer uma das reivindicações 1 a 27, caracterizado pelo fato de incluir um terminal de cliente que envia um sumário extraído de característica da amostra de sinal capturada contendo pares de marcos e impressões digitais para um terminal de servidor, o qual realiza o reconhecimento.
BRPI0112901A 2000-07-31 2001-07-26 métodos para reconhecer uma amostra de áudio, e, sistema de computador para realizar o mesmo BRPI0112901B1 (pt)

Applications Claiming Priority (3)

Application Number Priority Date Filing Date Title
US22202300P 2000-07-31 2000-07-31
US09/839,476 US6990453B2 (en) 2000-07-31 2001-04-20 System and methods for recognizing sound and music signals in high noise and distortion
PCT/EP2001/008709 WO2002011123A2 (en) 2000-07-31 2001-07-26 Method for search in an audio database

Publications (2)

Publication Number Publication Date
BR0112901A BR0112901A (pt) 2003-06-10
BRPI0112901B1 true BRPI0112901B1 (pt) 2015-12-22

Family

ID=26916372

Family Applications (1)

Application Number Title Priority Date Filing Date
BRPI0112901A BRPI0112901B1 (pt) 2000-07-31 2001-07-26 métodos para reconhecer uma amostra de áudio, e, sistema de computador para realizar o mesmo

Country Status (13)

Country Link
US (9) US6990453B2 (pt)
EP (1) EP1307833B1 (pt)
JP (1) JP4945877B2 (pt)
KR (1) KR100776495B1 (pt)
CN (1) CN1592906B (pt)
AT (1) ATE329319T1 (pt)
AU (1) AU2001289766A1 (pt)
BR (1) BRPI0112901B1 (pt)
DE (1) DE60120417T2 (pt)
DK (1) DK1307833T3 (pt)
ES (1) ES2266254T3 (pt)
PT (1) PT1307833E (pt)
WO (1) WO2002011123A2 (pt)

Families Citing this family (789)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US6449377B1 (en) * 1995-05-08 2002-09-10 Digimarc Corporation Methods and systems for watermark processing of line art images
US6560349B1 (en) * 1994-10-21 2003-05-06 Digimarc Corporation Audio monitoring using steganographic information
US7362775B1 (en) * 1996-07-02 2008-04-22 Wistaria Trading, Inc. Exchange mechanisms for digital information packages with bandwidth securitization, multichannel digital watermarks, and key management
US6760463B2 (en) * 1995-05-08 2004-07-06 Digimarc Corporation Watermarking methods and media
US7805500B2 (en) * 1995-05-08 2010-09-28 Digimarc Corporation Network linking methods and apparatus
US7224819B2 (en) 1995-05-08 2007-05-29 Digimarc Corporation Integrating digital watermarks in multimedia content
US5613004A (en) * 1995-06-07 1997-03-18 The Dice Company Steganographic method and device
US7711564B2 (en) * 1995-07-27 2010-05-04 Digimarc Corporation Connected audio and other media objects
US7289643B2 (en) 2000-12-21 2007-10-30 Digimarc Corporation Method, apparatus and programs for generating and utilizing content signatures
US7562392B1 (en) * 1999-05-19 2009-07-14 Digimarc Corporation Methods of interacting with audio and ambient music
US6965682B1 (en) 1999-05-19 2005-11-15 Digimarc Corp Data transmission by watermark proxy
US6829368B2 (en) * 2000-01-26 2004-12-07 Digimarc Corporation Establishing and interacting with on-line media collections using identifiers in media signals
US6411725B1 (en) * 1995-07-27 2002-06-25 Digimarc Corporation Watermark enabled video objects
US7006661B2 (en) 1995-07-27 2006-02-28 Digimarc Corp Digital watermarking systems and methods
US6505160B1 (en) * 1995-07-27 2003-01-07 Digimarc Corporation Connected audio and other media objects
US7664263B2 (en) 1998-03-24 2010-02-16 Moskowitz Scott A Method for combining transfer functions with predetermined key creation
US6205249B1 (en) * 1998-04-02 2001-03-20 Scott A. Moskowitz Multiple transform utilization and applications for secure digital watermarking
US5889868A (en) 1996-07-02 1999-03-30 The Dice Company Optimization methods for the insertion, protection, and detection of digital watermarks in digitized data
US7177429B2 (en) 2000-12-07 2007-02-13 Blue Spike, Inc. System and methods for permitting open access to data objects and for securing data within the data objects
US7095874B2 (en) 1996-07-02 2006-08-22 Wistaria Trading, Inc. Optimization methods for the insertion, protection, and detection of digital watermarks in digitized data
US7159116B2 (en) 1999-12-07 2007-01-02 Blue Spike, Inc. Systems, methods and devices for trusted transactions
US7346472B1 (en) 2000-09-07 2008-03-18 Blue Spike, Inc. Method and device for monitoring and analyzing signals
US7457962B2 (en) 1996-07-02 2008-11-25 Wistaria Trading, Inc Optimization methods for the insertion, protection, and detection of digital watermarks in digitized data
US7730317B2 (en) * 1996-12-20 2010-06-01 Wistaria Trading, Inc. Linear predictive coding implementation of digital watermarks
US7689532B1 (en) 2000-07-20 2010-03-30 Digimarc Corporation Using embedded data with file sharing
US7664264B2 (en) 1999-03-24 2010-02-16 Blue Spike, Inc. Utilizing data reduction in steganographic and cryptographic systems
GB9909362D0 (en) * 1999-04-23 1999-06-16 Pace Micro Tech Plc Memory database system for encrypted progarmme material
US7185201B2 (en) 1999-05-19 2007-02-27 Digimarc Corporation Content identifiers triggering corresponding responses
US7565294B2 (en) * 1999-05-19 2009-07-21 Digimarc Corporation Methods and systems employing digital content
US7302574B2 (en) * 1999-05-19 2007-11-27 Digimarc Corporation Content identifiers triggering corresponding responses through collaborative processing
US7013301B2 (en) * 2003-09-23 2006-03-14 Predixis Corporation Audio fingerprinting system and method
US20050038819A1 (en) * 2000-04-21 2005-02-17 Hicken Wendell T. Music Recommendation system and method
WO2001018628A2 (en) 1999-08-04 2001-03-15 Blue Spike, Inc. A secure personal content server
US8326584B1 (en) 1999-09-14 2012-12-04 Gracenote, Inc. Music searching methods based on human perception
US7174293B2 (en) * 1999-09-21 2007-02-06 Iceberg Industries Llc Audio identification system and method
US7194752B1 (en) 1999-10-19 2007-03-20 Iceberg Industries, Llc Method and apparatus for automatically recognizing input audio and/or video streams
US6671407B1 (en) 1999-10-19 2003-12-30 Microsoft Corporation System and method for hashing digital images
US6834308B1 (en) * 2000-02-17 2004-12-21 Audible Magic Corporation Method and apparatus for identifying media content presented on a media playing device
US20060217828A1 (en) * 2002-10-23 2006-09-28 Hicken Wendell T Music searching system and method
US8121843B2 (en) * 2000-05-02 2012-02-21 Digimarc Corporation Fingerprint methods and systems for media signals
US7853664B1 (en) * 2000-07-31 2010-12-14 Landmark Digital Services Llc Method and system for purchasing pre-recorded music
US6990453B2 (en) * 2000-07-31 2006-01-24 Landmark Digital Services Llc System and methods for recognizing sound and music signals in high noise and distortion
BR0107127A (pt) 2000-08-23 2002-07-02 Koninkl Philips Electronics Nv Método para aperfeiçoar a renderização de um item de conteúdo, sistema cliente configurado para aperfeiçoar a renderização de um item de conteúdo, e, sistema servidor configurado para facilitar uma renderização aperfeiçoada de um item de conteúdo
US8010988B2 (en) * 2000-09-14 2011-08-30 Cox Ingemar J Using features extracted from an audio and/or video work to obtain information about the work
US8205237B2 (en) 2000-09-14 2012-06-19 Cox Ingemar J Identifying works, using a sub-linear time search, such as an approximate nearest neighbor search, for initiating a work-based action, such as an action on the internet
US7127615B2 (en) 2000-09-20 2006-10-24 Blue Spike, Inc. Security based on subliminal and supraliminal channels for data objects
JP2002108350A (ja) * 2000-09-28 2002-04-10 Internatl Business Mach Corp <Ibm> 音楽配信のための方法及びシステム
US8122236B2 (en) 2001-10-24 2012-02-21 Aol Inc. Method of disseminating advertisements using an embedded media player page
DE60137454D1 (de) 2000-10-24 2009-03-05 Aol Llc Verfahren zur bemessung der seite einer eingebetteten medienabspielvorrichtung
WO2002056139A2 (en) 2000-10-26 2002-07-18 Digimarc Corporation Method and system for internet access
FR2816157A1 (fr) * 2000-10-31 2002-05-03 Thomson Multimedia Sa Procede de traitement de donnees video distinees a etre visualisees sur ecran et dispositif mettant en oeuvre le procede
US20020103920A1 (en) * 2000-11-21 2002-08-01 Berkun Ken Alan Interpretive stream metadata extraction
US20020072982A1 (en) 2000-12-12 2002-06-13 Shazam Entertainment Ltd. Method and system for interacting with a user in an experiential environment
US20020091761A1 (en) * 2001-01-10 2002-07-11 Lambert James P. Technique of generating a composite media stream
KR100893671B1 (ko) * 2001-02-12 2009-04-20 그레이스노트, 인크. 멀티미디어 콘텐트의 해시들의 생성 및 매칭
WO2003005242A1 (en) * 2001-03-23 2003-01-16 Kent Ridge Digital Labs Method and system of representing musical information in a digital representation for use in content-based multimedia information retrieval
US7363278B2 (en) 2001-04-05 2008-04-22 Audible Magic Corporation Copyright detection and protection system and method
US7248715B2 (en) * 2001-04-06 2007-07-24 Digimarc Corporation Digitally watermarking physical media
DE10117871C1 (de) * 2001-04-10 2002-07-04 Fraunhofer Ges Forschung Verfahren und Vorrichtung zum Extrahieren einer Signalkennung, Verfahren und Vorrichtung zum Erzeugen einer Datenbank aus Signalkennungen und Verfahren und Vorrichtung zum Referenzieren eines Such-Zeitsignals
US6975743B2 (en) * 2001-04-24 2005-12-13 Microsoft Corporation Robust and stealthy video watermarking into regions of successive frames
US6996273B2 (en) * 2001-04-24 2006-02-07 Microsoft Corporation Robust recognizer of perceptually similar content
US7020775B2 (en) * 2001-04-24 2006-03-28 Microsoft Corporation Derivation and quantization of robust non-local characteristics for blind watermarking
US7356188B2 (en) * 2001-04-24 2008-04-08 Microsoft Corporation Recognizer of text-based work
US7421376B1 (en) * 2001-04-24 2008-09-02 Auditude, Inc. Comparison of data signals using characteristic electronic thumbprints
US6973574B2 (en) * 2001-04-24 2005-12-06 Microsoft Corp. Recognizer of audio-content in digital signals
US7046819B2 (en) * 2001-04-25 2006-05-16 Digimarc Corporation Encoded reference signal for digital watermarks
US7962482B2 (en) * 2001-05-16 2011-06-14 Pandora Media, Inc. Methods and systems for utilizing contextual feedback to generate and modify playlists
KR20040024870A (ko) * 2001-07-20 2004-03-22 그레이스노트 아이엔씨 음성 기록의 자동 확인
US8972481B2 (en) 2001-07-20 2015-03-03 Audible Magic, Inc. Playlist generation method and apparatus
EP1421521A2 (en) * 2001-07-31 2004-05-26 Gracenote, Inc. Multiple step identification of recordings
US6724914B2 (en) 2001-10-16 2004-04-20 Digimarc Corporation Progressive watermark decoding on a distributed computing platform
US7035867B2 (en) * 2001-11-28 2006-04-25 Aerocast.Com, Inc. Determining redundancies in content object directories
US20050010604A1 (en) 2001-12-05 2005-01-13 Digital Networks North America, Inc. Automatic identification of DVD title using internet technologies and fuzzy matching techniques
US7020304B2 (en) 2002-01-22 2006-03-28 Digimarc Corporation Digital watermarking and fingerprinting including synchronization, layering, version control, and compressed embedding
KR20040086350A (ko) 2002-02-05 2004-10-08 코닌클리케 필립스 일렉트로닉스 엔.브이. 핑거프린트의 효율적 저장
WO2003084196A1 (en) * 2002-03-28 2003-10-09 Martin Dunsmuir Closed-loop command and response system for automatic communications between interacting computer systems over an audio communications channel
US7287275B2 (en) 2002-04-17 2007-10-23 Moskowitz Scott A Methods, systems and devices for packet watermarking and efficient provisioning of bandwidth
CN1685735A (zh) 2002-04-22 2005-10-19 尼尔逊媒介研究股份有限公司 采集与媒体显示相关的观众信息的方法和装置
PT1504445E (pt) * 2002-04-25 2008-11-24 Landmark Digital Services Llc Emparelhamento de padrões áudio robusto e invariante
US7987491B2 (en) * 2002-05-10 2011-07-26 Richard Reisman Method and apparatus for browsing using alternative linkbases
JP2005525600A (ja) * 2002-05-10 2005-08-25 コーニンクレッカ フィリップス エレクトロニクス エヌ ヴィ 透かしの埋め込み及び取り出し
US7824029B2 (en) * 2002-05-10 2010-11-02 L-1 Secure Credentialing, Inc. Identification card printer-assembler for over the counter card issuing
US7421096B2 (en) * 2004-02-23 2008-09-02 Delefevre Patrick Y Input mechanism for fingerprint-based internet search
US7461392B2 (en) * 2002-07-01 2008-12-02 Microsoft Corporation System and method for identifying and segmenting repeating media objects embedded in a stream
US7006703B2 (en) * 2002-06-28 2006-02-28 Microsoft Corporation Content recognizer via probabilistic mirror distribution
US7095873B2 (en) 2002-06-28 2006-08-22 Microsoft Corporation Watermarking via quantization of statistics of overlapping regions
WO2004004351A1 (en) * 2002-07-01 2004-01-08 Microsoft Corporation A system and method for providing user control over repeating objects embedded in a stream
US7949689B2 (en) * 2002-07-18 2011-05-24 Accenture Global Services Limited Media indexing beacon and capture device
DE10232916B4 (de) * 2002-07-19 2008-08-07 Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. Vorrichtung und Verfahren zum Charakterisieren eines Informationssignals
US7239981B2 (en) 2002-07-26 2007-07-03 Arbitron Inc. Systems and methods for gathering audience measurement data
US20030191764A1 (en) * 2002-08-06 2003-10-09 Isaac Richards System and method for acoustic fingerpringting
US9711153B2 (en) 2002-09-27 2017-07-18 The Nielsen Company (Us), Llc Activating functions in processing devices using encoded audio and detecting audio signatures
KR100872191B1 (ko) * 2002-09-27 2008-12-09 인터내셔널 비지네스 머신즈 코포레이션 발표 하이퍼링크 타임 테이블 생성 방법, 발표 처리 방법, 컴퓨팅 시스템 및 컴퓨터 판독가능한 기록 매체
US8959016B2 (en) 2002-09-27 2015-02-17 The Nielsen Company (Us), Llc Activating functions in processing devices using start codes embedded in audio
KR20050046815A (ko) * 2002-09-30 2005-05-18 코닌클리케 필립스 일렉트로닉스 엔.브이. 지문 추출
US7171561B2 (en) * 2002-10-17 2007-01-30 The United States Of America As Represented By The Secretary Of The Air Force Method and apparatus for detecting and extracting fileprints
SE524936C2 (sv) * 2002-10-23 2004-10-26 Softhouse Nordic Ab Mobil likhetsbedömning av objekt
KR20050061594A (ko) * 2002-11-01 2005-06-22 코닌클리케 필립스 일렉트로닉스 엔.브이. 개선된 오디오 데이터 지문 검색
AU2003274545A1 (en) * 2002-11-12 2004-06-03 Koninklijke Philips Electronics N.V. Fingerprinting multimedia contents
JP4172259B2 (ja) * 2002-11-26 2008-10-29 ソニー株式会社 情報処理装置および方法、並びにコンピュータ・プログラム
US6958103B2 (en) * 2002-12-23 2005-10-25 Kimberly-Clark Worldwide, Inc. Entangled fabrics containing staple fibers
AU2003234420A1 (en) 2002-12-27 2004-07-29 Nielsen Media Research, Inc. Methods and apparatus for transcoding metadata
ES2308135T3 (es) * 2003-01-06 2008-12-01 Pace Plc Agente de registro en tiempo real para datos emitidos por internet.
US7593915B2 (en) * 2003-01-07 2009-09-22 Accenture Global Services Gmbh Customized multi-media services
EP2456104A1 (en) 2003-02-10 2012-05-23 Nielsen Media Research, Inc. Methods and apparatus to adaptively gather audience measurement data
US7606790B2 (en) * 2003-03-03 2009-10-20 Digimarc Corporation Integrating and enhancing searching of media content and biometric databases
WO2004084182A1 (en) * 2003-03-15 2004-09-30 Mindspeed Technologies, Inc. Decomposition of voiced speech for celp speech coding
US20060235864A1 (en) * 2005-04-14 2006-10-19 Apple Computer, Inc. Audio sampling and acquisition system
WO2004107132A2 (en) * 2003-05-28 2004-12-09 Caymas Systems, Inc. Method, system and software for state signing of internet resources
WO2005113099A2 (en) 2003-05-30 2005-12-01 America Online, Inc. Personalizing content
US20040237759A1 (en) * 2003-05-30 2004-12-02 Bill David S. Personalizing content
CN1820511A (zh) 2003-07-11 2006-08-16 皇家飞利浦电子股份有限公司 用于生成并探测多媒体信号中起到触发标记作用的指纹的方法和设备
US7505964B2 (en) 2003-09-12 2009-03-17 Google Inc. Methods and systems for improving a search ranking using related queries
US7454417B2 (en) * 2003-09-12 2008-11-18 Google Inc. Methods and systems for improving a search ranking using population information
EP1668903A4 (en) * 2003-09-12 2011-01-05 Nielsen Media Res Inc DEVICES AND METHOD FOR DIGITAL VIDEO SIGNATURES FOR USE WITH VIDEO PROGRAM IDENTIFICATION SYSTEMS
US7715934B2 (en) * 2003-09-19 2010-05-11 Macrovision Corporation Identification of input files using reference files associated with nodes of a sparse binary tree
JP4328169B2 (ja) * 2003-10-02 2009-09-09 オリンパス株式会社 データ処理装置
US7383174B2 (en) * 2003-10-03 2008-06-03 Paulin Matthew A Method for generating and assigning identifying tags to sound files
WO2005041109A2 (en) * 2003-10-17 2005-05-06 Nielsen Media Research, Inc. Methods and apparatus for identifiying audio/video content using temporal signal characteristics
US7379875B2 (en) * 2003-10-24 2008-05-27 Microsoft Corporation Systems and methods for generating audio thumbnails
US9053299B2 (en) 2003-11-03 2015-06-09 James W. Wieder Adaptive personalized playback or presentation using rating
US9098681B2 (en) 2003-11-03 2015-08-04 James W. Wieder Adaptive personalized playback or presentation using cumulative time
US20150128039A1 (en) 2003-11-03 2015-05-07 James W. Wieder Newness Control of a Personalized Music and/or Entertainment Sequence
US8396800B1 (en) 2003-11-03 2013-03-12 James W. Wieder Adaptive personalized music and entertainment
US7884274B1 (en) 2003-11-03 2011-02-08 Wieder James W Adaptive personalized music and entertainment
US8554681B1 (en) * 2003-11-03 2013-10-08 James W. Wieder Providing “identified” compositions and digital-works
US11165999B1 (en) 2003-11-03 2021-11-02 Synergyze Technologies Llc Identifying and providing compositions and digital-works
US9053181B2 (en) 2003-11-03 2015-06-09 James W. Wieder Adaptive personalized playback or presentation using count
US8001612B1 (en) 2003-11-03 2011-08-16 Wieder James W Distributing digital-works and usage-rights to user-devices
US8521725B1 (en) 2003-12-03 2013-08-27 Google Inc. Systems and methods for improved searching
US7831832B2 (en) * 2004-01-06 2010-11-09 Microsoft Corporation Digital goods representation based upon matrix invariances
JP4933899B2 (ja) * 2004-02-19 2012-05-16 ランドマーク、ディジタル、サーヴィセズ、エルエルシー 放送源の識別のための方法および装置
EP1730105B1 (en) 2004-02-26 2012-01-25 Mediaguide, inc. Method and apparatus for automatic detection and identification of broadcast audio or video programming signal
US7877810B2 (en) * 2004-03-02 2011-01-25 Rovi Solutions Corporation System, method and client user interface for a copy protection service
US7925657B1 (en) 2004-03-17 2011-04-12 Google Inc. Methods and systems for adjusting a scoring measure based on query breadth
US20050216512A1 (en) * 2004-03-26 2005-09-29 Rahav Dor Method of accessing a work of art, a product, or other tangible or intangible objects without knowing the title or name thereof using fractional sampling of the work of art or object
KR100967125B1 (ko) * 2004-03-26 2010-07-05 노키아 코포레이션 네트워크 휴대용 장치에서의 특징 추출
US7221902B2 (en) * 2004-04-07 2007-05-22 Nokia Corporation Mobile station and interface adapted for feature extraction from an input media sample
US20050215239A1 (en) * 2004-03-26 2005-09-29 Nokia Corporation Feature extraction in a networked portable device
WO2005101243A1 (en) * 2004-04-13 2005-10-27 Matsushita Electric Industrial Co. Ltd. Method and apparatus for identifying audio such as music
CN101142591A (zh) 2004-04-19 2008-03-12 兰德马克数字服务有限责任公司 内容采样和标识
KR20070004891A (ko) * 2004-04-29 2007-01-09 코닌클리케 필립스 일렉트로닉스 엔.브이. 오디오 신호의 분류를 위한 방법 빛 시스템
US7770014B2 (en) 2004-04-30 2010-08-03 Microsoft Corporation Randomized signal transforms and their applications
US7273978B2 (en) 2004-05-07 2007-09-25 Fraunhofer-Gesellschaft Zur Foerderung Der Angewandten Forschung E.V. Device and method for characterizing a tone signal
DE102004022659B3 (de) * 2004-05-07 2005-10-13 Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. Vorrichtung zum Charakterisieren eines Tonsignals
US7565213B2 (en) * 2004-05-07 2009-07-21 Gracenote, Inc. Device and method for analyzing an information signal
DE102004023436B4 (de) 2004-05-10 2006-06-14 M2Any Gmbh Vorrichtung und Verfahren zum Analysieren eines Informationssignals
US20050251455A1 (en) * 2004-05-10 2005-11-10 Boesen Peter V Method and system for purchasing access to a recording
US20150051967A1 (en) 2004-05-27 2015-02-19 Anonymous Media Research, Llc Media usage monitoring and measurment system and method
US20050267750A1 (en) * 2004-05-27 2005-12-01 Anonymous Media, Llc Media usage monitoring and measurement system and method
EP1774348B1 (en) * 2004-06-24 2018-08-08 Shazam Investments Limited Method of characterizing the overlap of two media segments
DE602005018776D1 (de) 2004-07-01 2010-02-25 Nippon Telegraph & Telephone System für detektionssektion mit einem bestimmten akustischen signal, verfahren und programm dafür
US20090138108A1 (en) * 2004-07-06 2009-05-28 Kok Keong Teo Method and System for Identification of Audio Input
US7873521B2 (en) * 2004-07-09 2011-01-18 Nippon Telegraph And Telephone Corporation Sound signal detection system, sound signal detection server, image signal search apparatus, image signal search method, image signal search program and medium, signal search apparatus, signal search method and signal search program and medium
JP5279270B2 (ja) 2004-08-06 2013-09-04 ディジマーク コーポレイション 携帯コンピューティング装置における高速信号検出および分散コンピューティング
US20060212149A1 (en) * 2004-08-13 2006-09-21 Hicken Wendell T Distributed system and method for intelligent data analysis
US7623823B2 (en) * 2004-08-31 2009-11-24 Integrated Media Measurement, Inc. Detecting and measuring exposure to media content items
DE102004046746B4 (de) * 2004-09-27 2007-03-01 Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. Verfahren zum Synchronisieren von Zusatzdaten und Basisdaten
US7826708B2 (en) * 2004-11-02 2010-11-02 Microsoft Corporation System and method for automatically customizing a buffered media stream
US7574451B2 (en) * 2004-11-02 2009-08-11 Microsoft Corporation System and method for speeding up database lookups for multiple synchronized data streams
DE602004024318D1 (de) * 2004-12-06 2010-01-07 Sony Deutschland Gmbh Verfahren zur Erstellung einer Audiosignatur
US20060135098A1 (en) * 2004-12-17 2006-06-22 Yarosz Matthew J Method and apparatus for processing digital broadcast audio in the AM/FM bands
US7567899B2 (en) * 2004-12-30 2009-07-28 All Media Guide, Llc Methods and apparatus for audio recognition
US7921369B2 (en) 2004-12-30 2011-04-05 Aol Inc. Mood-based organization and display of instant messenger buddy lists
US7451078B2 (en) * 2004-12-30 2008-11-11 All Media Guide, Llc Methods and apparatus for identifying media objects
DE602005021047D1 (de) * 2005-01-21 2010-06-17 Unltd Media Gmbh Vervahren zum Erzeugen eines Abdrucks eines Audiosignals
US7634405B2 (en) * 2005-01-24 2009-12-15 Microsoft Corporation Palette-based classifying and synthesizing of auditory information
CN101189658A (zh) * 2005-02-08 2008-05-28 兰德马克数字服务有限责任公司 音频信号中重复素材的自动识别
US20060224798A1 (en) * 2005-02-22 2006-10-05 Klein Mark D Personal music preference determination based on listening behavior
US7818350B2 (en) 2005-02-28 2010-10-19 Yahoo! Inc. System and method for creating a collaborative playlist
CA2644943A1 (en) * 2005-03-04 2006-09-14 Musicip Corporation Scan shuffle for building playlists
DE102005014477A1 (de) * 2005-03-30 2006-10-12 Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. Vorrichtung und Verfahren zum Erzeugen eines Datenstroms und zum Erzeugen einer Multikanal-Darstellung
WO2006112843A1 (en) * 2005-04-19 2006-10-26 Sean Ward Distributed acoustic fingerprint based recognition
US20090193033A1 (en) * 2005-05-19 2009-07-30 Zulfikar Amin Ramzan Method and apparatus for communication efficient private information retrieval and oblivious transfer
US20070016918A1 (en) * 2005-05-20 2007-01-18 Alcorn Allan E Detecting and tracking advertisements
US7613736B2 (en) * 2005-05-23 2009-11-03 Resonance Media Services, Inc. Sharing music essence in a recommendation system
KR20060133410A (ko) * 2005-06-20 2006-12-26 엘지전자 주식회사 복합 미디어 장치에서 파일 검색 및 파일 데이터베이스관리 방법
US20070028262A1 (en) * 2005-07-29 2007-02-01 Zermatt Systems, Inc. Virtual discovery of content available to a device
US20070033229A1 (en) * 2005-08-03 2007-02-08 Ethan Fassett System and method for indexing structured and unstructured audio content
US20070106405A1 (en) * 2005-08-19 2007-05-10 Gracenote, Inc. Method and system to provide reference data for identification of digital content
US7516074B2 (en) * 2005-09-01 2009-04-07 Auditude, Inc. Extraction and matching of characteristic fingerprints from audio signals
CN100367279C (zh) * 2005-09-08 2008-02-06 上海交通大学 数字音乐旋律的跨越式高速匹配装置
US7809943B2 (en) * 2005-09-27 2010-10-05 Rovi Solutions Corporation Method and system for establishing trust in a peer-to-peer network
US20070078708A1 (en) * 2005-09-30 2007-04-05 Hua Yu Using speech recognition to determine advertisements relevant to audio content and/or audio content relevant to advertisements
US20070076869A1 (en) * 2005-10-03 2007-04-05 Microsoft Corporation Digital goods representation based upon matrix invariants using non-negative matrix factorizations
RU2008118509A (ru) * 2005-10-13 2009-11-20 Конинклейке Филипс Электроникс Н.В. (Nl) Система удаленного информированного обнаружения водяных знаков
US9697230B2 (en) 2005-11-09 2017-07-04 Cxense Asa Methods and apparatus for dynamic presentation of advertising, factual, and informational content using enhanced metadata in search-driven media applications
US7801910B2 (en) 2005-11-09 2010-09-21 Ramp Holdings, Inc. Method and apparatus for timed tagging of media content
US20070118873A1 (en) * 2005-11-09 2007-05-24 Bbnt Solutions Llc Methods and apparatus for merging media content
US9697231B2 (en) * 2005-11-09 2017-07-04 Cxense Asa Methods and apparatus for providing virtual media channels based on media search
KR100803206B1 (ko) 2005-11-11 2008-02-14 삼성전자주식회사 오디오 지문 생성과 오디오 데이터 검색 장치 및 방법
US7844774B2 (en) * 2005-11-16 2010-11-30 Sun Microsystems, Inc. Extensible fingerprinting functions and content addressed storage system using the same
CA2634706A1 (en) * 2005-12-20 2007-06-28 Arbitron Inc. Methods and systems for conducting research operations
JP5016610B2 (ja) 2005-12-21 2012-09-05 ディジマーク コーポレイション ルール駆動パンidメタデータルーティングシステム及びネットワーク
US8086722B2 (en) 2005-12-21 2011-12-27 Rovi Solutions Corporation Techniques for measuring peer-to-peer (P2P) networks
US20070162761A1 (en) * 2005-12-23 2007-07-12 Davis Bruce L Methods and Systems to Help Detect Identity Fraud
US8254308B1 (en) * 2006-01-05 2012-08-28 Sprint Spectrum L.P. Method and system for acoustically triggering electronic coupon retrieval
US8108452B2 (en) * 2006-01-12 2012-01-31 Yahoo! Inc. Keyword based audio comparison
WO2007080764A1 (ja) * 2006-01-12 2007-07-19 Matsushita Electric Industrial Co., Ltd. 対象音分析装置、対象音分析方法および対象音分析プログラム
FR2897217A1 (fr) * 2006-02-03 2007-08-10 France Telecom Determination d'identificateur de signal
JP5277634B2 (ja) * 2006-02-08 2013-08-28 日本電気株式会社 音声合成装置、音声合成方法及びプログラム
KR100774585B1 (ko) * 2006-02-10 2007-11-09 삼성전자주식회사 변조 스펙트럼을 이용한 음악 정보 검색 방법 및 그 장치
US7653342B2 (en) * 2006-02-16 2010-01-26 Dell Products L.P. Providing content to a device when lost a connection to the broadcasting station
US20070196802A1 (en) * 2006-02-21 2007-08-23 Nokia Corporation Visually Enhanced Personal Music Broadcast
KR100788682B1 (ko) * 2006-03-03 2007-12-26 삼성전자주식회사 음원 컨텐츠 전송 서비스 제공 방법 및 장치
US8626707B2 (en) * 2006-03-15 2014-01-07 Beats Music, Llc Automatic meta-data sharing of existing media to create streamable collections
US7765192B2 (en) * 2006-03-29 2010-07-27 Abo Enterprises, Llc System and method for archiving a media collection
US8285595B2 (en) 2006-03-29 2012-10-09 Napo Enterprises, Llc System and method for refining media recommendations
MX2007015979A (es) * 2006-03-31 2009-04-07 Nielsen Media Res Inc Metodos, sistemas y aparato para medicion de multiples fines.
CA3099528C (en) * 2006-03-31 2023-07-25 The Nielsen Company (Us), Llc Methods, systems, and apparatus for multi-purpose metering
US7772478B2 (en) * 2006-04-12 2010-08-10 Massachusetts Institute Of Technology Understanding music
US20070245378A1 (en) * 2006-04-13 2007-10-18 Concert Technology Corporation User system providing previews to an associated portable media player
US20070245377A1 (en) * 2006-04-13 2007-10-18 Concert Technology Corporation Central system providing previews to a portable media player
US7444388B1 (en) * 2006-04-13 2008-10-28 Concert Technology Corporation System and method for obtaining media content for a portable media player
US20070244985A1 (en) * 2006-04-13 2007-10-18 Concert Technology Corporation User system providing previews of a user's media collection to an associated portable media player
US8316081B2 (en) * 2006-04-13 2012-11-20 Domingo Enterprises, Llc Portable media player enabled to obtain previews of a user's media collection
US7603434B2 (en) * 2006-04-13 2009-10-13 Domingo Enterprises, Llc Central system providing previews of a user's media collection to a portable media player
US7774385B1 (en) 2007-07-02 2010-08-10 Datascout, Inc. Techniques for providing a surrogate heuristic identification interface
US7840540B2 (en) 2006-04-20 2010-11-23 Datascout, Inc. Surrogate hashing
US8549022B1 (en) 2007-07-02 2013-10-01 Datascout, Inc. Fingerprint generation of multimedia content based on a trigger point with the multimedia content
US7814070B1 (en) 2006-04-20 2010-10-12 Datascout, Inc. Surrogate hashing
US7991206B1 (en) 2007-07-02 2011-08-02 Datascout, Inc. Surrogate heuristic identification
US8156132B1 (en) 2007-07-02 2012-04-10 Pinehill Technology, Llc Systems for comparing image fingerprints
US8463000B1 (en) 2007-07-02 2013-06-11 Pinehill Technology, Llc Content identification based on a search of a fingerprint database
US7801868B1 (en) 2006-04-20 2010-09-21 Datascout, Inc. Surrogate hashing
US9020964B1 (en) * 2006-04-20 2015-04-28 Pinehill Technology, Llc Generation of fingerprints for multimedia content based on vectors and histograms
KR100684457B1 (ko) * 2006-05-04 2007-02-22 주식회사 모빌리언스 이동통신단말의 외부 음원 인식을 이용하여 사용자에게고유정보를 제공하는 고유정보 제공 시스템, 고유정보 제공방법 및 그 이동통신단말
US8903843B2 (en) 2006-06-21 2014-12-02 Napo Enterprises, Llc Historical media recommendation service
US7908275B2 (en) 2006-07-03 2011-03-15 Intel Corporation Method and apparatus for fast audio search
US7680959B2 (en) 2006-07-11 2010-03-16 Napo Enterprises, Llc P2P network for providing real time media recommendations
US8327266B2 (en) 2006-07-11 2012-12-04 Napo Enterprises, Llc Graphical user interface system for allowing management of a media item playlist based on a preference scoring system
US9003056B2 (en) 2006-07-11 2015-04-07 Napo Enterprises, Llc Maintaining a minimum level of real time media recommendations in the absence of online friends
US8059646B2 (en) * 2006-07-11 2011-11-15 Napo Enterprises, Llc System and method for identifying music content in a P2P real time recommendation network
US8805831B2 (en) 2006-07-11 2014-08-12 Napo Enterprises, Llc Scoring and replaying media items
US7970922B2 (en) 2006-07-11 2011-06-28 Napo Enterprises, Llc P2P real time media recommendations
US9633356B2 (en) * 2006-07-20 2017-04-25 Aol Inc. Targeted advertising for playlists based upon search queries
US8090606B2 (en) 2006-08-08 2012-01-03 Napo Enterprises, Llc Embedded media recommendations
US8620699B2 (en) * 2006-08-08 2013-12-31 Napo Enterprises, Llc Heavy influencer media recommendations
JP4961300B2 (ja) * 2006-08-14 2012-06-27 三洋電機株式会社 楽曲一致判定装置、楽曲記録装置、楽曲一致判定方法、楽曲記録方法、楽曲一致判定プログラム、及び楽曲記録プログラム
US8239190B2 (en) * 2006-08-22 2012-08-07 Qualcomm Incorporated Time-warping frames of wideband vocoder
US20080051029A1 (en) * 2006-08-25 2008-02-28 Bradley James Witteman Phone-based broadcast audio identification
US8707459B2 (en) 2007-01-19 2014-04-22 Digimarc Corporation Determination of originality of content
US8738749B2 (en) 2006-08-29 2014-05-27 Digimarc Corporation Content monitoring and host compliance evaluation
US9654447B2 (en) 2006-08-29 2017-05-16 Digimarc Corporation Customized handling of copied content based on owner-specified similarity thresholds
US8726195B2 (en) 2006-09-05 2014-05-13 Aol Inc. Enabling an IM user to navigate a virtual world
EP2070231B1 (en) 2006-10-03 2013-07-03 Shazam Entertainment, Ltd. Method for high throughput of identification of distributed broadcast content
US9135951B2 (en) * 2006-10-10 2015-09-15 Qualcomm Incorporated System and method for dynamic audio buffer management
US8661029B1 (en) 2006-11-02 2014-02-25 Google Inc. Modifying search result ranking based on implicit user feedback
US8874655B2 (en) * 2006-12-13 2014-10-28 Napo Enterprises, Llc Matching participants in a P2P recommendation network loosely coupled to a subscription service
US9179200B2 (en) 2007-03-14 2015-11-03 Digimarc Corporation Method and system for determining content treatment
US10242415B2 (en) 2006-12-20 2019-03-26 Digimarc Corporation Method and system for determining content treatment
WO2008080022A2 (en) * 2006-12-22 2008-07-03 Apple Inc. Communicating and storing information associated with media broadcasts
US20090070185A1 (en) * 2007-01-17 2009-03-12 Concert Technology Corporation System and method for recommending a digital media subscription service
US8938773B2 (en) * 2007-02-02 2015-01-20 Websense, Inc. System and method for adding context to prevent data leakage over a computer network
US8307092B2 (en) * 2007-02-21 2012-11-06 Napo Enterprises, Llc Method and system for collecting information about a user's media collections from multiple login points
US8453170B2 (en) 2007-02-27 2013-05-28 Landmark Digital Services Llc System and method for monitoring and recognizing broadcast data
US7827237B2 (en) * 2007-03-12 2010-11-02 Citrix Systems, Inc. Systems and methods for identifying long matches of data in a compression history
US7460038B2 (en) * 2007-03-12 2008-12-02 Citrix Systems, Inc. Systems and methods of clustered sharing of compression histories
US7873634B2 (en) * 2007-03-12 2011-01-18 Hitlab Ulc. Method and a system for automatic evaluation of digital files
US7865585B2 (en) * 2007-03-12 2011-01-04 Citrix Systems, Inc. Systems and methods for providing dynamic ad hoc proxy-cache hierarchies
US7619545B2 (en) 2007-03-12 2009-11-17 Citrix Systems, Inc. Systems and methods of using application and protocol specific parsing for compression
EP2126727A4 (en) * 2007-03-12 2010-04-14 Webhitcontest Inc METHOD AND SYSTEM FOR AUTOMATICALLY EVALUATING DIGITAL FILES
US7453379B2 (en) * 2007-03-12 2008-11-18 Citrix Systems, Inc. Systems and methods for identifying long matches of data in a compression history
US7532134B2 (en) * 2007-03-12 2009-05-12 Citrix Systems, Inc. Systems and methods for sharing compression histories between multiple devices
US8255570B2 (en) * 2007-03-12 2012-08-28 Citrix Systems, Inc. Systems and methods of compression history expiration and synchronization
US8938463B1 (en) 2007-03-12 2015-01-20 Google Inc. Modifying search result ranking based on implicit user feedback and a model of presentation bias
GB0704856D0 (en) * 2007-03-13 2007-04-18 Wesby Philip B System and method for data acquisition and processing
US8694374B1 (en) 2007-03-14 2014-04-08 Google Inc. Detecting click spam
US9224427B2 (en) 2007-04-02 2015-12-29 Napo Enterprises LLC Rating media item recommendations using recommendation paths and/or media item usage
US8112720B2 (en) 2007-04-05 2012-02-07 Napo Enterprises, Llc System and method for automatically and graphically associating programmatically-generated media item recommendations related to a user's socially recommended media items
US10489795B2 (en) 2007-04-23 2019-11-26 The Nielsen Company (Us), Llc Determining relative effectiveness of media content items
US9092510B1 (en) 2007-04-30 2015-07-28 Google Inc. Modifying search result ranking based on a temporal element of user feedback
US20080274687A1 (en) * 2007-05-02 2008-11-06 Roberts Dale T Dynamic mixed media package
US7840177B2 (en) * 2007-05-23 2010-11-23 Landmark Digital Services, Llc Device for monitoring multiple broadcast signals
US8849432B2 (en) * 2007-05-31 2014-09-30 Adobe Systems Incorporated Acoustic pattern identification using spectral characteristics to synchronize audio and/or video
US8839141B2 (en) 2007-06-01 2014-09-16 Napo Enterprises, Llc Method and system for visually indicating a replay status of media items on a media device
US9164993B2 (en) 2007-06-01 2015-10-20 Napo Enterprises, Llc System and method for propagating a media item recommendation message comprising recommender presence information
US20090049045A1 (en) 2007-06-01 2009-02-19 Concert Technology Corporation Method and system for sorting media items in a playlist on a media device
US8285776B2 (en) 2007-06-01 2012-10-09 Napo Enterprises, Llc System and method for processing a received media item recommendation message comprising recommender presence information
US20080301187A1 (en) * 2007-06-01 2008-12-04 Concert Technology Corporation Enhanced media item playlist comprising presence information
US9037632B2 (en) 2007-06-01 2015-05-19 Napo Enterprises, Llc System and method of generating a media item recommendation message with recommender presence information
JP5090523B2 (ja) * 2007-06-06 2012-12-05 ドルビー ラボラトリーズ ライセンシング コーポレイション 複数の検索の組み合わせを使用して、オーディオ/ビデオの指紋検索精度を改善する方法及び装置
US8171030B2 (en) * 2007-06-18 2012-05-01 Zeitera, Llc Method and apparatus for multi-dimensional content search and video identification
US8140331B2 (en) * 2007-07-06 2012-03-20 Xia Lou Feature extraction for identification and classification of audio signals
US8006314B2 (en) 2007-07-27 2011-08-23 Audible Magic Corporation System for identifying content of digital data
US8694511B1 (en) 2007-08-20 2014-04-08 Google Inc. Modifying search result ranking based on populations
US8238669B2 (en) * 2007-08-22 2012-08-07 Google Inc. Detection and classification of matches between time-based media
US7712150B2 (en) * 2007-10-01 2010-05-11 Pardillo Joseph M Protective pad assembly magnetically attachable to garment
US8909655B1 (en) 2007-10-11 2014-12-09 Google Inc. Time based ranking
KR100921867B1 (ko) * 2007-10-17 2009-10-13 광주과학기술원 광대역 오디오 신호 부호화 복호화 장치 및 그 방법
WO2009059300A2 (en) * 2007-11-02 2009-05-07 Melodis Corporation Pitch selection, voicing detection and vibrato detection modules in a system for automatic transcription of sung or hummed melodies
US7865522B2 (en) 2007-11-07 2011-01-04 Napo Enterprises, Llc System and method for hyping media recommendations in a media recommendation system
US9060034B2 (en) 2007-11-09 2015-06-16 Napo Enterprises, Llc System and method of filtering recommenders in a media item recommendation system
KR100939215B1 (ko) * 2007-12-17 2010-01-28 한국전자통신연구원 인덱스 데이터베이스 생성 장치 및 검색 장치
US9224150B2 (en) 2007-12-18 2015-12-29 Napo Enterprises, Llc Identifying highly valued recommendations of users in a media recommendation network
US9130686B2 (en) * 2007-12-20 2015-09-08 Apple Inc. Tagging of broadcast content using a portable media device controlled by an accessory
US8396951B2 (en) 2007-12-20 2013-03-12 Napo Enterprises, Llc Method and system for populating a content repository for an internet radio service based on a recommendation network
US9734507B2 (en) 2007-12-20 2017-08-15 Napo Enterprise, Llc Method and system for simulating recommendations in a social network for an offline user
US8060525B2 (en) * 2007-12-21 2011-11-15 Napo Enterprises, Llc Method and system for generating media recommendations in a distributed environment based on tagging play history information with location information
US8316015B2 (en) 2007-12-21 2012-11-20 Lemi Technology, Llc Tunersphere
US8117193B2 (en) 2007-12-21 2012-02-14 Lemi Technology, Llc Tunersphere
JP5345154B2 (ja) * 2008-01-11 2013-11-20 テレフオンアクチーボラゲット エル エム エリクソン(パブル) Ipマルチメディアサブシステムにおけるメッセージハンドリング
WO2009089621A1 (en) * 2008-01-14 2009-07-23 Algo Communication Products Ltd. Methods and systems for searching audio records
WO2009107049A2 (en) * 2008-02-26 2009-09-03 Koninklijke Philips Electronics N.V. Content identification method
US10216761B2 (en) * 2008-03-04 2019-02-26 Oath Inc. Generating congruous metadata for multimedia
US9130986B2 (en) * 2008-03-19 2015-09-08 Websense, Inc. Method and system for protection against information stealing software
US8407784B2 (en) * 2008-03-19 2013-03-26 Websense, Inc. Method and system for protection against information stealing software
US9015842B2 (en) 2008-03-19 2015-04-21 Websense, Inc. Method and system for protection against information stealing software
US8370948B2 (en) * 2008-03-19 2013-02-05 Websense, Inc. System and method for analysis of electronic information dissemination events
US8312022B2 (en) 2008-03-21 2012-11-13 Ramp Holdings, Inc. Search engine optimization
US8725740B2 (en) * 2008-03-24 2014-05-13 Napo Enterprises, Llc Active playlist having dynamic media item groups
US8484311B2 (en) 2008-04-17 2013-07-09 Eloy Technology, Llc Pruning an aggregate media collection
US9106801B2 (en) 2008-04-25 2015-08-11 Sony Corporation Terminals, servers, and methods that find a media server to replace a sensed broadcast program/movie
DE102008022125A1 (de) 2008-05-05 2009-11-19 Siemens Aktiengesellschaft Verfahren und Vorrichtung zur Klassifikation von schallerzeugenden Prozessen
US9128945B1 (en) 2008-05-16 2015-09-08 Google Inc. Query augmentation
US8275177B2 (en) * 2008-05-23 2012-09-25 Oracle America, Inc. System and method for media fingerprint indexing
GB2460306B (en) 2008-05-29 2013-02-13 Intrasonics Sarl Data embedding system
JP4327888B1 (ja) * 2008-05-30 2009-09-09 株式会社東芝 音声音楽判定装置、音声音楽判定方法及び音声音楽判定用プログラム
JP4327886B1 (ja) * 2008-05-30 2009-09-09 株式会社東芝 音質補正装置、音質補正方法及び音質補正用プログラム
US20090305665A1 (en) * 2008-06-04 2009-12-10 Irwin Oliver Kennedy Method of identifying a transmitting device
US20090307084A1 (en) * 2008-06-10 2009-12-10 Integrated Media Measurement, Inc. Measuring Exposure To Media Across Multiple Media Delivery Mechanisms
US20090307061A1 (en) * 2008-06-10 2009-12-10 Integrated Media Measurement, Inc. Measuring Exposure To Media
WO2010006334A1 (en) 2008-07-11 2010-01-14 Videosurf, Inc. Apparatus and software system for and method of performing a visual-relevance-rank subsequent search
US20100023328A1 (en) * 2008-07-28 2010-01-28 Griffin Jr Paul P Audio Recognition System
US20100057545A1 (en) * 2008-08-28 2010-03-04 Daniel Jean System and method for sending sponsored message data in a communications network
CN101673262B (zh) * 2008-09-12 2012-10-10 未序网络科技(上海)有限公司 音频内容的搜索方法
US20100070537A1 (en) * 2008-09-17 2010-03-18 Eloy Technology, Llc System and method for managing a personalized universal catalog of media items
US20100082180A1 (en) * 2008-10-01 2010-04-01 Honeywell International Inc. Errant vehicle countermeasures
US8983677B2 (en) * 2008-10-01 2015-03-17 Honeywell International Inc. Acoustic fingerprinting of mechanical devices
US20170034586A1 (en) * 2008-10-08 2017-02-02 Wakingapp Ltd. System for content matching and triggering for reality-virtuality continuum-based environment and methods thereof
US8880599B2 (en) * 2008-10-15 2014-11-04 Eloy Technology, Llc Collection digest for a media sharing system
US8484227B2 (en) 2008-10-15 2013-07-09 Eloy Technology, Llc Caching and synching process for a media sharing system
US8121830B2 (en) 2008-10-24 2012-02-21 The Nielsen Company (Us), Llc Methods and apparatus to extract data encoded in media content
US9667365B2 (en) 2008-10-24 2017-05-30 The Nielsen Company (Us), Llc Methods and apparatus to perform audio watermarking and watermark detection and extraction
US8359205B2 (en) 2008-10-24 2013-01-22 The Nielsen Company (Us), Llc Methods and apparatus to perform audio watermarking and watermark detection and extraction
GB2465141B (en) 2008-10-31 2014-01-22 Media Instr Sa Simulcast resolution in content matching systems
US20100205628A1 (en) 2009-02-12 2010-08-12 Davis Bruce L Media processing methods and arrangements
US9961388B2 (en) 2008-11-26 2018-05-01 David Harrison Exposure of public internet protocol addresses in an advertising exchange server to improve relevancy of advertisements
US9519772B2 (en) 2008-11-26 2016-12-13 Free Stream Media Corp. Relevancy improvement through targeting of information based on data gathered from a networked device associated with a security sandbox of a client device
US10334324B2 (en) 2008-11-26 2019-06-25 Free Stream Media Corp. Relevant advertisement generation based on a user operating a client device communicatively coupled with a networked media device
US9154942B2 (en) 2008-11-26 2015-10-06 Free Stream Media Corp. Zero configuration communication between a browser and a networked media device
US10567823B2 (en) 2008-11-26 2020-02-18 Free Stream Media Corp. Relevant advertisement generation based on a user operating a client device communicatively coupled with a networked media device
US9986279B2 (en) 2008-11-26 2018-05-29 Free Stream Media Corp. Discovery, access control, and communication with networked services
US8508357B2 (en) 2008-11-26 2013-08-13 The Nielsen Company (Us), Llc Methods and apparatus to encode and decode audio for shopper location and advertisement presentation tracking
US10977693B2 (en) 2008-11-26 2021-04-13 Free Stream Media Corp. Association of content identifier of audio-visual data with additional data through capture infrastructure
US8180891B1 (en) 2008-11-26 2012-05-15 Free Stream Media Corp. Discovery, access control, and communication with networked services from within a security sandbox
US10419541B2 (en) 2008-11-26 2019-09-17 Free Stream Media Corp. Remotely control devices over a network without authentication or registration
US10880340B2 (en) 2008-11-26 2020-12-29 Free Stream Media Corp. Relevancy improvement through targeting of information based on data gathered from a networked device associated with a security sandbox of a client device
US10631068B2 (en) 2008-11-26 2020-04-21 Free Stream Media Corp. Content exposure attribution based on renderings of related content across multiple devices
US9390167B2 (en) 2010-07-29 2016-07-12 Soundhound, Inc. System and methods for continuous audio matching
US8433431B1 (en) 2008-12-02 2013-04-30 Soundhound, Inc. Displaying text to end users in coordination with audio playback
WO2010065673A2 (en) * 2008-12-02 2010-06-10 Melodis Corporation System and method for identifying original music
US8396865B1 (en) 2008-12-10 2013-03-12 Google Inc. Sharing search engine relevance data between corpora
US8200602B2 (en) 2009-02-02 2012-06-12 Napo Enterprises, Llc System and method for creating thematic listening experiences in a networked peer media recommendation environment
JP2012517188A (ja) * 2009-02-05 2012-07-26 ディジマーク コーポレイション テレビベースの広告と携帯電話向けtvウィジェットの配信
US8312061B2 (en) * 2009-02-10 2012-11-13 Harman International Industries, Incorporated System for broadcast information database
US9009146B1 (en) 2009-04-08 2015-04-14 Google Inc. Ranking search results based on similar queries
US9633117B2 (en) 2009-04-27 2017-04-25 Hewlett Packard Enterprise Development Lp System and method for making a recommendation based on user data
CA2760677C (en) 2009-05-01 2018-07-24 David Henry Harkness Methods, apparatus and articles of manufacture to provide secondary content in association with primary broadcast media content
US8687839B2 (en) * 2009-05-21 2014-04-01 Digimarc Corporation Robust signatures derived from local nonlinear filters
CN102461066B (zh) * 2009-05-21 2015-09-09 数字标记公司 鉴别内容信号的方法
EP2443580A1 (en) * 2009-05-26 2012-04-25 Websense, Inc. Systems and methods for efficeint detection of fingerprinted data and information
WO2010138777A1 (en) * 2009-05-27 2010-12-02 Arsh Technologies, Llc Automatic resource retrieval and use
US8489774B2 (en) 2009-05-27 2013-07-16 Spot411 Technologies, Inc. Synchronized delivery of interactive content
US10949458B2 (en) 2009-05-29 2021-03-16 Inscape Data, Inc. System and method for improving work load management in ACR television monitoring system
US10116972B2 (en) 2009-05-29 2018-10-30 Inscape Data, Inc. Methods for identifying video segments and displaying option to view from an alternative source and/or on an alternative device
US9094715B2 (en) 2009-05-29 2015-07-28 Cognitive Networks, Inc. Systems and methods for multi-broadcast differentiation
US8595781B2 (en) 2009-05-29 2013-11-26 Cognitive Media Networks, Inc. Methods for identifying video segments and displaying contextual targeted content on a connected television
US10375451B2 (en) 2009-05-29 2019-08-06 Inscape Data, Inc. Detection of common media segments
US9449090B2 (en) 2009-05-29 2016-09-20 Vizio Inscape Technologies, Llc Systems and methods for addressing a media database using distance associative hashing
US20100319043A1 (en) * 2009-06-11 2010-12-16 Microsoft Corporation Interactive television architecture
US8713068B2 (en) * 2009-06-11 2014-04-29 Yahoo! Inc. Media identification system with fingerprint database balanced according to search loads
US8620967B2 (en) 2009-06-11 2013-12-31 Rovi Technologies Corporation Managing metadata for occurrences of a recording
US8635211B2 (en) * 2009-06-11 2014-01-21 Dolby Laboratories Licensing Corporation Trend analysis in content identification based on fingerprinting
US8381290B2 (en) * 2009-07-17 2013-02-19 Exelis Inc. Intrusion detection systems and methods
US8447760B1 (en) 2009-07-20 2013-05-21 Google Inc. Generating a related set of documents for an initial set of documents
US8498974B1 (en) 2009-08-31 2013-07-30 Google Inc. Refining search results
JP5440051B2 (ja) * 2009-09-11 2014-03-12 株式会社Jvcケンウッド コンテンツ同定方法、コンテンツ同定システム、コンテンツ検索装置及びコンテンツ利用装置
US20110069937A1 (en) * 2009-09-18 2011-03-24 Laura Toerner Apparatus, system and method for identifying advertisements from a broadcast source and providing functionality relating to the same
ES2638655T3 (es) * 2009-09-30 2017-10-23 Rovi Guides, Inc. Sistemas y métodos para identificar contenido de audio utilizando una aplicación interactiva de guía de medios
US8677400B2 (en) 2009-09-30 2014-03-18 United Video Properties, Inc. Systems and methods for identifying audio content using an interactive media guidance application
US8161071B2 (en) 2009-09-30 2012-04-17 United Video Properties, Inc. Systems and methods for audio asset storage and management
US8972391B1 (en) 2009-10-02 2015-03-03 Google Inc. Recent interest based relevance scoring
US8521779B2 (en) 2009-10-09 2013-08-27 Adelphoi Limited Metadata record generation
US8706276B2 (en) 2009-10-09 2014-04-22 The Trustees Of Columbia University In The City Of New York Systems, methods, and media for identifying matching audio
US9197736B2 (en) * 2009-12-31 2015-11-24 Digimarc Corporation Intuitive computing methods and systems
US9218530B2 (en) 2010-11-04 2015-12-22 Digimarc Corporation Smartphone-based methods and systems
US8121618B2 (en) 2009-10-28 2012-02-21 Digimarc Corporation Intuitive computing methods and systems
US8175617B2 (en) 2009-10-28 2012-05-08 Digimarc Corporation Sensor-based mobile search, related methods and systems
US8594392B2 (en) * 2009-11-18 2013-11-26 Yahoo! Inc. Media identification system for efficient matching of media items having common content
US8874555B1 (en) 2009-11-20 2014-10-28 Google Inc. Modifying scoring data based on historical changes
EP2520084A4 (en) * 2009-12-29 2013-11-13 Tv Interactive Systems Inc METHOD FOR IDENTIFYING VIDEO SEGMENTS AND DISPLAYING A CONTEXTUALLY TARGETED CONTENT ON A CONNECTED TELEVISION
US20110173185A1 (en) * 2010-01-13 2011-07-14 Rovi Technologies Corporation Multi-stage lookup for rolling audio recognition
US8886531B2 (en) * 2010-01-13 2014-11-11 Rovi Technologies Corporation Apparatus and method for generating an audio fingerprint and using a two-stage query
US8615514B1 (en) 2010-02-03 2013-12-24 Google Inc. Evaluating website properties by partitioning user feedback
US8731943B2 (en) * 2010-02-05 2014-05-20 Little Wing World LLC Systems, methods and automated technologies for translating words into music and creating music pieces
US8924379B1 (en) 2010-03-05 2014-12-30 Google Inc. Temporal-based score adjustments
US8959093B1 (en) 2010-03-15 2015-02-17 Google Inc. Ranking search results based on anchors
US20110238679A1 (en) * 2010-03-24 2011-09-29 Rovi Technologies Corporation Representing text and other types of content by using a frequency domain
US8725766B2 (en) * 2010-03-25 2014-05-13 Rovi Technologies Corporation Searching text and other types of content by using a frequency domain
US9264785B2 (en) * 2010-04-01 2016-02-16 Sony Computer Entertainment Inc. Media fingerprinting for content determination and retrieval
US8560583B2 (en) * 2010-04-01 2013-10-15 Sony Computer Entertainment Inc. Media fingerprinting for social networking
AU2011239567A1 (en) * 2010-04-14 2012-12-06 Sven Riethmueller Platform-independent interactivity with media broadcasts
US20120191231A1 (en) * 2010-05-04 2012-07-26 Shazam Entertainment Ltd. Methods and Systems for Identifying Content in Data Stream by a Client Device
US9159338B2 (en) 2010-05-04 2015-10-13 Shazam Entertainment Ltd. Systems and methods of rendering a textual animation
US20110276882A1 (en) 2010-05-04 2011-11-10 Kai Buehler Automatic grouping for users experiencing a specific broadcast media
KR20130029082A (ko) 2010-05-04 2013-03-21 샤잠 엔터테인먼트 리미티드 미디어 스트림의 샘플을 처리하는 방법 및 시스템
CN105843968A (zh) 2010-05-04 2016-08-10 沙扎姆娱乐有限公司 用于同步媒体的方法
US9311708B2 (en) 2014-04-23 2016-04-12 Microsoft Technology Licensing, Llc Collaborative alignment of images
US9508011B2 (en) * 2010-05-10 2016-11-29 Videosurf, Inc. Video visual and audio query
US9413477B2 (en) 2010-05-10 2016-08-09 Microsoft Technology Licensing, Llc Screen detector
US10192138B2 (en) 2010-05-27 2019-01-29 Inscape Data, Inc. Systems and methods for reducing data density in large datasets
US9838753B2 (en) 2013-12-23 2017-12-05 Inscape Data, Inc. Monitoring individual viewing of television events using tracking pixels and cookies
CN102959624B (zh) * 2010-06-09 2015-04-22 阿德尔福伊有限公司 用于音频媒体识别的系统和方法
US20110307786A1 (en) * 2010-06-11 2011-12-15 Brian Shuster Method and apparatus for bookmarking and retrieval of video content
US9623119B1 (en) 2010-06-29 2017-04-18 Google Inc. Accentuating search results
US20110320944A1 (en) * 2010-06-29 2011-12-29 Nokia Corporation Systems, methods, and apparatuses for generating an integrated user interface
US9143699B2 (en) 2010-07-13 2015-09-22 Sony Computer Entertainment Inc. Overlay non-video content on a mobile device
US9159165B2 (en) 2010-07-13 2015-10-13 Sony Computer Entertainment Inc. Position-dependent gaming, 3-D controller, and handheld as a remote
US9832441B2 (en) 2010-07-13 2017-11-28 Sony Interactive Entertainment Inc. Supplemental content on a mobile device
US9814977B2 (en) 2010-07-13 2017-11-14 Sony Interactive Entertainment Inc. Supplemental video content on a mobile device
US8730354B2 (en) 2010-07-13 2014-05-20 Sony Computer Entertainment Inc Overlay video content on a mobile device
US8832083B1 (en) 2010-07-23 2014-09-09 Google Inc. Combining user feedback
US9047371B2 (en) 2010-07-29 2015-06-02 Soundhound, Inc. System and method for matching a query against a broadcast stream
US9876905B2 (en) 2010-09-29 2018-01-23 Genesys Telecommunications Laboratories, Inc. System for initiating interactive communication in response to audio codes
GB2546025B (en) 2010-10-01 2017-08-23 Asio Ltd A Transaction authenticating device and method
KR20120034378A (ko) * 2010-10-01 2012-04-12 엔에이치엔(주) 사운드 인식을 통한 광고 정보 제공 시스템 및 방법
JP5728888B2 (ja) * 2010-10-29 2015-06-03 ソニー株式会社 信号処理装置および方法、並びにプログラム
US8716584B1 (en) * 2010-11-01 2014-05-06 James W. Wieder Using recognition-segments to find and play a composition containing sound
US8863165B2 (en) * 2010-11-01 2014-10-14 Gracenote, Inc. Method and system for presenting additional content at a media system
US8762852B2 (en) * 2010-11-04 2014-06-24 Digimarc Corporation Smartphone-based methods and systems
US9484046B2 (en) 2010-11-04 2016-11-01 Digimarc Corporation Smartphone-based methods and systems
US8346792B1 (en) 2010-11-09 2013-01-01 Google Inc. Query generation using structural similarity between documents
US8584198B2 (en) * 2010-11-12 2013-11-12 Google Inc. Syndication including melody recognition and opt out
TWI581250B (zh) * 2010-12-03 2017-05-01 杜比實驗室特許公司 利用多媒體處理節點之適應性處理技術
CN103250205B (zh) * 2010-12-07 2017-05-10 英派尔科技开发有限公司 用于端到端体验质量测量的音频指纹差
US20120158769A1 (en) * 2010-12-15 2012-06-21 Dish Network L.L.C. Music distribution and identification systems and methods
WO2012091938A1 (en) 2010-12-30 2012-07-05 Dolby Laboratories Licensing Corporation Ranking representative segments in media data
US9002867B1 (en) 2010-12-30 2015-04-07 Google Inc. Modifying ranking data based on document changes
WO2012120531A2 (en) 2011-02-02 2012-09-13 Makarand Prabhakar Karanjkar A method for fast and accurate audio content match detection
US9093120B2 (en) * 2011-02-10 2015-07-28 Yahoo! Inc. Audio fingerprint extraction by scaling in time and resampling
KR20140038374A (ko) 2011-02-18 2014-03-28 샤잠 엔터테인먼트 리미티드 클라이언트 장치에 의해 데이터 스트림 내 콘텐트를 식별하는 방법 및 시스템
US20120224711A1 (en) * 2011-03-04 2012-09-06 Qualcomm Incorporated Method and apparatus for grouping client devices based on context similarity
US8589171B2 (en) 2011-03-17 2013-11-19 Remote Media, Llc System and method for custom marking a media file for file matching
US8688631B2 (en) 2011-03-17 2014-04-01 Alexander Savenok System and method for media file synchronization
US8478719B2 (en) 2011-03-17 2013-07-02 Remote Media LLC System and method for media file synchronization
US9196028B2 (en) 2011-09-23 2015-11-24 Digimarc Corporation Context-based smartphone sensor logic
US9380356B2 (en) 2011-04-12 2016-06-28 The Nielsen Company (Us), Llc Methods and apparatus to generate a tag for media content
US8937537B2 (en) 2011-04-29 2015-01-20 Panasonic Automotive Systems Company Of America, Division Of Panasonic Corporation Of North America Method and system for utilizing spread spectrum techniques for in car applications
US8612390B2 (en) * 2011-05-02 2013-12-17 Microsoft Corporation Lightweight caching of transaction log for sequential access
US9035163B1 (en) 2011-05-10 2015-05-19 Soundbound, Inc. System and method for targeting content based on identified audio and multimedia
US8996557B2 (en) * 2011-05-18 2015-03-31 Microsoft Technology Licensing, Llc Query and matching for content recognition
EP2507790B1 (en) 2011-06-06 2014-01-22 Bridge Mediatech, S.L. Method and system for robust audio hashing.
JP6060155B2 (ja) 2011-06-08 2017-01-11 シャザム エンターテインメント リミテッドShazam Entertainment Limited 受信データの比較を実行しその比較に基づいて後続サービスを提供する方法及びシステム
CA2837725C (en) 2011-06-10 2017-07-11 Shazam Entertainment Ltd. Methods and systems for identifying content in a data stream
US9210208B2 (en) 2011-06-21 2015-12-08 The Nielsen Company (Us), Llc Monitoring streaming media content
US9209978B2 (en) 2012-05-15 2015-12-08 The Nielsen Company (Us), Llc Methods and apparatus to measure exposure to streaming media
US9953039B2 (en) * 2011-07-19 2018-04-24 Disney Enterprises, Inc. Method and system for providing a compact graphical user interface for flexible filtering of data
US8564684B2 (en) * 2011-08-17 2013-10-22 Digimarc Corporation Emotional illumination, and related arrangements
US9374183B2 (en) * 2011-08-30 2016-06-21 Iheartmedia Management Services, Inc. Broadcast source identification based on matching via bit count
US9461759B2 (en) 2011-08-30 2016-10-04 Iheartmedia Management Services, Inc. Identification of changed broadcast media items
US8639178B2 (en) 2011-08-30 2014-01-28 Clear Channel Management Sevices, Inc. Broadcast source identification based on matching broadcast signal fingerprints
US9049496B2 (en) * 2011-09-01 2015-06-02 Gracenote, Inc. Media source identification
US8498627B2 (en) 2011-09-15 2013-07-30 Digimarc Corporation Intuitive computing methods and systems
US20130111514A1 (en) * 2011-09-16 2013-05-02 Umami Co. Second screen interactive platform
US9113202B1 (en) * 2011-09-21 2015-08-18 Google Inc. Inverted client-side fingerprinting and matching
US9460465B2 (en) 2011-09-21 2016-10-04 Genesys Telecommunications Laboratories, Inc. Graphical menu builder for encoding applications in an image
WO2013049256A1 (en) * 2011-09-26 2013-04-04 Sirius Xm Radio Inc. System and method for increasing transmission bandwidth efficiency ( " ebt2" )
US8433577B2 (en) 2011-09-27 2013-04-30 Google Inc. Detection of creative works on broadcast media
US9384272B2 (en) 2011-10-05 2016-07-05 The Trustees Of Columbia University In The City Of New York Methods, systems, and media for identifying similar songs using jumpcodes
US9402099B2 (en) * 2011-10-14 2016-07-26 Digimarc Corporation Arrangements employing content identification and/or distribution identification data
US9223893B2 (en) 2011-10-14 2015-12-29 Digimarc Corporation Updating social graph data using physical objects identified from images captured by smartphone
US9098576B1 (en) * 2011-10-17 2015-08-04 Google Inc. Ensemble interest point detection for audio matching
WO2013077983A1 (en) 2011-11-01 2013-05-30 Lemi Technology, Llc Adaptive media recommendation systems, methods, and computer readable media
US8886543B1 (en) * 2011-11-15 2014-11-11 Google Inc. Frequency ratio fingerprint characterization for audio matching
CN102508916B (zh) * 2011-11-21 2013-08-14 电子科技大学 一种海量数据的文件指纹分析方法
US9286942B1 (en) * 2011-11-28 2016-03-15 Codentity, Llc Automatic calculation of digital media content durations optimized for overlapping or adjoined transitions
US9696336B2 (en) 2011-11-30 2017-07-04 The Nielsen Company (Us), Llc Multiple meter detection and processing using motion data
US8492633B2 (en) 2011-12-02 2013-07-23 The Echo Nest Corporation Musical fingerprinting
US8586847B2 (en) * 2011-12-02 2013-11-19 The Echo Nest Corporation Musical fingerprinting based on onset intervals
EP2600545A1 (en) * 2011-12-02 2013-06-05 Waterford Institute Of Technology Research data measurement system and method
JP2013117688A (ja) * 2011-12-05 2013-06-13 Sony Corp 音響処理装置、音響処理方法、プログラム、記録媒体、サーバ装置、音響再生装置および音響処理システム
DE102011087843B4 (de) * 2011-12-06 2013-07-11 Continental Automotive Gmbh Verfahren und System zur Auswahl mindestens eines Datensatzes aus einer relationalen Datenbank
US9116928B1 (en) * 2011-12-09 2015-08-25 Google Inc. Identifying features for media file comparison
JP5901790B2 (ja) * 2011-12-12 2016-04-13 ドルビー ラボラトリーズ ライセンシング コーポレイション メディアデータにおける低計算量反復検出
US8538333B2 (en) 2011-12-16 2013-09-17 Arbitron Inc. Media exposure linking utilizing bluetooth signal characteristics
US8977194B2 (en) 2011-12-16 2015-03-10 The Nielsen Company (Us), Llc Media exposure and verification utilizing inductive coupling
US8892572B2 (en) 2011-12-30 2014-11-18 Cellco Partnership Video search system and method of use
US10078690B2 (en) * 2011-12-31 2018-09-18 Thomson Licensing Dtv Method and device for presenting content
US20130178966A1 (en) * 2012-01-09 2013-07-11 Function(x), Inc. Method and System for Identifying a Media Program From an Audio Signal Associated With the Media Program
US9210467B2 (en) 2012-02-07 2015-12-08 Turner Broadcasting System, Inc. Method and system for a universal remote control
US9384734B1 (en) * 2012-02-24 2016-07-05 Google Inc. Real-time audio recognition using multiple recognizers
US9519909B2 (en) 2012-03-01 2016-12-13 The Nielsen Company (Us), Llc Methods and apparatus to identify users of handheld computing devices
US9684715B1 (en) * 2012-03-08 2017-06-20 Google Inc. Audio identification using ordinal transformation
US9292894B2 (en) 2012-03-14 2016-03-22 Digimarc Corporation Content recognition and synchronization using local caching
US8965766B1 (en) * 2012-03-15 2015-02-24 Google Inc. Systems and methods for identifying music in a noisy environment
US8768003B2 (en) 2012-03-26 2014-07-01 The Nielsen Company (Us), Llc Media monitoring using multiple types of signatures
US8681950B2 (en) 2012-03-28 2014-03-25 Interactive Intelligence, Inc. System and method for fingerprinting datasets
US9202472B1 (en) * 2012-03-29 2015-12-01 Google Inc. Magnitude ratio descriptors for pitch-resistant audio matching
CN102663090B (zh) 2012-04-10 2013-11-06 华为技术有限公司 元数据查询方法和装置
US8473975B1 (en) 2012-04-16 2013-06-25 The Nielsen Company (Us), Llc Methods and apparatus to detect user attentiveness to handheld computing devices
US8953811B1 (en) * 2012-04-18 2015-02-10 Google Inc. Full digest of an audio file for identifying duplicates
US9052986B1 (en) * 2012-04-18 2015-06-09 Google Inc. Pitch shift resistant audio matching
WO2014020449A2 (en) * 2012-05-10 2014-02-06 Magiktunes Limited Identifying audio stream content
US9418669B2 (en) * 2012-05-13 2016-08-16 Harry E. Emerson, III Discovery of music artist and title for syndicated content played by radio stations
KR101315970B1 (ko) 2012-05-23 2013-10-08 (주)엔써즈 오디오 신호를 이용한 콘텐츠 인식 장치 및 방법
US9235867B2 (en) * 2012-06-04 2016-01-12 Microsoft Technology Licensing, Llc Concurrent media delivery
US9628829B2 (en) 2012-06-26 2017-04-18 Google Technology Holdings LLC Identifying media on a mobile device
US9118951B2 (en) 2012-06-26 2015-08-25 Arris Technology, Inc. Time-synchronizing a parallel feed of secondary content with primary media content
US9213703B1 (en) * 2012-06-26 2015-12-15 Google Inc. Pitch shift and time stretch resistant audio matching
KR102040199B1 (ko) 2012-07-11 2019-11-05 한국전자통신연구원 오디오 품질 측정 장치 및 그 방법
US10957310B1 (en) 2012-07-23 2021-03-23 Soundhound, Inc. Integrated programming framework for speech and text understanding with meaning parsing
US20140041054A1 (en) * 2012-08-01 2014-02-06 Microsoft Corporation Attestation of possession of media content items using fingerprints
US9282366B2 (en) 2012-08-13 2016-03-08 The Nielsen Company (Us), Llc Methods and apparatus to communicate audience measurement information
CN103593356A (zh) * 2012-08-16 2014-02-19 丁瑞彭 基于多媒体信息指纹技术的信息搜索方法、系统和应用
GB201214842D0 (en) * 2012-08-21 2012-10-03 Omnifone Ltd Content tracker
US20140074466A1 (en) * 2012-09-10 2014-03-13 Google Inc. Answering questions using environmental context
US9081778B2 (en) 2012-09-25 2015-07-14 Audible Magic Corporation Using digital fingerprints to associate data with a work
US10149048B1 (en) 2012-09-26 2018-12-04 Foundation for Research and Technology—Hellas (F.O.R.T.H.) Institute of Computer Science (I.C.S.) Direction of arrival estimation and sound source enhancement in the presence of a reflective surface apparatuses, methods, and systems
US10175335B1 (en) 2012-09-26 2019-01-08 Foundation For Research And Technology-Hellas (Forth) Direction of arrival (DOA) estimation apparatuses, methods, and systems
US9549253B2 (en) 2012-09-26 2017-01-17 Foundation for Research and Technology—Hellas (FORTH) Institute of Computer Science (ICS) Sound source localization and isolation apparatuses, methods and systems
US9955277B1 (en) 2012-09-26 2018-04-24 Foundation For Research And Technology-Hellas (F.O.R.T.H.) Institute Of Computer Science (I.C.S.) Spatial sound characterization apparatuses, methods and systems
US10136239B1 (en) 2012-09-26 2018-11-20 Foundation For Research And Technology—Hellas (F.O.R.T.H.) Capturing and reproducing spatial sound apparatuses, methods, and systems
US9554203B1 (en) * 2012-09-26 2017-01-24 Foundation for Research and Technolgy—Hellas (FORTH) Institute of Computer Science (ICS) Sound source characterization apparatuses, methods and systems
US20160210957A1 (en) 2015-01-16 2016-07-21 Foundation For Research And Technology - Hellas (Forth) Foreground Signal Suppression Apparatuses, Methods, and Systems
JP2014067292A (ja) * 2012-09-26 2014-04-17 Toshiba Corp 情報処理装置及び情報処理方法
US20140095161A1 (en) * 2012-09-28 2014-04-03 At&T Intellectual Property I, L.P. System and method for channel equalization using characteristics of an unknown signal
US9460204B2 (en) * 2012-10-19 2016-10-04 Sony Corporation Apparatus and method for scene change detection-based trigger for audio fingerprinting analysis
US9992729B2 (en) 2012-10-22 2018-06-05 The Nielsen Company (Us), Llc Systems and methods for wirelessly modifying detection characteristics of portable devices
US9064318B2 (en) 2012-10-25 2015-06-23 Adobe Systems Incorporated Image matting and alpha value techniques
US8735708B1 (en) 2012-10-28 2014-05-27 Google Inc. System and method for synchronizing tag history
US9201580B2 (en) 2012-11-13 2015-12-01 Adobe Systems Incorporated Sound alignment user interface
EP2731030A1 (en) 2012-11-13 2014-05-14 Samsung Electronics Co., Ltd Music information searching method and apparatus thereof
US10638221B2 (en) 2012-11-13 2020-04-28 Adobe Inc. Time interval sound alignment
US9355649B2 (en) * 2012-11-13 2016-05-31 Adobe Systems Incorporated Sound alignment using timing information
US9027048B2 (en) * 2012-11-14 2015-05-05 Bank Of America Corporation Automatic deal or promotion offering based on audio cues
US9076205B2 (en) 2012-11-19 2015-07-07 Adobe Systems Incorporated Edge direction and curve based image de-blurring
US10249321B2 (en) 2012-11-20 2019-04-02 Adobe Inc. Sound rate modification
US10339936B2 (en) 2012-11-27 2019-07-02 Roland Storti Method, device and system of encoding a digital interactive response action in an analog broadcasting message
US10366419B2 (en) 2012-11-27 2019-07-30 Roland Storti Enhanced digital media platform with user control of application data thereon
US9106953B2 (en) 2012-11-28 2015-08-11 The Nielsen Company (Us), Llc Media monitoring based on predictive signature caching
US9451304B2 (en) 2012-11-29 2016-09-20 Adobe Systems Incorporated Sound feature priority alignment
WO2014084928A1 (en) 2012-11-30 2014-06-05 Arbitron, Inc. Multiple meter detection and processing using motion data
US9135710B2 (en) 2012-11-30 2015-09-15 Adobe Systems Incorporated Depth map stereo correspondence techniques
US9241259B2 (en) 2012-11-30 2016-01-19 Websense, Inc. Method and apparatus for managing the transfer of sensitive information to mobile devices
US10455219B2 (en) 2012-11-30 2019-10-22 Adobe Inc. Stereo correspondence and depth sensors
US9912713B1 (en) 2012-12-17 2018-03-06 MiMedia LLC Systems and methods for providing dynamically updated image sets for applications
US9208547B2 (en) 2012-12-19 2015-12-08 Adobe Systems Incorporated Stereo correspondence smoothness tool
US10249052B2 (en) 2012-12-19 2019-04-02 Adobe Systems Incorporated Stereo correspondence model fitting
US9214026B2 (en) 2012-12-20 2015-12-15 Adobe Systems Incorporated Belief propagation and affinity measures
US9159327B1 (en) 2012-12-20 2015-10-13 Google Inc. System and method for adding pitch shift resistance to an audio fingerprint
US9183849B2 (en) 2012-12-21 2015-11-10 The Nielsen Company (Us), Llc Audio matching with semantic audio recognition and report generation
US9158760B2 (en) 2012-12-21 2015-10-13 The Nielsen Company (Us), Llc Audio decoding with supplemental semantic audio recognition and report generation
US9195649B2 (en) 2012-12-21 2015-11-24 The Nielsen Company (Us), Llc Audio processing techniques for semantic audio recognition and report generation
US9167278B2 (en) 2012-12-28 2015-10-20 Turner Broadcasting System, Inc. Method and system for automatic content recognition (ACR) based broadcast synchronization
US9529907B2 (en) * 2012-12-31 2016-12-27 Google Inc. Hold back and real time ranking of results in a streaming matching system
US9706252B2 (en) 2013-02-04 2017-07-11 Universal Electronics Inc. System and method for user monitoring and intent determination
CN103971689B (zh) * 2013-02-04 2016-01-27 腾讯科技(深圳)有限公司 一种音频识别方法及装置
CN103970793B (zh) 2013-02-04 2020-03-03 腾讯科技(深圳)有限公司 信息查询方法、客户端及服务器
US9099080B2 (en) 2013-02-06 2015-08-04 Muzak Llc System for targeting location-based communications
US9313544B2 (en) 2013-02-14 2016-04-12 The Nielsen Company (Us), Llc Methods and apparatus to measure exposure to streaming media
US9008490B1 (en) 2013-02-25 2015-04-14 Google Inc. Melody recognition systems
US9223297B2 (en) 2013-02-28 2015-12-29 The Nielsen Company (Us), Llc Systems and methods for identifying a user of an electronic device
US9344759B2 (en) 2013-03-05 2016-05-17 Google Inc. Associating audio tracks of an album with video content
US9275625B2 (en) * 2013-03-06 2016-03-01 Qualcomm Incorporated Content based noise suppression
US9301070B2 (en) 2013-03-11 2016-03-29 Arris Enterprises, Inc. Signature matching of corrupted audio signal
US9307337B2 (en) 2013-03-11 2016-04-05 Arris Enterprises, Inc. Systems and methods for interactive broadcast content
US9451048B2 (en) 2013-03-12 2016-09-20 Shazam Investments Ltd. Methods and systems for identifying information of a broadcast station and information of broadcasted content
US9298758B1 (en) 2013-03-13 2016-03-29 MiMedia, Inc. Systems and methods providing media-to-media connection
US9465521B1 (en) 2013-03-13 2016-10-11 MiMedia, Inc. Event based media interface
US9384273B1 (en) * 2013-03-14 2016-07-05 Google Inc. Compressed patch features for audio fingerprinting
US9153239B1 (en) * 2013-03-14 2015-10-06 Google Inc. Differentiating between near identical versions of a song
US9390170B2 (en) 2013-03-15 2016-07-12 Shazam Investments Ltd. Methods and systems for arranging and searching a database of media content recordings
US9183232B1 (en) 2013-03-15 2015-11-10 MiMedia, Inc. Systems and methods for organizing content using content organization rules and robust content information
MX356884B (es) * 2013-03-15 2018-06-19 Inscape Data Inc Sistemas y metodos para direccionar una base de datos de medios usando cifrado asociativo en distancia.
US9773058B2 (en) 2013-03-15 2017-09-26 Shazam Investments Ltd. Methods and systems for arranging and searching a database of media content recordings
US20140278845A1 (en) 2013-03-15 2014-09-18 Shazam Investments Limited Methods and Systems for Identifying Target Media Content and Determining Supplemental Information about the Target Media Content
US8990638B1 (en) 2013-03-15 2015-03-24 Digimarc Corporation Self-stabilizing network nodes in mobile discovery system
US10257301B1 (en) 2013-03-15 2019-04-09 MiMedia, Inc. Systems and methods providing a drive interface for content delivery
US9223458B1 (en) 2013-03-21 2015-12-29 Amazon Technologies, Inc. Techniques for transitioning between playback of media files
US9269022B2 (en) 2013-04-11 2016-02-23 Digimarc Corporation Methods for object recognition and related arrangements
US9183499B1 (en) 2013-04-19 2015-11-10 Google Inc. Evaluating quality based on neighbor features
US9305038B2 (en) * 2013-04-19 2016-04-05 International Business Machines Corporation Indexing of significant media granulars
CN104125509B (zh) * 2013-04-28 2015-09-30 腾讯科技(深圳)有限公司 节目识别方法、装置及服务器
US9123330B1 (en) * 2013-05-01 2015-09-01 Google Inc. Large-scale speaker identification
US10157618B2 (en) 2013-05-02 2018-12-18 Xappmedia, Inc. Device, system, method, and computer-readable medium for providing interactive advertising
US9460201B2 (en) 2013-05-06 2016-10-04 Iheartmedia Management Services, Inc. Unordered matching of audio fingerprints
US20140336797A1 (en) * 2013-05-12 2014-11-13 Harry E. Emerson, III Audio content monitoring and identification of broadcast radio stations
US20140336799A1 (en) * 2013-05-13 2014-11-13 Harry E. Emerson, III Discovery of music artist and title via companionship between a cellular phone and a broadcast radio receiver
KR20160022307A (ko) 2013-06-20 2016-02-29 톰슨 라이센싱 콘텐츠의 분산 재생의 동기화를 지원하기 위한 시스템 및 방법
US20150312369A1 (en) * 2013-06-26 2015-10-29 Intel Corporation Checkpoints for media buffering
US20150039321A1 (en) 2013-07-31 2015-02-05 Arbitron Inc. Apparatus, System and Method for Reading Codes From Digital Audio on a Processing Device
US9711152B2 (en) 2013-07-31 2017-07-18 The Nielsen Company (Us), Llc Systems apparatus and methods for encoding/decoding persistent universal media codes to encoded audio
US9542488B2 (en) 2013-08-02 2017-01-10 Google Inc. Associating audio tracks with video content
US9373320B1 (en) * 2013-08-21 2016-06-21 Google Inc. Systems and methods facilitating selective removal of content from a mixed audio recording
CN103440330A (zh) * 2013-09-03 2013-12-11 网易(杭州)网络有限公司 一种音乐节目信息获取方法和设备
US9275427B1 (en) * 2013-09-05 2016-03-01 Google Inc. Multi-channel audio video fingerprinting
CN103442083A (zh) * 2013-09-10 2013-12-11 百度在线网络技术(北京)有限公司 音频文件传输关联内容的方法、系统、客户端和服务器
US10014006B1 (en) 2013-09-10 2018-07-03 Ampersand, Inc. Method of determining whether a phone call is answered by a human or by an automated device
US9053711B1 (en) * 2013-09-10 2015-06-09 Ampersand, Inc. Method of matching a digitized stream of audio signals to a known audio recording
TW201513095A (zh) * 2013-09-23 2015-04-01 Hon Hai Prec Ind Co Ltd 語音處理系統、裝置及方法
US9507849B2 (en) 2013-11-28 2016-11-29 Soundhound, Inc. Method for combining a query and a communication command in a natural language computer system
US9275136B1 (en) * 2013-12-03 2016-03-01 Google Inc. Method for siren detection based on audio samples
US9354778B2 (en) 2013-12-06 2016-05-31 Digimarc Corporation Smartphone-based methods and systems
US9286902B2 (en) 2013-12-16 2016-03-15 Gracenote, Inc. Audio fingerprinting
US9466310B2 (en) 2013-12-20 2016-10-11 Lenovo Enterprise Solutions (Singapore) Pte. Ltd. Compensating for identifiable background content in a speech recognition device
US9955192B2 (en) 2013-12-23 2018-04-24 Inscape Data, Inc. Monitoring individual viewing of television events using tracking pixels and cookies
US9426525B2 (en) 2013-12-31 2016-08-23 The Nielsen Company (Us), Llc. Methods and apparatus to count people in an audience
US9292488B2 (en) 2014-02-01 2016-03-22 Soundhound, Inc. Method for embedding voice mail in a spoken utterance using a natural language processing computer system
US9311639B2 (en) 2014-02-11 2016-04-12 Digimarc Corporation Methods, apparatus and arrangements for device to device communication
EP3111672B1 (en) 2014-02-24 2017-11-15 Widex A/S Hearing aid with assisted noise suppression
US11295730B1 (en) 2014-02-27 2022-04-05 Soundhound, Inc. Using phonetic variants in a local context to improve natural language understanding
CN103853836B (zh) * 2014-03-14 2017-01-25 广州酷狗计算机科技有限公司 一种基于音乐指纹特征的音乐检索方法及系统
US10430985B2 (en) 2014-03-14 2019-10-01 Magic Leap, Inc. Augmented reality systems and methods utilizing reflections
US9668020B2 (en) 2014-04-07 2017-05-30 The Nielsen Company (Us), Llc Signature retrieval and matching for media monitoring
US9438940B2 (en) 2014-04-07 2016-09-06 The Nielsen Company (Us), Llc Methods and apparatus to identify media using hash keys
CN104978968A (zh) * 2014-04-11 2015-10-14 鸿富锦精密工业(深圳)有限公司 水印加载装置及水印加载的方法
US20150302458A1 (en) * 2014-04-16 2015-10-22 Ebay Inc. Identifying advertisements based on audio data and performing associated tasks
US9699499B2 (en) 2014-04-30 2017-07-04 The Nielsen Company (Us), Llc Methods and apparatus to measure exposure to streaming media
US9564123B1 (en) 2014-05-12 2017-02-07 Soundhound, Inc. Method and system for building an integrated user profile
US10575126B2 (en) 2014-05-16 2020-02-25 Alphonso Inc. Apparatus and method for determining audio and/or visual time shift
CN104093079B (zh) 2014-05-29 2015-10-07 腾讯科技(深圳)有限公司 基于多媒体节目的交互方法、终端、服务器和系统
US9905233B1 (en) 2014-08-07 2018-02-27 Digimarc Corporation Methods and apparatus for facilitating ambient content recognition using digital watermarks, and related arrangements
WO2016024171A1 (en) 2014-08-14 2016-02-18 Yandex Europe Ag Method of and a system for indexing audio tracks using chromaprints
WO2016024172A1 (en) 2014-08-14 2016-02-18 Yandex Europe Ag Method of and a system for matching audio tracks using chromaprints with a fast candidate selection routine
US10748539B2 (en) 2014-09-10 2020-08-18 Crestron Electronics, Inc. Acoustic sensory network
US10204622B2 (en) 2015-09-10 2019-02-12 Crestron Electronics, Inc. Acoustic sensory network
CN104361889B (zh) * 2014-10-28 2018-03-16 北京音之邦文化科技有限公司 一种对音频文件进行处理的方法及装置
US20160132600A1 (en) * 2014-11-07 2016-05-12 Shazam Investments Limited Methods and Systems for Performing Content Recognition for a Surge of Incoming Recognition Queries
EP3023884A1 (en) * 2014-11-21 2016-05-25 Thomson Licensing Method and apparatus for generating fingerprint of an audio signal
US9837101B2 (en) * 2014-11-25 2017-12-05 Facebook, Inc. Indexing based on time-variant transforms of an audio signal's spectrogram
WO2016085414A1 (en) * 2014-11-27 2016-06-02 JOHN SMITH s.r.o. Method to lower decline in watching channels during commercial breaks and a connection
AU2015355209B2 (en) 2014-12-01 2019-08-29 Inscape Data, Inc. System and method for continuous media segment identification
US9363562B1 (en) 2014-12-01 2016-06-07 Stingray Digital Group Inc. Method and system for authorizing a user device
WO2016086905A1 (es) * 2014-12-05 2016-06-09 Monitoreo Tecnológico, S.A Método de medición de audiencias
CN107111642B (zh) 2014-12-31 2020-12-18 Pcms控股公司 用于创建收听日志和音乐库的系统和方法
US10333696B2 (en) 2015-01-12 2019-06-25 X-Prime, Inc. Systems and methods for implementing an efficient, scalable homomorphic transformation of encrypted data with minimal data expansion and improved processing efficiency
WO2016123495A1 (en) 2015-01-30 2016-08-04 Vizio Inscape Technologies, Llc Methods for identifying video segments and displaying option to view from an alternative source and/or on an alternative device
US10929464B1 (en) * 2015-02-04 2021-02-23 Google Inc. Employing entropy information to facilitate determining similarity between content items
US10360583B2 (en) 2015-02-05 2019-07-23 Direct Path, Llc System and method for direct response advertising
US10269392B2 (en) 2015-02-11 2019-04-23 Immersion Corporation Automated haptic effect accompaniment
US10142471B2 (en) * 2015-03-02 2018-11-27 Genesys Telecommunications Laboratories, Inc. System and method for call progress detection
US9955274B2 (en) 2015-04-08 2018-04-24 The Boeing Company Vibration monitoring systems
EP3284017B1 (en) 2015-04-17 2024-03-27 Inscape Data, Inc. Systems and methods for reducing data density in large datasets
US10997236B2 (en) 2015-04-27 2021-05-04 Samsung Electronics Co., Ltd. Audio content recognition method and device
CN106294331B (zh) * 2015-05-11 2020-01-21 阿里巴巴集团控股有限公司 音频信息检索方法及装置
GB201508963D0 (en) 2015-05-26 2015-07-01 Geo Track Identifier Gmbh Audio identification method
US9762965B2 (en) 2015-05-29 2017-09-12 The Nielsen Company (Us), Llc Methods and apparatus to measure exposure to streaming media
US10323612B2 (en) 2015-06-12 2019-06-18 Ford Global Technologies, Llc Methods and systems for dual fuel injection
US10094320B2 (en) 2015-06-23 2018-10-09 Ford Global Technologies, Llc Methods and systems for dual fuel injection
KR102137537B1 (ko) 2015-06-30 2020-07-27 프라운호퍼 게젤샤프트 쭈르 푀르데룽 데어 안겐반텐 포르슝 에. 베. 잡음을 연관시키기 위한 그리고 분석하기 위한 방법 및 장치
US10080062B2 (en) 2015-07-16 2018-09-18 Inscape Data, Inc. Optimizing media fingerprint retention to improve system resource utilization
KR102601485B1 (ko) * 2015-07-16 2023-11-10 인스케이프 데이터, 인코포레이티드 Acr 텔레비전 모니터링 시스템에서의 작업 부하 관리를 개선하기 위한 시스템 및 방법
JP6891170B2 (ja) 2015-07-16 2021-06-18 インスケイプ データ インコーポレイテッド ステムリソース利用を最適化するための映像セグメントの将来の視聴予測
WO2017011798A1 (en) 2015-07-16 2017-01-19 Vizio Inscape Technologies, Llc Detection of common media segments
CN108351879B (zh) 2015-07-16 2022-02-18 构造数据有限责任公司 用于提高识别媒体段的效率的划分搜索索引的系统和方法
US9900636B2 (en) 2015-08-14 2018-02-20 The Nielsen Company (Us), Llc Reducing signature matching uncertainty in media monitoring systems
US9654891B2 (en) 2015-09-15 2017-05-16 D&M Holdings, Inc. System and method for determining proximity of a controller to a media rendering device
US9769607B2 (en) 2015-09-24 2017-09-19 Cisco Technology, Inc. Determining proximity of computing devices using ultrasonic audio signatures
CN106558318B (zh) * 2015-09-24 2020-04-28 阿里巴巴集团控股有限公司 音频识别方法和系统
US10200546B2 (en) 2015-09-25 2019-02-05 The Nielsen Company (Us), Llc Methods and apparatus to identify media using hybrid hash keys
US9978366B2 (en) 2015-10-09 2018-05-22 Xappmedia, Inc. Event-based speech interactive media player
TWI579716B (zh) * 2015-12-01 2017-04-21 中華電信股份有限公司 Two - level phrase search system and method
US10594689B1 (en) 2015-12-04 2020-03-17 Digimarc Corporation Robust encoding of machine readable information in host objects and biometrics, and associated decoding and authentication
GB2545181A (en) * 2015-12-07 2017-06-14 Fujitsu Ltd Synchronisation device, method, program and system
US9516373B1 (en) 2015-12-21 2016-12-06 Max Abecassis Presets of synchronized second screen functions
US9596502B1 (en) 2015-12-21 2017-03-14 Max Abecassis Integration of multiple synchronization methodologies
US10089987B2 (en) * 2015-12-21 2018-10-02 Invensense, Inc. Music detection and identification
CN105589970A (zh) * 2015-12-25 2016-05-18 小米科技有限责任公司 音乐搜索方法和装置
EP3405830B1 (en) 2016-01-19 2024-10-16 Magic Leap, Inc. Augmented reality systems and methods utilizing reflections
US9848235B1 (en) 2016-02-22 2017-12-19 Sorenson Media, Inc Video fingerprinting based on fourier transform of histogram
US9930406B2 (en) 2016-02-29 2018-03-27 Gracenote, Inc. Media channel identification with video multi-match detection and disambiguation based on audio fingerprint
US10063918B2 (en) 2016-02-29 2018-08-28 Gracenote, Inc. Media channel identification with multi-match detection and disambiguation based on single-match
US10433026B2 (en) * 2016-02-29 2019-10-01 MyTeamsCalls LLC Systems and methods for customized live-streaming commentary
US9924222B2 (en) * 2016-02-29 2018-03-20 Gracenote, Inc. Media channel identification with multi-match detection and disambiguation based on location
KR20170101500A (ko) * 2016-02-29 2017-09-06 한국전자통신연구원 노이즈 제거를 통한 오디오 신호 식별 방법 및 장치
US9959885B2 (en) 2016-03-08 2018-05-01 Samsung Eletrônica Da Amazônia Ltda Method for user context recognition using sound signatures
US9786298B1 (en) 2016-04-08 2017-10-10 Source Digital, Inc. Audio fingerprinting based on audio energy characteristics
NZ787459A (en) 2016-04-26 2023-05-26 Magic Leap Inc Electromagnetic tracking with augmented reality systems
NL2016742B1 (en) 2016-05-09 2017-11-16 Audiocoup B V System for determining user exposure to audio fragments.
US10015612B2 (en) * 2016-05-25 2018-07-03 Dolby Laboratories Licensing Corporation Measurement, verification and correction of time alignment of multiple audio channels and associated metadata
JP6787624B2 (ja) 2016-06-22 2020-11-18 グレースノート インコーポレイテッド 音声指紋の照合のための方法、マシン可読媒体及びシステム
US9959448B2 (en) * 2016-08-19 2018-05-01 Google Llc Multi-step sequence alignment
US12341931B2 (en) 2016-10-13 2025-06-24 Sonos Experience Limited Method and system for acoustic communication of data
GB201617408D0 (en) 2016-10-13 2016-11-30 Asio Ltd A method and system for acoustic communication of data
GB201617409D0 (en) 2016-10-13 2016-11-30 Asio Ltd A method and system for acoustic communication of data
US10776170B2 (en) 2016-10-21 2020-09-15 Fujitsu Limited Software service execution apparatus, system, and method
EP3312724B1 (en) 2016-10-21 2019-10-30 Fujitsu Limited Microservice-based data processing apparatus, method, and program
JP6805765B2 (ja) 2016-10-21 2020-12-23 富士通株式会社 ソフトウェアサービスの実行のためのシステム、方法、及びプログラム
EP3312722A1 (en) 2016-10-21 2018-04-25 Fujitsu Limited Data processing apparatus, method, and program
JP7100422B2 (ja) 2016-10-21 2022-07-13 富士通株式会社 データプロパティ認識のための装置、プログラム、及び方法
US10701438B2 (en) 2016-12-31 2020-06-30 Turner Broadcasting System, Inc. Automatic content recognition and verification in a broadcast chain
US10785329B2 (en) * 2017-01-05 2020-09-22 The Nielsen Company (Us), Llc Methods and apparatus to facilitate meter to meter matching for media identification
US10922720B2 (en) 2017-01-11 2021-02-16 Adobe Inc. Managing content delivery via audio cues
GB201704636D0 (en) 2017-03-23 2017-05-10 Asio Ltd A method and system for authenticating a device
EP3379814A1 (en) 2017-03-23 2018-09-26 Christian Rymarenko Converting media using mobile devices
AU2018250286C1 (en) 2017-04-06 2022-06-02 Inscape Data, Inc. Systems and methods for improving accuracy of device maps using media viewing data
RU172737U1 (ru) * 2017-04-18 2017-07-21 Общество с ограниченной ответственностью "ДЖЕНТ КЛАБ" Устройство для идентификации музыкальных произведений
US10166472B2 (en) 2017-05-04 2019-01-01 Shazam Investments Ltd. Methods and systems for determining a reaction time for a response and synchronizing user interface(s) with content being rendered
RU2662939C1 (ru) * 2017-05-12 2018-07-31 Общество с ограниченной ответственностью "ИСКОНА ХОЛДИНГ" Способ идентификации музыкальных произведений
GB2565751B (en) * 2017-06-15 2022-05-04 Sonos Experience Ltd A method and system for triggering events
GB2562515A (en) * 2017-05-17 2018-11-21 Snell Advanced Media Ltd Generation of audio or video hash
US10271095B1 (en) 2017-12-21 2019-04-23 Samuel Chenillo System and method for media segment indentification
US10867185B2 (en) 2017-12-22 2020-12-15 Samuel Chenillo System and method for media segment identification
WO2018218034A1 (en) 2017-05-25 2018-11-29 J. W. Pepper & Son, Inc. Sheet music search and discovery system
EP3425522A1 (en) * 2017-07-06 2019-01-09 Bmat Licensing, S.L.U. Identifying background audio in broadcast signals using multiple sources
US20190028766A1 (en) * 2017-07-18 2019-01-24 Audible Magic Corporation Media classification for media identification and licensing
CN107367676A (zh) * 2017-09-04 2017-11-21 厦门斯玛特思智能电气股份有限公司 基于音频智能识别的局放指示器
US10264297B1 (en) * 2017-09-13 2019-04-16 Perfect Sense, Inc. Time-based content synchronization
US20190104335A1 (en) * 2017-09-29 2019-04-04 Theater Ears, LLC Theater ears audio recognition & synchronization algorithm
US10599702B2 (en) * 2017-10-05 2020-03-24 Audible Magic Corporation Temporal fraction with use of content identification
US10158907B1 (en) 2017-10-10 2018-12-18 Shazam Investments Ltd. Systems and methods for performing playout of multiple media recordings based on a matching segment among the recordings
US10129575B1 (en) 2017-10-25 2018-11-13 Shazam Entertainment Limited Methods and systems for determining a latency between a source and an alternative feed of the source
US10249319B1 (en) 2017-10-26 2019-04-02 The Nielsen Company (Us), Llc Methods and apparatus to reduce noise from harmonic noise sources
EP3477505B1 (en) * 2017-10-31 2021-10-20 Spotify AB Fingerprint clustering for content-based audio recogntion
EP3477643B1 (en) * 2017-10-31 2019-10-16 Spotify AB Audio fingerprint extraction and audio recognition using said fingerprints
CN108012173B (zh) * 2017-11-16 2021-01-22 百度在线网络技术(北京)有限公司 一种内容识别方法、装置、设备和计算机存储介质
US10276175B1 (en) 2017-11-28 2019-04-30 Google Llc Key phrase detection with audio watermarking
US10140966B1 (en) * 2017-12-12 2018-11-27 Ryan Laurence Edwards Location-aware musical instrument
CN107967922A (zh) * 2017-12-19 2018-04-27 成都嗨翻屋文化传播有限公司 一种基于特征的音乐版权识别方法
GB2570634A (en) 2017-12-20 2019-08-07 Asio Ltd A method and system for improved acoustic transmission of data
US11048946B2 (en) 2017-12-21 2021-06-29 Samuel Chenillo System and method for identifying cognate image sequences
SE542269C2 (en) 2017-12-21 2020-03-31 Telia Co Ab Methods and apparatuses for determining meta data related to media content
BR112020012544A2 (pt) * 2017-12-22 2020-11-24 Nativewaves Gmbh método para sincronizar um sinal adicional com um sinal primário
DE102017131266A1 (de) 2017-12-22 2019-06-27 Nativewaves Gmbh Verfahren zum Einspielen von Zusatzinformationen zu einer Liveübertragung
US10089994B1 (en) 2018-01-15 2018-10-02 Alex Radzishevsky Acoustic fingerprint extraction and matching
ES2779985B2 (es) 2019-02-20 2021-03-04 Moehs Iberica Sl Sal de dietilamina del ácido 3alfa-tetrahidropiraniloxi-6alfa-etil-7alfa-hidroxi-5ß-colánico
CN110322897B (zh) 2018-03-29 2021-09-03 北京字节跳动网络技术有限公司 一种音频检索识别方法及装置
CN110322886A (zh) * 2018-03-29 2019-10-11 北京字节跳动网络技术有限公司 一种音频指纹提取方法及装置
GB201810202D0 (en) * 2018-06-21 2018-08-08 Magus Communications Ltd Answer machine detection method & apparatus
US10904587B2 (en) * 2018-07-19 2021-01-26 Gracenote, Inc. Establishment and use of time mapping based on interpolation using low-rate fingerprinting, to help facilitate frame-accurate content revision
US11483785B2 (en) 2018-07-25 2022-10-25 Trulli Engineering, Llc Bluetooth speaker configured to produce sound as well as simultaneously act as both sink and source
US10915292B2 (en) 2018-07-25 2021-02-09 Eagle Acoustics Manufacturing, Llc Bluetooth speaker configured to produce sound as well as simultaneously act as both sink and source
US10860647B2 (en) 2018-09-06 2020-12-08 Gracenote, Inc. Systems, methods, and apparatus to improve media identification
US10771828B2 (en) * 2018-09-18 2020-09-08 Free Stream Media Corp. Content consensus management
US10911824B2 (en) 2018-11-05 2021-02-02 The Nielsen Company (Us), Llc Methods and apparatus to generate reference signatures
US10868620B2 (en) * 2018-12-26 2020-12-15 The Nielsen Company (Us), Llc Methods and apparatus for optimizing station reference fingerprint loading using reference watermarks
TR201902782A2 (tr) * 2019-02-25 2019-03-21 Aksoy Ahmet Kamusal alanlar için müzik analiz sistemi ve yöntemi.
US11683236B1 (en) 2019-03-30 2023-06-20 Snap Inc. Benchmarking to infer configuration of similar devices
US11853192B1 (en) 2019-04-16 2023-12-26 Snap Inc. Network device performance metrics determination
US11240104B1 (en) 2019-05-21 2022-02-01 Snap Inc. Device configuration parameter determination
US11234049B2 (en) * 2019-06-24 2022-01-25 The Nielsen Company (Us), Llc Use of steganographically-encoded time information as basis to control implementation of dynamic content modification
US11051057B2 (en) * 2019-06-24 2021-06-29 The Nielsen Company (Us), Llc Use of steganographically-encoded time information as basis to establish a time offset, to facilitate taking content-related action
US20210089909A1 (en) * 2019-09-25 2021-03-25 Deepmind Technologies Limited High fidelity speech synthesis with adversarial networks
CN110635824B (zh) * 2019-10-19 2021-07-09 广东石油化工学院 一种利用分类回归树的plc信道脉冲噪声检测方法和系统
WO2021101577A1 (en) * 2019-11-19 2021-05-27 Google Llc Methods, systems, and media for rights management of embedded sound recordings using composition clustering
CN110910899B (zh) * 2019-11-27 2022-04-08 杭州联汇科技股份有限公司 一种实时音频信号一致性对比检测方法
JP7396878B2 (ja) 2019-11-28 2023-12-12 株式会社ディーアンドエムホールディングス マルチチャンネルオーディオシステム、音響プロファイル情報生成装置、ワイヤレス録音再生装置、プログラム、および、音響プロファイル情報の生成方法
CN112995759A (zh) * 2019-12-13 2021-06-18 腾讯科技(北京)有限公司 互动业务处理方法、系统、装置、设备及存储介质
CN111008301B (zh) * 2019-12-19 2023-08-15 新华智云科技有限公司 一种以图搜视频的方法
US11922532B2 (en) 2020-01-15 2024-03-05 Digimarc Corporation System for mitigating the problem of deepfake media content using watermarking
US11991419B2 (en) 2020-01-30 2024-05-21 Snap Inc. Selecting avatars to be included in the video being generated on demand
EP4096798B1 (en) 2020-01-30 2025-09-24 Snap Inc. System for generating media content items on demand
US11036781B1 (en) 2020-01-30 2021-06-15 Snap Inc. Video generation system to render frames on demand using a fleet of servers
US11284144B2 (en) * 2020-01-30 2022-03-22 Snap Inc. Video generation system to render frames on demand using a fleet of GPUs
US11356720B2 (en) 2020-01-30 2022-06-07 Snap Inc. Video generation system to render frames on demand
US11252460B2 (en) 2020-03-27 2022-02-15 The Nielsen Company (Us), Llc Signature matching with meter data aggregation for media identification
US11616797B2 (en) 2020-04-30 2023-03-28 Mcafee, Llc Large scale malware sample identification
GB2597334A (en) 2020-07-17 2022-01-26 Playrcart Ltd A media player
US11670322B2 (en) 2020-07-29 2023-06-06 Distributed Creation Inc. Method and system for learning and using latent-space representations of audio signals for audio content-based retrieval
US11988784B2 (en) 2020-08-31 2024-05-21 Sonos, Inc. Detecting an audio signal with a microphone to determine presence of a playback device
US11283586B1 (en) 2020-09-05 2022-03-22 Francis Tiong Method to estimate and compensate for clock rate difference in acoustic sensors
US11284139B1 (en) * 2020-09-10 2022-03-22 Hulu, LLC Stateless re-discovery of identity using watermarking of a video stream
KR102447554B1 (ko) * 2020-11-18 2022-09-27 주식회사 샵캐스트 오디오 핑거프린트 매칭을 기반으로하는 음원 인식 방법 및 장치
US11405684B1 (en) * 2021-01-08 2022-08-02 Christie Digital Systems Usa, Inc. Distributed media player for digital cinema
US20220222294A1 (en) * 2021-01-14 2022-07-14 Smule, Inc. Densification in Music Search and Recommendation
WO2022198065A1 (en) 2021-03-19 2022-09-22 Evalve, Inc. Systems for tissue grasping and assessment
CN115134640B (zh) * 2021-03-25 2025-06-27 华为技术有限公司 同步播放方法及装置
US11589100B1 (en) * 2021-03-31 2023-02-21 Amazon Technologies, Inc. On-demand issuance private keys for encrypted video transmission
US11665377B2 (en) 2021-04-23 2023-05-30 At&T Intellectual Property I, L.P. System and method for identifying encrypted, pre-recorded media content in packet data networks
WO2022228693A1 (en) * 2021-04-30 2022-11-03 Huawei Technologies Co., Ltd. System and method for indexing a data item in a data storage system
US11996087B2 (en) 2021-04-30 2024-05-28 Comcast Cable Communications, Llc Method and apparatus for intelligent voice recognition
US20220392435A1 (en) * 2021-06-08 2022-12-08 Comcast Cable Communications, Llc Processing Voice Commands
US11496776B1 (en) * 2021-07-19 2022-11-08 Intrado Corporation Database layer caching for video communications
US12299851B2 (en) * 2021-07-29 2025-05-13 Samsung Electronics Co., Ltd. Method and apparatus with image preprocessing
US12447350B2 (en) * 2021-08-18 2025-10-21 Advanced Neuromodulation Systems, Inc. Systems and methods for providing digital health services
EP4421658A4 (en) 2021-10-20 2024-12-18 Sony Group Corporation INFORMATION PROCESSING DEVICE, INFORMATION PROCESSING METHOD, AND PROGRAM
TWI806210B (zh) * 2021-10-29 2023-06-21 宏碁股份有限公司 聲音浮水印的處理方法及聲音浮水印處理裝置
CN116129919B (zh) * 2021-11-12 2025-11-11 宏碁股份有限公司 声音水印的处理方法及声音水印产生装置
TW202325029A (zh) * 2021-12-13 2023-06-16 比利時商巴可公司 用於電影院內容之遞送平台
US12340025B2 (en) 2022-04-04 2025-06-24 Comcast Cable Communications, Llc Systems, methods, and apparatuses for execution of gesture commands
WO2023205559A1 (en) * 2022-04-22 2023-10-26 Whdiyo Llc Dynamic visual watermark for streaming video
CN117528176A (zh) * 2022-07-30 2024-02-06 脸萌有限公司 视频确定方法、装置、电子设备及存储介质
EP4336381A1 (en) 2022-09-09 2024-03-13 Sparwk AS System and method for music entity matching
US20240402262A1 (en) * 2023-06-05 2024-12-05 Rahner James Portable nmr apparatus and systems and methods for analyzing nmr data obtained therefrom
US20250069618A1 (en) * 2023-08-24 2025-02-27 Audio Technologies And Codecs, Inc. Method and System for Identifying Similarity Between Two Audio Tracks
FR3152691A1 (fr) 2023-09-01 2025-03-07 Arnaud GOKOU Procédé et système pour accéder à des ressources et services distants à partir d’un contenu audiovisuel disponible sur un équipement de télévision
US20260050903A1 (en) * 2024-08-19 2026-02-19 Motorola Mobility Llc Methods, Systems, and Electronic Devices for Contextually Identifying Divisions Associated with Digital Transactions
EP4708080A1 (en) * 2024-09-05 2026-03-11 Deezer S.A. Methods, devices, processors and systems for audio fingerprinting and retrieval

Family Cites Families (35)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US4415767A (en) * 1981-10-19 1983-11-15 Votan Method and apparatus for speech recognition and reproduction
US4450531A (en) * 1982-09-10 1984-05-22 Ensco, Inc. Broadcast signal recognition system and method
US4582181A (en) * 1983-08-12 1986-04-15 Advanced Cardiovascular Systems, Inc. Steerable dilatation catheter
JPS62159195A (ja) * 1986-01-06 1987-07-15 沖電気工業株式会社 音声パタン作成方法
US4852181A (en) * 1985-09-26 1989-07-25 Oki Electric Industry Co., Ltd. Speech recognition for recognizing the catagory of an input speech pattern
JPS6273298A (ja) * 1985-09-26 1987-04-03 沖電気工業株式会社 音声認識方式
US4843562A (en) * 1987-06-24 1989-06-27 Broadcast Data Systems Limited Partnership Broadcast information classification system and method
JPH03291752A (ja) * 1990-04-10 1991-12-20 Matsushita Electric Ind Co Ltd データ検索装置
US5210820A (en) * 1990-05-02 1993-05-11 Broadcast Data Systems Limited Partnership Signal recognition system and method
GB2262992B (en) * 1990-06-21 1995-07-05 Reynolds Software Inc Method and apparatus for wave analysis and event recognition
US5627915A (en) * 1995-01-31 1997-05-06 Princeton Video Image, Inc. Pattern recognition system employing unlike templates to detect objects having distinctive features in a video field
JPH09138691A (ja) * 1995-11-15 1997-05-27 Brother Ind Ltd 楽曲検索装置
US7346472B1 (en) 2000-09-07 2008-03-18 Blue Spike, Inc. Method and device for monitoring and analyzing signals
US5918223A (en) * 1996-07-22 1999-06-29 Muscle Fish Method and article of manufacture for content-based analysis, storage, retrieval, and segmentation of audio information
US6434520B1 (en) * 1999-04-16 2002-08-13 International Business Machines Corporation System and method for indexing and querying audio archives
JP2001042866A (ja) * 1999-05-21 2001-02-16 Yamaha Corp ネットワークを介したコンテンツ提供方法及びシステム
GR1003625B (el) 1999-07-08 2001-08-31 Μεθοδος χημικης αποθεσης συνθετων επικαλυψεων αγωγιμων πολυμερων σε επιφανειες κραματων αλουμινιου
JP2001075992A (ja) * 1999-09-07 2001-03-23 Hitachi Ltd 音響検索方法及び装置、並びに、コンピュータ読みとり可能な記録媒体
JP3969908B2 (ja) * 1999-09-14 2007-09-05 キヤノン株式会社 音声入力端末器、音声認識装置、音声通信システム及び音声通信方法
US7194752B1 (en) * 1999-10-19 2007-03-20 Iceberg Industries, Llc Method and apparatus for automatically recognizing input audio and/or video streams
US7174293B2 (en) * 1999-09-21 2007-02-06 Iceberg Industries Llc Audio identification system and method
US6834308B1 (en) * 2000-02-17 2004-12-21 Audible Magic Corporation Method and apparatus for identifying media content presented on a media playing device
US6453252B1 (en) 2000-05-15 2002-09-17 Creative Technology Ltd. Process for identifying audio content
AU2001267028A1 (en) 2000-06-23 2002-01-08 Mmr Technologies Inc Flexible counter-flow heat exchangers
US6990453B2 (en) * 2000-07-31 2006-01-24 Landmark Digital Services Llc System and methods for recognizing sound and music signals in high noise and distortion
US6748360B2 (en) * 2000-11-03 2004-06-08 International Business Machines Corporation System for selling a product utilizing audio content identification
US7359889B2 (en) * 2001-03-02 2008-04-15 Landmark Digital Services Llc Method and apparatus for automatically creating database for use in automated media recognition system
US7117159B1 (en) * 2001-09-26 2006-10-03 Sprint Spectrum L.P. Method and system for dynamic control over modes of operation of voice-processing in a voice command platform
PT1504445E (pt) * 2002-04-25 2008-11-24 Landmark Digital Services Llc Emparelhamento de padrões áudio robusto e invariante
JP4933899B2 (ja) * 2004-02-19 2012-05-16 ランドマーク、ディジタル、サーヴィセズ、エルエルシー 放送源の識別のための方法および装置
CN101189658A (zh) * 2005-02-08 2008-05-28 兰德马克数字服务有限责任公司 音频信号中重复素材的自动识别
WO2010065673A2 (en) 2008-12-02 2010-06-10 Melodis Corporation System and method for identifying original music
US8428955B2 (en) * 2009-10-13 2013-04-23 Rovi Technologies Corporation Adjusting recorder timing
EP2529527B1 (en) 2010-01-25 2015-12-02 Nokia Solutions and Networks Oy Method for controlling access to resources
US9390170B2 (en) * 2013-03-15 2016-07-12 Shazam Investments Ltd. Methods and systems for arranging and searching a database of media content recordings

Also Published As

Publication number Publication date
US20060122839A1 (en) 2006-06-08
DK1307833T3 (da) 2006-10-02
DE60120417D1 (de) 2006-07-20
US9401154B2 (en) 2016-07-26
KR100776495B1 (ko) 2007-11-16
EP1307833B1 (en) 2006-06-07
WO2002011123A2 (en) 2002-02-07
EP1307833A2 (en) 2003-05-07
US20120221131A1 (en) 2012-08-30
ES2266254T3 (es) 2007-03-01
US9899030B2 (en) 2018-02-20
HK1051248A1 (en) 2003-07-25
KR20030059085A (ko) 2003-07-07
US20140316787A1 (en) 2014-10-23
US8386258B2 (en) 2013-02-26
CN1592906B (zh) 2010-09-08
US20080208891A1 (en) 2008-08-28
US20160328473A1 (en) 2016-11-10
CN1592906A (zh) 2005-03-09
ATE329319T1 (de) 2006-06-15
US20110071838A1 (en) 2011-03-24
JP2004505328A (ja) 2004-02-19
US20130138442A1 (en) 2013-05-30
US10497378B2 (en) 2019-12-03
BR0112901A (pt) 2003-06-10
JP4945877B2 (ja) 2012-06-06
US8190435B2 (en) 2012-05-29
DE60120417T2 (de) 2007-01-11
US7346512B2 (en) 2008-03-18
US20020083060A1 (en) 2002-06-27
US6990453B2 (en) 2006-01-24
US20180374491A1 (en) 2018-12-27
US8700407B2 (en) 2014-04-15
PT1307833E (pt) 2006-10-31
WO2002011123A3 (en) 2002-05-30
AU2001289766A1 (en) 2002-02-13
US7865368B2 (en) 2011-01-04

Similar Documents

Publication Publication Date Title
US10497378B2 (en) Systems and methods for recognizing sound and music signals in high noise and distortion
US8688248B2 (en) Method and system for content sampling and identification
JP5150266B2 (ja) オーディオ信号において繰り返されるマテリアルの自動識別
CN100437572C (zh) 音频指纹识别系统和方法
US20140214190A1 (en) Method and System for Content Sampling and Identification
WO2016189307A1 (en) Audio identification method
CN109271501B (zh) 一种音频数据库的管理方法及系统
CN117573918A (zh) 用于识别音频片段的方法、装置及计算机可读介质
HK1051248B (en) Method for search in an audio database
HK1169208B (en) Automatic identification of repeated material in audio signals

Legal Events

Date Code Title Description
B25A Requested transfer of rights approved

Owner name: LANDMARK DIGITAL SERVICES LLC (US)

Free format text: TRANSFERIDO DE: SHAZAM ENTERTAINMENT LIMITED

B06A Patent application procedure suspended [chapter 6.1 patent gazette]
B09A Decision: intention to grant [chapter 9.1 patent gazette]
B16A Patent or certificate of addition of invention granted [chapter 16.1 patent gazette]

Free format text: PRAZO DE VALIDADE: 10 (DEZ) ANOS CONTADOS A PARTIR DE 22/12/2015, OBSERVADAS AS CONDICOES LEGAIS.

B21F Lapse acc. art. 78, item iv - on non-payment of the annual fees in time
B24J Lapse because of non-payment of annual fees (definitively: art 78 iv lpi, resolution 113/2013 art. 12)