HK40596A - Optimal method of data reduction in a speech recognition system - Google Patents

Optimal method of data reduction in a speech recognition system Download PDF

Info

Publication number
HK40596A
HK40596A HK40596A HK40596A HK40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A
Authority
HK
Hong Kong
Prior art keywords
frames
frame
block
word
representative
Prior art date
Application number
HK40596A
Other languages
German (de)
English (en)
Inventor
Alan Gerson Ira
Louis Lindsley Brett
Original Assignee
Motorola, Inc.
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Motorola, Inc. filed Critical Motorola, Inc.
Publication of HK40596A publication Critical patent/HK40596A/en

Links

Classifications

    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L13/00Speech synthesis; Text to speech systems
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition

Landscapes

  • Engineering & Computer Science (AREA)
  • Computational Linguistics (AREA)
  • Health & Medical Sciences (AREA)
  • Audiology, Speech & Language Pathology (AREA)
  • Human Computer Interaction (AREA)
  • Physics & Mathematics (AREA)
  • Acoustics & Sound (AREA)
  • Multimedia (AREA)
  • Telephonic Communication Services (AREA)
  • Transmission Systems Not Characterized By The Medium Used For Transmission (AREA)
  • Complex Calculations (AREA)
  • Time-Division Multiplex Systems (AREA)

Claims (8)

  1. Un procédé de réduction d'une séquence de trames de parole d'origine (510), en un groupe réduit de trames représentatives (514), comprenant les étapes suivantes :    on enregistre un ensemble de trames d'origine prélevées dans la séquence;    on combine les trames d'origine enregistrées en un ensemble de trames représentatives;    on génère pour chaque trame représentative une mesure de distorsion (D1-D5) correspondant à la distance entre chacune des trames représentatives et les trames d'origine qui sont combinées pour former cette trame représentative;    on compare chaque mesure de distorsion avec un seuil de distorsion prédéterminé; caractérisé en ce que    on sélectionne, à partir de l'ensemble de trames représentatives, au moins une trame représentative ayant une mesure de distorsion inférieure au seuil de distorsion prédéterminé, et représentant le plus grand nombre de trames d'origine enregistrées; et    on sélectionne une trame représentative parmi la ou les trames représentatives sélectionnées, qui a une mesure de distorsion générée qui est la plus faible des mesures de distorsion générées de la trame ou des trames représentatives sélectionnées.
  2. Un procédé de réduction d'une séquence de trames de parole d'origine (510) en un groupe réduit de trames représentatives (514), comprenant les étapes suivantes :    on forme des chemins de groupement se terminant à chaque trame d'origine dans la séquence, ces trames appartenant à une séquence qui porte les désignations m à n, avec m<n, chaque chemin de groupement étant constitué par une série de trames d'origine combinées;    on forme une trame représentative supplémentaire en combinant des trames j à n+1, avec m≦j≦n, et j étant un entier qui désigne une trame dans la série, cette opération de formation d'une trame représentative supplémentaire comprenant les étapes suivantes :    on génère, pour cette trame représentative supplémentaire, une mesure de distorsion (D1-D5) correspondant à la distance entre la trame représentative supplémentaire et des trames d'origine qui sont combinées dans cette dernière, et on compare cette mesure de distorsion avec un seuil de distorsion prédéterminé;    on ajoute cette trame représentative supplémentaire aux chemins de groupement formés précédemment, si cette mesure de distorsion ne dépasse pas le seuil de distorsion, grâce à quoi le groupe réduit résultant de trames représentatives est constitué par la trame représentative supplémentaire ajoutée au chemin de groupement qui est formé à la trame j-1; et    on invalide au moins un chemin de groupement précité lorsqu'on détermine qu'un autre chemin de groupement a moins de trames représentatives.
  3. Le procédé de la revendication 1 ou 2, comprenant en outre l'étape qui consiste à déterminer une trame de référence de convergence.
  4. Le procédé de la revendication 2, comprenant en outre l'étape qui consiste à déterminer une mesure de distorsion associée avec le groupe de trames représentatives.
  5. Un dispositif destiné à réduire une séquence de trames de parole d'origine (510) en un groupe réduit de trames représentatives (514), comprenant :    des moyens destinés à enregistrer un ensemble de trames d'origine prélevées dans la séquence;    des moyens destinés à combiner les trames d'origine enregistrées en un ensemble de trames représentatives;    des moyens destinés à générer pour chaque trame représentative une mesure de distorsion (D1-D5) correspondant à la distance entre chaque trame représentative et les trames d'origine qui sont combinées dans cette trame représentative;    des moyens destinés à comparer chaque mesure de distorsion avec un seuil de distorsion prédéterminé;    des moyens destinés à sélectionner, parmi l'ensemble de trames représentatives, au moins une trame représentative ayant une mesure de distorsion inférieure au seuil de distorsion prédéterminé, et représentant le plus grand nombre de trames d'origine enregistrées, et    des moyens destinés à sélectionner une trame représentative parmi la ou les trames représentatives sélectionnées, qui a une mesure de distorsion générée qui est la plus faible des mesures de distorsion générées de la trame ou des trames représentatives sélectionnées.
  6. Un dispositif destiné à réduire une séquence de trames de parole d'origine (510) en un groupe réduit de trames représentatives (514), comprenant :    des moyens destinés à former des chemins de groupement se terminant à chaque trame d'origine dans la séquence, ces trames formant une séquence que l'on désigne par m à n, avec m<n, chaque chemin de groupement étant composé d'une série de trames d'origine combinées;    des moyens destinés à former une trame représentative supplémentaire, en combinant des trames j à n+1, avec m≦j≦n, et j étant un entier qui désigne une trame dans la série, ces moyens de formation d'une trame représentative supplémentaire comprenant : des moyens destinés à générer, pour la trame représentative supplémentaire, une mesure de distorsion (D1-D5) correspondant à la distance entre la trame représentative supplémentaire et les trames d'origine qui sont combinées dans cette dernière, et des moyens destinés à comparer cette mesure de distorsion avec un seuil de distorsion prédéterminé, caractérisé par :    des moyens destinés à ajouter à la trame représentative supplémentaire les chemins de groupement formés précédemment, si la mesure de distorsion ne dépasse pas le seuil de distorsion, grâce à quoi le groupe de trames représentatives réduit résultant est constitué par la trame représentative supplémentaire qui est ajoutée au chemin de groupement formé à la trame j-1; et    des moyens destinés à invalider au moins un chemin de groupement précité lorsqu'on détermine qu'un autre chemin de groupement comprend moins de trames représentatives.
  7. Le dispositif de la revendication 5 ou 6, comprenant en outre des moyens qui sont destinés à déterminer une trame de référence de convergence.
  8. Le dispositif de la revendication 6, comprenant en outre des moyens qui sont destinés à déterminer une mesure de distorsion associée au groupe de trames représentatives.
HK40596A 1986-01-03 1996-03-07 Optimal method of data reduction in a speech recognition system HK40596A (en)

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
US81616386A 1986-01-03 1986-01-03

Publications (1)

Publication Number Publication Date
HK40596A true HK40596A (en) 1996-03-15

Family

ID=25219842

Family Applications (1)

Application Number Title Priority Date Filing Date
HK40596A HK40596A (en) 1986-01-03 1996-03-07 Optimal method of data reduction in a speech recognition system

Country Status (8)

Country Link
US (1) US4905288A (fr)
EP (1) EP0252946B1 (fr)
JP (1) JP3168562B2 (fr)
KR (1) KR950008539B1 (fr)
CA (1) CA1299750C (fr)
DE (1) DE3688747T2 (fr)
HK (1) HK40596A (fr)
WO (1) WO1987004290A1 (fr)

Families Citing this family (29)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US4802224A (en) * 1985-09-26 1989-01-31 Nippon Telegraph And Telephone Corporation Reference speech pattern generating method
JPH0782359B2 (ja) * 1989-04-21 1995-09-06 三菱電機株式会社 音声符号化装置、音声復号化装置及び音声符号化・復号化装置
US5146538A (en) * 1989-08-31 1992-09-08 Motorola, Inc. Communication system and method with voice steering
US5271089A (en) * 1990-11-02 1993-12-14 Nec Corporation Speech parameter encoding method capable of transmitting a spectrum parameter at a reduced number of bits
US5195168A (en) * 1991-03-15 1993-03-16 Codex Corporation Speech coder and method having spectral interpolation and fast codebook search
US5152007A (en) * 1991-04-23 1992-09-29 Motorola, Inc. Method and apparatus for detecting speech
US5485621A (en) * 1991-05-10 1996-01-16 Siemens Corporate Research, Inc. Interactive method of using a group similarity measure for providing a decision on which groups to combine
CA2483324C (fr) * 1991-06-11 2008-05-06 Qualcomm Incorporated Vocodeur a debit variable
US5548681A (en) * 1991-08-13 1996-08-20 Kabushiki Kaisha Toshiba Speech dialogue system for realizing improved communication between user and system
GB2272554A (en) * 1992-11-13 1994-05-18 Creative Tech Ltd Recognizing speech by using wavelet transform and transient response therefrom
US5351046A (en) * 1993-05-28 1994-09-27 Adcox Thomas A Method and system for compacting binary coded decimal data
TW271524B (fr) 1994-08-05 1996-03-01 Qualcomm Inc
US5742734A (en) * 1994-08-10 1998-04-21 Qualcomm Incorporated Encoding rate selection in a variable rate vocoder
US5960395A (en) * 1996-02-09 1999-09-28 Canon Kabushiki Kaisha Pattern matching method, apparatus and computer readable memory medium for speech recognition using dynamic programming
US5751901A (en) * 1996-07-31 1998-05-12 Qualcomm Incorporated Method for searching an excitation codebook in a code excited linear prediction (CELP) coder
US6131084A (en) * 1997-03-14 2000-10-10 Digital Voice Systems, Inc. Dual subframe quantization of spectral magnitudes
US6161089A (en) * 1997-03-14 2000-12-12 Digital Voice Systems, Inc. Multi-subframe quantization of spectral parameters
US6009383A (en) * 1997-10-30 1999-12-28 Nortel Networks Corporation Digital connection for voice activated services on wireless networks
KR100277105B1 (ko) * 1998-02-27 2001-01-15 윤종용 음성 인식 데이터 결정 장치 및 방법
US6208969B1 (en) 1998-07-24 2001-03-27 Lucent Technologies Inc. Electronic data processing apparatus and method for sound synthesis using transfer functions of sound samples
US6073093A (en) * 1998-10-14 2000-06-06 Lockheed Martin Corp. Combined residual and analysis-by-synthesis pitch-dependent gain estimation for linear predictive coders
US6735563B1 (en) * 2000-07-13 2004-05-11 Qualcomm, Inc. Method and apparatus for constructing voice templates for a speaker-independent voice recognition system
DE10054583C2 (de) * 2000-11-03 2003-06-18 Digital Design Gmbh Verfahren und Vorrichtung zum Aufzeichnen, Suchen und Wiedergeben von Notizen
US20030046084A1 (en) * 2001-08-28 2003-03-06 Blair Wyman Method and apparatus for providing location-specific responses in an automated voice response system
US7165028B2 (en) * 2001-12-12 2007-01-16 Texas Instruments Incorporated Method of speech recognition resistant to convolutive distortion and additive distortion
WO2008107027A1 (fr) * 2007-03-02 2008-09-12 Telefonaktiebolaget Lm Ericsson (Publ) Procédés et montages dans un réseau de télécommunications
US11082510B2 (en) * 2012-01-26 2021-08-03 Micro Focus Llc Identifying a push communication pattern
US9373338B1 (en) * 2012-06-25 2016-06-21 Amazon Technologies, Inc. Acoustic echo cancellation processing based on feedback from speech recognizer
CN114550694B (zh) * 2022-02-16 2025-10-28 深圳Tcl新技术有限公司 设备的语音测试方法、装置、存储介质及计算机设备

Family Cites Families (20)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
DE1162398B (de) * 1961-10-24 1964-02-06 Ibm Verdichter fuer Daten, die aus Bits verschiedener Wertigkeit bestehen
US3582559A (en) * 1969-04-21 1971-06-01 Scope Inc Method and apparatus for interpretation of time-varying signals
US3812291A (en) * 1972-06-19 1974-05-21 Scope Inc Signal pattern encoder and classifier
DE2657365C2 (de) * 1976-12-17 1978-11-02 Siemens Ag, 1000 Berlin Und 8000 Muenchen Verfahren und Schaltungsanordnung zur Durchführung des Verfahrens zur Rahmensynchronisierung eines Zeitmultiplexsystems
US4227177A (en) * 1978-04-27 1980-10-07 Dialog Systems, Inc. Continuous speech recognition method
US4227176A (en) * 1978-04-27 1980-10-07 Dialog Systems, Inc. Continuous speech recognition method
US4181813A (en) * 1978-05-08 1980-01-01 John Marley System and method for speech recognition
US4181821A (en) * 1978-10-31 1980-01-01 Bell Telephone Laboratories, Incorporated Multiple template speech recognition system
US4412098A (en) * 1979-09-10 1983-10-25 Interstate Electronics Corporation Audio signal recognition computer
JPS56101200A (en) * 1980-01-16 1981-08-13 Matsushita Electric Industrial Co Ltd Compacting method of voice pattern
US4449233A (en) * 1980-02-04 1984-05-15 Texas Instruments Incorporated Speech synthesis system with parameter look up table
US4328395A (en) * 1980-02-04 1982-05-04 Texas Instruments Incorporated Speech synthesis system with variable interpolation capability
US4624009A (en) * 1980-05-02 1986-11-18 Figgie International, Inc. Signal pattern encoder and classifier
US4513436A (en) * 1980-09-16 1985-04-23 Oki Electric Industry, Co., Ltd. Speech recognition system
US4415767A (en) * 1981-10-19 1983-11-15 Votan Method and apparatus for speech recognition and reproduction
JPS58105295A (ja) * 1981-12-18 1983-06-23 株式会社日立製作所 音声標準パタン作成方法
US4449190A (en) * 1982-01-27 1984-05-15 Bell Telephone Laboratories, Incorporated Silence editing speech processor
JPS58137899A (ja) * 1982-02-12 1983-08-16 日本電気株式会社 パタン認識装置
US4520499A (en) * 1982-06-25 1985-05-28 Milton Bradley Company Combination speech synthesis and recognition apparatus
US4550425A (en) * 1982-09-20 1985-10-29 Sperry Corporation Speech sampling and companding device

Also Published As

Publication number Publication date
US4905288A (en) 1990-02-27
KR950008539B1 (ko) 1995-07-31
DE3688747D1 (de) 1993-08-26
DE3688747T2 (de) 1993-10-28
WO1987004290A1 (fr) 1987-07-16
CA1299750C (fr) 1992-04-28
EP0252946A1 (fr) 1988-01-20
JP3168562B2 (ja) 2001-05-21
JPS63502145A (ja) 1988-08-18
KR880700986A (ko) 1988-04-13
EP0252946B1 (fr) 1993-07-21
EP0252946A4 (fr) 1988-05-31

Similar Documents

Publication Publication Date Title
EP0249635B1 (fr) Reconnaissance de mots dans un systeme de reconnaissance de la parole utilisant des modeles de mots avec reduction des donnees
EP0252946B1 (fr) Methode optimale de reduction des donnees dans un systeme de reconnaissance de la parole
EP0255524B1 (fr) Methode et appareil pour synthetiser la parole sans informations vocales ou relatives a la hauteur du son
US4220819A (en) Residual excited predictive speech coding system
EP0255523B1 (fr) Procede et appareil pour synthetiser la parole a partir de modeles de reconnaissance de la parole
US4791670A (en) Method of and device for speech signal coding and decoding by vector quantization techniques
EP1141939A1 (fr) Systeme et procede pour la segmentation et la reconnaissance de signaux vocaux
US20040148160A1 (en) Method and apparatus for noise suppression within a distributed speech recognition system
EP1076895B1 (fr) Systeme et procede pour ameliorer la qualite d&#39;un signal vocal code coexistant avec un bruit de fond
KR100205060B1 (ko) 정규 펄스 여기 방식을 이용한 celp 보코더의 피치검색 방법
Gersho Concepts and paradigms in speech coding
GB2266213A (en) Digital signal coding

Legal Events

Date Code Title Description
PF Patent in force
PE Patent expired

Effective date: 20061217