HK40596A - Optimal method of data reduction in a speech recognition system - Google Patents
Optimal method of data reduction in a speech recognition system Download PDFInfo
- Publication number
- HK40596A HK40596A HK40596A HK40596A HK40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A
- Authority
- HK
- Hong Kong
- Prior art keywords
- frames
- frame
- block
- word
- representative
- Prior art date
Links
Classifications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L13/00—Speech synthesis; Text to speech systems
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
Landscapes
- Engineering & Computer Science (AREA)
- Computational Linguistics (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Physics & Mathematics (AREA)
- Acoustics & Sound (AREA)
- Multimedia (AREA)
- Telephonic Communication Services (AREA)
- Transmission Systems Not Characterized By The Medium Used For Transmission (AREA)
- Complex Calculations (AREA)
- Time-Division Multiplex Systems (AREA)
Claims (8)
- Un procédé de réduction d'une séquence de trames de parole d'origine (510), en un groupe réduit de trames représentatives (514), comprenant les étapes suivantes : on enregistre un ensemble de trames d'origine prélevées dans la séquence; on combine les trames d'origine enregistrées en un ensemble de trames représentatives; on génère pour chaque trame représentative une mesure de distorsion (D1-D5) correspondant à la distance entre chacune des trames représentatives et les trames d'origine qui sont combinées pour former cette trame représentative; on compare chaque mesure de distorsion avec un seuil de distorsion prédéterminé; caractérisé en ce que on sélectionne, à partir de l'ensemble de trames représentatives, au moins une trame représentative ayant une mesure de distorsion inférieure au seuil de distorsion prédéterminé, et représentant le plus grand nombre de trames d'origine enregistrées; et on sélectionne une trame représentative parmi la ou les trames représentatives sélectionnées, qui a une mesure de distorsion générée qui est la plus faible des mesures de distorsion générées de la trame ou des trames représentatives sélectionnées.
- Un procédé de réduction d'une séquence de trames de parole d'origine (510) en un groupe réduit de trames représentatives (514), comprenant les étapes suivantes : on forme des chemins de groupement se terminant à chaque trame d'origine dans la séquence, ces trames appartenant à une séquence qui porte les désignations m à n, avec m<n, chaque chemin de groupement étant constitué par une série de trames d'origine combinées; on forme une trame représentative supplémentaire en combinant des trames j à n+1, avec m≦j≦n, et j étant un entier qui désigne une trame dans la série, cette opération de formation d'une trame représentative supplémentaire comprenant les étapes suivantes : on génère, pour cette trame représentative supplémentaire, une mesure de distorsion (D1-D5) correspondant à la distance entre la trame représentative supplémentaire et des trames d'origine qui sont combinées dans cette dernière, et on compare cette mesure de distorsion avec un seuil de distorsion prédéterminé; on ajoute cette trame représentative supplémentaire aux chemins de groupement formés précédemment, si cette mesure de distorsion ne dépasse pas le seuil de distorsion, grâce à quoi le groupe réduit résultant de trames représentatives est constitué par la trame représentative supplémentaire ajoutée au chemin de groupement qui est formé à la trame j-1; et on invalide au moins un chemin de groupement précité lorsqu'on détermine qu'un autre chemin de groupement a moins de trames représentatives.
- Le procédé de la revendication 1 ou 2, comprenant en outre l'étape qui consiste à déterminer une trame de référence de convergence.
- Le procédé de la revendication 2, comprenant en outre l'étape qui consiste à déterminer une mesure de distorsion associée avec le groupe de trames représentatives.
- Un dispositif destiné à réduire une séquence de trames de parole d'origine (510) en un groupe réduit de trames représentatives (514), comprenant : des moyens destinés à enregistrer un ensemble de trames d'origine prélevées dans la séquence; des moyens destinés à combiner les trames d'origine enregistrées en un ensemble de trames représentatives; des moyens destinés à générer pour chaque trame représentative une mesure de distorsion (D1-D5) correspondant à la distance entre chaque trame représentative et les trames d'origine qui sont combinées dans cette trame représentative; des moyens destinés à comparer chaque mesure de distorsion avec un seuil de distorsion prédéterminé; des moyens destinés à sélectionner, parmi l'ensemble de trames représentatives, au moins une trame représentative ayant une mesure de distorsion inférieure au seuil de distorsion prédéterminé, et représentant le plus grand nombre de trames d'origine enregistrées, et des moyens destinés à sélectionner une trame représentative parmi la ou les trames représentatives sélectionnées, qui a une mesure de distorsion générée qui est la plus faible des mesures de distorsion générées de la trame ou des trames représentatives sélectionnées.
- Un dispositif destiné à réduire une séquence de trames de parole d'origine (510) en un groupe réduit de trames représentatives (514), comprenant : des moyens destinés à former des chemins de groupement se terminant à chaque trame d'origine dans la séquence, ces trames formant une séquence que l'on désigne par m à n, avec m<n, chaque chemin de groupement étant composé d'une série de trames d'origine combinées; des moyens destinés à former une trame représentative supplémentaire, en combinant des trames j à n+1, avec m≦j≦n, et j étant un entier qui désigne une trame dans la série, ces moyens de formation d'une trame représentative supplémentaire comprenant : des moyens destinés à générer, pour la trame représentative supplémentaire, une mesure de distorsion (D1-D5) correspondant à la distance entre la trame représentative supplémentaire et les trames d'origine qui sont combinées dans cette dernière, et des moyens destinés à comparer cette mesure de distorsion avec un seuil de distorsion prédéterminé, caractérisé par : des moyens destinés à ajouter à la trame représentative supplémentaire les chemins de groupement formés précédemment, si la mesure de distorsion ne dépasse pas le seuil de distorsion, grâce à quoi le groupe de trames représentatives réduit résultant est constitué par la trame représentative supplémentaire qui est ajoutée au chemin de groupement formé à la trame j-1; et des moyens destinés à invalider au moins un chemin de groupement précité lorsqu'on détermine qu'un autre chemin de groupement comprend moins de trames représentatives.
- Le dispositif de la revendication 5 ou 6, comprenant en outre des moyens qui sont destinés à déterminer une trame de référence de convergence.
- Le dispositif de la revendication 6, comprenant en outre des moyens qui sont destinés à déterminer une mesure de distorsion associée au groupe de trames représentatives.
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| US81616386A | 1986-01-03 | 1986-01-03 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| HK40596A true HK40596A (en) | 1996-03-15 |
Family
ID=25219842
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| HK40596A HK40596A (en) | 1986-01-03 | 1996-03-07 | Optimal method of data reduction in a speech recognition system |
Country Status (8)
| Country | Link |
|---|---|
| US (1) | US4905288A (fr) |
| EP (1) | EP0252946B1 (fr) |
| JP (1) | JP3168562B2 (fr) |
| KR (1) | KR950008539B1 (fr) |
| CA (1) | CA1299750C (fr) |
| DE (1) | DE3688747T2 (fr) |
| HK (1) | HK40596A (fr) |
| WO (1) | WO1987004290A1 (fr) |
Families Citing this family (29)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US4802224A (en) * | 1985-09-26 | 1989-01-31 | Nippon Telegraph And Telephone Corporation | Reference speech pattern generating method |
| JPH0782359B2 (ja) * | 1989-04-21 | 1995-09-06 | 三菱電機株式会社 | 音声符号化装置、音声復号化装置及び音声符号化・復号化装置 |
| US5146538A (en) * | 1989-08-31 | 1992-09-08 | Motorola, Inc. | Communication system and method with voice steering |
| US5271089A (en) * | 1990-11-02 | 1993-12-14 | Nec Corporation | Speech parameter encoding method capable of transmitting a spectrum parameter at a reduced number of bits |
| US5195168A (en) * | 1991-03-15 | 1993-03-16 | Codex Corporation | Speech coder and method having spectral interpolation and fast codebook search |
| US5152007A (en) * | 1991-04-23 | 1992-09-29 | Motorola, Inc. | Method and apparatus for detecting speech |
| US5485621A (en) * | 1991-05-10 | 1996-01-16 | Siemens Corporate Research, Inc. | Interactive method of using a group similarity measure for providing a decision on which groups to combine |
| CA2483324C (fr) * | 1991-06-11 | 2008-05-06 | Qualcomm Incorporated | Vocodeur a debit variable |
| US5548681A (en) * | 1991-08-13 | 1996-08-20 | Kabushiki Kaisha Toshiba | Speech dialogue system for realizing improved communication between user and system |
| GB2272554A (en) * | 1992-11-13 | 1994-05-18 | Creative Tech Ltd | Recognizing speech by using wavelet transform and transient response therefrom |
| US5351046A (en) * | 1993-05-28 | 1994-09-27 | Adcox Thomas A | Method and system for compacting binary coded decimal data |
| TW271524B (fr) | 1994-08-05 | 1996-03-01 | Qualcomm Inc | |
| US5742734A (en) * | 1994-08-10 | 1998-04-21 | Qualcomm Incorporated | Encoding rate selection in a variable rate vocoder |
| US5960395A (en) * | 1996-02-09 | 1999-09-28 | Canon Kabushiki Kaisha | Pattern matching method, apparatus and computer readable memory medium for speech recognition using dynamic programming |
| US5751901A (en) * | 1996-07-31 | 1998-05-12 | Qualcomm Incorporated | Method for searching an excitation codebook in a code excited linear prediction (CELP) coder |
| US6131084A (en) * | 1997-03-14 | 2000-10-10 | Digital Voice Systems, Inc. | Dual subframe quantization of spectral magnitudes |
| US6161089A (en) * | 1997-03-14 | 2000-12-12 | Digital Voice Systems, Inc. | Multi-subframe quantization of spectral parameters |
| US6009383A (en) * | 1997-10-30 | 1999-12-28 | Nortel Networks Corporation | Digital connection for voice activated services on wireless networks |
| KR100277105B1 (ko) * | 1998-02-27 | 2001-01-15 | 윤종용 | 음성 인식 데이터 결정 장치 및 방법 |
| US6208969B1 (en) | 1998-07-24 | 2001-03-27 | Lucent Technologies Inc. | Electronic data processing apparatus and method for sound synthesis using transfer functions of sound samples |
| US6073093A (en) * | 1998-10-14 | 2000-06-06 | Lockheed Martin Corp. | Combined residual and analysis-by-synthesis pitch-dependent gain estimation for linear predictive coders |
| US6735563B1 (en) * | 2000-07-13 | 2004-05-11 | Qualcomm, Inc. | Method and apparatus for constructing voice templates for a speaker-independent voice recognition system |
| DE10054583C2 (de) * | 2000-11-03 | 2003-06-18 | Digital Design Gmbh | Verfahren und Vorrichtung zum Aufzeichnen, Suchen und Wiedergeben von Notizen |
| US20030046084A1 (en) * | 2001-08-28 | 2003-03-06 | Blair Wyman | Method and apparatus for providing location-specific responses in an automated voice response system |
| US7165028B2 (en) * | 2001-12-12 | 2007-01-16 | Texas Instruments Incorporated | Method of speech recognition resistant to convolutive distortion and additive distortion |
| WO2008107027A1 (fr) * | 2007-03-02 | 2008-09-12 | Telefonaktiebolaget Lm Ericsson (Publ) | Procédés et montages dans un réseau de télécommunications |
| US11082510B2 (en) * | 2012-01-26 | 2021-08-03 | Micro Focus Llc | Identifying a push communication pattern |
| US9373338B1 (en) * | 2012-06-25 | 2016-06-21 | Amazon Technologies, Inc. | Acoustic echo cancellation processing based on feedback from speech recognizer |
| CN114550694B (zh) * | 2022-02-16 | 2025-10-28 | 深圳Tcl新技术有限公司 | 设备的语音测试方法、装置、存储介质及计算机设备 |
Family Cites Families (20)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| DE1162398B (de) * | 1961-10-24 | 1964-02-06 | Ibm | Verdichter fuer Daten, die aus Bits verschiedener Wertigkeit bestehen |
| US3582559A (en) * | 1969-04-21 | 1971-06-01 | Scope Inc | Method and apparatus for interpretation of time-varying signals |
| US3812291A (en) * | 1972-06-19 | 1974-05-21 | Scope Inc | Signal pattern encoder and classifier |
| DE2657365C2 (de) * | 1976-12-17 | 1978-11-02 | Siemens Ag, 1000 Berlin Und 8000 Muenchen | Verfahren und Schaltungsanordnung zur Durchführung des Verfahrens zur Rahmensynchronisierung eines Zeitmultiplexsystems |
| US4227177A (en) * | 1978-04-27 | 1980-10-07 | Dialog Systems, Inc. | Continuous speech recognition method |
| US4227176A (en) * | 1978-04-27 | 1980-10-07 | Dialog Systems, Inc. | Continuous speech recognition method |
| US4181813A (en) * | 1978-05-08 | 1980-01-01 | John Marley | System and method for speech recognition |
| US4181821A (en) * | 1978-10-31 | 1980-01-01 | Bell Telephone Laboratories, Incorporated | Multiple template speech recognition system |
| US4412098A (en) * | 1979-09-10 | 1983-10-25 | Interstate Electronics Corporation | Audio signal recognition computer |
| JPS56101200A (en) * | 1980-01-16 | 1981-08-13 | Matsushita Electric Industrial Co Ltd | Compacting method of voice pattern |
| US4449233A (en) * | 1980-02-04 | 1984-05-15 | Texas Instruments Incorporated | Speech synthesis system with parameter look up table |
| US4328395A (en) * | 1980-02-04 | 1982-05-04 | Texas Instruments Incorporated | Speech synthesis system with variable interpolation capability |
| US4624009A (en) * | 1980-05-02 | 1986-11-18 | Figgie International, Inc. | Signal pattern encoder and classifier |
| US4513436A (en) * | 1980-09-16 | 1985-04-23 | Oki Electric Industry, Co., Ltd. | Speech recognition system |
| US4415767A (en) * | 1981-10-19 | 1983-11-15 | Votan | Method and apparatus for speech recognition and reproduction |
| JPS58105295A (ja) * | 1981-12-18 | 1983-06-23 | 株式会社日立製作所 | 音声標準パタン作成方法 |
| US4449190A (en) * | 1982-01-27 | 1984-05-15 | Bell Telephone Laboratories, Incorporated | Silence editing speech processor |
| JPS58137899A (ja) * | 1982-02-12 | 1983-08-16 | 日本電気株式会社 | パタン認識装置 |
| US4520499A (en) * | 1982-06-25 | 1985-05-28 | Milton Bradley Company | Combination speech synthesis and recognition apparatus |
| US4550425A (en) * | 1982-09-20 | 1985-10-29 | Sperry Corporation | Speech sampling and companding device |
-
1986
- 1986-12-11 CA CA000525037A patent/CA1299750C/fr not_active Expired - Lifetime
- 1986-12-18 DE DE87900588T patent/DE3688747T2/de not_active Expired - Lifetime
- 1986-12-18 JP JP50057087A patent/JP3168562B2/ja not_active Expired - Fee Related
- 1986-12-18 KR KR1019870700796A patent/KR950008539B1/ko not_active Expired - Lifetime
- 1986-12-18 WO PCT/US1986/002779 patent/WO1987004290A1/fr not_active Ceased
- 1986-12-18 EP EP87900588A patent/EP0252946B1/fr not_active Expired - Lifetime
-
1988
- 1988-10-18 US US07/262,173 patent/US4905288A/en not_active Expired - Lifetime
-
1996
- 1996-03-07 HK HK40596A patent/HK40596A/en not_active IP Right Cessation
Also Published As
| Publication number | Publication date |
|---|---|
| US4905288A (en) | 1990-02-27 |
| KR950008539B1 (ko) | 1995-07-31 |
| DE3688747D1 (de) | 1993-08-26 |
| DE3688747T2 (de) | 1993-10-28 |
| WO1987004290A1 (fr) | 1987-07-16 |
| CA1299750C (fr) | 1992-04-28 |
| EP0252946A1 (fr) | 1988-01-20 |
| JP3168562B2 (ja) | 2001-05-21 |
| JPS63502145A (ja) | 1988-08-18 |
| KR880700986A (ko) | 1988-04-13 |
| EP0252946B1 (fr) | 1993-07-21 |
| EP0252946A4 (fr) | 1988-05-31 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| EP0249635B1 (fr) | Reconnaissance de mots dans un systeme de reconnaissance de la parole utilisant des modeles de mots avec reduction des donnees | |
| EP0252946B1 (fr) | Methode optimale de reduction des donnees dans un systeme de reconnaissance de la parole | |
| EP0255524B1 (fr) | Methode et appareil pour synthetiser la parole sans informations vocales ou relatives a la hauteur du son | |
| US4220819A (en) | Residual excited predictive speech coding system | |
| EP0255523B1 (fr) | Procede et appareil pour synthetiser la parole a partir de modeles de reconnaissance de la parole | |
| US4791670A (en) | Method of and device for speech signal coding and decoding by vector quantization techniques | |
| EP1141939A1 (fr) | Systeme et procede pour la segmentation et la reconnaissance de signaux vocaux | |
| US20040148160A1 (en) | Method and apparatus for noise suppression within a distributed speech recognition system | |
| EP1076895B1 (fr) | Systeme et procede pour ameliorer la qualite d'un signal vocal code coexistant avec un bruit de fond | |
| KR100205060B1 (ko) | 정규 펄스 여기 방식을 이용한 celp 보코더의 피치검색 방법 | |
| Gersho | Concepts and paradigms in speech coding | |
| GB2266213A (en) | Digital signal coding |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| PF | Patent in force | ||
| PE | Patent expired |
Effective date: 20061217 |