HK141496A - Speech recognition - Google Patents
Speech recognitionInfo
- Publication number
- HK141496A HK141496A HK141496A HK141496A HK141496A HK 141496 A HK141496 A HK 141496A HK 141496 A HK141496 A HK 141496A HK 141496 A HK141496 A HK 141496A HK 141496 A HK141496 A HK 141496A
- Authority
- HK
- Hong Kong
- Prior art keywords
- templates
- word
- template
- stored
- words
- Prior art date
Links
Classifications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/06—Creation of reference templates; Training of speech recognition systems, e.g. adaptation to the characteristics of the speaker's voice
- G10L15/063—Training
Landscapes
- Engineering & Computer Science (AREA)
- Multimedia (AREA)
- Artificial Intelligence (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Physics & Mathematics (AREA)
- Computational Linguistics (AREA)
- Acoustics & Sound (AREA)
- Machine Translation (AREA)
- Fittings On The Vehicle Exterior For Carrying Loads, And Devices For Holding Or Mounting Articles (AREA)
- Reverberation, Karaoke And Other Acoustics (AREA)
- Bidet-Like Cleaning Device And Other Flush Toilet Accessories (AREA)
- Image Analysis (AREA)
- Navigation (AREA)
- Radio Relay Systems (AREA)
- Data Exchanges In Wide-Area Networks (AREA)
Claims (7)
- Verfahren zur Erzeugung von Schablonen für eine Liste von Wörtern zur Verwendung bei der Spracherkennung, mit den Schritten: Analysieren von Sprachsignalen von mehreren Benutzern, um zumindest eine Schablone für jedes Wort aus der Liste zu erzeugen, das durch jeden Benutzer eingegeben wurde, und Erzeugen aus diesen Schablonen eines Satzes von repräsentativen Schablonen für jedes der Worte, dadurch gekennzeichnet, daß im Erzeugungsschritt jeder Benutzer alle Worte einer gegebenen Wortliste in einem "Zwangs"-Modus eingibt, indem er entweder die Wörter der Liste liest oder indem er die Wörter der Liste wiederholt, die vorher durch einen Synthesizer ausgesprochen wurden, und dann zumindest einige der Wörter der Liste in einem "freien" Modus eingibt, indem er eine Reihe von durch den Synthesizer ausgesprochenen Fragen beantwortet, wobei die Fragen so entworfen sind, daß sie vom Benutzer die Wörter der Liste als Einwort-Antworten hervorrufen.
- Verfahren nach Anspruch 1, bei dem: jedes im "Zwangs"-Modus eingegebene Wort mit allen Bezugsschablonen der Wörter in der Liste verglichen wird, wobei diese Bezugsschablonen in einem ersten Schablonenspeicher gespeichert sind, im Analyseschritt für jedes im "Zwangs"-Modus ausgesprochene Einzelwort eine für dieses Einzelwort erzeugte Schablone identifiziert wird, indem sie mit jeder der gespeicherten Vergleichsschablonen verglichen wird, wobei die für das Einzelwort erzeugte Schablone markiert und dann in einem zweiten Schablonenspeicher gespeichert wird.
- Verfahren nach Anspruch 2, bei dem im Analyseschritt für jedes im "freien" Modus ausgesprochene Einzelwort eine für dieses Einzelwort erzeugte Schablone mit allen im ersten und zweiten Schablonenspeicher gespeicherten Schablonen verglichen wird, wobei die Schablone für dieses Einzelwort identifiziert und markiert und die markierte Schablone im zweiten Schablonenspeicher gespeichert wird.
- Verfahren nach Anspruch 3, bei dem: alle Schablonen einer gegebenen Anzahl von Benutzern vor dem Erzeugungsschritt in einem dritten Schablonenspeicher gespeichert werden, und die im Erzeugungsschritt identifizierten Schablonen in einem vierten Schablonenspeicher gespeichert werden.
- Verfahren nach Anspruch 4, bei dem: der Erzeugungsschritt den Schritt des Vergleichens jeder Schablone im dritten Schablonenspeicher mit allen Schablonen des gleichen Worts und mit allen Schablonen beliebiger anderer Worte, die mit dem erstgenannten Wort in vorbestimmter Weise verbunden sind, umfaßt, wobei der Erzeugungsschritt so ausgelegt ist, daß die im vierten Schablonenspeicher gespeicherten Schablonen eines gegebenen Worts repräsentativ für eine Maximalzahl von im dritten Schablonenspeicher gespeicherten Schablonen dieses Wort sind und nicht repräsentativ für beliebige andere Schablonen, die im dritten Schablonenspeicher gespeichert sind.
- Verfahren zur Erzeugung eines Satzes von Sprachschablonen, der in einem nachfolgenden Spracherkennungsprozeß verwendet wird, wobei das Verfahren für jedes einer Mehrzahl von Worten umfaßt:i) Erzeugen mehrerer erster Sprachschablonen in einem "Zwangs"-Modus, in dem ein menschlicher Sprecher unmittelbar aufgefordert wird, ein gegebenes Wort auszusprechen, undii) Erzeugen mehrerer zweiter Sprachschablonen in einem "freien" Modus, in dem ein menschlicher Sprecher dazu veranlaßt wird, das gleiche gegebene Wort auszusprechen, ohne daß er direkt darum gebeten worden wäre, beispielsweise indem er eine Frage gefragt wird, auf die zur Bildung der Antwort das Wort berechnet wird,gekennzeichnet durch den Schritt iii) Auswählen eines endgültigen Satzes von Schablonen aus den ersten und zweiten Sprachschablonen, wobei der endgültige Satz nachfolgend in einem Spracherkennungsvorgang verwendet wird, wobei der endgültige Satz keine aus den ersten und/oder zweiten Sprachschablonen zusammengesetzten Schablonen umfaßt.
- Sprecherunabhängiges Spracherkennungssystem für isolierte Worte mit einem Mehrwortvokabular, wobei das System einen gespeicherten Satz von Schablonen aufweist, wobei der gespeicherte Schablonensatz für jedes Wort des Vokabulars mehrere Schablonen aufweist, dadurch gekennzeichnet, daß der gespeicherte Satz von Schablonen Schablonen enthält, die aus Aussprachen im "freien" Modus hergeleitet wurden, jedoch keine zusammengesetzten Schablonen, die aus Aussprachen im "freien" Modus und/oder im "Zwangs"-Modus gebildet werden würden, wobei der gespeicherte Satz von Schablonen gemäß dem Verfahren nach einem der Ansprüche 1 bis 6 aufgebaut ist.
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| GB878720392A GB8720392D0 (en) | 1987-08-28 | 1987-08-28 | Speech database acquisition |
| GB888804201A GB8804201D0 (en) | 1988-02-23 | 1988-02-23 | Speech recognition |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| HK141496A true HK141496A (en) | 1996-08-09 |
Family
ID=26292662
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| HK141496A HK141496A (en) | 1987-08-28 | 1996-08-01 | Speech recognition |
Country Status (6)
| Country | Link |
|---|---|
| US (1) | US5146503A (de) |
| EP (1) | EP0305215B1 (de) |
| AT (1) | ATE122171T1 (de) |
| CA (1) | CA1325479C (de) |
| DE (1) | DE3853702T2 (de) |
| HK (1) | HK141496A (de) |
Families Citing this family (13)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| DE4031421C2 (de) * | 1989-10-05 | 1995-08-24 | Ricoh Kk | Musteranpassungssystem für eine Spracherkennungseinrichtung |
| US5293451A (en) * | 1990-10-23 | 1994-03-08 | International Business Machines Corporation | Method and apparatus for generating models of spoken words based on a small number of utterances |
| US6092043A (en) * | 1992-11-13 | 2000-07-18 | Dragon Systems, Inc. | Apparatuses and method for training and operating speech recognition systems |
| US5920836A (en) * | 1992-11-13 | 1999-07-06 | Dragon Systems, Inc. | Word recognition system using language context at current cursor position to affect recognition probabilities |
| US5428707A (en) * | 1992-11-13 | 1995-06-27 | Dragon Systems, Inc. | Apparatus and methods for training speech recognition systems and their users and otherwise improving speech recognition performance |
| US6081782A (en) * | 1993-12-29 | 2000-06-27 | Lucent Technologies Inc. | Voice command control and verification system |
| GB9929284D0 (en) * | 1999-12-11 | 2000-02-02 | Ibm | Voice processing apparatus |
| US7324942B1 (en) * | 2002-01-29 | 2008-01-29 | Microstrategy, Incorporated | System and method for interactive voice services using markup language with N-best filter element |
| US20040203629A1 (en) * | 2002-03-04 | 2004-10-14 | Dezonno Anthony J. | Intelligent interactive voice response unit |
| GB2409087A (en) * | 2003-12-12 | 2005-06-15 | Ibm | Computer generated prompting |
| US8229733B2 (en) * | 2006-02-09 | 2012-07-24 | John Harney | Method and apparatus for linguistic independent parsing in a natural language systems |
| US20090240499A1 (en) * | 2008-03-19 | 2009-09-24 | Zohar Dvir | Large vocabulary quick learning speech recognition system |
| JP2010154397A (ja) * | 2008-12-26 | 2010-07-08 | Sony Corp | データ処理装置、データ処理方法、及び、プログラム |
Family Cites Families (9)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPS58105295A (ja) * | 1981-12-18 | 1983-06-23 | 株式会社日立製作所 | 音声標準パタン作成方法 |
| JPS58129684A (ja) * | 1982-01-29 | 1983-08-02 | Toshiba Corp | パタ−ン認識装置 |
| JPS58178396A (ja) * | 1982-04-12 | 1983-10-19 | 株式会社日立製作所 | 音声認識用標準パタ−ン登録方式 |
| US4720863A (en) * | 1982-11-03 | 1988-01-19 | Itt Defense Communications | Method and apparatus for text-independent speaker recognition |
| US4712243A (en) * | 1983-05-09 | 1987-12-08 | Casio Computer Co., Ltd. | Speech recognition apparatus |
| JPS59216284A (ja) * | 1983-05-23 | 1984-12-06 | Matsushita Electric Ind Co Ltd | パタ−ン認識装置 |
| US4618984A (en) * | 1983-06-08 | 1986-10-21 | International Business Machines Corporation | Adaptive automatic discrete utterance recognition |
| US4783803A (en) * | 1985-11-12 | 1988-11-08 | Dragon Systems, Inc. | Speech recognition apparatus and method |
| GB8617389D0 (en) * | 1986-07-16 | 1986-08-20 | British Telecomm | Speech recognition |
-
1988
- 1988-08-24 US US07/235,416 patent/US5146503A/en not_active Expired - Fee Related
- 1988-08-26 EP EP88307979A patent/EP0305215B1/de not_active Expired - Lifetime
- 1988-08-26 CA CA000575746A patent/CA1325479C/en not_active Expired - Fee Related
- 1988-08-26 AT AT88307979T patent/ATE122171T1/de not_active IP Right Cessation
- 1988-08-26 DE DE3853702T patent/DE3853702T2/de not_active Expired - Fee Related
-
1996
- 1996-08-01 HK HK141496A patent/HK141496A/en not_active IP Right Cessation
Also Published As
| Publication number | Publication date |
|---|---|
| ATE122171T1 (de) | 1995-05-15 |
| DE3853702T2 (de) | 1995-09-14 |
| EP0305215A3 (en) | 1990-07-25 |
| EP0305215B1 (de) | 1995-05-03 |
| CA1325479C (en) | 1993-12-21 |
| US5146503A (en) | 1992-09-08 |
| DE3853702D1 (de) | 1995-06-08 |
| EP0305215A2 (de) | 1989-03-01 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JP3968133B2 (ja) | 音声認識対話処理方法および音声認識対話装置 | |
| JP4867804B2 (ja) | 音声認識装置及び会議システム | |
| US6975986B2 (en) | Voice spelling in an audio-only interface | |
| US5842168A (en) | Cartridge-based, interactive speech recognition device with response-creation capability | |
| US5454062A (en) | Method for recognizing spoken words | |
| US5748840A (en) | Methods and apparatus for improving the reliability of recognizing words in a large database when the words are spelled or spoken | |
| US5995928A (en) | Method and apparatus for continuous spelling speech recognition with early identification | |
| EP0305215B1 (de) | Spracherkennung | |
| US5623578A (en) | Speech recognition system allows new vocabulary words to be added without requiring spoken samples of the words | |
| US5428707A (en) | Apparatus and methods for training speech recognition systems and their users and otherwise improving speech recognition performance | |
| EP0700031A1 (de) | Spracherkennung mit Erkennung falscher Wörter | |
| EP0661690A1 (de) | Spracherkennung | |
| CA2126380A1 (en) | Minimum Error Rate Training of Combined String Models | |
| EP1398758B1 (de) | Verfahren und Vorrichtung zur Erzeugung von Entscheidungsbaumfragen für die Sprachverarbeitung | |
| JP4216361B2 (ja) | 数字用音声認識システム | |
| JP2980382B2 (ja) | 話者適応音声認識方法および装置 | |
| JP3438293B2 (ja) | 音声認識における単語テンプレートの自動作成方法 | |
| GB2192746A (en) | Speech recognition | |
| JP2537183B2 (ja) | 音声情報認識方法 | |
| JPH0546950B2 (de) | ||
| JPH04271397A (ja) | 音声認識装置 | |
| JPS59212900A (ja) | 音声認識装置 | |
| CA1236578A (en) | Feneme-based markov models for words | |
| JPS63303398A (ja) | 音声認識装置 | |
| Pandit et al. | Selection of speaker independent feature for a speaker verification system |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| PC | Patent ceased (i.e. patent has lapsed due to the failure to pay the renewal fee) |