KR20200072021A - 음성인식시스템의 도메인 관리 방법 - Google Patents
음성인식시스템의 도메인 관리 방법 Download PDFInfo
- Publication number
- KR20200072021A KR20200072021A KR1020180159723A KR20180159723A KR20200072021A KR 20200072021 A KR20200072021 A KR 20200072021A KR 1020180159723 A KR1020180159723 A KR 1020180159723A KR 20180159723 A KR20180159723 A KR 20180159723A KR 20200072021 A KR20200072021 A KR 20200072021A
- Authority
- KR
- South Korea
- Prior art keywords
- domain
- user
- voice recognition
- recognition system
- management method
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Images
Classifications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
-
- B—PERFORMING OPERATIONS; TRANSPORTING
- B60—VEHICLES IN GENERAL
- B60R—VEHICLES, VEHICLE FITTINGS, OR VEHICLE PARTS, NOT OTHERWISE PROVIDED FOR
- B60R16/00—Electric or fluid circuits specially adapted for vehicles and not otherwise provided for; Arrangement of elements of electric or fluid circuits specially adapted for vehicles and not otherwise provided for
- B60R16/02—Electric or fluid circuits specially adapted for vehicles and not otherwise provided for; Arrangement of elements of electric or fluid circuits specially adapted for vehicles and not otherwise provided for electric constitutive elements
- B60R16/037—Electric or fluid circuits specially adapted for vehicles and not otherwise provided for; Arrangement of elements of electric or fluid circuits specially adapted for vehicles and not otherwise provided for electric constitutive elements for occupant comfort, e.g. for automatic adjustment of appliances according to personal settings, e.g. seats, mirrors, steering wheel
- B60R16/0373—Voice control
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/06—Creation of reference templates; Training of speech recognition systems, e.g. adaptation to the characteristics of the speaker's voice
- G10L15/065—Adaptation
- G10L15/07—Adaptation to the speaker
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/08—Speech classification or search
- G10L15/18—Speech classification or search using natural language modelling
- G10L15/1822—Parsing for meaning understanding
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/26—Speech to text systems
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/08—Speech classification or search
- G10L15/18—Speech classification or search using natural language modelling
- G10L15/1815—Semantic context, e.g. disambiguation of the recognition hypotheses based on word meaning
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/223—Execution procedure of a spoken command
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/225—Feedback of the input speech
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/226—Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/226—Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics
- G10L2015/227—Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics of the speaker; Human-factor methodology
Landscapes
- Engineering & Computer Science (AREA)
- Computational Linguistics (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Physics & Mathematics (AREA)
- Acoustics & Sound (AREA)
- Multimedia (AREA)
- Artificial Intelligence (AREA)
- Mechanical Engineering (AREA)
- Navigation (AREA)
Abstract
이를 위하여, 본 발명은 음성인식시스템의 도메인 관리 방법에 있어서, 차량에 탑재된 시스템으로부터 음성인식 기능정보를 수집하는 단계; 차량에 탑재된 시스템으로부터 상황정보를 수집하는 단계; 및 상기 수집된 음성인식 기능정보와 상황정보에 기초하여 사용자 도메인을 관리하는 단계를 포함한다.
Description
도 2 는 본 발명의 일 실시예에 따른 복수의 사용자를 대상으로 생성한 사용자 도메인 모델을 나타내는 도면,
도 3 은 본 발명의 일 실시예에 따른 예외처리 관리 모듈의 구성을 나타내는 도면,
도 4 는 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법에 대한 흐름도,
도 5 는 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법을 실행하기 위한 컴퓨팅 시스템을 보여주는 블록도이다.
120: 전처리 모듈
130: 음성 인식부
140: NLU 엔진
150: 도메인 처리 모듈
160: 서비스 처리 모듈
Claims (13)
- 차량에 탑재된 시스템으로부터 음성인식 기능정보를 수집하는 단계;
차량에 탑재된 시스템으로부터 상황정보를 수집하는 단계; 및
상기 수집된 음성인식 기능정보와 상황정보에 기초하여 사용자 도메인을 관리하는 단계
를 포함하는 음성인식시스템의 도메인 관리 방법.
- 제 1 항에 있어서,
상기 사용자 도메인은,
복수의 메인 도메인을 포함하고, 각 메인 도메인은 복수의 서브 도메인을 포함하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
- 제 2 항에 있어서,
상기 사용자 도메인을 관리하는 단계는,
특정 메인 도메인을 활성화하거나 비활성화하는 단계; 및
특정 서브 도메인을 활성화하거나 비활성화하는 단계
를 포함하는 음성인식시스템의 도메인 관리 방법.
- 제 2 항에 있어서,
차량에 탑재된 시스템으로부터 수집한 사용자의 선호도 정보에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정하는 단계
를 더 포함하는 음성인식시스템의 도메인 관리 방법.
- 제 4 항에 있어서,
상기 활성화 여부를 결정하는 단계는,
상기 사용자의 선호도 정보로서 사용자가 설정한 메뉴 우선순위 또는 즐겨찾기에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
- 제 2 항에 있어서,
상기 메인 도메인은,
통신, 내비게이션, 미디어, 지식, 뉴스, 스포츠, 날씨 중 적어도 하나를 포함하는 음성인식시스템의 도메인 관리 방법.
- 제 2 항에 있어서,
상기 상황정보를 수집하는 단계는,
상기 차량의 주차상태 또는 정차상태, 내비게이션 설정 상태, 정보 수신 상태, 폰 연결 상태 중 적어도 하나를 수집하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
- 제 7 항에 있어서,
상기 수집한 상황정보에 기초하여 각각의 상황에서 각 메인 도메인의 사용빈도를 분석하고, 상기 분석된 사용빈도에 따라 각 메인 도메인에 가중치를 부여하는 단계
를 더 포함하는 음성인식시스템의 도메인 관리 방법.
- 제 1 항에 있어서,
상기 음성인식 기능정보를 수집하는 단계는,
상기 차량에 구비된 AVN(Audio Video Nagavigation) 시스템으로부터 음성인식 기능정보를 수집하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
- 제 1 항에 있어서,
상기 사용자 도메인을 관리하는 단계는,
복수의 사용자를 대상으로 각각의 사용자 도메인을 관리하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
- 제 1 항에 있어서,
예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 추가 관리하는 단계
를 더 포함하는 음성인식시스템의 도메인 관리 방법.
- 제 11 항에 있어서,
상기 사용자 도메인을 추가 관리하는 단계는,
상기 사용자가 선택한 도메인에 가중치를 부여하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
- 제 11 항에 있어서,
상기 사용자 도메인을 추가 관리하는 단계는,
불명확한 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 예외처리 모델1을 생성하는 단계; 및
미지원 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 예외처리 모델2를 생성하는 단계
를 포함하는 음성인식시스템의 도메인 관리 방법.
Priority Applications (3)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| KR1020180159723A KR102869070B1 (ko) | 2018-12-12 | 2018-12-12 | 음성인식시스템의 도메인 관리 방법 |
| US16/415,547 US20200193985A1 (en) | 2018-12-12 | 2019-05-17 | Domain management method of speech recognition system |
| CN201910514729.3A CN111312236A (zh) | 2018-12-12 | 2019-06-14 | 语音识别系统的域管理方法 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| KR1020180159723A KR102869070B1 (ko) | 2018-12-12 | 2018-12-12 | 음성인식시스템의 도메인 관리 방법 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| KR20200072021A true KR20200072021A (ko) | 2020-06-22 |
| KR102869070B1 KR102869070B1 (ko) | 2025-10-13 |
Family
ID=71071207
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| KR1020180159723A Active KR102869070B1 (ko) | 2018-12-12 | 2018-12-12 | 음성인식시스템의 도메인 관리 방법 |
Country Status (3)
| Country | Link |
|---|---|
| US (1) | US20200193985A1 (ko) |
| KR (1) | KR102869070B1 (ko) |
| CN (1) | CN111312236A (ko) |
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2023132470A1 (ko) * | 2022-01-06 | 2023-07-13 | 삼성전자주식회사 | 사용자 발화를 처리하는 서버, 전자 장치 및 그의 동작 방법 |
Families Citing this family (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US11043214B1 (en) * | 2018-11-29 | 2021-06-22 | Amazon Technologies, Inc. | Speech recognition using dialog history |
| US11495234B2 (en) * | 2019-05-30 | 2022-11-08 | Lg Electronics Inc. | Data mining apparatus, method and system for speech recognition using the same |
| GB202211620D0 (en) * | 2022-08-09 | 2022-09-21 | Oakspire Ltd | Automated speech recognition to support context-aware intent recognition |
| CN117390149A (zh) * | 2023-09-25 | 2024-01-12 | 中国第一汽车股份有限公司 | 一种车载电子手册控制方法、系统及车辆 |
Citations (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US20110307250A1 (en) * | 2010-06-10 | 2011-12-15 | Gm Global Technology Operations, Inc. | Modular Speech Recognition Architecture |
| US20140244259A1 (en) * | 2011-12-29 | 2014-08-28 | Barbara Rosario | Speech recognition utilizing a dynamic set of grammar elements |
| US20180096681A1 (en) * | 2016-10-03 | 2018-04-05 | Google Inc. | Task initiation using long-tail voice commands |
| KR20180075050A (ko) | 2016-12-26 | 2018-07-04 | 현대자동차주식회사 | 대화 처리 장치, 이를 포함하는 차량 및 대화 처리 방법 |
| KR20180086718A (ko) * | 2017-01-23 | 2018-08-01 | 현대자동차주식회사 | 대화 시스템, 이를 포함하는 차량 및 대화 처리 방법 |
Family Cites Families (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2008064885A (ja) * | 2006-09-05 | 2008-03-21 | Honda Motor Co Ltd | 音声認識装置、音声認識方法、及び音声認識プログラム |
| JP6029985B2 (ja) * | 2013-01-11 | 2016-11-24 | クラリオン株式会社 | 情報処理装置、操作システム、および、情報処理装置の操作方法 |
| US20150249906A1 (en) * | 2014-02-28 | 2015-09-03 | Rovi Guides, Inc. | Methods and systems for encouraging behaviour while occupying vehicles |
| US10475447B2 (en) * | 2016-01-25 | 2019-11-12 | Ford Global Technologies, Llc | Acoustic and domain based speech recognition for vehicles |
| US10229683B2 (en) * | 2017-03-10 | 2019-03-12 | Soundhound, Inc. | Speech-enabled system with domain disambiguation |
-
2018
- 2018-12-12 KR KR1020180159723A patent/KR102869070B1/ko active Active
-
2019
- 2019-05-17 US US16/415,547 patent/US20200193985A1/en not_active Abandoned
- 2019-06-14 CN CN201910514729.3A patent/CN111312236A/zh active Pending
Patent Citations (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US20110307250A1 (en) * | 2010-06-10 | 2011-12-15 | Gm Global Technology Operations, Inc. | Modular Speech Recognition Architecture |
| US20140244259A1 (en) * | 2011-12-29 | 2014-08-28 | Barbara Rosario | Speech recognition utilizing a dynamic set of grammar elements |
| US20180096681A1 (en) * | 2016-10-03 | 2018-04-05 | Google Inc. | Task initiation using long-tail voice commands |
| KR20180075050A (ko) | 2016-12-26 | 2018-07-04 | 현대자동차주식회사 | 대화 처리 장치, 이를 포함하는 차량 및 대화 처리 방법 |
| KR20180086718A (ko) * | 2017-01-23 | 2018-08-01 | 현대자동차주식회사 | 대화 시스템, 이를 포함하는 차량 및 대화 처리 방법 |
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| WO2023132470A1 (ko) * | 2022-01-06 | 2023-07-13 | 삼성전자주식회사 | 사용자 발화를 처리하는 서버, 전자 장치 및 그의 동작 방법 |
Also Published As
| Publication number | Publication date |
|---|---|
| US20200193985A1 (en) | 2020-06-18 |
| CN111312236A (zh) | 2020-06-19 |
| KR102869070B1 (ko) | 2025-10-13 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US7016849B2 (en) | Method and apparatus for providing speech-driven routing between spoken language applications | |
| EP1936606B1 (en) | Multi-stage speech recognition | |
| US11056113B2 (en) | Conversation guidance method of speech recognition system | |
| EP2838085B1 (en) | Voice recognition server integration device and voice recognition server integration method | |
| KR102869070B1 (ko) | 음성인식시스템의 도메인 관리 방법 | |
| KR102915192B1 (ko) | 대화 시스템, 대화 처리 방법 및 전자 장치 | |
| US20060100871A1 (en) | Speech recognition method, apparatus and navigation system | |
| KR20050082249A (ko) | 도메인 기반 대화 음성인식방법 및 장치 | |
| KR102485342B1 (ko) | 차량의 환경에 기반한 추천 신뢰도 판단 장치 및 방법 | |
| CN112651247B (zh) | 对话系统、对话处理方法、翻译装置和翻译方法 | |
| US20250149036A1 (en) | Preemptive wakeword detection | |
| US20070174055A1 (en) | Method and system for dynamic nametag scoring | |
| US11783806B2 (en) | Dialogue system and dialogue processing method | |
| JP2008134502A (ja) | 音声認識装置、および音声認識方法 | |
| KR20200095636A (ko) | 대화 시스템이 구비된 차량 및 그 제어 방법 | |
| CN112997247A (zh) | 利用大数据的最佳语言模型生成方法及用于其的装置 | |
| KR20250043811A (ko) | 음성 인식 시스템을 평가하기 위한 방법 및 장치 | |
| KR102787014B1 (ko) | 대화 시스템, 이를 포함하는 차량 및 대화 처리 방법 | |
| KR20090068856A (ko) | 음소레벨 로그우도 비율 분포와 음소 지속시간 분포에 의한단어음색 모델 기반 발화검증 시스템 및 방법 | |
| KR102527346B1 (ko) | 차량용 음성 인식 장치, 이를 이용한 차량의 주행상태를 고려한 응답 제공 방법 및 컴퓨터 프로그램 | |
| US12499877B2 (en) | Dialogue system and method for controlling the same | |
| KR20060098673A (ko) | 음성 인식 방법 및 장치 | |
| CN121884814A (zh) | 用于实时改变语言的方法和系统 | |
| Sárosi et al. | Recognition of multiple language voice navigation queries in traffic situations |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| PA0109 | Patent application |
St.27 status event code: A-0-1-A10-A12-nap-PA0109 |
|
| R18-X000 | Changes to party contact information recorded |
St.27 status event code: A-3-3-R10-R18-oth-X000 |
|
| R18-X000 | Changes to party contact information recorded |
St.27 status event code: A-3-3-R10-R18-oth-X000 |
|
| PG1501 | Laying open of application |
St.27 status event code: A-1-1-Q10-Q12-nap-PG1501 |
|
| PN2301 | Change of applicant |
St.27 status event code: A-3-3-R10-R13-asn-PN2301 St.27 status event code: A-3-3-R10-R11-asn-PN2301 |
|
| A201 | Request for examination | ||
| PA0201 | Request for examination |
St.27 status event code: A-1-2-D10-D11-exm-PA0201 |
|
| E902 | Notification of reason for refusal | ||
| PE0902 | Notice of grounds for rejection |
St.27 status event code: A-1-2-D10-D21-exm-PE0902 |
|
| E13-X000 | Pre-grant limitation requested |
St.27 status event code: A-2-3-E10-E13-lim-X000 |
|
| P11-X000 | Amendment of application requested |
St.27 status event code: A-2-2-P10-P11-nap-X000 |
|
| D22 | Grant of ip right intended |
Free format text: ST27 STATUS EVENT CODE: A-1-2-D10-D22-EXM-PE0701 (AS PROVIDED BY THE NATIONAL OFFICE) |
|
| PE0701 | Decision of registration |
St.27 status event code: A-1-2-D10-D22-exm-PE0701 |
|
| F11 | Ip right granted following substantive examination |
Free format text: ST27 STATUS EVENT CODE: A-2-4-F10-F11-EXM-PR0701 (AS PROVIDED BY THE NATIONAL OFFICE) |
|
| PR0701 | Registration of establishment |
St.27 status event code: A-2-4-F10-F11-exm-PR0701 |
|
| PR1002 | Payment of registration fee |
St.27 status event code: A-2-2-U10-U11-oth-PR1002 Fee payment year number: 1 |
|
| U11 | Full renewal or maintenance fee paid |
Free format text: ST27 STATUS EVENT CODE: A-2-2-U10-U11-OTH-PR1002 (AS PROVIDED BY THE NATIONAL OFFICE) Year of fee payment: 1 |
|
| PG1601 | Publication of registration |
St.27 status event code: A-4-4-Q10-Q13-nap-PG1601 |
|
| Q13 | Ip right document published |
Free format text: ST27 STATUS EVENT CODE: A-4-4-Q10-Q13-NAP-PG1601 (AS PROVIDED BY THE NATIONAL OFFICE) |