KR20200072021A - 음성인식시스템의 도메인 관리 방법 - Google Patents

음성인식시스템의 도메인 관리 방법 Download PDF

Info

Publication number
KR20200072021A
KR20200072021A KR1020180159723A KR20180159723A KR20200072021A KR 20200072021 A KR20200072021 A KR 20200072021A KR 1020180159723 A KR1020180159723 A KR 1020180159723A KR 20180159723 A KR20180159723 A KR 20180159723A KR 20200072021 A KR20200072021 A KR 20200072021A
Authority
KR
South Korea
Prior art keywords
domain
user
voice recognition
recognition system
management method
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Granted
Application number
KR1020180159723A
Other languages
English (en)
Other versions
KR102869070B1 (ko
Inventor
이경철
조재민
Original Assignee
현대자동차주식회사
기아자동차주식회사
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by 현대자동차주식회사, 기아자동차주식회사 filed Critical 현대자동차주식회사
Priority to KR1020180159723A priority Critical patent/KR102869070B1/ko
Priority to US16/415,547 priority patent/US20200193985A1/en
Priority to CN201910514729.3A priority patent/CN111312236A/zh
Publication of KR20200072021A publication Critical patent/KR20200072021A/ko
Application granted granted Critical
Publication of KR102869070B1 publication Critical patent/KR102869070B1/ko
Active legal-status Critical Current
Anticipated expiration legal-status Critical

Links

Images

Classifications

    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/22Procedures used during a speech recognition process, e.g. man-machine dialogue
    • BPERFORMING OPERATIONS; TRANSPORTING
    • B60VEHICLES IN GENERAL
    • B60RVEHICLES, VEHICLE FITTINGS, OR VEHICLE PARTS, NOT OTHERWISE PROVIDED FOR
    • B60R16/00Electric or fluid circuits specially adapted for vehicles and not otherwise provided for; Arrangement of elements of electric or fluid circuits specially adapted for vehicles and not otherwise provided for
    • B60R16/02Electric or fluid circuits specially adapted for vehicles and not otherwise provided for; Arrangement of elements of electric or fluid circuits specially adapted for vehicles and not otherwise provided for electric constitutive elements
    • B60R16/037Electric or fluid circuits specially adapted for vehicles and not otherwise provided for; Arrangement of elements of electric or fluid circuits specially adapted for vehicles and not otherwise provided for electric constitutive elements for occupant comfort, e.g. for automatic adjustment of appliances according to personal settings, e.g. seats, mirrors, steering wheel
    • B60R16/0373Voice control
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/06Creation of reference templates; Training of speech recognition systems, e.g. adaptation to the characteristics of the speaker's voice
    • G10L15/065Adaptation
    • G10L15/07Adaptation to the speaker
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/08Speech classification or search
    • G10L15/18Speech classification or search using natural language modelling
    • G10L15/1822Parsing for meaning understanding
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/26Speech to text systems
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/08Speech classification or search
    • G10L15/18Speech classification or search using natural language modelling
    • G10L15/1815Semantic context, e.g. disambiguation of the recognition hypotheses based on word meaning
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/22Procedures used during a speech recognition process, e.g. man-machine dialogue
    • G10L2015/223Execution procedure of a spoken command
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/22Procedures used during a speech recognition process, e.g. man-machine dialogue
    • G10L2015/225Feedback of the input speech
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/22Procedures used during a speech recognition process, e.g. man-machine dialogue
    • G10L2015/226Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/22Procedures used during a speech recognition process, e.g. man-machine dialogue
    • G10L2015/226Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics
    • G10L2015/227Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics of the speaker; Human-factor methodology

Landscapes

  • Engineering & Computer Science (AREA)
  • Computational Linguistics (AREA)
  • Health & Medical Sciences (AREA)
  • Audiology, Speech & Language Pathology (AREA)
  • Human Computer Interaction (AREA)
  • Physics & Mathematics (AREA)
  • Acoustics & Sound (AREA)
  • Multimedia (AREA)
  • Artificial Intelligence (AREA)
  • Mechanical Engineering (AREA)
  • Navigation (AREA)

Abstract

본 발명은 음성인식시스템의 도메인 관리 방법에 관한 것으로, 차량의 기능과 상황에 기초하여 사용자에게 최적화된 도메인(이하, 사용자 도메인)을 생성하고, 아울러 정상적으로 인식되지 않아 예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 관리함으로써, 전체 도메인을 대상으로 의미분석을 수행함으로 인해 발생하는 처리속도의 지연과, 의미분석 결과의 낮은 정확도로 인한 예외처리의 증가를 방지할 수 있는 음성인식시스템의 도메인 관리 방법을 제공하고자 한다.
이를 위하여, 본 발명은 음성인식시스템의 도메인 관리 방법에 있어서, 차량에 탑재된 시스템으로부터 음성인식 기능정보를 수집하는 단계; 차량에 탑재된 시스템으로부터 상황정보를 수집하는 단계; 및 상기 수집된 음성인식 기능정보와 상황정보에 기초하여 사용자 도메인을 관리하는 단계를 포함한다.

Description

음성인식시스템의 도메인 관리 방법{METHOD FOR MANAGING DOMAIN OF SPEECH RECOGNITION SYSTEM}
본 발명은 음성인식을 위해 이용되는 도메인을 관리하는 기술에 관한 것이다.
음성인식기술은 음성신호로부터 특징을 추출하고, 상기 추출된 특징에 패턴인식 알고리즘을 적용시킨 후 화자가 어떤 음소열 또는 단어열을 발화시켜 발생된 음성신호인가를 역추적하는 기술이다.
최근 들어, 대화체 음성인식의 정확도를 높이기 위한 다양한 방법들이 제안되고 있는데, 화행정보를 이용한 음성인식방법은 1차 음성인식과정에서 얻어진 인식결과를 바탕으로 하여 화행을 추정한 다음, 추정된 화행에 특화된 언어모델을 이용하여 최종 인식결과를 탐색한다. 그런데 이 방법에 따르면 1차 음성인식과정에서 얻어진 인식결과에 수반되는 오류로 인하여 화행추정 오류가 발생하게 되면, 잘못된 최종 인식결과를 도출할 가능성이 높다.
다른 방법으로는 예를 들면, 날씨, 관광 등과 같은 주제(topic) 별로 다수의 도메인을 분류하고, 각 도메인에 대하여 특화된 음향모델과 언어모델을 생성한 다음, 이들을 이용하여 주어진 음성신호를 인식하는 도메인 기반 음성인식기술이 널리 사용되고 있다. 이 방법에 따르면, 음성신호가 입력되면 준비된 복수개의 도메인에 대하여 병렬적으로 음성인식을 수행하여 인식결과를 생성한 다음, 복수개의 인식결과 중 가장 신뢰도가 높은 인식결과를 최종적으로 선택한다.
이러한 도메인 기반의 음성인식기술은 모든 도메인을 대상으로 의미분석을 수행해야 하기 때문에, 도메인의 수가 증가할수록 처리속도가 느려지는 것은 물론 사용자의 음성명령이 중의적 의미로 해석될 가능성이 높아 정확도 높은 결과를 도출하지 못해, 사용자에게 "인식하지 못했습니다. 다시 입력해 주세요" 등과 같은 안내문구를 표시하거나, 예외처리로서 웹검색을 통해 얻은 결과를 제공하게 된다. 이때, 예외처리는 정확도가 낮은 결과를 제공하는 것으로, 예외처리가 많아질수록 음성인식성능에 신뢰성은 떨어지게 된다.
대한민국공개특허 제2018-0075050호
본 발명은 차량의 기능과 상황에 기초하여 사용자에게 최적화된 도메인(이하, 사용자 도메인)을 생성하고, 아울러 정상적으로 인식되지 않아 예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 관리함으로써, 전체 도메인을 대상으로 의미분석을 수행함으로 인해 발생하는 처리속도의 지연과, 의미분석 결과의 낮은 정확도로 인한 예외처리의 증가를 방지할 수 있는 음성인식시스템의 도메인 관리 방법을 제공하는데 그 목적이 있다.
본 발명의 목적들은 이상에서 언급한 목적으로 제한되지 않으며, 언급되지 않은 본 발명의 다른 목적 및 장점들은 하기의 설명에 의해서 이해될 수 있으며, 본 발명의 실시예에 의해 보다 분명하게 알게 될 것이다. 또한, 본 발명의 목적 및 장점들은 특허 청구 범위에 나타낸 수단 및 그 조합에 의해 실현될 수 있음을 쉽게 알 수 있을 것이다.
상기 목적을 달성하기 위한 본 발명의 방법은, 음성인식시스템의 도메인 관리 방법에 있어서, 차량에 탑재된 시스템으로부터 음성인식 기능정보를 수집하는 단계; 차량에 탑재된 시스템으로부터 상황정보를 수집하는 단계; 및 상기 수집된 음성인식 기능정보와 상황정보에 기초하여 사용자 도메인을 관리하는 단계를 포함한다.
여기서, 상기 사용자 도메인은 복수의 메인 도메인을 포함하고, 각 메인 도메인은 복수의 서브 도메인을 포함할 수 있다.
또한, 상기 사용자 도메인을 관리하는 단계는 특정 도메인을 활성화하거나 비활성화하는 단계; 및 특정 서브 도메인을 활성화하거나 비활성화하는 단계를 포함할 수 있다.
이러한 본 발명의 방법은 차량에 탑재된 시스템으로부터 수집한 사용자의 선호도 정보에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정하는 단계를 더 포함할 수 있다.
또한, 상기 활성화 여부를 결정하는 단계는 상기 사용자의 선호도 정보로서 사용자가 설정한 메뉴 우선순위에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정할 수 있다.
또한, 상기 활성화 여부를 결정하는 단계는 상기 사용자의 선호도 정보로서 사용자가 설정한 즐겨찾기에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정할 수 있다.
또한, 상기 활성화 여부를 결정하는 단계는 상기 사용자의 선호도 정보로서 사용자가 설정한 메뉴 우선순위 및 즐겨찾기에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정할 수 있다.
또한, 상기 메인 도메인은 통신, 내비게이션, 미디어, 지식, 뉴스, 스포츠, 날씨 중 적어도 하나를 포함할 수 있다.
또한, 상기 상황정보를 수집하는 단계는 상기 차량의 주차상태 또는 정차상태, 내비게이션 설정 상태, 정보 수신 상태, 폰 연결 상태 중 적어도 하나를 수집할 수 있다.
이러한 본 발명의 방법은 상기 수집한 상황정보에 기초하여 각각의 상황에서 각 메인 도메인의 사용빈도를 분석하고, 상기 분석된 사용빈도에 따라 각 메인 도메인에 가중치를 부여하는 단계를 더 포함할 수 있다.
또한, 상기 음성인식 기능정보를 수집하는 단계는 상기 차량에 구비된 AVN(Audio Video Nagavigation) 시스템으로부터 음성인식 기능정보를 수집할 수 있다.
또한, 상기 사용자 도메인을 관리하는 단계는 복수의 사용자를 대상으로 각각의 사용자 도메인을 관리할 수 있다.
이러한 본 발명의 방법은 예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 추가 관리하는 단계를 더 포함할 수 있다.
또한, 상기 사용자 도메인을 추가 관리하는 단계는 상기 사용자가 선택한 도메인에 가중치를 부여할 수 있다.
또한, 상기 사용자 도메인을 추가 관리하는 단계는 불명확한 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 예외처리 모델1을 생성하는 단계; 및 미지원 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 예외처리 모델2를 생성하는 단계를 포함할 수 있다.
본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법은, 차량의 기능과 상황에 기초하여 사용자에게 최적화된 도메인(이하, 사용자 도메인)을 생성하고, 아울러 정상적으로 인식되지 않아 예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 관리함으로써, 전체 도메인을 대상으로 의미분석을 수행함으로 인해 발생하는 처리속도의 지연과, 의미분석 결과의 낮은 정확도로 인한 예외처리의 증가를 방지할 수 있다.
도 1 은 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 과정에 대한 개념도,
도 2 는 본 발명의 일 실시예에 따른 복수의 사용자를 대상으로 생성한 사용자 도메인 모델을 나타내는 도면,
도 3 은 본 발명의 일 실시예에 따른 예외처리 관리 모듈의 구성을 나타내는 도면,
도 4 는 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법에 대한 흐름도,
도 5 는 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법을 실행하기 위한 컴퓨팅 시스템을 보여주는 블록도이다.
이하, 본 발명의 일부 실시예들을 예시적인 도면을 통해 상세하게 설명한다. 각 도면의 구성요소들에 참조부호를 부가함에 있어서, 동일한 구성요소들에 대해서는 비록 다른 도면상에 표시되더라도 가능한 한 동일한 부호를 가지도록 하고 있음에 유의해야 한다. 또한, 본 발명의 실시예를 설명함에 있어, 관련된 공지 구성 또는 기능에 대한 구체적인 설명이 본 발명의 실시예에 대한 이해를 방해한다고 판단되는 경우에는 그 상세한 설명은 생략한다.
본 발명의 실시예의 구성 요소를 설명하는 데 있어서, 제 1, 제 2, A, B, (a), (b) 등의 용어를 사용할 수 있다. 이러한 용어는 그 구성 요소를 다른 구성 요소와 구별하기 위한 것일 뿐, 그 용어에 의해 해당 구성 요소의 본질이나 차례 또는 순서 등이 한정되지 않는다. 또한, 다르게 정의되지 않는 한, 기술적이거나 과학적인 용어를 포함해서 여기서 사용되는 모든 용어들은 본 발명이 속하는 기술 분야에서 통상의 지식을 가진 자에 의해 일반적으로 이해되는 것과 동일한 의미를 가진다. 일반적으로 사용되는 사전에 정의되어 있는 것과 같은 용어들은 관련 기술의 문맥상 가지는 의미와 일치하는 의미를 가진 것으로 해석되어야 하며, 본 출원에서 명백하게 정의하지 않는 한, 이상적이거나 과도하게 형식적인 의미로 해석되지 않는다.
도 1 은 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 과정에 대한 개념도로서, 차량에 적용된 음성인식시스템의 프로세서에 대한 기능 블록을 나타낸다.
먼저, 사용자 도메인 분석 모듈(110)은 차량의 기능과 상황(차량에 구비된 시스템의 동작상태)에 기초하여 사용자에게 최적화된 도메인(이하, 사용자 도메인)을 생성하고, 아울러 정상적으로 인식되지 않아 예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 관리하는 역할을 수행하는 기능 블록으로서, 차량 기능 분석 모듈(111), 차량 상황 분석 모듈(112), 사용자 도메인 관리 모듈(113), 예외처리 관리 모듈(114)을 구비할 수 있다.
차량 기능 분석 모듈(111)은 기능별 모델 세트(set)를 구성하기 위한 기능 블록으로서, 차량에서 제공하는 음성인식 관련 기능 세트를 구성한다. 즉, 차량에 탑재된 각종 시스템으로부터 음성인식 관련 기능 정보를 수집한다. 예를 들어, 차량의 AVN(Audio Video Nagavigation) 시스템에서 제공하는 음성인식과 관련된 기능에 대한 도메인 세트를 구성할 수 있다.
차량 기능 분석 모듈(111)은 차량 내 시스템에서 지원하는 기능에 따라 메인 도메인과 서브 도메인을 구성할 수 있다. 이때, 지원 기능 세트는 일례로 하기와 같이 구성할 수 있다.
1) Calling 기능 - 지원
2) Messaging 기능 - Android 폰 연결 시 지원, Iphone 연결 시 미지원
3) E-mail 기능 - 미지원
4) Car manual 제공 - 지원
5) Online Music 제공 - 사용자가 Online Music 사이트에 가입하고 연동을 허가한 경우에 지원
차량 기능 분석 모듈(111)은 사용자가 설정한 메뉴 우선순위 및 즐겨찾기 등과 같은 사용자의 선호도를 반영하여 도메인을 구성할 수 있다. 예를 들어, 우선순위가 높은 메뉴에 해당하거나 즐겨찾기에 포함된 기능에 상응하는 도메인의 가중치를 높일 수 있다. 참고로, 가중치가 높은 도메인일수록 음성인식 결과로 도출될 가능성이 높아진다.
차량 상황 분석 모듈(112)은 상황별 모델 세트(set)를 구성하기 위한 기능 블록으로서, 차량에 탑재된 각종 시스템으로부터 차량의 상황정보를 수집할 수 있다. 예를 들어, 주행상태(정차, 주차), 내비게이션 설정 상태(목적지, 등록지점, 즐겨찾기 등), 정보(스포츠, 뉴스, 날씨 등) 수신 상태, 폰 연결 상태(폰북, 콜 히스토리, 즐겨찾기, 데이터 다운로드) 등과 같은 상황정보를 수집할 수 있다.
차량 상황 분석 모듈(112)은 주행상태에 따른 각 메인 도메인 및 각 서브 도메인의 사용빈도를 분석하여 각 메인 도메인 및 각 서브 도메인에 가중치를 부여할 수 있다.
일례로, 사용자가 주행중에 자주 사용하는 도메인의 사용빈도가 Communication 50%, Media 30%, 뉴스 10%, 내비게이션 10% 라면, 그 사용빈도에 따라 가중치를 부여할 수 있다. 이때, 가중치가 0 인 도메인은 주행중에 디스에이블(Disable) 된다.
다른 예로, 사용자가 정차시 자주 사용하는 도메인의 사용빈도가 내비게이션 검색 50%, 지식 검색 30%, 뉴스 20% 라면, 그 사용빈도에 따라 가중치를 부여할 수 있다. 이때, 가중치가 0 인 도메인은 주행중에 디스에이블(Disable) 된다.
또 다른 예로, 폰이 연결되지 않은 상황에는 Communication 도메인이 비활성화 처리되며, 주행중 전화 사용빈도에 따라 해당 Communication 도메인 및 서브 도메인의 가중치를 부여할 수 있다.
차량 상황 분석 모듈(112)은 상술한 상황들을 복합적으로 분석하여 메인 도메인 및 서브 도메인의 활성화 여부를 결정하고, 아울러 가중치를 부여할 수 있다.
사용자 도메인 관리 모듈(113)은 사용자 도메인을 관리하는 기능 블록으로서, 사용자 도메인 모델을 관리한다.
도 1에 도시된 바와 같이, 사용자 도메인 모델은 Communication 도메인, Navigation 도메인, Media 도메인, Knowledge 도메인, 뉴스 도메인, 스포츠 도메인, 날씨 도메인 등을 포함할 수 있다. 이때, Communication 도메인은 서브 도메인으로서 Calling, Messaging, E-mail을 포함할 수 있고, Navigation 도메인은 서브 도메인으로서 POI(Position Of Interest)/Address, Parking, Traffic을 포함할 수 있고, Media 도메인은 서브 도메인으로서 Radio, Local Music, Online music을 포함할 수 있고, Knowledge 도메인은 서브 도메인으로서 POI Knowledge, General, Car manual을 포함할 수 있다. 이때, 메인 도메인으로서 뉴스 도메인과 스포츠 도메인 및 날씨 도메인은 디스에이블 상태이고, 서브 도메인으로서 E-Mail, Radio, General 역시 디스에이블 상태이다.
사용자 도메인 관리 모듈(113)은 서버에 구축되는 경우, 복수의 사용자를 대상으로 해당 사용자에 최적화된 사용자 도메인 모델을 생성 및 관리할 수 있다. 즉, 사용자 도메인 관리 모듈(113)은 도 2에 도시된 바와 같이 제2 사용자 도메인 모델이 저장된 고객 DB2, 제3 사용자 도메인 모델이 저장된 고객 DB3 등을 생성 및 관리할 수 있다.
예외처리 관리 모듈(114)은 정상적으로 인식되지 않아 예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 관리하기 위한 기능 블록으로서, 미지원 도메인, 불병확한 명령어로 분류되어 예외처리된 케이스에 대해 자료를 수집할 수 있다.
예외처리 관리 모듈(114)은 상기 수집된 자료를 기준으로 지원 가능한 도메인 중에서 미지원 명령어 또는 지원 가능하지만 명확하지 않은 발화에 대해 코퍼스(Corpus)를 수집하고, 이를 이용하여 미지원 명령어와 불명확 명령어를 구분함으로써, 미지원 명령어로 구분된 명령어 발화시 사용자에게 이에 대한 안내를 제공할 수 있다.
예외처리 관리 모듈(114)은 불명확하게 발화하여 예외처리된 결과에서 사용자의 선택이 있는 경우 해당 도메인에 대해 추가 가중치를 부여하여 해당 도메인에서 의미분석이 수행될 수 있도록 한다.
예를 들어, '스타벅스 찾아줘', '스타벅스 길안내', '스타벅스 어디야' 등과 같이 각 도메인별로 자연어에 대한 의도파악을 위한 메인 키워드가 있어야 해당 도메인을 인식할 수 있다. 단순히 '스타벅스는?'은 사용자 발화가 어떤 의도를 의미하는지 알 수 있는 어휘가 없다. 이러한 경우 예외처리가 이루어지는데, 이때 사용자가 예외처리된 결과에서 지도검색을 선택하거나 내비게이션을 통해 스타벅스를 검색하면, 예외처리 관리 모듈(114)은 내비게이션 도메인에 가중치를 부여할 수 있다. 이로 인해 추후 '스타벅스는?'이 입력되면 곧바로 내비게이션 길안내가 이루어질 수 있다.
예외처리 관리 모듈(114)은 미지원 명령어를 발화하여 예외처리된 결과에서 사용자의 선택이 있는 경우 해당 도메인에 대해 추가 가중치를 부여하여 해당 도메인에서 의미분석이 수행될 수 있도록 한다.
예를 들어, 사용자가 '봄 하늘'이라 명확하게 발화하였지만 의도 파악이 안되는 경우, 날씨 도메인의 봄 날씨 및 검색 도메인의 미세먼지 정보를 제공하고, 사용자가 날씨를 선택하면, 날씨 도메인에 가중치를 부여하여 추후 '봄 하늘'이 입력되면 봄 날씨가 제공되도록 할 수 있다. 이를 확장하여 '가을 하늘', '여름 비 소식' 등과 같이 유사한 발화가 발생해도 날씨 도메인을 통해 가을 날씨, 여름 날씨 가 제공되도록 할 수 있다.
결국, 예외처리 관리 모듈(144)은 사용자의 음성명령에 따른 서비스 결과가 사용자의 의도에 맞지 않는 경우, 사용자의 선택에 기초하여 사용자 도메인을 관리하는 역할을 수행한다.
다음으로, 전처리 모듈(120)은 사용자로부터 입력받은 음성의 노이즈를 제거한다.
다음으로, 음성 인식부(130)는 입력된 음성신호로부터 사용자가 발화한 음성을 인식하고, 그 인식 결과를 출력한다. 음성인식부(120)에서 출력되는 인식결과는 텍스트 형태의 발화문일 수 있다.
음성 인식부(130)는 음성인식엔진(Automatic Speech Recognition, ASR)을 포함하고, 음성인식엔진은 입력된 음성에 음성인식 알고리즘을 적용하여 사용자가 발화한 음성을 인식하고, 인식결과를 생성할 수 있다.
이때, 입력된 음성은 음성인식을 위한 더 유용한 형태로 변환될 수 있는바, 음성신호로부터 시작지점과 끝지점을 검출하여 입력된 음성에 포함된 실제 음성 구간을 검출한다. 이를 EPD(End Point Detection)이라 한다. 그리고, 검출된 구간 내에서 켑스트럼(Cepstrum), 선형 예측 코딩(Linear Predictive Coefficient: LPC), MFCC(Mel Frequency Cepstral Coefficient) 또는 필터 뱅크 에너지(Filter Bank Energy) 등의 특징 벡터 추출 기술을 적용하여 입력된 음성의 특징 벡터를 추출할 수 있다. 그리고, 추출된 특징 벡터와 훈련된 기준 패턴과의 비교를 통하여 인식 결과를 얻을 수 있다. 이를 위해, 음성의 신호적인 특성을 모델링하여 비교하는 음향 모델(Acoustic Model) 과 인식 어휘에 해당하는 단어나 음절 등의 언어적인 순서 관계를 모델링하는 언어 모델(Language Model)이 사용될 수 있다.
음성 인식부(130)는 음성을 인식함에 있어 어느 방식을 사용해도 무방하다. 예를 들어, 히든 마르코프 모델이 적용된 음향 모델을 사용할 수도 있고, 음향 모델과 음성 모델을 통합한 N-best 탐색법을 사용할 수 있다. N-best 탐색법은 음향 모델과 언어 모델을 이용하여 N개까지의 인식 결과 후보를 선택한 후, 이들 후보의 순위를 재평가함으로써 인식 성능을 향상시킬 수 있다.
음성 인식부(130)는 인식 결과의 신뢰성을 확보하기 위해 신뢰값(confidence value)을 계산할 수 있다. 신뢰값은 음성 인식 결과에 대해서 그 결과를 얼마나 믿을 만한 것인가를 나타내는 척도이다. 일례로, 인식된 결과인 음소나 단어에 대해서, 그 외의 다른 음소나 단어로부터 그 말이 발화되었을 확률에 대한 상대값으로 정의할 수 있다. 따라서, 신뢰값은 0 에서 1 사이의 값으로 표현할 수도 있고, 0 에서 100 사이의 값으로 표현할 수도 있다.
신뢰값이 미리 설정된 임계값(threshold)을 초과하는 경우에는 인식 결과를 출력하여 인식 결과에 대응되는 동작이 수행되도록 할 수 있고, 신뢰값이 임계값 이하인 경우에는 인식 결과를 거절(rejection)할 수 있다.
음성 인식부(120)의 인식 결과인 텍스트 형태의 발화문은 NUL(Natural Language Understanding) 엔진(140)으로 입력된다.
NLU 엔진(140)은 자연어 이해 기술을 적용하여 발화 언어에 포함된 사용자의 발화 의도를 파악할 수 있다. 즉, NLU 엔진(140)은 발화 언어의 의미를 분석할 수 있다.
NLU 엔진(140)은 텍스트 형태의 발화문에 대해 형태소 분석을 수행한다. 형태소는 의미의 최소 단위로서, 더 이상 세분화할 수 없는 가장 작은 의미 요소를 나타낸다. 따라서, 형태소 분석은 자연어 이해의 첫 단계로서, 입력 문자열을 형태소열로 바꿔준다.
NLU 엔진(140)은 형태소 분석 결과에 기초하여 발화문으로부터 도메인을 추출한다. 도메인은 사용자 발화언어의 주제를 식별할 수 있는 것으로서, 예를 들어, 경로 안내, 날씨 검색, 교통 검색, 일정 관리, 주유 안내, 공조 제어 등의 다양한 주제를 나타내는 도메인이다.
NLU 엔진(140)은 발화문으로부터 개체명을 인식할 수 있다. 개체명은 인명, 지명, 조직명, 시간, 날짜, 화폐 등의 고유 명사로서, 개체명 인식은 문장에서 개체명을 식별하고 식별된 개체명의 종류를 결정하는 작업이다. 개체명 인식을 통해 문장에서 중요한 키워드를 추출하여 문장의 의미를 파악할 수 있다.
NLU 엔진(140)은 발화문이 갖는 화행을 분석할 수 있다. 화행 분석은 사용자 발화에 대한 의도를 분석하는 작업으로, 사용자가 질문을 하는 것인지, 요청을 하는 것인지, 단순한 감정 표현을 하는 것인지 등에 관한 문장의 의도를 파악하는 것이다.
NLU 엔진(140)은 사용자의 발화 의도에 대응하는 액션을 추출한다. 발화문에 대응되는 도메인, 개체명, 화행 등의 정보에 기초하여 사용자의 발화 의도를 파악하고, 발화 의도에 대응되는 액션을 추출한다.
NLU 엔진(140)의 처리 결과는 예를 들어, 발화문에 대응되는 도메인과 키워드를 포함할 수 있으며, 형태소 분석 결과, 개체명, 액션 정보, 화행 정보 등을 더 포함할 수도 있다.
다음으로, 도메인 처리 모듈(150)은 NLU 엔진(140)에서 참조할 사용자 도메인 모델 및 예외처리 모델을 선정한다. 여기서, 예외처리 모델은 예외처리 관리 모듈(113)이 관리하는 모델로서, 도 3에 도시된 바와 같이 불명확한 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 생성한 예외처리 모델1과 미지원 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 생성한 예외처리 모델2를 의미한다.
도메인 처리 모듈(150)은 NLU 엔진(140)에 의해 인식된 결과(일례로, Intent: search Music, Slot: 봄 및 드라이브)를 기반으로 정보처리 결과를 제안하거나 서비스를 제안하거나 상기 인식된 결과를 미지원 도메인으로 판단하거나 불명확 명령어로 판단할 수 있다.
다음으로, 서비스 처리 모듈(160)은 도메인 처리 모듈(150)의 처리 결과에 기초하여 검색을 추천하거나 데이터 검색을 수행하거나 서비스를 제안하거나 예외처리를 수행한다.
서비스 처리 모듈(160)은 CP(Contents Provider, 170)로부터 컨텐츠를 획득하여 사용자에게 제공할 수 있다.
서비스 처리 모듈(160)은 예외처리로서 웹 검색(180)을 수행할 수 있다. 이때, 예외처리에 따른 사용자의 최종 선택(190)은 예외처리 관리 모듈(114)로 전달되어 예외처리 모델을 생성하는데 이용될 수 있다.
도 4 는 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법에 대한 흐름도로서, 음성인식시스템에 구비된 프로세서 또는 별도의 프로세서에 의해 수행될 수 있다.
먼저, 차량에서 제공하는 음성인식 기능을 파악한다(401). 즉, 차량에 탑재된 시스템으로부터 음성인식 기능정보를 수집한다.
그리고, 상기 차량의 상황을 파악한다(402). 즉, 차량에 탑재된 시스템으로부터 상황정보를 수집한다.
이후, 상기 파악된 차량의 음성인식 기능과 상황에 기초하여 사용자 도메인을 관리한다(403). 즉, 상기 수집된 음성인식 기능정보와 상황정보에 기초하여 사용자 도메인을 관리한다.
이러한 과정을 통해, 전체 도메인을 대상으로 의미분석을 수행함으로 인해 발생하는 처리속도의 지연과 의미분석 결과의 낮은 정확도로 인한 예외처리의 증가를 방지할 수 있다.
도 5 는 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법을 실행하기 위한 컴퓨팅 시스템을 보여주는 블록도이다.
도 5를 참조하면, 상술한 본 발명의 일 실시예에 따른 음성인식시스템의 도메인 관리 방법은 컴퓨팅 시스템을 통해서도 구현될 수 있다. 컴퓨팅 시스템(1000)은 시스템 버스(1200)를 통해 연결되는 적어도 하나의 프로세서(1100), 메모리(1300), 사용자 인터페이스 입력 장치(1400), 사용자 인터페이스 출력 장치(1500), 스토리지(1600), 및 네트워크 인터페이스(1700)를 포함할 수 있다.
프로세서(1100)는 중앙 처리 장치(CPU) 또는 메모리(1300) 및/또는 스토리지(1600)에 저장된 명령어들에 대한 처리를 실행하는 반도체 장치일 수 있다. 메모리(1300) 및 스토리지(1600)는 다양한 종류의 휘발성 또는 불휘발성 저장 매체를 포함할 수 있다. 예를 들어, 메모리(1300)는 ROM(Read Only Memory) 및 RAM(Random Access Memory)을 포함할 수 있다.
따라서, 본 명세서에 개시된 실시예들과 관련하여 설명된 방법 또는 알고리즘의 단계는 프로세서(1100)에 의해 실행되는 하드웨어, 소프트웨어 모듈, 또는 그 2 개의 결합으로 직접 구현될 수 있다. 소프트웨어 모듈은 RAM 메모리, 플래시 메모리, ROM 메모리, EPROM 메모리, EEPROM 메모리, 레지스터, 하드 디스크, SSD(Solid State Drive), 착탈형 디스크, CD-ROM과 같은 저장 매체(즉, 메모리(1300) 및/또는 스토리지(1600))에 상주할 수도 있다. 예시적인 저장 매체는 프로세서(1100)에 커플링되며, 그 프로세서(1100)는 저장 매체로부터 정보를 판독할 수 있고 저장 매체에 정보를 기입할 수 있다. 다른 방법으로, 저장 매체는 프로세서(1100)와 일체형일 수도 있다. 프로세서 및 저장 매체는 주문형 집적회로(ASIC) 내에 상주할 수도 있다. ASIC는 사용자 단말기 내에 상주할 수도 있다. 다른 방법으로, 프로세서 및 저장 매체는 사용자 단말기 내에 개별 컴포넌트로서 상주할 수도 있다.
이상의 설명은 본 발명의 기술 사상을 예시적으로 설명한 것에 불과한 것으로서, 본 발명이 속하는 기술 분야에서 통상의 지식을 가진 자라면 본 발명의 본질적인 특성에서 벗어나지 않는 범위에서 다양한 수정 및 변형이 가능할 것이다.
따라서, 본 발명에 개시된 실시예들은 본 발명의 기술 사상을 한정하기 위한 것이 아니라 설명하기 위한 것이고, 이러한 실시예에 의하여 본 발명의 기술 사상의 범위가 한정되는 것은 아니다. 본 발명의 보호 범위는 아래의 청구범위에 의하여 해석되어야 하며, 그와 동등한 범위 내에 있는 모든 기술 사상은 본 발명의 권리범위에 포함되는 것으로 해석되어야 할 것이다.
110: 사용자 도메인 분석 모듈
120: 전처리 모듈
130: 음성 인식부
140: NLU 엔진
150: 도메인 처리 모듈
160: 서비스 처리 모듈

Claims (13)

  1. 차량에 탑재된 시스템으로부터 음성인식 기능정보를 수집하는 단계;
    차량에 탑재된 시스템으로부터 상황정보를 수집하는 단계; 및
    상기 수집된 음성인식 기능정보와 상황정보에 기초하여 사용자 도메인을 관리하는 단계
    를 포함하는 음성인식시스템의 도메인 관리 방법.
  2. 제 1 항에 있어서,
    상기 사용자 도메인은,
    복수의 메인 도메인을 포함하고, 각 메인 도메인은 복수의 서브 도메인을 포함하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
  3. 제 2 항에 있어서,
    상기 사용자 도메인을 관리하는 단계는,
    특정 메인 도메인을 활성화하거나 비활성화하는 단계; 및
    특정 서브 도메인을 활성화하거나 비활성화하는 단계
    를 포함하는 음성인식시스템의 도메인 관리 방법.
  4. 제 2 항에 있어서,
    차량에 탑재된 시스템으로부터 수집한 사용자의 선호도 정보에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정하는 단계
    를 더 포함하는 음성인식시스템의 도메인 관리 방법.
  5. 제 4 항에 있어서,
    상기 활성화 여부를 결정하는 단계는,
    상기 사용자의 선호도 정보로서 사용자가 설정한 메뉴 우선순위 또는 즐겨찾기에 기초하여 메인 도메인과 서브 도메인의 활성화 여부를 결정하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
  6. 제 2 항에 있어서,
    상기 메인 도메인은,
    통신, 내비게이션, 미디어, 지식, 뉴스, 스포츠, 날씨 중 적어도 하나를 포함하는 음성인식시스템의 도메인 관리 방법.
  7. 제 2 항에 있어서,
    상기 상황정보를 수집하는 단계는,
    상기 차량의 주차상태 또는 정차상태, 내비게이션 설정 상태, 정보 수신 상태, 폰 연결 상태 중 적어도 하나를 수집하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
  8. 제 7 항에 있어서,
    상기 수집한 상황정보에 기초하여 각각의 상황에서 각 메인 도메인의 사용빈도를 분석하고, 상기 분석된 사용빈도에 따라 각 메인 도메인에 가중치를 부여하는 단계
    를 더 포함하는 음성인식시스템의 도메인 관리 방법.
  9. 제 1 항에 있어서,
    상기 음성인식 기능정보를 수집하는 단계는,
    상기 차량에 구비된 AVN(Audio Video Nagavigation) 시스템으로부터 음성인식 기능정보를 수집하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
  10. 제 1 항에 있어서,
    상기 사용자 도메인을 관리하는 단계는,
    복수의 사용자를 대상으로 각각의 사용자 도메인을 관리하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
  11. 제 1 항에 있어서,
    예외처리된 결과에 대한 사용자의 선택을 반영하여 상기 사용자 도메인을 추가 관리하는 단계
    를 더 포함하는 음성인식시스템의 도메인 관리 방법.
  12. 제 11 항에 있어서,
    상기 사용자 도메인을 추가 관리하는 단계는,
    상기 사용자가 선택한 도메인에 가중치를 부여하는 것을 특징으로 하는 음성인식시스템의 도메인 관리 방법.
  13. 제 11 항에 있어서,
    상기 사용자 도메인을 추가 관리하는 단계는,
    불명확한 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 예외처리 모델1을 생성하는 단계; 및
    미지원 명령어의 예외처리 결과에 대한 사용자의 선택에 기초하여 예외처리 모델2를 생성하는 단계
    를 포함하는 음성인식시스템의 도메인 관리 방법.
KR1020180159723A 2018-12-12 2018-12-12 음성인식시스템의 도메인 관리 방법 Active KR102869070B1 (ko)

Priority Applications (3)

Application Number Priority Date Filing Date Title
KR1020180159723A KR102869070B1 (ko) 2018-12-12 2018-12-12 음성인식시스템의 도메인 관리 방법
US16/415,547 US20200193985A1 (en) 2018-12-12 2019-05-17 Domain management method of speech recognition system
CN201910514729.3A CN111312236A (zh) 2018-12-12 2019-06-14 语音识别系统的域管理方法

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
KR1020180159723A KR102869070B1 (ko) 2018-12-12 2018-12-12 음성인식시스템의 도메인 관리 방법

Publications (2)

Publication Number Publication Date
KR20200072021A true KR20200072021A (ko) 2020-06-22
KR102869070B1 KR102869070B1 (ko) 2025-10-13

Family

ID=71071207

Family Applications (1)

Application Number Title Priority Date Filing Date
KR1020180159723A Active KR102869070B1 (ko) 2018-12-12 2018-12-12 음성인식시스템의 도메인 관리 방법

Country Status (3)

Country Link
US (1) US20200193985A1 (ko)
KR (1) KR102869070B1 (ko)
CN (1) CN111312236A (ko)

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
WO2023132470A1 (ko) * 2022-01-06 2023-07-13 삼성전자주식회사 사용자 발화를 처리하는 서버, 전자 장치 및 그의 동작 방법

Families Citing this family (4)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US11043214B1 (en) * 2018-11-29 2021-06-22 Amazon Technologies, Inc. Speech recognition using dialog history
US11495234B2 (en) * 2019-05-30 2022-11-08 Lg Electronics Inc. Data mining apparatus, method and system for speech recognition using the same
GB202211620D0 (en) * 2022-08-09 2022-09-21 Oakspire Ltd Automated speech recognition to support context-aware intent recognition
CN117390149A (zh) * 2023-09-25 2024-01-12 中国第一汽车股份有限公司 一种车载电子手册控制方法、系统及车辆

Citations (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US20110307250A1 (en) * 2010-06-10 2011-12-15 Gm Global Technology Operations, Inc. Modular Speech Recognition Architecture
US20140244259A1 (en) * 2011-12-29 2014-08-28 Barbara Rosario Speech recognition utilizing a dynamic set of grammar elements
US20180096681A1 (en) * 2016-10-03 2018-04-05 Google Inc. Task initiation using long-tail voice commands
KR20180075050A (ko) 2016-12-26 2018-07-04 현대자동차주식회사 대화 처리 장치, 이를 포함하는 차량 및 대화 처리 방법
KR20180086718A (ko) * 2017-01-23 2018-08-01 현대자동차주식회사 대화 시스템, 이를 포함하는 차량 및 대화 처리 방법

Family Cites Families (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JP2008064885A (ja) * 2006-09-05 2008-03-21 Honda Motor Co Ltd 音声認識装置、音声認識方法、及び音声認識プログラム
JP6029985B2 (ja) * 2013-01-11 2016-11-24 クラリオン株式会社 情報処理装置、操作システム、および、情報処理装置の操作方法
US20150249906A1 (en) * 2014-02-28 2015-09-03 Rovi Guides, Inc. Methods and systems for encouraging behaviour while occupying vehicles
US10475447B2 (en) * 2016-01-25 2019-11-12 Ford Global Technologies, Llc Acoustic and domain based speech recognition for vehicles
US10229683B2 (en) * 2017-03-10 2019-03-12 Soundhound, Inc. Speech-enabled system with domain disambiguation

Patent Citations (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US20110307250A1 (en) * 2010-06-10 2011-12-15 Gm Global Technology Operations, Inc. Modular Speech Recognition Architecture
US20140244259A1 (en) * 2011-12-29 2014-08-28 Barbara Rosario Speech recognition utilizing a dynamic set of grammar elements
US20180096681A1 (en) * 2016-10-03 2018-04-05 Google Inc. Task initiation using long-tail voice commands
KR20180075050A (ko) 2016-12-26 2018-07-04 현대자동차주식회사 대화 처리 장치, 이를 포함하는 차량 및 대화 처리 방법
KR20180086718A (ko) * 2017-01-23 2018-08-01 현대자동차주식회사 대화 시스템, 이를 포함하는 차량 및 대화 처리 방법

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
WO2023132470A1 (ko) * 2022-01-06 2023-07-13 삼성전자주식회사 사용자 발화를 처리하는 서버, 전자 장치 및 그의 동작 방법

Also Published As

Publication number Publication date
US20200193985A1 (en) 2020-06-18
CN111312236A (zh) 2020-06-19
KR102869070B1 (ko) 2025-10-13

Similar Documents

Publication Publication Date Title
US7016849B2 (en) Method and apparatus for providing speech-driven routing between spoken language applications
EP1936606B1 (en) Multi-stage speech recognition
US11056113B2 (en) Conversation guidance method of speech recognition system
EP2838085B1 (en) Voice recognition server integration device and voice recognition server integration method
KR102869070B1 (ko) 음성인식시스템의 도메인 관리 방법
KR102915192B1 (ko) 대화 시스템, 대화 처리 방법 및 전자 장치
US20060100871A1 (en) Speech recognition method, apparatus and navigation system
KR20050082249A (ko) 도메인 기반 대화 음성인식방법 및 장치
KR102485342B1 (ko) 차량의 환경에 기반한 추천 신뢰도 판단 장치 및 방법
CN112651247B (zh) 对话系统、对话处理方法、翻译装置和翻译方法
US20250149036A1 (en) Preemptive wakeword detection
US20070174055A1 (en) Method and system for dynamic nametag scoring
US11783806B2 (en) Dialogue system and dialogue processing method
JP2008134502A (ja) 音声認識装置、および音声認識方法
KR20200095636A (ko) 대화 시스템이 구비된 차량 및 그 제어 방법
CN112997247A (zh) 利用大数据的最佳语言模型生成方法及用于其的装置
KR20250043811A (ko) 음성 인식 시스템을 평가하기 위한 방법 및 장치
KR102787014B1 (ko) 대화 시스템, 이를 포함하는 차량 및 대화 처리 방법
KR20090068856A (ko) 음소레벨 로그우도 비율 분포와 음소 지속시간 분포에 의한단어음색 모델 기반 발화검증 시스템 및 방법
KR102527346B1 (ko) 차량용 음성 인식 장치, 이를 이용한 차량의 주행상태를 고려한 응답 제공 방법 및 컴퓨터 프로그램
US12499877B2 (en) Dialogue system and method for controlling the same
KR20060098673A (ko) 음성 인식 방법 및 장치
CN121884814A (zh) 用于实时改变语言的方法和系统
Sárosi et al. Recognition of multiple language voice navigation queries in traffic situations

Legal Events

Date Code Title Description
PA0109 Patent application

St.27 status event code: A-0-1-A10-A12-nap-PA0109

R18-X000 Changes to party contact information recorded

St.27 status event code: A-3-3-R10-R18-oth-X000

R18-X000 Changes to party contact information recorded

St.27 status event code: A-3-3-R10-R18-oth-X000

PG1501 Laying open of application

St.27 status event code: A-1-1-Q10-Q12-nap-PG1501

PN2301 Change of applicant

St.27 status event code: A-3-3-R10-R13-asn-PN2301

St.27 status event code: A-3-3-R10-R11-asn-PN2301

A201 Request for examination
PA0201 Request for examination

St.27 status event code: A-1-2-D10-D11-exm-PA0201

E902 Notification of reason for refusal
PE0902 Notice of grounds for rejection

St.27 status event code: A-1-2-D10-D21-exm-PE0902

E13-X000 Pre-grant limitation requested

St.27 status event code: A-2-3-E10-E13-lim-X000

P11-X000 Amendment of application requested

St.27 status event code: A-2-2-P10-P11-nap-X000

D22 Grant of ip right intended

Free format text: ST27 STATUS EVENT CODE: A-1-2-D10-D22-EXM-PE0701 (AS PROVIDED BY THE NATIONAL OFFICE)

PE0701 Decision of registration

St.27 status event code: A-1-2-D10-D22-exm-PE0701

F11 Ip right granted following substantive examination

Free format text: ST27 STATUS EVENT CODE: A-2-4-F10-F11-EXM-PR0701 (AS PROVIDED BY THE NATIONAL OFFICE)

PR0701 Registration of establishment

St.27 status event code: A-2-4-F10-F11-exm-PR0701

PR1002 Payment of registration fee

St.27 status event code: A-2-2-U10-U11-oth-PR1002

Fee payment year number: 1

U11 Full renewal or maintenance fee paid

Free format text: ST27 STATUS EVENT CODE: A-2-2-U10-U11-OTH-PR1002 (AS PROVIDED BY THE NATIONAL OFFICE)

Year of fee payment: 1

PG1601 Publication of registration

St.27 status event code: A-4-4-Q10-Q13-nap-PG1601

Q13 Ip right document published

Free format text: ST27 STATUS EVENT CODE: A-4-4-Q10-Q13-NAP-PG1601 (AS PROVIDED BY THE NATIONAL OFFICE)