ES2379572T3 - Sistemas y métodos para navegación automática de vehículo con voz, no incorporados - Google Patents
Sistemas y métodos para navegación automática de vehículo con voz, no incorporados Download PDFInfo
- Publication number
- ES2379572T3 ES2379572T3 ES05795145T ES05795145T ES2379572T3 ES 2379572 T3 ES2379572 T3 ES 2379572T3 ES 05795145 T ES05795145 T ES 05795145T ES 05795145 T ES05795145 T ES 05795145T ES 2379572 T3 ES2379572 T3 ES 2379572T3
- Authority
- ES
- Spain
- Prior art keywords
- data center
- operator
- information
- destination
- components
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Expired - Lifetime
Links
Classifications
-
- G—PHYSICS
- G01—MEASURING; TESTING
- G01C—MEASURING DISTANCES, LEVELS OR BEARINGS; SURVEYING; NAVIGATION; GYROSCOPIC INSTRUMENTS; PHOTOGRAMMETRY OR VIDEOGRAMMETRY
- G01C21/00—Navigation; Navigational instruments not provided for in groups G01C1/00 - G01C19/00
- G01C21/26—Navigation; Navigational instruments not provided for in groups G01C1/00 - G01C19/00 specially adapted for navigation in a road network
- G01C21/34—Route searching; Route guidance
- G01C21/36—Input/output arrangements for on-board computers
- G01C21/3605—Destination input or retrieval
- G01C21/3608—Destination input or retrieval using speech input, e.g. using speech recognition
-
- G—PHYSICS
- G08—SIGNALLING
- G08G—TRAFFIC CONTROL SYSTEMS
- G08G1/00—Traffic control systems for road vehicles
- G08G1/09—Arrangements for giving variable traffic instructions
- G08G1/0962—Arrangements for giving variable traffic instructions having an indicator mounted inside the vehicle, e.g. giving voice messages
- G08G1/0968—Systems involving transmission of navigation instructions to the vehicle
- G08G1/096805—Systems involving transmission of navigation instructions to the vehicle where the transmitted instructions are used to compute a route
- G08G1/096811—Systems involving transmission of navigation instructions to the vehicle where the transmitted instructions are used to compute a route where the route is computed offboard
-
- G—PHYSICS
- G08—SIGNALLING
- G08G—TRAFFIC CONTROL SYSTEMS
- G08G1/00—Traffic control systems for road vehicles
- G08G1/09—Arrangements for giving variable traffic instructions
- G08G1/0962—Arrangements for giving variable traffic instructions having an indicator mounted inside the vehicle, e.g. giving voice messages
- G08G1/0968—Systems involving transmission of navigation instructions to the vehicle
- G08G1/096833—Systems involving transmission of navigation instructions to the vehicle where different aspects are considered when computing the route
- G08G1/09685—Systems involving transmission of navigation instructions to the vehicle where different aspects are considered when computing the route where the complete route is computed only once and not updated
-
- G—PHYSICS
- G08—SIGNALLING
- G08G—TRAFFIC CONTROL SYSTEMS
- G08G1/00—Traffic control systems for road vehicles
- G08G1/09—Arrangements for giving variable traffic instructions
- G08G1/0962—Arrangements for giving variable traffic instructions having an indicator mounted inside the vehicle, e.g. giving voice messages
- G08G1/0968—Systems involving transmission of navigation instructions to the vehicle
- G08G1/096855—Systems involving transmission of navigation instructions to the vehicle where the output is provided in a suitable form to the driver
- G08G1/096872—Systems involving transmission of navigation instructions to the vehicle where the output is provided in a suitable form to the driver where instructions are given per voice
-
- G—PHYSICS
- G08—SIGNALLING
- G08G—TRAFFIC CONTROL SYSTEMS
- G08G1/00—Traffic control systems for road vehicles
- G08G1/09—Arrangements for giving variable traffic instructions
- G08G1/0962—Arrangements for giving variable traffic instructions having an indicator mounted inside the vehicle, e.g. giving voice messages
- G08G1/0968—Systems involving transmission of navigation instructions to the vehicle
- G08G1/096877—Systems involving transmission of navigation instructions to the vehicle where the input to the navigation device is provided by a suitable I/O arrangement
- G08G1/096894—Systems involving transmission of navigation instructions to the vehicle where the input to the navigation device is provided by a suitable I/O arrangement where input is assisted by the navigation device, i.e. the user does not type the complete name of the destination, e.g. using zip codes, telephone numbers, progressively selecting from initial letters
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L21/00—Speech or voice signal processing techniques to produce another audible or non-audible signal, e.g. visual or tactile, in order to modify its quality or its intelligibility
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L21/00—Speech or voice signal processing techniques to produce another audible or non-audible signal, e.g. visual or tactile, in order to modify its quality or its intelligibility
- G10L21/06—Transformation of speech into a non-audible representation, e.g. speech visualisation or speech processing for tactile aids
Landscapes
- Engineering & Computer Science (AREA)
- Radar, Positioning & Navigation (AREA)
- Physics & Mathematics (AREA)
- Remote Sensing (AREA)
- General Physics & Mathematics (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Health & Medical Sciences (AREA)
- Acoustics & Sound (AREA)
- Computational Linguistics (AREA)
- Multimedia (AREA)
- Signal Processing (AREA)
- Quality & Reliability (AREA)
- Automation & Control Theory (AREA)
- Mathematical Physics (AREA)
- Artificial Intelligence (AREA)
- General Health & Medical Sciences (AREA)
- Data Mining & Analysis (AREA)
- Navigation (AREA)
- Traffic Control Systems (AREA)
- Automatic Cycles, And Cycles In General (AREA)
Abstract
Un método para suministrar información de navegación a un operador de un vehículo (10) que comprende: procesar la información de destino pronunciada (102) por un operador de vehículo (10) con un sistema de procesamiento a bordo en el vehículo; transmitir la información de voz procesada por vía de un enlace inalámbrico (25) a un centro de datos remoto (19); analizar (103) la información de voz procesada con un sistema de reconocimiento de voz (20) en el centro de datos remoto (19) para reconocer los componentes de la información de destino pronunciada por el operador del vehículo (10); determinar un destino de los componentes confirmados en la información de destino; generar (113) la información de ruta al destino en el centro de datos remoto (19); y transmitir (114) la información de ruta al sistema de procesamiento a bordo desde el centro de datos remoto (19 ) por vía del enlace inalámbrico (25); caracterizado porque genera en un centro de datos remoto (19) una lista de los componentes reconocidos hipotéticos de la información de destino listada por los niveles de confianza tal como se calculó para cada componente de la información de destino analizada por el sistema de reconocimiento de voz (20); desplega la lista de los componentes reconocidos hipotéticos y los niveles de confianza en el centro de datos remoto (19) para hacer una revisión selectiva por un operador humano del centro de datos (23); selecciona un conjunto de componentes hipotéticos con base en los niveles de confianza en la lista; y confirmar la precisión del conjunto seleccionado de componentes hipotéticos reconocidos de la infomación de destino por vía de intercambio de voz interactivos entre el operador del vehículo (10) y el centro de datos remoto (19) al reproducir un audio hablado de texto a voz generado por ordenador al operador del vehículo (10) para confirmación.
Description
Sistemas y métodos para navegación automática de vehículo con voz, no incorporados
Campo de la invención
La presente invención se relaciona en general con técnicas de navegación de vehículo, y en particular, con sistemas y métodos para navegación automática de vehículo con voz no incorporados.
Antecedentes de la invención
Los sistemas de navegación automotriz han estado disponibles durante numerosos años y se diseñan para guiar los operadores de vehículo a un destino específico. Un inconveniente principal de los sistemas de navegación convencional se relaciona con los métodos de ingresar los destinos objetivos. Es bien conocido que ocurre distracción del conductor cuando el operador del vehículo interactúa con un teclado o una pantalla táctil mientras maneja, de hecho, los usuarios típicamente se frustraron con los factores humanos y el necesario aprendizaje asociado para ingresar los destinos objetivo manualmente. Adicionalmente, los sistemas existentes le permiten a los usuarios ingresar el destino mientras se maneja, lo que ha mostrado que origina distracción del conductor. El ingreso de una dirección o punto de interés (POI) al utilizar métodos manuales típicamente requiere tiempo y concentración de parte del operador del vehículo, y en particular, no se puede mirar el camino y manejar de manera segura. Existe un litigio pendiente en desarrollo que se relaciona con la distracción del conductor y el uso de sistemas de navegación mediante maneja.
Para la mayoría de los sistemas de navegación interna o que se encuentran en el vehículo, existen etapas secuenciales que ocurren durante el uso. El proceso inicia con la interacción del usuario donde el sistema de navegación determina primero la ubicación de partida, usualmente de la información GPS. El destino del blanco se ingresa típicamente como una dirección, una intersección de calles, o un punto de interés que sería un avance sustancial en la técnica administrar sistemas de reconocimiento de voz automáticos que manejen un menú localizados en un centro de datos remoto que reconocería los destinos blanco hablados mientras se utiliza simultáneamente la información GPS transmitida desde el vehículo sobre un enlace inalámbrico a un centro de datos remoto. También sería un avance significativo suministrar una interface de usuario por medio de voz que se diseñe para minimizar el tiempo de interacción del operador del vehículo y/o el tiempo de interacción del operador del centro de datos. Finalmente, sería un avance significativo si los destinos objetivo se pudieran determinar con una alta confiabilidad y eficiencia al utilizar la combinación de la tecnología de automatización con voz de información GPS, la ayuda del operador, y la ayuda del usuario para confirmar que es correcto el destino especificado. Cuando es necesario, el operador se involucraría en determinar el destino objetivo que se ha hablado, y el operador del vehículo (el usuario) confirmaría que el destino hablado es correcto antes de que se involucre el operador del centro de datos. Un reconocedor de habla automático, contexto para hablar de alta calidad, e información GPS juegan cada una un papel en el proceso final de determinar un destino objeto.
La WO 02/48650 A1 describe un sistema y un procedimiento para suministrar un servicio telefónico a un usuario con una descripción de la ruta a información acerca del objeto geográfico, por ejemplo una compañía, un tipo de compañía, una dirección o similar. El procedimiento incluye las etapas de que el usuario establezca una conexión por vía de un sistema de comunicación, preferiblemente un sistema telefónico móvil, con un dispositivo de servicio de habla que incluye un servidor de servicio de habla. El usuario establece/da un comando hablado al dispositivo de servicio hablado, cuyo comando incluye una inquietud con relación al tipo de objeto geográfico. El dispositivo del servicio de habla se deriva, de uno a la base de datos conectada al sistema de comunicación, la información relacionada con la posición asociada con dicho objeto, y presenta, mediante habla sintetizada, dicha información relacionada con la posición al usuario.
La US 2003/088359 A1 describe un método para suministrar información de navegación a un usuario terminando navegación. El método le permite a la terminal ITS recibir información de navegación de un centro de información por vía de un terminal de comunicación móvil y guía audiblemente la información de navegación a un usuario. El método para que un terminal de navegación que utiliza una red inalámbrica reciba información de navegación relacionada con una posición predeterminada desde un centro de información comprende las etapas de: a) transmitir información de posición al centro de información por vía de un canal de voz; y b) recibir la información de navegación relacionada con la posición predeterminada del centro de información por vía de un canal de datos.
La WO 03/079310 A2 describe un sistema que incluye una unidad localizada en el vehículo y acoplada a la primera red, un centro de información de tráfico acoplado a una segunda red, y un servidor acoplado a la primera y segunda redes. Se genera un plan de viaje de acuerdo con la información de navegación, las coordenadas del vehículo y la información de solicitud de viaje recibida de la unidad, y la información del camino recibido del centro de información de tráfico. El plan de viaje se envía a la unidad para presentación.
La US 2002/156570 A1 describe un sistema de navegación de un coche que, al momento de desear información de un mapa, información de tráfico, y otra información requerida en un coche, le requiere a un proveedor de servicio de distribución de información distribuir la información y ésta se compone de un dispositivo terminal en movimiento que se puede operar mediante voz que ingresa y que sale, un dispositivo de comunicación, un servidor interactivo de audio que puede ingresar y sacar voz y datos, y está conectado a un dispositivo externo y la Internet sobre la base de interacciones de audio por medio de un proceso de reconocimiento de voz y un proceso de síntesis de voz, y ejecuta la transferencia de información. Uno de una pluralidad de proveedores de servicios de distribución de información se conectan a la Internet para distribuir la información tal como información de mapa e información de tráfico.
Resumen de la invención
De acuerdo con esto, la presente invención está dirigida a un sistema y método para suministrar, o bajar la información de navegación desde una base de datos de un centro de datos remoto sobre un enlace inalámbrico a un vehículo de acuerdo con las reivindicaciones independientes. La información suministrada sería en respuesta a unos destinos objetivo reconocidos por voz hablados por el operador del vehículo. El sistema de reconocimiento de voz estaría localizado en el centro de datos remoto. La información suministrada, o bajada, podría ser el POI del destino objetivo, la intersección de calle, o dirección. El destino se determinaría a través de la interface de una interface de usuario con voz por medio de la cual cuatro componentes están involucrados en el proceso de automatización, que incluyen tecnología de voz, información GPS del vehículo, el operador del centro de datos, y el operador del vehículo. La información suministrada, o bajada, podría ser la información de la ruta para el POI del destino objetivo,
o la dirección, determinada a través de la interface de usuario con voz.
Las ventajas primarias del centro de datos remoto son la flexibilidad y la efectividad de costos. Se puede acceder a datos precisos, actualizados y la cantidad de datos puede ser muy grande en razón de la tecnología de memoria. En razón a que la plataforma de información no está incorporada, la aplicación se puede modificar fácilmente sin cambiar ni el hardware ni el software del vehículo. Tal flexibilidad permite la personalización del usuario y la incorporación de aplicación, en el cual un número de diferentes aplicaciones son accesibles a través de un menú principal de voz. En términos de costos, los recursos de reconocimiento de voz con base en el servidor se pueden compartir a través de un gran espectro de diferentes vehículos. Por ejemplo, 48 canales de reconocimiento de voz con base en servidor se pueden acomodar en mil vehículos de manera simultánea.
Los requisitos de la tecnología de voz para la invención incluyen texto a voz altamente inteligible, reconocimiento de voz, n-mejores resultados de búsqueda y niveles de confianza de reconocimiento asociada. El término “n-mejores resultados de búsqueda” se refiere a un formato de salida de reconocimiento de habla común que ordena por rango las hipótesis de reconocimiento con base en la probabilidad. El texto para hablar se utiliza para representar lo que se reconoció automáticamente y se puede distinguir de la voz del operador del vehículo. Una base de datos de pronunciación, también denominada como una base de datos fonética, es necesaria para las pronunciaciones inteligibles correctas de los POI, ciudades, estados, y nombres de las calles. Para los casos en los cuales un reconocimiento resulta no tener una alta calificación de confianza, un registro de lo que se habló es reproducido al operador del vehículo para confirmación de lo que la representación de habla, o archivo de onda de audio, es correcto y reconocible por un humano, finalmente el operador del centro de datos. Por ejemplo, si un operador de vehículo dice una ciudad y estado, un nombre de calle, y un número de calle, entonces la aplicación repite lo que se ha hablado en una de tres maneras: una voz de ordenador pura (texto a habla), y una combinación de una voz de ordenador y la voz del operador del vehículo, o solamente la voz del operador del vehículo. En el último caso, el operador del centro de datos escucharía el habla y determinaría la dirección al escuchar y observar las n mejores listas asociadas con cada parte de la dirección. En el caso anterior, el operador del centro de datos no estaría involucrado o se requeriría; el proceso sería completamente automático. En el caso híbrido, el operador del centro de datos escucharía una parte de lo que se habló para determinar la dirección al escuchar y observar las n mejores listas asociadas con la parte de la dirección no reconocida de manera automática. Sería típico para el operador escuchar o simplemente pinchar sobre la n mejor selección que coincida con el componente de dirección en cuestión. Digitar el componente de dirección se requeriría si la n mejor lista no contiene el componente de dirección correcto. Cuando se involucra, el operador del centro de datos puede seleccionar escuchar a cualquier componente de la dirección. Se utiliza una estrategia similar para determinar un POI hablado.
Para la entrada del POI, la interface de usuario de voz se puede diseñar para capturar una categoría POI (por ejemplo restaurante o ATM) y determinar si se desea la ubicación más cercana. Si es así, se completa la tarea de ingreso del destino hablado después de la confirmación con una respuesta de “si”. Si no se desea el sitio más cercano, una respuesta de “no” se manifiesta y el operador del vehículo se compele al decir el nombre del POI. De manera similar, si no se reconoce la categoría, esta se registra y pasa al operador del centro de datos además del nombre del POI, también gravado sino se reconoció, posterior a la confirmación del operador del vehículo de que la grabación está correcta. Para la determinación del POI, el GPS se puede utilizar para y restringir la gramática activa del POI con base en un radio específico con relación a la ubicación de vehículo.
Si el operador del vehículo dice una categoría POI y un nombre POI entonces la aplicación repite lo que se habló en una de tres formas: una voz de ordenador pura (texto a habla) una combinación de voz de ordenador y la voz del operador del vehículo, o exclusivamente en solamente la voz del operador del centro de datos. En el último caso, el operador del centro de datos escucharía todo lo que se habló y determina el POI al escuchar y observar la n mejor lista asociada con la categoría y nombre del POI. En el anterior caso, el operador no estaría involucrado o se necesitaría; el proceso sería completamente automático. En el caso híbrido, el operador del centro de datos escucharía una parte de lo que se habló y determinaría el POI a través de escuchar y observar la n mejor lista asociada con cualquier categoría o nombre del POI. Sería típico para el operador escuchar y simplemente pinchar sobre la n mejor selección que coincida con el componente del POI en cuestión. Digitar el componente del POI requeriría si la n mejor lista no contiene el componente POI correcto. Cuando se involucra, el operador del centro de datos puede seleccionar escuchar cualquier componente del POI.
La invención descrita pretende estar integrada con un sistema de navegación a bordo capaz de procesar GPS en tiempo real para suministro de ruta. El sistema de navegación es una solución híbrida en el caso optimizado por que la ruta no se puede suministrar tan efectivamente en tiempo real desde un centro de datos remoto. Cuando guías vez por vez se suministran directamente desde el centro de datos remoto la información GPS que específica la ubicación del vehículo puede perder sincronización con la posición efectiva del vehículo debido a latencias en la comunicación inalámbrica entre el vehículo y el centro de datos remoto. Por ejemplo, un indicativo generado por el sistema (por ejemplo instrucción de voltear) puede experimentar demasiado tarde por el operador del vehículo lo cual resulta en una desviación de la ruta. En resumen, la implementación ideal utiliza tecnología a bordo que incluye información de GPS en tiempo real para suministrar direcciones vez a vez mediante la voz en el ambiente del vehículo.
Breve descripción de los dibujos
Para un más completo entendimiento de la presente invención, y las ventajas de la misma, se hace referencia a la siguiente descripción tomada en conjunto con los dibujos que la acompañan, en los cuales:
La FIGURA 1A es un diagrama de bloque de un sistema de navegación automatizada de vehículo con voz, no incorporado que efectúan los principios de la presente invención;
Las FIGURAS 1B a 1E muestran un diagrama de flujo que ilustran las operaciones de navegación de un vehículo automatizado con voz representativo implementado en el sistema mostrado en la FIGURA 1A.
La FIGURA 2 es un diagrama conceptual de una exhibición de un centro de datos representativo adecuado para implementar la ayuda del operador del centro de datos en reconocimiento del destino objetivo con base en la información de punto de interés (POI);
La FIGURA 3 es un diagrama conceptual de una exhibición de un centro de datos representativo adecuado para implementar la ayuda del operador del centro de datos en reconocimiento del destino objetivo con base en la información de ciudad y estado; y
Las FIGURAS 4 y 5 son diagramas conceptuales de exhibiciones de centros de datos representativos adecuados para implementar la ayuda del operador del centro de datos en el reconocimiento del destino objetivo con base en la información de la ciudad, estado, y nombre de la calle.
Descripción detallada de la invención
Los principios de la presente invención y sus ventajas se entenderán mejor al referirse a las realizaciones ilustradas descritas en las FIGURAS 1-5 de los dibujos, en los cuales números similares designan partes similares.
La FIGURA 1A es un diagrama de un sistema de navegación automático con voz, no incorporado que representa los principios de la presente invención. La FIGURA 1B es un diagrama de flujo de un procedimiento 100 que ilustra las operaciones representativas del sistema 100, también representado los principios de la presente invención.
En referencia a las FIGURAS 1A Y 1B, cuando el operador del vehículo 10 desea ingresar un destino objetivo con el fin de recibir la guía de ruta, se inicia un enlace de comunicaciones inalámbrico al centro de datos remoto 19 en bloque 101 del procedimiento 100. El proceso se podría iniciar de numerosas maneras, tal como hablar un comando en el vehículo o preferiblemente al presionar un botón. Se establece la comunicación y el operador del vehículo 10 pronuncia comandos en el micrófono de manos libre 11, localizado en proximidad del operador del vehículo 10, en el bloque 102.
Los comandos hablados del operador del vehículo pasan por el enlace inalámbrico 25 a través del módulo de comunicación inalámbrico montado en el vehículo 14, a través de la antena inalámbrica montada en el vehículo 15, a través de la antena de la red inalámbrica 16 y de la estación base inalámbrica de la red 14, a través de una de muchas redes de comunicación y en el centro de datos 19. Desde el centro de datos, la unidad de reconocimiento de voz 20 interpreta él o los comandos hablados. Los comandos incluyen información con relación a la dirección, POI, o intersección de calle. Para una entrada de dirección, se pueden mencionar primero la ciudad y el estado.
La unidad de reconocimiento de voz 20 intenta, en el bloque 103 del procedimiento 100 de la FIGURA 1B, reconocer el ingreso hablado en el bloque 104 crea una n mejor lista de la hipótesis superior donde n típicamente no excede 5 (esto es, la unidad de reconocimiento 20 genera hasta 5 representaciones de texto de posibles combinaciones de ciudad/estado, cada una con una probabilidad asociada de reconocimiento correcta). Cada hipótesis de reconocimiento se le asigna una calificación de confianza (probabilidad), en el bloque 105, que es normalizado a 1. Si a la elección más alta se le asigna una calificación de confianza por encima de un umbral especificado, en el bloque de decisión 106, el ingreso hablado se considera como reconocido, y el audio del habla de texto a habla ingresado en el ordenador es reproducido al operador del vehículo 10 (bloque 107) para confirmación (bloque 108). Si la confirmación es positiva en el bloque 111, entonces en los bloques 113 y 114 se genera una información de ruta automáticamente y se transmite a la unidad a bordo 13.
El audio de lo hablado se dirige a él o los parlantes del vehículo 12 en un ambiente de manos libre. El operador del vehículo 10 responde en el micrófono manos libres 11 a cada indicativo del sistema para especificar una dirección, diciendo de esta manera una ciudad, estado, nombre de calle, y número de calle. El operador del vehículo 10 escucha el o los parlantes del vehículo 12 para oír la dirección de hipótesis representada por el audio de lo conversado que es 1) puramente generado por el ordenador, 2) puramente del operador del vehículo 12, o 3) una combinación de los dos tipos de audio de lo hablado.
La voz generada por el ordenador, utilizada en el bloque 107 del procedimiento 100, solo ocurre para declaraciones reconocidas (reconocimiento de la selección superior con alta confianza). Los componentes del destino (ciudad, estado, nombre de calle y número, POI, etc.) se identifican de otra forma auditivamente de manera individual en la propia voz del operador del vehículo 12 para confirmación cuando la calificación de confianza cae por debajo de un umbral. En particular, si alguno, o aún todos los componentes de destino hablados por el operador del vehículo tienen calificaciones de confianza por debajo del umbral en el bloque 106 del procedimiento 100, entonces al menos aquellos componentes con baja confianza son reproducidos al propietario del vehículo en la propia voz del operador del vehículo en el bloque 109, para confirmación en el bloque 110. Si el operador del vehículo confirma la reproducción del bloque 109, entonces en el bloque de decisión 112 el procedimiento 100 continua al bloque 115 para ayuda del operador del centro de datos para la determinación del destino adecuado y la generación de unas guías de navegación adecuadas.
De otro lado, cuando la primera confirmación intentada produce un resultado negativo en el bloque 111 o en el bloque 112 del procedimiento 100, se efectúa la segunda reproducción en el bloque 117 y la segunda confirmación del propietario del vehículo se intenta en el bloque 118. Para el segundo intento de confirmación, todos los componentes del destino son reproducidos al operador del vehículo. Una confirmación positiva, en el bloque 118, concluye la experiencia del usuario para el ingreso del destino, después de lo cual el operador se involucra en el bloque 115, si es necesario. Se debe enfatizar de que si el destino objetivo es dicho y gravado correctamente, no se requiere repetir de nuevo por el operador del vehículo 12; sin embargo, si el operador del vehículo aún no confirma los componentes de destino desde el segundo intento de confirmación, entonces el procedimiento NAVE, por ejemplo, regresa al menú principal y al operador del vehículo se le solicita repetir el destino deseado en el bloque
102.
Es crítico enfatizar que el operador del vehículo 10 confirma que el archivo de onda de audio almacenado es preciso antes de que se involucre la respuesta del operador del centro 23. Una confirmación de si/no por vía de una unidad de reconocimiento de voz 20 se requiere para todos los destinos antes de que el operador del centro de datos 23 se involucre, si es necesario en todos. Si la confirmación es negativa, otra elección de la n mejor lista de entrada se selecciona en el bloque 106, para reproducción en el bloque 109 y se hace otro intento de confirmación en el bloque
110.
La FIGURA 2 representa una captura de pantalla de muestra de una estación de operador en vivo 22 que se diseña para ayudar al operador del centro de respuesta 23, en el bloque 115 del procedimiento 100, a determinar un destino objetivo. El ejemplo mostrado es para un POI específico, que incluye la correspondiente categoría POI. La FIGURA 2 ilustra 2 n mejor listas, una para la categoría POI y una para el correspondiente POI. Las calificaciones de confianza se listan luego en cada hipótesis de reconocimiento mostrada en las n mejores listas, y sirve para indicar la probabilidad relativa de que la frase que se pronunció es la que se listó. Para la hipótesis, “complejo deportivo”, el nivel de confianza mostrado es de .67199999, que es significativamente mejor que el nivel de confianza para la siguiente elección .01600000 (la frase de hipótesis hablada, “arrendamiento de coche”). Las dos casillas superiores contienen texto que coinciden con las primeras elecciones de las n mejores listas. El texto contenido en las dos casillas se pueden modificar mediante o por el operador del centro de respuesta mediante una entrada de carácter 10 por carácter desde un teclado, al seleccionar la n mejor entrada, también al utilizar un ratón (o teclado). A la derecha de cada casilla están los controles de audio (botones de radio) que le permiten que los archivos de audio almacenados sean reproducidos y escuchados por el operador del centro de respuesta 23.
La capacidad del operador del centro de datos al reproducir las representaciones del archivo de fondo de audio de los componentes del destino pronunciados es crítica para el proceso completo. Para el ejemplo bajo consideración, existen dos componentes de destino: la categoría POI y el nombre POI. Si una frase diferente de la elección de voz se selecciona de la n mejor lista, entonces el texto en la casilla superior correspondiente cambia automáticamente. En el ejemplo mostrado, si se selecciona una categoría POI diferente por el operador del centro de respuesta 23, entonces una gramática posterior diferente se puede activar; la n mejor lista para la POI cambia y una nueva elección superior se ingresa automáticamente en la casilla superior para el nombre del POI. Las calificaciones de confianza para la nueva n mejor lista será muy diferente y se esperaría que fuera significativamente superior si el archivo de onda de audio almacenado coincide con la entrada de gramática bien. Para el ejemplo descrito aquí, el operador del vehículo dice una categoría de POI. La categoría se reconoce, y el operador del vehículo se le solicita si el más cercano “complejo deportivo” es el destino deseado. Una respuesta positiva completa del lado de la interface de usuario por que la información del GPS para la posición del vehículo es todo lo que se requiere para determinar la ruta en el bloque GENERA del procedimiento 100. El GPS se utiliza como el punto de partida, y el POI más cercano se determina con base en la selección de categoría y distancia.
La FIGURA 3 representa parte de una captura de pantalla de muestra de la estación del operador en vivo 22 que se diseña para ayudar la respuesta del operador del centro 23, en el bloque 115 del procedimiento 100, al determinar un componente del destino objetivo. El ejemplo mostrado es para una ciudad y estado específicos, e incluye la n mejor lista generada por la unidad de reconocimiento de voz 20 para la ciudad y estado que se pronunció por el operador del vehículo 10. Las calificaciones de confianza se listan luego encada hipótesis de reconocimiento mostrada en la n mejor lista y sirve para indicar la probabilidad relativa de que la frase que se ha pronunciado es la que se listó. Para la hipótesis “Dallas Texas”, en la calificación de confianza mostrada es .96799999, que es significativamente mejor que la calificación de confianza para la siguiente mejor elección, .01899999 (la frase pronunciada de hipótesis, “Alice, Texas”).
En relación de nuevo a la FIGURA 3, la casilla superior contiene texto que coincide con las primeras elecciones de las n mejor listas. El texto contenido en cada casilla se puede modificar por el operador del centro de respuesta bien sea mediante una entrada de carácter por carácter desde el teclado, al seleccionar una n mejor entrada al utilizar un ratón. A la derecha de la casilla superior están los controles de audio que le permiten a los archivos de onda de audio almacenados ser reproducidos y escuchados por el operador del centro de respuesta 23. De nuevo, la capacidad de reproducir las representaciones del archivo de onda de audio del destino de los componentes del destino pronunciado es crítico para el proceso completo. Si una frase diferente de la elección superior se selecciona de la n mejor lista, entonces el texto en la casilla superior correspondiente cambia automáticamente. El archivo de audio de onda de audio representa lo hablado suministrado por el operador del vehículo 10 (en este caso, una ciudad y un estado).
La FIGURA 4 representa otra captura de pantalla de la estación del operador en vivo 22 que se diseña para ayudar al operador del centro de respuesta 23 a determinar el destino objetivo. El ejemplo mostrado es para una ciudad, estado, y nombre de calle específico. La FIGURA 4 ilustra dos n mejores listas, una para la ciudad y el estado y una para el nombre de la calle. Las calificaciones de confianza se listan luego a cada hipótesis de reconocimiento mostrada en las n mejores listas y sirven para indicar la probabilidad relativa de que la frase que se ha pronunciado es la que se listó. Para la hipótesis “Winchester, California”, la calificación de confianza mostrada es 0.18600000, que no es significativamente mejor que la calificación de confianza para la siguiente mejor elección, 0.14499999 (la frase hablada de hipótesis, “Westchester, California”). En referencia a la FIGURA 4, las dos casillas superiores contienen textos que coinciden con las primeras elecciones de las dos n mejores listas. El texto contenido en las dos casillas se puede modificar por el operador del centro de respuesta bien sea en una entrada carácter por carácter desde un teclado, o al seleccionar la n mejor entrada, al utilizar un ratón (u otros medios). A la derecha de cada casilla se encuentran los controles de audio que le permiten a los archivos de onda de audio almacenados ser reproducidos y escuchados por el operador del centro de respuesta 23.
La capacidad de reproducir las representaciones del archivo de onda de audio de los componentes de destino hablados es crítica para el proceso completo. Para el ejemplo en consideración, existen dos componentes de destino: la ciudad/estado y el nombre de la calle. Si una hipótesis diferente de la elección se selecciona de la n mejor lista, entonces el texto en la casilla superior correspondiente cambia automáticamente. En el ejemplo mostrado, si una ciudad/estado diferente se selecciona por el operador de centro de respuesta 23, entonces se activa una gramática posterior diferente; la n mejor lista para el nombre de la calle cambia y la nueva selección superior es ingresada automáticamente en la casilla superior para el nombre de la calle. La FIGURA 5 ilustra el resultado que ocurre cuando “Lancaster, California” se selecciona por el operador del centro de respuesta 23. Las calificaciones de confianza para la nueva n mejor lista del nombre de la calle son muy diferentes, y la calle de elección superior tiene una alta calificación de confianza, .996, que es cercana a una coincidencia perfecta. Note que la tarea del operador del centro de respuesta 23 para el ejemplo descrito aquí es: 19 escuchar el archivo de onda de audio de la ciudad estado, 2) seleccionar la ciudad/estado correcta, 3) escuchar el archivo de onda de audio del nombre de la calle para confirmar que es correcto, 4) escuchar el archivo de onda de audio del número de la calle para confirmar que es
5 correcto (no ilustrado) y hacer cualquiera corrección de digitación si se requiere antes del suministro final para el procesamiento relacionado con la navegación.
El nivel de archivos de onda de audio capturados se puede normalizar al aplicar un control de ganancia automático digital para mejorar la inteligibilidad humana y la consistencia de la interface de usuario durante la reproducción de audio de los componentes de destino. El audio capturado puede servir para indicar la calidad de las condiciones de
10 la red al operador del vehículo. El audio capturado le enseña al operador del vehículo como hablar en el micrófono y lograr un reconocimiento óptimo.
Claims (20)
- REIVINDICACIONES1. Un método para suministrar información de navegación a un operador de un vehículo (10) que comprende:procesar la información de destino pronunciada (102) por un operador de vehículo (10) con un sistema de procesamiento a bordo en el vehículo; transmitir la información de voz procesada por vía de un enlace inalámbrico (25) a un centro de datos remoto (19); analizar (103) la información de voz procesada con un sistema de reconocimiento de voz (20) en el centro de datosremoto (19) para reconocer los componentes de la información de destino pronunciada por el operador del vehículo (10); determinar un destino de los componentes confirmados en la información de destino;generar (113) la información de ruta al destino en el centro de datos remoto (19); y transmitir (114) la información de ruta al sistema de procesamiento a bordo desde el centro de datos remoto (19 ) por vía del enlace inalámbrico (25);caracterizado porque genera en un centro de datos remoto (19) una lista de los componentes reconocidos hipotéticos de la información dedestino listada por los niveles de confianza tal como se calculó para cada componente de la información de destino analizada por el sistema de reconocimiento de voz (20); desplega la lista de los componentes reconocidos hipotéticos y los niveles de confianza en el centro de datos remoto(19) para hacer una revisión selectiva por un operador humano del centro de datos (23);selecciona un conjunto de componentes hipotéticos con base en los niveles de confianza en la lista; y confirmar la precisión del conjunto seleccionado de componentes hipotéticos reconocidos de la infomación de destino por vía de intercambio de voz interactivos entre el operador del vehículo (10) y el centro de datos remoto (19) al reproducir un audio hablado de texto a voz generado por ordenador al operador del vehículo (10) para confirmación.
- 2. El método de la reivindicación 1, donde confirmar la precisión de los componentes hipotéticos reconocidos de la información de destino comprende:transmitir una representación generada por ordenador de al menos un componente hipotético reconocido de la información de destino al operador del vehículo (10) por vía del enlace inalámbrico (25);e indicar al operador del vehículo (10) por vía del enlace inalámbrico (25) a confirmar oralmente la precisión del componente de información de destino.
- 3. El método de la reivindicación 1, en donde confirmar la precisión de los componentes hipotéticos reconocidos de la información de destino comprende:transmitir (109) al menos un componente hipotético reconocido gravado de la información de destino pronunciada por el operador del vehículo (10) al operador del vehículo por vía del enlace inalámbrico (25); yindicar al operador del vehículo (10) por vía del enlace inalámbrico (25) a confirmar oralmente la precisión del componente hipotético reconocido de la información de destino por voz.
- 4. El método de la reivindicación 2, en donde confirmar la precisión de los componentes hipotéticos reconocidos al destino deseado comprende:determinar (106) si un nivel de confianza del componente hipotético reconocido está por encima de un umbral seleccionado; ygenerar por ordenador una representación del componente hipotético reconocido para transmisión al operador del vehículo (10) cuando el nivel de confianza está por encima del umbral seleccionado.
-
- 5.
- El método de la reivindicación 1, en donde determinar el destino desde los componentes confirmados comprende suministrar ayuda al operador humano del centro de datos utilizando la lista desarrollada de los componentes hipotéticos reconocidos y los niveles de confianza para reconocer el destino deseado.
-
- 6.
- El método de la reivindicación 1, en donde confirmar la precisión del conjunto seleccionado de componentes hipotéticos reconocidos del destino deseado por vía de intercambios de voz interactivos comprende transmitir representaciones orales de los componentes hipotéticos reconocidos de la información de destino al operador del vehículo (10), los componentes hipotéticos reconocidos de la información de destino seleccionados del grupo que consiste de representaciones orales del número de la dirección, nombre de la calle, ciudad, estado y punto de interés de destino.
-
- 7.
- El método de la reivindicación 5, en donde suministrar ayuda del operador del centro de datos comprende:
reproducir las representaciones gravadas de la información de destino pronunciada por el operador del vehículo (10) al operador del centro de datos (23) para análisis del operador del centro de datos (23); y recibir información del operador del centro de datos (23) que identifica el destino. -
- 8.
- El método de la reivindicación 7, en donde la información de recepción del operador del centro de datos (23) comprende:
ingresar una selección de la lista desplegada de los componentes hipotéticos del operador del centro de datos (23). -
- 9.
- El método de la reivindicación 1, en donde generar la información de ruta comprende generar (113) la informacipón de ruta de la información del sistema de posicionamiento global recibida por el centro de datos desde el sistema de procesamiento a bordo.
-
- 10.
- Un sistema para suministrar información de navegación a un operador de un vehículo (10) que comprende:
un sistema a bordo dispuesto en un vehículo para procesar y transmitir por vía de enlace inalámbrico (25) solicitudes habladas del operador del vehículo (10) para información de navegación a un destino seleccionado; yun centro de datos (19) para procesar las solicitudes habladas para la información de navegación recibida por vía del enlace inalámbrico (25) y operable paraefectuar (103) procesamiento de reconocimiento de voz automático sobre las solicitudes habladas para información de navegación para reconocer los componentes de destino de las solicitudes habladas; ybajar información de navegación al destino deseado para la transmisión al sistema a bordo derivado de los componentes de destino confirmado;el centro de datos (19) se caracteriza por que es operable para:generar en el centro de datos (19) una lista de componentes hipotéticos reconocidos de la información de destino listada por las calificaciones de confianza según se calculó para cada componente de la información de destino analizada en el procesamiento de reconocimiento de voz automatizado; desplegar la lista de los componentes hipotéticos reconocidos y las calificaciones de confianza en el centro de datos (19) para la revisión selectiva del operador del centro de datos humano (23); yconfirmar la precisión del conjunto de componentes hipotéticos reconocidos de la información de destino seleccionada con base en las calificaciones de confianza en la lista a través de intercambios de habla interactivos con el operador del vehículo (10) por vía del enlace inalámbrico (25) y un sistema a bordo al desplegar un audio del habla de texto a voz generado por ordenador al operador del vehículo (10) para confirmación. -
- 11.
- El sistema de la reivindicación 10, en donde el centro de datos (19) es operable además para bajar la información de navegación en respuesta a la información de posición recibida del sistema a bordo por vía del enlace inalámbrico (25).
-
- 12.
- El sistema de la reivindicación 10, en donde el centro de datos (19) es operable además para:
generar (104) una lista de posibles componentes de destino que correspondan a las solicitudes habladas; asignar(105) una calificación de confianza para cada uno de los posibles componentes de destino en la lista; determinar (106) si un componente de destino posible con una más alta calificación de confianza tiene una calificación de confianza por encima de un umbral; y una representación oral generada por ordenador del destino para la transmisión al sistema a bordo para confirmación del operador del vehículo 10 de si la calificación de confianza está por encima del umbral. - 13. El sistema de la reivindicación 10, en donde el centro de datos (19) es operable además para:determinar (106) que al menos un componente del destino de la solicitud pronunciada tiene un valor de confianza de reconocimiento por debajo de un umbral; y de reproducir (109) una grabación en la voz del propietario del vehículo(10) de al menos el componente con el valor de confianza de reconocimiento por debajo del umbral al propietario del vehículo (10) por vía del sistema a bordo para confirmación.
-
- 14.
- El sistema de la reivindicación 13, en donde el centro de datos (19) comprende además una instalación del operador del centro de datos para reproducir los componentes del destino para ayudar a identificar el destino deseado.
-
- 15.
- El sistema de la reivindicación 10, en donde una solicitud hablada seleccionada comprende una solicitud hablada de información del punto de interés.
-
- 16.
- El sistema de la reivindicación 10, en donde la información del punto de interés incluye la información seleccionada del grupo que consiste de los nombres y categorías.
-
- 17.
- El sistema de la reivindicación 10, en donde una solicitud hablada seleccionada comprende información de ubicación seleccionada del grupo que consiste de información que identifica el estado, ciudad, nombre de la calle, y número de dirección.
-
- 18.
- El sistema de la reivindicación 10, en donde el centro de datos (19) es operable además para gravar las solicitudes habladas como campos de onda de audio normalizados para reproducción posterior.
-
- 19.
- El sistema de la reivindicación 13, en donde el centro de datos (19) es operable además para representar la lista de posibles destinos listados por las calificaciones de confianza al operador del centro de datos (23) para selección como el destino deseado.
-
- 20.
- El sistema de la reivindicación 10, en donde el centro de datos, (19) es operable además para permitirle al operador del centro de datos (23) variar el orden de los componentes hipotéticos reconocidos de la información de destino en la lista.
OPERADOR DELVEH�?CULOPARLANTES RUTA DESUMINISTROENLACE INALÀMBRICOANTENAMICRÓFONOANTENAESTACIÓN DE OPERADOR UNIDAD DEMÓDULO DEEN VIVOENLACE ASCENDENTECONTROL DECOMUNICACIÓNTELECOMUNICACIONESTELEMÀTICAS INAL�?MBRICO ESTACIÓNCENTRO BASE DEDEOPERADORREDDATOS INAL�?MBRICA DE CENTRODE RESPUESTABASE DE DATOSUNIDAD DE RECONOCIMIENTO DE VOZSUSURRODESDE EL BLOQUENAVEGACIÓN ACTIVADA POR VOZEL OPERADOR DE VEH�?CULO INICIA COMUNICACIÓNEL OPERADOR DE VEH�?CULO PROPORCIONA COMANDOS HABLADOSEL CENTRO DE DATOS DEL SISTEMA DE RECONOCIMIENTO DE VOZ INTENTA INTERPRETACIÓNN-MEJOR LISTA DE HIPÓTESIS DE RECONOCIMIENTO GENERADASCALIFICACIÓN DE CONFIANZA ASIGNADA A CADA HIPÓTESIS DE RECONOCIMIENTOHASTA EL BLOQUESIREPRODUCE HABLADO GENERADO POR COMPUTADOR DE HIPÓTESIS AL OPERADOR DEL VEH�?CULOEL OPERADOR DE VEH�?CULO RESPONDE A INDICATIVOS DEL SISTEMA¿CONFIRMADO?SIHASTA ELBLOQUEDESDE EL BLOQUE¿TODAS LAS CALIFICACIONES DE CONFIANZA DE LOS COMPONENTES EST�?N POR ENCIMA DEL UMBRAL?HASTA EL BLOQUEREPRODUCE VOZ PARA COMPONENTES DE BAJA CONFIANZA PARA CONFIRMACIÓNEL OPERADOR DE VEH�?CULO RESPONDE A INDICATIVOS DEL SISTEMA¿CONFIRMADO?SIHASTA EL BLOQUE
Applications Claiming Priority (5)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| US60885004P | 2004-09-10 | 2004-09-10 | |
| US608850P | 2004-09-10 | ||
| US29971 | 2005-01-05 | ||
| US11/029,971 US7373248B2 (en) | 2004-09-10 | 2005-01-05 | Systems and methods for off-board voice-automated vehicle navigation |
| PCT/US2005/032552 WO2006031804A2 (en) | 2004-09-10 | 2005-09-09 | Systems and methods for off-board voice automated vehicle navigation |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| ES2379572T3 true ES2379572T3 (es) | 2012-04-27 |
Family
ID=36035201
Family Applications (3)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| ES12000136.7T Expired - Lifetime ES2454556T3 (es) | 2004-09-10 | 2005-09-09 | Sistemas y métodos para navegación automática de vehículo con voz, no incorporados |
| ES12000135.9T Expired - Lifetime ES2527263T3 (es) | 2004-09-10 | 2005-09-09 | Sistemas y métodos para navegación automática de vehículo con voz, no incorporados |
| ES05795145T Expired - Lifetime ES2379572T3 (es) | 2004-09-10 | 2005-09-09 | Sistemas y métodos para navegación automática de vehículo con voz, no incorporados |
Family Applications Before (2)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| ES12000136.7T Expired - Lifetime ES2454556T3 (es) | 2004-09-10 | 2005-09-09 | Sistemas y métodos para navegación automática de vehículo con voz, no incorporados |
| ES12000135.9T Expired - Lifetime ES2527263T3 (es) | 2004-09-10 | 2005-09-09 | Sistemas y métodos para navegación automática de vehículo con voz, no incorporados |
Country Status (6)
| Country | Link |
|---|---|
| US (5) | US7373248B2 (es) |
| EP (3) | EP2447926B1 (es) |
| AT (1) | ATE542112T1 (es) |
| CA (1) | CA2579620C (es) |
| ES (3) | ES2454556T3 (es) |
| WO (1) | WO2006031804A2 (es) |
Families Citing this family (70)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| DE10304229A1 (de) * | 2003-01-28 | 2004-08-05 | Deutsche Telekom Ag | Kommunikationssystem, Kommunikationsendeinrichtung und Vorrichtung zum Erkennen fehlerbehafteter Text-Nachrichten |
| US9224394B2 (en) * | 2009-03-24 | 2015-12-29 | Sirius Xm Connected Vehicle Services Inc | Service oriented speech recognition for in-vehicle automated interaction and in-vehicle user interfaces requiring minimal cognitive driver processing for same |
| US8825379B2 (en) * | 2005-01-05 | 2014-09-02 | Sirius Xm Connected Vehicle Services Inc. | Systems and methods for off-board voice-automated vehicle navigation |
| US20060129311A1 (en) * | 2004-12-09 | 2006-06-15 | Jason Bauman | Remote navigation server interface |
| DE102005019591A1 (de) * | 2005-04-27 | 2006-11-09 | Siemens Ag | Vorrichtung zum Navigieren eines Fahrzeugs und Server-System |
| US20070067095A1 (en) * | 2005-07-01 | 2007-03-22 | Honeywell International Inc. | Method and apparatus for resolving ambiguous waypoints |
| US7826945B2 (en) * | 2005-07-01 | 2010-11-02 | You Zhang | Automobile speech-recognition interface |
| US20070155367A1 (en) * | 2005-12-30 | 2007-07-05 | Telenav, Inc | Communication system with remote applications |
| US8510109B2 (en) | 2007-08-22 | 2013-08-13 | Canyon Ip Holdings Llc | Continuous speech transcription performance indication |
| US20080097688A1 (en) * | 2006-06-27 | 2008-04-24 | Microsoft Corporation | Route generation based upon activity criteria |
| US8793066B2 (en) | 2006-06-27 | 2014-07-29 | Microsoft Corporation | Route monetization |
| US7610151B2 (en) | 2006-06-27 | 2009-10-27 | Microsoft Corporation | Collaborative route planning for generating personalized and context-sensitive routing recommendations |
| JP2010515893A (ja) * | 2007-01-10 | 2010-05-13 | トムトム インターナショナル ベスローテン フエンノートシャップ | ナビゲーション装置及び運転の休息警告方法 |
| AU2007343335A1 (en) * | 2007-01-10 | 2008-07-17 | Tomtom International B.V. | Method of indicating traffic delays, computer program and navigation system therefor |
| US9973450B2 (en) | 2007-09-17 | 2018-05-15 | Amazon Technologies, Inc. | Methods and systems for dynamically updating web service profile information by parsing transcribed message strings |
| JP4225356B2 (ja) * | 2007-04-09 | 2009-02-18 | トヨタ自動車株式会社 | 車両用ナビゲーション装置 |
| US9595008B1 (en) | 2007-11-19 | 2017-03-14 | Timothy P. Heikell | Systems, methods, apparatus for evaluating status of computing device user |
| US8060297B2 (en) * | 2007-12-14 | 2011-11-15 | Microsoft Corporation | Route transfer between devices |
| US8473198B2 (en) * | 2007-12-14 | 2013-06-25 | Microsoft Corporation | Additional content based on intended travel destination |
| US20090157312A1 (en) * | 2007-12-14 | 2009-06-18 | Microsoft Corporation | Social network based routes |
| US8428859B2 (en) | 2007-12-14 | 2013-04-23 | Microsoft Corporation | Federated route production |
| US8090532B2 (en) * | 2007-12-14 | 2012-01-03 | Microsoft Corporation | Pedestrian route production |
| US20090157499A1 (en) * | 2007-12-14 | 2009-06-18 | Microsoft Corporation | Automatic splices for targeted advertisements |
| US8626152B2 (en) | 2008-01-31 | 2014-01-07 | Agero Connected Sevices, Inc. | Flexible telematics system and method for providing telematics to a vehicle |
| US8793065B2 (en) * | 2008-02-19 | 2014-07-29 | Microsoft Corporation | Route-based activity planner |
| US20090210276A1 (en) * | 2008-02-19 | 2009-08-20 | Microsoft Corporation | Ad hoc and opportunistic transportation services |
| DE102008028090A1 (de) * | 2008-02-29 | 2009-09-10 | Navigon Ag | Verfahren zum Betrieb eines Navigationssystems |
| EP2096412A3 (de) | 2008-02-29 | 2009-12-02 | Navigon AG | Verfahren zum Betrieb eines Navigationssystems |
| US8255224B2 (en) | 2008-03-07 | 2012-08-28 | Google Inc. | Voice recognition grammar selection based on context |
| US8676577B2 (en) * | 2008-03-31 | 2014-03-18 | Canyon IP Holdings, LLC | Use of metadata to post process speech recognition output |
| GB201016385D0 (en) * | 2010-09-29 | 2010-11-10 | Touchtype Ltd | System and method for inputting text into electronic devices |
| EP2259252B1 (en) * | 2009-06-02 | 2012-08-01 | Nuance Communications, Inc. | Speech recognition method for selecting a combination of list elements via a speech input |
| US9653066B2 (en) * | 2009-10-23 | 2017-05-16 | Nuance Communications, Inc. | System and method for estimating the reliability of alternate speech recognition hypotheses in real time |
| US20120253822A1 (en) * | 2009-12-11 | 2012-10-04 | Thomas Barton Schalk | Systems and Methods for Managing Prompts for a Connected Vehicle |
| US8489331B2 (en) | 2010-04-29 | 2013-07-16 | Microsoft Corporation | Destination maps user interface |
| US20110307250A1 (en) * | 2010-06-10 | 2011-12-15 | Gm Global Technology Operations, Inc. | Modular Speech Recognition Architecture |
| WO2011163538A1 (en) | 2010-06-24 | 2011-12-29 | Honda Motor Co., Ltd. | Communication system and method between an on-vehicle voice recognition system and an off-vehicle voice recognition system |
| GB201200643D0 (en) | 2012-01-16 | 2012-02-29 | Touchtype Ltd | System and method for inputting text |
| KR101283210B1 (ko) * | 2010-11-09 | 2013-07-05 | 기아자동차주식회사 | 카오디오 장치를 이용한 주행 경로 안내 시스템 및 그 카오디오 장치, 이를 이용한 경로 안내 방법 |
| US8406938B2 (en) * | 2011-05-19 | 2013-03-26 | Ford Global Technologies, Llc | Remote operator assistance for one or more user commands in a vehicle |
| US9087455B2 (en) * | 2011-08-11 | 2015-07-21 | Yahoo! Inc. | Method and system for providing map interactivity for a visually-impaired user |
| CN103460281B (zh) * | 2011-10-25 | 2015-12-23 | 奥林巴斯株式会社 | 内窥镜手术系统 |
| CN102435202B (zh) * | 2011-12-01 | 2015-03-11 | 广西卫通汽车信息技术有限公司 | 云端语音导航的方法和装置 |
| US8521539B1 (en) * | 2012-03-26 | 2013-08-27 | Nuance Communications, Inc. | Method for chinese point-of-interest search |
| US8744771B2 (en) * | 2012-03-26 | 2014-06-03 | Navteq B.V. | Reverse natural guidance |
| US9378752B2 (en) * | 2012-09-05 | 2016-06-28 | Honda Motor Co., Ltd. | Sound processing device, sound processing method, and sound processing program |
| US10567471B2 (en) * | 2012-10-26 | 2020-02-18 | Sirius Xm Radio Inc. | Systems and methods for cost effective distribution of files to user devices using combination of broadcast and two-way communication paths |
| US9704486B2 (en) * | 2012-12-11 | 2017-07-11 | Amazon Technologies, Inc. | Speech recognition power management |
| US9190057B2 (en) * | 2012-12-12 | 2015-11-17 | Amazon Technologies, Inc. | Speech model retrieval in distributed speech recognition systems |
| US9911408B2 (en) * | 2014-03-03 | 2018-03-06 | General Motors Llc | Dynamic speech system tuning |
| KR102319530B1 (ko) | 2014-08-18 | 2021-10-29 | 삼성전자주식회사 | 사용자 입력 처리 방법 및 장치 |
| CN105467987A (zh) * | 2014-09-11 | 2016-04-06 | 苗码信息科技(上海)股份有限公司 | 汉语文本远程自动导航并驾驶的汽车系统 |
| CN105466436A (zh) * | 2014-09-11 | 2016-04-06 | 苗码信息科技(上海)股份有限公司 | 外语自然语文本现场自动导航并驾驶的汽车系统 |
| CN105467989A (zh) * | 2014-09-11 | 2016-04-06 | 苗码信息科技(上海)股份有限公司 | 汉语文本现场自动导航并驾驶的汽车系统 |
| CN105425786A (zh) * | 2014-09-11 | 2016-03-23 | 苗码信息科技(上海)股份有限公司 | 外语自然语文本远程自动导航并驾驶的汽车系统 |
| CN105404293A (zh) * | 2014-09-11 | 2016-03-16 | 苗码信息科技(上海)股份有限公司 | 汉语语音现场自动导航并驾驶的汽车系统 |
| DE102015205044A1 (de) | 2015-03-20 | 2016-09-22 | Bayerische Motoren Werke Aktiengesellschaft | Eingabe von Navigationszieldaten in ein Navigationssystem |
| JP6621613B2 (ja) | 2015-08-10 | 2019-12-18 | クラリオン株式会社 | 音声操作システム、サーバー装置、車載機器および音声操作方法 |
| US20170047062A1 (en) * | 2015-08-14 | 2017-02-16 | Panasonic Automotive Systems Company Of America, Division Of Panasonic Corporation Of North America | Business name phonetic optimization method |
| US9683862B2 (en) | 2015-08-24 | 2017-06-20 | International Business Machines Corporation | Internationalization during navigation |
| US10006777B2 (en) * | 2015-10-02 | 2018-06-26 | GM Global Technology Operations LLC | Recognizing address and point of interest speech received at a vehicle |
| US10157616B2 (en) * | 2016-12-19 | 2018-12-18 | Honeywell International Inc. | Methods and apparatus for post-processing speech recognition results of received radio voice messages onboard an aircraft |
| CN207124650U (zh) * | 2017-05-19 | 2018-03-20 | 杭州青奇科技有限公司 | 一种共享交通工具的铃声下载播放系统 |
| DE102017216513A1 (de) | 2017-09-19 | 2018-09-27 | Audi Ag | Verfahren zum Verarbeiten einer Spracheingabe, über welche ein Benutzer eine Ortsangabe an einem Bedienterminal vorgibt, sowie Bedienvorrichtung und Kraftfahrzeug |
| CN108307069B (zh) * | 2018-01-29 | 2020-08-07 | Oppo广东移动通信有限公司 | 导航运行方法、导航运行装置及移动终端 |
| CN109035914B (zh) * | 2018-08-20 | 2020-12-25 | 广东小天才科技有限公司 | 一种基于智能台灯的学习方法及智能台灯 |
| CN109410935A (zh) * | 2018-11-01 | 2019-03-01 | 平安科技(深圳)有限公司 | 一种基于语音识别的目的地搜索方法及装置 |
| US20220012420A1 (en) * | 2020-07-08 | 2022-01-13 | NameCoach, Inc. | Process, system, and method for collecting, predicting, and instructing the pronunciaiton of words |
| CN113312070B (zh) * | 2021-06-03 | 2023-02-24 | 海信集团控股股份有限公司 | 车载应用的应用名称更新方法及车辆 |
| US12525234B2 (en) * | 2023-09-18 | 2026-01-13 | Qualcomm Incorporated | Low power always-on listening artificial intelligence (AI) system |
Family Cites Families (14)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| FR2761837B1 (fr) * | 1997-04-08 | 1999-06-11 | Sophie Sommelet | Dispositif d'aide a la navigation ayant une architecture distribuee basee sur internet |
| JP4085500B2 (ja) * | 1999-01-29 | 2008-05-14 | 株式会社エクォス・リサーチ | 車両状況把握装置、エージェント装置、および、車両制御装置 |
| JP3749821B2 (ja) * | 1999-09-30 | 2006-03-01 | 株式会社東芝 | 歩行者用道案内システムおよび歩行者用道案内方法 |
| US6405123B1 (en) * | 1999-12-21 | 2002-06-11 | Televigation, Inc. | Method and system for an efficient operating environment in a real-time navigation system |
| SE518173C2 (sv) * | 2000-12-14 | 2002-09-03 | Telia Ab | Talstyrd telefonitjänst för att ge positionsrelaterad information för ett geografiskt objekt |
| US6789065B2 (en) * | 2001-01-24 | 2004-09-07 | Bevocal, Inc | System, method and computer program product for point-to-point voice-enabled driving directions |
| US6691026B2 (en) * | 2001-03-29 | 2004-02-10 | Intellisist, Llc | Vehicle navigation system and method |
| JP2002318132A (ja) | 2001-04-23 | 2002-10-31 | Hitachi Ltd | 音声対話型ナビゲーションシステムおよび移動端末装置および音声対話サーバ |
| FR2827695A1 (fr) * | 2001-07-23 | 2003-01-24 | France Telecom | Portail de services de telecommunications comprenant un serveur avec reconnaissance vocale et equipement de navigation et de guidage utilisant ledit portail |
| US6721633B2 (en) * | 2001-09-28 | 2004-04-13 | Robert Bosch Gmbh | Method and device for interfacing a driver information system using a voice portal server |
| KR20020060048A (ko) | 2001-11-02 | 2002-07-16 | 윤종용 | 지능형교통시스템 단말기가 이동통신단말기를 이용하여사용자에게 네비게이션 정보를 안내하는 방법 |
| EP1408303B1 (en) * | 2002-03-15 | 2011-12-21 | Mitsubishi Denki Kabushiki Kaisha | Vehicular navigation device |
| US6691028B2 (en) * | 2002-06-07 | 2004-02-10 | Motorola, Inc. | Server-based navigation system and method of operating same |
| JP4019904B2 (ja) * | 2002-11-13 | 2007-12-12 | 日産自動車株式会社 | ナビゲーション装置 |
-
2005
- 2005-01-05 US US11/029,971 patent/US7373248B2/en not_active Expired - Lifetime
- 2005-09-09 EP EP12000136.7A patent/EP2447926B1/en not_active Expired - Lifetime
- 2005-09-09 ES ES12000136.7T patent/ES2454556T3/es not_active Expired - Lifetime
- 2005-09-09 ES ES12000135.9T patent/ES2527263T3/es not_active Expired - Lifetime
- 2005-09-09 ES ES05795145T patent/ES2379572T3/es not_active Expired - Lifetime
- 2005-09-09 WO PCT/US2005/032552 patent/WO2006031804A2/en not_active Ceased
- 2005-09-09 AT AT05795145T patent/ATE542112T1/de active
- 2005-09-09 EP EP05795145A patent/EP1792140B1/en not_active Expired - Lifetime
- 2005-09-09 CA CA2579620A patent/CA2579620C/en not_active Expired - Lifetime
- 2005-09-09 EP EP12000135.9A patent/EP2450867B1/en not_active Expired - Lifetime
-
2008
- 2008-03-28 US US12/057,984 patent/US7634357B2/en not_active Expired - Lifetime
-
2009
- 2009-12-11 US US12/636,327 patent/US8478520B2/en not_active Expired - Lifetime
-
2013
- 2013-03-15 US US13/834,788 patent/US8700259B2/en not_active Expired - Lifetime
- 2013-06-03 US US13/908,421 patent/US8738287B2/en not_active Expired - Lifetime
Also Published As
| Publication number | Publication date |
|---|---|
| EP2450867A8 (en) | 2012-07-11 |
| ES2454556T3 (es) | 2014-04-10 |
| EP2447926A1 (en) | 2012-05-02 |
| US20130204627A1 (en) | 2013-08-08 |
| US7373248B2 (en) | 2008-05-13 |
| EP1792140B1 (en) | 2012-01-18 |
| WO2006031804A2 (en) | 2006-03-23 |
| US8478520B2 (en) | 2013-07-02 |
| ES2527263T3 (es) | 2015-01-22 |
| US20100185392A1 (en) | 2010-07-22 |
| ATE542112T1 (de) | 2012-02-15 |
| US7634357B2 (en) | 2009-12-15 |
| CA2579620C (en) | 2014-07-08 |
| EP1792140A2 (en) | 2007-06-06 |
| EP2450867A1 (en) | 2012-05-09 |
| EP2447926B1 (en) | 2013-12-25 |
| US8700259B2 (en) | 2014-04-15 |
| EP2450867B1 (en) | 2014-11-12 |
| US20080177551A1 (en) | 2008-07-24 |
| US20130262102A1 (en) | 2013-10-03 |
| EP1792140A4 (en) | 2009-12-23 |
| CA2579620A1 (en) | 2006-03-23 |
| US8738287B2 (en) | 2014-05-27 |
| WO2006031804A3 (en) | 2007-05-03 |
| US20060058947A1 (en) | 2006-03-16 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| ES2454556T3 (es) | Sistemas y métodos para navegación automática de vehículo con voz, no incorporados | |
| US8694244B2 (en) | Systems and methods for off-board voice-automated vehicle navigation | |
| US8364402B2 (en) | Methods and systems for testing navigation routes | |
| US6691028B2 (en) | Server-based navigation system and method of operating same | |
| ES2359627T3 (es) | Método y dispositivo para la comunicación por interfaz de un sistema de información para conductores que utiliza un servidor de portales de voz. | |
| US20090070034A1 (en) | Method for recording an annotation and making it available for later playback | |
| JP2010515890A (ja) | ナビゲーション装置、音声認識モードを有するナビゲーション装置を動作させる方法及びプログラム | |
| US20090030602A1 (en) | System and method for reducing the amount of repetitive data sent by a server to a client for vehicle navigation | |
| US20120253822A1 (en) | Systems and Methods for Managing Prompts for a Connected Vehicle | |
| CN101641569A (zh) | 导航装置、操作包含音频辨识模式的所述导航装置的方法和计算机程序 | |
| JPH1054730A (ja) | 車両を目的地へ案内する方法および装置 | |
| KR100456187B1 (ko) | 데이터통신망을 매개한 주행정보제공시스템 및 그 제공방법 | |
| WO2023163047A1 (ja) | 端末装置、情報提供システム、情報処理方法、プログラム及び記憶媒体 |