TW201837896A - 語音的功能控制方法和裝置 - Google Patents
語音的功能控制方法和裝置 Download PDFInfo
- Publication number
- TW201837896A TW201837896A TW106139676A TW106139676A TW201837896A TW 201837896 A TW201837896 A TW 201837896A TW 106139676 A TW106139676 A TW 106139676A TW 106139676 A TW106139676 A TW 106139676A TW 201837896 A TW201837896 A TW 201837896A
- Authority
- TW
- Taiwan
- Prior art keywords
- user
- application
- function
- voice
- recognition result
- Prior art date
Links
Classifications
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F3/00—Input arrangements for transferring data to be processed into a form capable of being handled by the computer; Output arrangements for transferring data from processing unit to output unit, e.g. interface arrangements
- G06F3/16—Sound input; Sound output
- G06F3/167—Audio in a user interface, e.g. using voice commands for navigating, audio feedback
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/08—Speech classification or search
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/26—Speech to text systems
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/28—Constructional details of speech recognition systems
- G10L15/32—Multiple recognisers used in sequence or in parallel; Score combination systems therefor, e.g. voting systems
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/08—Speech classification or search
- G10L2015/088—Word spotting
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/223—Execution procedure of a spoken command
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/226—Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics
- G10L2015/228—Procedures used during a speech recognition process, e.g. man-machine dialogue using non-speech characteristics of application context
Landscapes
- Engineering & Computer Science (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Physics & Mathematics (AREA)
- Multimedia (AREA)
- Computational Linguistics (AREA)
- Acoustics & Sound (AREA)
- Theoretical Computer Science (AREA)
- General Health & Medical Sciences (AREA)
- General Physics & Mathematics (AREA)
- General Engineering & Computer Science (AREA)
- User Interface Of Digital Computer (AREA)
- Telephone Function (AREA)
- Stored Programmes (AREA)
- Machine Translation (AREA)
- Management, Administration, Business Operations System, And Electronic Commerce (AREA)
Abstract
本發明提供一種語音的功能控制方法,應用在終端的語音助理上,包括:根據對使用者輸入語音的識別結果,確定關聯應用程式;所述關聯應用程式用來實現使用者要使用的功能;將使用者的輸入語音傳遞給所述關聯應用程式,供所述關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行所述功能的實現。透過本發明的技術方案,能夠更為準確和快速的完成使用者需要的功能,提高語音功能控制的效率。
Description
本發明涉及網路通訊技術領域,尤其涉及一種語音的功能控制方法和裝置。
語音助理是運行在終端上的一種軟體,能夠和使用者進行語音交流,以及協助使用者實現其指定的各項功能,如進行資訊搜索、終端操作等。自從蘋果推出其語音助理Siri以後,使用者對語音助理類的軟體的關注程度和使用率有了極大的提高,也給語音助理的發展帶來了動力。 目前語音助理能夠與安裝在終端上的應用程式相結合,使用者向語音助理發出執行某項任務的指令,由語音助理調用相應的應用程式來完成該項任務,從而極大的豐富了使用者能夠以語音助理為單一入口來完成的功能。 現有技術中,以Siri為例,Siri可以與六類應用程式(叫車、通訊、照片搜索、支付、網路電話、健身)協作,當Siri接收到使用者的語音輸入時,判斷使用者的意圖,並決定是由自己處理還是調用應用程式處理。如果決定調用應用程式,Siri從自己對使用者語音的識別結果中提取相關資訊交給應用程式。應用程式按照Siri提供的資訊,執行該資訊指定的功能。 可見,Siri提供的資訊是使用者指定的任務是否能被正確完成的基礎。當Siri識別出的輸入語音不夠準確時,使用者透過語音進行的功能控制就難以達到令人滿意的水平。
有鑑於此,本發明提供一種語音的功能控制方法,應用在終端的語音助理上,包括: 根據對使用者輸入語音的識別結果,確定關聯應用程式;所述關聯應用程式用來實現使用者要使用的功能; 將使用者的輸入語音傳遞給所述關聯應用程式,供所述關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行所述功能的實現。 本發明提供的一種語音的功能控制方法,應用在用來實現除語音助理外其他功能的終端應用程式上,包括: 接收來自語音助理的使用者的輸入語音; 識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現。 本發明還提供了一種語音的功能控制裝置,應用在終端的語音助理上,包括: 關聯應用程式單元,用於根據對使用者輸入語音的識別結果,確定關聯應用程式;所述關聯應用程式用來實現使用者要使用的功能; 輸入語音傳遞單元,用於將使用者的輸入語音傳遞給所述關聯應用程式,供所述關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行所述功能的實現。 本發明提供的一種語音的功能控制裝置,應用在用來實現除語音助理外其他功能的終端應用程式上,包括: 輸入語音接收單元,用於接收來自語音助理的使用者的輸入語音; 功能實現單元,用於識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現。 由以上技術方案可見,本發明的實施例中,在語音助理根據對使用者輸入語音的識別結果確定關聯應用程式後,將使用者的輸入語音傳遞給關聯應用程式,由關聯應用程式自行識別輸入語音後執行使用者的指令;由於關聯應用程式都有其專屬的應用領域,比如高德地圖是地圖及導航領域,因此在其所屬的功能類型的語音識別準確度在絕大多數情況下高於通用於所有功能類型的語音助理的準確度,從而能夠更為準確和快速的完成使用者需要的功能,提高語音功能控制的效率。
現有技術中,終端上安裝的很多非語音助理類的應用程式本身也具有接收使用者語音輸入,識別出並執行使用者的語音指令,實現使用者要使用功能的能力。簡便起見,以下將語音助理類的應用程式稱為語音助理,將非語音助理類、用來實現除語音助理外的其他功能的應用程式稱為應用程式。 語音助理的設計初衷是作為與使用者進行語音互動的統一入口,除了識別使用者可能涉及所有功能類型的指令,還要陪使用者聊天,因此語音助理詞庫的詞彙範圍極其廣泛,並且其語音識別演算法的優化也必須兼顧所有類型詞彙的識別率。而應用程式往往專注於幾項主要功能的實現,如地圖類型應用程式專注於尋址、定位和導航,購物類型的應用程式專注於商品和交易等等,使用者在採用這些應用程式時,意圖基本確定是要使用應用程式專注的功能。因此應用程式中用於語音識別的詞庫的詞彙範圍同樣集中在其專注的功能領域,語音識別演算法的優化也是如此。 從發出語音指令後到等待終端給出響應的等待時間長度會極大的影響使用者體驗,因而可供進行語音識別的時間非常有限。在有限的時間內,在任何一個特定的功能領域,語音助理對使用者意圖使用該領域某個功能的輸入語音的識別,在準確度上很難趕上屬於該功能領域的應用程式進行的識別。 比如在地點名稱上,高德地圖的詞庫比Siri的詞庫更為全面準確;同時,由於有長期的關於地點方面的搜索的積累,高德地圖的識別演算法在識別地名上也比Siri更為精准,Siri在導航這個應用場景中沒有更為可靠的地名、位置等資料作為參考,來優化其識別演算法。 可見,現有技術中由語音助理將識別結果傳遞給應用程式的做法,實際上是由不擅長某個工作的一方來完成工作,將不準確的工作結果交給擅長該工作的另一方,另一方不得不以較差的工作結果為基礎來執行任務,自然難以達到好的結果。 基於上述思路,本發明的實施例提出一種新的語音功能控制方法,由語音助理透過對使用者輸入語音的識別,確定實現使用者意圖的關聯應用程式,再將輸入語音傳遞給關聯應用程式,由關聯應用程式自行識別語音後實現使用者要使用的功能,使得應用程式基於原始的輸入語音執行使用者指令,可以以自行識別的結果而不必以語音助理不理想的識別結果為基礎來執行,從而能夠更為準確和快速的完成使用者需要的功能,以解決現有技術中存在的問題。 本發明的實施例中,語音助理和應用程式都運行在使用者的終端上。語音助理可以運行在終端的操作系統層面,也可以是作為操作系統上層的應用來運行,不做限定。使用者的終端可以是任何具有語音輸入、計算和儲存功能的設備,如手機、平板電腦、PC(Personal Computer,個人電腦)、筆記型電腦、伺服器等,同樣不做限定。 本發明實施例中,語音的功能控制方法應用在語音助理中的流程如圖1所示,應用在應用程式中的流程如圖2所示。 在語音助理上,步驟110,根據對使用者輸入語音的識別結果,確定關聯應用程式。關聯應用程式用來實現使用者要使用的功能。 當語音助理接收到使用者的語音輸入後,識別使用者的語音,如果使用者的指令不涉及對哪個功能的使用、或者使用者要使用的功能由語音助理來執行,則語音助理依據識別結果回復使用者的輸入,或者執行使用者的指令。如果語音助理的識別結果是使用者要使用某種由應用程式來執行的功能,則語音助理確定實現該功能的關聯應用程式。 使用者可能在輸入語音中指定想使用的應用程式。在這種情形下,語音助理可以從對使用者輸入語音的識別結果中提取出應用程式名稱,將該應用程式(即使用者在輸入語音中指定的應用程式)作為關聯應用程式。例如,使用者對語音助理說,“用滴滴幫我叫車回家”,語音助理識別出應用程式名稱“滴滴”,則將應用程式滴滴作為關聯應用程式。 如果使用者沒有在輸入語音中指定想使用的應用程式,語音助理可以根據對使用者輸入語音的識別結果,確定使用者要使用的功能,再按照使用者要使用的功能在終端上安裝的應用程式中確定關聯應用程式。語音助理從識別結果中確定使用者要使用的功能的方法可以參照各種現有技術實現,例如,可以預置各個功能的若干個關鍵詞,如果對使用者語音的識別結果命中了某個功能關鍵詞,則可獲知使用者想要使用的功能是哪一個。 由使用者要使用的功能確定關聯應用程式的方式可以根據實際應用場景的需要來決定,以下以兩個實現方式為例進行說明。 在第一個實現方式中,語音助理在識別出使用者要使用的功能後,可以將終端上安裝的應用程式中,能夠實現使用者要使用的功能、並且支持語音輸入的一個到多個應用程式作為備選應用程式,將備選應用程式的名稱顯示給使用者,供使用者選擇。在收到使用者的選擇結果後,語音助理將使用者選定的應用程式作為關聯應用程式。 在第二個實現方式中,可以在終端上維護要使用的功能與應用程式的映射關係。在識別出使用者要使用的功能後,語音助理可以將與使用者要使用的功能具有映射關係的應用程式作為關聯應用程式。在前述以功能關鍵詞來反映使用者要使用的功能的例子中,可以在終端上保存一張功能關鍵詞與應用程式的映射關係表,語音助理從對使用者輸入語音的識別結果中提取出功能關鍵詞後,即可將與該功能關鍵詞具有映射關係的應用程式作為關聯應用程式。 在第二個實現方式中,要使用的功能與應用程式的映射關係可以由使用者設置和/或修改,也可以由語音助理或操作系統產生,還可以同時應用這些方式,本發明的實施例不做限定。一個例子中,使用者可以在語音助理或操作系統提供的設置項中設置語音輸入時,要使用的功能和關聯應用程式的映射關係(一個到多個功能對應於一個應用程式)。另一個例子中,可以把要實現某個功能時,使用者最頻繁採用的應用程式作為與該功能有映射關係的應用程式;具體而言,如果安裝在終端上的實現某功能的應用程式只有一個,則將該應用程式作為與該功能有映射關係的應用程式;如果超過一個,則可以按照操作系統統計的使用者使用每個實現該功能的應用程式的頻率,將頻率最高的一個作為與該功能有映射關係的應用程式。第三個例子中,使用者還可以在實現某個功能的應用程式中,將該應用程式設置為語音輸入時、與該功能有映射關係的應用程式,應用程式在收到使用者的設置指令後,向語音助理提交本應用程式與要使用功能的映射關係;如使用者在高德地圖中設置語音輸入時、與功能關鍵詞“導航”具有映射關係,高德地圖按照使用者的操作將該設置項提交給Siri,Siri將這一映射關係保存起來,後續使用者語音輸入“導航去哪裡”時,Siri將按照映射關係,以高德地圖作為關聯應用程式。 需要說明的是,上述兩個確定關聯應用程式的方式也可以結合應用。例如,當語音助理確定使用者要使用的功能後,查詢保存的功能與應用程式的映射關係,如果能查到與要使用的功能有映射關係的應用程式,則按照映射關係來確定關聯應用程式;如果查不到,則將終端上能夠實現要使用的功能、並且支持語音輸入的應用程式給使用者選擇,並且按照使用者選擇確定關聯應用程式。在使用者選擇後可以請使用者設置該功能的預設關聯應用程式,如果使用者進行設置,則保存該功能與使用者設置的應用程式的映射關係;如果沒有進行設置,語音助理也可以在使用者選擇一個應用程式實現某個功能的次數和頻率都超過設定閾值後,保存該應用程式與該功能的映射關係。例如,Siri維護的功能與應用程式的映射關係表中不包括“導航”這一功能的映射關係,在5次使用者給出語音指令“導航去哪裡”後,Siri將終端上安裝的高德地圖、百度地圖和搜狗地圖的應用程式名稱顯示給使用者,由使用者選擇要使用哪個應用程式導航;如果使用者有4次選擇了高德地圖,則Siri將“導航”這一功能與高德地圖的映射關係保存至該映射關係表中;之後使用者給出導航的語音指令時,Siri將直接以高德地圖作為關聯應用程式。 在語音助理上,步驟120,將使用者的輸入語音傳遞給關聯應用程式,供關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行該功能的實現。 在關聯應用程式上,步驟210,接收來自語音助理的使用者的輸入語音。 語音助理在確定執行使用者要使用功能的關聯應用程式後,打開關聯應用程式(包括啟動該關聯應用程式、將該關聯應用程式置於前臺運行等),將使用者的輸入語音傳遞給關聯應用程式。 在關聯應用程式上,步驟220,識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現。 關聯應用程式自行識別來自語音助理的使用者的輸入語音,按照識別結果,運行關聯應用程式的業務處理邏輯,來實現使用者要使用的功能。關聯應用程式可以按照現有技術來進行語音識別和功能實現,不再贅述。 在一個例子中,語音助理可以將自己對使用者輸入語音的識別結果和使用者的輸入語音一併傳遞給關聯應用程式。關聯應用程式自行識別使用者的輸入語音,根據關聯應用程式自己的識別結果和來自語音助理的識別結果,來實現使用者要使用功能的實現。語音助理的識別結果可以作為供關聯應用程式在語音識別時的參考,進一步增加識別的準確程度。 可見,本發明的實施例中,語音助理透過對使用者輸入語音的識別,確定實現使用者要使用功能的關聯應用程式,並將輸入語音傳遞給關聯應用程式,由關聯應用程式自行識別輸入語音後執行使用者的指令,從而能夠利用應用程式其在所屬功能類型更為準確的語音識別結果,更為準確和快速的完成使用者需要的功能,提高語音功能控制的效率。 在本發明的一個應用示例中,使用者的蘋果終端上安裝有語音助理Siri和若干個能夠完成各種類型功能的應用程式。Siri中保存有功能關鍵詞和應用程式的映射關係表。一種映射關係表的示例如表1:本應用示例的工作原理如圖3所示,在收到使用者的輸入語音後,Siri對輸入語音進行識別,假設使用者要使用的功能需要借助於其他應用程式來實現,Siri從識別結果中提取描述使用者要使用功能的功能關鍵詞,用功能關鍵詞查找映射關係表。如果找到對應於該功能關鍵詞的應用程式,則以該應用程式為關聯應用程式。如果沒有在表中找到該功能關鍵詞,Siri將終端上安裝的所有能夠實現該功能、並且支持語音輸入的應用程式名稱顯示給使用者,請使用者選擇想用哪個應用程式。Siri將使用者選定的應用程式作為關聯應用程式。 Siri將關聯應用程式置於前臺運行,並把使用者的輸入語音透過操作系統傳輸給關聯應用程式。關聯應用程式識別使用者的輸入語音,按照自己的識別結果和業務流程來完成使用者指令的任務。 例如,使用者對Siri說,“轉帳2000給張三”。Siri識別出功能關鍵詞“轉帳”,從表1查詢到關聯應用程式為支付寶。Siri打開支付寶,將使用者的輸入語音傳遞給支付寶。支付寶識別輸入語音,啟動轉帳業務流程,向使用者顯示“收款方:張三”、“轉帳金額:2000”等內容,在使用者輸入密碼或驗證指紋後即可完成轉帳。 與上述流程實現對應,本發明的實施例還提供了一種應用在終端語音助理上的語音的功能控制裝置,和一種應用在終端應用程式上的語音的功能控制裝置。這兩種裝置均可以透過軟體實現,也可以透過硬體或者軟硬體結合的方式實現。以軟體實現為例,作為邏輯意義上的裝置,是透過終端的CPU(Central Process Unit,中央處理器)將對應的電腦程式指令讀取到內存中運行形成的。從硬體層面而言,除了圖4所示的CPU、內存以及非易失性記憶體之外,語音的功能控制裝置所在的終端通常還包括用於進行無線信號收發的晶片等其他硬體,和/或用於實現網路通訊功能的板卡等其他硬體。 圖5所示為本發明實施例提供的一種語音的功能控制裝置,應用在終端的語音助理上,包括關聯應用程式單元和輸入語音傳遞單元,其中:關聯應用程式單元用於根據對使用者輸入語音的識別結果,確定關聯應用程式;所述關聯應用程式用來實現使用者要使用的功能;輸入語音傳遞單元用於將使用者的輸入語音傳遞給所述關聯應用程式,供所述關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行所述功能的實現。 一個例子中,所述終端上維護有要使用的功能與應用程式的映射關係;所述關聯應用程式單元具體用於:根據對使用者輸入語音的識別結果,確定使用者要使用的功能,將與使用者要使用的功能具有映射關係的應用程式作為關聯應用程式。 上述例子中,所述要使用的功能與應用程式的映射關係,包括:功能關鍵詞與應用程式的映射關係;所述關聯應用程式單元具體用於:提取對使用者輸入語音的識別結果中的功能關鍵詞,將與所述功能關鍵詞具有映射關係的應用程式作為關聯應用程式。 上述例子中,所述要使用的功能與應用程式的映射關係,包括:由使用者設置的要使用的功能與應用程式的映射關係;和/或,以實現所述要使用的功能時,使用者最頻繁採用的應用程式作為與所述要使用的功能具有映射關係的應用程式;和/或,由某個應用程式提交的、所述應用程式與要使用功能的映射關係。 可選的,所述關聯應用程式單元具體用於:根據對使用者輸入語音的識別結果,確定使用者要使用的功能,將所述終端上能夠實現所述功能、並且支持語音輸入的若干個應用程式名稱顯示給使用者供其選擇,將使用者選定的應用程式作為關聯應用程式。 可選的,所述關聯應用程式單元具體用於:提取對使用者輸入語音的識別結果中的應用程式名稱,將輸入語音中指定的應用程式作為關聯應用程式。 可選的,所述輸入語音傳遞單元具體用於:將所述識別結果和使用者的輸入語音傳遞給所述關聯應用程式,供所述關聯應用程式對使用者的輸入語音進行識別,並根據關聯應用程式的識別結果和語音助理的識別結果進行所述功能的實現。 圖6所示為本發明實施例提供的一種語音的功能控制裝置,應用在用來實現除語音助理外其他功能的終端應用程式上,包括輸入語音接收單元和功能實現單元,其中:輸入語音接收單元用於接收來自語音助理的使用者的輸入語音;功能實現單元用於識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現。 可選的,所述輸入語音接收單元具體用於:接收來自語音助理的使用者的輸入語音,以及語音助理對所述輸入語音的識別結果;所述功能實現單元具體用於:識別使用者的輸入語音,根據自己的識別結果和來自語音助理的識別結果,進行使用者要使用功能的實現。 一個例子中,所述裝置還包括:映射關係提交單元,用於根據使用者的指令,向語音助理提交本應用程式與要使用功能的映射關係。 上述例子中,所述本應用程式與要使用功能的映射關係,包括:本應用程式與功能關鍵詞的映射關係。 以上所述僅為本發明的較佳實施例而已,並不用以限制本發明,凡在本發明的精神和原則之內,所做的任何修改、等同替換、改進等,均應包含在本發明保護的範圍之內。 在一個典型的配置中,計算設備包括一個或多個處理器(CPU)、輸入/輸出介面、網路介面和內存。 內存可能包括電腦可讀媒體中的非永久性記憶體,隨機存取記憶體 (RAM)和/或非易失性內存等形式,如唯讀記憶體(ROM)或快閃隨機存取記憶體(flash RAM)。內存是電腦可讀媒體的示例。 電腦可讀媒體包括永久性和非永久性、可移動和非可移動媒體可以由任何方法或技術來實現資訊儲存。資訊可以是電腦可讀指令、資料結構、程式的模組或其他資料。電腦的儲存媒體的例子包括,但不限於相變隨機存取記憶體(PRAM)、靜態隨機存取記憶體(SRAM)、動態隨機存取記憶體(DRAM)、其他類型的隨機存取記憶體(RAM)、唯讀記憶體(ROM)、電可擦除可程式化唯讀記憶體 (EEPROM)、快閃記憶體或其他內存技術、唯讀光碟(CD-ROM)、數位化多功能光碟(DVD)或其他光學儲存、磁盒式磁帶,磁帶磁磁碟儲存或其他磁性儲存設備或任何其他非傳輸媒體,可用於儲存可以被計算設備存取的資訊。按照本文中的界定,電腦可讀媒體不包括暫存電腦可讀媒體(transitory media),如調變的資料信號和載波。 還需要說明的是,術語“包括”、“包含”或者其任何其他變體意在涵蓋非排他性的包含,從而使得包括一系列要素的過程、方法、商品或者設備不僅包括那些要素,而且還包括沒有明確列出的其他要素,或者是還包括為這種過程、方法、商品或者設備所固有的要素。在沒有更多限制的情況下,由語句“包括一個……”限定的要素,並不排除在包括所述要素的過程、方法、商品或者設備中還存在另外的相同要素。 本領域技術人員應明白,本發明的實施例可提供為方法、系統或電腦程式產品。因此,本發明可採用完全硬體實施例、完全軟體實施例或結合軟體和硬體方面的實施例的形式。而且,本發明可採用在一個或多個其中包含有電腦可用程式碼的電腦可用儲存媒體(包括但不限於磁碟記憶體、CD-ROM、光學記憶體等)上實施的電腦程式產品的形式。
110、120‧‧‧步驟
210、220‧‧‧步驟
圖1是本發明實施例中一種應用在終端的語音助理上、語音的功能控制方法的流程圖; 圖2是本發明實施例中一種應用在終端的應用程式上、語音的功能控制方法的流程圖; 圖3是本發明應用示例的工作原理示意圖; 圖4是終端的一種硬體結構圖; 圖5是本發明實施例中一種應用在終端的語音助理上、語音的功能控制裝置的邏輯結構圖; 圖6是本發明實施例中一種應用在終端的應用程式上、語音的功能控制裝置的邏輯結構圖。
Claims (22)
- 一種語音的功能控制方法,應用在終端的語音助理上,其特徵在於,包括: 根據對使用者輸入語音的識別結果,確定關聯應用程式;該關聯應用程式用來實現使用者要使用的功能; 將使用者的輸入語音傳遞給該關聯應用程式,供該關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行該功能的實現。
- 根據申請專利範圍第1項所述的方法,其中,該終端上維護有要使用的功能與應用程式的映射關係; 該根據對使用者輸入語音的識別結果,確定關聯應用程式,包括:根據對使用者輸入語音的識別結果,確定使用者要使用的功能,將與使用者要使用的功能具有映射關係的應用程式作為關聯應用程式。
- 根據申請專利範圍第2項所述的方法,其中,該要使用的功能與應用程式的映射關係,包括:功能關鍵詞與應用程式的映射關係; 該根據對使用者輸入語音的識別結果,確定關聯應用程式,包括:提取對使用者輸入語音的識別結果中的功能關鍵詞,將與該功能關鍵詞具有映射關係的應用程式作為關聯應用程式。
- 根據申請專利範圍第2或3項所述的方法,其中,該要使用的功能與應用程式的映射關係,包括: 由使用者設置的要使用的功能與應用程式的映射關係;和/或, 以實現該要使用的功能時,使用者最頻繁採用的應用程式作為與該要使用的功能具有映射關係的應用程式;和/或, 由某個應用程式提交的、該應用程式與要使用功能的映射關係。
- 根據申請專利範圍第1項所述的方法,其中,該根據對使用者輸入語音的識別結果,確定關聯應用程式,包括:根據對使用者輸入語音的識別結果,確定使用者要使用的功能,將該終端上能夠實現該功能、並且支持語音輸入的若干個應用程式名稱顯示給使用者供其選擇,將使用者選定的應用程式作為關聯應用程式。
- 根據申請專利範圍第1項所述的方法,其中,該根據對使用者輸入語音的識別結果,確定關聯應用程式,包括:提取對使用者輸入語音的識別結果中的應用程式名稱,將輸入語音中指定的應用程式作為關聯應用程式。
- 根據申請專利範圍第1項所述的方法,其中,該將使用者的輸入語音傳遞給該關聯應用程式,包括:將該識別結果和使用者的輸入語音傳遞給該關聯應用程式,供該關聯應用程式對使用者的輸入語音進行識別,並根據關聯應用程式的識別結果和語音助理的識別結果進行該功能的實現。
- 一種語音的功能控制方法,應用在用來實現除語音助理外其他功能的終端應用程式上,其特徵在於,包括: 接收來自語音助理的使用者的輸入語音; 識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現。
- 根據申請專利範圍第8項所述的方法,其中,該接收來自語音助理的使用者的輸入語音,包括:接收來自語音助理的使用者的輸入語音,以及語音助理對該輸入語音的識別結果; 該識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現,包括:識別使用者的輸入語音,根據自己的識別結果和來自語音助理的識別結果,進行使用者要使用功能的實現。
- 根據申請專利範圍第8項所述的方法,其中,該方法還包括:根據使用者的指令,向語音助理提交本應用程式與要使用功能的映射關係。
- 根據申請專利範圍第10項所述的方法,其中,該本應用程式與要使用功能的映射關係,包括:本應用程式與功能關鍵詞的映射關係。
- 一種語音的功能控制裝置,應用在終端的語音助理上,其特徵在於,包括: 關聯應用程式單元,用於根據對使用者輸入語音的識別結果,確定關聯應用程式;該關聯應用程式用來實現使用者要使用的功能; 輸入語音傳遞單元,用於將使用者的輸入語音傳遞給該關聯應用程式,供該關聯應用程式對使用者的輸入語音進行識別,並根據識別結果進行該功能的實現。
- 根據申請專利範圍第12項所述的裝置,其中,該終端上維護有要使用的功能與應用程式的映射關係; 該關聯應用程式單元具體用於:根據對使用者輸入語音的識別結果,確定使用者要使用的功能,將與使用者要使用的功能具有映射關係的應用程式作為關聯應用程式。
- 根據申請專利範圍第13項所述的裝置,其中,該要使用的功能與應用程式的映射關係,包括:功能關鍵詞與應用程式的映射關係; 該關聯應用程式單元具體用於:提取對使用者輸入語音的識別結果中的功能關鍵詞,將與該功能關鍵詞具有映射關係的應用程式作為關聯應用程式。
- 根據申請專利範圍第13或14項所述的裝置,其中,該要使用的功能與應用程式的映射關係,包括: 由使用者設置的要使用的功能與應用程式的映射關係;和/或, 以實現該要使用的功能時,使用者最頻繁採用的應用程式作為與該要使用的功能具有映射關係的應用程式;和/或, 由某個應用程式提交的、該應用程式與要使用功能的映射關係。
- 根據申請專利範圍第12項所述的裝置,其中,該關聯應用程式單元具體用於:根據對使用者輸入語音的識別結果,確定使用者要使用的功能,將該終端上能夠實現該功能、並且支持語音輸入的若干個應用程式名稱顯示給使用者供其選擇,將使用者選定的應用程式作為關聯應用程式。
- 根據申請專利範圍第12項所述的裝置,其中,該關聯應用程式單元具體用於:提取對使用者輸入語音的識別結果中的應用程式名稱,將輸入語音中指定的應用程式作為關聯應用程式。
- 根據申請專利範圍第12項所述的裝置,其中,該輸入語音傳遞單元具體用於:將該識別結果和使用者的輸入語音傳遞給該關聯應用程式,供該關聯應用程式對使用者的輸入語音進行識別,並根據關聯應用程式的識別結果和語音助理的識別結果進行該功能的實現。
- 一種語音的功能控制裝置,應用在用來實現除語音助理外其他功能的終端應用程式上,其特徵在於,包括: 輸入語音接收單元,用於接收來自語音助理的使用者的輸入語音; 功能實現單元,用於識別使用者的輸入語音,根據識別結果進行使用者要使用功能的實現。
- 根據申請專利範圍第19項所述的裝置,其中,該輸入語音接收單元具體用於:接收來自語音助理的使用者的輸入語音,以及語音助理對該輸入語音的識別結果; 該功能實現單元具體用於:識別使用者的輸入語音,根據自己的識別結果和來自語音助理的識別結果,進行使用者要使用功能的實現。
- 根據申請專利範圍第19項所述的裝置,其中,該裝置還包括:映射關係提交單元,用於根據使用者的指令,向語音助理提交本應用程式與要使用功能的映射關係。
- 根據申請專利範圍第21項所述的裝置,其中,該本應用程式與要使用功能的映射關係,包括:本應用程式與功能關鍵詞的映射關係。
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| CN201710210831.5 | 2017-03-31 | ||
| CN201710210831.5A CN107122179A (zh) | 2017-03-31 | 2017-03-31 | 语音的功能控制方法和装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| TW201837896A true TW201837896A (zh) | 2018-10-16 |
| TWI665656B TWI665656B (zh) | 2019-07-11 |
Family
ID=59725277
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| TW106139676A TWI665656B (zh) | 2017-03-31 | 2017-11-16 | 語音的功能控制方法和裝置 |
Country Status (9)
| Country | Link |
|---|---|
| US (2) | US10643615B2 (zh) |
| EP (1) | EP3575957B1 (zh) |
| JP (1) | JP6869354B2 (zh) |
| KR (1) | KR102228964B1 (zh) |
| CN (1) | CN107122179A (zh) |
| MY (1) | MY194401A (zh) |
| PH (1) | PH12019501488A1 (zh) |
| TW (1) | TWI665656B (zh) |
| WO (1) | WO2018177233A1 (zh) |
Families Citing this family (44)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| CN107122179A (zh) * | 2017-03-31 | 2017-09-01 | 阿里巴巴集团控股有限公司 | 语音的功能控制方法和装置 |
| US11436417B2 (en) | 2017-05-15 | 2022-09-06 | Google Llc | Providing access to user-controlled resources by automated assistants |
| CN107783705A (zh) * | 2017-10-20 | 2018-03-09 | 珠海市魅族科技有限公司 | 展示应用程序的方法、装置、计算机装置及存储介质 |
| KR102455199B1 (ko) * | 2017-10-27 | 2022-10-18 | 엘지전자 주식회사 | 인공지능 디바이스 |
| US10747954B2 (en) * | 2017-10-31 | 2020-08-18 | Baidu Usa Llc | System and method for performing tasks based on user inputs using natural language processing |
| CN107919123B (zh) * | 2017-12-07 | 2022-06-03 | 北京小米移动软件有限公司 | 多语音助手控制方法、装置及计算机可读存储介质 |
| CN108231081A (zh) * | 2017-12-29 | 2018-06-29 | 北京视觉世界科技有限公司 | 一种语音处理方法、装置、电子设备和存储介质 |
| CN108231076A (zh) * | 2018-01-04 | 2018-06-29 | 广州视源电子科技股份有限公司 | 一种语音控制方法、装置、设备及存储介质 |
| CN108255462A (zh) * | 2018-01-17 | 2018-07-06 | 北京网信云服信息科技有限公司 | 应用程序的操作方法及装置 |
| CN108364647A (zh) * | 2018-02-09 | 2018-08-03 | 智慧海派科技有限公司 | 基于语音识别的应用程序显示方法及移动终端 |
| CN108391009A (zh) * | 2018-02-13 | 2018-08-10 | 广东欧珀移动通信有限公司 | 应用页面的显示方法、装置、存储介质及电子设备 |
| CN110231863B (zh) * | 2018-03-06 | 2023-03-24 | 斑马智行网络(香港)有限公司 | 语音交互方法和车载设备 |
| CN108428451B (zh) * | 2018-03-12 | 2021-05-18 | 联想(北京)有限公司 | 语音控制方法、电子设备和语音控制系统 |
| CN108877811B (zh) * | 2018-04-24 | 2022-05-06 | 中国地质大学(武汉) | 一种基于声纹选择词汇的方法、设备及存储设备 |
| US11487501B2 (en) * | 2018-05-16 | 2022-11-01 | Snap Inc. | Device control using audio data |
| CN108735211A (zh) * | 2018-05-16 | 2018-11-02 | 智车优行科技(北京)有限公司 | 语音处理方法、装置、车辆、电子设备、程序及介质 |
| CN108897552A (zh) * | 2018-06-15 | 2018-11-27 | 联想(北京)有限公司 | 功能实现方法及系统 |
| CN110620705B (zh) * | 2018-06-19 | 2022-03-18 | 芜湖美的厨卫电器制造有限公司 | 智能浴室的控制终端和控制方法、电子设备 |
| CN110166417B (zh) * | 2018-08-01 | 2021-10-01 | 腾讯科技(深圳)有限公司 | 任务执行方法、装置、计算机设备和存储介质 |
| EP3826280B1 (en) * | 2018-08-07 | 2023-05-24 | Huawei Technologies Co., Ltd. | Method for generating speech control command, and terminal |
| EP3937030B1 (en) | 2018-08-07 | 2024-07-10 | Google LLC | Assembling and evaluating automated assistant responses for privacy concerns |
| CN110874201B (zh) * | 2018-08-29 | 2023-06-23 | 斑马智行网络(香港)有限公司 | 交互方法、设备、存储介质和操作系统 |
| CN108986814A (zh) * | 2018-09-04 | 2018-12-11 | 出门问问信息科技有限公司 | 一种唤醒应用服务的方法及装置 |
| CN109065047B (zh) * | 2018-09-04 | 2021-05-04 | 出门问问信息科技有限公司 | 一种唤醒应用服务的方法及装置 |
| WO2020116026A1 (ja) * | 2018-12-07 | 2020-06-11 | ソニー株式会社 | 応答処理装置、応答処理方法及び応答処理プログラム |
| CN109658934B (zh) * | 2018-12-27 | 2020-12-01 | 苏州思必驰信息科技有限公司 | 通过语音控制多媒体app的方法及装置 |
| CN109903763B (zh) | 2019-01-11 | 2022-02-22 | 百度在线网络技术(北京)有限公司 | 服务控制方法、装置及设备 |
| CN109828787A (zh) * | 2019-01-17 | 2019-05-31 | 维沃移动通信有限公司 | 一种运行文件的方法、电子设备和云服务器 |
| WO2020159190A1 (en) * | 2019-01-28 | 2020-08-06 | Samsung Electronics Co., Ltd. | Method and apparatus for supporting voice instructions |
| CN111724775B (zh) * | 2019-03-22 | 2023-07-28 | 华为技术有限公司 | 一种语音交互方法及电子设备 |
| CN113330489A (zh) * | 2019-05-20 | 2021-08-31 | 深圳市欢太科技有限公司 | 语音信息处理方法、装置、电子设备以及存储介质 |
| CN110866179A (zh) * | 2019-10-08 | 2020-03-06 | 上海博泰悦臻网络技术服务有限公司 | 一种基于语音助手的推荐方法、终端及计算机存储介质 |
| CN110851104A (zh) * | 2019-10-28 | 2020-02-28 | 爱钱进(北京)信息科技有限公司 | 语音控制应用程序的方法、装置以及存储介质 |
| CN114391165A (zh) * | 2019-10-29 | 2022-04-22 | 深圳市欢太科技有限公司 | 语音信息处理方法、装置、设备及存储介质 |
| CN111048087A (zh) * | 2019-12-24 | 2020-04-21 | 深圳Tcl新技术有限公司 | 共享式语音交互方法、装置、设备及存储介质 |
| CN113053370B (zh) * | 2019-12-27 | 2024-04-05 | 北京沃东天骏信息技术有限公司 | 唤醒应用的方法和装置 |
| CN111429597B (zh) * | 2020-03-31 | 2021-11-02 | 腾讯科技(成都)有限公司 | 语音打卡方法、装置及存储介质 |
| WO2022160911A1 (zh) * | 2021-01-29 | 2022-08-04 | 青岛海信传媒网络技术有限公司 | 显示设备上语音方案的切换方法、显示设备及控制装置 |
| CN113093596A (zh) * | 2021-03-29 | 2021-07-09 | 北京金山云网络技术有限公司 | 一种控制指令的处理方法和装置 |
| CN113496703A (zh) * | 2021-07-23 | 2021-10-12 | 北京百度网讯科技有限公司 | 通过语音方式控制程序的方法、设备及程序产品 |
| CN116189673A (zh) * | 2021-11-29 | 2023-05-30 | 中兴通讯股份有限公司 | 语音控制方法、终端设备、服务器及存储介质 |
| US12055405B2 (en) | 2022-03-08 | 2024-08-06 | Telenav, Inc. | Navigation system with voice assistant mechanism and method of operation thereof |
| CN116825096A (zh) * | 2022-03-21 | 2023-09-29 | 南京四维智联科技有限公司 | 一种语音识别程序控制方法及系统 |
| CN117423336B (zh) * | 2023-10-10 | 2024-11-19 | 阿波罗智联(北京)科技有限公司 | 音频数据处理方法、装置、电子设备及存储介质 |
Family Cites Families (70)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2000076040A (ja) * | 1998-09-03 | 2000-03-14 | Matsushita Electric Ind Co Ltd | 音声入力ネットワーク端末装置 |
| WO2002060162A2 (en) * | 2000-11-30 | 2002-08-01 | Enterprise Integration Group, Inc. | Method and system for preventing error amplification in natural language dialogues |
| US7209880B1 (en) * | 2001-03-20 | 2007-04-24 | At&T Corp. | Systems and methods for dynamic re-configurable speech recognition |
| US20030008193A1 (en) | 2001-06-28 | 2003-01-09 | Foamex L.P. | Liquid fuel delivery system for fuel cells |
| US8150872B2 (en) * | 2005-01-24 | 2012-04-03 | The Intellection Group, Inc. | Multimodal natural language query system for processing and analyzing voice and proximity-based queries |
| US20070174214A1 (en) * | 2005-04-13 | 2007-07-26 | Robert Welsh | Integrated fraud management systems and methods |
| US8234494B1 (en) * | 2005-12-21 | 2012-07-31 | At&T Intellectual Property Ii, L.P. | Speaker-verification digital signatures |
| US9318108B2 (en) * | 2010-01-18 | 2016-04-19 | Apple Inc. | Intelligent automated assistant |
| US7528713B2 (en) * | 2006-09-28 | 2009-05-05 | Ektimisi Semiotics Holdings, Llc | Apparatus and method for providing a task reminder based on travel history |
| US8214208B2 (en) * | 2006-09-28 | 2012-07-03 | Reqall, Inc. | Method and system for sharing portable voice profiles |
| US20110054894A1 (en) * | 2007-03-07 | 2011-03-03 | Phillips Michael S | Speech recognition through the collection of contact information in mobile dictation application |
| US20110054895A1 (en) * | 2007-03-07 | 2011-03-03 | Phillips Michael S | Utilizing user transmitted text to improve language model in mobile dictation application |
| WO2009123030A1 (ja) * | 2008-04-02 | 2009-10-08 | 京セラ株式会社 | ユーザインタフェース生成装置 |
| US9292307B2 (en) * | 2008-07-30 | 2016-03-22 | Kyocera Corporation | User interface generation apparatus |
| US20120310652A1 (en) * | 2009-06-01 | 2012-12-06 | O'sullivan Daniel | Adaptive Human Computer Interface (AAHCI) |
| US9858925B2 (en) * | 2009-06-05 | 2018-01-02 | Apple Inc. | Using context information to facilitate processing of commands in a virtual assistant |
| US10706373B2 (en) * | 2011-06-03 | 2020-07-07 | Apple Inc. | Performing actions associated with task items that represent tasks to perform |
| US9213558B2 (en) * | 2009-09-02 | 2015-12-15 | Sri International | Method and apparatus for tailoring the output of an intelligent automated assistant to a user |
| US8326624B2 (en) * | 2009-10-26 | 2012-12-04 | International Business Machines Corporation | Detecting and communicating biometrics of recorded voice during transcription process |
| US20110099507A1 (en) * | 2009-10-28 | 2011-04-28 | Google Inc. | Displaying a collection of interactive elements that trigger actions directed to an item |
| EP2390757A1 (en) * | 2010-05-25 | 2011-11-30 | Samsung Electronics Co., Ltd. | Method and apparatus for managing an application being executed in a portable terminal |
| US8504404B2 (en) * | 2010-06-17 | 2013-08-06 | Google Inc. | Distance and location-aware scheduling assistance in a calendar system with notification of potential conflicts |
| US8775156B2 (en) * | 2010-08-05 | 2014-07-08 | Google Inc. | Translating languages in response to device motion |
| US8359020B2 (en) * | 2010-08-06 | 2013-01-22 | Google Inc. | Automatically monitoring for voice input based on context |
| US8473289B2 (en) * | 2010-08-06 | 2013-06-25 | Google Inc. | Disambiguating input based on context |
| US8812321B2 (en) * | 2010-09-30 | 2014-08-19 | At&T Intellectual Property I, L.P. | System and method for combining speech recognition outputs from a plurality of domain-specific speech recognizers via machine learning |
| US8571937B2 (en) * | 2010-10-20 | 2013-10-29 | Playspan Inc. | Dynamic payment optimization apparatuses, methods and systems |
| US20120108221A1 (en) * | 2010-10-28 | 2012-05-03 | Microsoft Corporation | Augmenting communication sessions with applications |
| US20120158422A1 (en) * | 2010-12-21 | 2012-06-21 | General Electric Company | Methods and systems for scheduling appointments in healthcare systems |
| CN102651217A (zh) * | 2011-02-25 | 2012-08-29 | 株式会社东芝 | 用于合成语音的方法、设备以及用于语音合成的声学模型训练方法 |
| US8862255B2 (en) * | 2011-03-23 | 2014-10-14 | Audible, Inc. | Managing playback of synchronized content |
| US20120271676A1 (en) * | 2011-04-25 | 2012-10-25 | Murali Aravamudan | System and method for an intelligent personal timeline assistant |
| US10057736B2 (en) * | 2011-06-03 | 2018-08-21 | Apple Inc. | Active transport based notifications |
| US20120310642A1 (en) * | 2011-06-03 | 2012-12-06 | Apple Inc. | Automatically creating a mapping between text data and audio data |
| US9122981B1 (en) * | 2011-06-15 | 2015-09-01 | Amazon Technologies, Inc. | Detecting unexpected behavior |
| US20130006633A1 (en) * | 2011-07-01 | 2013-01-03 | Qualcomm Incorporated | Learning speech models for mobile device users |
| US8768707B2 (en) * | 2011-09-27 | 2014-07-01 | Sensory Incorporated | Background speech recognition assistant using speaker verification |
| US8452597B2 (en) * | 2011-09-30 | 2013-05-28 | Google Inc. | Systems and methods for continual speech recognition and detection in mobile computing devices |
| AU2012232977A1 (en) * | 2011-09-30 | 2013-04-18 | Apple Inc. | Using context information to facilitate processing of commands in a virtual assistant |
| KR101934998B1 (ko) * | 2011-10-04 | 2019-01-04 | 삼성전자주식회사 | 복수의 애플리케이션에 대한 사용자 인터페이스를 제공하는 방법 및 시스템 |
| AU2013214801B2 (en) * | 2012-02-02 | 2018-06-21 | Visa International Service Association | Multi-source, multi-dimensional, cross-entity, multimedia database platform apparatuses, methods and systems |
| JP5887162B2 (ja) * | 2012-02-23 | 2016-03-16 | 株式会社Nttドコモ | 通信端末、制御方法及びプログラム |
| US20130238326A1 (en) * | 2012-03-08 | 2013-09-12 | Lg Electronics Inc. | Apparatus and method for multiple device voice control |
| WO2013185109A2 (en) * | 2012-06-08 | 2013-12-12 | Apple Inc. | Systems and methods for recognizing textual identifiers within a plurality of words |
| CN103915095B (zh) * | 2013-01-06 | 2017-05-31 | 华为技术有限公司 | 语音识别的方法、交互设备、服务器和系统 |
| EP4560630A3 (en) * | 2013-02-07 | 2025-08-06 | Apple Inc. | Voice trigger for a digital assistant |
| WO2014144579A1 (en) * | 2013-03-15 | 2014-09-18 | Apple Inc. | System and method for updating an adaptive speech recognition model |
| CN103219005B (zh) * | 2013-04-28 | 2016-01-20 | 北京云知声信息技术有限公司 | 一种语音识别方法及装置 |
| US9292254B2 (en) * | 2013-05-15 | 2016-03-22 | Maluuba Inc. | Interactive user interface for an intelligent assistant |
| TW201505023A (zh) * | 2013-07-19 | 2015-02-01 | Richplay Information Co Ltd | 個人化語音助理之方法 |
| CN104346151B (zh) * | 2013-07-30 | 2018-04-27 | 联想(北京)有限公司 | 一种信息处理方法及电子设备 |
| US9489171B2 (en) * | 2014-03-04 | 2016-11-08 | Microsoft Technology Licensing, Llc | Voice-command suggestions based on user identity |
| KR102261552B1 (ko) * | 2014-06-30 | 2021-06-07 | 삼성전자주식회사 | 음성 명령어 제공 방법 및 이를 지원하는 전자 장치 |
| CN204390737U (zh) * | 2014-07-29 | 2015-06-10 | 科大讯飞股份有限公司 | 一种家庭语音处理系统 |
| US9548066B2 (en) * | 2014-08-11 | 2017-01-17 | Amazon Technologies, Inc. | Voice application architecture |
| CN105469786A (zh) * | 2014-08-22 | 2016-04-06 | 中兴通讯股份有限公司 | 语音识别的控制方法和装置 |
| JP2016095383A (ja) * | 2014-11-14 | 2016-05-26 | 株式会社ATR−Trek | 音声認識クライアント装置及びサーバ型音声認識装置 |
| US9824207B1 (en) * | 2014-12-15 | 2017-11-21 | Amazon Technologies, Inc. | Authentication information update based on fraud detection |
| US10147421B2 (en) | 2014-12-16 | 2018-12-04 | Microcoft Technology Licensing, Llc | Digital assistant voice input integration |
| US9398361B1 (en) * | 2015-02-20 | 2016-07-19 | Vxi Corporation | Headset system with user-configurable function button |
| CN106157955A (zh) | 2015-03-30 | 2016-11-23 | 阿里巴巴集团控股有限公司 | 一种语音控制方法及装置 |
| US9921805B2 (en) | 2015-06-17 | 2018-03-20 | Lenovo (Singapore) Pte. Ltd. | Multi-modal disambiguation of voice assisted input |
| CN105094717B (zh) * | 2015-07-15 | 2019-02-26 | 百度在线网络技术(北京)有限公司 | 基于语音输入的打印方法、打印装置和打印机 |
| US9811305B2 (en) * | 2015-08-13 | 2017-11-07 | Dell Products L.P. | Systems and methods for remote and local host-accessible management controller tunneled audio capability |
| CN105183422B (zh) * | 2015-08-31 | 2018-06-05 | 百度在线网络技术(北京)有限公司 | 语音控制应用程序的方法和装置 |
| US9875081B2 (en) * | 2015-09-21 | 2018-01-23 | Amazon Technologies, Inc. | Device selection for providing a response |
| TWI557599B (zh) * | 2015-11-05 | 2016-11-11 | 宏碁股份有限公司 | 語音控制方法及語音控制系統 |
| CN105719649B (zh) * | 2016-01-19 | 2019-07-05 | 百度在线网络技术(北京)有限公司 | 语音识别方法及装置 |
| CN105825851B (zh) * | 2016-05-17 | 2020-07-21 | Tcl科技集团股份有限公司 | 一种基于Android系统的语音控制方法及系统 |
| CN107122179A (zh) | 2017-03-31 | 2017-09-01 | 阿里巴巴集团控股有限公司 | 语音的功能控制方法和装置 |
-
2017
- 2017-03-31 CN CN201710210831.5A patent/CN107122179A/zh active Pending
- 2017-11-16 TW TW106139676A patent/TWI665656B/zh not_active IP Right Cessation
-
2018
- 2018-03-26 EP EP18778228.9A patent/EP3575957B1/en active Active
- 2018-03-26 KR KR1020197018535A patent/KR102228964B1/ko active Active
- 2018-03-26 WO PCT/CN2018/080436 patent/WO2018177233A1/zh not_active Ceased
- 2018-03-26 MY MYPI2019003596A patent/MY194401A/en unknown
- 2018-03-26 JP JP2019535874A patent/JP6869354B2/ja active Active
-
2019
- 2019-06-20 US US16/447,536 patent/US10643615B2/en active Active
- 2019-06-25 PH PH12019501488A patent/PH12019501488A1/en unknown
-
2020
- 2020-03-16 US US16/820,098 patent/US10991371B2/en active Active
Also Published As
| Publication number | Publication date |
|---|---|
| MY194401A (en) | 2022-11-30 |
| US10991371B2 (en) | 2021-04-27 |
| EP3575957B1 (en) | 2021-07-07 |
| JP6869354B2 (ja) | 2021-05-12 |
| US20190304461A1 (en) | 2019-10-03 |
| CN107122179A (zh) | 2017-09-01 |
| WO2018177233A1 (zh) | 2018-10-04 |
| KR102228964B1 (ko) | 2021-03-18 |
| US20200219510A1 (en) | 2020-07-09 |
| KR20190089032A (ko) | 2019-07-29 |
| JP2020510852A (ja) | 2020-04-09 |
| EP3575957A4 (en) | 2020-01-01 |
| US10643615B2 (en) | 2020-05-05 |
| EP3575957A1 (en) | 2019-12-04 |
| PH12019501488A1 (en) | 2020-03-02 |
| TWI665656B (zh) | 2019-07-11 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| TWI665656B (zh) | 語音的功能控制方法和裝置 | |
| CN111741035B (zh) | 电子合同的签署方法、装置及设备 | |
| CN107111725B (zh) | 在输入理解系统中保护私有信息 | |
| CN111566638B (zh) | 向应用编程接口添加描述性元数据以供智能代理使用 | |
| US10146560B2 (en) | Method and apparatus for automatic processing of service requests on an electronic device | |
| WO2018113601A1 (zh) | 一种业务处理方法及装置 | |
| WO2019011186A1 (zh) | 信息验证处理方法、装置、系统、客户端及服务器 | |
| WO2015043420A1 (zh) | 权限控制方法和装置 | |
| US9646438B2 (en) | Device operations based on configurable input sequences | |
| US9830362B2 (en) | Techniques for ranking character searches | |
| TWI504860B (zh) | An electronic device and how to launch an app based on address information | |
| JP2025506009A (ja) | 会話型仕事検索のためのインテリジェントアシスタントシステム | |
| CN107203302A (zh) | 一种页面展示方法和装置 | |
| CN106982197A (zh) | 业务处理方法和装置 | |
| CN106293354A (zh) | 快捷菜单自适应显示控制方法、服务器及便携式终端 | |
| CN111240553A (zh) | 一种操作入口展示方法及装置 | |
| CN115063156A (zh) | 一种风险的处理方法、装置及设备 | |
| CN110059502B (zh) | 隐私数据感知方法及装置 | |
| US10275529B1 (en) | Active content rich media using intelligent personal assistant applications | |
| HK1243510A1 (zh) | 语音的功能控制方法和装置 | |
| US20250138976A1 (en) | System and method for managing operation of a deployment based on compatability mapping | |
| CN110738982B (zh) | 一种请求处理方法、装置及电子设备 | |
| WO2026011325A1 (zh) | 请求处理方法、装置、设备和存储介质 | |
| HK1235486B (zh) | 用户数据库的建立方法和装置 | |
| CN110298522A (zh) | 工作项的管理方法及装置 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| MM4A | Annulment or lapse of patent due to non-payment of fees |