資料介紹
語音接口已經(jīng)成為一個改變?nèi)藱C(jī)交互方式的全新切入點(diǎn)。這些系統(tǒng)如何工作?打造這樣一款設(shè)備在硬件方面有什么要求?隨著語音控制接口變得越來越普及,德州儀器(TI)的一位工程師對此技術(shù)進(jìn)行了深入的了解,并分享了其對這項(xiàng)技術(shù)的認(rèn)識和看法。
語音接口是什么?
語音識別技術(shù)自20世紀(jì)50年代起開始出現(xiàn)在我們身邊。那時貝爾實(shí)驗(yàn)室的工程師創(chuàng)建了一款可以識別單個數(shù)字的系統(tǒng)。然而,語音識別只是完整語音接口技術(shù)的一部分。語音接口包含傳統(tǒng)用戶接口的所有方面:它能呈現(xiàn)信息并為用戶提供一種操控方式。在語音接口中,操控或者甚至一些信息的呈現(xiàn)都將通過語音實(shí)現(xiàn)。在一些如按鈕或顯示屏等傳統(tǒng)的用戶接口上,也可能配置語音接口這一選項(xiàng)。
大部分人遇到的第一款語音接口設(shè)備很有可能是移動電話,或者是個人電腦上非?;A(chǔ)的將語言轉(zhuǎn)換成文字的程序。然而,這些設(shè)備的運(yùn)行都非常緩慢、識別不精確且可識別的詞匯有限。
那是什么將語音識別從一種附屬性功能變成了計(jì)算機(jī)世界炙手可熱的技術(shù)呢?首先,如今的計(jì)算能力和算法性能都有顯著的提高(如果你對隱馬爾科夫模型有所了解,對此你會有更直觀的認(rèn)識)。其次,云技術(shù)和大數(shù)據(jù)分析的應(yīng)用也改進(jìn)了語音識別效果,并且提高了識別的速度和準(zhǔn)確性。
為你的設(shè)備添加語音識別功能
一些人常常會對如何為項(xiàng)目添加某種語音接口存在疑問。實(shí)際上,TI供應(yīng)幾種不同的語音接口產(chǎn)品,包括ARM?處理器的Sitara?系列產(chǎn)品和,這些產(chǎn)品都具備語音處理的能力。兩種系列的產(chǎn)品各有千秋,分別適用于不同的應(yīng)用。
在選擇DSP和ARM這兩種解決方案時,考慮的關(guān)鍵因素在于這款設(shè)備能否或?qū)⑷绾卫迷普Z音平臺。當(dāng)中有三種應(yīng)用場景:第一種是離線,所有的處理過程都在本地設(shè)備上發(fā)生。第二種是在線,通過基于云端的語音處理設(shè)備,如亞馬遜的Alexa,谷歌助手或IBM Watson;第三種是兩者混合。
離線:車載語音控制
從目前的發(fā)展趨勢來看,人們似乎希望所有事物都能夠連接至互聯(lián)網(wǎng)。然而,無論是出于成本考慮或是缺乏可靠的網(wǎng)絡(luò)連接,在某些應(yīng)用中,連接網(wǎng)絡(luò)的意義其實(shí)不大。在現(xiàn)代的汽車應(yīng)用中,許多娛樂信息系統(tǒng)就采用了離線語音接口系統(tǒng)。這些語音接口系統(tǒng)通常只能使用有限的命令集,如“撥打電話”、“播放音樂”和“提高或降低音量”。雖然傳統(tǒng)處理器的語音識別算法取得了重大進(jìn)展,但仍有不盡如人意之處。遇到這樣的情況,例如等DSP可能夠?yàn)橄到y(tǒng)提供最佳的性能。
在線:智能家庭中樞
關(guān)于語音接口的很多熱議主要圍繞于例如Google Home和亞馬遜 Alexa等互聯(lián)設(shè)備。由于亞馬遜允許第三方進(jìn)入其已配備Alex語音服務(wù)的語音處理生態(tài)系統(tǒng),他們在這方面的發(fā)展備受矚目。另外,如Microsoft Azur等其它的云服務(wù)也可以提供語音識別服務(wù)和類似功能。值得注意的是,這些設(shè)備的聲音處理過程全部發(fā)生在云端。
是否值得為了這種便捷的集成而向語音服務(wù)供應(yīng)商提供上行數(shù)據(jù)完全取決于用戶。但是,云服務(wù)供應(yīng)商承擔(dān)了主要的工作,設(shè)備商需要做的很簡單,實(shí)際上,由于接口的語音合成部分也發(fā)生在云端,Alexa只要完成最簡單的功能,即播放并記錄錄音文件。既然不需要特別的信號處理功能,ARM處理器足以處理接口工作。這意味著,如果你的設(shè)備已配備ARM處理器,你就可能集成云計(jì)算語音接口。
事實(shí)上,關(guān)注Alexa等不能提供的服務(wù)也是非常重要的。Alexa不直接執(zhí)行任何一種設(shè)備控制或云集成。驅(qū)動Alexa的許多“智能設(shè)備”都具備云計(jì)算功能,該功能由開發(fā)商提供,可以利用Alexa的語音處理能力將驅(qū)動輸入至現(xiàn)有的云應(yīng)用。例如,如果你告訴Alexa需要訂一個披薩,你最喜愛的披薩店則需要為Alexa編制一項(xiàng)“技能”。該項(xiàng)技能是一個可以在你訂披薩時定義工作內(nèi)容的代碼。當(dāng)你每次訂披薩時,Alexa都會調(diào)用該技能。該技能嵌入了可以為你下單的在線訂購系統(tǒng)。同樣,智能家居設(shè)備制造商必須執(zhí)行Alexa如何與本地設(shè)備和在線服務(wù)相互作用的技能。亞馬遜自帶許多這樣的技能,加上第三方開發(fā)者提供的技能,即便你沒有開發(fā)任何技能,Alexa設(shè)備仍然可以非常有用。
混合:互聯(lián)自動調(diào)溫器
有時,即使沒有連接互聯(lián)網(wǎng),我們也有保證設(shè)備的某些基礎(chǔ)功能可以正常使用的需求。例如:在連不上網(wǎng)的時候,如果自動調(diào)溫器不會自主調(diào)節(jié)溫度,這就會是一個很麻煩的問題。為避免這種問題的發(fā)生 ,一個好的產(chǎn)品設(shè)計(jì)師會設(shè)計(jì)一些本地的聲音處理功能,在功能上實(shí)現(xiàn)無縫銜接。為了實(shí)現(xiàn)此功能,系統(tǒng)必須具有DSP,例如用于本地語音處理的C55XX和用于將已連網(wǎng)的接口連接至云端的ARM處理器。
語音觸發(fā)又是什么?
你也許已經(jīng)注意到了,直到現(xiàn)在我們還沒有提及新一代語音助手真正神奇的地方:那就是始終關(guān)注“觸發(fā)詞匯”。它們將如何追蹤你在房間內(nèi)任意位置所發(fā)出的聲音,或是當(dāng)設(shè)備播放音頻時,又如何聽到你的聲音?實(shí)現(xiàn)這些其實(shí)并沒有什么特別神奇的地方,只需要一些智能化軟件。這類軟件獨(dú)立于云端的語音接口,也能在系統(tǒng)離線的狀態(tài)下運(yùn)行。
這個系統(tǒng)最易理解的部分就是“喚醒詞匯”。喚醒詞匯是一個簡單的本地語音識別程序,通過持續(xù)性采樣,在接收的音頻信號中尋找單個詞匯。由于大多數(shù)語音服務(wù)均樂意接受不含喚醒詞匯的音頻,因此該詞匯不需要指定任何特殊的語音平臺。因?yàn)閷?shí)現(xiàn)這種功能的要求相對較低,所以通過利用Sphinx或KITT.AI等開源數(shù)據(jù)庫在ARM處理器上即可完成操作。
為了聽到你在房間內(nèi)任意位置發(fā)出的聲音,語音識別設(shè)備采用一個叫波束成型的流程。最重要的是,通過對比不同聲音的到達(dá)時間和麥克風(fēng)間的距離來確定聲音的來源。一旦確認(rèn)了目標(biāo)聲音的位置,設(shè)備就會采用如空間濾波等音頻處理技術(shù)來進(jìn)一步減少噪音并增強(qiáng)信號質(zhì)量。波束成型的實(shí)現(xiàn)取決于麥克風(fēng)的布局。真正實(shí)現(xiàn)360度識別則需要一個非線性麥克風(fēng)陣列(通常是圓形)。對于壁掛式設(shè)備而言,僅需兩個麥克風(fēng)就能啟用180度的空間辨別。
語音助手的最后一招是采用自動回波消除(AEC)。AEC在某種程度上類似于噪音消除耳機(jī),但應(yīng)用恰好相反。該算法是利用已知的音樂等輸出音頻信號來實(shí)現(xiàn)的。在噪音消除耳機(jī)利用這點(diǎn)來消除外部雜音,AEC消除了輸出信號對輸入信號在麥克風(fēng)上的影響。該設(shè)備能忽略自身產(chǎn)生的音頻,且無論揚(yáng)聲器播放何種內(nèi)容,其都仍然能接收。實(shí)現(xiàn)AEC需要大量的計(jì)算,其中在DSP中效果最佳。
為了實(shí)施喚醒識別、波束成型和AEC等以上提及的所有功能,則要求ARM處理器配合DSP共同工作:DSP增強(qiáng)了所有的信號處理功能,而ARM處理器控制設(shè)備邏輯和接口。DSP可在執(zhí)行輸入數(shù)據(jù)管路方面發(fā)揮重要的作用,由此最大限度地減少處理的延遲,從而提供更好的用戶體驗(yàn)。ARM可以自由運(yùn)行如Linux等高級操作系統(tǒng)以控制其它設(shè)備。這樣高級的功能全部發(fā)生在本地,若使用云服務(wù),將只接收包含最終處理結(jié)果的單個語音文件。
結(jié)論
語音接口似乎已收獲了超高的人氣,并且將在未來很長一段時間內(nèi)以不同形式出現(xiàn)在我們的生活中。盡管有多種不同的處理方式可以實(shí)現(xiàn)語音接口服務(wù),但無論你的應(yīng)用需要何種裝置,TI都可以為你提供理想的選擇。
來源:德州儀器 TI
(mbbeetchina)
下載該資料的人也在下載
下載該資料的人還在閱讀
更多 >
- WTR050語音錄放芯片中文資料下載 2次下載
- PCM語音編解碼及原理圖下載 13次下載
- NRK11系列語音識別芯片資料手冊 19次下載
- 基于VS1003B的語音通信方法研究資料下載
- 諾基亞4G核心網(wǎng)下EPS FALLBACK語音業(yè)務(wù)接入失敗問題資料下載
- 將EPS Fallback作為5G語音解決方案的可行性資料下載
- 什么是時序電路?觸發(fā)器又是怎么回事資料下載
- PCM語音編解碼的PCB原理圖免費(fèi)下載 20次下載
- 設(shè)計(jì)一個雙路語音同傳的無線收發(fā)系統(tǒng)的試題資料合集免費(fèi)下載 62次下載
- 如何使用MATLAB進(jìn)行語音識別算法研究的論文資料免費(fèi)下載 43次下載
- 科大訊飛5.0語音軟件的安裝和操作要領(lǐng)資料說明 11次下載
- YS-MP3語音播放模塊的詳細(xì)資料介紹和使用方式說明免費(fèi)下載 56次下載
- H5A02HP語音芯片資料說明書下載.pdf 25次下載
- M6085A語音芯片資料下載 1次下載
- 基于短信和語音合成的報(bào)警接口設(shè)計(jì)
- Transformer模型在語音識別和語音生成中的應(yīng)用優(yōu)勢 713次閱讀
- 語音芯片KT148A支持3個IO口一對一觸發(fā)的配置教程 1660次閱讀
- 當(dāng)語音控制和語音接口開始滲透到所有消費(fèi)類邊緣設(shè)備 1673次閱讀
- 詳談機(jī)器學(xué)習(xí)的智能語音處理技術(shù) 5949次閱讀
- 基于JuliUS語音識別引擎實(shí)現(xiàn)機(jī)器人孤立詞語音識別系統(tǒng)的設(shè)計(jì) 1695次閱讀
- 語音芯片如何發(fā)聲 3893次閱讀
- 語音芯片選型_語音芯片如何使用 3983次閱讀
- 語音識別芯片的原理_語音識別芯片有哪些 5171次閱讀
- 語音識別技術(shù)在智能語音機(jī)器人中的應(yīng)用 5357次閱讀
- 語音識別技術(shù)的發(fā)展歷程,語音識別是如何工作的?語音識別資料概述 1w次閱讀
- 語音識別技術(shù)是什么_語音識別技術(shù)應(yīng)用領(lǐng)域介紹 1.6w次閱讀
- TI資深工程師對語音接口的解析分享 1408次閱讀
- 基于數(shù)字信號處理器的中文語音合成系統(tǒng)設(shè)計(jì) 1886次閱讀
- 語音識別技術(shù)原理全面解析 1.2w次閱讀
- 語音識別技術(shù)的應(yīng)用及發(fā)展 2318次閱讀
下載排行
本周
- 1TC358743XBG評估板參考手冊
- 1.36 MB | 330次下載 | 免費(fèi)
- 2開關(guān)電源基礎(chǔ)知識
- 5.73 MB | 11次下載 | 免費(fèi)
- 3100W短波放大電路圖
- 0.05 MB | 4次下載 | 3 積分
- 4嵌入式linux-聊天程序設(shè)計(jì)
- 0.60 MB | 3次下載 | 免費(fèi)
- 5DIY動手組裝LED電子顯示屏
- 0.98 MB | 3次下載 | 免費(fèi)
- 6基于FPGA的C8051F單片機(jī)開發(fā)板設(shè)計(jì)
- 0.70 MB | 2次下載 | 免費(fèi)
- 751單片機(jī)PM2.5檢測系統(tǒng)程序
- 0.83 MB | 2次下載 | 免費(fèi)
- 8基于51單片機(jī)的RGB調(diào)色燈程序仿真
- 0.86 MB | 2次下載 | 免費(fèi)
本月
- 1OrCAD10.5下載OrCAD10.5中文版軟件
- 0.00 MB | 234315次下載 | 免費(fèi)
- 2555集成電路應(yīng)用800例(新編版)
- 0.00 MB | 33566次下載 | 免費(fèi)
- 3接口電路圖大全
- 未知 | 30323次下載 | 免費(fèi)
- 4開關(guān)電源設(shè)計(jì)實(shí)例指南
- 未知 | 21549次下載 | 免費(fèi)
- 5電氣工程師手冊免費(fèi)下載(新編第二版pdf電子書)
- 0.00 MB | 15349次下載 | 免費(fèi)
- 6數(shù)字電路基礎(chǔ)pdf(下載)
- 未知 | 13750次下載 | 免費(fèi)
- 7電子制作實(shí)例集錦 下載
- 未知 | 8113次下載 | 免費(fèi)
- 8《LED驅(qū)動電路設(shè)計(jì)》 溫德爾著
- 0.00 MB | 6656次下載 | 免費(fèi)
總榜
- 1matlab軟件下載入口
- 未知 | 935054次下載 | 免費(fèi)
- 2protel99se軟件下載(可英文版轉(zhuǎn)中文版)
- 78.1 MB | 537797次下載 | 免費(fèi)
- 3MATLAB 7.1 下載 (含軟件介紹)
- 未知 | 420027次下載 | 免費(fèi)
- 4OrCAD10.5下載OrCAD10.5中文版軟件
- 0.00 MB | 234315次下載 | 免費(fèi)
- 5Altium DXP2002下載入口
- 未知 | 233046次下載 | 免費(fèi)
- 6電路仿真軟件multisim 10.0免費(fèi)下載
- 340992 | 191186次下載 | 免費(fèi)
- 7十天學(xué)會AVR單片機(jī)與C語言視頻教程 下載
- 158M | 183279次下載 | 免費(fèi)
- 8proe5.0野火版下載(中文版免費(fèi)下載)
- 未知 | 138040次下載 | 免費(fèi)
評論
查看更多