我吃西红柿,有声小说下载,《完美世界》txt全集

因為資本的涌入、智能家居的火熱和人工智能的崛起，市場對語音市場的關(guān)注度迅速提升。尤其是近年來隨著亞馬遜、谷歌、華為和BAT等廠商入局智能音箱，爭先押寶這個智能家居的關(guān)鍵入口之后，語音市場變得空前擁擠。

根據(jù) ReportLinker的預(yù)測，到2024年，全球智能語音市場規(guī)模將躍升到215億美元，而在當(dāng)中AI語音芯片就扮演了一個關(guān)鍵角色。不同于過往的芯片只考慮PPA，開發(fā)者在選擇語音芯片的時候更多是考慮其體驗，但這是很多過往的硬件解決方案所不具備的。這就吸引了眾多傳統(tǒng)廠商或者初創(chuàng)企業(yè)開始紛紛涌入AI語音芯片這個賽道，用MCU、DSP或者ASIC的方案來解決現(xiàn)有，有些廠商甚至還推出了顛覆傳統(tǒng)的新架構(gòu)去搶占市場。

但在行業(yè)專家看來，這些方案或多或少都存在一些問題。要了解這一點，就必須從語音識別行業(yè)的一些現(xiàn)狀說起。

語音識別面臨的幾大挑戰(zhàn)

以智能音箱為例，現(xiàn)在的語音識別產(chǎn)品在廠商的智能家居規(guī)劃藍圖中是扮演一個人與機器交流的橋梁，那在實際應(yīng)用中就要求音箱能夠聽得到人說的話，同時還要求它聽得清晰和聽得準(zhǔn)。這就提出了第一個挑戰(zhàn)——那就是信噪比。

所謂信噪比，就是目標(biāo)信號與干擾信號強度比值的對數(shù)，我們需要一定的信噪比，才能讓機器聽得清楚。但根據(jù)聲音的傳播特性，它在空氣中衰減會非常大，但人在與智能音箱交流的過程中，可能會處在不同的位置和距離。這就給相關(guān)的方案提供商提出了一個難題，這也是語音識別所面臨的最大挑戰(zhàn)。

第二個問題是非穩(wěn)態(tài)的噪聲影響。如果我們面對的是規(guī)律的噪聲，應(yīng)對的辦法無疑會簡單很多。但在實際的使用環(huán)境中，我們經(jīng)常會面對的是帶有突發(fā)性和不可預(yù)見性的噪音，這給供應(yīng)商也帶來了不小的挑戰(zhàn)。

第三，多聲源的問題。智能音箱在使用的過程中，只會聽從一個聲源的指令，但在人機交流的過程中，必然會出現(xiàn)干擾源。如何處理這個干擾的問題，也困擾著相關(guān)供應(yīng)商和開發(fā)者。

而其實面對這些問題，產(chǎn)業(yè)鏈已經(jīng)想了不少應(yīng)對之法。例如麥克風(fēng)陣列、波束成形和降噪的引入，更強的人工智能芯片加持，但這依然沒有能徹底解決問題。

語音識別行業(yè)的發(fā)展現(xiàn)狀分析

如上圖所示，在傳統(tǒng)方案中，系統(tǒng)最后識別的信號是在波束成形之后做的，因為波束成形依賴于聲源定位（即DOA），但DOA一般用單MIC信號來做檢測。換而言之，我們這樣設(shè)計的目的原本是為了提升喚醒率和識別率，但依賴于單MIC信號的檢測之后，兩者之間就存在相互依賴的關(guān)系，這就會給設(shè)備的喚醒率造成影響。

其次，傳統(tǒng)方案里面有多個模塊和多個環(huán)節(jié)，但他們并不都是以降低識別率為優(yōu)化目標(biāo)，這就讓降噪、信號增強和最后的識別可能會出現(xiàn)不適配的情況，使得系統(tǒng)雖然降了噪，但沒有得到想要的識別率的提升。

再者，傳統(tǒng)的流程對硬件要求非常高，對MIC的一致性以及電容元器件的一致性要求非常高。這就節(jié)能會導(dǎo)致大家在實驗室和在量產(chǎn)線上取得不同的結(jié)果。量產(chǎn)場景下的識別率非常差。這主要與波束成形和聲源定位要求高，一旦出現(xiàn)波動會影響識別效果有關(guān)。

此外，波束成形算法原理是增強設(shè)定波束內(nèi)的信號強度，衰減波束外的信號幅度。那就意味著當(dāng)干擾聲源和目標(biāo)聲源方向非常接近的時候，信號和噪聲是會同時增強，這是傳統(tǒng)波束成形算法也不能解決的問題。

單從芯片的角度看，也有不少的困難要面對。如算力問題、馮諾依曼架構(gòu)帶來的內(nèi)存墻問題，還有基于浮點訓(xùn)練出來的模型與定點推理之間的不匹配引致的重新訓(xùn)練和精度丟失等問題。其他如對神經(jīng)網(wǎng)絡(luò)支持不夠、功耗過高和開發(fā)復(fù)雜等也是當(dāng)下很多語音識別芯片的掣肘所在。

市場渴求更好的解決方案。

基于創(chuàng)新架構(gòu)開辟新路徑

面對以上種種挑戰(zhàn)，由Marvell中國芯片研發(fā)部門前高管魯勇創(chuàng)立的探境科技正在從架構(gòu)、芯片、軟件和算法等多維度創(chuàng)新入手，幫助語音識別方案客戶解決其問題。而其顛覆性創(chuàng)新的SFA（storage First Architectur）架構(gòu)則是他們“全棧”式服務(wù)的基礎(chǔ)。

探境科技CEO魯勇先生首先告訴半導(dǎo)體行業(yè)觀察記者，他們的SFA架構(gòu)并不是大家所認(rèn)為的存算一體架構(gòu)。在他看來，現(xiàn)在很多所謂的存算一體架構(gòu)存在著成本、可靠性、算法兼容性等問題。

“我們的SFA從架構(gòu)上也是將計算和存儲單元分開，但是我們的做法是以存儲來驅(qū)動計算，并且將傳統(tǒng)AI運算時要在數(shù)據(jù)在存儲和計算單元中來回搬回多次的過程壓縮到一次卻又不影響結(jié)果精度。這是我們的核心競爭力所在，這也能很多AI語音識別芯片碰到的問題迎刃而解”，魯勇說。

從實際測試上看，探境科技AI語音芯片的表現(xiàn)優(yōu)越。據(jù)魯勇介紹，在實際測試中，探境科技的AI語音識別芯片的數(shù)據(jù)訪問可降低10~100倍，存儲子系統(tǒng)功耗下降10倍，而基于28nm工藝打造的芯片系統(tǒng)能效超過4T OPS/W。

語音識別行業(yè)的發(fā)展現(xiàn)狀分析

SFA架構(gòu)芯片與其他芯片的對比

注：在28nm專用測試芯片上得到的對比數(shù)據(jù)，測試方法為帶有卷積加速器擴展指令的DSP模式與SFA架構(gòu)模式的對比，乘法器數(shù)目相同，DRAM為LPDDR4

除了高性能的能耗比之外，這個架構(gòu)還有非常好的易用性和通用性。

魯勇指出，基于SFA架構(gòu)打造的AI芯片不是針對某一個神經(jīng)網(wǎng)絡(luò)做的優(yōu)化，可以支持所有已知的神經(jīng)網(wǎng)絡(luò)，并且能讓所有神經(jīng)網(wǎng)絡(luò)在其上面都能跑出最高的效率；同時它對參數(shù)也沒有限制，可以用任意的參數(shù)；此外，基于SFA架構(gòu)打造的芯片對數(shù)據(jù)類型也沒有限制，可以支持定點數(shù)、位點數(shù)。針對常見的稀疏數(shù)據(jù)，這個芯片也有自適應(yīng)的支持，而不用人工干預(yù)。“探境科技提供的工具鏈可以讓開發(fā)者能夠零基礎(chǔ)切入SFA架構(gòu)芯片的開發(fā)。”魯勇強調(diào)。

基于SFA架構(gòu)，探境科技開辟出了語音和圖像兩條產(chǎn)品線，其中語音產(chǎn)品已經(jīng)獲得了客戶的高度認(rèn)可。其中音旋風(fēng)611功不可沒。

據(jù)了解，這是探境科技針對智能家居市場推出的一款語音識別芯片，是目前市面上綜合性能最好，性價比最高的一款芯片。如下圖所示，它能夠支持200條的命令詞，能夠做到99%的喚醒率和極低的誤喚醒率。

至于探境科技的另一條產(chǎn)品線圖像芯片也已經(jīng)流片成功，期待探境科技用其給市場帶來更多的賦能。

音旋風(fēng)611

雖然基于SFA打造的芯片擁有多項優(yōu)勢。但正如上文所說，語音識別方案是一個涉及多個模塊的項目，芯片只是當(dāng)中的一環(huán)。為此，探境科技從多個角度入手，為語音識別方案商提供了一個交鑰匙方案。

針對前文提到的傳統(tǒng)麥克風(fēng)陣列信號增強算法的缺點，探境科技提出了一個新的處理方法，把增強和識別一體化處理，做了一個端到端的識別流程。

據(jù)探境科技的技術(shù)副總裁李同治介紹，他們在這個識別流程里放棄了用傳統(tǒng)數(shù)字信號處理算法來做語音增強的做法，而是用一套基于神經(jīng)網(wǎng)絡(luò)的AI算法來做信號增強。他指出，這個方案的處理算法所有的參數(shù)都是和神經(jīng)網(wǎng)絡(luò)一起訓(xùn)練的，這樣整體優(yōu)化的目標(biāo)都是為了降低最后的識別錯誤率，而不僅僅是提升信號質(zhì)量。

端對端的處理算法是最前沿的處理算法

“我們這套降噪算法與傳統(tǒng)的降噪算法不一樣，我們的降噪算法是基于深度學(xué)習(xí)的AI降噪算法，不僅可以處理常見的穩(wěn)態(tài)噪聲，對一些非穩(wěn)態(tài)的噪聲和突發(fā)性的噪聲也可以很好地處理。”，李同治補充說。

除了這個降噪算法以外，探境科技還開發(fā)出了專門用來做語音識別的高計算強度的神經(jīng)網(wǎng)絡(luò)HONN。據(jù)了解，高強度神經(jīng)網(wǎng)絡(luò)的參數(shù)量不大，僅為DNN的五分之一，這就讓探境科技可以用更少的參數(shù)量和更少的存儲達到了更好的效果。

與此同時，高強度計算神經(jīng)網(wǎng)絡(luò)的算力需求量很大，但DNN只有個位數(shù)的計算強度，兩者之間差了30倍。這也是為什么其他廠商并沒有使用效果更好的HONN，而是DNN的原因。因為這個算力要求對基于SFA打造的AI芯片來說是綽綽有余，但對很多其他架構(gòu)芯片來說，是難以應(yīng)付的，李同治告訴記者。

“SFA不僅僅是適配于終端，也適配于云端、推理、訓(xùn)練，可以組合成各種不同的產(chǎn)品形態(tài)，適合于終端、推理、訓(xùn)練”，魯勇最后說，但他也強調(diào)，將SFA應(yīng)用到云端會是一個很漫長的過程。我們現(xiàn)在可以看到的是，探境科技正在用他們的全棧實力在擁擠的語音AI芯片賽道上找到了屬于他們的”捷徑”。

聲明：本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點僅代表作者本人，不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用，如有內(nèi)容侵權(quán)或者其他違規(guī)問題，請聯(lián)系本站處理。舉報投訴

語音識別

語音識別

+關(guān)注

關(guān)注
38

文章
1742

瀏覽量
112711
AI芯片

AI芯片

+關(guān)注

關(guān)注
17

文章
1890

瀏覽量
35097

新型儲能產(chǎn)業(yè)發(fā)展現(xiàn)狀及趨勢-2024年上半年數(shù)據(jù)發(fā)布簡版

新型儲能產(chǎn)業(yè)發(fā)展現(xiàn)狀及趨勢-2024年上半年數(shù)據(jù)發(fā)布簡版

發(fā)表于 01-03 15:14 ?0次下載

離線語音識別技術(shù)引領(lǐng)智能語音燈具市場——NRK3502

智能語音燈具集高科技與人性化設(shè)計，內(nèi)置NRK3502離線語音識別芯片，支持遠場識別與自定義指令，提供便捷智能體驗，推動智能家居行業(yè)

發(fā)表于 12-30 15:04 ?124次閱讀

離線<b class='flag-5'>語音</b><b class='flag-5'>識別</b>技術(shù)引領(lǐng)智能<b class='flag-5'>語音</b>燈具市場——NRK3502

機器人諧波減速器的發(fā)展現(xiàn)狀與趨勢

? 機器人諧波減速器的 發(fā)展現(xiàn)狀與趨勢. ? ? ? ?

發(fā)表于 11-29 10:41 ?458次閱讀

機器人諧波減速器的<b class='flag-5'>發(fā)展現(xiàn)狀</b>與趨勢

語音識別技術(shù)的應(yīng)用與發(fā)展

語音識別技術(shù)的發(fā)展可以追溯到20世紀(jì)50年代，但直到近年來，隨著計算能力的提升和機器學(xué)習(xí)技術(shù)的進步，這項技術(shù)才真正成熟并廣泛應(yīng)用于各個領(lǐng)域。語音識別

發(fā)表于 11-26 09:20 ?541次閱讀

ASR語音識別技術(shù)應(yīng)用

語音識別技術(shù)應(yīng)用的分析：一、ASR語音識別技術(shù)原理 ASR語音

發(fā)表于 11-18 15:12 ?803次閱讀

醫(yī)療機器人發(fā)展現(xiàn)狀與趨勢

醫(yī)療機器人作為醫(yī)療領(lǐng)域與現(xiàn)代機器人科技的融合體，正逐步引領(lǐng)醫(yī)療服務(wù)向更高效、更精準(zhǔn)的方向發(fā)展。以下是對醫(yī)療機器人發(fā)展現(xiàn)狀與趨勢的詳細分析：

發(fā)表于 10-21 15:24 ?2544次閱讀

工控機廠家發(fā)展現(xiàn)狀及未來趨勢

中發(fā)揮著重要作用。本文將探討工控機廠家的發(fā)展現(xiàn)狀、市場需求、技術(shù)創(chuàng)新以及未來趨勢。一、工控機廠家發(fā)展現(xiàn)狀工控機廠家是指專門從事工業(yè)控制計算機設(shè)計、研發(fā)、生產(chǎn)和銷售的企業(yè)。在中國

發(fā)表于 09-29 11:01 ?586次閱讀

智能制造行業(yè)現(xiàn)狀與發(fā)展趨勢

智能制造行業(yè)作為現(xiàn)代制造業(yè)的重要組成部分，正經(jīng)歷著快速的發(fā)展與變革。以下是對智能制造行業(yè)現(xiàn)狀與發(fā)展趨勢的詳細

發(fā)表于 09-15 14:26 ?1423次閱讀

Transformer模型在語音識別和語音生成中的應(yīng)用優(yōu)勢

自然語言處理、語音識別、語音生成等多個領(lǐng)域展現(xiàn)出強大的潛力和廣泛的應(yīng)用前景。本文將從Transformer模型的基本原理出發(fā)，深入探討其在語音

發(fā)表于 07-03 18:24 ?1180次閱讀

2.晶體和振蕩器 行業(yè)研究及十五五規(guī)劃分析報告(行業(yè)發(fā)展現(xiàn)狀及“十五五”前景預(yù)測)

行業(yè)發(fā)展現(xiàn)狀及“十五五”前景預(yù)測2.1全球晶體和振蕩器供需現(xiàn)狀及預(yù)測（2019-2030）2.1.1全球晶體和振蕩器產(chǎn)能、產(chǎn)量、產(chǎn)能利用率及發(fā)展趨勢（2019-2030）圖14：全球晶

發(fā)表于 06-21 14:08 ?344次閱讀

STM32國內(nèi)外發(fā)展現(xiàn)狀

電子發(fā)燒友網(wǎng)站提供《STM32國內(nèi)外發(fā)展現(xiàn)狀.docx》資料免費下載

發(fā)表于 04-08 15:56 ?37次下載

萬兆電口模塊的產(chǎn)業(yè)發(fā)展現(xiàn)狀與前景展望

本文將探討萬兆電口模塊的產(chǎn)業(yè)發(fā)展現(xiàn)狀及未來前景。市場需求增長迅速，企業(yè)、數(shù)據(jù)中心、園區(qū)網(wǎng)等需求不斷推動產(chǎn)業(yè)快速發(fā)展。產(chǎn)業(yè)鏈布局完整，技術(shù)創(chuàng)新推動產(chǎn)業(yè)發(fā)展。未來市場將繼續(xù)擴大，產(chǎn)業(yè)鏈上下游企業(yè)需加強協(xié)同合作。

發(fā)表于 02-21 16:13 ?485次閱讀

工程振弦采集儀監(jiān)測技術(shù)的發(fā)展現(xiàn)狀與展望

工程振弦采集儀監(jiān)測技術(shù)的發(fā)展現(xiàn)狀與展望工程振弦采集儀監(jiān)測技術(shù)是指利用振弦采集儀對工程結(jié)構(gòu)進行振動檢測和監(jiān)測的技術(shù)。隨著工程結(jié)構(gòu)的復(fù)雜化和要求的提高，工程振弦采集儀監(jiān)測技術(shù)也在不斷發(fā)展和完善。工程

發(fā)表于 01-22 14:44 ?357次閱讀

三坐標(biāo)測量機發(fā)展現(xiàn)狀以及三坐標(biāo)國產(chǎn)化的意義

隨著中國制造業(yè)不斷發(fā)展壯大，三坐標(biāo)測量機作為一個關(guān)鍵的檢測設(shè)備，其發(fā)展現(xiàn)狀備受關(guān)注。通過國內(nèi)企業(yè)的不斷努力和政府的支持，中國三坐標(biāo)測量機市場蓬勃發(fā)展。同時，國產(chǎn)化的推動也為中國制造業(yè)帶來了更大的機遇和

發(fā)表于 01-17 09:25 ?2286次閱讀

乘用車一體化電池的發(fā)展現(xiàn)狀和未來趨勢

佐思汽研發(fā)布《2024年乘用車CTP、CTC和CTB一體化電池行業(yè)研究報告》，對乘用車一體化電池發(fā)展現(xiàn)狀及主機廠、供應(yīng)商相關(guān)產(chǎn)品布局進行了梳理研究，并對乘用車一體化電池未來發(fā)展趨勢進行預(yù)測。

發(fā)表于 01-10 14:06 ?1235次閱讀