

智能語音技術是人工智能應用最廣泛的技術之一,在眾多的人工智能產品中應用,此技術可以減少設備操作的學習成本,讓智能設備聽懂人類的自然語言從而更便捷地滿足用戶的需求。
智能聲學傳感器方案是一種邊緣計算的解決方案,可以解決傳統云計算模式下存在的高延遲、受限于網絡穩定性等問題,將語音處理程序放置在靠近用戶和語音數據收集點的位置,通過本地化語音處理,實現離線語音喚醒及控制。由于無需聯網,語音處理和反饋的時間較短,因此語音交互時客戶感覺不到明顯的延遲,用戶體驗較好。
歌爾微作為MEMS聲學傳感器行業龍頭企業,深耕MEMS聲學傳感器新技術研究,在智能聲學傳感器技術方面取得突破,研發出了集成AI語音芯片的智能聲學傳感器產品。該產品是在傳統MEMS聲學傳感器基礎上引入AI語音芯片,將語音信號采集部分和語音信號處理單元集成在一起的新型聲學傳感器,借助于語音芯片強大的信號處理能力,在器件本體實現語音喚醒、語音識別、事件檢測等自主功能。該方案為應用系統提供一種靈活的低功耗集成化語音解決方案。
歌爾微為客戶推出的智能聲學傳感器優點十分突出。其采用優化的專用AI語音處理芯片,達到超低的運行功耗,其支持數字信號輸出的智能聲學傳感器的總體監聽功耗小于0.5mW,達到與傳統數字式MEMS聲學傳感器相當。同時,通過疊片式集成封裝技術,將AI語音處理芯片封裝進了聲學傳感器的內部,實現了小尺寸的效果,其集成尺寸可以達到與傳統MEMS聲學傳感器相當。MEMS聲學傳感器收集到的音頻信號無需向外部網絡傳遞,直接在器件本體內AI語音處理芯片中進行信號處理,該本地化的處理方式使語音交互的延遲降低到0.5s之內,大大提升了用戶體驗。
其采用了AI語料訓練的技術,語音命令的識別率高。
語音交互是人與人之間最自然的交互方式,其使用的門檻低,幾乎不需要額外學習,也不需要設置額外的遙控器,可以解放雙手進行遠距離、無接觸式的控制,這在設備的控制應用上具有天然的優勢。尤其在全球疫情的背景之下,非接觸式的控制更是一種較為安全選擇。在智能設備的語音喚醒或命令的應用中,命令詞可根據客戶的需求進行訓練,識別率可達到95%及以上,誤識別指標可達到≤2次/24H。可以廣泛適用于燈具、空調、風扇等智能家電設備,TWS、智能手表、VR/AR等穿戴設備,以及其它需要長時間、低功耗待機等待喚醒或命令的設備。

除了實現語音喚醒、語音命令之外,智能聲學傳感器還可以通過語料的訓練實現多種聲音事件的探測。比如,可識別嬰兒啼哭的聲音、玻璃破碎的聲音、特定呼救的聲音、警笛報警的聲音、以及其它具有特征的聲音。在此模式下,智能聲學傳感器可以很簡單地讓用戶的設備具備兒童看護、危險事件警報、聲音防盜、治安監控等智能功能。



