搜狗發(fā)布“個(gè)性化語(yǔ)音識(shí)別”,能知人善察你的每句口頭禪
專業(yè)機(jī)構(gòu)發(fā)布《2019年語(yǔ)音技術(shù)》報(bào)告稱,語(yǔ)音將成為未來(lái)十年決定性主題之一,與人工智能一起從根本上改變?nèi)伺c機(jī)器的關(guān)系。近日,搜狗輸入法在語(yǔ)音輸入領(lǐng)域率先推出“個(gè)性化語(yǔ)音識(shí)別”功能,突破語(yǔ)音識(shí)別技術(shù)瓶頸,大幅優(yōu)化個(gè)人詞匯錄入的直接準(zhǔn)確性,在語(yǔ)音輸入領(lǐng)域?qū)崿F(xiàn)“更懂用戶”。
搜狗“個(gè)性化語(yǔ)音識(shí)別”打造用戶專屬輸入法在日常交流中,個(gè)人口頭禪、慣用語(yǔ)經(jīng)常會(huì)干擾雙方的信息傳達(dá),這一問(wèn)題在人機(jī)語(yǔ)音交互中尤為凸顯。在語(yǔ)音輸入時(shí),往往用戶只是想錄入一個(gè)名稱,輸入結(jié)果卻顯示的是音同意不同的另一項(xiàng)結(jié)果。比如,當(dāng)用戶希望輸入法顯示人名“憑遠(yuǎn)”時(shí),通用的語(yǔ)音識(shí)別往往將大眾常用的“平原、品源”列在前列的候選詞匯,用戶的個(gè)性化內(nèi)容并不在其中。除此之外,用戶習(xí)慣使用的個(gè)人詞匯,以及一些多音字、讀音差錯(cuò)也會(huì)對(duì)語(yǔ)音識(shí)別結(jié)果造成影響。基于以上原因,搜狗語(yǔ)音率先對(duì)語(yǔ)音識(shí)別技術(shù)進(jìn)行了革新優(yōu)化,推出“個(gè)性化語(yǔ)音識(shí)別”服務(wù)。經(jīng)過(guò)本輪更新,用戶只需在搜狗輸入法App選擇一鍵登錄個(gè)人賬戶,即可體驗(yàn)此項(xiàng)服務(wù)。成功開(kāi)啟后,“個(gè)性化語(yǔ)音識(shí)別”會(huì)通過(guò)強(qiáng)化學(xué)習(xí)用戶習(xí)慣使用的個(gè)人詞匯,為每個(gè)用戶建立定制化語(yǔ)音輸入法。此后,在用戶需要進(jìn)行語(yǔ)音輸入時(shí),輸入法會(huì)根據(jù)語(yǔ)言環(huán)境,結(jié)合上下段落語(yǔ)句進(jìn)行分析,快速輸出符合用戶心意的文本內(nèi)容,有效減少用戶手動(dòng)進(jìn)行二次更改的頻率。搜狗語(yǔ)音又誕生“黑科技”語(yǔ)音識(shí)別更精準(zhǔn)搜狗“個(gè)性化語(yǔ)音識(shí)別”不僅可有效提升用戶個(gè)性化詞句的識(shí)別準(zhǔn)確率,同時(shí)全自動(dòng)詞庫(kù)學(xué)習(xí)這一特色極大保證了系統(tǒng)的處理及反饋速度,實(shí)現(xiàn)整個(gè)學(xué)習(xí)個(gè)性化特征的過(guò)程在“毫秒級(jí)別”就可以全部自動(dòng)完成。通過(guò)DTSS(Deep Transformer-based Sequence to Sequence model)的端到端聲學(xué)模型、神經(jīng)網(wǎng)絡(luò)語(yǔ)言模型和智能標(biāo)點(diǎn)預(yù)測(cè)等技術(shù),搜狗輸入法引入前沿深度學(xué)習(xí)技術(shù),對(duì)語(yǔ)音識(shí)別進(jìn)行仿真模擬和訓(xùn)練,有效提高語(yǔ)音錄入在通用場(chǎng)景下的識(shí)別準(zhǔn)確性,精準(zhǔn)度已達(dá)到領(lǐng)先業(yè)內(nèi)。“個(gè)性化語(yǔ)音識(shí)別”可基于用戶數(shù)據(jù)分析,對(duì)用戶習(xí)慣使用的個(gè)性化詞組進(jìn)行掃描記錄,在語(yǔ)音輸入時(shí),優(yōu)先選擇用戶習(xí)慣用語(yǔ)進(jìn)行文本輸出。通過(guò)此項(xiàng)技術(shù)革新,在保障通用識(shí)別準(zhǔn)確性的前提下,使用戶常用語(yǔ)的字詞錯(cuò)誤率下降40%,攻克語(yǔ)音識(shí)別精準(zhǔn)化的技術(shù)難關(guān)。掌控AI從個(gè)性化語(yǔ)音識(shí)別開(kāi)始手和舌頭是人類最靈活的兩個(gè)部分,從移動(dòng)智能設(shè)備發(fā)展以來(lái),各種觸控交互無(wú)不依賴于手的操作。而當(dāng)語(yǔ)音技術(shù)和人工智能同時(shí)走向成熟時(shí),或許就像《2019語(yǔ)音技術(shù)報(bào)告》中所描述的那樣:語(yǔ)音交互扭轉(zhuǎn)了以往人機(jī)交互的存在形態(tài),用戶與設(shè)備間基于語(yǔ)音交互的全新關(guān)系開(kāi)始搭建,與之前互聯(lián)網(wǎng)向移動(dòng)互聯(lián)網(wǎng)過(guò)渡一樣,其對(duì)底層平臺(tái)的全新需求也在醞釀當(dāng)中。新時(shí)代即將來(lái)臨,為應(yīng)對(duì)人工智能、虛擬現(xiàn)實(shí)等技術(shù)的革新以及不同維度、多場(chǎng)景使用的需要,用戶輸入法的使用習(xí)慣逐漸向語(yǔ)音輸入轉(zhuǎn)移。同時(shí),與文本輸入相比,語(yǔ)音輸入注定成為最主要的人機(jī)互動(dòng)接口。優(yōu)化語(yǔ)音識(shí)別技術(shù),為用戶提供更自然、更便利、更高效的語(yǔ)音錄入服務(wù),是智慧輸入法的發(fā)展趨勢(shì)。隨著語(yǔ)音識(shí)別技術(shù)的不斷成熟,以及用戶個(gè)性化詞庫(kù)的不斷豐富,搜狗將聚合用戶級(jí)語(yǔ)音個(gè)性化資源,實(shí)現(xiàn)“定制化語(yǔ)音輸入法”。使每個(gè)用戶基于“定制版”、“更懂自己”的搜狗語(yǔ)音識(shí)別的支持,在日常生活以及醫(yī)療、法律等專業(yè)領(lǐng)域,有效提高線上交流和人機(jī)溝通的效率及準(zhǔn)確度,或?qū)⒊蔀槿斯ぶ悄軙r(shí)代輸入端的全局掌控者。
來(lái)源:東方網(wǎng)
- 免責(zé)聲明
- 本文所包含的觀點(diǎn)僅代表作者個(gè)人看法,不代表新火種的觀點(diǎn)。在新火種上獲取的所有信息均不應(yīng)被視為投資建議。新火種對(duì)本文可能提及或鏈接的任何項(xiàng)目不表示認(rèn)可。 交易和投資涉及高風(fēng)險(xiǎn),讀者在采取與本文內(nèi)容相關(guān)的任何行動(dòng)之前,請(qǐng)務(wù)必進(jìn)行充分的盡職調(diào)查。最終的決策應(yīng)該基于您自己的獨(dú)立判斷。新火種不對(duì)因依賴本文觀點(diǎn)而產(chǎn)生的任何金錢(qián)損失負(fù)任何責(zé)任。