7月4日、5日,百度AI開(kāi)發(fā)者大會(huì)火熱召開(kāi),會(huì)上百度向開(kāi)發(fā)者們展示了百度AI能力的核心——百度大腦3.0。
百度大腦3.0的核心是“多模態(tài)深度語(yǔ)義理解”,它不僅能讓機(jī)器聽(tīng)清、看清,更能深入理解它背后的含義,深度地理解真實(shí)世界,進(jìn)而更好地支撐各種應(yīng)用。
在下午的百度大腦分論壇上,百度展示了它在語(yǔ)音語(yǔ)義一體化、視覺(jué)語(yǔ)義化等技術(shù)上的新突破。
“小度小度,我要看電影~”
“小度小度,徐崢的老婆是誰(shuí)~”
“小度小度,聲音調(diào)大點(diǎn)~”
……
如果是識(shí)別出了幾段普通話,可能并不讓人驚奇,但這段指令卻是一段四川方言,而搭載了DuerOS的電視不僅識(shí)別出了口令,并且和人類進(jìn)行了流暢互動(dòng),這就讓在場(chǎng)的開(kāi)發(fā)者們驚奇不已了。而在這流暢交互的背后,就是百度大腦3.0在語(yǔ)音技術(shù)上的體現(xiàn)。
據(jù)百度高級(jí)副總裁、AI技術(shù)平臺(tái)體系總負(fù)責(zé)人王海峰介紹,百度大腦3.0的核心是“多模態(tài)深度語(yǔ)義理解”,“多模態(tài)深度語(yǔ)義理解”是指對(duì)文字、聲音、圖片、視頻等多模態(tài)的數(shù)據(jù)和信息進(jìn)行深層次多維度的語(yǔ)義理解,包括數(shù)據(jù)語(yǔ)義、知識(shí)語(yǔ)義、視覺(jué)語(yǔ)義、語(yǔ)音語(yǔ)義一體化和自然語(yǔ)言語(yǔ)義等多方面的語(yǔ)義理解技術(shù)。
在語(yǔ)音技術(shù)上,百度取得了三項(xiàng)重大突破:百度高噪聲環(huán)境Hand-free語(yǔ)音識(shí)別準(zhǔn)確率已提升了10個(gè)百分點(diǎn);語(yǔ)音語(yǔ)義一體化技術(shù)使得遠(yuǎn)場(chǎng)語(yǔ)音識(shí)別準(zhǔn)確率提升了10個(gè)百分點(diǎn);在語(yǔ)音合成方面,WaveNet+拼接的情感語(yǔ)音合成技術(shù),使得流暢度和自然度也大幅提升。
語(yǔ)音識(shí)別的準(zhǔn)確率是語(yǔ)音技術(shù)的基礎(chǔ),針對(duì)遠(yuǎn)場(chǎng)交互中高頻Query的識(shí)別率問(wèn)題,百度對(duì)語(yǔ)義識(shí)別的技術(shù)和框架進(jìn)行了重新設(shè)計(jì),專門(mén)為高頻Query建構(gòu)解碼空間,且對(duì)高頻Query和普通Query兩套架構(gòu)并行解碼。在動(dòng)態(tài)解碼階段,百度采用了Ranking綜合排序,以保證高頻Query的高權(quán)重。百度基于高頻Query的識(shí)別架構(gòu),目前能夠?qū)⒏哳lQuery的準(zhǔn)確性提升10個(gè)點(diǎn),并能保證普通Query的識(shí)別率不降。
多語(yǔ)種混合Query的識(shí)別是語(yǔ)音技術(shù)中攻克的難點(diǎn),百度發(fā)布的基于Deep Peak2采用的多語(yǔ)種音素組合建模,突破了以音素為基本建模單元的傳統(tǒng),對(duì)中英文統(tǒng)一建模,不僅能將建模單元減少至一千多、將解碼速度加快、解碼效率增高,且因?yàn)槟P蛯?duì)訓(xùn)練數(shù)據(jù)極高的多樣性和包容性,模型能積累更多的訓(xùn)練數(shù)據(jù),進(jìn)而大大提高對(duì)中英文混合Query的識(shí)別準(zhǔn)確率。目前,基于中文Deep Peak2的多語(yǔ)種音素組合模型已在百度多個(gè)產(chǎn)品上線,相對(duì)錯(cuò)誤率比業(yè)界最好競(jìng)品降低了20%。
技術(shù)質(zhì)量與成本最優(yōu)化是技術(shù)追求的目標(biāo),百度創(chuàng)新的WaveNet+拼接技術(shù)不僅保證了合成聲音的情感,保證了輸出聲音的穩(wěn)定性,同時(shí)降低了需要使用的數(shù)據(jù)和成本,全新的語(yǔ)音合成技術(shù)的經(jīng)濟(jì)適用性,覆蓋了更多的聊天場(chǎng)景,也讓該技術(shù)能得到大規(guī)模的工業(yè)應(yīng)用。
- 為什么年輕人不愛(ài)換手機(jī)了
- 柔宇科技未履行金額近億元被曝已6個(gè)月發(fā)不出工資
- 柔宇科技被曝已6個(gè)月發(fā)不出工資 公司回應(yīng)欠薪有補(bǔ)償方案
- 第六座“綠動(dòng)未來(lái)”環(huán)保公益圖書(shū)館落地貴州山區(qū)小學(xué)
- 窺見(jiàn)“新紀(jì)元”,2021元宇宙產(chǎn)業(yè)發(fā)展高峰論壇“廣州啟幕”
- 以人為本,景悅科技解讀智慧城市發(fā)展新理念
- 紐迪瑞科技/NDT賦能黑鯊4 Pro游戲手機(jī)打造全新一代屏幕壓感
- 清潔家電新老玩家市場(chǎng)定位清晰,攜手共進(jìn),核心技術(shù)決定未來(lái)
- 新思科技與芯耀輝在IP產(chǎn)品領(lǐng)域達(dá)成戰(zhàn)略合作伙伴關(guān)系
- 芯耀輝加速全球化部署,任命原Intel高管出任全球總裁
免責(zé)聲明:本網(wǎng)站內(nèi)容主要來(lái)自原創(chuàng)、合作伙伴供稿和第三方自媒體作者投稿,凡在本網(wǎng)站出現(xiàn)的信息,均僅供參考。本網(wǎng)站將盡力確保所提供信息的準(zhǔn)確性及可靠性,但不保證有關(guān)資料的準(zhǔn)確性及可靠性,讀者在使用前請(qǐng)進(jìn)一步核實(shí),并對(duì)任何自主決定的行為負(fù)責(zé)。本網(wǎng)站對(duì)有關(guān)資料所引致的錯(cuò)誤、不確或遺漏,概不負(fù)任何法律責(zé)任。任何單位或個(gè)人認(rèn)為本網(wǎng)站中的網(wǎng)頁(yè)或鏈接內(nèi)容可能涉嫌侵犯其知識(shí)產(chǎn)權(quán)或存在不實(shí)內(nèi)容時(shí),應(yīng)及時(shí)向本網(wǎng)站提出書(shū)面權(quán)利通知或不實(shí)情況說(shuō)明,并提供身份證明、權(quán)屬證明及詳細(xì)侵權(quán)或不實(shí)情況證明。本網(wǎng)站在收到上述法律文件后,將會(huì)依法盡快聯(lián)系相關(guān)文章源頭核實(shí),溝通刪除相關(guān)內(nèi)容或斷開(kāi)相關(guān)鏈接。