當(dāng)前位置:首頁 > 芯聞號(hào) > 充電吧
[導(dǎo)讀]近日,在剛剛落幕的IWSLT(International Workshop on Spoken Language Translation)國(guó)際頂級(jí)口語機(jī)器翻譯評(píng)測(cè)大賽上,搜狗擊敗訊飛、阿里巴巴, AP

近日,在剛剛落幕的IWSLT(International Workshop on Spoken Language Translation)國(guó)際頂級(jí)口語機(jī)器翻譯評(píng)測(cè)大賽上,搜狗擊敗訊飛、阿里巴巴, APPTEK(美國(guó)應(yīng)用科技公司)、AFRL(美國(guó)空軍研究實(shí)驗(yàn)室)以及KIT(德國(guó)卡爾斯魯厄理工學(xué)院)等國(guó)際國(guó)內(nèi)多個(gè)強(qiáng)勁對(duì)手,一舉奪得了2018年IWSLT大賽Baseline Model(基線模型)賽道冠軍,代表中國(guó)向世界彰顯了AI領(lǐng)域的技術(shù)硬實(shí)力!

表1 IWSLT大賽Baseline Model賽道最終結(jié)果

--取自IWSLT官方公布結(jié)果:https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

這是搜狗繼WMT 2017機(jī)器翻譯頂級(jí)評(píng)測(cè)大賽奪冠之后,所摘得的又一翻譯領(lǐng)域的技術(shù)桂冠。短期內(nèi)連續(xù)登頂世界第一的位置,充分證明了搜狗在翻譯行業(yè)特別是口語翻譯領(lǐng)域已位居領(lǐng)先地位。

IWSLT是什么比賽?

IWSLT是國(guó)際最具影響力的口語機(jī)器翻譯評(píng)測(cè)比賽,從2004年開始已經(jīng)舉辦了15屆。每屆比賽都吸引了世界各地機(jī)器翻譯領(lǐng)域的知名企業(yè)和研究機(jī)構(gòu)參與,本屆比賽吸引了訊飛、阿里巴巴等國(guó)內(nèi)公司,愛爾蘭ADAPT中心,美國(guó)約翰霍普金斯大學(xué),德國(guó)卡爾斯魯厄理工學(xué)院,芬蘭赫爾辛基大學(xué),英國(guó)愛丁堡大學(xué),美國(guó)AppTek公司等多家國(guó)際知名大學(xué)、研究機(jī)構(gòu)和公司參加。

表2 IWSLT2018大賽參賽情況

--取自IWSLT官方公布結(jié)果:https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

本屆IWSLT 2018的口語機(jī)器翻譯任務(wù)主要評(píng)測(cè)基于指定數(shù)據(jù)集從英語到德語的語音翻譯能力,共分為Baseline Model(基線模型賽道)和End-to-End(端到端賽道)兩個(gè)賽道,其中Baseline Model賽道主要評(píng)測(cè)語音翻譯的流水線方案,輸入語音先通過語音識(shí)別系統(tǒng)得到語音識(shí)別結(jié)果,之后將結(jié)果送入機(jī)器翻譯系統(tǒng)獲得譯文,這也是業(yè)內(nèi)最主流、效果最好的語音翻譯解決方案,市場(chǎng)上商用機(jī)器同傳、翻譯機(jī)等語音翻譯類產(chǎn)品幾乎都采用了類似的方法;End-to-End則是本次評(píng)測(cè)新增設(shè)的賽道,主要鼓勵(lì)參賽方探索基于神經(jīng)網(wǎng)絡(luò)的端到端語音翻譯解決方案,希望能夠輸入語音,基于深度神經(jīng)網(wǎng)絡(luò)模型直接輸出譯文,這種方法目前仍處于早期研究階段,受制于語音-文本平行語料難以大規(guī)模采集、算法研究不成熟等因素的限制,距離商用仍存在較大距離。本次評(píng)測(cè)中,在訓(xùn)練集、測(cè)試集相同的情況下,Baseline Model賽道最好的系統(tǒng)取得了28.09的BLEU(機(jī)器翻譯質(zhì)量評(píng)價(jià)指標(biāo),值越大代表翻譯質(zhì)量越好),而End-to-End賽道最好的系統(tǒng)僅取得了19.4的BLEU,較Baseline Model賽道相差8.69個(gè)BLEU,差距非常明顯,也證明了Baseline Model賽道評(píng)測(cè)的算法仍是目前最可行和實(shí)用的解決方案。

搜狗本次參加的是Baseline Model賽道的評(píng)測(cè),并取得了第一名的好成績(jī)。評(píng)測(cè)任務(wù)面向TED演講和大會(huì)學(xué)術(shù)報(bào)告場(chǎng)景,測(cè)試集包括來自英國(guó)、歐洲、印度等各個(gè)國(guó)家的英語演講者,存在噪聲、口音、自由表達(dá)等復(fù)雜語音現(xiàn)象,同時(shí)語言中存在大量領(lǐng)域?qū)S忻~和口語化的表達(dá)(如:大量語氣詞、錯(cuò)誤語法表達(dá)等),具有極強(qiáng)的實(shí)戰(zhàn)意義和挑戰(zhàn)性。最終,搜狗提交的系統(tǒng)BLEU值達(dá)到28.09,領(lǐng)先排名第二的科大訊飛1.6個(gè)BLEU,證明了搜狗在口語機(jī)器翻譯領(lǐng)域強(qiáng)大的實(shí)力。

AI賽道中持續(xù)發(fā)力,搜狗領(lǐng)跑語音翻譯行業(yè)

搜狗的AI戰(zhàn)略藍(lán)圖之中,語言是最核心的重頭戲。一直以來,搜狗都堅(jiān)持著“自然交互+知識(shí)計(jì)算”的人工智能核心方向,并持續(xù)深耕技術(shù),推動(dòng)技術(shù)向產(chǎn)品的快速轉(zhuǎn)化,2016年,搜狗發(fā)布了自有人機(jī)交互解決方案-知音引擎。擁有充足真實(shí)語料數(shù)據(jù)優(yōu)勢(shì)的搜狗,將語音識(shí)別與機(jī)器翻譯技術(shù)相結(jié)合,并在2016年推出了全球首款商用AI同傳系統(tǒng)-搜狗同傳,引領(lǐng)了語音翻譯技術(shù)的普及與應(yīng)用。通過數(shù)百場(chǎng)的國(guó)際會(huì)議“實(shí)戰(zhàn)”,搜狗同傳獲得了無數(shù)媒體和觀眾的好評(píng),成為當(dāng)下炙手可熱的“AI字幕君”。

與此同時(shí),搜狗也推出了一系列的智能硬件,將語音翻譯技術(shù)應(yīng)用到了更廣闊的場(chǎng)景之中,幫助用戶打破了跨國(guó)交流時(shí)的語言困境。2018年3月,搜狗推出了搜狗旅行翻譯寶,具備離線翻譯功能與拍照翻譯功能,讓馬化騰都為之心動(dòng),在朋友圈里大打廣告。作為首款智能翻譯硬件,它支持42種語言對(duì)話翻譯,解決了旅游場(chǎng)景中用戶聽不懂、看不懂、不會(huì)說等真實(shí)痛點(diǎn)。該項(xiàng)產(chǎn)品在京東平臺(tái)首發(fā)當(dāng)日即告售罄,首日銷售額破千萬。與此同時(shí),搜狗還推出了錄音翻譯筆,提供錄音轉(zhuǎn)寫、對(duì)話翻譯、同聲傳譯等功能,把AI同傳落地到了消費(fèi)級(jí)產(chǎn)品之中,開拓了語音翻譯的新航道。

眾所周知,人工智能是未來科技的風(fēng)向標(biāo)。通過這次在IWSLT比賽中的優(yōu)秀成績(jī),可以看到以搜狗為代表的國(guó)產(chǎn)科技巨頭企業(yè),已表現(xiàn)出了引領(lǐng)行業(yè)的技術(shù)硬實(shí)力。

本站聲明: 本文章由作者或相關(guān)機(jī)構(gòu)授權(quán)發(fā)布,目的在于傳遞更多信息,并不代表本站贊同其觀點(diǎn),本站亦不保證或承諾內(nèi)容真實(shí)性等。需要轉(zhuǎn)載請(qǐng)聯(lián)系該專欄作者,如若文章內(nèi)容侵犯您的權(quán)益,請(qǐng)及時(shí)聯(lián)系本站刪除。
換一批
延伸閱讀

9月2日消息,不造車的華為或?qū)⒋呱龈蟮莫?dú)角獸公司,隨著阿維塔和賽力斯的入局,華為引望愈發(fā)顯得引人矚目。

關(guān)鍵字: 阿維塔 塞力斯 華為

倫敦2024年8月29日 /美通社/ -- 英國(guó)汽車技術(shù)公司SODA.Auto推出其旗艦產(chǎn)品SODA V,這是全球首款涵蓋汽車工程師從創(chuàng)意到認(rèn)證的所有需求的工具,可用于創(chuàng)建軟件定義汽車。 SODA V工具的開發(fā)耗時(shí)1.5...

關(guān)鍵字: 汽車 人工智能 智能驅(qū)動(dòng) BSP

北京2024年8月28日 /美通社/ -- 越來越多用戶希望企業(yè)業(yè)務(wù)能7×24不間斷運(yùn)行,同時(shí)企業(yè)卻面臨越來越多業(yè)務(wù)中斷的風(fēng)險(xiǎn),如企業(yè)系統(tǒng)復(fù)雜性的增加,頻繁的功能更新和發(fā)布等。如何確保業(yè)務(wù)連續(xù)性,提升韌性,成...

關(guān)鍵字: 亞馬遜 解密 控制平面 BSP

8月30日消息,據(jù)媒體報(bào)道,騰訊和網(wǎng)易近期正在縮減他們對(duì)日本游戲市場(chǎng)的投資。

關(guān)鍵字: 騰訊 編碼器 CPU

8月28日消息,今天上午,2024中國(guó)國(guó)際大數(shù)據(jù)產(chǎn)業(yè)博覽會(huì)開幕式在貴陽舉行,華為董事、質(zhì)量流程IT總裁陶景文發(fā)表了演講。

關(guān)鍵字: 華為 12nm EDA 半導(dǎo)體

8月28日消息,在2024中國(guó)國(guó)際大數(shù)據(jù)產(chǎn)業(yè)博覽會(huì)上,華為常務(wù)董事、華為云CEO張平安發(fā)表演講稱,數(shù)字世界的話語權(quán)最終是由生態(tài)的繁榮決定的。

關(guān)鍵字: 華為 12nm 手機(jī) 衛(wèi)星通信

要點(diǎn): 有效應(yīng)對(duì)環(huán)境變化,經(jīng)營(yíng)業(yè)績(jī)穩(wěn)中有升 落實(shí)提質(zhì)增效舉措,毛利潤(rùn)率延續(xù)升勢(shì) 戰(zhàn)略布局成效顯著,戰(zhàn)新業(yè)務(wù)引領(lǐng)增長(zhǎng) 以科技創(chuàng)新為引領(lǐng),提升企業(yè)核心競(jìng)爭(zhēng)力 堅(jiān)持高質(zhì)量發(fā)展策略,塑強(qiáng)核心競(jìng)爭(zhēng)優(yōu)勢(shì)...

關(guān)鍵字: 通信 BSP 電信運(yùn)營(yíng)商 數(shù)字經(jīng)濟(jì)

北京2024年8月27日 /美通社/ -- 8月21日,由中央廣播電視總臺(tái)與中國(guó)電影電視技術(shù)學(xué)會(huì)聯(lián)合牽頭組建的NVI技術(shù)創(chuàng)新聯(lián)盟在BIRTV2024超高清全產(chǎn)業(yè)鏈發(fā)展研討會(huì)上宣布正式成立。 活動(dòng)現(xiàn)場(chǎng) NVI技術(shù)創(chuàng)新聯(lián)...

關(guān)鍵字: VI 傳輸協(xié)議 音頻 BSP

北京2024年8月27日 /美通社/ -- 在8月23日舉辦的2024年長(zhǎng)三角生態(tài)綠色一體化發(fā)展示范區(qū)聯(lián)合招商會(huì)上,軟通動(dòng)力信息技術(shù)(集團(tuán))股份有限公司(以下簡(jiǎn)稱"軟通動(dòng)力")與長(zhǎng)三角投資(上海)有限...

關(guān)鍵字: BSP 信息技術(shù)
關(guān)閉
關(guān)閉