1. 創(chuàng)業(yè)頭條
  2. 前沿領(lǐng)域
  3. 人工智能
  4. 正文

搜狗擊敗訊飛阿里,獲IWSLT國(guó)際口語(yǔ)機(jī)器翻譯評(píng)測(cè)大賽冠軍

 2018-10-31 10:40  來(lái)源:互聯(lián)網(wǎng)  我來(lái)投稿 撤稿糾錯(cuò)

  阿里云優(yōu)惠券 先領(lǐng)券再下單

近日,在剛剛落幕的IWSLT(International Workshop on Spoken Language Translation)國(guó)際頂級(jí)口語(yǔ)機(jī)器翻譯評(píng)測(cè)大賽上,搜狗擊敗訊飛、阿里巴巴, APPTEK(美國(guó)應(yīng)用科技公司)、AFRL(美國(guó)空軍研究實(shí)驗(yàn)室)以及KIT(德國(guó)卡爾斯魯厄理工學(xué)院)等國(guó)際國(guó)內(nèi)多個(gè)強(qiáng)勁對(duì)手,一舉奪得了2018年IWSLT大賽Baseline Model(基線(xiàn)模型)賽道冠軍,代表中國(guó)向世界彰顯了AI領(lǐng)域的技術(shù)硬實(shí)力!

表1 IWSLT大賽Baseline Model賽道最終結(jié)果

--取自IWSLT官方公布結(jié):https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

這是搜狗繼WMT 2017機(jī)器翻譯頂級(jí)評(píng)測(cè)大賽奪冠之后,所摘得的又一翻譯領(lǐng)域的技術(shù)桂冠。短期內(nèi)連續(xù)登頂世界第一的位置,充分證明了搜狗在翻譯行業(yè)特別是口語(yǔ)翻譯領(lǐng)域已位居領(lǐng)先地位。

IWSLT是什么比賽?

IWSLT是國(guó)際最具影響力的口語(yǔ)機(jī)器翻譯評(píng)測(cè)比賽,從2004年開(kāi)始已經(jīng)舉辦了15屆。每屆比賽都吸引了世界各地機(jī)器翻譯領(lǐng)域的知名企業(yè)和研究機(jī)構(gòu)參與,本屆比賽吸引了訊飛、阿里巴巴等國(guó)內(nèi)公司,愛(ài)爾蘭ADAPT中心,美國(guó)約翰霍普金斯大學(xué),德國(guó)卡爾斯魯厄理工學(xué)院,芬蘭赫爾辛基大學(xué),英國(guó)愛(ài)丁堡大學(xué),美國(guó)AppTek公司等多家國(guó)際知名大學(xué)、研究機(jī)構(gòu)和公司參加。

表2 IWSLT2018大賽參賽情況

--取自IWSLT官方公布結(jié)果:

:https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

本屆IWSLT 2018的口語(yǔ)機(jī)器翻譯任務(wù)主要評(píng)測(cè)基于指定數(shù)據(jù)集從英語(yǔ)到德語(yǔ)的語(yǔ)音翻譯能力,共分為Baseline Model(基線(xiàn)模型賽道)和End-to-End(端到端賽道)兩個(gè)賽道,其中Baseline Model賽道主要評(píng)測(cè)語(yǔ)音翻譯的流水線(xiàn)方案,輸入語(yǔ)音先通過(guò)語(yǔ)音識(shí)別系統(tǒng)得到語(yǔ)音識(shí)別結(jié)果,之后將結(jié)果送入機(jī)器翻譯系統(tǒng)獲得譯文,這也是業(yè)內(nèi)最主流、效果最好的語(yǔ)音翻譯解決方案,市場(chǎng)上商用機(jī)器同傳、翻譯機(jī)等語(yǔ)音翻譯類(lèi)產(chǎn)品幾乎都采用了類(lèi)似的方法;End-to-End則是本次評(píng)測(cè)新增設(shè)的賽道,主要鼓勵(lì)參賽方探索基于神經(jīng)網(wǎng)絡(luò)的端到端語(yǔ)音翻譯解決方案,希望能夠輸入語(yǔ)音,基于深度神經(jīng)網(wǎng)絡(luò)模型直接輸出譯文,這種方法目前仍處于早期研究階段,受制于語(yǔ)音-文本平行語(yǔ)料難以大規(guī)模采集、算法研究不成熟等因素的限制,距離商用仍存在較大距離。本次評(píng)測(cè)中,在訓(xùn)練集、測(cè)試集相同的情況下,Baseline Model賽道最好的系統(tǒng)取得了28.09的BLEU(機(jī)器翻譯質(zhì)量評(píng)價(jià)指標(biāo),值越大代表翻譯質(zhì)量越好),而End-to-End賽道最好的系統(tǒng)僅取得了19.4的BLEU,較Baseline Model賽道相差8.69個(gè)BLEU,差距非常明顯,也證明了Baseline Model賽道評(píng)測(cè)的算法仍是目前最可行和實(shí)用的解決方案。

搜狗本次參加的是Baseline Model賽道的評(píng)測(cè),并取得了第一名的好成績(jī)。評(píng)測(cè)任務(wù)面向TED演講和大會(huì)學(xué)術(shù)報(bào)告場(chǎng)景,測(cè)試集包括來(lái)自英國(guó)、歐洲、印度等各個(gè)國(guó)家的英語(yǔ)演講者,存在噪聲、口音、自由表達(dá)等復(fù)雜語(yǔ)音現(xiàn)象,同時(shí)語(yǔ)言中存在大量領(lǐng)域?qū)S忻~和口語(yǔ)化的表達(dá)(如:大量語(yǔ)氣詞、錯(cuò)誤語(yǔ)法表達(dá)等),具有極強(qiáng)的實(shí)戰(zhàn)意義和挑戰(zhàn)性。最終,搜狗提交的系統(tǒng)BLEU值達(dá)到28.09,領(lǐng)先排名第二的科大訊飛1.6個(gè)BLEU,證明了搜狗在口語(yǔ)機(jī)器翻譯領(lǐng)域強(qiáng)大的實(shí)力。

AI賽道中持續(xù)發(fā)力,搜狗領(lǐng)跑語(yǔ)音翻譯行業(yè)

搜狗的AI戰(zhàn)略藍(lán)圖之中,語(yǔ)言是最核心的重頭戲。一直以來(lái),搜狗都堅(jiān)持著“自然交互+知識(shí)計(jì)算”的人工智能核心方向,并持續(xù)深耕技術(shù),推動(dòng)技術(shù)向產(chǎn)品的快速轉(zhuǎn)化,2016年,搜狗發(fā)布了自有人機(jī)交互解決方案-知音引擎。擁有充足真實(shí)語(yǔ)料數(shù)據(jù)優(yōu)勢(shì)的搜狗,將語(yǔ)音識(shí)別與機(jī)器翻譯技術(shù)相結(jié)合,并在2016年推出了全球首款商用AI同傳系統(tǒng)-搜狗同傳,引領(lǐng)了語(yǔ)音翻譯技術(shù)的普及與應(yīng)用。通過(guò)數(shù)百場(chǎng)的國(guó)際會(huì)議“實(shí)戰(zhàn)”,搜狗同傳獲得了無(wú)數(shù)媒體和觀眾的好評(píng),成為當(dāng)下炙手可熱的“AI字幕君”。

與此同時(shí),搜狗也推出了一系列的智能硬件,將語(yǔ)音翻譯技術(shù)應(yīng)用到了更廣闊的場(chǎng)景之中,幫助用戶(hù)打破了跨國(guó)交流時(shí)的語(yǔ)言困境。2018年3月,搜狗推出了搜狗旅行翻譯寶,具備離線(xiàn)翻譯功能與拍照翻譯功能,讓馬化騰都為之心動(dòng),在朋友圈里大打廣告。作為首款智能翻譯硬件,它支持42種語(yǔ)言對(duì)話(huà)翻譯,解決了旅游場(chǎng)景中用戶(hù)聽(tīng)不懂、看不懂、不會(huì)說(shuō)等真實(shí)痛點(diǎn)。該項(xiàng)產(chǎn)品在京東平臺(tái)首發(fā)當(dāng)日即告售罄,首日銷(xiāo)售額破千萬(wàn)。與此同時(shí),搜狗還推出了錄音翻譯筆,提供錄音轉(zhuǎn)寫(xiě)、對(duì)話(huà)翻譯、同聲傳譯等功能,把AI同傳落地到了消費(fèi)級(jí)產(chǎn)品之中,開(kāi)拓了語(yǔ)音翻譯的新航道。

眾所周知,人工智能是未來(lái)科技的風(fēng)向標(biāo)。通過(guò)這次在IWSLT比賽中的優(yōu)秀成績(jī),可以看到以搜狗為代表的國(guó)產(chǎn)科技巨頭企業(yè),已表現(xiàn)出了引領(lǐng)行業(yè)的技術(shù)硬實(shí)力。

申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!

相關(guān)標(biāo)簽
搜狗翻譯
ai技術(shù)

相關(guān)文章

  • 匯聚中國(guó)AI頂尖力量 云天勵(lì)飛參與華為AI大模型聯(lián)合創(chuàng)新

    2023年7月6日,第六屆世界人工智能大會(huì)(WAIC2023)在上海開(kāi)幕,“人工智能大模型”是本屆大會(huì)的備受矚目的話(huà)題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊(duì)”,云天勵(lì)飛作為中國(guó)人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠(chǎng)、運(yùn)營(yíng)商、科研院所等優(yōu)秀團(tuán)隊(duì)

    標(biāo)簽:
    ai技術(shù)
  • 用友大易:邁入AI招聘2.0時(shí)代,讓人力資源回歸本質(zhì)

    這幾個(gè)月來(lái),以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個(gè)名詞重回C位。過(guò)去在AI1.0時(shí)代,主要通過(guò)訓(xùn)練模型來(lái)實(shí)現(xiàn)圖像識(shí)別、聲音識(shí)別、語(yǔ)言處理等特

    標(biāo)簽:
    ai技術(shù)
  • 新發(fā)布的PaaS2.0,能否助力涂鴉智能再起飛?

    文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個(gè)新故事。6月29日,涂鴉智能在開(kāi)發(fā)者大會(huì)上,發(fā)布了企業(yè)級(jí)戰(zhàn)略PaaS2.0,希望通過(guò)一個(gè)平臺(tái)+四大開(kāi)發(fā)服務(wù),建立起IoT生態(tài)。對(duì)于這場(chǎng)發(fā)布會(huì),市場(chǎng)的態(tài)度是積極的。美東時(shí)間6月29日收盤(pán),涂鴉智能美股股價(jià)上漲5.6%,來(lái)到1.87美元/股。近日股價(jià)穩(wěn)定

    標(biāo)簽:
    ai技術(shù)
  • 大模型難掩AI制藥的悲傷:越過(guò)山丘,無(wú)人等候

    美團(tuán)曾經(jīng)的二號(hào)人物王慧文對(duì)標(biāo)OpenAI的創(chuàng)業(yè)項(xiàng)目光年之外,以20億賣(mài)給美團(tuán),再度引發(fā)市場(chǎng)對(duì)大模型的熱議。

    標(biāo)簽:
    ai技術(shù)
  • 拾起王慧文的AI夢(mèng),美團(tuán)沖向“光年之外”?

    2020年底,王慧文在朋友圈寫(xiě)下這句話(huà)時(shí),外界本以為這位伴隨中國(guó)互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺(tái)。但是,一個(gè)曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。

    標(biāo)簽:
    ai技術(shù)
  • Figma股價(jià)熱情僅存1天,AI焦慮成關(guān)鍵隱憂(yōu)?

    文/道哥美國(guó)設(shè)計(jì)軟件公司Figma近期在紐約證券交易所掛牌上市,首日即上演“狂飆”行情——發(fā)行價(jià)定每股33美元,開(kāi)盤(pán)報(bào)價(jià)85美元,較發(fā)行價(jià)翻倍。首日收?qǐng)?bào)115.50美元,較發(fā)行價(jià)大漲約250%,市值飆升至近670億美元,創(chuàng)下近30年來(lái)同等規(guī)模美股IPO的最大單日漲幅紀(jì)錄。然而,隨著短線(xiàn)資金獲利了結(jié),

    標(biāo)簽:
    ai智能
  • 人類(lèi)首屆機(jī)器人運(yùn)動(dòng)會(huì):跑歪了+撞人了+打哆嗦,但我卻看到了中國(guó)智造的未來(lái)

    8月16日,盧松松非常榮幸的成為了一名《2025世界人形機(jī)器人運(yùn)動(dòng)會(huì)》的觀眾。這是一場(chǎng)超酷的機(jī)器人運(yùn)動(dòng)會(huì),也是人類(lèi)給機(jī)器人辦的第一屆奧運(yùn)會(huì),來(lái)自16個(gè)國(guó)家的280支隊(duì)伍會(huì)參加500多個(gè)比賽項(xiàng)目。看了一天的比賽,晚上就回來(lái)寫(xiě)文章,編輯短視頻。先說(shuō)感悟:(1)這是人類(lèi)首次給機(jī)器人辦的第一屆運(yùn)動(dòng)會(huì),史無(wú)前

    標(biāo)簽:
    智能機(jī)器人
  • AI「帶飛」騰訊業(yè)績(jī)

    文/一燈來(lái)源/節(jié)點(diǎn)財(cái)經(jīng)在當(dāng)前無(wú)人敢缺席的AI軍備競(jìng)賽中,巨頭們一面為巨額的資本支出焦慮,一面又向市場(chǎng)勾勒著未來(lái)的宏偉藍(lán)圖。在各家動(dòng)輒千億級(jí)投入的背景下,市場(chǎng)迫切需要一份關(guān)于AI回報(bào)價(jià)值的有力證明。而騰訊,率先給出了答卷。8月13日,騰訊控股發(fā)布2025年第二季度財(cái)報(bào)。盡管資本開(kāi)支同比劇增119%,達(dá)

    標(biāo)簽:
    ai智能
    騰訊
  • Meta用億元薪酬發(fā)起「人才狙擊」能否買(mǎi)來(lái)一個(gè)AI未來(lái)?

    文/二風(fēng)來(lái)源/節(jié)點(diǎn)財(cái)經(jīng)2025年的硅谷,一場(chǎng)沒(méi)有硝煙的戰(zhàn)爭(zhēng)正以前所未有的烈度上演。這場(chǎng)戰(zhàn)爭(zhēng)的核心武器不是代碼或芯片,而是人——那些全球僅有數(shù)千名、能夠構(gòu)建未來(lái)人工智能基礎(chǔ)模型的頂尖大腦。在這場(chǎng)激烈的人才爭(zhēng)奪戰(zhàn)中,Meta及其首席執(zhí)行官馬克·扎克伯格(MarkZuckerberg)正扮演著最具侵略性的

    標(biāo)簽:
    ai智能
  • 騰訊AI夢(mèng):克制的雄心

    關(guān)乎14億用戶(hù)的深刻變化

    標(biāo)簽:
    ai智能
  • 阿里媽媽、巨量引擎、騰訊廣告,誰(shuí)是當(dāng)代“AI印鈔機(jī)”?

    阿里媽媽、巨量引擎、騰訊廣告,誰(shuí)是當(dāng)代“AI印鈔機(jī)”?

熱門(mén)排行

編輯推薦