1. 創(chuàng)業(yè)頭條
  2. 前沿領域
  3. 人工智能
  4. 正文

搜狗-清華天工研究院提出ChoreoNet模型:讓數(shù)字人聞聲起舞

 2020-08-22 08:42  來源:A5專欄  我來投稿 撤稿糾錯

  阿里云優(yōu)惠券 先領券再下單

近日,搜狗分身技術團隊聯(lián)合清華大學天工智能計算研究院賈珈老師團隊共同發(fā)表的數(shù)字人技術論文《ChoreoNet:基于舞蹈動作單元的音樂-舞蹈合成框架》被2020國際頂級盛會ACM Multimedia錄用為長文。

(截圖來源:ACM Multimedia官網(wǎng)https://2020.acmmm.org)

ACM Multimedia專注于推進多種媒體的研究與應用,涉及人工智能、計算視覺、數(shù)據(jù)科學、深度學習、人機交互等多個新興領域,是中國計算機學會推薦的多媒體領域唯一A類國際學術會議,被認為是多媒體技術領域奧運級別的盛會。雖然鼓勵來自全球的各類機構分享、交流最新研究成果,但該會議論文接受率很低,只有對日常生活和技術突破具有巨大影響潛力的研究項目才會被通過。

“攻克難關”備受認可

音樂和舞蹈是與人們生活密不可分且高度相關的兩種藝術形式,近年來,“樂舞合成”也是業(yè)內(nèi)高度關注的領域。不過,早期合成基于相似度檢索進行,合成結果的多樣性有限,而目前通行的方法是利用神經(jīng)網(wǎng)絡模型,將音樂特征映射到人體骨骼關鍵點,但由于人類骨架關鍵點的高度冗余和帶噪特性,逐幀關鍵點預測非常困難,導致合成質(zhì)量有限,成為困擾業(yè)內(nèi)人士的一大“難關”。

搜狗分身技術團隊與清華天工研究院賈珈老師團隊在論文中提出了一個極具創(chuàng)造性的解決方案,該方案將人類編舞知識融合到樂舞合成框架中,設計多個舞蹈單元(CAU),并使用CAU序列預測模型,開發(fā)了一個像人類一樣根據(jù)音樂編排舞蹈動作的舞蹈合成框架——ChoreoNet。通過實驗驗證和數(shù)據(jù)對比,相較于基線法,ChoreoNet性能更好,合成動作也更加自然逼真,無論是音樂匹配度、動作自然度還是其他方面,表現(xiàn)都更加優(yōu)秀。

(截圖來源:ChoreoNet論文)

此次,該論文被ACM Multimedia認可并錄取為長文,不僅代表了搜狗AI分身技術在身體動作及姿態(tài)生成方面的突破,也從側(cè)面印證了搜狗強大的AI技術實力和能夠?qū)崿F(xiàn)持續(xù)輸出的創(chuàng)新能力。值得注意的是,搜狗是在業(yè)內(nèi)率先選擇通過音頻來驅(qū)動身體動作作為研究課題的先行者。

“死磕技術”引領方向

在搜狗的AI戰(zhàn)略版圖中,“自然交互+知識計算”是核心方向,技術研究和推動技術向產(chǎn)品的快速轉(zhuǎn)化均以此為基礎和方向,而搜狗“分身”是其中關鍵和重要一環(huán)。

在2018年發(fā)布全球首個AI合成主播之后,搜狗分身持續(xù)研究并打造更加逼真自然的數(shù)字人能力,在2D/3D數(shù)字人領域構建了音畫同步、逼真的面部表情唇動生成及驅(qū)動能力。此外,如何能夠讓數(shù)字人更加自然并且富有表現(xiàn)力也是搜狗分身的重點研究方向,其中身體動作以及姿態(tài)的表達至關重要。搜狗在首代AI合成主播問世后不到3個月的時間,便成功推出與“坐播”截然不同的“站播”合成主播,今年5月推出的3D AI合成主播不止面部細節(jié)經(jīng)得起高清鏡頭考驗,更是實現(xiàn)了自如行走。本次與清華大學天工智能計算研究院的工作選擇了音樂場景,重點研究如何提升身體動作生成及驅(qū)動的表現(xiàn)力和自然度,為AI數(shù)字人的技術探索開啟了新方向。

“未來應用”前景廣闊

人工智能是未來科技的風向標,而5G時代的到來又大大加速了這一進程。自2018年搜狗推出全球首個AI合成主播之后,能夠與普通人的生活深度交融并廣泛運用于各行各業(yè)的“AI分身”便深受關注,不少科技企業(yè)躬身入局。

從上文可以看出,搜狗從未停下突破的步伐,從2D到3D、“坐播”到“站播”、從支持單一語種到支持多語種、再到支持互動。目前搜狗分身技術已經(jīng)在司法、傳媒、會展、藝術、金融客服等多個場地落地,為新華社、央視、平安惠普、北京互聯(lián)網(wǎng)法院等打造了多個AI合成主播、AI合成客服、AI虛擬法官等,也創(chuàng)造了雅妮、新小微、新小浩、新小萌等多個經(jīng)典AI數(shù)字人形象。

由音頻驅(qū)動的數(shù)字人或數(shù)字舞蹈演員,擁有巨大的想象空間和市場化應用前景。特別是與搜狗現(xiàn)有3D數(shù)字人的技術相結合后,使用場景可以從目前集中的傳媒、金融、法律等領域向影視、娛樂領域進軍,攪動萬億規(guī)模的市場。

AI為人賦能,這是搜狗人工智能的發(fā)展理念,也是搜狗分身技術的愿景。作為一項既能解決行業(yè)痛點,又能為用戶創(chuàng)造價值,既能給社會帶來變革、又能對科技產(chǎn)生影響,同時還能持續(xù)突破和進步的前沿技術,搜狗分身的未來,無疑具備更多的可能性、極大的想象空間。

申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!

相關標簽
人工智能
ai技術

相關文章

  • IoT開發(fā)者為王,涂鴉智能硬核“靠邊站”

    IoT盛宴:涂鴉向下,產(chǎn)品向上

    標簽:
    人工智能
  • IPO觀察丨黑芝麻智能遞表港交所,車芯行業(yè)已邁向量產(chǎn)決戰(zhàn)期?

    雖然我國汽車芯片行業(yè)還處在發(fā)展初期,但已經(jīng)迸發(fā)出無限潛力。一方面,智能汽車的發(fā)展不斷帶動需求增長;另一方面,政策引導下,汽車芯片企業(yè)持續(xù)搶占高地。對此,在7月5日-7日舉辦的2023年中國汽車論壇上,中國汽車工業(yè)協(xié)會副秘書長李邵華就做出表示,“中國將成為未來汽車芯片發(fā)展的集聚地”。車規(guī)芯片行業(yè)近日的

    標簽:
    人工智能
  • 匯聚中國AI頂尖力量 云天勵飛參與華為AI大模型聯(lián)合創(chuàng)新

    2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團隊

    標簽:
    ai技術
  • 用友大易:邁入AI招聘2.0時代,讓人力資源回歸本質(zhì)

    這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特

    標簽:
    ai技術
  • 新發(fā)布的PaaS2.0,能否助力涂鴉智能再起飛?

    文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務,建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定

    標簽:
    ai技術
  • Figma股價熱情僅存1天,AI焦慮成關鍵隱憂?

    文/道哥美國設計軟件公司Figma近期在紐約證券交易所掛牌上市,首日即上演“狂飆”行情——發(fā)行價定每股33美元,開盤報價85美元,較發(fā)行價翻倍。首日收報115.50美元,較發(fā)行價大漲約250%,市值飆升至近670億美元,創(chuàng)下近30年來同等規(guī)模美股IPO的最大單日漲幅紀錄。然而,隨著短線資金獲利了結,

    標簽:
    ai智能
  • 人類首屆機器人運動會:跑歪了+撞人了+打哆嗦,但我卻看到了中國智造的未來

    8月16日,盧松松非常榮幸的成為了一名《2025世界人形機器人運動會》的觀眾。這是一場超酷的機器人運動會,也是人類給機器人辦的第一屆奧運會,來自16個國家的280支隊伍會參加500多個比賽項目。看了一天的比賽,晚上就回來寫文章,編輯短視頻。先說感悟:(1)這是人類首次給機器人辦的第一屆運動會,史無前

    標簽:
    智能機器人
  • AI「帶飛」騰訊業(yè)績

    文/一燈來源/節(jié)點財經(jīng)在當前無人敢缺席的AI軍備競賽中,巨頭們一面為巨額的資本支出焦慮,一面又向市場勾勒著未來的宏偉藍圖。在各家動輒千億級投入的背景下,市場迫切需要一份關于AI回報價值的有力證明。而騰訊,率先給出了答卷。8月13日,騰訊控股發(fā)布2025年第二季度財報。盡管資本開支同比劇增119%,達

    標簽:
    ai智能
    騰訊
  • Meta用億元薪酬發(fā)起「人才狙擊」能否買來一個AI未來?

    文/二風來源/節(jié)點財經(jīng)2025年的硅谷,一場沒有硝煙的戰(zhàn)爭正以前所未有的烈度上演。這場戰(zhàn)爭的核心武器不是代碼或芯片,而是人——那些全球僅有數(shù)千名、能夠構建未來人工智能基礎模型的頂尖大腦。在這場激烈的人才爭奪戰(zhàn)中,Meta及其首席執(zhí)行官馬克·扎克伯格(MarkZuckerberg)正扮演著最具侵略性的

    標簽:
    ai智能
  • 騰訊AI夢:克制的雄心

    關乎14億用戶的深刻變化

    標簽:
    ai智能
  • 阿里媽媽、巨量引擎、騰訊廣告,誰是當代“AI印鈔機”?

    阿里媽媽、巨量引擎、騰訊廣告,誰是當代“AI印鈔機”?

編輯推薦