愛奇藝 M2VOC 挑戰賽6篇論文被 ICASSP 2021 收錄，少樣本語音克隆取得重要成果

原創

爱奇艺技术产品团队

2021-06-13 07:03

{"type":"doc","content":[{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"近年來，遷移學習、風格遷移、聲碼器、聲學模型等方面的最新進展，爲低資源語音克隆的提供了潛在的解決方案。"},{"type":"link","attrs":{"href":"https:\/\/www.infoq.cn\/profile\/8307336C925D3C\/publish","title":"xxx","type":null},"content":[{"type":"text","text":"愛奇藝"}]},{"type":"text","text":"聯合西北工業大學音頻語音與語言處理研究組、新加坡國立大學、清華大學深圳國際研究生院、起源智能、希爾貝殼在ICASSP2021舉辦了多說話人多風格音色克隆大賽——M2VoC。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"M2VoC挑戰賽旨在提供一個通用的數據集以及一個公平的測試平臺，對語音克隆任務進行研究。作爲2021年聲學、語音和信號處理國際會議（ICASSP2021）信號處理挑戰旗艦任務之一，吸引了多支學術界和工業界的研究人員加入了挑戰。 "}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"本週，在"},{"type":"link","attrs":{"href":"https:\/\/2021.ieeeicassp.org","title":"xxx","type":null},"content":[{"type":"text","text":"ICASSP2021"}]},{"type":"text","text":"峯會上，M2VoC挑戰賽順利落幕，並公佈了比賽成果。共153只隊伍註冊參賽了本次挑戰賽，其中有多家學術機構和互聯網公司共同參與其中，學術機構包括北京大學，清華大學，浙江大學，上海交通大學，國立臺灣大學，哈工大，University of Crete，中科院自動化所，University of Tsukuba，Nagoya University，復旦大學，香港中文大學，中科院大學，電子科技大學等；參與互聯網公司包括虎牙，微軟，滴滴，騰訊，網易等。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"image","attrs":{"src":"https:\/\/static001.infoq.cn\/resource\/image\/93\/ea\/93193269e9c65a284ec73abcf9360fea.jpg","alt":null,"title":"","style":[{"key":"width","value":"75%"},{"key":"bordertype","value":"none"}],"href":"","fromPaste":false,"pastePass":false}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"愛奇藝多說話人多風格音色克隆大賽分爲少樣本賽道和極少樣本賽道兩大任務。在少樣本賽道方面，主辦方針對每個說話人提供100句不同說話風格的"},{"type":"link","attrs":{"href":"https:\/\/s.geekbang.org\/search\/c=0\/k=%E8%AE%AD%E7%BB%83%E6%A0%B7%E6%9C%AC\/t=","title":"xxx","type":null},"content":[{"type":"text","text":"訓練樣本"}]},{"type":"text","text":"；在極少樣本賽道方面，主辦方針對每個說話人提供5句不同說話風格的訓練樣本；同時，主辦方提供了兩個基礎庫，分別包含5000句不同說話風格的訓練樣本，供參賽者訓練基礎模型。最終，主辦方經過“說話人相似度、語音質量、風格\/表現力、發音準確率”四大標準加權作爲比賽評判標準。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"針對提交成果，愛奇藝組委會進行了兩輪主觀評估：第一輪包括所有團隊的提交，第二輪則對幾個得分最高的團隊進行了進一步評估。每個賽道的最終獲勝者是根據兩輪比賽的綜合結果選出的。考慮到在短時間內對質量、風格和相似度進行主觀評價的巨大成本，組委會採用了抽樣評價方法。第一輪和第二輪主觀聽力測試分別有66名和30名專業聽測人員參加。所有的聽測人員都是以漢語爲母語，由語言學專業的大學生和專業的語音註釋員組成。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":" "}]},{"type":"image","attrs":{"src":"https:\/\/static001.infoq.cn\/resource\/image\/ea\/c1\/ea5afdd0710b09f2c6b12a9cf90c50c1.jpg","alt":null,"title":"","style":[{"key":"width","value":"75%"},{"key":"bordertype","value":"none"}],"href":"","fromPaste":false,"pastePass":false}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"比賽彙集了業內頂尖團隊，作爲業內首個多說話人多風格音色克隆比賽，體現了當前業內和學界最高水平。本次挑戰賽共收錄18篇相關論文，其中，6篇論文被ICASSP2021收錄。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"image","attrs":{"src":"https:\/\/static001.infoq.cn\/resource\/image\/6c\/d3\/6cc06888b5d11f55a096d8b0e2dcffd3.jpg","alt":null,"title":"","style":[{"key":"width","value":"75%"},{"key":"bordertype","value":"none"}],"href":"","fromPaste":false,"pastePass":false}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":"center","origin":null},"content":[{"type":"text","text":"圖：ICASSP 2021本次挑戰賽收錄論文"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"參賽隊伍在Acoustic model、Speaker representation、Vocoder、Speaker adaptation strategy等多個方面都提出了創新，並取得了很好的效果。相關成果應用於APP口播、UGC配音、有聲書、風格化語音合成等多個應用場景，能夠滿足不斷變化的聲音定製場景，特別是基於多風格低質量語料場景下的聲音的定製。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"image","attrs":{"src":"https:\/\/static001.infoq.cn\/resource\/image\/01\/c7\/0189e7d1851d26a0095a606b0bd56bc7.jpg","alt":null,"title":"","style":[{"key":"width","value":"75%"},{"key":"bordertype","value":"none"}],"href":"","fromPaste":false,"pastePass":false}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":"center","origin":null},"content":[{"type":"text","text":"圖：各賽道第一輪評估中所有提交的MOS"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"本次愛奇藝多說話人多風格音色克隆大賽（M2VoC）是世界上第一個小資源音色克隆挑戰賽，旨在爲語音克隆任務的研究提供一個通用的數據集和一個公平的測試平臺。挑戰展示了當前語音克隆技術的性能：隨着深度學習的進步，少樣本語音克隆已經取得了相當好的性能，但單樣本語音克隆仍然是一個未解決的問題。在現實世界的語音克隆應用中，低質量（嘈雜）音頻和訓練\/適應\/推理的時間\/成本限制也是不可忽視的重要因素。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"愛奇藝也在ICASSP2021發佈了相關論文，總結本次大賽的情況。希望通過本次大賽的成果，爲音色克隆、語音識別等前沿技術的創新探索提供更多機會，進一步拓寬人工智能技術的應用空間，爲視聽行業發展提供新的可能（在"},{"type":"text","marks":[{"type":"strong"}],"text":"愛奇藝技術產品團隊"},{"type":"text","text":"微信公衆號，後臺回覆“papers”，獲取18篇挑戰賽論文合集）。"}]}]}

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

裁員了！別錯過2024年大數據工程師必備的10項技能

在當今快速發展的世界中，數據被視爲新的石油。隨着對數據驅動洞察的日益依賴，大數據工程師的角色比以往任何時候都更爲關鍵。這些專業人員在管理和優化組織內的數據操作中扮演着至關重要的角色。在本文中，我們將探索2024年大數據工程師必須具備的十

2024-04-16 11:00:53

DevOps已死？2024年的DevOps將如何發展

隨着我們進入2024年，DevOps也隨之發生變化。新興的技術、變化的需求和發展的方法正在重新定義有效實施DevOps實踐。 IDC預測顯示，未來五年，支持DevOps實踐的產品市場繼續保持健康且快速增長，2022年-2027年的複合年增長

2024-04-08 12:51:44

從模型到部署，教你如何用Python構建機器學習API服務

本文分享自華爲雲社區《Python構建機器學習API服務從模型到部署的完整指南》，作者：檸檬味擁抱。在當今數據驅動的世界中，機器學習模型在解決各種問題中扮演着重要角色。然而，將這些模型應用到實際問題中並與其他系統集成，往往需要構建API

2024-04-08 10:33:17

測試左移已經開始影響DevOps的發展？

在軟件開發的早期，該過程通常是開發人員編寫代碼，再將其交給質量保證（QA）進行測試。這種瀑布開發方法可能會導致質量問題和延遲，因爲問題是在週期後期發現的。一、瞭解DevOps和測試左移 DevOps是Development和Operati

2024-04-07 12:48:37

黑盒Prompt優化：提升大模型反饋效果的新思路

隨着人工智能技術的快速發展，大模型在各種應用場景中發揮着越來越重要的作用。然而，如何提升大模型的反饋效果，使其更加準確、高效地爲用戶提供服務，一直是研究者和開發者關注的焦點。本文提出了一種新的思路——黑盒Prompt優化，旨在通過改進輸入提

2024-03-29 00:01:17

分佈式數據庫技術的演進和發展方向

這些年大家都在談分佈式數據庫，各大企業也紛紛開始做數據庫的分佈式改造。那麼，所謂的分佈式數據庫到底是什麼？採用什麼架構？優勢在哪？爲什麼越來越多企業選擇它？分佈式數據庫技術會向什麼方向發展？帶着這些疑問，一探究竟吧！參與文末的話題互動

2024-03-26 11:34:43

利用RAG技術打破大模型幻覺

隨着人工智能技術的不斷進步，大模型在各個領域中發揮着越來越重要的作用。然而，大模型幻覺問題一直是制約其進一步發展的瓶頸。爲了解決這一問題，研究者們不斷探索新的技術和方法。近年來，一種名爲RAG（檢索增強生成）的技術備受關注，它通過結合知識圖

2024-03-21 00:28:34

與 NVIDIA 再次合作、深度參與 GTC，Zilliz 與全球頂尖開發者共迎 AI 變革時刻！

Zilliz 與全球的頂尖開發者齊聚 GTC 2024。近日，備受關注的 NVIDIA GTC 2024 已拉開序幕，來自世界各地的頂尖 AI 開發者齊聚美國加州聖何塞會議中心，共同探索行業未來。作爲去年被 NVIDIA CEO 黃仁

2024-03-19 21:26:53

多模態+大模型會帶來哪些“化學反應”？

導語：沒人懷疑，2024 年，AI 依然將是科技界的主角。上個月，OpenAI 推出了可以生成 60 秒高清視頻的視頻生成模型 Sora，掀起了對多模態模型的進一輪討論。多模態大模型技術的最新進展如何？這一波新技術，對於行業和消費者的體驗會

2024-03-15 13:45:01

婦女節：打開 AI 視界，成就“她力量”

根據國內招聘平臺獵聘發佈的《2024 女性人才數據洞察報告》，從 2023 年 3 月到 2024 年 2 月，女性在 AIGC 領域的求職人次同比增長了 190.49%。隨着人工智能時代的降臨，女性正以前所未有的姿態，在技術的助力下，蛻變

2024-03-09 01:06:57

AI安全白皮書 | “深度僞造”產業鏈調查以及四類防禦措施

以下內容，摘編自頂象防禦雲業務安全情報中心正在製作的《“深度僞造”視頻識別與防禦白皮書》，對“深度僞造”感興趣的網友，可前往頂象留言，在該白皮書完成後，會爲您免費寄送一份電子版。 “深度僞造”就是創建高度逼真的虛假視頻或虛假錄音，然

2024-03-08 00:45:22

深入學習NumPy庫在數據分析中的應用場景

在數據科學與機器學習領域，NumPy（Numerical Python）是一個經常被提及的重要工具。它是Python語言中一個非常強大的庫，提供了高性能的多維數組對象以及用於處理這些數組的工具。NumPy不僅僅是一個用於數值計算的庫，它還

2024-03-02 00:30:28

2024年首個iOS AI病毒來了！偷人臉照片，轉銀行卡餘額...

2024年2月15日，國外安全公司Group-IB宣佈，發現一個名爲“GoldPickaxe”的惡意軟件。該惡意軟件的iOS版本，誘騙用戶進行人臉識別、提交身份證件，然後基於用戶的人臉信息進行深度僞造。通過深度僞造的虛假的人臉視頻，欺詐分

2024-02-29 00:54:54

生物科學大模型：驅動生物醫學研究的未來

在當今的大數據時代，生物科學大模型已經成爲生命科學領域的前沿研究領域。生物科學大模型是指利用大規模數據和複雜算法來模擬和預測生命現象的過程。通過模擬基因、蛋白質和其他生物分子的相互作用，以及對生物系統的整體行爲進行預測，生物科學大模型可以幫

2024-02-29 00:50:33

數字化浪潮中的守護者：智能軟件測試引領行業革新

在這個被數據和軟件驅動的時代，我們正見證着一個由數字化轉型塑造的全新世界。軟件不僅是這一代信息技術的靈魂，更是數字經濟發展的堅實基石，它是製造強國、網絡強國、數字中國建設的關鍵支撐。隨着行業的蓬勃發展，軟件產業已不僅僅是社會生活和生產各個領

2024-02-24 03:08:08

24小時熱門文章

最新文章

最新評論文章