關於華爲雲最新發布的盤古大模型，我們提了幾個問題

原創

2021-05-06 12:08

{"type":"doc","content":[{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"4 月 25 日，在華爲開發者大會（Cloud）上，華爲雲發佈了盤古系列超大規模預訓練模型，包括 30 億參數的全球最大視覺（CV）預訓練模型，以及華爲雲與循環智能、鵬城實驗室聯合開發的千億參數、40TB 訓練數據的（NLP）預訓練模型。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"image","attrs":{"src":"https:\/\/static001.infoq.cn\/resource\/image\/c0\/66\/c05910127138519c211a9bf81bf74e66.jpg","alt":null,"title":"","style":[{"key":"width","value":"75%"},{"key":"bordertype","value":"none"}],"href":"","fromPaste":false,"pastePass":false}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"其中，盤古 NLP 大模型由華爲雲、循環智能和鵬城實驗室聯合開發，具備領先的語言理解和模型生成能力：在權威的中文語言理解評測基準 CLUE 榜單中，盤古 NLP 大模型在總排行榜及分類、閱讀理解單項均排名第一，刷新三項榜單世界歷史紀錄；總排行榜得分 83.046，多項子任務得分業界領先, 向人類水平（85.61）邁進了一大步。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"image","attrs":{"src":"https:\/\/static001.infoq.cn\/resource\/image\/2b\/ca\/2b217c6ee156ba65640de68aa8f595ca.jpg","alt":null,"title":"","style":[{"key":"width","value":"75%"},{"key":"bordertype","value":"none"}],"href":"","fromPaste":false,"pastePass":false}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":"center","origin":null},"content":[{"type":"text","text":"盤古 NLP 大模型位列 CLUE 榜單總排行榜第一"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"華爲雲人工智能領域首席科學家、IEEE Fellow 田奇表示：“預訓練大模型是解決 AI 應用開發定製化和碎片化的重要方法。華爲雲盤古大模型可以實現一個 AI 大模型在衆多場景通用、泛化和規模化複製，減少對數據標註的依賴，並使用 ModelArts 平臺，讓 AI 開發由作坊式轉變爲工業化開發的新模式。”外界對華爲雲盤古大模型充滿了好奇，在華爲開發者大會（Cloud）期間，參與大模型開發的兩位華爲雲專家回答了以下幾個大家關心的問題。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":" 作爲一個開發者，請問盤古大模型的易用性如何？使用成本有多高？"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲雲專家："},{"type":"text","text":"預訓練模型設計的目的就是爲了讓大家降低使用成本。大模型的預訓練過程中，成本是比較高的，但這個成本不需要開發者來承擔。開發者在使用盤古大模型的時候，它本身的易用性會使得使用成本進一步降低，達到一個比較合適的水平。比如說，我們會開發出一些比較通俗易懂的 Pipeline，如果你是有一定基礎的開發人員，你可以從我們的 Pipeline 當中去做更多的定製化的開發，更好地去釋放預訓練模型的能力。如果你只是一個 AI 開發小白，想用大模型去做 AI 簡單的開發，我們也會給你更加通俗易懂的界面，讓大家能夠用一些拖拉拽的方式使用盤古大模型。總體來講，大家在使用預訓練模型的時候，計算時長、調參所需要重複的代價等都會被降到很低，總體來講是對開發者非常友好的。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":" 對於新入門計算機視覺的人來說，需要掌握什麼哪些知識才能快速進入到學習和研發中？"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲雲專家："},{"type":"text","text":"人工智能、計算機視覺等經過幾十年的發展，到現在已經擁有很龐大的知識體系。如果一個初學者想要把這些東西都瞭解以後再開始做研究，效率會稍微有點低。我給大家的建議是，你在學習過程當中，可以先找準一個問題。剛開始的時候，這個問題可能是相對初級的問題，但一定有具體的場景。比如想做弱監督學習，一般就是遇到某個實際的問題，它確實需要弱監督算法。但是我是不是一定要掌握全監督才能去做弱監督呢？並不是這樣的。你可以先去查閱一些資料，瞭解當前的弱監督學習方法，它的基線是什麼，它的前沿在哪裏。然後你可以開始做一些簡單的實驗。實驗的過程當中，一般會遇到一些困難或者一些疑惑。解決這些困難和疑惑的過程，一般就會把你引導到它的基礎，比如說全監督到底是怎麼做的。當你有了更多基礎以後，回過頭來，也會發現你對當前做的算法有了一個更好的理解。所以我的建議是大家可以找一本機器學習、計算機視覺這類介紹比較深入的教材去看，但是不要侷限於這個教材：一邊做具體的課題，一邊去學習知識，效率會比較高。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"盤古 CV 大模型有哪些成功的落地？跟業界相比處在什麼位置？"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲雲專家："},{"type":"text","text":"盤古 CV 大模型，結合相關流程化開發，已經在華爲內部以及其他合作項目上，有 100+ 成功落地，這些方向涵蓋了各行各業，包括工業視覺、網絡審查、零售商超，以及醫療等場景，都獲得了一些相較於之前不使用預訓練大模型更高的結果。在某些場景上，比如遙感影像分割，我們通過設計針對遙感影像的預訓練算法，在沒有增加額外標註代價的情況下，達到了最多 12% 的分割精度提升。還有另外一個比較有意思的現象，我們使用超大規模圖像進行的預訓練模型具有更好的可遷移性，即直接把這樣一個模型，遷移到了工業質檢的缺陷上進行推理，我們非常欣喜地發現，我們在下游數據集上沒有進行任何微調，但是在工業缺陷檢測上，獲得了比之前我的模型不停地高度的優化，甚至利用下游的數據微調更好的結果，這個結果基本上會高出 3 到 4 個百分點。這個啓發我們，模型數據一旦夠多，其實它的泛化能力能夠獲得更好的保障。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","text":"第二，我們是國內最早做視覺預訓練大模型的公司之一。在國外是 Facebook 和谷歌從 2019 年開始在圖像上做了一些應用。我們視覺預訓練模型大概從 2019 年底的時候就開始了，通過自研的一些列改進算法，我們首次在基於 ImageNet 的無監督預訓練模型線性分類精度上達到了全監督基線的水平，同時在小樣本學習上大大領先現有技術，這些都是業界領先的成果。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲的預訓練是採用什麼類型數據和學習任務？盤古 CV 大模型如何保證端側性能？"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲雲專家："},{"type":"text","text":"針對視覺圖像不同角度，以及不同場景的變化，盤古 CV 大模型採取的方法非常簡單。一，我們可能有海量數據集，這個數據集規模已經達到了億級甚至十億級這樣的規模，我們相信這個海量的數據集，它能夠建模實際場景圖像的方方面面。二，我們採取了什麼樣的學習方式。其實它的一個核心思想，就是 2019 年開始，比較火的基於全局的對比度自監督學習方法。我們在這上面做了很多改進。包括如何來利用弱標籤信息，如何把全局的信息拓展到局部來更好建模局部相關關係。同時也會呼應剛纔提到的，如何處理不同視角、不同尺度圖像問題，怎麼來讓它進行高效的建模，這裏面就是讓它進行不同的數據增強，我們在預訓練算法中，集成了十餘種數據增強方法，讓它通過不同的數據增強，使得整個模型具有針對不同數據增強的不變性。到目前爲止，我們在一個大模型種，搭載模型蒸餾、抽取以及行業大模型，已經適配了大概十餘種預訓練模型。這十餘種模型都是通過我們一個大模型的抽取，蒸餾所得到的，它在相應的行業上，得到了非常大的精度提升。同時也極大地減少了標註代價以及模型迭代週期。"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲雲盤古 CV 大模型是如何結合不同行業知識，解決標註數據大的問題？"}]},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null}},{"type":"paragraph","attrs":{"indent":0,"number":0,"align":null,"origin":null},"content":[{"type":"text","marks":[{"type":"strong"}],"text":"華爲雲專家："},{"type":"text","text":"舉一個我們在華爲開發者大會（Cloud）上發佈的國網重慶永川供電公司電力無人機智能巡檢的例子，這就是非常典型的利用盤古 CV 大模型解決行業問題的例子。在國網電力巡檢模型開發的過程中，它有海量的數據，標註非常困難，我們做了什麼呢？通過我們的視覺預訓練算法，在海量的巡檢數據上進行預訓練，這個預訓練是利用了無人機巡檢的數十 TB 圖像，上百萬規模的數量，進行預訓練。大模型的參數更大，數據更多，所以它能夠更好地建模無人機巡檢過程中的圖片的細微差異。利用盤古 CV 大模型，它能夠提供更好的表徵，使得標註代價減少了 80% 以上，這在人力成本上是一個非常大的節省。除了減少標註，還可以一個大模型適配我們電力巡檢領域的一百多種缺陷，從而讓模型迭代週期大大減少，整個迭代效率大概提升了 10 倍。我們在每次模型迭代過程中反饋給人需要標註的整體的工作量就會越少。通過這兩種模式，最終提升了電力無人機智能巡檢 AI 模型的整體開發效率。"}]}]}

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

相關文章

Stable Diffusion中的embedding

Stable Diffusion中的embedding 嵌入，也稱爲文本反轉，是在 Stable Diffusion 中控制圖像樣式的另一種方法。在這篇文章中，我們將學習什麼是嵌入，在哪裏可以找到它們，以及如何使用它們。什麼是嵌入embe

2024-04-25 21:31:13

AI從入門到入門之手寫數字識別模型java方式Dense全連接神經網絡實現

前言：授人以魚不如授人以漁.先學會用，在學原理，在學創造，可能一輩子用不到這種能力，但是不能不具備這種能力。這篇文章主要是介紹算法入門Helloword之手寫圖片識別模型java中如何實現以及部分解釋。目前大家對於人工智能-機器學習-神經網

2024-04-19 23:17:21

Pinecone: 大模型時代的智能索引與搜索解決方案

隨着人工智能技術的飛速發展，大模型（Large Models）已成爲衆多領域的重要工具。無論是自然語言處理、圖像識別還是其他複雜任務，大模型都展現出了強大的性能。然而，隨着模型規模的不斷擴大，數據量的激增，如何有效地管理、索引和搜索這些模型

2024-04-19 11:29:43

軟件測試從自動化到智能化，大模型開始加入

隨着科技的飛速發展，軟件行業也在不斷地演進和創新。作爲軟件行業的關鍵環節之一，軟件測試行業也在經歷着前所未有的變革。從最初的手動測試，到自動化測試，再到如今的智能化測試，軟件測試行業正在經歷一場深刻的技術革命。在這場革命中，Testin雲測

2024-04-19 00:53:25

裁員了！別錯過2024年大數據工程師必備的10項技能

在當今快速發展的世界中，數據被視爲新的石油。隨着對數據驅動洞察的日益依賴，大數據工程師的角色比以往任何時候都更爲關鍵。這些專業人員在管理和優化組織內的數據操作中扮演着至關重要的角色。在本文中，我們將探索2024年大數據工程師必須具備的十

2024-04-16 11:00:53

DevOps已死？2024年的DevOps將如何發展

隨着我們進入2024年，DevOps也隨之發生變化。新興的技術、變化的需求和發展的方法正在重新定義有效實施DevOps實踐。 IDC預測顯示，未來五年，支持DevOps實踐的產品市場繼續保持健康且快速增長，2022年-2027年的複合年增長

2024-04-08 12:51:44

從模型到部署，教你如何用Python構建機器學習API服務

本文分享自華爲雲社區《Python構建機器學習API服務從模型到部署的完整指南》，作者：檸檬味擁抱。在當今數據驅動的世界中，機器學習模型在解決各種問題中扮演着重要角色。然而，將這些模型應用到實際問題中並與其他系統集成，往往需要構建API

2024-04-08 10:33:17

測試左移已經開始影響DevOps的發展？

在軟件開發的早期，該過程通常是開發人員編寫代碼，再將其交給質量保證（QA）進行測試。這種瀑布開發方法可能會導致質量問題和延遲，因爲問題是在週期後期發現的。一、瞭解DevOps和測試左移 DevOps是Development和Operati

2024-04-07 12:48:37

黑盒Prompt優化：提升大模型反饋效果的新思路

隨着人工智能技術的快速發展，大模型在各種應用場景中發揮着越來越重要的作用。然而，如何提升大模型的反饋效果，使其更加準確、高效地爲用戶提供服務，一直是研究者和開發者關注的焦點。本文提出了一種新的思路——黑盒Prompt優化，旨在通過改進輸入提

2024-03-29 00:01:17

分佈式數據庫技術的演進和發展方向

這些年大家都在談分佈式數據庫，各大企業也紛紛開始做數據庫的分佈式改造。那麼，所謂的分佈式數據庫到底是什麼？採用什麼架構？優勢在哪？爲什麼越來越多企業選擇它？分佈式數據庫技術會向什麼方向發展？帶着這些疑問，一探究竟吧！參與文末的話題互動

2024-03-26 11:34:43

利用RAG技術打破大模型幻覺

隨着人工智能技術的不斷進步，大模型在各個領域中發揮着越來越重要的作用。然而，大模型幻覺問題一直是制約其進一步發展的瓶頸。爲了解決這一問題，研究者們不斷探索新的技術和方法。近年來，一種名爲RAG（檢索增強生成）的技術備受關注，它通過結合知識圖

2024-03-21 00:28:34

與 NVIDIA 再次合作、深度參與 GTC，Zilliz 與全球頂尖開發者共迎 AI 變革時刻！

Zilliz 與全球的頂尖開發者齊聚 GTC 2024。近日，備受關注的 NVIDIA GTC 2024 已拉開序幕，來自世界各地的頂尖 AI 開發者齊聚美國加州聖何塞會議中心，共同探索行業未來。作爲去年被 NVIDIA CEO 黃仁

2024-03-19 21:26:53

多模態+大模型會帶來哪些“化學反應”？

導語：沒人懷疑，2024 年，AI 依然將是科技界的主角。上個月，OpenAI 推出了可以生成 60 秒高清視頻的視頻生成模型 Sora，掀起了對多模態模型的進一輪討論。多模態大模型技術的最新進展如何？這一波新技術，對於行業和消費者的體驗會

2024-03-15 13:45:01

婦女節：打開 AI 視界，成就“她力量”

根據國內招聘平臺獵聘發佈的《2024 女性人才數據洞察報告》，從 2023 年 3 月到 2024 年 2 月，女性在 AIGC 領域的求職人次同比增長了 190.49%。隨着人工智能時代的降臨，女性正以前所未有的姿態，在技術的助力下，蛻變

2024-03-09 01:06:57

AI安全白皮書 | “深度僞造”產業鏈調查以及四類防禦措施

以下內容，摘編自頂象防禦雲業務安全情報中心正在製作的《“深度僞造”視頻識別與防禦白皮書》，對“深度僞造”感興趣的網友，可前往頂象留言，在該白皮書完成後，會爲您免費寄送一份電子版。 “深度僞造”就是創建高度逼真的虛假視頻或虛假錄音，然

2024-03-08 00:45:22

24小時熱門文章

最新文章

最新評論文章