欧美三级一区 I 亚洲一本大道av久在线播放 I 神马影院一区二区 I 欧美日韩亚洲国产综合 I 午夜日韩福利 I 久久久久免费精品国产 I 小小拗女性bbwxxxx国产 I 精品日韩一区 I 天天射天天搞 I 久久精品极品盛宴观看 I 日韩欧美高清一区二区 I 国产日韩欧美网站 I 欧美在线天堂 I 久草91视频 I 99精品久久久久久久婷婷 I 天天网综合 I 黄色av播放 I 福利片一区二区 I 国产一区二区不卡老阿姨 I 91九色蝌蚪在线观看 I 亚洲 国产 日韩在线 精品 I 久久国内精品自在自线图片 I 华人在线视频 I 日韩城人免费 I 色小妹影院 I 久久亚洲人成综合网 I 久操中文在线 I 午夜精品三级久久久有码 I 天堂无码人妻精品av一区 I 久久亚洲精中文字幕冲田杏梨 I 精品少妇无码一区二区三批 I 女生裸体视频一区二区三区 I 91久久精品www人人做人人爽 I 欧洲做爰大片 I 一区二区三区中文字幕精品精品

首頁 > 汽車生活 > 汽車生活 > 世界級成果亮相智源大會,北京人工智能數據運營平臺發布

世界級成果亮相智源大會,北京人工智能數據運營平臺發布

發布時間:2024-06-15 16:28:57

數據量超過700萬億字節的通用數據集和4.33萬億字節的行業數據集,在同一個平臺匯聚。6月14日,北京人工智能數據運營平臺在2024北京智源大會上發布,“行業數據集-場景應用創新計劃”也同步啟動。北京智源人工智能研究院理事長、北京大學教授黃鐵軍表示,構建大模型生態首先要建立數據流通機制,推動從數據到智能的正反饋。

匯聚數據超700 萬億字節

“如果沒有開源數據集,很難想象過去十幾年,人工智能怎樣才能實現如此快速的迭代。然而,這些數據集還遠遠不夠。”智源研究院副院長兼總工程師林詠華坦言,特別是中文互聯網的數據量相差甚遠,“數據孤島”問題也較為嚴重。

本次發布的北京人工智能數據運營平臺,匯聚了大量通用數據、行業數據,支持文本、圖像、視頻等多種模態,并打造了全流程的數據處理工具。超過700萬億字節的通用數據集可以開展通用模型訓練,同時,4.33萬億字節的行業垂類數據對模型訓練也極為重要。


當前已知的全球開源行業文本類數據集總量僅約1.2萬億字節。“這次開源的行業數據集,幾乎每一項都遠超全球已經開源的該行業數據集總和,是全球最大的多行業中英雙語數據集。”林詠華說,目前數據集包含醫療、教育、法律、新聞等18類行業數據,未來將進一步擴展到30類左右。

針對不同數據特點,平臺明確了3種數據使用方式。一批公開領域采集的數據集將開源開放,用戶可以免費下載;有意向互換高質量數據集的主體,可以參與構建數據池,合作共建、共享數據集;高價值數據集則通過數算一體模式,確保模型在加工、訓練過程中,數據不出安全域,保障數據安全。

挑戰多模態模型新路線

“智源研究院在2021年就發布了悟道1.0和2.0大模型,當年創造了‘中國首個’‘全球最大’等一系列紀錄。可以說,智源與大模型有著緊密的關聯。”智源研究院院長王仲遠表示,隨著大模型的發展,人工智能逐步進入通用人工智能時代,該院目前正在訓練的原生多模態世界模型Emu3,再次瞄準了行業內最有挑戰性的一條技術路線。

當前,文生圖、圖生文、文生視頻等模型都有各自對應的架構和方法,很難兼容不同任務。例如文生視頻模型Sora,就無法做到對圖像和視頻的理解。“Emu3從設計之初就瞄準了多模態融合,其生成和理解能力也得到統一,還具備更多模態的可擴展性。”王仲遠說,基于智源研究院自研的多模態自回歸技術路徑,圖像、視頻、文字等模態可以進行聯合訓練。

這一模式,讓該模型不僅能閱讀文字,還擁有“讀圖”“看視頻”的能力。上傳一段視頻,模型能快速識別出,視頻內的男人給人以幸福、興奮的感覺。“如果這條路線實現突破,又將是對人工智能產業的一次重大技術貢獻。”王仲遠說,目前,該模型已具備生成高質量圖片和視頻、續寫視頻、理解物理世界等多模態能力,但中間還存在不盡完美之處。待持續訓練并經過安全評估后,Emu3將逐步開源。

世界級研究成果接連產出

具身智能技術的發展,推動人工智能從數字世界走入物理世界。在大會展廳中,經過通用抓取模型訓練,機器人對任意形狀、反光透明等物體都能有效抓取,在工業級真機上實現超過95%的抓取成功率,實現全球領先的商業級動作執行水平。機器人還擁有對開放指令的思考能力,當測試人員提出“我餓了”,機器人在桌面擺放的10多種物品中,發現了可以食用的橘子和香蕉。“橘子和香蕉您要哪個?”機器人追問。得到需要橘子的答案后,它抓起橘子放入筐里。


機械臂搭載探頭在被檢測者的胸部往復移動,心臟跳動的畫面就在床旁的顯示屏上呈現出來。王仲遠介紹,智源研究院與清華大學、301醫院合作研發的全球首創智能心臟超聲機器人,能在高速動態環境下快速計算提取心臟特征。臨床驗證結果顯示,它檢測的準確性、高效性與人類醫生基本持平,但穩定性和舒適性顯著高于人類醫生,對提升超聲醫療的普及度有重要意義。

全球首個低碳單體稠密萬億語言模型推出,全球首個實時孿生心臟計算模型構建,全原子生物分子模型達世界領先……王仲遠介紹,過去的1年里,智源研究院在多模態大模型、具身大模型和生物計算大模型等方向發力,已取得了多個世界級成果。未來幾年內,該院還將圍繞這些方向持續研發。

汽車生活更多>>

庫克稱iPhone 17等兼容機型用戶正“積極利用”蘋果牌AI IDC發布最新數據:OPPO系手機全球銷量猛增,擠進前三! 特斯拉財報會議萬字實錄|馬斯克意外官宣停產Model S/X;直言只有中國機器人配做對手 【智庫聲音】上觀新聞 | 張虎祥等:社群運營:上海社區商業的新玩法 抖音電商:年貨節期間品牌年貨禮盒銷量增長3倍 對話九識CEO孔旗:我們已實現業務現金流和毛利率正向增長 千問迭代,是阿里的又一次 AI 戰略選擇 哈工大系闖出人形機器人黑馬:成立不到一年,全棧開源3m/s原型機 新能源車的「硬核」戰事,2026年卷向何處? 賈國龍再發聲:西貝從來不存在“兩歲的西藍花”,現在標準是一個月內使用完畢 ARR達2.4億美元,可靈能帶快手起飛嗎? 世界級工廠按斤賣,觀致常熟工廠是如何被人為做空的 兩部門:對公租房建設期間用地及公租房建成后占地,免征城鎮土地使用稅 華住,比攜程還會撈金? 追覓科技俞浩:生態鏈基金已獲募資數量和規模雙料第一 國泰海通證券:維持農夫山泉“增持”評級 料下半年提速 盈利繼續樂觀 國泰海通證券:維持優然牧業(09858)“增持”評級 大股東定增彰顯信心 新一代奧迪Q5L賣30.98萬起!盤盤優缺點,我推薦購買嗎? Agent時代,為什么多模態數據湖是必選項? 索尼與本田聯手造車了?AFEELA 1亮相,車內可遠程操控PS游戲機 尺寸全面升級!哈弗猛龍加長版要來了,造型硬朗氣派,搭1.5T插混 本田革新品牌標識 “雙手”新“H”引領2027電動化新紀元‌ 北向資金持倉路徑曝光!全球鋰電巨頭連續7個季度獲加倉,商業航天概念股獲大面積掃貨 又一半導體概念股,將登陸A股!本周五申購! iQOO/紅米/OPPO/真我新機齊發:誰才是真正的中端小鋼炮? 消息稱蘋果iOS 26.4將對健康應用進行重大升級 榮耀MagicBook Pro 14 2026筆記本亮相CES 小米開出大罰單,許斐徐潔云取消年終獎,辭退經辦人員,大熊道歉 這誰頂得住?iQOO新機1月6日突襲曝光,性能直接拉滿到爆! iPhone 18影像規格曝光,沒有2億像素