欧美三级一区 I 亚洲一本大道av久在线播放 I 神马影院一区二区 I 欧美日韩亚洲国产综合 I 午夜日韩福利 I 久久久久免费精品国产 I 小小拗女性bbwxxxx国产 I 精品日韩一区 I 天天射天天搞 I 久久精品极品盛宴观看 I 日韩欧美高清一区二区 I 国产日韩欧美网站 I 欧美在线天堂 I 久草91视频 I 99精品久久久久久久婷婷 I 天天网综合 I 黄色av播放 I 福利片一区二区 I 国产一区二区不卡老阿姨 I 91九色蝌蚪在线观看 I 亚洲 国产 日韩在线 精品 I 久久国内精品自在自线图片 I 华人在线视频 I 日韩城人免费 I 色小妹影院 I 久久亚洲人成综合网 I 久操中文在线 I 午夜精品三级久久久有码 I 天堂无码人妻精品av一区 I 久久亚洲精中文字幕冲田杏梨 I 精品少妇无码一区二区三批 I 女生裸体视频一区二区三区 I 91久久精品www人人做人人爽 I 欧洲做爰大片 I 一区二区三区中文字幕精品精品

首頁 > 汽車生活 > 汽車生活 > AI首次實時生成視頻!尤洋團隊新作,網(wǎng)友:這是新紀元

AI首次實時生成視頻!尤洋團隊新作,網(wǎng)友:這是新紀元

發(fā)布時間:2024-06-29 16:41:19

這是團隊在Open-Sora上,使用5個4s(192幀)480p分辨率視頻進行的測試。

新方法名為Pyramid Attention Broadcast(PAB),由新加坡國立大學尤洋以及3位學生推出。

 

具體來說,PAB通過減少冗余注意力計算,可實現(xiàn)高達21.6FPS10.6倍加速,并且不會犧牲基于DiT的流行視頻生成模型(包括Open-Sora、Open-Sora-Plan和Latte)的質(zhì)量。

作為一種免訓練方法,PAB可為將來任何基于DiT的視頻生成模型提供實時功能。

看完效果對比,網(wǎng)友們紛紛驚嘆:

這將是新紀元。

 

也引來了眾多專業(yè)人士的轉(zhuǎn)發(fā)和點評,如MIT博士Yilun Du表示:

是一個展示了如何將視頻生成加速到實時速度的酷炫工作!可能會為視頻策略和模擬的現(xiàn)實世界用例開辟新的領域。

 

那么,新方法具體如何破解實時生成視頻這個難題的呢?

減少冗余注意力計算

一開始,團隊比較了當前擴散步驟與前一步驟的注意力輸出差異

這些差異通過均方誤差(MSE)進行量化,并對每個擴散步驟的所有層進行平均。

團隊捕捉到兩個關鍵信息

  • 隨著時間推移,注意力差異遵循U形模式,中間70%差異較小
  • 注意力差異的排序為:空間>時間>交叉

 

具體而言,不同時間步驟的注意力差異呈現(xiàn)出U形模式,在第一步和最后一步的15%步驟中發(fā)生顯著變化,而中間70%的步驟非常穩(wěn)定,差異很小。

其次,在穩(wěn)定的中間部分,不同類型的注意力表現(xiàn)出差異:空間注意力變化最大,涉及高頻元素,如邊緣和紋理;時間注意力顯示出與視頻中的運動和動態(tài)相關的中頻變化;跨模態(tài)注意力最為穩(wěn)定,它將文本與視頻內(nèi)容聯(lián)系起來,類似于反映文本語義的低頻信號。

對此,團隊正式提出用PAB來減少不必要的注意力計算

 

PAB通過根據(jù)每種注意力的差異將注意力輸出到不同的后續(xù)步驟,從而節(jié)省計算量。

舉個例子,就像廣播電臺把一個信號發(fā)送給多個聽眾一樣,如果某個步驟的注意力結(jié)果在接下來的幾個步驟中仍然適用,就不需要重新計算,而是直接使用之前的結(jié)果。

團隊發(fā)現(xiàn),即使沒有后期訓練,這種簡單策略也能實現(xiàn)高達35%的加速,并且質(zhì)量損失可以忽略不計。

為了進一步增強PAB,團隊基于動態(tài)序列并行(DSP)改進了序列并行。

 

序列并行通過在多個GPU上分割視頻以降低延遲,但DSP帶來的時間注意力需兩次全對全通信,導致高通信開銷。

而PAB由于時間注意力不再需要被計算,使這些通信開銷減少了50%以上,從而優(yōu)化了實時視頻生成的分布式推理效率。

借助并行功能,PAB可實現(xiàn)高達21.6FPS10.6倍加速,并且不會犧牲基于DiT的流行視頻生成模型(包括Open-Sora、Open-Sora-Plan和Latte)的質(zhì)量。

汽車生活更多>>

庫克稱iPhone 17等兼容機型用戶正“積極利用”蘋果牌AI IDC發(fā)布最新數(shù)據(jù):OPPO系手機全球銷量猛增,擠進前三! 特斯拉財報會議萬字實錄|馬斯克意外官宣停產(chǎn)Model S/X;直言只有中國機器人配做對手 【智庫聲音】上觀新聞 | 張虎祥等:社群運營:上海社區(qū)商業(yè)的新玩法 抖音電商:年貨節(jié)期間品牌年貨禮盒銷量增長3倍 對話九識CEO孔旗:我們已實現(xiàn)業(yè)務現(xiàn)金流和毛利率正向增長 千問迭代,是阿里的又一次 AI 戰(zhàn)略選擇 哈工大系闖出人形機器人黑馬:成立不到一年,全棧開源3m/s原型機 新能源車的「硬核」戰(zhàn)事,2026年卷向何處? 賈國龍再發(fā)聲:西貝從來不存在“兩歲的西藍花”,現(xiàn)在標準是一個月內(nèi)使用完畢 ARR達2.4億美元,可靈能帶快手起飛嗎? 世界級工廠按斤賣,觀致常熟工廠是如何被人為做空的 兩部門:對公租房建設期間用地及公租房建成后占地,免征城鎮(zhèn)土地使用稅 華住,比攜程還會撈金? 追覓科技俞浩:生態(tài)鏈基金已獲募資數(shù)量和規(guī)模雙料第一 國泰海通證券:維持農(nóng)夫山泉“增持”評級 料下半年提速 盈利繼續(xù)樂觀 國泰海通證券:維持優(yōu)然牧業(yè)(09858)“增持”評級 大股東定增彰顯信心 新一代奧迪Q5L賣30.98萬起!盤盤優(yōu)缺點,我推薦購買嗎? Agent時代,為什么多模態(tài)數(shù)據(jù)湖是必選項? 索尼與本田聯(lián)手造車了?AFEELA 1亮相,車內(nèi)可遠程操控PS游戲機 尺寸全面升級!哈弗猛龍加長版要來了,造型硬朗氣派,搭1.5T插混 本田革新品牌標識 “雙手”新“H”引領2027電動化新紀元‌ 北向資金持倉路徑曝光!全球鋰電巨頭連續(xù)7個季度獲加倉,商業(yè)航天概念股獲大面積掃貨 又一半導體概念股,將登陸A股!本周五申購! iQOO/紅米/OPPO/真我新機齊發(fā):誰才是真正的中端小鋼炮? 消息稱蘋果iOS 26.4將對健康應用進行重大升級 榮耀MagicBook Pro 14 2026筆記本亮相CES 小米開出大罰單,許斐徐潔云取消年終獎,辭退經(jīng)辦人員,大熊道歉 這誰頂?shù)米。縤QOO新機1月6日突襲曝光,性能直接拉滿到爆! iPhone 18影像規(guī)格曝光,沒有2億像素