成人免费xxxxx在线视频软件_久久精品久久久_亚洲国产精品久久久_天天色天天色_亚洲人成一区_欧美一级欧美三级在线观看

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元

發布于 2024-7-3 09:49
瀏覽
0收藏

尤洋團隊新作,首個基于DiT的實時視頻生成方法來了!

?

先來直觀感受一下效果(右側為新方法):

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

這是團隊在Open-Sora上,使用5個4s(192幀)480p分辨率視頻進行的測試。


新方法名為Pyramid Attention Broadcast(PAB),由新加坡國立大學尤洋以及3位學生推出。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

具體來說,PAB通過減少冗余注意力計算,可實現高達21.6FPS10.6倍加速,并且不會犧牲基于DiT的流行視頻生成模型(包括Open-Sora、Open-Sora-Plan和Latte)的質量。


作為一種免訓練方法,PAB可為將來任何基于DiT的視頻生成模型提供實時功能。

看完效果對比,網友們紛紛驚嘆:

這將是新紀元。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

也引來了眾多專業人士的轉發和點評,如MIT博士Yilun Du表示:

是一個展示了如何將視頻生成加速到實時速度的酷炫工作!可能會為視頻策略和模擬的現實世界用例開辟新的領域。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

那么,新方法具體如何破解實時生成視頻這個難題的呢?

減少冗余注意力計算

一開始,團隊比較了當前擴散步驟與前一步驟的注意力輸出差異


這些差異通過均方誤差(MSE)進行量化,并對每個擴散步驟的所有層進行平均。

團隊捕捉到兩個關鍵信息

  • 隨著時間推移,注意力差異遵循U形模式,中間70%差異較小
  • 注意力差異的排序為:空間>時間>交叉

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

具體而言,不同時間步驟的注意力差異呈現出U形模式,在第一步和最后一步的15%步驟中發生顯著變化,而中間70%的步驟非常穩定,差異很小。


其次,在穩定的中間部分,不同類型的注意力表現出差異:空間注意力變化最大,涉及高頻元素,如邊緣和紋理;時間注意力顯示出與視頻中的運動和動態相關的中頻變化;跨模態注意力最為穩定,它將文本與視頻內容聯系起來,類似于反映文本語義的低頻信號。


對此,團隊正式提出用PAB來減少不必要的注意力計算

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

PAB通過根據每種注意力的差異將注意力輸出到不同的后續步驟,從而節省計算量。


舉個例子,就像廣播電臺把一個信號發送給多個聽眾一樣,如果某個步驟的注意力結果在接下來的幾個步驟中仍然適用,就不需要重新計算,而是直接使用之前的結果。


團隊發現,即使沒有后期訓練,這種簡單策略也能實現高達35%的加速,并且質量損失可以忽略不計。


為了進一步增強PAB,團隊基于動態序列并行(DSP)改進了序列并行。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

序列并行通過在多個GPU上分割視頻以降低延遲,但DSP帶來的時間注意力需兩次全對全通信,導致高通信開銷。


而PAB由于時間注意力不再需要被計算,使這些通信開銷減少了50%以上,從而優化了實時視頻生成的分布式推理效率。


借助并行功能,PAB可實現高達21.6FPS10.6倍加速,并且不會犧牲基于DiT的流行視頻生成模型(包括Open-Sora、Open-Sora-Plan和Latte)的質量。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

展開來說,團隊測量了PAB在8個英偉達H100 GPU上為不同模型生成單個視頻的總延遲。

使用單個GPU時,PAB實現了1.26倍到1.32倍的速度提升,這一提升在不同調度器中保持穩定。


擴展到多個GPU時,PAB實現了高達10.6倍的速度提升,且這一提升幾乎與GPU數量成線性關系

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

背后團隊

簡單介紹一下提出PAB的團隊成員,總共有4位。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

尤洋教授想必大家都比較熟悉了,清華計算機系碩士,UC伯克利博士,畢業后加入新加坡國立大學計算機系,擔任校長青年教授 (Presidential Young Professor)。


2021年7月,在北京中關村創辦了“潞晨科技”

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

作者之一Xuanlei Zhao(趙軒磊),華科大計算機科學與電子信息專業工程學士,碩博均在新國立(目前為博一),導師為尤洋,研究方向包括但不限于算法、數據結構、計算機網絡、信號處理、通信系統等方面。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

作者之一Kai Wang(王鍇),新國立HPC-AI實驗室博士生,導師為尤洋,本科就讀于北師大珠海分校電氣工程與自動化系,碩士就讀于中科院深圳先進技術研究院(MMLAB-SIAT),研究重點是以數據為中心的人工智能和高效機器學習。他和尤洋教授共同指導了這個項目。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

最后一位Xiaolong Jin(金小龍),本科就讀于中國科學技術大學少年班學院,目前是普渡大學在讀博士生。

AI首次實時生成視頻!尤洋團隊新作,網友:這是新紀元-AI.x社區

目前相關研究已公開,感興趣可以進一步了解。


項目主頁:??https://oahzxl.github.io/PAB/???
開源地址:???https://github.com/NUS-HPC-AI-Lab/OpenDiT??


本文轉自 AI生成未來 ,作者:一水


原文鏈接:??https://mp.weixin.qq.com/s/MIxPp9CYUSP0mB8bhe06sA??

收藏
回復
舉報
回復
相關推薦
主站蜘蛛池模板: 欧产日产国产精品视频 | av夜夜操| 亚洲第一av | av网站免费| 亚洲三级国产 | 精品国产网 | 欧美人妇做爰xxxⅹ性高电影 | 北条麻妃99精品青青久久 | 亚洲视频在线观看 | a级在线| 中文字幕免费在线 | 国产精品7777777 | 成人av网页| 日韩 欧美 综合 | 91深夜福利视频 | 国产一区二区三区在线 | 久久不卡视频 | 欧美亚洲国语精品一区二区 | 午夜欧美一区二区三区在线播放 | 国产精品一区二区无线 | 二区中文 | 欧美日韩久久久 | 久久99久久久久 | 日韩理论电影在线观看 | 精品在线视频播放 | 国产激情视频 | 夜夜夜操 | 国产精品久久久久久吹潮日韩动画 | 伊人99| 精品国产乱码久久久久久中文 | 国产高清免费 | 国产日韩欧美一区二区 | 亚洲欧美日韩精品 | 羞羞的视频在线 | 欧美一级在线观看 | 国产成人综合在线 | 国产午夜精品一区二区三区四区 | 精品一区二区三区不卡 | 91一区二区三区 | 午夜视频在线 | 国产在线精品一区 |