微软亚洲研究院推出NUWA-XL超长视频生成模型

站长之家（ChinaZ.com）4月20日消息:你相信吗?只要输入16句简单描述，AI就能生成11分钟的动画了。

近日，微软亚洲研究院推出了NUWA-XL超长视频生成模型，采用创新的Diffusion over Diffusion架构，通过「从粗到细」的生成过程，可以并行生成高质量的超长视频，为多模态大模型提供了新的解题思路。

论文地址:https://arxiv.org/abs/2303.12346

NUWA-XL「从粗到细」的生成方法具有三个优势:

分层结构使模型能够直接在长视频上进行训练，从而消除了训练和推理之间的差距。
模型包含多个局部扩散模型，自然支持并行推理，可以显著提高生成长视频时的推理速度。例如在相同的硬件设置下，当生成1024帧时，NUWA-XL 使平均推理时间从7.55分钟减少到26秒，速度提升了94.26%。
由于视频的长度可以相对于深度 m 呈指数级扩展，因此模型可以很容易地扩展出更长的视频。

目前，长视频生成的多数方法是采用「Autoregressive over X」架构，这种方法存在训练-推理差距的问题，导致不真实的、扭曲的镜头变化。

NUWA-XL的推出填补了长视频生成领域的空白，为人工智能在视频生成方面的应用提供了新的可能性。

微软亚洲研究院首席研究员段楠表示，目前人工智能多模态大模型的研发仍停留在文字生成阶段。即使GPT-4已经在理解方面加入了视觉信息，但仅限于图片，输出依旧是文字或代码。因此，当前和未来的研究方向非常明确，就是将语言和视觉的理解和生成融入到一个基础大模型中，以增强图像、视频和音频的生成。他希望未来可以使用一套结构来融合支持语言和视觉的生成算法，使人工智能模型更加通用。

AI版《我的世界》震撼欧美，AI实时生成游戏成下一个大风口？

2024-11-072.2万阅读

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

微软亚洲研究院推出NUWA-XL超长视频生成模型

推荐关键词

24小时热搜

大家正在看

AI Agent大爆发！微软刚刚发布大量商用AI Agent，全民智能体！

智谱AI的AutoGLM后，Google和微软也下场来做“贾维斯”了。

微软Win11画图应用大变身！AI填充、擦除一应俱全

双11特惠，不满减，无套路，AI数字人分身、AI视频、AI论文等各种AI相关产品价格一步到底 !

用AI打败AI！荣耀MagicOS 9.0支持AI换脸检测堪比照妖镜

秘塔AI上线“知识库”，他们直接超进化成AI搜索完全体了。

大佬喊话，AI寒冬已来？

英伟达发布视觉AI Agent，能用AI总结真实世界了

AI+？，吸量又赚钱

当AI搜索开始赚钱养家

淘天AI打算让吴泳铭等多久？

AI Agent再迎一巨头！谷歌重磅发力AI Agent ，商用大爆发！

AI版《我的世界》震撼欧美，AI实时生成游戏成下一个大风口？

AI日报：快手推“可灵AI”独立APP；百度将推AI智能眼镜；智谱AI开源CogVideoX v1.5并上线“新清影”；Krea AI上线Lora训练功能

大厂裸辞靠AI年入百万后，不会编程的他用AI做出一个爆火App

手机卷向AI，没有开门红

AI 1.0公司的节节败退

AI日报：360将发布新一代AI搜索；蜜雪冰城进军AI领域；Suno v4新增翻唱等功能

从C.ai出走的用户，在Kindroid AI开启“第二春”

AI先让B站赚了钱

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

微软亚洲研究院推出NUWA-XL超长视频生成模型

推荐关键词

24小时热搜

大家正在看

AI Agent大爆发！微软刚刚发布大量商用AI Agent，全民智能体！

智谱AI的AutoGLM后，Google和微软也下场来做“贾维斯”了。

微软Win11画图应用大变身！AI填充、擦除一应俱全

双11特惠，不满减，无套路，AI数字人分身、AI视频、AI论文等各种AI相关产品价格一步到底 !

用AI打败AI！荣耀MagicOS 9.0支持AI换脸检测 堪比照妖镜

秘塔AI上线“知识库”，他们直接超进化成AI搜索完全体了。

大佬喊话，AI寒冬已来？

英伟达发布视觉AI Agent，能用AI总结真实世界了

AI+？，吸量又赚钱

当AI搜索开始赚钱养家

淘天AI打算让吴泳铭等多久？

AI Agent再迎一巨头！谷歌重磅发力AI Agent ，商用大爆发！

AI版《我的世界》震撼欧美，AI实时生成游戏成下一个大风口？

AI日报：快手推“可灵AI”独立APP；百度将推AI智能眼镜；智谱AI开源CogVideoX v1.5并上线“新清影”；Krea AI上线Lora训练功能

大厂裸辞靠AI年入百万后，不会编程的他用AI做出一个爆火App

手机卷向AI，没有开门红

AI 1.0公司的节节败退

AI日报：360将发布新一代AI搜索；蜜雪冰城进军AI领域；Suno v4新增翻唱等功能

从C.ai出走的用户，在Kindroid AI开启“第二春”

AI先让B站赚了钱

用AI打败AI！荣耀MagicOS 9.0支持AI换脸检测堪比照妖镜