站长之家(ChinaZ.com)4月20日 消息:你相信吗?只要输入16句简单描述,AI就能生成11分钟的动画了。
(资料图片仅供参考)
近日,微软亚洲研究院推出了NUWA-XL超长视频生成模型,采用创新的Diffusion over Diffusion架构,通过「从粗到细」的生成过程,可以并行生成高质量的超长视频,为多模态大模型提供了新的解题思路。
论文地址:https://arxiv.org/abs/2303.12346
NUWA-XL「从粗到细」的生成方法具有三个优势:
分层结构使模型能够直接在长视频上进行训练,从而消除了训练和推理之间的差距。
模型包含多个局部扩散模型,自然支持并行推理,可以显著提高生成长视频时的推理速度。例如在相同的硬件设置下,当生成1024帧时,NUWA-XL 使平均推理时间从7.55分钟减少到26秒,速度提升了94.26%。
由于视频的长度可以相对于深度 m 呈指数级扩展,因此模型可以很容易地扩展出更长的视频。
目前,长视频生成的多数方法是采用「Autoregressive over X」架构,这种方法存在训练-推理差距的问题,导致不真实的、扭曲的镜头变化。
NUWA-XL的推出填补了长视频生成领域的空白,为人工智能在视频生成方面的应用提供了新的可能性。
微软亚洲研究院首席研究员段楠表示,目前人工智能多模态大模型的研发仍停留在文字生成阶段。即使GPT-4已经在理解方面加入了视觉信息,但仅限于图片,输出依旧是文字或代码。因此,当前和未来的研究方向非常明确,就是将语言和视觉的理解和生成融入到一个基础大模型中,以增强图像、视频和音频的生成。他希望未来可以使用一套结构来融合支持语言和视觉的生成算法,使人工智能模型更加通用。
(举报)
标签:
微软亚洲研究院推出NUWA-XL超长视频生成模型
1、道家所说的“顶上三花”就是“三花聚顶”。2、三花聚顶是内丹学...
江南高纤4月19日公告,2022年公司全年销售收入31亿元,同比下滑01%...
在亲核取代反应中,下列哪个卤化物的反应活性最大很多人还不知道,现...
4月18日下午,涞水农商银行组织召开2023年业务“开门红”总结表彰大...
1、《落脚城市》跟拍了15年前艾美奖获奖影片《归途列车》张琴一家今...
一、长峰医院连年亏损却豪掷上亿打广告据上游新闻报道,18日,北京...
孟荣达给学生上课。新华社记者杨文斌摄中寨教学点的学生在享用免费...
为抢抓农时,不误春耕。连日来,安徽省舒城县五显镇陈院村新时代文...
4月19日华鲁恒升化工股份有限公司己内酰胺全国送到价13100元 吨,...
曾写出《芈月传》的作者蒋胜男最近在个人账号发言,称捍卫“888”工...
[本站新车上市]在上海车展上,2023款欧拉好猫GT木兰版正式上市,新...
你需要的东西冰棒棒胶水回形针胶带炎炎夏日过后,您可能会发现您的...
一线调研·经营主体看活力一碗面,见证餐饮业回暖(主题)餐饮业是...
4月19日午盘收盘,国内期货主力合约涨跌互现。沪镍涨超4%,生猪涨超...
储户争夺战!苹果版“余额宝”给出10倍高息,年化利率高达4 15%,储...
互联网造车企业纷纷回怼传统汽车企业,近日蔚来李斌就回怼沃尔沃,...
截至2023年4月19日收盘,ST大集(000564)报收于1 55元,上涨4 73%...
每经AI快讯,4月19日,中芯国际(00981 HK)午后走强。截至发稿,其...
看似强大的美国已没钱,卢拉:我每晚自问,世界为什么用美元结算,巴...
吃花生怎么避免上火?上火后有啥表现?为了健康,少吃3种花生,上火,...
一季度铁路投资1135 5亿元同比增长6 6%,投资额创同期历史记录,...
每经AI快讯,2023年4月19日,深交所向奥园美谷(SZ000615,最新价:...
计划是提高工作与学习效率的一个前提。做好一个完整的工作计划,才能...
雷达图显示,“厂”字形强降雨正在横扫整个广东…△4月19日上午雷达...
数智化转型实践看三门核电当数字化席卷各个行业之时,对于技术、信...
4月19日盘中消息11点21分环旭电子601231触及涨停板目前价格1818上涨...
央视网消息(新闻联播):记者今天(4月18日)从民航局新闻发布会上...
假设不成立,于是,谢晖率领中甲配置的大连人征战2022赛季中超,凭...
以下是中际旭创在北京时间4月19日10:28分盘口异动快照:4月19日,中...