日前,阿里电影级视频生成模型通义万相Wan2.2正式开源,并全面接入通义APP。手机用户只需在通义APP中输入文本或图片,即可化身“AI导演”,借助Wan2.2首创的美学控制系统,生成具备电影级质感的1080P高清视频。
目前,用户单次可生成5秒视频,并可通过多轮提示词进一步完成短剧制作。未来,通义万相还将继续提升单次视频生成的时长。
据介绍,Wan2.2首创的美学控制系统,直接将光影、色彩、镜头语言三大电影美学元素装进模型,可以随意组合60多个直观可控的参数,在构图、微表情、复杂调度等能力上媲美专业电影水平。
此外,Wan2.2在人物面部表情、多人交互、复杂运动等维度上也实现了提升。
据了解,Wan2.2此次开源的文生视频模型和图生视频模型均为业界首个使用MoE架构的视频生成模型,总参数量为27B,激活参数14B,均由高噪声专家模型和低噪专家模型组成,分别负责视频的整体布局和细节完善,在同等参数规模下,计算资源消耗降低约50%,有效缓解了视频生成处理Token过长带来的算力压力。
自今年2月以来,通义万相已连续开源文生视频、图生视频、首尾帧生视频和全能编辑等多款模型,相关功能均可在通义APP直接体验。
校对:高源