阿里发布Wan3.0视频生成模型:单次生成30秒,文档直转视频开启公测
8月7日,阿里云宣布,全新一代视频生成模型Wan3.0正式开启公测。该模型在生成时长、万能创作、全能参考与真实感等维度实现全面升级,首次支持文档格式输入,被官方称为“万物皆可生视频”。
Wan3.0支持单段30秒视频生成,令连续运镜、一镜到底等复杂镜头语言得以充分表达,AI视频从“生成一个镜头”走向“讲述一段完整的故事”。模型还支持智能时长功能,可根据提示词自动推荐合适时长;搭配视频延长功能可延展剧情走向。
在模态支持上,Wan3.0不仅支持文本、图片、音频、视频的全能参考,还**首次支持doc、xls、ppt、pdf、txt、md等文档格式输入**,单次最多输入一个文件或链接,文件大小不超过100MB,页数不超过50页。搭配提示词,即可生成教学课件、产品演示、动态图表、业务汇报等内容,将大量办公素材直接转化为视频素材。
在文生视频模式中,Wan3.0的人像力求“千人千面”——更敏锐地刻画五官与皮肤细节,人物情绪表达自然克制,微表情与肢体动作彼此联动。在全能参考任务中,模型可精准复刻参考细节,保持角色、道具、声音、空间关系、风格等关键维度的一致性。
即日起,Wan3.0在阿里云百炼、万镜一刻、万相官网和千问创作PC端开启公测,在千问App灰度开放。API接口将于近期全量开放,480P/720P/1080P的API价格分别为0.3/0.6/1.2元/秒。Wan3.0是阿里在视频生成赛道上的重要升级。此前字节跳动于7月31日发布了Seedance 2.5,同样支持30秒视频生成和局部编辑能力。从“生成一个镜头”到“讲述完整故事”,视频生成模型正经历从片段式输出向长叙事创作的范式跨越。