30 秒
更长的单次生成
在支持的模式下,单次可以生成最长 30 秒的视频。
Wan 3.0 · 已在 AIWan 正式上线
Wan 3.0 是阿里巴巴专为多模态创作打造的下一代全合一视频生成模型。它支持文本、图片、视频、音频和结构化参考素材,以更强的叙事与编辑能力生成更具一致性、更真实且更可控的视频内容。
30 秒
在支持的模式下,单次可以生成最长 30 秒的视频。
20 份
一个创作任务最多可以组合 20 份项目参考资料。
8 类
可使用文本、图片、音频、视频、文档、表格、幻灯片和网页。
Wan 3.0
你不必再把所有要求硬塞进一段很长的提示词。Wan 3.0 更适合参考素材驱动的创作方式:描述画面,再加入真正重要的图片、音频、动作或项目资料,让生成和修改都围绕同一组上下文进行。
对创作者来说,这意味着在保持角色、商品、环境或视觉风格时可以少一些反复重做。你可以从概念图、首帧和参考素材一路进入动态生成,再继续修改已有结果。
怎么实现
单次最长可生成 30 秒,并根据需要控制视频时长
为什么更好用
减少大量短片拼接,也降低人物、光线和节奏突然变化的问题
怎么实现
最多加入 20 份图片、视频、音频或项目文档
为什么更好用
把主体、品牌方向、动作和背景资料放在一起,不必全靠提示词重复描述
怎么实现
用参考素材锁定人物、商品、物件和环境特征
为什么更好用
更适合广告、角色内容和需要持续保持品牌视觉的项目
怎么实现
通过文字指令和参考素材继续调整已有视频
为什么更好用
需要改动作、画面、风格或环境时,不必每次从零重新生成
先选择最符合任务的创作模式,只加入真正会影响画面的参考素材,再围绕生成结果持续迭代,比每个镜头都从头开始更高效。
Wan 3.0 Studio
当一个镜头不仅需要“好看”,还要认得出商品、保持角色一致、遵循明确视觉方向,或者必须使用现有素材时,Wan 3.0 的参考驱动工作流会更有价值。
结合商品图、品牌参考和动作方向制作广告镜头,减少每次都重新解释品牌视觉和商品细节。
用参考图片固定角色外观,再延伸到更长镜头、新动作和不同场景,降低角色漂移。
把 Brief、分镜、原始视频和品牌素材转成新品发布、社媒短片、预告和营销活动所需的多个版本。
更可控的创作方式
图片与视频模式可以连续配合:先把角色、商品或构图做稳定,再加入运动,并继续针对结果做修改。
针对动作、构图、风格、剧情节点或环境提出修改,不必为了一个小变化重新生成整个创意。
先生成或编辑人物、商品、构图和分镜,再把这些视觉素材作为更明确的视频起点。
正式用于广告、客户项目或公开发布前,建议检查文字、数字、Logo、商品细节以及与参考素材的一致程度。
不只依赖提示词
一个任务最多可加入 20 份、覆盖八类内容的参考资料,让模型和你使用同一份 Brief、角色素材、商品资料、动作参考和品牌方向。



AAC · 5.0s
30 秒
更长的单次生成
20 份
参考素材
8 类
参考内容类型
创作模式
进入支持的视频工作台后,可以直接在模型选择器中选择 Wan 3.0,并在同一套 Studio 流程里切换不同创作模式。
通过这些清晰入口在核心生成器和生产级提示词示例之间快速切换。
FAQ
关于上线时间、收费方式、API、参考素材和视频时长的常见问题。
可以。Wan 3.0 已在 AIWan 正式上线。进入支持的视频工作台,在模型选择器中选择 Wan 3.0,设置时长、分辨率和需要的参考素材,并在生成前确认预计积分即可。
Wan 3.0 支持文本生成视频、图片生成视频、多参考生成和视频引导编辑,特别适合需要保持商品、角色、环境或视觉风格一致,并且需要反复修改的创作任务。你也可以先使用 AIWan 图片工具准备更稳定的源图,再进入 Wan 3.0 视频生成。
工作台会在提交生成前显示 Wan 3.0 本次预计消耗的积分。实际消耗会根据创作模式、视频时长、分辨率、音频、参考素材以及其他生成参数动态计算,你可以在提交前看到成本。
目前这个 Studio 页面还不提供公开的 Wan 3.0 API。现阶段优先提供浏览器端创作工作流;如果后续开放公共 API,会单独提供鉴权方式、调用文档和使用说明。
可以围绕文本、图片、音频、视频、文档、表格、演示文稿和网页建立参考驱动的工作流,一个任务最多可加入 20 份参考素材。建议只放真正会影响最终画面的资料,避免无关内容干扰生成。
Wan 3.0 单次生成最长可达到 30 秒。当前模式实际可选的视频时长、分辨率和其他参数会直接显示在工作台中。