即将上线

Wan 3.0 创作能力预览

提前了解下一代 Wan 3.0 创作生成器

Wan 是阿里巴巴的视频生成模型系列。Wan 3.0 预计将为 AI 视频生成带来重大改进,包括更高质量的输出、更佳的一致性和更高级的创意控制,并即将开放正式访问权限。

Wan 3.0 模型即将上线;各独立模式工作台现已可以选择其他可用模型进行创作。
Wan 3.0演示效果预览演示视频使用Wan 3.0 工作流生成

30 秒

原生视频时长

Public Beta 信息显示,单次生成最长可达到 30 秒。

20 份

跨格式参考素材

Omni-Creation 最多可在一个任务中加入 20 份项目资料。

8 类

输入内容类型

文本、图片、音频、视频、文档、试算表、简报与网页。

Wan 3.0

Wan 3.0 是什么?

Wan 3.0 是阿里巴巴 Wan 团队最新公开测试的影像生成模型与创作平台。它同时涵盖视频生成、图片生成,以及依照文字指令或参考素材修改既有内容。

Public Beta 指产品已开放一般用户申请测试,但功能、价格、使用资格与输出质量仍可能调整。这和正式商用版、公开 API 或开源模型并不是同一件事。

原生 30 秒视频

官方公布内容

单次生成最长 30 秒,并提供智能长度控制

对创作者的实际意义

减少把多段短片接在一起造成人物、光线与叙事跳动

Omni-Creation

官方公布内容

最多可加入 20 份参考素材

对创作者的实际意义

一次提供角色、商品、脚本、简报与品牌资料,降低只靠提示词描述的负担

参考一致性

官方公布内容

重现人物与物件细节

对创作者的实际意义

更适合广告、角色短片与需要固定视觉识别的内容

精准视频编辑

官方公布内容

支持文字指令与参考素材驱动的修改

对创作者的实际意义

不必每次从头生成,可针对画面、故事或环境提出修改要求

这四项功能指向同一个改变:Wan 3.0 的竞争重点已从“能不能生成好看的单一镜头”,转向“能不能完成一段可控、可修改的内容”。

Wan 3.0 Studio

从一次提示词生成,走向可控制的完整制作流程

Public Beta 展示的方向不只是生成单一镜头,而是让企划资料进入上下文、保持重要视觉锚点,并在已有结果上继续修改,减少每次从头生成的不确定性。

原生 30 秒创作空间

更长的单次生成有机会减少多段短视频拼接造成的人物、光线和节奏跳动。

Omni-Creation 上下文

将企划、品牌文档、参考图、视频与音频一起提供,不必把所有要求压缩成一段提示词。

参考素材一致性

在多步骤工作流中保持人物、商品、环境与品牌视觉等关键锚点。

Wan 3.0 Public Beta

连接图片与视频的创作系统

预览信息将 Wan 3.0 描述为连续的创作环境,而不只是一个文本生成视频接口。

精确视频编辑

通过文字指令和参考素材修改画面、故事或环境,降低整段内容重新生成的成本。

图片生成与编辑

先完成角色、分镜、品牌视觉、多图融合和区域编辑,再把稳定素材延伸成动态内容。

生产前人工核验

长文字、公式、数字、品牌细节及从文档读取的信息,正式发布前仍需逐项检查。

Omni-Creation 预览

让企划素材真正进入提示词上下文

已公布的工作流最多可以加入 20 份、覆盖八类内容的参考资料,为企划、分镜、商品素材、品牌规范到生成或修改结果建立更连贯的路径。

文本图片音频视频文档试算表简报网页

输入

4 类输入
角色图片
角色图片 · 01
角色图片 · 02
背景图片
背景图片 · 03
动作视频 · 04
音频轨道

AAC · 5.0s

输出 · 生成视频

30 秒

原生视频时长

20 份

跨格式参考素材

8 类

输入内容类型

FAQ

Wan 3.0 常见问题

了解 Public Beta、已公布能力以及仍待确认的信息。

Wan 3.0 已经正式推出了吗?

Wan 3.0 已在 2026 年 8 月 6 日进入 Public Beta,用户可前往官方网站申请。Public Beta 仍属测试阶段,不代表价格、功能与资格已经固定。

Wan 3.0 最长可以生成几秒视频?

官方公布的原生视频长度最长为 30 秒,并提供智能长度控制。实际可选长度、分辨率与不同模式限制,仍应以账号内显示为准。

Wan 3.0 可以读取哪些参考资料?

官方列出的类型包含文字、图片、音频、视频、文档、试算表、简报与网页,最多可加入 20 份参考素材。模型能否正确理解复杂表格与精确数字,仍需要人工验证。

Wan 3.0 已经开源了吗?

目前没有看到 Wan 3.0 的官方开源模型项目或权重。Wan 系列过去有开源版本,但不能因此推断 3.0 也采用相同方式发布。