30 秒
原生视频时长
Public Beta 信息显示,单次生成最长可达到 30 秒。
Wan 3.0 创作能力预览
Wan 是阿里巴巴的视频生成模型系列。Wan 3.0 预计将为 AI 视频生成带来重大改进,包括更高质量的输出、更佳的一致性和更高级的创意控制,并即将开放正式访问权限。
30 秒
Public Beta 信息显示,单次生成最长可达到 30 秒。
20 份
Omni-Creation 最多可在一个任务中加入 20 份项目资料。
8 类
文本、图片、音频、视频、文档、试算表、简报与网页。
Wan 3.0
Wan 3.0 是阿里巴巴 Wan 团队最新公开测试的影像生成模型与创作平台。它同时涵盖视频生成、图片生成,以及依照文字指令或参考素材修改既有内容。
Public Beta 指产品已开放一般用户申请测试,但功能、价格、使用资格与输出质量仍可能调整。这和正式商用版、公开 API 或开源模型并不是同一件事。
官方公布内容
单次生成最长 30 秒,并提供智能长度控制
对创作者的实际意义
减少把多段短片接在一起造成人物、光线与叙事跳动
官方公布内容
最多可加入 20 份参考素材
对创作者的实际意义
一次提供角色、商品、脚本、简报与品牌资料,降低只靠提示词描述的负担
官方公布内容
重现人物与物件细节
对创作者的实际意义
更适合广告、角色短片与需要固定视觉识别的内容
官方公布内容
支持文字指令与参考素材驱动的修改
对创作者的实际意义
不必每次从头生成,可针对画面、故事或环境提出修改要求
这四项功能指向同一个改变:Wan 3.0 的竞争重点已从“能不能生成好看的单一镜头”,转向“能不能完成一段可控、可修改的内容”。
Wan 3.0 Studio
Public Beta 展示的方向不只是生成单一镜头,而是让企划资料进入上下文、保持重要视觉锚点,并在已有结果上继续修改,减少每次从头生成的不确定性。
更长的单次生成有机会减少多段短视频拼接造成的人物、光线和节奏跳动。
将企划、品牌文档、参考图、视频与音频一起提供,不必把所有要求压缩成一段提示词。
在多步骤工作流中保持人物、商品、环境与品牌视觉等关键锚点。
Wan 3.0 Public Beta
预览信息将 Wan 3.0 描述为连续的创作环境,而不只是一个文本生成视频接口。
通过文字指令和参考素材修改画面、故事或环境,降低整段内容重新生成的成本。
先完成角色、分镜、品牌视觉、多图融合和区域编辑,再把稳定素材延伸成动态内容。
长文字、公式、数字、品牌细节及从文档读取的信息,正式发布前仍需逐项检查。
Omni-Creation 预览
已公布的工作流最多可以加入 20 份、覆盖八类内容的参考资料,为企划、分镜、商品素材、品牌规范到生成或修改结果建立更连贯的路径。



AAC · 5.0s
30 秒
原生视频时长
20 份
跨格式参考素材
8 类
输入内容类型
Workspaces
每个 URL 固定对应创作模式。现在可以选择其他已开放模型进行创作,Wan 3.0 仅在模型列表中标注“即将上线”。
FAQ
了解 Public Beta、已公布能力以及仍待确认的信息。
Wan 3.0 已在 2026 年 8 月 6 日进入 Public Beta,用户可前往官方网站申请。Public Beta 仍属测试阶段,不代表价格、功能与资格已经固定。
官方公布的原生视频长度最长为 30 秒,并提供智能长度控制。实际可选长度、分辨率与不同模式限制,仍应以账号内显示为准。
官方列出的类型包含文字、图片、音频、视频、文档、试算表、简报与网页,最多可加入 20 份参考素材。模型能否正确理解复杂表格与精确数字,仍需要人工验证。
目前没有看到 Wan 3.0 的官方开源模型项目或权重。Wan 系列过去有开源版本,但不能因此推断 3.0 也采用相同方式发布。