Wan 3.030s
多模态故事 AI 视频生成器

用 VisionStory 在线制作电影感 Wan 3.0 AI 视频。将文本、图片、视频、音频、文档与网页转化为可控的 1080p 故事,支持原生声音,并可实现最长 30 秒的连贯叙事。

Wan 3.0 电影感 AI 视频示例:一位穿西装的马角色

什么是 Wan 3.0?

Wan 3.0 是阿里巴巴的新一代 AI 视频模型,支持原生 30 秒叙事、1080p 电影级输出,以及视听同步生成。它旨在让角色、场景、动作、对话与声音在同一段更长的创作序列中保持连贯一致。

它的 Omni Reference 工作流可将文本、图片、视频、音频、文档与网页作为创作输入。无需拼接短片或来回切换工具,创作者只用一份多模态创意简报,就能统一指挥主体、镜头运动、场景节奏、音色与声音设计。

Wan 3.0 已在 VisionStory 上线,因此团队可在同一个在线工作流中探索文本转视频、图片转视频、参考素材转视频、产品广告、演示视频与电影感社交故事。

原生 30 秒镜头

在一次原生 30 秒生成中完成完整故事弧:更充足的铺垫、动作、对话、镜头运动,以及自然收尾。

Omni Reference 控制

用文本、图片、视频、音频、文档与网页来引导生成结果。只需一份创意简报,就能统一指挥角色、产品、场景、风格、镜头与节奏。

1080p + 同步声音

生成电影感 1080p 画面并同步声音,纹理更逼真、主体更稳定,在动作、对话与场景切换之间也更连贯。

Wan 3.0 有什么不同

用一套多模态工作流,掌控更长、更丰富的 AI 视频:叙事、参考控制、电影级画面与同步声音一次到位。

立即试用 Wan 3.0
原生 30 秒叙事

原生 30 秒叙事

Wan 3.0 可原生生成最长 30 秒,让提示词有足够空间进行铺垫、动作推进、对话与镜头运动,并完成一个完整结尾,无需拼接多个片段。

几乎任何来源的 Omni Reference

几乎任何来源的 Omni Reference

在同一份简报中融合文本、图片、视频、音频、文档与网页。用参考素材保留人物、产品、环境、音色、构图与创意方向。

原生视听生成

原生视听生成

将画面与声音一并生成,让动作、对话、环境氛围、音乐与场景节奏更紧密相连。Wan 3.0 的目标是在更长、可直接用于制作的序列中,保持动作与身份的一致性。

3 个简单步骤,制作 Wan 3.0 AI 视频

VisionStory 为你提供精简的 Wan 3.0 工作流,无需复杂的制作栈,也能做出更长、更可控的 AI 视频。

01

添加参考素材

从提示词、图片、视频、音频片段、文档或网页开始,为创意方向打好基础。

02

掌控完整场景

用自然语言描述角色、动作、镜头、对话、声音、灯光、节奏以及结尾。

03

用 Wan 3.0 生成

生成 30 秒 1080p 创意成片,用于广告、演示、社交故事与电影级营销活动。

Wan 3.0 AI 视频生成器常见问题

  • Wan 3.0 是阿里巴巴最新的 AI 视频模型,支持原生 30 秒生成、1080p 电影级输出、多模态 Omni Reference 控制,以及视听同步叙事。

用户喜爱 VisionStory

了解内容创作者和营销人员为何信赖 VisionStory 满足他们的 AI 视频需求。从强大功能到流畅体验,我们的用户社区对 VisionStory 的成果赞不绝口。

查看 G2 上的所有评价