在 YouTube 上观看本教程

YouTube

准备把一段脚本变成逼真的 AI 出镜讲解员了吗?这份分步指南将带你在 VisionStory 制作第一个 AI 口播头像视频——选择头像、写下台词、挑选音色,几分钟生成质感满满的口播成片。先看上方演示流程,再跟着下面一起操作。

第 1 步:选择或创建你的头像

打开 AI 视频,先决定由谁来出镜。你有 3 种方式获取头像:

  • 选择内置头像:从 VisionStory 的现成公共角色中挑一个——最快上手。
  • 上传你的照片:添加一张清晰的正面图片,把真人变成会说话的头像。
  • 生成头像:用文本提示词创建一个全新的角色。

你也可以随时使用 Change Look 来调整已选头像。

Choosing a built-in avatar in VisionStory AI Video

第 2 步:添加你的脚本

告诉头像要说什么。在右侧面板中,选择音频的提供方式:

  • Script:输入你希望头像说的内容,让 AI 生成语音。
  • Import:上传预先录好的音频文件来驱动视频,头像的 AI 口型同步会跟随你的录音。
  • Record:直接在 VisionStory 里录制你的声音。

第一次建议脚本短一些,方便快速查看效果。

第 3 步:选择音色

每个头像都有默认音色,但你可以随时更换:

  • Voice Library:打开音色库,探索覆盖 88 种语言的 1,000+ 音色,并用搜索快速找到你想要的那一款。
  • 克隆音色:用你自己的短录音样本创建自定义 AI 音色。
  • 预览与增强:用 Preview Audio 在提交前先试听,用 Voice Enhance 清理并优化声音。
Searching the VisionStory Voice Library with over 1,000 voices

第 4 步:选择视频模型、分辨率与选项

生成前,先设置视频的呈现方式:

  • 视频模型:VisionStory 默认使用最新的口播头像模型 V-Character 4.0,实现自然的口型同步与表情。
  • 分辨率:根据发布平台选择 720P、1080P 或 2K。
  • 宽高比:在 9:16(竖屏)、16:9(横屏)与 1:1(正方形)之间切换,以匹配平台。
  • 绿幕视频:仅在你需要纯色背景、用于后期替换时开启。
  • 动作:调节头像的动作幅度,让表达更有动感。
VisionStory video settings: model, resolution, and green screen

第 5 步:查看积分并生成

VisionStory 会在生成前显示消耗:

  • Credit Details:展开 Credit Details 查看总计如何计算——消耗取决于你选择的分辨率与时长(例如:60 秒的 720P 视频消耗 15 积分)。
  • Generate Talking Video:确认无误后点击 Generate。VisionStory 会让头像动起来,并将口型与表情精准同步到你的脚本。

第 6 步:查看、分享与管理你的视频

处理完成后,你的视频会出现在 Assets 中,你可以:

  • 预览最终效果,并重命名,方便整理。
  • 下载 MP4,或复制分享链接,随处发布。
  • 直接分享到 X、Facebook 等社交平台。
  • 删除不再需要的视频。

就这么简单——你的第一个 AI 口播头像视频已经完成。接下来,你可以尝试不同头像、克隆你的音色,或随着项目增长导出更高分辨率的成片。

常见问题

  • 不需要。你可以直接选择现成的内置角色,上传你自己清晰的正面照片,或用文字提示词生成全新的头像。