准备把一段脚本变成逼真的 AI 出镜讲解员了吗?这份分步指南将带你在 VisionStory 制作第一个 AI 口播头像视频——选择头像、写下台词、挑选音色,几分钟生成质感满满的口播成片。先看上方演示流程,再跟着下面一起操作。
第 1 步:选择或创建你的头像
打开 AI 视频,先决定由谁来出镜。你有 3 种方式获取头像:
- 选择内置头像:从 VisionStory 的现成公共角色中挑一个——最快上手。
- 上传你的照片:添加一张清晰的正面图片,把真人变成会说话的头像。
- 生成头像:用文本提示词创建一个全新的角色。
你也可以随时使用 Change Look 来调整已选头像。

第 2 步:添加你的脚本
告诉头像要说什么。在右侧面板中,选择音频的提供方式:
- Script:输入你希望头像说的内容,让 AI 生成语音。
- Import:上传预先录好的音频文件来驱动视频,头像的 AI 口型同步会跟随你的录音。
- Record:直接在 VisionStory 里录制你的声音。
第一次建议脚本短一些,方便快速查看效果。
第 3 步:选择音色
每个头像都有默认音色,但你可以随时更换:
- Voice Library:打开音色库,探索覆盖 88 种语言的 1,000+ 音色,并用搜索快速找到你想要的那一款。
- 克隆音色:用你自己的短录音样本创建自定义 AI 音色。
- 预览与增强:用 Preview Audio 在提交前先试听,用 Voice Enhance 清理并优化声音。

第 4 步:选择视频模型、分辨率与选项
生成前,先设置视频的呈现方式:
- 视频模型:VisionStory 默认使用最新的口播头像模型 V-Character 4.0,实现自然的口型同步与表情。
- 分辨率:根据发布平台选择 720P、1080P 或 2K。
- 宽高比:在 9:16(竖屏)、16:9(横屏)与 1:1(正方形)之间切换,以匹配平台。
- 绿幕视频:仅在你需要纯色背景、用于后期替换时开启。
- 动作:调节头像的动作幅度,让表达更有动感。
第 5 步:查看积分并生成
VisionStory 会在生成前显示消耗:
- Credit Details:展开 Credit Details 查看总计如何计算——消耗取决于你选择的分辨率与时长(例如:60 秒的 720P 视频消耗 15 积分)。
- Generate Talking Video:确认无误后点击 Generate。VisionStory 会让头像动起来,并将口型与表情精准同步到你的脚本。
第 6 步:查看、分享与管理你的视频
处理完成后,你的视频会出现在 Assets 中,你可以:
- 预览最终效果,并重命名,方便整理。
- 下载 MP4,或复制分享链接,随处发布。
- 直接分享到 X、Facebook 等社交平台。
- 删除不再需要的视频。
就这么简单——你的第一个 AI 口播头像视频已经完成。接下来,你可以尝试不同头像、克隆你的音色,或随着项目增长导出更高分辨率的成片。
