准备把一段脚本变成栩栩如生的 AI 主播吗?本分步指南将带你在 VisionStory 中创建第一个 AI 口播头像视频——选择头像、输入文案、挑选音色,几分钟内生成质感出众的口播视频。先观看上方演示视频,再按下面步骤操作。
步骤 1:选择或创建头像
打开 AI 视频,先确定由谁来出镜讲解。你可以通过 3 种方式获得头像:
- 选择内置头像:从 VisionStory 现成的公开角色中选择——最快上手。
- 上传自己的照片:添加一张清晰的正面照片,把真人变成口播头像。
- 生成头像:用一段文本提示词创建全新角色。
你也可以随时使用 Change Look 来调整所选头像。

步骤 2:添加脚本
告诉你的头像要说什么。在右侧面板中,选择提供音频的方式:
- Script:输入你希望头像说出的内容,由 AI 生成语音。
- Import:上传已录制的音频文件来驱动视频。
- Record:直接在 VisionStory 内录制你的声音。
建议第一次先写短一点,方便快速查看效果。
步骤 3:选择音色
每个头像都会有默认音色,但你可以随时更换:
- Voice Library:打开音色库,探索覆盖 88 种语言的 1,000+ 音色,并通过搜索快速找到你想要的那一款。
- 克隆音色:用你自己录音的一小段样本,创建专属 AI 音色。
- 预览与增强:使用 Preview Audio 在生成前先试听;用 Voice Enhance 清理音频,让声音更干净。

步骤 4:选择视频模型、分辨率与选项
生成前,先设置视频的呈现方式:
- 视频模型:VisionStory 使用最新的口播头像模型 V-Character 3.0,实现更自然的口型同步与表情表现。
- 分辨率:根据发布平台选择 720P、1080P 或 2K。
- 宽高比:在 9:16(竖屏)、16:9(横屏)和 1:1(方形)之间切换,以适配你的平台。
- 绿幕视频:仅在需要后期替换背景时开启,便于剪辑中抠像替换。
- 动作幅度:调整头像的运动幅度,让表达更有动感。
步骤 5:查看积分并生成
VisionStory 会在生成前展示本次消耗:
- Credit Details:展开 Credit Details 查看总积分的计算方式——费用取决于你选择的分辨率和时长(例如,本教程中的短 720P 视频消耗 4 积分)。
- Generate Talking Video:确认无误后点击 Generate。VisionStory 会为你的头像生成动画,将口型与表情同步到脚本内容。
步骤 6:查看、分享与管理视频
处理完成后,你的视频会出现在 Assets 中,你可以:
- 预览最终效果,并重命名方便整理。
- 下载 MP4,或复制分享链接发布到任意平台。
- 直接分享到 X、Facebook 等社交平台。
- 删除不再需要的视频。
就这样——你的第一个 AI 口播头像视频已经完成。接下来你可以尝试不同头像、克隆自己的音色,或随着项目增长导出更高分辨率。
