准备把一段讲稿变成逼真的 AI 主播吗?这份分步指南将带你在 VisionStory 制作你的第一个 AI 口播虚拟人视频:选择虚拟人、输入文案、挑选音色,几分钟内生成质感满满的口播视频。先观看上方演示视频,再按下方步骤操作即可。
步骤 1:选择或创建你的虚拟人
打开 AI 视频,先决定由谁来出镜讲解。你可以通过 3 种方式获得虚拟人:
- 选择内置虚拟人:从 VisionStory 现成的公开角色中挑选——最快上手。
- 上传自己的照片:添加一张清晰的正面照片,把真人变成口播虚拟人。
- 生成虚拟人:通过文本提示创建一个全新的角色。
你也可以随时使用 Change Look 调整当前选择的虚拟人外观。

步骤 2:添加讲稿
告诉你的虚拟人要说什么。在右侧面板中,选择提供音频的方式:
- 讲稿:输入你希望虚拟人说的话,让 AI 生成语音。
- 导入:上传预先录制好的音频文件来驱动视频。
- 录制:直接在 VisionStory 内录制你的声音。
建议首次讲稿尽量简短,方便你快速查看效果。
步骤 3:挑选音色
每个虚拟人都有默认音色,你也可以随时更换:
- 音色库:打开音色库,探索覆盖 88 种语言的 1,000+ 音色,并通过搜索快速找到你想要的音色。
- 克隆音色:用一段你自己的录音样本创建专属 AI 音色。
- 预览与增强:使用 预览音频 先试听再决定,并用 Voice Enhance 提升音质、清理杂音。

步骤 4:选择视频模型、分辨率与选项
生成前,先设置视频呈现效果:
- 视频模型:VisionStory 使用最新口播虚拟人模型 V-Character 3.0,实现更自然的口型同步与表情表现。
- 分辨率:根据发布渠道选择 720P、1080P 或 2K。
- 宽高比:在 9:16(竖屏)、16:9(横屏)与 1:1(方形)之间切换,匹配你的平台。
- 绿幕视频:仅在你需要后期替换背景时再开启,以获得纯色背景。
- Motion:调整虚拟人的动作幅度,让表达更有动感。
步骤 5:确认积分并生成
VisionStory 会在生成前显示本次成本:
- 积分明细:展开积分明细查看总计如何计算——费用取决于你选择的分辨率与时长(例如,本教程中的短 720P 视频需要 4 积分)。
- 生成口播视频:确认无误后点击生成。VisionStory 会为你的虚拟人生成动画,并将口型与表情同步到讲稿内容。
步骤 6:查看、分享与管理视频
处理完成后,你的视频会出现在 Assets 中,你可以:
- 预览最终效果,并重命名,便于整理管理。
- 下载 MP4,或复制分享链接发布到任何平台。
- 直接分享到 X 或 Facebook 等社交平台。
- 删除不再需要的视频。
完成——你的第一个 AI 口播虚拟人视频已经制作好了。接下来你可以尝试不同的虚拟人、克隆自己的音色,或随着项目需求提升导出分辨率。
