过去,制作一期视频播客意味着要约齐两个人,还要准备摄像机、麦克风和剪辑师。而借助 VisionStory 的视频播客工作流,整个过程都可以在浏览器里完成:两位 AI 主持人同处一个共享场景,脚本可由话题、网页、PDF 或你自己的音频录音生成,每个分镜的剪辑都由你掌控。上方视频演示了完整流程;下面的指南将详细讲解每个环节。
第 1 步:从预设开始,或创建自己的模板
打开视频播客。最快的入门方式是使用现成的快速开始模板—将鼠标悬停在模板上即可预览其主持人和场景,并立即以它为起点开始创作。若想拥有一套可复用的自定义配置,请选择创建模板。
选择一个主持人角色,然后打开完整音色库为主持人设置音色—确定之前可以试听任意音色。用同样的方式设置嘉宾;如果调换布局效果更好,可随时互换主持人和嘉宾的位置。


第 2 步:将两位主持人放入同一个共享场景
接下来,选择一个场景。这正是这种形式的核心所在:VisionStory 会把你选定的主持人和嘉宾放进所选场景,让他们看起来就像在同一空间中交谈—无论原始角色图片的背景是什么。生成分镜预览以检查构图,然后保存模板,之后的每期节目几秒钟即可开始。

第 3 步:从话题、网页、PDF 或实时联网检索创建一期节目
模板准备好后,告诉 VisionStory 这期节目要讲什么。以下起点都可以:
- 直接在提示框中输入的话题或创意简报。
- 网页—粘贴链接,节目将基于其内容生成。
- PDF—上传文档,主持人将围绕它展开讨论。
- 联网搜索—当脚本需要最新的实时信息时启用。
VisionStory 会根据你提供的素材撰写双主持人对话。设置目标时长作为参考—它是最终长度的估计值,并非精确控制。
第 4 步:或从双人音频录音开始
已经录好了一段对话?直接拖入双人音频文件。VisionStory 会识别说话人、拆分对话,并将每句台词分配给对应的主持人或嘉宾—无需手动转录,就能把纯音频访谈变成一部完整成型的视频播客。

第 5 步:在 Studio 中编辑 — 脚本与分镜相互联动
生成的节目会在 Studio 中打开,文字段落、预览画面和分镜时间线双向联动。点击某个段落,时间线会跳转到对应的分镜;点击某个分镜,对应段落也会随之显示。删除段落时,与之关联的分镜也会一并删除 — 脚本与视频始终保持一致。

第 6 步:选择分镜并打磨节奏
每个分镜都可以是主持人特写、嘉宾特写、中景构图或双人镜头。点击不同的分镜缩略图即可更新主预览并变换节奏 — 特写用于强调,双人镜头用于你来我往的对话。

第 7 步:添加 Logo 并设置字幕样式
直接在画布上为节目加入品牌元素:添加 Logo,调整大小,移动到某个角落(视频中放在左上角),并应用到整期播客。字幕同样可以调整 — 字体、颜色和位置 — 让字幕与你频道的风格保持一致。

第 8 步:检查后生成
渲染之前,把整条时间线过一遍:
- 节奏:停顿和场景切换自然得当。
- 说话人切换:每句台词都对应正确的主持人。
- 分镜多样性:特写、中景和双人镜头搭配均衡。
- 品牌元素与字幕:大小、对比度和位置都在安全范围内。
一切确认无误后,点击生成。最终成片 — 就像上方视频结尾展示的真实节目一样 — 是一期完整的双主持人视频播客,可以直接发布。
让节目更出色的小技巧
- 每期只聚焦一个主题。聚焦的简介或素材比宽泛的主题能产出更紧凑、更自然的对话。
- 需要时效性时使用联网搜索。新闻类节目建议开启;常青主题则可以关闭。
- 有意识地变换分镜。反应特写和双人镜头能让对话显得真实生动,而不是一成不变。
- 保存你的模板。下一期节目只需点击几下就能复用你的主持人、音色和场景。
整个工作流程就是这样:在同一场景中设置两位主持人,把主题、网页、PDF 或录音交给 VisionStory,在 Studio 中打磨分镜,然后生成。快来体验视频播客功能,看看它能为你的频道带来什么。
