在 YouTube 上观看本教程

YouTube

换脸流程包含两个容易混淆的角色:源素材决定场景和表演,目标头像提供要替换的新面孔。理解这一区别后,视频和图片两种流程就很清晰了。

开始之前

  • 只使用你拥有或获准编辑的素材,并取得画面中相关人物的许可。
  • 选择只有一个清晰主要人物的源素材,避免面部遮挡、严重模糊或物体穿过脸部。
  • 目标头像与源人物的头部角度和光线方向越接近,换脸结果通常越自然。
  • 每次生成前,都以产品界面显示的实时积分预估为准。
每次处理一张主要人脸。当前视频流程会替换主要人物的脸,并不支持多人同时换脸。
1

打开换脸并添加源视频

打开 AI 工具,选择换脸,并停留在视频标签页。你可以通过以下方式开始:

快速开始

将鼠标悬停在示例上预览,再打开一个示例体验完整流程。

上传

从设备添加 MP4、MOV 或 WebM 视频。

历史记录

重新使用你之前处理过且符合要求的源素材。

源视频限制

时长 4 到 60 秒,最大 200 MB,单边尺寸在 300 到 6000 像素之间。

VisionStory 换脸视频页面中的快速开始、上传和历史记录入口
可以从示例开始、上传视频,或重新打开之前使用过的源素材。
2

选择完整视频或准确片段

当上传的视频超过 15 秒时,需要保留整段内容就选择完整视频;只想处理某个准确片段,或先快速测试效果,就选择裁剪

使用裁剪时,拖动左右手柄设置起点和终点,预览后再确认。建议选择人脸持续清晰可见、镜头角度没有突然变化的一段。

换脸裁剪界面中设置源视频起点和终点的前后状态
选择处理整段视频,或设置准确范围并预览后确认。
3

选择目标头像

源视频继续决定身体、服装、动作、背景、镜头运动和原始音频;目标头像只提供新的面孔。

打开目标头像。你可以选择自己的头像、上传新头像,或浏览公共头像库。请选择一张清晰可见、与源人物不同的单人脸。相似的光线和头部角度通常能带来更自然的衔接。

VisionStory 头像选择器和已选中的公共目标头像
等待头像库加载完成后,再选择一张清晰的目标人脸。
4

生成并查看最终效果

确认源视频范围和目标头像后,点击生成视频。任务完成时,从最近任务中打开成片。

播放完整结果,重点检查新面孔与表情、口型、头部动作之间是否自然。成片会保留源视频的原始音频,因此也要结合声音和表演一起判断效果。

点击生成视频并在 VisionStory 视频播放器中查看真实换脸结果
提交素材生成,再打开真实成片检查面孔、动作和原始音频。
为什么场景仍然保持一致:生成过程会在替换主要人物面孔的同时,尽量保留表情、口型、头发、头饰、身体、服装、姿态、动作、光线、背景、镜头运动和色调。
5

为照片换脸

切换到图片标签页,上传你希望保留的源照片。支持的源图片格式包括 JPG、JPEG、PNG、WebP 和 HEIC。然后打开目标图片,选择用于替换面孔的头像。

源图片会保留构图、光线、色彩和面孔以外的细节。查看实时图片积分,点击生成,之后可以下载结果,或返回尝试另一组素材。

VisionStory 真实图片换脸输入和生成结果页面
真实输入与结果页面清楚展示:源图片决定画面,目标头像提供新面孔。

质量检查清单

检查项更合适的素材尽量避免
人脸可见度一张无遮挡、五官清晰的人脸口罩、手、头发或道具遮挡脸部
角度源人物和目标头像朝向相近正面源人物搭配极端侧脸目标头像
光线光线方向和对比度接近强烈逆光,或目标头像从相反方向受光
动作动作稳定,人脸持续可见快速运动模糊、突然切镜或人物离开画面

常见问题

换脸可以同时替换视频中的多个人物吗?

当前流程会替换主要人物的脸。如果不同人物需要分别换脸,请为每个人物准备单独的源视频片段。

原始视频音频会怎样处理?

VisionStory 在视觉生成阶段会暂时移除源音频,并在成片中重新合入原始音频。

为什么较长视频会显示“完整视频”和“裁剪”?

超过 15 秒的视频既可以按场景拆成较短片段处理后合并,也可以通过裁剪只处理一个选中的片段。

视频换脸的积分预估如何计算?

当前视频流程按所选源视频范围的秒数向上取整,每秒消耗 4 积分。生成前请始终以界面显示的实时预估为准。

可以上传新面孔,而不是选择公共头像吗?

可以。头像选择器支持使用你的头像、上传新头像,或选择公共头像。

相关教程

常见问题

  • 当前流程会替换主要人物的脸。如果不同人物需要分别换脸,请为每个人物准备单独的源视频片段。