在 YouTube 上觀看本教學

YouTube

準備好把一段講稿變成栩栩如生的 AI 主講人了嗎?這份逐步指南會帶你在 VisionStory 製作第一支 AI talking avatar 影片——選擇虛擬人像、加入你的文字、挑選音色,幾分鐘內就能生成一支精緻的口說影片。先看上方教學示範,再跟著下面一起做。

步驟 1:選擇或建立你的虛擬人像

打開 AI Video,先決定由誰來出鏡。你有 3 種方式取得虛擬人像:

  • 選擇內建虛擬人像:從 VisionStory 現成的公開角色中挑一位——最快開始的方式。
  • 上傳你自己的照片:加入一張清晰正面照,把真人變成會說話的虛擬人像。
  • 生成虛擬人像:用文字提示生成全新的角色。

你也可以隨時使用 Change Look 來調整已選擇的虛擬人像。

Choosing a built-in avatar in VisionStory AI Video

步驟 2:加入你的腳本

告訴虛擬人像要說什麼。在右側面板中,選擇你要如何提供音訊:

  • Script:輸入你想讓虛擬人像說的內容,讓 AI 生成語音。
  • Import:上傳預先錄好的音訊檔來驅動影片,虛擬人像的 AI 口型同步會跟著你的錄音。
  • Record:直接在 VisionStory 裡錄下你的聲音。

建議第一段腳本先寫短一點,這樣能更快檢視生成效果。

步驟 3:挑選音色

每個虛擬人像都有預設音色,但你可以更換:

  • Voice Library:打開音色庫,探索 88 種語言的 1,000+ 種音色,並用搜尋快速找到你想要的特定音色。
  • Clone a voice:用自己錄音的一小段樣本建立自訂 AI 音色。
  • Preview & enhance:用 Preview Audio 在生成前先聽聽看,並用 Voice Enhance 把聲音修得更乾淨。
Searching the VisionStory Voice Library with over 1,000 voices

步驟 4:選擇影片模型、解析度與選項

在生成前,先設定影片的呈現方式:

  • Video Model:VisionStory 使用最新的口說虛擬人像模型 V-Character 4.0,帶來自然的口型同步與表情。
  • Resolution:依你要發布的平台選擇 720P、1080P 或 2K。
  • Aspect ratio:在 9:16(直式)、16:9(橫式)與 1:1(方形)之間切換,匹配你的平台。
  • Green Screen Video:只有在你需要純色背景、方便之後剪輯替換時才開啟。
  • Motion:調整虛擬人像的動作幅度,讓表達更有動感。
VisionStory video settings: model, resolution, and green screen

步驟 5:確認點數並生成

VisionStory 會在你生成前先顯示費用:

  • Credit Details:展開 Credit Details 查看總點數如何計算——費用取決於你選擇的解析度與時長(例如:60 秒的 720P 影片需要 15 點數)。
  • Generate Talking Video:確認都沒問題後,點擊 Generate。VisionStory 會讓虛擬人像動起來,並將口型與表情同步到你的腳本。

步驟 6:檢視、分享與管理你的影片

處理完成後,你的影片會出現在 Assets,你可以:

  • 預覽最終成品,並重新命名方便整理。
  • 下載 MP4,或複製分享連結發布到任何地方。
  • 直接分享到 X、Facebook 等社群平台。
  • 刪除不再需要的影片。

就這樣——你已經完成第一支 AI talking avatar 影片了。接下來,你可以嘗試不同的虛擬人像、複製自己的音色,或隨著專案需求成長,改用更高解析度匯出。

常見問題

  • 不需要。你可以選用現成的內建角色、上傳清晰的正面照片,或用文字提示生成全新的虛擬人像。