準備好把一段講稿變成栩栩如生的 AI 主講人了嗎?這份逐步指南會帶你在 VisionStory 製作第一支 AI talking avatar 影片——選擇虛擬人像、加入你的文字、挑選音色,幾分鐘內就能生成一支精緻的口說影片。先看上方教學示範,再跟著下面一起做。
步驟 1:選擇或建立你的虛擬人像
打開 AI Video,先決定由誰來出鏡。你有 3 種方式取得虛擬人像:
- 選擇內建虛擬人像:從 VisionStory 現成的公開角色中挑一位——最快開始的方式。
- 上傳你自己的照片:加入一張清晰正面照,把真人變成會說話的虛擬人像。
- 生成虛擬人像:用文字提示生成全新的角色。
你也可以隨時使用 Change Look 來調整已選擇的虛擬人像。

步驟 2:加入你的腳本
告訴虛擬人像要說什麼。在右側面板中,選擇你要如何提供音訊:
- Script:輸入你想讓虛擬人像說的內容,讓 AI 生成語音。
- Import:上傳預先錄好的音訊檔來驅動影片,虛擬人像的 AI 口型同步會跟著你的錄音。
- Record:直接在 VisionStory 裡錄下你的聲音。
建議第一段腳本先寫短一點,這樣能更快檢視生成效果。
步驟 3:挑選音色
每個虛擬人像都有預設音色,但你可以更換:
- Voice Library:打開音色庫,探索 88 種語言的 1,000+ 種音色,並用搜尋快速找到你想要的特定音色。
- Clone a voice:用自己錄音的一小段樣本建立自訂 AI 音色。
- Preview & enhance:用 Preview Audio 在生成前先聽聽看,並用 Voice Enhance 把聲音修得更乾淨。

步驟 4:選擇影片模型、解析度與選項
在生成前,先設定影片的呈現方式:
- Video Model:VisionStory 使用最新的口說虛擬人像模型 V-Character 4.0,帶來自然的口型同步與表情。
- Resolution:依你要發布的平台選擇 720P、1080P 或 2K。
- Aspect ratio:在 9:16(直式)、16:9(橫式)與 1:1(方形)之間切換,匹配你的平台。
- Green Screen Video:只有在你需要純色背景、方便之後剪輯替換時才開啟。
- Motion:調整虛擬人像的動作幅度,讓表達更有動感。
步驟 5:確認點數並生成
VisionStory 會在你生成前先顯示費用:
- Credit Details:展開 Credit Details 查看總點數如何計算——費用取決於你選擇的解析度與時長(例如:60 秒的 720P 影片需要 15 點數)。
- Generate Talking Video:確認都沒問題後,點擊 Generate。VisionStory 會讓虛擬人像動起來,並將口型與表情同步到你的腳本。
步驟 6:檢視、分享與管理你的影片
處理完成後,你的影片會出現在 Assets,你可以:
- 預覽最終成品,並重新命名方便整理。
- 下載 MP4,或複製分享連結發布到任何地方。
- 直接分享到 X、Facebook 等社群平台。
- 刪除不再需要的影片。
就這樣——你已經完成第一支 AI talking avatar 影片了。接下來,你可以嘗試不同的虛擬人像、複製自己的音色,或隨著專案需求成長,改用更高解析度匯出。
