準備把講稿變成栩栩如生的 AI 主講人了嗎?本逐步指南將帶你在 VisionStory 製作第一支AI 會說話虛擬人像影片——選擇虛擬人像、加入台詞、挑選音色,幾分鐘內就能生成質感滿分的會說話影片。先觀看上方操作示範影片,再跟著下方步驟一起做。
步驟 1:選擇或建立你的虛擬人像
開啟 AI 影片,決定由誰來上場。你有 3 種方式取得虛擬人像:
- 選擇內建虛擬人像:從 VisionStory 現成的公開角色中挑選——最快開始的方法。
- 上傳自己的照片:加入清晰的正面照片,把真人變成會說話虛擬人像。
- 生成虛擬人像:用文字提示創建全新的角色。
你也可以隨時使用 Change Look 來調整所選的虛擬人像。

步驟 2:加入你的講稿
告訴你的虛擬人像要說什麼。在右側面板中,選擇提供音訊的方式:
- Script:輸入你希望虛擬人像說出的文字,讓 AI 生成語音。
- Import:上傳已錄製的音訊檔來驅動影片。
- Record:直接在 VisionStory 內錄下你的聲音。
建議第一段講稿先寫短一點,方便快速檢視成果。
步驟 3:挑選音色
每個虛擬人像都有預設音色,但你可以隨時更換:
- Voice Library:開啟素材庫,探索88 種語言、1,000+ 種音色,並使用搜尋快速找到你想要的特定音色。
- 複製音色:用你自己的短音訊樣本建立自訂 AI 音色。
- 預覽與增強:先用 Preview Audio 試聽再決定;再用 Voice Enhance 淨化、提升音質。

步驟 4:選擇影片模型、解析度與選項
生成前,先設定影片的呈現方式:
- 影片模型:VisionStory 使用最新的會說話虛擬人像模型 V-Character 3.0,帶來更自然的口型同步與表情呈現。
- 解析度:依你的發佈平台選擇 720P、1080P 或 2K。
- 長寬比:可在 9:16(直式)、16:9(橫式)與 1:1(方形)之間切換,以符合你的平台。
- 綠幕影片:只有在你需要後續剪輯替換背景時再開啟。
- 動作幅度:調整虛擬人像的肢體與動作強度,讓表達更有動感。
步驟 5:確認點數並生成
在你生成之前,VisionStory 會先顯示所需成本:
- Credit Details:展開 Credit Details 查看總點數的計算方式——費用會依你選擇的解析度與影片長度而不同(例如:本教學中的短版 720P 影片需 4 點數)。
- Generate Talking Video:確認無誤後點擊 Generate。VisionStory 會為你的虛擬人像加上動畫,將口型與表情同步到講稿內容。
步驟 6:檢視、分享並管理影片
處理完成後,你的影片會出現在 Assets,你可以:
- 預覽成品並重新命名,方便整理。
- 下載 MP4,或複製分享連結發佈到任何地方。
- 直接分享到 X 或 Facebook 等社群平台。
- 刪除不再需要的影片。
完成——你已經做出第一支 AI 會說話虛擬人像影片了。接下來你可以嘗試不同的虛擬人像、複製自己的音色,或隨著專案成長輸出更高解析度的版本。
