VisionStory API
為開發者打造

使用 VisionStory REST API 或 Python SDK,從文字或音訊生成口型同步的說話虛擬人像影片。探索目前可用的模型、虛擬人像與音色,送出非同步任務並下載完成的 MP4;或透過 CLI、MCP server 或 Agent Skill,把同樣的流程自動化。

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Agent 就緒

你的 Agent 在哪裡工作,它就在哪裡運作。

複製一段設定訊息給你的程式編寫 Agent,或連接 MCP 伺服器,將 VisionStory 作為可重複使用的工具提供給它。

VisionStory CLI

安裝一次,在終端機使用所有 API。

安裝程式會在隔離環境中升級到最新的 PyPI 版本,讓你現有的 Python 專案完全不受影響。

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSL安裝選項
把這段設定提示詞傳給 Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
第一次使用嗎?

建立 API Key,然後把這段提示詞傳給你的程式編寫 Agent。它會帶你完成 visionstory 登入、確認點數,並在不暴露你的 Key 的情況下製作影片。

VisionStory 開發者工具

選擇最適合你技術棧的 API 整合方式。

REST、Python SDK、CLI、MCP server 與 Agent Skill 都共用同一套已驗證的 VisionStory API 與資源 ID。你可以先從任一介面開始,再把同一套虛擬人像影片流程搬進後端、CI pipeline 或 coding agent。

說話虛擬人像 API 快速開始

生成你的第一支說話虛擬人像影片。

建立伺服器端 API key、確認你的點數餘額,並取得目前的模型、虛擬人像與音色 ID。將一份 text_script 或 audio_script 送到 POST /api/v1/video,每 5 秒左右輪詢一次直到任務建立完成,接著下載 MP4。已完成影片的 URL 會保留 7 天。

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

VisionStory 模型目錄

選擇符合你輸出需求的模型。

先從你要完成的任務出發,再在執行階段抓取最新的模型目錄。可用的 ID、可接受的參數與輸出限制,皆以 API 回應為準。

可組合的 AI 媒體 API

整合虛擬人像、音色與 AI 影片 API。

用一組 API key 就能打造會說話的主持人、合成自然語音、重用自訂虛擬人像與音色及媒體資產,並生成輔助影片片段。無需拼接多家供應商,即可製作在地化解說、個人化新手導引、教學內容、銷售外聯或由 agent 生成的媒體。

AI 虛擬人像影片 API 常見問題

針對驗證、請求、非同步任務、SDK、CLI 自動化、MCP 與正式環境使用的直接解答。

  • AI 虛擬人像影片 API 能將數位主持人加上文字或錄製音訊,轉為口型同步的影片,讓應用程式可用程式方式生成。VisionStory 會接受已驗證的伺服器端請求,立即回傳影片 ID,以非同步方式渲染任務,並在生成完成後提供 MP4 URL。

從一次已驗證的請求開始

打造你的第一個 AI 虛擬人像影片整合。

建立 API key、確認你的點數,並執行 5 步驟的會說話虛擬人像快速開始。先從 REST 或 Python 上手,接著隨著流程成長再加入 CLI 自動化、MCP 工具或 Agent Skill。請改用即時資源端點查詢,而不是硬編碼模型、虛擬人像或音色 ID。