VisionStory API
為開發者而設

用 VisionStory REST API 或 Python SDK,由文字或音訊製作對嘴同步的說話虛擬人像影片。查詢現有模型、虛擬人像及音色,提交非同步任務並下載完成的 MP4;或透過 CLI、MCP server 或 Agent Skill 自動化同一套流程。

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Agent 就緒

喺你嘅 Agent 工作嘅地方照樣運作。

複製一段設定訊息畀你嘅 coding agent,或者連接 MCP 伺服器,將 VisionStory 變成可重用工具。

VisionStory CLI

一次安裝,用終端機呼叫所有 API。

安裝程式會喺隔離環境升級到最新嘅 PyPI 版本,你現有嘅 Python 專案唔會受影響。

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSL安裝選項
將呢個設定提示詞傳送畀 Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
第一次用?

先建立 API Key,然後將呢段提示詞傳送畀你嘅 coding agent。佢會引導你完成 visionstory 登入、驗證積分,並喺唔會暴露你嘅 key 嘅情況下製作影片。

VisionStory 開發者工具

揀選最適合你技術棧的 API 整合方式。

REST、Python SDK、CLI、MCP server 及 Agent Skill 都使用同一個已驗證的 VisionStory API 同資源 ID。你可以先由其中一個介面開始,之後再將同一套虛擬人像影片流程搬到後端、CI pipeline 或 coding agent。

說話虛擬人像 API 快速開始

生成你第一條說話虛擬人像影片。

建立伺服器端 API key、核對你的積分結餘,並查找現有模型、虛擬人像及音色 ID。提交一段 text_script 或 audio_script 到 POST /api/v1/video,約每 5 秒輪詢一次直到任務建立完成,再下載 MP4。已完成影片的 URL 會保留 7 日。

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

VisionStory 模型目錄

按你需要的輸出揀選模型。

先由你要完成的任務出發,再於執行時取得最新模型目錄。API 回應會作為可用 ID、支援參數及輸出限制的最終依據。

可組合的 AI 媒體 API

整合虛擬人像、音色及 AI 影片 API。

只需 1 個 API key,即可製作說話主持人、合成自然語音、重用自訂虛擬人像/音色/媒體素材,並生成配套影片片段。無需拼接多個供應商,即可打造本地化解說、個人化 onboarding、教育內容、銷售觸達,或由 agent 生成的媒體內容。

AI 虛擬人像影片 API 常見問題

提供關於驗證、請求、非同步任務、SDK、CLI 自動化、MCP 以及生產環境使用的直接解答。

  • AI 虛擬人像影片 API 會將數碼主持人加上文字或錄音音訊,轉換成對口型的影片,讓應用程式可透過程式方式生成。VisionStory 接受已驗證的伺服器端請求,會即時返回影片 ID,以非同步方式渲染任務,並在生成完成後提供 MP4 URL。

由一次已驗證請求開始

建立你第一個 AI 虛擬人像影片整合。

建立 API key、確認積分,並跟隨 5 步會說話虛擬人像 quickstart 開始。你可以先用 REST 或 Python 起步,之後按工作流程需要加入 CLI 自動化、MCP 工具或 Agent Skill。請查詢即時資源端點,毋須硬編碼模型、虛擬人像或音色 ID。