VisionStory API
为开发者打造

使用 VisionStory REST API 或 Python SDK,将文本或音频生成口型同步的虚拟人说话视频。查找当前可用的模型、虚拟人和音色,提交异步任务并下载生成好的 MP4——也可通过 CLI、MCP 服务器或 Agent Skill 自动化同一套工作流。

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
智能体就绪

在你的智能体工作的地方照样好用。

复制一段配置消息给你的编程智能体,或连接 MCP 服务器,将 VisionStory 作为可复用工具对外开放。

VisionStory CLI

一次安装,在终端调用所有 API。

安装器会在隔离环境中升级到最新的 PyPI 版本,你现有的 Python 项目不受影响。

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSL安装选项
把这段配置提示词发送给 Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
第一次用?

先创建一个 API Key,再把这段提示词发给你的编程智能体。它会引导你完成 visionstory 登录、验证积分,并在不暴露密钥的情况下创建视频。

VisionStory 开发者工具

选择适合你技术栈的 API 集成方式。

REST、Python SDK、CLI、MCP 服务器与 Agent Skill 都使用同一套已认证的 VisionStory API 与资源 ID。你可以先从任意一种接口开始,再将同样的虚拟人视频工作流迁移到后端、CI 流水线或编码智能体中。

虚拟人说话 API 快速上手

生成你的第一个虚拟人说话视频。

创建服务器端 API key,确认你的积分余额,并获取当前模型、虚拟人与音色 ID。将 text_script 或 audio_script 提交到 POST /api/v1/video,大约每 5 秒轮询一次直到任务创建完成,然后下载 MP4。已完成视频的 URL 会保留 7 天。

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

VisionStory 模型目录

选择满足你输出需求的模型。

从你要完成的任务出发,然后在运行时获取最新的模型目录。可用 ID、可接受参数与输出限制都以 API 返回为准。

可组合的 AI 媒体 API

组合虚拟人、音色与 AI 视频 API。

用一个 API key 即可创建会说话的主持人、合成自然语音、复用自定义虚拟人、音色与媒体资产,并生成配套视频片段。无需拼接多个服务商,就能构建本地化讲解视频、个性化引导、教育内容、销售触达或由智能体生成的媒体内容。

AI 虚拟人视频 API 常见问题

关于鉴权、请求、异步任务、SDK、CLI 自动化、MCP 与生产环境使用的直接解答。

  • AI 虚拟人视频 API 可将数字主持人加上文本或录制音频,生成可由应用以程序方式生成的对口型视频。VisionStory 接受已鉴权的服务器端请求,会立即返回视频 ID,以异步方式渲染任务,并在生成完成后提供 MP4 URL。

从一次已鉴权请求开始

打造你的首个 AI 虚拟人视频集成。

创建 API key、确认你的积分,并运行 5 步口播虚拟人快速上手。从 REST 或 Python 开始,随着工作流扩展再加入 CLI 自动化、MCP 工具或 Agent Skill。查询实时资源端点,而不是硬编码模型、虚拟人或音色 ID。