VisionStory API
为开发者而生

通过 VisionStory REST API 或 Python SDK,将文本或音频生成口型同步的数字人口播视频。获取最新的模型、头像与音色,提交异步任务并下载成品 MP4;或使用 CLI、MCP server 或 Agent Skill 自动化同一套工作流。

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
智能体就绪

在你的智能体工作的地方也能用。

复制一条配置消息给你的编程智能体,或连接 MCP 服务器,将 VisionStory 作为可复用工具开放出来。

VisionStory CLI

一次安装,在终端调用全部 API。

安装器会在隔离环境中升级到最新的 PyPI 版本,你现有的 Python 项目不受影响。

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSL安装选项
将此配置提示词发送给 Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
第一次用?

先创建一个 API Key,然后把这段提示词发给你的编程智能体。它会引导你完成 visionstory 登录、核验积分,并在不暴露密钥的情况下创建视频。

VisionStory 开发者工具

为你的技术栈选择合适的 API 集成方式。

REST、Python SDK、CLI、MCP server 与 Agent Skill 均使用同一套需要鉴权的 VisionStory API 与资源 ID。你可以先从任意一种接口开始,再将同样的数字人视频工作流迁移到后端、CI 流水线或编程智能体中。

数字人口播 API 快速开始

生成你的第一个数字人口播视频。

创建服务端 API key,核对积分余额,并获取当前模型、头像与音色 ID。将 text_script 或 audio_script 提交到 POST /api/v1/video,大约每 5 秒轮询一次直到任务创建完成,然后下载 MP4。已完成视频的 URL 将保留 7 天。

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

VisionStory 模型目录

选择满足你输出需求的模型。

从你要完成的任务出发,再在运行时拉取最新的模型目录。可用 ID、支持的参数与输出限制,以 API 返回为准。

可组合的 AI 媒体 API

整合头像、音色与 AI 视频 API。

用一个 API key 即可生成数字人讲解视频、合成自然语音、复用自定义头像与音色及媒体资产,并生成配套视频片段。无需拼接多个供应商,即可打造本地化讲解、个性化新手引导、教育内容、销售触达或由智能体生成的媒体内容。

AI 数字人视频 API 常见问题

关于鉴权、请求、异步任务、SDK、CLI 自动化、MCP 与生产环境使用的直接解答。

  • AI 数字人视频 API 可将数字人讲解员与文本或录制音频合成为口型同步视频,应用可通过编程方式生成。VisionStory 接受已鉴权的服务端请求,立即返回视频 ID,异步渲染任务,并在生成完成后提供 MP4 URL。

从一次鉴权请求开始

搭建你的第一个 AI 数字人视频集成。

创建 API key,确认积分充足,并运行 5 步口播数字人快速上手。先从 REST 或 Python 开始,随着工作流增长再加入 CLI 自动化、MCP 工具或 Agent Skill。查询实时资源接口,而不是硬编码模型、数字人或音色 ID。