Русский

VisionStory API
создан для разработчиков

Создавайте говорящие видео с аватаром и синхронизацией губ из текста или аудио с помощью VisionStory REST API или Python SDK. Получайте актуальные модели, аватары и голоса, отправляйте асинхронную задачу и скачивайте готовый MP4 — или автоматизируйте этот же процесс через CLI, MCP-сервер или Agent Skill.

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Готово для агента

Работает там, где работают ваши агенты.

Скопируйте одно сообщение настройки для вашего кодинг-агента или подключите MCP-сервер и сделайте VisionStory переиспользуемым инструментом.

VisionStory CLI

Установите один раз. Используйте любой API из терминала.

Установщик обновляет до последнего релиза на PyPI в изолированной среде. Ваши существующие проекты Python останутся нетронутыми.

curl -fsSL https://developers.visionstory.ai/cli | bash
Отправить этот промпт настройки в Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Впервые здесь?

Создайте API-ключ, затем отправьте этот промпт вашему кодинг-агенту. Он проведёт вас через вход в visionstory, проверит кредиты и создаст видео, не раскрывая ваш ключ.

Инструменты VisionStory для разработчиков

Выберите интеграцию API под свой стек.

REST, Python SDK, CLI, MCP-сервер и Agent Skill используют один и тот же VisionStory API с аутентификацией и одинаковые ID ресурсов. Начните с одного интерфейса, а затем перенесите тот же процесс создания видео с аватаром в бэкенд, CI-пайплайн или кодинг-агента.

01REST

Вызывайте REST API

Вызывайте VisionStory из любого серверного языка. Получите список актуальных моделей, аватаров и голосов; отправьте один text_script или audio_script в POST /api/v1/video; опрашивайте задачу, пока она не будет создана; затем скачайте MP4.

Открыть справочник REST API
02PYTHON

Создавайте с Python SDK

Используйте типизированный Python-клиент без зависимостей для аутентификации через переменные окружения, сборки payload, загрузок, опроса задач и скачивания результатов. Подходит для Python-приложений, ноутбуков и внутренних медиа-сервисов.

Открыть быстрый старт Python SDK
03CLI

Автоматизируйте через CLI

Запускайте visionstory doctor, проверяйте Кредиты, находите ID ресурсов, генерируйте видео с аватаром, просматривайте задачи и скачивайте результаты из терминала, shell-скрипта или CI-задачи — без необходимости сначала собирать приложение.

Установить и проверить CLI
04MCP / SKILL

Подключите ИИ-агента для кода

Подключите VisionStory MCP-сервер или установите Agent Skill, чтобы Codex, Claude Code, Cursor, Windsurf, Cline и Gemini могли находить ресурсы, генерировать медиа и скачивать результаты, при этом API-ключ оставался в локальном хранилище секретов.

Подключить MCP или Agent Skill

Быстрый старт Talking avatar API

Создайте своё первое видео с говорящим аватаром.

Создайте серверный API-ключ, проверьте баланс Кредитов и получите актуальные ID модели, аватара и голоса. Отправьте один text_script или audio_script в POST /api/v1/video, опрашивайте примерно каждые пять секунд, пока задача не будет создана, затем скачайте MP4. URL готовых видео хранятся семь дней.

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

Каталог моделей VisionStory

Выберите модель под нужный результат.

Начните с задачи, которую нужно решить, а затем подгружайте актуальный каталог моделей во время выполнения. Ответ API — единственный источник истины по доступным ID, принимаемым параметрам и ограничениям вывода.

Компонованные API ИИ-медиа

Комбинируйте API аватаров, голоса и ИИ-видео.

Используйте один API-ключ, чтобы создавать говорящих ведущих, синтезировать естественную речь, переиспользовать кастомные аватары, голоса и медиа-ассеты и генерировать дополнительные видеоклипы. Делайте локализованные объясняющие ролики, персонализированный онбординг, обучение, outreach для продаж или медиа, созданные агентом, без склейки отдельных провайдеров.

Портрет и аудио превращаются в видео с говорящим аватаром через VisionStory API

Базовый процесс работы с аватарами

API видео с говорящим аватаром

Создавайте видео с ведущим и синхронизацией губ из текста или записанного аудио. Выберите публичный аватар или создайте переиспользуемый кастомный аватар из одного портрета, выберите публичный или клонированный голос — и получите MP4 для скачивания после завершения асинхронной задачи.

Сценарий превращается в звуковую волну через VisionStory API текста в речь

Слой голоса и речи

API текста в речь и голоса

Преобразуйте текст в естественную MP3-речь с публичным или клонированным голосом, а затем используйте тот же голос в видео с аватаром и локализованном контенте. Запрашивайте каталог голосов во время выполнения вместо того, чтобы «зашивать» ID голосов в код.

Промпт превращается в сгенерированное видео через VisionStory API ИИ-видео

Создание под управлением агента

API генерации ИИ-видео

Создавайте клипы text-to-video, image-to-video и по референсу, выбирая модель из актуального каталога. ИИ-агент может подготовить промпты и ассеты, оценить Кредиты, отправить задачу и объединить результат с аватаром-ведущим.

FAQ по API ИИ-видео с аватаром

Прямые ответы про аутентификацию, запросы, асинхронные задачи, SDK, автоматизацию через CLI, MCP и использование в продакшене.

  • API ИИ-видео с аватаром превращает цифрового ведущего и текст или записанное аудио в видео с синхронизацией губ, которое приложение может генерировать программно. VisionStory принимает аутентифицированные серверные запросы, сразу возвращает ID видео, рендерит задачу асинхронно и выдаёт URL MP4 после завершения генерации.

Начните с одного аутентифицированного запроса

Соберите свою первую интеграцию ИИ-видео с аватаром.

Создайте API key, проверьте Кредиты и пройдите пятишаговый quickstart по говорящему аватару. Начните с REST или Python, а затем по мере роста процессов добавьте автоматизацию через CLI, инструменты MCP или Agent Skill. Запрашивайте «живые» эндпоинты ресурсов вместо того, чтобы жёстко прописывать ID модели, аватара или голоса.