Создавайте говорящие видео с аватаром и синхронизацией губ из текста или аудио с помощью VisionStory REST API или Python SDK. Получайте актуальные модели, аватары и голоса, отправляйте асинхронную задачу и скачивайте готовый MP4 — или автоматизируйте этот же процесс через CLI, MCP-сервер или Agent Skill.
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Впервые здесь?
Создайте API-ключ, затем отправьте этот промпт вашему кодинг-агенту. Он проведёт вас через вход в visionstory, проверит кредиты и создаст видео, не раскрывая ваш ключ.
Инструменты VisionStory для разработчиков
Выберите интеграцию API под свой стек.
REST, Python SDK, CLI, MCP-сервер и Agent Skill используют один и тот же VisionStory API с аутентификацией и одинаковые ID ресурсов. Начните с одного интерфейса, а затем перенесите тот же процесс создания видео с аватаром в бэкенд, CI-пайплайн или кодинг-агента.
Создайте серверный API-ключ, проверьте баланс Кредитов и получите актуальные ID модели, аватара и голоса. Отправьте один text_script или audio_script в POST /api/v1/video, опрашивайте примерно каждые пять секунд, пока задача не будет создана, затем скачайте MP4. URL готовых видео хранятся семь дней.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Каталог моделей VisionStory
Выберите модель под нужный результат.
Начните с задачи, которую нужно решить, а затем подгружайте актуальный каталог моделей во время выполнения. Ответ API — единственный источник истины по доступным ID, принимаемым параметрам и ограничениям вывода.
Используйте один API-ключ, чтобы создавать говорящих ведущих, синтезировать естественную речь, переиспользовать кастомные аватары, голоса и медиа-ассеты и генерировать дополнительные видеоклипы. Делайте локализованные объясняющие ролики, персонализированный онбординг, обучение, outreach для продаж или медиа, созданные агентом, без склейки отдельных провайдеров.
Прямые ответы про аутентификацию, запросы, асинхронные задачи, SDK, автоматизацию через CLI, MCP и использование в продакшене.
API ИИ-видео с аватаром превращает цифрового ведущего и текст или записанное аудио в видео с синхронизацией губ, которое приложение может генерировать программно. VisionStory принимает аутентифицированные серверные запросы, сразу возвращает ID видео, рендерит задачу асинхронно и выдаёт URL MP4 после завершения генерации.
Создайте VisionStory API key, проверьте свои Кредиты, получите актуальные ID модели, аватара и голоса, затем отправьте либо text_script, либо audio_script в POST /api/v1/video. API сразу вернёт ID видео. Опрашивайте задачу примерно каждые пять секунд, пока её статус не станет created, затем скачайте MP4 по video_url.
Используйте REST, когда нужен независимый от языка контроль; Python SDK — когда вы создаёте Python-сервис или ноутбук; CLI — для автоматизации в терминале, CI или пакетной генерации. Все три интерфейса используют одни и те же ресурсы VisionStory и асинхронный процесс создания видео.
Да. Установите VisionStory Agent Skill или подключите VisionStory MCP server. Поддерживаемый кодинговый агент может проверить Кредиты, вывести список актуальных моделей, аватаров и голосов, подготовить корректный запрос, запустить задачу, отслеживать её и скачать результат — при этом API key остаётся в вашем окружении или в хранилище секретов MCP.
Да. Отправляйте audio_script, когда аватар должен говорить по записанному аудио, или отправляйте text_script с ID голоса, когда VisionStory нужно синтезировать речь. Используйте один тип сценария на запрос, а не оба сразу.
Рассматривайте создание видео как асинхронную задачу. Сохраните ID клиентского запроса и возвращённый ID видео, опрашивайте примерно каждые пять секунд и остановитесь, когда задача перейдёт в created или failed. URL готовых видео хранятся семь дней, поэтому при необходимости копируйте результат в своё постоянное хранилище.
Храните VISIONSTORY_API_KEY в переменной окружения на сервере, в секрете CI или в хранилище секретов MCP-клиента и передавайте его через заголовок запроса X-API-Key. Никогда не встраивайте ключ в браузерный код, бандл мобильного приложения, публичный репозиторий, скриншоты, логи или сообщение в AI-чате.
Вы можете сочетать видео с аватаром с текстом в речь, публичными или клонированными голосами, переиспользуемыми изображениями и аудио-ассетами, транскрибацией, генерацией ИИ-изображений и передовыми видеомоделями. Эти базовые компоненты подходят для локализованных объясняющих роликов, персонализированных обращений, автоматизированного учебного контента и медиапроцессов с ИИ-агентами.
Начните с одного аутентифицированного запроса
Соберите свою первую интеграцию ИИ-видео с аватаром.
Создайте API key, проверьте Кредиты и пройдите пятишаговый quickstart по говорящему аватару. Начните с REST или Python, а затем по мере роста процессов добавьте автоматизацию через CLI, инструменты MCP или Agent Skill. Запрашивайте «живые» эндпоинты ресурсов вместо того, чтобы жёстко прописывать ID модели, аватара или голоса.