Створюйте відео з говорящими аватарами з ліпсинком із тексту або аудіо за допомогою VisionStory REST API або Python SDK. Переглядайте актуальні моделі, аватари та голоси, надсилайте асинхронне завдання й завантажуйте готовий MP4 — або автоматизуйте той самий процес за допомогою CLI, MCP-сервера чи Agent Skill.
Скопіюйте одне повідомлення для налаштування вашого coding agent або підключіть MCP-сервер і відкрийте VisionStory як інструмент для повторного використання.
VisionStory CLI
Встановіть один раз. Використовуйте кожен API з термінала.
Інсталятор оновлює до найновішого релізу з PyPI в ізольованому середовищі. Ваші наявні Python-проєкти залишаються недоторканими.
Надішліть цю підказку для налаштування до Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Вперше тут?
Створіть API-ключ, а потім надішліть цю підказку вашому coding agent. Він проведе вас через вхід у visionstory, перевірить кредити та створить відео, не розкриваючи ваш ключ.
Інструменти VisionStory для розробників
Оберіть API-інтеграцію для вашого стеку.
REST, Python SDK, CLI, MCP-сервер і Agent Skill використовують один і той самий автентифікований VisionStory API та ідентифікатори ресурсів. Почніть з одного інтерфейсу, а потім перенесіть цей самий процес створення відео з аватаром у бекенд, CI-пайплайн або агента для кодування.
Створіть серверний API-ключ, перевірте баланс кредитів і дізнайтеся актуальні ID моделі, аватара та голосу. Надішліть text_script або audio_script у POST /api/v1/video, опитуйте приблизно кожні п’ять секунд, доки завдання не буде створено, а потім завантажте MP4. URL готових відео зберігаються протягом семи днів.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Каталог моделей VisionStory
Оберіть модель для потрібного вам результату.
Почніть із завдання, яке потрібно виконати, а потім отримайте актуальний каталог моделей під час виконання. Відповідь API є єдиним джерелом правди щодо доступних ID, прийнятних параметрів і лімітів результату.
Використовуйте один API-ключ, щоб створювати говорящих ведучих, синтезувати природне мовлення, повторно використовувати кастомні аватари, голоси та медіаактиви й генерувати допоміжні відеокліпи. Створюйте локалізовані пояснювальні відео, персоналізований онбординг, навчальні матеріали, продажні звернення або медіа, створені агентом, без необхідності «зшивати» різних провайдерів.
Прямі відповіді про автентифікацію, запити, асинхронні завдання, SDK, автоматизацію CLI, MCP та використання в продакшені.
API AI-відео з аватаром перетворює цифрового ведучого разом із текстом або записаним аудіо на відео з синхронізацією губ, яке застосунок може генерувати програмно. VisionStory приймає автентифіковані серверні запити, одразу повертає ID відео, рендерить завдання асинхронно та надає URL MP4 після завершення генерації.
Створіть ключ VisionStory API, перевірте свої кредити, отримайте актуальні ID моделі, аватара та голосу, а потім надішліть або text_script, або audio_script у POST /api/v1/video. API одразу поверне ID відео. Опитуйте завдання приблизно кожні п’ять секунд, доки його статус не стане created, після чого завантажте MP4 з video_url.
Використовуйте REST, коли потрібен мовонезалежний контроль; Python SDK — коли ви будуєте Python-сервіс або notebook; а CLI — для автоматизації в терміналі, CI або пакетної генерації. Усі три інтерфейси використовують ті самі ресурси VisionStory та асинхронний робочий процес генерації відео.
Так. Встановіть VisionStory Agent Skill або підключіть VisionStory MCP server. Підтримуваний coding agent може перевірити кредити, показати список актуальних моделей, аватарів і голосів, підготувати коректний запит, запустити відеозавдання, відстежувати його та завантажити результат, при цьому ключ API залишатиметься у вашому середовищі або в сховищі секретів MCP.
Так. Надсилайте audio_script, коли хочете, щоб аватар говорив із записаного аудіо, або надсилайте text_script з ID голосу, коли VisionStory має синтезувати мовлення. Використовуйте один тип сценарію на запит, а не обидва одночасно.
Розглядайте створення відео як асинхронне завдання. Зберігайте ID запиту клієнта та повернений ID відео, опитуйте приблизно кожні п’ять секунд і зупиняйтеся, коли завдання перейде в created або failed. URL готових відео зберігаються протягом семи днів, тож за потреби копіюйте готові файли у власне постійне сховище.
Зберігайте VISIONSTORY_API_KEY у змінній середовища на сервері, у секретах CI або в сховищі секретів клієнта MCP та передавайте його через заголовок запиту X-API-Key. Ніколи не вбудовуйте ключ у код браузера, бандл мобільного застосунку, публічний репозиторій, скриншоти, логи або повідомлення в AI-чаті.
Ви можете поєднувати відео з аватаром із «Текстом у мовлення», публічними або клонованими голосами, повторно використовуваними ресурсами зображень і аудіо, транскрибацією, AI-генерацією зображень та передовими відеомоделями. Ці базові можливості підтримують локалізовані пояснювальні ролики, персоналізовані звернення, автоматизований навчальний контент і медіаробочі процеси з AI-агентами.
Почніть з одного автентифікованого запиту
Створіть свою першу інтеграцію AI-відео з аватаром.
Створіть ключ API, перевірте свої кредити та запустіть швидкий старт «аватар, що говорить» із 5 кроків. Почніть із REST або Python, а потім додайте автоматизацію CLI, інструменти MCP або Agent Skill у міру зростання вашого робочого процесу. Звертайтеся до живих endpoint-ів ресурсів замість того, щоб жорстко прописувати ID моделі, аватара чи голосу.