Създавайте lip-sync talking-avatar видеа от текст или аудио с VisionStory REST API или Python SDK. Открийте актуалните модели, аватари и гласове, пуснете асинхронна задача и изтеглете готовото MP4 — или автоматизирайте същия процес с CLI, MCP сървър или Agent Skill.
Копирайте едно съобщение за настройка за вашия coding агент или свържете MCP сървъра и направете VisionStory достъпен като инструмент за многократна употреба.
VisionStory CLI
Инсталирайте веднъж. Използвайте всеки API от терминала си.
Инсталаторът обновява до най-новата версия в PyPI в изолирана среда. Съществуващите ви Python проекти остават недокоснати.
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Нов тук?
Създайте API ключ, след това изпратете този промпт на вашия coding агент. Той ще ви преведе през входа във visionstory, ще провери кредитите и ще създаде видеото, без да разкрива ключа ви.
Инструменти за разработчици на VisionStory
Изберете API интеграция за вашия стек.
REST, Python SDK, CLI, MCP сървърът и Agent Skill използват една и съща автентикирана VisionStory API и resource ID-та. Започнете с един интерфейс, после прехвърлете същия процес за аватар видеа към бекенд, CI pipeline или coding agent.
Създайте server-side API ключ, проверете баланса си от кредити и открийте актуалните ID-та за модел, аватар и глас. Изпратете text_script или audio_script към POST /api/v1/video, проверявайте приблизително на всеки пет секунди, докато задачата бъде създадена, след което изтеглете MP4. URL адресите на завършените видеа се пазят 7 дни.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Каталог с модели на VisionStory
Изберете модела за резултата, от който се нуждаете.
Започнете от задачата, която трябва да изпълните, и после извличайте актуалния каталог с модели по време на изпълнение. Отговорът на API е източникът на истина за наличните ID-та, поддържаните параметри и ограниченията на резултата.
Използвайте един API ключ, за да създавате talking водещи, да синтезирате естествена реч, да преизползвате персонализирани аватари, гласове и медийни ресурси и да генерирате допълващи видео клипове. Създавайте локализирани обяснителни видеа, персонализирано onboarding, обучение, outreach за продажби или медия, създадена от agent — без да сглобявате различни доставчици.
Директни отговори за автентикация, заявки, асинхронни задачи, SDK, CLI автоматизация, MCP и употреба в продукция.
API за AI аватар видео превръща дигитален водещ плюс текст или записано аудио във видео с лип-синк, което приложението може да генерира програмно. VisionStory приема автентикирани заявки от сървърната страна, връща video ID веднага, рендерира задачата асинхронно и предоставя MP4 URL, когато генерирането приключи.
Създайте VisionStory API key, проверете кредитите си, вземете актуалните model, avatar и voice ID-та, след което изпратете или text_script, или audio_script към POST /api/v1/video. API връща video ID веднага. Проверявайте статуса приблизително на всеки пет секунди, докато стане created, след което изтеглете MP4 от video_url.
Използвайте REST, когато ви трябва контрол, независим от езика; Python SDK — когато изграждате Python услуга или notebook; а CLI — за автоматизация в терминал, CI или пакетно генериране. И трите интерфейса използват едни и същи ресурси на VisionStory и асинхронен работен процес за видео.
Да. Инсталирайте VisionStory Agent Skill или свържете VisionStory MCP сървъра. Поддържан coding агент може да провери кредитите, да изведе списък с текущите модели, аватари и гласове, да подготви валидна заявка, да стартира видео задачата, да я следи и да изтегли резултата, докато API ключът остава във вашата среда или в secret storage на MCP.
Да. Изпратете audio_script, когато искате аватарът да говори по записано аудио, или изпратете text_script с voice ID, когато VisionStory трябва да синтезира речта. Използвайте само един тип скрипт на заявка, вместо да изпращате и двата.
Третирайте създаването на видео като асинхронна задача. Запазете вашия client request ID и върнатото video ID, проверявайте приблизително на всеки пет секунди и спрете, когато задачата достигне created или failed. URL адресите на готовите видеа се пазят седем дни, затова при нужда копирайте завършения файл в собствено постоянно хранилище.
Съхранявайте VISIONSTORY_API_KEY в server environment variable, CI secret или в MCP client secret store и го изпращайте чрез request header X-API-Key. Никога не вграждайте ключа в браузърен код, bundle на мобилно приложение, публично хранилище, скрийншоти, логове или AI чат съобщение.
Можете да комбинирате аватар видео с текст към реч, публични или клонирани гласове, многократно използваеми image и audio активи, транскрипция, AI генериране на изображения и най-нови видео модели. Тези базови компоненти поддържат локализирани explainer видеа, персонализиран outreach, автоматизирано обучително съдържание и медийни работни процеси с AI агенти.
Започнете с една автентикирана заявка
Създайте първата си интеграция за AI аватар видео.
Създайте API key, проверете кредитите си и следвайте петстъпковото quickstart ръководство за говорещ аватар. Започнете с REST или Python, а после добавете CLI автоматизация, MCP инструменти или Agent Skill, когато работният ви процес се разраства. Правете заявки към live resource endpoints, вместо да заковавате в кода model, avatar или voice ID-та.