Twórz wideo z gadającym awatarem z synchronizacją ust na podstawie tekstu lub audio dzięki VisionStory REST API lub Python SDK. Odkrywaj aktualne modele, awatary i głosy, wysyłaj zadanie asynchroniczne i pobieraj gotowy plik MP4 — albo zautomatyzuj ten sam workflow za pomocą CLI, serwera MCP lub Agent Skill.
Skopiuj jedną wiadomość konfiguracyjną dla swojego agenta programistycznego albo podłącz serwer MCP i udostępnij VisionStory jako narzędzie wielokrotnego użytku.
VisionStory CLI
Zainstaluj raz. Korzystaj z każdego API z terminala.
Instalator aktualizuje do najnowszej wersji z PyPI w odizolowanym środowisku, więc Twoje obecne projekty w Pythonie pozostają nienaruszone.
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Dopiero zaczynasz?
Utwórz klucz API, a następnie wyślij ten prompt do swojego agenta programistycznego. Przeprowadzi Cię przez logowanie do VisionStory, sprawdzi Kredyty i stworzy wideo, nie ujawniając Twojego klucza.
Narzędzia deweloperskie VisionStory
Wybierz integrację API dla swojego stosu technologicznego.
REST, Python SDK, CLI, serwer MCP i Agent Skill korzystają z tego samego uwierzytelnionego API VisionStory oraz tych samych identyfikatorów zasobów. Zacznij od jednego interfejsu, a potem przenieś ten sam workflow wideo z awatarem do backendu, pipeline’u CI lub agenta programistycznego.
Wygeneruj swoje pierwsze wideo z gadającym awatarem.
Utwórz klucz API po stronie serwera, sprawdź saldo kredytów i poznaj aktualne identyfikatory modelu, awatara i głosu. Wyślij jeden text_script lub audio_script do POST /api/v1/video, odpytyuj mniej więcej co 5 sekund, aż zadanie zostanie utworzone, a następnie pobierz MP4. Adresy URL ukończonych wideo są przechowywane przez 7 dni.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Katalog modeli VisionStory
Wybierz model dla potrzebnego efektu.
Zacznij od zadania, które chcesz wykonać, a następnie pobierz aktualny katalog modeli w runtime. Odpowiedź API jest źródłem prawdy o dostępnych identyfikatorach, akceptowanych parametrach i limitach wyjściowych.
Użyj jednego klucza API, aby tworzyć gadających prezenterów, syntezować naturalną mowę, ponownie wykorzystywać niestandardowe awatary, głosy i zasoby medialne oraz generować uzupełniające klipy wideo. Twórz zlokalizowane materiały wyjaśniające, spersonalizowany onboarding, edukację, działania sprzedażowe lub media tworzone przez agentów — bez łączenia wielu dostawców.
Konkretne odpowiedzi o uwierzytelnianiu, żądaniach, zadaniach asynchronicznych, SDK, automatyzacji CLI, MCP i użyciu produkcyjnym.
API wideo z awatarem AI zamienia cyfrowego prezentera oraz tekst lub nagrane audio w wideo z synchronizacją ruchu ust, które aplikacja może generować programowo. VisionStory przyjmuje uwierzytelnione żądania po stronie serwera, natychmiast zwraca identyfikator wideo, renderuje zadanie asynchronicznie i udostępnia URL do MP4 po zakończeniu generowania.
Utwórz klucz API VisionStory, sprawdź swoje Kredyty, pobierz aktualne identyfikatory modelu, awatara i głosu, a następnie wyślij do POST /api/v1/video albo text_script, albo audio_script. API natychmiast zwraca identyfikator wideo. Odpytuj zadanie co około pięć sekund, aż jego status będzie created, a potem pobierz MP4 z video_url.
Użyj REST, gdy potrzebujesz kontroli niezależnej od języka, Python SDK, gdy tworzysz usługę w Pythonie lub notebook, oraz CLI do automatyzacji w terminalu, CI lub generowania wsadowego. Wszystkie trzy interfejsy korzystają z tych samych zasobów VisionStory i asynchronicznego przepływu pracy wideo.
Tak. Zainstaluj VisionStory Agent Skill lub podłącz serwer VisionStory MCP. Wspierany agent programistyczny może sprawdzić Kredyty, wyświetlić listę aktualnych modeli, awatarów i głosów, przygotować poprawne żądanie, uruchomić zadanie wideo, monitorować je i pobrać wynik, podczas gdy klucz API pozostaje w Twoim środowisku lub w magazynie sekretów MCP.
Tak. Wyślij audio_script, gdy chcesz, aby awatar mówił z nagranego audio, albo wyślij text_script z identyfikatorem głosu, gdy VisionStory ma zsyntetyzować mowę. Używaj jednego typu skryptu na żądanie, zamiast wysyłać oba.
Traktuj tworzenie wideo jako zadanie asynchroniczne. Zapisz identyfikator żądania klienta i zwrócony identyfikator wideo, odpytyj co około pięć sekund i zakończ, gdy zadanie osiągnie status created lub failed. Ukończone URL-e do wideo są przechowywane przez siedem dni, więc w razie potrzeby skopiuj gotowe materiały do własnej, trwałej pamięci masowej.
Przechowuj VISIONSTORY_API_KEY w zmiennej środowiskowej serwera, sekrecie CI lub magazynie sekretów klienta MCP i wysyłaj go w nagłówku żądania X-API-Key. Nigdy nie osadzaj klucza w kodzie przeglądarki, paczce aplikacji mobilnej, publicznym repozytorium, zrzutach ekranu, logach ani w wiadomości czatu AI.
Możesz połączyć wideo z awatarem z Tekst na mowę, publicznymi lub sklonowanymi głosami, wielokrotnego użytku zasobami obrazu i audio, transkrypcją, generowaniem obrazów AI oraz najnowszymi modelami wideo. Te podstawowe elementy wspierają zlokalizowane materiały wyjaśniające, spersonalizowany outreach, zautomatyzowane treści szkoleniowe i przepływy pracy mediów z agentami AI.
Zacznij od jednego uwierzytelnionego żądania
Zbuduj swoją pierwszą integrację wideo z awatarem AI.
Utwórz klucz API, sprawdź swoje Kredyty i przejdź przez pięcioetapowy quickstart mówiącego awatara. Zacznij od REST lub Pythona, a potem dodaj automatyzację CLI, narzędzia MCP lub Agent Skill, gdy Twój workflow będzie się rozwijał. Odpytuj endpointy zasobów na żywo zamiast na stałe wpisywać identyfikatory modelu, awatara lub głosu.