VisionStory API
stworzone dla deweloperów

Twórz wideo z gadającym awatarem z synchronizacją ust na podstawie tekstu lub audio dzięki VisionStory REST API lub Python SDK. Odkrywaj aktualne modele, awatary i głosy, wysyłaj zadanie asynchroniczne i pobieraj gotowy plik MP4 — albo zautomatyzuj ten sam workflow za pomocą CLI, serwera MCP lub Agent Skill.

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Agent gotowy

Działa tam, gdzie pracują Twoi agenci.

Skopiuj jedną wiadomość konfiguracyjną dla swojego agenta programistycznego albo podłącz serwer MCP i udostępnij VisionStory jako narzędzie wielokrotnego użytku.

VisionStory CLI

Zainstaluj raz. Korzystaj z każdego API z terminala.

Instalator aktualizuje do najnowszej wersji z PyPI w odizolowanym środowisku, więc Twoje obecne projekty w Pythonie pozostają nienaruszone.

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSLOpcje instalacji
Wyślij ten prompt konfiguracji do Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Dopiero zaczynasz?

Utwórz klucz API, a następnie wyślij ten prompt do swojego agenta programistycznego. Przeprowadzi Cię przez logowanie do VisionStory, sprawdzi Kredyty i stworzy wideo, nie ujawniając Twojego klucza.

Narzędzia deweloperskie VisionStory

Wybierz integrację API dla swojego stosu technologicznego.

REST, Python SDK, CLI, serwer MCP i Agent Skill korzystają z tego samego uwierzytelnionego API VisionStory oraz tych samych identyfikatorów zasobów. Zacznij od jednego interfejsu, a potem przenieś ten sam workflow wideo z awatarem do backendu, pipeline’u CI lub agenta programistycznego.

Quickstart API gadającego awatara

Wygeneruj swoje pierwsze wideo z gadającym awatarem.

Utwórz klucz API po stronie serwera, sprawdź saldo kredytów i poznaj aktualne identyfikatory modelu, awatara i głosu. Wyślij jeden text_script lub audio_script do POST /api/v1/video, odpytyuj mniej więcej co 5 sekund, aż zadanie zostanie utworzone, a następnie pobierz MP4. Adresy URL ukończonych wideo są przechowywane przez 7 dni.

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

Katalog modeli VisionStory

Wybierz model dla potrzebnego efektu.

Zacznij od zadania, które chcesz wykonać, a następnie pobierz aktualny katalog modeli w runtime. Odpowiedź API jest źródłem prawdy o dostępnych identyfikatorach, akceptowanych parametrach i limitach wyjściowych.

Składane API mediów AI

Połącz API awatarów, głosu i Wideo AI.

Użyj jednego klucza API, aby tworzyć gadających prezenterów, syntezować naturalną mowę, ponownie wykorzystywać niestandardowe awatary, głosy i zasoby medialne oraz generować uzupełniające klipy wideo. Twórz zlokalizowane materiały wyjaśniające, spersonalizowany onboarding, edukację, działania sprzedażowe lub media tworzone przez agentów — bez łączenia wielu dostawców.

FAQ API wideo z awatarem AI

Konkretne odpowiedzi o uwierzytelnianiu, żądaniach, zadaniach asynchronicznych, SDK, automatyzacji CLI, MCP i użyciu produkcyjnym.

  • API wideo z awatarem AI zamienia cyfrowego prezentera oraz tekst lub nagrane audio w wideo z synchronizacją ruchu ust, które aplikacja może generować programowo. VisionStory przyjmuje uwierzytelnione żądania po stronie serwera, natychmiast zwraca identyfikator wideo, renderuje zadanie asynchronicznie i udostępnia URL do MP4 po zakończeniu generowania.

Zacznij od jednego uwierzytelnionego żądania

Zbuduj swoją pierwszą integrację wideo z awatarem AI.

Utwórz klucz API, sprawdź swoje Kredyty i przejdź przez pięcioetapowy quickstart mówiącego awatara. Zacznij od REST lub Pythona, a potem dodaj automatyzację CLI, narzędzia MCP lub Agent Skill, gdy Twój workflow będzie się rozwijał. Odpytuj endpointy zasobów na żywo zamiast na stałe wpisywać identyfikatory modelu, awatara lub głosu.