Creează videoclipuri cu avatar vorbitor sincronizat pe buze din text sau audio cu VisionStory REST API sau Python SDK. Descoperă modelele, avatarele și vocile disponibile, trimite o sarcină asincronă și descarcă MP4-ul final — sau automatizează același flux cu CLI, serverul MCP sau Agent Skill.
Trimite acest prompt de configurare către Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Ești nou aici?
Creează o cheie API, apoi trimite acest prompt agentului tău de programare. Te va ghida prin autentificarea în visionstory, va verifica Creditele și va crea videoclipul fără să-ți expună cheia.
Instrumente pentru dezvoltatori VisionStory
Alege integrarea API pentru stack-ul tău.
REST, Python SDK, CLI, serverul MCP și Agent Skill folosesc același API VisionStory autentificat și aceleași ID-uri de resurse. Începe cu o interfață, apoi mută același flux de lucru pentru videoclipuri cu avatar într-un backend, un pipeline CI sau un agent de programare.
Generează primul tău videoclip cu avatar vorbitor.
Creează o cheie API pe server, verifică soldul de Credite și descoperă ID-urile curente pentru model, avatar și voce. Trimite un text_script sau audio_script la POST /api/v1/video, interoghează cam la fiecare cinci secunde până când sarcina este creată, apoi descarcă MP4-ul. URL-urile videoclipurilor finalizate sunt păstrate timp de șapte zile.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Catalog de modele VisionStory
Alege modelul pentru rezultatul de care ai nevoie.
Pornește de la sarcina pe care trebuie s-o finalizezi, apoi preia catalogul curent de modele la runtime. Răspunsul API este sursa de adevăr pentru ID-urile disponibile, parametrii acceptați și limitele de ieșire.
Folosește o singură cheie API ca să creezi prezentatori care vorbesc, să sintetizezi vorbire naturală, să reutilizezi avatare personalizate, voci și resurse media și să generezi clipuri video de suport. Creează explicații localizate, onboarding personalizat, conținut educațional, outreach pentru vânzări sau media creată de agenți, fără să îmbini furnizori separați.
Întrebări frecvente despre API-ul de video cu avatar AI
Răspunsuri directe despre autentificare, cereri, joburi asincrone, SDK-uri, automatizare CLI, MCP și utilizare în producție.
Un API de video cu avatar AI transformă un prezentator digital împreună cu text sau audio înregistrat într-un videoclip cu sincronizare a buzelor, pe care o aplicație îl poate genera programatic. VisionStory acceptă cereri autentificate pe server, returnează imediat un ID de video, randă jobul asincron și furnizează un URL MP4 când generarea este finalizată.
Creează o cheie API VisionStory, verifică-ți Creditele, preia ID-urile curente pentru model, avatar și voce, apoi trimite fie un text_script, fie un audio_script la POST /api/v1/video. API-ul returnează imediat un ID de video. Interoghează jobul cam la fiecare cinci secunde până când statusul lui este created, apoi descarcă MP4-ul din video_url.
Folosește REST când ai nevoie de control independent de limbaj, Python SDK când construiești un serviciu sau un notebook în Python și CLI pentru automatizare în terminal, CI sau generare în lot. Toate cele trei interfețe folosesc aceleași resurse VisionStory și același flux de lucru video asincron.
Da. Instalează VisionStory Agent Skill sau conectează serverul VisionStory MCP. Un agent de programare compatibil poate verifica creditele, lista modelele, avatarele și vocile curente, pregăti o cerere validă, porni jobul video, îl poate monitoriza și descărca rezultatul, în timp ce cheia API rămâne în mediul tău sau în stocarea de secrete MCP.
Da. Trimite un audio_script când vrei ca avatarul să vorbească dintr-un audio înregistrat sau trimite un text_script cu un ID de voce când VisionStory trebuie să sintetizeze vorbirea. Folosește un singur tip de script per cerere, în loc să le trimiți pe ambele.
Tratează crearea video ca pe un job asincron. Stochează ID-ul cererii clientului și ID-ul de video returnat, interoghează cam la fiecare cinci secunde și oprește-te când jobul ajunge la created sau failed. URL-urile videoclipurilor finalizate sunt păstrate timp de șapte zile, așa că, atunci când este necesar, copiază materialele finalizate în propria ta stocare permanentă.
Păstrează VISIONSTORY_API_KEY într-o variabilă de mediu pe server, într-un secret CI sau în stocarea de secrete a clientului MCP și trimite-o prin antetul de cerere X-API-Key. Nu încorpora niciodată cheia în codul din browser, într-un bundle de aplicație mobilă, într-un repository public, în capturi de ecran, în loguri sau într-un mesaj de chat cu AI.
Poți combina video cu avatar cu text în vorbire, voci publice sau clonate, resurse reutilizabile de imagine și audio, transcriere, generare de imagini AI și modele video de ultimă generație. Aceste componente de bază susțin materiale explicative localizate, outreach personalizat, conținut de învățare automatizat și fluxuri de lucru media cu agenți AI.
Începe cu o cerere autentificată
Construiește prima ta integrare de video cu avatar AI.
Creează o cheie API, verifică-ți Creditele și parcurge quickstart-ul în 5 pași pentru avatarul vorbitor. Începe cu REST sau Python, apoi adaugă automatizare CLI, instrumente MCP sau Agent Skill pe măsură ce fluxul tău de lucru crește. Interoghează endpoint-urile de resurse live în loc să hard-codezi ID-urile de model, avatar sau voce.