Bouw lipsynced talking-avatarvideo’s op basis van tekst of audio met de VisionStory REST API of Python SDK. Ontdek de huidige modellen, avatars en stemmen, dien een asynchrone job in en download de voltooide MP4—of automatiseer dezelfde workflow met de CLI, MCP-server of Agent Skill.
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Nieuw hier?
Maak een API-key aan en stuur deze prompt naar je coding agent. Die begeleidt je door visionstory login, controleert credits en maakt de video aan zonder je key bloot te geven.
VisionStory developer tools
Kies de API-integratie voor jouw stack.
REST, de Python SDK, CLI, MCP-server en Agent Skill gebruiken allemaal dezelfde geauthenticeerde VisionStory API en resource-ID’s. Begin met één interface en verplaats dezelfde avatarvideo-workflow vervolgens naar een backend, CI-pipeline of coding agent.
Maak een server-side API-sleutel aan, controleer je creditsaldo en ontdek de huidige model-, avatar- en stem-ID’s. Dien één text_script of audio_script in via POST /api/v1/video, poll ongeveer elke vijf seconden totdat de job is aangemaakt en download vervolgens de MP4. URL’s van voltooide video’s worden zeven dagen bewaard.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
VisionStory modelcatalogus
Kies het model voor de output die je nodig hebt.
Begin met de job die je moet afronden en haal daarna tijdens runtime de actuele modelcatalogus op. De API-response is de bron van waarheid voor beschikbare ID’s, geaccepteerde parameters en outputlimieten.
Gebruik één API-sleutel om talking presenters te maken, natuurlijke spraak te synthetiseren, custom avatars, stemmen en media-assets te hergebruiken en ondersteunende videoclips te genereren. Bouw gelokaliseerde uitlegvideo’s, gepersonaliseerde onboarding, educatie, sales outreach of door agents gemaakte media—zonder verschillende providers aan elkaar te knopen.
Directe antwoorden over authenticatie, requests, asynchrone jobs, SDK’s, CLI-automatisering, MCP en productiegebruik.
Een AI avatar video API zet een digitale presentator plus tekst of opgenomen audio om in een lipsynced video die een applicatie programmatisch kan genereren. VisionStory accepteert geauthenticeerde server-side requests, geeft meteen een video-ID terug, rendert de job asynchroon en levert een MP4-URL zodra de generatie is voltooid.
Maak een VisionStory API-sleutel aan, controleer je credits, haal de actuele model-, avatar- en stem-ID’s op, en dien vervolgens een text_script of een audio_script in via POST /api/v1/video. De API geeft meteen een video-ID terug. Poll de job ongeveer elke vijf seconden totdat de status created is, en download daarna de MP4 via video_url.
Gebruik REST wanneer je taal-onafhankelijke controle nodig hebt, de Python SDK wanneer je een Python-service of notebook bouwt, en de CLI voor terminalautomatisering, CI of batchgeneratie. Alle drie de interfaces gebruiken dezelfde VisionStory-resources en asynchrone videoworkflow.
Ja. Installeer de VisionStory Agent Skill of verbind de VisionStory MCP-server. Een ondersteunde coding agent kan credits controleren, actuele modellen, avatars en stemmen ophalen, een geldige request voorbereiden, de videojob starten, deze monitoren en het resultaat downloaden, terwijl de API-sleutel in je omgeving of in de MCP secret storage blijft.
Ja. Stuur een audio_script wanneer je wilt dat de avatar spreekt vanuit opgenomen audio, of stuur een text_script met een stem-ID wanneer VisionStory de spraak moet synthetiseren. Gebruik per request één scripttype in plaats van beide te versturen.
Behandel videocreëatie als een asynchrone job. Sla je client request ID en het teruggegeven video-ID op, poll ongeveer elke vijf seconden en stop wanneer de job created of failed bereikt. Voltooide video-URL’s worden zeven dagen bewaard, dus kopieer afgeronde media indien nodig naar je eigen permanente opslag.
Bewaar VISIONSTORY_API_KEY in een server environment variable, CI secret of MCP client secret store en stuur deze mee via de X-API-Key request header. Verwerk de sleutel nooit in browsercode, een mobiele app-bundle, een openbare repository, screenshots, logs of een AI-chatbericht.
Je kunt avatarvideo combineren met tekst naar spraak, openbare of gekloonde stemmen, herbruikbare beeld- en audio-assets, transcriptie, AI-afbeeldingsgeneratie en geavanceerde videomodellen. Deze bouwstenen ondersteunen gelokaliseerde explainers, gepersonaliseerde outreach, geautomatiseerde leercontent en AI-agent mediaworkflows.
Begin met één geauthenticeerde request
Bouw je eerste AI avatarvideo-integratie.
Maak een API-sleutel aan, controleer je credits en doorloop de vijfstappen-quickstart voor een pratende avatar. Begin met REST of Python en voeg daarna CLI-automatisering, MCP-tools of de Agent Skill toe naarmate je workflow groeit. Query live resource-endpoints in plaats van model-, avatar- of stem-ID’s hard te coderen.