Vytvářejte lip-sync videa s mluvícími avatary z textu nebo audia pomocí VisionStory REST API nebo Python SDK. Najděte aktuální modely, avatary a hlasy, odešlete asynchronní úlohu a stáhněte hotové MP4 — nebo stejný workflow automatizujte pomocí CLI, MCP serveru nebo Agent Skill.
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Jste tu noví?
Vytvořte API klíč a pak pošlete tento prompt svému programovacímu agentovi. Provede vás přihlášením do VisionStory, ověří kredity a vytvoří video, aniž by vystavil váš klíč.
Nástroje VisionStory pro vývojáře
Vyberte si integraci API pro svůj stack.
REST, Python SDK, CLI, MCP server i Agent Skill používají stejné autentizované VisionStory API a ID zdrojů. Začněte s jedním rozhraním a pak stejný workflow pro videa s avatary přesuňte do backendu, CI pipeline nebo kódovacího agenta.
Vytvořte serverový API klíč, ověřte stav kreditů a zjistěte aktuální ID modelu, avatara a hlasu. Odešlete jeden text_script nebo audio_script na POST /api/v1/video, kontrolujte zhruba každých pět sekund, dokud se úloha nevytvoří, a poté stáhněte MP4. URL dokončených videí se uchovávají po dobu sedmi dnů.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Katalog modelů VisionStory
Vyberte model pro výstup, který potřebujete.
Začněte úlohou, kterou potřebujete dokončit, a pak si za běhu načtěte aktuální katalog modelů. Odpověď API je jediným zdrojem pravdy pro dostupná ID, akceptované parametry a limity výstupu.
Použijte jeden API klíč k vytváření mluvících moderátorů, syntéze přirozené řeči, opakovanému využití vlastních avatarů, hlasů a mediálních assetů i generování doplňkových videoklipů. Vytvářejte lokalizované explainery, personalizovaný onboarding, vzdělávání, sales outreach nebo média vytvořená agenty — bez skládání více různých poskytovatelů.
Přímé odpovědi k autentizaci, požadavkům, asynchronním úlohám, SDK, automatizaci přes CLI, MCP a nasazení do produkce.
API pro AI avatar video převádí digitálního moderátora spolu s textem nebo nahraným audiem na video se synchronizací rtů, které aplikace může generovat programově. VisionStory přijímá autentizované požadavky ze serveru, okamžitě vrátí ID videa, úlohu vyrenderuje asynchronně a po dokončení generování poskytne URL na MP4.
Vytvořte si VisionStory API klíč, ověřte své kredity, načtěte aktuální ID modelu, avatara a hlasu a poté odešlete buď text_script, nebo audio_script na POST /api/v1/video. API okamžitě vrátí ID videa. Dotazujte se na stav úlohy zhruba každých pět sekund, dokud nebude status created, a pak stáhněte MP4 z video_url.
REST použijte, když potřebujete jazykově nezávislé ovládání, Python SDK při tvorbě Python služby nebo notebooku a CLI pro automatizaci v terminálu, CI nebo dávkové generování. Všechny tři rozhraní používají stejné prostředky VisionStory a asynchronní workflow videí.
Ano. Nainstalujte VisionStory Agent Skill nebo připojte VisionStory MCP server. Podporovaný kódovací agent může ověřit kredity, vypsat aktuální modely, avatary a hlasy, připravit platný požadavek, spustit úlohu videa, průběžně ji sledovat a stáhnout výsledek — přičemž API klíč zůstává ve vašem prostředí nebo v MCP úložišti tajných údajů.
Ano. Pošlete audio_script, když chcete, aby avatar mluvil z nahraného audia, nebo pošlete text_script s ID hlasu, když má VisionStory řeč syntetizovat. V jednom požadavku použijte vždy jen jeden typ skriptu, neposílejte oba.
Berte tvorbu videa jako asynchronní úlohu. Uložte si ID požadavku klienta i vrácené ID videa, dotazujte se zhruba každých pět sekund a skončete, jakmile se úloha dostane do stavu created nebo failed. URL dokončených videí se uchovávají sedm dní, takže v případě potřeby zkopírujte hotové médium do svého trvalého úložiště.
Ukládejte VISIONSTORY_API_KEY do proměnné prostředí na serveru, do CI secrets nebo do úložiště tajných údajů MCP klienta a posílejte ho v hlavičce požadavku X-API-Key. Klíč nikdy nevkládejte do kódu prohlížeče, balíčku mobilní aplikace, veřejného repozitáře, screenshotů, logů ani do zprávy v AI chatu.
Video s avatarem můžete kombinovat s Text na řeč, veřejnými nebo klonovanými hlasy, znovupoužitelnými obrazovými a zvukovými podklady, přepisem, generováním AI obrázků a špičkovými video modely. Tyto stavební bloky podporují lokalizovaná vysvětlující videa, personalizované oslovení, automatizovaný vzdělávací obsah a mediální workflow řízené AI agenty.
Začněte jedním autentizovaným požadavkem
Vytvořte svou první integraci pro AI avatar video.
Vytvořte si API klíč, ověřte své kredity a spusťte pětikrokový rychlý start pro mluvícího avatara. Začněte s REST nebo Pythonem a s růstem workflow přidejte automatizaci přes CLI, nástroje MCP nebo Agent Skill. Místo pevného zadávání ID modelu, avatara nebo hlasu se dotazujte na živé resource endpointy.