Português (Portugal)

VisionStory API
criada para programadores

Crie vídeos de avatares falantes com sincronização labial a partir de texto ou áudio com a REST API da VisionStory ou o SDK de Python. Descubra os modelos, avatares e vozes atuais, submeta um trabalho assíncrono e transfira o MP4 final — ou automatize o mesmo fluxo de trabalho com a CLI, o servidor MCP ou o Agent Skill.

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Agente pronto

Funciona onde os seus agentes trabalham.

Copie uma mensagem de configuração para o seu agente de programação ou ligue o servidor MCP e disponibilize a VisionStory como uma ferramenta reutilizável.

VisionStory CLI

Instale uma vez. Use todas as APIs a partir do seu terminal.

O instalador faz upgrade para a versão mais recente no PyPI num ambiente isolado. Os seus projetos Python existentes permanecem intocados.

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSLOpções de instalação
Envie este prompt de configuração para Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Novo por aqui?

Crie uma chave de API e, depois, envie este prompt ao seu agente de programação. Ele irá guiá-lo no login do visionstory, verificar os Créditos e criar o vídeo sem expor a sua chave.

Ferramentas para programadores da VisionStory

Escolha a integração da API para a sua stack.

REST, o SDK de Python, a CLI, o servidor MCP e o Agent Skill usam todos a mesma API da VisionStory autenticada e os mesmos IDs de recursos. Comece com uma interface e depois leve o mesmo fluxo de trabalho de vídeo de avatar para um backend, pipeline de CI ou agente de programação.

Guia rápido da API de avatar falante

Gere o seu primeiro vídeo de avatar falante.

Crie uma chave de API do lado do servidor, verifique o seu saldo de Créditos e descubra os IDs atuais de modelo, avatar e Voz. Submeta um text_script ou audio_script para POST /api/v1/video, faça polling a cada cerca de cinco segundos até o trabalho ser criado e depois transfira o MP4. Os URLs dos vídeos concluídos são mantidos durante sete dias.

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

Catálogo de modelos da VisionStory

Escolha o modelo para o resultado de que precisa.

Comece pela tarefa que precisa de concluir e depois obtenha o catálogo de modelos atual em runtime. A resposta da API é a fonte de verdade para os IDs disponíveis, os parâmetros aceites e os limites de saída.

APIs de media com IA combináveis

Combine APIs de avatar, Voz e Vídeo com IA.

Use uma chave de API para criar apresentadores falantes, sintetizar fala natural, reutilizar avatares personalizados, vozes e ativos de media e gerar clips de vídeo de suporte. Crie vídeos explicativos localizados, onboarding personalizado, conteúdos de educação, prospeção comercial ou media criado por agentes, sem ter de juntar vários fornecedores.

Perguntas frequentes da API de Vídeo de Avatar com IA

Respostas diretas sobre autenticação, pedidos, tarefas assíncronas, SDKs, automação por CLI, MCP e utilização em produção.

  • Uma API de vídeo de avatar com IA transforma um apresentador digital mais texto ou áudio gravado num vídeo com sincronização labial que uma aplicação pode gerar de forma programática. O VisionStory aceita pedidos autenticados no servidor, devolve imediatamente um ID de vídeo, processa a tarefa de forma assíncrona e fornece um URL de MP4 quando a geração estiver concluída.

Comece com um pedido autenticado

Crie a sua primeira integração de vídeo de avatar com IA.

Crie uma chave de API, verifique os seus Créditos e siga o quickstart de avatar falante em cinco passos. Comece com REST ou Python e, depois, adicione automação por CLI, ferramentas MCP ou o Agent Skill à medida que o seu fluxo de trabalho cresce. Consulte endpoints de recursos em tempo real, em vez de codificar IDs de modelo, avatar ou voz no código.