Português (Brasil)

VisionStory API
feita para desenvolvedores

Crie vídeos de avatares falantes com sincronização labial a partir de texto ou áudio com a API REST do VisionStory ou o SDK Python. Descubra os modelos, avatares e vozes atuais, envie um job assíncrono e baixe o MP4 final — ou automatize o mesmo fluxo de trabalho com o CLI, servidor MCP ou Agent Skill.

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Agente pronto

Funciona onde seus agentes trabalham.

Copie uma mensagem de configuração para o seu agente de código ou conecte o servidor MCP e exponha o VisionStory como uma ferramenta reutilizável.

VisionStory CLI

Instale uma vez. Use todas as APIs pelo seu terminal.

O instalador atualiza para a versão mais recente do PyPI em um ambiente isolado. Seus projetos Python atuais ficam intactos.

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSLOpções de instalação
Envie este prompt de configuração para Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Novo por aqui?

Crie uma chave de API e envie este prompt para o seu agente de código. Ele vai te guiar pelo login no visionstory, verificar os créditos e criar o vídeo sem expor a sua chave.

Ferramentas de desenvolvedor do VisionStory

Escolha a integração de API para o seu stack.

REST, o SDK Python, o CLI, o servidor MCP e o Agent Skill usam a mesma API autenticada do VisionStory e os mesmos IDs de recursos. Comece com uma interface e depois leve o mesmo fluxo de vídeo de avatar para um backend, pipeline de CI ou agente de codificação.

Início rápido da API de avatar falante

Gere seu primeiro vídeo de avatar falante.

Crie uma chave de API do lado do servidor, verifique seu saldo de créditos e descubra os IDs atuais de modelo, avatar e voz. Envie um text_script ou audio_script para POST /api/v1/video, faça polling a cada cinco segundos até o job ser criado e depois baixe o MP4. As URLs dos vídeos concluídos são mantidas por sete dias.

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

Catálogo de modelos do VisionStory

Escolha o modelo para a saída que você precisa.

Comece pelo job que você precisa concluir e, em seguida, busque o catálogo de modelos atual em tempo de execução. A resposta da API é a fonte de verdade para IDs disponíveis, parâmetros aceitos e limites de saída.

APIs de mídia com IA componíveis

Combine APIs de avatar, Voz e Vídeo com IA.

Use uma única chave de API para criar apresentadores falantes, sintetizar fala natural, reutilizar avatares personalizados, vozes e ativos de mídia e gerar clipes de vídeo de apoio. Crie vídeos explicativos localizados, onboarding personalizado, educação, prospecção de vendas ou mídia criada por agentes sem precisar juntar provedores diferentes.

Perguntas frequentes sobre a API de Vídeo de Avatar com IA

Respostas diretas sobre autenticação, requisições, tarefas assíncronas, SDKs, automação via CLI, MCP e uso em produção.

  • Uma API de vídeo de avatar com IA transforma um apresentador digital com texto ou áudio gravado em um vídeo com sincronização labial, que um aplicativo pode gerar programaticamente. A VisionStory aceita requisições autenticadas do lado do servidor, retorna um ID de vídeo imediatamente, renderiza a tarefa de forma assíncrona e fornece uma URL de MP4 quando a geração é concluída.

Comece com uma requisição autenticada

Crie sua primeira integração de vídeo de avatar com IA.

Crie uma chave de API, verifique seus Créditos e execute o guia rápido de avatar falante em cinco etapas. Comece com REST ou Python e, depois, adicione automação via CLI, ferramentas MCP ou o Agent Skill conforme seu fluxo de trabalho cresce. Consulte endpoints de recursos ao vivo em vez de codificar IDs de modelo, avatar ou voz fixos.