Español (España)

API de VisionStory
diseñada para desarrolladores

Crea vídeos de avatares parlantes con sincronización labial a partir de texto o audio con la API REST de VisionStory o el SDK de Python. Consulta los modelos, avatares y voces disponibles, envía un trabajo asíncrono y descarga el MP4 final, o automatiza el mismo flujo de trabajo con la CLI, el servidor MCP o Agent Skill.

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
Agente listo

Funciona donde trabajan tus agentes.

Copia un mensaje de configuración para tu agente de programación o conecta el servidor MCP y expón VisionStory como una herramienta reutilizable.

CLI de VisionStory

Instala una vez. Usa cualquier API desde tu terminal.

El instalador actualiza a la última versión de PyPI en un entorno aislado. Tus proyectos de Python existentes se mantienen intactos.

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSLOpciones de instalación
Envía este prompt de configuración a Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
¿Eres nuevo?

Crea una clave de API y luego envía este prompt a tu agente de programación. Te guiará por el inicio de sesión en visionstory, verificará los créditos y creará el vídeo sin exponer tu clave.

Herramientas para desarrolladores de VisionStory

Elige la integración de API para tu stack.

REST, el SDK de Python, la CLI, el servidor MCP y Agent Skill usan la misma API autenticada de VisionStory y los mismos ID de recursos. Empieza con una interfaz y luego lleva ese mismo flujo de trabajo de vídeo de avatar a un backend, un pipeline de CI o un agente de programación.

Guía rápida de la API de avatar parlante

Genera tu primer vídeo de avatar parlante.

Crea una clave de API del lado del servidor, verifica tu saldo de créditos y consulta los ID actuales de modelo, avatar y voz. Envía un text_script o audio_script a POST /api/v1/video, consulta el estado aproximadamente cada cinco segundos hasta que se cree el trabajo y luego descarga el MP4. Las URL de los vídeos completados se conservan durante siete días.

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

Catálogo de modelos de VisionStory

Elige el modelo para el resultado que necesitas.

Empieza por el trabajo que necesitas completar y luego obtén el catálogo de modelos actual en tiempo de ejecución. La respuesta de la API es la fuente de referencia para los ID disponibles, los parámetros aceptados y los límites de salida.

APIs de medios con IA componibles

Combina APIs de avatar, Voz y Vídeo con IA.

Usa una sola clave de API para crear presentadores parlantes, sintetizar voz natural, reutilizar avatares personalizados, voces y recursos multimedia, y generar clips de vídeo de apoyo. Crea vídeos explicativos localizados, onboarding personalizado, formación, prospección de ventas o contenido generado por agentes sin tener que unir proveedores distintos.

Preguntas frecuentes sobre la API de vídeo de avatar con IA

Respuestas directas sobre autenticación, solicitudes, trabajos asíncronos, SDK, automatización con CLI, MCP y uso en producción.

  • Una API de vídeo de avatar con IA convierte un presentador digital, junto con texto o audio grabado, en un vídeo con sincronización labial que una aplicación puede generar de forma programática. VisionStory acepta solicitudes autenticadas del lado del servidor, devuelve un ID de vídeo de inmediato, renderiza el trabajo de forma asíncrona y proporciona una URL MP4 cuando la generación se completa.

Empieza con una solicitud autenticada

Crea tu primera integración de vídeo de avatar con IA.

Crea una clave de API, verifica tus créditos y sigue la guía rápida de cinco pasos para crear un avatar parlante. Empieza con REST o Python y, a medida que crezca tu flujo de trabajo, añade automatización con CLI, herramientas MCP o la Agent Skill. Consulta endpoints de recursos en vivo en lugar de codificar de forma rígida los ID de modelo, avatar o voz.