Español (México)

De texto a video es la forma más rápida de crear una toma que todavía no existe. Describe una escena con palabras y el generador de video con IA la convierte en un clip de unos cuantos segundos hasta más de diez — una revelación de producto, una toma de establecimiento, un momento de historia o B-roll para una edición más grande.

Lo que esta herramienta no hace es construir por ti un video completo de varias escenas. Si quieres que se generen juntos un guion, storyboard, avatares, voz en off y subtítulos a partir de un tema, usa AI Video Agent en su lugar. Este tutorial resuelve una tarea clara: convertir un prompt escrito en una toma de video revisable y descargable.

Paso 1: Abre el modo Generar video

Abre el Generador de video con IA en las Herramientas de IA de VisionStory y asegúrate de que Generate Video esté seleccionado en la parte superior. Este modo crea una nueva escena solo a partir de texto — no se requiere una imagen inicial. Si necesitas conservar el aspecto exacto de un producto, una persona o una escena, cambia a Image to Video.

Antes de escribir cualquier cosa, decide qué función tiene esta toma en el video final: el gancho de los primeros tres segundos de un clip para redes, un close-up del producto, una toma de establecimiento, B-roll de transición o una acción dentro de una historia. Entre más clara sea la función, más fácil será el prompt.

Generate Video mode selected in the VisionStory AI Video Generator for making an AI video from text
Generate Video crea una nueva toma a partir de una descripción en texto; Image to Video añade movimiento a una imagen que ya tienes.

Paso 2: Escribe el sujeto, la acción, el entorno y la cámara

Un prompt efectivo para video con IA es más que un sustantivo. Cubre al menos cuatro cosas: qué es el sujeto, qué hace el sujeto, cómo se ve la escena y la luz, y cómo se mueve la cámara. Las tomas de producto también deben mencionar los materiales, colores y estructura que deben mantenerse fieles.

  • Sujeto — una persona, producto, animal, edificio o entorno.
  • Acción — abre, gira, camina, vierte, revela, pasa volando, se transforma.
  • Entorno — estudio, calle, oficina, naturaleza, además de la hora del día y la iluminación.
  • Cámara — close-up o gran plano, fija o en seguimiento, push-in, órbita, cenital.
  • Límites — sin texto, sin gente extra, sin errores de marca, sin deformaciones, sin objetos sueltos.
Una revelación cinematográfica 16:9 de un estuche de audífonos inalámbricos negro mate abriéndose sobre una mesa oscura de estudio,
luz de contorno morada suave, push-in lento de cámara, reflejos realistas, estilo comercial premium, sin texto.
Typing a product-reveal video prompt into the VisionStory AI video generator
Un solo prompt incluye el producto, la acción de apertura, el entorno de estudio, la luz de contorno morada y el push-in lento.

Paso 3: Elige el modelo, la duración, la relación de aspecto y la resolución

Abre el panel de configuración y ajusta la salida a donde se publicará la toma. El formato horizontal 16:9 va bien para YouTube, sitios web y presentaciones; 9:16 va bien para TikTok, Instagram Reels y YouTube Shorts; 1:1 funciona para tarjetas de producto y algunos espacios del feed.

Los clips cortos son la forma más barata de probar la composición y la dirección del movimiento — confirma que el prompt funciona antes de renderizar versiones más largas o más nítidas. Los modelos varían en movimiento humano, consistencia del producto, movimientos de cámara y audio nativo, así que compara muestras pequeñas con el mismo prompt antes de una producción seria.

Resolution, duration, and aspect ratio settings in the VisionStory AI video generator
Este ejemplo usa 16:9 horizontal, 10 segundos y 1080p para una toma de exhibición de producto.

Paso 4: Genera y encuentra el resultado en tu lista de Videos

Haz clic en el botón de generar en la parte inferior derecha del cuadro del prompt. Cuando termine el render, el nuevo clip aparece en la parte superior de la lista de Videos abajo, etiquetado con duración, resolución, título y hora de creación. Revisa primero la miniatura: ¿ya muestra el sujeto principal y la composición de tu prompt?

Si la miniatura está claramente mal — color de producto incorrecto, falta el sujeto, encuadre inutilizable — no la metas a un proyecto real. Vuelve al prompt, agrega las características que deben conservarse y las cosas que no deben aparecer, y genera de nuevo.

A finished text-to-video result showing at the top of the Videos list in VisionStory
La tarjeta más reciente incluye el título, la duración, la resolución y una miniatura para una revisión rápida de primera pasada.

Paso 5: Previsualiza la toma completa y luego descarga

Abre la tarjeta del video y reprodúcelo desde el inicio. Observa si el sujeto se mantiene estable durante toda la toma, si el movimiento respeta la física, si la cámara da saltos y si la estructura del producto, las manos, el texto o el fondo se rompen en algún punto. Generation Details conserva el prompt original, el modelo y la resolución para repetir y comparar.

Descarga solo después de que la toma pase la revisión; luego intégrala a tu edición, a tu proyecto de AI Video Agent o al resto de tu flujo de trabajo. Nunca publiques solo porque el primer cuadro se ve bien — los cuadros del medio y del final necesitan el mismo escrutinio.

Previewing a text-generated video in the VisionStory Video Viewer with its prompt and model details
El Video Viewer reproduce el resultado completo y conserva el prompt, el modelo y la configuración de salida usados en esta ejecución.

Problemas comunes y cómo solucionarlos

  • El video básicamente es una imagen fija. Escribe de forma explícita la acción del sujeto y el movimiento de cámara — la tapa se abre, push-in lento, órbita alrededor del producto — en lugar de describir una foto.
  • El sujeto se deforma a mitad de la toma. Reduce la cantidad de acciones en una sola toma, acorta la duración y especifica los materiales, colores y estructura que deben mantenerse estables.
  • La toma se ve llamativa, pero no dice nada. Primero decide qué argumento de venta o momento de la historia llevará la toma; después elige la iluminación y los movimientos de cámara.
  • La relación de aspecto no coincide con la plataforma. Elige la relación correcta antes de generar. Recortar una toma horizontal para volverla vertical normalmente corta el sujeto y la acción.
  • Aparecen textos o logos sueltos. Agrega sin texto, sin logo al prompt — y aun así revisa cada cuadro antes de publicar.

De texto a video es mejor cuando aporta la toma en movimiento que de otro modo no podrías filmar. Primero define la función de la toma, escribe con claridad el sujeto, la acción, el entorno y la cámara, y revisa toda la línea de tiempo — no solo una miniatura. Cuando tu punto de partida es una imagen en vez de un prompt, cambia a convertir una imagen en un video.

Preguntas frecuentes

  • Texto a video es un método de generación con IA que crea una toma en movimiento completamente nueva a partir de un prompt escrito. Un buen prompt cubre el sujeto, la acción, el entorno y la luz, el movimiento de cámara y cualquier cosa que no deba aparecer en el encuadre.