Español (Estados Unidos)

Imagen a video no se trata de diseñar una nueva imagen — se trata de darle a una imagen en la que ya confías algo de tiempo y movimiento. Sube una foto de producto, un retrato o un fotograma conceptual, describe qué debería moverse y cómo debería comportarse la cámara, y la herramienta de imagen a video genera un clip en movimiento que mantiene tu sujeto intacto.

Eso la convierte en la herramienta ideal cuando la apariencia no es negociable. En comparación con el texto a video puro, la imagen inicial fija a la persona, el producto, el outfit, la escena y la composición; el trabajo del prompt es decir qué puede moverse, cómo se mueve la cámara y qué detalles no deben cambiar.

Paso 1: Elige una imagen inicial que pueda soportar la animación

En el Generador de Video con IA, cambia a Imagen a Video y sube tu imagen como el fotograma inicial. Prioriza imágenes con un sujeto completo, iluminación limpia y una composición ya cercana a la relación de aspecto final. Una foto de producto debe mostrar la forma completa y las partes clave; un retrato debe evitar manos, cabello o ropa recortados; una escena debe dejar espacio para que la cámara se mueva.

Este tutorial usa una toma 16:9 de un estuche mate negro para audífonos. El prompt pide que la tapa se abra ligeramente, que una luz morada recorra la superficie y un acercamiento lento — mientras se mantiene estable la geometría del producto, sin objetos nuevos y sin texto.

El estuche para audífonos permanece idéntico mientras la tapa se abre ligeramente y una luz morada suave recorre la superficie.
Acercamiento cinematográfico lento de cámara, reflejos realistas, geometría del producto estable, sin objetos nuevos, sin texto.
Uploading a product photo to VisionStory Image to Video and writing a motion prompt
El fotograma inicial define el producto y la composición; el prompt solo describe la acción de la tapa, el barrido de luz, el acercamiento y lo que debe mantenerse estable.

Paso 2: Decide un fotograma final y luego configura los parámetros

Si la imagen solo necesita movimiento natural, omite el fotograma final. Sube una segunda imagen solo cuando el video deba pasar de una imagen exacta a otra — y mantén ambos fotogramas con el mismo sujeto, punto de vista y escena, o el modelo podría dar saltos o distorsionarse entre uno y otro.

Luego elige el modelo, la duración, la relación de aspecto y la resolución de destino. Las tomas de detalle de producto suelen verse mejor con movimiento más lento; un gancho para redes puede moverse más rápido siempre que el producto siga siendo legible. Confirma que la relación de aspecto coincida con la imagen de entrada para que el sistema no recorte tu sujeto para llenar el encuadre.

Resolution, duration, and aspect ratio settings for VisionStory image to video generation
Este ejemplo usa solo el fotograma inicial, con Seedance 2.0, 720p, 16:9 y 15 segundos para observar la geometría del producto durante una toma más larga.

Paso 3: Genera y revisa primero la miniatura

Haz clic en generar. El clip final aparece en la parte superior de la lista de Videos con su duración, resolución, título y hora de creación. Antes de reproducir nada, hazle una pregunta a la miniatura: ¿sigue siendo el mismo producto o la misma persona?

Si el primer fotograma ya está mal — color, cantidad de piezas, identidad o encuadre — cambia a una imagen de entrada más limpia. Si el primer fotograma está bien, pero la toma se degrada a mitad de camino, reduce el movimiento, acorta la duración o refuerza las restricciones de apariencia en el prompt.

A completed image-to-video generation showing in the VisionStory Videos list
La primera tarjeta es el resultado de esta ejecución — la miniatura todavía mantiene el estuche negro para audífonos como sujeto.

Paso 4: Reproduce el clip completo y revisa la consistencia del sujeto

Reproduce el resultado de principio a fin en el Visor de Video. Para productos, revisa la forma, materiales, botones, puertos y cantidad de piezas. Para personas, revisa el rostro, manos, cabello, ropa y cómo se integran con el fondo. Para escenas, revisa la estructura, la perspectiva y la continuidad de la iluminación.

Detalles de generación conserva el prompt original, el modelo y la resolución. Descarga el clip cuando lo apruebes y úsalo en anuncios de producto, videos de afiliados, clips para redes, B-roll del canal o una edición más larga. Si falla, corrige el prompt o la imagen de entrada — no intentes ocultar un error evidente del sujeto en la edición.

Previewing an image-generated video in the VisionStory Video Viewer with its motion prompt
La vista previa completa sirve para auditar la estructura del producto, los cambios de luz y el movimiento de cámara a lo largo de toda la línea de tiempo — no solo el primer fotograma.

Paso 5: Integra la toma que funcionó en un flujo de trabajo de video completo

Un clip de imagen a video suele ser una toma dentro de una pieza más grande. Los vendedores de productos lo combinan con un avatar portavoz o un explicador de UGC con IA; los creadores de YouTube lo usan como B-roll; los equipos de marca y capacitación lo usan para mostrar productos, procesos o escenas conceptuales.

Cuando generes varias tomas sobre un mismo tema, mantén fijos la imagen de entrada, la versión del producto, la identidad del personaje y el estilo visual, y cambia exactamente una variable de movimiento por ejecución. Comparar aperturas, transiciones y revelaciones se vuelve mucho más fácil — y el desvío de apariencia entre generaciones se vuelve menos común.

Problemas comunes y cómo solucionarlos

  • El producto se convierte en un producto diferente a mitad del movimiento. Usa una imagen de producto más nítida y completa, reduce la cantidad de acciones y especifica los materiales, colores, estructura y piezas que no deben cambiar.
  • Los rostros o las manos tiemblan. Elige una entrada con un sujeto frontal claro y manos sin obstrucciones, evita giros grandes y gestos complejos, y empieza con clips más cortos.
  • El resultado es solo un zoom lento. Describe una acción visible del sujeto o un cambio del entorno y un movimiento de cámara específico — no solo “hacer que la imagen se mueva”.
  • La imagen de entrada se recorta. Ajusta la imagen de origen a la relación de aspecto de destino y mantén el sujeto en el área segura; no dependas del generador para convertir un formato horizontal en vertical.
  • La toma da saltos entre los fotogramas inicial y final. Mantén ambos fotogramas con el mismo sujeto, punto de vista y escena, cambiando solo el estado que quieres que ocurra.

El estándar para imagen a video no es más movimiento — es un sujeto que siga siendo creíble mientras gana movimiento que aporte al contenido. Primero fija la apariencia y luego dirige el movimiento. Si lo que en realidad quieres es un retrato que hable, ese es otro flujo de trabajo: haz que una foto hable. Y cuando no haya ninguna imagen utilizable, empieza con palabras con texto a video.

Preguntas frecuentes

  • Una imagen con el sujeto completo, iluminación clara, suficiente resolución y una composición ya cercana a la relación de aspecto final. Los bordes clave del producto, la persona o la escena no deben quedar recortados.