Español (España)

La conversión de imagen a vídeo no consiste en diseñar una imagen nueva — consiste en dar tiempo y movimiento a una imagen en la que ya confías. Sube una foto de producto, un retrato o un fotograma conceptual, describe qué debe moverse y cómo debe comportarse la cámara, y la herramienta de imagen a vídeo generará un clip en movimiento que mantiene tu sujeto intacto.

Eso la convierte en la herramienta adecuada cuando la apariencia no es negociable. En comparación con el texto a vídeo puro, la imagen inicial fija a la persona, el producto, el atuendo, la escena y la composición; la función del prompt es indicar qué puede moverse, cómo se mueve la cámara y qué detalles no deben cambiar.

Paso 1: Elige una imagen inicial que aguante la animación

En el Generador de vídeos con IA, cambia a Imagen a Vídeo y sube tu imagen como fotograma inicial. Prioriza imágenes con un sujeto completo, una iluminación limpia y una composición ya cercana a la relación de aspecto final. Una foto de producto debería mostrar la forma completa y las partes clave; un retrato debería evitar manos, pelo o ropa recortados; y una escena debería dejar espacio para que la cámara se mueva.

Este tutorial usa una toma 16:9 de un estuche de auriculares negro mate. El prompt pide que la tapa se abra ligeramente, que una luz morada recorra la superficie y un acercamiento lento — manteniendo estable la geometría del producto, sin objetos nuevos y sin texto.

El estuche de los auriculares permanece idéntico mientras la tapa se abre ligeramente y una suave luz morada recorre la superficie.
Acercamiento de cámara cinematográfico lento, reflejos realistas, geometría del producto estable, sin objetos nuevos, sin texto.
Uploading a product photo to VisionStory Image to Video and writing a motion prompt
El fotograma inicial define el producto y la composición; el prompt solo describe la acción de la tapa, el barrido de luz, el acercamiento y lo que debe mantenerse estable.

Paso 2: Decide un fotograma final y ajusta los parámetros

Si la imagen solo necesita movimiento natural, omite el fotograma final. Sube una segunda imagen solo cuando el vídeo deba pasar de una imagen exacta a otra — y mantén ambos fotogramas con el mismo sujeto, punto de vista y escena, o el modelo puede dar saltos o distorsionar entre medias.

Después elige el modelo, la duración, la relación de aspecto y la resolución de destino. Las tomas de detalle de producto suelen verse mejor con un movimiento más lento; un gancho para redes puede moverse más rápido siempre que el producto siga siendo legible. Confirma que la relación de aspecto coincide con la imagen de entrada para que el sistema no recorte tu sujeto al rellenar el encuadre.

Resolution, duration, and aspect ratio settings for VisionStory image to video generation
Este ejemplo usa solo el fotograma inicial, con Seedance 2.0, 720p, 16:9 y 15 segundos para observar la geometría del producto en una toma más larga.

Paso 3: Genera y revisa primero la miniatura

Haz clic en generar. El clip terminado aparecerá arriba del todo en la lista de Vídeos, con su duración, resolución, título y hora de creación. Antes de reproducir nada, hazte una pregunta al ver la miniatura: ¿sigue siendo el mismo producto o la misma persona?

Si el primer fotograma ya está mal — color, número de piezas, identidad o encuadre — cambia a una imagen de entrada más limpia. Si el primer fotograma está bien, pero la toma empeora a mitad, reduce el movimiento, acorta la duración o refuerza las restricciones de apariencia en el prompt.

A completed image-to-video generation showing in the VisionStory Videos list
La primera tarjeta es el resultado de esta ejecución — la miniatura sigue manteniendo como sujeto el estuche negro de los auriculares.

Paso 4: Reproduce el clip completo y revisa la consistencia del sujeto

Reproduce el resultado de principio a fin en el Visor de vídeo. En productos, fíjate en la forma, los materiales, los botones, los puertos y el número de piezas. En personas, fíjate en la cara, las manos, el pelo, la ropa y cómo encajan con el fondo. En escenas, fíjate en la estructura, la perspectiva y la continuidad de la iluminación.

Detalles de generación conserva el prompt original, el modelo y la resolución. Descarga el clip cuando lo supere, y úsalo en anuncios de producto, vídeos de afiliación, clips para redes, B-roll para el canal o un montaje más largo. Si falla, corrige el prompt o la imagen de entrada — no intentes ocultar un error evidente del sujeto en la edición.

Previewing an image-generated video in the VisionStory Video Viewer with its motion prompt
La vista previa completa sirve para auditar la estructura del producto, los cambios de luz y el movimiento de cámara a lo largo de toda la línea de tiempo — no solo el primer fotograma.

Paso 5: Integra la toma que funciona en un flujo de trabajo de vídeo completo

Un clip de imagen a vídeo suele ser una toma dentro de una pieza más grande. Los vendedores de productos lo combinan con un avatar presentador o un explicador de UGC con IA; los creadores de YouTube lo usan como B-roll; y los equipos de marca y formación lo utilizan para mostrar productos, procesos o escenas conceptuales.

Cuando generes varias tomas sobre un mismo tema, mantén fija la imagen de entrada, la versión del producto, la identidad del personaje y el estilo visual, y cambia exactamente una variable de movimiento en cada ejecución. Comparar aperturas, transiciones y revelados resulta mucho más fácil — y la deriva de apariencia entre generaciones es menos frecuente.

Problemas comunes y cómo solucionarlos

  • El producto se convierte en otro producto a mitad del movimiento. Usa una imagen de producto más nítida y más completa, reduce el número de acciones y especifica los materiales, colores, estructura y piezas que no deben cambiar.
  • Las caras o las manos tiemblan. Elige una entrada con el sujeto claro de frente y las manos sin obstrucciones, evita giros grandes y gestos complejos, y empieza con clips más cortos.
  • El resultado es solo un zoom lento. Describe una acción visible del sujeto o un cambio en el entorno y un movimiento de cámara específico — no solo hacer que la imagen se mueva.
  • La imagen de entrada se recorta. Haz coincidir la imagen de origen con la relación de aspecto objetivo y mantén el sujeto en la zona segura; no confíes en el generador para convertir apaisado en vertical.
  • La toma da saltos entre los fotogramas inicial y final. Mantén ambos fotogramas con el mismo sujeto, punto de vista y escena, cambiando solo el estado que quieres que ocurra.

El listón en imagen a vídeo no es más movimiento — es un sujeto que se mantenga creíble mientras gana un movimiento que sirva al contenido. Bloquea primero la apariencia y luego dirige el movimiento. Si lo que realmente quieres es un retrato que hable, ese es un flujo de trabajo diferente: hacer que una foto hable. Y cuando no hay ninguna imagen utilizable, empieza desde las palabras con texto a vídeo.

Preguntas frecuentes

  • Una foto con el sujeto completo, iluminación clara, suficiente Resolución y una composición ya cercana a la Relación de Aspecto final. No se deben recortar los bordes clave del producto, la persona o la escena.