Español (México)

Imagen a video no se trata de diseñar una imagen nueva — se trata de darle tiempo y movimiento a una imagen en la que ya confías. Sube una foto de producto, un retrato o un fotograma conceptual, describe qué debería moverse y cómo debería comportarse la cámara, y la herramienta de imagen a video genera un clip en movimiento que mantiene tu sujeto intacto.

Eso la convierte en la herramienta ideal cuando la apariencia no es negociable. En comparación con el text-to-video puro, la imagen inicial fija a la persona, el producto, el outfit, la escena y la composición; el trabajo del prompt es decir qué puede moverse, cómo se mueve la cámara y qué detalles no deben cambiar.

Paso 1: Elige una imagen inicial que resista la animación

En el Generador de Video con IA, cambia a Imagen a Video y sube tu imagen como el fotograma inicial. Prefiere imágenes con un sujeto completo, iluminación limpia y una composición ya cercana a la relación de aspecto final. Una foto de producto debe mostrar la forma completa y las partes clave; un retrato debe evitar manos, cabello o ropa recortados; una escena debe dejar espacio para que la cámara se mueva.

Este tutorial usa una toma 16:9 de un estuche de audífonos matte negro. El prompt pide que la tapa se abra ligeramente, que una luz morada recorra la superficie y un acercamiento lento — mientras se mantiene estable la geometría del producto, sin objetos nuevos y sin texto.

El estuche de audífonos permanece idéntico mientras la tapa se abre ligeramente y una luz morada suave recorre la superficie.
Lento push-in cinematográfico de cámara, reflejos realistas, geometría del producto estable, sin objetos nuevos, sin texto.
Uploading a product photo to VisionStory Image to Video and writing a motion prompt
El fotograma inicial define el producto y la composición; el prompt solo describe la acción de la tapa, el barrido de luz, el push-in y lo que debe mantenerse estable.

Paso 2: Decide un fotograma final y luego configura los parámetros

Si la imagen solo necesita movimiento natural, omite el fotograma final. Sube una segunda imagen solo cuando el video deba pasar de una imagen exacta a otra — y mantén ambos fotogramas con el mismo sujeto, punto de vista y escena, o el modelo puede dar saltos o distorsionarse en medio.

Luego elige el modelo, la duración, la relación de aspecto y la resolución de salida. Las tomas de detalle de producto suelen verse mejor con movimiento más lento; un gancho para redes puede moverse más rápido mientras el producto siga siendo legible. Confirma que la relación de aspecto coincida con la imagen de entrada para que el sistema no recorte tu sujeto para llenar el encuadre.

Resolution, duration, and aspect ratio settings for VisionStory image to video generation
Este ejemplo usa solo el fotograma inicial, con Seedance 2.0, 720p, 16:9 y 15 segundos para observar la geometría del producto en una toma más larga.

Paso 3: Genera y primero revisa la miniatura

Haz clic en generar. El clip final aparece en la parte superior de la lista de Videos con su duración, resolución, título y hora de creación. Antes de reproducir nada, hazle una pregunta a la miniatura: ¿sigue siendo el mismo producto o la misma persona?

Si el primer fotograma ya está mal — color, cantidad de piezas, identidad o encuadre — cambia a una imagen de entrada más limpia. Si el primer fotograma está bien pero la toma se degrada a la mitad, reduce el movimiento, acorta la duración o refuerza las restricciones de apariencia en el prompt.

A completed image-to-video generation showing in the VisionStory Videos list
La primera tarjeta es el resultado de esta ejecución — la miniatura sigue manteniendo como sujeto el estuche de audífonos negro.

Paso 4: Reproduce el clip completo y audita la consistencia del sujeto

Reproduce el resultado de principio a fin en el Video Viewer. En productos, fíjate en la forma, materiales, botones, puertos y número de piezas. En personas, fíjate en el rostro, manos, cabello, ropa y cómo se integran con el fondo. En escenas, fíjate en la estructura, la perspectiva y la continuidad de la iluminación.

Detalles de generación conserva el prompt original, el modelo y la resolución. Descarga el clip cuando lo apruebe, y úsalo en anuncios de producto, videos de afiliados, clips para redes, B-roll del canal o una edición de historia más larga. Si falla, corrige el prompt o la imagen de entrada — no intentes ocultar un error evidente del sujeto en la edición.

Previewing an image-generated video in the VisionStory Video Viewer with its motion prompt
La vista previa completa sirve para auditar la estructura del producto, los cambios de luz y el movimiento de cámara a lo largo de toda la línea de tiempo — no solo el primer fotograma.

Paso 5: Integra la toma que funciona en un flujo de trabajo de video completo

Un clip de imagen a video suele ser una toma dentro de una pieza más grande. Vendedores de productos lo combinan con un avatar presentador o un explicador de UGC con IA; creadores de YouTube lo usan como B-roll; y equipos de marca y capacitación lo usan para mostrar productos, procesos o escenas conceptuales.

Cuando generes varias tomas sobre un mismo tema, mantén fija la imagen de entrada, la versión del producto, la identidad del personaje y el estilo visual, y cambia exactamente una variable de movimiento por ejecución. Comparar aperturas, transiciones y revelaciones se vuelve mucho más fácil — y la deriva de apariencia entre generaciones se vuelve más rara.

Problemas comunes y cómo solucionarlos

  • El producto se convierte en otro producto a mitad del movimiento. Usa una imagen de producto más nítida y completa, reduce el número de acciones y especifica los materiales, colores, estructura y piezas que no deben cambiar.
  • Los rostros o las manos tiemblan. Elige una entrada con un sujeto frontal claro y manos sin obstrucciones, evita giros grandes y gestos complejos, y empieza con clips más cortos.
  • El resultado es solo un zoom lento. Describe una acción visible del sujeto o un cambio en el entorno y un movimiento de cámara específico — no solo hacer que la imagen se mueva.
  • La imagen de entrada se recorta. Ajusta la imagen de origen a la relación de aspecto objetivo y mantén el sujeto en el área segura; no dependas del generador para convertir horizontal a vertical.
  • La toma da saltos entre el fotograma inicial y el final. Mantén ambos fotogramas con el mismo sujeto, punto de vista y escena, cambiando solo el estado que quieres que ocurra.

El estándar en imagen a video no es más movimiento — es un sujeto que se mantenga creíble mientras gana movimiento que aporte al contenido. Primero fija la apariencia y luego dirige el movimiento. Si lo que realmente quieres es un retrato que hable, ese es otro flujo de trabajo: hacer hablar una foto. Y cuando no hay ninguna imagen utilizable, empieza con palabras con text to video.

Preguntas frecuentes

  • Una imagen con el sujeto completo, iluminación clara, suficiente resolución y una composición ya cercana a la relación de aspecto final. No deben recortarse los bordes clave del producto, la persona o la escena.