¿Quieres hacer que una foto estática hable—un retrato que abre la boca, parpadea y dice lo que sea que escribas? Con VisionStory puedes hacer exactamente eso desde una sola imagen, directamente en tu navegador, sin cámara ni experiencia en edición. El video de arriba recorre todo el flujo, y la guía paso a paso de abajo cubre cada parte en detalle.
A medida que avanzas, subirás un retrato y lo prepararás como tu propio avatar reutilizable. Otros usuarios no pueden verlo, y puedes volver a elegirlo para videos futuros en lugar de subir la misma imagen cada vez. Todo funciona dentro de la herramienta de foto parlante de VisionStory con una cuenta gratuita.
Paso 1: Sube un retrato claro
Abre Video de IA. En el panel de Personajes, elige Subir y selecciona una imagen desde tu dispositivo, o arrastra la foto directamente a la zona de carga. Usa una persona clara, de frente, con el rostro y los hombros visibles, ojos y boca sin obstrucciones, y un poco de espacio alrededor del sujeto para reencuadrar más tarde.
- Archivos compatibles: JPG, JPEG, PNG, WebP y HEIC.
- Tamaño máximo de archivo: 30 MB.
- Tamaño inicial recomendado: al menos 512 x 768 píxeles para un retrato.
- Comportamiento de carga: una imagen de origen a la vez.

Haz que la composición de origen coincida con cómo quedará el video al final. Un retrato muy recortado puede funcionar en 9:16, pero convertirse en un recorte de rostro incómodamente cerrado en 16:9, porque no hay área de imagen a la izquierda y derecha para rellenar el encuadre más ancho.
Paso 2: Deja que VisionStory valide y prepare el avatar
Después de subirla, VisionStory verifica si la imagen contiene una persona utilizable y la prepara como un personaje. Un fallo de carga casi siempre se debe a la foto original: la cara puede ser demasiado pequeña, estar muy cubierta, estar girada demasiado hacia un lado, estar borrosa o estar demasiado cerca de otra cara.
Si la preparación falla, no sigas reintentando el mismo recorte. Elige una fuente más nítida con una cara más grande, un ángulo más directo, hombros visibles, iluminación uniforme y menos obstrucciones.

Cuando termina el procesamiento, el avatar aparece encima de la biblioteca pública de personajes y se abre en la vista previa del avatar. Solo tú puedes verlo.
Paso 3: Previsualiza o cambia la voz asignada
VisionStory asigna automáticamente una voz inicial adecuada según la edad y el género aparentes de la persona. Puedes mantenerla, previsualizarla o cambiarla por otra.
- Selecciona la voz actual para abrir la Biblioteca de Voz.
- Usa el botón de reproducción a la derecha de una voz para escuchar una muestra.
- Si no encaja, filtra por Idioma, Género, Edad y Caso de uso.
- Previsualiza algunas alternativas y luego elige la voz que coincida tanto con el avatar como con el objetivo del video.

Una voz puede encajar con la edad y el género aparentes de la persona, pero aun así sentirse mal para narración, educación, publicidad o contenido conversacional. Haz coincidir a la persona y el propósito, no solo la demografía.
Paso 4: Reencuadra la foto según su destino
Usa la vista previa del avatar para decidir cuánto de la persona aparecerá en el video final. Arrastra la foto para reposicionar al sujeto y usa los controles de zoom para acercarte o alejarte. Luego elige la Relación de Aspecto que se ajuste a dónde vas a publicar:
- 9:16 vertical para TikTok, Instagram Reels, YouTube Shorts y otras ubicaciones pensadas para móvil.
- 1:1 cuadrado para publicaciones cuadradas, diseños centrados en perfil e incrustaciones flexibles.
- 16:9 horizontal para YouTube, presentaciones, sitios web y cursos en formato panorámico.

El zoom no puede revelar píxeles que no existen. Si la persona ya toca todos los bordes de la foto original, parte de una imagen con más fondo en lugar de forzar un recorte más ancho.
Paso 5: Qué hacen Change Look y Generate Image
Hay dos herramientas de imágenes de IA junto al avatar, y conviene conocer la diferencia antes de usarlas.
Change Look abre un chat de IA con tu avatar actual ya adjunto, para que puedas describir un nuevo atuendo, escenario o estilo. Es un flujo de trabajo de imagen a imagen, y el avatar original sigue disponible. Generate Image parte de una descripción escrita del personaje en lugar de una foto, así que es un flujo de trabajo de texto a imagen. En ambos, puedes seguir chateando para afinar el resultado.

En resumen: usa Change Look cuando el personaje ya existe y necesita un nuevo estilo visual, y usa Generate Image cuando quieras crear un personaje a partir de un prompt.
Paso 6: Añade un guion corto y genera el video parlante
Con tu avatar subido seleccionado, escribe una frase corta y conversacional en el cuadro de Guion. Una línea corta se renderiza más rápido y facilita evaluar la foto, el recorte, la voz, la sincronización labial y el movimiento en conjunto.
Haz clic en Generate Talking Video. VisionStory anima el rostro, sincroniza los labios con la voz y añade parpadeos realistas y movimiento de cabeza usando el avatar, el encuadre, el guion y la voz seleccionados. El renderizado tarda un par de minutos.

Toma este primer resultado como una prueba práctica de la foto de origen. Revísalo por cuatro cosas:
- El rostro se mantiene lo suficientemente nítido al tamaño final.
- Los ojos y la boca permanecen sin obstrucciones durante el movimiento.
- La cabeza y los hombros quedan cómodamente dentro de la proporción elegida.
- El avatar en movimiento sigue pareciéndose a la persona original.
Si el recorte es demasiado cerrado o el rostro se ve suave al moverse, corrige primero la imagen de origen o el encuadre. Cambiar el guion no arreglará un problema de composición.
Paso 7: Reutiliza o elimina tu avatar de foto parlante
De vuelta en la lista de Personajes, tu avatar subido aparece encima de la biblioteca pública de personajes y se puede seleccionar cuando quieras volver a usar el mismo presentador. Otros usuarios no pueden verlo, y los suscriptores pueden crear y conservar avatares ilimitados.
- Reutilízalo: selecciona el avatar en lugar de subir la foto otra vez.
- Cambia de look: abre el avatar y elige una de sus miniaturas de looks guardados.
- Elimínalo: pasa el cursor sobre el avatar para mostrar el botón de eliminar en la esquina superior derecha y confirma antes de eliminar el avatar y sus looks.

Solución de problemas comunes de fotos
VisionStory no puede encontrar un rostro utilizable. Usa una imagen más brillante y nítida con una cara más grande y de frente. Evita ojos o bocas cubiertos, ángulos de perfil pronunciados y fotos donde otra cara esté muy cerca del sujeto principal.
El recorte horizontal queda demasiado cerca. Probablemente el retrato de origen no tiene suficiente área de imagen en los lados. Usa una fuente más ancha o una con más espacio vacío alrededor de la persona.
El avatar todavía se está preparando. Espera a que termine la preparación antes de usar el personaje. Si se queda atascado, actualiza la vista de Personajes y revisa si el avatar ya apareció antes de subir otra copia.
El resultado se ve suave. Empieza con una foto de mayor resolución y bien enfocada, y evita agrandar una cara pequeña de forma demasiado agresiva. La Resolución de salida no puede recuperar detalles que faltaban en la fuente.
Eso es todo lo que necesitas para hacer que una foto hable: sube un retrato, ajusta una voz, encuádralo y genera. Tu foto ahora es un avatar parlante reutilizable que puedes usar de nuevo cuando lo necesites.
¿Listo para el flujo de trabajo completo de guion, voz, ajustes, créditos y generación? Sigue How to Create an AI Talking Avatar, o convierte guiones completos en videos de IA a escala. O simplemente empieza ahora: crea gratis tu primera foto parlante.
