¿Quieres hacer que una foto fija hable—un retrato que abre la boca, parpadea y dice lo que sea que escribas? Con VisionStory puedes hacer exactamente eso a partir de una sola imagen, directo en tu navegador, sin cámara y sin experiencia en edición. El video de arriba muestra todo el proceso, y la guía paso a paso de abajo cubre cada parte a detalle.
En el camino, subirás un retrato y lo prepararás como tu propio avatar reutilizable. Otros usuarios no pueden verlo, y podrás elegirlo de nuevo para futuros videos en lugar de subir la misma imagen cada vez. Todo corre dentro de la herramienta de foto parlante de VisionStory con una cuenta gratuita.
Paso 1: Sube un retrato claro
Abre Video con IA. En el panel de Personajes, elige Subir y selecciona una imagen desde tu dispositivo, o arrastra la foto directo al área de carga. Usa una persona clara, de frente, con el rostro y los hombros visibles, ojos y boca sin obstrucciones, y un poco de espacio alrededor del sujeto para poder reencuadrar después.
- Archivos compatibles: JPG, JPEG, PNG, WebP y HEIC.
- Tamaño máximo de archivo: 30 MB.
- Tamaño inicial recomendado: al menos 512 x 768 pixeles para un retrato.
- Comportamiento de carga: una imagen de origen a la vez.

Alinea la composición original con el lugar donde terminará el video. Un retrato muy recortado puede funcionar en 9:16, pero volverse un recorte de cara incómodamente cerrado en 16:9, porque no hay área de imagen a la izquierda y derecha para llenar el encuadre más ancho.
Paso 2: Deja que VisionStory valide y prepare el avatar
Después de subirla, VisionStory revisa si la imagen contiene una persona utilizable y la prepara como personaje. Un fallo de carga casi siempre se debe a la foto original: el rostro puede ser muy pequeño, estar muy cubierto, estar demasiado de lado, borroso o demasiado cerca de otro rostro.
Si la preparación falla, no sigas intentando con el mismo recorte. Elige una fuente más nítida con un rostro más grande, un ángulo más directo, hombros visibles, iluminación uniforme y menos obstrucciones.

Cuando termina el procesamiento, el avatar aparece arriba de la biblioteca pública de personajes y se abre en la vista previa del avatar. Solo tú puedes verlo.
Paso 3: Previsualiza o cambia la voz asignada
VisionStory asigna automáticamente una voz inicial adecuada según la edad y el género aparentes de la persona. Puedes quedártela, previsualizarla o cambiarla por otra.
- Selecciona la voz actual para abrir la Biblioteca de voces.
- Usa el botón de reproducir a la derecha de una voz para escuchar una muestra.
- Si no encaja, filtra por Idioma, Género, Edad y Caso de uso.
- Previsualiza algunas alternativas y luego elige la voz que combine tanto con el avatar como con el objetivo del video.

Una voz puede coincidir con la edad y el género aparentes, pero aun así sentirse mal para narración, educación, publicidad o contenido conversacional. Haz que combine la persona y el propósito, no solo la demografía.
Paso 4: Reencuadra la foto según su destino
Usa la vista previa del avatar para decidir cuánto de la persona aparece en el video final. Arrastra la foto para reposicionar al sujeto y usa los controles de zoom para acercarte o alejarte. Luego elige la relación de aspecto que se ajuste a donde vas a publicar:
- 9:16 vertical para TikTok, Instagram Reels, YouTube Shorts y otros espacios pensados para móvil.
- 1:1 cuadrado para publicaciones cuadradas, diseños centrados en perfil e inserciones flexibles.
- 16:9 horizontal para YouTube, presentaciones, sitios web y cursos en pantalla ancha.

El zoom no puede revelar pixeles que no existen. Si la persona ya toca todos los bordes de la foto original, parte de una imagen con más fondo en lugar de forzar un recorte más ancho.
Paso 5: Entiende qué hacen Change Look y Generate Image
Hay dos herramientas de imagen con IA junto al avatar, y conviene conocer la diferencia antes de usarlas.
Change Look abre un chat de IA con tu avatar actual ya adjunto, para que describas un nuevo outfit, escenario o estilo. Es un flujo de trabajo image-to-image, y el avatar original sigue disponible. Generate Image parte de una descripción escrita del personaje en lugar de una foto, así que es un flujo text-to-image. En ambos casos, puedes seguir chateando para afinar el resultado.

En resumen: usa Change Look cuando el personaje ya existe y necesita un nuevo estilo visual, y usa Generate Image cuando quieras crear un personaje desde un prompt.
Paso 6: Agrega un guion corto y genera el video parlante
Con tu avatar subido seleccionado, escribe una sola frase corta y conversacional en el cuadro de Guion. Una línea breve se renderiza más rápido y hace más fácil evaluar la foto, el recorte, la voz, la sincronización labial y el movimiento en conjunto.
Haz clic en Generate Talking Video. VisionStory anima el rostro, sincroniza los labios con la voz y agrega parpadeos realistas y movimiento de cabeza usando el avatar, encuadre, guion y voz seleccionados. El renderizado tarda un par de minutos.

Toma este primer resultado como una prueba práctica de la foto de origen. Revísalo en cuatro aspectos:
- Que el rostro se mantenga lo suficientemente nítido al tamaño final.
- Que los ojos y la boca permanezcan sin obstrucciones durante el movimiento.
- Que la cabeza y los hombros queden cómodos dentro de la relación elegida.
- Que el avatar en movimiento siga pareciéndose a la persona de la foto.
Si el recorte está muy cerrado o el rostro se ve suave en movimiento, corrige primero la imagen de origen o el encuadre. Cambiar el guion no va a arreglar un problema de composición.
Paso 7: Reutiliza o elimina tu avatar de foto parlante
De vuelta en la lista de Personajes, tu avatar subido aparece arriba de la biblioteca pública de personajes y puedes seleccionarlo cuando quieras al mismo presentador otra vez. Otros usuarios no pueden verlo, y los suscriptores pueden crear y guardar avatares ilimitados.
- Reutilízalo: selecciona el avatar en lugar de volver a subir la foto.
- Cambia el look: abre el avatar y elige una de sus miniaturas de look guardadas.
- Elimínalo: pasa el cursor sobre el avatar para mostrar el botón de borrar en la esquina superior derecha, y confirma antes de borrar el avatar y sus looks.

Solución de problemas comunes con fotos
VisionStory no puede encontrar un rostro utilizable. Usa una imagen más brillante y nítida con un rostro más grande y de frente. Evita ojos o bocas cubiertos, ángulos de perfil marcados y fotos donde otro rostro esté cerca del sujeto principal.
El recorte horizontal queda muy cerca. Probablemente el retrato original no tiene suficiente área de imagen a los lados. Usa una fuente más amplia o una con más espacio vacío alrededor de la persona.
El avatar aún se está preparando. Espera a que termine la preparación antes de usar el personaje. Si se queda atorado, actualiza la vista de Personajes y revisa si el avatar ya apareció antes de subir otra copia.
El resultado se ve suave. Empieza con una foto de mayor resolución, bien enfocada, y evita agrandar demasiado un rostro pequeño. La resolución de salida no puede recuperar detalle que faltaba en el origen.
Eso es todo lo que necesitas para hacer que una foto hable: sube un retrato, haz que la voz combine, encuadra y genera. Tu foto ahora es un avatar parlante reutilizable que puedes volver a usar cuando lo necesites.
¿Listo para ver el flujo completo de guion, voz, ajustes, créditos y generación? Sigue How to Create an AI Talking Avatar, o convierte guiones completos en videos con IA a escala. O simplemente empieza ahora: crea tu primera foto parlante gratis.
