Guarda questo tutorial su YouTube

YouTube

Vuoi far parlare una foto statica—un ritratto che apre la bocca, sbatte le palpebre e dice qualsiasi cosa tu scriva? Con VisionStory puoi farlo davvero partendo da una sola immagine, direttamente nel browser, senza videocamera né esperienza di montaggio. Il video qui sopra mostra l’intero flusso, e la guida passo passo qui sotto spiega ogni parte nel dettaglio.

Lungo il percorso, caricherai un ritratto e lo preparerai come il tuo avatar riutilizzabile. Gli altri utenti non possono vederlo e potrai sceglierlo di nuovo per i video futuri, invece di caricare ogni volta la stessa immagine. Tutto funziona all’interno di lo strumento di foto parlante di VisionStory con un account gratuito.

Passaggio 1: Carica un ritratto nitido

Apri Video AI. Nel pannello Personaggi, scegli Carica e seleziona un’immagine dal tuo dispositivo, oppure trascina la foto direttamente nell’area di rilascio. Usa una persona ben visibile e frontale, con volto e spalle in inquadratura, occhi e bocca non ostruiti e un po’ di spazio attorno al soggetto per poter reinquadrare in seguito.

  • File supportati: JPG, JPEG, PNG, WebP e HEIC.
  • Dimensione massima del file: 30 MB.
  • Dimensione iniziale consigliata: almeno 512 x 768 pixel per un ritratto.
  • Comportamento di caricamento: un’immagine sorgente alla volta.
Dragging a portrait onto the Upload control in the VisionStory Characters panel

Fai combaciare la composizione di partenza con il formato finale del video. Un ritratto molto ravvicinato può funzionare in 9:16 ma diventare un taglio del viso scomodo in 16:9, perché non c’è area dell’immagine a sinistra e a destra per riempire l’inquadratura più ampia.

Passaggio 2: Lascia che VisionStory convalidi e prepari l’avatar

Dopo il caricamento, VisionStory verifica se l’immagine contiene una persona utilizzabile e la prepara come personaggio. Un caricamento non riuscito quasi sempre dipende dalla foto di origine: il volto potrebbe essere troppo piccolo, molto coperto, ruotato troppo di lato, sfocato o troppo vicino a un altro volto.

Se la preparazione non va a buon fine, non continuare a riprovare con lo stesso ritaglio. Scegli una sorgente più nitida, con un volto più grande, un’angolazione più diretta, spalle visibili, illuminazione uniforme e meno ostacoli.

VisionStory avatar preview beside a checklist for a clear, unobstructed source photo

Al termine dell’elaborazione, l’avatar appare sopra la libreria dei personaggi pubblici e si apre nell’anteprima dell’avatar. È visibile solo a te.

Passaggio 3: Ascolta l’anteprima o cambia la voce assegnata

VisionStory assegna automaticamente una voce iniziale adatta in base all’età e al genere apparenti della persona. Puoi mantenerla, ascoltarla in anteprima o sostituirla con un’altra.

  1. Seleziona la voce attuale per aprire la Libreria delle Voci.
  2. Usa il pulsante di riproduzione a destra di una voce per ascoltare un campione.
  3. Se non va bene, filtra per Lingua, Genere, Età e Caso d’uso.
  4. Ascolta qualche alternativa, poi scegli la voce che corrisponde sia all’avatar sia all’obiettivo del video.
VisionStory Voice Library with Language, Gender, Age, and Use Case filters and a preview button

Una voce può combaciare con età e genere apparenti della persona, ma risultare comunque inadatta per narrazione, formazione, pubblicità o contenuti conversazionali. Abbina la persona e lo scopo, non solo i dati demografici.

Passaggio 4: Reinquadra la foto in base alla destinazione

Usa l’anteprima dell’avatar per decidere quanta parte della persona apparirà nel video finale. Trascina la foto per riposizionare il soggetto e usa i controlli di zoom per avvicinarti o allontanarti. Poi scegli il rapporto d'aspetto più adatto a dove pubblicherai:

  • 9:16 verticale per TikTok, Instagram Reels, YouTube Shorts e altre posizioni mobile-first.
  • 1:1 quadrato per post social quadrati, layout incentrati sul profilo e incorporamenti flessibili.
  • 16:9 orizzontale per YouTube, presentazioni, siti web e corsi in widescreen.
The same VisionStory avatar shown in 9:16, 1:1, and 16:9 aspect ratios

Lo zoom non può rivelare pixel che non esistono. Se la persona tocca già ogni bordo della foto di origine, parti da un’immagine con più sfondo invece di forzare un ritaglio più ampio.

Passaggio 5: Capisci cosa fanno Change Look e Generate Image

Accanto all’avatar ci sono due strumenti di immagini AI: prima di usarli, è utile conoscerne la differenza.

Change Look apre una chat AI con il tuo avatar attuale già allegato, così puoi descrivere un nuovo outfit, un’ambientazione o uno stile. È un flusso image-to-image e l’avatar originale resta disponibile. Generate Image invece parte da una descrizione scritta del personaggio, non da una foto: quindi è un flusso text-to-image. In entrambi i casi puoi continuare a chattare per perfezionare il risultato.

VisionStory Change Look chat opened with the current avatar attached as the starting image

In breve: usa Change Look quando il personaggio esiste già e ha bisogno di un nuovo stile visivo; usa Generate Image quando vuoi creare un personaggio partendo da un prompt.

Passaggio 6: Aggiungi un breve copione e genera il video parlante

Con l’avatar caricato selezionato, digita una sola frase breve e conversazionale nella casella Copione. Una riga corta viene renderizzata più velocemente e rende più facile valutare insieme foto, ritaglio, voce, sincronizzazione labiale e movimento.

Clicca Generate Talking Video. VisionStory anima il volto, sincronizza le labbra con la voce e aggiunge battiti di ciglia realistici e movimento della testa usando avatar, inquadratura, copione e voce selezionati. Il rendering richiede un paio di minuti.

A short VisionStory script generating a talking-avatar result from the uploaded portrait

Considera questo primo risultato come un test pratico della foto di origine. Controlla 4 cose:

  • Il volto resta abbastanza nitido alla dimensione finale.
  • Occhi e bocca restano non ostruiti durante il movimento.
  • Testa e spalle stanno comodamente dentro il rapporto scelto.
  • L’avatar in movimento somiglia ancora alla persona di origine.

Se il ritaglio è troppo stretto o il volto appare poco definito in movimento, correggi prima la foto di origine o l’inquadratura. Cambiare copione non risolverà un problema di composizione.

Passaggio 7: Riutilizza o rimuovi il tuo avatar da foto parlante

Tornando all’elenco Personaggi, l’avatar caricato si trova sopra la libreria dei personaggi pubblici e può essere selezionato ogni volta che vuoi lo stesso presentatore. Gli altri utenti non possono vederlo e gli abbonati possono creare e conservare avatar illimitati.

  • Riutilizzalo: seleziona l’avatar invece di caricare di nuovo la foto.
  • Cambia look: apri l’avatar e scegli una delle miniature dei look salvati.
  • Rimuovilo: passa il mouse sull’avatar per mostrare il pulsante di eliminazione nell’angolo in alto a destra, poi conferma prima di eliminare l’avatar e i suoi look.
A reusable uploaded avatar in VisionStory Characters with the delete control and confirmation dialog

Risoluzione dei problemi più comuni con le foto

VisionStory non riesce a trovare un volto utilizzabile. Usa un’immagine più luminosa e nitida, con un volto più grande e frontale. Evita occhi o bocca coperti, forti angolazioni di profilo e foto in cui un altro volto è molto vicino al soggetto principale.

Il ritaglio orizzontale è troppo ravvicinato. Probabilmente il ritratto di origine non ha abbastanza area immagine ai lati. Usa una sorgente più ampia o con più spazio vuoto attorno alla persona.

L’avatar è ancora in preparazione. Attendi la fine della preparazione prima di usare il personaggio. Se si blocca, aggiorna la vista Personaggi e controlla se l’avatar è già apparso prima di caricarne un’altra copia.

Il risultato sembra poco definito. Parti da una foto a risoluzione più alta e a fuoco ed evita di ingrandire troppo un volto piccolo. La risoluzione di output non può ripristinare dettagli che mancavano nella sorgente.

Questo è tutto ciò che serve per far parlare una foto: carica un ritratto, abbina una voce, inquadra e genera. La tua foto è ora un avatar parlante riutilizzabile che puoi usare di nuovo ogni volta che ne hai bisogno.

Vuoi il flusso completo per copione, voce, impostazioni, crediti e generazione? Segui How to Create an AI Talking Avatar, oppure trasforma copioni completi in Video AI su larga scala. Oppure inizia subito: crea gratis la tua prima foto parlante.

Domande frequenti

  • Carica una foto chiara e frontale nello strumento di foto parlante di VisionStory, digita una breve frase da farle dire, scegli (o mantieni) la voce assegnata e clicca Generate Talking Video. Con il piano gratuito ottieni in pochi minuti un video parlante con sincronizzazione labiale direttamente nel browser, senza software da installare.