Vous voulez faire parler une photo fixe—un portrait qui ouvre la bouche, cligne des yeux et dit tout ce que vous tapez ? Avec VisionStory, vous pouvez faire exactement ça à partir d’une seule image, directement dans votre navigateur, sans caméra ni expérience en montage. La vidéo ci-dessus présente l’ensemble du parcours, et le guide pas à pas ci-dessous détaille chaque étape.
Au fil du processus, vous importerez un portrait et le préparerez comme votre propre avatar réutilisable. Les autres utilisateurs ne peuvent pas le voir, et vous pourrez le sélectionner à nouveau pour de futures vidéos au lieu d’importer la même image à chaque fois. Tout se fait dans l’outil de photo parlante de VisionStory avec un compte gratuit.
Étape 1 : Importer un portrait net
Ouvrez Vidéo IA. Dans le panneau Personnages, choisissez Importer et sélectionnez une image depuis votre appareil, ou faites glisser la photo directement dans la zone de dépôt. Utilisez une personne bien de face, nette, avec le visage et les épaules visibles, les yeux et la bouche sans obstruction, et un peu d’espace autour du sujet pour pouvoir recadrer ensuite.
- Fichiers pris en charge : JPG, JPEG, PNG, WebP et HEIC.
- Taille maximale du fichier : 30 MB.
- Taille de départ recommandée : au moins 512 x 768 pixels pour un portrait.
- Comportement d’import : une image source à la fois.

Adaptez la composition de la photo source à l’endroit où la vidéo sera publiée. Un portrait très recadré peut fonctionner en 9:16, mais devenir un recadrage du visage trop serré en 16:9, car il n’y a pas d’image à gauche et à droite pour remplir un cadre plus large.
Étape 2 : Laisser VisionStory valider et préparer l’avatar
Après l’import, VisionStory vérifie si l’image contient une personne exploitable et la prépare comme personnage. Un échec d’import est presque toujours lié à la photo source : le visage peut être trop petit, largement couvert, trop tourné de côté, flou, ou trop proche d’un autre visage.
Si la préparation échoue, ne réessayez pas en boucle avec le même recadrage. Choisissez une source plus nette, avec un visage plus grand, un angle plus frontal, des épaules visibles, un éclairage homogène et moins d’obstructions.

Une fois le traitement terminé, l’avatar apparaît au-dessus de la bibliothèque de personnages publics et s’ouvre dans l’aperçu d’avatar. Il n’est visible que par vous.
Étape 3 : Prévisualiser ou modifier la voix attribuée
VisionStory attribue automatiquement une voix de départ adaptée en fonction de l’âge et du genre apparents de la personne. Vous pouvez la conserver, la prévisualiser ou la remplacer par une autre.
- Sélectionnez la voix actuelle pour ouvrir la bibliothèque de voix.
- Utilisez le bouton de lecture à droite d’une voix pour écouter un extrait.
- Si cela ne convient pas, filtrez par Langue, Genre, Âge et Cas d’usage.
- Prévisualisez quelques alternatives, puis choisissez la voix qui correspond à la fois à l’avatar et à l’objectif de la vidéo.

Une voix peut correspondre à l’âge et au genre apparents de la personne, tout en sonnant faux pour de la narration, de l’éducation, de la publicité ou un contenu conversationnel. Faites correspondre la personne et l’objectif, pas seulement les caractéristiques démographiques.
Étape 4 : Recadrer la photo selon sa destination
Utilisez l’aperçu de l’avatar pour décider quelle partie de la personne apparaît dans la vidéo finale. Faites glisser la photo pour repositionner le sujet, et utilisez les contrôles de zoom pour vous rapprocher ou vous éloigner. Ensuite, choisissez le ratio d’aspect adapté à l’endroit où vous publierez :
- 9:16 vertical pour TikTok, Instagram Reels, YouTube Shorts et d’autres emplacements mobile-first.
- 1:1 carré pour les posts sociaux carrés, les mises en page centrées sur un profil et les intégrations flexibles.
- 16:9 horizontal pour YouTube, les présentations, les sites web et les cours en grand écran.

Le zoom ne peut pas révéler des pixels qui n’existent pas. Si la personne touche déjà tous les bords de la photo source, partez plutôt d’une image avec plus d’arrière-plan, au lieu de forcer un recadrage plus large.
Étape 5 : Comprendre la différence entre Change Look et Generate Image
Deux outils d’image IA se trouvent à côté de l’avatar ; mieux vaut connaître la différence avant de les utiliser.
Change Look ouvre un chat IA avec votre avatar actuel déjà joint : vous pouvez décrire une nouvelle tenue, un décor ou un style. C’est un flux image-to-image, et l’avatar d’origine reste disponible. Generate Image part d’une description écrite du personnage plutôt que d’une photo : c’est un flux text-to-image. Dans les deux cas, vous pouvez continuer à discuter pour affiner le résultat.

En bref : utilisez Change Look quand le personnage existe déjà et a besoin d’un nouveau rendu visuel, et utilisez Generate Image quand vous voulez créer un personnage à partir d’un prompt.
Étape 6 : Ajouter un script court et générer la vidéo parlante
Avec votre avatar importé sélectionné, tapez une phrase courte et conversationnelle dans la zone Script. Une courte ligne se rend plus vite et permet d’évaluer plus facilement la photo, le recadrage, la voix, la synchronisation labiale et le mouvement, ensemble.
Cliquez sur Generate Talking Video. VisionStory anime le visage, synchronise les lèvres avec la voix et ajoute des clignements d’yeux et des mouvements de tête réalistes à partir de l’avatar, du cadrage, du script et de la voix sélectionnés. Le rendu prend quelques minutes.

Considérez ce premier résultat comme un test pratique de la photo source. Vérifiez quatre points :
- Le visage reste suffisamment net à la taille finale.
- Les yeux et la bouche restent dégagés pendant le mouvement.
- La tête et les épaules tiennent confortablement dans le ratio choisi.
- L’avatar en mouvement ressemble toujours à la personne sur la photo source.
Si le recadrage est trop serré ou si le visage paraît trop doux en mouvement, corrigez d’abord l’image source ou le cadrage. Changer le script ne corrigera pas un problème de composition.
Étape 7 : Réutiliser ou supprimer votre avatar de photo parlante
De retour dans la liste des Personnages, votre avatar importé se trouve au-dessus de la bibliothèque de personnages publics et peut être sélectionné à tout moment si vous voulez retrouver le même présentateur. Les autres utilisateurs ne peuvent pas le voir, et les abonnés peuvent créer et conserver un nombre illimité d’avatars.
- Le réutiliser : sélectionnez l’avatar au lieu d’importer à nouveau la photo.
- Changer de look : ouvrez l’avatar et choisissez l’une de ses vignettes de look enregistrées.
- Le supprimer : survolez l’avatar pour afficher le bouton de suppression en haut à droite, puis confirmez avant de supprimer l’avatar et ses looks.

Dépannage des problèmes photo courants
VisionStory ne trouve pas de visage exploitable. Utilisez une image plus lumineuse et plus nette, avec un visage plus grand, de face. Évitez les yeux ou la bouche couverts, les angles de profil marqués et les photos où un autre visage est proche du sujet principal.
Le recadrage en horizontal est trop serré. Le portrait source n’a probablement pas assez d’espace sur les côtés. Utilisez une source plus large, ou une image avec plus d’espace vide autour de la personne.
L’avatar est encore en préparation. Attendez la fin de la préparation avant d’utiliser le personnage. Si cela bloque, actualisez la vue Personnages et vérifiez si l’avatar n’est pas déjà apparu avant d’importer une autre copie.
Le résultat paraît trop doux. Commencez avec une photo de plus haute résolution, nette, et évitez d’agrandir trop agressivement un petit visage. La résolution de sortie ne peut pas restaurer des détails absents de la source.
C’est tout ce qu’il faut pour faire parler une photo : importez un portrait, associez une voix, cadrez et générez. Votre photo est désormais un avatar parlant réutilisable que vous pourrez reprendre dès que vous en aurez besoin.
Prêt pour le flux complet (script, voix, paramètres, crédits et génération) ? Suivez How to Create an AI Talking Avatar, ou transformez des scripts complets en vidéos IA à grande échelle. Ou commencez tout de suite : créez gratuitement votre première photo parlante.
