Français

Open source

Projets open source de vidéo IA et d’avatars

Des guides clairs et accessibles sur les modèles et outils IA open source derrière les avatars parlants, la génération de vidéos et la voix — ce qu’ils font, comment les exécuter et quand un outil hébergé est plus rapide.

OpenMontage : l’agent de Vidéo IA open source, expliqué

OpenMontage : l’agent de Vidéo IA open source, expliqué

Un guide pratique d’OpenMontage, l’agent de Vidéo IA open source qui transforme votre assistant de codage IA en véritable studio vidéo — ce qu’il fait, comment le configurer, combien ça coûte et quand un outil hébergé comme VisionStory est le choix le plus rapide.

LongCat-Video-Avatar 1.5 : nous avons testé le modèle open source de vidéo d’avatar parlant

LongCat-Video-Avatar 1.5 : nous avons testé le modèle open source de vidéo d’avatar parlant

Une analyse pratique et détaillée de LongCat-Video-Avatar 1.5, le modèle open source sous licence MIT de Meituan qui transforme une photo et un audio en vidéo d’avatar parlant. Nous avons exécuté les trois tâches sur un GPU A800, mesuré la vitesse réelle et la VRAM, rencontré cinq pièges de configuration, et expliquons franchement quand l’auto-hébergement a du sens et quand un outil hébergé l’emporte.

Kokoro TTS : nous avons exécuté le modèle open source de voix 82M sur le CPU d’un ordinateur portable

Kokoro TTS : nous avons exécuté le modèle open source de voix 82M sur le CPU d’un ordinateur portable

Un démontage pratique de Kokoro, le modèle open source de texte en parole à 82 millions de paramètres. Nous l’avons exécuté sur un CPU Apple M3 Pro, généré de vrais échantillons de voix que vous pouvez écouter, rencontré le bug de packaging d’espeak-ng (et l’avons corrigé), et expliquons en toute transparence quand Kokoro suffit et quand vous avez besoin d’un outil hébergé de vidéo parlante.

LivePortrait : le modèle open source d’animation de portrait, expliqué

LivePortrait : le modèle open source d’animation de portrait, expliqué

Un guide pratique sur LivePortrait, le modèle IA open source qui anime un portrait fixe à partir d’une vidéo ou d’un audio de pilotage : ce qu’il fait, comment le lancer et quand un outil d’avatar parlant hébergé comme VisionStory est le choix le plus rapide.