Español (Argentina)

Código abierto

Proyectos de Video con IA y avatares de código abierto

Guías en lenguaje simple sobre los modelos y herramientas de IA de código abierto detrás de los avatares parlantes, la generación de video y la voz — qué hacen, cómo ejecutarlos y cuándo una herramienta alojada es más rápida.

OpenMontage: el agente open source de video con IA, explicado

OpenMontage: el agente open source de video con IA, explicado

Una guía práctica sobre OpenMontage, el agente open source de video con IA que convierte tu asistente de programación con IA en un estudio de video completo: qué hace, cómo configurarlo, cuánto cuesta y cuándo una herramienta alojada como VisionStory es la opción más rápida.

LongCat-Video-Avatar 1.5: probamos el modelo open-source de video de avatar parlante

LongCat-Video-Avatar 1.5: probamos el modelo open-source de video de avatar parlante

Un análisis práctico a fondo de LongCat-Video-Avatar 1.5, el modelo open-source de Meituan con licencia MIT que convierte una foto más audio en un video de avatar parlante. Ejecutamos las tres tareas en una GPU A800, medimos la velocidad real y la VRAM, nos encontramos con cinco trampas de configuración y contamos con honestidad cuándo tiene sentido hacer self-hosting y cuándo conviene más una herramienta alojada.

Kokoro TTS: ejecutamos el modelo de voz open source de 82M en la CPU de una notebook

Kokoro TTS: ejecutamos el modelo de voz open source de 82M en la CPU de una notebook

Un análisis práctico y a fondo de Kokoro, el modelo open source de Texto a voz de 82 millones de parámetros. Lo ejecutamos en una CPU Apple M3 Pro, generamos muestras de voz reales que podés reproducir, nos encontramos con el bug de empaquetado de espeak-ng (y lo arreglamos), y te contamos con total honestidad cuándo Kokoro alcanza y cuándo necesitás una herramienta alojada para videos parlantes.

LivePortrait: el modelo open source de animación de retratos, explicado

LivePortrait: el modelo open source de animación de retratos, explicado

Una guía práctica de LivePortrait, el modelo de IA open source que anima un retrato fijo a partir de un video o audio de referencia: qué hace, cómo ejecutarlo y cuándo una herramienta alojada de avatar parlante como VisionStory es la opción más rápida.