Español (México)

Código abierto

Proyectos de Video con IA y avatares de código abierto

Guías claras sobre los modelos y herramientas de IA de código abierto detrás de los avatares parlantes, la generación de video y la voz — qué hacen, cómo ejecutarlos y cuándo una herramienta alojada es más rápida.

OpenMontage: el agente de video con IA de código abierto, explicado

OpenMontage: el agente de video con IA de código abierto, explicado

Una guía práctica de OpenMontage, el agente open-source de video con IA que convierte tu asistente de programación con IA en un estudio de video completo: qué hace, cómo configurarlo, cuánto cuesta y cuándo una herramienta alojada como VisionStory es la opción más rápida.

LongCat-Video-Avatar 1.5: Probamos el modelo open source de video de avatar parlante

LongCat-Video-Avatar 1.5: Probamos el modelo open source de video de avatar parlante

Un análisis práctico a fondo de LongCat-Video-Avatar 1.5, el modelo open source de Meituan con licencia MIT que convierte una foto y audio en un video de avatar parlante. Ejecutamos las tres tareas en una GPU A800, medimos la velocidad real y la VRAM, nos topamos con cinco trampas de configuración y explicamos con honestidad cuándo conviene el autoalojamiento y cuándo gana una herramienta alojada.

Kokoro TTS: ejecutamos el modelo de voz open source de 82M en la CPU de una laptop

Kokoro TTS: ejecutamos el modelo de voz open source de 82M en la CPU de una laptop

Un análisis práctico y a fondo de Kokoro, el modelo open source de Texto a voz de 82 millones de parámetros. Lo ejecutamos en una CPU Apple M3 Pro, generamos muestras de voz reales que puedes reproducir, nos topamos con el bug de empaquetado de espeak-ng (y lo corregimos) y te contamos con total honestidad cuándo Kokoro es suficiente y cuándo necesitas una herramienta alojada para crear videos hablados.

LivePortrait: el modelo de animación de retratos de código abierto, explicado

LivePortrait: el modelo de animación de retratos de código abierto, explicado

Una guía práctica de LivePortrait, el modelo de IA de código abierto que anima un retrato estático a partir de un video o audio de referencia: qué hace, cómo ejecutarlo y cuándo una herramienta alojada de avatares parlantes como VisionStory es la opción más rápida.