Imagen de retrato + audio: video parlante, 480p o 720p.
Modelos de sincronización de labios: 15 formas de hacer coincidir el audio con un rostro
9 modelos con nombre en dos modos de entrada: anima un retrato desde el audio o vuelve a sincronizar los labios de un video existente. 15 modelos en total, sin filtros de contenido.
Los modelos de sincronización de labios hacen que un video parlante siga una pista de audio, ya sea animando un retrato fijo o volviendo a sincronizar los labios de un clip existente. La categoría incluye 15 modelos en total, 9 de ellos con nombre y puntos de conexión dedicados repartidos entre los modos basados en imagen y en video. Esta página cubre los modelos: consulta la página del Lip Sync Studio para ver el flujo de generación.
15 modelos de sincronización de labios, un solo catálogo de Open Generative AI
Cada modelo de abajo se enumera según el modo de entrada que admite: una imagen de retrato más audio, o un video existente más audio. La página del Lip Sync Studio cubre cómo se monta una generación; esta página se centra en los modelos.
Imagen de retrato + audio: video parlante, 480p o 720p.
Imagen de retrato + audio: video parlante, hasta 1080p.
Imagen de retrato + audio: video parlante, hasta 1080p.
Vuelve a sincronizar los labios de un video existente con audio nuevo.
Video + audio: video con sincronización de labios.
Video + audio: video con sincronización de labios.
Video + audio: video con sincronización de labios.
Video + audio: video con sincronización de labios, 480p o 720p.
Alojado hoy, sin ruta local de lip sync
Open Generative AI documenta la inferencia local solo para la generación de imagen y video, así que estos modelos se ejecutan a través de la API alojada: la misma que usa el resto del catálogo.
Alojado
Los 15 modelos de sincronización de labios (9 de ellos con nombre, en modos basados en imagen y video) se ejecutan a través de la API alojada sin configuración local.
Inferencia local
La inferencia local (sd.cpp y Wan2GP) está documentada solo para la generación de imagen y video; el proyecto fuente no enumera ninguna ruta local para el lip sync, así que hoy se ejecuta alojado.
Tres modelos de sincronización de labios, comparados
Una mirada rápida a tres modelos representativos del catálogo: uno por modo de entrada, además de la opción de mayor resolución.
| Modelo | Modo de entrada | Resoluciones |
|---|---|---|
| Infinite Talk | Imagen de retrato + audio | 480p, 720p |
| LTX 2.3 Lipsync | Imagen de retrato + audio | 480p, 720p, 1080p |
| Sync Lipsync | Video existente + audio | No especificada |
Desliza para ver la tabla completa
FAQ de los modelos de sincronización de labios
Más Open Generative AI Categorías de modelos
El lip sync se complementa con las categorías de abajo. Para el flujo de generación en sí (elegir el modo de entrada, preparar la pista de audio, ejecutar el trabajo), consulta la página del Lip Sync Studio.
Sincroniza los labios de un video con Open Generative AI — Gratis, ahora mismo
15 modelos de sincronización de labios, sin filtros de contenido y sin suscripción. No hace falta cuenta para probarlo.
Probar gratis