Categoría de modelos

Modelos de sincronización de labios: 15 formas de hacer coincidir el audio con un rostro

9 modelos con nombre en dos modos de entrada: anima un retrato desde el audio o vuelve a sincronizar los labios de un video existente. 15 modelos en total, sin filtros de contenido.

15 Modelos de sincronización de labios9 Con nombre en dos modos de entrada

Los modelos de sincronización de labios hacen que un video parlante siga una pista de audio, ya sea animando un retrato fijo o volviendo a sincronizar los labios de un clip existente. La categoría incluye 15 modelos en total, 9 de ellos con nombre y puntos de conexión dedicados repartidos entre los modos basados en imagen y en video. Esta página cubre los modelos: consulta la página del Lip Sync Studio para ver el flujo de generación.

Modelos de sincronización de labios

15 modelos de sincronización de labios, un solo catálogo de Open Generative AI

Cada modelo de abajo se enumera según el modo de entrada que admite: una imagen de retrato más audio, o un video existente más audio. La página del Lip Sync Studio cubre cómo se monta una generación; esta página se centra en los modelos.

infinite-talk

Imagen de retrato + audio: video parlante, 480p o 720p.

wan-2.2-speech-to-video

Imagen de retrato + audio: video parlante, 480p o 720p.

ltx-2.3-lipsync

Imagen de retrato + audio: video parlante, hasta 1080p.

ltx-2-19b-lipsync

Imagen de retrato + audio: video parlante, hasta 1080p.

sync-lipsync

Vuelve a sincronizar los labios de un video existente con audio nuevo.

latentsync

Video + audio: video con sincronización de labios.

creatify-lipsync

Video + audio: video con sincronización de labios.

veed-lipsync

Video + audio: video con sincronización de labios.

infinite-talk-v2v

Video + audio: video con sincronización de labios, 480p o 720p.

Alojado frente a ejecutarlo localmente

Alojado hoy, sin ruta local de lip sync

Open Generative AI documenta la inferencia local solo para la generación de imagen y video, así que estos modelos se ejecutan a través de la API alojada: la misma que usa el resto del catálogo.

Alojado

Los 15 modelos de sincronización de labios (9 de ellos con nombre, en modos basados en imagen y video) se ejecutan a través de la API alojada sin configuración local.

Inferencia local

La inferencia local (sd.cpp y Wan2GP) está documentada solo para la generación de imagen y video; el proyecto fuente no enumera ninguna ruta local para el lip sync, así que hoy se ejecuta alojado.

Comparar

Tres modelos de sincronización de labios, comparados

Una mirada rápida a tres modelos representativos del catálogo: uno por modo de entrada, además de la opción de mayor resolución.

ModeloModo de entradaResoluciones
Infinite TalkImagen de retrato + audio480p, 720p
LTX 2.3 LipsyncImagen de retrato + audio480p, 720p, 1080p
Sync LipsyncVideo existente + audioNo especificada

Desliza para ver la tabla completa

FAQ

FAQ de los modelos de sincronización de labios

15 en total; 9 de ellos tienen nombre y puntos de conexión dedicados en dos modos de entrada: 4 modelos basados en imagen y 5 basados en video.

Explorar más

Más Open Generative AI Categorías de modelos

El lip sync se complementa con las categorías de abajo. Para el flujo de generación en sí (elegir el modo de entrada, preparar la pista de audio, ejecutar el trabajo), consulta la página del Lip Sync Studio.

Sincroniza los labios de un video con Open Generative AI — Gratis, ahora mismo

15 modelos de sincronización de labios, sin filtros de contenido y sin suscripción. No hace falta cuenta para probarlo.

Probar gratis
Las imágenes y los videos de Open Generative AI se generan con IA. Revisa los resultados antes de usarlos para cualquier propósito que requiera precisión o autenticidad.