Image portrait + audio → vidéo parlante, 480p ou 720p.
Modèles Lip Sync — 15 façons d'associer l'audio à un visage
9 modèles nommés sur deux modes d'entrée — animez un portrait à partir de l'audio, ou resynchronisez les lèvres sur une vidéo existante. 15 modèles au total, aucun filtre de contenu.
Les modèles de synchronisation labiale pilotent une vidéo parlante à partir d'une piste audio, soit en animant un portrait fixe, soit en resynchronisant les lèvres sur un clip existant. La catégorie compte 15 modèles au total, dont 9 nommés avec des endpoints dédiés répartis entre les modes image et vidéo. Cette page couvre les modèles eux-mêmes — consultez la page du Studio Lip Sync pour le workflow de génération.
15 modèles Lip Sync, un seul catalogue Open Generative AI
Chaque modèle ci-dessous est répertorié selon le mode d'entrée qu'il accepte — une image portrait plus un audio, ou une vidéo existante plus un audio. La page du Studio Lip Sync explique comment une génération est montée ; cette page se concentre sur les modèles.
Image portrait + audio → vidéo parlante, 480p ou 720p.
Image portrait + audio → vidéo parlante, jusqu'à 1080p.
Image portrait + audio → vidéo parlante, jusqu'à 1080p.
Resynchronisez les lèvres sur une vidéo existante avec un nouvel audio.
Vidéo + audio → vidéo synchronisée.
Vidéo + audio → vidéo synchronisée.
Vidéo + audio → vidéo synchronisée.
Vidéo + audio → vidéo synchronisée, 480p ou 720p.
Hébergé aujourd'hui, sans voie locale de synchronisation labiale
Open Generative AI documente l'inférence locale uniquement pour la génération d'images et de vidéos, ces modèles passent donc par l'API hébergée — la même que celle utilisée par le reste du catalogue.
Hébergé
Les 15 modèles de synchronisation labiale — dont 9 nommés, sur les modes image et vidéo — passent par l'API hébergée sans configuration locale.
Inférence locale
L'inférence locale (sd.cpp et Wan2GP) est documentée uniquement pour la génération d'images et de vidéos ; le projet source ne répertorie aucune voie locale pour la synchronisation labiale, elle s'exécute donc en hébergé aujourd'hui.
Trois modèles Lip Sync côte à côte
Un aperçu rapide de trois modèles représentatifs du catalogue — un par mode d'entrée, plus l'option de plus haute résolution.
| Modèle | Mode d'entrée | Résolutions |
|---|---|---|
| Infinite Talk | Image portrait + audio | 480p, 720p |
| LTX 2.3 Lipsync | Image portrait + audio | 480p, 720p, 1080p |
| Sync Lipsync | Vidéo existante + audio | Non spécifiées |
Faites glisser pour voir le tableau complet
Lip Sync Modèle FAQ
Plus de Open Generative AI Catégories de modèles
La synchronisation labiale fonctionne en étroite synergie avec les catégories ci-dessous. Pour le workflow de génération lui-même — choix du mode d'entrée, préparation de la piste audio, exécution de la tâche — lisez plutôt la page du Studio Lip Sync.
Synchronisez une vidéo avec Open Generative AI — gratuitement, dès maintenant
15 modèles de synchronisation labiale, aucun filtre de contenu, sans abonnement. Aucun compte requis pour essayer.
Essayer gratuitement