Catégorie de modèles

Modèles Lip Sync — 15 façons d'associer l'audio à un visage

9 modèles nommés sur deux modes d'entrée — animez un portrait à partir de l'audio, ou resynchronisez les lèvres sur une vidéo existante. 15 modèles au total, aucun filtre de contenu.

15 Modèles Lip Sync9 Nommés sur deux modes d'entrée

Les modèles de synchronisation labiale pilotent une vidéo parlante à partir d'une piste audio, soit en animant un portrait fixe, soit en resynchronisant les lèvres sur un clip existant. La catégorie compte 15 modèles au total, dont 9 nommés avec des endpoints dédiés répartis entre les modes image et vidéo. Cette page couvre les modèles eux-mêmes — consultez la page du Studio Lip Sync pour le workflow de génération.

Modèles Lip Sync

15 modèles Lip Sync, un seul catalogue Open Generative AI

Chaque modèle ci-dessous est répertorié selon le mode d'entrée qu'il accepte — une image portrait plus un audio, ou une vidéo existante plus un audio. La page du Studio Lip Sync explique comment une génération est montée ; cette page se concentre sur les modèles.

infinite-talk

Image portrait + audio → vidéo parlante, 480p ou 720p.

wan-2.2-speech-to-video

Image portrait + audio → vidéo parlante, 480p ou 720p.

ltx-2.3-lipsync

Image portrait + audio → vidéo parlante, jusqu'à 1080p.

ltx-2-19b-lipsync

Image portrait + audio → vidéo parlante, jusqu'à 1080p.

sync-lipsync

Resynchronisez les lèvres sur une vidéo existante avec un nouvel audio.

latentsync

Vidéo + audio → vidéo synchronisée.

creatify-lipsync

Vidéo + audio → vidéo synchronisée.

veed-lipsync

Vidéo + audio → vidéo synchronisée.

infinite-talk-v2v

Vidéo + audio → vidéo synchronisée, 480p ou 720p.

Hébergé ou exécuté en local

Hébergé aujourd'hui, sans voie locale de synchronisation labiale

Open Generative AI documente l'inférence locale uniquement pour la génération d'images et de vidéos, ces modèles passent donc par l'API hébergée — la même que celle utilisée par le reste du catalogue.

Hébergé

Les 15 modèles de synchronisation labiale — dont 9 nommés, sur les modes image et vidéo — passent par l'API hébergée sans configuration locale.

Inférence locale

L'inférence locale (sd.cpp et Wan2GP) est documentée uniquement pour la génération d'images et de vidéos ; le projet source ne répertorie aucune voie locale pour la synchronisation labiale, elle s'exécute donc en hébergé aujourd'hui.

Comparer

Trois modèles Lip Sync côte à côte

Un aperçu rapide de trois modèles représentatifs du catalogue — un par mode d'entrée, plus l'option de plus haute résolution.

ModèleMode d'entréeRésolutions
Infinite TalkImage portrait + audio480p, 720p
LTX 2.3 LipsyncImage portrait + audio480p, 720p, 1080p
Sync LipsyncVidéo existante + audioNon spécifiées

Faites glisser pour voir le tableau complet

FAQ

Lip Sync Modèle FAQ

15 au total ; 9 d'entre eux sont nommés avec des endpoints dédiés sur deux modes d'entrée — 4 modèles basés sur l'image et 5 modèles basés sur la vidéo.

Explorer plus

Plus de Open Generative AI Catégories de modèles

La synchronisation labiale fonctionne en étroite synergie avec les catégories ci-dessous. Pour le workflow de génération lui-même — choix du mode d'entrée, préparation de la piste audio, exécution de la tâche — lisez plutôt la page du Studio Lip Sync.

Synchronisez une vidéo avec Open Generative AI — gratuitement, dès maintenant

15 modèles de synchronisation labiale, aucun filtre de contenu, sans abonnement. Aucun compte requis pour essayer.

Essayer gratuitement
Les images et vidéos Open Generative AI sont générées par IA. Vérifiez les résultats avant de les utiliser à des fins exigeant exactitude ou authenticité.