Portret + audio → mówiące wideo, 480p lub 720p.
Modele synchronizacji ust — 15 sposobów na dopasowanie Audio do twarzy
9 nazwanych modeli w dwóch trybach wejściowych — animuj portret z audio albo ponownie zsynchronizuj usta na istniejącym wideo. Łącznie 15 modeli, bez filtrów treści.
Modele synchronizacji ust tworzą film z mówiącą postacią na podstawie ścieżki audio — animując statyczny portret lub ponownie synchronizując usta na istniejącym klipie. Kategoria obejmuje łącznie 15 modeli, z czego 9 ma dedykowane punkty końcowe podzielone między tryby oparte na obrazie i na wideo. Ta strona opisuje same modele — proces generowania znajdziesz na stronie Lip Sync Studio.
15 Modeli Synchronizacji Ruchu Warg, Jeden Katalog Open Generative AI
Każdy model poniżej jest opisany według trybu wejściowego, jaki przyjmuje — portret plus audio albo istniejące wideo plus audio. Strona Lip Sync Studio wyjaśnia, jak zbudowany jest proces generowania; ta strona skupia się na modelach.
Portret + audio → mówiące wideo, 480p lub 720p.
Portret + audio → mówiące wideo, do 1080p.
Portret + audio → mówiące wideo, do 1080p.
Zsynchronizuj ponownie usta na istniejącym wideo z nowym audio.
Wideo + audio → wideo z synchronizacją ust.
Wideo + audio → wideo z synchronizacją ust.
Wideo + audio → wideo z synchronizacją ust.
Wideo + audio → wideo z synchronizacją ust, 480p lub 720p.
Dziś tylko hosting — bez lokalnej ścieżki do synchronizacji ust
Open Generative AI dokumentuje inferencję lokalną wyłącznie dla generowania obrazów i wideo, więc te modele działają przez hostowane API — to samo, z którego korzysta reszta katalogu.
Wersja hostowana
Wszystkie 15 modeli synchronizacji ruchu warg — 9 z nich nazwanych, w trybach opartych na obrazie i wideo — działa przez hostowane API bez konfiguracji lokalnej.
Lokalna inferencja
Lokalna inferencja (sd.cpp i Wan2GP) jest udokumentowana wyłącznie dla generowania obrazów i wideo; projekt źródłowy nie podaje lokalnej ścieżki dla synchronizacji ust, więc dziś działa ona w wersji hostowanej.
Trzy modele synchronizacji ust obok siebie
Szybki przegląd trzech reprezentatywnych modeli w katalogu — po jednym na tryb wejściowy, plus opcja o najwyższej rozdzielczości.
| Model | Tryb wejściowy | Rozdzielczości |
|---|---|---|
| Infinite Talk | Portret + audio | 480p, 720p |
| LTX 2.3 Lipsync | Portret + audio | 480p, 720p, 1080p |
| Sync Lipsync | Istniejące wideo + audio | Nie podano |
Przesuń, aby zobaczyć pełną tabelę
Synchronizacja ust Model FAQ
Więcej Open Generative AI Kategorie modeli
Synchronizacja ust ściśle współgra z kategoriami poniżej. Sam proces generowania — wybór trybu wejściowego, przygotowanie ścieżki audio, uruchomienie zadania — opisany jest na stronie Lip Sync Studio.
Zsynchronizuj usta w filmie za pomocą Open Generative AI — Za darmo, już teraz
15 modeli synchronizacji ruchu warg, bez filtrów treści, bez subskrypcji. Nie wymaga konta, aby wypróbować.
Wypróbuj za darmo