Categoria de Modelos

Modelos de Sincronização Labial — 15 Maneiras de Combinar Áudio com um Rosto

9 modelos nomeados em dois modos de entrada — anime um retrato a partir de áudio ou ressincronize os lábios em um vídeo existente. 15 modelos no total, sem filtros de conteúdo.

15 Modelos de Sincronização Labial9 Nomeados em Dois Modos de Entrada

Os modelos de sincronização labial conduzem um vídeo falado a partir de uma faixa de áudio, seja animando um retrato estático ou ressincronizando os lábios em um clipe existente. A categoria traz 15 modelos no total, 9 deles nomeados com endpoints dedicados, divididos entre modos baseados em imagem e vídeo. Esta página cobre os modelos em si — veja a página do Estúdio de Sincronização Labial para o fluxo de geração.

Modelos de Sincronização Labial

15 Modelos de Sincronização Labial, Um Catálogo Open Generative AI

Cada modelo abaixo é listado pelo modo de entrada que aceita — uma imagem de retrato mais áudio, ou um vídeo existente mais áudio. A página do Estúdio de Sincronização Labial cobre como uma execução de geração é montada; esta página foca nos modelos.

infinite-talk

Imagem de retrato + áudio → vídeo falado, 480p ou 720p.

wan-2.2-speech-to-video

Imagem de retrato + áudio → vídeo falado, 480p ou 720p.

ltx-2.3-lipsync

Imagem de retrato + áudio → vídeo falado, até 1080p.

ltx-2-19b-lipsync

Imagem de retrato + áudio → vídeo falado, até 1080p.

sync-lipsync

Ressincronize os lábios em um vídeo existente com novo áudio.

latentsync

Vídeo + áudio → vídeo com sincronização labial.

creatify-lipsync

Vídeo + áudio → vídeo com sincronização labial.

veed-lipsync

Vídeo + áudio → vídeo com sincronização labial.

infinite-talk-v2v

Vídeo + áudio → vídeo com sincronização labial, 480p ou 720p.

Hospedado vs. executar localmente

Hospedado Hoje, Sem Caminho Local de Sincronização Labial

O Open Generative AI documenta inferência local apenas para geração de imagem e vídeo, então esses modelos rodam pela API hospedada — a mesma que o restante do catálogo usa.

Hospedado

Todos os 15 modelos de sincronização labial — 9 deles nomeados, entre modos baseados em imagem e vídeo — rodam pela API hospedada, sem configuração local.

Inferência Local

A inferência local (sd.cpp e Wan2GP) é documentada apenas para geração de imagem e vídeo; o projeto de origem não lista caminho local para sincronização labial, então ela roda hospedada hoje.

Comparar

Três Modelos de Sincronização Labial, Lado a Lado

Uma visão rápida de três modelos representativos do catálogo — um por modo de entrada, além da opção de maior resolução.

ModeloModo de entradaResoluções
Infinite TalkImagem de retrato + áudio480p, 720p
LTX 2.3 LipsyncImagem de retrato + áudio480p, 720p, 1080p
Sync LipsyncVídeo existente + áudioNão especificado

Deslize para ver a tabela completa

FAQ

Sincronização Labial Modelo FAQ

15 no total; 9 deles são nomeados com endpoints dedicados em dois modos de entrada — 4 modelos baseados em imagem e 5 baseados em vídeo.

Explore mais

Mais Open Generative AI Categorias de Modelos

A sincronização labial combina de perto com as categorias abaixo. Para o fluxo de geração em si — escolher um modo de entrada, preparar a faixa de áudio, executar o trabalho — leia a página do Estúdio de Sincronização Labial.

Sincronize os Lábios de um Vídeo Com o Open Generative AI — Grátis, Agora Mesmo

15 modelos de sincronização labial, sem filtros de conteúdo, sem assinatura. Sem conta necessária para testar.

Experimente Grátis
As imagens e vídeos do Open Generative AI são gerados por IA. Revise os resultados antes de usá-los para qualquer finalidade que exija precisão ou autenticidade.