画像ベースのリップシンク
単一のポートレートと音声トラックから開始。Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync、LTX 2 19B Lipsyncの4モデルが、モデルに応じて最大1080pの解像度で声に合わせて顔をアニメーション化します。
音声トラックを顔に同期するひとつのワークスペース。単一のポートレートまたは既存の動画のどちらからでも、9つの専用モデルで作業できます。
声を顔に合わせるためのプラットフォーム専用のワークスペース。単一のポートレートからでも、すでに撮影済みの動画からでも始められます。
単一のポートレートと音声トラックから開始。Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 Lipsync、LTX 2 19B Lipsyncの4モデルが、モデルに応じて最大1080pの解像度で声に合わせて顔をアニメーション化します。
すでに動画をお持ちですか?Sync Lipsync、LatentSync、Creatify Lipsync、Veed Lipsync、Infinite Talk V2Vの5モデルが、顔全体を再アニメーション化せずに、口の動きを新しい音声トラックに再同期します。
これらのジョブは画像や動画とは別の専用履歴で管理され、生成中にページをリロードしても、保留中のジョブは自動的に再開します。
リップシンクカタログに含まれる15モデルのうち、画像ベース・動画ベースの両モードにまたがる9つの専用モデルを搭載。
静止したポートレートから始める場合も、既存の動画から始める場合も、流れは同じです。
画像ベースモードなら単一のポートレートを、動画ベースモードなら既存の動画をアップロード。スタジオが対応するモデルセットを表示します。
顔に合わせたい音声・セリフトラックをアップロードまたは選択します。
モデルに応じて最大1080pでジョブを実行。生成中にタブを閉じても、リロード時に専用履歴から保留中のジョブが再開します。
これはプラットフォームに用意された14の専用ワークスペースのひとつです。次に進むならこちら。