このドキュメントはAIによって生成されました。誤りを発見された場合、または改善のご提案がある場合は、ぜひご貢献ください! GitHubで編集するKling Lip Sync Audio to Video ノードは、動画ファイル内の口の動きを音声ファイルの内容と同期させる機能を提供します。このノードは音声に含まれる発話パターンを解析し、動画内の顔の動きを調整することで、リアルなリップシンク(口の動きの同期)効果を実現します。この処理には、明確に識別可能な顔が映っている動画ファイルと、はっきりと聞き分けられる発話が含まれている音声ファイルの両方が必要です。
入力
重要な制約条件:
- 音声ファイルのサイズは5MBを超えてはいけません
- 動画ファイルのサイズは100MBを超えてはいけません
- 動画の解像度(高さ/幅)は720px~1920pxの範囲内である必要があります
- 動画の再生時間は2秒~10秒の範囲内である必要があります
- 音声には明確に聞き分けられる発話が含まれている必要があります
- 動画には明確に識別可能な顔が映っている必要があります