
Kling の現行ツール群および外部公開モデルは、多くの導入環境で、ジョブあたり最長60秒のオーディオトラックに対するリップシンク処理をサポートしています。最高の忠実度の結果を得るため、ソース動画は通常2〜10秒の範囲に最適化されています。より大規模なジョブでは、実務的な制作ワークフローとして、長尺のオーディオを60秒(またはそれ以下)の複数セグメントに分割し、ポストプロダクションで結果を再結合します。

Kling 2.6は、急速に進化するAIビデオ分野で最大の増分アップデートの1つとして登場しました。無音のビデオを生成して音声を残す代わりに、

Kling Video 2.6はKling AI(Kuaishou)の最新のメジャーリリースであり、モデルが初めて同期オーディオを生成するという大きな変化をもたらしました。