
Kling 目前的工具與面向公眾的模型在許多部署中支援口型同步操作,單一任務可處理長度最多 60 秒的音訊,而原始影片通常會優化至 2–10 秒範圍以獲得最高保真度的結果。對於更大的任務,實務的製作流程會將較長的音訊切分為多個 60 秒(或更短)的片段,並在後期製作中重新組合結果。

Kling 2.6 的發布是快速發展的 AI 視訊領域中最重要的一次增量更新之一:它不再產生無聲視訊而將音訊留給用戶。

Kling Video 2.6 是快手 Kling AI 的最新重大版本,它標誌著一項重大變革:該模型首次產生了同步音訊。