
Klings aktuelle Tools und öffentlich zugängliche Modelle unterstützen in vielen Bereitstellungen Lippensynchronisation auf Audiospuren von bis zu 60 Sekunden pro Auftrag, wobei Quellvideos typischerweise im Bereich von 2–10 Sekunden optimiert werden, um Ergebnisse mit höchster Wiedergabetreue zu erzielen. Für größere Aufträge teilen praxisnahe Produktions-Workflows längere Audiospuren in mehrere Segmente von 60 Sekunden (oder kürzer) und setzen die Ergebnisse in der Postproduktion wieder zusammen.

Kling 2.6 erschien als eines der größten inkrementellen Updates im schnelllebigen Bereich der KI-Videobearbeitung: Anstatt stummes Video zu erzeugen und den Ton dem Benutzer zu überlassen.

Kling Video 2.6 ist die neueste Hauptversion von Kling AI (Kuaishou) und markiert einen Quantensprung: Das Modell generiert erstmals synchronisiertes Audio.