
Obecne narzędzia i publicznie dostępne modele Kling obsługują operacje lip-sync na ścieżkach audio o długości do 60 sekund na zadanie w wielu wdrożeniach, przy czym materiały wideo źródłowe są zwykle optymalizowane do długości 2–10 sekund w celu uzyskania wyników o najwyższej wierności. W przypadku większych zadań praktyczne przepływy pracy w produkcji dzielą dłuższy materiał audio na wiele 60-sekundowych (lub krótszych) segmentów i ponownie składają wyniki w postprodukcji.

Kling 2.6 pojawił się jako jedna z największych, przyrostowych aktualizacji w szybko rozwijającej się przestrzeni wideo opartej na sztucznej inteligencji: zamiast generować ciche wideo i pozostawiać dźwięk

Kling Video 2.6 to najnowsza główna wersja firmy Kling AI (Kuaishou) i oznacza ona przełom: po raz pierwszy model generuje zsynchronizowany dźwięk