
Klings nuværende værktøjer og offentligt tilgængelige modeller understøtter mundsynkronisering på lydspor på op til 60 sekunder pr. job i mange implementeringer, hvor kildevideoer typisk er optimeret til området 2–10 sekunder for de mest naturtro resultater. For større opgaver opdeler praktiske produktionsarbejdsgange længere lyd i flere segmenter på 60 sekunder (eller kortere) og samler resultaterne igen i postproduktion.

Kling 2.6 ankom som en af de største trinvise opdateringer inden for det hurtigt udviklende AI-videorum: i stedet for at generere lydløs video og overlade lyd til

Kling Video 2.6 er den seneste store udgivelse fra Kling AI (Kuaishou), og den markerer en afgørende ændring: for første gang genererer modellen synkroniseret lyd