
Les outils actuels et les modèles destinés au public de Kling prennent en charge des opérations de synchronisation labiale sur des pistes audio jusqu’à 60 secondes par tâche dans de nombreux déploiements, les vidéos sources étant généralement optimisées dans une plage de 2–10 secondes pour obtenir des résultats de la plus haute fidélité. Pour des tâches plus importantes, les flux de production opérationnels découpent les pistes audio plus longues en segments de 60 secondes (ou moins) et réassemblent les résultats en post-production.

Kling 2.6 est arrivé comme l'une des plus importantes mises à jour incrémentales dans le domaine en constante évolution de la vidéo IA : au lieu de générer une vidéo muette et de laisser l'audio à la charge de l'utilisateur, Kling 2.6 a été conçu pour être géré par l'IA.

Kling Video 2.6 est la dernière version majeure de Kling AI (Kuaishou) et marque un tournant : pour la première fois, le modèle génère un son synchronisé.