
Các công cụ hiện tại và các mô hình công khai của Kling hỗ trợ lip-sync trên track âm thanh dài tối đa 60 giây cho mỗi tác vụ trong nhiều môi trường triển khai, với video nguồn thường được tối ưu trong khoảng 2–10 giây để đạt độ trung thực cao nhất. Đối với các tác vụ lớn hơn, các quy trình sản xuất thực tế sẽ chia âm thanh dài thành nhiều đoạn 60 giây (hoặc ngắn hơn) và ghép lại kết quả trong giai đoạn hậu kỳ.

Kling 2.6 ra mắt như một trong những bản cập nhật gia tăng lớn nhất trong không gian video AI đang phát triển nhanh chóng: thay vì tạo video im lặng và để lại âm thanh

Kling Video 2.6 là bản phát hành chính thức mới nhất của Kling AI (Kuaishou) và đánh dấu một bước thay đổi: lần đầu tiên mô hình tạo ra âm thanh được đồng bộ hóa