
เครื่องมือและโมเดลที่เปิดให้สาธารณะใช้งานของ Kling ในปัจจุบันรองรับการลิปซิงก์บนแทร็กเสียงได้สูงสุด 60 วินาทีต่อหนึ่งงานในหลายกรณีการใช้งาน โดยวิดีโอต้นฉบับมักถูกปรับให้เหมาะสมให้อยู่ในช่วง 2–10 วินาทีเพื่อให้ได้ผลลัพธ์ที่มีความเที่ยงตรงสูงสุด สำหรับงานที่มีขนาดใหญ่กว่า เวิร์กโฟลว์การผลิตในทางปฏิบัติมักจะแบ่งเสียงที่ยาวออกเป็นหลายเซกเมนต์ความยาว 60 วินาที (หรือน้อยกว่า) แล้วประกอบผลลัพธ์กลับเข้าด้วยกันในขั้นตอนหลังการผลิต。

Kling 2.6 มาถึงในฐานะหนึ่งในการอัปเดตเพิ่มเติมครั้งใหญ่ที่สุดในพื้นที่วิดีโอ AI ที่เปลี่ยนแปลงอย่างรวดเร็ว: แทนที่จะสร้างวิดีโอแบบเงียบและปล่อยให้เสียง

Kling Video 2.6 เป็นเวอร์ชันหลักล่าสุดจาก Kling AI (Kuaishou) และถือเป็นการเปลี่ยนแปลงครั้งสำคัญ: เป็นครั้งแรกที่รุ่นนี้สร้างเสียงที่ซิงโครไนซ์กัน