
Текущий инструментарий и публичные модели Kling во многих развертываниях поддерживают операции синхронизации губ на аудиодорожках длительностью до 60 секунд на одну задачу, при этом исходные видео обычно оптимизируют в диапазоне 2–10 секунд для наивысшего качества результатов. Для более крупных задач на практике производственные процессы разбивают длинные аудиодорожки на несколько 60‑секундных (или более коротких) сегментов и затем собирают результаты в постпродакшне.

Kling 2.6 появился как одно из крупнейших дополнительных обновлений в быстро развивающемся пространстве видео с использованием искусственного интеллекта: вместо того, чтобы создавать беззвучное видео и оставлять звук

Kling Video 2.6 — это последний крупный релиз от Kling AI (Kuaishou), и он знаменует собой качественное изменение: впервые модель генерирует синхронизированный звук.