
Las herramientas actuales y los modelos de cara al público de Kling admiten operaciones de sincronización labial en pistas de audio de hasta 60 segundos por tarea en muchas implementaciones, y los videos de origen se optimizan normalmente en el rango de 2–10 segundos para obtener resultados de la máxima fidelidad. Para tareas más grandes, los flujos de trabajo de producción prácticos dividen el audio más largo en múltiples segmentos de 60 segundos (o más cortos) y reensamblan los resultados en la posproducción.

Kling 2.6 llegó como una de las actualizaciones incrementales más grandes en el espacio de video de IA de rápido movimiento: en lugar de generar video silencioso y dejar el audio en

Kling Video 2.6 es el último lanzamiento importante de Kling AI (Kuaishou) y marca un cambio radical: por primera vez, el modelo genera audio sincronizado.