Crea impresionantes videos cinematográficos con Kling 3.0 — el modelo de video IA más avanzado con audio nativo, consistencia de personajes, edición Multi-Shot y clonación de voz personalizada.
Todo lo que necesitas saber sobre la generación de videos con IA Kling 3.0 — funciones, precios y uso.
Kling 3.0 es el último modelo de generación de video IA de Kuaishou. Cuenta con generación de audio nativa, consistencia de personajes mediante el binding Elements, control de escenas Multi-Shot, clonación de voz personalizada y una calidad visual significativamente mejorada con movimiento cinematográfico. En comparación con Kling 2.0, ofrece mayor resolución, mayor duración (hasta 15 segundos) y capacidades de audio/voz integradas.
Kling 3.0 soporta duraciones de video de 3 a 15 segundos. Las relaciones de aspecto disponibles son 16:9 (horizontal), 9:16 (vertical) y 1:1 (cuadrado). También puedes usar el modo Multi-Shot para crear escenas complejas con múltiples tomas con un total de hasta 15 segundos.
Elements te permite mantener la consistencia de los personajes en tu video. Puedes subir una imagen frontal e imágenes de referencia de un personaje, o proporcionar un videoclip corto. Referencia los personajes en tu prompt usando @Element1, @Element2, etc. Esto asegura que el mismo personaje aparezca de manera consistente en todo el video generado.
El modo Multi-Shot te permite dividir tu video en múltiples escenas, cada una con su propio prompt y duración. Esto te da un control preciso sobre el flujo narrativo. Cada toma puede tener una descripción diferente mientras mantiene la continuidad visual. La duración total de todas las tomas no puede exceder 15 segundos.
Puedes subir un archivo de audio (5-30 segundos, mp3/wav) o un video con habla clara para crear un ID de voz personalizado. Luego referéncialo en tu prompt usando '<<<voice_1>>>' o '<<<voice_2>>>' (máx. 2 voces por generación). La IA generará un video con diálogos que coincidan con las voces clonadas. La generación de audio debe estar habilitada para que los IDs de voz surtan efecto.
La calidad Standard ofrece generación rápida a 1,000 créditos por segundo. La calidad Pro ofrece fidelidad visual superior, movimiento más fluido y renderizado más detallado a 2,000 créditos por segundo (2× Standard). Habilitar el audio añade un multiplicador de 1,5× a ambos niveles.
Los créditos se calculan como: Duración (segundos) × Tarifa Base × Multiplicador de Audio. La tarifa base Standard es 1,000 créditos/segundo, Pro es 2,000 créditos/segundo. La generación de audio añade un multiplicador de 1,5×. Por ejemplo, un video Pro de 5 segundos con audio cuesta 5 × 2,000 × 1,5 = 15,000 créditos.
Sí, los videos generados a través del generador Kling 3.0 de LongCat Video pueden usarse con fines comerciales. Sin embargo, asegúrate de que tu contenido de entrada (imágenes, prompts) no infrinja derechos de autor y que el contenido generado cumpla con las leyes y regulaciones aplicables.
Usa LongCat Video para convertir prompts o imágenes en historias 720p 30 fps de varios minutos sin deriva.