Créez des vidéos cinématographiques époustouflantes avec Kling 3.0 — le modèle vidéo IA le plus avancé avec audio natif, cohérence des personnages, montage Multi-Shot et clonage vocal personnalisé.
Tout ce que vous devez savoir sur la génération vidéo IA Kling 3.0 — fonctionnalités, tarifs et utilisation.
Kling 3.0 est le dernier modèle de génération vidéo IA de Kuaishou. Il propose la génération audio native, la cohérence des personnages via le binding Elements, le contrôle de scènes Multi-Shot, le clonage vocal personnalisé et une qualité visuelle considérablement améliorée avec des mouvements cinématographiques. Par rapport à Kling 2.0, il offre une résolution plus élevée, une durée plus longue (jusqu'à 15 secondes) et des fonctionnalités audio/vocales intégrées.
Kling 3.0 prend en charge des durées vidéo de 3 à 15 secondes. Les formats d'image disponibles sont 16:9 (paysage), 9:16 (portrait) et 1:1 (carré). Vous pouvez également utiliser le mode Multi-Shot pour créer des scènes complexes avec plusieurs plans totalisant jusqu'à 15 secondes.
Elements vous permet de maintenir la cohérence des personnages dans votre vidéo. Vous pouvez télécharger une image frontale et des images de référence d'un personnage, ou fournir un court clip vidéo. Référencez les personnages dans votre prompt avec @Element1, @Element2, etc. Cela garantit que le même personnage apparaît de manière cohérente tout au long de la vidéo générée.
Le mode Multi-Shot vous permet de diviser votre vidéo en plusieurs scènes, chacune avec son propre prompt et sa propre durée. Cela vous donne un contrôle précis sur le flux narratif. Chaque plan peut avoir une description différente tout en maintenant la continuité visuelle. La durée totale de tous les plans ne peut pas dépasser 15 secondes.
Vous pouvez télécharger un fichier audio (5-30 secondes, mp3/wav) ou une vidéo avec une parole claire pour créer un ID vocal personnalisé. Référencez-le ensuite dans votre prompt avec '<<<voice_1>>>' ou '<<<voice_2>>>' (max 2 voix par génération). L'IA générera une vidéo avec des dialogues correspondant aux voix clonées. La génération audio doit être activée pour que les ID vocaux prennent effet.
La qualité Standard offre une génération rapide à 1 000 crédits par seconde. La qualité Pro offre une fidélité visuelle supérieure, des mouvements plus fluides et un rendu plus détaillé à 2 000 crédits par seconde (2× Standard). L'activation de l'audio ajoute un multiplicateur de 1,5× aux deux niveaux.
Les crédits sont calculés ainsi : Durée (secondes) × Tarif de Base × Multiplicateur Audio. Le tarif de base Standard est de 1 000 crédits/seconde, Pro de 2 000 crédits/seconde. La génération audio ajoute un multiplicateur de 1,5×. Par exemple, une vidéo Pro de 5 secondes avec audio coûte 5 × 2 000 × 1,5 = 15 000 crédits.
Oui, les vidéos générées via le générateur Kling 3.0 de LongCat Video peuvent être utilisées à des fins commerciales. Cependant, veuillez vous assurer que vos contenus d'entrée (images, prompts) ne portent pas atteinte aux droits d'auteur et que les contenus générés sont conformes aux lois et réglementations applicables.
Utilisez LongCat Video pour transformer un prompt ou une image en histoires 720p 30 fps de plusieurs minutes, sans dérive.