🎉 Kling 3 Launch-Feier 50 % Rabatt Voller Zugang zu allen Kling-3-Funktionen mit unseren Jahresplänen.
10:00:00cs

Kling 3.0 KI-Videogenerator

Erstellen Sie atemberaubende filmreife Videos mit Kling 3.0 — dem fortschrittlichsten KI-Videomodell mit nativer Audiogenerierung, Charakterkonsistenz, Multi-Shot-Bearbeitung und benutzerdefiniertem Voice Cloning.

Kling 3.0 Videogenerator

Häufig gestellte Fragen zu Kling 3.0

Alles, was Sie über die Kling 3.0 KI-Videogenerierung wissen müssen — Funktionen, Preise und Nutzung.

Kling 3.0 ist das neueste KI-Videogenerierungsmodell von Kuaishou. Es bietet native Audiogenerierung, Charakterkonsistenz durch Elements-Bindung, Multi-Shot-Szenensteuerung, benutzerdefiniertes Voice Cloning und erheblich verbesserte visuelle Qualität mit filmreifer Bewegung. Im Vergleich zu Kling 2.0 bietet es höhere Auflösung, längere Dauer (bis zu 15 Sekunden) und integrierte Audio-/Sprachfunktionen.


Kling 3.0 unterstützt Videodauern von 3 bis 15 Sekunden. Verfügbare Seitenverhältnisse sind 16:9 (Querformat), 9:16 (Hochformat) und 1:1 (Quadrat). Sie können auch den Multi-Shot-Modus verwenden, um komplexe Szenen mit mehreren Aufnahmen von insgesamt bis zu 15 Sekunden zu erstellen.


Elements ermöglicht es Ihnen, die Charakterkonsistenz in Ihrem Video beizubehalten. Sie können ein Frontalbild und Referenzbilder eines Charakters hochladen oder einen kurzen Videoclip bereitstellen. Referenzieren Sie Charaktere in Ihrem Prompt mit @Element1, @Element2 usw. Dies stellt sicher, dass derselbe Charakter durchgehend im generierten Video konsistent erscheint.


Der Multi-Shot-Modus ermöglicht es Ihnen, Ihr Video in mehrere Szenen aufzuteilen, jede mit eigenem Prompt und eigener Dauer. Dies gibt Ihnen präzise Kontrolle über den Erzählfluss. Jede Aufnahme kann eine andere Beschreibung haben, während die visuelle Kontinuität erhalten bleibt. Die Gesamtdauer aller Aufnahmen darf 15 Sekunden nicht überschreiten.


Sie können eine Audiodatei (5–30 Sekunden, mp3/wav) oder ein Video mit deutlicher Sprache hochladen, um eine benutzerdefinierte Stimmen-ID zu erstellen. Referenzieren Sie diese dann in Ihrem Prompt mit '<<<voice_1>>>' oder '<<<voice_2>>>' (max. 2 Stimmen pro Generierung). Die KI generiert ein Video mit Dialogen, die den geklonten Stimmen entsprechen. Die Audiogenerierung muss aktiviert sein, damit die Stimmen-IDs wirksam werden.


Standard-Qualität bietet schnelle Generierung bei 1.000 Credits pro Sekunde. Pro-Qualität bietet überlegene visuelle Wiedergabetreue, flüssigere Bewegungen und detaillierteres Rendering bei 2.000 Credits pro Sekunde (2× Standard). Die Aktivierung von Audio fügt beiden Stufen einen 1,5×-Multiplikator hinzu.


Credits werden wie folgt berechnet: Dauer (Sekunden) × Grundtarif × Audio-Multiplikator. Der Standard-Grundtarif beträgt 1.000 Credits/Sekunde, Pro 2.000 Credits/Sekunde. Die Audiogenerierung fügt einen 1,5×-Multiplikator hinzu. Beispiel: Ein 5-Sekunden-Pro-Video mit Audio kostet 5 × 2.000 × 1,5 = 15.000 Credits.


Ja, über den Kling 3.0 Generator von LongCat Video erstellte Videos können für kommerzielle Zwecke verwendet werden. Stellen Sie jedoch bitte sicher, dass Ihre Eingabeinhalte (Bilder, Prompts) keine Urheberrechte verletzen und die generierten Inhalte den geltenden Gesetzen und Vorschriften entsprechen.


Bereit für lange Clips mit LongCat Video?

Mit LongCat Video wandeln Sie Prompts oder Bilder in 720p-30fps-Stories von mehreren Minuten ohne Drift um.