KI-Videos mit Ton erstellen: Anleitung
Beschreibe für KI-Videos mit Ton Bild und Klang gemeinsam und prüfe die Audiounterstützung des gewählten Modells.
Wähle den passenden Audioablauf
Unterscheide neue Klänge, vorhandene Aufnahmen und die Vertonung fertiger Videos.
Schreibe einen Prompt, den man hören kann
Formel: Szene + Handlung + Kamera + Atmosphäre + Hauptgeräusch + optionaler kurzer Dialog + Ausschlüsse.
Bild und Ton getrennt beschreiben
Beschreibe erst die Aufnahme, dann die Klangquelle: leiser Regen auf Glas, ein Tassenklirren, keine Musik.
Den Satz aussprechen lassen
Nutze eine Person und einen kurzen Satz. Nenne Sprache und Tonfall und vermeide überlappende Stimmen.
Die Geräuschursache nennen
Das Glas klirrt beim Absetzen auf der Theke ist konkreter als ein allgemeiner Wunsch nach filmischem Sound.
Stille der Reihe nach prüfen
Hebe die Stummschaltung auf, prüfe die Lautstärke und höre den Download an. Bleibt er stumm, kontrolliere die Audiounterstützung und verfügbare Toneinstellungen vor dem nächsten Versuch.
Konkurrierende Klänge reduzieren
Bitte um klare Sprache im Vordergrund, leise Atmosphäre und keine Musik. Ändere jeweils eine Ebene.
Synchronität überprüfen
Höre zu und beobachte die Handlung. Vereinfache die Aktion oder kürze den Satz bei Versatz. Exakte Korrekturen gehören ins Schnittprogramm.
Vier Schritte für Bild und Ton
Speichere deine Prompts, um Änderungen einzeln vergleichen zu können.
Eingabe wählen
Öffne KI-Video mit Ton. Beginne mit Text für eine neue Komposition oder einem Referenzbild für einen bestehenden Aufbau.
Einstellungen prüfen
Prüfe aktuelle Dauer, Ausgabeoptionen und Kosten. Aktiviere Ton, falls ein Schalter vorhanden ist; kontrolliere Audio nach einem Modellwechsel erneut.
Beschreiben und generieren
Ergänze Handlung, Kamera und Klang. Passe eine Vorlage unten an und fahre im Generator fort.
Ansehen und erneut anhören
Prüfe Handlung, Worte, Geräusche und Ende. Behebe das Hauptproblem, bevor du eine längere Sequenz planst.
Vier Prompts für KI-Videos mit Ton
Passe diese Prompts an deine Szene an und stimme die Dauer auf Handlung und Dialog ab.
Regnerisches Café
Feste Nahaufnahme einer dampfenden Tasse am regennassen Caféfenster. Warme Pendelleuchte, kühler Abend draußen. Audio: sanfter Regen auf Glas, ruhiger Raumklang, ein leises Klirren der Tasse auf dem Unterteller. Keine Sprache, keine Musik.
Achte auf einen ruhigen Hintergrund und ein einzelnes Tassenklirren.
Eine Person, ein Satz
Halbnahe Aufnahme einer erwachsenen Kaffeekiosk-Betreiberin an einem ruhigen Hafen. Sie schaut in die Kamera, lächelt und sagt langsam auf Deutsch: ‚Dein Kaffee ist fertig.‘ Audio: klare Stimme und leise entfernte Wellen. Keine weiteren Stimmen oder Musik.
Prüfe den ganzen Satz und die Lippen; kürze bei einem gehetzten Ende.
Ein Produktgeräusch
Nahaufnahme von Sprudelwasser, das aus einer klaren Flasche ohne Marke in ein Glas auf einer Schiefertheke fließt. Weiches bernsteinfarbenes Seitenlicht, feste Kamera. Audio: klares Gießen, feines Sprudeln, ein leises Glasklicken am Ende. Keine Stimme oder Musik.
Vergleiche Gießen und Sprudeln mit der sichtbaren Aktion.
Ein Referenzbild animieren
Nutze das hochgeladene Bild als Startkomposition. Blätter bewegen sich leicht im Wind, die Kamera fährt langsam zum Gartentor. Audio: sanftes Blätterrascheln, ferne Vögel und leises Holzknarren beim Öffnen des Tors. Keine Sprache oder Musik.
Lade ein passendes Gartenbild hoch und halte die Bewegung einfach.
Den richtigen KI-Video-Ablauf wählen
Gehe zur Generierung, vergleiche einen einfacheren Modus oder entdecke verwandte Workflows.
KI-Videogenerator mit Ton
Erstelle Videos aus Text oder Bild mit Atmosphäre, Dialog und Geräuschen.
So wandeln Sie Text mit KI in Video um
Lernen Sie, Text mit KI in Video umzuwandeln: Prompt-Formel, Modell- und Formatauswahl, vier Schritte und praktische Beispiele.
Reference-to-Video-Generator
Bild, Video und Audio in einem multimodalen Ablauf hochladen.
Image to Video AI
Ein Bild animieren, wenn nur ein Referenzbild nötig ist.
KI-Modelle
Verfügbare Modelle prüfen.
Preise
Verfügbare Tarife ansehen.
Fragen zu KI-Videos mit Ton
Wie beginne ich nur mit Text?
Beschreibe Bild und Ton, prüfe die Audiounterstützung des Modells und aktiviere Ton, falls ein Schalter angeboten wird. Generiere und höre das vollständige Ergebnis vor der Überarbeitung an.
Was gehört in einen Audioprompt?
Atmosphäre, Hauptquelle, auslösendes Ereignis und gegebenenfalls ein kurzer Dialog. Ergänze hilfreiche Ausschlüsse wie keine Musik.
Wie erkenne ich eine stumme Datei?
Höre sowohl im Player als auch die heruntergeladene Datei mit hörbarer Lautstärke an. Wiedergabeeinstellungen und fehlender generierter Ton erfordern verschiedene Lösungen.
Wie verbessere ich das Timing?
Verbinde ein Geräusch mit einer klaren Handlung und vergleiche die Zeitpunkte. Weniger Ereignisse und kürzere Sätze erleichtern die Fehlerprüfung.
Was tun, wenn Musik die Sprache verdeckt?
Bitte um Sprache im Vordergrund, leisen Hintergrund und keine Musik. Für präzise Lautstärken nutze ein Schnittprogramm.
Ist das dasselbe wie Audio zu Video?
Nein. Hier entsteht Ton für eine neue Szene. Audio zu Video verwendet eine Aufnahme zur Bildsteuerung, abhängig von den unterstützten Eingaben.
Wie gehe ich mit langem Voiceover um?
Bereite einzelne Aufnahmen und eine Narrationsspur vor und montiere sie im Editor. Ein kurzer generierter Satz ist eine andere Aufgabe als eine kontrollierte lange Erzählung.
Teste eine Szene mit klaren Audioanweisungen
Beginne mit einer Klangquelle, höre das Ergebnis und verfeinere deinen Prompt.
