KI-Videos mit Ton erstellen: Anleitung

Beschreibe für KI-Videos mit Ton Bild und Klang gemeinsam und prüfe die Audiounterstützung des gewählten Modells.

Arbeitsweisen

Wähle den passenden Audioablauf

Unterscheide neue Klänge, vorhandene Aufnahmen und die Vertonung fertiger Videos.

Video mit generiertem Ton
Text oder Referenzbild
Eine neue Szene mit Atmosphäre, Geräuschen oder Sprache erstellen.
Ton zu Video hinzufügen
Fertiges Video und Audiospur
Sprache, Musik und Effekte in einem Schnittprogramm platzieren und mischen, wenn die genaue Tonspur zählt.
Audio zu Video / Audioreferenz
Vorhandene Audiodatei
Bilder mit einem passenden Audiomodell steuern. Dieser Ablauf verspricht keine identische Wiedergabe des Tons.
Audioprompt

Schreibe einen Prompt, den man hören kann

Formel: Szene + Handlung + Kamera + Atmosphäre + Hauptgeräusch + optionaler kurzer Dialog + Ausschlüsse.

Bild und Ton getrennt beschreiben

Beschreibe erst die Aufnahme, dann die Klangquelle: leiser Regen auf Glas, ein Tassenklirren, keine Musik.

Den Satz aussprechen lassen

Nutze eine Person und einen kurzen Satz. Nenne Sprache und Tonfall und vermeide überlappende Stimmen.

Die Geräuschursache nennen

Das Glas klirrt beim Absetzen auf der Theke ist konkreter als ein allgemeiner Wunsch nach filmischem Sound.

Stille der Reihe nach prüfen

Hebe die Stummschaltung auf, prüfe die Lautstärke und höre den Download an. Bleibt er stumm, kontrolliere die Audiounterstützung und verfügbare Toneinstellungen vor dem nächsten Versuch.

Konkurrierende Klänge reduzieren

Bitte um klare Sprache im Vordergrund, leise Atmosphäre und keine Musik. Ändere jeweils eine Ebene.

Synchronität überprüfen

Höre zu und beobachte die Handlung. Vereinfache die Aktion oder kürze den Satz bei Versatz. Exakte Korrekturen gehören ins Schnittprogramm.

Workflow

Vier Schritte für Bild und Ton

Speichere deine Prompts, um Änderungen einzeln vergleichen zu können.

Schritt 01

Eingabe wählen

Öffne KI-Video mit Ton. Beginne mit Text für eine neue Komposition oder einem Referenzbild für einen bestehenden Aufbau.

Schritt 02

Einstellungen prüfen

Prüfe aktuelle Dauer, Ausgabeoptionen und Kosten. Aktiviere Ton, falls ein Schalter vorhanden ist; kontrolliere Audio nach einem Modellwechsel erneut.

Schritt 03

Beschreiben und generieren

Ergänze Handlung, Kamera und Klang. Passe eine Vorlage unten an und fahre im Generator fort.

Schritt 04

Ansehen und erneut anhören

Prüfe Handlung, Worte, Geräusche und Ende. Behebe das Hauptproblem, bevor du eine längere Sequenz planst.

Kopierbare Prompts

Vier Prompts für KI-Videos mit Ton

Passe diese Prompts an deine Szene an und stimme die Dauer auf Handlung und Dialog ab.

Regnerisches Café

Feste Nahaufnahme einer dampfenden Tasse am regennassen Caféfenster. Warme Pendelleuchte, kühler Abend draußen. Audio: sanfter Regen auf Glas, ruhiger Raumklang, ein leises Klirren der Tasse auf dem Unterteller. Keine Sprache, keine Musik.

Achte auf einen ruhigen Hintergrund und ein einzelnes Tassenklirren.

Eine Person, ein Satz

Halbnahe Aufnahme einer erwachsenen Kaffeekiosk-Betreiberin an einem ruhigen Hafen. Sie schaut in die Kamera, lächelt und sagt langsam auf Deutsch: ‚Dein Kaffee ist fertig.‘ Audio: klare Stimme und leise entfernte Wellen. Keine weiteren Stimmen oder Musik.

Prüfe den ganzen Satz und die Lippen; kürze bei einem gehetzten Ende.

Ein Produktgeräusch

Nahaufnahme von Sprudelwasser, das aus einer klaren Flasche ohne Marke in ein Glas auf einer Schiefertheke fließt. Weiches bernsteinfarbenes Seitenlicht, feste Kamera. Audio: klares Gießen, feines Sprudeln, ein leises Glasklicken am Ende. Keine Stimme oder Musik.

Vergleiche Gießen und Sprudeln mit der sichtbaren Aktion.

Ein Referenzbild animieren

Nutze das hochgeladene Bild als Startkomposition. Blätter bewegen sich leicht im Wind, die Kamera fährt langsam zum Gartentor. Audio: sanftes Blätterrascheln, ferne Vögel und leises Holzknarren beim Öffnen des Tors. Keine Sprache oder Musik.

Lade ein passendes Gartenbild hoch und halte die Bewegung einfach.

FAQ

Fragen zu KI-Videos mit Ton

Wie beginne ich nur mit Text?

Beschreibe Bild und Ton, prüfe die Audiounterstützung des Modells und aktiviere Ton, falls ein Schalter angeboten wird. Generiere und höre das vollständige Ergebnis vor der Überarbeitung an.

Was gehört in einen Audioprompt?

Atmosphäre, Hauptquelle, auslösendes Ereignis und gegebenenfalls ein kurzer Dialog. Ergänze hilfreiche Ausschlüsse wie keine Musik.

Wie erkenne ich eine stumme Datei?

Höre sowohl im Player als auch die heruntergeladene Datei mit hörbarer Lautstärke an. Wiedergabeeinstellungen und fehlender generierter Ton erfordern verschiedene Lösungen.

Wie verbessere ich das Timing?

Verbinde ein Geräusch mit einer klaren Handlung und vergleiche die Zeitpunkte. Weniger Ereignisse und kürzere Sätze erleichtern die Fehlerprüfung.

Was tun, wenn Musik die Sprache verdeckt?

Bitte um Sprache im Vordergrund, leisen Hintergrund und keine Musik. Für präzise Lautstärken nutze ein Schnittprogramm.

Ist das dasselbe wie Audio zu Video?

Nein. Hier entsteht Ton für eine neue Szene. Audio zu Video verwendet eine Aufnahme zur Bildsteuerung, abhängig von den unterstützten Eingaben.

Wie gehe ich mit langem Voiceover um?

Bereite einzelne Aufnahmen und eine Narrationsspur vor und montiere sie im Editor. Ein kurzer generierter Satz ist eine andere Aufgabe als eine kontrollierte lange Erzählung.

Teste eine Szene mit klaren Audioanweisungen

Beginne mit einer Klangquelle, höre das Ergebnis und verfeinere deinen Prompt.