Warum Regie über die Qualität von KI-Videos entscheidet
Generative Videomodelle liefern heute erstaunlich saubere Einzelbilder: weiches Licht, plausible Hauttöne, glaubwürdige Bewegungsabläufe. Trotzdem wirken viele damit erzeugte Clips beliebig. Der Grund ist selten die Technik. Es fehlt die Regie – jene Instanz, die entscheidet, was das Publikum wann sehen soll, welches Bild welche Information trägt und welche Einstellung nur dekorativ ist.
Der Unterschied zwischen Generieren und Inszenieren wird an einer einfachen Beobachtung sichtbar: Ein Clip kann technisch fehlerfrei sein und trotzdem nichts erzählen. Wenn eine Figur drei Sekunden lang schön im Gegenlicht steht, aber nichts will, nichts fürchtet und nichts verliert, ist das kein Film, sondern eine Postkarte. Regie bedeutet, jeder Einstellung eine Aufgabe zu geben und diese Aufgabe überprüfbar zu machen.
Ein Regieassistent – ob als Funktion in einem Produktionswerkzeug oder als Denkweise, die du selbst einhältst – übernimmt drei Aufgaben: Auswahl, Verdichtung und Blickführung. Auswahl bedeutet, aus zwanzig möglichen Einstellungen die vier zu wählen, die eine Szene tatsächlich tragen. Verdichtung heißt, Handlung in Bilder zu übersetzen statt in Erklärungen. Blickführung ist die Frage, wohin das Auge im Frame zuerst wandert und welche Bewegung es zur nächsten Einstellung weiterleitet.
Die typischen Symptome fehlender Regie sind schnell erkannt: schöne, aber zusammenhanglose Bilder; Figuren, die posieren statt zu handeln; Kameras, die ohne Motivation kreisen; Szenen, die nach zehn Sekunden keine offene Frage mehr besitzen; Schnitte, die addieren statt zu steigern. Wer diese Muster kennt, kann sie gezielt beheben. Genau dafür lohnt sich ein strukturierter Regie-Workflow, der Storytelling-Analyse, Shot-Planung und Konsistenzkontrolle als feste Arbeitsschritte behandelt.
Zwei kurze Selbsttests helfen vor jedem Projekt. Erstens der Ein-Satz-Test: Kannst du für das gesamte Video in einem Satz sagen, wer was will und was sich am Ende verändert hat? Zweitens der Stumm-Test: Verstehst du die Handlung, wenn du die Tonspur entfernst? Wer beide Tests besteht, hat bereits mehr Regie geführt als die meisten Creator, die ausschließlich mit Prompts arbeiten.
Die drei Ebenen der Regiearbeit: Story, Bild, Kontinuität
Regiearbeit lässt sich in drei Ebenen zerlegen, die unterschiedlich stark automatisiert werden können. Wer sie getrennt betrachtet, versteht, wo ein KI-Assistent wirklich hilft – und wo menschliche Entscheidungen unersetzlich bleiben.
Storytelling-Ebene: Was passiert und warum
Auf dieser Ebene geht es um Figur, Ziel, Hindernis und Veränderung. Ein hilfreicher Test für jede Szene: Wer will was, was steht dem im Weg, und was ist danach anders? Wenn du diese drei Fragen nicht in einem Satz beantworten kannst, fehlt der Szene die dramatische Funktion. KI-Assistenz kann hier beim Strukturieren helfen, indem sie Beats markiert, Spannungsverläufe sichtbar macht oder alternative Auflösungen vorschlägt. Die Entscheidung, welche Variante zur Marke und zur Zielgruppe passt, bleibt bei dir.
Shot-Design-Ebene: Wie die Geschichte aussieht
Shot-Design übersetzt Handlung in Kamerasprache. Es legt fest, ob eine Figur in der Totalen verletzlich oder in der Nahaufnahme bedrohlich wirkt, ob die Kamera dem Protagonisten folgt oder ihn beobachtet. Hier profitieren KI-Workflows am stärksten von Struktur: Wer Einstellungsgrößen, Perspektiven und Bewegungen in einer Shot-List definiert, bekommt reproduzierbare Ergebnisse statt Zufallstreffer.
Kontinuitäts-Ebene: Warum alles zusammenpasst
Kontinuität umfasst Figur, Kleidung, Requisiten, Lichtstimmung, Wetter, Tageszeit und Bewegungsrichtung. Ein einzelner Clip kann brillant sein und trotzdem unbrauchbar, wenn die Figur im nächsten Shot ein anderes Gesicht hat oder die Sonne plötzlich von links kommt. Diese Ebene ist technisch am anspruchsvollsten und der häufigste Grund, warum KI-Sequenzen amateurhaft wirken.
Wichtig ist die Reihenfolge: Story zuerst, Bild danach, Kontinuität zuletzt als Prüfschritt. Wer mit dem Bild beginnt, produziert hübsche Fragmente. Wer mit der Story beginnt, produziert eine Sequenz, die auch dann noch funktioniert, wenn einzelne Einstellungen nachjustiert werden müssen.
Storytelling-Struktur für Kurzformate
Kurzformate verzeihen keine langen Anläufe. Die folgenden vier Bausteine funktionieren für Werbespots, Social-Clips, Trailer und erklärende Videos gleichermaßen.
Der Hook: die erste Sekunde entscheidet
Ein Hook ist keine Sensation, sondern eine offene Frage. Eine Hand, die einen Gegenstand versteckt. Ein Blick in die Kamera. Ein Satz, der mitten im Geschehen beginnt. Für KI-Produktionen eignen sich visuelle Hooks besser als dialoglastige, weil Modelle Mimik und kleine Gesten inzwischen zuverlässig rendern, komplexe Lippenbewegungen dagegen nur mit zusätzlichem Aufwand.
Ein praktikabler Hook-Test: Beschreibe den ersten Frame in fünf Wörtern. Wenn dabei nichts Ungewöhnliches, nichts Fragiles oder nichts Widersprüchliches herauskommt – „Frau lächelt in Kamera“ –, ist der Hook zu schwach.
Die Eskalation: Hindernisse statt Wiederholung
Nach dem Hook muss sich etwas verändern. Drei Varianten desselben Bildes sind keine Steigerung, sondern Stillstand. Baue stattdessen eine Kette: erst ein kleines Problem, dann ein größeres, dann eines, das die Figur zu einer Entscheidung zwingt. Jede Einstellung sollte eine Information hinzufügen – ein Detail, eine Reaktion, eine Verschiebung der Machtverhältnisse.
Ein Beispiel für ein 30-Sekunden-Produktvideo mit vier Beats:
- Beat 1 (0–4 s): Hände öffnen eine Schublade, darin liegt ein abgenutztes Werkzeug. Offene Frage: Warum ist es abgenutzt?
- Beat 2 (4–12 s): Die Figur arbeitet, das Werkzeug versagt, ein kurzer Moment des Innehaltens.
- Beat 3 (12–22 s): Ein Wechsel des Werkzeugs, eine ruhigere, präzisere Bewegung – die Erwartung kippt.
- Beat 4 (22–30 s): Das Ergebnis in einer ruhigen Detailaufnahme, danach ein leerer Raum mit Spuren der Arbeit.
Dieses Gerüst ist bewusst karg. Es lässt sich in jedes Genre übertragen, weil es nur auf Zustandsänderungen setzt.
Der Wendepunkt: die Erwartung brechen
Der Wendepunkt ist der Moment, in dem das Publikum merkt, dass es die Situation falsch eingeschätzt hat. Das kann ein Perspektivwechsel sein, ein enthülltes Detail im Hintergrund oder eine Figur, die plötzlich anders handelt als erwartet. In KI-Videos funktioniert das besonders gut über Bildinhalte, weil die Auflösung eines Details stärker wirkt als jede Erklärung.
Der Payoff: eine Antwort und ein Nachhall
Ein guter Schluss beantwortet die Ausgangsfrage und lässt eine zweite, kleinere Frage offen. Das erzeugt Kommentare, Wiedersichten und Weiterleitungen. Praktisch heißt das: Der letzte Shot ist oft eine ruhige Einstellung – ein Nachatmen, ein Blick, ein leeres Bild mit Spuren der Handlung. Rechne für den Abschluss mindestens zwei Sekunden ruhige Bildzeit ein; ein harter Schnitt auf den Markennamen verschenkt die Wirkung des Payoffs.
Shot-Design: Bildsprache, die KI-Modelle zuverlässig umsetzen
Shot-Design ist Handwerk mit klaren Parametern. Je präziser du sie benennst, desto weniger überlässt du dem Zufall – und desto besser versteht ein Modell deine Absicht.
Einstellungsgrößen und Perspektive
Arbeite mit einer festen Skala: Weit, Halbtotal, Halbnah, Nah, Detail. Ergänze die Perspektive – auf Augenhöhe, von unten, von oben, über die Schulter. Diese Kombination bestimmt die emotionale Wirkung stärker als jedes Stilwort. Eine Figur, die von oben gefilmt wird, wirkt kleiner; dieselbe Figur in Untersicht wirkt dominant. Wer diese Wirkung bewusst einsetzt, braucht keine Effekte.
Ein weiterer Hebel ist die Achse. Wenn zwei Figuren miteinander sprechen, verläuft zwischen ihnen eine gedachte Linie. Bleib auf einer Seite dieser Linie, solange der Raum nicht neu etabliert wird. Achssprünge sind der häufigste Grund, warum eine an sich saubere Sequenz im Schnitt verwirrend wirkt.
Kamerabewegung mit Motiv
Bewegung muss begründet sein. Ein Schwenk folgt einer Handlung, ein Push-in steigert die Intensität, ein Dolly-out distanziert. Vermeide Bewegungen, die nur „dynamisch“ aussehen sollen. Für KI-Generierung gilt: langsame, gleichmäßige Bewegungen sind stabiler als schnelle, komplexe Fahrten. Wenn du eine komplizierte Bewegung brauchst, zerlege sie in zwei Einstellungen.
Merksatz: Eine Einstellung, eine Bewegung. Zwei Bewegungen in einem Clip – Kamera fährt und Figur dreht sich gleichzeitig – erhöhen die Wahrscheinlichkeit von Artefakten deutlich.
Licht, Farbe und Zeitgefühl
Licht ist Stimmung. Hartes Seitenlicht erzeugt Konflikt, weiches Gegenlicht Wärme, kühles Streiflicht Distanz. Beschreibe Licht nicht als Stil, sondern als Situation: „Nachmittagssonne durch ein Fenster, Staub in der Luft, warme Reflexe auf Metall“. Ergänze Tageszeit und Wetter, weil sie Kontinuität über mehrere Einstellungen sichern.
Komposition und Blickführung
Nutze Grundregeln, die auch in der klassischen Fotografie gelten: Drittelteilung, führende Linien, Vordergrund-Mittelgrund-Hintergrund. Achte darauf, dass pro Frame nur ein Hauptelement die Aufmerksamkeit zieht. Zwei konkurrierende Blickpunkte zerstören die Wirkung einer Einstellung schneller als schlechtes Licht.
Ein nützliches Werkzeug ist die Brennweite als Stimmungsregler: 24 bis 28 mm wirken räumlich und unmittelbar, 35 bis 50 mm neutral und dokumentarisch, 85 mm und mehr verdichten und isolieren. Wenn du dieselbe Figur in einer Szene mit zwei verschiedenen Brennweiten zeigst, wirkt das schnell wie ein Stilbruch.
Der Workflow vom Treatment zur fertigen Sequenz
Ein wiederholbarer Ablauf spart mehr Zeit als jeder einzelne Optimierungstrick. Die folgenden Schritte funktionieren für Solo-Creator genauso wie für kleine Teams.
Schritt 1: Treatment in einem Absatz
Schreibe die Geschichte als einen einzigen Absatz: Figur, Ziel, Hindernis, Wendung, Ende. Dieser Absatz ist deine Referenz. Wenn eine spätere Einstellung nichts zu diesem Absatz beiträgt, gehört sie nicht in die Sequenz.
Schritt 2: Beat-Sheet und Shot-List
Teile den Absatz in vier bis acht Beats. Ordne jedem Beat eine Einstellung zu und beschreibe sie in fünf Kategorien: Größe, Perspektive, Bewegung, Licht, Handlung im Bild. Diese Tabelle ist der wichtigste Teil der Vorbereitung, weil sie die Generierung deterministisch macht.
Schritt 3: Prompt-Bau pro Einstellung
Baue Prompts aus wiederverwendbaren Modulen: Motiv, Handlung, Umgebung, Licht, Objektiv, Bewegung, Stimmung. Halte die Reihenfolge konstant. Nur so kannst du später nachvollziehen, welche Änderung welche Wirkung hatte.
Schritt 4: Generieren, bewerten, verwerfen
Erzeuge pro Einstellung mehrere Varianten und bewerte sie nach drei Kriterien: Trägt das Bild die Handlung? Passt es zur Nachbareinstellung? Ist die Bewegung sauber? Wer nach Sympathie auswählt, verliert Zeit. Wer nach Kriterien auswählt, kommt schneller zum Ergebnis.
Schritt 5: Schnitt und Ton
Der Schnitt entscheidet über Rhythmus. Halte Einstellungen so lange, wie sie Information liefern, und nicht länger. Musik, Atmosphäre und ein präziser Soundeffekt am Wendepunkt erhöhen die wahrgenommene Qualität stärker als ein zusätzlicher Generierungsversuch.
Eine realistische Zeitaufteilung für einen 30-Sekunden-Clip ohne vorherige Übung: rund 20 Prozent Treatment und Beat-Sheet, 20 Prozent Shot-List und Prompts, 40 Prozent Generieren und Bewerten, 20 Prozent Schnitt und Ton. Wenn die Generierung deutlich mehr als die Hälfte der Zeit frisst, ist meist die Vorbereitung zu dünn.
Prompt-Bau mit Modulen und fester Reihenfolge
Ein guter Regie-Prompt ist kein Gedicht, sondern ein Bauplan. Bewährt hat sich folgende Reihenfolge:
- Subjekt und Handlung: Wer tut was, mit welcher Absicht?
- Einstellungsgröße und Perspektive: Halbnah, auf Augenhöhe, leicht von links.
- Objektiv und Tiefe: 35 mm, flache Tiefenschärfe, Hintergrund weich.
- Licht und Tageszeit: Bewölktes Morgenlicht, kühl, weiche Schatten.
- Umgebung und Requisiten: Was ist im Bild, was ist bewusst nicht im Bild?
- Bewegung: Kamera ruhig, Figur dreht sich langsam nach rechts.
- Stimmung und Genre: zurückhaltend, dokumentarisch, ohne Pathos.
Ein ausformuliertes Beispiel für Einstellung 3 eines Produktvideos:
„Eine Hand legt ein Werkzeug auf eine Werkbank, halbnah, auf Augenhöhe, leicht von links; 35 mm, flache Tiefenschärfe; Nachmittagslicht durch ein hohes Fenster, warme Reflexe auf Metall; Werkstatt mit Hobelspänen, kein zweites Werkzeug im Bild; Kamera ruhig, Hand bleibt am Ende der Bewegung stehen; ruhig, dokumentarisch, ohne Pathos.“
Für Konsistenz hilft es, die ersten fünf Module über eine ganze Szene hinweg unverändert zu lassen und nur Handlung und Bewegung zu variieren. Notiere die Module in einer Textdatei oder Tabelle – das ist dein Drehbuch für die Generierung.
Negative Angaben gehören ebenfalls in den Prompt, aber sparsam. Drei bis fünf Ausschlüsse sind wirksam, zwanzig machen den Prompt unlesbar. Typische Ausschlüsse: keine zusätzlichen Personen, keine Texteinblendungen, kein Kamerawackeln, keine schnellen Zooms.
Konsistenz sichern und typische Fehler vermeiden
Konsistenz entsteht nicht durch Glück, sondern durch Referenzen. Nutze ein festes Referenzbild für Figur und Kostüm, ein zweites für den Ort und ein drittes für die Lichtstimmung. Wo Bild-zu-Video oder Keyframe-Steuerung verfügbar ist, starte jede Einstellung mit einem kontrollierten Ausgangsbild statt mit reinem Text.
Weitere bewährte Maßnahmen: Begrenze die Anzahl der Figuren pro Einstellung. Vermeide schnelle Richtungswechsel im Bild, weil Modelle Bewegungsachsen schlecht halten. Plane Übergänge bewusst – ein Schnitt auf eine ähnliche Komposition wirkt ruhig, ein Kontrastschnitt wirkt energisch. Und kontrolliere am Ende jede Einstellung stumm: Wenn die Sequenz ohne Ton verständlich bleibt, ist die visuelle Erzählung gelungen.
Die häufigsten Fehler und ihre Gegenmittel:
| Fehler | Symptom | Gegenmittel |
|---|---|---|
| Zu viele Ideen pro Einstellung | Bild wirkt überladen, Fokus unklar | Ein Bild, eine Information |
| Stilwörter statt Beschreibung | Ergebnisse springen zwischen Looks | Konkrete Situationen statt Adjektive |
| Fehlende Bewegungsmotivation | Kamera driftet ohne Grund | Bewegung an eine Handlung koppeln |
| Ignorierte Achse | Figuren wechseln die Seite | Blickrichtung festlegen und halten |
| Kein Tonkonzept | Gute Bilder wirken flach | Atmosphäre parallel zur Shot-List planen |
| Zu späte Auswahl | Überblick über Kontinuität geht verloren | Pro Einstellung entscheiden, bevor weiter generiert wird |
| Zu lange Einstellungen | Sequenz wirkt zäh | Einstellung endet, wenn die Information durch ist |
Ein letzter, oft unterschätzter Fehler: zu viele Figuren gleichzeitig. Jede zusätzliche Person erhöht die Zahl der möglichen Konsistenzfehler überproportional. Für kurze Formate gilt: eine Hauptfigur, höchstens eine Nebenfigur, alle weiteren nur als Silhouette oder angeschnitten im Bild.
Werkzeugklassen und Entscheidungskriterien
Es gibt nicht das eine richtige Werkzeug, sondern Rollen im Workflow. Sinnvoll ist eine Aufteilung entlang dieser Klassen:
| Werkzeugklasse | Aufgabe im Workflow | Worauf du achten solltest |
|---|---|---|
| Text-zu-Video | Rohmaterial für einzelne Einstellungen | Bewegungstreue, Länge pro Clip |
| Bild-zu-Video | Kontrolle über Ausgangsbild und Figur | Referenztreue, Stabilität |
| Keyframe-Steuerung | Übergänge und präzise Choreografie | Genauigkeit der Start- und Endbilder |
| Storyboard-Planung | Struktur, Beats, Shot-List | Übersichtlichkeit, Exportierbarkeit |
| Schnitt und Ton | Rhythmus und Wirkung | Zeitleiste, Audio-Workflow |
Prüfe bei der Auswahl drei Dinge: Wie gut hält das Werkzeug eine Figur über mehrere Einstellungen? Wie transparent sind die Einstellungen für Bewegung und Licht? Und wie einfach lässt sich die Shot-List in die Generierung übertragen? Wer diese drei Fragen beantwortet, trifft die Entscheidung schneller als mit jeder Feature-Liste.
Ergänzend lohnt ein Blick auf die Arbeitsweise des Werkzeugs: Manche Systeme erwarten kurze Prompts und interpretieren viel Spielraum, andere belohnen lange, exakt strukturierte Beschreibungen. Teste das mit derselben Einstellung in beiden Stilen. Wenn ein Modell auf dein Modulschema schlechter reagiert, passe das Schema an – nicht die Story.
Praxisbeispiel: ein 40-Sekunden-Clip von der Idee zum Schnitt
Angenommen, du bewirbst einen Fahrradhelm. Das Treatment in einem Absatz: Eine Radfahrerin fährt morgens zur Arbeit, ein beinahe übersehener Lieferwagen zwingt sie zum Ausweichen, sie hält kurz inne und fährt ruhig weiter – geschützt, aber nicht dramatisiert.
Die Beats daraus: (1) Morgenlicht auf einer leeren Straße, Radfahrerin von hinten. (2) Blick über die Schulter, Verkehr dichter werdend. (3) Der Lieferwagen taucht im Bildhintergrund auf, ein Detail: Bremslichter. (4) Ausweichbewegung, halbnah, kurze Zeitlupe. (5) Sie atmet aus, Schultern sinken. (6) Detail: Helm bleibt ruhig, Haar bewegt sich nicht. (7) Ruhige Totale, Straße mit den Spuren der Bremsung, sie fährt weiter.
Für Beat 3 und 4 brauchst du eine identische Lichtsituation, sonst bricht die Illusion eines durchgehenden Moments. Deshalb definierst du für die gesamte Szene ein Modul: „früher Morgen, bewölkt mit warmem Streiflicht, 35 mm, entsättigte Grüntöne“. Dieses Modul bleibt unverändert; nur Handlung, Einstellungsgröße und Bewegung variieren.
Jetzt folgt die Generierung in drei Runden. Runde eins: je drei Varianten der Einstellungen, keine Auswahl treffen, nur grob sortieren. Runde zwei: eine Variante pro Einstellung auswählen und in der richtigen Reihenfolge hintereinanderlegen, ohne Ton. Hier fällt auf, ob der Schnittrhythmus stimmt. Runde drei: Korrektur einzelner Einstellungen, die im Kontext nicht funktionieren – meistens sind das Einstellungen, die isoliert gut aussehen und im Fluss zu viel Raum einnehmen.
Im Schnitt gilt: Beat 4 darf kurz sein, zwei Sekunden genügen, weil die Bewegung selbst Information trägt. Beat 5 braucht dagegen Zeit, weil eine Reaktion ohne Dauer nicht lesbar ist. Der Ton wird in zwei Schichten angelegt – eine ruhige Atmosphäre über die ganze Sequenz und ein einzelner Akzent im Moment der Bremslichter.
Am Ende steht die Regie-Prüfung: Trägt jede Einstellung eine Information? Bleibt Licht und Blickrichtung konstant? Motiviert sich jede Bewegung selbst? Bleibt die Sequenz stumm verständlich? Und endet sie mit einem Bild, das im Gedächtnis bleibt?
FAQ: Fragen aus der Praxis
Brauche ich Filmerfahrung, um mit KI-Video zu arbeiten?
Nein, aber Grundlagen aus Bildgestaltung und Schnitt verkürzen die Lernkurve erheblich. Wer weiß, was eine Halbnahaufnahme bewirkt, trifft bessere Entscheidungen als jemand, der nur Prompts kopiert.
Wie viele Einstellungen braucht ein 60-Sekunden-Video?
Faustregel: acht bis fünfzehn. Zu wenige Einstellungen langweilen, zu viele erzeugen Hektik. Beginne mit einer Einstellung pro Beat und kürze anschließend im Schnitt.
Was ist wichtiger: Story oder Bildqualität?
Die Story. Ein technisch mittelmäßiger Clip mit klarer Handlung wird zu Ende geschaut, ein perfektes Bild ohne Inhalt nicht. Die Reihenfolge im Workflow ist deshalb immer Story, dann Bild, dann Technik.
Wie halte ich Figuren über mehrere Clips konsistent?
Arbeite mit Referenzbildern, festen Beschreibungen in Modulen und möglichst kurzen Einstellungen. Vermeide Nahaufnahmen mit stark verändertem Winkel, wenn die Figur noch nicht stabil ist. Wenn eine Figur über mehrere Szenen auftritt, definiere ein Merkmal, das in jeder Beschreibung wiederholt wird – eine Haarfarbe, ein Kleidungsstück, eine Brille.
Sollte ich Dialoge im Bild generieren?
Nur wenn die Sprachausgabe präzise kontrolliert werden kann. Sonst ist es sauberer, Dialoge als Voice-over oder als Text zu inszenieren und die Bildsprache erzählen zu lassen.
Wie gehe ich mit unbrauchbaren Varianten um?
Sofort löschen und die Ursache im Prompt benennen. Wer nur nach Gefühl neu generiert, wiederholt denselben Fehler mit anderen Bildern. Führe ein kurzes Fehlerprotokoll: Einstellung, Problem, geänderte Module.
Eignet sich der Workflow auch für längere Formate?
Ja, wenn du in Sequenzen denkst. Behandle jede Sequenz wie ein Kurzformat mit eigenem Hook, eigener Steigerung und eigenem Abschluss, und verknüpfe die Sequenzen über Figuren, Orte und Lichtstimmung. Zwei bis drei bewusst gesetzte Motiv-Wiederholungen halten längere Videos zusammen – ein Ort, ein Objekt, eine Farbe.
Wie schnell sollte ich eine Einstellung verwerfen?
Wenn nach drei Bewertungsdurchgängen weder Handlung noch Anschlussfähigkeit stimmen, ist meist der Prompt falsch, nicht die Zufallsvarianz. Ändere dann ein Modul – am wirksamsten Einstellungsgröße oder Licht – und generiere erneut.
Was mache ich, wenn der Stil zwischen Einstellungen kippt?
Reduziere den Prompt auf die stabilen Module, entferne alle Stiladjektive und beschreibe stattdessen die konkrete Lichtsituation. Prüfe außerdem, ob Brennweite und Tageszeit über alle Einstellungen identisch benannt sind.
Abschlusscheckliste vor dem Rendern
Ist die Ausgangsfrage des Videos klar? Trägt jede Einstellung eine Information? Bleiben Figur, Licht und Blickrichtung konstant? Motiviert jede Kamerabewegung sich selbst? Funktioniert die Sequenz stumm? Endet sie mit einem Bild, das man behält? Wer diese Fragen mit Ja beantworten kann, hat nicht nur schöne Clips produziert, sondern Regie geführt – mit oder ohne KI-Assistenz.

