🎬 Story-Modus

Story-Modus-Anleitung

Vom leeren Blatt zum fertigen Video — ohne die App zu verlassen

🎬 Was ist der Story-Modus? v3.0.0

Der Story-Modus ist eine Pipeline, die aus einer Idee eine Szenentabelle mit Prompts, Stimmen und Soundeffekten macht — komplett innerhalb von AutoFlowCut. Sie geben einen Titel vor (oder ein Drehbuch, das Sie bereits geschrieben haben), und die Pipeline arbeitet sich durch Recherche, Exposé, Drehbuch, Szenentrennung, Audio und Prompts. Jeder Schritt reicht sein Ergebnis an den nächsten weiter.

✍️ Story-Modus, wenn …

… Sie ein Thema, einen Titel oder ein fertiges Drehbuch haben, aber noch keine Szenen, keine Prompts und keinen Ton. Der Story-Modus baut Ihnen all das.

📥 CSV-/SRT-Import, wenn …

… Sie bereits ein Storyboard oder Untertitel plus ein außerhalb der App erstelltes Audiopaket haben. Siehe Datei-Import-Anleitung.

💡 Tipp: Beide Wege münden an derselben Stelle. Egal, wie Ihre Szenen entstanden sind — Generierung und Export funktionieren danach genau gleich.

🧭 Die Schrittleiste im Überblick

Oben in der Story-Ansicht liegt die Schrittleiste. Jeder Schritt ist ein Chip, den Sie anklicken können, um jederzeit nachzusehen, was er produziert hat. Ein farbiger Punkt im Chip zeigt den Status: Wartend, Läuft, Fertig oder Fehler.

0 Einrichtung → ① Recherche → ② Exposé → ③ Drehbuch → ④ Szenentrennung → ⑤ Audio → ⑥ Prompts
                   (optional)     (Gate)                    [auto]            [auto]      [auto]

                                                                        ▶ Alles ausführen
Schritt Übergabe an den nächsten Schritt
0 EinrichtungGenre, Modell, Ausgabesprache, Drehbuchlänge, Trennungseinheit, Prüfungseinstellungen, Titel — und optional ein Drehbuch, das Sie einfügen oder importieren
① RechercheEine Strukturanalyse der YouTube-Referenzvideos mit faktengeprüften Aussagen
② ExposéEin Exposé und eine bestätigte Figurenliste
③ DrehbuchDer vollständige Drehbuchtext
④ SzenentrennungSzenen, Segmente je Sprecher (mit Emotion) und Soundeffekt-Anweisungen
⑤ AudioEine eigene Erzählspur je Sprecher plus die generierten Soundeffekte
⑥ PromptsJe Szene ein Bild-Prompt und ein Video-Prompt

💡 Hinweis: Recherche und Exposé sind Gates, keine Generierungsschritte — sie lassen sich nur anklicken, wenn sie für Ihr Projekt gelten. Sind die Szenen an importierte Bilder gebunden, bleiben die Schritte gesperrt, die sie überschreiben würden.

0️⃣ Einrichtung

Der Einstiegs-Tab. Alles, was Sie hier wählen, wird mit dem Projekt gespeichert — öffnen Sie es später erneut, steht das Formular genau so da, wie Sie es verlassen haben.

Optionen

Feld Bedeutung
Story-TypWelche Genres angeboten werden, hängt von der Ausgabesprache ab. Auf Koreanisch gibt es Yadam (koreanische Erzählungen), auf Englisch Dark History. In beiden Sprachen steht Maßgeschneidert zur Verfügung — die universelle Voreinstellung.
Generierungs-KIDas Modell, das für Sie schreibt — Claude oder Codex. Modelle, die es unterstützen, zeigen daneben zusätzlich eine Auswahl für die Denktiefe.
AusgabespracheKoreanisch oder Englisch. Gemeint ist die Sprache der Geschichte, nicht die der Oberfläche.
DrehbuchlängeEine Zahl und eine Einheit. Minuten gehen in beiden Sprachen; zusätzlich lässt sich eine Zeichenzahl (Koreanisch) oder eine Wortzahl (Englisch) angeben. Bis zu 60 Minuten.
TrennungseinheitNach Szene mit einer Ziellänge (standardmäßig 5–10 Sekunden) oder Nach Satz. Siehe Szenentrennung.
PrüfungEin Schalter für die automatische Prüfung und eine Rundenzahl (1–5) — jeweils für Drehbuch, Szenen und Prompts.
TitelOptional. Bleibt er leer und es existiert bereits ein Drehbuch, erzeugt AutoFlowCut vor der Szenentrennung selbst einen Titel.

Zwei Einstiege

A

Mit einem Titel beginnen

Titel eintippen, ✨ Start drücken — die Pipeline springt zum Exposé-Gate, wo die KI ein Exposé und eine Besetzung vorschlägt, die Sie bestätigen.

B

Ihr eigenes Drehbuch mitbringen

Fügen Sie das Drehbuch in das Textfeld ein oder ziehen Sie eine .txt- bzw. .md-Datei darauf (📁 Datei wählen geht auch). Nach ✨ Start wird das Drehbuch unverändert gespeichert, und das Exposé-Gate zieht die Figuren daraus.

💡 Hinweis: Sobald ein Drehbuch existiert, heißt die Schaltfläche ↻ Mit Änderungen neu starten. Sie wird nur aktiv, wenn Sie wirklich etwas geändert haben, und startet die Pipeline beim Drehbuch neu — also mit Bedacht drücken.

1️⃣ Recherche optional

Sehen Sie nach, was auf YouTube bereits funktioniert, bevor Sie sich auf ein Thema festlegen. Die Recherche liegt vor dem Exposé und steht zur Verfügung, solange das Projekt noch kein Drehbuch hat. Gesucht wird per Stichwort — einen Titel brauchen Sie dafür nicht.

Der Ablauf

1

Suchen

Stichwort eingeben, Trefferzahl wählen (10 / 20 / 30) und einen Zeitraum (alle, letzte Woche, letzte 30 Tage). Sie können auch eine YouTube-URL einfügen, um ein Video von Hand hinzuzufügen.

2

Referenzen auswählen

Die Treffer erscheinen als Karten mit Vorschaubild, Kanal, Aufrufen und Upload-Datum. Haken Sie an, was Sie brauchen; ein Doppelklick öffnet die Details — Abonnenten, Veröffentlichungsdatum, Viral-Wert und ein eingebetteter Player.

3

Analysieren

Alles auf einmal analysieren führt die drei Stufen hintereinander aus: Untertitel holen → Strukturanalyse → Faktencheck. Sie können Untertitel holen, Strukturanalyse und Faktencheck auch einzeln starten und einen langen Lauf mit ⏹ Abbrechen stoppen.

4

Bestätigen oder überspringen

Diese Recherche verwenden speichert sie im Projekt und führt weiter zum Exposé. Überspringen geht ohne Recherche direkt dorthin.

🧱 Strukturanalyse

Zerlegt die Referenzvideos in Erzählbeats mit je einer Zusammenfassung, listet ihre gemeinsamen Themen auf und zieht die zentralen Aussagen heraus.

🔎 Faktencheck

Jede Aussage bekommt ein Urteil — Bestätigt, Widerlegt oder Ungeprüft — samt Quellenlinks. Ins Projekt wandern nur die Aussagen, die Sie ankreuzen; voreingestellt sind die bestätigten.

⚠️ yt-dlp wird benötigt. Die Recherche holt Suchergebnisse und Untertitel über yt-dlp. Ist es nicht installiert, zeigt das Panel den passenden Installationsbefehl für Ihr System.

📜 Nur zur Orientierung und Neuinterpretation. Fremde Untertitel wörtlich zu kopieren oder weiterzuverbreiten kann eine Urheberrechtsverletzung sein. Die App wiederholt diesen Hinweis oben im Recherche-Panel.

2️⃣ Exposé Gate

Das Exposé ist die eine Stelle, an der ein Mensch abnickt, bevor die Maschine mit Ihrer Geschichte davonläuft. Nichts danach — weder Szenentrennung noch Audio noch Prompts — beginnt, bevor Sie hier die Besetzung bestätigt haben.

Was hier passiert

  • Vom Titel aus: Die KI schreibt das Exposé, streamt es in ein editierbares Textfeld und schlägt eine Besetzung vor.
  • Von Ihrem eigenen Drehbuch aus: Es geht rückwärts — Figuren und Exposé werden aus dem mitgebrachten Drehbuch herausgezogen.
  • Haben Sie eine Recherche bestätigt, erscheint ein Kontrollkästchen Recherche-Kontext einbeziehen. Es ist der einzige Schalter: Recherche wird niemals heimlich eingespeist.
  • Das Exposé ist frei editierbar, mit einer laufenden Zeilen- und Zeichenzählung.

Die Figurenkarten

Eine Zeile ist eine Figur, und jedes Feld können Sie ändern. Zeilen lassen sich beliebig hinzufügen oder entfernen.

Feld Wofür es benutzt wird
NameBenennt den Sprecher in der Szenentabelle — und wird später zum Kürzel für die @Erwähnung
GeschlechtMännlich / Weiblich / Unbekannt. Filtert die Stimmenauswahl vor und warnt bei einer unpassenden Stimme
EthnieFreitext. Fließt in die Erscheinungsbeschreibung der Figur im Bild-Prompt ein
AlterFreitext
RolleFreitext
PromptDas Aussehen der Figur. Genau dieser Text erzeugt später die Referenzkarte — siehe Figuren & @Erwähnung

Enthält das Drehbuch überhaupt keine Figuren — etwa ein reines Erzählstück —, sagt Ihnen das Panel das, und Sie können mit leerer Besetzung bestätigen und weitermachen.

Prüfung und Immersionswert

Ein Druck auf Prüfen, und die KI liest ihr eigenes Exposé, bewertet die Immersion auf einer Skala bis 100 und schreibt es um. Wie viele Runden sie bekommt, legen Sie fest (1–5). Das Abzeichen unter dem Editor zeigt den ersten und den letzten Wert, sodass Sie sehen, ob die Überarbeitung wirklich etwas gebracht hat — und wird eine Runde schlechter, wird die Fassung verworfen und im Protokoll vermerkt.

Bestätigen: Vom Titel aus heißt die Schaltfläche Drehbuch aus diesem Exposé schreiben und führt direkt weiter zum Drehbuch. Bei einem eigenen Drehbuch heißt sie Figuren bestätigen — Ihr Text bleibt unangetastet, nur die Besetzung wird übernommen.

3️⃣ Drehbuch

Das Drehbuch ist die alleinige Grundlage für alles, was danach kommt. Es läuft live ein, während das Modell schreibt, und landet anschließend in einem Editor, in dem Sie jederzeit selbst Hand anlegen können.

Neu schreiben

Erzeugt das ganze Drehbuch aus dem aktuellen Titel und den aktuellen Einstellungen neu. Scheitert der neue Lauf, bleibt das alte Drehbuch erhalten.

Weiterschreiben

Behält das Geschriebene und setzt dort fort, wo es aufgehört hat — praktisch, wenn ein langes Drehbuch zu kurz gerät.

🔍 Prüfen

Dieselbe Prüf- und Überarbeitungsschleife wie beim Exposé, mit eigenem Immersionswert und eigener Rundenzahl. Mit Autom. Prüfung in der Einrichtung läuft sie bei jeder Generierung mit.

✂️ Trennung starten

Speichert Ihre Änderungen und startet die Szenentrennung in einem Zug. Fehlt der Titel noch, wird er zuvor erzeugt.

💡 Hinweis: Während der Generierung zeigt eine Stoppuhr die verstrichene Zeit, und ⏹ Abbrechen hält sie an. Bei hoher Denktiefe kann es dauern, bis die ersten Worte erscheinen — die Uhr sagt Ihnen, dass noch gearbeitet wird.

4️⃣ Szenentrennung

Schneidet das Drehbuch in Szenen und jede Szene in Segmente. Ein Segment ist entweder eine Zeile Erzählung oder Dialog — mit Sprecher und Emotion — oder eine Soundeffekt-Anweisung.

🎞️ Nach Szene

Die Szenen werden auf eine Ziellänge geschnitten, die Sie festlegen — ein Minimum und ein Maximum in Sekunden (standardmäßig 5–10).

📝 Nach Satz

Eine Szene je Satz, immer mit Schnitt beim Sprecherwechsel. Sehr kurze Fragmente werden zusammengefasst, alles über 10 Sekunden wird geteilt.

Die Szenentabelle

Drei Spalten: Nummer, Sprecher und das Segment selbst. Unter Figurenzeilen steht ihre Emotion — normal, fröhlich, traurig oder wütend. Bei der Erzählung steht keine: Der Erzähler bekommt grundsätzlich keine Emotion. Soundeffekt-Zeilen sind mit SFX markiert und zeigen statt einer Textzeile die Beschreibung des Effekts.

Die Emotion ist keine Dekoration. Sie ist die Spielanweisung, die an die TTS-Engine geht.

🔁 Der Schnitt gefällt nicht? Trennungseinheit und Längenbereich stehen direkt über der Tabelle. Ändern Sie sie und drücken Sie ↻ Szenen neu trennen — so oft Sie mögen.

5️⃣ Audio

Jeder Sprecher bekommt seine eigene Stimme, jede Soundeffekt-Anweisung ihren Klang. Heraus kommt eine eigene Erzählspur je Sprecher — genau das lässt eine Geschichte mit mehreren Figuren nach einem Ensemble klingen und nicht nach einer Person, die vorliest.

Die Stimmen besetzen

Oben im Panel steht die Sprecherliste: In jeder Zeile sehen Sie den Namen der Figur, ein Geschlechts-Abzeichen und ihr Aussehen. Über die Schaltfläche 🎙 öffnen Sie die Stimmenauswahl.

  • Pro Sprecher eine eigene Engine. Filtern Sie nach Typecast, Gemini oder ElevenLabs — oder lassen Sie es auf Alle. Verschiedene Figuren dürfen in derselben Geschichte verschiedene Engines benutzen.
  • Suchen und probehören. Suchen Sie nach Name oder Eigenschaft, filtern Sie nach Geschlecht, und hören Sie jede Karte per Play-Taste an, bevor Sie sich festlegen. Die geteilte Bibliothek von ElevenLabs wird per Remote-Suche durchsucht — tippen Sie mindestens zwei Zeichen, um über die erste Seite hinauszukommen.
  • Geschlechts-Tags. Jede Karte ist als männlich, weiblich oder unbekannt markiert. Fehlt der Tag oder stimmt er nicht, setzen Sie ihn per Rechtsklick selbst.
  • Warnung bei Abweichung. Passen das Geschlecht der Figur und das der gewählten Stimme nicht zusammen, erscheint ein ⚠ auf der Schaltfläche. Blockiert wird nichts — es stellt nur sicher, dass es Absicht war.
  • Standardstimme. Lassen Sie einen Sprecher auf Standardstimme, greift die App auf ihre eigene Voreinstellung für diese Engine zurück.

Emotion — nur für Figuren

Die Emotion, die die Szenentrennung einer Figurenzeile zugewiesen hat, geht an die TTS-Engine, damit der Vortrag zum Moment passt. Der Erzähler ist bewusst ausgenommen: Ein Erzähler, der mitfühlt, klingt aufgekratzt — ein ruhiger trägt die Geschichte.

Soundeffekte

Die Soundeffekte werden bei der Szenentrennung aus dem Drehbuch gezogen und den passenden Szenen zugeordnet — in der Tabelle erscheinen sie als SFX-Zeilen mit ihrer Beschreibung. Erzeugt werden sie mit ElevenLabs, und Sie können sie direkt in der Zeile einzeln anhören.

Arbeiten Zeile für Zeile

Aktion Wirkung
▶ TestSynthetisiert genau dieses eine Segment mit der gewählten Stimme und spielt es sofort ab — Sie müssen nicht den ganzen Stapel laufen lassen, um die Besetzung zu beurteilen
▶ / ⏹Spielt bereits erzeugtes Audio ab bzw. stoppt es
Erzwingt die Neuerzeugung genau dieses Segments

Jede Zeile zeigt außerdem ihren eigenen Status — wartend, läuft, fertig oder Fehler — und aktualisiert ihn live, während der Stapel abgearbeitet wird.

🎧 Ist alles fertig, erscheint über der Tabelle eine Zeitleiste mit sämtlichen Sprachspuren und den Soundeffekten, ausgerichtet an den Untertiteln — dieselbe Zeitleiste wie bei einem importierten Audiopaket. ↻ Audio neu erzeugen synthetisiert nur die Segmente neu, bei denen sich Engine oder Stimme tatsächlich geändert haben.

6️⃣ Prompts

Der letzte Schritt schreibt für jede Szene einen Bild-Prompt und einen Video-Prompt — auf Basis der Zusammenfassung und der Segmenttexte der Szene, der Erscheinungsbeschreibung Ihrer bestätigten Figuren und des Stils. Die Tabelle stellt beide nebeneinander, eine Zeile je Szene.

Prompts werden behandelt wie das Drehbuch: eine Schaltfläche Prüfen mit Rundenzahl, dazu der Schalter für die automatische Prüfung in der Einrichtung. ↻ Prompts neu erzeugen schreibt sie allesamt neu.

💡 Hinweis: Diese Prompts landen in der normalen Szenentabelle — Sie können sie überall in AutoFlowCut weiterbearbeiten: in der App oder aus Claude Code heraus über den MCP-Server.

Automatik & Alles ausführen

Setzen Sie bei den Schritten, denen Sie vertrauen, den Haken bei auto, drücken Sie ▶ Alles ausführen — und die Pipeline läuft von selbst bis zum Ende.

Wie es sich verhält

  • Das Kästchen auto sitzt im Chip selbst, und zwar nur bei den drei Schritten, die unbeaufsichtigt laufen können: Szenentrennung, Audio und Prompts. Einrichtung und Drehbuch stehen nicht auf der Liste — ein Drehbuch braucht einen Menschen.
  • Alles ausführen arbeitet die angehakten Schritte der Reihe nach ab und überspringt den Rest. Es setzt ein fertiges Drehbuch voraus und stoppt, sobald ein Schritt scheitert.
  • Audio ist standardmäßig aus. TTS kostet bei jedem Lauf Geld — das schalten Sie bewusst selbst ein.
  • Bestätigen Sie zuerst die Besetzung im Exposé-Gate: Solange sie offen ist, bleibt „Alles ausführen“ deaktiviert.

💡 Ein guter Rhythmus: Szenentrennung und Prompts auf auto lassen, Audio aus lassen, bis Sie in der Stimmenauswahl ein paar Testzeilen gehört haben — dann den Haken setzen und „Alles ausführen“ den Rest erledigen lassen.

🎭 Figuren & @Erwähnung

Ihre Figuren bleiben nicht im Drehbuch. Sobald Sie die Besetzung im Exposé-Gate bestätigen, tragen sie sich selbst als Referenzkarten im Referenzen-Tab ein — und das Feld Prompt, das Sie auf jeder Karte bearbeitet haben, ist genau der Text, aus dem das Referenzbild entsteht.

Eine Figur an eine Szene hängen

Schreiben Sie im Szenen-Prompt ein @ gefolgt vom Namen der Figur, und daraus wird ein Chip, der an dieses Referenzbild gebunden ist:

@scholar sitzt allein in einem lampenerhellten Studierzimmer, Regen am Fenster

Eine passende Erwähnung wird zu einem cyanfarbenen Chip, eine unpassende bleibt einfacher Text mit roter Wellenlinie — Sie wissen also immer, ob die Referenz wirklich hängt. Deshalb ist der Name der Figur wichtig: Er ist das Kürzel.

📖 Die vollständige @Erwähnungs-Spezifikation — Zuordnungsregeln, Chips, Referenzbilder — steht in der Datei-Import-Anleitung. Der Story-Modus liefert Ihnen die Besetzung dafür einfach mit.

🚀 Generieren & Exportieren

Am Ende der Pipeline übergibt der Story-Modus ein fertiges Projekt: Szenen, Prompts, Figuren als Referenzen und Audio. Ab hier ist nichts mehr Story-spezifisch.

1

Bilder und Video generieren

Schicken Sie die Szenen genauso durch die Generierung wie bei einem importierten Projekt — per Google-Flow-Login oder mit Ihrem eigenen Gemini-/Veo-API-Schlüssel. Prüfen Sie das Ergebnis im Ergebnis-Panel: Zeitleiste, Ergebnisse oder Raster.

2

Nachbessern, wo nötig

Einen Prompt ändern und nur diese eine Szene neu generieren, eine einzelne Sprachzeile neu aufnehmen, die Szenen neu trennen. Jeder Schritt bleibt über seinen Chip in der Schrittleiste erreichbar.

3

In Ihren Editor exportieren

Export nach CapCut, Adobe Premiere Pro (.prproj) oder Vrew (.vrew). Ihre Erzählspuren und die Soundeffekte kommen als separate Audiospuren mit.

📖 Weiter geht es in der CapCut-Export-Anleitung: wohin der Projektordner gehört und wie Sie ihn öffnen.