Die kurze Antwort: zwei Episoden, 38 Minuten fertiger Anime, eine Person, ein Arbeitsbereich. Episode 2 hat 1.850 $ und 75 Stunden gekostet. Das Drehbuch wurde in ScreenWeaver geschrieben, gestoryboardet und in die Produktion geschickt, und der Generator war nie der Flaschenhals. Das Entscheiden war es. Alles, was jetzt kommt, ist die tatsächliche Pipeline, Werkzeug für Werkzeug, samt dem, was schiefging und was es ersetzt hat.
Lost Garden ist eine Dark-Fantasy-Serie über leere Rüstungen, die zwanzig Jahrhunderte nach dem Ende der Welt aufwachen. Episode 1 dauert 17 Minuten, Episode 2 dauert 21. Kein Studio, kein Team, nichts ausgelagert.
Ich werde dir nicht erzählen, dass die KI das leicht gemacht hat. Hat sie nicht. Was sie weggenommen hat, ist das Warten. Ein Projekt wie dieses starb früher an der Stelle „Ich muss erst das Budget auftreiben“, dann vergehen sechs Monate, und du bist längst bei etwas anderem. Es ist nie daran gestorben, dass ich niemanden gefunden hätte, der zeichnen kann. Leute, die zeichnen können, gibt es überall, und sie sind darin besser als jedes Modell.
Erst das Ergebnis
Alles, was folgt, ist Prozess. Hier ist, was dabei herausgekommen ist, damit du selbst beurteilen kannst, ob die Methode deine Zeit wert ist.
Episode 1, The Awakening of the Lantern Knight, 17 Minuten: youtu.be/eZ_JlaLDJ-8
Episode 2, The King Beneath the Vault, 21 Minuten: youtu.be/z-YRrutXaFE
Beide findest du auf lostgarden.world, zusammen mit dem Pressekit.

Das sind fertige Bilder, direkt aus den Episoden, unbearbeitet. Behalte sie beim Lesen im Kopf, denn jeder Screenshot ab hier ist die Maschinerie dahinter.
Die Karte des Ganzen
ScreenWeaver ist in drei Schritten aufgebaut, und die Episoden sind ihnen der Reihe nach gefolgt.
| Schritt | Was passiert | Wo in ScreenWeaver |
|---|---|---|
| Write | Das Drehbuch, seine Struktur, seine Figuren, Orte und Objekte | Script tab, Living Story Map, story elements, die beiden KI-Agenten |
| See | Jede Szene wird zu Einstellungen, jede Einstellung zu einem Panel | Storyboard tab: reference sheets, Auflösung, shot panels, Auto-generate |
| Build | Freigegebene Panels werden zu Bild- und Videogenerierungen | Die Workflow-Engine: ein Node-Graph, vorverdrahtet aus dem Drehbuch, am Ende Seedance und Co. |
Danach ein Finish auf den Ausgaben: Musik, Schnitt, Untertitel, Verbreitung. Der Teil ist kurz. Das Interessante ist alles davor.
Eine Regel steht über allen drei Schritten, deshalb kommt sie zuerst.
Die eine Regel, die alles andere geprägt hat
Alle zwei bis drei Sekunden schneiden.
KI-Video zerfällt, wenn eine Einstellung lang läuft. Hände driften, Gesichter rutschen, Hintergründe atmen. Jedes Modell macht das, und der Verfall ist nicht linear: Eine Einstellung ist bei zwei Sekunden in Ordnung, bei vier wird sie weich, bei acht ist sie unbrauchbar.
Also habe ich aufgehört, Einstellungen lang laufen zu lassen. Nicht als Stilentscheidung, als Überlebenstaktik. Episode 2 hat rund 400 Einstellungen in 21 Minuten.
Dann ist etwas passiert, das ich nicht geplant hatte. Die Einschränkung wurde zum Stil. Anime schneidet ohnehin schnell. Zwei Sekunden halten und hart schneiden liest sich als bewusste Regie, nicht als Schadensbegrenzung. Das, was ich getan habe, weil ich musste, ist das, wofür mich die Leute loben.
Schreib dir das in deinen Prozess, bevor du ein einziges Bild generierst, denn es ändert die Zahl der Einstellungen, was das Storyboard ändert, was das Drehbuch ändert. In ScreenWeaver ändert es eine konkrete Sache: das Drehkonzept, das du vor der Auflösung schreibst, und dazu kommen wir im Schritt See.
Schritt 1, Write: Das Drehbuch muss die einzige Wahrheit bleiben
Der größte Zeitfresser in dieser Art von Produktion ist nicht die Generierung. Es ist das Hin und Her zwischen den Werkzeugen.
Du schreibst in einem Werkzeug. Du storyboardest in einem anderen. Du änderst eine Zeile, und das Storyboard ist zwei Tage lang falsch, bevor du es merkst. Du änderst eine Einstellung, und das Drehbuch beschreibt nicht mehr, was passiert.
ScreenWeaver lässt diese Drift gar nicht erst entstehen. Das Drehbuch ist vertikal, die Struktur ist horizontal, und beides ist ein einziges Dokument.
Die Living Story Map
Der horizontale Sequenzer am unteren Rand des Script tab zeigt jederzeit Akte, Sequenzen und Beats. Bei einer Serie geht das so: Episode, Akt, Sequenz, Story Beats, Szenen. Klick auf eine Sequenz, und das Drehbuch scrollt dorthin. Zieh einen Beat woandershin, und die Seiten folgen.
Ich habe sie als Tempomesser der Episode benutzt. Wenn eine Sequenz über ihre Nachbarn hinauswächst, siehst du das auf der Karte, bevor du es beim Lesen spürst, und genau dann ist der Moment zum Kürzen, nicht erst, wenn die Panels existieren.
Story elements und @-Erwähnungen
Jede Figur, jeder Ort und jedes Objekt der Episode existiert als story element. Im Drehbuch erreichst du sie mit einem @: Tipp @ser, und Serrure taucht auf, tipp @glo, und die Glockengießerei auch. Das ist keine Bequemlichkeit, das ist die Verbindung zwischen dem Drehbuch und allem, was danach kommt. Dasselbe Element, das im Drehbuch lebt, ist das, was der Storyboard tab zeichnen und die Workflow-Engine rendern wird.

Episode 2 kam als Final-Draft-Datei über das AI Center herein und landete mit ihren Figuren und Orten bereits in story elements getrennt. Nichts neu abgetippt. Die Besetzungsliste der Episode existierte, bevor ich eine einzige neue Zeile geschrieben hatte.
Die zwei Agenten, die ich wirklich benutzt habe
ScreenWeaver hat zwei KI-Agenten mit verschiedenen Aufgaben, und sie haben sich ihren Platz unterschiedlich verdient.
Der Dokumentalist hält die Bibel des Projekts. Dort lebt der Kanon von Lost Garden: wer die dreizehn Ritter sind, warum die Medaillons geschlossen bleiben müssen, sobald der Aushänger etabliert ist, was ein Quellkind ist. Wenn eine Zeile einer Tatsache widerspricht, die schon in der Bibel steht, sagt er es, und wenn ein neuer Name im Drehbuch auftaucht, fragt er, ob der dort hingehört. Bei einer Serie ist das die Arbeit, die ich am wenigsten aus dem Gedächtnis machen will.
Der Virtuelle Zuschauer liest wie ein Publikum und kommentiert Rhythmus, Spannung und Klarheit, während du schreibst. Ich übernehme nicht alle seine Anmerkungen. Ich übernehme die zum Tempo, weil das Tempo das ist, was du aus dem Inneren deines eigenen Drehbuchs nicht sehen kannst.
Keiner von beiden schreibt ein Wort für dich. Das ist der Punkt.
Export, weil das Branchenformat weiterhin zählt
Das Ganze lässt sich jederzeit als PDF und als Final Draft exportieren. Die Sprecher haben ein PDF bekommen. Die FDX ging zurück in mein Archiv. Nichts am Schreiben in ScreenWeaver sperrt dich ein.
Schritt 2, See: Erst die Figuren, dann die Einstellungen
Das ist der Schritt, den alle überspringen, und deshalb sehen die meisten KI-Filme aus wie ein Ordner voller schöner Bilder, die nichts miteinander zu tun haben.
Es ist auch der Schritt, den ich bei Episode 1 falsch gemacht und für Episode 2 ordentlich neu aufgebaut habe. Jede Figur in Lost Garden hat jetzt drei Dokumente, und die erledigen drei Aufgaben, die sich nicht zusammenlegen lassen.
- Das reference sheet. Wie die Figur aussieht, einmal im Storyboard tab generiert und an jedes Panel gehängt, in dem sie vorkommt.
- Die angepinnte Beschreibung. Der Absatz, aus dem das Sheet gebaut wird, und das Einzige über die Figur, was das Bildmodell überhaupt erreicht.
- Der Spielbogen. Wie sich die Figur bewegt, spricht, reagiert, und was sie nie tut. Der lebt in der Bibel des Dokumentalisten.
Lass das erste weg, und deine Figur driftet. Lass das zweite weg, und jede Einstellung wird zur Verhandlung. Lass das dritte weg, was fast alle tun, und deine Figur sieht perfekt aus und benimmt sich in jeder Szene wie jemand anderes.
Das reference sheet, und warum es eine Spezifikation ist, kein Bild
Im Storyboard tab listet das Entitäten-Panel links alle story elements der Szene. Jedes hat ein Moodboard mit einem Block für die angepinnte Beschreibung. Generate reference sheet liest diesen Block und erzeugt das Sheet: drei Ansichten, weißer Hintergrund, flache Farbe, kein Licht, keine Pose.

Jede dieser Entscheidungen ist bewusst, und jede ist das Gegenteil von dem, was du eigentlich tun willst.
Drei Ansichten, nicht eine. Vorne, Profil, hinten. Die Rückansicht ist die, die dich rettet, weil es die ist, an die du nie denkst, bis du einen Over-Shoulder brauchst und feststellst, dass du nie entschieden hast, was die Rückseite des Umhangs macht.
Weißer Hintergrund, kein Licht. Sobald ein Sheet dramatisch beleuchtet ist, erbt jedes Panel, das darauf verweist, die Beleuchtung. Du willst das Objekt, nicht die Stimmung.
Keine Actionpose. Eine Figur, die neutral dasteht, liest sich als „so ist sie“. Eine Figur mitten im Sprung liest sich als „mach das nochmal“, und du bekommst Varianten dieses Sprungs bis in alle Ewigkeit.

Requisiten gehören aufs Sheet, weil Requisiten zuerst driften
Sieh dir Bourdons Sheet an. Er ist ein Steinriese, der Glocken gießt, und sein Sheet trägt ein Pagodendach auf seinem Rücken mit drei daran hängenden Glocken, Hammer und Zange am Gürtel und eine kleine Messingteekanne.

Die Teekanne hat mit seiner Funktion nichts zu tun. Sie ist da, weil sie dir in einem einzigen Objekt sagt, wer er ist, und weil Requisiten das Erste sind, was driftet. Eine Silhouette überlebt dreißig Panels. Accessoires mutieren ab Panel vier: Der Hammer wird zur Axt, die Zange wird zur Kneifzange, die Teekanne verschwindet. Zeichne sie aufs Sheet, nenne sie in der angepinnten Beschreibung, und sie kommen zurück.
Beachte die Kopfstudie im Einschub oben. Bourdon hat Nahaufnahmen, und ein Ganzkörper-Turnaround trägt in diesem Maßstab nicht genug Information über ein Gesicht. Wenn eine Figur in der Episode eine Nahaufnahme hat, braucht das Sheet eine Kopfstudie.
Entwirf die Silhouette so, dass sie auch klein noch funktioniert

Barrik ist ein Fass auf Beinen. Bei vierzig Pixeln Höhe im Timeline-Streifen ist er immer noch unverkennbar Barrik.
Das ist kein Witz über das Design, das ist das Design. In einer Serie, die alle zwei Sekunden schneidet und viele extreme Weiten benutzt, ist eine Figur, die nur in der Naheinstellung zu erkennen ist, eine Figur, die du nicht inszenieren kannst.
Der Test: Verkleinere das Sheet auf die Höhe des Timeline-Streifens unten im Storyboard tab. Wenn du nicht erkennst, wer das ist, ist die Silhouette nicht fertig. Serrure ist eine hohe, dünne Vertikale mit einem Schlüsselloch. Lanterne ist ein kleiner Block mit einem Ring obendrauf. Bourdon ist ein Berg mit einem Dach darauf.
Barrik trägt außerdem die härteste Regel der ganzen Serie, in Großbuchstaben oben in seiner angepinnten Beschreibung: Er hat keinen Kopf und keinen Helm. Das Fass ist Kopf und Körper zugleich. Keine Kuppel, kein Hut, und niemals der Laternenhelm, der gehört allein dem Laternenritter. Ohne diese Zeile versucht jede Generierung irgendwann, ihm einen Kopf zu verpassen, weil Fässer mit Gesichtern nicht in den Trainingsdaten sind und Ritter schon.
Die angepinnte Beschreibung ist das Einzige, was das Modell liest
Hier ist die von Bourdon, unbearbeitet, genau so, wie sie in seinem Moodboard steht:
Steinriese, groß wie ein Torhaus. Blasse, wie blind wirkende Augen, ein Bart aus lebendiger Flamme, Risse, die glühen, wenn er lacht. Gießt Glocken für ein Königreich, das nicht mehr antwortet. Lacht zuerst, denkt laut, entscheidet langsam.
Zwei Dinge an diesem Absatz zählen mehr, als es aussieht.
Er enthält messbare Fakten. „Groß wie ein Torhaus“ ist eine Vorgabe, die ich in einem Bild prüfen kann. „Risse, die glühen, wenn er lacht“ ist bedingt: Sie glühen, wenn er lacht, nicht dauerhaft. Das ist die Art Satz, die eine Figur lebendig hält statt starr.
Der letzte Satz handelt gar nicht vom Aussehen. „Lacht zuerst, denkt laut, entscheidet langsam“ ist für das Sheet nahezu nutzlos, und es ist die wertvollste Zeile des Absatzes, weil sie seine Dialoge über zwanzig Minuten hinweg konsistent hält. Eigentlich ist das eine Zeile aus dem Spielbogen, die in die Beschreibung durchgesickert ist, und ich habe sie absichtlich dort gelassen.
Der Spielbogen: das Dokument, das niemand schreibt
Das dritte Dokument ist das, was den Unterschied gemacht hat, und es ist für mich und für die Sprechleistung geschrieben, nicht für irgendein Modell. Es lebt in der Bibel des Dokumentalisten, neben dem Kanon, wo ein Konsistenz-Agent es tatsächlich nutzen kann.
Meine beginnen mit einer Zeile, die die Grenze zieht: Spielbögen, keine Designbögen. Ein Teil dessen, was in Serrures steht:
Größe ist ein Verhältnis, keine Zahl. Der Kanon legt eine einzige Sache fest: Serrure ist einen halben Kopf größer als der Laternenritter. Nie mehr. Die Meterangaben stehen als Vorschlag drin, markiert als noch freizugeben, weil ein Meterwert eine Schätzung ist und ein Verhältnis eine Tatsache.
Ein körperliches Vokabular. Mit Lanterne ist er auf bestimmte, wiederholbare Weisen körperlich: zwei Klopfer auf den Brustpanzer, ein Schnipsen gegen den Laternenhelm, eine Hand auf der Schulter, den Helm mit der Hand drehen, um ihm zu zeigen, wohin er schauen soll. Eine Liste wiederverwendbarer Gesten ist das, was eine Figur davon abhält, in jeder Episode eine neue Körpersprache zu haben.
Ein Sprechtempo. Warm, mittel bis tief, leicht rau. Etwa zwei Wörter pro Sekunde, mit echten Pausen. Und dann die Zeile, die die Performance tatsächlich lenkt: Eine Zeile, die zu früh endet, ist richtig, eine Zeile, die weiterläuft, ist falsch.
Ein Schreibtick. Serrure beruhigt und untergräbt seine eigene Beruhigung drei Sekunden später, halblaut, ohne sich umzudrehen. „Ich irre mich nie... fast nie.“ Sobald dieser Tick aufgeschrieben ist, kann jeder eine Zeile schreiben, die nach ihm klingt, auch ich um zwei Uhr morgens.
Ein seltenes Signal, geschützt. Wenn Serrure aufhört zu scherzen und seine Stimme flach abfällt, stimmt wirklich etwas nicht. Der Bogen sagt es unverblümt: Dieser Kontrast ist das beste dramatische Werkzeug der Serie, und er funktioniert nur, wenn er selten bleibt. Dieser Satz hat mich dreimal davon abgehalten, ihn zu benutzen.
Das Wertvollste an einem Spielbogen ist die Liste dessen, was die Figur nie tut
Jeder meiner Bögen endet mit einem „Nie“-Abschnitt, und das ist der Teil, den ich am häufigsten nachschlage.
Serrure schreit nie, um zu dominieren. Er hält nie Reden. Er spielt nie den König oder den Helden. Er stolpert nie, verliert nie den Halt, wird nie von der Kulisse überrascht.
Die Liste des Laternenritters ist strenger, weil er die schwierigere Figur ist:
- Er spricht nie. Kein einziges Wort, niemals. Er erzeugt nur hohle metallische Geräusche: leises Knarren, Resonanzen, die sich wie Atmen anhören, Klicken, schüchternes Klopfen, ein fragendes Zischen und ein Scheppern, wenn ihn etwas erschreckt.
- Er stolpert nie. Er rutscht nicht aus, fällt nicht hin, läuft nicht in die Kulisse. Seine Komik kommt aus Neugier, nie aus Tollpatschigkeit.
- Er erzeugt nie selbst Licht, und sein Medaillon ist nie zu sehen.
Die zweite Regel ist die, die ich am häufigsten verteidigen musste, denn einer kleinen runden Figur in einer großen gefährlichen Welt wird ständig ein Sturz angeboten. Eine Figur, die stolpert, ist eine Figur, die man bemitleidet, und diese hier muss tapfer bleiben.
Und beim anderen: So sieht „stolpert nie, verliert nie den Halt“ am Ende von Episode 1 aus, als Serrure ankommt, um den Laternenritter aus einem Kampf zu holen, den der gerade verliert:

Beim Laternenritter muss die ganze Emotion stattdessen durch den Körper gehen: Helmneigungen, Haltung, Handgesten, Zögern. Und der Tragring oben auf seinem Helm schwingt, wenn er sich schnell bewegt, und genau der spielt das Zittern, wenn er in Panik gerät. Dieser Ring ist eine Requisite, die die Arbeit eines Schauspielers macht, und das funktioniert nur, weil er auf dem Sheet steht.
Der Rest der Besetzung

Dieselbe Behandlung für alle, die mehr als einmal auftauchen, einschließlich der Antagonisten und der Kreatur, gegen die im Arenakampf gekämpft wird. Eine Figur mit nur einer Szene bekommt trotzdem ein Sheet, wenn die Szene mehr als drei Einstellungen hat, was bei einem Schnittrhythmus von zwei Sekunden auf die meisten zutrifft.
Schreib die Beschreibung einmal, generiere das Sheet einmal, und jedes Panel verweist von da an darauf. Deshalb sehen meine beiden Ritter in Einstellung 380 immer noch wie sie selbst aus.
Schritt 2, weiterhin: Lass die Szene ihre eigene Auflösung vorschlagen
Eine leere Shotlist ist die langsamste Seite im Filmemachen.
Generate shots from scene script liest die Szene, die du schon geschrieben hast, und schlägt die Auflösung vor, Einstellung für Einstellung, jeweils mit Einstellungsgröße, Bewegung und einer Aktionszeile. Ich behalte vielleicht 60 Prozent und schreibe den Rest um, aber das ist weit schneller als eine leere Seite, und es erwischt zuverlässig die Einstellung, die ich immer vergesse.

Das Feld über der Shotlist ist der Ort, an dem die Arbeit passiert. Dort schreibst du dein Drehkonzept in ganz normaler Sprache, bevor irgendetwas vorgeschlagen wird. Hier ist das, was ich für den Arenakampf in Episode 2 benutzt habe:
Wir bleiben den ganzen Kampf über mit Serrure auf dem Felsvorsprung. Wir nehmen nie die Perspektive des Kämpfers ein, nur die der beiden, die ihm zusehen.
Dieser eine Satz hat neun Einstellungen entschieden. Er ist auch die gesamte dramatische Idee der Szene: Nicht der Kampf ist das Thema, sondern die beiden Figuren, die einem Fremden beim Kämpfen zusehen. Ohne diese Zeile liefert dir die Auflösung eine solide Actionszene. Mit ihr bekommst du die Szene, die die Episode gebraucht hat.
Schreib die Absicht, nicht die Einstellungen. Die Einstellungen folgen.
Hier derselbe Tab auf einer völlig anderen Szene, der Ankunft an der Burg. Zehn Einstellungen, andere Entitäten, andere Absicht: erst der Maßstab, die Gesichter später.

Und die zehn Panels für sich, außerhalb der Oberfläche. Graues Blockout, flaches Orange, wo die Flammen sind, keine Gesichter. Ein Panel ist dazu da, Bildausschnitt und Anordnung festzulegen, und ein hübsches Panel lügt bei beidem.

Das shot panel: drei Felder, und alle drei gehen in den Prompt

Jede Einstellung in ScreenWeaver trägt drei Felder, und das sind genau die drei Dinge, die ein Panel braucht:
- Einstellungsgröße, aus einer festen Liste: Weit, Totale, Halbtotale, Halbnah, Nah, Groß, Detail, Insert, Over-Shoulder, POV.
- Kamerabewegung: statisch, langsame Fahrt nach vorn, langsamer Dolly, Reißschwenk, Handkamera.
- Die Aktionszeile, der einzige Freitext, der Entitäten über ihr Handle referenziert.
Die Aktionszeile für Einstellung 3.1 lautet:
@serrure und @lantern-knight flach auf dem Felsvorsprung, sie schauen hinunter in die Grube. Die Weite halten, bis die Klinge antwortet.
Die @-Handles lösen auf die reference sheets auf, also wird das Panel mit den richtigen Rittern darin generiert. Der zweite Satz ist eine Notiz an mich selbst zum Timing, die kein Modell liest und die im Schnitt den Schnittpunkt entschieden hat.
Noch eine Sache zu diesem Freitext. „Cinematic“ bringt dir nichts. Es ist das häufigste Wort in KI-Film-Prompts und trägt keinerlei Information. Nenn stattdessen das Mittel: Negativraum, Chiaroscuro von unten beleuchtet, tiefe Zweier-Anordnung, extreme Weite mit dem Motiv auf einem Achtel der Bildhöhe. Das Feld für die Einstellungsgröße erledigt davon schon die Hälfte, und genau deshalb ist es eine Liste und kein Textfeld.
Edit with AI, Regenerate, und wann du welches nimmst
Zwei Buttons auf jedem shot panel, und es ist nicht derselbe Button.
Regenerate würfelt denselben Prompt noch einmal. Nimm ihn, wenn der Bildausschnitt stimmt und das Rendering nicht.
Edit with AI nimmt eine Anweisung und verändert das bestehende Panel: Kamera tiefer, Serrure nach links, das Feuer größer. Nimm ihn, wenn das Rendering stimmt und der Bildausschnitt nicht. Das ist weit günstiger als ein neuer Wurf, weil du behältst, was funktioniert hat.
Bei Episode 2 lag das Verhältnis bei etwa 2,4 Generierungen pro behaltenem Panel, also knapp unter tausend Generierungen für 400 Einstellungen. Wenn du für ein brauchbares Panel sechs- oder achtmal neu würfelst, liegt das Problem fast nie am Modell. Es liegt daran, dass die Aktionszeile kein Mittel benannt hat, oder dass die Einstellung auf kein Sheet gezeigt hat, oder dass die Einstellung gar nicht existieren sollte.
Auto-generate, und die Reihenfolge, die es dir aufzwingt

Der Button Auto-generate in der Timeline-Leiste öffnet einen Dialog mit drei Aufgaben, in dieser Reihenfolge: fehlende reference sheets der Entitäten, dann leere Szenen ohne Auflösung, dann fehlende Einstellungsbilder. Run all lässt sie nacheinander laufen, bis zu drei parallel pro Schritt.
Diese Reihenfolge ist die Methode. Sheets vor Einstellungen, Einstellungen vor Panels. Der Dialog lässt dich keine Panels für eine Einstellung generieren, deren Entitäten noch kein Sheet haben, und er sagt dir, warum. Beim ersten Mal, als er mich blockiert hat, war ich genervt. Beim zehnten Mal habe ich verstanden, dass er mir gerade eine ganze Szene driftender Figuren erspart hatte.
Das hat dieser Durchlauf bei der Gießereiszene ergeben: untexturierter grauer Ton, gesichtslose Puppen, und das Feuer in einem einzigen flachen Orange markiert, weil ein Panel genau dafür da ist. Alles grau, eine Farbe auf dem, worum es in der Einstellung geht.

Und hier dieselbe Szene in der fertigen Episode:

Sperr, was stimmt, importiere, was du schon hast
Zwei Dinge im Storyboard tab, die nach Kleinigkeiten klingen und keine sind.
Freigegebene Panels lassen sich sperren. Ein gesperrtes Panel wird von Run all nie wieder angefasst. Sobald die Arenaszene stimmte, blieb sie richtig, durch drei weitere Durchläufe über den Rest der Episode hinweg.
Und du kannst eigene Bilder als Panels importieren: eigene Referenzen, eigene Renderings, ein Bild aus einer früheren Episode. Lost Garden hat das kaum gebraucht, aber es ist die Tür, durch die ein bestehendes Projekt hereinkommt.
Die Arena, gesperrt. Neun Panels, die Klinge in Cyan markiert, und keines davon hat sich nach diesem Punkt noch verändert.

Try it free
Try Screenweaver for free on your script
It is free. Import your existing project, get a clearer view of your outline, and regain control of your story structure in minutes.
Start FreeSchritt 3, Build: die Workflow-Engine
Das ist der Teil, der aus einem Panel eine Einstellung macht.
Die Produktionsseite von ScreenWeaver ist ein Node-Graph. Kein Formular mit einem Generieren-Button, ein echter Graph, den du lesen kannst: Quellszene, Bildregie, Referenzen, Bild, Video, Ausgaben. Der Graph kommt aus dem Drehbuchkontext vorverdrahtet, also sind der Szenentext, die Aktionszeile der Einstellung und die reference sheets der Entitäten schon mit den richtigen Nodes verbunden, wenn du ihn öffnest.
Jeder Node ist editierbar. Das ist der Satz, der zählt. Die Vorverdrahtung nimmt dir das Einrichten ab, nicht die Kontrolle. Das Bild- oder Videomodell zu wechseln heißt, einen Node auszutauschen, nicht eine Pipeline neu zu bauen, und das ist es, was eine Serie überleben lässt, wenn sich die Modell-Rangliste unter ihr verschiebt.
Wie der Graph für eine Einstellung aus Lost Garden aussah
Für eine typische Einstellung in Episode 2:
- Quellszene trägt den Drehbuchtext und die drei Felder der Einstellung.
- Bildregie macht daraus den Bild-Prompt, mit dem benannten Kompositionsmittel.
- Referenzen hängt die reference sheets jedes @-Handles aus der Aktionszeile an.
- Bild erzeugt das Standbild. Hier kommt das freigegebene Panel als Referenz ins Spiel: Das Modell soll das Panel rendern, nicht das Bild erfinden.
- Video nimmt das Standbild, das Bewegungsfeld, die Dialogzeile und eine kurze Referenzaufnahme der Stimme der Figur und erzeugt den Clip mit der Stimme darin. Seedance 2.5 für Lost Garden, und das Modell ist ein Node, den du austauschen kannst.
- Ausgaben sammelt Standbilder, Clips und Rushes, versioniert.
Die Stimme ist einen eigenen Satz wert. Fast jede Zeile in beiden Episoden wurde von Seedance 2.5 aus einem Referenzaudio der Figur gesprochen, ein paar Sekunden Serrure, der wie Serrure klingt, an jede Einstellung gehängt, in der er spricht. Eine Referenz pro Figur ist das, was eine Stimme über vierhundert Einstellungen identisch hält. Es gibt keinen separaten Stimmdurchlauf auf den Ausgaben, kein separates Audiowerkzeug: Der Clip kommt aus dem Node und spricht schon.
Jeder Video-Prompt in diesem Graph trägt eine feste Anweisung: no music. Wenn du jeden Clip sein eigenes Klangbett generieren lässt, klingen neununddreißig Clips wie neununddreißig Filme. Das kriegst du in der Mischung nicht mehr hin. Die Musik ist ein separater Durchlauf auf dem fertigen Schnitt, weiter unten.
Versionen und Review, denn da steckt das Geld
Die Ausgaben kennen ihre Versionen. Jede Generierung einer Einstellung bleibt an der Einstellung hängen, neben den vorherigen, und du wählst aus. Das klingt nach einer Speicherfunktion. Es ist eine Budgetfunktion.
Der teure Fehler im KI-Filmemachen ist nicht eine schlechte Generierung, es ist, eine Woche lang wunderschön zu generieren und dann festzustellen, dass du ein Moodboard hast statt einer Sequenz. Wenn du die Takes einer Einstellung im Graph nebeneinander vergleichst, merkst du, dass der, der sich schneiden lässt, selten der hübscheste ist. Diese Entscheidung kostet dort nichts. Sie im Schnitt zu entdecken kostet einen Tag.
Eine Zeile, den ganzen Weg hindurch
Alles, was oben steht, glaubt man leichter, wenn man es an einem einzigen Beispiel durchverfolgt. Hier ist eine Dialogzeile aus Episode 2, von der Bibel bis zum fertigen Bild, mit dem Schritt in ScreenWeaver, in dem sie gelebt hat.
1. Der Spielbogen entscheidet, was für eine Zeile das ist (Dokumentalist)
Serrures Bogen sagt, dass er laut denkt, dass er Fragen stellt, deren Antwort er schon kennt, und dass eine Zeile, die zu früh endet, richtig ist. Er sagt auch, dass der Moment, in dem er aufhört zu scherzen und flach wird, das seltene Signal ist.
Das hier ist dieser Moment. Er hat gerade etwas in der Grube gehört. Also muss die Zeile kurz sein, und sie muss eine Feststellung sein, die er sich selbst gegenüber macht, bevor er sie irgendjemand anderem gegenüber macht.
2. Das Drehbuch (Script tab)
EXT. THE ARENA - CONTINUOUS A voice comes up out of the pit. SERRURE stops dead. SERRURE (startled, hushed) ...That's an armor voice. SERRURE (shouting with joy) It's one of ours! Quick, Lanterne, come on!
Vier Wörter tragen das Thema der Episode: Sie haben seit sehr langer Zeit keinen ihrer Art mehr getroffen. Die Regieanweisung in Klammern ist keine Dekoration, sie ist die Anweisung für den Stimmdurchlauf vier Schritte später.
3. Das Drehkonzept (Generate shots from scene script)
Wir bleiben den ganzen Kampf über mit Serrure auf dem Felsvorsprung. Wir nehmen nie die Perspektive des Kämpfers ein, nur die der beiden, die ihm zusehen.
4. Die Einstellung (shot panel)
Einstellung 3.1. Totale, statisch, Untersicht. Aktionszeile:
@serrure und @lantern-knight flach auf dem Felsvorsprung, sie schauen hinunter in die Grube. Die Weite halten, bis die Klinge antwortet.
5. Die Stimme (Video-Node)
Die Zeile geht mit Serrures Referenzaudio in den Video-Node, genau so, wie sie im Drehbuch steht: die Klammer, die Auslassungspunkte, die Pause.
Die Auslassungspunkte am Anfang von „...You hear that?“ bremsen den Einsatz. Ohne sie startet die Zeile laut, und der Beat ist verloren.
„Quick, Lanterne... come on!“ ist ein Satz, nicht zwei. Als zwei Fragmente kam es als zwei sich steigernde Rufe heraus. Mit Auslassungspunkten verbunden liest es sich als ein einziger Impuls.
Die zwei Sekunden Stille vor und nach der Enthüllung leisten mehr als jedes Adjektiv, und sie stehen im Prompt, statt dem Modell überlassen zu werden. Die Stille ist die Performance.
6. Das Panel, und die daraus gerenderte Einstellung (Storyboard tab, dann Build)

Oben links ist Einstellung 3.1: zwei Ritter flach auf einem Felsvorsprung, die hinunterschauen, in der Weite gehalten. Derselbe Bildausschnitt im Panel und im Film.
Das ist die ganze Pipeline in einer Einstellung. Eine Regel aus der Bibel hat eine Zeile hervorgebracht, die Zeile eine Klammer, die Klammer eine Stimmanweisung, das Drehkonzept den Bildausschnitt, der Bildausschnitt das Panel, und der Graph hat das Panel in den Clip gerendert.
Das Finish: was mit den Ausgaben von ScreenWeaver passiert
Alles ab hier passiert auf den exportierten Clips, die Stimmen schon drin. Es ist kurz, und jeder Punkt ist eine Lektion, die mich einen Take oder ein Rendering gekostet hat.
Warum leere Rüstungen die beste Entscheidung waren, die ich nicht getroffen habe
Meine Protagonisten sind leere Rüstungen. Sie haben keinen Mund. Es gibt keine Lippensynchronisation, die passen müsste, niemals.
Das klingt nach einem Detail. Es ist der Grund, warum die Stimme überhaupt im Video-Node leben konnte. Ein Take, bei dem die Stimme stimmt und das Bild nicht, oder umgekehrt, erzwingt nie einen zweiten Take des jeweils anderen, weil es keinen Mund gibt, der passen muss. Zeile umschreiben, Clip neu generieren, nichts anderes bewegt sich.
Wenn du eine KI-Serie von Grund auf entwirfst, entscheide das, bevor du deine Figuren entwirfst. Helme, Masken, Kreaturen, Tiere, alles ohne sichtbaren Mund verschafft dir enorm viel Produktionsfreiheit.
Musik, auf dem gesperrten Schnitt
Sechs Originalstücke, aufs Bild geschrieben, nachdem der Schnitt gesperrt war, ein Durchlauf, das Ohr eines einzigen Komponisten über die ganze Episode. Erst schneiden, dann vertonen. Jeder Film hat es seit einem Jahrhundert so gemacht, und der Audio-Button in einem Videomodell verführt dich dazu, das aufzugeben.
| Arbeitstitel | Länge | Wo es sitzt |
|---|---|---|
| Inexorable Ascent | 5:00 | der lange Aufstieg, der Maßstab der Welt |
| Song of the Empty Sky | 5:00 | die offenen Passagen, die Welt, wie sie jetzt ist |
| Clockwork Requiem | 3:30 | die Maschinen, die Dinge, die noch laufen |
| The Giant and the Knight | 3:30 | die Glockengießerei, Bourdon |
| Ash Lantern Prayer | 3:18 | die stillen Nachtwachen |
| The Knight's Lullaby | 2:30 | das Wiegenlied-Motiv, in beiden Episoden wieder aufgegriffen |
Für die Veröffentlichung wurden sie umbenannt, weil ein Arbeitstitel dir sagt, wo ein Cue sitzt, und ein Veröffentlichungstitel als eigenständiges Stück funktionieren muss. Zwei Aufgaben, zwei Namen.
Der Schnitt, und eine Encoder-Einstellung
Geschnitten wird in DaVinci Resolve Studio, der Bezahlversion. Rund 400 Clips pro Episode, ein Node-Graph für die Farbe, und ein Master, der dann zu jedem Lieferformat wird.
Wenn deine Quelle ein langer Master ist und ffmpeg bei null Prozent CPU steht, hängt es nicht, es sondiert die Datei. Gib ihm Raum: -probesize 20M -analyzeduration 10M. Und bei der finalen Mischung ist -x264-params no-fast-pskip=1 seine paar Prozent Bitrate wert, weil große, flache, dunkle Flächen, und das ist der Großteil dieser Serie, sonst Blockartefakte entwickeln, die wie ein eingefrorenes Bild aussehen.
Untertitel, und ein kostenloser Trick, um Halluzinationen zu erwischen
Beide Episoden sind auf Englisch und Französisch untertitelt, mit Zeitstempeln auf Wortebene, damit der Untertitel auf dem Wort landet, nicht daneben.
Whisper hat in Episode 1 sechs Phantomzeilen „I'm sorry“ über instrumentalen Passagen erzeugt. So erwischst du sie kostenlos: Transkribiere die verdächtige Passage für sich allein noch einmal. Echte Sprache transkribiert sich jedes Mal identisch. Eine Halluzination nicht: Dieselben acht Sekunden Musik, die im vollen Durchlauf „I'm sorry“ ergaben, ergaben isoliert „I'm not going to die“. Die Abweichung zwischen zwei Durchläufen ist die Signatur. Diese Prüfung hat jede Phantomzeile entfernt und jede echte behalten, einschließlich eines einzelnen geflüsterten „Find me“ bei Sekunde achtzehn.
Zwei Dinge noch: Brenn die Untertitel ein, bevor du einen Querformat-Master ins Hochformat drehst, nie danach. Und miss zuerst deine Letterbox-Balken. Mein Master hat oben und unten 130 Pixel Schwarz, also sitzen die Untertitel im Balken und verdecken nie das Bild.
Verbreitung
Die volle Episode geht auf YouTube. Der vertikale Schnitt, auf 9:16 gedreht und mit eingebrannten Untertiteln, geht auf TikTok und Instagram. Eine Erkenntnis, die mir einen Neuschnitt erspart hat: Auf Instagram erlaubt ein Videopost sechzig Minuten, ein Reel drei. Die volle Episode geht als Post hoch.
Was es gekostet hat, und wo die Zeit hingegangen ist
1.850 $ und 75 Stunden für Episode 2. Fünfundsiebzig Stunden sind etwa neun Arbeitstage für einundzwanzig fertige Minuten.
Der größte Posten ist die Generierung über die Workflow-Engine, Stimmen eingeschlossen, da sie aus dem Video-Node kommen. Danach die Musik. Schreiben und Storyboarden kosten Zeit, kein Geld.
Die interessante Zahl ist das Verhältnis zwischen Entscheiden und Generieren. Jede Stunde am Storyboard hat mir ungefähr fünf Stunden Generieren von Einstellungen erspart, die ich nicht gebraucht hätte. Das ist die ganze Ökonomie dieser Art von Produktion, und deshalb beginnt die Pipeline im Script tab und nicht am Video-Node.
Was ich anders machen würde
Die angepinnten Beschreibungen vor dem ersten Panel schreiben, nicht nach dem zehnten. Ich habe Konsistenz bei Episode 1 auf die teure Art gelernt und es bei Episode 2 richtig gemacht.
Die Schnittlänge vor der Auflösung festlegen. Zwei bis drei Sekunden pro Einstellung sind keine Entscheidung für die Postproduktion. Das verdoppelt deine Zahl an Einstellungen, und es gehört ins Drehkonzept.
Mindestens eine Hauptfigur ohne Mund entwerfen. Die Produktionsfreiheit, die das verschafft, steht in keinem Verhältnis zur Einschränkung.
Panels sperren, sobald sie stimmen. Run all ist schnell und macht bereitwillig eine Szene neu, die du schon fertig hattest, wenn du es ihm nicht verboten hast.
Wie es weitergeht
Wenn du die Pipeline lieber allgemein willst statt als diese Fallstudie, fang mit dem KI-Filmemachen-Workflow vom Drehbuch zur Leinwand an. Wenn du zusehen willst, wie es passiert, ist wie man einen KI-Film macht die Anleitung. Wenn du nur den Storyboard-Schritt für sich willst, decken der Storyboard-Generator und wie man mit KI ein Storyboard aus einem Drehbuch generiert das ordentlich ab.
Und wenn du aus dem Ganzen eine Sache mitnimmst: Die Werkzeuge sind nicht der Flaschenhals. Das Entscheiden ist es.
Beide Episoden sind frei anzusehen. Episode 1, Episode 2, und alles Weitere auf lostgarden.world. Episode 3 wird gerade in ScreenWeaver geschrieben, und Barrik, das Fass, ist der, der sie trägt.
Final Step
Build your next script with Screenweaver
Move from ideas to production-ready pages faster with timeline-native writing and AI-assisted story flow.
Try Screenweaver
