KI-Videoclip-Planer
Teilen Sie jede Szene in Clips, die zur Grenze Ihres Modells passen
Fügen Sie eine Szene ein, wählen Sie die maximale Cliplänge Ihres Modells, und dieser Planer teilt sie in nummerierte, einfügefertige Prompts, die sich zu einer durchgehenden Sequenz verketten. Gebaut für KI-Filmschaffende, deren Modell bei 8 oder 10 Sekunden endet, während die Szene 45 dauert.
Jedes Text-zu-Video-Modell erzeugt in kurzen Schüben: Veo 3 endet bei etwa 8 Sekunden, Sora 2 und Kling 2.x bei etwa 10. Eine längere Szene existiert nur als Kette von Clips, die einen gemeinsamen Continuity-Block teilen und an jedem Schnitt ihren Zustand übergeben. Der Planer schätzt die Bildschirmzeit pro Beat (Handlung mit etwa 3 Wörtern pro Sekunde, Dialog mit etwa 2,5 gesprochenen Wörtern pro Sekunde plus 20 Prozent Reserve) und packt aufeinanderfolgende Beats in Clips, die Ihre Grenze nie überschreiten.
Alles läuft in Ihrem Browser. Ihr Szenentext verlässt ihn nie, und es wird nichts an einen Server gesendet.
Die Modellvorgaben setzen nur die Sekunden, nach der Grenze des jeweiligen Modells Ende 2026.
Sekunden pro ClipWird wortgleich an den Anfang jedes Clip-Prompts gesetzt. Je genauer er ist, desto weniger driften Ihre Figuren und Ihr Ort zwischen den Clips.
FigurenIhr Clipplan
Fügen Sie oben Ihre Szene ein, um den Clipplan zu sehen.
So funktioniert es
Der Planer teilt Ihre Szene in Beats: Jeder Handlungssatz und jede Sprechhandlung (eine NAME:-Zeile oder ein Satz in Anführungszeichen) wird ein Beat. Er schätzt die Bildschirmsekunden pro Beat nach Lesetempo-Konventionen, Handlung mit etwa 3 Wörtern pro Sekunde und Dialog mit etwa 2,5 Wörtern pro Sekunde plus 20 Prozent Reserve für Atem und Reaktionen. Dann packt er aufeinanderfolgende Beats in der Reihenfolge in Clips, die Ihre Höchstlänge nicht überschreiten. Jeder Clip-Prompt trägt denselben Continuity-Kopf, eine ENTRY-STATE-Zeile aus dem EXIT STATE des vorigen Clips, den Beat-Text und eine Zieldauer, damit sich die Kette als eine Szene schneiden lässt.
Wie man eine Szene in KI-Videoclips teilt
Modelle begrenzen die Dauer aus zwei Gründen: Die Rechenkosten steigen steil mit der Cliplänge, und die Stimmigkeit driftet, je länger eine Generierung läuft (Gesichter verändern sich, Requisiten springen, das Licht wandert). Deshalb gibt es keine Einstellung, die Veo 3 über 8 Sekunden bringt oder Sora 2 in einem Durchgang länger macht. Der einzige verlässliche Weg zu längeren KI-Videos ist die Arbeit in mehreren Clips: die Szene in Beats teilen, jeden Clip einzeln erzeugen und sie zusammenschneiden.
Der Verkettungsablauf, der funktioniert, ist langweilig und wiederholbar. Nutzen Sie das letzte Bild eines Clips als erstes Bild des nächsten, wo Ihr Modell Bildvorgaben unterstützt, und wiederholen Sie die vollständige Continuity-Beschreibung in jedem Prompt. „Dieselbe Figur wie vorher“ zu schreiben bewirkt nichts, weil das Modell keine Erinnerung an die vorige Generierung hat; „rote Regenjacke, kurzes schwarzes Haar“ zu wiederholen schon. Diese Wiederholung erhält die Continuity zwischen den Clips, und genau das sollte ein Clipplaner automatisieren.
Die Nähte zwischen Clips verschwinden, wenn Sie auf eine Bewegung schneiden, eine Montagekonvention, so alt wie das Continuity-Prinzip selbst. Beenden Sie einen Clip mitten in einer Bewegung (eine Tür öffnet sich, ein Kopf dreht sich) und beginnen Sie den nächsten mit ihrer Vollendung, und das Auge überbrückt den Schnitt von selbst. Die Zeilen EXIT STATE und ENTRY STATE in jedem Prompt existieren, um diese Übergaben vorzubereiten, und das macht es möglich, Clips aus Veo 3, Sora 2 oder Kling zu einer Szene zu verketten, die als ein Stück läuft statt als Diaschau.
Wenn der Plan steht, feinjustieren Sie Kamera- und Lichtsprache jedes Clips mit unserem kostenlosen KI-Video-Prompt-Generator damit jeder Prompt der Kette dieselbe Filmsprache spricht.
Für wen das gedacht ist
- KI-Kurzfilmschaffende: nutzen Sie ihn als Szenenplaner und machen Sie aus jeder Drehbuchszene einen nummerierten Einstellungsplan, bevor Sie Guthaben verbrauchen.
- Alleinschaffende auf Veo 3 oder Sora 2: hören Sie auf, Szenen auf 8 Sekunden zurechtzustutzen, und planen Sie Verkettungen mit Ein- und Ausgangszuständen, die sich wirklich schneiden lassen.
- Agenturen und Social-Teams: briefen Sie einen 30-Sekunden-Spot als Clipkette, die das ganze Team lesen kann, mit festgelegter Continuity vor der ersten Generierung.
Scene to Clip Splitter: the complete guide
It segments a pasted scene into beats, estimates screen seconds per beat from word count, packs beats into clips under your max length, and writes one ready-to-paste prompt per clip with an identical continuity header.
For this workflow, the central problem is clear: text-to-video models cap generations at 8 to 12 seconds, so full scenes have to be planned as clip chains, and doing that by hand loses continuity and screen-time math. Left unresolved, this creates downstream friction and slower decisions. The practical target is a numbered clip plan with per-clip prompts, chained entry and exit states, and duration estimates that never exceed the model's cap.
Limitation to keep in mind: Word-count pacing is an estimate, not a stopwatch: performance, camera speed, and model interpretation shift real durations, so treat clip timings as planning targets and expect to trim in the edit.
Advanced workflow: Advanced users pair each clip prompt with last-frame conditioning: generate clip 1, export its final frame, feed it in as clip 2's start image, and keep the written continuity header identical so the model has both a visual and a textual anchor.
Step-by-Step Workflow
- Paste the scene text, dialogue included, and pick your model preset or a custom max clip length.
- Fill the continuity block with exact character looks, location, lighting, and style, since it repeats in every prompt.
- Review the clip cards: check durations, watch for over-cap warnings, and adjust beats that split awkwardly.
- Copy prompts clip by clip (or export the .txt), generate in order, and cut the results together on the action beats.
Use Cases By Profile
- AI short film maker: turn a script scene into a shot-by-shot generation plan before spending credits.
- Solo Veo 3 creator: plan an 8-second clip chain with handoffs that cut on action instead of jarring resets.
- Social team lead: brief a 30-second spot as a readable clip chain with continuity locked up front.
Common Mistakes To Avoid
- Writing "same character as before" instead of repeating the full description, which the model cannot remember.
- Packing clips to the exact cap with no handle, leaving nothing to trim when a generation runs short.
- Splitting mid-sentence on dialogue, which makes lip-sync and performance continuity nearly impossible.
Professional Best Practices
- Plan clips a second or two under the cap so every generation has trim room in the edit.
- End clips mid-movement and start the next completing it; cutting on action hides the seam between generations.
- Keep one master continuity block per project and paste it unchanged into every scene you split.
Treat this tool output as a decision support layer, not a replacement for authorship. Great scripts are remembered for specific choices, emotional precision, and clarity of dramatic movement. Tools help by removing noise so your energy can go where it matters: character, conflict, escalation, and payoff. If you review outcomes after each pass and keep an explicit log of accepted changes, your workflow becomes faster and more predictable from draft to draft. That consistency is exactly what professional collaborators value: fewer surprises, clearer rationale, and a script that evolves with intent.
Extended FAQ
Why do AI video models cap clips at 8 or 10 seconds?
Two reasons: compute cost grows steeply with duration, and temporal coherence drifts the longer a generation runs, so faces and props mutate. Short caps keep quality high, which is why longer scenes are built as clip chains instead.
What is the best AI video clip planner workflow for a full scene?
Split the scene into beats, pack beats into clips under your model's cap, repeat one continuity block in every prompt, chain entry and exit states, and generate in order. This tool automates the splitting, timing, and prompt assembly.
How does last frame to first frame chaining work?
You export the final frame of clip N and feed it to clip N+1 as a start image where the model supports it. Paired with a repeated text continuity block, it anchors character, wardrobe, and lighting across the cut.
Can I use this for Kling or Runway instead of Veo?
Yes. The presets only set the max seconds (10 for Kling 2.x and Runway Gen-4 as of late 2026). The prompts are plain text, so they paste into any model's prompt field.
How is clip duration estimated from my scene text?
Action is estimated at about 3 words per second of visualized screen time and dialogue at about 2.5 words per second spoken, plus 20 percent handles. Beats are clamped to a 1 second minimum, and clips never exceed your cap.
What should I do when one beat is longer than the cap?
The tool splits it at word boundaries and flags the affected clips. The better fix is a rewrite: break the long beat into two actions with a natural cut point, then re-run the split.
Häufige Fragen
In einer einzelnen Generierung gar nicht. Der Weg ist, die Szene in Clips von höchstens 8 Sekunden zu teilen, denselben Continuity-Block in jedem Prompt zu wiederholen, das letzte Bild jedes Clips als erstes Bild des nächsten einzuspeisen, wo das unterstützt wird, und die Ergebnisse zusammenzuschneiden. Dieser Planer baut Ihnen diese Kette.
Etwa 24 Wörter Handlung (bei rund 3 Wörtern pro Sekunde) oder etwa 16 Wörter gesprochener Dialog (bei rund 2,5 Wörtern pro Sekunde plus 20 Prozent Reserve für Atem und Reaktionen). Deshalb braucht eine halbe Drehbuchseite mehrere Clips.
Weil jede Generierung bei null beginnt: Das Modell hat keine Erinnerung an Ihren vorigen Clip. Die Lösung ist, die vollständige Figuren- und Ortsbeschreibung wortgleich in jedem Prompt zu wiederholen, was der Continuity-Kopf jeder Clipkarte tut.
Sie verketten die Clips. Der EXIT STATE jedes Clips beschreibt das letzte Bild, und der ENTRY STATE des nächsten wiederholt ihn, damit das Modell dort beginnt, wo der vorige Clip endete. Wenn Ihr Modell ein Startbild annimmt, kombinieren Sie das mit dem letzten Bild des vorigen Clips.
Die Grenze Ihres Modells ist die Obergrenze: 8 Sekunden für Veo 3, etwa 10 für Sora 2, Kling 2.x und Runway Gen-4 Ende 2026. Viele planen bewusst kürzere Clips (4 bis 6 Sekunden), weil kurze Generierungen weniger driften und mehr Schnittpunkte geben.

Ganze Filme planen, nicht nur Clips
ScreenWeaver verbindet Ihr Drehbuch mit Szenenauflösungen, Storyboards und Einstellungslisten, damit die eben geplante Clipkette neben dem Rest Ihrer Produktion liegt. Kostenlos starten.
Film kostenlos planen









