Pianificatore di clip video con IA
Dividi qualsiasi scena in clip che rispettano il limite del tuo modello
Incolla una scena, scegli la durata massima di clip del tuo modello, e questo pianificatore la divide in prompt numerati, pronti da incollare, che si concatenano in un'unica sequenza continua. Pensato per chi fa cinema con l'IA e ha un modello che si ferma a 8 o 10 secondi mentre la scena ne dura 45.
Ogni modello testo-verso-video genera a piccoli scatti: Veo 3 si ferma intorno agli 8 secondi, Sora 2 e Kling 2.x intorno ai 10. Una scena più lunga esiste solo come catena di clip che condividono un unico blocco di continuità e si passano lo stato a ogni stacco. Il pianificatore stima la durata sullo schermo di ogni beat (l'azione a circa 3 parole al secondo, il dialogo a circa 2,5 parole al secondo pronunciate più il 20 per cento di margine), poi raggruppa i beat consecutivi in clip che non superano mai il tuo limite.
Tutto funziona nel tuo browser. Il testo della tua scena non lo lascia mai e nulla viene inviato a nessun server.
Le impostazioni per modello fissano solo i secondi, in base al limite di ciascun modello a fine 2026.
Secondi per clipRipetuto parola per parola in cima a ogni prompt di clip. Più è preciso, meno i tuoi personaggi e la tua ambientazione vanno alla deriva da una clip all'altra.
PersonaggiIl tuo piano di clip
Incolla la tua scena qui sopra per vedere il piano di clip.
Come funziona
Il pianificatore divide la scena in beat: ogni frase di azione e ogni intervento di dialogo (una riga NOME: o una frase tra virgolette) diventa un beat. Stima i secondi sullo schermo di ogni beat con le convenzioni sul ritmo di lettura, l'azione a circa 3 parole al secondo e il dialogo a circa 2,5 parole al secondo pronunciate più il 20 per cento di margine per respiri e reazioni. Poi raggruppa i beat consecutivi, nell'ordine, in clip che restano entro la tua durata massima. Ogni prompt di clip porta la stessa intestazione di continuità, una riga ENTRY STATE ereditata dall'EXIT STATE della clip precedente, il testo del beat e una durata obiettivo, così la catena si monta come un'unica scena.
Come dividere una scena in clip video IA
I modelli limitano la durata per due motivi: il costo di calcolo cresce rapidamente con la lunghezza della clip, e la coerenza va alla deriva man mano che la generazione avanza (i volti si deformano, gli oggetti saltano, la luce scivola). È per questo che nessuna impostazione porta Veo 3 oltre gli 8 secondi né allunga Sora 2 in una sola passata. L'unico modo affidabile di allungare un video IA è lavorare a più clip: dividere la scena in beat, generare ogni clip separatamente e montarle insieme.
Il metodo di concatenamento che funziona è noioso e ripetibile. Usa l'ultimo fotogramma di una clip come primo della successiva dove il tuo modello accetta il condizionamento per immagine, e ripeti l'intera descrizione di continuità in ogni prompt. Scrivere «lo stesso personaggio di prima» non serve a nulla, perché il modello non ha memoria della generazione precedente; ripetere «giacca da pioggia rossa, capelli neri corti» sì. È quella ripetizione a preservare la continuità tra le clip, ed è esattamente quello che un pianificatore dovrebbe automatizzare.
Le giunzioni tra clip spariscono quando stacchi su un'azione, una convenzione di montaggio antica quanto il montaggio in continuità. Chiudi una clip in pieno movimento (una porta che si apre, una testa che gira) e apri la successiva completandolo: l'occhio attraversa lo stacco da solo. Le righe EXIT STATE ed ENTRY STATE di ogni prompt servono a preparare quei passaggi di testimone, ed è quello che permette di concatenare clip di Veo 3, Sora 2 o Kling in una scena che scorre come un pezzo unico invece che come una sequenza di diapositive.
Fissato il piano, calibra il linguaggio di macchina e di luce di ogni clip col nostro generatore gratuito di prompt per video con IA così tutti i prompt della catena parlano la stessa grammatica cinematografica.
Per chi è
- Chi fa cortometraggi con l'IA: usalo come pianificatore di scene, trasformando ogni scena della sceneggiatura in un piano di ripresa numerato prima di bruciare crediti di generazione.
- Chi lavora da solo su Veo 3 o Sora 2: smetti di tagliare le scene per farle stare in 8 secondi e comincia a pianificare concatenamenti con stati di entrata e di uscita che si montano davvero.
- Agenzie e squadre social: presenta uno spot da 30 secondi come una catena di clip leggibile da tutta la squadra, con la continuità fissata prima della prima generazione.
Scene to Clip Splitter: the complete guide
It segments a pasted scene into beats, estimates screen seconds per beat from word count, packs beats into clips under your max length, and writes one ready-to-paste prompt per clip with an identical continuity header.
For this workflow, the central problem is clear: text-to-video models cap generations at 8 to 12 seconds, so full scenes have to be planned as clip chains, and doing that by hand loses continuity and screen-time math. Left unresolved, this creates downstream friction and slower decisions. The practical target is a numbered clip plan with per-clip prompts, chained entry and exit states, and duration estimates that never exceed the model's cap.
Limitation to keep in mind: Word-count pacing is an estimate, not a stopwatch: performance, camera speed, and model interpretation shift real durations, so treat clip timings as planning targets and expect to trim in the edit.
Advanced workflow: Advanced users pair each clip prompt with last-frame conditioning: generate clip 1, export its final frame, feed it in as clip 2's start image, and keep the written continuity header identical so the model has both a visual and a textual anchor.
Step-by-Step Workflow
- Paste the scene text, dialogue included, and pick your model preset or a custom max clip length.
- Fill the continuity block with exact character looks, location, lighting, and style, since it repeats in every prompt.
- Review the clip cards: check durations, watch for over-cap warnings, and adjust beats that split awkwardly.
- Copy prompts clip by clip (or export the .txt), generate in order, and cut the results together on the action beats.
Use Cases By Profile
- AI short film maker: turn a script scene into a shot-by-shot generation plan before spending credits.
- Solo Veo 3 creator: plan an 8-second clip chain with handoffs that cut on action instead of jarring resets.
- Social team lead: brief a 30-second spot as a readable clip chain with continuity locked up front.
Common Mistakes To Avoid
- Writing "same character as before" instead of repeating the full description, which the model cannot remember.
- Packing clips to the exact cap with no handle, leaving nothing to trim when a generation runs short.
- Splitting mid-sentence on dialogue, which makes lip-sync and performance continuity nearly impossible.
Professional Best Practices
- Plan clips a second or two under the cap so every generation has trim room in the edit.
- End clips mid-movement and start the next completing it; cutting on action hides the seam between generations.
- Keep one master continuity block per project and paste it unchanged into every scene you split.
Treat this tool output as a decision support layer, not a replacement for authorship. Great scripts are remembered for specific choices, emotional precision, and clarity of dramatic movement. Tools help by removing noise so your energy can go where it matters: character, conflict, escalation, and payoff. If you review outcomes after each pass and keep an explicit log of accepted changes, your workflow becomes faster and more predictable from draft to draft. That consistency is exactly what professional collaborators value: fewer surprises, clearer rationale, and a script that evolves with intent.
Extended FAQ
Why do AI video models cap clips at 8 or 10 seconds?
Two reasons: compute cost grows steeply with duration, and temporal coherence drifts the longer a generation runs, so faces and props mutate. Short caps keep quality high, which is why longer scenes are built as clip chains instead.
What is the best AI video clip planner workflow for a full scene?
Split the scene into beats, pack beats into clips under your model's cap, repeat one continuity block in every prompt, chain entry and exit states, and generate in order. This tool automates the splitting, timing, and prompt assembly.
How does last frame to first frame chaining work?
You export the final frame of clip N and feed it to clip N+1 as a start image where the model supports it. Paired with a repeated text continuity block, it anchors character, wardrobe, and lighting across the cut.
Can I use this for Kling or Runway instead of Veo?
Yes. The presets only set the max seconds (10 for Kling 2.x and Runway Gen-4 as of late 2026). The prompts are plain text, so they paste into any model's prompt field.
How is clip duration estimated from my scene text?
Action is estimated at about 3 words per second of visualized screen time and dialogue at about 2.5 words per second spoken, plus 20 percent handles. Beats are clamped to a 1 second minimum, and clips never exceed your cap.
What should I do when one beat is longer than the cap?
The tool splits it at word boundaries and flags the affected clips. The better fix is a rewrite: break the long beat into two actions with a natural cut point, then re-run the split.
Domande frequenti
In una singola generazione non si può. Il metodo è dividere la scena in clip da 8 secondi o meno, ripetere lo stesso blocco di continuità in ogni prompt, reinserire l'ultimo fotogramma di ogni clip come primo della successiva dove è possibile, e montare i risultati. Questo pianificatore costruisce quella catena al posto tuo.
Circa 24 parole di azione (a più o meno 3 parole al secondo) o circa 16 parole di dialogo pronunciato (a più o meno 2,5 parole al secondo più il 20 per cento di margine per respiri e reazioni). È per questo che una scena da mezza pagina richiede più clip.
Perché ogni generazione riparte da zero: il modello non ha memoria della clip precedente. La soluzione è ripetere parola per parola l'intera descrizione di personaggio e ambientazione in ogni prompt, che è quello che fa l'intestazione di continuità di ogni scheda di clip.
Concatenano le clip. L'EXIT STATE di ogni clip descrive il fotogramma finale, e l'ENTRY STATE della successiva lo ripete, così il modello comincia dove la precedente si è fermata. Se il tuo modello accetta un'immagine di partenza, abbina questo alla reimmissione dell'ultimo fotogramma della clip precedente.
Il limite del tuo modello è il tetto: 8 secondi per Veo 3, circa 10 per Sora 2, Kling 2.x e Runway Gen-4 a fine 2026. Molti pianificano di proposito clip più brevi (da 4 a 6 secondi), perché le generazioni corte vanno meno alla deriva e danno più punti di stacco in montaggio.

Pianifica film interi, non solo clip
ScreenWeaver collega la tua sceneggiatura a spogli di scena, storyboard e liste di inquadrature, così la catena di clip che hai appena pianificato vive accanto al resto della tua produzione. Gratis per iniziare.
Pianifica il tuo film gratis









