Planificateur de clips vidéo IA

Découpez n'importe quelle scène en clips compatibles avec la limite de votre modèle

Collez une scène, choisissez la durée maximale de clip de votre modèle, et ce planificateur la découpe en prompts numérotés, prêts à coller, qui s'enchaînent en une seule séquence continue. Conçu pour les créateurs de films IA dont le modèle plafonne à 8 ou 10 secondes alors que la scène en dure 45.

Tous les modèles texte vers vidéo génèrent par courtes salves : Veo 3 plafonne autour de 8 secondes, Sora 2 et Kling 2.x autour de 10. Une scène plus longue n'existe que comme une chaîne de clips qui partagent un même bloc de continuité et se transmettent leur état à chaque coupe. Le planificateur estime la durée à l'écran de chaque beat (l'action à environ 3 mots par seconde visualisés, le dialogue à environ 2,5 mots par seconde prononcés plus 20 % de marge), puis regroupe les beats consécutifs en clips qui ne dépassent jamais votre limite.

Tout tourne dans votre navigateur. Le texte de votre scène ne le quitte jamais et rien n'est envoyé à un serveur.

Durée maximale de clip

Les préréglages de modèle ne font que fixer les secondes, d'après la limite de chaque modèle fin 2026.

Secondes par clip
Bloc de continuité

Répété au mot près en tête de chaque prompt de clip. Plus il est précis, moins vos personnages et votre décor dérivent d'un clip à l'autre.

Personnages

Votre plan de clips

Collez votre scène ci-dessus pour voir le plan de clips.

Comment ça marche

Le planificateur découpe votre scène en beats : chaque phrase d'action et chaque prise de parole (une ligne NOM : ou une phrase entre guillemets) devient un beat. Il estime les secondes à l'écran de chaque beat selon les conventions de rythme de lecture, l'action à environ 3 mots par seconde et le dialogue à environ 2,5 mots par seconde prononcés plus 20 % de marge pour les respirations et les réactions. Il regroupe ensuite les beats consécutifs, dans l'ordre, en clips qui restent sous votre durée maximale. Chaque prompt de clip porte le même en-tête de continuité, une ligne ENTRY STATE héritée de l'EXIT STATE du clip précédent, le texte du beat et une durée cible, pour que la chaîne se monte comme une seule scène.

Comment découper une scène en clips vidéo IA

Les modèles plafonnent la durée pour deux raisons : le coût de calcul grimpe fortement avec la longueur du clip, et la cohérence dérive à mesure que la génération avance (les visages se déforment, les accessoires se téléportent, la lumière glisse). C'est pourquoi aucun réglage ne fait dépasser 8 secondes à Veo 3 ni ne produit une vidéo Sora 2 plus longue en une seule passe. La seule façon fiable d'allonger une vidéo IA reste le travail en plusieurs clips : découper la scène en beats, générer chaque clip séparément, puis les monter ensemble.

La méthode d'enchaînement qui fonctionne est ennuyeuse et répétable. Utilisez la dernière image d'un clip comme première image du suivant quand votre modèle accepte le conditionnement par image, et répétez toute la description de continuité dans chaque prompt. Écrire « le même personnage que précédemment » ne sert à rien, puisque le modèle n'a aucune mémoire de la génération d'avant ; répéter « veste de pluie rouge, cheveux noirs courts » fonctionne. Cette répétition est ce qui préserve la continuité entre les clips, et c'est exactement ce qu'un planificateur devrait automatiser.

Les jointures entre clips disparaissent quand on coupe sur une action, une convention de montage aussi ancienne que le montage en continuité. Terminez un clip en plein mouvement (une porte qui s'ouvre, une tête qui se tourne) et commencez le suivant en achevant ce mouvement : l'œil du spectateur franchit la coupe tout seul. Les lignes EXIT STATE et ENTRY STATE de chaque prompt existent pour préparer ces passages de relais, et c'est ce qui permet d'enchaîner des clips Veo 3, Sora 2 ou Kling en une scène qui se joue d'un seul tenant plutôt qu'en diaporama.

Une fois le plan posé, réglez le langage de caméra et de lumière de chaque clip avec notre générateur de prompts vidéo IA gratuit, pour que tous les prompts de la chaîne parlent la même grammaire de cinéma.

À qui ça s'adresse

  • Réalisateurs de courts métrages IA : utilisez-le comme planificateur de scènes, en transformant chaque scène du scénario en plan de tournage numéroté avant de consommer vos crédits de génération.
  • Créateurs solo sur Veo 3 ou Sora 2 : cessez de raboter vos scènes pour tenir en 8 secondes et commencez à planifier vos enchaînements avec des états d'entrée et de sortie qui se montent vraiment.
  • Agences et équipes social media : briefez un spot de 30 secondes sous forme de chaîne de clips lisible par toute l'équipe, avec la continuité verrouillée avant la première génération.

Scene to Clip Splitter: the complete guide

It segments a pasted scene into beats, estimates screen seconds per beat from word count, packs beats into clips under your max length, and writes one ready-to-paste prompt per clip with an identical continuity header.

For this workflow, the central problem is clear: text-to-video models cap generations at 8 to 12 seconds, so full scenes have to be planned as clip chains, and doing that by hand loses continuity and screen-time math. Left unresolved, this creates downstream friction and slower decisions. The practical target is a numbered clip plan with per-clip prompts, chained entry and exit states, and duration estimates that never exceed the model's cap.

Limitation to keep in mind: Word-count pacing is an estimate, not a stopwatch: performance, camera speed, and model interpretation shift real durations, so treat clip timings as planning targets and expect to trim in the edit.

Advanced workflow: Advanced users pair each clip prompt with last-frame conditioning: generate clip 1, export its final frame, feed it in as clip 2's start image, and keep the written continuity header identical so the model has both a visual and a textual anchor.

Step-by-Step Workflow

  1. Paste the scene text, dialogue included, and pick your model preset or a custom max clip length.
  2. Fill the continuity block with exact character looks, location, lighting, and style, since it repeats in every prompt.
  3. Review the clip cards: check durations, watch for over-cap warnings, and adjust beats that split awkwardly.
  4. Copy prompts clip by clip (or export the .txt), generate in order, and cut the results together on the action beats.

Use Cases By Profile

  • AI short film maker: turn a script scene into a shot-by-shot generation plan before spending credits.
  • Solo Veo 3 creator: plan an 8-second clip chain with handoffs that cut on action instead of jarring resets.
  • Social team lead: brief a 30-second spot as a readable clip chain with continuity locked up front.

Common Mistakes To Avoid

  • Writing "same character as before" instead of repeating the full description, which the model cannot remember.
  • Packing clips to the exact cap with no handle, leaving nothing to trim when a generation runs short.
  • Splitting mid-sentence on dialogue, which makes lip-sync and performance continuity nearly impossible.

Professional Best Practices

  • Plan clips a second or two under the cap so every generation has trim room in the edit.
  • End clips mid-movement and start the next completing it; cutting on action hides the seam between generations.
  • Keep one master continuity block per project and paste it unchanged into every scene you split.

Treat this tool output as a decision support layer, not a replacement for authorship. Great scripts are remembered for specific choices, emotional precision, and clarity of dramatic movement. Tools help by removing noise so your energy can go where it matters: character, conflict, escalation, and payoff. If you review outcomes after each pass and keep an explicit log of accepted changes, your workflow becomes faster and more predictable from draft to draft. That consistency is exactly what professional collaborators value: fewer surprises, clearer rationale, and a script that evolves with intent.

Extended FAQ

Why do AI video models cap clips at 8 or 10 seconds?

Two reasons: compute cost grows steeply with duration, and temporal coherence drifts the longer a generation runs, so faces and props mutate. Short caps keep quality high, which is why longer scenes are built as clip chains instead.

What is the best AI video clip planner workflow for a full scene?

Split the scene into beats, pack beats into clips under your model's cap, repeat one continuity block in every prompt, chain entry and exit states, and generate in order. This tool automates the splitting, timing, and prompt assembly.

How does last frame to first frame chaining work?

You export the final frame of clip N and feed it to clip N+1 as a start image where the model supports it. Paired with a repeated text continuity block, it anchors character, wardrobe, and lighting across the cut.

Can I use this for Kling or Runway instead of Veo?

Yes. The presets only set the max seconds (10 for Kling 2.x and Runway Gen-4 as of late 2026). The prompts are plain text, so they paste into any model's prompt field.

How is clip duration estimated from my scene text?

Action is estimated at about 3 words per second of visualized screen time and dialogue at about 2.5 words per second spoken, plus 20 percent handles. Beats are clamped to a 1 second minimum, and clips never exceed your cap.

What should I do when one beat is longer than the cap?

The tool splits it at word boundaries and flags the affected clips. The better fix is a rewrite: break the long beat into two actions with a natural cut point, then re-run the split.

FAQ

Questions fréquentes

C'est impossible en une seule génération. La méthode consiste à découper la scène en clips de 8 secondes maximum, à répéter le même bloc de continuité dans chaque prompt, à réinjecter la dernière image de chaque clip comme première image du suivant quand c'est possible, puis à monter les résultats. Ce planificateur construit cette chaîne pour vous.

Environ 24 mots d'action (à peu près 3 mots par seconde visualisés) ou environ 16 mots de dialogue prononcé (environ 2,5 mots par seconde plus 20 % de marge pour les respirations et les réactions). C'est pour ça qu'une scène d'une demi-page demande plusieurs clips.

Parce que chaque génération repart de zéro : le modèle n'a aucune mémoire de votre clip précédent. La solution est de répéter au mot près toute la description de personnage et de décor dans chaque prompt, ce que fait l'en-tête de continuité de chaque fiche de clip.

Elles enchaînent les clips. L'EXIT STATE de chaque clip décrit l'image finale, et l'ENTRY STATE du suivant la reprend, pour que le modèle démarre là où le clip précédent s'est arrêté. Si votre modèle accepte une image de départ, associez cela à la réinjection de la dernière image du clip précédent.

La limite de votre modèle est le plafond : 8 secondes pour Veo 3, environ 10 pour Sora 2, Kling 2.x et Runway Gen-4 fin 2026. Beaucoup de créateurs planifient volontairement des clips plus courts (4 à 6 secondes), parce que les générations courtes dérivent moins et offrent plus de points de coupe au montage.

Preview of ScreenWeaver visual timeline and script rhythm

Planifiez des films entiers, pas seulement des clips

ScreenWeaver relie votre scénario aux dépouillements de scènes, aux storyboards et aux listes de plans, pour que la chaîne de clips que vous venez de planifier vive à côté du reste de votre production. Gratuit pour démarrer.

Planifier votre film gratuitement