Planificador de clips de vídeo IA

Divide cualquier escena en clips que respeten el límite de tu modelo

Pega una escena, elige la duración máxima de clip de tu modelo, y este planificador la divide en prompts numerados, listos para pegar, que se encadenan en una secuencia continua. Pensado para creadores de cine con IA cuyo modelo se detiene en 8 o 10 segundos mientras la escena dura 45.

Todos los modelos de texto a vídeo generan en ráfagas cortas: Veo 3 se detiene en torno a 8 segundos, Sora 2 y Kling 2.x en torno a 10. Una escena más larga solo existe como una cadena de clips que comparten un mismo bloque de continuidad y se pasan su estado en cada corte. El planificador estima la duración en pantalla de cada beat (la acción a unas 3 palabras por segundo, el diálogo a unas 2,5 palabras por segundo pronunciadas más un 20 % de margen) y agrupa después los beats consecutivos en clips que nunca superan tu límite.

Todo funciona en tu navegador. El texto de tu escena nunca sale de él, y no se envía nada a ningún servidor.

Duración máxima de clip

Los ajustes por modelo solo fijan los segundos, según el límite de cada modelo a finales de 2026.

Segundos por clip
Bloque de continuidad

Se repite palabra por palabra al principio de cada prompt de clip. Cuanto más preciso sea, menos derivan tus personajes y tu decorado de un clip a otro.

Personajes

Tu plan de clips

Pega tu escena arriba para ver el plan de clips.

Cómo funciona

El planificador divide tu escena en beats: cada frase de acción y cada intervención (una línea NOMBRE: o una frase entre comillas) se convierte en un beat. Estima los segundos en pantalla de cada beat según convenciones de ritmo de lectura, la acción a unas 3 palabras por segundo y el diálogo a unas 2,5 palabras por segundo pronunciadas más un 20 % de margen para respiraciones y reacciones. Después agrupa los beats consecutivos, en orden, en clips que se mantienen bajo tu duración máxima. Cada prompt de clip lleva la misma cabecera de continuidad, una línea ENTRY STATE heredada del EXIT STATE del clip anterior, el texto del beat y una duración objetivo, para que la cadena se monte como una sola escena.

Cómo dividir una escena en clips de vídeo IA

Los modelos limitan la duración por dos razones: el coste de cálculo sube con fuerza con la longitud del clip, y la coherencia deriva a medida que avanza la generación (los rostros se deforman, los objetos saltan, la luz se desplaza). Por eso no hay ningún ajuste que lleve a Veo 3 más allá de 8 segundos ni que alargue Sora 2 en una sola pasada. La única forma fiable de alargar un vídeo con IA es el trabajo en varios clips: dividir la escena en beats, generar cada clip por separado y montarlos juntos.

El método de encadenado que funciona es aburrido y repetible. Usa la última imagen de un clip como primera imagen del siguiente cuando tu modelo admite condicionamiento por imagen, y repite toda la descripción de continuidad en cada prompt. Escribir «el mismo personaje de antes» no sirve de nada, porque el modelo no recuerda la generación anterior; repetir «chubasquero rojo, pelo negro corto» sí funciona. Esa repetición es lo que preserva la continuidad entre clips, y es exactamente lo que un planificador debería automatizar.

Las costuras entre clips desaparecen cuando se corta sobre una acción, una convención de montaje tan antigua como el montaje en continuidad. Termina un clip en plena acción (una puerta que se abre, una cabeza que gira) y empieza el siguiente completando ese movimiento: el ojo cruza el corte solo. Las líneas EXIT STATE y ENTRY STATE de cada prompt existen para preparar esos relevos, y eso es lo que permite encadenar clips de Veo 3, Sora 2 o Kling en una escena que se juega de una pieza en vez de como un pase de diapositivas.

Cuando el plan esté cerrado, ajusta el lenguaje de cámara y de luz de cada clip con nuestro generador de prompts de vídeo IA gratuito, para que todos los prompts de la cadena hablen la misma gramática de cine.

A quién sirve

  • Quien hace cortometrajes con IA: úsalo como planificador de escenas, convirtiendo cada escena del guion en un plan de rodaje numerado antes de gastar créditos de generación.
  • Creadores en solitario con Veo 3 o Sora 2: deja de recortar escenas para caber en 8 segundos y empieza a planificar encadenados con estados de entrada y de salida que de verdad se montan.
  • Agencias y equipos de redes: informa un anuncio de 30 segundos como una cadena de clips legible por todo el equipo, con la continuidad cerrada antes de la primera generación.

Scene to Clip Splitter: the complete guide

It segments a pasted scene into beats, estimates screen seconds per beat from word count, packs beats into clips under your max length, and writes one ready-to-paste prompt per clip with an identical continuity header.

For this workflow, the central problem is clear: text-to-video models cap generations at 8 to 12 seconds, so full scenes have to be planned as clip chains, and doing that by hand loses continuity and screen-time math. Left unresolved, this creates downstream friction and slower decisions. The practical target is a numbered clip plan with per-clip prompts, chained entry and exit states, and duration estimates that never exceed the model's cap.

Limitation to keep in mind: Word-count pacing is an estimate, not a stopwatch: performance, camera speed, and model interpretation shift real durations, so treat clip timings as planning targets and expect to trim in the edit.

Advanced workflow: Advanced users pair each clip prompt with last-frame conditioning: generate clip 1, export its final frame, feed it in as clip 2's start image, and keep the written continuity header identical so the model has both a visual and a textual anchor.

Step-by-Step Workflow

  1. Paste the scene text, dialogue included, and pick your model preset or a custom max clip length.
  2. Fill the continuity block with exact character looks, location, lighting, and style, since it repeats in every prompt.
  3. Review the clip cards: check durations, watch for over-cap warnings, and adjust beats that split awkwardly.
  4. Copy prompts clip by clip (or export the .txt), generate in order, and cut the results together on the action beats.

Use Cases By Profile

  • AI short film maker: turn a script scene into a shot-by-shot generation plan before spending credits.
  • Solo Veo 3 creator: plan an 8-second clip chain with handoffs that cut on action instead of jarring resets.
  • Social team lead: brief a 30-second spot as a readable clip chain with continuity locked up front.

Common Mistakes To Avoid

  • Writing "same character as before" instead of repeating the full description, which the model cannot remember.
  • Packing clips to the exact cap with no handle, leaving nothing to trim when a generation runs short.
  • Splitting mid-sentence on dialogue, which makes lip-sync and performance continuity nearly impossible.

Professional Best Practices

  • Plan clips a second or two under the cap so every generation has trim room in the edit.
  • End clips mid-movement and start the next completing it; cutting on action hides the seam between generations.
  • Keep one master continuity block per project and paste it unchanged into every scene you split.

Treat this tool output as a decision support layer, not a replacement for authorship. Great scripts are remembered for specific choices, emotional precision, and clarity of dramatic movement. Tools help by removing noise so your energy can go where it matters: character, conflict, escalation, and payoff. If you review outcomes after each pass and keep an explicit log of accepted changes, your workflow becomes faster and more predictable from draft to draft. That consistency is exactly what professional collaborators value: fewer surprises, clearer rationale, and a script that evolves with intent.

Extended FAQ

Why do AI video models cap clips at 8 or 10 seconds?

Two reasons: compute cost grows steeply with duration, and temporal coherence drifts the longer a generation runs, so faces and props mutate. Short caps keep quality high, which is why longer scenes are built as clip chains instead.

What is the best AI video clip planner workflow for a full scene?

Split the scene into beats, pack beats into clips under your model's cap, repeat one continuity block in every prompt, chain entry and exit states, and generate in order. This tool automates the splitting, timing, and prompt assembly.

How does last frame to first frame chaining work?

You export the final frame of clip N and feed it to clip N+1 as a start image where the model supports it. Paired with a repeated text continuity block, it anchors character, wardrobe, and lighting across the cut.

Can I use this for Kling or Runway instead of Veo?

Yes. The presets only set the max seconds (10 for Kling 2.x and Runway Gen-4 as of late 2026). The prompts are plain text, so they paste into any model's prompt field.

How is clip duration estimated from my scene text?

Action is estimated at about 3 words per second of visualized screen time and dialogue at about 2.5 words per second spoken, plus 20 percent handles. Beats are clamped to a 1 second minimum, and clips never exceed your cap.

What should I do when one beat is longer than the cap?

The tool splits it at word boundaries and flags the affected clips. The better fix is a rewrite: break the long beat into two actions with a natural cut point, then re-run the split.

FAQ

Preguntas frecuentes

En una sola generación es imposible. El método consiste en dividir la escena en clips de 8 segundos como máximo, repetir el mismo bloque de continuidad en cada prompt, reinyectar la última imagen de cada clip como primera del siguiente cuando se pueda, y montar los resultados. Este planificador construye esa cadena por ti.

Unas 24 palabras de acción (a unas 3 palabras por segundo) o unas 16 palabras de diálogo pronunciado (a unas 2,5 palabras por segundo más un 20 % de margen para respiraciones y reacciones). Por eso una escena de media página necesita varios clips.

Porque cada generación parte de cero: el modelo no recuerda tu clip anterior. La solución es repetir palabra por palabra toda la descripción de personaje y decorado en cada prompt, que es lo que hace la cabecera de continuidad de cada ficha de clip.

Encadenan los clips. El EXIT STATE de cada clip describe la imagen final, y el ENTRY STATE del siguiente lo repite, para que el modelo arranque donde terminó el anterior. Si tu modelo acepta una imagen de inicio, combínalo con la reinyección de la última imagen del clip anterior.

El límite de tu modelo es el techo: 8 segundos para Veo 3, unos 10 para Sora 2, Kling 2.x y Runway Gen-4 a finales de 2026. Mucha gente planifica a propósito clips más cortos (4 a 6 segundos), porque las generaciones cortas derivan menos y ofrecen más puntos de corte en el montaje.

Preview of ScreenWeaver visual timeline and script rhythm

Planifica películas enteras, no solo clips

ScreenWeaver conecta tu guion con los desgloses de escenas, los storyboards y las listas de planos, para que la cadena de clips que acabas de planificar viva junto al resto de tu producción. Gratis para empezar.

Planificar tu película gratis