AI 動画クリップ設計
どんなシーンも、モデルの上限に収まるクリップに割る
シーンを貼り、使うモデルのクリップ尺の上限を選べば、この AI 動画クリップ設計ツールが、番号のついたそのまま貼れるプロンプトに割り、ひと続きの流れとしてつながるようにします。シーンは45秒あるのに、モデルは8秒か10秒で頭打ちになる。そんな AI の作り手のために作りました。
どの動画モデルも短い塊で生成します。Veo 3 は8秒前後、Sora 2 と Kling 2.x は10秒前後が上限です。それより長いシーンは、ひとつの連続性のかたまりを共有し、切れ目ごとに状態を受け渡すクリップの連鎖としてしか存在しません。この設計ツールはビートごとの尺を見積もり(ト書きは1秒およそ3語ぶんの絵、台詞は話す速さで1秒およそ2.5語、それに前後の余白を20パーセント)、連続するビートを、上限を決して超えないクリップに詰めていきます。
すべてブラウザ内で動きます。シーンの本文がここを離れることはなく、サーバーには何も送られません。
モデルの初期値は秒数だけを設定します。2026年後半時点での各モデルの上限を使っています。
1クリップあたりの秒数すべてのクリップのプロンプトの先頭に、一字一句そのまま繰り返されます。具体的であるほど、クリップのあいだで人物と場所がぶれにくくなります。
登場人物クリップの割り付け
上にシーンを貼ると、クリップの割り付けが出ます。
仕組み
シーンをビートに区切ります。ト書きの一文ごと、台詞のひとやりとりごと(NAME: の行か、引用された一文)が1つのビートになります。読む速さの慣習を使って、ビートごとの画面上の秒数を見積もります。ト書きは1秒およそ3語、台詞は話す速さで1秒およそ2.5語に、息と反応のための余白を20パーセント足します。そのうえで、連続するビートを順番のまま、上限以下に収まるクリップに詰めます。各クリップのプロンプトには、まったく同じ連続性のヘッダー、前のクリップの EXIT STATE を引き継いだ ENTRY STATE の行、ビートの本文、目標の尺が入るので、連鎖がひとつのシーンとしてつながります。
シーンを AI 動画のクリップに割る方法
モデルが尺に上限を設けるのには2つの理由があります。クリップが長くなるほど計算の費用が急に増えること、そして生成が長く続くほど整合性が崩れること(顔が変わり、小道具が瞬間移動し、光がずれていく)です。だから Veo 3 を8秒より長くする設定も、Sora 2 で1回の生成から長い動画を得る方法もありません。AI 動画を延ばす確実な手立ては、複数クリップの流れだけです。シーンをビートに割り、クリップを別々に生成し、つなぐのです。
実際に効く連鎖のやり方は、地味で反復的です。モデルが画像からの生成に対応しているなら、あるクリップの最後のフレームを次のクリップの最初のフレームに使い、そして連続性の記述はすべてのプロンプトで丸ごと繰り返します。「さっきと同じ人物」と書いても何も起きません。モデルは前の生成を覚えていないからです。「赤いレインジャケット、短い黒髪」と繰り返せば効きます。その繰り返しこそがクリップ間の連続性を保つものであり、AI 動画クリップ設計ツールが自動化すべきものです。
クリップの継ぎ目は、動きの途中で切ると消えます。連続性の編集そのものと同じくらい古い作法です。動きの最中でクリップを終え(扉が開きかけ、頭が振り向きかけ)、次のクリップでそれを完結させると、観客の目が切れ目を橋渡しします。各プロンプトの EXIT STATE と ENTRY STATE の行は、その受け渡しを用意するためにあります。だからこそ Veo 3、Sora 2、Kling のクリップをつないで、紙芝居ではなくひと続きに見えるシーンにできるのです。
割り付けが決まったら、各クリップのカメラと照明の言葉は無料の AI 動画プロンプト生成 で詰めてください。連鎖のすべてのプロンプトが同じ映画文法を話すようになります。
向いている人
- AI 短編の作り手: AI 短編のシーン設計として使い、生成のクレジットを使う前に、脚本の各シーンを番号のついたカットの計画に変えられます。
- Veo 3 や Sora 2 を使う個人の作り手: 8秒に収めるためにシーンを削るのをやめて、実際につながる開始と終了の状態を持つクリップの連鎖を設計できます。
- 代理店と SNS のチーム: 30秒の広告を、チーム全員が読めるクリップの連鎖として立案でき、最初の生成の前に連続性を固められます。
シーンをクリップに分割: 完全ガイド
貼り付けたシーンをビートに区切り、語数から画面上の秒数を見積もり、上限以下に収まるようにビートをクリップへ詰め、まったく同じ連続性のヘッダーを持つ、そのまま貼れるプロンプトをクリップごとに書きます。
この作業で中心にある問題ははっきりしています。動画モデルは1回の生成を8から12秒に制限しているので、シーン全体はクリップの連鎖として設計する必要があるが、手でやると連続性と画面時間の計算が崩れる。放っておくと、後工程で摩擦が生まれ、判断が遅くなります。実務上の目標は番号のついたクリップの計画。クリップごとのプロンプト、つながった開始と終了の状態、そしてモデルの上限を決して超えない尺の見積もりつきです。
頭に置いておきたい限界: 語数からのテンポはストップウォッチではなく見積もりです。演技、カメラの速さ、モデルの解釈で実際の尺は動くので、クリップの時間は計画の目標として扱い、編集で詰めることを見込んでください。
進んだ使い方: 慣れた使い手は各クリップのプロンプトを最終フレームの条件づけと組み合わせます。クリップ1を生成し、その最後のフレームを書き出し、クリップ2の開始画像として渡し、書かれた連続性のヘッダーは同一に保ちます。モデルは視覚と文章の両方の錨を得られます。
手順
- 台詞を含めてシーンの本文を貼り、モデルの初期値か、自分で決めた上限を選びます。
- 連続性のかたまりに、人物の正確な見た目、場所、照明、スタイルを入れます。すべてのプロンプトで繰り返されるからです。
- クリップのカードを確かめます。尺、上限超えの警告、そして不自然に割れたビートがないかを見ます。
- クリップごとにプロンプトをコピーし(あるいは .txt で書き出し)、順に生成して、動きのビートでつないでください。
立場別の使いどころ
- AI 短編の作り手: クレジットを使う前に、脚本のシーンをカットごとの生成の計画に変える。
- Veo 3 を使う個人の制作者: 唐突なリセットではなく、動きの途中で切れる受け渡しを持つ8秒のクリップの連鎖を設計する。
- SNS チームの責任者: 30秒の広告を、連続性を先に固めた読めるクリップの連鎖として立案する。
避けたいよくある失敗
- 描写を丸ごと繰り返すかわりに「さっきと同じ人物」と書くこと。モデルは覚えていられません。
- 余白なしに上限ぴったりまでクリップを詰めること。生成が短く出たときに詰めるところがなくなります。
- 台詞の途中で割ること。口の動きと演技の連続性を保つのがほぼ不可能になります。
実務でのコツ
- 上限より1、2秒短く計画してください。どの生成にも編集で詰める余地が残ります。
- 動きの途中でクリップを終え、次のクリップでそれを完結させてください。動きで切ると生成のあいだの継ぎ目が隠れます。
- 企画ごとに連続性のかたまりの原本を1つ持ち、分割するどのシーンにも、そのまま貼ってください。
このツールの出力は、書くことの代わりではなく、判断を支える層として扱ってください。優れた脚本が記憶に残るのは、具体的な選択、感情の精度、ドラマの動きの明快さによってです。ツールは雑音を取り除くことで力になります。あなたの労力が、人物、対立、高まり、報いといった大事なところへ向かうように。ひと巡りごとに結果を見直し、採用した変更を明示的に記録しておけば、作業は稿を重ねるごとに速く、読みやすくなります。その一貫性こそ、プロの共同制作者が価値を置くものです。驚きが少なく、理由がはっきりしていて、意図をもって育っていく脚本です。
さらに詳しい質問
AI 動画モデルがクリップを8秒や10秒に制限するのはなぜですか。
理由は2つあります。尺が伸びると計算の費用が急に増えること、そして生成が長く続くほど時間方向の整合性が崩れて、顔や小道具が変わってしまうことです。短い上限は品質を保ちます。だから長いシーンは、代わりにクリップの連鎖として組み立てます。
シーン全体を扱うのに、いちばん良い進め方は何ですか。
シーンをビートに割り、モデルの上限以下にビートを詰めてクリップにし、すべてのプロンプトで同じ連続性のかたまりを繰り返し、開始と終了の状態をつなぎ、順に生成することです。このツールは、割り付け、時間の見積もり、プロンプトの組み立てを自動化します。
最後のフレームを次の最初のフレームにする連鎖は、どう機能しますか。
クリップ N の最後のフレームを書き出し、モデルが対応していればクリップ N+1 の開始画像として渡します。繰り返される文章の連続性のかたまりと組み合わせることで、切れ目をまたいで人物、衣装、照明が固定されます。
Veo ではなく Kling や Runway でも使えますか。
使えます。初期値が設定するのは最大の秒数だけです(2026年後半時点で Kling 2.x と Runway Gen-4 は10秒)。プロンプトはただの文章なので、どのモデルの入力欄にも貼れます。
クリップの尺は、シーンの本文からどう見積もられていますか。
ト書きは画面上の1秒あたりおよそ3語、台詞は話す速さで1秒あたりおよそ2.5語として見積もり、さらに20パーセントの余白を足します。ビートは最低1秒に丸められ、クリップが上限を超えることはありません。
ひとつのビートが上限より長いときはどうすればいいですか。
ツールが語の切れ目で分割し、該当するクリップに印をつけます。より良い直し方は書き直しです。長いビートを、自然な切れ目のある2つの動きに割ってから、分割し直してください。
よくある質問
1回の生成ではできません。手順は、シーンを8秒以下のクリップに割り、すべてのプロンプトで同じ連続性のかたまりを繰り返し、対応しているなら各クリップの最後のフレームを次の最初のフレームとして渡し、結果を編集でつなぐことです。この設計ツールが、その連鎖を組み立てます。
ト書きならおよそ24語(1秒およそ3語ぶんの絵として)、話す台詞ならおよそ16語(1秒およそ2.5語に、息と反応のための余白を20パーセント)です。だから半ページのシーンにも複数のクリップが要ります。
生成が毎回ゼロから始まるからです。モデルは前のクリップを覚えていません。直し方は、人物と場所の描写を、すべてのプロンプトで一字一句そのまま繰り返すことです。各クリップのカードにある連続性のヘッダーがそれをやっています。
クリップをつなぐためです。各クリップの EXIT STATE が最後のフレームを書き表し、次のクリップの ENTRY STATE がそれを繰り返すので、モデルは前のクリップが終わったところから始めます。開始画像を受け付けるモデルなら、前のクリップの最後のフレームを渡すのと組み合わせてください。
モデルの上限が天井です。2026年後半時点で、Veo 3 は8秒、Sora 2、Kling 2.x、Runway Gen-4 はおよそ10秒です。多くの作り手はあえて短いクリップ(4から6秒)で計画します。短い生成のほうがぶれにくく、編集でつなぎ目の選択肢も増えるからです。

クリップだけでなく、作品全体を設計する
ScreenWeaver は脚本を、シーンの分解、絵コンテ、ショットリストとつなぎます。いま設計したクリップの連鎖が、制作の残りの部分の隣に置かれます。無料で始められます。
無料で作品を設計する