AI电影制作阅读约30分钟

我如何用AI从头到尾做出一部日式动画

两集,38分钟成片,一个人,一个工作台。第二集花了1,850美元和75小时。剧本、分镜、送入生产,全部在ScreenWeaver里完成,逐个工具讲清楚:Living Story Map、story elements、Documentalist、reference sheet、Generate shots from scene script、Auto-generate、节点式工作流引擎,以及在生成第一帧之前就已经完整画好的3D预演分镜板。

Try Screenweaver
ScreenWeaver的分镜视图,一部AI制作的日式动画:九张预演板和剧本并排

**先说结论:**两集,38分钟成片,一个人,一个工作台。第二集花了1,850美元和75小时。剧本在ScreenWeaver里写完、画完分镜、送入生产,生成器从来不是瓶颈。做决定才是。下面是真实的流水线,逐个工具讲,包括哪里失败了、用什么替代了。

Lost Garden是一部黑暗奇幻剧集,讲的是世界终结二十个世纪之后苏醒过来的空盔甲。第一集17分钟,第二集21分钟。没有工作室,没有团队,没有外包。

我不会告诉你AI让这件事变轻松了。它没有。它去掉的是等待。这样的项目以前总是死在“我得先找到预算”这一步,然后半年过去,你已经在忙别的了。它从来没有因为找不到会画画的人而死掉。会画画的人到处都是,而且画得比任何模型都好。


先看成片

下面全是过程。先看看它产出了什么,你再判断这套方法值不值得你花时间。

第一集,The Awakening of the Lantern Knight,17分钟:youtu.be/eZ_JlaLDJ-8

第二集,The King Beneath the Vault,21分钟:youtu.be/z-YRrutXaFE

两集都在lostgarden.world,附有媒体资料包。

Lost Garden的六张成片画面:Bourdon的火焰胡须、源树、悬崖上的城堡、纪念章里的Rose、架子上的老鼠们、双刃出鞘跃在半空的Serrure

这些是成片画面,直接从剧集里截出来,没有任何修饰。读下去的时候记住它们,因为从这里开始的每一张截图,都是它们背后的机器。


整件事的地图

ScreenWeaver分三步,两集都是按这个顺序做的。

步骤做什么在ScreenWeaver的哪里
Write剧本、结构、角色、地点和道具Script tab、Living Story Map、story elements、两个AI代理
See每场戏拆成镜头,每个镜头变成一张分镜板Storyboard tab:reference sheet、镜头拆分、shot panel、Auto-generate
Build定稿的分镜板变成图像和视频生成工作流引擎:从剧本预先接好线的节点图,末端接着Seedance和它的同类

之后是对输出的收尾:配乐、剪辑、字幕、发行。那部分很短。有意思的是前面的一切。

有一条规则凌驾于三个步骤之上,所以先讲它。


那条决定了其他一切的规则

每两到三秒切一次。

镜头一长,AI视频就散架。手在飘,脸在滑,背景在呼吸。每个模型都这样,而且劣化不是线性的:一个镜头两秒时没问题,四秒开始发软,八秒就没法用了。

所以我不再让镜头拖长。这不是风格选择,是求生手段。第二集21分钟里大约有400个镜头。

然后发生了一件我没有计划的事。限制变成了风格。动画本来就切得快。停两秒、硬切,看起来像是刻意的导演处理,而不是补救。我因为不得已而做的事,成了大家夸的东西。

在生成第一帧之前就把这条写进你的流程,因为它改变镜头数量,镜头数量改变分镜板,分镜板改变剧本。在ScreenWeaver里它具体改变一样东西:你在镜头拆分之前写的拍摄方案,See那一步会讲到。


第一步,Write:剧本必须一直是唯一的事实来源

这类制作最大的时间黑洞不是生成。是来回折腾。

你在一个工具里写。在另一个工具里画分镜。你改了一句台词,分镜板错了两天你才发现。你改了一个镜头,剧本描述的就不再是画面里发生的事。

ScreenWeaver不让这种偏移存在。剧本是竖的,结构是横的,它们是同一份文档。

Living Story Map

Script tab底部的横向序列器随时显示幕、段落和节拍。做剧集的话,层级是集、幕、段落、故事节拍、场。点一个段落,剧本滚到那里。把一个节拍拖到别处,页面跟着走。

我把它当剧集的节奏表来用。当一个段落长得超过邻居时,你在地图上先看到,然后才在阅读中感觉到,那就是该砍的时候,而不是等分镜板做出来之后。

story elements和@提及

剧集里的每个角色、地点和道具都作为一个story element存在。在剧本里,你用@来调用它们:输入@ser,Serrure弹出来;输入@bel,铸钟坊弹出来。这不是便利功能,而是剧本和下游一切之间的连接点。活在剧本里的那个元素,就是Storyboard tab要画、工作流引擎要渲染的那个元素。

AI Center,正在导入第二集的Final Draft文件,列出进行中的生成任务

第二集是以Final Draft文件的形式通过AI Center进来的,落地时角色和地点已经分好成story elements。一个字都不用重打。在我写下任何一句新台词之前,这一集的演员表就已经存在了。

我真正用上的两个代理

ScreenWeaver有两个AI代理,分工不同,各自派上用场的方式也不同。

Documentalist掌管项目的设定集。Lost Garden的正典就住在这里:十三位骑士是谁,摘钩者确立之后纪念章为什么必须保持关闭,源之子是什么。当一句台词和设定集里已有的事实矛盾,它会指出来;当剧本里冒出一个新名字,它会问这个名字是否属于这里。做剧集的时候,这是我最不想凭记忆去干的活。

Virtual Spectator像观众一样阅读,在你写的时候对节奏、张力和清晰度做出评论。它的意见我不全收。我收关于节奏的那些,因为节奏是你从自己剧本内部看不见的东西。

两个都不会替你写一个字。这正是重点。

导出,因为行业格式依然重要

整个项目随时可以导出为PDF和Final Draft。配音演员拿到的是PDF。FDX回到了我的存档里。在ScreenWeaver里写作,没有任何东西把你锁死。


第二步,See:先角色,后镜头

这是大家跳过的一步,也是大多数AI电影看起来像一个装满漂亮却互不相关图片的文件夹的原因。

这也是我在第一集做错、第二集重新做对的一步。Lost Garden的每个角色现在都有三份文档,三份文档各干一件事,不能合并。

  1. **reference sheet。**角色长什么样,在Storyboard tab里生成一次,附在他出现的每一张分镜板上。
  2. **pinned description。**生成参考表所依据的那一段文字,也是关于这个角色唯一能到达图像模型的东西。
  3. **表演卡。**角色怎么动、怎么说话、怎么反应,以及他永远不做什么。这份放在Documentalist的设定集里。

跳过第一份,角色会漂。跳过第二份,每个镜头都是一场谈判。跳过第三份,几乎所有人都跳过了这份,你的角色看起来完美,却在每场戏里表现得像另一个人。

reference sheet,以及为什么它是规格说明,不是一张画

在Storyboard tab里,左侧的实体面板列出场景中的每个story element。每个元素都有一个情绪板,里面有一个pinned description区块。Generate reference sheet读取那个区块,产出参考表:三视图,白底,平涂,没有打光,没有姿势。

Serrure的角色设定表:正面、侧面和背面,一身深色板甲,钥匙孔头盔,胸甲上一把金钥匙

这里每一个选择都是刻意的,而且每一个都和你想做的相反。

**三视图,不是一张。**正面、侧面、背面。救你的是背面图,因为那是你从来不会想到的视角,直到你需要一个过肩镜头,才发现你从来没决定过披风的背面是什么样。

**白底,不打光。**参考表一旦打了戏剧性的光,引用它的每一张分镜板都会继承那道光。你要的是物体,不是氛围。

**没有动作姿势。**一个中性站立的角色读起来是“他就是这样”。一个跃在半空的角色读起来是“再来一次这个”,然后你会永远得到那一跳的各种变体。

提灯骑士的角色设定表:白色提灯头盔带提环,棕褐色披风,华丽的肩甲,三视图

道具画进参考表,因为道具最先漂

看看Bourdon的参考表。他是个铸钟的石头巨人,参考表上他背着一个宝塔顶的架子,挂着三口钟,腰间一把锤子和一把火钳,还有一只小小的黄铜茶壶。

Bourdon的角色设定表:火焰胡须的石头巨人,背上的钟架,锤子、火钳和黄铜茶壶,顶部附头部细节图

茶壶和他的职能毫无关系。它在那里,是因为它用一件物品就告诉你他是谁,也因为**道具是最先漂掉的东西。**剪影能撑过三十张分镜板。配件到第四张就开始变异:锤子变成斧头,火钳变成钳子,茶壶消失。把它们画进参考表,在pinned description里写上名字,它们就会回来。

注意顶部的头部细节图。Bourdon有特写,而全身转面图在那个比例下装不下足够的面部信息。如果一个角色在这一集里有特写,参考表就需要一张头部习作。

把剪影设计到缩小了也认得出

Barrik的角色设定表:一个开着两个眼孔的木桶身体,铁箍,短短的装甲腿,正面和背面

Barrik是一只长了腿的木桶。在时间线条里缩到四十像素高,他依然一眼就是Barrik。

这不是拿设计开玩笑,这就是设计。在一部每两秒切一次、用了大量大远景的剧集里,只有在中近景才认得出的角色,是一个你没法调度的角色。

测试方法:把参考表缩到Storyboard tab底部时间线条的高度。如果看不出是谁,剪影就没做完。Serrure是一条带钥匙孔的细长竖线。Lanterne是顶上有个环的小方块。Bourdon是一座顶着屋顶的山。

Barrik还背着全剧最难守的一条规则,用大写字母写在他的pinned description顶端:**他没有头,也没有头盔。**木桶同时是他的头和身体。没有圆顶,没有帽子,永远不戴提灯头盔,那只属于提灯骑士一个人。没有这一行,每次生成迟早会试图给他安一个头,因为训练数据里没有长脸的木桶,却有的是骑士。

pinned description是模型唯一读到的东西

这是Bourdon的,没有改动,和他情绪板里的一模一样:

石头巨人,有一座门楼那么大。一双苍白、像是失明的眼睛,一把活火焰做的胡须,笑的时候会发光的裂缝。为一个不再回应的王国铸钟。先笑,边想边说,慢慢做决定。

这段话里有两点比看上去更要紧。

它包含可以测量的事实。“有一座门楼那么大”是我可以在画面里核对的限制。“笑的时候会发光的裂缝”是有条件的:他笑的时候才发光,不是一直亮着。正是这种句子让一个角色活着,而不是一动不动。

最后一句根本不是在讲外形。“先笑,边想边说,慢慢做决定”对参考表几乎没用,却是这段话里最值钱的一句,因为它让他的台词在二十分钟里保持一致。它其实是一句表演卡的内容漏进了描述里,我故意留在那儿。

表演卡:没人写的那份文档

第三份文档才是拉开差距的那份,它是写给我自己和配音表演的,不是写给任何模型的。它放在Documentalist的设定集里,紧挨着正典,因为那是一个一致性代理真正能用上它的地方。

我的表演卡开头都有一句划界线的话:表演卡,不是设计表。Serrure那份里的一部分:

**身高是比例,不是数字。**正典只固定一件事:Serrure比提灯骑士高半个头。绝不更多。米数只作为提议记下,标注为待批准,因为一个米数是猜测,一个比例才是事实。

**一套肢体词汇。**面对Lanterne,他的肢体动作具体而且可以重复:在胸甲上拍两下,弹一下提灯头盔,一只手搭在肩上,用手转动头盔告诉他往哪儿看。有一张可复用的手势清单,角色才不会每一集都换一套肢体语言。

**语速。**温暖,中低音,略微沙哑。大约每秒两个词,带真正的停顿。然后是真正指导表演的那一句:一句台词结束得太早是对的,拖长了是错的。

**一个写作习惯。**Serrure先安抚人,三秒后又自己拆自己的台,半压着嗓子,不回头。“我从不出错……几乎从不。”这个习惯一旦写下来,谁都能写出一句像他的台词,包括凌晨两点的我。

**一个稀有信号,受保护。**当Serrure不再开玩笑、声音沉下去变平的时候,就是真出事了。表演卡写得很直白:这种反差是全剧最好的戏剧工具,而且只有保持稀有才管用。这句话已经三次拦住我没去用它。

表演卡里最值钱的部分,是角色永远不做的事的清单

我每一份表演卡的结尾都有一个“永不”段落,那是我翻得最多的部分。

Serrure从不靠吼叫压人。他从不发表演说。他从不扮演国王或英雄。他从不绊倒,从不失足,从不被布景吓一跳。

提灯骑士的清单更严,因为他是更难的那个角色:

  • **他从不说话。**一个字都没有,永远没有。他只发出空洞的金属声:轻微的吱嘎声,听起来像呼吸的共鸣,咔哒声,怯生生的敲击声,带疑问的嘶声,还有受惊时的一声哐当。
  • **他从不摔跤。**不打滑,不跌倒,不撞上布景。他的喜感来自好奇心,从来不来自笨拙。
  • 他从不自己发光,而且他的纪念章永远不露出来。

第二条是我不得不最常捍卫的一条,因为一个身处巨大危险世界里的小圆角色,总是不断有人想让他摔一跤。一个会绊倒的角色是一个让人可怜的角色,而这一个必须一直勇敢。

至于另一个,“从不绊倒,从不失足”在第一集结尾产出了这个画面,Serrure赶到,把提灯骑士从一场快输掉的战斗里拉出来:

成片里的Serrure,在蓝光中跃起,双刃出鞘

他所有的情绪都只能从身体走:头盔的倾斜、姿态、手势、迟疑。他头盔顶上的提环在他快速移动时会晃动,惊慌时的颤抖就是靠它演出来的。那个环是一件干着演员活儿的道具,而它管用,只因为它画在参考表上。

其余的演员

穹顶之王、摘钩者、黑暗骑士和披甲者的角色设定表

出场超过一次的人物一律同样处理,包括反派,也包括竞技场那场战斗里的对手,那只生物。只出一场戏的角色,只要那场戏超过三个镜头,也有参考表,而按两秒一切的节奏,这意味着他们中的大多数。

描述写一次,参考表生成一次,从此每一张分镜板都引用它。这就是为什么我的两位骑士在第380个镜头里还是他们自己。


第二步,续:让场景自己提出分镜方案

一张空白的镜头表是电影制作里最慢的一页。

Generate shots from scene script读取你已经写好的场景,逐个镜头提出覆盖方案,每个镜头都带景别、运镜和一句动作描述。我大概保留六成,其余重写,但这比空白页快得多,而且它总能可靠地抓住我老是忘记的那个镜头。

竞技场场景上的Generate shots from scene script,拍摄方案写在建议镜头列表上方

镜头列表上方那个字段才是干活的地方。在任何建议生成之前,你在那里用大白话写下拍摄方案。这是我在第二集竞技场打斗里用的那句:

整场打斗都和Serrure一起待在岩架上。我们从不取战斗者的视角,只取旁观的那两个人的视角。

这一句话决定了九个镜头。它也是这场戏全部的戏剧构思:打斗不是主题,看一个陌生人打斗的两个角色才是。没有这一行,拆分给你的是一场合格的动作戏。有了它,你得到的是这一集需要的那场戏。

写意图,不写镜头。镜头自己会来。

这是同一个tab在一场完全不同的戏上的样子,抵达城堡。十个镜头,不同的实体,不同的意图:先给尺度,脸留到后面。

大厅场景的分镜视图,十张预演板,穹顶之王作为一个实体

再看脱离界面的这十张板。灰色的粗模,火焰所在处一块平涂的橙色,没有脸。分镜板的作用是定构图和调度,一张好看的分镜板会在这两件事上撒谎。

抵达城堡,十张分镜板,火焰用橙色标出

shot panel:三个字段,三个都进提示词

镜头3.6的shot panel,有景别、运镜和动作描述

ScreenWeaver里每个镜头带三个字段,正好就是一张分镜板需要的三样东西:

  • 景别,从固定列表里选:大远景、远景、中远景、中景、中近景、近景、大特写、插入镜头、过肩、主观视角。
  • 运镜:固定、缓慢推进、缓慢移动、甩镜、手持。
  • 动作描述,唯一的自由文本,用句柄引用实体。

镜头3.1的动作描述是:

@serrure和@lantern-knight趴在岩架上,往下看向深坑。保持全景,直到刀刃回应。

@句柄会解析到参考表,所以分镜板生成出来时里面是对的骑士。第二句是我写给自己的关于时机的备注,没有任何模型会读它,但它决定了剪辑里的切点。

关于那段自由文本再说一点。“Cinematic”什么都给不了你。它是AI电影提示词里最常见的词,却不携带任何信息。改成点名手法:负空间、明暗对比的底光、纵深双人构图、主体只占画面高度八分之一的大远景。景别字段已经替你做了一半,这就是它是一个列表而不是文本框的原因。

Edit with AI、Regenerate,以及什么时候用哪个

每个shot panel上有两个按钮,它们不是同一个按钮。

Regenerate用同一条提示词再跑一遍。构图对了、渲染不对的时候用它。

Edit with AI接收一条指令,修改现有的分镜板:把镜头放低,把Serrure挪到左边,把火烧大点。渲染对了、构图不对的时候用它。它比重跑便宜得多,因为你保住了已经对的部分。

第二集里,每张保留的分镜板大约对应2.4次生成,也就是400个镜头不到一千次生成。如果你为一张能用的板要重跑六次八次,问题几乎从来不在模型。是动作描述没有点名手法,或者镜头没有指向一张参考表,或者这个镜头根本不该存在。

Auto-generate,以及它强加给你的顺序

铸钟坊场景的分镜视图,Bourdon和老鼠们作为实体

时间线栏里的Auto-generate按钮打开一个对话框,里面有三项任务,按这个顺序:缺失的实体reference sheet,然后是还没拆分镜头的空场景,然后是缺失的镜头图像。Run all按顺序跑完它们,每一步最多三个并行。

这个顺序就是方法本身。参考表先于镜头,镜头先于分镜板。对话框不会让你给实体还没有参考表的镜头生成分镜板,还会告诉你为什么。第一次被它拦住我很恼火。第十次我明白了,它刚刚帮我省下了一整场角色漂移的戏。

这是那一轮在铸钟坊场景上产出的东西:没有贴图的灰色黏土,没有五官的人偶,火用一块平涂的橙色标出来,因为分镜板就是干这个的。全是灰色,只有镜头的主角有一种颜色。

铸钟坊场景的分镜板:灰色黏土粗模,火用平涂橙色标出

这是成片里的同一场戏:

成片里的Bourdon:石头的脸,苍白的眼睛,一把活火焰的胡须照亮身后的钟

锁住对的,导入已有的

Storyboard tab里有两样东西听起来不起眼,其实不是。

定稿的分镜板可以锁定。锁定的板从此永远不会再被Run all碰到。竞技场那场戏一旦对了,之后对这一集其余部分又跑了三轮,它一直是对的。

你还可以把自己的画面导入为分镜板:你自己的参考图、你自己的渲染、上一集的某一帧。Lost Garden用得不多,但一个已有的项目就是从这扇门走进来的。

竞技场,已锁定。九张板,刀刃用青色标出,从这一刻起没有一张再改过。

竞技场打斗的分镜板,九张,刀刃用青色标出

Try it free

Try Screenweaver for free on your script

It is free. Import your existing project, get a clearer view of your outline, and regain control of your story structure in minutes.

Start Free

第三步,Build:工作流引擎

这是把一张分镜板变成一个镜头的部分。

ScreenWeaver的Production一侧是一张节点图。不是一个带Generate按钮的表单,而是一张你能读懂的真正的图:源场景、画面指令、参考、图像、视频、输出。这张图从剧本的上下文预先接好线,所以场景的文本、镜头的动作描述、实体的参考表,在你打开它的时候就已经连到了正确的节点上。

每个节点都可以编辑。这才是关键的一句。预接线去掉的是搭建,不是控制。换图像模型或视频模型是换一个节点,不是重建一条流水线,这就是让一部剧集能在模型排行榜不断变动的情况下活下来的原因。

Lost Garden一个镜头的图长什么样

第二集里一个典型的镜头:

  1. 源场景携带剧本文本和镜头的三个字段。
  2. 画面指令把它变成图像提示词,并点名构图手法。
  3. 参考附上动作描述里每个@句柄的参考表。
  4. 图像产出静帧。定稿的分镜板在这里作为参考进来:让模型去渲染这张板,而不是自己发明画面。
  5. 视频接收静帧、运镜字段、那句台词,以及一段角色声音的简短参考录音,产出带声音的片段。Lost Garden用的是Seedance 2.5,而模型是一个可以替换的节点。
  6. 输出收集静帧、片段和素材,带版本。

声音值得单独说一句。两集里几乎每一句台词都是Seedance 2.5根据角色的参考音频说出来的,几秒钟Serrure听起来像Serrure的声音,附在他说话的每一个镜头上。每个角色一段参考,这就是让一个声音在四百个镜头里保持一致的东西。输出上没有单独的配音环节,没有单独的音频工具:片段从节点里出来时就已经在说话了。

那张图里的每一条视频提示词都带着一条固定指令:no music。如果你让每个片段自己生成音乐底,三十九个片段听起来就像三十九部电影。混音里救不回来。配乐是对定剪成片的单独一道工序,在后面讲。

版本和审片,钱就花在这里

输出是分版本的。一个镜头的每次生成都留在这个镜头上,和之前的挨在一起,由你来挑。这听起来像是存储功能。它是预算功能。

AI电影制作里昂贵的错误不是一次糟糕的生成,而是漂漂亮亮地生成了一个星期,然后发现手里是一块情绪板而不是一段戏。在图里把一个镜头的几条素材并排比较,你才会注意到能剪进去的那条很少是最漂亮的那条。在那里做这个决定不花钱。到剪辑时才发现要花一天。


一句台词,从头走到尾

上面的一切,串成一条线来看更容易相信。这是第二集的一句台词,从设定集到成片画面,以及它所经过的每一个ScreenWeaver步骤。

1. 表演卡决定这是哪一种台词(Documentalist)

Serrure的表演卡说他边想边说,说他问的是自己已经知道答案的问题,说一句结束得太早的台词是对的。它还说,他停止开玩笑、声音变平的那一刻,是那个稀有信号。

这就是那一刻。他刚在深坑里听到了什么。所以这句台词必须短,而且必须是他先对自己说、再对别人说的一句陈述。

2. 剧本(Script tab)

EXT. THE ARENA - CONTINUOUS

A voice comes up out of the pit. SERRURE stops dead.

                    SERRURE
              (startled, hushed)
        ...That's an armor voice.

                    SERRURE
             (shouting with joy)
        It's one of ours! Quick, Lanterne, come on!

四个词扛起了这一集的主题:他们已经很久很久没有遇到过同类了。括号里的提示不是装饰,它是四步之后配音环节的表演指令。

3. 拍摄方案(Generate shots from scene script)

整场打斗都和Serrure一起待在岩架上。我们从不取战斗者的视角,只取旁观的那两个人的视角。

4. 镜头(shot panel)

镜头3.1。远景,固定,低角度。动作描述:

@serrure和@lantern-knight趴在岩架上,往下看向深坑。保持全景,直到刀刃回应。

5. 声音(Video节点)

这句台词和Serrure的参考音频一起进入视频节点,和剧本里写的一模一样:括号提示、省略号、停顿。

“...You hear that?”开头的省略号压住了起音。没有它,这句话一开口就很响,节拍就丢了。

**“Quick, Lanterne... come on!”是一句话,不是两句。**拆成两个片段时,出来的是两声层层升高的喊叫。用省略号连起来,它读起来是同一股冲动。

揭示前后各两秒的静默比任何形容词都管用,而且它写进了提示词,不是留给模型自己决定。静默就是表演。

6. 分镜板,以及由它渲染出的镜头(Storyboard tab,然后Build)

左边是分镜板,右边是最终渲染,竞技场场景的四个镜头

左上角是镜头3.1:两位骑士趴在岩架上,往下看,保持全景。分镜板和成片里是同一个构图。

这就是浓缩在一个镜头里的整条流水线。一条设定集规则产出一句台词,台词产出一个括号提示,括号提示产出一条配音指令,拍摄方案产出构图,构图产出分镜板,节点图把分镜板渲染成片段。


收尾:ScreenWeaver的输出之后发生了什么

从这里开始的一切都发生在导出的片段上,声音已经在里面了。这部分很短,而每一条都是用一次素材或一次渲染换来的教训。

为什么空盔甲是我没有刻意做出的最好决定

我的主角是空的盔甲。他们没有嘴。永远不存在需要对上的口型。

这听起来像个细节。它却是声音之所以能住进视频节点的原因。一条声音对了、画面不对的素材,或者反过来,永远不会逼你把另一个也重来一遍,因为没有嘴需要对齐。改一句台词,重新生成片段,别的什么都不动。

如果你在从零设计一部AI剧集,先决定这件事,再去设计角色。头盔、面具、生物、动物,任何看不见嘴的东西,都能给你换来巨大的制作自由。

配乐,在定剪之后

六首原创曲,在定剪之后对着画面写,一次过,整集由同一位作曲者的耳朵把关。先剪,后配。电影一百年来都是这么做的,而视频模型里那个音频按钮在诱惑你放弃它。

工作标题时长放在哪里
Inexorable Ascent5:00漫长的攀登,世界的尺度
Song of the Empty Sky5:00开阔的段落,如今的世界
Clockwork Requiem3:30机器,那些还在运转的东西
The Giant and the Knight3:30铸钟坊,Bourdon
Ash Lantern Prayer3:18安静的守夜
The Knight's Lullaby2:30摇篮曲动机,在两集里反复出现

发行时它们改了名,因为工作标题告诉你一段配乐放在哪里,而发行标题必须作为一首独立的曲子成立。两份工作,两个名字。

剪辑,以及一个编码器参数

剪辑用的是DaVinci Resolve Studio,付费版。每集大约400个片段,调色用一张节点图,一条母版,然后由它生成所有交付格式。

如果你的源文件是一条长母版,而ffmpeg的CPU占用停在零,它不是卡死了,是在探测文件。给它留点余地:-probesize 20M -analyzeduration 10M。在最终混合上,-x264-params no-fast-pskip=1值得它那几个百分点的码率,因为大面积平坦的暗部,也就是这部剧的大部分画面,否则会出现看起来像画面冻住了一样的块状伪影。

字幕,以及一个免费抓幻觉的技巧

两集都有英文和法文字幕,带词级时间戳,字幕落在那个词上,而不是它附近。

Whisper在第一集的纯音乐段落上生出了六句幽灵般的“I'm sorry”。免费抓住它们的办法:把可疑的段落单独再转写一遍。真实的语音每次转写结果都一样。幻觉不会:同样八秒的音乐,整段转写时给出“I'm sorry”,单独转写时给出“I'm not going to die”。两次结果对不上,这就是幻觉的标记。这一步检查去掉了每一句幽灵台词,保住了每一句真话,包括十八秒处一句耳语般的“Find me”。

再补两条:先烧字幕,再把横向母版转成竖版,永远不要反过来。还有,先量你的黑边。我的母版上下各有130像素的黑边,所以字幕落在黑边里,永远不会挡住画面。

发行

完整一集上YouTube。转成9:16、烧好字幕的竖版上TikTok和Instagram。一个省下一次重剪的发现:在Instagram上,视频帖子允许六十分钟,Reel只允许三分钟。完整一集是作为帖子发的。


花了多少钱,时间去了哪里

第二集1,850美元和75小时。75小时大约是九个工作日,换来21分钟成片。

最大的一项是通过工作流引擎的生成,包括配音,因为它们是从视频节点里出来的。其次是配乐。写作和分镜花的是时间,不是钱。

有意思的数字是做决定和生成之间的比例。在分镜板上花的每一个小时,大约省下了五个小时去生成我根本不需要的镜头。这就是这类制作的全部经济学,也是流水线从Script tab开始而不是从视频节点开始的原因。


如果重来,我会怎么做

**在第一张分镜板之前写pinned description,而不是在第十张之后。**一致性这一课我在第一集付了昂贵的学费,第二集才做对。

**在镜头拆分之前决定切换时长。**每个镜头两到三秒不是后期的决定。它让镜头数量翻倍,它属于拍摄方案。

**至少设计一个没有嘴的主角。**它换来的制作自由,远远超出这个限制本身。

**分镜板一对就锁。**Run all很快,而且会高高兴兴地把你已经做完的一场戏重做一遍,除非你告诉它别碰。


接下来去哪儿

如果你想要的是抽象的流水线而不是这个案例,从从剧本到银幕的AI电影制作工作流开始。如果你想看它实际发生,如何制作一部AI电影是完整演示。如果你只想要分镜那一步,分镜生成器如何用AI从剧本生成分镜讲得很到位。

如果你从这整篇文章里只带走一件事:工具不是瓶颈。做决定才是。

两集都可以免费观看。第一集第二集,其余一切都在lostgarden.world。第三集正在ScreenWeaver里写,扛起它的是Barrik,那只木桶。

Final Step

Build your next script with Screenweaver

Move from ideas to production-ready pages faster with timeline-native writing and AI-assisted story flow.

Try Screenweaver
ScreenWeaver Logo

关于作者

ScreenWeaver 编辑部由资深电影人、编剧和技术人组成,他们要做的事,是把想象和制作之间的距离缩短。