ARTICLE · 1091180
一支20秒的AI视频做到了45秒,我们整理了这份开工清单

8月28日,客户确认了一份20秒脚本。
9月2日,第一版视频发进群里,已经37.292秒。客户看完后提出:入口案名不够突出,水流不明显,园林画面过多集中在水系,整体中轴也没有充分展示。
9月10日,视频最终以45.001秒的版本定稿。
我们重新看了一遍中间的63张项目群截图,也把第一版和终版按时间轴逐帧对照了一次。
真正把制作量越推越大的,不是某一次生成失败,而是三份没有同时确认的东西:
脚本、素材和验收标准。
它们看起来都在回答“这条视频要做什么”,实际上是三件不同的事。



01|通过的是脚本,不是开工条件
最初确认的脚本只有20秒,却已经写进入口、大堂、水系、玻璃桥、儿童区、园林主轴和单元大堂等多个节点。
而在脚本确认之前,制作端已经发现:一些节点的照片数量不够,一些只有相近角度,还有一些清晰度和景别不足,无法支撑连续镜头。
客户回复“可以”,确认的是卖点、台词和路线方向。
但这句“可以”没有同时回答:每个节点现在有没有可用素材?缺失的视角如何补?如果补不到,脚本该删、该换,还是允许弱化?
于是,脚本先承诺了要看见什么,素材却还没有证明这些画面都能做出来。
脚本确认不能代替素材确认。
对于依赖真实空间的地产视频,脚本旁边还需要一张素材矩阵。每个节点都要标明:可直接制作、需要补拍,还是目前无法实现。


02|第一版发出来,双方才发现“完整”的意思不一样
制作端更在意的是一条能走得通的归家路线:人物从入口进入,经过大堂和水系,再走向园林深处。镜头之间要有连接,不能只是把客户提供的照片依次放进视频。
客户更在意的则是另一个结果:项目园林要显得丰富、完整,除了水系,还要让人看到整体中轴和更多景观节点。
两种要求都合理,但它们会导向不同的片子。
一条20秒的叙事短片,可以只选择最能形成路线感的几个节点;一条强调完整展示的视频,则需要更多场景、更多机位,也自然需要更长的时间。
第一版和终版的时间轴把这种变化呈现得很直观:
第一版在29秒已经回到销售收束,33秒进入片尾; 终版在29秒加入园林俯拍,33秒加入中轴景观,销售收束被推到37秒,41秒后才进入片尾。
新增的7.709秒并不是简单把片尾拖长,而是补进了客户希望看到的园林信息。

双方真正没有提前回答的是:
这条片首先要“好看地走完一条路线”,还是要“尽量看全整个园林”?
最后采用的是平衡方案:保留归家路线,减少水系占比,再补园林和中轴段。视频也从最初的20秒计划,经过37秒初版,继续增长到45秒终版。

03|“把园林再丰富一点”,不能直接拿去制作
客户愿意补拍,也多次询问应该怎么拍。
但最开始的沟通仍然停留在“每个节点多拍一些”“尽量拍高清”。直到项目进入修改阶段,补拍要求才逐渐具体到高位全景、正对节点、近景细节和能够模拟移动视角的角度。
对AI视频来说,照片多不等于镜头多。
十张相似角度的水系照片,可能只能支撑一个方向的运动;一张能看清共同地标、道路走向和前后空间关系的全景,反而可能补出一段新的路线。
所以“再丰富一点”不是一个可执行的修改项。它至少要继续拆成:缺哪个节点、缺什么景别、从哪里拍向哪里、画面中必须保留什么地标。

这次项目后半段真正有效的补充,也不是继续往群里堆照片,而是围绕园林中轴和缺失节点重新指导机位,再从中挑出少量能形成新镜头的素材。
补拍的价值不取决于数量,而取决于它有没有增加新的镜头能力。

04|让版本停下来的,不是再生成一次,而是一张修改单
初版反馈出现后,讨论一度散落在文字、图片和现场补拍中。
直到9月4日,制作端把变化收成四项:入口保留项目案名,增强水流表现,减少水系占比并增加园林节点,同时调整整体亮度。客户确认后,制作才重新获得了一条清晰的执行线。
这张修改单的价值,不只是记录了要改什么。
它还暂时结束了“边看、边想、边补”的状态,让所有人重新站到同一个版本上。

9月10日,45秒新版本发出。客户的第一反应是“比之前好很多”。随后,群里又出现了丰富文案、调整色调、让人物更自然等建议。
这些听起来像小调整,但如果新文案要由画面中的人物说出来,就会连带触发口型、镜头时长、人物动作和剪辑节奏的重新生成。
改动成本从来不由“多了几个字”决定,而由这些字落在字幕、画外音,还是可见人物口型上决定。
制作端说明了继续调整的影响,客户最终回复:
“这个就以此定稿了。”
项目完成了,但它也留下了一个很清楚的提醒:群聊可以用来讨论,不能代替版本管理。每一版都需要一份集中反馈,并明确哪些是必须修改、哪些是建议优化、哪些已经属于新增需求。

一份可以直接使用的“地产AI视频开工五问”
复盘完这次从20秒到45秒的过程,我们把最应该前置的确认,压缩成了五个问题。
下一支地产AI视频开工前,客户、项目经理和制作团队最好一起回答:
成片首先要好看地讲完一条路线,还是尽量看全所有节点? 脚本里的每个节点,现在真的有可用素材吗? 这一版到底按多少秒、多少个场景和多少个人物镜头执行? 文案修改会落在字幕、画外音,还是可见人物口型? 谁负责把反馈分成“必须改、建议优化、新增需求”?

这五个问题并不复杂。
但如果没有人在开工前问,它们就会在成片之后,用补拍、返工和越来越长的时长重新出现。

最后的判断
一支AI视频从20秒做到45秒,并不一定是谁突然增加了要求,也不一定是谁控制不住制作。
更常见的情况是:大家确认了脚本,却没有同时确认素材能不能做到,也没有确认最后用什么标准判断它好不好。
AI降低了生成画面的门槛,却不会自动替一个项目完成范围管理。
真正决定交付效率的,仍然是开工前把不确定性说清,把每一次变化变成所有人都看得见、可以确认的选择。
制作| 吕杰、于妍娇撰稿| 吕杰

