乐于分享
好东西不私藏

AI白板动画全流程,四个工具零成本做出白板视频

AI白板动画全流程,四个工具零成本做出白板视频

AI白板动画全流程

四个工具,零成本做出百万播放的白板视频

AI视频这一波,大家都在聊模型。Sora 2能生成多长的片,VEO 3.1的高清画质有多炸裂,可灵3.0的Arena ELO评分多少。每天都有"惊爆",每天都有"炸裂",每天都有人告诉你"不知道就完了"。

但我一直觉得,模型从来不是瓶颈,流程才是。

你拿着全世界最好的画笔,不知道先画什么、再画什么、最后怎么收笔,照样画不出来。AI视频也一样——模型能力已经溢出了,但绝大多数人卡在"我怎么用这些工具,拼出一条完整的视频"。

想想大部分人用AI工具的方式:找一个最强的模型,打开输入框,然后——发呆。不知道让它先干什么、再干什么、最后怎么收。模型等在那儿,能力拉满了,但你脑子里没有流程,它就只能帮你生成一堆零散的碎片。

所以今天不聊模型,聊流程。一套从零到成品的AI白板动画全流程,四个工具,五步走完,零成本

我直接放流程,你就懂了。

第一步:ChatGPT生成脚本

整套流程的起点,是ChatGPT。不是让它帮你写一段话,而是让它当一个"选题策划师+哲学家+历史学家"。

你把下面这段提示词发给它:

你是一个类似于after school的YouTube频道的首席研究员、选题策划师、哲学家、历史学家、心理学家。你的主要任务是创作具有传播性的教育内容,目的是做出能够获得百万播放量的爆款白板动画视频。

after school是YouTube上做白板动画教育的顶级频道,选题直击人性痛点和认知盲区。你让ChatGPT对标这个频道,它就知道你要的不是科普小课堂,是有传播力的内容。

发完提示词,回复"生成选题",它会给你10个选题,每个带潜力评分。选一个,告诉它时长(5分钟或10分钟),它就给你完整脚本——每个场景包含旁白文本和画面描述。

这里我叠个甲,提示词不是万能的。它给你的10个选题里,可能有一半是水货。但只要有一个让你眼前一亮,就值了。这一步说明的问题很简单:模型再强,它不知道你想做什么。你得先定义"做什么",它才能开始干活。

第二步:ChatGPT拆分分镜

脚本有了,但还不能直接用。你需要把它拆成一个个独立场景,每个场景配一段可以直接喂给AI视频工具的画面描述。

这一步还是ChatGPT,换一段提示词:

你的角色是专业白板讲解制作人+AI分镜设计师。请将我提供的完整脚本拆分成独立场景,并为每个场景生成可直接用于AI视频生成的提示词。

关键在输出格式——每个场景输出四样东西:场景编号、场景主题、旁白文本、AI视频提示词(英文)。画面风格要求白板手绘,白色背景,黑色线条,有一只手在画面中绘画。

拆完之后,你就拿到了一份完整的"分镜本":左边是旁白,右边是画面怎么画。后面所有的生成,都对着这份分镜本来。

第三步:Google Flow生成画面

这一步是整个流程里最"重"的环节,但也是最炸裂的。

Google Flow集成了VEO 3.1模型,你把上一步生成的英文画面描述粘进去,它就给你生成一段白板手绘动画。白色背景,一只手从右侧伸进来,一笔一笔画出来。

每个片段消耗10个点数,免费账号每天50个点数,能生成5个片段。一条5分钟的视频大概需要15-20个片段,所以——多账号轮换。能薅也可以多薅。

这里说一个技巧:不要一口气全生成完。先生成前三个场景,看看画风对不对,不对就调提示词。风格稳定了再批量生成,省得浪费点数。

我一直觉得,AI视频的门槛已经从"有没有模型"变成了"有没有流程"。模型人人都能用,但谁能把模型串成一条生产线,谁就能批量出活。这一步最能说明问题——VEO 3.1能画,但你得告诉它画什么、怎么画、按什么顺序画。

模型不缺能力,缺的是你的指令。

第四步:11Labs配音

画面有了,声音还没有。

回到ChatGPT,让它把所有场景的旁白文本单独提取出来,按场景顺序整理成一份完整的旁白稿。

然后打开11Labs,选V3模型,支持70种语言。语音选择里筛选"英语口音→标准美国口音",试听几个,选一个你觉得最像"智者在娓娓道来"的声音。

把旁白文本分段粘贴进去,生成,试听,下载。一段一段来,别贪多。声音这东西,模型给的选择很多,但"哪个声音合适"这件事,模型替你做不了——你得自己听,自己判断。

第五步:剪映合成

最后一步,也是最简单的一步。

打开剪映,导入所有视频片段和音频文件。按场景顺序把视频拖进时间轴,对应旁白拖进音轨。手动调一下每段画面和音频的对应关系,确保音画同步。检查整体节奏,该剪就剪,该留就留。导出,完事。

这一步没什么技术含量,但它把前面四步串成了一条线。流程的意义就在这——每一步单独看都不难,但串起来,就是一条从零到成品的生产线。

最后说几句

整个过程,ChatGPT负责想,Google Flow负责画,11Labs负责说,剪映负责拼。四个工具,没有一个需要你会画画、会配音、会剪辑。你需要做的,就是定义"做什么",然后把流程跑通。

我有时候会觉得自己真的挺幸运的。正好赶上了这个时代,正好有了这些工具,能让你把脑子里那些乱七八糟的想法真的变成一个可以运行的东西。

以前做一条白板动画,需要编剧、画师、配音、剪辑四个人一周起步。现在一个人一下午零成本。这不是效率提升,这是创作力的解放。

下次你打开任何一个AI工具,
别急着问它能做什么,
先问自己:我的流程是什么?