乐于分享
好东西不私藏

AI漫剧五步实操指南 照抄就能跑通

AI漫剧五步实操指南 照抄就能跑通
不需要画工,不需要剪辑经验。一台电脑或手机,三四个免费工具,半小时出第一条成片。

我第一次试着做AI漫剧,花了整整一个下午,出来的东西连自己都看不下去。角色每张图长得不一样,画面像PPT翻页,配音像机器念经。
后来我把流程拆成五步,每步只做一件事,换了几个工具搭配,突然就通了。半小时一条,画面稳,角色不崩,节奏也像那么回事。
这篇文章就是我当时最想要的那份说明书。五步照做,模板照抄,第一条成片今天就能出来。

开始前要准备的

三样东西就够。一台能上网的电脑,手机也行。一个豆包账号,免费。一个即梦AI账号,每天有免费额度。手机上装个剪映,也免费。
如果你之前从没碰过AI绘图和视频工具,不用慌。这篇教程假设你什么都不会,每一步都附了现成的提示词,直接复制粘贴就能跑。

第一步 写出分镜脚本

很多人一上来就让AI「写一个漫剧剧本」,出来的东西根本没法用。情节太虚,画面描述模糊,生成图片的时候AI完全不知道要画什么。
正确思路是让AI输出结构化的分镜表,每一行对应一个镜头,有画面描述,有人物动作,有台词,有时长。
打开豆包,把下面这段提示词直接贴进去。
帮我生成1集AI漫剧分镜脚本。题材【古风重生逆袭】,时长约60秒,9:16竖屏。要求- 开头3秒要有强冲突钩子- 中间有爽点转折- 结尾留悬念- 台词简洁口语化,每句不超过12字输出格式,每个镜头包含镜头编号 | 景别(远景/中景/近景/特写) | 场景描述 | 人物动作与表情 | 台词 | 时长(秒)共15到20个镜头
出来以后别急着用。快速扫一遍,把模糊描述改具体。比如豆包写了「她很生气」,你就改成「她攥紧拳头,眼眶发红,嘴唇微抖」。AI画图需要这种具象描述,模糊词出不来你要的效果。
这步大概15分钟,出来的是后面所有工作的导航图。

第二步 锁定角色形象

这是整个流程里最容易翻车的地方。角色变脸是AI漫剧的头号杀手,观众刚看入戏,女主突然从瓜子脸变成圆脸,瞬间出戏。
解法很简单。先花十分钟给每个主要角色生成一张基准图,后面所有镜头都拿这张图当参考,强制锁定。
打开即梦AI,进入AI图片生成,输入角色提示词。
国漫风,20岁女主,黑色长直发,杏眼,身穿红色汉服,面容清冷,气质坚韧。正面照,半身,高清,8K,纯色背景,角色设计图,三视图风格
把括号内容换成你自己的设定就成。生成3到5张,挑一张最满意的保存到本地。这就是你女主角的定妆照。
男主、反派、配角依次照做。每人的基准图都单独存好,文件名写清楚角色名,后面不会搞混。

第三步 批量生成分镜图

剧本有了,角色定了,现在把这些变成一张张画面。
回到第一步的分镜表,从镜头01开始。打开即梦AI,选择图生图,或者在文生图模式里上传参考图。把角色的基准图传上去,开启「角色参考」功能,这个选项在高级设置里。
然后输入这个镜头对应的画面提示词。套这个公式就行。
景别 + 场景 + 角色动作表情 + 风格 + 画质
举个实际例子。假设分镜表里第5个镜头长这样
近景,古风大殿,女主拍案而起,眼神凌厉,暖光从窗外打入
扩展成下面这样填进即梦
近景,国漫风,古风大殿内,金色龙柱,暖色烛光。女主站在案前,单手拍桌,眼神凌厉带着怒意,发丝微扬。高清,1080P,线条干净,角色参考图已上传
每个镜头生成2到3张备选,挑最好的那张,按编号命名。01.jpg、02.jpg、03.jpg,后面剪辑时一目了然。
一个60秒的漫剧大概15到20个镜头,全部生成完大约20分钟。

第四步 让静止画面动起来

这是从连环画变动画的关键一跃。两种方法,看你手上有什么工具。
方法A AI直接生成动态视频(推荐)
用即梦AI的图生视频功能。上传上一步生成的分镜图,输入动态指令。
镜头缓慢推近,人物嘴唇微动,发丝轻飘,眼神有轻微变化,画面流畅自然,不要剧烈运动,保持角色不变形
时长设3到5秒,越短越稳定。每个镜头生成完成后下载保存,编号跟分镜图对应。
如果你追求更高画质,可以把图上传到可灵AI做图生视频。效果更细腻,但可灵免费额度有限,新手先用即梦就够了。
方法B 剪映关键帧(零成本备选)
不想折腾图生视频,或者免费额度用完了,还有一个土办法。把分镜图直接导入剪映,给每张图加关键帧动画。设置起始位置和结束位置,中间加一个缓慢的缩放或平移。
效果肯定没有AI生成的自然,但对于第一条练手作品,完全够用。

第五步 配音剪辑出片

最后一步,把所有素材组装成一条完整的片子。
打开剪映,把上一环节的动态视频,或者加了关键帧的静态图,按分镜编号顺序拖入时间线。每个镜头放3到5秒,根据台词长度微调。
配音直接在剪映里做。把剧本里的台词一行行粘贴到文本轨道,选中文本,点文本朗读。剪映内置了几十种AI音色,女主选「温柔女声」或「御姐」,男主选「少年」或「霸总」,语速调到1.1倍,听起来更有节奏。
背景音乐搜「古风」「悬疑」「热血」,音量拉低到比人声低15%到20%,别盖住台词。顺手加上环境音效,脚步声,拔剑声,风声,细节感一下子上来。
字幕用自动识别,校对一遍错别字。转场用淡入淡出和叠化就行,别搞花里胡哨的特效。
导出设置,分辨率1080P,帧率30,格式MP4,9比16竖屏。

两个实操案例 直接跟着做

案例一 古风重生逆袭《重生王妃不好惹》

全程工具链和提示词都在上面了,这套流程走下来大约40分钟。题材选古风重生,因为即梦AI对国漫风格理解最好,出图稳定,翻车率低。新手第一条作品优先选这个方向。
实际操作流程
  1. 豆包生成60秒分镜脚本,约18个镜头
  2. 即梦AI生成女主(红衣汉服清冷脸)和男主(黑衣邪魅轮椅)的基准图
  3. 逐镜生成分镜图,全程绑定角色参考
  4. 每张图生3秒短视频,镜头缓慢推近
  5. 剪映配音加BGM,导出1080P竖屏成片

案例二 都市甜宠《咖啡店的猫先生》

换一个题材试试。第一步改豆包的提示词,把「古风重生逆袭」换成「都市甜宠」,风格关键词从「国漫风」换成「清新日漫风」。角色设定换成现代装扮,场景换成咖啡店、街道和公寓。
其他四步流程完全不变。你会发现不同题材在同一个流程里适配得很好。古风重生偏爱暖色调和厚重光影,都市甜宠更适合明亮柔和的配色。即梦AI两种风格都能吃住。

新手最容易踩的三个坑

第一个坑 不锁定角色参考图。每张图都用不同的参考,或者干脆不传参考,出来的角色每张脸都不一样。解法就是上面第二步,固定基准图,全程引用。这是铁律。
第二个坑 提示词太抽象。「温馨的氛围」「紧张的情绪」这种描述,AI画出来基本都是废片。换成「阳光透过窗帘洒在地板上」「她手心出汗,不停回头张望」。记住一个原则,写你眼睛能看见的东西,别写心里感受到的东西。
第三个坑 单集做太长。新手第一条作品控制在60秒以内,15个镜头左右。先把整条流程跑通,再考虑加长。很多新手第一集就想搞两分钟,最后卡在中间某个环节,信心全没了。

下一步

这篇文章讲的是零基础快速入门。三四个免费工具,半小时出第一条片。东西是丑了点,但流程通了。
如果你想追求更稳定的角色一致性,更高画质的动态效果,或者学怎么通过漫剧赚到第一笔钱,那些是下一篇的内容。ComfyUI本地工作流怎么搭,即梦AI的高阶用法,不同平台的流量分发策略,都会讲到。
先动手把第一条做出来。流程跑通了,后面全是经验积累。