2026年,AI漫剧(AI-generated comic drama)成了短视频平台的新风口。
一条3分钟的AI漫剧视频,在抖音上能拿到50万播放。制作成本?几乎为零。只需要一个脚本、一套分镜、一个ComfyUI工作流。
但问题是,大多数人用ComfyUI,连节点怎么连都搞不明白。今天我把ComfyUI做AI漫剧的完整工作流拆解给你,从安装到分镜生成,一步不落。

一、ComfyUI是什么?为什么做漫剧要用它?
ComfyUI是一个基于Stable Diffusion的"节点式"AI绘画工具。和Midjourney不同,ComfyUI不是输入提示词就生成图片,而是用"节点"搭建一个完整的工作流。
打个比方:Midjourney像"全自动相机",你按快门就行。ComfyUI像"单反相机",你可以调光圈、快门、ISO、白平衡,每个参数都能控制。
做AI漫剧为什么用ComfyUI?
1. 角色一致性控制:用IPAdapter节点,可以固定角色形象,让每一帧的画面中,主角的脸、衣服、发型都一样。
2. 批量生成:一个工作流设置好,可以批量生成10张、20张分镜,不用每次重新输入提示词。
3. 完全免费:ComfyUI开源免费,只需要一台显卡6G以上的电脑,就能本地运行。不用订阅,不用付费。
4. 可复用工作流:设置好的节点连接,可以保存为JSON文件,下次直接加载,不用重新搭建。
二、ComfyUI漫剧工作流:7个核心节点
我总结了一个"标准漫剧工作流",只需要7个核心节点:
节点1:Load Checkpoint(加载模型)
选择一个适合动漫风格的模型。推荐:
- Counterfeit-V3.0:日式动漫风格,色彩饱和度高- DreamShaper:通用动漫+写实混合,细节丰富- AnythingV5:二次元风格,人物颜值稳定
模型文件放在 ComfyUI/models/checkpoints/ 目录下,刷新后就能在节点里选择。
节点2:CLIP Text Encode(正向提示词)
输入正向提示词。漫剧提示词的核心是"人物+场景+情绪+画风"。
示例:1girl, long black hair, red eyes, school uniform, standing in classroom, sunset light through window, sad expression, anime style, high quality, masterpiece
节点3:CLIP Text Encode(反向提示词)
输入反向提示词,排除不想要的元素:
low quality, blurry, deformed hands, extra fingers, bad anatomy, watermark, text, signature, worst quality
节点4:IPAdapter(角色一致性控制)
这是做漫剧最关键的节点。IPAdapter的作用:上传一张角色参考图,让AI在生成每一帧时,都尽量保持角色形象一致。
使用方法:在IPAdapter节点上传一张角色的"正面照",设置权重0.6-0.8。权重太低,角色会变形;权重太高,画面会过度限制,失去创意。
技巧:先用Midjourney或ComfyUI生成一张满意的角色形象,保存下来,作为IPAdapter的参考图。
节点5:KSampler(采样器)
控制生成过程的采样参数。漫剧推荐设置:
- steps: 25-30(步数太少画面质量差,太多浪费时间)- cfg: 7-8(引导强度,太高会过度"听话",太低会偏离提示词)- sampler: DPM++ 2M Karras(最稳定的采样器)- scheduler: Karras(动态调度,画面质量更平滑)
节点6:Save Image(保存图片)
生成的图片自动保存到 output 目录。注意:ComfyUI默认保存的是PNG,如果要做视频,建议在提示词中加"16:9"或者后期裁剪。
节点7:VAE Decode(解码)
VAE负责把潜在空间的数据解码成最终图片。漫剧推荐用fp16(半精度)的VAE,节省显存,速度更快。
三、分镜设计:从脚本到画面
ComfyUI只是工具,漫剧的核心是分镜设计。分镜设计好了,AI生成只是执行;分镜设计不好,AI再强也救不了。
分镜设计流程:
Step 1:写脚本
脚本不是小说,是"画面描述"。每个镜头一行,包含:画面内容、角色动作、情绪、时间/地点。
示例脚本(3分钟漫剧,约15个镜头):1. 女主角站在教室窗前,看着窗外下雨,表情忧郁2. 特写:女主角的眼睛,泪水在眼眶里打转3. 中景:男主角从走廊走过来,手里拿着一把伞4. 特写:男主角的手,把伞递给女主角5. 女主角惊讶的表情,然后微笑6. 两人一起走出教室,走廊尽头的光很温暖...(后续镜头省略)
Step 2:每个镜头翻译成提示词
把脚本中的每个镜头,翻译成ComfyUI能理解的提示词。重点是:保持角色描述一致,只改变场景和情绪。
镜头1提示词:1girl, long black hair, red eyes, school uniform, standing by classroom window, rain outside, gloomy atmosphere, looking out window, melancholic expression, anime style, high quality镜头2提示词:1girl, long black hair, red eyes, close-up of eyes, tears forming, emotional, soft lighting, anime style, high quality
注意:两个镜头的角色描述部分(1girl, long black hair, red eyes)完全一样,IPAdapter会确保生成同一个人。
Step 3:批量生成
ComfyUI的"Batch"功能,可以一次生成多张图片。把15个镜头的提示词做成列表,让ComfyUI自动批量生成。
或者更简单的方法:生成一张满意的基础图,用"img2img"(图生图)功能,改变提示词,保留基础构图和角色,只改场景和情绪。
[此处配图:脚本→提示词→分镜的转换流程]
四、漫剧后期:从分镜到视频
ComfyUI生成的是静态分镜,要变成视频,还需要后期:
1. 动画化(可选)
用ComfyUI的"AnimateDiff"节点,可以把静态图变成动画。比如让角色的头发飘动、眼睛眨动、背景的云移动。
AnimateDiff需要额外的模型(motion module),放在 models/AnimateDiff/ 目录下。推荐用"mm_sd_v15_v2"模型,效果最稳定。
2. 配音和字幕
用剪映的"文本朗读"功能,给每个镜头配上旁白或对话。字幕用剪映的自动识别功能,自动生成。
3. 转场和节奏
漫剧的节奏很重要。每个镜头停留2-3秒,情绪高潮时放慢,动作场景时加快。转场用"淡入淡出"或"硬切",不要用花哨的特效。
4. 背景音乐
漫剧的情绪主要靠音乐烘托。剪映的免费曲库里搜"动漫"或"情感",找节奏舒缓的钢琴或弦乐。音量控制在-20dB,不要盖过配音。
五、常见问题解答
Q1:我的显卡只有4G,能跑ComfyUI吗?
A:4G显存可以跑,但很慢。建议用"--lowvram"参数启动,或者使用云端GPU(比如Google Colab)。如果预算允许,升级显卡到8G以上,效率提升3倍。
Q2:IPAdapter权重设多少合适?
A:0.6-0.8是最佳区间。低于0.6,角色一致性差;高于0.8,画面会失去创意,所有角色长得一模一样。漫剧建议0.7。
Q3:ComfyUI和Midjourney哪个更适合做漫剧?
A:各有优劣。Midjourney出图质量更高,但无法批量生成、无法控制角色一致性。ComfyUI适合需要"角色统一+批量生成"的漫剧项目。建议:用Midjourney生成角色参考图,用ComfyUI批量生成分镜。
Q4:生成的图有瑕疵怎么办?
A:ComfyUI的"Inpaint"(局部重绘)功能可以修复。用蒙版选中瑕疵区域,重新生成。或者用PS手动修复,漫剧对画面精度要求没有商业插画那么高,小瑕疵观众看不出来。
[
六、完整工作流JSON下载
我把上面讲的所有节点设置,保存成了一个完整的ComfyUI工作流JSON文件。你只需要:
1. 下载JSON文件
2. 在ComfyUI中点击"Load"加载
3. 替换提示词和IPAdapter参考图
4. 点击"Queue Prompt",开始生成
后台回复「ComfyUI」,获取完整工作流JSON文件 + 20个漫剧提示词模板。
👇想学更多AI漫剧制作技巧?关注后回复「漫剧」👇
🎁 转发福利:关注公众号,后台回复「ComfyUI」,免费领取:
📚 ComfyUI完整漫剧工作流JSON文件 🤖 20个漫剧分镜提示词模板 💬 专属AI创作交流群入口
星尘AI · 每天8点,和你聊点有意思的
夜雨聆风