AI VIDEO · 自动化内容生产
我用 6 个工具搭了个 AI 动画工厂
从风格、角色到镜头与发布,把一次制作变成可复用流水线
真正值得拆解的,不是“躺赚”两个字,而是怎样把剧本、画面、声音和发布沉淀成一套越来越快的生产系统。
原文作者:路飞 AI 研究员|公众号版精编与移动端排版

原作者给出了一个很抓眼球的案例:每月只投入少量人工时间,让自动化系统持续准备动画素材、镜头提示词与发布任务,再由人负责审核和最终生成。
但这套方法真正有价值的地方,不是某个收入数字,而是一个更朴素的思路:先把容易漂移的内容做成标准资产,再把重复劳动交给自动化。
先说结论
AI 动画工厂的核心不是“无人生产”,而是“素材固定、流程固定、人工只处理判断与验收”。
| 6类工具协作 | 5 步搭建生产流程 | 4 块提示词结构 |
为什么是动画
动态、角色与情节,更容易留住注意力
内容发布后,平台通常会先观察一小批用户的反馈,再决定是否扩大推荐。原文把关键反馈概括为三个指标:
| 停留率有没有停下滑动 | 完播率有没有看完整条 | 互动率有没有点赞评论 |
动态角色比纯文字更容易制造停顿,连续情节也更容易形成追看和讨论。不过,形式优势只是入场券;能否稳定更新,仍取决于生产速度和内容质量。
生产方向
一条流水线,可以服务四类内容
01 动画故事系列
6 至 10 分钟的连续剧集,固定角色、配音和原创配乐,适合频道广告与会员订阅。
02 品牌动画广告
围绕产品卖点制作 60 至 90 秒短片,交付逻辑更接近商业视频服务。
03 动态漫画系列
把图文分镜推进成视频,叠加叙述与镜头运动,可探索订阅与版权授权。
04 睡前故事频道
采用柔和画风、舒缓配音与环境音乐。涉及儿童内容时,需要额外注意平台规则、广告限制与隐私要求。
工具栈
六类工具,各自只做最擅长的一段

工具套餐、额度、模型能力与商业授权会调整。正式使用前,应重新核对各平台当期价格、版权条款和可用地区。
提示词架构
3 个固定区块,1 个变化区块
原文把每条动画提示词拆成四块。前三块长期固定,最后一块随场景变化。这样可以把角色与世界观的“一致性”,从运气变成规则。

STEP 0
先写“风格圣经”,再开始做图
先定义一段可复用的视觉风格描述,生成测试图,直到输出趋于稳定。最终版本与最佳参考图一起保存,并附加到之后的每条提示词中。
关键:不要每到一个新场景就重新发挥。即兴改写越多,色彩、比例与画面质感越容易漂移。
STEP 1
角色创建:先定稿,再做参考表
每个角色需要两次制作。第一次只解决“角色长什么样”;第二次用确定后的设计,生成包含正面、背面、侧面和面部特写的参考表。

如果结果不满意,优先在同一套描述下重新生成。角色服装、发色、饰品、疤痕和标志等必须持续出现的细节,都应在这个阶段明确。

服装描述要原样复用。不要随手总结,也不要换同义词。需要稳定的特征越明确,后续几十个镜头越省返工。
STEP 2
场景参考表:让不同集发生在同一个世界
反复出现的教室、办公室、街道或卧室,也要像角色一样建立参考表。通常只需要调整不同视角的描述,其余风格、时间、材质和空间关系保持不变。

角色表与场景表做得越扎实,后面的镜头提示词越短,也越容易维持连续性。
STEP 3
声音设计:每个角色固定一种声线
先为每个角色测试一句台词,确认声音与年龄、性格和能量感匹配。之后每句对白单独切成片段,在提示词编辑器中为不同角色标记对应声音。
原文特别提醒
声音参考需要按工具要求制作成“空白视频 + 音轨”,而不是直接上传 MP3。
STEP 4
场景生成:先用自然语言讲清楚,再交给代理扩写
先像给朋友讲故事一样写场景:人物在做什么、情绪怎样、对白是什么。再把自然叙述交给代理,让它展开成镜头级提示词。
原文使用 15 秒、16:9、1080p 作为示例参数。具体可选项与额度消耗可能变化,应以当前产品界面为准。
镜头语法
让生成结果“像剪过”,而不是一镜到底
· 一行只写一个镜头
· 单镜头控制在 2 至 3 秒
· 动作与反应交替出现
· 远景、中景、特写循环
· 轮换不同焦距,制造剪辑感
· 如果多镜头中声音漂移,改为单镜头生成后再剪辑
自动化循环
定时任务,才让流水线真正变成工厂
把每周选题、剧本拆解、素材缺口检查和镜头提示词准备设置为定时任务。系统提前产出待审核文件,人只在固定时段检查、修订和生成。
理想的人机分工
机器准备候选方案,人负责审美、事实、版权与发布判断。
自动化减少的是重复工作,不会自动解决选题、叙事、审美和商业需求。没有质量门槛的“全自动”,只会更快地产生没人想看的内容。
变现路径
收入不是一个按钮,而是五种生意
重要说明:原文中的月收入、单价、RPM、成本与增长时间线属于作者案例和测算,不构成收益保证。实际结果受内容质量、平台政策、地区、版权、获客能力和持续投入影响。
四条铁律
决定系统能不能长期稳定
01 先有素材,再做场景
没有参考表的角色,不要直接送进正式场景。
02 一段风格描述,用到底
按场景随意改风格,就是一致性漂移的起点。
03 显性规则,优于模型猜测
必须持续出现的细节,明确写进角色表或场景表。
04 素材库才是真正的剧集
每一集只是角色、地点、声音与镜头规则的重新组合。资产越完整,后续制作越快。
你的第一集
先做最小可行版本
1. 写一页风格圣经
2. 创建两个角色与角色参考表
3. 创建三个重复出现的场景
4. 把故事拆成多个短镜头
5. 先完成一集,再复盘哪些步骤值得自动化
最后
第 1 集最慢,但它在为第 10 集修路
第一次要定义风格、角色、场景、声音和镜头语法,当然很慢。可一旦这些资产进入素材库,后面的每一集都不再从零开始。
真正的复利,不是让 AI 替你做完所有事,而是让每次创作都为下一次留下可复用的资产。

夜雨聆风