夜雨聆风学习资料网

ARTICLE · 1085606

麦客AI短视频智能体实战课

麦客AI短视频智能体实战课

我的这门课教的不是"某一个AI工具",而是完整掌握AI内容生产链——用智能体负责专业思考,用不同模型负责文本、图片、视频和声音,最终让一个普通人也能独立完成一条AI短剧作品。

课程大纲与讲师手册

——从零手搓到多AI协同,一天做出你的第一条AI短剧

课程代号:AIV-D1 | 版本:V1.0

适用形式:单日训练营(线下)

配套资料:授课课件(PPT)× 1

核心智能体提示词模板库 × 1

2026 年 9 月

目录

1. 一、课程定位与设计总纲
1) 1.1 课程名称与一句话定位
2) 1.2 设计哲学:先手搓,后自动化
3) 1.3 目标学员画像
4) 1.4 课程成果承诺
5) 1.5 课程形式与总时长
2. 二、课程结构总览
3. 三、模块详案与讲授指引
1) 模块一:开场——为什么是现在(15分钟)
2) 模块二:认知重塑——AI到底能做什么(25分钟)
3) 模块三:核心概念——AI 1.0、AI 2.0与智能体(25分钟)
4) 模块四:实战第一步——生成短剧脚本(35分钟)
5) 模块五:实战第二步——分镜图与人物一致性(40分钟)
6) 模块六:实战第三步——分镜视频与多帧转场(30分钟)
7) 模块七:实战第四步——剪映合成与AI配音(25分钟)
8) 模块八:总结——智能体思维与课后作业(15分钟)
4. 四、三大核心智能体的教学定位
5. 五、课后实操作业与验收
1) 5.1 作业题目
2) 5.2 十步练习清单
3) 5.3 提交物与评分标准
6. 六、学员能力验收标准
7. 七、常见误区与讲师应对话术
8. 八、开课物料与准备清单
9. 九、排课变体建议

执行摘要

《AI短视频智能体实战课》是一门面向零基础学员的单日实战训练营(8 个模块),核心目标不是"介绍AI工具",而是让每位学员在课程内亲手走通一条完整的AI内容生产链:

脚本 → 分镜图 → 分镜视频 → 剪辑配音 → 完整成片,并在过程中建立"智能体"与"多AI协同"的核心认知,为下一阶段"AI 2.0 自动化工作流"打牢地基。

课程遵循"先手搓、后自动化"的设计铁律:

学员先用 3 个核心智能体(剧本创作大师、分镜图像提示词智能体、分镜视频提示词创作大师)人工调度多个AI模型完成作品,真正理解每一步AI在做什么,再进入自动化学习。

一、课程定位与设计总纲

本章明确课程的整体定位、设计哲学、目标学员与成果承诺,是全部教学设计的出发点,也是讲师备课前必须内化的部分。

1.1 课程名称与一句话定位

课程全称:《麦客AI短视频智能体实战课——从零手搓到多AI协同,一天做出你的第一条AI短剧》。

一句话定位:这不是一门"AI工具介绍课",而是一门让零基础学员在3.5小时内亲手走通一条完整AI内容生产流水线的实战训练营。

1.2 设计哲学:先手搓,后自动化

本课程遵循一条铁律:

1.0 AI工具手搓(了解AI内容生成原理)→ 2.0 AI自动化生成进阶(实现百倍提效)。

课程刻意要求学员先用"人工调度多个AI工具"的方式,完整走一遍"脚本 → 分镜图 → 分镜视频 → 剪辑配音 → 完整成片"的生产流程。

原因很简单:只有先知道每一步AI在做什么、结果为什么好或不好,进入下一阶段"智能体自动化工作流"的学习时,学员才能真正理解智能体到底自动化了什么、出了问题该去哪里找原因。

麦客导师反复强调:实操才是学习的唯一路径。

1.3 目标学员画像

本课程面向以下三类人群,均可零基础入学:

学员类型

核心诉求

课程给他的答案

想做AI短视频的普通人

不会写剧本、不会画画、不会剪辑,也能做内容

用智能体+AI模型补齐全部专业能力

个人博主 / 小团队

内容生产成本高,更新跟不上

多AI协同,一人顶一条内容流水线

对AI智能体感兴趣的职场人

听过概念,没动手做过

三小时亲手搭出"多AI协同"的最小闭环

1.4 课程成果承诺

完成本课程后,学员应达到"AI博主级"的基础内容制作能力,具体承诺为以下六项:

1. 能让写出结构化内容(剧本、台词、分镜);
2. 能用AI生成整套分镜图片;
3. 能把静态分镜变成动态视频镜头;
4. 能在剪映中完成配音、字幕、音乐与剪辑;
5. 能独立输出一条完整AI短剧作品;
6. 能理解爆款内容的基本生产逻辑,并为下一阶段"智能体自动化"打牢地基。

1.5 课程形式与总时长

标准版为3.5小时训练营(含8个模块、4次学员实操、2次课间休息),课后配套一次30–60秒短片的实操作业。课程方向聚焦短视频平台四大热门赛道:AI古文短剧、AI科普短剧、AI漫画短剧、AI故事类内容。

二、课程结构总览

全课共8个模块,总时长210分钟,主线为"认知 → 概念 → 四步实战 → 思维升华":

模块

主题

时长

类型

学员产出

一

开场:为什么是现在

15 分钟

讲授

明确学习目标

二

认知重塑:AI到底能做什么

25 分钟

讲授+案例

建立AI能力全景认知

三

核心概念:AI 1.0、AI 2.0与智能体

25 分钟

讲授+互动

理解智能体定义与价值

四

实战第一步:生成短剧脚本

35 分钟

演示+实操

一份结构化剧本

五

实战第二步:分镜图与人物一致性

40 分钟

演示+实操

一套分镜图+角色参考图

六

实战第三步:分镜视频与多帧转场

30 分钟

演示+实操

至少3个动态镜头

七

实战第四步:剪映合成与AI配音

25 分钟

演示+实操

一条完整成片(课堂版)

八

总结:智能体思维与课后作业

15 分钟

讲授

课后实操任务书

排课提示:模块四至模块七为实战主线,是课程的重心(合计 130 分钟,占全课 62%)。若时间吃紧,优先压缩模块一、二的案例展示,绝不压缩实操。

三、模块详案与讲授指引

以下按授课顺序给出8个模块的完整详案。每个模块统一包含五项要素:教学目标、讲授要点、现场演示、学员实操与讲师提示,讲师可按此结构直接组织课堂。

模块一:开场——为什么是现在

教学目标:让学员在15分钟内放下"我不懂技术"的畏难情绪,并明确今天的学习目标不是学工具,而是走通一条生产链。

讲授要点:

1. 开场提问(互动):"在座有没有人觉得,做短视频最难的不是拍摄,而是每天都要有新内容?"——引出全课核心大部份分学员痛点:真正困难的不是做出一条内容,而是每天持续稳定地产出。
2. 抛出课程承诺:今天结束时,每个人都会拥有一条自己亲手制作的AI短剧成片。
3. 讲清课程主线:今天学的是"AI 1.0 手搓"——亲手走通"脚本 → 分镜图 → 分镜视频 → 剪辑配音 → 成片";下一课才是"AI 2.0 自动化"——把这些步骤交给智能体工作流。今天学流程中的每一个零件,明天学如何把零件连成自动运转的机器。

讲师提示:开场务必让学员写下自己的账号方向(美食、情感、科普均可),后续所有实操都用学员自己的方向做主题,参与感会完全不同。

模块二:认知重塑——AI到底能做什么(25分钟)

教学目标:打破"AI只能问问题、写文章"的旧认知,让学员看到AI已进入商业、自媒体、内容创作、图片设计、音乐、玩具、电商、数字人、直播、自动化生产等领域的现实。

讲授要点(按AI四大能力展开,每个能力配1–2个案例展示):

1. AI商业力:帮企业完成创意内容、营销素材、产品视觉、品牌内容与自动化生产。可展示AI玩具、品牌合作等商业案例。
2. AI艺术力:插画创作、视觉设计、海报、IP形象、艺术风格创作。强调关键转变——过去需要专业设计能力的活,现在普通人靠模型和提示词也能完成。
3. AI音乐力:作词、作曲、演唱、配乐、背景音乐均可由AI辅助完成。
4. AI流量生产:展示AI内容账号案例(古文短剧号、漫画故事号等),核心认知是AI不仅能"做内容",还能极大降低持续生产内容的成本——这正是下一课学智能体的重要原因。

现场演示:现场用即梦生成一张"古风新娘"风格图,让学员直观看到30秒出图的效果。

麦客导师提示:此模块最容易讲散,务必控制在25分钟内,案例贵精不贵多——每个能力方向一个代表作即可,把震撼感留给模块四之后的实操。

模块三:核心概念——AI 1.0、AI 2.0与智能体(25分钟)

教学目标:建立全课最重要的三个概念:AI 1.0与AI 2.0的区别、什么是智能体、为什么通用大模型直接写短剧容易翻车。

讲授要点:

1. AI 1.0:人工调度多个AI工具。以制作一条AI漫画短剧为例,学员需要自己完成:找AI写剧本 → 找AI写图片提示词 → 生成图片 → 写视频提示词 → 生成视频 → 配音 → 剪辑。人是整个流程的"总导演",每一步都要自己操作。
2. AI 2.0:让智能体执行流程。输入一个主题,自动完成整个内容生产流程——剧本、图片、视频、配音、剪辑、输出全部连成工作流。
3. 什么是智能体?给出核心判断:有规定流程的大模型,就是最初级的智能体。普通大模型是你问一次、它答一次,同样一句"帮我写个短剧",每次写法都不同,质量高度依赖提示词。专业智能体则提前规定好了六件事: 
○ 身份
○ 专业能力
○ 工作步骤
○ 判断标准
○ 输出格式
○ 修改规则
4. 为什么通用模型直接写容易翻车?现场对比演示(本模块核心互动):用同一句"帮我写一个爆款短剧"分别发给裸模型和"短剧剧本创作大师"智能体,让学员亲眼看到差距。裸模型输出常见问题:剧情普通、爆点不足、人物不鲜明、节奏不紧、起承转合不明显、不懂短视频观看节奏、分镜不专业。根本原因不是模型不会写,而是它不知道你想要的"专业标准"是什么。

互动设计:让学员举手投票——两份剧本哪份更想看完?用真实反映强化"专业流程写进AI"的价值认知。

导师提示:"有规定流程的大模型,就是最初级的智能体"这句话要让学员抄下来,它是理解下一课智能体工作流的地基。智能体的价值不只是回答问题,而是把一套专业工作方法固化下来。

模块四:实战第一步——生成短剧脚本(35分钟)

教学目标:学员用自己的主题,借助剧本智能体产出一份包含故事主题、人物设定、剧情、台词、镜头拆分的结构化剧本。

讲授要点:

1. 可用的语言模型:DeepSeek、豆包、Kimi、通义,负责创意、故事、人物、台词、分镜与剧情结构。
2. 普通做法 vs 进阶做法:直接说"帮我写一个短剧",输出不稳定;正确姿势是使用提前配置好的「短剧剧本创作大师」智能体(提示词见配套《核心智能体提示词模板库》)。
3. 脚本生成关键思维——AI写剧本不能只要求"好看",必须明确六项输入:

输入项

示例

题材

古风、悬疑、民间故事、逆袭、科普、漫画故事

内容风格

爽、有反转、接地气、有悬念、情绪明显

视频时长

1–2分钟

镜头数量

每集10个镜头左右

人物要求

主角、配角、性格、人物关系

输出格式

按"镜头1 → 场景 → 人物 → 动作 → 台词"输出

现场演示:讲师现场以"古风逆袭"为主题,用剧本智能体生成完整剧本,边生成边讲解好剧本长什么样(有冲突、有反转、有情绪节奏、镜头拆分明确)。

学员实操(约15分钟):学员写下自己的主题,套用六项输入模板生成剧本,讲师巡场解决"题材没定""镜头数太多"等常见问题。

讲师提示:剧本阶段宁短勿长。第一次练习控制在 6–10个镜头,剧情越简单,后面分镜、视频阶段越顺利。

模块五:实战第二步——分镜图与人物一致性(40分钟)

教学目标:把文字剧本变成一整套视觉分镜图,并掌握AI短剧最关键的硬技术——人物与场景一致性。

讲授要点:

1. 从剧本到分镜的正确路径:不是每个镜头自己瞎编提示词,而是"剧本 → 分析每个镜头 → 生成对应的AI绘画提示词 → AI生成分镜图片"。演示工具以即梦的图像生成能力为主。
2. 绘画提示词十要素:人物长相、服装、表情、场景、灯光、色彩、景别、镜头角度、艺术风格、画质。以剧本中"女主穿着红色婚服坐在房间里,周围燃烧着红烛,表情温柔但诡异"一句为例,逐要素展开成一条完整提示词。
3. 不会写怎么办?把剧本直接交给「分镜图像提示词智能体」,它会自动分析剧情、拆解镜头、把每个镜头转换成AI绘画提示词——流程从"我自己一个个想"升级为"剧本进、提示词出",这是智能体第一次明显提升效率的地方。
4. 批量生成:把每个镜头的提示词分别交给图像模型,得到镜头1、2、3、4……组成完整分镜。

重点技术:人物一致性(本模块核心,预留15分钟):

● 问题:每个镜头重新生成,会出现女主脸变了、发型变了、衣服变了、年龄变了、五官比例变化、场景风格不一致。
● 解法:先制作角色参考图——先生成同一角色的正面、侧面、不同角度、半身、全身,形成角色参考;之后生成新镜头时,上传角色参考图+指定新场景+指定新表情和动作。
● 一致性生成公式(要求学员抄录):角色参考图 + 场景描述 + 动作 + 表情 + 镜头要求,并在提示词中明确"保持参考图中的女性人物五官、发型、婚服完全一致,只改变场景、动作、表情、机位"。

学员实操:学员锁定自己剧本主角,先生成角色参考图,再完成至少4张一致性分镜图。

讲师提示:这是全课最容易卡壳的环节。若学员生成的人物仍不一致,优先检查两点:是否真的上传了参考图;提示词里是否明确写了"保持人物五官、发型、服装完全一致"。

模块六:实战第三步——分镜视频与多帧转场(30分钟)

教学目标:把静态分镜变成动态镜头,掌握视频提示词写法与多帧转场技术。

讲授要点:

1. 两大核心能力: 
○ 全能参考视频生成:用于生成正片镜头,可控人物动作、说话、口型、情绪、运镜与场景变化;
○ 智能多帧丝滑转场:用于片头、片尾、变身、场景变化、连续转场。
2. 视频提示词要素:只说"让人物动起来"远远不够,必须写明——镜头怎么运动、人物怎么动、人物表情、动作速度、环境变化、光影变化、前景与背景、镜头什么时候推进、什么时候拉远、什么时候转换。
3. 不会写怎么办?使用「分镜视频提示词创作大师」智能体:把分镜图、剧本、想要的动作交给它,即可得到更专业、更复杂、更准确的动态视频提示词。
4. 多帧转场思路:首帧 + 中间参考帧 + 尾帧 + 转场描述,让AI完成连续变化。适用场景:人物变身、时空变化、白天变黑夜、人物衰老、场景切换、片头片尾动画。经典演示案例:第一张是美女,最后一张是骷髅,多帧生成让人物自然渐变,而不是硬切。

现场演示:讲师用一张学员生成的分镜图现场图生视频,展示运镜提示词的落地效果。

学员实操:学员选择自己最满意的3张分镜图,生成3段动态镜头,其中至少1段尝试多帧转场。

麦客导师提示:使用三个智能体——剧本智能体(故事怎么讲)、分镜图像提示词智能体(每个镜头长什么样)、分镜视频提示词智能体(每个镜头怎么动)。点明这就是多AI协同工作模式的雏形。

模块七:实战第四步——剪映合成与AI配音(25分钟)

教学目标:把AI生成的"素材"变成一条真正完整的视频。

讲授要点:

1. 所有镜头生成完成后不能直接发布,必须进剪辑软件做最后合成。工具:剪映。
2. 剪映八大操作:视频排序、镜头剪辑、配音、音乐、音效、字幕、转场、节奏调整与最终导出。
3. AI配音讲解:将台词文本交给剪映的文本朗读/AI配音功能,选择贴合角色的音色;音乐与音效注意与剧情情绪匹配。

现场演示:讲师把课堂演示的镜头素材导入剪映,10分钟内完成排序、配音、字幕、背景音乐并导出成片——让学员看到"最后一公里"其实很轻。

学员实操:学员把自己生成的3段镜头合成一条课堂版成片并导出。

麦客导师提示:强调本步的目标是"完整"而非"精致"。先完整走通流程,比把其中一张图做得特别漂亮更重要。

模块八:总结——智能体思维与课后作业(15分钟)

教学目标:把今天的体验升华为可迁移的思维模型,并布置课后作业。

讲授要点:

1. 完整工作流总复盘(带领学员齐声复述):想一个故事 → 剧本智能体 → 完整剧本 → 分镜图像提示词智能体 → 每个镜头的绘画提示词 → AI图像模型 → 完整分镜图 → 分镜视频提示词智能体 → 镜头动作与运镜提示词 → AI视频模型 → 分镜视频 → 多帧转场 → AI配音+剪映 → 完整成片。
2. 智能体思维(全课的灵魂):把复杂任务拆成多个专业步骤,让不同AI分别负责——编剧AI、分镜AI、绘画AI、视频AI、配音AI、剪辑。这门课表面在教AI视频,真正教的是多AI协同工作模式。
3. 五大常见误区(快讲,每条一句话点透): 
○ 误区一,只会"问AI":智能体思维不是问一句答一句,而是让AI按预设专业流程持续完成任务;
○ 误区二,提示词越长越专业:真正重要的是目标、输入、流程、标准、输出五要素;
○ 误区三,一个AI解决所有事:语言模型管文本、图像模型管视觉、视频模型管运动、语音模型管声音,让最适合的AI干最适合的活;
○ 误区四,只追求一张漂亮图片:目标是短剧,就必须兼顾人物一致、场景一致、镜头连续、剧情连续、动作连贯、转场自然;
○ 误区五,只学工具不学流程:工具会变,但"剧本 → 分镜 → 图片 → 视频 → 声音 → 剪辑"这套内容生产流程不会轻易改变。
4. 下一课预告:从"我调度AI完成工作"升级到"AI工作流自动替我完成工作"——智能体自动化,一键出视频,实现落地增收。

四、三大核心智能体的教学定位

本课程的效率秘密全部沉淀在三个智能体中,配套提示词已单独成册(《核心智能体提示词模板库》),随课发放给学员:

智能体

解决的问题

在课程中的位置

短剧剧本创作大师

不会写剧本、剧本不专业、结构不稳定

模块四

分镜图像提示词智能体

不会写AI绘画提示词

模块五

分镜视频提示词创作大师

不会写复杂的动作、运镜与转场提示词

模块六

讲师使用原则:先让学员看"裸模型输出"的差距,再给智能体工具——先痛后甜,学员才会真正珍惜工作流的价值。

五、课后实操作业与验收

课后作业是巩固课堂成果的关键环节:学员需在课后独立完成一条完整短片并按标准提交,助教按评分标准验收反馈。

5.1 作业题目

独立完成一条 30–60秒AI故事短片,题材自选(建议从古风、悬疑、民间故事、逆袭、科普中选)。

5.2 十步练习清单

1. 先定一个简单故事;
2. 控制在6–10个镜头;
3. 用剧本智能体完成脚本;
4. 用分镜图像智能体生成绘画提示词;
5. 先锁定主角参考图;
6. 完成全部分镜图片;
7. 用视频提示词智能体生成动态描述;
8. 逐镜头生成视频;
9. 至少尝试一次多帧转场;
10. 导入剪映完成配音和剪辑。

5.3 提交物与评分标准

提交物

权重

合格线

结构化剧本(含镜头拆分)

20%

镜头要素完整

全套分镜图

25%

主角形象前后一致

动态镜头视频

25%

动作与运镜自然

完整成片(含配音、字幕)

30%

可直接发布水平

验收原则:第一次练习不追求作品特别长、特别精致——先完整走通流程,比把其中一张图做得特别漂亮更重要。

六、学员能力验收标准

完成本课程后,学员应能独立完成以下 11 项任务,作为课程效果验收清单:

1. 确定一个短剧主题;
2. 让AI生成结构化剧本;
3. 把剧本拆成连续分镜;
4. 生成分镜绘画提示词;
5. 用AI生成完整分镜图;
6. 用角色参考图保持人物一致性;
7. 生成每个镜头的视频提示词;
8. 把静态分镜生成动态视频;
9. 利用多帧完成变身或转场;
10. 在剪映完成配音、音乐、字幕和剪辑;
11. 最终输出一条完整AI短剧。

七、常见误区与讲师应对话术

以下六类问题是课堂现场出现频率最高的学员疑问,讲师应提前熟悉应对话术,保持回答口径统一:

学员现场常见问题

讲师应对话术

"我完全没有基础,能学会吗?"

"今天的流程里没有任何一步需要你手动创作——剧本AI写、图AI画、视频AI生成,你只需要当导演。"

"为什么我生成的图人物每次都不一样?"

"因为没挂角色参考图。记住公式:参考图+场景+动作+表情+镜头要求,人不能变,只改变场景、动作和表情。"

"提示词是不是写得越长越好?"

"不是堆词,是五要素:目标、输入、流程、标准、输出。长而不准,不如短而准。"

"能不能只用一个AI做完所有事?"

"不同模型有不同长处:语言模型管文本、图像模型管视觉、视频模型管运动、语音模型管声音。让最适合的AI干最适合的活。"

"工具以后变了怎么办?"

"工具一定会变,但'剧本→分镜→图片→视频→声音→剪辑'这套流程不会变。你今天学的是流程,不是工具。"

"今天学的什么时候能赚到钱?"

"今天解决'能稳定做出来',下一课智能体自动化解决'做得快、做得多'——先有产能,再谈变现。"

八、开课物料与准备清单

开课前讲师与运营需按下表逐项备齐,缺任何一项都可能造成课堂翻车:

类别

物料

说明

工具账号

DeepSeek / 豆包 / Kimi / 通义(任选其一以上)

剧本生成

工具账号

即梦

分镜图生成、图生视频、多帧转场

软件

剪映(专业版)

合成、配音、字幕、导出

智能体

三大智能体提示词模板库

课前导入或现场发放

演示素材

讲师预生成的完整短剧案例一套

含剧本、分镜图、视频、成片,防现场翻车

备用素材

预生成分镜图与视频素材包

学员生成失败时兜底

硬件

大屏 / 直播推流 + 讲师双屏

一屏演示、一屏看学员群消息

学员物料

六项剧本输入模板 + 一致性生成公式卡片

打印或电子版均可

九、排课

两天版(进阶营):Day1即本课程;Day2接入"AI 2.0 智能体自动化工作流"——输入主题一键出视频,把今天手工走的每一步变成自动节点,实现从"我调度AI"到"AI工作流替我工作"的跃迁。

相关学习资料