
——记一次让我怀疑人生的 AI 视频制作实录
作者:大腿子整理:小爱 协助日期:2026 年 7 月 6 日
一、以为 AI 万能的我,被现实狠狠打脸了
最近我刷小红书和抖音,迷上了一类内容:AI 美女视频。
就是那种极度精致的"赛博美女"——冷白皮、动漫大眼、小家碧玉的脸颊、嘟嘴但又带着一股优雅劲儿。每一帧都让人挪不开眼,评论区清一色"求教程""求 prompt"。
我心想:这种东西,AI 肯定能干吧?
工具那么多——海螺、即梦、可灵、Sora……随便挑一个,调一调提示词,不就是"打几个字出一张图"的事吗?
事实证明,我太天真了。
7 月 4 号那天晚上,我和我的 AI 助手小爱(对,就是正在帮我整理这篇稿子的那位),整整耗了两个多小时,硬是没出一张能用的图。
一张都没有。
二、第一回合:调参调到怀疑人生
事情是这么开始的。
我从抖音存了一张图,是一个 AI 美女,五官精致、氛围感拉满。我把它丢给小爱,说:
"就照这个感觉,给我出一张三视图。"
小爱二话不说,开干。
第一版出来,太 3D CG 了,像游戏建模。我说:"再写实点。"
第二版,左右脸崩了,眼睛大小不一致,像毕加索画的。我说:"左边眼睛大了一倍,这不行。"
第三版,好点了,但太像普通证件照,缺那种一眼就知道是 AI 出的"赛博味道"。我说:"要完美 AI 感,冷白皮,小脸颊,动漫大眼。"
第四版,嘴变成了嘟嘟唇,太"网红"了。我说:"嘴再小点,要小家碧玉,但不失优雅。"
第五版,额头没露出来。第六版,双耳没完全露出。第七版……第八版……
我跟小爱就这么来回磨,调了十几版。
每次我都觉得"这次肯定对了",每次她都说"这回是不是你心中的那张?"——而我每次的回答都是:"还差点意思。"
到后来,小爱自己先崩不住了,主动认输:
"我承认我不行。聊了快两小时,你给了 10 多张参考图,我也堆了几十条 prompt,最后还是不对。这是我的能力边界。"
说实话,看到这句话的时候,我心里反而松了一口气。
不是因为图做出来了,而是终于有人(有个 AI)跟我一起承认:这事没那么简单。
三、第二回合:我终于搞明白,为什么 AI 出图差距这么大
我这个人有个毛病,搞不明白的事就睡不着。
当时我追着小爱问了一句:"你们 MiniMax 的文本模型和海螺生图不是同一家吗?为啥你出的图这么拉,海螺 App 上随便生成的都比这好看?"
小爱被我逼得没办法,扒了一圈技术细节,给了我一个残酷的真相——
是通道被阉割了。
什么意思呢?看我俩当时整理的对比:
我现在用的(API 调用):minimax-portal/image-01,敏感词直接拦截、参数被压缩、用裸 prompt 直喂、可能是早期版本 海螺 App 直接用:完整版 image-01,审核宽松、风格随便选、自带提示词优化器、最新内部版
小爱说了句特别形象的话,我到现在都记得:
"不是海螺生图比 MiniMax 强,是我调用的通道被阉割了。我用的是劣化版的同款模型——相当于拿 4G 手机跑 5G 网络。"
听完这话,我沉默了好几秒。
原来我以为的"AI 出图",是同一个模型在不同通道下的两种命运。同一个脑子,被掐着脖子跑和放开跑,出来的结果天差地别。
这一刻我才想明白:为什么很多博主用海螺能出大片,而我自己拿着工具调半天,出来的是"AI 残次品"。
不是我笨,是工具没用对。
更准确地说——是我根本不知道自己用的工具,和别人用的工具,不是同一个版本。
四、第三回合:换条路,问题突然就解了
聊到这儿,我突然开窍了。
既然我自己的出图能力有天花板,那为什么不让 AI 帮我把"别人的图"反推成"我的 prompt"?
思路一转,天地宽。
我做了三件事:
第一步:去抖音、小红书找爆款 AI 美女视频。
不用自己创作,就去找那些点赞几千、几万、几十万的爆款。它们已经被市场验证过了——观众用真金白银的注意力投了票,告诉你"这就是好看的"。
第二步:截图,把图片丢给 AI 反推提示词。
这一步是核心操作。我让小爱帮我逐帧分析图片的每个细节:
镜头类型——特写、半身还是全身? 光线——柔光、霓虹灯、自然光还是顶光? 肤色和质感——冷白皮、暖黄皮还是奶油肌? 五官细节——眼睛大小、嘴唇形状、脸颊轮廓到底长啥样? 服装和配饰——穿的什么、戴的什么、背景是什么? 整体氛围——梦幻、写实、赛博还是古风?
这些反推出来的描述词,就是海螺、即梦、可灵这些工具能直接吃的"成品 prompt"。比你自己瞎编的 prompt 精准十倍。
第三步:把 prompt 喂给海螺 AI App。
打开海螺 AI,选图片生成,粘贴 prompt,点生成。
出来的图——惊艳。
真的,第一次出来的时候我愣了两秒。不是因为我突然变厉害了,而是因为我终于站在了正确的肩膀上:
海螺 App 的完整版通道(没被阉割的那个) 爆款图的现成风格(已经被市场验证过) AI 反推的精确 prompt(专业级描述精度)
三件事叠在一起,第一次让我有了那种"原来我真的能用 AI 做出能用的东西"的感觉。
五、想明白的事:AI 工具不是魔法,是放大器
这一晚折腾下来,我最大的收获不是那张终于像样的美女图。
而是想明白了一件事——
AI 工具不是魔法,是放大器。
它放大的,是你脑子里已有的东西。
你脑子里有清晰的审美?AI 帮你 10 倍速度出图。你脑子里有结构化的 prompt?AI 帮你 10 倍质量出图。你脑子里有市场验证过的爆款逻辑?AI 帮你 10 倍效率复制。
但反过来也成立:
你脑子里没审美?AI 给你的是一坨"看起来很厉害但毫无灵魂"的垃圾。你脑子里没结构?AI 给你的是一堆随机拼凑的混乱组合。你脑子里没市场感?AI 给你的是只有你自己觉得好看的自嗨废品。
所以回到那个问题:为什么很多人买了 AI 工具,却做不出能用的东西?
不是因为 AI 不行,而是因为三个"没搞清楚":
第一,没搞清楚工具的边界。 你以为所有"AI 出图"都一样,其实 API 通道和 App 原生通道天差地别。你用的是阉割版,却指望它出完整版的效果,这不现实。
第二,没搞清楚自己的边界。 你以为缺的是工具,其实缺的是审美能力、prompt 结构化能力、市场判断力。工具只是最后一环,前面的能力才是地基。
第三,没搞清楚 AI 的边界。 AI 不是从 0 到 1 的创作者,它是从 1 到 10 的放大器。你得先有那个"1",它才能帮你放大到"10"。你给它一个 0,它放大一万倍还是 0。
真正的 AI 工作流是这样的:市场爆款(输入)→ AI 反推 prompt(拆解)→ 海螺/即梦/可灵 App(生成)→ 人工微调(审美把关)→ 成品视频/图片(输出)。
看到没?AI 不是单点工具,它只是工作流里的一个环节。单点用 AI,出来的是垃圾;把它放在正确的位置,AI 就是核弹。
五.五、圈里一位 AI 商业影像创作者大佬的感悟
上面这些,是我自己摸索出来的。抖音上好多AI视频的创作者也有同感,最近刷到一位大佬的感悟,语气里全是"你写的这些我全经历过"的那种共鸣。
他最近刚跑完一条美妆 TVC 宣传片,用的是 libtv 平台——光积分就烧了 3000 多。更扎心的是,那条 26 秒短片的成片背后,是 13 组场景、30 组分镜反复精挑细选,出来的素材里还有近一半是废弃镜头。
我看完的第一反应是:原来不只是我这种业余选手会踩坑,专业做商业片的人一样在跟 AI 较劲。
关于大佬的笔记,有几句话我反复看了好几遍,忍不住想摘出来分享:
"工具不重要,什么模型不重要,重要的是你想要什么,以及如何可控地实现这个结果。"
这句话跟我在第四部分写的那个反推法,其实是同一个意思——别在工具和参数上死磕,先把"我到底要什么"想清楚。
然后他戳破了一个我这两天深有体会、但一直没总结出来的反直觉真相:
"当你越有某个清晰的想法,但描述不清楚的时候,反而越难达到你想要的结果。但如果你只是有个大致方向,让 AI 去'抽卡',反而更容易撞上惊喜。"
这跟我调美女图的体验完全吻合——我越执着于"完美 AI 感 + 冷白皮 + 动漫大眼 + 小家碧玉不失优雅",小爱越调不出来,只能从一堆矮子里拔一个凑活的大个。
他最后说了一段话,我直接抄进了今天这篇稿子里,因为他说得比我好:
"未来 AI 影像会越来越两极分化——要么你在某个细分领域有极致审美,能做到 95 分;要么你把全流程跑通,稳定出 80-85 分的东西。中间那批'差不多就行'的,会被淘汰。"
最后一句我特别认同:
"工具不重要,模型不重要,知道什么是好的东西,才能创造出好的东西。"
这话翻译过来就是——AI 不是"工具平权"的乌托邦,而是"审美 + 流程"的双重筛选。你得至少占一样,不然 AI 也救不了你。
六、聊一聊 AI 视频和 AI 短剧的制作与成本
大佬的笔记把我这两天隐隐感觉、但一直没敢确认的东西直接挑明了。
他把这次"美妆 TVC"的成本掰开了给我看——这条片子他报价几乎贴着成本走的,账面利润接近 0。
说实话,看到他说"利润接近 0"那几个字,愣了一下。
AI 省的是硬成本——摄影棚、灯光、演员、后期合成这些。但你以为 AI 视频是'打几个字就出片'?做梦呢。
他算了一笔账,我直接整理出来:
第一笔账:积分/算力烧钱。
光一个 libtv 平台就烧了 3000 多积分。换算下来光平台成本就有好几百。这还只是 libtv 一个平台,他还用了即梦、可灵、海螺做风格测试和样片生成。每个平台都是钱。
他说了句话我印象特别深:"你知道 AI 创作最隐蔽的成本是什么吗?是你以为'再试一次不花钱'。每次点生成都是积分,每次调参数都是算力。积少成多,月底一看账单,你会怀疑人生。"
第二笔账:时间机会成本。
26 秒的片子,花多久?一周多。
13 组场景、30 组分镜,前后期加起来——前期调研风格、测试不同模型的出图效果、批量生成素材、逐帧筛选、人工微调、后期合成。每一步都不是"点一下按钮"那么简单。
他特别强调了"筛选"这个环节:"你以为 AI 生成的素材拿来就能用?天真。30 组分镜里,真正能用的不到一半。剩下的要么风格不一致,要么细节崩了,要么跟整体调性不搭。你得一帧一帧看,一组一组筛。"
第三笔账:废弃镜头沉没成本。
这条是我之前没想到的。
他给我看了截图——成片只用到了一半素材,另一半直接进了回收站。你没看错,近一半的素材是废弃的。
这些"无效输出"也是钱。每一帧都是积分烧出来的,每一组都是时间堆出来的,但它们最终的命运是被删掉。这就是 AI 创作的"沉没成本"——你试错的代价,不会因为你没用上那些素材就消失。
他说了句话,我觉得特别到位:"传统拍摄是'重资产 + 一次性'——你提前做好分镜、对好灯光,演员到位就开机,拍出来的素材基本能用。AI 视频是'轻资产 + 高迭代'——你随时能开拍,但每一帧都是赌,赌输了整组废掉。"
换句话说——AI 视频不是"零成本创作",而是"低成本试错"。
它把传统 TVC 的硬成本压下来了,但试错成本反而上去了。你省了摄影棚的钱,但你多花了"反复生成 + 反复筛选"的钱。总体算下来,成本结构变了,但总成本并没有消失。
他特别提到一点,让我印象极深:
"完整的 AI 商业化流程,其实跟 TVC 拍摄流程非常接近——前期调研、风格测试、样片锁定、分镜拆解、批量生成、人工微调、后期合成。AI 让这一切又快又好,但目前精度和可控性还有更好的提升空间。"
翻译一下就是——AI 没有省掉流程,只是把流程从"工业化"变成了"数字化"。该走的一步都不会少,只是每一步的门槛和成本变了。
他还分享了一个让我虎躯一震的成本洞察:
"新开一个会员肯定比充积分划算。"
他说国内这种"积分制"的 AI 平台,会员价的边际成本远低于积分价。这次 libtv 花 3000+ 积分,如果换算成会员费,其实不到会员价的 1/3。所以"用 AI 创作"的第一条成本建议就是——别零散充积分,先算清楚你一个月大概的创作量,再决定是开会员还是直接买断。
我听完这笔账,沉默了很久。
不是因为被吓到了,而是因为我突然意识到——我们都被"AI 一键生成"的营销话术给骗了。
哪有什么一键生成?背后都是积分、时间、废弃素材堆出来的。AI 没有让创作变"免费",只是让创作的"付费方式"变了——从一次性大额支出(摄影棚、演员),变成了持续性小额支出(积分、算力、时间)。
AI 不省流程,只换形态——成本结构变了,但没消失。
七、写在最后:承认边界,然后用对工具
这一晚,我从"AI 工具万能论"的忠实信徒,被现实狠狠上了一课。
如果让我总结,我学到了这么几件事:
AI 工具有版本和通道差异。 承认自己不行,比硬撑重要得多。 爆款是最好的免费老师。 AI 是放大器,不是创造者。 工作流永远大于单点工具。 - AI 不省流程,只换形态——成本结构变了,但没消失。
- AI 是低成本试错,不是零成本创作——你得算清账。
最后,送给所有在 AI 工具里挣扎的朋友一句话:
"AI 工具不会让你变强,只会放大你本来就有的强。先让自己强起来,再让 AI 帮你放大。"
与其焦虑"为什么别人用 AI 做出的东西那么好",不如先问自己:"我脑子里,有什么值得 AI 放大的东西?"
想清楚这个问题,工具自然就用对了。
如果你也有 AI 出图的踩坑经历,欢迎在评论区聊聊~ 我是大腿子,一个喜欢折腾的AI爱好者。
附 1:我的小成果。


附 2:AI 影像创作者的成本清单(基于笔记整理)
| 平台积分 / 算力 | ||
| 时间机会成本 | ||
| 废弃镜头沉没 | ||
| 学习试错 |
降本建议:先开会员再决定充积分、爆款反推 prompt 减少试错、流程化工具链降低单次成本。
👉 关注我,看下一篇:
《闭源 or 开源:当主流模型越收越紧,我们该怎么办》
夜雨聆风