夜雨聆风学习资料网

ARTICLE · 1063419

人人手握AI工具,但审美与工匠精神无法复制

人人手握AI工具,但审美与工匠精神无法复制
最近在研究AI内容创作,认真看了一些AI短剧,更多的是平时刷短视频刷到的。
先说句实话:绝大多数,我根本看不下去。
AI技术迭代飞快,但绝大多数AI作品的质感,依旧廉价、生硬、充满机器流水线味道。
如今AI建模早已告别早期塑料人脸,画面分辨率越来越高清。可人物一动、开口说话,浓浓的AI感扑面而来。
· · · · · · · · · · · ·

▍01|AI作品三大通病:模板化,没有分寸感

❶ 表情只会符号化表演

我们平时没少吐槽某些演员演技差,演什么都靠瞪大眼。
但看过大量AI短剧之后,我想替他们讲句公道话:跟AI演员一比,人类的瞪眼,至少瞪得有层次。
AI的情绪表达,基本停留在表情包级别:开心就大笑,震惊就瞪眼,愤怒就皱眉。人类真实微妙的隐忍、怅然、克制、淡淡的失落,这些流动的微情绪,AI很难自然生成。画面看着是人,情绪却是复制粘贴出来的。

❷ AI配音永远亢奋紧绷

跟朋友聊起AI短剧,他的原话是:"我现在最反胃的就是AI配音,所有AI剧都是一样的语气语调,还有BGM。"
先说配音。不管角色是低声倾诉、沉静悲伤,还是淡然回忆,AI语音永远语速快、音调拔高。缺少人说话自然的气息停顿、轻重起伏,像一台永不停歇的读稿机器。

❸ 配乐千篇一律,只是贴BGM

再说他连着吐槽的BGM,确实是重灾区。
悲伤直接套伤感钢琴,冲突直接堆激昂鼓点。背景音乐机械叠加在画面之上,不跟随叙事起伏,不服务人物情绪。音乐和故事互相割裂,只是完成"要有背景音乐"这个任务。
流水线AI创作逻辑很简单:输入提示词,一键生成,直接交付。所有人都在比拼谁出片更快、谁的指令更精巧,整个行业疯狂崇拜效率。
· · · · · · · · · · · ·

▍02|直到我看完获奖AI短片《牌子》

B站播放千万、郭帆导演转发点赞、拿下B站AI创作大赛百万一等奖。
同样全套依靠AI工具制作,《牌子》几乎没有"AI味":叙事克制、镜头节奏舒展,情绪层层递进。尤其配乐,令我印象很深。
它的音乐不是一键生成直接拿来用。
有个细节很多人不知道:作者DiDi-OK连五线谱都不认识,自嘲五音不全。
他的办法很笨:先让AI帮他写音乐提示词,喂给Suno,反复生成1500多遍,花了整整一周,只选中最贴合情绪的一首两分钟曲子。
选定之后还没完。他再把这首曲子在Suno里拆解、打碎,一段一段垫到每个主要画面下面,反复试配——狗熊出场时音乐要更抽象,情绪压抑时音乐要收着走,跟着故事的心跳走。
判断好坏的标准也很原始:让完全不知情的女朋友当第一个听众。他说,一个没被创作过程污染的"干净耳朵",非常宝贵。
一首曲子,硬是靠手工拆配,磨成了整部片子的情绪骨架。
很多网友会简单归因:"他提示词写得好"。
但读完大量深度采访才明白:提示词只是表层技巧,真正的根源,是创作者的底色——专业审美,以及一份逆时代的工匠精神。
· · · · · · · · · · · ·

▍03|DiDi-OK:"AI弱爆了。"

这句话,是他接受《南方人物周刊》采访时直白的判断。
AI很强,可以批量生成画面、音乐、镜头,但仅仅局限在确定性的执行工作。
┃ "审美这件事情,AI是搞不定的。"
很多人以为AI时代,创作已经变成输入指令游戏。DiDi-OK却走出一条完全相反的路:
《牌子》里那个全网封神的十字路口长镜头——遛狗的老人、爬行的行人、骑着自行车的狗熊在路口交错,短短十几秒的画面——他前后生成了三四千次,单这一个镜头就烧掉数千元,最后只留下一条。
整部片子,剧本打磨一个半月,AI生成制作23天,前后两个月,自费五六万。
他自己算过一笔账:同样的画面如果走传统实拍,三年起步,成本至少一千万。
从三年到二十三天,从一千万到五六万。
省掉的是团队和流程,省不掉的,是一次次亲手否决AI结果的判断:
● 剧本不是AI一键写就,灵感来自土耳其旅行真实见闻,打磨一个半月;● 不会AI输出什么就直接用什么,每一段画面、音乐,全部人工判断、人工取舍、人工否决;
● 临近发布,明明成片已经做完,依然按下暂停键,反复调整情绪节奏,又打磨二十多个小时。
现在AI圈子到处都在谈效率、谈快速量产、谈几分钟生成一部短片。但DiDi-OK愿意为一个镜头、一段音乐,投入金钱、时间,无数次否定AI的结果。
在所有人追求"更快"的时候,他选择"慢一点、磨得更好"。
他并不排斥AI。恰恰相反,他积极拥抱全部新工具。但他清醒分清边界:AI是助理、是美工、是执行苦力,但是不能当导演,不能当编剧,不能替创作者做审美抉择。
● AI负责渲染画面;人负责故事内核
● AI负责批量生成素材;人负责筛选、拒绝、取舍
● AI负责完成技术执行;人把控情绪节奏、叙事分寸
DiDi-OK本身是伦敦艺术大学动画硕士,曾任职伦敦WPP全球顶尖广告集团。在接触AI之前,早已系统吃透镜头语言、叙事节奏、视听审美。
AI只是降低落地成本,而创作底层能力,是他多年阅历、专业训练沉淀下来的。
很多普通创作者的误区恰恰在这里:把全部希望寄托工具。花大量时间钻研模型参数、神奇提示词,却忽略自己叙事、审美、生活观察的修炼。以为拿到同款工具,就能做出同等质量作品。却忽略:工具可以复制,审美和工匠精神无法复制。
· · · · · · · · · · · ·

▍04|AI最大局限:它处理不了"不确定"

AI擅长标准化、参数明确的任务。但艺术创作大量是没有标准答案的"不确定判断":
什么时候音乐该进来,什么时候应该留白安静;情绪要渲染到几分,是放大冲突还是克制隐忍;镜头该停留多久,哪一帧画面应该直接舍弃。
这些微妙的分寸,写不进提示词。只能依靠创作者阅历、审美、共情能力,依靠一次次打磨试错。
AI可以帮你把1000份素材快速生产出来,但是挑选出那最好1份的眼光,AI给不了你。
DiDi-OK说得直白:
┃ "我生成3000次,为什么前面2999次都不要?这个'不要',才是审美,才是判断。"
真正的创作,是那个"不要"。
这句话让我想起刘慈欣的《诗云》:神级文明穷举了所有中文的排列组合,其中一定存在超越李白的诗。但问题是——你怎么知道,哪一首是好的?
AI能生成一万段视频,但哪一段是真正的好?考验的,永远是人。
DiDi-OK还打了一个很形象的比方:就像现代化厨房设备齐全,但是自动厨具不会直接把普通人变成大厨。厨具可以切菜控温;但是菜谱构思、火候分寸、调味判断,永远是厨师本人。
· · · · · · · · · · · ·

▍05|写在最后:未来不是AI淘汰创作者,是创作者淘汰流水线作品

AI工具已经全民普惠,门槛几乎归零。未来人与人之间的差距,不再是谁会调用AI,谁掌握神奇提示词。
真正拉开差距的,是两件事:
向内:审美判断力、生活感知、叙事思考;
向外:一份工匠精神——愿意为作品反复打磨,敢于否定机器输出的半成品,不迷信效率,愿意为好内容投入时间成本。
现在太多AI内容,把效率当成最高信仰,追求快速批量产出。而DiDi-OK给我们展示了另一种可能性:AI只是工具,创作的灵魂永远是人。
工具人人平等,但是审美、阅历、工匠精神,永远不可复制。

相关学习资料