乐于分享
好东西不私藏

手把手教你用免费AI工具,复刻AI民间故事爆款视频,完整操作步骤!

手把手教你用免费AI工具,复刻AI民间故事爆款视频,完整操作步骤!

最近刷视频,连着刷到好几条民间故事类的视频。有故事情节,配着古风画面,讲个两三分钟,点赞都不低。

我顺手点进一个账号翻了翻,发现更新频率很高,几乎日更。我心里就想到:我自己能不能做?

抱着这个念头,我花了一个下午,真把一条做出来了。过程比想象中顺,但也踩了几个坑。这篇就把我完整的做法写下来,用的都是现成的工具,写故事的大模型、生图的、生成视频的、剪辑的,小白也能上手。

故事是根本,别让 AI 自己瞎编

很多人第一步就让 AI "写一个古风的奇闻异事或者民间故事,大概 3-4 分钟的剧情",这种提示词适用于没有方向,不知道做什么的时候,AI能给出一个大概的故事,如果符合我们的预期,就继续使用;如果不符合我们设想的,就继续对话把详细的风格、故事大概规定清楚。

写完AI会给到我们几点主要的东西:一主要角色的形象和穿着气质;二是需要哪些场景;三是按顺序拆好的分镜,标出每个镜头拍什么、大概几秒。后面画图、生成视频,全照着这份角色、场景和分镜清单做,不会漏也不会乱。

先定妆,再开拍,角色的脸不能变

故事定了,接下来是让主角"长什么样"。这步看着不起眼,其实是整条视频成败的关键。

道理很简单:观众对"脸变了"的敏感,远远超过"画面好不好看"。上一个镜头还是这张脸,下个镜头五官换了个人,前面铺垫的氛围一下就散了。所以这一步我宁愿多花时间。

这里按照AI给的剧情,我先单独生成白灵,狐仙化形的白衣少女的形象:

2D日漫风格,日系萌系动漫插画;18岁 年轻女性 身高1.60米,体型轻盈纤细,中国人,黑色披肩长发,发间别一朵白色灯笼花,鹅蛋脸,大而明亮的光泽感浅棕眼眸,鼻梁小巧,唇色粉嫩,自然肤色,头发半挽起,带发饰,身穿素白色齐腰宋制百迭纱裙,直领对襟短褙子,浅灰调衣缘,裙长及地,裙摆覆盖脚踝与脚背,长度直达脚部,脚穿素白色绢布绣白花弓鞋

抽到一张满意的脸之后,马上用它生成正面、侧面、背面三张多视图。现在的生图工具都能传参考图,把这张脸传上去,让 AI 照着出,不同角度就不会换人。我把这几张图存好,后面所有镜头都拿它们当参照。

其他形象也是同样的路数,先出形象,再做三视图。

场景和道具,宁少勿滥

角色定了,照着前面AI写的场景清单补画面。我这条只要四个场景:青石板古镇(外)-雨夜街道、陈记灯笼铺(内)-前厅、陈记灯笼铺(内)-作坊、古镇端午灯会街道

道具单独出,担子、油灯、供桌上的旧物,故事里出现什么补什么。这步别贪多,镜头用不上的别浪费时间生成。

让画面动起来,一次打磨一个镜头

所有图备齐,才轮到生成视频。Seedance 系列、MiniMax、可灵这几个模型都能做,效果差不太多。

把角色图或场景图喂进去,输入文字的剧情描述。

这步不要一次性把所有镜头丢进去,首先AI生成不了那么长的画面,如果把提示词堆上去,画面时长不够,那就是一条快闪的视频。我头一回就这么干的,六个片段一起提交,结果第一个就出了问题,后面全得重来,白等半天。后来就老老实实一次只磨一个:生成一个,看效果,不行改提示词重来,满意了再下一个。

再交代几个真实情况。生成视频要排队,一条片子五六个镜头,等上半天很正常。而且不是每条都一次到位,人物的形象最容易崩,动不动就有出入;画面里要是同时出现两个以上的人,动作还容易打架。碰到这些,别怀疑是自己不会用,就是模型现阶段的水平,多抽几次挑能用的就行。

已关注
关注
重播 分享

片段齐了,剩下就是拼。我用剪映,别的剪辑软件也一样。

顺序按分镜排好,字幕让剪映自动识别,但导出前一定自己过一遍。志怪故事里生僻字多,"山魈""乩童"这类词,识别经常出错。

BGM 找古风、悬疑方向的,音量压到比人声低一截,它是垫底的,不是抢戏的。最后把画面切换卡在音乐的重音上,导出 一条就齐了。

做下来我最大的感受是:这类视频,工具解决的其实是"画面"和"声音",真正费心思的还是故事本身。

有个反直觉的发现:观众其实不介意画面是不是完美的。大家盯着的是故事讲得清不清楚、氛围到不到位。所以想明白这点,就不用跟每个镜头死磕,该放过就放过。

流程跑熟之后,做一条真的就是一个下午甚至一个小时的事。