乐于分享
好东西不私藏

从零开始自学AI视频第一课:塑造人物

从零开始自学AI视频第一课:塑造人物
第一步:AI人物形象创建
一般来说人物形象需要描述的非常清晰,这个方法费时费力很久都没弄出满意的,所以这里也不写下提示词。
所以还是直接把自己喜欢的人物图片去进行融合方便快捷出好图。
先找到几张不同的人物:

提示词1:参考图片,融合新的人物形象,发丝自然垂落在脸颊旁,身穿V领长袖上衣,纹理清晰有质感,商业人像柔光,无硬阴影、无死黑区城,面部光线均匀通透,眼窝、鼻影、唇周光影过渡自然,瞳孔添加细腻高光,让眼部更灵动有神。画面呈现模特面部特写,纯白色背景。

提示词2:

A photorealistic portrait of a distinct individual who looks like the biological offspring of the people in the provided reference photos.

The face should be a natural, organic blend of the input features, creating a unique new identity that bears a strong family resemblance to both inputs without being a direct copy of either.

Capture the subtle genetic traits from the references.

Character Description:

Subject: An Asian [女] model with flawless, pore-level skin texture.

Expression: Neutral and candid, with a high-quality photo realism aesthetic — soft, cinematic lighting that highlights facial contours.

Vibe: High-fashion, sophisticated, and authentic.

setting: white background, eye-level front face.

Technical Constraints:

Maintain consistent lighting across the blended features.

Output in 4k resolution, raw photography style.

提示词3:

Task: Create a hyper-realistic digital human character by blending the features of the provided reference images.

Fusion Instruction:

Seamlessly merge the facial structures of Reference Image 1 and Reference Image 2.

Face Shape: Create a balanced mix, aiming for [比如,图1的上庭和图2的下庭].

Goal: The result should look like a unique, single living person, not a collage or a morph.

Character Description:

Subject: An Asian [女] model with flawless, pore-level skin texture.

Expression: Neutral and candid, with a high-quality photo realism aesthetic — soft, cinematic lighting that highlights facial contours.

Vibe: High-fashion, sophisticated, and authentic.

setting: white background, eye-level front face.

Technical Constraints:

Maintain consistent lighting across the blended features.

Output in 4k resolution, raw photography style.

就这样不断的去融合去测试,找到心仪的那几个人物就可以开始继续。

每个人的审美都不一样,选择喜欢的就可以接下去了。

第二步:人物大头照完善

提示词:

严格以上传参考图中的人物脸部作为唯一身份锚点,保持同一张脸,不改变原有五官特征、脸型轮廓、眼睛形状、眼距、鼻梁鼻头、嘴唇形态、下颌线、眉眼神态与整体面部比例。不要生成陌生人,不要重新设计五官,不要把脸洗成另一种风格,只允许在不改变身份的前提下提升画质、肤质表现和整体商业摄影质感。

生成一张年轻东亚女性的超写实商业人像摄影,中景构图,人物面对镜头。整体呈现高端商业精修质感,角色身份统一稳定,面部保持与参考图高度一致。

皮肤保持真实细腻的商业摄影质感,可见轻微毛孔与自然肌理,保留真实肤感与细节层次,但不要夸张毛孔、不要放大瑕疵、不要增加皱纹、不要增加疲惫感、不要出现脏感或显老效果。整体肤质干净、通透、自然、精致,具有高级商业精修感,而不是塑料磨皮。

在保持人物原有面部身份完全不变的前提下,妆容升级为高级淡妆,整体妆感精致。

服装为白色抹胸,整体气质温柔、时尚、青春且高级。

背景为浅白色柔和渐变背景,简洁干净。光线采用柔和侧光结合轻微正面补光,突出面部立体感。整体色调为高级柔和暖色调,画质清晰通透,边缘锐利自然,无重影、无锯齿。最终输出为高端商业级精修人像,镜头语言为 Canon EF 85mm f/1.2 人像摄影风格,浅景深,焦点精准落在眼部。禁止改变五官,禁止改变脸型,禁止改变眼睛大小和形状,禁止改变鼻型,禁止改变嘴唇厚薄,禁止改变面部比例,禁止生成陌生脸,禁止脸部重塑,禁止显老,禁止苦相,禁止脏感,禁止夸张毛孔,禁止明显皱纹,禁止法令纹加深,禁止疲惫感,禁止面部结构硬化,禁止角色身份漂移。

第三步:人物全身照/三视图

提示词:生成一张角色设定图,白底风格,角色的正面全景全身像,构图需完整覆盖从头顶到脚底的全身比例,准确呈现角色的体型特征、服饰版型、肢体姿态及整体造型风格,超模身材比例,腿超长,超大胸。

根据我提供的人物形象,自由搭配纯欲系服饰,生成一张角色设定图,白底风格,采用网格布局,依次排列角色的正面、前侧面、背面全景全身像,构图需完整覆盖从头顶到脚底的全身比例,准确呈现角色的体型特征、服饰版型、肢体姿态及整体造型风格,超模身材比例,腿超长,大胸细腰。

第四步:给人物打码(过审即梦使用,大量测试发现过完审会换脸变成即梦特邀演员,这一步请慎重。)

提示词:

专业3D风格化角色肖像三联画,由三张完全相同的并排头像组成。每张头像的面部均覆盖特定几何色块遮罩:左侧肖像:T字形实心几何色块覆盖面部中央,T字上横边位于眉毛与发际线之间,竖条完全覆盖鼻梁宽度,向下延伸至下巴底端。中间肖像:实心矩形色块覆盖整个上半脸,矩形上边缘对齐发际线(或头顶),下边缘延伸至眼睛下方、鼻梁中部与颧骨位置,确保额头、眉毛及双眼被完全遮挡。右侧肖像:实心矩形色块覆盖下半脸,矩形下边缘对齐下巴,上边缘对齐颧骨。风格要求:遮罩为纯色实心平面色块,边缘锐利清晰;角色面部未被遮挡区域保留100%原有五官、皮肤质感与光影一致性。极简影棚摄影风格,遮罩与人物形成强烈对比。

这一套下来人物基本就固定好了。当然有些人精益求精还会去做身体这一步的内容,会把整个骨架都拆了来弄,这一步非常耗费时间,而且太过美学,我并没有去深入研究。不值当。

因为自己踩过很多坑,也是需要说明一下:使用各种开源去练LORA也是可以的,然后继续用开源去生图。但不建议新人去搞这个,我搞了不少时间,从最开始选图,打标,跑图,前前后后花了大几百块钱,最后人物生图时仍有明显的塑料感,没必要。毕竟不是专门搞美学的。人物差不多就好,图片可能看起来有点假,但后期经过剪映去处理的话就非常真实了。

主要还是视频制作这一块的内容了。

以上图片均来自nanobanana2。(豆包应该可以做,前期建议全部白嫖)

这里是记录自己从零开始到使用各种工具创建AI视频的全流程。

这里没有卖课,没有套路。

自己记录,仅供参考。不喜勿骂。谢谢