ARTICLE · 1157658
AI 时代,选对模型比努力更重要?
我在某个视频里看到有人分享了一个网站的登录页:页面上有个卡通小人,你输入密码的时候它会用手把眼睛捂上,登录失败它会摇头,登录成功它蹦起来欢呼。就这么几个小动作,我盯着看了好几遍。

太想要了。
我的部门工作台(楚伴)正好也要做登录页,AI 助手也得有个形象。这不就是现成的方向吗?
第一版:AI 画的 SVG 小机器人,能用,但不像"活物"
我让 AI 直接给我做一个。第二天我就拿到了:一个纯 SVG 画的紫色小机器人,待机状态上下浮动,输密码眯眼摇头,打招呼招手,六个状态全部用 CSS 动画驱动。
功能是全的。但我看着它,总觉得少了点什么——它是"平的"。
2D 矢量图再精致,终究是一张会动的图标,不是一个"角色"。我想要的是:它有表情、有光影、你鼠标移过去它会微微转向看你——像动画片里走出来的那种感觉。
然后我就钻进了兔子洞
我先用豆包生成了一张 3D 渲染风格的楚伴卡通形象。这张图出来的时候我挺满意的——圆润的白色身体、紫色和青绿色的点缀、圆脸上有个 M 形微笑。

好,形象有了。下一步:让它动起来。
我的想法很直接——让豆包用这张图做参考,生成一系列动态视频:待机呼吸的、打招呼的、输密码遮眼的、登录失败的。然后把这些视频接到登录页上,不同场景切换不同的视频。
听起来很简单对吧?
接下来的两天,我陷进去了。
问题一:视频一致性。 豆包生成的视频,每一段的人物大小、画布位置、背景颜色都不完全一样。这段人物偏左,那段偏右;这段稍微大一点,那段小一点。这就意味着,当你在页面上从"待机"切到"打招呼"的时候,形象会突然跳动一下——穿帮了。
问题二:首尾帧衔接。 从一段视频切到另一段,画面不能有明显跳跃。这就需要前一段的最后一帧和后一段的第一帧几乎一模一样。豆包的视频模式下,你很难精确控制首尾帧——每一段都是独立生成的,姿态和位置总有微小差异。
我试了豆包的工作模式、视频生成模式,反复调整提示词和参考图,花了大量时间,结果就是:一致性永远差一口气。
然后我想:豆包不行,那搭个工作流呢?
我花时间搭了一套 COZE 工作流。说实话,COZE 在一致性上确实进步了——生成的多段视频,人物位置和大小基本稳住了。但新问题来了:人物的表情和动作质量变差了。 笑容僵硬、转头卡顿、眨眼节奏怪异——你让 AI 同时满足"一致性"和"表现力",它就开始顾此失彼。


然后我开始调提示词。一遍、两遍、五遍、十遍。改参考图、加约束条件、换参数组合。折腾到后面我开始怀疑自己:我到底是在做产品,还是在跟 AI 较劲?
转折来得毫无预兆
到第二天下午,我差不多要放弃了。视频方案不行,那就退回去用静态图片——我让豆包之前生成的定稿形象,再用 AI 生成四张不同表情的变体(微笑、开心、思考、出错),然后手动写 CSS 动画让它"看起来"在动。
就在这时,我突然想:不如把我这张定稿图丢给 WorkBuddy,选一个好点的模型,例如 GLM-5.3,让它直接给我写一个完整的动态网页?
我甚至没有认真"写提示词"。就是把图丢进去,说了一句:"把这个形象做成登录页的动态形象,点它会打招呼,输密码会遮眼,多戳几下会晕。"
三分钟后,页面跑起来了。
不是概念图,不是预览视频,是一个可以直接打开、可以点、可以戳、所有交互都通的完整网页。
更让我意外的是效果——3D 质感的 PNG 贴图 + CSS transform 做鼠标视差转头 + 表情图切换 + 关键帧动画,所有状态联动完全丝滑,没有视频方案那些一致性、首尾帧、画布尺寸的问题。
我前面花了两天半试图用视频解决的事情,用 CSS 动画 + 表情图矩阵,一个下午全搞定了。
这个方案甚至比视频更实用:文件小几十倍、加载快、可控性高、状态切换零延迟。
然后我又让 AI 加了一个彩蛋——连续快速点击三下形象,它会切换成 X 眼晕圈脸,左右摇晃,弹出一句"别戳啦,我头晕了~"。
我当时看着浏览器里那个摇头晃脑的小机器人,觉得有点好笑:我费了那么大劲去搞视频,结果答案一直在前端 CSS 这个最简单的方向上。
说实话,我有点迷茫
这件事之后我一直在想一个问题:我现在花时间学 AI、调提示词、搭工作流、研究各种工具,还有意义吗?
想想最早 AI 能生成视频的时候,我第一时间充了可灵AI的会员。那时候做一条短片,得一张图一张图地生成,每一帧都在"抽卡"——这个镜头动作歪了重新来,那个镜头光影不对重新来。把所有素材攒齐,再拖进剪映一条一条拼。做一个一分钟的小片子,前后要花五六个小时。
现在呢?Seedance 出来之后,门槛直接降到脚底。你只需要一段文字描述,它给你一整段视频。
同样的轨迹也发生在我这次做动态形象上:我花了两天时间折腾视频一致性、首尾帧衔接、多段视频协调——这些在几个月前还是"高端技能"的事情。而今天,一个模型直接生成完整网页代码,不仅解决了我的问题,还让那些"技能"一夜之间过时了。
你在某个方向上的努力,模型的进化可以轻易抹掉。
但我想了想,又觉得不对
如果"技能会过时"就是不去学的理由,那我们这一代人早就可以躺平了——Flash 会过时、PhotoShop抠图也会过时。
真正没变的,是我看到别人的动态登录页时脑子里冒出来的那个念头:"这个好,我也想要。"
不是我有多擅长用 AI、会多少个提示词技法——而是我每天在刷的时候,看一眼就知道什么东西能用在我的产品里、什么东西能提升用户体验。
AI 会越来越强,提示词会越来越不重要,工作流会被大模型原生能力替代。但有一件事不会变:你得先有一个想法。 你得先觉得"那个登录页的卡通小人很酷",然后才会去折腾、去试错、去最终找到解法。
所以不用急。别天天焦虑"我不学 AI 会不会被淘汰"。你该关注的是:你今天看到了什么、想到了什么、觉得什么东西可以变得更好。
AI 负责执行,你负责决定做什么。而后者,才是最难被替代的。