ARTICLE · 1111767
Personal AI assitant 为什么集体“长出了脸”?

大家都偷偷长出了脸
刚结束的 OpenAI DevDay 上,除了万众瞩目的 6.1sol(顺便吐槽一下,推迟了好久都才推送给我!!),这场发布会还把整个 AI 圈抄了个遍,虽然演示翻车、产品反应速度慢可以说是血统老毛病了!总体来说是上打 Grok Bot,下踢飞书豆包工作。我今天要讲的,和它新发布的 Dots 有关。之前 9 月 8 号发布的 Muse,和 8 月 11 号发布的 Grok Bot。
大家应该都看到了这个现象,但十有八九没再往深里想一步:为什么短时间内,这些产品都选择长出“一张脸”?其实身为我们产品经理,就应该具备这样敏锐的嗅觉,做到每当一家的产品做出的趋同性动作和差异性行为都能进行快速分析且转化,甚至必要时刻分析完其他产品后立马进行快速迭代。
那话不多说,let’s dive in
啥时候开始长出脸!(我自己梳理了一下时间点)
希望大家看了能说出对应时间,能在关键时间点装装b)
8 月 11 日,Grok Bot:SpaceXAI 发布的常驻 Agent。官方上有一篇专门的设计文,核心无比直接就是一句:统一的简单形状加富表现力的眼睛,靠形状和配饰来区分不同的 Bot。
9 月 8 日,Meta Muse:默认形象叫 Jolly,奶油色毛绒、豆豆眼、粉腮红,设计者是 Alex Cornell,可以完全自定义。后面还配了一个叫 Charm 的随身小挂件,一眼就是高级AI版拓麻歌子。
9 月 29 日,OpenAI Dots(DevDay 同场发布):彩色的拟人化小圆点,可以配眼镜、帽子、领结,能起名字,能自定义。目前的情况是媒体普遍把它看成对标 Muse。
上面都是personal assistent AI 产品,我们其实可以再往前看,给自己产品添加造型和可爱形象其实不是这三家突然发明的:Claude Code 的像素小螃蟹 Clawd,2025 年 9 月就由官方社交账号引入了;Codex 也在 2026 年 5 月 1 日上了 Codex Pets(像素宠物,还能自己生成)。
说白了,开发者工具那边的“QQ宠物”早就养起来了,只是这次轮到面向大众的 Agent AI集体出场。
为什么偏偏是现在?
以前的聊天机器人,你问一句它答一句,没必要有脸;但是现在的 Agent 是常驻的、在后台干活的,你得知道它此刻是闲着,是在忙,还是卡住了。
Grok Bot 的设计文里就明确写了,头像会用动态表达去展示待机、工作、阻塞这些状态。这正好是尼尔森十大可用性原则里的第一条,“系统状态可见性
”:系统要随时让用户知道发生了什么。(其他的分别是系统状态可见性,系统与现实世界匹配,用户控制与自由,一致性与标准,错误预防)

所以脸首先是个功能件,其次才是情绪件。(把“状态指示灯”换成“一张会眨眼的脸”,信息量一样,但作为使用者的我们看着舒服多了。)
我自己的体验:这张脸到底改变了什么
声明!我是体验设计出身的,所以看产品有个职业病:先看入口,再看人愿不愿意点。
先交代一下我的使用情况:Dots 和 Grok Bot 我是深度用户;Muse 因为地区限制,我只能算轻度尝鲜(它截至 9 月 27 日的报道,只开放了美国和加拿大,国区用不了)。所以 Muse 我不强装明白人哈,没体验过产品就美话语权,主要聊他公开信息和设计逻辑。
先说 Grok Bot。它最早把自己的图标,从一个纯 logo 变成了一个小黑点,上面长着眼睛。摇身一变,让我的第一反应变成为:这个入口,我想点。(当然设计的好看很重要哈)相较于当时千篇一律的纯 logo 的 AI 产品,或者各种 harness,它最大的区别就是让人愿意点开、愿意用。(说白了,logo 是用来认的,脸是用来勾引人的。)
点开之后更有意思:列表里是一张张小脸浮现出来,不再是传统的聊天框。以前的“对话框”,虽然叫对话框,但你面对的就是一块输入区,没有对话感;现在列表里站着一个个有脸的存在,开口的时候,会真有一种“我在跟谁说话”的感觉。
从体验设计角度讲,这是把“操作一个工具”变成了“找一个对象交流”,心理门槛一下子就低了。
三家的“脸”,能调到什么程度
我查了一圈,当前的脸都啥情况,整理成一张表:

三家的风格在我看来非常相似:
简约,带眼睛,带可爱表情。Grok 出得早,个性化程度没有 Muse 高,这点我能理解。
但我想说的是,“真正的差别在于“形象和性格有没有联动”。在我的实际使用里,Dots 和 Grok Bot 目前只在“形象”这一层做出了区别:用语、交互方式,两边都没有明显个性化,形象不会反过来影响它怎么跟你说话。Muse 把 Avatar、名字、人格和表达风格放在同一套角色塑造体系里。
用户可以同时定义它“长什么样、叫什么、是什么性格、怎么说话”,让 AI Agent 形成统一的人格体验。
我猜 Dots 的情况是,OpenAI 这阵子连着出了好多产品,主要在对标别人、忙着补齐自己的产品矩阵,细节上还没顾得上打磨。
Muse 的小挂件:为什么大家都说它像拓麻歌子
Muse 还出了个硬件叫 Muse Charm,钥匙扣大小,两英寸的屏幕整个就是一个可自定义的卡通形象。能放默认吉祥物 Jolly,也能换成拟人芒果、拉布拉多、戴墨镜的吐司;能语音聊天,还能处理邮件、订行程(Dezeen)。
一发布,全网都在喊“AI 拓麻歌子”。TechCrunch 还提了一个更新的参照,就是年轻人把旧 Apple Watch 当包挂的潮流。所以我只写“外界都说像”。
那么问题来了,拓麻歌子是啥?那拓麻歌子当年凭什么这么能打?
它是 1996 年 Bandai 推出的蛋形小机器,几颗按键加一块简陋的像素屏,累计出货超 1 亿台。
它的魔力不在屏幕,在“照顾”。你得喂它、陪它玩,不管它就会“死”。付出越多,感情越深。
它是钥匙扣形态,随身带,是个有存在感的实物。
Muse Charm 的思路很像:把形象放进一个随身的实体里,给它一张脸、一个名字。Guardian 采访的学者 Joshua Paul Dale 说得挺直白:Meta 想把 Muse 做成伙伴,用的是最简单的办法,一块很小很简化的屏幕,诱导你把上面的形象当成有生命的东西。
不过 PCMag 的编辑吐槽,说这是对拓麻歌子的“污蔑”:拓麻歌子是能收藏、能魔改、能升值的玩具,而 Muse Charm 一旦服务器关了,就剩一块电子垃圾。(这条挺扎心,后面讲风险时我们还要用。)
这么个小玩意为什么能引发这么大反应?我觉得刚好可以套诺曼的情感化设计三层次:
本能层:形状圆润,屏幕上只有一张脸,先“萌”一下,戒心就降了。
行为层:随身,不用解锁手机,抬手就能说话,使用路径变短了。
反思层:自己选形象、起名字,它就成了“我的”,变成自我表达的一部分。

为什么三家都选了“抽象的脸”:恐怖谷
这里我想插一个理论,恐怖谷。注意,很多人会记反:它不是“越吓人越亲近”,而是日本机器人学家森政弘 1970 年提出的:形象越像人,好感越高;但在“接近真人、又差一点点”的时候,好感会突然跌进谷底也就是我们说的像伪人,伪人感十足,让人毛骨悚然(甚至不少游戏都利用这个理念去设计怪物);再往上到真人水平才会回升。
所以抽象、简化的形象,其实是一种聪明的躲坑:圆点加眼睛,不会掉进谷里。这也解释了为什么这三家的方向这么像。
国内有个特别典型的对照,小鹏。
早期的小P,身体比例更接近真人,还戴着头盔。从车主社区的反馈看,大家的评价很集中:缺乏亲切感,有距离感。2023 年的 1024 科技日上,小鹏把它换成了大圆头、小身体的卡通形象。我的理解是:想传达“我们是有科技感的公司”,结果让用户觉得“有点冷”,这是情感传递的偏差。
小鹏自己的人形机器人 IRON 是另一个例子:2025 年 11 月发布后,因为走路太像真人,被网友质疑是“真人套壳”,何小鹏最后在发布会现场剪开了机器人的小腿自证。
一个越像越让人起疑,一个越卡通越让人放松。放在一起,刚好能说明问题。

产品对比:脸分四类,再看 NOMI 和国内三条路
四类“脸”
调研下来,我把现在的玩法分成四类:官方主打型、工具内置型、社区共创型、没有形象型。


把“长出脸”做得最彻底的,其实是 NOMI
到这儿,我得提一下我心里“长出脸”做得最彻底的产品:蔚来的 NOMI。最近的豆包汽车也采用了类似防范,后面陆续所有车企都在抄袭这个方案。
NOMI 的做法是:你给它戴上不同的帽子,它就切换成不同的状态来跟你说话。第三代 NOMI 还能通过 NFC 识别头饰,车机里的形象、地图动画、声音和音效一起变。NOMI GPT 的情感引擎会还能通过长期陪伴,让每个 NOMI 形成跟用户性格契合的“人设”。
这个设计最厉害的地方,是让用户的心态变了:我不是在操作一个工具,我是在跟一个“它”相处。
再讲一个我自己的故事。我以前在蔚来工作,亲眼见过很多用户是这样操作的(现在出厂预装官方价 4900 元,交付后再加装是 5280 元,少数顶配签名版标配,有活动的时候还会半价)很多用户自以为聪明,觉得这钱可以省:一个语音助手而已,手机里不也有吗?结果开了一阵子,有没有 NOMI,体验天差地别。不是在打广告哈,事实是,在我的体感里,它是座舱和人之间的“交通枢纽”,也是“感知枢纽”,没有它,整个座舱的体验是大打折扣的。
放到 AI 产品上,我想说的是:形象不是装饰,它是人和系统之间的枢纽。脸只是入口,真正留住人的,是脸背后跟着变的语气、声音和人设。
尤其是声音。TTS(文字转语音)一定要做个性化,这是我对 Dots 和 Grok Bot 下一步最大的期待:现在它们只是把脸拉开了差距,声音和说话方式还没拉开,这一课得补上。
国内这边,脸也卷起来了
这两天国内确实有不少大厂在集中进入个人 AI 助理这个赛道,不要以为只有海外在玩。国内早就在“给 AI 一张脸”上各显神通了,我分成三条路来讲,再聊聊我自己用过的几个。
路线一:官方直接给你一张脸。
千问今年 4 月推出了“小酒窝”:丸子头、橙白穿搭。按央广网的报道,官方的说法是“酒窝寓意打开用户脸上的笑容开关”。(好家伙,连脸上哪个部位都设计了含义。)澎湃的解读说它走写实风,和豆包的卡通路线形成对比——注意,这是媒体的观点,不是官方说法。
荣耀 YOYO 更早:2018 年就是一个紫发二次元少女,到今年 8 月的 Robot Phone,又给它配了会动的云台“身体”。理想同学则有一个 3D 毛绒形象(2025 年 5 月),可以和前面讲的 NOMI 放在一起看:车里的助手,都在往“有个伴”的方向走。
路线二:你自己造一张脸。
小米 18 Pro 在 9 月 23 日发布的“AI 百变背屏”,用户可以用宠物、偶像的素材生成可交互的形象,智东西的说法是“就像把小爱换了个形象放到背屏上”。vivo OriginOS 7 的“AI 萌宠主题”(9 月 16 日),则是上传自家宠物的照片,生成一只数字宠物。
这和 Muse、Dots 的“自定义”是同一个方向,只是国内更爱拿宠物和偶像做文章。
路线三:克制,甚至不给脸。
微信的“小微”(6 月灰度)只有一对绿色小眼睛,没有角色。海外的 Manus Cue(9 月 28 日)让用户自己选名字和头像,不给固定的脸。我自己的体验:豆包、理想同学和小微
豆包,靠“人设”出圈。在我看来,国内这批助手里,形象塑造最深入人心的就是豆包。原因很简单:它是国民级产品,连老爷爷老奶奶都在用。你随便刷刷网上,还能看到一堆网红在模仿它的说话方式和造型。(一个产品的口吻被拿来当梗,说白了就是品牌资产已经出圈了。)
理想同学,靠“动作”加分。它是理想的“当家花旦”,和任务大师联动之后,会让你觉得这台车机真的很聪明。我最喜欢的是它在车机上的小动画:比如你让它帮你点一杯咖啡,理想同学的小手会从屏幕顶部飞到下面,模仿一次按钮点击。这个小动作同时干了两件事:一是告诉你它正在帮你操作(这里可以回想起尼尔森的“系统状态可见”吗?),二是让整个过程更有沉浸感、更有趣。脸不只是装饰,在这里它变成了“状态的演员”。
微信小微,躲在树洞里的小精灵。小微只有一对绿色的小眼睛,给我的感觉特别准:像一只躲在树洞里的小精灵,你不叫它,它就安静待着,你一开口,它才探出眼睛看你。这恰好切合微信一贯“小而美”的产品方针:克制、不打扰、工具感大于角色感。
同样是“圆点加眼睛”,Grok Bot 是想让你“想点开”,小微是让你“不被打扰”:一个主动邀请,一个安静待命。
豆包靠“说话方式加造型”走进大众,偏品牌,对应诺曼三层次里的反思层;理想同学靠“动作加场景”赢得好感,偏交互,对应行为层。小微则干脆把脸压到最小。
说白了,国内目前是“官方脸”“自己造脸”“不给脸”三条路并行。这也印证了一个判断:脸不是标配,而是一个需要认真做选择的产品决策。
为什么人会依恋一张脸
这里我想拿豆包举例。豆包大家都熟,默认是那个女生形象,同时它也能选男形象。我自己试过切换,说实话,第一时间的感觉是别扭:仿佛换了一个人在跟我聊天,甚至有点像换了一个产品。可明明它还拥有我的上下文,拥有我的记忆,还能在原来的话题上接着聊。
再叠加自媒体里各种“调教豆包”“用豆包男声假扮男友”的梗,你会发现:一个产品的声音和脸,早就被用户玩成了一个“人”。说白了,用户依赖的早就不只是功能,而是那个稳定的、熟悉的“它”。
小葵花理论课来了!
理论一:拟社会互动,把 AI 当成“熟人”
这背后有个专业理论,叫拟社会互动(Parasocial Interaction)。1956 年由 Horton 和 Wohl 提出,原本讲的是观众对电视主持人、角色单方面产生的熟悉感:明知道对方不认识自己,也会觉得“这是我的朋友”。
AI 吉祥物是它的加强版,因为电视里的人不会回你话,AI 会。所以产品经理要意识到:
一旦给产品加上脸和声音,你就是在给用户建立一段“关系”。关系一旦建立,改它的声音、换它的脸,用户感受到的就不是“升级”,而是“换人了”。
理论二、三:婴儿图式和 CASA,为什么偏偏是大眼圆头
婴儿图式(Kindchenschema),动物行为学家洛伦茨提出:大头、大眼睛、圆脸、小身体,会本能地触发人的照顾和喜爱。你再回头看 Grok Bot、Dots、小P 的新形象,是不是都是大眼圆头?这不是巧合。(“大圆头、小身体”这个特征,小P 改版时官方社区帖里就是这么写的。)
CASA(Computers Are Social Actors,计算机即社会行动者),Reeves 和 Nass 在 1990 年代做了一系列实验:人会下意识地用对待人的方式,对待有社交线索(会说话、会回应)的机器,比如对它客气、在意它的“评价”。AI 一旦有了声音和脸,这些社交线索只会更多。(其实自己平常用ai的时候经常会请这个词哈哈哈,我是不是贼有素质!)
我把这几个理论串起来,能对应诺曼的情感化设计三层次:

从 JTBD 看:用户“雇”这张脸,是为了什么
用 JTBD(待办任务)的视角再看一遍:用户雇一个 AI 产品,除了“帮我把事办了”这个功能任务,往往还有一个情感任务:“让我在用它的时候不那么孤单、不那么紧张、有点乐趣”。脸和声音,干的就是这份情感任务的活。(这是我的分析,不是研究结论。)
从品牌角度看也一样:一张被记住的脸,是品牌资产。你能记住豆包,不是因为模型参数,而是因为它的口吻、它的造型被网友模仿、被做成梗。同质化越严重,这张脸越值钱。
前车之鉴:脸是怎么翻车的,又是怎么活下来的
聊了这么多“脸”的好处,咱得泼点冷水,不然就成吹捧文了。历史上有一堆“长脸”的先烈,我挑几个看。
失败的:强行打扰的,和被撤下的
Clippy(微软办公助手“回形针”),几乎是所有“AI 吉祥物”文章绕不开的反面教材。它的问题不是丑,而是**在你不需要的时候跳出来,又没那么聪明**(The Atlantic 等媒体长期把它作为反例)。
Mico(微软 Copilot 的果冻状小球),2025 年 10 月 23 日上线,主打语音交互,还留了变成 Clippy 的彩蛋。但据 TechCrunch 报道,2026 年 8 月它被撤出了 Copilot 主界面,只保留在 Learn Live 模块里。
我身边的真实案例:ChatGPT 桌面端的 Pets。这个不是读来的,是我同事们的真实反馈。OpenAI 在桌面端做了个 “Mini & Pets”,按 ⌥Space 就能呼出一只像素风小机器人(默认那只脸上是红色的 “NULL”,哇,真的很有程序员的幽默感)。但它的对话窗口老是拦住、挡住屏幕上的信息源,再加上造型不够美观,我好多同事干脆关掉了,甚至有人直接去 vibecoding(用 AI 写代码)给自己做了一个专属造型。
你看,这就是上面说的“反向型”:脸本身没错,错在它挡了用户的事。而“自己做造型”这一点更有意思:用户嫌你的脸,就会自己动手换一张。耐人寻味的是,这个功能里本来就有 Customize 和 Create pet 的入口,说白了,用户要的不是没有脸,而是一张自己能管的脸。
活下来的:多邻国的猫头鹰
对照看看多邻国(Duolingo)的猫头鹰。据 BBC 报道,它在社交媒体上的粉丝数超过 2000 万。它为什么能活?我的归纳是:它是用户自愿接触的,性格稳定,而且和产品的激励机制(打卡、提醒)绑在一起,它是“有用”的。
拓麻歌子也类似:靠“养成”这个有用的机制活了下来。
用 Kano 模型看:吉祥物到底是什么属性
Kano 模型把用户需求分成几类:必备型(没有就生气)、期望型(越多越好)、魅力型(没有不生气,有了很惊喜),还有一种反向型(有了反而更不满意)。
我的分析是:

能活下来的有什么共性?
把上面的案例放一起,规律其实挺朴素:可选、有用、性格稳定、能被用户改造的,活得下来;强制打扰、没有实用价值的,会被撤掉。
说白了,脸不是免死金牌。它只是放大器,放大一个产品本身是“有用”还是“添乱”。

市场与环境:吉祥物是真需求,也是真话术
一句话立场:吉祥物是真需求,也是真话术,区别在于这张脸背后,有没有做到可见、可控、可解释。
同质化:模型都差不多了,只好靠“脸”差异化
大模型的能力越来越接近,产品到最后拼的是“让人记住你”。BBC 的报道里,有专家认为大厂借吉祥物来应对信任危机;Mozilla 也提到想和那些“冷冰冰”的竞品 logo 拉开差异。脸,成了同质化时代里最便宜、也最直观的差异化手段。
信任:萌,既是亲近,也是降戒心
Axios 的报道指出,Meta 的 Muse 是在“AI 末日论”盛行的背景下,用萌化形象推出的。The Register 也说 OpenAI 在用可爱的图形化解 AI 焦虑。The Verge 更直接,警告读者“别被可爱的脸骗了”。
我自己的体验是:这张脸并没有让我放松警惕,我用 AI 的时候一直是带着警惕的。但说白了,会让我更乐意用它。
所以我的看法是:这不矛盾。可爱确实让人更愿意靠近 AI,降的是“心理门槛”,不一定降“警惕心”。不过我是带着警惕用的,换成不设防的普通用户,就可能少设防。越可爱,越需要把“它在干什么、能碰什么、数据去哪了”讲清楚。
风险:越让人依恋,出事代价越大
隐私
:Muse 被报道出现过隐私问题(包括泄露地址的事故)。这类事故在“有脸、被信任”的产品上,伤害会更大。
陪伴类产品的监管
:美国 FTC 在 2025 年 9 月启动了对陪伴类聊天机器人的调查;加州 SB 243 于 2026 年 1 月 1 日生效;Character.AI 与 Google 就相关诉讼达成和解。
国内
:《人工智能拟人化互动服务管理暂行办法》2026 年 4 月 10 日公布,7 月 15 日起施行。方向很明确:拟人化的交互,开始有规矩了。
硬件的尾巴
:Muse Charm 这类实体小挂件,服务器一关就成了电子垃圾。这是“脸要有实物”之后绕不开的问题.
国内外的一个小对比
海外这波更像“官方集中发布一张脸”,国内是三条路并行。共同点是:大家都意识到脸是入口,但谁都没想清楚,脸后面那份责任怎么担。

产品经理怎么用:要不要给你的产品长一张脸?
聊了这么多,回到咱们产品经理的本行。我整理了一份判断清单,前三条讲怎么落地,后三条讲怎么不翻车。
落地三步

避坑三条

给未来三年来个预测
吉祥物会成为 Agent 的标配。
按 Kano 模型的理论,魅力型会变成期望型,没脸的产品反而显得冷。
走向“每人一只”的自定义,这是我最看好的一条。
Muse 和 Dots 已经开了头,小米、vivo 也在让用户用宠物生成形象,连 ChatGPT 的 Pets 都开了 Create pet。我的判断是:三年后这张脸会是每个人自己定制的、专属的、自己喜爱的东西,而不是厂商发一只大家都一样。下一步是个人的长期记忆和性格,让同一个形象在不同人手里长出不同的样子。
产品会想办法淡化“这是 AI”的印象,逐渐变成生活的一部分。
就像手机、闹钟、家里的某个小摆件,你用着用着就不觉得它是个“AI 产品”了。
延伸到实体和周边。
Muse Charm、NOMI 的帽子都在说:脸要有实物。
监管会跟上,而且会和上一条拧着来。
产品想让人淡化“这是 AI”,监管却越来越要求披露 AI 身份、保护未成年人。我觉得这是三年里最值得盯的一对矛盾:脸越融进生活,越需要在关键时刻让用户一眼看清“你在和 AI 说话”。
最后,只有“有用加有性格”的才能留下。
光靠萌,会被淘汰。

三句话总结
这批 AI 产品长出脸,不是巧合,是 Agent 常驻后台、大模型趋同、用户需要信任感三件事撞在了一起。
脸是放大器:放大好体验,也放大坏体验。靠婴儿图式降戒心,靠 CASA 让人当它是人,靠拟社会互动留住人。
对产品经理来说,不是要不要做吉祥物,而是这张脸背后有没有做到“可见、可控、可解释
”。

(伸出小手给我点点赞好吗,这么可爱的产品你们遇不到第二个了!❤️)