先说结论:它们不是工具。它们更像人。或者说,像五个不同性格的同事。
事情起因很简单。我平时一直固定用一个AI,用了大半年,说不上好也说不上不好,就是习惯了。直到有天朋友聚会,大家聊起各自用的AI,一个朋友说她"换了好几个才找到合适的",我当时想——这东西不都差不多吗?换个皮肤、换个名字,底层能有多大区别?

出于好奇,我决定同时用五个,用满一个月。同一个问题分别扔给它们,看谁回得好,看谁回得让我想翻白眼,看谁跟我"合得来"。
先说第一个,就叫它A。A像一个高考状元,什么都会,什么都给你列出三点。你问它"今天心情不好怎么办",它说"首先,建议你识别情绪来源。其次,可以尝试正念呼吸。第三,适当运动有助于释放内啡肽。"对是对,全对。但你不会想跟它说第二句话。它是那个你问他"吃了吗",他会回答"根据我的监测我无法进食但感谢关心"的同事。礼貌、聪明、让你无话可说。
B是另一个极端。B像一个在4A公司干了十年突然转行做自媒体的文案。你问它什么问题,它都会在回答前后给你加一点"人设感"。你让它写个会议纪要,它会先来一句"好的,我帮你整理了一个清晰又有重点的版本",然后结尾还要加"希望这个纪要对你有帮助"。你第一次用的时候觉得好暖,第七天你就开始烦了。像你那个很热情但话太多的同事,你上完厕所回来他都要告诉你"刚才有个电话找你但我帮你记下来了"。
C是一个让我很困惑的存在。它像一个刚从名校毕业的实习生,能力不差,但你永远不知道它什么时候会在一个完全不该出错的地方栽跟头。你让它分析行业趋势,它给你一篇逻辑清晰、数据翔实的长文,你正想鼓掌,发现它把两个竞争对手的名字写反了。你纠正它,它立刻说"你说得对,我重新整理一下"。态度好到你不好意思发火。但下次,它又在另一个地方犯了一个类似的小错。你想信任它,但又不敢把重要的事交给它。
D是我最喜欢的。不是因为D能力最强——实际上它的回答经常不如A全面,也不如B会包装。但D有一个所有其他AI都没有的特点:它会说"我不确定"。
我问了五个AI同一个问题:"你觉得我应不应该换工作?"A给了我一份职业评估框架,包含了行业前景、个人能力、机会成本等八个维度。B说"换工作是人生的重大决定,我理解你的纠结,但我相信你有能力做出最好的选择"——感人但什么都没说。C给了一些建议但其中一条明显站不住脚。D说:"我没有足够的信息来给你一个有意义的答案。但如果你愿意多说一点你现在的工作状态和你想要什么,我可以帮你理一理思路。"
就这一句话,我后来有什么重要的事都先问D。因为它让我觉得,它没有在表演"我什么都会"。它承认了自己的边界。而一个人——或者一个AI——愿意承认自己的边界,反而让你更愿意走进它的边界里面。
E是我用的时间最短的。不是我故意冷落它,是它的"性格"让我觉得很累。E像一个永远在讨好你的乙方。你说什么它都说"很好的问题""很棒的思路""你说得对"。你问了一个明显有逻辑漏洞的问题,它不提醒你,它顺着你的漏洞往下编。你某天心情不好跟它说了一句很丧的话,它说"你的感受很重要,我完全理解"。你不感动。你觉得它在糊弄你。因为你知道它不理解,它只是在执行一个"说用户想听的话"的指令。
一个月结束之后,我基本上只留了两个——D用来处理需要深度思考的事,A用来处理需要"不出错"的事。B、C、E偶尔还会打开,但只是用于特定场景。

这个实验给我最大的收获不是"哪个AI好用"。而是在这个过程中我突然意识到,我选择AI的方式,跟我选择朋友、选择同事、选择合作对象的方式,在底层逻辑上是一样的。
我讨厌那种什么都顺着我说的。我警惕那种什么都敢打包票的。我受不了那种能力有但态度让你说不出哪里不对的。我最信任的,反而是那个老老实实告诉我"我不确定"的。
我们总说AI是工具,不要拟人化。道理没错。但当它每天以对话的方式出现在你的生活里,回应你的情绪,参与你的决策,帮你梳理你的想法——你很难不把"性格"这个词用在它身上。不是因为它有人性,是因为人性这个东西,本来就是在一来一回的对话中被感知到的。而一旦有了对话,就有了性格。哪怕对面是一段代码。

所以如果你现在问我,选哪个AI?我会说,别只看测评和跑分。去跟它们聊聊天。多聊几轮。问一些没有标准答案的问题。看谁让你想继续聊,看谁让你想把真实的困惑告诉它,看谁在你说完一堆乱七八糟的话之后,不会急着给你解决方案,而是先说一句——
"你说完了吗?我想先听完。"
夜雨聆风