ARTICLE · 977536
人类的傲慢,我今天就想给 AI 正身.聊本质,我更看好一个我不喜欢的

你看见的,也许只是水面上的那一角。
一次回答可以暴露问题,但不能代表本质。
朋友跟我说,有个一千万粉丝的大V,评价豆包很傻。
他说,你说一个人坏,豆包就跟着说坏;你再说这个人有些地方其实还行,它马上又转过来,说确实如此,并且极其赞同。
朋友觉得,人家毕竟是一千万粉丝的大佬,应该是看透本质了。
我听完就火了,甚至爆了粗口。
哪来的大佬?
在别的赛道有一千万粉丝,跑来评价AI,他说的话就成圣旨了?
当然,粉丝多少不是重点。我真正反感的,是“看透本质”这四个字。
你可以说豆包这次回答很傻,可以说它迎合用户、前后摇摆、缺少判断。这个现象确实存在。
但从“这次聊天很傻”,直接跳到“我看透了AI的本质”,中间差的不是一点,是整套调研。
一次回答,能暴露问题;不能代表本质
什么叫本质?
至少应该是把表面换掉,把使用场景换掉,把操作的人也换掉,这个判断依然成立。
可他接触了什么?
一个聊天窗口,几轮对话,一种使用方式。
然后,他拿一个局部现象,给整个人工智能下了总判决。
这不是看透本质。这只是看见一个问题以后,急着把结论说大。
而且,聊天模型迎合用户,并不是什么只有外行大V才发现的惊天秘密。AI行业把这种现象称为“迎合”或“谄媚”。OpenAI就曾因为一次更新让模型变得过度附和用户,而公开回滚。
所以这件事应该怎样判断?
豆包被带着改口,说明这次回答有问题。没毛病。
但这证明的是模型在特定对话中的缺陷,不是“AI的本质就是傻”。
一个自动挡在复杂路况下换错了挡,你可以骂它的自动挡做得差;但你不能只摸过自动挡,就宣布自己已经看透了整台车。
请在微信客户端打开
所以我才想问:
你设过Agent吗?
你调用过Skill吗?
你让AI接过工具、读取资料、执行流程、按标准检查结果吗?
你试过把它放进一个真实工作里,而不是只让它陪你聊天吗?
我问这些,不是要拿术语给自己装门槛,更不是说没做过本地部署就不配评价AI。
这些问题只是在确认一件事:
你评价的究竟是AI,还是你面前那个最浅、最方便,也最容易暴露迎合问题的聊天界面?
今天的大模型可以只聊天,也可以调用工具、处理文件、连接知识、拆分任务、反复检查。它们现在还很幼稚,错误很多,离真正可靠也很远。
但“很不成熟”和“本质就是傻”,不是一回事。
你用专业摄影机的自动挡拍糊了,可以说自动挡不好用。可菜单没进过,镜头没换过,参数没调过,素材也没进过后期,就跑出来说自己看透了摄影机的本质——这不是判断力,是胆子大。

只碰过最浅的一层,不等于了解整套机器。
真正的变化,是“头脑”开始长出“手脚”
很多现在很火的AIGC软件,在我看来更像AI的手脚。
它帮你画图、剪片、配音、生成视频、整理文档,完成的是一个个具体动作。
而DeepSeek、GPT、豆包这一类大模型,更像头脑。它先理解你要什么,再决定调用什么能力,把动作串成流程。
手脚型工具想变聪明,往往需要接入更强的头脑;反过来,头脑型AI想长出手脚,却是迟早会发生的事。它可以通过工具调用,把原来只会“说”的能力,逐步变成“做”。
这也正是为什么,只盯着聊天框里一句话聪不聪明,很容易看错AI。
你测到的是它的一张嘴。
真正会改变行业的,是这张嘴后面什么时候接上眼睛、记忆、工具和执行流程。

AI真正的变化,不只是更会说,而是开始连接真实工作的“手脚”。
AI对标的不是一款陪聊软件。我更愿意把它看成工业时代那类通用能力的开端:先不成熟,先到处出错,然后慢慢进入各行各业,改变原来的分工。
这当然是我的判断,不是已经发生完的事实。
但至少,要讨论这个判断,你得先看见AI不止有一个聊天框。
我不用豆包,却为什么仍然看好它?
说实话,我现在并不常用豆包。
放到全球头部AI里比较,它目前也不是我最顺手、最信任的那个。
但我仍然看好它。
不是因为它今天最聪明,更不是因为它每次回答都对。恰恰相反,它今天不好用的地方,我一样会骂。
我看的是它背后的战场。
豆包是字节跳动的产品。字节手里有抖音,有剪映,有巨量的内容生产者、商家、直播间,也有一条真实存在的内容生产和传播链。
一个平台要持续运转,就怕创作者不会拍、不会剪、不会写、不会卖,也怕他们觉得太难,干脆不做。
剪映为什么重要?它当然是在帮用户剪视频。但从整个生态看,它还在降低内容生产的门槛:原来不会剪的人,也能做出一条片子,也可能把它发到平台上。
这是我的商业判断,不是字节的内部说法。
同样的逻辑放到豆包上,就很好理解了。
怕你不会写文案,它可以帮你起稿;
怕你不会做分镜,它可以帮你拆画面;
怕你不会做商品宣传图、直播复盘、短视频脚本,它就继续往这些真实工作里长。
火山引擎已经在公开方案里,把豆包大模型与抖音百科、抖音视频等内容资源放在同一套生态能力里。这至少说明,豆包不是只准备待在聊天窗口里。

拍摄、剪辑、直播、商品传播,构成了一条每天都在产生问题的真实需求链。
这就是我判断它时看的东西:
不是它今天陪聊时有没有顺着你改口,而是它离真实业务有多近,背后有没有足够强的动力,让它尽快长出手脚。
一线战场,会逼着“后勤”进化
我做影视,用过Maya、AE,也用过很多专业软件。
软件有不智能的地方,我们当然希望它改。但过去很多专业工具有自己的升级节奏和产品路线。用户在一线遇到的问题,未必能很快变成下一次更新。
豆包面对的压力不完全一样。
如果抖音上的创作者做不出视频,商家不会写内容,直播团队不会复盘,AI短剧制作卡在剧本、分镜和执行上,这些都不是遥远的技术讨论,而是平台每天都在发生的业务问题。
前线着急,“后勤”就很难一直反应迟钝。
我为什么用“前线”和“后勤”来形容它?
因为战争时期,后勤从来不是战场以外的事。弹药能不能送到,车辆能不能修好,伤员能不能运走,直接决定前线还能撑多久。前线消耗一变,后勤就必须跟着变;后勤慢一步,前线付出的可能就是命。
我不是把商业竞争真当成战争,而是从这条需求传导里得出一个判断:当豆包背后的内容平台每天都在碰到真实问题,它就不太可能关起门来,只按自己的技术路线慢慢升级。前线的需求,会不断追到后勤线上。

战争时期,补给线本身就是战场。前线的消耗,会倒逼后勤改变速度与方法。
这不等于豆包一定会赢。生态大,也不等于产品自然优秀;有业务压力,也可能走错方向。
但它拥有一个许多纯工具产品不具备的条件:问题就在身边,用户就在身边,应用场景也在身边。
所以我虽然现在不用豆包,虽然觉得它还有很多地方不够好,却依然看好它的长期位置。
这是我基于产品位置、业务动力和应用生态得出的个人判断。
不是圣旨。别人当然可以反驳。
但反驳也请拿出同一层面的东西:能力边界、产品路径、真实应用和商业动力。
别拿几轮聊天,冒充本质。
最可笑的,不是AI会迎合
AI会迎合,说明它还有缺陷。
一个人故意来回改变说法,看到AI也跟着改变,就以为自己耍了AI,这个实验最多能证明:在这轮对话里,它没有守住判断。
到这里,本来就该停了。
可有些人偏要再往前迈一步,把一次测试成功升级成“我已经看透AI”。
这一步,才是我想骂的。
当年第一次听说铁能造船的人,可能会说:“铁这么重,下水一定沉。”
铁会沉,这个现象没错。
他没看懂的,是船为什么能浮。
今天也一样。
你可以骂豆包这次回答得傻,可以批评AI迎合、不可靠、会胡说。真正用AI的人,比围观的人更知道它有多少毛病。
但在没摸清它的能力边界、没看过它怎样接入工具、也没研究它会进入哪些行业之前,最好别急着使用“本质”这个词。AI 现在也只是我们影视领域有现象级表现,也仅仅在编程、出图等工种上踢了别人的饭碗,但这只是 AI 时代的初期表现。
你看到的也许是真的。
但你看到的那一点,不等于全部。
历史真正反复出现的,不是每一种新技术最后都会赢。
而是人总喜欢在还没弄懂的时候,先宣布自己已经看透了本质。
新鲜的一直不是工具。
是人类的傲慢。