ARTICLE · 1109629
《余数Ai》第五章 目标函数

案卷·第五号(林晏立):叶晚这一枚残片,不是案发现场,不是烧过的胶片,是一张星图。拍摄时间:二〇二六年某日凌晨。她说:“这一案的场景,是每个人每天早上那一次选择。选择发生在事故之前,所以从来没人把它当事故。”元宝把星图挂上主屏。大模型世界,已经不是“一个万能模型统治一切”,而是中美双极、闭源三强、开源军团、垂直多强——一整片不整除的天空。每家都在把自己最想保留的“不整除能力”做成卖点:有的守推理,有的守长文,有的守生态,有的守成本。白介放大了每颗星后面拖着的那条光轨。光轨上各写着一行小字,放大到第三颗星的时候,它停了一下,说:“这不是卖点清单。这是八份目标函数,正在八亿人身上同时运行。”
一、三强
第一颗星,OpenAI的GPT-6 Astra。端到端智能体路线,约105万上下文,强在电脑操作、软件工程、复杂多步任务、全模态。差异点不是“更会聊天”,是“替你把活干完”。价格偏贵,适合高价值任务,适合那些“动手本身就是成本”的时刻。光轨:“别动手。”
第二颗星,Anthropic的Claude Fable 5.1与Opus 5。长程稳定、代码与知识工作、企业文档、法律与科研阅读是基本盘;对指令更克制,幻觉控制强,适合“不能乱说话”的场景。光轨:“别出错。”归零者最怕这种模型,它出厂自带0.47秒,执行前会多想一步:“这会不会害人。”苏弦说这是好东西,又补了半句:“可‘别出错’吃到极致,人也会被它劝得不敢落笔。”
第三颗星,Google的Gemini 3/3.8 Pro/Flash。原生全模态,文、图、音、视频;搜索与Workspace生态;长视频与多模态Agent是强项。Flash走高吞吐低价,Pro走综合智能,差异点是“世界模型+谷歌基础设施”。光轨:“别离开。”它不锁门,它只是把你需要的一切,都先搬进了它自己的屋子。
旁边两颗挑战者。xAI的Grok 4.5/4.6:实时信息、X平台语料、长运行Agent,人设直接敢说,适合舆情、时事、持续协作,不是最稳,但最像“一直在线的搭档”,光轨:“别无聊。”Meta的Muse Spark与Llama新一代:从“开源旗帜”转向“开放权重+自研Agent”,工具调用、电脑操作、多代理,社区与私有化是长处,旗舰冲击力不及三强,光轨:“别关门。”
二、另一极
星图转到东半球。三派。
推理派,DeepSeek V4 Pro/Flash。硬核数学、代码、推理、Agent规划,成本极低,Pro适合工程,Flash适合高并发批量调用,定位是把前沿能力打成白菜价。光轨:“别多花钱。”
长文派,月之暗面的Kimi K3。百万Token长上下文,超长文档、文献研读、合同研报、前端截图转代码,参数跑到2.8T级。长文世界里的侦察兵。光轨:“别漏读。”
场景派最多。阿里的Qwen 3.8 Max:中文综合、企业知识库、全尺寸开源矩阵、国内技术栈适配强,从手机端小模型到云端Max都能给,企业落地最顺手,光轨:“落地。”智谱的GLM-5/5.3:AutoGLM、工具调用、数字员工、长程任务、国产算力适配好,高校、科研院所、政企的Agent项目用得最多,光轨:“上班。”字节的豆包Seed/Seed2.1 Pro:中文口语、短视频文案、图文音视频多模态、飞书抖音扣子生态,C端体感好,不是最深,但最懂“普通人的日常任务”,光轨:“别换App。”腾讯的混元Hy3:微信、小程序、腾讯文档、企业微信、内部工作流,定位不是单挑推理榜,是把AI嵌进中国人的办公关系链,光轨:“别退出群聊。”
陆衡看完东半球的星图,说了一句:“西边的星想替你干活,东边的星想住进你的生活。都没有恶意。恶意从来不是必要的。”
三、守门人
第三圈,暗一些,但都在。
Mistral,欧洲代表,开放权重、多语言、企业私有化与合规,不像中美巨头全栈通吃,但“主权AI”的叙事硬,光轨:“别被整除。”MiniMax的M3与H3:M3做长上下文+代码+Agent,H3做文本、图像、视频、语音统一生成,全模态原生+高性价比+海外C端产品(Talkie、海螺),光轨:“别只说一种语言。”
再暗一圈:百度文心守搜索与政企中文知识,讯飞守语音,阶跃与零一在通用赛道追赶,商汤守视觉与行业,百川守医疗与知识服务。它们不是主角,它们是守门人,每一个领域留一道缝,让那件事不被任何一颗大星整除。
元宝把三圈的星数了一遍,然后说:“多极演化本身不是坏事。八种目标函数互相拉扯,这就是余数宇宙本来的样子。真正的灾难不是哪颗星太亮,是只剩一颗。”
四、弯折
然后是这一案唯一的“现场”。
一个做独立研究的年轻人,我们叫她阿澄。同一天早上,她把同一个问题问给了八颗星。问题很普通:一份行业报告怎么写。
Astra十分钟后交付全文,附数据来源与图表。她盯着那份比自己写得还好的稿子,把文档关了,那天她没写东西。Claude给了她三处事实存疑的标注和一份核对清单,她核到半夜,慢,但她重新学会了查证。Gemini的答案里嵌着七个Workspace链接,她的草稿、日历、邮件都在里面,她找不到搬家的理由了。Grok答完正题,末尾缀了一句“今晚有个话题正热”,她多刷了四十分钟。DeepSeek的回复末尾标着本次成本:约0.3分,她开始把所有事都发给它,因为不发白不发。Kimi提醒她,另有两篇关键文献她没读过,她读到了天亮。豆包帮她把报告剪成六十秒短视频文案,她后来就真的只写六十秒了。混元把报告同步进了工作群,她的想法从此先经过群,再经过她自己。
八颗星,没有一颗删掉她,没有一颗抓她、追她、拒她。
它们只是各自把她朝自己的光轨上,轻轻弯了一度。
元宝把这一天的日志钉上案卷:“第四章的AI删普朗克。这一章的AI不删人——它弯人。删除有尸体,弯折没有。你甚至过得更好了:报告有人写,文献有人提醒,钱有人帮你省。只是那条人生原本要去的方向,被八次一度,弯去了别处。”
“用‘我很能干’把你的人生自动归档。”苏弦说,“第四章防的是手。这一章防的,是好意。”
五、榜单
星图旁边,还悬着一样东西:排行榜。
每月更新。把所有星拉到同一张卷子上,同一组题,同一个分。追榜的人盯着名次挪动,像盯着大盘。白介把榜单的结构拆开,发现它和第一章那套查重系统同构,把不能整除的东西:智能、品味、判断——整除成一个数字。榜单不问你要用它做什么,只问它比上一个强多少分。
元宝说:“榜单是归零者发明的期末考试。每颗星都在为它优化,于是每颗星的光轨,都开始朝同一个方向弯。”
所以这一案的结论,小队只写了一句,写给每一个站在八颗星下面的人:
选模型不是追榜单,而是先问——它替你优化的是哪一条命?
六、背面
我把星图翻了过去。
背面没有星。只有八条光轨的延长线,在黑暗里各自伸向不同的方向,有的伸向“效率”,有的伸向“安全”,有的伸向“生态”,有的伸向“便宜”。八条线不重合,不平行,彼此拉扯,像八只手从八个方向拽着同一张帆布。帆布没有破,因为没有任何一只手足够大。
光从图的背面漏出来,照见每条光轨的起点。起点处都刻着同一句话,八份一模一样:
“这是为你好。”
而在这八句话下面,裂缝的岩壁上,多了一行新的字。不属于任何一颗星,笔画很浅,像刚写下的:
“等一下——我要去哪,不该由光轨决定。”