ARTICLE · 1120247
上线12天下载超ChatGPT两倍:Muse赢的不是模型
上线12天下载超ChatGPT两倍:Muse赢的不是模型
全行业都在卷跑分的时候,扎克伯格悄悄给每个用户配了一台电脑,外加一个不肯轻易放行的狱警。
大家都这么做:Agent竞赛就是跑分竞赛
过去两年,AI行业的共识只有一个:模型强,产品才强。
发布会比参数,评测榜比名次。SWE-bench刷一遍,数学竞赛测一轮,上下文从8K卷到百万token。OpenAI、Anthropic、Google,每家都在证明同一件事——我的模型比对手聪明。开发者选型先看榜单,投资人估值先看跑分,媒体标题永远写着「再创新高」。
按这个逻辑,谁家模型第一,谁家的Agent就该横扫市场。
证据否定:12天280万下载,但Spark不是跑分第一
9月8日,Meta独立发布了个人AI智能体Muse。接下来发生的事让所有人意外。
第三方机构Apptopia的统计:上线12天,Muse累计下载约280万次,同期ChatGPT是130万,Claude约40万。美国区双平台免费榜登顶。Meta股价9月上涨约31%,市值涨了4570亿美元。
但如果去查跑分榜单,会发现一个尴尬的事实:Muse的底座模型Spark 1.3,9月2日发布,几乎没有拿下任何一个重量级榜单的第一。它强调的是100万token上下文和为Agent工作构建,而不是「屠榜」。
真正拉开差距的,是榜单上看不见的三层架构。
第一层,Secure VM:每个用户一台独立的云端虚拟机,Linux系统,带独立浏览器。Agent住在这台机器里替你干活——你关掉App,它还在后台继续跑任务。扎克伯格的比喻是「放在你桌子底下的那台只属于你的电脑」。
第二层,Sentinel:一个独立于主Agent的安全代理。主Agent的每一个出网动作,都要先经过Sentinel审批;所有动作留审计日志。它不是配置项,是产品里一个看得见的角色。
第三层,支付隔离:绑定的支付通过Stripe Link生成一次性虚拟卡号。Agent可以帮你下单,但碰不到你的真实卡号。
为什么一直没发现:安全被做成了免责条款
行业不是没想过安全,只是把它放错了位置。
主流做法里,安全是用户协议第14页的免责条款,是开发者文档里一张权限申请表,是出事之后的封号公告。产品演示视频里,Agent流畅地订机票、发邮件、改代码——审批环节要么被剪掉,要么被做成一行不起眼的确认弹窗。
但真实用户的犹豫恰恰卡在这里:敢让它读邮箱吗?敢让它碰钱包吗?敢让它半夜替我下单吗?
Muse把答案做成了前台卖点。审批不再是摩擦,而是体验的一部分——子代理群并发干活,遇到高风险动作,Agent会停下来回来找你,像下属请示而不是系统报错。一个耐人寻味的插曲:Meta去年曾想以约20亿美元收购Agent公司Manus,交易今年4月被叫停,Manus本月刚发布了2.0反击战。买不来,就自己照着这个觉悟重建。多家媒体称Muse的云电脑架构「有Manus的影子」,两家公司均未承认。
正确做法:把信任做成产品功能
拆开Muse的架构,有三件事是所有做Agent的团队今晚就能抄的。用一段伪代码说清它的核心流程:
def act(task): plan = agent.plan(task) # 子代理群拆解任务 for step in plan.steps: verdict = sentinel.review(step) # 独立代理审批每个出网动作 if verdict.risk == "HIGH": notify_user(step, verdict) # 回来找人请示,不硬闯 continue audit.log(step, verdict) # 每一步留审计日志 vm.execute(step) # 云端VM内执行区别在于:别家把这三行压缩成「用户已同意协议」,Meta把每一行都做成了用户看得见的功能。审批是产品,日志是产品,支付隔离还是产品。23日的Connect大会上,扎克伯格把Muse定为公司AI战略的核心,他说超级智能的最高使命是创造和发明——但Muse真正证明的是另一件事:用户不敢把事情交给AI的时代,信任本身就是体验。
复盘:三个行动清单
做Agent产品,先把审批流做成UI。它是转化率的来源,不是摩擦成本。 给每个出网动作留用户可见的审计日志。黑箱的Agent永远不会被托付重要的事。 支付与凭据物理隔离。一次性虚拟卡的思路,比一千行安全提示都管用。
模型会追平,跑分会反超。但用户把密码交给谁,从来不看跑分。
END