ARTICLE · 1090672
AI助手一进中国就卡壳,问题不在AI
周三上午,我想把三件杂活一次交出去:把上周的项目数据从两个后台系统导出来拼成一张表、核一下预算口径、再回一封客户邮件。需求打给AI助手,它很快给了表格框架,也把邮件写好了——但它导不出那两个后台里的数据,也进不了我的邮箱。最后我花了四十分钟手动搬运,它替我省下的时间是两分钟。
是它不够聪明吗?我原本也这么想,直到看到一份解释,才明白差在哪。
先看一个对照。9月26日,Meta的Muse在北美还在涨:一周跑了两百多万个提示词,在美国和加拿大的应用商店免费榜同时超过ChatGPT,也超过ChatGPT当年移动App刚上线的时候。国内做AI的人却有个困惑——邮件处理、购物、旅行助理这些功能,我们自己的助手也都有,为什么没有那种「哇」的冲击?
一、不是AI变笨,是它「看不见」你在用的东西
关键在干活的环境。Muse的工位是它自己的一台云端电脑和浏览器,Meta专门给它训了一个浏览器Agent,能自己打开网页、阅读、登录、填表、点击、返回。这里有个常被忽略的前提:浏览器是跨所有公司的标准操作系统,过去二十年几乎没大变过。它相当于自带一只鼠标——搞定一个网页的玩法,就等于搞定所有网页。
这套办法搬到中国就不灵了。我们的高频功能大多不在网页里,而在App里。美团网站打开几乎没内容,只有一个公司形象页加下载链接;2012年王兴喊出「All in移动互联网」之后,内容对PC浏览器的适配基本就停了。更绕不过去的是微信——聊天、支付、生活服务、小程序全在里面,所有Agent既躲不开,也进不去。
原文里有一句话说得很准:封装对于人很友好,对于AI很不好。
二、人和AI要的「好用」,正好相反
人要的是:图标漂亮、层级清楚、信息密度刚好,最好所有功能都在一个App里。AI要的刚好相反,它要四样东西:可观察,它得知道自己在哪个页面、上面有什么能操作;语义明确,一个动作对应一个明确的意思,不用猜;可组合,最好每个小应用只干一件事,它按步骤自己拼;可验证,活干完没有,要有明确信号。
对照下来,我们习以为常的那些保护措施,恰恰全是AI的天敌:人脸识别、短信验证码、滑块验证、动态渲染、App之间的来回跳转。App之间「我不给你数据、你也别想要我的」的封闭,对AI就是一堵堵墙。文中提到,豆包手机想跨App操作时被微信、淘宝相继限制,9月新出的第二代也只接进了曹操出行等少数第三方应用。它们为什么要把用户入口交给一个Agent?这才是最真实的门槛。
三、别等「一句话办完所有事」,Muse自己也没做到
Muse在北美好评最多的场景是处理邮件,有人几天内清掉12000封积压邮件。但同一批测试里它也常卡住:让它汇总孩子的学校和课外活动安排,信息散在邮件、家校平台、在线表单和WhatsApp里,它能读邮件却凑不齐;让它续费Girl Scouts年度会员,流程几乎走完,最后支付页面超时,测试者只能自己接管电脑付款;让它预约年度体检,它卡在保险资料更新那一步,最后AI的建议是——直接打电话给诊所。
AI让你打电话,这句话信息量很大。它说明就算在最「舒服」的网页环境里,跨系统的长流程依然是硬骨头。中国不会走和美国一样的路,方向大概有三条:超级App里内置Agent、巨头生态内的Agent、手机厂商自带的Agent。作者判断国内的消费级Agent「一开始很难,后面反而更好」——只是这个「后面」什么时候到,不由我们决定。
行动建议:这周就能做的三件事
第一步,给AI划一块自己的地盘。把常用资料、模板、数据放进一个你能授权的本地文件夹或自有云盘,让它在你的地盘里干活。它进不去别人的App,但进得去你的文件夹——今天就能做完,而且立刻见效。
第二步,用「能不能说清楚」挑活。能一句话讲清输入和输出、结果又能核对的活,交给AI;需要跨两个以上App、要人脸或验证码才能完成的,先别试。
第三步,做一次交办复检。拿张纸,记下这周你真正交给AI的活:哪些办完了、哪些卡住了、卡在哪一步。一个月后你会发现,卡住的原因九成是「门关着」,而不是你的提示词写得不好。