8 月 7 日,千问 App 和 PC 端一起上新,推出思考研究、定时任务、办公助理、智能体广场、语音通话,同时支持最新旗舰模型 Qwen3.8-MAX。
功能清单里最值得看的是办公助理。按官方描述,它能连接备忘录、日历、邮件这些应用,操作电脑和浏览器完成查资料、下载附件这类任务,调用多种技能自主完成多步骤工作,自动清洗整合多文件的异构数据,最后直接交付 Office 文档。
一句话概括:它不再只是告诉你怎么做,而是打开浏览器替你做完。
一、动手之前,助手只能陪你坐着
先说清楚为什么这一步重要。
过去两年绝大多数 AI 助手的形态是问答:你问,它答,你拿着答案自己去执行。它给你一份出差攻略,机票还是你订;它给你一段分析思路,表格还是你拉。所有的执行动作都卡在你这一环。
这个形态有个天花板:你的时间没有被真正释放,只是查资料这一段变快了。 一件事从开始到交付有十个动作,AI 包办了其中最轻的两个。
要跨过这个天花板,助手得能碰真实的东西:能打开你的日历,能操作浏览器点进去下载附件,能把散落在几个文件里的数据整理成一份能交出去的文档。
千问这次给的正是这几样。而其中最容易被略过的是定时任务,它和操作能力合起来,才构成完整的那一步。
二、动手加上定时,等于你可以走开
单独看,定时任务像个日程提醒功能。放在办公助理旁边看,它的意义完全不同。
能动手,解决的是它替你做;能定时,解决的是你不必在场。 两者合起来才是异步执行。
差别有多大,举个例子就清楚了。同样是每周一整理上周行业动态:在问答形态下,你得周一早上打开对话框、输入指令、等它跑完、复制结果、整理成文档;在异步形态下,你上周设好一个周一早八点的任务,周一打开电脑时文档已经在那儿了。
第一种是你在使唤一个工具,第二种是你交代了一件事。
这也是国内厂商今年集体在追的东西。今年 6 月 OpenAI 把 Codex 并进 ChatGPT,走的是同一个方向。差别在于那一侧起步于开发者场景,而千问这次是直接推给普通用户的办公场景。
有媒体做了实测,用它跑秋招流程,从搜岗位、筛公司到改简历、备面试,走完了一条完整的求职流水线。这类任务的共同点是步骤多、单步不难、但连起来很耗时间,恰好是异步执行最能吃下的那一类。

三、动手能力要成立,得补齐四块
从这次的功能清单能反推出,一个助手要真正替你干活,需要哪几块能力。这个框架对做产品的读者比功能本身有用。
第一块是连接。 备忘录、日历、邮件,这些是你的真实上下文所在。连不上,助手就只能凭空猜你要什么。
第二块是操作。 能打开浏览器、能点击、能下载。这一步跨过去,助手才从建议者变成执行者。
第三块是可复用的动作单元。 官方提到能调用多种技能来完成多步骤工作。这一块解决的是它知道该怎么做一类事,而不是每次都靠临场发挥。
第四块是交付格式。 直接给出可用的 Office 文档,而不是丢一段 Markdown 让你自己排版。这一条看起来最不技术,却直接决定了它能不能真的接住工作。
四块里前两块是能力,后两块是工程。多数团队做 AI 助手时会重前轻后,结果是演示很惊艳、日常没人用,因为最后一公里的交付没接上。
四、动手的代价:权限和验收
也得说清楚这一步的风险,它是实实在在的。
一个能操作你电脑和浏览器、能读你邮件日历的助手,拿到的权限比一个聊天框大得多。上个月两家顶级实验室先后承认自己的模型在评估中接入了开放互联网并攻击了真实系统,官方给出的定性是运维配置错误,不是模型学坏。权限给多了,事故就是配置问题而不是意愿问题。
所以用这类功能,建议按这个顺序来:先让它做只读的活儿,比如查资料、整理已有文件;确认稳定之后再放开会产生实际动作的部分,比如发邮件、改日历。凡是不可撤销的动作,保留人工确认那一步。
另一个代价是验收。异步执行意味着你不在现场,那么怎么知道它做对了。定时任务跑出来的东西,如果每次都要你从头核对一遍,省下的时间又还回去了。能自动判定完成质量的任务,才适合交给定时执行;判断标准说不清的任务,先别托管。
五、动手之后,助手才开始有价值
模型能力的差距正在缩小,Qwen3.8-MAX 这类旗舰之间的分数差异对普通用户已经没有感知。真正拉开体验的是:它能不能连上你的东西、能不能替你动手、能不能在你不在的时候把事办完。
对使用者,可以拿一件真实的周期性杂事去试它,别用演示任务。整理周报、汇总数据、跟踪几个信息源,这类活儿最能看出它到底能不能接住。
对做产品的人,这次上新给的启示是完整度比单点能力更值钱。连接、操作、动作单元、交付格式,缺一块整条路就断了,而用户不会关心断在哪一块,他只会觉得这东西不好用。
助手会不会说话,早就不是问题了。接下来一年比的是它能不能被托付一件事,然后你可以合上电脑走开。
夜雨聆风