过去,AI 办公是给原有软件增加一个按钮。打开文档,让 AI 润色;打开表格,让 AI 写公式;进入会议,让 AI 生成纪要。软件仍是主角,AI 只是在旁边提供建议。
现在,这个顺序正在倒过来。用户只需说:“把上季度销售数据和会议记录放在一起,找出业绩下滑的区域,生成分析报告,再把后续任务写进项目表。”Agent 会自己决定读取哪些文件、调用什么工具、生成何种图表,并把结果写回办公系统。
过去是人在软件之间搬运任务;现在是AI 调度软件,人只看结果。
钉钉推出悟空,腾讯同时布局WorkBuddy 和 QClaw,字节把豆包企业版接入飞书,阿里又用 QoderWork 将代码 Agent 延伸到日常办公,WPS 则守住文档、表格和演示这些最基础的生产资料。
它们看起来都叫“AI 办公”,实际争夺的并不是同一张桌子。
01
PART
AI 办公不是一个新赛道
THREE OLD TRACKS
更准确地说,它是三条旧赛道在同一张桌上相撞:
办公套件
掌握文档、表格和演示。
企业协同
掌握组织、消息、会议和审批。
AI 助手
掌握用户与模型交流的第一入口。
WPS 从文件出发,飞书和钉钉从组织出发,豆包从个人 AI 助手出发,WorkBuddy、QClaw 和 QoderWork 则从电脑控制与任务执行出发。
过去这些产品之间泾渭分明。AI Agent 出现后,边界开始消失:聊天工具想操作文件,办公软件想理解组织,个人助手想进入企业,企业协同平台又想成为所有 Agent 的总入口。
模型只是这一轮竞争的发动机,真正被争夺的是工作发生的地方。
02
PART
钉钉悟空:从协同软件进入企业流程
DINGTALK WUKONG
阿里发布的“悟空”被定位为企业级 AI 工作平台,并不是在钉钉里多放一个聊天机器人。它能够在权限范围内操作本地电脑、浏览器和云端系统,编辑文档、更新表格、填写审批、处理会议资料,并协调多个 Agent 完成连续任务。(参考:阿里巴巴官方介绍)
钉钉的优势不只是企业用户数量,而是它本来就处在组织流程里。员工是谁、属于哪个部门、能看哪些文件、审批要经过谁、差旅和采购走什么流程,这些信息并不在大模型参数里,却决定一项工作能否真正完成。
例如,普通 AI 可以帮你写一份采购建议;悟空试图继续向后推进:连接 1688 寻源比价、生成采购材料、进入审批,再处理开票和报销。这意味着钉钉想守住的不是“聊天入口”,而是企业动作的合法路径。
在企业环境里,知道怎么做不难;知道谁有权做、做完写到哪里、还要经过谁确认,才是门槛。
03
PART
腾讯:QClaw 和 WorkBuddy 并不是重复产品
TENCENT MATRIX
腾讯的产品矩阵看起来更拥挤:元宝、ima、腾讯文档、CodeBuddy、WorkBuddy、QClaw、ClawPro。但 QClaw 与 WorkBuddy 的位置并不相同。
QClaw 更接近个人电脑的远程 AI 管家
它强调本地运行,可以通过微信等入口远程唤醒电脑上的 Agent。腾讯还为其加入了针对恶意指令和 Skill 投毒的安全模块。(参考:腾讯 QClaw 介绍)
它争夺的是一个很有腾讯特色的位置:人已经在微信里,能否顺手发一句话,让电脑整理文件、执行任务或返回结果。
WorkBuddy 则更像一张完整的 AI 办公桌
它可以读取本地文件、拆解复杂任务、调用工具、多 Agent 并行协作,也可以把岗位规范、知识库和 SOP 做成企业专家。腾讯推出企业版后,又把腾讯文档、腾讯会议和企业知识接进 WorkBuddy:人和 Agent 可以在同一份文档里接力,会议内容也能通过 MCP、Skills 和 CLI 被其他 Agent 调用。(参考:腾讯效率智能体工具集)
QClaw 解决“从哪里叫它”,WorkBuddy 解决“叫来以后在哪里干活”
一个更靠近个人入口,一个更靠近任务系统。
04
PART
豆包与飞书:不是简单的“谁并入谁”
DOUBAO × FEISHU
外界常用“飞书并入豆包”概括最近的变化,但目前没有公开信息能够证明飞书在组织层面被并入豆包。已经落地的是更深的产品融合。
豆包企业版提供独立 App 和飞书内 Agent 两种形态:用户可以在飞书文档、群聊、会议和搜索结果旁发起任务,也可以进入独立豆包企业版完成需要多文件、多步骤和反复修改的复杂工作。飞书的企业知识、组织权限和协作能力,则成为豆包完成任务时的上下文。(参考:飞书官方说明)
豆包企业版还把 Seed、Seedream、Seedance 等能力放入同一工作台,可以连续完成资料分析、文档与表格处理、图片视频生成及在线应用搭建,成果再回到飞书分享、评论和继续编辑。(参考:豆包企业版介绍)
从产品关系看,更接近于:豆包负责理解和执行,飞书负责提供组织上下文、权限与协作现场。
这背后存在一个值得观察的变化。过去员工先打开飞书,再寻找其中的 AI 功能;未来也可能先进入豆包,再由豆包调用飞书中的消息、会议、文档和组织关系。
这是入口位置的移动,而不只是功能接入。
05
PART
WPS 守住的是“最后一公里”
THE LAST MILE
Agent 可以生成一份报告,但企业最终需要的往往不是一段回答,而是一个可以继续修改的 Word、一张公式正确的 Excel、一份排版稳定的 PPT。这正是 WPS 的位置。
它未必需要拥有最强的通用 Agent,只要生成结果最终仍需落入文档、表格、演示和 PDF,WPS 就掌握着办公结果的格式层。WPS 已将 AI 嵌入文字、表格、演示和 PDF 等原有工具中,让用户不必离开正在编辑的文件。(参考:WPS 官方介绍)
Agent 负责思考,办公套件负责让结果可编辑、可打印、可流转
答案可以存在聊天框里,工作成果必须存在一个可继续使用的载体里。
06
PART
四层能力,决定谁更接近工作入口
FOUR LAYERS
判断一款 AI 办公产品,不妨看它能否接起四层。
入口:用户从哪里发起任务?豆包拥有个人 AI 入口,钉钉和飞书拥有企业通信入口,QClaw 靠近微信,WorkBuddy 和 QoderWork 占据桌面。高频入口决定了用户会不会想起它。
上下文:AI 是否知道相关文档、会议、日程、联系人、组织架构和历史任务?办公任务很少从一张白纸开始。没有上下文的 Agent,只能输出一份听起来合理的通用答案。
执行:AI 能否真正读写文件、操作浏览器、更新表格、调用企业系统,而不只是告诉用户应该怎么做?这一层区分了聊天助手和工作 Agent。
治理:谁能看哪些资料?哪些操作必须确认?是否留下审计记录?一次任务消耗多少 Token?失败后能否停止和回滚?个人使用时,偶尔出错只是麻烦;进入企业后,一次错误写入、误发消息或越权读取,都可能成为事故。
AI 办公最后拼的不是谁最能说,而是谁能在权限范围内稳定地做。
07
PART
为什么办公成为 Agent 最密集的战场
WHY OFFICE
办公任务同时具备几项难得的条件:
频率足够高。邮件、表格、报告、会议和文件整理每天都在发生。
结果相对容易验收。数字是否正确、文件是否生成、会议行动项是否写入,都有较明确的反馈。
工作天然存在于数字环境。Agent 不需要先学会拿杯子、开房门,只需操作软件和数据。
企业存在付费能力。一套系统只要能稳定减少重复劳动,就有机会进入预算。
办公上下文具有很强的黏性。一旦员工的文件、会议、流程和知识沉淀进某个平台,迁移成本会越来越高。
因此,各家争夺的并不只是一次订阅收入。谁掌握工作上下文,谁就更容易成为其他模型和工具必须经过的中间层。
08
PART
办公软件正在退到工具层
TOOL LAYER
传统办公软件的设计逻辑,是把功能放进菜单,等待人来点击。Agent 的设计逻辑,是接收目标,再决定调用哪些功能。
未来完成一份经营分析,用户可能不再分别打开 Excel、浏览器、会议纪要和 PPT。Agent 会在后台读取数据、核对资料、生成图表,再调用办公套件输出文件。软件不会消失,但会越来越像工具箱。
人面对的是任务,Agent 面对的是软件。
这也改变了办公产品的收费逻辑。过去企业购买账号和功能模块;未来还会购买模型调用、任务运行时间、云端执行环境、Skill、企业知识连接和审计能力。
企业购买的不再只是软件许可,而是一部分被托管的执行能力。
09
PART
怎么选择,不必先比较模型排行榜
HOW TO CHOOSE
可以先看工作主要住在哪里。
这里不是简单的产品排名。离工作数据最近的工具,通常比模型分数高一点的工具更有价值。
可以准备一组相同材料,对不同工具进行一次测试:
请读取销售数据、会议纪要和活动方案。
完成以下任务:
1. 核对三个文件中的核心数据是否一致;
2. 找出销售下降最明显的区域和可能原因;
3. 生成一页可编辑的经营分析;
4. 将待确认信息单独列出,不要自行补全;
5. 生成后续行动清单,但不要发送消息或修改原文件;
6. 每个结论注明对应文件和数据位置。
测试时只记录五件事:任务完成率;人工接管用了多久;错误修改成本;权限是否清楚;结果能否继续编辑。
跑完这一轮,往往比阅读十篇产品评测更容易判断一款工具是否适合自己。
10
PART
热闹背后的几处隐忧
CONCERNS
产品越来越多,不代表办公体验一定更简单。腾讯内部存在多种 Agent 产品,阿里同时有千问、悟空、QoderWork 和大量云端 Agent,字节又在调整豆包与飞书的关系。对用户而言,首先面对的可能不是效率提升,而是不知道应该从哪个入口开始。
更深的问题是数据锁定。当会议、文件、通讯录、知识库和自动化流程都依附于同一个 Agent 平台,切换服务商将比更换聊天机器人困难得多。企业今天选择的可能是一款效率工具,几年后形成的却是一套新的工作基础设施。
另一个风险来自权限放大。聊天模型答错一句话,影响有限;Agent 如果拥有写文件、发消息、提交审批和访问数据库的权限,错误就会直接进入业务流程。
!踩坑提示 🕳
Agent 越接近工作,可靠性越不能只靠模型自觉。
///
LAST
办公桌之后
EPILOGUE
这一轮竞争不会只产生一个“最好用的 AI 办公软件”。更可能出现的是几类不同入口长期并存:个人从豆包或微信发起任务,企业在钉钉或飞书中提供组织上下文,WorkBuddy 一类桌面 Agent 操作本地文件,WPS 负责承接最终文档,后台再根据成本和任务动态选择模型。
最后胜出的未必是写周报最漂亮的 AI。它需要知道哪些数据可以读、应该调用什么工具、结果写到哪里、谁有权确认,以及什么时候必须停下来问人。
办公的下一代入口,不是一个更大的聊天框,而是一套知道怎样把事情安全办完的系统。
既然看到这里了,如果觉得有用,随手点个赞、在看、转发三连吧。
THANKS FOR READING
夜雨聆风