前两天我把 Mac 的应用列表拉开,本来只是想找一个软件,结果光是 AI 相关的应用,就看到了满满一排。
ChatGPT、Codex、Claude、Gemini、Kimi、豆包、TRAE SOLO、Marvis、飞书/Lark、Obsidian。
十个名字都在!
如果只是把它们截一张图,特别容易变成“我的 AI 全家桶”。但我盯着这排图标看了一会儿,冒出来的第一个问题却是:这些工具明明有大量重叠,为什么还要让它们同时留在一台电脑里?
安装只能证明它们在这里,不能证明我每天都打开,也不能证明哪一个比另一个强。真要讨论它们,最有用的角度不是做排行榜,而是看一件工作从模糊到完成,要经过哪些位置。
有时我缺的是一个陪我把问题聊清楚的入口,有时是一双能读文件的眼睛,有时需要有人真的碰代码、跑命令,还有时,事情做完了,真正的麻烦才刚刚开始:资料到底放哪里,下次还能不能找回来?
这样再看这十个工具,就清楚多了!
先别急着选模型,先看问题卡在哪里

假设眼前突然来了一个陌生主题,要查资料、形成判断、写成文档,后面可能还要做页面或者改项目。
很多人会先问:“我该用哪一个最强的 AI?”
我的判断是,这个问题太大了。更好用的问法是:我现在卡在想不清、查不全、写不出,还是做不完?
如果连问题都还没说清楚,我会先把 ChatGPT 放在最靠前的位置。OpenAI 对 Chat 的定位,本来就包括日常问答、搜索和头脑风暴。它适合接住那些还很毛糙的念头:帮我换几个角度追问,列出可能忽略的对象,或者把一团话整理成可以继续研究的问题。
比如不要只丢一句“帮我研究个人知识管理”,可以把任务说成:“我要给没有整理习惯的人写一篇文章,他们最常见的三个卡点是什么?哪些结论需要找来源?”
这一改,聊天就不再是要答案,而是在给后面的工作修路。
这也是我看待 ChatGPT 的位置:不是默认让它包办整件事,而是先拿到一个能继续行动的问题版本。问题变具体以后,下一步才知道该找谁。
五个聊天入口,差别藏在材料和交付里
ChatGPT、Claude、Gemini、Kimi、豆包摆在一起,表面上都是一个输入框。真按“谁更聪明”去分,很容易陷入没有尽头的比较。

我更愿意按手上的材料来选。
手里是一批长文档,最后还想整理成表格、演示文稿、Word 或 PDF,Claude 是很自然的候选。Anthropic 的官方说明里,研究、分析、创作和代码都属于它覆盖的任务,也明确提供在对话里创建、编辑多种文件的能力。
这里最实用的动作,不是让它“总结一下”,而是先规定成品。
可以直接说:“把这些材料里的结论、证据和待核验项分开,先给我一张表;证据不足的地方不要补写;最后再整理成一页给同事看的说明。”
同样一堆材料,“总结”往往只会得到更短的一堆文字;先规定读者、格式和不能越过的边界,才更接近交付。
如果材料本来就在 Google 相关的文件环境里,或者任务就是围绕上传的文档、表格继续提问,Gemini 会更顺手。Google 官方帮助页确认了文件上传、摘要和提取洞察这些能力,同时也提醒,具体可用功能会受账户、订阅和管理员设置影响。
所以我不会写“把文件扔进去,所有人都能得到同样结果”。先看当前账户能不能用,再看文件类型和限制,这是比背功能表更靠谱的动作。
中文资料很多,还需要一边联网找线索、一边承接比较长的上下文时,可以把 Kimi 放进候选。Kimi 的官方帮助中心列出了联网搜索、深度思考、多模态推理和长上下文对话。
但“支持中文研究”和“它一定最懂中文”不是一回事。前者有官方能力说明,后者需要真实对比。我宁可把任务拆成可检查的结果:来源链接有没有给全,关键结论能不能回到原文,事实和推断有没有混在一起。

能检查,才有选择工具的依据。
豆包的位置则更像一个中文通用对话与内容辅助入口。公开官网可以确认它是字节跳动旗下的 AI 智能助手,但这次能稳定核验到的具体功能材料有限,所以我不打算硬凑一长串卖点。
这反而提醒了我一件很重要的事:看到应用里有一个按钮,不等于写文章时就能把它扩成一条确定事实。工具可以现场打开再判断,公开表达却要更克制。能确认到哪一层,就写到哪一层。
这五个入口可以同时存在,因为任务的语言、材料、账户环境和成品格式都可能不同。它们不是五把必须同时挥舞的锤子,更像五个入口。眼前是哪扇门近,就走哪扇。
聊清楚之后,事情还得真的往前走
当问题已经明确,聊天窗口给再多建议,也不等于任务完成。
比如一个项目里有报错,需要找到相关文件、修改代码、运行测试,再检查改动有没有超出范围。这时我关心的就不是回答漂不漂亮,而是它能不能面对真实仓库工作。
Codex 更接近这个位置。
OpenAI 对 Codex app 的官方介绍,是一个管理软件开发智能体的工作台:任务可以在线程中运行,人可以查看代码改动,也可以通过 Skills 扩展工作流。翻成更直白的话,就是你不只问“这段代码该怎么改”,而是把仓库、约束和验收标准交代清楚,让它读代码、动手修改、执行检查,最后把改动交回来给人审。

这里最容易漏掉的,不是提示词技巧,而是验收标准。
“修一下登录问题”太模糊了。“未登录用户访问设置页时跳回登录页;登录后能回到原地址;现有测试必须通过;不要改动无关页面”,才是一份能执行也能检查的任务。
我越来越相信,执行型工具的效果,很大一部分取决于人有没有说清楚什么叫完成。没有边界,它做得越多,检查成本可能越高。
TRAE SOLO 也能碰到代码,但适合从另一种项目形态理解。任务里保留的是 TRAE SOLO 这个名称,而它原来的官方页面目前已经转到 TraeWork。当前官方页面覆盖深度调研、文档、PPT、数据分析和代码开发,也提供 Work、Code、Workspace、Skills 与工具调用等入口。
如果一件事不只是一份代码,而是调研材料、数据、演示文稿和项目文件混在一起,那么统一 Workspace 的思路就有价值。它不是单纯回答一个问题,而是试着让不同形态的工作待在同一个工作台里。
Codex 和 TRAE SOLO 因此不必被写成二选一。一个可以围绕仓库、命令、改动和验收来组织;另一个可以从多格式任务和统一工作空间来理解。这是我给它们划分场景的方法,不是官方规定的排他边界。
真正选择时,还是回到那句老实的话:看任务离代码更近,还是离一整套混合交付更近。
再往电脑里面走一步

聊到执行,就会碰到另一个很诱人的想法:能不能不只处理聊天框里的材料,而是直接处理电脑上的文件、应用和操作?
Marvis 对应的正是这个方向。
本机应用信息能够确认它与腾讯的关系;腾讯云开发者社区的资料把它定位成操作系统层级的个人 AI 助手,场景触及文件、系统、应用、浏览器和搜索。
这个定位很有想象力,因为它离“替我把电脑上的事情做掉”更近。但也正因为离系统更近,我会把边界画得更重。
本次没有现场操作证据,所以我不会写成“我已经让它成功整理了某个文件夹”,也不会把资料里的宽泛场景改写成亲测结果。比较稳妥的用法,是把它当作本地电脑任务入口的候选:先从可撤回、可检查、权限较小的事情试起;遇到删除文件、对外发送、覆盖内容或涉及账号的操作,必须停下来由人确认。
AI 越能执行,授权就越应该具体。
聊天工具犯错,可能只是一段答案不对;系统层工具犯错,影响的是真实文件和真实操作。能力往前走一层,人的确认也要跟着往前走一层。这不是保守,而是让它真正进入工作流的前提。
做完不算结束,找得回来才算
资料查完了,文章写出来了,项目也跑通了,桌面上往往会多出一批文件、链接和对话记录。

如果不处理,它们很快又会变成下一次工作的起点:我记得看过,但放在哪里了?
这时,飞书/Lark 和 Obsidian 才开始显出价值。
飞书知识库更靠近团队共同维护的版本。官方介绍里的层级页面树、多人共建、多类型内容、多端访问、资料迁移和权限管理,解决的是“这份东西怎样被一群人持续使用”。
一份要交接的项目说明,不只需要内容正确,还需要别人有权限打开、知道哪个版本有效、能在同一个位置继续更新。把它放进团队知识库,重点不是收藏,而是流转。
Obsidian 更靠近个人的本地思考。它用 Markdown 保存内容,通过内部链接把笔记、附件和文件连起来。它的价值不是把所有资料塞进一个巨大仓库,而是让一个想法能指向另一个想法。
比如今天研究“AI 工具分工”,可以把它链接到“任务验收标准”“来源核验”“个人知识库”这些旧笔记。下次写别的主题时,不必重新从搜索框出发,而是沿着已有关系继续往下走。
当然,“本地笔记”也不等于数据在任何配置下都绝不会离开电脑。是否使用同步服务、装了什么插件,都会改变实际的数据边界。工具名称给不了绝对安全,配置和习惯才可以。
飞书和 Obsidian 也不是谁替代谁。
我会用一个简单问题判断:这份内容主要是给自己继续想,还是要让一群人共同使用?前者适合进入个人笔记网络,后者适合进入有权限、有协作关系的团队空间。同一份项目,完全可能同时需要这两种去向,只是保存的目的不同。

真正该留下的,是清晰的任务边界
绕完一圈再回到那排图标,我反而不觉得“十个”很多了。
ChatGPT 适合先把模糊问题聊清楚;Claude、Gemini、Kimi 和豆包根据材料、语言环境与交付形式进入候选;Codex 接近代码仓库和可验收的修改;TRAE SOLO 适合从多格式项目工作台去理解;Marvis 把入口推向本地电脑和应用;飞书/Lark 与 Obsidian,则分别接住团队知识和个人思考。
这里没有一张永远正确的分工表。产品会更新,账户能力会变化,同一个任务也可能在几个入口之间来回移动。
但有一条判断可以一直留着:不要因为工具能做很多事,就把所有事都交给它。先确认当前卡点,再规定输入、成品、事实边界和验收方式,最后才选择离这段任务最近的入口。
如果你也装了不少 AI 应用,不妨现在就打开应用列表,别急着删,也别急着补。给每个工具只写一句话:什么任务出现时,我才会打开它?
写不出来的,可能只是暂时没有明确位置;写得出来的,也别只写“聊天、写作、办公”,要具体到材料和结果。比如“围绕一组文件提问并做摘要”“读取仓库、修改代码并跑测试”“把个人笔记通过链接接回旧主题”。
这张小清单,会比“十大神器”更接近你自己的工作流。
电脑里留下多少工具并不重要。重要的是,当一件事真的来到面前,你知道该从哪个入口进去,也知道在哪个位置停下来亲自检查。
如果感兴趣的话,可以加一下我的联系方式。

夜雨聆风