ARTICLE · 1084187
AI 工具挑花眼?从"能聊天"到"能干活":我挑 AI 工具的标准
AI 工具越来越多,功能表一个比一个长。我用下来觉得,更值得先看的是另外几件事:它动手前会不会先商量、过程看不看得见、能不能拆出分身、东西放在谁手里、会不会越用越顺手。
这两年,能自己动手干活的 AI 工具冒出来一堆:能查东西、能连着干好几步,不用人一直盯着。功能表一个比一个长,攻略一个比一个花哨。
我自己有一套用了一阵的:Hermes Agent,Nous Research 出的,跑在我自己的机器上。平时不少细碎的活都过它——查的、整的、盯一些要跑一阵的任务。
用得越久,我越觉得:挑这类工具,功能表只能当参考。决定我会不会一直用下去的,是另外几件事。这篇把我自己盯的几点理一理。

它动手前,会不会先跟你商量
先说一条,也是我打交道最多的:它动手之前,会不会先停下来问一句。
系统里比较重的操作——删东西、覆盖原来的、改设置——它不会闷头就干,会先把话说明白:要动什么、为什么动、大概会有什么后果。我点头,它才动手。问的时候用的是普通话,不甩术语,也不用我去猜。
反过来,不值得打扰我的小事,它自己掂量完就做了,不会每动一下都来问一遍;真拿不准的,才交到我这里。
这个分寸,是我看重的一处。每多一次确认,就多一道麻烦;换来的是每一步都清楚。这笔账我觉得划算——决定权在我手里,我又不用当那个逐条点确认的监工。
它干活的过程,你看不看得见
另一件:它干活的时候,你看不看得见。
它在查什么、翻到哪一步、动了哪些东西,会摆在对话里。觉得不对劲,随时可以叫停,或者让它换个做法再来。拿不准的操作,还可以让它在一个单独隔开的环境里试,出问题不牵连正地方。
做过的事也留得下记录,回头能翻出来对。一个过程全在看不见的地方发生的工具,大一点的活我不敢交——出了岔子,连从哪儿查起都不知道。
它能拆出几个"分身"一起开工
用得多了还会发现:它能拆出几个分身,几摊活一起开。
一件活如果几段互不打架,可以拆开,几个分身各自跑一段,跑完回来汇总。等它们干活的时候,我该干嘛干嘛,不用坐在那儿盯进度条。
拆之前得想清楚:哪些能拆、拆到哪一层、出了问题找谁对账。我吃过拆得太碎的亏——来回交接和核对的开销,有时比活本身还大。
它记的东西,放在谁手里
接下来这件,可能比前面几件都重要:它攒下的东西,放在谁手里。
工具用久了,总会攒东西——记忆、记录、各种习惯。我挑工具时会看这些放在哪。我用的这套 Hermes Agent,记忆和记录都放在本地的文件里,能翻、能改、能带走;要是都锁在别人的服务器里,哪天想搬家都搬不动。
我自己的习惯是:要紧的东西从来不只放一处,定期做备份,坏了有得修、丢了有得找。工具可以换,攒下来的东西得留得下。
它会不会越用越顺手
最后一件:它会不会越用越顺手。
新工具刚上手,笨手笨脚很正常。我看的是它有没有长进:解决过的事,能不能记住"章法"——下次碰上差不多的活,直接拿出来用,而不是每次都从头教一遍。
这种顺手,更像是一点点养出来的,不是买来就满级的。它攒下的经验,才是它跟我之间越来越合拍的原因。
收个尾
回头看,这几件事说的是同一件事:放心。
功能多不多,决定我要不要试它;这几件事,决定我敢不敢一直用下去。
要不要用这类工具、用哪一套,还是看各人手上的活。但在翻功能表之前,不妨先拿这几条过一遍。
时效声明:本文写的是我截至 2026 年 9 月的使用情况和看法;AI 工具的能力、行为和具体功能会变化,请以你实际使用时的版本为准。
免责声明:这是基于个人使用习惯的体验与判断,不是通用方案,也不构成对任何工具的推荐;要不要把什么活交给 AI、怎么设置,请结合自己的情况判断,重要数据请先做好备份。