乐于分享
好东西不私藏

打通电脑和手机,头部agent加速“龙虾”化

打通电脑和手机,头部agent加速“龙虾”化
随着agent的普及,大家基本上对于AI for Work,也就是AI辅助工作有了大概认知。

比如最近,OpenAI持续强化Codex,明确每周四更新版本。

还打通了ChatGPT app远程控制Codex的链路,基本上形成了覆盖电脑和手机的完整工作界面。

Anthropic这边,Claude Code早已实现远程控制,近期稳中有进,适当提升了用量限额以应对Codex竞争。

同时,A社还是把更多精力放在了价值观层面,继续鼓捣Claude's Constitution和AI对齐,强化“安全”叙事。

O、A两家虽然各自风格鲜明,但目前卷的还是基模和agent产品。

国内agent这边,字节旗下TRAE Solo做了些投放,也引起了些讨论,主打MTC(More Than Coding)。

按我理解,TRAE Solo是在之前TRAE的基础上,对标Codex和CC,针对个人工作流做优化的一个产品,也是主打电脑、手机全链条打通,便于远程监工。

前几天试用了下,没用它默认的Solo auto模型(估计是豆包定制版),接的是DeepSeeK V4 Pro的API。

然后执行一个小任务(消化文件夹中各类资料并梳理思路),没一会就卡住了,而且明显是agent的问题,而非模型的问题,所以当时感觉一般。

*Solo支持配置各家模型

今天再用,更新了Solo的版本,模型还是V4,互动感觉明显提升,任务也不卡了。

看来现在大家的进步速度还是快,士别三日确实应当刮目相看。

现阶段,中美agent都开始做远程控制。

也就是大家都在打通电脑和手机,开始像OpenClaw龙虾一样工作。所以龙虾也就显得没那么独特了,近期养虾热度下降也成为必然。

目前我的体感是,作为中国宝宝,继续用好Codex即可。

MiniMax这边,作为国内比较早做agent的厂牌,这两天围绕agent team在做文章,而且也打通了飞书和微信两大IM。
他们还专门发了个长文,解释自己对于多agent协作是怎么思考的,如何解决在长任务中,agent做到一半卡壳和越做越笨等问题。
我用给TRAE Solo的同样的任务实测下来,MiniMax Agent目前体验还是要比TRAE Solo好些。
MiniMax Agent多模态也更强(当然,这个跟模型也有关),但感觉token更贵,应该是目前M2.7比V4贵的缘故。
插一句,目前DeepSeek V4 Pro的api打2.5折,持续到5月底。
大家养虾或者接agent都可以试试接V4,可以以较低的成本,体验接近Opus4.6的智能。
百度那边,最近推了一波“秒哒”这个产品。
它主打“一句话做应用”,看起来是个定位大众市场的轻量级agent,可能跟字节扣子类似。
秒哒背靠百度自己的文心模型,李总还出来站台,推广自创的“DAA(Daily Active Agents)”概念,但总感觉还是传统互联网那味。
不过这类产品的优势是门槛低,好上手,所以也要客观看待。他们在大众市场也许更有价值。
综合来讲,目前如果寻找Codex和CC的国内平替的话,可以先试试MiniMax Agent。
TRAE Solo也可以同步玩着,毕竟大家都是你追我赶的状态。
说完agent,再说说关于AI发展阶段的思考。

目前,我们正处在agent能力迅速提升的AI for Work阶段。

其范式稳定后,AI for Science阶段将快速推进。AI将攻克许多困扰人类千百年的数学、物理、生物化学难题,实现能源、生产和智能跃迁。

再往后,就是AI for Fun的阶段了。因为现实问题基本被AI解决,具身智能和脑机接口应用基本成熟,人类就用AI可以尽情for fun了。

当然,AI for Fun还不是终局。

但那时的世界,想想都有趣。

AI必然成为空气一样的存在,透明到你不会在意。

重要的,是提前开始深呼吸。

欢迎关注