ARTICLE · 1056840
长期使用 OpenClaw 后再看这次升级:它正在变成什么
长期使用者最关心的,不是“OpenClaw 是什么”
OpenClaw 不是最近才出现的名字。年初它就已经在大量个人助理 Agent 中被使用,workbuddy、飞书助手 aily 等产品也都能看到它的影响。对我们这些已经长期运行 OpenClaw 的人来说,再写一篇“它支持哪些渠道、如何安装”的介绍,价值并不大。
真正值得复盘的是:最近被社区称为“OpenClaw 2.0”的这一轮更新,究竟在解决什么问题?它不是简单增加功能,而是在把一个好用的个人机器人,改造成可以连续运行、持续记忆、主动行动的 Agent 基础设施。理解这背后的逻辑,比记住几个新特性更重要。
本文以 2026.8.1/8.2 这一轮代码为观察窗口,重点和 Claude Code、Codex、DeepSeek Harness 放在同一张架构地图上比较。
一、这次更新的主线:从“会回答”到“能长期在场”
OpenClaw 的定位一直和前三者不同。Claude Code 是终端里的编码搭档,Codex 是可被产品调用的执行服务,DeepSeek Harness 是可组装的运行时。OpenClaw 则进入飞书、Slack、Discord、Telegram、WhatsApp 等 28 个聊天渠道,并覆盖桌面和移动端,让 Agent 不必等你打开专门界面。
这次更新最重要的变化,可以归纳成五件事。
第一,会话按“长期服务”来治理。会话和 transcript 迁入 SQLite,agent/state 库有 schema 版本(约 v19/v15),并配套迁移、快照、校验、Git 归档和恢复。一次 coding run 丢失上下文可以重问;运行半年的助理丢失数据,等于丢失人格。SQLite 迁移是产品从工具转向服务的分水岭。
第二,记忆从“文件夹”变成“系统”:可读文件、sqlite-vec 语义索引、Active Memory 召回和 Dreaming 后台整合。Dreaming 凌晨运行,按浅睡、深睡、REM 去重、提炼和修复,并依据召回频次与半衰期调整权重,解决每天几十个会话带来的整理瓶颈。
这里也修正我过去的一个判断:结构化 Markdown 加 grep 对项目级记忆依然有效,但当记忆跨渠道、跨设备、跨半年累积到“人生级”规模,用户往往连关键词都不知道该怎么写,语义检索就不再是炫技,而是必要条件。
第三,工具开始“按需出现”。OpenClaw 提供三档 tool search 和四类控制工具,并限制候选数、批量查询数及响应字符数。Code Mode 使用带内存、输出和快照 TTL 限制的 QuickJS-WASI,支持挂起后续跑,适合长链路任务。
第四,常驻服务需要自我修复:认证 profile 轮换、启动迁移、卡住会话恢复、定时任务和 heartbeat,目标是让服务自行换 key、重排队或降级,而不是把故障直接甩给用户。
第五,能力被持续外置。渠道、provider、媒体处理和第三方集成拆成独立扩展包,让社区可以高频扩展而少动核心。七天 npm 依赖冷却、SecretRef、1Password 和静态分析,则是在为插件与密钥增多补供应链防线。
二、一个约束,为什么能推导出这么多设计
把这些更新串起来,最有解释力的不是功能清单,而是一个约束:Agent 必须长期驻留。
因为要驻留,会话必须持久化,于是有 SQLite;上下文会溢出,于是压缩成为常态;记忆不可枚举,于是需要 sqlite-vec;人工整理跟不上增长,于是出现 Dreaming;服务不能因 key 限流中断,于是重试绑定 profile;工具和渠道变多,则必须有搜索、预算、身份、密钥和备份治理。
这组因果关系也解释了 OpenClaw 为什么看起来“什么都做”:它不是在和 coding agent 比拼单轮推理,而是在补齐数字助理作为长期进程所必须拥有的器官。
三、和 Claude Code、Codex、DeepSeek Harness 放在一起看
四者并非简单的高低排名,而是四种不同的工程取向。
Claude Code 的答案是“你到终端来”;Codex 的答案是“让宿主产品定义接触面”;DeepSeek Harness 的答案是“接触面由你自己搭”;OpenClaw 的答案是“我去你已有的聊天窗口”。这比“谁的 Agent 更强”更接近真实分界:Agent 与人的接触面归谁。
OpenClaw 也并非全面领先。它能通过 Codex harness、ACP、A2A 接入异构 Agent,provider 足够中立;但没有 Codex 的密码学身份、持久化血缘图和跨子树预算。沙箱仍默认为 off,官方明确它面向可信 operator,不是多租户边界。
这两个缺口尤其关键:接入群聊并开启 cron、heartbeat、Dreaming 后,输入面和自主运行时间都远大于终端工具,一次失控扇出就可能放大费用。Codex 在执行点拦截风险,DeepSeek Harness 默认拒绝未授权操作;OpenClaw 则把部分约束交给 operator。
四、长期用户应该如何理解这次升级
我自己的 workspace 也长期运行在 OpenClaw 上。升级后不要因为能力变多就全部打开;更准确的理解是:在场能力增强了,治理责任也上移了。
至少要做四件事:
1. 把 sandbox.mode 从默认 off 调整到 non-main 或 all,尤其是接入群聊和外部 webhook 时。 2. 自建按日、按月的 token 与金额闸门。单会话预算不等于整棵 Agent 树的预算,后台任务必须有单独上限。 3. 打开 SQLite 快照和 Git 备份,并把需要审计的记忆放在不会被 Dreaming 半衰减的归档路径。 4. 明确 Dreaming 与自有记忆蒸馏的目录边界,避免两套机制同时改写同一批 Markdown。
工具搜索和外部扩展值得采用:前者控制上下文,后者让升级更平滑。但不要把 roles 当成多租户隔离,也不要把“有测试代码”当成“行为已全量验证”。
结语:下一阶段竞争的是“在场”与“约束”
这轮更新让我更确定,OpenClaw 的价值不在于它是“第四个 coding agent”,而在于它把 Agent 从一次性工具推进成了住在你工作和生活里的操作员。SQLite、Dreaming、语义记忆、工具发现、异构 harness 和供应链治理,都是这一目标的必然选择。
它的优势也正是风险来源:越接近人的注意力入口,越需要可验证的安全边界、成本边界和记忆边界。Claude Code 代表更强的人工驾驶,Codex 代表更成熟的治理基础设施,DeepSeek Harness 代表更彻底的可组合运行时,OpenClaw 代表更高的到达率与持续在场。
未来真正值得比较的,不是谁的功能列表更长,而是谁能同时回答两个问题:Agent 能不能一直在这里,以及它在这里做错事时,谁能及时把它按停。
📌 这几期的文章重点拆解了全球最强的几个超级 Agent,接下来我会把重点上移,开始关注 Agent 在各种场景中是如何释放巨大的生产力的。
关注「Leo机器人进化论」,10+年AI机器人CTO实战分享。