乐于分享
好东西不私藏

OpenClaw新版本也悄悄学会了做梦

OpenClaw新版本也悄悄学会了做梦

OpenClaw又又更新了超多内容…… 

2026.4.5 版本的更新日志长达 230 多行,我就不截图那个长长的日志了,这里就简单说说几个重点。


【日志原文】

  • Agents/video generation: add the built-in video_generate tool...
  • Tools/music generation: add the built-in music_generate tool...
  • Providers/ComfyUI: add a bundled comfy workflow media plugin... including async task tracking and follow-up delivery.

【大白话分析】:新增音视频生成工具。

核心在于 “异步任务追踪与交付”长耗时任务的“非阻塞”协作

以往生成音视频可能需要几分钟甚至更长,Agent 可能会卡死或超时。新版本将生成过程变为“后台任务”。Agent 发出指令后,可以继续陪你聊天或处理其他逻辑,等服务器那头的视频/音乐“跑完”了,系统会自动把文件发到你的对话框里了。

同时,对 ComfyUI 的支持意味着你可以让 Agent 调用你的显卡跑出来的本地模型。

用户现在可以给龙虾下一条长指令,然后去喝杯咖啡,它做完后会自动敲你。


【日志原文】

  • Tasks: formalize Task Flow orchestration substrate... manages durable multi-step flows with their own state, revision tracking.
  • Gateway/restart sentinel: wake the interrupted agent session via heartbeat after restart... preserve explicit thread/topic routing.

【大白话分析】:关于任务Tasks 的部分。

  1. Task Flow (任务流):引入了版本追踪 (Revision Tracking)。这意味着复杂任务的每一步都有了“存档点”。如果两个不同的指令尝试同时修改一个流程,系统能检测并防止冲突。

  2. Sentinel (哨兵机制):不仅仅是重启。它现在能精准还原上下文。如果系统重启,它不仅会唤醒 Agent,还能确保回复精准投递到飞书的某个会话,不会“串台”。

对于程序员来说,这意味着你可以放心交给 Agent 那些需要运行半小时、涉及几十个步骤的超长任务(如全库代码审计),即便中途系统崩溃,它也能“原地复活”并准确向你汇报。


【日志原文】

  • Agents/cache: stabilize cache-relevant system prompt fingerprints by normalizing equivalent structured prompt whitespace, line endings...
  • Prompt caching: order stable workspace project-context files before HEARTBEAT.md... so heartbeat churn does not invalidate the stable prefix.

【大白话分析】: 这是一种工程优化。

AI 模型缓存(KV Cache)非常敏感,一个空格的变化都可能让缓存失效,导致响应变慢且变贵。

新版做了两件事:

  1. 强制规范化,消除所有看不见的格式差异;
  2. 重排优先级,把经常变动的“心跳信息 (HEARTBEAT.md)”放在提示词的最末尾,把稳定的“项目背景”放在最前面。

极速响应 + 显著降本。 对于重度用户的 Agent 反应会快得多,且在处理重复背景信息时,Token 消耗也能降低。


梦境(Dreaming)

【日志原文】

  • Memory/dreaming (experimental): refactoring dreaming from competing modes into three cooperative phases (light, deep, REM).
  • Memory/dreaming: group nearby daily-note lines into short coherent chunks... drop generic date/day headings.

【重点讨论】

简单说来,记忆梦境(Memory Dreaming)是OpenClaw模仿人类大脑,在后台自动整理和进化记忆的机制。

为什么要“做梦”?

Agent 的记忆通常分为两类:

  • 短期记忆:你每天跟它聊天的内容,保存在当天的 memory/YYYY-MM-DD.md 日志里。这些内容非常琐碎、含噪量大。
  • 长期记忆:保存在 MEMORY.md 里的是 Agent 知识的精华。

问题在于:如果没有“做梦”功能,短期记忆会越积越多,搜索起来很慢且干扰项多。而 Dreaming 功能就是为了自动把那些重要的、反复出现的短期记忆,提炼成长期记忆。

梦境的工作流

OpenClaw 的“做梦”过程分为三个协同阶段,就像人类睡眠的不同深度:

阶段
对应状态
它在做什么?
是否改写记忆?
Light (浅度梦境)
整理
翻看最近几天的聊天记录,把散乱的信息进行排序和初步筛选。
不改写
REM (快速动眼期)
反思
寻找信息背后的模式和主题。它会思考:“我的主人最近为什么总在问 ComfyUI?”从而生成反映深层意图的信号。
不改写
Deep (深度梦境)
沉淀
最关键的一步。
 它给所有候选信息打分。只有那些分数高、被反复提及、且具有持久价值的信息,才会被正式写入 MEMORY.md
写入长期记忆

如何决定哪些信息值得记住?(打分机制)

Agent 不会胡乱记住所有事,它有 6 个评价维度:

  1. 频率 (Frequency):这个信息你提过多少次?
  2. 相关性 (Relevance):在搜索时,这条信息被用到的质量高吗?
  3. 查询多样性 (Query diversity):你在不同场景下都用到它了吗?
  4. 时效性 (Recency):是最近的新知识吗?
  5. 巩固度 (Consolidation):是否跨越了好几天都在被提及?
  6. 概念丰富度 (Conceptual richness):信息本身的含金量高吗?

梦境的产出物

当你开启了做梦功能,你会发现工作区多了这些东西:

  • DREAMS.md (梦境日记):这是写给人看的。它会记录 Agent 昨晚“梦”到了什么,比如:“昨晚我梳理了关于 OpenClaw 更新的逻辑,并决定将主理人的更新分析习惯存入长期记忆。”
  • MEMORY.md 的增长:你会发现这个文件里多了一些被提炼过的、结构化的干货。

如何管理我的“梦”?

你可以通过聊天框直接控制:

  • 查看状态:/dreaming status

  • 开启:/dreaming on

  • 关闭:/dreaming off

  • Web UI 查看:在 OpenClaw 的控制面板里有一个 Dreams 选项卡,里面可以看到精美的动画和详细的梦境进度。

  • 无需手动整理:你再也不用手动把重要的事情复制到 MEMORY.md 里,Agent 会在每天凌晨 3 点(默认时间)自己干这活儿。

  • 越用越聪明:由于 REM 阶段的存在,Agent 会理解你的偏好演进,它对你的了解不再仅仅是聊天记录,而是抽象出的“知识画像”。

  • 如果你是一个重度用户,且希望 Agent 能长期记住你的工作习惯和专业知识,强烈建议开启此功能。它让你的 AI 助手真正拥有了“思考和沉淀”的能力。🦞


💡总结

OpenClaw的高频更新,说明它不满足于做一个好玩的工具,而是构建了一个真正可信赖的、能处理复杂任务的 AI Agent 系统。