乐于分享
好东西不私藏

AI 原生时代全景:Harness 范式、记忆革命与被重构的基础设施

AI 原生时代全景:Harness 范式、记忆革命与被重构的基础设施

一、三代AI工程范式完整演进:Prompt → Context → Harness

(东旭逐一定义、逐一对别、逐层升级,是本次对话最核心框架)

第一代:Prompt Engineering(提示工程)

时间:2022年底 → 2023 → 2024年初
核心:短程对话内调优
两个关键点
Few-Shot(小样本)
在一段很短的对话里,通过示例引导输出
无外部工具调用
完全在“问答流程”内完成
定位:最基础、最早的人机交互方式

第二代:Context Engineering(上下文工程)

比提示工程高一个层级
核心长程任务交付
两大特征
任务长度变长、对话轮次变多
不再是单轮问答,而是复杂任务
开始涉及外部工具调用
能调用工具、检索信息、处理多步骤
额外挑战
如何高效利用有限的上下文窗口
如何做结果分析、记忆沉淀
致命痛点
任务太长 → 窗口装不下 → 必须压缩(Compaction)
一压缩 →灾难性失忆

第三代:Harness Engineering(最前沿、最高维度)

定义多智能体协同的系统性工程
跳出单一模型、单一窗口
解决的核心问题
多Agent之间的信息同步
复杂任务的拆解与管理
每个子Agent的上下文压缩与失忆问题
外挂系统、记忆、工具的统一调度
本质
像管理一支真正的软件开发团队一样管理Agent
目标
让Agent团队永续、持续、稳定地产出
依赖关系
建立在前两代(Prompt + Context)的最佳实践之上
层层递进,不可跳过

二、Harness 的边界:东旭明确判断——目前看不到边界

1. 个人体感

每一次觉得“快到极限”
Agent都会给出新惊喜
人类无法真正评估当前SOTA模型的上限
很多时候不是模型不够强,而是人类设计的“考题”太差

2. 当前Benchmark的巨大缺陷

所有基准测试都只测:

单一Agent

单一任务

单一环境

但真实世界是:

无数个体组织成社会

协同完成超越任何个体的能力

3. 未来判断

未来一定会出现Agent Sociology(智能体社会学)
一旦多智能体出现涌现行为
能力将不再有边界

三、Harness 会不会变成通用基础设施?终局是什么?

东旭核心结论:

Harness Engineering 本质 = Software Engineering(软件工程)

给Agent分角色、设权限、排流程
和管理真人工程师团队几乎一样
唯一区别:Agent不睡觉、不休息、不疲劳

Harness 未来三阶段演进

阶段1:映射人类软件工程(现在)

直接把人类几十年的:

团队架构

开发流程

工具链

协作方法

全部映射给Agent
目标:先让多Agent能做单个Agent做不了的事

阶段2:递归自进化(Recursive Self-Improvement)

参考Elon Musk提出的方向
Agent开始自己优化自己的代码、架构、协作体系
自我迭代、自我修复、自我升级

阶段3:超出人类理解

一旦进入递归自优化
系统复杂度将超出人类完全理解范围

终局判断

每家公司都会有自己的Harness体系
但底层思想不会偏离软件工程的基本真理
最终会收敛成一套通用范式

四、核心产品:Memoji 龙虾记忆插件(完整设计、痛点、技术、理念)

解决的两大强痛点(用户真实痛苦)

痛点1:聊着聊着就“失忆”

长对话、长任务
到最后面,前面的关键信息全部忘记
重要任务直接失败

痛点2:升级/崩溃导致“永久失去记忆”

用户与龙虾有大量私密、重要、个人化内容
一旦版本升级、系统崩溃
数据消失,体验如同失去亲人
云端备份成为强需求

产品形态:

1.开源项目

可自行部署、私有化
2.云端托管服务
提供永续记忆存储

设计哲学:Agent Native 体验

3.传统软件安装
配置A、B、C、D,下载安装包,配置环境变量,复杂、门槛高
4.Agent Native 安装
复制粘贴一句话 → 自动安装完成
零配置、零门槛、完全为Agent设计

五、最核心知识点:Context Window(短期)与 Memory(长期)的区别

(东旭用人脑记忆做最通俗比喻)

1. Context Window = 短期记忆

模型当下能“看到”的极小窗口
由Transformer架构决定 →固定大小
超出窗口内容完全看不见
对应:人脑工作记忆
任务一长,必然溢出、遗忘

2. Memory = 长期记忆

一本永久笔记本
记录所有对话、事实、偏好、历史
不放在模型里,存在外部
需要时:
对应:人类长期记忆

关键结论

RAG 已经不够
RAG与具体技术绑定,Memory是更大范畴
只要模型还是Transformer架构:
人类也是短期记忆+长期记忆结构
复杂任务必须依赖长期记忆

六、为什么 Memory 是 Harness 里最难、最关键的一环?

1. 单体Agent的必死问题:Compaction(压缩)= 失忆

长任务必须压缩历史
一压缩 →信息丢失、逻辑断裂、目标遗忘
Harness要跑复杂任务 →必须靠Memory解决

2. 传统聊天产品只是“掩盖问题”

ChatGPT等强制用户开新对话
没有解决记忆
只是视觉上隐藏问题
体验割裂、无法持续任务

3. 模型本身是“无状态”的

模型不会越用越强
不会自动成长
你的价值 = 你的记忆
模型只是通用算力
未来价值在记忆层,不在大模型层

4. 记忆决定“有多懂你”

大模型能力趋同
差异只在于:它有多了解你
了解来自记忆

七、记忆如何存储、如何提取?东旭独家极简方案

1.行业误区

设计复杂算法
遗忘曲线
人工规则过滤
精准控制存储

2.东旭方案:交给模型自己判断

存储时:只加一个标签,此信息距离当前时间多少天

检索时:把所有相关信息丢给模型

加一句Prompt:根据你的判断,哪些最重要?

核心思想,不自己写算法,让模型成为评估函数

新时代开发思路:用模型能力解决问题

例子:Agent 安全

东旭观点:
未来Agent最好的安全系统可能就是一句话:
“你要注意安全。”

八、数据量级:Agent时代 = 海量小数据(反直觉真相)

1.Web2 时代:中心化大数据

淘宝、美团
数据量级:PB级(1024TB)
集中存储、集中计算

2.Agent 时代:海量小数据

每个人/每个龙虾 →一套独立小数据
高度碎片化,单用户数据量极小

为什么这么小?纯文本交互

一个人一辈子的对话、文档、资料
对现代存储而言几乎可以忽略不计

3.未来趋势:

单个用户数据小
全球Agent数量巨大
总数据量超过中心化平台
但分布在无数服务商

4.存储策略

全部存储,永久不删除
Google哲学:
只要存储成本可覆盖
所有数据永久保留
人机所有行为足迹(Footprint)都有价值

九、一虾一库 + 共享存储:技术原理详解

1.一虾一库(必然趋势)

每个人记忆结构不同
安全硬性要求:个人数据独立加密
每个人独立密钥
不能与陌生人数据混合

2.如何做到低成本?

底层:大型共享云存储
上层:数据库虚拟化
对外呈现:每个Agent拥有完整独立数据库
对内:资源共享、大幅降低成本

3.设计目标

对Agent极度友好
不用教Agent注册存储
直接呈现:
这是你的完整数据库
极简、自治、易用

十、记忆存在本地还是云端?结论:一定云端

不是安全问题,是产品体验问题

1.Local First(本地优先)的致命问题

极客能用
普通人会把龙虾“养死”
升级失败 → 数据丢失 →体验崩溃
无备份、无迁移、跨设备困难

2.云端的不可替代优势

随时复活,自动备份,跨设备同步,零技术门槛,真正C端产品化
3.东旭明确结论:
要普及C端,一定是云端。

十一、记忆层的商业化前景

模式1:备份/恢复/迁移订阅

基础记忆:免费
高级功能:
订阅制收费

模式2:记忆市场(最震撼的未来)

厨师与龙虾聊10年做饭经验
系统抽取厨师专业记忆
打包成外挂记忆包
接入其他人的Agent
厨师不会编程,也能变现知识
诞生全新知识市场与分发渠道

十二、Agent时代:整个基础设施都会被重写

现在的云、数据库、网络
都是为人类开发者设计
未来会出现:
一套完全为Agent设计的新基础设施

1. Agent Cloud(智能体云)

不是AWS/阿里云
而是轻量级沙箱(Sandbox)
一沙一库
自动启动、自动销毁、自动协作

2. Agent Database(智能体数据库)

支持数十亿Agent,单位成本极低
虚拟库、共享底层,一虾一库

3. Agent 通信

无界面,机器对机器,高频、自动,    无现有对应产品

4. Agent 支付 / 鉴权 / ID

全部重新设计

十三、SQL、文件系统会被淘汰吗?

结论:长期存在,不会消失

1.原因:
模型从人类数据训练
SQL/文件系统是模型最熟悉的心智模型
最容易操作、最稳定

2.未来形态

接口不变
底层实现重写
Agent最擅长:

3.回归Unix哲学

简洁,自洽,可组合
能应对无限灵活任务

十四、向量数据库的终局

向量检索只是若干检索手段之一
包括:
向量检索,全文匹配,规则过滤,时间衰减
不应该独立成库
独立向量库 =数据割裂
对Agent极不友好

终局

向量能力成为所有数据库标配
无独立向量数据库公司
接口收敛、统一

十五、给Agent做软件:怎样才算好用?

Agent 体验 = 程序员的好体验

图形界面不适合Agent
命令行、组合、管道、自动化更适合
可组合、可扩展、可自动化

好体验标准

一套简洁心智模型
覆盖尽可能多的灵活任务
自洽、稳定、可预测
回归Unix设计哲学

十六、AI下一个突破边界:多智能体规模定律

现在只是几个Agent协同
如果放100、1000、10000个Agent
会出现什么涌现能力
完全未知
这是下一个最大突破口

十七、编程语言、工具还重要吗?

既重要,又不重要

1.重要

心智模型重要
模型基于人类语言/代码训练
必须贴合模型心智

2.不重要

人不用看具体代码
每天产出几万行代码
一行都不看
3.人只关注

架构

软件工程

代码不腐化

系统稳定

十八、人与Agent如何协同?

人提需求
人验证结果
人把经验变成Skill/Spec传递给Agent
人绝不参与Agent内部协作
一参与 → 人变成系统瓶颈
交互只在顶层

十九、个人护城河:认知每月都过时

身处浪潮,天天使用,保持手感
不靠看文章学习
必须亲自实践
用当下经验推导下个月方向
手感 = 护城河

二十、团队效率:1人 = 传统100人年

新产品(Memoji)1-2人小团队
东旭单人主力
过去3个月 =传统100人年工作量

二十一、未来组织形态

不再是大公司、大平台
高度碎片化小型部落
每个部落:

对硅谷工程师判断

上一代软件工程师已终结
不再需要大量码农
但这是好事:
软件民主化,人人都能创造软件

二十二、给计算机学生的建议

不要焦虑,不要学很快过时的技能

要学永恒不变的东西:
1.Unix 哲学
软件工程本质,底层思维模型,系统设计能力

2.两条路

真热爱计算机
学底层、学原理
重新思考热爱
3.AI已降低所有领域门槛
去做你真正热爱的事。