01

02
03

Claude Code :Anthropic 推出的编码 Agent,直接在你的终端里写代码、调试、提 PR
Hermes Agent :Nous Research 的开源自主 Agent(后面专门讲)
OpenAI Codex Agent :能持续数周、跨会话工作的大型项目 Agent

04
怎么把任务讲清楚? — 措辞、结构、强调方式 要不要给示例? — 用 Few-shot 展示期望的输出模式 要不要引导推理? — 比如加一句"让我们一步一步思考"(Chain-of-Thought) 怎么约束输出? — 格式要 JSON 还是 Markdown
修复我的代码BUG你是一个资深Python工程师。orders.py第47行有一个KeyError请按照一下步骤分析:1.先分析根因,不要改代码2.提出向后兼容的修复方案3.列出需要增加的测试在确认诊断之前,不要修改任何文件。
它没办法注入私有知识库
它不知道你上周二代码库里发生了什么
它没法记住上次会话的内容
它更没法帮你执行系统级的操作
05
❌ 不是 IDE 里的代码补全(不是 Copilot)
❌ 不是套壳的 ChatGPT
❌ 不是用完就忘的一次性助手
06

Agent 怎么自己去找信息?(工具调用)
Agent 如何安全地运行?(沙箱、权限)
Agent 如何跨会话持续工作?(状态持久化)
什么时候该压缩上下文?(生命周期管理)



07
CI 失败了,你收到 Slack 通知 你打开 Claude Code 你手动输入 prompt Agent 开始修复 你盯着它修完 你手动提 PR 你盯着 CI 变绿有 Loop Engineering: 系统每隔 10 分钟自动扫描 CI 状态 发现失败 → 自动生成 prompt 启动 Agent Agent 在隔离工作空间中修复 Checker 自动验证修复是否通过 通过 → 自动开 PR CI 变绿 → 自动通知你"已修复,请 review"
过去:你发现问题、分配任务、盯着执行
现在:你设计规则,系统自己发现问题、分配任务、执行、检查
Cron 定时 :每 10 分钟扫描一次
Event 事件 :PR 创建时自动触发
Condition 条件 :当错误率超过 5% 时自动触发
设计 Agent 什么时候该被唤醒
设计任务完成后如何验证
设计失败后如何降级或升级到人工
设计跨会话的状态如何传递
普通工程师是 训练运动员 (写代码)
Agent Engineer 是 给运动员设计训练计划 (写 Agent 的 prompt 和 harne$
Loop Engineer 是 设计整个体育场馆的自动运营系统 (让场馆 24 小时自动运行)
✅ 流程需要频繁重复(比如 CI 检查、PR review) ✅ 你是瓶颈(半夜失败了也得你盯着) ✅ 状态可以持久化(有文件能传递状态)
08
┌─────────────────────────────────┐│ Loop Engineering │ ← 让 Agent 自主运转│ (Self-triggering / 自动化调度) │└──────────────────┬──────────────┘│┌──────────────────▼──────────────┐│ Harness Engineering │ ← 把模型变成可靠的 Agent│ (Pattern / Framework / Design) │└──────────────────┬──────────────┘│┌──────────────────▼──────────────┐│ Context Engineerin │ ← 给模型看什么信息│ (RAG / 记忆 / 工具定义) │└──────────────────┬──────────────┘│┌──────────────────▼──────────────┐│ Prompt Engineering │ ← 怎么跟模型说话│ (指令 / 示例 / 格式) │└─────────────────────────────────┘
Bottom-Up 看:从 Prompt → Context → Harness → Loop,解决的问题越来越宏观
Top-Down 看:每层都依赖下层的能力
09
Prompt 是在解决"怎么说清楚"
Context 是在解决"给什么信息"
Harness 是在解决"怎么让系统可靠"
Loop 是在解决"怎么自动运转"
Agent 是所有这些的最终形态
Hermes 是这些理念的一个优秀实现
夜雨聆风