昨天有个学员联系我跟我抱怨:Codex 装了一堆插件,62 个应用、110 项技能全点亮了,结果打开还是不知道干嘛。
我说你搞反了。插件不是越多越好,配置才是。
我花了 30 天,把 Codex 从"聊天框"调成了"工作台"。没装几个新插件,就配了 3 样东西:AGENTS.md、Skills、Automations。跑通以后,5 个日常场景的效率全部翻倍。
未来真正拉开差距的,不是谁装的插件多,而是谁更会把自己的方法论交给 AI 反复执行。
聊天框 vs 工作台,差的不只是效率
大多数人用 Codex 的方式:打开 → 问问题 → 拿到答案 → 复制 → 自己整理 → 关掉。下次再打开,从头解释一遍上下文。
这不叫用 AI,这叫被 AI 反复消耗。
真正的用法是:配好规则和流程,让 Codex 在你的项目里自己跑。你给目标,它给交付物。
| 上下文 | ||
| 重复流程 | ||
| 定时任务 | ||
| 产出 | ||
| 你的角色 |
前者省 5 分钟,后者省 5 小时。区别不在于 AI 多强,在于你有没有把规则和流程固化下来。
第一件套:AGENTS.md —— 你的规则,它每次必读
AGENTS.md 是项目级指令文件。Codex 每次开始工作前,会自动读取它,构建一条从全局到当前目录的指令链。
你不用每次重复说"用中文"、"先写大纲再写正文"、"不要用 emoji"——写进 AGENTS.md,一劳永逸。
三层结构,越近越优先
~/.codex/AGENTS.md ← 全局:个人工作约定
项目根目录/AGENTS.md ← 仓库:团队共识
项目根目录/子目录/AGENTS.override.md ← 专项:覆盖上层
Codex 从根目录开始拼接,离工作目录越近的文件越靠后加载,覆盖前面的规则。
一个实操示例:
# 全局 AGENTS.md(~/.codex/AGENTS.md)
## 工作约定
- 所有输出使用中文
- 先列计划,确认后再执行
- 写完检查有没有夸大、重复、口水话
# 项目 AGENTS.md(公众号项目/AGENTS.md)
## 内容规范
- 文章 1500-2500 字
- 标题用数字钩子 + 冲突感
- 每篇至少 3 处 blockquote 承载金句
- 代码块标注「发给 Codex:」
- 文末 CTA 固定格式
配好这个,你每次打开项目,Codex 已经知道你的风格、格式、交付标准了。
一句话记住:必须遵守的规则写 AGENTS.md,别指望 AI 每次都"记得"。它是确定性加载,不是概率性回忆。
两个坑别踩
- 32 KiB 上限
:所有 AGENTS.md 合计不超过 32 KiB(默认),超了就截断。解法是把大段内容拆到子目录。 - override 会覆盖普通文件
:同目录下如果有 AGENTS.override.md,普通AGENTS.md会被忽略。别两个都写。
第二件套:Skills —— 反复做的流程,封装成技能
Skill 是 Codex 的能力包。把你的工作流程封装成 Skill,下次一句话调用,不用从头写提示词。
三种创建方式
| Record & Replay | ||
| $skill-creator | ||
| 手动创建 |
新手推荐第二种。直接在 Codex 里输入:
发给 Codex:
$skill-creator
帮我创建一个 Skill,用来把文章转成公众号排版 HTML。
参考材料:我常用的排版模板、上一次做得满意的成品、
必须遵守的样式规范(橙色 #FF6B35 强调、引用块淡橙底色)、
输出前需要检查的清单。
关键细节:Codex 初始只加载每个 Skill 的 name 和 description(约上下文窗口的 2%),选中后才加载完整内容。所以 description 就是你的"广告位"——要简洁、包含触发词,否则隐式匹配不会命中。
四个作用域
| REPO | .agents/skills/ | |
| USER | ~/.agents/skills/ | |
| ADMIN | /etc/codex/skills/ | |
| SYSTEM |
反复照做的流程做 Skill,必须遵守的规则写 AGENTS.md,希望它记得的上下文交给 Memories。三句话讲清分工。
第三件套:Automations —— 定时任务,无人值守
Automations 让 Codex 按计划自动执行任务。每天抓资讯、每周体检依赖、定期清理死代码——全是"重复 + 定时"的事。
两类任务
- 独立任务
:每次从保存的 prompt 全新启动,上下文干净,结果可预期(推荐) - 基于已有会话
:复用历史上下文,适合长期跟踪型任务
prompt 里可以直接调用 Skill:
发给 Codex:
$ai-news-daily
每天早上 8 点,自动抓取最新 AI 资讯,
整理成日报格式,推送到飞书群。
这就是"Skill 定义方法,Automation 定义时刻表"的标准组合。
权限模型
无人值守任务遵守 sandbox 设置:默认 workspace-write 只能改工作区文件,网络访问受限。管理员可用 requirements.toml 强制约束,用户配置无法突破。
电脑须开机且 App 运行。目前只有桌面 App 支持定时任务,CLI 和 IDE 扩展没有这个界面。
5 个场景落地:配好三件套后,效率怎么翻
场景一:电脑管家 —— 文件整理
最笨但最省时间的起步场景。让 Codex 扫描下载文件夹,按大小排序,自动归类。
关键:先让 Codex 列清单,人工确认后再执行。删除、移动这类操作别上来就给完全访问权限。
场景二:办公交付 —— 从"帮我写"到"帮我交付"
大多数人让 AI 写方案,拿到一段文字就满足了。其实你可以让它直接输出 Word、PDF、PPT。
PPT 有两条路线:
- 图片型 PPT:每页一张完整视觉图,适合封面/营销页,还能导出 PSD
- HTML 型 PPT:含交互、动画、可预览、可部署
5 分钟生成一版 PPT,用批注功能在画面上圈出要改的地方,所见即所得。
你要的不是"帮我写一段话",是"帮我交付一个能用的文件"。
场景三:内容生产 —— 让 Codex 跑流程
自媒体最大的误用:一上来就说"帮我写一篇关于 XX 的文章"。出来的东西像通稿,因为 AI 没有 Context。
正确做法:
1. 把选题方式、标题习惯、写作风格、审稿标准写成 Skill
2. 写具体选题时,先让 Codex 读资料、整理关键事实
3. 再让它根据你的风格搭结构,补案例、补截图位置
4. 最后检查夸大、重复、口水话
你可以丢一堆视频和网页链接给 Codex,让它根据这些素材写解读,然后直接发到公众号或小红书后台。
场景四:原型开发 —— 先做个能跑的
非程序员最有价值的用法:不是"帮我写代码",是"帮我把想法做成能跑的第一版"。
流程:写 PRD → 生成原型图(GPT image 模型直接出 UI) → 写代码 → 启动预览 → 浏览器检查 → 批注改细节。
电子名片、活动报名页、客户报价计算器、数据看板——只要能打开、能点击、能展示主流程,就能帮你验证需求。
场景五:浏览器自动化 —— 最接近真实降本
四个插件各有所长:
整理后台数据、抓取收藏内容、检查页面、同步多平台内容——全是重复工作,全可以自动化。
新功能加持:锁屏也能干活
最近三个更新让工作台更完整:
- Appshots
:快捷键把当前窗口截图挂进对话,连带可提取文本、路径、链接。不用再写一大段背景说明。 - Goal mode
:给 Codex 一个终极目标,它围绕结果持续推进,中途可以查看、改方向、暂停。不再是"做一段就停"。 - Locked Computer Use
:Mac 锁屏后 Codex 仍能运行。配合手机端远程查看和批准——你只在关键节点介入,剩下的交给 AI 后台推进。
电脑锁屏后 Codex 还在干活,你出门回来验收就行。这才是"工作台"该有的样子。
最后
Codex 不是万能助手,它是一个能把个人经验放大的执行层。
你有清晰判断,它能放大效率;你只有模糊愿望,它也放大混乱。
真正该花时间的不是追每个新功能,而是把自己的工作拆成可执行、可检查、可复用的流程——然后用 AGENTS.md 固定规则,用 Skills 封装流程,用 Automations 接管定时任务。
三件套配好,Codex 才不只是一个聊天框,而是你自己的工作台。
安装 Codex · 回复「部署」获取保姆级部署机会
夜雨聆风