你把需求丢给 Codex、Claude Code 或其他编程 Agent,它们很快就能改文件、补测试,甚至直接替你提交代码。
麻烦出在后面。
代码能运行,不代表可以放心上线。权限判断漏了一层、用户输入被拼进命令、密钥被写进日志,这些问题不一定会让程序立刻报错,却可能在上线后留下安全口子。
对独立开发者和小团队来说,这件事更麻烦。AI 一次能改十几个甚至几十个文件,人工逐行检查,刚省下来的时间又搭进去了;完全不检查,又不知道哪一处会在上线后出问题。
很多人的检查办法,还是把刚写完代码的同一个 Agent 叫回来:
你再帮我看看,这里面有没有安全问题。
它当然可以再看一遍。但让同一个 Agent 自己写、自己审、自己判断能不能放行,这套流程多少有点不踏实。
这里缺的是一层单独的安全检查:它不负责替你赶进度,而是专门找问题、验证问题,并把证据留下来交给人判断。
OpenAI 最近把 Codex Security 的 CLI 和 TypeScript SDK 公开了。看完官方文档和仓库后,我觉得,经常让 AI 写代码的人可以先关注一下。
Codex Security 是做什么的
OpenAI 把 Codex Security 定义为一个应用安全 Agent。
它拿到代码仓库后,会先理解项目结构、权限边界和可能的攻击面,再去寻找问题。发现候选问题以后,还会继续验证,整理证据、攻击路径和修复建议。
现在公开的 @openai/codex-security 是一个 npm 包,里面同时提供了两个入口:
• CLI,适合在终端里使用,也可以接入 Git 和 CI;
• TypeScript SDK,适合接入团队自己的开发平台、自动化流程或内部工具。
运行扫描时,需要使用 OpenAI 账号或 API Key,并调用 Codex 运行时和在线模型。
它和“让 AI 再检查一遍”有什么不同
安全检查最费时间的,往往不是跑出一堆告警,而是判断哪些问题是真的、为什么会发生、应该怎么修,以及修完以后怎么继续追踪。
Codex Security 把这些后续步骤连成了一条流程。
一次扫描可以包含这些步骤:
1. 根据仓库和补充文档建立威胁模型;
2. 检查整个仓库、指定目录或一段 Git 变更;
3. 找出可能的安全问题,再继续验证;
4. 记录代码证据、根因、攻击路径和修复建议;
5. 单独记录哪些地方检查过,哪些地方没有检查完整;
6. 保存历史结果,比较新增、持续存在、重新出现和已经解决的问题;
7. 导出 Markdown、JSON、CSV 或 SARIF,供人审阅或交给 CI。
这比一段聊天回复更容易进入真实开发流程。
尤其是 coverage,也就是扫描覆盖情况。Codex Security 不会只给你一个“通过”或者“不通过”,还会标明本次覆盖是 complete、partial 还是 unknown,以及有哪些部分被排除、延期或没有确认。
如果结果是 partial 或 unknown,就不能拿它证明“代码已经安全”。
这个设计挺重要,至少它没有把一次不完整的 AI 检查包装成确定答案。
【独立安全检查流程】

CLI 怎么安装和使用
普通开发者最关心的还是能不能直接放进现有项目里。CLI 就是最简单的入口,不需要先搭一套安全平台。
先看环境要求:
• Node.js 22 或更高;
• Python 3.10 或更高;
• ChatGPT/Codex 登录,或者 OpenAI API Key;
• Codex Security 产品访问资格。
官方安装命令是:
npm install @openai/codex-security然后登录:
npx codex-security login远程服务器或没有浏览器的环境,可以使用设备授权:
npx codex-security login --device-auth先确认版本和可用命令:
npx codex-security --versionnpx codex-security --help第一次运行,我建议先做 dry-run。它只检查仓库路径、输出目录、认证来源和扫描配置,不会正式启动扫描:
npx codex-security scan /path/to/repository \ --output-dir /path/outside/repository/results \ --dry-run确认没有问题后,再去掉 --dry-run:
npx codex-security scan /path/to/repository \ --output-dir /path/outside/repository/results输出目录最好放在被扫描的 Git 仓库外面。
报告里可能包含源码片段、漏洞细节和复现步骤,不适合随手提交进仓库或传到公共位置。
【CLI 最小上手路径】

如果只想检查部分代码,可以指定目录:
npx codex-security scan /path/to/repository \ --path src \ --path tests检查当前代码相对主分支发生的变化:
npx codex-security scan /path/to/repository \ --diff origin/main检查还没有提交的修改:
npx codex-security scan /path/to/repository \ --working-tree \ --base HEAD它还能读取架构文档、威胁模型和安全策略,帮助 Agent 理解项目实际怎么工作:
npx codex-security scan /path/to/repository \ --knowledge-base /path/to/architecture.md \ --knowledge-base /path/to/security-policies模型扫描的费用和耗时不固定。可以先设置估算费用上限:
npx codex-security scan /path/to/repository \ --max-cost 5但官方也写明,--max-cost 不是绝对硬上限。已经发出的请求可能继续完成,最终费用有机会超过设定值。
TypeScript SDK 能做什么
如果只是自己在终端里检查代码,CLI 已经够用了。
团队里的难点不在于偶尔跑一次命令,而是怎么把扫描接进后台、CI、任务队列和内部开发工具。所有逻辑都靠 shell 命令拼接,后续很难管理进度、费用、取消和错误处理。
TypeScript SDK 就是为这类集成准备的。
最小调用方式如下:
import { CodexSecurity } from"@openai/codex-security";const security = newCodexSecurity();try {const result = await security.run("/path/to/repository", {outputDir: "/path/outside/repository/results", });console.log(result.reportPath);console.log(result.coverage.completeness);console.log(result.findings.findings.length);} finally {await security.close();}返回结果不是一整段无法拆分的文本。SDK 会提供结构化 findings、覆盖情况、扫描产物路径、线程信息和费用估算,上层工具可以继续处理。
它还支持:
• 扫描前预检;
• 费用限制和费用回调;
• 扫描进度回调;
• 任务取消;
• 针对认证、配置、路径、预算和扫描中断的细分错误处理。
需要注意,这个 SDK 是给 Node.js 服务端使用的 ESM 包,不是浏览器前端 SDK。当前版本还是 0.1.x,OpenAI 也明确提醒,1.0 之前公开 API 可能在小版本更新中变化。
使用前先看这三点
访问权限
官方文档仍把 CLI 和 SDK 标为 beta,并写明需要访问资格。正式扫描取决于账号是否获得访问权限,部分完整仓库扫描还可能要求 Trusted Access for Cyber。
成本和稳定性
它依赖模型推理,同一套配置重复扫描,结果也可能有差异。使用时最好把单次结果、历史匹配和覆盖率放在一起看。
代码与扫描结果的敏感性
官方安全说明明确提醒,扫描可能检查代码并在 Codex 沙箱内运行命令。仓库文件、构建脚本和扫描结果都应该按不可信内容处理。报告本身也可能暴露源码和漏洞细节,需要控制保存位置、访问权限和保留时间。
它会替代传统安全扫描工具吗
按照 OpenAI 的官方定位,它不会取代传统安全工具。
传统 SAST、依赖扫描、密钥扫描和运行时防护,擅长稳定执行已知规则、检查固定模式。Codex Security 想补的是另一部分:理解项目上下文、寻找流程绕过、验证候选问题,并把后续修复和跟踪连起来。
更稳妥的做法,是把它加在现有安全流程旁边,原来的工具继续运行。
如果后面真的接入 CI,我会建议先让它只生成报告。观察一段时间的耗时、费用、误报和人工采纳情况,再决定要不要用严重程度阻止提交或合并。
【工具互补与使用边界】

我会推荐给哪些人
如果你符合下面几种情况,可以先关注或申请尝试:
• 经常让 Codex、Claude Code 等 Agent 生成或修改真实项目代码;
• 已经有 Git 和 CI 流程,希望增加一层独立安全检查;
• 愿意人工复核发现的问题和建议补丁;
• 能接受 beta 工具的权限、费用和接口变化。
下面这些情况,现阶段就不用急着折腾:
• 项目必须完全离线,源码不能进入外部 AI 服务;
• 只需要快速、稳定、低成本地执行固定安全规则;
• 没有人负责复核扫描结果;
• 希望一次扫描就给出合规证明或“代码绝对安全”的结论。
我的建议很简单:有访问资格的话,先拿一个自己有权检查、没有敏感信息的小仓库试用。第一阶段只看报告,不自动修复,不自动合并,也不要停掉现有的安全扫描工具。
Codex Security 仍在 beta,但它已经把安全检查做成了可以接入开发流程的 Agent 工具链。AI 写代码越来越快以后,开发流程需要一个能独立检查、留下证据、允许人来做最后决定的安全环节。
官方资料
• OpenAI Codex Security 总览:https://developers.openai.com/codex/security
• CLI 快速开始:https://developers.openai.com/codex/security/cli
• TypeScript SDK:https://developers.openai.com/codex/security/sdk
• OpenAI 官方 GitHub 仓库:https://github.com/openai/codex-security
• OpenAI 关于 Codex Security 与 SAST 的说明:https://openai.com/index/why-codex-security-doesnt-include-sast
到这里,如果觉得这篇文章还不错,欢迎点个关注,也可以顺手点个赞、来个三连。
后面我会继续把自己折腾 AI 工具和 Agent 的真实过程、踩过的坑、跑通的办法,慢慢分享出来。
感谢你看我的文章,下篇见咯!
夜雨聆风