OpenAI自己说悄悄放了开源的Codex Security CLI,结果Hacker News先发现了。
现在你可以直接用它扫描仓库、跨多次运行追踪发现、验证修复有没有真正生效,再把安全检查塞进CI/CD。这是早期版本,他们还在听反馈。

普通人写完代码习惯靠人工review或固定规则扫一遍就过。真正危险的漏洞往往藏在逻辑深处,静态工具抓不到,人工又容易漏。这工具把扫描、历史对比和修复验证串成一条线,理论上能少踩几次“修了又复现”的坑。
它到底能干什么,为什么值得现在试
扫仓库不再只是跑一遍规则。它会生成发现报告,把历史记录下来,下次再扫时能对比变化。你改了代码,想确认某个漏洞是不是真的没了,可以直接验证。CI里也能挂上,严重级别不达标就直接失败。
对普通开发者来说,这有点像给代码装了个会记账的安检员。每次提交不只是说“有问题”,而是告诉你上次发现的那些现在还在不在、修没修干净。对安全团队更直接:能批量扫一批仓库,还能把结果导出成SARIF、CSV或JSON,方便后续流程。
技术上它是TypeScript SDK加CLI,底层依赖Codex运行时。默认会用较高推理力度的模型去做扫描。扫描目标可以是整个仓库、指定路径、已提交的diff,或者工作区变更。状态默认存在本地workbench目录,写不进去就得自己设CODEX_SECURITY_STATE_DIR。
我自己试的时候发现状态目录如果不小心放在仓库里,有时候会跟gitignore打架。
早期版本意味着接口还可能变。社区里有人觉得现在就上生产风险大,也有人觉得先用起来反馈才有意义(这个判断本身就有争议)。
怎么装、怎么扫,踩坑点在哪
先装包:
npm install @openai/codex-security
或者直接:
npx @openai/codex-security@latest --help
需要Node.js 22以上,扫的时候还要Python 3.10以上。认证有两种:跑npx codex-security login用ChatGPT账号,或者设OPENAI_API_KEY。CI环境里直接用API key更稳。
扫当前目录最简单:
npx codex-security scan .
想只看某次变更可以加--diff。输出目录必须放在仓库外面,否则会报错。想让扫描失败就退出,可以设--fail-on-severity high。还有bulk-scan能一次扫一批仓库,git hook也能装上,提交前自动查一遍。
两种认证方式都有人在用:有人习惯login省事,有人只信环境变量。
跑完会看到报告路径和发现列表。容易出错的地方是状态目录权限和Python环境,缺tomli的时候Python 3.10会直接挂。
源码和文档在GitHub上,npm包名是@openai/codex-security。
早期工具用着总会遇到小摩擦,比如状态目录配置、认证优先级、输出必须在仓库外这些细节。先在自己的小项目上跑一遍,确认报告可读、修复验证流程顺,再考虑挂CI。同行可以直接看SDK接口,把扫描嵌进自己的工具链。
你现在会先在哪个项目上试这工具💬
