OpenAI 悄悄开源安全神器!两天狂揽 4300 星,3 行命令免费扫漏洞

OpenAI 有个内部工具,去年在 React 框架里挖出了一个零日漏洞,远程代码执行级别,编号 CVE-2025-55182。
这个安全工具,现在开源了。
OpenAI 自己都没来得及宣传,技术社区 Hacker News 先把开源仓库给扒出来了,GitHub 两天狂揽 4300 多颗星,目前已超 8100 星。OpenAI 后来补发了一条推文,「我们本来想悄悄上线的,结果被你们先发现了。」
话外音:「低调,都坐下!」

这个工具叫做 Codex Security,传送门 https://github.com/openai/codex-security。他的前身是 Aardvark,2025 年 10 月就在 OpenAI 内部上线了,专门给自家代码做安全审计。今年 3 月改名后面向企业客户开放公测,Beta 期间累计扫描了 120 万次代码提交,找出 792 个严重漏洞,10561 个高危漏洞。
6 月 24 日,一位开发者在 GitHub 创建了一个 issue,其中写着这样一句话,「安全工具不该藏着掖着」。

Codex Security 安全扫描,准吗?
一位资深技术顾问用 16.2 万行生产代码做了横向对比。Codex Security 共报告了 31 个问题,23 个经人工确认属实,命中率 74%。同一批代码交给目前开发者最常用的两款安全扫描工具,Snyk 扫描出 89 个问题,25 个属实,命中率 28%;Semgrep 更夸张,29/147,命中率 20%。
Codex Security 报告的问题最少,命中率最高,还额外挖出了 3 个严重漏洞,Snyk 和 Semgrep 都没有发现。
[图片] 误报太多是传统安全扫描工具最大的痛点之一,你花一下午筛选完 100 个告警,真正要修复的不到三分之一,剩下全是噪音。Codex Security 换了个思路,它用 AI 分析代码在上下文里的实际行为,判断一段代码在它所处的环境里到底有没有真实风险。
有网友跑完第一次扫描就说,「好家伙,这玩意真好用。」
那么,Codex Security 怎么用,三行命令搞定。
你电脑上需要安装 Node.js 22 以上和 Python 3.10 以上的版本。满足这两个条件后,打开终端,运行下面的命令。
npm install @openai/codex-security
npx codex-security login
npx codex-security scan .
第一行安装 Codex Security,第二行登录 ChatGPT 账号,第三行扫描当前目录。
[图片] 划重点,ChatGPT 免费用户就能用。 扫描会消耗你套餐自带的额度,不额外收费。如果是 CI/CD 环境没法交互登录,设置一个环境变量 OPENAI_API_KEY 就行,按量计费。
如果你本来就在用 Codex,不用额外安装 CLI。Codex 桌面端(现已并入 ChatGPT 桌面客户端)自带 Security 插件,扫描引擎和 CLI 是同一个,直接在 Codex 里就能用。CLI 的优势是能集成到 CI/CD 里、批量扫描多个仓库、追踪历史记录,适合开发团队把安全检查嵌进开发流程。日常自己写代码顺手扫一下,用 Codex 里的插件就够了。

Codex Security 安全扫描分为两种模式,标准和深度。
标准模式速度快,覆盖常见漏洞,日常用足够;深度模式则是多轮分析,能挖出复杂的逻辑漏洞,适合正式上线前做一次全面审计。
npx codex-security scan . --mode deep
但深度模式的 token 消耗很猛,有开发者吐槽「Codex Security 深度扫描一小时就用完了我一周的额度」,第一次尝试建议先设置 token 花费上限。
npx codex-security scan . --mode deep --max-cost 10
--max-cost 10 的意思是最多消耗 10 美元的 token,超了自动停止。先用标准模式扫描一遍心里有个底,再决定要不要开深度模式。
如果你只想扫描这次 PR 改动的代码,加个 --diff main,只看未提交的改动用 --working-tree,想在 CI 里设置门禁就加 --fail-on-severity critical,遇到严重漏洞直接强行终止合并。这几个参数可以互相组合,日常开发里 --diff 加 --fail-on-severity 最实用,PR 提交了自动扫描一遍,省心。
如果你团队有架构文档,还可以用 --knowledge-base 把文档传给它,让它结合上下文分析,进一步减少误报。扫描历史存在本地 SQLite 里,scans list 查看记录,scans compare 对比两次扫描的差异,追踪哪些漏洞已经修复、哪些是新问题。
想用代码集成的话,TypeScript SDK 五行代码搞定。
import { CodexSecurity } from "@openai/codex-security";
const security = new CodexSecurity();
const result = await security.run(".");
console.log(result.reportPath);
await security.close();
值得一提的是,目前这个安全工具有一个非常荒诞的 bug。多位开发者都反馈了同一件事,「用 Codex Security 扫描安全漏洞时,扫描过程本身被 Codex 的安全策略拦截了。」一个专门扫描安全漏洞的工具,被自家的安全系统标记成了「网络安全风险」,多少有点讽刺了吧。
有开发者说,「我们能用它,但用的时候会频繁触发安全策略失败。什么鬼。」
还有更离谱的,有一位开发者反馈 Codex Security 确实识别出了漏洞,但拒绝透露漏洞的具体内容。Token 花了,漏洞也找到了,就是什么都不告诉你。

吐槽归吐槽,Codex Security 还在 Research Preview 阶段,有边界问题不意外。好在它核心能力在线,免费开源,你可以自己审计这个安全工具本身的代码,这在安全领域反而是加分项。
想试试的,可以冲了。
我是木易,每天帮你抹平 AI 圈的信息差。这篇如果有用,顺手点个赞和在看,转给身边用 AI 的朋友。想第一时间收到更新,给我加个星标⭐。我们明天见。
