TL;DR:
OpenAI 这次没画饼,真把代码安全智能体 Codex Security 开源了。它像个能读懂业务的 AI 保安,自动找漏洞、修漏洞,30 天就干掉了 792 个致命 bug。但开发者实测一把冷汗——默认调用顶级大模型 GPT-5.6-sol,扫个仓库能烧掉半周预算。这到底是真福利,还是 OpenAI 的 API 氪金陷阱?
三行命令,召唤一个「代码保安」
谁能想到,OpenAI 在 2026 年的夏天,突然拾起了被遗忘在角落的 “Open” 人设。
没有一点点防备,Codex Security CLI 就这么水灵灵地出现在了 GitHub 上。星标一路狂飙到 1.2k,Hacker News 直接引爆。OpenAI 眼看藏不住了,只好出来尴尬认领:“对对对,是我们干的。”1
这个 “Codex Security” 到底是什么来头?简单说,它不是一个只会喊 “这里有 Bug” 的静态扫描器,而是一个真正能读懂你代码、理解你系统在干啥的应用安全智能体(Agent)。
主打一个开箱即用:
npm install @openai/codex-securitynpx codex-security loginnpx codex-security scan .
三行命令,你的代码库就开始“全面体检”。
它的工作流堪称“组合拳”:
- 通读全仓:先把你整个项目读一遍,生成一份可编辑的威胁模型,搞清楚这项目是干啥的、哪里最脆弱;
- 精准打击:基于上下文去找漏洞,并按真实世界的影响分个三六九等;
- 实锤验证:把可疑问题扔进沙箱里模拟攻击,验证不了的绝不往外报。
这套组合拳打下来,效果拔群。官方数据显示,上线头 30 天,它扫了超过 120 万次提交,捞出了 792 个严重级别 的漏洞,连带着 1 万多个高危发现。更离谱的是,同一批仓库反复扫,误报率下降了超过 50%。这效率,堪比代码界的“朝阳群众”。
实测翻车:账单烧穿了,仓库还在报警
不过,官方的饼画得再圆,也敌不过开发者的实测翻车。HN 上已经涌现出一波“钱包阵亡”的惨案。
开发者 gregwebs 拿了个小仓库试水,结果直接甩出了令人崩溃的终端日志:
- 0 分 3 秒,开始准备;
- 1 分 20 秒,进入扫描;
- 52 分 47 秒,弹出红字——“扫描期间仓库 HEAD 发生了变化,请重新开始!”
一小时白跑不说,这一趟直接干掉了 Pro 套餐周额度的一半。1
这波啊,这波是大出血。—— 某匿名开发者调侃
另一位老哥 Quai 更惨。扫描刚起步就撞上账户限流,工具重试了一分钟就放弃了。工具倒是提示“部分结果已保留”,但他死活没找到接着扫的办法。这次失败的运行,花了大约 13 美元。1
为什么这么烧钱?看一眼默认配置,直接破案了。
Codex Security 默认调用 gpt-5.6-sol,并且把“推理力度”粗暴地拉满到了 extra-high。
要知道,Sol 可是 GPT-5.6 家族中定价最“尊贵”的一档:API 标价 $5/1M 输入 token,$30/1M 输出 token。1 这哪是扫代码,明明是在往 API 里倒美金。开发者们纷纷表示:开源是真开源,用不起也是真的用不起。
老黄一开口,OpenAI 就「Open」了?
这次开源的时机,也非常耐人寻味。
就在前几天,黄仁勋亲自下场,公开表态力挺开源 AI。紧接着,OpenAI 就补签加入了“开源阵营”,顺手把 Codex Security 给端了出来。1
果然,还是老黄说话有分量!
不过,先别急着把 OpenAI 抬进“开源圣殿”。这次操作更像一个精妙的“半开放”生态布局:开源的是应用层的壳,但最核心的模型层,依然被 OpenAI 牢牢攥在自己手里。
羊毛出在羊身上,工具是免费了,但调用底层模型的钱,可是一分都不能少。这波“开源”,堪称当代 AI 圈最成功的“体验式营销”。
但无论如何,一个无法逆转的事实已经摆在眼前:Agent 接管代码安全的魔盒已经打开。
接下来,就看开发者们如何爆改这个开源神器,用社区的魔法,来打败 OpenAI 的魔法了。或许,一个更低成本的“平替”方案,正在赶来的路上?