OpenAI 终于真·Open了!但开发者一用,钱包直接报警

温故智新AIGC实验室

TL;DR:

OpenAI 这次没画饼,真把代码安全智能体 Codex Security 开源了。它像个能读懂业务的 AI 保安,自动找漏洞、修漏洞,30 天就干掉了 792 个致命 bug。但开发者实测一把冷汗——默认调用顶级大模型 GPT-5.6-sol,扫个仓库能烧掉半周预算。这到底是真福利,还是 OpenAI 的 API 氪金陷阱?

三行命令,召唤一个「代码保安」

谁能想到,OpenAI 在 2026 年的夏天,突然拾起了被遗忘在角落的 “Open” 人设。

没有一点点防备,Codex Security CLI 就这么水灵灵地出现在了 GitHub 上。星标一路狂飙到 1.2k,Hacker News 直接引爆。OpenAI 眼看藏不住了,只好出来尴尬认领:“对对对,是我们干的。”1

这个 “Codex Security” 到底是什么来头?简单说,它不是一个只会喊 “这里有 Bug” 的静态扫描器,而是一个真正能读懂你代码、理解你系统在干啥的应用安全智能体(Agent)

主打一个开箱即用:

  • npm install @openai/codex-security
  • npx codex-security login
  • npx codex-security scan .

三行命令,你的代码库就开始“全面体检”。

它的工作流堪称“组合拳”:

  1. 通读全仓:先把你整个项目读一遍,生成一份可编辑的威胁模型,搞清楚这项目是干啥的、哪里最脆弱;
  2. 精准打击:基于上下文去找漏洞,并按真实世界的影响分个三六九等;
  3. 实锤验证:把可疑问题扔进沙箱里模拟攻击,验证不了的绝不往外报。

这套组合拳打下来,效果拔群。官方数据显示,上线头 30 天,它扫了超过 120 万次提交,捞出了 792 个严重级别 的漏洞,连带着 1 万多个高危发现。更离谱的是,同一批仓库反复扫,误报率下降了超过 50%。这效率,堪比代码界的“朝阳群众”。

实测翻车:账单烧穿了,仓库还在报警

不过,官方的饼画得再圆,也敌不过开发者的实测翻车。HN 上已经涌现出一波“钱包阵亡”的惨案。

开发者 gregwebs 拿了个小仓库试水,结果直接甩出了令人崩溃的终端日志:

  • 0 分 3 秒,开始准备;
  • 1 分 20 秒,进入扫描;
  • 52 分 47 秒,弹出红字——“扫描期间仓库 HEAD 发生了变化,请重新开始!”

一小时白跑不说,这一趟直接干掉了 Pro 套餐周额度的一半1

这波啊,这波是大出血。—— 某匿名开发者调侃

另一位老哥 Quai 更惨。扫描刚起步就撞上账户限流,工具重试了一分钟就放弃了。工具倒是提示“部分结果已保留”,但他死活没找到接着扫的办法。这次失败的运行,花了大约 13 美元1

为什么这么烧钱?看一眼默认配置,直接破案了。

Codex Security 默认调用 gpt-5.6-sol,并且把“推理力度”粗暴地拉满到了 extra-high

要知道,Sol 可是 GPT-5.6 家族中定价最“尊贵”的一档:API 标价 $5/1M 输入 token,$30/1M 输出 token1 这哪是扫代码,明明是在往 API 里倒美金。开发者们纷纷表示:开源是真开源,用不起也是真的用不起。

老黄一开口,OpenAI 就「Open」了?

这次开源的时机,也非常耐人寻味。

就在前几天,黄仁勋亲自下场,公开表态力挺开源 AI。紧接着,OpenAI 就补签加入了“开源阵营”,顺手把 Codex Security 给端了出来。1

果然,还是老黄说话有分量!

不过,先别急着把 OpenAI 抬进“开源圣殿”。这次操作更像一个精妙的“半开放”生态布局:开源的是应用层的壳,但最核心的模型层,依然被 OpenAI 牢牢攥在自己手里。

羊毛出在羊身上,工具是免费了,但调用底层模型的钱,可是一分都不能少。这波“开源”,堪称当代 AI 圈最成功的“体验式营销”。

但无论如何,一个无法逆转的事实已经摆在眼前:Agent 接管代码安全的魔盒已经打开。

接下来,就看开发者们如何爆改这个开源神器,用社区的魔法,来打败 OpenAI 的魔法了。或许,一个更低成本的“平替”方案,正在赶来的路上?

引用


  1. OpenAI,开源了(微信公众号“新智元”,2026/7/30)· ASI启示录 · 检索日期2026/7/30 ↩︎ ↩︎ ↩︎ ↩︎ ↩︎