OpenAI,终于又迈出了“开源”这一步!最近,OpenAI 官宣已悄然发布了一款代码安全神器——Codex Security CLI。此前,该工具已被 Hacker News 的用户抢先发现,讨论热度瞬间引爆,GitHub 上的星标数一路飙升至 1200 多个。眼看热度藏不住了,OpenAI 只好正式出面认领。
几天前,英伟达 CEO 黄仁勋亲自下场,公开表态力挺开源 AI,随后 OpenAI 便紧随其后加入了阵营。没想到惊喜来得这么快,重磅开源神作转眼就给端了出来。不得不说,还是老黄说话有分量!
这次开源的“主角”是 Codex Security,它包含一个 CLI 工具和一个 TypeScript SDK。其核心功能非常直白,主打一套“组合拳”:在代码库中自动发现漏洞、验证漏洞并修复漏洞。它主打开箱即用,只需三行命令即可跑通全流程:
npm install @openai/codex-security
npx codex-security login
npx codex-security scan .
如果是集成到 CI 流程中,无需登录,只需配置一个 OPENAI_API_KEY 即可。该工具的运行门槛为 Node.js 22 以上、Python 3.10 以上,外加 Codex Security 的访问权限。
严格来说,Codex Security 并非一个“新物种”。它脱胎于去年 10 月的私测项目 Aardvark,并于今年 3 月 6 日更名上线了研究预览版。这款工具最硬核的地方在于它的定位——应用安全智能体。Codex Security 会真正深入底层,去读懂你的代码,理解你的系统到底在干什么。它的工作流分三步:
首先,把整个仓库读一遍,生成一份可编辑的威胁模型,搞清楚这个项目是做什么的、哪里最暴露;
然后,基于这份上下文去找漏洞,并按真实世界的影响分级;
最后,把可疑的问题扔进沙箱里实打实地压测一遍,验证不了的不往外报。
从战绩看,它确实相当能打。上线头 30 天,它扫了超过 120 万次提交,捞出 792 个严重级别,以及 10561 个高危级别的发现。OpenAI 还提到,同一批仓库反复扫,误报率下降超过 50%。
官方的饼画得再大,也敌不过开发者们第一时间涌现的“实测惨案”。在 Hacker News 上,一位开发者 Gregwebs 拿了个小仓库试水,直接甩出了令人崩溃的终端日志。0 分 3 秒开始准备,1 分 20 秒进入扫描,然后一路跑到 52 分 47 秒,最后弹出一行红字——扫描期间仓库 HEAD 发生了变化,请重新开始。一小时白跑不说,这一趟直接干掉了他 Pro 套餐周额度的一半。
另一位开发者 Quai 更惨,扫描刚起步就撞上账户限流,工具重试了一分钟就放弃了。虽然工具提示“部分结果已保留”,但他没找到明显的办法在下一次扫描里接着用。这次失败的运行,花了大约 13 美元。
究竟为什么这么烧钱?看一眼默认配置直接破案。Codex Security 默认调用的是 gpt-5.6-sol,并且把“推理力度”粗暴地拉满到了 extra-high。要知道,Sol 可是 GPT-5.6 家族中定价最“尊贵”的一档,其 API 标价高达每百万输入 token 5 美元、每百万输出 token 30 美元。
黄仁勋开个头,OpenAI 迈出了一步。前脚黄仁勋公开喊话力挺开源 AI,后脚 OpenAI 就端出了 Codex Security。不过,先不要把这次“开源”想得太满。OpenAI 这一招走得很精:开源的是应用层的壳,模型层还牢牢攥在自己手里。无论如何,Agent 接管代码安全的魔盒已经打开。接下来,就看开发者们如何爆改这个开源神器,用社区的魔法,来打败 OpenAI 的魔法了。
