TL;DR:
- OpenAI publicó en GitHub el CLI y el SDK de TypeScript de Codex Security con licencia Apache 2.0, sin anuncio previo: Hacker News lo encontró antes que nadie.
- La documentación oficial mantiene ambos en beta y con acceso requerido, y advierte que un escaneo de repositorio completo puede exigir además Trusted Access for Cyber.
- Los primeros usuarios reportaron corridas que se cayeron a medias: una consumió unos 13 dólares y otra, media cuota semanal de un plan Pro.
OpenAI subió a GitHub el código del Codex Security CLI y de su SDK de TypeScript con licencia Apache 2.0, la herramienta con la que la empresa busca, confirma y parcha vulnerabilidades en repositorios. Lo hizo sin anuncio: el repositorio apareció el 28 de julio de 2026, publicado por Thibault Sottiaux, líder de Codex, y Hacker News lo detectó antes de que la compañía alcanzara a difundirlo en X. El paquete escanea repositorios completos o solo un diff, guarda el historial de hallazgos, compara resultados entre corridas y mete una compuerta de severidad dentro de CI/CD. La letra chica está en la documentación: el CLI y el SDK siguen en beta y requieren acceso, así que tener el código no equivale a poder correrlo.
La confesión llegó al día siguiente, desde la cuenta oficial de la empresa.
"Publicamos discretamente el Codex Security CLI de código abierto, pero Hacker News lo encontró antes de que tuviéramos oportunidad de compartirlo aquí… Ya pueden usarlo para escanear repositorios, dar seguimiento a los hallazgos entre corridas, verificar correcciones y agregar revisiones de seguridad a CI/CD. Este es un lanzamiento temprano y estamos atentos a sus comentarios mientras seguimos mejorándolo."
We quietly released the open-source Codex Security CLI, but Hacker News found it before we had a chance to share it here...
— OpenAI (@OpenAI) July 29, 2026
You can now use it to scan repositories, track findings across runs, verify fixes, and add security checks to CI/CD.
This is an early release, and we're… pic.twitter.com/4AbAn1ZRym
Qué trae el CLI y en qué se separa del plugin de Codex
Codex Security nació como Aardvark, una beta privada, y salió en research preview el 6 de marzo de 2026 conectado a repositorios de GitHub. Lo que se publicó ahora es la versión de terminal, la que corre en la máquina del desarrollador o dentro de una canalización. Estas son sus piezas, tal como las documenta el propio repositorio:
- Escanea un repositorio entero, solo ciertas rutas con
--path, los cambios contra una rama con--diff origin/main, o lo que está sin commitear con--working-tree. - Exporta los hallazgos en SARIF, CSV o JSON, así que se pueden cargar en las herramientas de code scanning que el equipo ya usa.
--fail-on-severityhace que la corrida devuelva error en CI cuando aparece un hallazgo de la severidad elegida o superior. Por defecto los escaneos solo reportan.install-hookdeja un gancho de pre-commit que revisa los cambios antes de cada commit y frena los hallazgos de severidad alta, sin reemplazar un hook existente.bulk-scandescubre repositorios de una cuenta u organización de GitHub con actividad en los últimos 90 días, excluye archivados y forks, y acepta un CSV con revisiones fijas para campañas automatizadas.scans matchyscans comparecruzan dos escaneos y separan los hallazgos nuevos, los que persisten, los reabiertos, los resueltos y los que quedan en duda.--knowledge-baseacepta documentos de arquitectura, modelos de amenazas o políticas de seguridad en Markdown, texto, PDF y Word, para que el escaneo entienda cómo funciona el sistema antes de opinar sobre él.
Esa última capa es la que OpenAI vende como diferencia frente a los escáneres de reglas y firmas: la herramienta arma un modelo del proyecto (dónde están los datos sensibles, cuáles son las fronteras de confianza, por dónde entra un atacante) y trata de validar el camino de ataque antes de mostrar el hallazgo.
En Hacker News, Michael D'Angelo, cofundador de Promptfoo (comprada por OpenAI en marzo) y hoy parte del equipo del CLI, explicó por qué existe esta versión si ya había un plugin dentro de Codex: el plugin sirve para el repositorio en el que estás trabajando ahora, mientras que el CLI y el SDK usan el mismo escáner pero están hechos para correr seguridad sobre muchos repositorios a lo largo del tiempo, con escaneos de toda la organización, historial, deduplicación, seguimiento de falsos positivos, control de presupuesto e integración con CI.

Código abierto no es lo mismo que acceso abierto
Aquí es donde la cobertura y la realidad se separan. El repositorio es público y la licencia Apache 2.0 permite leerlo, clonarlo, modificarlo y redistribuirlo. Pero el quickstart oficial del CLI lo dice sin adornos en la segunda línea: el CLI y el SDK de Codex Security están en beta y requieren acceso, y hay que seguir las instrucciones de instalación que llegan con ese acceso.
Hay un candado más, y es el que se le va a atravesar a cualquiera que quiera auditar un proyecto grande. Según la misma documentación, dependiendo de la cuenta y del repositorio, los escaneos de repositorio completo pueden requerir además Trusted Access for Cyber, un permiso que ni iniciar sesión ni configurar una API key otorgan por sí solos. RuntimeWire lo resumió bien: el código fuente es público, el escáner sigue con la puerta cerrada. Del lado de la nube, Codex Security está disponible para cuentas de ChatGPT Enterprise, Edu, Business y Pro.
Las primeras horas dejaron facturas y errores de autenticación
El hilo de Hacker News superó los 240 votos en un par de horas y se llenó de la clase de reporte que ningún comunicado incluye. Un usuario contó que su escaneo arrancó y murió al chocar con el límite de peticiones de su cuenta, que la herramienta se rindió tras un minuto de reintentos y que la corrida fallida le costó alrededor de 13 dólares. Otro contó que corrió el escaneo en un repositorio pequeño, que estuvo casi una hora trabajando y que terminó con un error porque el HEAD del repositorio cambió mientras tanto: la corrida se perdió y, según su reporte, le consumió la mitad de su cuota semanal de un plan Pro.
Ninguna de esas dos experiencias está verificada de forma independiente, pero explican por qué el CLI trae la bandera --max-cost, que detiene la corrida cuando el costo estimado del modelo pasa un límite en dólares. La cuenta se entiende mejor con el default: los escaneos usan gpt-5.6-sol con esfuerzo de razonamiento extra alto, y la documentación de Docker advierte que un repositorio completo puede tardar decenas de minutos con esa configuración. Los problemas de autenticación fueron el otro tropiezo del debut, y D'Angelo los reconoció en el mismo hilo.
"Hola HN, soy Michael, cofundador de Promptfoo y una de las personas que trabajan en el Codex Security CLI en OpenAI. Gracias por revisarlo y por señalar los problemas de autenticación. Acabamos de liberarlo como código abierto y todavía hay mucho por mejorar de nuestro lado. Esperen que el producto evolucione rápido."
Cyber Security News reportó que OpenAI corrigió esas fallas con rapidez y que el repositorio ya rondaba las 1,500 estrellas ese mismo día. La pregunta que quedó abierta en el hilo fue otra: varios desarrolladores preguntaron si el CLI puede apuntarse a un modelo local o a un endpoint compatible con la API de OpenAI, porque mandar código propietario a la nube choca con las políticas de más de una empresa. D'Angelo respondió que están trabajando en soportarlo de forma oficial y que, al ser código abierto, hoy ya es sencillo cambiar el modelo por cuenta propia.
La pelea por la seguridad de aplicaciones se mudó a la terminal
OpenAI entra con esto a un mercado que ya atienden Snyk, Semgrep, Checkmarx, Veracode y el propio GitHub con Copilot Autofix, y compite de frente con la herramienta equivalente de Anthropic, Claude Security, según reportó The Decoder. Las cifras que la empresa ha puesto sobre la mesa son suyas y no vienen de una comparación independiente: en los 30 días previos al lanzamiento de marzo dijo haber escaneado más de 1.2 millones de commits en repositorios de beta externos, con 792 hallazgos críticos y 10,561 de severidad alta, más 14 CVE asignados a fallas reportadas a proyectos como OpenSSH, GnuTLS, libssh, PHP y Chromium. Para abril, según OpenAI, el sistema había ayudado a corregir más de 3,000 vulnerabilidades críticas.
La presión de fondo es de volumen, y FomoEra ya contó cómo la IA está acelerando la detección de fallas, con 45,207 registradas en el NVD en 2026. Del otro lado del tablero pasa algo incómodo para quien defiende: en Hacker News, un usuario contó que al usar Codex Security dentro de la app de Codex el modelo a veces le avisaba que había encontrado una vulnerabilidad y luego no podía decirle cuál, y preguntó cómo maneja eso el CLI. La pregunta seguía sin respuesta del equipo al momento de esta consulta.
No es un detalle aislado. Cuando Hugging Face reconstruyó el ataque autónomo que sufrió en julio, los filtros de los modelos comerciales le bloquearon los comandos de ataque y los artefactos que necesitaba para el análisis forense, y la empresa terminó usando un modelo de pesos abiertos en su propia infraestructura.

Preguntas rápidas sobre el Codex Security CLI
¿Cuánto cuesta usar el Codex Security CLI?
El paquete es gratuito y tiene licencia Apache 2.0, pero cada escaneo consume tokens de una cuenta de ChatGPT o de la API de OpenAI. La documentación incluye la bandera --max-cost para detener una corrida cuando el costo estimado supera un límite en dólares; las peticiones ya iniciadas pueden terminar por encima de ese tope.
¿Qué necesito para instalar Codex Security?
Node.js 22 o superior en macOS, Linux o Windows, y Python 3.10 o superior para escanear y exportar hallazgos, con el paquete tomli si se usa exactamente la 3.10. La instalación es npm install @openai/codex-security. Iniciar sesión o configurar una API key es un paso aparte, y la beta requiere acceso otorgado por OpenAI.
¿En qué se diferencia del plugin de Codex Security?
Michael D'Angelo, del equipo de OpenAI, explicó en Hacker News que el plugin sirve para revisar el repositorio en el que se está trabajando, mientras que el CLI y el SDK usan el mismo escáner pero están pensados para correr seguridad sobre muchos repositorios a lo largo del tiempo: escaneos de toda la organización, historial, deduplicación, seguimiento de falsos positivos, control de presupuesto e integración con CI.
Para un equipo en México, España o cualquier parte de América Latina, las preguntas prácticas son dos: si le dan acceso a la beta y cuánto va a costar cada corrida, porque el gasto se mide en tokens y no en asientos. El código del arnés, en cambio, ya está publicado bajo Apache 2.0, y quien quiera auditarlo, adaptarlo o apuntarlo a otro modelo puede empezar hoy, con invitación o sin ella.