A OpenAI abriu o cofre da seguranca
Eu já perdi a conta de quantas vezes rodei um npm audit e fiquei olhando para uma lista de 200 vulnerabilidades sem ter a menor ideia de por onde comecar. Se voce é dev e já passou por isso, a OpenAI acaba de liberar uma ferramenta que promete mudar esse jogo: o Codex Security, agora open source no GitHub, com CLI e SDK em TypeScript, licenca Apache 2.0.
A ideia é simples na teoria e ambiciosa na prática: em vez de só apontar o dedo para o problema (como faz a maioria dos scanners), o Codex Security encontra a vulnerabilidade, valida se ela é real e gera o patch pronto para voce aprovar. Tudo isso usando IA, sem regras estáticas.
Vamos ver como isso funciona, onde ele brilha e onde ainda tropeça.
O que é o Codex Security (sem enrolacao)
O Codex Security é um agente de seguranca de aplicacoes criado pela OpenAI. Ele funciona como uma CLI que voce instala via npm e aponta para seu repositório. A partir daí, ele:
- Escaneia o código-fonte inteiro, incluindo histórico de commits
- Constrói um modelo de ameacas específico do seu projeto
- Valida cada achado em um sandbox isolado antes de reportar
- Gera pull requests com correcoes prontas
Não é mais um linter glorificado. É um agente que raciocina sobre contexto, entende como as pecas do seu código se conectam e tenta corrigir o problema, não só avisá-lo.
Requisitos
| Componente | Versão mínima | |
|---|---|---|
| ———– | ————– | |
| Node.js | 22+ | |
| Python | 3.10+ | |
| Acesso | Codex Security service (via ChatGPT Pro ou API key) |
Instalacao e primeiro scan
npm install @openai/codex-security
npx codex-security login
npx codex-security scan .
Três comandos. Não precisa configurar YAML de 200 linhas, não precisa criar conta em mais uma plataforma SaaS. Login via ChatGPT ou OPENAI_API_KEY como variável de ambiente para CI.
Os números que importam
A OpenAI publicou dados agregados da fase de research preview, que comecou em marco de 2026:
| Métrica | Valor | |
|---|---|---|
| ——— | ——- | |
| Commits escaneados | 1,2 milhão | |
| Vulnerabilidades high-severity | 10.561 | |
| Vulnerabilidades críticas | 792 | |
| Reducao de falsos positivos | ~70% (vs. scanners tradicionais) | |
| Linguagens com análise profunda | Python, JavaScript, TypeScript | |
| Linguagens suportadas | Python, JS, TS, Go, Java, C, C++, Rust, Ruby, PHP |
Aquele número de 70% menos falsos positivos é o que mais chama atencao. Quem já usou SonarQube ou Snyk sabe: metade do trabalho de seguranca é filtrar os alertas que não significam nada. O Codex Security faz essa triagem rodando os achados em sandbox antes de reportar. Se ele não consegue provar que a vulnerabilidade é explorável, ele descarta.
Como funciona por dentro
O processo de scan do Codex Security segue três fases:
Fase 1: Identificacao
A IA analisa o código usando raciocínio contextual, não pattern matching. Isso significa que ela entende o fluxo de dados da sua aplicacao. Se um input do usuário passa por sanitizacao antes de chegar no banco, a ferramenta reconhece isso e não dispara um alerta de SQL injection.
Diferente de um SAST tradicional que olha linha por linha, o Codex Security constrói um grafo de dependências e entende como os módulos se comunicam. Pense nisso como a diferenca entre um corretor ortográfico e alguém que realmente lê o texto.
Fase 2: Validacao
Cada vulnerabilidade candidata é testada em um ambiente sandbox. A IA tenta explorar o bug encontrado. Se ela consegue, a vulnerabilidade é classificada como confirmada. Se não, vai para uma fila de “possível” com prioridade baixa.
Essa fase é o que mata os falsos positivos. Scanners tradicionais reportam tudo que parece suspeito. O Codex Security só reporta o que ele conseguiu provar.
Fase 3: Remediacao
Aqui é onde a coisa fica interessante. Para cada vulnerabilidade confirmada, a IA gera um pull request com:
- O fix no código
- Testes que validam a correcao
- Explicacao do que foi encontrado e por que o fix funciona
Voce revisa, aprova e mergeia. Ou não. O ponto é que voce recebe a solucao pronta, não um relatório PDF de 80 páginas que ninguém lê.
Codex Security vs. o resto do mercado
Vamos ser honestos: o mercado de AppSec já tem players consolidados. Snyk, SonarQube, GitHub Advanced Security, Semgrep. Onde o Codex Security se encaixa?
| Feature | Codex Security | Snyk | SonarQube | GitHub Advanced Security | |
|---|---|---|---|---|---|
| ——— | ————— | —— | ———– | ————————- | |
| Auto-fix com PR | Sim | Limitado | Não | Parcial | |
| CI/CD gating | Em breve | Sim | Sim | Sim | |
| Compliance (SOC 2, PCI) | Não | Sim | Sim | Sim | |
| Scan de histórico de commits | Sim | Parcial | Não | Parcial | |
| Scan de dependências | Não | Sim | Parcial | Sim | |
| Scan de containers | Não | Sim | Não | Sim | |
| Preco (time de 20 repos, 50k LOC) | ~US$ 540/mês | Variável | Grátis (Community) | Incluso no Enterprise |
A tabela deixa claro: o Codex Security não substitui Snyk ou SonarQube. Ele complementa. O Snyk é imbatível em SCA (análise de dependências) e compliance. O SonarQube é o rei da qualidade de código. O Codex Security é o cara que pega as vulnerabilidades que os outros encontram e gera o fix automaticamente.
Se voce já tem Snyk no pipeline, adicionar Codex Security é como contratar um dev que só faz code review de seguranca. 24 horas por dia. Sem reclamar.
Patch the Planet: o programa que muda o jogo open source
Junto com o open source do CLI, a OpenAI lancou o Patch the Planet, uma parceria com a Trail of Bits focada em projetos open source críticos.
Os números da primeira semana:
- 19 projetos atendidos
- 64 pull requests enviados
- 51 issues criadas
- 37 patches mergeados
A filosofia é clara: “patches, testes, triagem e suporte ao maintainer, não apenas mais bug reports”. Qualquer um pode abrir issues. O difícil é consertar. E é exatamente isso que o programa faz.
O Patch the Planet também oferece para maintainers de projetos open source:
- 6 meses grátis de ChatGPT Pro com Codex
- Acesso condicional ao Codex Security
- Créditos de API pelo Codex Open Source Fund
Se voce mantém um projeto open source com mais de 1.000 stars, vale dar uma olhada. A Trail of Bits não é qualquer empresa: são os mesmos caras que auditam smart contracts bilionários e infraestrutura crítica.
GPT-5.5-Cyber: o modelo por trás
O Codex Security não roda num GPT genérico. Por trás, ele usa o GPT-5.5-Cyber, um modelo especializado em seguranca defensiva. É parte do programa Daybreak da OpenAI, que foca em usar IA para protecao (não ataque).
O que torna o GPT-5.5-Cyber diferente de rodar um prompt de seguranca no ChatGPT:
- Treinamento específico em CVEs, CWEs e padrões de ataque reais
- Compreensão de fluxos de dados em aplicacoes web complexas
- Capacidade de gerar exploits de prova de conceito para validacao
- Conhecimento atualizado de vulnerabilidades recentes
Basicamente, é um pentester júnior que nunca dorme e analisa código na velocidade de 1.000 linhas por segundo.
Tutorial prático: escaneando seu projeto
Chega de teoria. Vamos ver como usar na prática.
Passo 1: Instale e autentique
# Instale globalmente
npm install -g @openai/codex-security
# Login interativo (abre o browser)
npx codex-security login
# OU use API key para CI
export OPENAI_API_KEY="sk-..."
Passo 2: Scan completo do repositório
# Scan do diretório atual
npx codex-security scan .
# Scan com output em JSON (para CI)
npx codex-security scan . --format json --output results.json
Passo 3: Review de mudancas (ideal para PRs)
# Analisa apenas os arquivos alterados
npx codex-security review --diff HEAD~1
Passo 4: Integracao com SDK
Se voce quer integrar no seu pipeline programaticamente:
import { CodexSecurity } from "@openai/codex-security";
const security = new CodexSecurity();
const result = await security.run(".");
console.log(`Vulnerabilidades encontradas: ${result.findings.length}`);
console.log(`Críticas: ${result.findings.filter(f => f.severity === "critical").length}`);
// Gerar fixes automaticamente
for (const finding of result.findings) {
if (finding.fixAvailable) {
console.log(`Fix para ${finding.id}: ${finding.fix.description}`);
}
}
Passo 5: No GitHub Actions
name: Security Scan
on: [push, pull_request]
jobs:
codex-security:
runs-on: ubuntu-latest
steps:
- uses: actions/checkout@v4
with:
fetch-depth: 0
- uses: actions/setup-node@v4
with:
node-version: 22
- run: npm install -g @openai/codex-security
- run: npx codex-security scan . --format json --output results.json
env:
OPENAI_API_KEY: ${{ secrets.OPENAI_API_KEY }}
- uses: actions/upload-artifact@v4
with:
name: security-results
path: results.json
Onde o Codex Security ainda tropeça
Seria desonesto não falar das limitacoes. E elas existem.
GitLab ainda é beta. Se seu time usa GitLab em vez de GitHub, a integracao ainda não é estável. Funciona, mas espere bugs.
Sem scan de dependências. O Codex Security analisa seu código, não as bibliotecas que voce importa. Para isso, voce ainda precisa do Snyk, Dependabot ou npm audit. Isso é uma lacuna grande, já que a maioria das vulnerabilidades em projetos Node.js vem de dependências, não de código próprio.
Sem scan de containers. Dockerfile com imagem base vulnerável? O Codex Security não vai avisar. De novo, Snyk ou Trivy para isso.
Sem compliance reporting. Se voce precisa de relatórios para SOC 2, PCI-DSS ou HIPAA, o Codex Security não gera. É uma ferramenta de dev, não de auditoria.
Kotlin não é suportado. Se voce desenvolve Android nativo com Kotlin, por enquanto fica de fora.
Custo em escala. A US$ 0,018 por 1.000 linhas, um monorepo com 5 milhões de linhas custa US$ 90 por scan. Roda 3 vezes por dia? São US$ 270/dia. Em times grandes, esse custo se acumula rápido.
Quando usar (e quando não usar)
Use se:
- Voce tem um time de 5 a 50 devs e quer automatizar a triagem de seguranca
- Seus pull requests não passam por review de seguranca hoje
- Voce já tem Snyk/SonarQube e quer adicionar uma camada de auto-fix
- Voce mantém projetos open source e quer o suporte do Patch the Planet
Não use se:
- Voce precisa de compliance reporting agora (espere a versão enterprise)
- Seu stack principal é Kotlin ou linguagens não suportadas
- Voce espera que ele substitua todo o seu pipeline de AppSec (ele não faz SCA nem DAST)
Um caso real: a ironia de quem caça bugs
Vale lembrar uma ironia deliciosa. No final de janeiro de 2026, pesquisadores da Check Point descobriram uma vulnerabilidade de command injection no próprio Codex CLI da OpenAI. O bug permitia que um atacante roubasse tokens de acesso ao GitHub de quem usava a ferramenta.
A OpenAI corrigiu rápido, mas o episódio deixou uma licao: até a ferramenta que encontra bugs pode ter bugs. Seguranca é um jogo infinito. Nenhuma ferramenta, por mais inteligente que seja, elimina a necessidade de revisao humana.
O próprio time do Codex Security reconhece isso. Na documentacao, eles recomendam um fluxo de cinco etapas: definicao de contexto, scan, validacao com evidências, testes e, por fim, revisao humana. A IA é o copiloto. Voce continua sendo o piloto.
Isso não é falsa modéstia. É pragmatismo. Vulnerabilidades arquiteturais, falhas de lógica de negócio e problemas de autorizacao complexa ainda precisam de um humano para avaliar. A IA pega os XSS, os SQL injections, os path traversals. O raciocínio de “esse endpoint deveria exigir autenticacao?” ainda é seu.
O que isso significa para o mercado
A OpenAI abrir o CLI do Codex Security é um movimento estratégico. Eles estão fazendo com seguranca o que fizeram com o ChatGPT: colocar uma ferramenta gratuita na mão dos devs, criar dependência e depois monetizar via API e enterprise.
Snyk e SonarQube não vão sumir. Mas vão precisar responder. Provavelmente com suas próprias features de auto-fix baseadas em IA. O Snyk já tem algo nessa linha, mas ainda é limitado.
O GitHub Advanced Security também vai sentir a pressão. Ter Codex Security rodando via GitHub Actions com auto-fix é uma proposta de valor forte. Muito dev vai testar e perceber que os PRs automáticos de fix economizam horas de trabalho.
A pergunta que fica: quando a OpenAI vai adicionar scan de dependências e containers? Porque no dia que isso acontecer, Snyk vai ter um problema sério.
Enquanto isso, o código está no GitHub, a licenca é Apache 2.0 e voce pode testar agora. Três comandos e seu primeiro scan já roda. Se seu projeto tem mais de 6 meses sem um review de seguranca, talvez esse seja o empurrão que faltava.













