Quem cria app pedindo para a IA escrever o código raramente confere se ele tem brecha de segurança. A Cloudflare liberou em código aberto uma skill que faz essa conferência: instalada no Claude Code (ou no Codex, no Cursor e em outros agentes de programação), ela transforma o agente num auditor que lê o projeto inteiro e procura falhas.
A skill é o ponto de partida do sistema interno que a Cloudflare usa para caçar vulnerabilidades, descrito no blog da empresa. O que a diferencia de pedir "procura falhas no meu código" é o método: cada falha encontrada vai para outro agente, novo, cuja única função é provar que ela não existe. Só o que sobrevive a essa tentativa vira resultado.
Este guia traz o link, o comando de instalação, o que acontece em cada uma das seis fases, como ler o relatório e os cuidados antes de rodar. Os dados foram conferidos no README e na API do GitHub em 04/10/2026.
O link
Repositório: https://github.com/cloudflare/security-audit-skill
Artigo da Cloudflare sobre o sistema que nasceu dela: https://blog.cloudflare.com/build-your-own-vulnerability-harness
Código aberto, com 24.104 estrelas em 04/10/2026.
Como instalar
A instalação usa a Skills CLI. Com o Node.js instalado, rode na pasta do projeto:
npx skills add https://github.com/cloudflare/security-audit-skill --skill security-audit
Para deixar disponível em todos os seus projetos, acrescente --global no fim.
Como pedir a auditoria
Abra o agente dentro da pasta do projeto e peça em linguagem comum. Os exemplos do README:
security audit this codebase
find security vulnerabilities in ./src
do a security review, output to ~/audits/my-project
Em português também funciona: "faça uma auditoria de segurança deste projeto". Se você não disser onde salvar, o relatório vai para ~/security-audit-skill/<nome-do-projeto>/run-<N>, fora do seu repositório.
As seis fases
- Reconhecimento. O agente mapeia o projeto: arquitetura, onde entram dados de fora, onde há fronteira de confiança. Grava isso em
architecture.mde numa lista de cobertura. - Caça. Agentes isolados recebem pedaços do projeto e procuram falhas, cada um anotando o que conferiu. Outros agentes apontam o que ficou sem olhar.
- Tentativa de desmentir. Cada falha candidata vai para um agente novo, que não participou da caça, com a missão de provar que ela não existe. O README resume o princípio: quem confere nunca é quem encontrou.
- Resultado estruturado. O que sobra é gravado em
findings.jsone conferido contra um esquema fixo por um validador em Node. - Verificação independente. Agentes novos conferem de novo cada afirmação final contra o código.
- Relatório. Saem três arquivos para ler:
REPORT.md,FINDINGS-DETAIL.mdeNEEDS-VALIDATION.md.
Como ler o resultado
Cada item termina em um de três estados:
- confirmed: a falha tem caminho completo no código e efeito observado. É o que corrigir primeiro.
- needs_validation: há um indício sério, mas falta um fato para fechar. Vem sem gravidade atribuída e diz exatamente o que falta conferir.
- rejected: a falha candidata foi desmentida. Fica registrada para não ser reaberta à toa.
A skill também separa vulnerabilidade de reforço: se uma camada já impede o ataque, a ausência de uma segunda camada vira nota de melhoria, não alarme.
Os cuidados antes de rodar
- Gasta bastante do seu plano de IA. São muitos agentes em paralelo, numa rodada longa. Comece por uma pasta pequena (
./src, por exemplo) antes do projeto inteiro. - Precisa de um agente com subagentes em paralelo e de um modelo que use ferramentas. O Claude Code atende.
- Código do seu app só roda em ambiente isolado. Sem uma sandbox com rede desligada e escrita limitada, a skill não executa o seu código: deixa o item como
needs_validation. Isso é proteção, não defeito. - Uma rodada não pega tudo. O README conta que, nos testes da Cloudflare, uma rodada achou cerca de metade das falhas que várias rodadas acharam somadas. As rodadas seguintes aproveitam o que a anterior já cobriu.
O que isso não substitui
A skill reduz alarme falso, mas não promete zero. Se o app guarda dado pessoal ou dinheiro de terceiros, trate o relatório como primeira triagem e peça a revisão de uma pessoa antes de publicar.