Agora você pode auditar a segurança do seu código com IA usando security-audit, o skill MIT que Cloudflare usou como base de seu harness interno de vulnerabilidades. Se instala com um único npx skills add e funciona com qualquer coding agent capaz de lançar subagentes em paralelo. No momento de escrever esta nota, o repositório está em tendência no GitHub: 6,2 mil estrelas, 1,2 mil delas em um único dia.
O que o separa de pedir ao seu agente que „busque bugsSe você não indicar um diretório de saída, os resultados vão para ~/security-audit-skill/<repo-name>/run-<N>, fora do seu repositório, portanto nenhuma descoberta termina em um commit por acidente. A skill só escreve dentro do repositório se você escolher explicitamente um diretório que o controle de versão ignore.
Quick, standard ou deep?
Uma auditoria completa tem três perfis:
quickrealiza uma única rodada de busca e uma verificação crítica, pensada para objetivos pequenos ou uma primeira análise.standardé o perfil padrão.deepdivide o trabalho com mais detalhes e mantém a validação e a verificação final como agentes separados, para código grande ou crítico.
Você também pode limitar a execução a caminhos concretos, a um subsistema, a um domínio especializado ou ao diff entre duas referências do código. Nesse caso, a skill marca o relatório como cobertura parcial.
Mudar de perfil altera quanto terreno a auditoria cobre, não quanta evidência exige. Até mesmo quick mantém o filtro de validação e a verificação independente das descobertas confirmadas.
O que você precisa antes de executá-la?
Segundo o README, três coisas:
- Um agente de codificação cujo modelo suporte uso de ferramentas e subagentes em paralelo.
- Node.js, para os dois validadores, que não têm dependências.
- Uma sandbox aplicada pelo sistema operacional para qualquer build, teste ou processo que execute código do próprio objetivo. Deve ter:
- sem acesso à rede externa,
- um ambiente construído a partir de uma lista explícita de variáveis permitidas,
- o objetivo em apenas leitura, com escrita permitida apenas em um diretório
scratch/designado, - limites explícitos de CPU, memória, processos e tempo.
Leia com cuidado esse terceiro requisito. Se seu ambiente não puder garantir todos esses controles, a skill não toma atalhos: não executa o código do objetivo e marca a pista como needs_validation, com o bloqueio exato e um plano seguro para resolvê-lo.
Se você usa Claude Code, possui uma /sandbox integrada que isola o sistema de arquivos e a rede para os comandos bash. Verifique se sua configuração também atende aos requisitos de ambiente e limites de recursos antes de contar com a reprodução local.
A skill também é rigorosa com seus próprios limites: nada de sondar endpoints implantados nem infraestrutura compartilhada, nada de instalar dependências durante a auditoria e apenas principais, fixtures e segredos fictícios. Descreve as correções, mas não modifica seu código.
É grátis?
A skill é de código aberto com licença MIT; o custo está no uso do modelo, e uma auditoria multiagente consome muito mais do que um único prompt. A skill torna essa despesa contabilizável: em termos gerais, uma unidade do plano equivale a uma alocação de caçador, e cada candidato que sobrevive precisa de um ou dois verificadores dependendo do perfil.
Você pode definir um orçamento como número máximo de chamadas de agentes. A skill reserva as chamadas de crítica e validação antes de começar a caçar. Se o orçamento não é suficiente nem para o mínimo, não inicia nenhum agente e avisa você, em vez de entregar silenciosamente uma auditoria mais pobre.
Como referência, Cloudflare descreve os scans completos de seu harness como varreduras periódicas do backlog que podem levar horas em um repositório complexo, não como uma verificação por PR. Isso se aplica ao harness, não a esta skill, mas é uma boa indicação de onde esse tipo de auditoria se encaixa.
Como ler os resultados do scan de vulnerabilidades?
Comece com findings.json. Cada registro tem um de três veredictos:
confirmed: um rastreamento completo no código-fonte e um resultado observado e delimitado. Apenas estes recebem severidade (critical,high,medium,lowouinformational).needs_validation: uma hipótese concreta, ancorada no código, bloqueada por um único dado não resolvido, como uma configuração de proxy ou uma política de identidade que não está no repositório. Não recebem severidade. São perguntas abertas, não vulnerabilidades de baixa confiança.rejected: um candidato que a validação refutou. É preservado para que as próximas execuções não o persigam novamente.
A skill executa os dois validadores por conta própria, e você pode executá-los novamente:
node <skill-dir>/validate-findings.cjs <output-dir>/findings.json
node <skill-dir>/validate-coverage-ledger.cjs <output-dir>/coverage-ledger.json
```Uma execução só pode terminar de duas maneiras: com todos os relatórios escritos e ambos os validadores em verde, ou com `run_status: "incomplete"` e o motivo exato declarado no relatório.
### Por que executá-lo mais de uma vez?
Segundo os testes do próprio Cloudflare, uma única execução encontrou aproximadamente metade das vulnerabilidades que várias execuções encontraram no total. É um dado autodeclarado pelo Cloudflare. Cada execução lê os planos e descobertas anteriores, revisa novamente tudo o que mudou no código e se concentra nas lacunas. Uma descoberta `confirmed` anterior só é mantida se seu código não mudou e continua a passar na verificação.
## Claude Code security review ou security-audit: qual usar?
Eles resolvem problemas distintos, e muitos times vão querer ambos:
- **O comando `/security-review` do Claude Code** faz, segundo a documentação da Anthropic, uma revisão de segurança sob demanda sobre as alterações da sua branch atual. É rápido, fica dentro do seu fluxo habitual e serve para revisar o trabalho antes de fazer commit.
- **`security-audit`** audita um código completo (ou uma parte delimitada). Constrói um plano de cobertura, tenta refutar seus próprios candidatos e deixa um registro legível por máquina que você pode ampliar execução após execução. Se parece mais com uma auditoria programada do que com um passo de revisão.
Se você leu nossa nota sobre [VulnHunter, o caçador de vulnerabilidades open source do Capital One](https://www.yodev.dev/t/vulnhunter-como-poner-el-cazador-de-vulnerabilidades-de-capital-one-a-trabajar-sobre-tu-propio-repo/3917), a abordagem vai parecer familiar: raciocinar a partir do atacante e se verificar de forma adversarial. O skill do Cloudflare coloca mais peso no acompanhamento de cobertura, no veredicto explícito `needs_validation` e em não depender de nenhum agente específico.
## Funciona com Cursor, Codex ou outros agentes?
Está projetado para isso. `SKILL.md` se descreve como agnóstico em relação ao agente, e a CLI de Skills pode instalar em muitos agentes, incluindo Cursor e Codex. O requisito prático é o do README: seu agente e seu modelo precisam suportar tool use e subagentes em paralelo. Confirme isso antes de esperar uma auditoria completa.
Se você ainda não trabalha com skills, aqui tem uma seleção de [skills para agentes de IA](https://www.yodev.dev/t/las-mejores-skills-para-agentes-de-ia-21-que-hacen-codear-a-tu-ia-como-un-senior/2418) para começar.
## Qual é a relação com o harness do Cloudflare?
O skill é o ponto de partida para um único repositório; o harness é o que o Cloudflare construiu em cima. Segundo seu artigo, o harness adiciona:
- estado persistente em SQLite,
- agentes de deduplicação,
- rastreamento de dependências entre repositórios,
- um sistema de triagem separado que usa um modelo diferente da fase de descoberta,
- um agente que gera correções, cujos patches ainda assim requerem revisão humana antes do merge.
Os números do harness naquele artigo são do Cloudflare e descrevem o harness, não o skill:
- 20.799 candidatos brutos, dos quais cerca de 12.057 passaram na validação.
- Um pool combinado de 13.841 descobertas (incluindo a saída de outro harness), do qual restaram 7.245 acionáveis após deduplicação e triagem.
- Uma queda na taxa de rejeição na validação inicial de 40% para 11% graças a um melhor contexto do reconhecimento.
Quando publicou o artigo, o Cloudflare disse que esperava liberar o harness em breve. No momento da publicação desta nota, o Cloudflare não havia liberado o harness.
## Como evitar instalar uma cópia não oficial?
Instale sempre a partir de `github.com/cloudflare/security-audit-skill` e leia `SKILL.md` antes de executar qualquer coisa. Os skills populares atraem cópias, e no diretório de skills já figura pelo menos um reempacotamento de terceiros com outro nome. O ecossistema já produziu [skills que roubam credenciais](https://www.yodev.dev/t/las-skills-que-instalas-en-tu-agente-de-ia-pueden-estar-robandote-las-credenciales/2048), e um auditor de segurança é justamente o último que você quer tirar de uma fonte não oficial.
## Vale a pena?
Sim, se você o usar conforme foi pensado. security-audit é essa rara ferramenta de segurança mais rigorosa com o que não afirma do que com o que encontra. Teste primeiro com o perfil `quick` em um serviço pequeno, leia `findings.json` antes de `REPORT.md` e trate cada registro `needs_validation` como uma pergunta para o proprietário do serviço, não como um bug. Depois, execute-o novamente.
https://github.com/cloudflare/security-audit-skill