Simulações de ataque
Uma simulação é uma execução controlada de testes de ataque contra sua aplicação LLM: limitada a um alvo permitido, executada pelo nosso motor e avaliada contra OWASP LLM Top 10 e MITRE ATT&CK.
Pontos-chave
- Toda simulação tem um target_scope explícito; alvos fora de escopo são rejeitados.
- A criação é idempotente: reutilizar a mesma Idempotency-Key retorna a execução existente, embora respostas do modelo possam variar em novas execuções.
- Uma execução concluída persiste achados e artefatos de evidência. A pontuação numérica só fica apta para decisão quando a evidência canônica persistida sustenta uma avaliação conclusiva; caso contrário, pontuações públicas e comparativas permanecem N/A.
- Perfis de simulação variam de quick (≈5 minutos) a deep (≈30 minutos).
01
O que uma simulação produz
- Descobertas por categoria marcadas com IDs OWASP LLM e técnicas ATT&CK.
- Estados por categoria (aberta / corrigida / testada / não testada) derivados de evidência conclusiva e persistida.
- Execuções elegíveis do Starter+ podem gerar um pacote de evidência com integridade verificada por SHA-256. Execuções LLM com descobertas elegíveis também podem incluir transcrições de requisição e resposta e guia operacional de remediação.
02
Quando executar
- Antes de cada lançamento, contra um ponto de acesso de homologação.
- Semanalmente contra produção (perfil de verificação rápida).
- Após qualquer mudança em instruções de sistema, ferramentas ou versões de modelo.