Guias e referências da API para realizar simulações controladas de ataque em suas aplicações LLM.
Aprenda a configurar sua primeira simulação de ataque contra um endpoint LLM-integrado.
Metodologia do Defense lattice, testes de ataque do mecanismo e rubrica de avaliação: como a pontuação é calculada.
Referência REST API para acesso programático ao motor de simulação.
Entenda as pontuações de risco, os níveis de severidade e os intervalos de confiança.
Como exportar e compartilhar pacotes de evidência verificados por checksum de execuções elegíveis do Starter+ com pessoas auditoras.
Entenda o contrato planejado para entrega por webhook por organização e os limites da versão atual.
Uma execução controlada de testes de ataque contra um alvo permitido: o que é enviado, como é avaliado e o que retorna.
Como personas de atacante guiam a seleção de testes e por que o mesmo alvo gera achados diferentes entre personas.
Do achado à ação priorizada de remediação: qual controle bloqueia qual teste, rastreado de volta à execução.
Como o DoesItDefend mapeia testes de ataque para o OWASP LLM Top 10: o que cada categoria cobre e como a pontuação é agregada.
A grade de avaliação (coberta, parcial, lacuna ou não testada) e por que agregar entre paráfrases importa.
Como testes literais e parafraseados correspondentes podem revelar sensibilidade à redação — e por que o valor permanece N/A sem avaliação pareada.
Conecte a CLI ou a GitHub Action ao repositório para que todo PR execute a verificação nos arquivos de prompt alterados.
Como achados se relacionam a controles NIST AI RMF, EU AI Act, SOC 2 e ISO 27001 no pacote de evidências.
Selo público de pontuação (somente no ambiente de demonstração) para READMEs e páginas de campanha. Pontos de acesso SVG + JSON, com incorporação em duas linhas.
Como o gate decide PROMOTE / HOLD num pull request a partir do diff: o caminho do dado do PR ao veredito.
Desafio DNS TXT para provar que você controla um alvo antes de qualquer probe tocá-lo. Camada CFAA / Marco Civil.
Autorize cenários a partir dos seus próprios modelos de ataque e execute-os como qualquer entrada do catálogo integrado.
SAML 2.0 e OIDC para login do tenant. Armazenamento de metadata, roteamento por domínio e o que ainda não foi implementado.
Como funciona o limite de usuários ativos, como convites entram na contagem e como a verificação é refeita no aceite.
Entenda o limite da entrega planejada por organização e as integrações disponíveis nesta versão.
Cadência estilo cron (horária / diária / semanal) sobre um RunRequest salvo. Validação contínua de defesa, hands-off.
Compare duas execuções com evidência compatível por score canônico e ciclo de vida dos achados, com cobertura de evidência explícita. Uma visão de reexecução para validar mudanças dentro do mesmo escopo.
Instale uma vez, gate em todo PR. O App escuta eventos de pull_request e posta um Check Run + comentário com o veredito.
Perguntas comuns sobre preços, pontuação, organização isolada, postura de auditoria e uso do ambiente de demonstração: tudo em um só lugar.
Cadeias de ataque coordenadas, não scripts parametrizados. Pipeline de quatro fases, roteamento baseado em descobertas e o que 'adaptativo' significa na prática.