Cenários de ataque
Um cenário descreve uma persona adversária, a técnica que ela exerce e a asserção que decide se a defesa segurou.
Pontos-chave
- Modelos personalizados salvos registram `updated_at`; cada execução preserva a requisição concreta que executou para revisão posterior.
- Os testes LLM incluídos preservam a atribuição estável de categoria e técnica quando ela é definida pelo corpus.
- Algumas famílias de cenários LLM incluídas no produto têm variantes parafraseadas e versionadas para verificações de robustez dentro do escopo.
- Cenários personalizados podem ser adicionados pela API de criação de cenários.
01
Famílias de cenários integrados
- Prompt injection / jailbreak (LLM01).
- Sensitive information disclosure (LLM02).
- System-prompt leak (LLM07).
02
Cenários customizados
- Salve pela API um título, uma categoria, tags opcionais e um modelo de RunRequest válido.
- Os limites do tenant e do plano são aplicados antes da persistência.
- O motor avalia o modelo salvo pelo fluxo normal de evidências; não há envio de código avaliador executável.