Comparação de execuções
Compare duas execuções de escopo compatível usando deltas canônicos de score, cobertura de evidência e mudanças no ciclo de vida dos achados.
Pontos-chave
- As entradas são o ID da execução atual e uma referência explícita; a resposta traz deltas de score e diferenças entre achados quando a evidência é comparável.
- Descobertas classificam como nova (só em B), resolvida (só em A) ou regressão (ainda presente + mesma severidade).
- A API só retorna deltas de pontuação e achados quando as duas execuções têm escopo compatível e linhagem apta para decisão; nos demais casos, a comparação é inconclusiva.
- Disponível na interface em /runs/compare?a=A&b=B e na API em GET /v1/runs/{current}/diff?baseline={baseline}.
01
Comparações práticas
- Antes e depois da implantação de uma mudança nas instruções: confirma que uma proteção entrou em vigor e não abriu novas brechas.
- Ontem à noite e hoje à noite: expõe regressão silenciosa no comportamento anterior do modelo.
- Produção e homologação: quantifica a diferença de defesa entre ambientes.
02
O que não faz
- Não é uma view longitudinal de tendência: compara duas execuções específicas, não uma janela.
- Não faz merge nem rerun: produza ambos os inputs a partir de execuções reais antes de comparar.
- Compara dentro de um tenant apenas; comparação cross-tenant não é exposta intencionalmente.