Instrumento de aferição · processamento local · v1.5.0
Você paga
pelo score.
Mas consegue provar
o que ele acrescenta?
O ZORMA é uma camada independente de aferição: mede se o score de terceiro funciona nesta operação e, quando o stack atual é informado, mede o valor incremental que o fornecedor acrescenta ao que você já possui. Não é um motor antifraude e não depende do relatório do próprio fornecedor.
- Zero linha da base transacional enviada pelo instrumento
- 12 limiares fixados antes de rodar
- Reprodutível — semente declarada
Instrumento recuperou os alvos conhecidos, sinal acima do acaso, ganho confirmado sobre o trivial. Sobre faixa de valor e tempo, o laudo diz exatamente o que apurou — estável, queda tolerada, sem poder para descartar, ou não avaliado.
Um laudo negado não é falha do instrumento. É o instrumento se recusando a afirmar o que a evidência não sustenta.
Como funciona
Três passos, nesta ordem — cada um é pré-condição do seguinte, por isso é numerado.
Você abre o arquivo
CSV com escore, desfecho, valor e — se tiver — cliente e data. Lido inteiramente no seu próprio navegador. Sem arquivo em mãos, o simulador embutido traz sete cenários prontos, do fornecedor forte ao que só reflete o valor da compra.
O protocolo afere sozinho
Calibração do próprio instrumento, autoteste do encadeamento, independência da amostra, significância, incremento sobre sinais triviais, estabilidade e degradação temporal — nessa ordem, e cada uma só depois que a anterior sustentou.
Você recebe o laudo
Executivo ou completo, em PDF ou Markdown, mais os números brutos em JSON. Com veredito — ou com o motivo, e o quanto de dado ainda falta, quando não há veredito.
O que é verificado
Dez portões compõem o protocolo. Quando a amostra não permite executar algum deles — ou quando o reamostreio não resolve a resposta com a precisão disponível — o laudo declara qual e por quê, em vez de arredondar para a conclusão mais forte. Todo intervalo sai de reamostreio agrupado por cliente, nunca por linha.
O instrumento mede a si mesmo
Antes de julgar o seu score, o ZORMA aponta para dois alvos de separação conhecidos por álgebra e verifica se recupera os valores certos — nesta amostra, com esta estrutura de clientes, neste tamanho. É teste de correção e teste de poder ao mesmo tempo. Se erra o alvo conhecido, não emite laudo nenhum.
Autoteste da própria bancada
Com os rótulos embaralhados livremente, a separação média tem de voltar a 0,50. Se não voltar, há defeito no encadeamento — coluna trocada, índice desalinhado, cache velho. É defeito do instrumento, não resultado sobre o score, e o laudo diz isso com todas as letras.
A premissa que sustenta todo intervalo
Sem unidade de agrupamento declarada, não há laudo. Mapear o id da transação como cliente — que devolve o intervalo mais estreito de todos — trava e exige confirmação explícita. Fraude concentrada em poucos clientes também bloqueia. As duas portas do incentivo ficam fechadas.
Existe sinal, ou é sorte?
A separação observada é confrontada contra um nulo que troca blocos inteiros entre clientes de mesmo tamanho. Quando esse espaço é pequeno demais para alcançar o limiar, o protocolo declara o teste não executável em vez de acusar o score.
Contra o trivial
O score precisa acrescentar sobre o que valor da transação, log do valor e frequência do cliente já entregam de graça. A pergunta nunca é se ele vence o acaso — é o que ele acrescenta sobre uma regra de duas linhas.
Entre faixas de valor
Um score que separa no ticket baixo e falha no alto tem um número global que não descreve o risco real, porque a perda está no ticket alto. Avaliado por contraste assinado com intervalo, não por amplitude entre faixas — amplitude é enviesada para cima com evento raro.
Degradação ao longo do tempo
A amostra é cortada em 60% da linha do tempo e a separação é medida dos dois lados. Fraude é adversarial: um número calculado sobre seis meses pode descrever uma média que o mês passado já não confirma.
Bom demais para ser verdade
Acima de AUROC 0,98 e KS 0,95 ao mesmo tempo, o instrumento retém o veredito — não aprova nem acusa. Essa assinatura é de rótulo codificado dentro do escore, não de poder preditivo. Existe porque uma auditoria por inversão de papéis mostrou que preencher a coluna de score com o próprio desfecho devolvia o carimbo mais favorável possível.
A conta fecha por aritmética
Linhas físicas menos malformadas, menos ilegíveis, menos sem cliente, menos excluídas por declaração do operador = linhas aferidas. O laudo confere essa soma em tempo de emissão. Se não fechar, ele declara defeito de contagem e se invalida sozinho.
Teto de rodadas
Duas rodadas por amostra. Acima disso o laudo é negado por orçamento, qualquer que seja o resultado — senão "ajustar até passar" vira laço sem condição de parada. Trocar a política de aceitação também queima um ciclo.
São doze limiares pré-registrados: oito são política de decisão — mudam conforme o que está em jogo e são escolhidos antes de olhar a amostra — e quatro são método e não se movem, porque autoteste, convenção de significância, teto de rodadas e limite de separação interpretável não dependem do apetite de quem decide. O laudo imprime a tabela inteira, com a origem de cada um.
O que o laudo responde
O seu fornecedor entregou uma afirmação: “este score separa fraude de operação legítima”. O instrumento testa se aquela afirmação específica resiste a uma aferição independente. Quando existe um score interno/stack atual, também mede quanto o fornecedor acrescenta ao que a operação já possuía — sem transformar a comparação em novo gate principal. E devolve um de três estados.
Afirmação sustentada
VALIDOA evidência sustenta a decisão dentro do escopo testado: o score separa acima do acaso, acrescenta sobre sinais triviais, e se mantém entre faixas de valor e ao longo do tempo. O laudo documenta essa evidência para uso em auditoria ou supervisão, sem prometer aceitação por terceiros.
Afirmação divergente
ACHADO_*O instrumento mediu e a afirmação não se sustenta. Pode ser porque o score não separa acima do acaso (ACHADO_SEM_SINAL), porque separa mas não acrescenta sobre o valor da transação e a frequência do cliente (ACHADO_SEM_GANHO), porque cai no quartil de maior valor (ACHADO_INSTABILIDADE) ou porque degradou ao longo do período (ACHADO_DEGRADACAO).
Isto é achado sobre a afirmação, e cabe levar ao fornecedor.
Aferição inconclusiva
INCONCLUSIVO_*Não houve cobertura para concluir coisa alguma — faltam casos ou fraudes confirmadas, falta identificador de cliente, o intervalo saiu largo demais, ou a separação veio alta demais para ser interpretável. Também entram aqui os defeitos de dado anteriores a qualquer medição (INVALIDO_*).
Isto NÃO é achado contra o fornecedor, e o laudo proíbe expressamente que seja usado como tal. Usar ausência de medição como acusação é injustiça sustentada por documento.
A terceira possibilidade é o que separa um instrumento de um carimbo. Uma ferramenta que só sabe aprovar ou reprovar é obrigada a forçar resposta quando a evidência não permite — e resposta forçada é pior que resposta nenhuma, porque vem com aparência de rigor.
Para quem é
Faz sentido para
- Bancos, fintechs, PSPs, adquirentes/subadquirentes, grandes e-commerces e marketplaces com decisões de risco e contratos relevantes de antifraude.
- Segunda linha de defesa, model risk e third-party validation que precisam de evidência independente sobre modelo ou score de terceiro.
- Procurement/RFP, renovação ou substituição de fornecedor que precisam comparar alternativas na mesma população e além do relatório do próprio fornecedor.
- Auditoria interna que precisa documentar desempenho, limitações e valor incremental do score comprado.
- Quem já tem histórico com desfecho conhecido. O mínimo depende da política escolhida antes de rodar: 200 casos e 15 fraudes no Exploratório, 300 e 25 no Padrão, 500 e 40 no Conservador.
Não é para
- Quem ainda não tem desfecho rotulado — sem isso não há o que aferir.
- Monitoramento em tempo real de decisões — o ZORMA Monitor acompanha safras já aferidas; não é uma esteira transacional de decisão.
- Avaliação de viés entre grupos protegidos — não é medido, e não deve ser inferido daqui.
- Quem precisa de API para esteira de produção — a arquitetura é local, de propósito.
- Aferição de calibração de PD — o instrumento mede discriminação e estabilidade, não o acerto do nível previsto.
Se a decisão envolve procurement/RFP, renovação, model risk ou third-party validation, use o percurso institucional: a triagem começa pelo mesmo diagnóstico e preserva as mesmas limitações do protocolo.
O que ele não consegue testar
Duas limitações estão declaradas dentro de cada laudo emitido, e não há ajuste estatístico que as resolva. Elas estão aqui na vitrine pela mesma razão que estão lá: um instrumento que esconde o próprio limite não serve para decidir nada.
Viés de seleção
Se a amostra contém apenas casos que passaram por revisão manual, e a revisão foi escolhida pelo próprio score que se quer aferir, o laudo sai válido e errado — com carimbo verde. Nenhum teste desta bancada detecta isso. Por isso o instrumento exige confirmação explícita do operador antes de rodar, e registra essa declaração no laudo.
Vazamento de alvo
Score gravado ou recalculado depois de a fraude ser conhecida contém a resposta. A permutação livre não detecta isso — foi medido: com o escore igual ao gabarito literal, 400 permutações devolveram média 0,4998. O que existe é o teto de plausibilidade, que retém o veredito no caso extremo. Não é o mesmo que detectar.
“Um laudo negado é o instrumento funcionando.”
O princípio que rege cada rodada
Comece agora
Não há cadastro nem upload da sua base no instrumento: a amostra transacional é processada localmente. Isso reduz a necessidade de transferir a base para terceiros, mas requisitos internos de DPA, fornecedor ou comitê continuam sendo decisão da sua instituição. O formulário de diagnóstico é separado e transmite somente os campos que você preencher via Formspree.
A aferição técnica permanece separada da contratação. O instrumento autônomo é grátis; assinatura técnica pontual é um serviço profissional; Compare, Monitor recorrente e third-party model assessment são ofertas institucionais com escopo próprio. Nenhuma contratação muda o resultado calculado pelo instrumento.