Instrumento de aferição · processamento local · v1.5.0

Você paga
pelo score.
Mas consegue provar
o que ele acrescenta?

O ZORMA é uma camada independente de aferição: mede se o score de terceiro funciona nesta operação e, quando o stack atual é informado, mede o valor incremental que o fornecedor acrescenta ao que você já possui. Não é um motor antifraude e não depende do relatório do próprio fornecedor.

  • Zero linha da base transacional enviada pelo instrumento
  • 12 limiares fixados antes de rodar
  • Reprodutível — semente declarada
Quando o score sustenta
Protocolo AF-2026
Laudo emitido

Instrumento recuperou os alvos conhecidos, sinal acima do acaso, ganho confirmado sobre o trivial. Sobre faixa de valor e tempo, o laudo diz exatamente o que apurou — estável, queda tolerada, sem poder para descartar, ou não avaliado.

Quando não sustenta
Protocolo AF-2026
Laudo não emitido

Um laudo negado não é falha do instrumento. É o instrumento se recusando a afirmar o que a evidência não sustenta.

01

Como funciona

Três passos, nesta ordem — cada um é pré-condição do seguinte, por isso é numerado.

1

Você abre o arquivo

CSV com escore, desfecho, valor e — se tiver — cliente e data. Lido inteiramente no seu próprio navegador. Sem arquivo em mãos, o simulador embutido traz sete cenários prontos, do fornecedor forte ao que só reflete o valor da compra.

2

O protocolo afere sozinho

Calibração do próprio instrumento, autoteste do encadeamento, independência da amostra, significância, incremento sobre sinais triviais, estabilidade e degradação temporal — nessa ordem, e cada uma só depois que a anterior sustentou.

3

Você recebe o laudo

Executivo ou completo, em PDF ou Markdown, mais os números brutos em JSON. Com veredito — ou com o motivo, e o quanto de dado ainda falta, quando não há veredito.

02

O que é verificado

Dez portões compõem o protocolo. Quando a amostra não permite executar algum deles — ou quando o reamostreio não resolve a resposta com a precisão disponível — o laudo declara qual e por quê, em vez de arredondar para a conclusão mais forte. Todo intervalo sai de reamostreio agrupado por cliente, nunca por linha.

01 · calibração

O instrumento mede a si mesmo

Antes de julgar o seu score, o ZORMA aponta para dois alvos de separação conhecidos por álgebra e verifica se recupera os valores certos — nesta amostra, com esta estrutura de clientes, neste tamanho. É teste de correção e teste de poder ao mesmo tempo. Se erra o alvo conhecido, não emite laudo nenhum.

02 · encadeamento

Autoteste da própria bancada

Com os rótulos embaralhados livremente, a separação média tem de voltar a 0,50. Se não voltar, há defeito no encadeamento — coluna trocada, índice desalinhado, cache velho. É defeito do instrumento, não resultado sobre o score, e o laudo diz isso com todas as letras.

03 · independência

A premissa que sustenta todo intervalo

Sem unidade de agrupamento declarada, não há laudo. Mapear o id da transação como cliente — que devolve o intervalo mais estreito de todos — trava e exige confirmação explícita. Fraude concentrada em poucos clientes também bloqueia. As duas portas do incentivo ficam fechadas.

04 · significância

Existe sinal, ou é sorte?

A separação observada é confrontada contra um nulo que troca blocos inteiros entre clientes de mesmo tamanho. Quando esse espaço é pequeno demais para alcançar o limiar, o protocolo declara o teste não executável em vez de acusar o score.

05 · incremento

Contra o trivial

O score precisa acrescentar sobre o que valor da transação, log do valor e frequência do cliente já entregam de graça. A pergunta nunca é se ele vence o acaso — é o que ele acrescenta sobre uma regra de duas linhas.

06 · estabilidade

Entre faixas de valor

Um score que separa no ticket baixo e falha no alto tem um número global que não descreve o risco real, porque a perda está no ticket alto. Avaliado por contraste assinado com intervalo, não por amplitude entre faixas — amplitude é enviesada para cima com evento raro.

07 · temporal

Degradação ao longo do tempo

A amostra é cortada em 60% da linha do tempo e a separação é medida dos dois lados. Fraude é adversarial: um número calculado sobre seis meses pode descrever uma média que o mês passado já não confirma.

08 · plausibilidade

Bom demais para ser verdade

Acima de AUROC 0,98 e KS 0,95 ao mesmo tempo, o instrumento retém o veredito — não aprova nem acusa. Essa assinatura é de rótulo codificado dentro do escore, não de poder preditivo. Existe porque uma auditoria por inversão de papéis mostrou que preencher a coluna de score com o próprio desfecho devolvia o carimbo mais favorável possível.

09 · custódia

A conta fecha por aritmética

Linhas físicas menos malformadas, menos ilegíveis, menos sem cliente, menos excluídas por declaração do operador = linhas aferidas. O laudo confere essa soma em tempo de emissão. Se não fechar, ele declara defeito de contagem e se invalida sozinho.

10 · governança

Teto de rodadas

Duas rodadas por amostra. Acima disso o laudo é negado por orçamento, qualquer que seja o resultado — senão "ajustar até passar" vira laço sem condição de parada. Trocar a política de aceitação também queima um ciclo.

São doze limiares pré-registrados: oito são política de decisão — mudam conforme o que está em jogo e são escolhidos antes de olhar a amostra — e quatro são método e não se movem, porque autoteste, convenção de significância, teto de rodadas e limite de separação interpretável não dependem do apetite de quem decide. O laudo imprime a tabela inteira, com a origem de cada um.

03

O que o laudo responde

O seu fornecedor entregou uma afirmação: “este score separa fraude de operação legítima”. O instrumento testa se aquela afirmação específica resiste a uma aferição independente. Quando existe um score interno/stack atual, também mede quanto o fornecedor acrescenta ao que a operação já possuía — sem transformar a comparação em novo gate principal. E devolve um de três estados.

estado 01

Afirmação sustentada

LAUDO EMITIDOcódigo VALIDO

A evidência sustenta a decisão dentro do escopo testado: o score separa acima do acaso, acrescenta sobre sinais triviais, e se mantém entre faixas de valor e ao longo do tempo. O laudo documenta essa evidência para uso em auditoria ou supervisão, sem prometer aceitação por terceiros.

estado 02

Afirmação divergente

ACHADOcódigos ACHADO_*

O instrumento mediu e a afirmação não se sustenta. Pode ser porque o score não separa acima do acaso (ACHADO_SEM_SINAL), porque separa mas não acrescenta sobre o valor da transação e a frequência do cliente (ACHADO_SEM_GANHO), porque cai no quartil de maior valor (ACHADO_INSTABILIDADE) ou porque degradou ao longo do período (ACHADO_DEGRADACAO).

Isto é achado sobre a afirmação, e cabe levar ao fornecedor.

estado 03

Aferição inconclusiva

NÃO EMITIDOcódigos INCONCLUSIVO_*

Não houve cobertura para concluir coisa alguma — faltam casos ou fraudes confirmadas, falta identificador de cliente, o intervalo saiu largo demais, ou a separação veio alta demais para ser interpretável. Também entram aqui os defeitos de dado anteriores a qualquer medição (INVALIDO_*).

Isto NÃO é achado contra o fornecedor, e o laudo proíbe expressamente que seja usado como tal. Usar ausência de medição como acusação é injustiça sustentada por documento.

A terceira possibilidade é o que separa um instrumento de um carimbo. Uma ferramenta que só sabe aprovar ou reprovar é obrigada a forçar resposta quando a evidência não permite — e resposta forçada é pior que resposta nenhuma, porque vem com aparência de rigor.

04

Para quem é

Faz sentido para

  • Bancos, fintechs, PSPs, adquirentes/subadquirentes, grandes e-commerces e marketplaces com decisões de risco e contratos relevantes de antifraude.
  • Segunda linha de defesa, model risk e third-party validation que precisam de evidência independente sobre modelo ou score de terceiro.
  • Procurement/RFP, renovação ou substituição de fornecedor que precisam comparar alternativas na mesma população e além do relatório do próprio fornecedor.
  • Auditoria interna que precisa documentar desempenho, limitações e valor incremental do score comprado.
  • Quem já tem histórico com desfecho conhecido. O mínimo depende da política escolhida antes de rodar: 200 casos e 15 fraudes no Exploratório, 300 e 25 no Padrão, 500 e 40 no Conservador.

Não é para

  • Quem ainda não tem desfecho rotulado — sem isso não há o que aferir.
  • Monitoramento em tempo real de decisões — o ZORMA Monitor acompanha safras já aferidas; não é uma esteira transacional de decisão.
  • Avaliação de viés entre grupos protegidos — não é medido, e não deve ser inferido daqui.
  • Quem precisa de API para esteira de produção — a arquitetura é local, de propósito.
  • Aferição de calibração de PD — o instrumento mede discriminação e estabilidade, não o acerto do nível previsto.

Se a decisão envolve procurement/RFP, renovação, model risk ou third-party validation, use o percurso institucional: a triagem começa pelo mesmo diagnóstico e preserva as mesmas limitações do protocolo.

05

O que ele não consegue testar

Duas limitações estão declaradas dentro de cada laudo emitido, e não há ajuste estatístico que as resolva. Elas estão aqui na vitrine pela mesma razão que estão lá: um instrumento que esconde o próprio limite não serve para decidir nada.

Viés de seleção

Se a amostra contém apenas casos que passaram por revisão manual, e a revisão foi escolhida pelo próprio score que se quer aferir, o laudo sai válido e errado — com carimbo verde. Nenhum teste desta bancada detecta isso. Por isso o instrumento exige confirmação explícita do operador antes de rodar, e registra essa declaração no laudo.

Vazamento de alvo

Score gravado ou recalculado depois de a fraude ser conhecida contém a resposta. A permutação livre não detecta isso — foi medido: com o escore igual ao gabarito literal, 400 permutações devolveram média 0,4998. O que existe é o teto de plausibilidade, que retém o veredito no caso extremo. Não é o mesmo que detectar.

“Um laudo negado é o instrumento funcionando.”

O princípio que rege cada rodada

06

Comece agora

Não há cadastro nem upload da sua base no instrumento: a amostra transacional é processada localmente. Isso reduz a necessidade de transferir a base para terceiros, mas requisitos internos de DPA, fornecedor ou comitê continuam sendo decisão da sua instituição. O formulário de diagnóstico é separado e transmite somente os campos que você preencher via Formspree.

A aferição técnica permanece separada da contratação. O instrumento autônomo é grátis; assinatura técnica pontual é um serviço profissional; Compare, Monitor recorrente e third-party model assessment são ofertas institucionais com escopo próprio. Nenhuma contratação muda o resultado calculado pelo instrumento.