Nossa opinião

O que o marketing de "pontuação de confiança" erra

Uma resposta de geocodificação que retorna um índice de confiança de 0.87 parece mais rigorosa do que uma que apenas retorna se houve correspondência ou não. Ela tem uma casa decimal. Ela sugere um modelo por trás, calibrado em relação a algo mensurável. Às vezes é exatamente isso. Muitas vezes, o número está mais perto de uma heurística vestida com um formato que parece científico, e é difícil distinguir os dois olhando de fora.

O problema de um índice de confiança isolado é que ele responde a uma pergunta que ninguém fez nesses termos. Um desenvolvedor que constrói um formulário de endereço não precisa de uma probabilidade entre zero e um. Ele precisa saber algo mais específico: o número da rua foi encontrado, ou apenas a rua? O código postal foi encontrado, ou apenas a cidade? É uma correspondência no nível do telhado ou um recurso ao centroide de uma área mais ampla? Um único número de ponto flutuante comprime todo esse detalhe útil e acionável em um número que parece preciso enquanto diz menos do que uma descrição simples diria.

Achamos que a versão honesta disso é descrever o que realmente foi encontrado, em termos simples, em vez de comprimir tudo em um índice que sugere mais certeza do que o método subjacente consegue sustentar. Isso importa ainda mais porque a geocodificação direta e a reversa são exatamente o tipo de recurso em que exagerar a exatidão causa danos reais mais adiante. Um endereço resolvido no lado errado de uma cidade porque um índice de confiança acima de algum limite deixou passar discretamente uma correspondência ruim não é um erro de arredondamento. É uma remessa enviada para o local errado, ou uma verificação de área de atendimento que inclui um cliente que na verdade está fora dela.

Não vamos afirmar que a nossa geocodificação direta, a geocodificação reversa ou o preenchimento automático já tratam todos os padrões de endereço com exatidão verificada em todos os casos, porque essa afirmação seria exatamente o tipo de exagero que estamos descrevendo aqui. O que podemos dizer com clareza é o que os endpoints fazem e como são construídos, sem embrulhar a descrição em um número pensado para fazer a confiança parecer maior do que a realidade sustenta.

Um índice de confiança não é intrinsecamente desonesto. Bem usado, ele pode resumir de verdade algo real sobre uma correspondência, especialmente quando é documentado com clareza suficiente para que um desenvolvedor veja a partir de que o número é realmente calculado. O problema é quando o índice vira a resposta inteira, vendido como prova de exatidão em vez de apresentado como um sinal entre vários, com o método subjacente sem explicação. Um número sem explicação não é mais exato do que palavras. Ele só é mais difícil de contestar, o que é uma coisa completamente diferente.

A solução não é complicada, mesmo que seja menos lisonjeira em uma página de marketing. Descreva o que foi encontrado, em linguagem simples, e deixe o desenvolvedor decidir por conta própria se esse nível de detalhe é bom o suficiente para o que ele está construindo. Uma correspondência no nível da rua descrita com clareza é mais útil do que um índice de 0.91 sem nenhuma explicação por trás, porque a linguagem simples diz o que verificar em seguida e um número isolado não diz.