Ir para o conteúdo
Totalmente local

Calculadora de significância de testes A/B

Calcular taxas de conversão, elevação e significância estatística entre variantes de testes A/B.

Entrada
Saída

Calculadora de significância de testes A/B

Cole os dados do seu teste em uma linha por variante — um nome, o número de visitantes e o número de conversões — e esta ferramenta executa um teste z de duas proporções contra a primeira linha, que trata como controle. Ela relata a taxa de conversão de cada variante, o elevação absoluta e relativa sobre o controle, um intervalo de confiança e se a diferença é estatisticamente significante.

O nível de confiança define como é rigoroso o teste: 90%, 95% ou 99%. Um teste bilateral pergunta se uma variante difere do controle em qualquer direção; um teste unilateral pergunta apenas se é melhor, o que atinge significância mais rapidamente para os mesmos dados. Ativar o intervalo de confiança adiciona um intervalo para a taxa de conversão verdadeira de cada variante, não apenas do controle. Escolha uma tabela para uma comparação compacta lado a lado, ou uma frase para um resultado em linguagem natural terminando com um vencedor declarado.

O tráfego real é complexo, portanto a ferramenta também verifica o tamanho da amostra: quando o número esperado de conversões ou não-conversões para qualquer variante fica abaixo de cinco, ela adiciona uma nota de que a aproximação normal por trás do teste pode ser pouco confiável, em vez de reportar um número que soa confiante mas não é. Você pode comparar mais de duas variantes ao mesmo tempo — cada linha após o controle é testada independentemente contra ele, e o vencedor é a variante com a conversão mais alta que supera o controle por uma margem estatisticamente significante.

Tudo é executado localmente no seu navegador. Os números de tráfego e conversão podem ser comercialmente sensíveis, e nada é enviado — o cálculo acontece no seu dispositivo e em nenhum outro lugar. Copie o resultado, baixe como arquivo .txt, ou reinsira na entrada para ajustar um número e ver a significância atualizar.

FAQ

Como é calculada a significância?
A ferramenta executa um teste z de duas proporções entre o controle (a primeira linha) e cada outra variante, usando um erro padrão agrupado, e compara o valor p resultante com seu nível de confiança escolhido.
Qual é a diferença entre unilateral e bilateral?
Um teste bilateral verifica qualquer diferença do controle, melhor ou pior. Um teste unilateral verifica apenas se a variante é melhor, então precisa de dados menos extremos para chamar um resultado significante.
Por que avisa sobre o tamanho da amostra?
O teste z assume uma distribuição aproximadamente normal, o que precisa de pelo menos cerca de cinco conversões esperadas e cinco não-conversões esperadas por variante. Abaixo disso, a ferramenta sinaliza o resultado como potencialmente pouco confiável em vez de esconder a ressalva.
Posso testar mais de duas variantes?
Sim. Adicione quantas linhas quiser após o controle — cada uma é comparada independentemente contra ele, e o vencedor é a melhor variante que ultrapassa seu limite de significância.
Os números de tráfego e conversão são enviados para algum lugar?
Não. O cálculo é executado inteiramente no seu navegador, portanto seus números de visitantes e conversão nunca saem do seu dispositivo.