# Calculadora de Significância A/B

Insira dados de controle/tratamento para obter diferença de taxas, intervalos de confiança 95%/99%, p-value do Z-test (proporções) ou t de Welch (contínuas), significância, lift, tamanho amostral para 80%/90% de potência, dias recomendados, aviso de sequential testing e correção de Bonferroni.

> Página canônica: https://elysiatools.com/pt/tools/ab-test-significance-calculator

- **Categoria:** Data Analysis

- **Palavras-chave:** teste A/B, significância, p-valor, intervalo de confiança, Z-test, t de Welch, conversão, tamanho amostral, potência, Bonferroni, sequencial, lift

## Visão geral

Decida se o resultado do seu teste A/B é sinal real ou ruído — com a estatística feita direito.

**Dois tipos de teste.**
- **Proporção / taxa de conversão.** Sucessos + visitantes do controle e tratamento. Calcula taxas, lift relativo, Z-test agrupado e IC 95%/99% da diferença.
- **Métrica contínua (média e DP).** Média, DP e n de cada grupo. Executa um t de Welch (sem assumir variâncias iguais) com gl de Welch–Satterthwaite.

**Além do p-valor:** lift, intervalo de confiança, tamanho amostral para 80%/90% de potência, dias recomendados, correção de Bonferroni para múltiplas comparações e aviso de sequential testing (não espreite o p-valor no meio do experimento).

"Significativo" significa que os dados são incompatíveis com diferença zero em α=0,05 — não que o lift seja grande ou importante. Combine significância com tamanho do efeito antes de liberar.

## Entradas

- **Tipo de teste** (select)
- **Controle: sucessos** (number): e.g. 1200
- **Controle: visitantes** (number): e.g. 20000
- **Tratamento: sucessos** (number): e.g. 1320
- **Tratamento: visitantes** (number): e.g. 20000
- **Controle: média** (number): e.g. 42.5
- **Controle: desvio padrão** (number): e.g. 12.0
- **Controle: tamanho amostra** (number): e.g. 500
- **Tratamento: média** (number): e.g. 45.8
- **Tratamento: desvio padrão** (number): e.g. 12.5
- **Tratamento: tamanho amostra** (number): e.g. 500
- **Nível de significância α** (select)
- **Potência estatística** (select)
- **Conversão base (%)** (number): e.g. 6 (for sample-size planning)
- **Aumento MDE (%)** (number): e.g. 5 (minimum detectable lift)
- **Visitantes diários** (number): e.g. 4000 (for days estimate)
- **Divisão de tráfego (%)** (select)
- **Número de comparações** (number): 1 unless running multiple variants
- **Casas decimais** (number)

## Quando usar

- Ao analisar os resultados de um experimento de marketing ou alteração de produto para confirmar se o aumento na taxa de conversão é estatisticamente significativo.
- Ao comparar métricas contínuas, como tempo médio de sessão ou valor médio de pedido (AOV), entre dois grupos de usuários sem assumir variâncias iguais.
- Ao planejar a duração de um teste A/B, estimando o tamanho amostral necessário e os dias recomendados com base no tráfego diário e na potência estatística desejada.

## Como funciona

- Selecione o tipo de teste: Proporção para taxas de conversão (inserindo sucessos e visitantes) ou Contínua para médias (inserindo média, desvio padrão e tamanho da amostra).
- Defina os parâmetros estatísticos do experimento, incluindo o nível de significância (alfa), a potência desejada, o tráfego diário e o número de comparações simultâneas.
- O sistema executa o teste estatístico apropriado (Z-test agrupado para proporções ou t de Welch para dados contínuos) e calcula o p-valor e os intervalos de confiança.
- Visualize o veredito de significância, o lift relativo obtido, o tamanho amostral recomendado e alertas sobre testes sequenciais ou correções de Bonferroni.

## Casos de uso

- Validação de testes de conversão de páginas de vendas comparando o número de cadastros em duas variantes de design.
- Comparação do tempo médio de carregamento de página ou tempo de checkout entre duas arquiteturas de servidores usando o teste t de Welch.
- Dimensionamento prévio de experimentos para calcular quantos visitantes são necessários antes de iniciar a coleta de dados.

## Perguntas frequentes

### O que significa um resultado ser estatisticamente significativo?

Significa que a diferença observada entre o controle e o tratamento é improvável de ter ocorrido por mero acaso, considerando o nível de significância (alfa) escolhido.

### Quando devo usar o teste t de Welch em vez do Z-test?

Use o t de Welch para métricas contínuas (como receita média ou tempo de uso) onde você possui médias e desvios padrão. Use o Z-test para proporções binárias (como cliques ou conversões).

### Por que a calculadora exibe um aviso sobre testes sequenciais (sequential testing)?

Espreitar os resultados e parar o teste assim que o p-valor parecer significativo infla a taxa de falsos positivos. O teste deve rodar até atingir o tamanho amostral planejado.

### O que é a correção de Bonferroni e quando ela é aplicada?

É um ajuste no nível de significância usado quando você compara múltiplos tratamentos contra o controle, reduzindo a chance de encontrar falsos positivos devido a múltiplas comparações.

### Como é calculado o número de dias recomendados para o teste?

O cálculo divide o tamanho amostral total necessário (baseado na potência e MDE) pelo volume de visitantes diários, ajustando pela divisão de tráfego configurada.

## Ferramentas relacionadas

- [Construtor de Simulação Monte Carlo](https://elysiatools.com/pt/tools/monte-carlo-simulation-builder): Defina distribuições de entrada (normal/uniforme/lognormal/triangular), escreva uma fórmula, execute milhares de ensaios e obtenha o histograma com intervalos de confiança.
- [Resumidor de Feed RSS / Atom em Markdown](https://elysiatools.com/pt/tools/rss-feed-markdown-summarizer): Busca um feed RSS ou Atom por URL (ou cola o XML bruto), ordena por data de publicação, deduplica, aplica uma janela de tempo e entrega um resumo Markdown limpo
- [Tradutor IA de artigos Markdown](https://elysiatools.com/pt/tools/ai-markdown-article-translator): Traduz artigos Markdown completos com IA preservando titulos, tabelas, links, imagens e blocos de codigo
- [Desinfetante de Nome de Arquivo](https://elysiatools.com/pt/tools/filename-sanitizer): Limpa e desinfeta nomes de arquivo removendo caracteres ilegais para Windows, Linux e Mac
- [Analisador de Volume Plaquetário Médio (VPM)](https://elysiatools.com/pt/tools/mean-platelet-volume-analyzer): Analisa o Volume Plaquetário Médio VPM (fL). Referência ~7.5–11.5 fL. VPM baixo (< 7.5 fL, plaquetas pequenas e velhas) sugere produção medular suprimida: anemia aplásica, quimio/radioterapia, transfusão plaquetária recente, regeneração precoce de ferropenia, síndrome de Wiskott-Aldrich. VPM alto (> 11.5 fL, plaquetas grandes e jovens) sugere destruição periférica com produção medular compensatória ou macrotrombocitopenia: PTI (ITP), pós-esplenectomia, neoplasias mieloproliferativas (TE/LMC/MF), sepse grave em recuperação, Bernard-Soulier/MYH9, anemia megaloblástica, infarto agudo do miocárdio (marcador de ativação e prognóstico cardiovascular adverso). VPM cruzado com a contagem refina o diagnóstico: plaquetas baixas + VPM alto → destruição periférica (PTI, PTT, recuperação de CIVD); baixas + baixo → subprodução; altas + baixo → trombocitose reativa; altas + alto → neoplasia mieloproliferativa. Precaução: em amostra EDTA as plaquetas incham (~2 h) elevando o VPM, dependência do método (impedância > óptico > imunológico) — comparar no mesmo laboratório e analisador. Fontes: Bath 1996, Leader 2012, Vagdatli 2010, MDCalc. Não é conselho médico.
- [Traçador de distribuição normal](https://elysiatools.com/pt/tools/normal-distribution-plotter): Traça uma curva normal em SVG com marcadores z, sombreamento de intervalo/cauda e faixas σ 68/95/99.7.
- [Agrupador de Array](https://elysiatools.com/pt/tools/array-grouper): Agrupa elementos de array com base em vários critérios como comprimento, ordem alfabética, intervalos numéricos, condições personalizadas e mais
- [Calculadora do Escore APACHE II](https://elysiatools.com/pt/tools/apache-ii-score): Calcula o escore APACHE II: escore fisiológico agudo (APS, 12 variáveis, 0-4 pontos cada, pior valor nas primeiras 24 h na UTI) + pontos de idade (0-6) + saúde crônica (0/2/5); total 0-71; quanto maior, pior o prognóstico. Oxigenação: se FiO₂≥0.5 usa gradiente A-a, senão PaO₂; creatinina ×2 em insuficiência renal aguda; GCS = 15−GCS. Inclui a predição de mortalidade do modelo base (logit=−3.517+0.146×escore, sem peso diagnóstico). Fontes: Knaus 1985 Crit Care Med, tabela SFAR. Não substitui julgamento clínico. Não é conselho médico.

## Exemplos

- [Exemplos de Processamento de Imagem Android Java](https://elysiatools.com/pt/samples/android-image-processing-java): Exemplos de processamento de imagem Android Java incluindo leitura/escrita, dimensionamento e conversão de formato
- [Exemplos de Processamento de Imagem Android Kotlin](https://elysiatools.com/pt/samples/android-image-processing-kotlin): Exemplos de processamento de imagem Android Kotlin incluindo leitura/escrita, dimensionamento e conversão de formato
- [Exemplos de Processamento de Imagem Web Python](https://elysiatools.com/pt/samples/web-image-processing-python): Exemplos de processamento de imagem Web Python usando PIL/Pillow incluindo leitura, salvamento, redimensionamento e conversão de formato
- [Exemplos de Processamento de Imagem Web Rust](https://elysiatools.com/pt/samples/web-image-processing-rust): Exemplos de processamento de imagem Web Rust incluindo leitura/gravação, redimensionamento e conversão de formato

## Conteúdo relacionado

- [Desenho de experimentos A/B, tamanho da amostra e poder estatístico](https://elysiatools.com/pt/hubs/ab-testing-experiment-design-and-statistical-power): Planeje um experimento A/B, dimensione a evidência, escolha o teste adequado e avalie o efeito antes de decidir.
