Calculadora de T-Test

Próximo

Cole duas amostras de números, escolha o tipo de teste (duas amostras agrupadas, Welch com variância desigual ou pareado) e a calculadora retorna tudo o que você precisa para relatar um teste t: médias das amostras, variâncias, a estatística t, graus de liberdade e um valor p de duas caudas calculado via a função beta incompleta regularizada. Sem planilha, sem R, sem login.

Como executar um teste t

  1. 1

    Insira a amostra 1

    Separe os valores por vírgulas, espaços ou novas linhas: `12, 15, 14, 10, 13`.

  2. 2

    Insira a amostra 2

    Mesmo formato. Para testes pareados, os tamanhos das amostras devem corresponder; para agrupados e Welch, podem diferir.

  3. 3

    Escolha o tipo de teste

    Agrupado assume variâncias iguais. Welch não. Pareado é para antes/depois nos mesmos sujeitos.

  4. 4

    Leia o resultado

    Você obtém médias, variâncias, t, df e p. Um valor p abaixo de 0.05 é o limite de significância convencional.

Qual teste eu escolho

Cenário Usar
Dois grupos independentes, variância similar, tamanho similar Agrupado
Dois grupos independentes, variância diferente ou tamanho diferente Welch
Mesmos sujeitos medidos duas vezes (pré / pós, A / B por pessoa) Pareado
Uma amostra contra uma média conhecida Não esta ferramenta (teste de uma amostra)

O teste de Welch é o padrão mais seguro quando em dúvida, ele lida com variâncias desiguais e se reduz ao teste agrupado quando as variâncias são iguais.

As fórmulas em ação

  • Agrupado: t = (x1 - x2) / sqrt( sp^2 * (1/n1 + 1/n2) ) com df = n1 + n2 - 2.
  • Welch: t = (x1 - x2) / sqrt( s1^2/n1 + s2^2/n2 ) com df de Welch-Satterthwaite.
  • Pareado: t = mean(d) / (sd(d) / sqrt(n)) com df = n - 1, onde d é a diferença por par.
  • Valor p: calculado via a função beta incompleta regularizada para resultados precisos em amostras pequenas, com uma aproximação normal acima de df = 30.

Interpretando o valor p

  • p < 0.05: convencionalmente “estatisticamente significativo”, a hipótese nula de médias iguais é improvável.
  • p entre 0.05 e 0.10: sugestivo; frequentemente relatado, mas não digno de manchete.
  • p >= 0.10: sem evidências contra médias iguais com a amostra que você tem.

Significância não é tamanho. Uma diferença pequena pode ser “significativa” com uma amostra enorme, e uma diferença significativa pode ser “não significativa” com uma amostra pequena. Sempre relate o tamanho do efeito junto com o valor p.

Dicas

  • Decida sobre o teste antes de ver os dados. Escolher Welch apenas após notar variância desigual inflaciona as taxas de falsos positivos.
  • Para dados pareados, calcule as diferenças por sujeito você mesmo se a ordem não for óbvia, a ferramenta assume que as linhas estão alinhadas.
  • O valor p é de duas caudas. Divida por 2 para um teste de uma cauda e somente se a direção foi prevista com antecedência.
  • Outliers dominam testes t. Plote um histograma rápido antes de confiar nos números.

Perguntas frequentes

De duas caudas, que é o padrão que a maioria dos artigos relata. Se você previu a direção da diferença com antecedência, divida por 2 para um p de uma cauda.

Quando os tamanhos das amostras diferem ou as variâncias das amostras são claramente desiguais. Orientações estatísticas recentes recomendam Welch como o teste padrão de duas amostras, independentemente.

O teste t lida com amostras até n=2 por grupo matematicamente, mas resultados com n<5 por grupo têm intervalos de confiança muito amplos. Interprete com cautela.

Não. Para um teste de uma amostra contra uma média conhecida, subtraia a média conhecida da sua amostra e teste se as diferenças têm uma média zero, ou use uma ferramenta dedicada de uma amostra.

Os números que você cola são enviados ao nosso servidor para realizar o cálculo, que é como os resultados se atualizam enquanto você digita. Eles não são armazenados nem registrados, e nada é mantido depois que a página responde.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas