Selector de prueba estadística

Elige la prueba estadística que encaja con tus datos y la ejecuta.Pega tus grupos y elige el control. Las comprobaciones de los supuestos vienen con el resultado.

La misma disposición que acepta el creador de gráficos con barras de error: los datos preparados para uno sirven en el otro.

Cómo se usa

  1. Elige la disposición y pega. Es el mismo formato que acepta el creador de gráficos con barras de error.
  2. Di si los datos son apareados, por ejemplo el mismo sujeto medido antes y después. Que los grupos tengan el mismo tamaño no lo prueba.
  3. Elige el grupo control. Todos los demás grupos se comparan con él.
  4. Lee primero «por qué esta prueba». Importa más que el resultado.
  5. Mira juntas la respuesta recomendada y la otra, y vuelve a pensar en los supuestos si difieren.

Las fórmulas y lo que hay que vigilar

El valor de esta página no es la aritmética. Es decidir qué aritmética hacer.

En qué se apoya la elección

No en un valor p de normalidad: con el tamaño muestral que se maneja en el laboratorio, ese número no es evidencia. Solo en motivos que se puedan defender.

Menos de 8 por grupo
la normalidad no se puede juzgar → prueba de rangos
Levene rechaza
una prueba que no supone igualdad de varianzas (Welch)
En los demás casos
la prueba paramétrica clásica

Igualdad de varianzas — Levene, centrado en la mediana

Un ANOVA sobre las desviaciones absolutas respecto de la mediana de cada grupo. La mediana y no la media, porque centrar en la media vuelve a la propia prueba sensible a la falta de normalidad que se supone que se comprueba a su lado.

Estadístico
F sobre |xᵢⱼ − medianaⱼ|

Pruebas de rangos

Sin empates y con una muestra pequeña, se cuentan las permutaciones y el valor p es exacto. En los demás casos, una aproximación normal con correcciones por continuidad y por empates.

Mann-Whitney
c(m,n,u) = c(m−1,n,u−n) + c(m,n−1,u)
La p más pequeña con 3 contra 3
2 / C(6,3) = 0.1

Lo que hay que vigilar

  • ⛔ No hay Shapiro-Wilk. Sus coeficientes no se han podido obtener con fuente y no se han copiado del código de nadie. Lo que se muestra en su lugar está explicado en la página.
  • Con pocas réplicas la normalidad *no se puede contrastar*. Entonces «p > 0.05» significa «no hemos podido saberlo», no «es normal», y esta herramienta dice cuál de las dos cosas es.
  • El apareamiento es una pregunta sobre el diseño. Los números no pueden responderla, y aplicar una prueba para datos apareados a datos que no lo están tira grados de libertad a la basura.
  • Cuando la respuesta recomendada y la alternativa difieren, no elijas la p más pequeña. Que difieran es en sí mismo el hallazgo: el resultado se está apoyando en el supuesto.
  • La corrección de las comparaciones con el control es la de Holm, no los valores críticos propios de Dunnett, y la página lo dice.
  • Con tres contra tres, una prueba de rangos no puede alcanzar la significación de ninguna manera. Es un límite del diseño, no de los datos.

Preguntas frecuentes

Se usan a menudo juntas