Herramientas · Bioestadística abierta
Intervalo de confianza de una media: t de Student e intervalo de la desviación estándar
Captura la media, la desviación estándar y el número de observaciones para obtener el intervalo de confianza de la media (t de Student), el error estándar, el intervalo de la desviación estándar y la interpretación en lenguaje llano, con el código de R equivalente.
https://udgca1190.com.mx/herramientas/bioestadistica/ic-media
Este enlace no incluye los datos pegados: son demasiado largos para una URL.
Resultados
Media
95.00
83.63 a 106.37
IC 95 % · t de Student, n − 1 gl
Error estándar de la media (EEM)
5.66
DE dividida entre la raíz de n
Desviación estándar (DE)
40.00
33.41 a 49.85
IC 95 % · distribución χ²
Multiplicador t de Student
2.010
Grados de libertad: 49
Interpretación
La media fue 95.00 (DE 40.00) en 50 observaciones; el intervalo de confianza al 95 % (83.63 a 106.37) indica el rango de medias poblacionales compatibles con los datos.
Ese intervalo no describe la dispersión individual: para eso sirve media ± 2 DE, que aquí abarca aproximadamente de 15.00 a 175.00.
La desviación estándar de la población es compatible con valores de 33.41 a 49.85; con muestras pequeñas ese intervalo es mucho más ancho de lo que suele suponerse.
Con n = 50 el multiplicador es t = 2.010 en vez del 1.96 de la distribución normal, y el error estándar de la media vale 5.66.
Con n = 50 (30 o más) el teorema del límite central hace robusto el intervalo de la media aunque los datos no sean normales; el de la desviación estándar, en cambio, sí depende de ese supuesto.
Explicación
El intervalo de confianza de una media responde a una pregunta muy concreta: ¿qué medias poblacionales son compatibles con lo que observé? No dice dónde caen los pacientes individuales. Confundir ambas cosas es el error más frecuente al leer un artículo: un intervalo estrecho con una desviación estándar grande significa que la media está bien estimada, no que los valores se parezcan entre sí.
El multiplicador no es 1.96 sino el cuantil de la distribución t de Student con n − 1 grados de libertad, porque la desviación estándar también se estimó a partir de los mismos datos. Con muestras pequeñas ese multiplicador crece bastante (con n = 5 vale 2.78) y el intervalo se ensancha. La convergencia hacia 1.96 es lenta: con n = 30 el multiplicador todavía vale 2.045, con n = 100 vale 1.984 y hacen falta unas 240 observaciones para que la diferencia baje de 0.01.
La desviación estándar también es una estimación y también tiene incertidumbre. Su intervalo se obtiene de la distribución χ² de (n − 1)s²/σ², es marcadamente asimétrico y, con n pequeño, sorprendentemente ancho: es una buena forma de ver por qué no conviene comparar desviaciones estándar de estudios pequeños como si fueran cifras exactas.
Ambos intervalos suponen que los datos proceden de una distribución aproximadamente normal. El de la media es robusto gracias al teorema del límite central en cuanto la muestra crece; el de la desviación estándar no lo es, y con distribuciones muy asimétricas conviene reportar mediana y rango intercuartílico en vez de media y desviación estándar.
Ecuaciones
- media observada
- desviación estándar muestral (denominador n − 1)
- número de observaciones
- cuantil bilateral de la t de Student con n − 1 grados de libertad
- cuantil q de la distribución ji cuadrada con n − 1 grados de libertad
- desviación estándar de la población, que es lo que se estima
- error estándar de la media: cuánto varía la media de muestra a muestra
Código R
# Confidence interval for a mean (t) and for the SD (chi-squared) - Bioestadistica abierta, UDG-CA-1190
# Runs as is in R, RStudio or webR; prints the results as JSON at the end.
library(jsonlite)
media <- 95; de <- 40; n <- 50; nivel <- 0.95
# Two-sided Student t quantile with n - 1 degrees of freedom, and the standard error of the mean
tcrit <- qt(1 - (1 - nivel)/2, n - 1)
eem <- de/sqrt(n)
media_ic <- c(media, media - tcrit*eem, media + tcrit*eem)
# CI for the population SD from the chi-squared distribution of (n - 1)s^2/sigma^2 (equal tails)
de_ic <- c(de, de*sqrt((n - 1)/qchisq(1 - (1 - nivel)/2, n - 1)), de*sqrt((n - 1)/qchisq((1 - nivel)/2, n - 1)))
res <- list(media = media_ic, eem = eem, de = de_ic, t_crit = tcrit)
cat(toJSON(res, auto_unbox = TRUE, digits = NA))
# Equivalent in RStudio with raw data: t.test(x, conf.level = nivel)$conf.int; DescTools::MeanCI(x)
Este es el mismo código que valida la calculadora: cópialo y ejecútalo en R o RStudio para reproducir el resultado.
La verificación con R dentro del navegador llegará en una próxima versión; mientras tanto, copia el código y ejecútalo en RStudio.
Métodos para manuscrito
La media (95.00; DE 40.00; n = 50) se acompañó de su intervalo de confianza al 95 % basado en la distribución t de Student con n − 1 grados de libertad [1,2]: 83.63 a 106.37. El intervalo de la desviación estándar se obtuvo de la distribución χ² de (n − 1)s²/σ², con colas iguales: 33.41 a 49.85. Los cálculos se realizaron con la calculadora «IC de una media» de Bioestadística abierta (Cuerpo Académico UDG-CA-1190, https://udgca1190.com.mx/herramientas/bioestadistica/ic-media), verificada contra R.
Párrafo listo para la sección de Métodos; los números entre corchetes remiten a la lista de referencias.
Referencias
- 01 Student. The probable error of a mean. Biometrika. 1908;6(1):1–25. doi:10.1093/biomet/6.1.1 Fuente original
- 02 Gardner MJ, Altman DG. Confidence intervals rather than P values: estimation rather than hypothesis testing. British Medical Journal (Clinical Research Edition). 1986;292(6522):746–750. doi:10.1136/bmj.292.6522.746 PMID: 3082422 Lectura didáctica
- 03 Altman DG, Machin D, Bryant TN, Gardner MJ. Statistics with Confidence: Confidence Intervals and Statistical Guidelines. 2.ª ed. London: BMJ Books; 2000. Lectura didáctica
- 04 Altman DG. Practical Statistics for Medical Research. London: Chapman & Hall; 1991. Lectura didáctica