Caso con datos reales
Paramétricas y no paramétricas sobre los mismos datos
Las mismas preguntas resueltas de las dos maneras con la EPH: cuándo coinciden, cuánto se pierde y un bootstrap que falla de manera instructiva.
La pregunta
¿Cambian las conclusiones si se usan pruebas no paramétricas?
Las mismas preguntas del módulo de hipótesis, resueltas de las dos maneras sobre los 15.448 ocupados con ingreso de la EPH del primer trimestre de 2026.
Las dos variables
| Ingreso | Edad | |
|---|---|---|
| Asimetría | 10,21 | 0,26 |
| Curtosis | 267,28 | −0,62 |
El ingreso es el caso extremo de no normalidad; la edad, una variable razonablemente simétrica. Sirven para contrastar.
La prueba de normalidad rechaza siempre
Shapiro-Wilk sobre 5.000 casos:
| Variable | ||
|---|---|---|
| Ingreso | 0,482 | |
| Edad | 0,981 |
La edad tiene —casi 1, o sea casi normal— y aun así se rechaza con un valor p de .
Cuántas veces rechaza la normalidad de la edad, según el tamaño de muestra (200 submuestras por cada ):
| Rechaza | |
|---|---|
| 10 | 7,0 % |
| 20 | 6,5 % |
| 30 | 14,5 % |
| 50 | 24,5 % |
| 100 | 60,5 % |
| 500 | 100 % |
| 5.000 | 100 % |
Mann-Whitney contra la prueba t
¿Difiere el ingreso entre varones y mujeres?
| Paramétrica | No paramétrica | |
|---|---|---|
| Prueba | t de Welch | U de Mann-Whitney |
| Compara | medias: $1.123.989 vs $832.239 | medianas: $900.000 vs $700.000 |
| Estadístico | ||
| Valor p | ||
| Tamaño del efecto |
Las dos rechazan con enorme holgura. La no paramétrica da incluso un valor p más chico, lo que desmiente la idea de que “siempre pierde potencia”: con distribuciones muy asimétricas puede ganarla.
La probabilidad de superioridad de 0,618 es el tamaño de efecto más interpretable de los dos: si se toma un varón y una mujer al azar, hay un 62 % de probabilidad de que él gane más. Con igualdad perfecta sería 50 %.
Kruskal-Wallis contra ANOVA
Ingreso según los seis niveles educativos:
| ANOVA | Kruskal-Wallis | |
|---|---|---|
| Estadístico | ||
| gl | 5 y 15.359 | 5 |
| Valor p | ||
| Efecto |
Misma conclusión. Las medianas por nivel —$500.000, $600.000, $600.000, $800.000, $800.000 y $1.100.000— muestran el mismo patrón que las medias: los tres primeros niveles casi no se distinguen.
Transformar en lugar de abandonar
Aplicar logaritmo al ingreso:
| Original | Con logaritmo | |
|---|---|---|
| Asimetría | 10,21 | −0,64 |
| Curtosis | 267,28 | 1,36 |
El costo: la media del logaritmo corresponde a la media geométrica, $719.241, que no es la media aritmética ($990.201) ni la mediana ($800.000). Hay que decirlo al interpretar.
El bootstrap: uno que valida, uno que sirve y uno que falla
10.000 remuestras del ingreso:
| Estadístico | Observado | EE bootstrap | IC 95 % | Valores distintos |
|---|---|---|---|---|
| Media | $990.201 | $8.079 | $974.553 a $1.005.980 | 10.000 |
| CV | 1,0138 | 0,0608 | 0,903 a 1,139 | 10.000 |
| Mediana | $800.000 | $0 | $800.000 a $800.000 | 1 |
La media valida el método: el error estándar bootstrap ($8.079) coincide con la fórmula ($8.076) hasta el tercer dígito, sin haber usado ninguna fórmula.
El CV muestra para qué sirve: no tiene fórmula cerrada sencilla para su error estándar, y el bootstrap la da igual.
La mediana muestra dónde falla.
Es la advertencia práctica más útil del módulo: el bootstrap supone que la muestra representa bien a la población, y con datos fuertemente discretizados ese supuesto falla para los estadísticos basados en posiciones.
La prueba de permutación
Diferencia de medias entre varones y mujeres, con 10.000 permutaciones al azar de las etiquetas:
| Valor | |
|---|---|
| Diferencia observada | $291.750 |
| Máxima diferencia entre 10.000 permutaciones | $63.670 |
| Valor p | 0,0001 |
Ninguna de las 10.000 reasignaciones al azar se acercó siquiera a la diferencia observada: la mayor llegó a $63.670, menos de una cuarta parte. El valor p es el mínimo alcanzable con esa cantidad de permutaciones.
La conclusión
En este conjunto de datos, las cinco comparaciones dan lo mismo: paramétricas, no paramétricas, transformadas y por remuestreo. Eso no es casualidad: con más de 15.000 casos, el teorema central del límite protege a las pruebas paramétricas aun con asimetría de 10.
Reproducirlo
# R
shapiro.test(sample(ingreso, 5000))
wilcox.test(ingreso ~ sexo)
kruskal.test(ingreso ~ factor(nivel_ed))
ks.test(v, m)
library(boot)
boot(ingreso, function(x, i) mean(x[i]), R = 10000)
# Python
from scipy import stats
stats.shapiro(sub)
stats.mannwhitneyu(v, m)
stats.kruskal(*grupos)
stats.bootstrap((ingreso,), np.mean, n_resamples=10000)
El script completo es datos/eph/preparar-no-parametricas-m12.py, con semilla
fija en 2026 para que todo sea reproducible.