Distribución Pareto Primer Tipo
De un fenómeno a un modelo
Vilfredo Pareto observó en 1896 una regularidad de concentración de riqueza: el número de personas con más de una cantidad seguía aproximadamente una ley de potencia. La distribución se separó después de la ley empírica.
Lo que conviene mirar
El soporte comienza en loc + xm en la forma de Phitter. xm fija el mínimo y alpha el índice de cola; la media solo existe cuando alpha > 1.
Relaciones útiles
Es el caso más directo de colas regularmente variables y un caso límite o particular de varias familias Burr y Beta prime. La Generalized Pareto comparte el lenguaje de colas, pero modela excesos sobre un umbral.
Nombres que también encontrarás
También se conoce como Pareto Type I, distribución de Pareto clásica o ley de Pareto.
Cuándo tiene sentido
Pareto es apropiada para la parte alta de una distribución, no necesariamente para todo el rango. En catástrofes y seguros, el índice alpha determina cuánto peso reciben eventos muy grandes.
Qué no debe suponerse
Estimar una pendiente en un gráfico log-log no basta para validar Pareto; el umbral debe elegirse y la incertidumbre del índice debe cuantificarse.
La recta que Pareto encontró en los ingresos altos
Al estudiar tablas fiscales europeas, Vilfredo Pareto observó que la proporción de personas por encima de un ingreso alto descendía aproximadamente como una potencia. En escala logarítmica, la cola se vuelve una recta cuya pendiente está ligada a alpha. Su obra de referencia fue el Cours d’économie politique de 1896 y 1897.
La distribución de Pareto de primer tipo formaliza esa cola desde un mínimo estricto. No afirma que toda la distribución del ingreso, incluida su zona central, siga la misma potencia. Tampoco es sinónimo de la regla 80/20, que corresponde solo a ciertas elecciones y fue popularizada después. Como la existencia de media y varianza depende de alpha, extrapolar sin cuantificar su incertidumbre puede convertir unos pocos máximos en conclusiones económicas enormes.
Guía de elección
Buena candidata cuando: el interés está en valores por encima de un mínimo real y la cola sigue aproximadamente una ley de potencia.
Compárala con: Generalized Pareto para excedencias y Burr o Lognormal para modelar también el cuerpo. Comprueba estabilidad frente al umbral: Pareto rara vez describe toda la muestra.
Referencias
-
Referencia de SciPy: scipy.stats.pareto — definición y parametrización
-
Pareto, V. (1896–1897). Cours d’économie politique. F. Rouge.
-
Johnson, N. L., Kotz, S. & Balakrishnan, N. (1994). Continuous Univariate Distributions, 2nd ed., Vol. 1. Wiley.
-
Clauset, A., Shalizi, C. R. & Newman, M. E. J. (2009). Power-law distributions in empirical data. SIAM Review, 51(4), 661–703.