Francisco Marcos cierra en Almacén de Derecho su serie sobre el cártel de la leche analizando las ocho sentencias de la Audiencia Provincial de Barcelona señalando cómo el juez rechazó las estimaciones de daños realizadas por ambas partes usando objetivísimos modelos macroeconómicos y prefirió evaluar su impacto, poco más o menos, por la cuenta de la vieja. Un episodio más que nos recuerda que la estadística es poco más que un recurso retórico.
En la misma línea, Gabrielle Sorensen retuerce el hilo metodológico para reestudiar la famosa «paradoja de la igualdad de género», según la cual las mujeres de los países más igualitarios son menos propensas a optar por carreras STEM. Sostiene que el resultado es muy sensible a las decisiones de medición, se infla por un sesgo estadístico y, al controlar por conglomerados culturales, la relación —como no podía ser de otra manera tras repasar la biografía de la autora— desaparece o incluso se invierte: la paradoja no es tal, sino un artefacto impulsado por los países occidentales, que son outliers en muchos rasgos.
John D. Cook examina en su blog el comportamiento de la varianza a posteriori en estadística bayesiana. Contrariamente a lo que pueda dictar la intuición, en el modelo conjugado beta-binomial la varianza puede aumentar ante datos inesperados; en el normal-normal, cada nueva observación reduce la varianza; y en el poisson-gamma la varianza aumenta con cada evento observado y disminuye cuadráticamente con el tiempo (en la interpretación más usual del proceso).
Dado un conjunto de $n$ personas, hacen falta $\log_2(n)$ bits de información para identificar a cada individuo. Así las cosas, Dynomight conjetura que la (pseudo) anonimidad desaparecerá dado que los rasgos de estilo son suficientes para extraer los no tantos bits de información necesarios para identificar a una persona a partir de un texto razonablemente largo que haya redactado. Su estimación es, de hecho, que un texto en inglés de unas mil palabras da para destilar los 29 bits de información suficientes para identificar a una persona dentro del universo angloparlante.
Guardaba una selección de artículos (como este, este, este, este de la BBC, o esta misma disculpa pública de la ONS) sobre errores del INE británico, la ONS, pero prácticamente no tengo ninguno del de aquí. Debe de ser porque hace mucho mejor las cosas.