La brecha entre los modelos chinos y los estadounidenses, ¿crece o decrece?

Hay gente ocupada en y preocupada por la cuestión de la brecha entre los LLMs chinos y los estadounidenses. También hay gente ocupada en y preocupada por la cuestión de cómo la selección de los métodos de análisis estadístico condiciona las narrativas que se construyen alrededor de ellos (o, más habitualmente, al revés). En mayo de 2026 escribí «Los LLMs chinos, ¿ocho meses por detrás del estado del arte?» que se ocupaba de ambas cuestiones a la vez. El argumento central de la crítica estadística era que la sensación de convergencia o divergencia entre los LLMs de ambos países puede adaptarse a una narrativa preespecificada escogiendo adecuadamente la transformación no lineal implícita en el modelo. Es ocioso reiterar ahora los detalles: el lector interesado los tiene a un clic de distancia. ...

17 de septiembre de 2026 · Carlos J. Gil Bellosta

Incógnitas incógnitas, una interpretación analítica de la incertidumbre de Knight

Los libros nos enseñan que un espacio de probabilidad es una terna $(\Omega, \mathcal{F}, \mathbb{P})$ donde $\Omega$ es el conjunto de posibles eventos, $\mathcal{F}$ es una sigma-álgebra sobre $\Omega$ y $\mathbb{P}$ es una función de probabilidad —un tipo muy especial de medida— sobre $\Omega$. En lo que sigue sobreentenderemos $\mathcal{F}$ y consideraremos el par $(\Omega, \mathbb{P})$. Si el par $(\Omega, \mathbb{P})$ es conocido, estamos hablando de teoría de la probabilidad. $\Omega$ pueden ser los números del 1 al 6, $\mathbb{P}(i) = 1/6$, etc. Entonces se pueden plantear y resolver con más o menos dificultad el tipo de problemas de índole deductivo que aparecen al final de los capítulos de los libros en la materia. ...

3 de septiembre de 2026 · Carlos J. Gil Bellosta

Notas (31): una serie de apuntes sobre estadística

Francisco Marcos cierra en Almacén de Derecho su serie sobre el cártel de la leche analizando las ocho sentencias de la Audiencia Provincial de Barcelona señalando cómo el juez rechazó las estimaciones de daños realizadas por ambas partes usando objetivísimos modelos macroeconómicos y prefirió evaluar su impacto, poco más o menos, por la cuenta de la vieja. Un episodio más que nos recuerda que la estadística es poco más que un recurso retórico. ...

28 de julio de 2026 · Carlos J. Gil Bellosta

Notas (25): el algoritmo de Feynman para encontrar «el mejor restaurante» y algunos asuntos más

Matthew Yglesias defiende la siempre subestimada importancia de las disputas metodológicas aburridas en el debate político. Debates aparentemente fácticos en política dependen de decisiones metodológicas complejas sobre las que la gente pasa de puntillas. Por ejemplo, al analizar si los salarios reales en EEUU cayeron entre 1979 y 2014, la conclusión varía drásticamente según los supuestos y deflatores técnicos elegidos. En una entrada de 2017 titulada If It’s Worth Doing, It’s Worth Doing With Made-Up Statistics, Scott Alexander aboga por el uso de estimaciones numéricas aproximadas y «cifras inventadas» en marcos de decisión formales (como el utilitarismo o la inferencia bayesiana). Sostiene que, aunque estas cuantificaciones sean imprecisas, siguen aportando información útil y superan con creces a la intuición humana pura, que, como es bien sabido, suele sufrir sesgos graves. ...

16 de junio de 2026 · Carlos J. Gil Bellosta

Sobre el «affaire» Jon González

Jon González tenía una cuenta popular en Twitter. Unos tipos a los que no les gustaba lo que contaba urdieron una estrategia, eventualmente exitosa, para taparle la boca. Eso está contado en muchas partes, como por ejemplo, esta. Jon González era conocido por sus gráficos, que acompañaban a sus análisis y opiniones sobre diversos aspectos de la economía española. Se trata de un asunto que no me interesa demasiado porque aunque me afecta, carezco de instrumentos para actuar sobre él de forma efectiva. Es un poco como el tiempo: no soy yo el que hace llover; de igual manera, yo no subo los tipos de interés ni redacto la legislación laboral, así que invierto mi tiempo en otra cosa. ...

11 de junio de 2026 · Carlos J. Gil Bellosta

Notas (24): la paradoja de Berkson en acción y otros asuntos

Mi viejo colega J.L. Cañadas ha publicado su consuetudinario análisis de las encuestas electorales, esta vez para las elecciones andaluzas de 2026. La novedad de este año es que ha delegado el trabajo en Claude: le ha pasado los enlaces de las anteriores y le ha pedido que lo replique. Y nada mal. Como anécdota, contaré que yo también traté luego de replicar sus resultados usando modelos gratuitos para ver si respondían mucho peor que Claude pero luego caí en la cuenta de que uno de ellos había encontrado por su cuenta la entrada enlazada más arriba y la había copiado literalmente. Hay modelos listos y modelos espabilados, parece. ...

9 de junio de 2026 · Carlos J. Gil Bellosta

Una aportación adicional a la extensa literatura sobre potenciales extensiones del coeficiente de correlación

En 2019 escribí sobre variantes «modernas» del coeficiente de correlación.. Mencioné allí: Otra entrada mía de 2011 sobre el mismo asunto sobre el artículo Detecting Novel Associations in Large Data Sets. La correlación de Hellinger, de 2018 (que cita a la anterior). La «multivarianza total de la distancia», que se publicó en 2019 (aunque el artículo es del 17) y que no cita a ninguna de las anteriores. Y a la lista hay que sumar la de Chatterjee (también publicada en 2019, un muy fructífero año para variantes de la correlación) que solo cita al primer artículo y de cuya existencia me enteré muy recientemente. ...

4 de junio de 2026 · Carlos J. Gil Bellosta

Los LLMs chinos, ¿ocho meses por detrás del estado del arte?

Uno de los indicadores que sigue la gente hoy en día —y yo con particular interés— es el de «cuántos meses por detrás» de los mejores LLMs estadounidenses se encuentran los modelos chinos. Al respecto, el NIST (National Institute of Standards and Technology de los EEUU) ha publicado el estudio CAISI Evaluation of DeepSeek V4 Pro, que se resume en que el retraso es de ocho meses, y que contiene el gráfico ...

21 de mayo de 2026 · Carlos J. Gil Bellosta

Notas (21): Predicciones, métricas y el rigor de los datos: un recorrido por la actualidad estadística

A veces hay en el mundo una variable aleatoria $X$ que distintos agentes tratan de predecir. Pero en otras ocasiones hay una variable aleatoria $X$, ciertos agentes crean predicciones $Y$ de $X$ y otros están interesados en la predicción de $Y$, tal como describe Matt Levine en Weather Prediction Prediction. The Economist describe los esfuerzos de la India por recuperar la credibilidad de sus estadísticas nacionales tras años de interferencia política. ...

19 de mayo de 2026 · Carlos J. Gil Bellosta

Tres maneras de «atacar» un problema estadístico (¿o es una sola?)

Andrew Gelman escribió recientemente These are the three ways of attacking a statistical problem (illustrated with the NFL example) en el que se enfrenta a un problema estadístico usando tres técnicas distintas. El problema consiste en determinar cuál es el patrón de resultados más frecuente en series de cuatro enfrentamientos entre equipos de fútbol americano: todas las combinaciones $(x_1, x_2, x_3, x_4)$, donde $x_i \in {0, 1}$, desde $(1, 1, 1, 1)$ (el primer equipo gana todos los enfrentamientos) hasta $(0, 0, 0, 0)$ (el primer equipo pierde todos los enfrentamientos). ...

14 de mayo de 2026 · Carlos J. Gil Bellosta