La brecha entre los modelos chinos y los estadounidenses, ¿crece o decrece?

Hay gente ocupada en y preocupada por la cuestión de la brecha entre los LLMs chinos y los estadounidenses. También hay gente ocupada en y preocupada por la cuestión de cómo la selección de los métodos de análisis estadístico condiciona las narrativas que se construyen alrededor de ellos (o, más habitualmente, al revés). En mayo de 2026 escribí «Los LLMs chinos, ¿ocho meses por detrás del estado del arte?» que se ocupaba de ambas cuestiones a la vez. El argumento central de la crítica estadística era que la sensación de convergencia o divergencia entre los LLMs de ambos países puede adaptarse a una narrativa preespecificada escogiendo adecuadamente la transformación no lineal implícita en el modelo. Es ocioso reiterar ahora los detalles: el lector interesado los tiene a un clic de distancia. ...

17 de septiembre de 2026 · Carlos J. Gil Bellosta

¿Es Jacob Coxon un «loco de la colina»?

Resumida, la historia —que creo que conocemos casi todos— es que Jacob Coxon trabajaba en Antropic, un buen día dimitió, publicó en Twitter y mucha gente lo tomó en serio. Analíticamente, todos tenemos una priori sobre la archifamosa $P(\text{doom})$ que vamos afinando a partir de la información que recibimos. Para algunos, $P(\text{doom})$ es alta y, tras las declaraciones de Coxon, y debido a la credibilidad que dan a la fuente, la actualización bayesiana la ha incrementado significativamente. ...

16 de septiembre de 2026 · Carlos J. Gil Bellosta

Los LLMs chinos, ¿ocho meses por detrás del estado del arte?

Uno de los indicadores que sigue la gente hoy en día —y yo con particular interés— es el de «cuántos meses por detrás» de los mejores LLMs estadounidenses se encuentran los modelos chinos. Al respecto, el NIST (National Institute of Standards and Technology de los EEUU) ha publicado el estudio CAISI Evaluation of DeepSeek V4 Pro, que se resume en que el retraso es de ocho meses, y que contiene el gráfico ...

21 de mayo de 2026 · Carlos J. Gil Bellosta

Cuando hables con los LLMs, usa «la lengua del imperio»

Al trabajar con LLMs, la elección del idioma tiene efectos en términos de precisión, precio y fiabilidad. La evidencia empírica está alineada con lo que se esperaría razonando desde primeros principios: en inglés funcionan mejor. En términos de precisión, existe una degradación sistemática fuera del inglés que se acentúa en lenguas minoritarias y exóticas. Esto es así por el sobremuestreo de los contenidos en inglés en el entrenamiento, que, además, es mucho más sustancial en disciplinas científicas y técnicas. Por lo tanto, se especula que los modelos «internalizan» mejor los patrones semánticos y las estructuras argumentativas en ese idioma. La conclusión operativa es que si la tarea requiere exactitud (análisis, programación, medicina, etc.), usar el inglés reduce el riesgo de error. ...

2 de abril de 2026 · Carlos J. Gil Bellosta

Los LLMs y la devaluación del conocimiento legible

A la hora de evaluar el potencial impacto de los LLMs en el mercado laboral, tanto en general como en el más concreto de la ciencia de datos y la estadística, es conveniente distinguir entre tipos de conocimiento. En esta entrada voy a considerar una dimensión muy particular en la que la inteligencia de los LLMs y la humana operan de manera muy distinta: la de la legibilidad de la información y el conocimiento. ...

12 de marzo de 2026 · Carlos J. Gil Bellosta

Más sobre por qué la IA generativa es menos útil para lidiar con cuestiones jurídicas que en otros ámbitos

Tiene Jesús Alfaro una entrada en su blog, Por qué la AI generativa es menos útil para lidiar con cuestiones jurídicas que en otros ámbitos, cuyo contenido no es enteramente fiel a su rótulo. Aunque aporta razones de peso (y que no voy a cuestionar) sobre los problemas que plantean los LLMs a la hora de resolver cuestiones jurídicas, no acaba de explicar qué cosa concreta los hace precisamente menos útiles que en otros campos. Es decir, aunque anuncia una comparación, luego no la realiza expresamente. El objetivo de esta entrada es comparar el uso de los LLMs en el ámbito del derecho —basándome necesariamente en la entrada anterior en tanto que mi experiencia en esa disciplina es nula— con otros que conozco mejor, matemáticas y programación, para acabar proponiendo una síntesis (en el sentido dialéctico del término). ...

4 de febrero de 2026 · Carlos J. Gil Bellosta

Ahora el blog tiene una lista de entradas relacionadas construida usando LLMs

He implementado las entradas relacionadas en el blog. Dos entradas están relacionadas cuando el producto escalar de sus embeddings es alto. Así que en primer lugar he asociado a cada entrada un embedding. Las entradas son ficheros de markdown con un preámbulo en yaml. Los embeddings no están creados directamente sobre el texto bruto de la entrada sino sobre la entrada y algunos de los elementos, no todos, del preámbulo. ...

27 de marzo de 2025 · Carlos J. Gil Bellosta

ALIA: los enlaces

ALIA es el LLM público español. Hasta hace no mucho se sabía poco de él. Durante meses, solo hubo dos clústers de noticias: Uno, alrededor del 25 de febrero de 2024, coincidiendo con el anuncio de la cosa (véase, por ejemplo, esto o esto). Otro, alrededor de abril de 2024, cuando se anunció un acuerdo con IBM para el desarrollo de dicho modelo (véase esto o esto). En esa época ya tenía nombre, ALIA, y se lo esperaba para después del verano (véase esto). Después hubo una especie de apagón informativo —acabó el verano y yo no paraba de pulsar F5 en Google en vano— solo rasgado por una críptica nota de Alberto Palomo, aquel que fue ungido tiempo atrás como el CDO del Reino de España, que en una entrevista en El Confidencial a principios de diciembre decía de pasada que: ...

23 de enero de 2025 · Carlos J. Gil Bellosta

carlos:~/ $ clih "Find all files older than 45 days"

Estas cosas hace ahora mi terminal: carlos:bin/ $ clih "Find all files older than 45 days" find / -type f -mtime +45 -print A clih le paso la descripción de una tarea que quiero realizar en mi ordenador y me devuelve el comando correspondiente. Lo he construido así: He instalado LLM para llamar modelos desde línea de comandos. Lo he conectado con mi cuenta en DeepInfra según estas instrucciones (con la salvedad de que estoy usando Llama-3.3-70B-Instruct). De todos modos, es posible que cambie pronto a DeepSeek V3, que es mejor y más barato. He creado un template con el nombre de clihint; véanse los detalles debajo. He creado un alias así: alias clih='llm -t clihint' El template, inspirado en esto, es un fichero yaml con el siguiente contenido: ...

2 de enero de 2025 · Carlos J. Gil Bellosta

Claude y el desafío matemático navideño de 2024

Dice Gaussianos: Siguiendo la tradición desde 2012, vuelve el Desafío Matemático RSME-El País de Navidad. Este año, como hace ya tiempo, de nuevo es Adolfo Quirós (profesor de la Universidad Autónoma de Madrid (UAM) y director de La Gaceta de la Real Sociedad Matemática Española) quien nos lo presenta. El problema es el siguiente: El desafío comienza cuando elegimos dos números de la Lotería de Navidad (recordemos que tienen 5 cifras), con la única condición de que cumplan estos dos requisitos: ...

24 de diciembre de 2024 · Carlos J. Gil Bellosta