El error en las encuestas: cuentas en una servilleta

Bien escondidita en las encuestas que se publican, puede encontrarse a veces una ficha técnica. Y esta suele contener una frase de esta guisa: Partiendo de los criterios del muestreo aleatorio simple, para un nivel de confianza del 95 % (que es el habitualmente adoptado) y en la hipótesis más desfavorable de máxima indeterminación (p=q=0.5), el margen de error de los datos referidos al total de la muestra es de 3.2 puntos. ...

16 de mayo de 2013 · Carlos J. Gil Bellosta

La frontera bayesiana en problemas de clasificación (simples)

Una de las preguntas formuladas dentro del foro desde el que seguimos la lectura del libro The Elements of Statistical Learning se refiere a cómo construir la frontera bayesiana óptima en ciertos problemas de clasificación. Voy a plantear aquí una discusión así como código en R para representarla (en casos simples y bidimensionales). Supongamos que hay que crear un clasificador que distinga entre puntos rojos y verdes con la siguiente pinta, ...

1 de febrero de 2012 · Carlos J. Gil Bellosta

Visualización de la actualización bayesiana (y unas cuantas funciones de R)

Me ha llegado noticia de una entrada en un blog, Visualizing Bayesian Updating, en el que se muestra visualmente cómo se actualiza la distribución a posteriori conforme aumenta el número de ensayos en un problema bayesiano simple. Explica también los fundamentos estadísticos del asunto. Yo me limitaré a ofrecer una nueva versión del código —que no funcionaba copiando y pegando sin más— en el que he introducido ciertas modificaciones. Es el siguiente: ...

12 de septiembre de 2011 · Carlos J. Gil Bellosta