Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
Estimación media robusta con eficiencia de actualización O (1)
Estoy buscando una estimación sólida de la media que tiene una propiedad específica. Tengo un conjunto de elementos para los que quiero calcular esta estadística. Luego, agrego nuevos elementos uno a la vez, y para cada elemento adicional me gustaría volver a calcular la estadística (también conocida como algoritmo en …





2
La fórmula de Doane para la agrupación de histogramas
Estoy implementando varios algoritmos para estimar el mejor número de contenedores para usar en histogramas. La mayoría de los que estoy implementando se describen en la página "Histograma" de Wikipedia en la sección " Número de contenedores y ancho " *. Estoy atrapado en un problema con la fórmula de …

2
¿Stan hace predicciones posteriores?
¿Stan (en particular, rstan) tiene instalaciones incorporadas para generar distribuciones posteriores predictivas? No es difícil generar la distribución desde el ajuste estándar, pero prefiero no reinventar la rueda.


1
¿Cómo especificar una matriz de contraste (en R) para la diferencia entre un nivel y un promedio de los otros?
Tengo un modelo de regresión que se ve así:Y=β0+β1X1+β2X2+β3X3+β12X1X2+β13X1X3+β123X1X2X3Y=β0+β1X1+β2X2+β3X3+β12X1X2+β13X1X3+β123X1X2X3Y = \beta_0+\beta_1X_1 + \beta_2X_2 + \beta_3X_3 +\beta_{12}X_1X_2+\beta_{13}X_1X_3+\beta_{123}X_1X_2X_3 ... o en notación R: y ~ x1 + x2 + x3 + x1:x2 + x1:x3 + x1:x2:x3 Digamos que y son variables categóricas y es numérico. La complicación es que tiene tres niveles …
9 r  contrasts 

3
Elección de clústeres para k-means: el caso de 1 clúster
¿Alguien sabe un buen método para determinar si la agrupación utilizando kmeans es incluso apropiada? Es decir, ¿qué pasa si su muestra es realmente homogénea? Sé que algo así como un modelo de mezcla (a través de mclust en R) proporcionará estadísticas de ajuste para el caso de clúster 1: …
9 r  clustering  k-means 

2
¿Cómo encontrar la distancia esperada entre dos puntos distribuidos uniformemente?
Si tuviera que definir las coordenadas y donde( X 2 , Y 2 )(X1,Y1)(X1,Y1)(X_{1},Y_{1})(X2,Y2)(X2,Y2)(X_{2},Y_{2}) X1,X2∼Unif(0,30) and Y1,Y2∼Unif(0,40).X1,X2∼Unif(0,30) and Y1,Y2∼Unif(0,40).X_{1},X_{2} \sim \text{Unif}(0,30)\text{ and }Y_{1},Y_{2} \sim \text{Unif}(0,40). ¿Cómo encontraría el valor esperado de la distancia entre ellos? Estaba pensando, ya que la distancia se calcula por (X1−X2)2+(Y1−Y2)2−−−−−−−−−−−−−−−−−−−√)(X1−X2)2+(Y1−Y2)2)\sqrt{(X_{1}-X_{2})^{2} + (Y_{1}-Y_{2})^{2}}) sería el valor …

2
Libro para estadísticas no paramétricas
Lo que sería un buen libro para estadísticas no paramétricas. No solo la introducción sino el nivel avanzado. También estoy mirando algo que puedo usar para aprender y no como referencia. En particular, estoy buscando un libro que pueda contener conceptos básicos detrás de métodos no paramétricos, inferencia sin parámetros, …



1
Función generadora de momentos del producto interno de dos vectores aleatorios gaussianos
¿Alguien puede sugerir cómo puedo calcular la función generadora de momentos del producto interno de dos vectores aleatorios gaussianos, cada uno distribuido como , independientes el uno del otro? ¿Hay algún resultado estándar disponible para esto? Cualquier puntero es muy apreciado.N(0,σ2)norte(0 0,σ2)\mathcal N(0,\sigma^2)

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.