Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

5
¿Por qué usar la teoría del valor extremo?
Vengo de Ingeniería Civil, en la que utilizamos la Teoría del Valor Extremo , como la distribución GEV para predecir el valor de ciertos eventos, como La mayor velocidad del viento , es decir, el valor al que sería menor el 98.5% de la velocidad del viento. Mi pregunta es …

1
Posicionar las flechas en un biplot PCA
Estoy buscando implementar un biplot para el análisis de componentes principales (PCA) en JavaScript. Mi pregunta es, ¿cómo determino las coordenadas de las flechas a partir de la salida U,V,DU,V,DU,V,D de la descomposición vectorial singular (SVD) de la matriz de datos? Aquí hay un ejemplo de biplot producido por R: …
18 pca  svd  biplot 




1
¿Significado en lenguaje sencillo de pruebas "dependientes" e "independientes" en la literatura de comparaciones múltiples?
Tanto en la literatura de la tasa de error familiar (FWER) como de la tasa de descubrimiento falso (FDR), se dice que métodos particulares para controlar FWER o FDR son apropiados para pruebas dependientes o independientes. Por ejemplo, en el artículo de 1979 "Un procedimiento de prueba múltiple secuencialmente rechazado …



1
¿Separación de fuente ciega de mezcla convexa?
Supongamos que tengo nnn fuentes independientes, X1,X2,...,XnX1,X2,...,XnX_1, X_2, ..., X_n y observo mmm mezclas convexas: Y1...Ym=a11X1+a12X2+⋯+a1nXn=am1X1+am2X2+⋯+amnXnY1=a11X1+a12X2+⋯+a1nXn...Ym=am1X1+am2X2+⋯+amnXn\begin{align} Y_1 &= a_{11}X_1 + a_{12}X_2 + \cdots + a_{1n}X_n\\ ...&\\ Y_m &= a_{m1}X_1 + a_{m2}X_2 + \cdots + a_{mn}X_n \end{align} con para todo i y a i j ≥ 0 para todo i , …
18 pca  ica 


2
Media de la muestra bootstrap vs estadística de la muestra
Digamos que tengo una muestra y la muestra de bootstrap de esta muestra para un estatico (por ejemplo, la media). Como todos sabemos, esta muestra de bootstrap estima la distribución muestral del estimador de la estadística.χχ\chi Ahora, ¿es la media de esta muestra de bootstrap una mejor estimación de la …



1
Usando bootstrap bajo H0 para realizar una prueba para la diferencia de dos medios: reemplazo dentro de los grupos o dentro de la muestra agrupada
Supongamos que tengo datos con dos grupos independientes: g1.lengths <- c (112.64, 97.10, 84.18, 106.96, 98.42, 101.66) g2.lengths <- c (84.44, 82.10, 83.26, 81.02, 81.86, 86.80, 85.84, 97.08, 79.64, 83.32, 91.04, 85.92, 73.52, 85.58, 97.70, 89.72, 88.92, 103.72, 105.02, 99.48, 89.50, 81.74) group = rep (c ("g1", "g2"), c (length …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.