Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

3
Lo que es más alto, o
Así que tuve una prueba de probabilidad y realmente no pude responder esta pregunta. Simplemente preguntó algo como esto: "Teniendo en cuenta que es una variable aleatoria, 0 , use la desigualdad correcta para demostrar qué es mayor o igual, E (X ^ 2) ^ 3 o E (X ^ …

2
Expectativa de la raíz cuadrada de la suma de variables aleatorias uniformes al cuadrado independientes
Deje que X1,…,Xn∼U(0,1)X1,…,Xn∼U(0,1)X_1,\dots,X_n \sim U(0,1) sea independiente y identicallly distribuido variables aleatorias uniformes estándar. Let Yn=∑inX2iI seek: E[Yn−−√]Let Yn=∑inXi2I seek: E[Yn]\text{Let }\quad Y_n=\sum_i^nX_i^2 \quad \quad \text{I seek: } \quad \mathbb{E}\big[\sqrt{Y_n } \big] La expectativa de es fácil:YnYnY_n E[X2]E[Yn]=∫10y2y√=13=E[∑inX2i]=∑inE[X2i]=n3E[X2]=∫01y2y=13E[Yn]=E[∑inXi2]=∑inE[Xi2]=n3\begin{align} \mathbb{E}\left[X^2\right] &=\int_0^1\frac{y}{2\sqrt{y}}=\frac{1}{3}\\ \mathbb{E}\left[Y_n\right] &=\mathbb{E}\left[\sum_i^nX_i^2\right] = \sum_i^n\mathbb{E}\left[X_i^2\right]=\frac{n}{3} \end{align} Ahora para la parte aburrida. …



1
¿
¿ implica independencia de X e Y ?Cov(f(X),Y)=0∀f(.)Cov(f(X),Y)=0∀f(.)\mathbb{Cov} \left(f(X),Y\right) = 0 \; \forall \; f(.)XXXYYY No soy más que familiarizado con la siguiente definición de independencia entre e Y .XXXYYY Fx , y( x , y) = fX( x ) fy( y)FX,y(X,y)=FX(X)Fy(y) f_{x,y}(x,y) = f_x(x)f_y(y)


1
Datos correlacionados de alta dimensión y características principales / covariables descubiertas; prueba de hipótesis múltiples?
Tengo un conjunto de datos con aproximadamente 5,000 características / covariables a menudo correlacionadas y una respuesta binaria. Me dieron los datos, no los recolecté. Utilizo Lasso y el refuerzo de gradiente para construir modelos. Utilizo validación cruzada anidada iterada. Reporto los 40 coeficientes más grandes (absolutos) de Lasso y …


1
Ayuda a interpretar los datos de conteo GLMM usando lme4 glmer y glmer.nb - Binomial negativo versus Poisson
Tengo algunas preguntas con respecto a la especificación e interpretación de GLMM. 3 preguntas son definitivamente estadísticas y 2 son más específicamente sobre R. Estoy publicando aquí porque, en última instancia, creo que el problema es la interpretación de los resultados de GLMM. Actualmente estoy tratando de ajustar un GLMM. …



1
¿Por qué está sesgado el intervalo bayesiano creíble en esta regresión polinómica mientras que el intervalo de confianza es correcto?
Considere la siguiente gráfica en la que simulé datos de la siguiente manera. Observamos un resultado binario para el cual la probabilidad real de ser 1 se indica mediante la línea negra. La relación funcional entre una covariable y es un polinomio de tercer orden con enlace logístico (por lo …




Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.