Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
Momento / mgf de coseno de vectores direccionales?
¿Alguien puede sugerir cómo puedo calcular el segundo momento (o la función generadora del momento completo) del coseno de dos vectores aleatorios gaussianos , cada uno distribuido como , independientes el uno del otro? IE, momento para la siguiente variable aleatoriax,yx,yx,yN(0,Σ)N(0,Σ)\mathcal N (0,\Sigma) ⟨x,y⟩∥x∥∥y∥⟨x,y⟩‖x‖‖y‖\frac{\langle x, y\rangle}{\|x\|\|y\|} La pregunta más cercana …

3
Los datos de entrenamiento están desequilibrados, pero ¿también debería estar mi conjunto de validación?
He etiquetado los datos compuestos por 10000 ejemplos positivos y 50000 ejemplos negativos, dando un total de 60000 ejemplos. Obviamente estos datos están desequilibrados. Ahora digamos que quiero crear mi conjunto de validación, y quiero usar el 10% de mis datos para hacerlo. Mi pregunta es la siguiente: ¿Debo asegurarme …



2
Estadística completa para en una
Me gustaría saber si la estadística está completa para en una configuración .T(X1, ... ,Xnorte) =∑nortei = 1(Xyo-X¯norte)2n - 1T(X1,…,Xn)=∑i=1n(Xi−X¯n)2n−1T(X_1,\ldots,X_n)=\frac{\sum_{i=1}^n (X_i-\bar{X}_n)^2}{n-1}σ2σ2\sigma^2norte( μ ,σ2)N(μ,σ2)N(\mu,\sigma^2) ¿Depende esto de si se conoce previamente o no? Si está completo para , entonces por Lehmann-Scheffé es UMVUE . Pero si se conociera \ mu , …

1
¿Valor esperado de la razón de variables aleatorias correlacionadas?
Para las variables aleatorias independientes y , ¿existe una expresión de forma cerrada paraαα\alphaββ\beta E[αα2+β2√]E[αα2+β2]\mathbb E \left[ \frac{\alpha}{\sqrt{\alpha^2 + \beta^2}} \right] en términos de los valores esperados y las variaciones de y ? Si no, ¿hay un límite inferior bueno en esa expectativa?αα\alphaββ\beta Actualización: también puedo mencionar que y . …



2
¿Es Random Forest una buena opción para la clasificación de datos desequilibrados? [cerrado]
Cerrada . Esta pregunta necesita estar más centrada . Actualmente no está aceptando respuestas. ¿Quieres mejorar esta pregunta? Actualice la pregunta para que se centre en un problema solo editando esta publicación . Cerrado hace 3 años . A pesar del parecido y otros enfoques de variabilidad de datos cada …






3
¿Cómo se entrena el generador en una GAN?
El documento sobre GAN dice que el discriminador usa el siguiente gradiente para entrenar: ∇θre1metro∑i = 1metro[ logD (X( i )) +log( 1 - D ( G (z( i )) ) ) ]∇θre1metro∑yo=1metro[Iniciar sesión⁡re(X(yo))+Iniciar sesión⁡(1-re(sol(z(yo))))]\nabla _{\theta_d} \frac{1}{m}\sum^{m}_{i=1} [\log{D(x^{(i)})} + \log{(1-D(G(z^{(i)})))}] Los valores se muestrean, se pasan a través del generador …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.