Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
¿Por qué la familia exponencial no incluye todas las distribuciones?
Estoy leyendo el libro: Obispo, reconocimiento de patrones y aprendizaje automático (2006) que define la familia exponencial como distribuciones de la forma (Ec. 2.194): p(x|η)=h(x)g(η)exp{ηTu(x)}p(x|η)=h(x)g(η)exp⁡{ηTu(x)}p(\mathbf x|\boldsymbol \eta) = h(\mathbf x) g(\boldsymbol \eta) \exp \{\boldsymbol \eta^\mathrm T \mathbf u(\mathbf x)\} Pero no veo restricciones impuestas a o . ¿No significa esto …

2
¿Deben tomarse muestras de entrenamiento extraídas al azar para redes neuronales de entrenamiento de mini lotes sin reemplazo?
Definimos una época como haber pasado por la totalidad de todas las muestras de entrenamiento disponibles, y el tamaño del mini lote como el número de muestras sobre el que promediamos para encontrar las actualizaciones de pesos / sesgos necesarios para descender el gradiente. Mi pregunta es si deberíamos dibujar …




2
¿Ventajas de la optimización de enjambre de partículas sobre la optimización bayesiana para el ajuste de hiperparámetros?
Existe una importante investigación contemporánea sobre la optimización bayesiana (1) para ajustar los hiperparámetros ML. La motivación principal aquí es que se requiere un número mínimo de puntos de datos para tomar decisiones informadas sobre qué puntos vale la pena intentar (las llamadas a funciones objetivas son caras, por lo …

2
¿Se puede aplicar el descenso de gradiente a funciones no convexas?
Estoy aprendiendo sobre la optimización y tengo problemas para comprender la diferencia entre la optimización convexa y no convexa. Según tengo entendido, una función convexa es aquella en la que "el segmento de línea entre dos puntos cualquiera en el gráfico de la función se encuentra arriba o en el …




2
¿REML o ML para comparar dos modelos de efectos mixtos con diferentes efectos fijos, pero con el mismo efecto aleatorio?
Antecedentes: Nota: Mi conjunto de datos y mi código r se incluyen debajo del texto Deseo usar AIC para comparar dos modelos de efectos mixtos generados usando el paquete lme4 en R. Cada modelo tiene un efecto fijo y un efecto aleatorio. El efecto fijo difiere entre modelos, pero el …

5
¿ -squared tiene un valor ?
Parece que me he confundido tratando de entender si un valor de rrr cuadrado también tiene un valor de ppp . Según tengo entendido, en la correlación lineal con un conjunto de puntos de datos, puede tener un valor que varía de a y este valor, cualquiera que sea, puede …

4
¿Son sinónimos "muestra aleatoria" y "variable aleatoria iid"?
He tenido dificultades para comprender el significado de "muestra aleatoria", así como "variable aleatoria iid". Traté de encontrar el significado de varias fuentes, pero me confundí cada vez más. Estoy publicando aquí lo que probé y llegué a saber: Probabilidad y estadística de Degroot dice: Muestras aleatorias / iid / …


5
Variabilidad en los resultados de cv.glmnet
Estoy usando cv.glmnetpara encontrar predictores. La configuración que uso es la siguiente: lassoResults<-cv.glmnet(x=countDiffs,y=responseDiffs,alpha=1,nfolds=cvfold) bestlambda<-lassoResults$lambda.min results<-predict(lassoResults,s=bestlambda,type="coefficients") choicePred<-rownames(results)[which(results !=0)] Para asegurarse de que los resultados son reproducibles set.seed(1). Los resultados son muy variables. Ejecuté exactamente el mismo código 100 para ver qué tan variables fueron los resultados. En las ejecuciones 98/100 siempre …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.