Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
¿A qué nivel es una prueba
ANTECEDENTES: Salte con seguridad: está aquí como referencia y para legitimar la pregunta. La apertura de este documento dice: "Famosa prueba de contingencia chi-cuadrado de Karl Pearson se deriva de otra estadística, llamada la estadística z, basado en la distribución Normal. Las versiones más simples de χ2χ2\chi^2 se pueden demostrar …




7
¿Qué hiciste / hiciste para recordar la regla de Bayes?
Creo que una buena manera de recordar la fórmula es pensar en la fórmula de esta manera: La probabilidad de que algún evento A tenga un resultado particular dado un resultado independiente del evento B = la probabilidad de que ambos resultados ocurran simultáneamente / lo que digamos, la probabilidad …
15 bayesian  bayes 

4
Minería de texto: ¿cómo agrupar textos (por ejemplo, artículos de noticias) con inteligencia artificial?
He construido algunas redes neuronales (MLP (completamente conectadas), Elman (recurrente)) para diferentes tareas, como jugar Pong, clasificar dígitos escritos a mano y otras cosas ... Además, intenté construir algunas primeras redes neuronales convolucionales, por ejemplo, para clasificar notas manuscritas de varios dígitos, pero soy completamente nuevo para analizar y agrupar …


1
Regularización para modelos ARIMA
Soy consciente del tipo de regularización LASSO, cresta y red elástica en modelos de regresión lineal. Pregunta: ¿Se puede aplicar este tipo (o similar) de estimación penalizada al modelado ARIMA (con una parte MA no vacía)? En la construcción de modelos ARIMA, parece habitual considerar un orden de retraso máximo …

1
¿Cómo responder a los revisores que solicitan valores p en el modelo multinivel bayesiano?
Un revisor nos pidió que proporcionáramos valores p para comprender mejor las estimaciones del modelo en nuestro modelo bayesiano multinivel. El modelo es un modelo típico de múltiples observaciones por participante en un experimento. Estimamos el modelo con Stan, por lo que podemos calcular fácilmente estadísticas posteriores adicionales. Actualmente, estamos …


1
¿El bosque aleatorio de Breiman utiliza la ganancia de información o el índice de Gini?
Me gustaría saber si el bosque aleatorio de Breiman (bosque aleatorio en el paquete R randomForest) usa como criterio de división (criterio para la selección de atributos) la ganancia de información o el índice de Gini. Traté de encontrarlo en http://www.stat.berkeley.edu/~breiman/RandomForests/cc_home.htm y en la documentación del paquete randomForest en R. …


1
Aclaración sobre la implementación de la regla de Perceptron vs. el descenso del gradiente vs. el descenso del gradiente estocástico
Experimenté un poco con diferentes implementaciones de Perceptron y quiero asegurarme de entender las "iteraciones" correctamente. La regla original del perceptrón de Rosenblatt Según tengo entendido, en el clásico algoritmo perceptrón de Rosenblatt, los pesos se actualizan simultáneamente después de cada ejemplo de entrenamiento a través de Δw(t+1)=Δw(t)+η(target−actual)xiΔw(t+1)=Δw(t)+η(target−actual)xi\Delta{w}^{(t+1)} = \Delta{w}^{(t)} …


2
Crear un solo índice a partir de varios componentes principales o factores retenidos de PCA / FA
Estoy usando el Análisis de componentes principales (PCA) para crear un índice requerido para mi investigación. Mi pregunta es cómo debo crear un índice único utilizando los componentes principales retenidos calculados a través de PCA. Por ejemplo, decidí retener 3 componentes principales después de usar PCA y calculé los puntajes …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.