Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
Análisis residual de regresión logística.
Esta pregunta es algo general y de largo aliento, pero por favor tengan paciencia conmigo. En mi aplicación, tengo muchos conjuntos de datos, cada uno con ~ 20,000 puntos de datos con ~ 50 características y una sola variable binaria dependiente. Estoy intentando modelar los conjuntos de datos usando regresión …

6
Si usa una estimación puntual que maximiza , ¿qué dice eso sobre su filosofía? (Frecuente o bayesiano o algo más?)
Si alguien dijera "Ese método utiliza el MLE, la estimación puntual para el parámetro que maximiza , por lo tanto, es frecuentista; y además no es bayesiano".P ( x | θ )P(x|θ)\mathrm{P}(x|\theta) estarías de acuerdo? Actualización sobre los antecedentes : Hace poco leí un artículo que dice ser frecuente. No …

2
¿Cómo simular datos funcionales?
Estoy tratando de probar varios enfoques de análisis de datos funcionales. Idealmente, me gustaría probar el panel de enfoques que tengo sobre datos funcionales simulados. Intenté generar FD simulada utilizando un enfoque basado en un ruido gaussiano sumador (código a continuación), pero las curvas resultantes se ven demasiado resistentes en …


1
¿Cómo generar predicciones con rjags?
He usado rjags para ejecutar MCMC en un modelo, especificado en el lenguaje JAGS. ¿Hay una buena manera de extraer ese modelo y realizar predicciones con él (usando las distribuciones posteriores de mis parámetros)? Puedo volver a especificar el modelo en R y conectar los modos de mis parámetros posteriores; …
12 r  jags 

2
Determinar automáticamente la distribución de probabilidad dado un conjunto de datos
Dado un conjunto de datos: x <- c(4.9958942,5.9730174,9.8642732,11.5609671,10.1178216,6.6279774,9.2441754,9.9419299,13.4710469,6.0601435,8.2095239,7.9456672,12.7039825,7.4197810,9.5928275,8.2267352,2.8314614,11.5653497,6.0828073,11.3926117,10.5403929,14.9751607,11.7647580,8.2867261,10.0291522,7.7132033,6.3337642,14.6066222,11.3436587,11.2717791,10.8818323,8.0320657,6.7354041,9.1871676,13.4381778,7.4353197,8.9210043,10.2010750,11.9442048,11.0081195,4.3369520,13.2562675,15.9945674,8.7528248,14.4948086,14.3577443,6.7438382,9.1434984,15.4599419,13.1424011,7.0481925,7.4823108,10.5743730,6.4166006,11.8225244,8.9388744,10.3698150,10.3965596,13.5226492,16.0069239,6.1139247,11.0838351,9.1659242,7.9896031,10.7282936,14.2666492,13.6478802,10.6248561,15.3834373,11.5096033,14.5806570,10.7648690,5.3407430,7.7535042,7.1942866,9.8867927,12.7413156,10.8127809,8.1726772,8.3965665) .. Me gustaría determinar la distribución de probabilidad más adecuada (gamma, beta, normal, exponencial, poisson, chi-cuadrado, etc.) con una estimación de los parámetros. Ya estoy al tanto de la pregunta en el siguiente enlace, donde se proporciona una solución usando R: /programming/2661402/given-a-set-of-random-numbers-drawn-from-a- …




1




1
¿Por qué cuadrar da la varianza explicada?
Esta puede ser una pregunta básica, pero me preguntaba ¿por qué un valor en un modelo de regresión puede simplemente cuadrarse para dar una cifra de varianza explicada?RRR Entiendo que el coeficiente puede dar la fuerza de una relación, pero no entiendo cómo simplemente elevar al cuadrado este valor da …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.