Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.






3
Modelos de apilamiento / ensamblaje con caret
A menudo me encuentro entrenando varios modelos predictivos diferentes usando careten R. Los entrenaré a todos en los mismos pliegues de validación cruzada, usando caret::: createFolds, luego elegiré el mejor modelo basado en un error de validación cruzada. Sin embargo, la predicción mediana de varios modelos a menudo supera al …
21 r  caret  ensemble 




4
¿Diferencia entre análisis de regresión y análisis de varianza?
Esta pregunta se migró de Mathematics Stack Exchange porque se puede responder en Cross Validated. Migrado hace 7 años . Ahora mismo estoy aprendiendo sobre el análisis de regresión y el análisis de varianza. En el análisis de regresión, tiene una variable fija y desea saber cómo va la variable …
21 regression 


3
Primer paso para big data ( , )
Suponga que está analizando un gran conjunto de datos con miles de millones de observaciones por día, donde cada observación tiene un par de miles de variables numéricas y categoriales dispersas y posiblemente redundantes. Digamos que hay un problema de regresión, un problema de clasificación binaria desequilibrada y una tarea …


1
¿Cuándo los campos aleatorios de Markov
En su libro de texto, Modelos gráficos, familias exponenciales e inferencia variacional , M. Jordan y M. Wainwright discuten la conexión entre las familias exponenciales y los campos aleatorios de Markov (modelos gráficos no dirigidos). Estoy tratando de entender mejor la relación entre ellos con las siguientes preguntas: ¿Todos los …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.