Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


1
De HMM estándar a HMM bayesiano
Estoy tratando de entender cuál es la diferencia entre un HMM estándar y un HMM bayesiano. Wikipedia solo menciona brevemente cómo se ve el modelo, pero necesito un tutorial más detallado. ¿Alguien sabe de un documento o una implementación que pueda ver? También tengo problemas con la terminología utilizada. ¿Qué …






1
Sesgo variable omitido en regresión lineal
Tengo una pregunta filosófica con respecto al sesgo variable omitido. Tenemos el modelo de regresión típico (modelo de población) donde provienen las muestras , y luego un montón de condiciones por las cuales las estimaciones de OLS se comportan bastante bien.Y=β0+β1X1+...+βnXn+υ,Y=β0+β1X1+...+βnXn+υ, Y= \beta_0 + \beta_1X_1 + ... + \beta_nX_n + …





2
¿Cómo comparar estadísticamente dos algoritmos en tres conjuntos de datos en la selección y clasificación de características?
Antecedentes del problema: como parte de mi investigación, he escrito dos algoritmos que pueden seleccionar un conjunto de características de un conjunto de datos (datos de expresión génica de pacientes con cáncer). Estas características luego se prueban para ver qué tan bien pueden clasificar una muestra invisible como cancerosa o …

2
¿Qué tan importante es el conocimiento del dominio en nuestra profesión?
o: ¿Seleccionar un dominio al ingresar a un trabajo reduce sus opciones futuras para dominios y, por lo tanto, trabajos? Para hacer esta pregunta tan ampliamente aplicable como sea posible ... La profesión se refiere a todo tipo de analistas de datos, desde estadísticos sobre programadores de aprendizaje automático hasta …
8 careers 

2
Prueba post-hoc después de 2 factores repetidos medidas ANOVA en R?
Tengo problemas para encontrar una solución con respecto a cómo ejecutar una prueba post-hoc (Tukey HSD) después de un ANOVA de medidas repetidas de 2 factores (ambos dentro de los sujetos) en R. Para el ANOVA, he usado la función aov: summary(aov(dv ~ x1 * x2 + Error(subject/(x1*x2)), data=df1)) Después …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.