Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


3
¿Por qué centrar variables independientes puede cambiar los efectos principales con moderación?
Tengo una pregunta relacionada con la regresión múltiple y la interacción, inspirada en este hilo CV: ¿ Término de interacción usando el análisis de regresión jerárquica de variables centradas? ¿Qué variables debemos centrar? Al verificar un efecto de moderación, centro mis variables independientes y multiplico las variables centradas para calcular …



2
¿Por qué se distribuye RSS chi square times np?
Me gustaría entender por qué, bajo el modelo OLS, el RSS (suma residual de cuadrados) se distribuye ( es el número de parámetros en el modelo, el número de observaciones).χ2⋅(n−p)χ2⋅(n−p)\chi^2\cdot (n-p)pppnnn Pido disculpas por hacer una pregunta tan básica, pero parece que no puedo encontrar la respuesta en línea (o …

3
¿Cómo lidiar con la multicolinealidad al realizar la selección de variables?
Tengo un conjunto de datos con 9 variables independientes continuas. Estoy tratando de seleccionar entre estas variables para ajustar un modelo a una sola variable de porcentaje (dependiente) Score. Desafortunadamente, sé que habrá una colinealidad seria entre varias de las variables. Intenté usar la stepAIC()función en R para la selección …





4
¿Cómo es posible que la pérdida de validación aumente mientras que la precisión de validación también aumenta?
Estoy entrenando una red neuronal simple en el conjunto de datos CIFAR10. Después de un tiempo, la pérdida de validación comenzó a aumentar, mientras que la precisión de la validación también está aumentando. La pérdida de prueba y la precisión de la prueba continúan mejorando. ¿Cómo es esto posible? Parece …


7
En Naive Bayes, ¿por qué molestarse con el suavizado de Laplace cuando tenemos palabras desconocidas en el conjunto de prueba?
Estaba leyendo sobre la clasificación Naive Bayes hoy. Leí, bajo el encabezado de Estimación de parámetros con agregar 1 suavizado : Deje que refiera a una clase (como Positivo o Negativo), y deje que refiera a una ficha o palabra.cccwww El estimador de máxima verosimilitud para esP(w|c)P(w|c)P(w|c)count(w,c)count(c)=counts w in class …



Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.