Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

3
¿Por qué la traza de
En el modelo y=Xβ+ϵy=Xβ+ϵ{y} = X \beta + \epsilon , podríamos estimar ββ\beta utilizando la ecuación normal: β^=(X′X)−1X′y,β^=(X′X)−1X′y,\hat{\beta} = (X'X)^{-1}X'y,y podríamos obtener y =X β .y^=Xβ^.y^=Xβ^.\hat{y} = X \hat{\beta}. El vector de residuos se estima por ϵ^=y−Xβ^=(I−X(X′X)−1X′)y=Qy=Q(Xβ+ϵ)=Qϵ,ϵ^=y−Xβ^=(I−X(X′X)−1X′)y=Qy=Q(Xβ+ϵ)=Qϵ,\hat{\epsilon} = y - X \hat{\beta} = (I - X (X'X)^{-1} X') y = …








3
¿Por qué la eficiencia relativa asintótica de la prueba de Wilcoxon
Es bien sabido que la eficiencia relativa asintótica (ARE) de la prueba de rango con signo de Wilcoxon es 3π≈0.9553π≈0.955\frac{3}{\pi} \approx 0.955comparación con lapruebat deStudent, si los datos se obtienen de una población distribuida normalmente. Esto es cierto tanto para la prueba básica de una muestra como para la variante …



5
¿Cómo puedo lidiar mejor con los efectos de los marcadores con diferentes niveles de generosidad en la calificación de los documentos de los estudiantes?
Alrededor de 600 estudiantes tienen un puntaje en una evaluación extensa, que se puede suponer que tiene buena fiabilidad / validez. La evaluación se califica entre 100 y es una prueba de opción múltiple marcada por computadora. Esos 600 estudiantes también tienen puntajes en una segunda evaluación menor. En esta …

5
¿Cómo dedico las series temporales?
¿Cómo detrendo series de tiempo? ¿Está bien tomar la primera diferencia y ejecutar una prueba de Dickey Fuller, y si es estacionaria, estamos bien? También descubrí en línea que puedo eliminar la tendencia de las series de tiempo haciendo esto en Stata: reg lncredit time predict u_lncredit, residuals twoway line …


1
¿Por qué no usar siempre el aprendizaje conjunto?
Me parece que el aprendizaje conjunto siempre dará un mejor rendimiento predictivo que con una sola hipótesis de aprendizaje. Entonces, ¿por qué no los usamos todo el tiempo? ¿Mi conjetura es quizás debido a limitaciones computacionales? (incluso entonces, usamos predictores débiles, así que no lo sé).

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.