Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
Objeciones a la aleatorización
En Ensayos clínicos: una perspectiva metodológica , Steven Piantadosi escribe (cap.13, p. 334): En el Capítulo 2, noté las objeciones a la aleatorización de Abel y Koch (1997) y Urbach (1993), e indiqué el valor de estudiar sus preocupaciones y posibles errores. Rechazan la aleatorización como un significa validar ciertas …



1
vcovHC, vcovHAC, NeweyWest: ¿qué función utilizar?
Estoy tratando de actualizar mi modelo basado en lm () para obtener errores y pruebas estándar correctos. Estoy realmente confundido qué matriz de VC usar. El sandwichpaquete ofrece vcovHC, vcovHACy NeweyWest. Mientras que el primero solo explica la heterocedasticidad, los dos últimos explican tanto la correlación serial como la heterocedasticidad. …

1
Filtro de Kalman vs. alisar splines
P: ¿Para qué datos es apropiado usar modelado de espacio de estado y filtrado de Kalman en lugar de suavizar splines y viceversa? ¿Hay alguna relación de equivalencia entre los dos? Estoy tratando de obtener una comprensión de alto nivel de cómo encajan estos métodos. Hojeé la nueva Estimación gaussiana …


3
Regresión lineal con factores en R
Estoy tratando de entender cómo funcionan exactamente los factores en R. Digamos que quiero ejecutar una regresión usando algunos datos de muestra en R: > data(CO2) > colnames(CO2) [1] "Plant" "Type" "Treatment" "conc" "uptake" > levels(CO2$Type) [1] "Quebec" "Mississippi" > levels(CO2$Treatment) [1] "nonchilled" "chilled" > lm(uptake ~ Type + Treatment, …





4
Buen libro sobre enfoque teórico de la estadística.
Cuando tomé cursos de estadística teórica como estudiante universitario hace 10 años, utilizamos las estadísticas matemáticas modernas de Dudewicz y Mishra. Me encuentro refiriéndome al libro ahora y recuerdo que algunos de los ejemplos de código están ensamblados para un IBM 370. Aunque es curioso, no puedo evitar sentir que …
10 references 

2
Si se debe usar una compensación en una regresión de Poisson al predecir los objetivos profesionales totales anotados por los jugadores de hockey
Tengo una pregunta sobre si usar o no un desplazamiento. Suponga un modelo muy fácil, donde desea describir el número (general) de goles en el hockey. Entonces tienes goles, número de juegos jugados y un "delantero" ficticio variable que es igual a 1 si el jugador es delantero y 0 …

2
Izquierda sesgada vs. distribución simétrica observada
Esto es bastante difícil de describir para mí, pero intentaré que mi problema sea comprensible. Primero, debes saber que hasta ahora he hecho una regresión lineal muy simple. Antes de calcular el coeficiente, observé la distribución de mi . Es pesado dejado sesgado. Después de estimar el modelo, estaba bastante …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.