Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
Conjuntos de datos de juegos de computadora
He estado buscando conjuntos de datos de juegos de computadora, pero hasta ahora solo he podido encontrar el conjunto de datos 'Historial de Avatar' para WoW. ¿Existen otros conjuntos de datos interesantes, posiblemente para otros géneros?


1
¿Cómo calcular la matriz del sombrero para la regresión logística en R?
Quiero calcular la matriz de sombreros directamente en R para un modelo logit. Según Long (1997), la matriz de sombreros para los modelos logit se define como: H=VX(X′VX)−1X′VH=VX(X′VX)−1X′VH = VX(X'VX)^{-1} X'V X es el vector de variables independientes, y V es una matriz diagonal con en la diagonal.π(1−π)−−−−−−−√π(1−π)\sqrt{\pi(1-\pi)} Utilizo la …
8 r  logistic  deviance 

2
Evaluación de la multicolinealidad de las variables predictoras dicotómicas
Estoy trabajando en un proyecto donde observamos el comportamiento en una tarea (por ejemplo, tiempo de respuesta) y modelamos este comportamiento en función de varias variables manipuladas experimentalmente, así como varias variables observadas (sexo del participante, coeficiente intelectual del participante, respuestas en un seguimiento) cuestionario). No me preocupa la multicolinealidad …





1
Bayesiana vs máxima entropía
Suponga que la cantidad que queremos inferir es una distribución de probabilidad. Todo lo que sabemos es que la distribución proviene de un conjunto determinado, por ejemplo, por algunos de sus momentos y tenemos una previa .mimiEQQQ El principio de entropía máxima (MEP) dice que que tiene la entropía menos …


3
Distancia de Mahalanobis entre dos distribuciones bivariadas con diferentes covarianzas
La pregunta está más o menos contenida en el título. ¿Cuál es la distancia de Mahalanobis para dos distribuciones de diferentes matrices de covarianza? Lo que he encontrado hasta ahora supone la misma covarianza para ambas distribuciones, es decir, algo de este tipo: ΔTΣ−1ΔΔTΣ−1Δ\Delta^T \Sigma^{-1} \Delta ¿Qué pasa si tengo …

1
Regresión múltiple con pequeños conjuntos de datos.
Tengo un conjunto de datos de estudios de casos de proyectos para un nuevo tipo de método de investigación para que las agencias gubernamentales apoyen las actividades de toma de decisiones. Mi tarea es desarrollar un método de estimación basado en la experiencia pasada para proyectos futuros con fines de …

1
Distribución de la correlación muestral
Supongamos que tengo una gran población de puntos de datos y que la correlación de Pearson es( x , y)(X,y)(x,y) corr (X, Y) = ρcorr(X,Y)=ρ\textrm{corr}(X,Y) = \rho ¿Qué puedo decir razonablemente sobre la correlación que espero observar en una muestra de tamaño ? Si la correlación de la muestra es …

2
¿Se puede usar Cohen's Kappa solo para dos juicios?
Estoy usando el Kappa de Cohen para calcular el acuerdo entre dos jueces. Se calcula como: P(A)−P(E)1−P(E)P(A)−P(E)1−P(E) \frac{P(A) - P(E)}{1 - P(E)} donde es la proporción de acuerdo y la probabilidad de acuerdo por casualidad.P(A)P(A)P(A)P(E)P(E)P(E) Ahora para el siguiente conjunto de datos, obtengo los resultados esperados: User A judgements: - …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.