Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


6
¿Cómo agrupar / estandarizar variables en R?
Bloqueado . Esta pregunta y sus respuestas están bloqueadas porque la pregunta está fuera de tema pero tiene un significado histórico. Actualmente no acepta nuevas respuestas o interacciones. Las funciones con las que estoy familiarizado incluyen escalar desde la base R, reescalar desde ARM. Quizás la mejor manera sería usar …

1
¿Cómo interpretar los valores p de 0 o 1?
Ejecuté un ANOVA encontrando, por ejemplo, una interacción entre género y grado de la que quiero saber en qué grados difieren los niños y las niñas, pero en muchos casos encuentro valores p (ajustados) de 0 y 1. ¿Cómo / por qué es esto posible? No parece correcto ... as.factor(gender) …
9 r 

3
¿Pueden los efectos aleatorios aplicarse solo a variables categóricas?
Estas preguntas pueden sonar estúpidas, pero ... ¿ es correcto que los efectos aleatorios solo puedan aplicarse a variables categóricas (como identificación individual, identificación de población, ...), por ejemplo, digamos que es una variable categórica:xixix_i yiyiy_i ~βxiβxi\beta_{x_i} βxiβxi\beta_{x_i} ~Norm(μ,δ2)Norm(μ,δ2)Norm(\mu, \delta^2) pero desde el principio el efecto aleatorio no puede aplicarse …


3
¿Cómo puedo simular microdatos censales para áreas pequeñas usando una muestra de microdatos al 1% a gran escala y estadísticas agregadas a escala de área pequeña?
Me gustaría realizar un análisis multivariado a nivel individual en pequeños niveles de agregación geográfica (distritos de recolección de censo de Australia). Claramente, el censo no está disponible en estos pequeños niveles de agregación por razones de privacidad, por lo que estoy investigando otras alternativas. Casi todas las variables de …





2
¿Esta distribución tiene un nombre? ¿O qué es un proceso estocástico que podría generarlo?
Una distribución discreta con función de masa. p(x;k)=k(x+k)(x+k−1),x=1,2,…p(x;k)=k(x+k)(x+k−1),x=1,2,…p(x;k) = \frac{k}{(x+k)(x+k-1)},\quad x = 1,2,\ldots surge en la página 9 de este documento . Para es una distribución de Yule-Simon con , pero no he encontrado ningún otro ejemplo.k=1k=1k=1ρ=1ρ=1\rho=1 Eso tiene un nombre? ¿Aparece en algún otro contexto? ¿Existe un proceso estocástico …

2
Regresión logística ponderada de casos
Estoy viendo algunos problemas de regresión logística. ("regular" y "condicional"). Idealmente, me gustaría ponderar cada uno de los casos de entrada para que la glm se centre más en predecir correctamente los casos con mayor ponderación a expensas de posiblemente clasificar erróneamente los casos con menor ponderación. Seguramente esto ya …
9 logistic 


2
¿Una distancia tiene que ser una "métrica" ​​para que una agrupación jerárquica sea válida en ella?
Digamos que definimos una distancia, que no es una métrica , entre N elementos. En base a esta distancia, usamos un agrupamiento jerárquico aglomerativo . ¿Podemos usar cada uno de los algoritmos conocidos (enlace único / máximo / promedio, etc.) para obtener resultados significativos? O dicho de otra manera, ¿cuál …

2
Distribución de la desviación estándar.
Esta pregunta abordó la distribución normal, pero me pregunto qué se sabe sobre la distribución de la desviación estándar de una muestra de tamaño n extraída de una distribución arbitraria. En particular, ¿cuál es la desviación estándar de la desviación estándar? Para una distribución normal, el sd del sd es …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.