Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
Prueba T usando solo datos de resumen en un diagrama de caja
Tengo el resumen de 5 números (mínimo, Q1, Mediano, Q3, máximo) de dos diagramas de caja y quería probar si los promedios de los grupos en los dos diagramas de caja eran significativamente diferentes. Me gustaría hacer esto usando una prueba t, pero no tengo los datos disponibles (solo el …
8 t-test  boxplot 

2
OLS en términos de medias y tamaño de muestra
Dado un modelo: y=β0 0+β1⋅ f+ uy=β0 0+β1⋅F+tu y = \beta_0 + \beta_1 \cdot f + u Donde es ficticio si es hembra y caso contrario, y es altura en cm. El tamaño de la muestra es en total. Además y . Calcular las estimaciones de los parámetros.FFf= 1=1=10 00 …

2
Encuentre la distribución conjunta de y
Esta pregunta es de la Introducción a las estadísticas matemáticas de Robert Hogg, sexta versión, pregunta 7.6.7. El problema es : Deje que se tome una muestra aleatoria de tamaño de una distribución con el pdfnnnf(x;θ)=(1/θ)exp(−x/θ)I(0,∞)(x)f(x;θ)=(1/θ)exp⁡(−x/θ)I(0,∞)(x)f(x;\theta)=(1/\theta)\exp(-x/\theta)\mathbb{I}_{(0,\infty)}(x) Encuentre el MLE y el MVUE de .P(X≤2)P(X≤2)P(X \le 2) Sé cómo encontrar el …





2
¿Por qué agregar la penalización L1 a la optimización de R ralentiza tanto las cosas (en relación con ninguna penalización o L2)?
Estoy ejecutando algunas optimizaciones con la implementación de BFGS de optim. La función objetivo es en realidad un algoritmo computacional, no solo matemático. Descubrí que cuando agrego una penalización L1, las cosas se ralentizan bastante. ¿Por qué podría ser esto? ¿Hay algo en L1 que ralentiza las cosas? Entonces, ¿cómo …
8 r  optimization  lasso 


1
¿Qué matriz debe interpretarse en el análisis factorial: matriz de patrón o matriz de estructura?
Al hacer un análisis factorial (por factorización de eje principal, por ejemplo) o un análisis de componentes principales como análisis factorial, y haber realizado una rotación oblicua de las cargas, ¿qué matriz utiliza entonces para comprender qué elementos cargan en qué factores? e para interpretar los factores, ¿ matriz de …


1
CARRITO: ¿Selección del mejor predictor para dividir cuando las ganancias en la disminución de impurezas son iguales?
Mi pregunta trata sobre los árboles de clasificación . Considere el siguiente ejemplo del conjunto de datos de Iris: Quiero seleccionar manualmente el mejor predictor para la primera división. Según el algoritmo CART, la mejor característica para hacer una división es la que maximiza la disminución de la impureza de …




Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.