Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


7
Problema de dos sobres revisitado
Estaba pensando en este problema. http://en.wikipedia.org/wiki/Two_envelopes_problem Creo en la solución y creo que la entiendo, pero si adopto el siguiente enfoque, estoy completamente confundido. Problema 1: Te ofreceré el siguiente juego. Me pagas $ 10 y lanzaré una moneda justa. Cara te doy $ 5 y Tails te doy $ …

1
Suficiente estadística, problemas específicos / intuitivos
Me estoy enseñando algunas estadísticas para divertirme y tengo cierta confusión con respecto a estadísticas suficientes . Escribiré mis confusiones en formato de lista: Si una distribución tiene parámetros, ¿tendrá n estadísticas suficientes?nnnnnn ¿Existe algún tipo de correspondencia directa entre las estadísticas suficientes y los parámetros? O las estadísticas suficientes …


2
Selección de características con bosques aleatorios
Tengo un conjunto de datos con variables financieras en su mayoría (120 características, ejemplos de 4k) que en su mayoría están altamente correlacionadas y son muy ruidosas (indicadores técnicos, por ejemplo), por lo que me gustaría seleccionar un máximo de 20-30 para su uso posterior con entrenamiento modelo (clasificación binaria …






2
SVM de una clase versus SVM ejemplar
Entiendo que los SVM de una clase (OSVM) se propusieron con la ausencia de datos negativos en mente y que buscan encontrar límites de decisión que separen un conjunto positivo y algún punto de anclaje negativo, digamos el origen. Un trabajo en 2011 propone SVM Ejemplares (ESVM) que entrena a …

3
Cholesky versus descomposición propia para extraer muestras de una distribución normal multivariante
Me gustaría dibujar una muestra x∼N(0,Σ)x∼N(0,Σ)\mathbf{x} \sim N\left(\mathbf{0}, \mathbf{\Sigma} \right) . Wikipedia sugiere usar una descomposición de Cholesky o Eigen , es decir, Σ=D1DT1Σ=D1D1T \mathbf{\Sigma} = \mathbf{D}_1\mathbf{D}_1^T o Σ=QΛQTΣ=QΛQT \mathbf{\Sigma} = \mathbf{Q}\mathbf{\Lambda}\mathbf{Q}^T Y por lo tanto, la muestra se puede extraer mediante: x=D1vx=D1v \mathbf{x} = \mathbf{D}_1 \mathbf{v} o x=QΛ−−√vx=QΛv \mathbf{x} …


2
Confusión con la prueba Dickey Fuller aumentada
Estoy trabajando en el conjunto de datos electricitydisponibles en el paquete R TSA. Mi objetivo es averiguar si un arimamodelo será apropiado para estos datos y, finalmente, ajustarlo. Así que procedí de la siguiente manera: primero: trazar la serie de tiempo que resultó si el siguiente gráfico: segundo: quería tomar …

2
Lenguaje R cuál es la diferencia entre rnorm y runif [cerrado]
Cerrado. Esta pregunta está fuera de tema . Actualmente no está aceptando respuestas. ¿Quieres mejorar esta pregunta? Actualice la pregunta para que esté en el tema de Cross Validated. Cerrado hace 6 años . ¿Cuál es la diferencia entre las funciones rnormy runifen R?
16 r 

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.