Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
¿Por qué informar R al cuadrado?
Si la R al cuadrado ajustada es superior a la R al cuadrado, entonces, ¿por qué el software estadístico continúa informando esto último? ¿Hay algún tipo de situación en la que un investigador prefiera usar R al cuadrado en lugar de R al cuadrado ajustado?

2
¿Cómo se usa el teorema de Bayes con un previo continuo?
Si mi anterior se modela como una distribución de probabilidad continua, por ejemplo, una distribución beta sesgada para reflejar mi sesgo hacia ciertos modelos, ¿cómo puedo calcular la probabilidad posterior? El desafío para mí es calcular la probabilidad de un modelo dado, ya que la distribución continua solo me dará …
8 bayesian  prior 

4
¿Importa la no estacionariedad en logit / probit?
Me gustaría preguntar: estoy usando logit para investigar si algunas variables mejoran el riesgo de crisis monetarias. Tengo datos anuales de 1980 para muchos países (panel desequilibrado), la variable ficticia es 1 si comenzaron las crisis monetarias (según mi definición), 0 de lo contrario. Las variables explicativas están de acuerdo …
8 logit  probit 


1
Generando variables aleatorias binomiales con correlación dada
Supongamos que sé cómo generar variables aleatorias binomiales independientes. ¿Cómo puedo generar dos variables aleatorias?XXX y YYY tal que X∼Bin(8,23),Y∼Bin(18,23) and Corr(X,Y)=0.5X∼Bin(8,23),Y∼Bin(18,23) and Corr(X,Y)=0.5X\sim \text{Bin}(8,\dfrac{2}{3}),\quad Y\sim \text{Bin}(18,\dfrac{2}{3})\ \text{ and }\ \text{Corr}(X,Y)=0.5 Pensé en tratar de usar el hecho de que XXX y Y−ρXY−ρXY-\rho X son independientes donde ρ=Corr(X,Y)ρ=Corr(X,Y)\rho=Corr(X,Y) pero no …


1
Probabilidad de un par de valores consecutivos.
Permite donde y son independientes .X=(x1,x2,...x20)X=(x1,x2,...x20)X=(x_1, x_2,...x_{20})xi∼N(0,1)xi∼N(0,1)x_i\sim N(0,1)xi,xjxi,xjx_i, x_j∀i≠j∀i≠j\forall i\neq j ¿Cuál es la probabilidad de obtener una muestra donde hay al menos dos valores consecutivos y modo que ?XXXxixix_ixi+1xi+1x_{i+1}⎧⎩⎨|xi||xi+1|xixi+1&gt;&gt;&lt;1.51.50{|xi|&gt;1.5|xi+1|&gt;1.5xixi+1&lt;0 \begin{cases} |x_{i}| & > & 1.5 \\ |x_{i+1}| & > & 1.5 \\ x_i x_{i+1} & < & 0 \end{cases}

1
Modelo de aprendizaje automático "Exportar" de R
Puedo construir e implementar modelos clásicos de ML en conjuntos de entrenamiento / prueba tradicionales en R, pero ¿qué pasa si un socio quiere obtener este modelo para implementar su propio sistema (de cualquier tipo)? Guardar y enviar la estructura del modelo R no ayuda, por supuesto; y descubrir el …


2
¿Cómo se deriva la unidad softmax y cuál es la implicación?
Estoy tratando de entender por qué la función softmax se define como tal: mizjΣKk = 1mizk= σ(z)ezjΣk=1Kezk=σ(z)\frac{e^{z_{j}}} {\Sigma^{K}_{k=1}{e^{z_{k}}}} = \sigma(z) Entiendo cómo esto normaliza los datos y se asigna correctamente a algún rango (0, 1), pero la diferencia entre las probabilidades de peso varía exponencialmente en lugar de linealmente. ¿Hay …




1
Altura de una curva de distribución normal
Para una curva de distribución 'en forma de campana' normal, uno hubiera pensado que la altura debería tener un valor ideal. Conocer este valor puede ser un indicador rápido para verificar si los datos se distribuyen normalmente. Sin embargo, no pude encontrar su valor formal. En la mayoría de los …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.