Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


2
¿Qué significa exactamente la notación
¿Qué significa la notación ∼˙∼˙\dot\sim (punto sobre tilde), en el contexto como x∼˙N(0,1)x∼˙N(0,1)x \mathrel{\dot\sim} \mathcal N(0,1) ? Resulta que es más fácil encontrar cómo escribirlo correctamente: tex.SE explica que uno debe escribir en \mathrel{\dot\sim}lugar de simplemente \dot\simsolucionar el problema de espaciado, que encontrar lo que realmente significa. Solo se ha …

2
¿Cuál es la distribución de la cardinalidad de la intersección de muestras aleatorias independientes sin reemplazo?
SSS es un conjunto con elementos , y son enteros positivos fijos menores o iguales que .n∈Nn∈Nn\in\mathbb{N}a1,a2,...,ama1,a2,...,ama_1,a_2,...,a_mnnn Dado que los elementos de son igualmente probables, muestras se separado e independientemente de sin reemplazo, cuyo tamaño es , respectivamente.SSSmmmL1,L2,...,LmL1,L2,...,LmL_1, L_2,...,L_mSSSa1,a2,...,ama1,a2,...,ama_1,a_2,...,a_m La cardinalidad de la intersección de las muestrastiene, en general, soporte …

3
¿Cómo leer p, d y q de auto.arima ()?
¿Cómo puedo obtener p,d and qvalores en el ARIMA(p,d,q)modelo estimado por auto.arima(mytimeseries)? arima_model <- auto.arima (mytimeseries, ic = 'bic') Si nos fijamos en la salida de arima_model $ arma obtenemos, [1] 1 0 0 0 1 2 0 ¿Cuál es el significado de los números que aparecen en la secuencia …
10 r  arima 


3
¿Cuáles son los métodos estadísticos que puedo usar para encontrar combinaciones populares o comunes de variables categóricas?
Estoy haciendo un estudio sobre el uso de polidrogas. Tengo un conjunto de datos de 400 drogadictos, cada uno de los cuales declaró las drogas que abusan. Hay más de 10 medicamentos y, por lo tanto, hay grandes combinaciones posibles. He recodificado la mayoría de las drogas que consumen en …


1
¿Cómo kernelize un perceptrón simple?
Los problemas de clasificación con límites no lineales no se pueden resolver con un simple perceptrón . El siguiente código R tiene fines ilustrativos y se basa en este ejemplo en Python): nonlin <- function(x, deriv = F) { if (deriv) x*(1-x) else 1/(1+exp(-x)) } X <- matrix(c(-3,1, -2,1, -1,1, …




1
Al volver a parametrizar una función de probabilidad, ¿es suficiente conectar la variable transformada en lugar de una fórmula de cambio de variables?
Supongamos que estoy tratando de volver a parametrizar una función de probabilidad que se distribuye exponencialmente. Si mi función de probabilidad original es: p ( y∣ θ ) = θ e- θ yp(y∣θ)=θe−θy p(y \mid \theta) = \theta e^{-\theta y} y me gustaría volver a parametrizarlo usando , dado queθno …

4
Sobreajuste con clasificadores lineales
Hoy nuestro profesor declaró en clase que "no es posible sobreajustar con clasificadores lineales". Considero que eso es incorrecto, ya que incluso los clasificadores lineales pueden ser sensibles a los valores atípicos en el conjunto de entrenamiento; tomemos, por ejemplo, un margen duro. ¿O estoy equivocado? Obviamente, la linealidad probablemente …

2
RMSE (error cuadrático medio) para modelos logísticos
Tengo una pregunta sobre la validez del uso de RMSE (Root Mean Squared Error) para comparar diferentes modelos logísticos. La respuesta es bien 0o 1y las predicciones son las probabilidades entre 0- 1? ¿La forma aplicada a continuación también es válida con las respuestas binarias? # Using glmnet require(glmnet) load(url("https://github.com/cran/glmnet/raw/master …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.