Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.




3
¿Cómo puedo calcular ?
Supongamos que es una muestra aleatoria de una función de distribución continua . Deje que sea ​​independiente de los 's. ¿Cómo puedo calcular ?Y1,…,Yn+1Y1,…,Yn+1Y_1,\dots,Y_{n+1}FFFX∼Uniform{1,…,n}X∼Uniform{1,…,n}X\sim\mathrm{Uniform}\{1,\dots,n\}YiYiY_iE[∑Xi=1I{Yi≤Yn+1}]E[∑i=1XI{Yi≤Yn+1}]\mathrm{E}\!\left[\sum _{i=1}^X I_{\{Y_i\leq Y_{n+1}\}}\right]




1
Codificación de características categóricas de alta cardinalidad (muchas categorías) cuando las características difieren mucho de la cardinalidad
He estado buscando preguntas sobre la codificación de características categóricas, pero no pude encontrar ninguna que discuta mi problema. Disculpas si me lo perdí. Digamos que tenemos un conjunto de datos con variables binarias y nominales de aproximadamente igual importancia cada una. La mayoría de los clasificadores no pueden ocuparse …





1
Expectativa condicional de una derivación de RV truncada, distribución de gumbel (diferencia logística)
Tengo dos variables aleatorias que son independientes e idénticamente distribuidas, es decir, :ϵ1,ϵ0∼iidGumbel(μ,β)ϵ1,ϵ0∼iidGumbel(μ,β)\epsilon_{1}, \epsilon_{0} \overset{\text{iid}}{\sim} \text{Gumbel}(\mu,\beta) F(ϵ)=exp(−exp(−ϵ−μβ)),F(ϵ)=exp⁡(−exp⁡(−ϵ−μβ)),F(\epsilon) = \exp(-\exp(-\frac{\epsilon-\mu}{\beta})), f(ϵ)=1βexp(−(ϵ−μβ+exp(−ϵ−μβ))).f(ϵ)=1βexp⁡(−(ϵ−μβ+exp⁡(−ϵ−μβ))).f(\epsilon) = \dfrac{1}{\beta}\exp(-\left(\frac{\epsilon-\mu}{\beta}+\exp(-\frac{\epsilon-\mu}{\beta})\right)). Estoy tratando de calcular dos cantidades: Eϵ1Eϵ0|ϵ1[c+ϵ1|c+ϵ1&gt;ϵ0]Eϵ1Eϵ0|ϵ1[c+ϵ1|c+ϵ1&gt;ϵ0]\mathbb{E}_{\epsilon_{1}}\mathbb{E}_{\epsilon_{0}|\epsilon_{1}}\left[c+\epsilon_{1}|c+\epsilon_{1}>\epsilon_{0}\right] Eϵ1Eϵ0|ϵ1[ϵ0|c+ϵ1&lt;ϵ0]Eϵ1Eϵ0|ϵ1[ϵ0|c+ϵ1&lt;ϵ0]\mathbb{E}_{\epsilon_{1}}\mathbb{E}_{\epsilon_{0}|\epsilon_{1}}\left[\epsilon_{0}|c+\epsilon_{1}<\epsilon_{0}\right] Llego a un punto en el que necesito hacer integración en algo de la forma: , que parece no tener …

1
Beneficios de SVM como herramienta para el reconocimiento de dígitos
Soy bastante nuevo en el reconocimiento de dígitos, y he notado que muchos tutoriales usan la clasificación SVM, por ejemplo: http://hanzratech.in/2015/02/24/handwritten-digit-recognition-using-opencv-sklearn-and-python.html http://scikit-learn.org/stable/auto_examples/classification/plot_digits_classification.html Me gustaría saber si hay algún beneficio (específico del dominio) para esa herramienta, en comparación con, por ejemplo, Redes neuronales de aprendizaje profundo Clasificación basada en k-means Gracias …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.