Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.



3
¿Cómo comunicar mejor la incertidumbre?
Un problema enorme en la comunicación de los resultados de los cálculos estadísticos a los medios y al público es cómo comunicamos la incertidumbre. Ciertamente, a la mayoría de los medios de comunicación parece gustarles un número duro y rápido, aunque, salvo en un número relativamente pequeño de casos, los …

2
Volumen de tiempo correlacionado
Considere el siguiente gráfico: La línea roja (eje izquierdo) describe el volumen de negociación de una determinada acción. La línea azul (eje derecho) describe el volumen del mensaje de Twitter para ese stock. Por ejemplo, el 9 de mayo (05-09) se realizaron 1.100 millones de intercambios y 4.000 tweets. Me …


1
Estimando la distribución a partir de datos
Tengo una muestra de datos generados Rpor rnorm(50,0,1), por lo que los datos obviamente adquieren una distribución normal. Sin embargo, Rno "conoce" esta información de distribución sobre los datos. ¿Existe algún método Rque pueda estimar de qué tipo de distribución proviene mi muestra? Si no, usaré la shapiro.testfunción y procederé …
12 r  distributions 

2
¿Cuándo usar bootstrap vs. técnica bayesiana?
Tengo un problema de análisis de decisiones bastante complicado que involucra pruebas de confiabilidad y el enfoque lógico (para mí) parece involucrar el uso de MCMC para soportar un análisis bayesiano. Sin embargo, se ha sugerido que sería más apropiado utilizar un enfoque de arranque. ¿Podría alguien sugerir una referencia …


3
¿Cuáles son las distribuciones en el cuadrante k-dimensional positivo con matriz de covarianza parametrizable?
Siguiendo la pregunta de zzk sobre su problema con las simulaciones negativas, me pregunto cuáles son las familias parametrizadas de distribuciones en el cuadrante k-dimensional positivo, para el cual se puede establecer la matriz de covarianza .Rk+R+k\mathbb{R}_+^kΣΣ\Sigma Como se discutió con zzk , comenzar desde una distribución en y aplicar …

2
Modelo bayesiano jerárquico (?)
Disculpe mi carnicería de jerga estadística :) Aquí he encontrado un par de preguntas relacionadas con la publicidad y las tasas de clics. Pero ninguno de ellos me ayudó mucho con mi comprensión de mi situación jerárquica. Hay una pregunta relacionada ¿Son estas representaciones equivalentes del mismo modelo jerárquico bayesiano? …

2
Analizando coeficientes de regresión logística
Aquí hay una lista de coeficientes de regresión logística (el primero es una intersección) -1059.61966694592 -1.23890500515482 -8.57185269220438 -7.50413155570413 0 1.03152408392552 1.19874787949191 -4.88083274930613 -5.77172565873336 -1.00610998453393 Me resulta extraño que la intersección sea tan baja y tengo un coeficiente que en realidad es igual a 0. No estoy completamente seguro de cómo …


1
Paquetes de Python para trabajar con modelos de mezcla gaussianos (GMM)
Parece que hay varias opciones disponibles para trabajar con Gaussian Mixture Models (GMM) en Python. A primera vista hay al menos: PyMix - http://www.pymix.org/pymix/index.php Herramientas para modelar mezclas PyEM: http://www.ar.media.kyoto-u.ac.jp/members/david/softwares/em/ que forma parte de la caja de herramientas de Scipy y parece centrarse en la actualización de GMM : ahora …



Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.