Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


3
¿Algoritmo de aprendizaje de conjunto de vanguardia en tareas de reconocimiento de patrones?
La estructura de esta pregunta es la siguiente: al principio, proporciono el concepto de aprendizaje en conjunto , luego proporciono una lista de tareas de reconocimiento de patrones , luego doy ejemplos de algoritmos de aprendizaje en conjunto y, finalmente, presento mi pregunta. Aquellos que no necesitan toda la información …

4
Concepto conjunto típico
Pensé que el concepto de conjunto típico era bastante intuitivo: una secuencia de longitud pertenecería al conjunto típico si la probabilidad de que la secuencia saliera fuera alta. Entonces, cualquier secuencia que probablemente esté en . (Estoy evitando la definición formal relacionada con la entropía porque estoy tratando de entenderla …


1
¿Tal cosa como una correlación ponderada?
Tengo algunos datos interesantes sobre los artistas musicales más populares transmitidos divididos por ubicación en unos 200 distritos del Congreso. Quiero ver si es posible sondear a una persona sobre sus preferencias musicales y determinar si él o ella "escucha como un demócrata" o "escucha como un republicano". (Naturalmente, esto …



2
Hamiltoniano monte carlo
¿Alguien puede explicar la idea principal detrás de los métodos hamiltonianos de Monte Carlo y en qué casos arrojarán mejores resultados que los métodos de Markov Chain Monte Carlo?
14 bayesian  mcmc  hmc 


2
Puntos de referencia de rendimiento para MCMC
¿Se han realizado estudios a gran escala de métodos MCMC que comparen el rendimiento de varios algoritmos diferentes en un conjunto de densidades de prueba? Estoy pensando en algo equivalente al artículo de Rios y Sahinidis (2013), que es una comparación exhaustiva de una gran cantidad de optimizadores de caja …

4
¿Por qué es ? (Una regresión lineal variable)
Nota: = Suma de cuadrados totales, = Suma de errores al cuadrado, y = Suma de cuadrados de la regresión. La ecuación en el título a menudo se escribe como:SSTSSTSSTSSESSESSESSRSSRSSR ∑i=1n(yi−y¯)2=∑i=1n(yi−y^i)2+∑i=1n(y^i−y¯)2∑i=1n(yi−y¯)2=∑i=1n(yi−y^i)2+∑i=1n(y^i−y¯)2\sum_{i=1}^n (y_i-\bar y)^2=\sum_{i=1}^n (y_i-\hat y_i)^2+\sum_{i=1}^n (\hat y_i-\bar y)^2 Pregunta bastante directa, pero estoy buscando una explicación intuitiva. Intuitivamente, me parece …



2
Cómo suavizar datos y forzar la monotonicidad
Tengo algunos datos que me gustaría suavizar para que los puntos suavizados disminuyan monotónicamente. Mis datos disminuyen bruscamente y luego comienzan a estabilizarse. Aquí hay un ejemplo usando R df <- data.frame(x=1:10, y=c(100,41,22,10,6,7,2,1,3,1)) ggplot(df, aes(x=x, y=y))+geom_line() ¿Cuál es una buena técnica de suavizado que podría usar? Además, sería bueno si …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.