Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


2
La prueba
Acabo de leer en una revista científica bastante respetada (popular) (PM alemán, 02/2013, p.36) sobre un experimento interesante (sin una fuente, desafortunadamente). Me llamó la atención porque intuitivamente dudé de la importancia del resultado, pero la información proporcionada fue suficiente para reproducir las pruebas estadísticas. Los investigadores se preguntaron si …



1
Ratio de probabilidades vs ratio de PDF
Estoy usando Bayes para resolver un problema de agrupamiento. Después de hacer algunos cálculos termino con la necesidad de obtener la razón de dos probabilidades: P(A)/P(B)P(A)/P(B)P(A)/P(B) para poder obtener . Estas probabilidades se obtienen mediante la integración de dos KDE multivariados 2D diferentes como se explica en esta respuesta :P(H|D)P(H|D)P(H|D) …


10
Palabras comunes que tienen significados estadísticos particulares
No soy estadístico, pero mi trabajo de investigación involucra estadísticas (análisis de datos, lectura de literatura, etc.). Una vez más, un comentario sobre una de mis preguntas publicado aquí me recordó que hay algunas palabras comunes que tienen significados o connotaciones particularmente específicas para aquellos que tienen una buena práctica …

2
¿MLE siempre significa que conocemos el PDF subyacente de nuestros datos, y EM significa que no?
Tengo algunas preguntas conceptuales simples que me gustaría aclarar con respecto a MLE (Estimación de máxima verosimilitud), y qué vínculo tiene, si lo hay, con EM (Maximización de expectativas). Según tengo entendido, si alguien dice "Usamos el MLE", ¿significa eso automáticamente que tienen un modelo explícito del PDF de sus …

2
Intuición detrás de la función de densidad de distribuciones t
Estoy estudiando sobre la distribución t de Student y comencé a preguntarme cómo derivaría la función de densidad de distribuciones t (de wikipedia, http://en.wikipedia.org/wiki/Student%27s_t-distribution ): f(t)=Γ(v+12)vπ−−√Γ(v2)(1+t2v)−v+12f(t)=Γ(v+12)vπΓ(v2)(1+t2v)−v+12f(t) = \frac{\Gamma(\frac{v+1}{2})}{\sqrt{v\pi}\:\Gamma(\frac{v}{2})}\left(1+\frac{t^2}{v} \right)^{-\frac{v+1}{2}} donde es los grados de libertad y \ Gamma es la función gamma. ¿Cuál es la intuición de esta función? Quiero …



2
¿Por qué algunas personas prueban los supuestos del modelo similar a la regresión en sus datos sin procesar y otras personas los prueban en el residual?
Soy un estudiante de doctorado en psicología experimental y me esfuerzo por mejorar mis habilidades y conocimientos sobre cómo analizar mis datos. Hasta mi quinto año en psicología, pensé que los modelos de regresión (por ejemplo, ANOVA) suponen lo siguiente: normalidad de los datos homogeneidad de varianza para los datos, …




Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.