Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
Extracción automática de palabras clave: uso de similitudes de coseno como características
Tengo una matriz de términos de documentos , y ahora me gustaría extraer palabras clave para cada documento con un método de aprendizaje supervisado (SVM, Naive Bayes, ...). En este modelo, ya uso Tf-idf, etiqueta Pos, ...METROMETROM Pero ahora me pregunto sobre nexts. Tengo una matriz con las similitudes de …

1
Cómo interpretar la altura de la gráfica de densidad
¿Cómo debo interpretar las gráficas de altura de densidad? Por ejemplo, en la gráfica anterior, el pico es de aproximadamente 0.07 en x = 18. ¿Puedo inferir que alrededor del 7% de los valores son alrededor de 18? ¿Puedo ser más específico que eso? También hay un segundo pico en …

1
¿Cuándo debería preocuparme la paradoja de Jeffreys-Lindley en la elección del modelo bayesiano?
Estoy considerando un espacio grande (pero finito) de modelos de complejidad variable que exploro usando RJMCMC . Lo anterior en el vector de parámetros para cada modelo es bastante informativo. ¿En qué casos (si corresponde) debería preocuparme la paradoja de Jeffreys-Lindley que favorece modelos más simples cuando uno de los …


3
En cuanto a la convergencia en la probabilidad
Sea una secuencia de variables aleatorias st en probabilidad, donde es una constante fija. Estoy tratando de mostrar lo siguiente: y ambos con probabilidad. Estoy aquí para ver si mi lógica era sólida. Aquí esta mi trabajo{Xn}n≥1{Xn}n≥1\{X_n\}_{n\geq 1}Xn→aXn→aX_n \to aa>0a>0a>0Xn−−−√→a−−√Xn→a\sqrt{X_n} \to \sqrt{a}aXn→1aXn→1\frac{a}{X_n}\to 1 INTENTO Para la primera parte, tenemos Tenga …

1
Distribución aproximada del producto de N iid normal? Caso especial μ≈0
Dado iid X n ≈ N ( μ X , σ 2 X ) y μ X ≈ 0 , buscando:norte≥ 30N≥30N\geq30Xnorte≈ N( μX, σ2X)Xn≈N(μX,σX2)X_n\approx\mathcal{N}(\mu_X,\sigma_X^2)μX≈ 0μX≈0\mu_X \approx 0 aproximación precisa de distribución de forma cerrada de Ynorte= ∏1norteXnorteYN=∏1NXnY_N=\prod\limits_{1}^{N}{X_n} aproximación asintótica ( ¿ exponencial ?) del mismo producto Este es un …

1
¿Cuál es el nombre del método de estimación de densidad donde se usan todos los pares posibles para crear una distribución de mezcla Normal?
Acabo de pensar en una forma ordenada (no necesariamente buena) de crear estimaciones de densidad unidimensionales y mi pregunta es: ¿Este método de estimación de densidad tiene un nombre? Si no, ¿es un caso especial de algún otro método en la literatura? Aquí está el método: Tenemos un vector que …

1
Variación de la estadística
La de Cohen es una de las formas más comunes en que medimos el tamaño de un efecto ( ver Wikipedia ). Simplemente mide la distancia entre dos medias en términos de la desviación estándar agrupada. ¿Cómo podemos derivar la fórmula matemática de la estimación de la varianza de la …


3
Cuantificación de similitudes entre dos conjuntos de datos
Resumen : intentar encontrar el mejor método resume la similitud entre dos conjuntos de datos alineados con un solo valor. Detalles : Mi pregunta se explica mejor con un diagrama. Los gráficos a continuación muestran dos conjuntos de datos diferentes, cada uno con valores etiquetados nfy nr. Los puntos a …

2
¿Cómo calcular los pesos del criterio de Fisher?
Estoy estudiando reconocimiento de patrones y aprendizaje automático, y me encontré con la siguiente pregunta. Considere un problema de clasificación de dos clases con igual probabilidad de clase previaP(D1)=P(D2)=12P(D1)=P(D2)=12P(D_1)=P(D_2)= \frac{1}{2} y la distribución de instancias en cada clase dada por p(x|D1)=N([00],[2001]),p(x|D1)=N([00],[2001]), p(x|D_1)= {\cal N} \left( \begin{bmatrix} 0 \\0 \end{bmatrix}, \begin{bmatrix} …





Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.