Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.


4
Intuición detrás de la distribución de la ley de poder
Sé que el pdf de una distribución de la ley de potencia esp ( x ) = α - 1Xmin( xXmin)- αpag(X)=α-1Xmin(XXmin)-α p(x) = \frac{\alpha-1}{x_{\text{min}}} \left(\frac{x}{x_{\text{min}}} \right)^{-\alpha} Pero, ¿qué significa intuitivamente si, por ejemplo, los precios de las acciones siguen una distribución de la ley de poder? ¿Significa esto que …

6
¿Dónde encontrar un corpus de texto grande? [cerrado]
Cerrado. Esta pregunta está fuera de tema . Actualmente no está aceptando respuestas. ¿Quieres mejorar esta pregunta? Actualice la pregunta para que esté en el tema de Cross Validated. Cerrado hace 6 años . Estoy buscando un corpus de texto grande (> 1000) para descargar. Preferiblemente con noticias mundiales o …
16 dataset 





4
Agrupación de datos 1D
Tengo un conjunto de datos, quiero crear grupos en esos datos basados ​​en una sola variable (no faltan valores). Quiero crear 3 grupos basados ​​en esa variable. ¿Qué algoritmo de agrupamiento utilizar, k-means, EM, DBSCAN, etc.? Mi pregunta principal es, ¿en qué circunstancias debo usar k-means sobre EM o EM …
16 clustering 

3
Hacer apuestas grandes e inteligentes
He estado tratando de codificar un algoritmo para sugerir apuestas en juegos 1X2 (ponderados). Básicamente, cada juego tiene un conjunto de partidos (equipos locales vs fuera): 1: casa gana X: dibujar 2: visitante gana Para cada coincidencia y símbolo ( 1, Xy 2), asignaré un porcentaje que represente las posibilidades …

11
¿Cómo empezar y aprender R?
He intentado varias veces "hacerlo por mi cuenta", pero con un éxito limitado. Soy un usuario casual de SPSS y tengo experiencia en SAS. Agradecería un puntero o dos de alguien que tiene antecedentes similares y ahora usa R.
16 r  references 

1
¿Puedo usar Kolmogorov-Smirnov para comparar dos distribuciones empíricas?
¿Está bien usar la prueba de bondad de ajuste de Kolmogorov-Smirnov para comparar dos distribuciones empíricas para determinar si parecen provenir de la misma distribución subyacente, en lugar de comparar una distribución empírica con una distribución de referencia preespecificada? Déjame intentar preguntar esto de otra manera. Recojo N muestras de …

2
¿Cuándo combinamos la reducción de dimensionalidad con la agrupación?
Estoy intentando realizar la agrupación a nivel de documento. Construí la matriz de frecuencia de término-documento y estoy tratando de agrupar estos vectores de alta dimensión usando k-means. En lugar de agrupar directamente, lo que hice fue aplicar primero la descomposición vectorial singular de LSA (Análisis semántico latente) para obtener …


1
Generando muestras aleatorias a partir de una distribución personalizada
Estoy tratando de generar muestras aleatorias de un pdf personalizado usando R. Mi pdf es: fX(x)=32(1−x2),0≤x≤1fX(x)=32(1−x2),0≤x≤1f_{X}(x) = \frac{3}{2} (1-x^2), 0 \le x \le 1 Generé muestras uniformes y luego traté de transformarlo en mi distribución personalizada. Hice esto buscando el cdf de mi distribución ( FX(x)FX(x)F_{X}(x) ) y configurándolo en …
16 r  sampling  uniform 

2
¿Qué significa exactamente 'agrupar datos'?
Pensé que 'agrupar datos' simplemente significaba combinar datos que antes se dividían en categorías ... esencialmente, ignorar las categorías y hacer que el conjunto de datos sea un 'grupo' gigante de datos. Supongo que esta es una pregunta más sobre la terminología que la aplicación de estadísticas. Por ejemplo: quiero …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.