Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

3
Lectura de solo dos de las tres columnas con read.csv
Bloqueado . Esta pregunta y sus respuestas están bloqueadas porque la pregunta está fuera de tema pero tiene importancia histórica. Actualmente no acepta nuevas respuestas o interacciones. Tengo un conjunto de datos ASCII que consta de tres columnas, pero solo las dos últimas son datos reales. Ahora quiero crear un …
12 r 

4
Estimador para una distribución binomial
¿Cómo definimos un estimador para datos provenientes de una distribución binomial? Para bernoulli puedo pensar en un estimador que estima un parámetro p, pero para binomio no puedo ver qué parámetros estimar cuando tenemos n caracterizando la distribución. Actualizar: Por estimador me refiero a una función de los datos observados. …

2
Diferencia entre prueba t y ANOVA en regresión lineal
Me pregunto qué diferencias hay entre la prueba t y ANOVA en regresión lineal. ¿Es una prueba t para probar si alguna de las pendientes e intersecciones tiene media cero, mientras que ANOVA prueba si todas las pendientes tienen media cero? ¿Es esta la única diferencia entre ellos? En la …

4
Predicción de series de tiempo binarias
Tengo una serie temporal binaria con 1 cuando el automóvil no se mueve y 0 cuando el automóvil se mueve. Quiero hacer un pronóstico para un horizonte temporal de hasta 36 horas por adelantado y para cada hora. Mi primer enfoque fue utilizar un Bayes Naive usando las siguientes entradas: …





2
¿Qué maximizan los primeros factores del análisis factorial?
En el análisis de componentes principales, los primeros componentes principales son las direcciones ortogonales con la varianza máxima. En otras palabras, el primer componente principal se elige como la dirección de la varianza máxima, el segundo componente principal se elige como la dirección ortogonal al primero con la varianza máxima, …


1
Definición de cuantiles sobre una muestra ponderada
Tengo una muestra ponderada, para la cual deseo calcular cuantiles. 1 Idealmente, donde los pesos son iguales (ya sea = 1 o no), los resultados serían consistentes con los de scipy.stats.scoreatpercentile()y R's quantile(...,type=7). Un enfoque simple sería "multiplicar" la muestra usando los pesos dados. Eso efectivamente da un ecdf localmente …





Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.