Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.



2
¿Es inusual que MEAN supere a ARIMA?
Recientemente apliqué una variedad de métodos de pronóstico (MEAN, RWF, ETS, ARIMA y MLP) y descubrí que MEAN funcionó sorprendentemente bien. (MEDIO: donde todas las predicciones futuras se predicen como iguales a la media aritmética de los valores observados). MEDIO incluso superó a ARIMA en las tres series que utilicé. …



1
calculado manualmente
Sé que esto es bastante específico Rpregunta, pero puede estar pensando en proporción de varianza explicado, R2R2R^2 , de forma incorrecta. Aquí va. Estoy tratando de usar el Rpaquete randomForest. Tengo algunos datos de entrenamiento y datos de prueba. Cuando ajusto un modelo de bosque aleatorio, la randomForestfunción le permite …

3
¿Aprendizaje en línea versus fuera de línea?
¿Cuál es la diferencia entre el aprendizaje fuera de línea y en línea ? ¿Es solo una cuestión de aprender sobre todo el conjunto de datos (sin conexión) versus aprender de forma incremental (una instancia a la vez)? ¿Cuáles son ejemplos de algoritmos utilizados en ambos?

3
Aplique incrustaciones de palabras en todo el documento para obtener un vector de características
¿Cómo uso una incrustación de palabras para asignar un documento a un vector de características, adecuado para su uso con aprendizaje supervisado? Una incrustación de palabras asigna cada palabra www a un vector , donde es un número no demasiado grande (por ejemplo, 500). Las incrustaciones de palabras populares incluyen …

4
¿Qué es la invariancia de traducción en la visión por computadora y la red neuronal convolucional?
No tengo experiencia en visión por computadora, pero cuando leo algunos artículos y documentos relacionados con el procesamiento de imágenes y las redes neuronales convolucionales, me enfrento constantemente al término translation invariance, o translation invariant. ¿O leí mucho que la operación de convolución proporciona translation invariance? ¿Qué significa esto? Yo …


3
¿Cuáles son las diferencias entre 'época', 'lote' y 'minibatch'?
Hasta donde sé, al adoptar el Descenso de gradiente estocástico como algoritmo de aprendizaje, alguien usa 'epoch' para el conjunto de datos completo y 'batch' para los datos utilizados en un solo paso de actualización, mientras que otro usa 'batch' y 'minibatch' respectivamente, y los otros usan 'epoch' y 'minibatch'. …


3
Random number-Set.seed (N) en R [duplicado]
Esta pregunta ya tiene una respuesta aquí: ¿Qué es exactamente una semilla en un generador de números aleatorios? 3 respuestas Me doy cuenta de que uno usa set.seed()en R para la generación de números pseudoaleatorios. También me doy cuenta de que usar el mismo número, como set.seed(123)asegura, puede reproducir resultados. …


3
Derivar la varianza del coeficiente de regresión en regresión lineal simple
En regresión lineal simple, tenemos y=β0+β1x+uy=β0+β1x+uy = \beta_0 + \beta_1 x + u , donde u∼iidN(0,σ2)u∼iidN(0,σ2)u \sim iid\;\mathcal N(0,\sigma^2) . Derivé el estimador: β1^=∑i(xi−x¯)(yi−y¯)∑i(xi−x¯)2 ,β1^=∑i(xi−x¯)(yi−y¯)∑i(xi−x¯)2 , \hat{\beta_1} = \frac{\sum_i (x_i - \bar{x})(y_i - \bar{y})}{\sum_i (x_i - \bar{x})^2}\ , dondex¯x¯\bar{x} yy¯y¯\bar{y} son las medias muestrales dexxxeyyy. Ahora quiero encontrar la varianza …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.