Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
¿Por qué mis valores p difieren entre la salida de regresión logística, la prueba de ji cuadrado y el intervalo de confianza para el OR?
He construido una regresión logística donde la variable de resultado se está curando después de recibir el tratamiento ( Curevs. No Cure). Todos los pacientes en este estudio recibieron tratamiento. Estoy interesado en ver si tener diabetes está asociado con este resultado. En R mi salida de regresión logística se …

2
¿Cuándo es t-SNE engañoso?
Cita de uno de los autores: La incrustación de vecinos estocásticos distribuidos en t (t-SNE) es una técnica ( premiada ) para la reducción de la dimensionalidad que es particularmente adecuada para la visualización de conjuntos de datos de alta dimensión. Entonces suena bastante bien, pero ese es el autor …

3
¿Tiene sentido el signo de puntajes o de cargas en PCA o FA? ¿Puedo revertir el signo?
Realicé el análisis de componentes principales (PCA) con R usando dos funciones diferentes ( prcompy princomp) y observé que las puntuaciones de PCA diferían en el signo. ¿Cómo puede ser? Considera esto: set.seed(999) prcomp(data.frame(1:10,rnorm(10)))$x PC1 PC2 [1,] -4.508620 -0.2567655 [2,] -3.373772 -1.1369417 [3,] -2.679669 1.0903445 [4,] -1.615837 0.7108631 [5,] -0.548879 …
37 r  pca  factor-analysis 

4
¿Diferencia entre pronóstico y predicción?
Me preguntaba qué diferencia y relación hay entre pronóstico y predicción. ¿Especialmente en series de tiempo y regresión? Por ejemplo, ¿estoy en lo cierto? En series de tiempo, el pronóstico parece significar estimar valores futuros dados los valores pasados ​​de una serie de tiempo. En la regresión, la predicción parece …



5
Análisis de series temporales de validación cruzada
He estado usando el paquete caret en R para construir modelos predictivos para clasificación y regresión. Caret proporciona una interfaz unificada para ajustar los hiperparámetros del modelo mediante validación cruzada o arranque de bandas. Por ejemplo, si está construyendo un modelo simple de 'vecinos más cercanos' para la clasificación, ¿cuántos …









Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.