Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

1
¿Cuáles son las notaciones clásicas en estadística, álgebra lineal y aprendizaje automático? ¿Y cuáles son las conexiones entre estas notaciones?
Cuando leemos un libro, entender las anotaciones juega un papel muy importante para comprender los contenidos. Desafortunadamente, diferentes comunidades tienen diferentes convenciones de notación para la formulación del modelo y el problema de optimización. ¿Podría alguien resumir algunas anotaciones de formulación aquí y proporcionar posibles razones? Daré un ejemplo aquí: …

6
¿Cómo elegir entre ROC AUC y puntaje F1?
Recientemente completé una competencia de Kaggle en la que se utilizó la puntuación roc auc según los requisitos de la competencia. Antes de este proyecto, normalmente usaba la puntuación f1 como la métrica para medir el rendimiento del modelo. En el futuro, me pregunto cómo debo elegir entre estas dos …




1
¿Uno contra todos y Uno contra uno en svm?
¿Cuál es la diferencia entre un clasificador SVM uno contra uno y uno contra uno? ¿One-vs-all significa un clasificador para clasificar todos los tipos / categorías de la nueva imagen y one-vs-one significa que cada tipo / categoría de nueva imagen clasifica con un clasificador diferente (cada categoría es manejada …

2
¿Por qué el Lik scikit-learn de Python no funciona correctamente y cómo calcula LDA a través de SVD?
Estaba utilizando el Análisis discriminante lineal (LDA) de la scikit-learnbiblioteca de aprendizaje automático (Python) para la reducción de la dimensionalidad y tenía un poco de curiosidad por los resultados. Ahora me pregunto qué scikit-learnestá haciendo la LDA para que los resultados se vean diferentes de, por ejemplo, un enfoque manual …

7
Prueba de hipótesis de distribución: ¿de qué sirve hacerlo si no puede "aceptar" su hipótesis nula?
Varias pruebas de hipótesis, como la GOF, Kolmogorov-Smirnov, Anderson-Darling, etc., siguen este formato básico:χ2χ2\chi^{2} H0 0H0H_0 : los datos siguen la distribución dada. H1H1H_1 : los datos no siguen la distribución dada. Típicamente, uno evalúa la afirmación de que algunos datos dados siguen a una distribución dada, y si uno …


5
Explicación intuitiva de convergencia en distribución y convergencia en probabilidad
¿Cuál es la diferencia intuitiva entre una variable aleatoria que converge en probabilidad versus una variable aleatoria que converge en distribución? He leído numerosas definiciones y ecuaciones matemáticas, pero eso realmente no ayuda. (Tenga en cuenta que soy un estudiante universitario que estudia econometría). ¿Cómo puede una variable aleatoria converger …


2
Estimar el cuantil de valor en un vector
Tengo un conjunto de números reales. Necesito estimar el cuantil de un nuevo número. ¿Hay alguna forma limpia de hacer esto en R? ¿en general? Espero que esto no sea ultra trivial ;-) Muy apreciado por su respuesta. PK
26 r 




Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.