Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.







6
¿Es inútil la regresión de cresta en altas dimensiones (
Considere un buen viejo problema de regresión con predictores ppp y tamaño de muestra nnorten . La sabiduría usual es que OLS estimador será overfit y generalmente será superado por la arista estimador de β^=(X⊤X+λI)−1X⊤y.β^=(X⊤X+λI)−1X⊤y.\hat\beta = (X^\top X + \lambda I)^{-1}X^\top y.Es estándar utilizar la validación cruzada para encontrar un …

1
Codificación de uno solo vs simulado en Scikit-learn
Hay dos formas diferentes de codificar variables categóricas. Digamos, una variable categórica tiene n valores. La codificación única lo convierte en n variables, mientras que la codificación ficticia lo convierte en n-1 variables. Si tenemos k variables categóricas, cada una de las cuales tiene n valores. Una codificación activa termina …


3
¿Cuál es la intuición detrás de SVD?
He leído sobre la descomposición de valores singulares (SVD). En casi todos los libros de texto se menciona que factoriza la matriz en tres matrices con especificación dada. Pero, ¿cuál es la intuición detrás de dividir la matriz en tal forma? PCA y otros algoritmos para la reducción de dimensionalidad …



4
¿Por qué molestarse con el doble problema al instalar SVM?
Dados los puntos de datos y las etiquetas , el problema primario del margen duro SVM esx1,…,xn∈Rdx1,…,xn∈Rdx_1, \ldots, x_n \in \mathbb{R}^dy1,…,yn∈{−1,1}y1,…,yn∈{−1,1}y_1, \ldots, y_n \in \left \{-1, 1 \right\} minimizew,w012wTwminimizew,w012wTw \text{minimize}_{w, w_0} \quad \frac{1}{2} w^T w s.t.∀i:yi(wTxi+w0)≥1s.t.∀i:yi(wTxi+w0)≥1 \text{s.t.} \quad \forall i: y_i (w^T x_i + w_0) \ge 1 que es un …
50 svm 

16
¿Libros recomendados sobre diseño de experimentos?
¿Cuáles son las recomendaciones del panel para libros sobre diseño de experimentos? Idealmente, los libros deberían estar impresos o disponibles electrónicamente, aunque eso no siempre es factible. Si se siente conmovido para agregar algunas palabras sobre lo que es tan bueno del libro, también sería genial. Además, busque un libro …

4
¿Por qué ANOVA es equivalente a la regresión lineal?
Leí que ANOVA y la regresión lineal son lo mismo. ¿Cómo puede ser eso, considerando que la salida de ANOVA es algún valor de y algún valor de función del cual se concluye si las medias de muestra en las diferentes muestras son iguales o diferentes?pFFFppp Pero suponiendo que las …
50 regression  anova 

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.