Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.



2
¿Cómo haces bootstrapping con datos de series temporales?
Recientemente aprendí sobre el uso de técnicas de arranque para calcular errores estándar e intervalos de confianza para estimadores. Lo que aprendí fue que si los datos son IID, puede tratar los datos de la muestra como la población, y hacer un muestreo con reemplazo y esto le permitirá obtener …




1
Si genero una matriz simétrica aleatoria, ¿cuál es la probabilidad de que sea positiva definida?
Recibí una pregunta extraña cuando estaba experimentando algunas optimizaciones convexas. La pregunta es: Supongamos que genero aleatoriamente (digamos distribución normal estándar) una matriz simétrica (por ejemplo, genero una matriz triangular superior y lleno la mitad inferior para asegurarme de que sea simétrica), ¿cuál es la probabilidad de que sea un …



6
¿Hay algún ejemplo de dónde no se cumple el teorema del límite central?
Wikipedia dice: En la teoría de la probabilidad, el teorema del límite central (CLT) establece que, en la mayoría de las situaciones , cuando se agregan variables aleatorias independientes, su suma correctamente normalizada tiende hacia una distribución normal (informalmente una "curva de campana") incluso si las variables originales no son …

2
¿Fueron las redes de confrontación generativas introducidas por Jürgen Schmidhuber?
Leí en https://en.wikipedia.org/wiki/Generative_adversarial_networks : [Redes adversas generativas] fueron introducidas por Ian Goodfellow et al en 2014. pero Jurgen Schmidhuber afirma haber realizado un trabajo similar anteriormente en esa dirección (por ejemplo, hubo un debate en NIPS 2016 durante el tutorial de redes generativas adversarias: https://channel9.msdn.com/Events/Neural-Information-Processing-Systems- Conferencia / Neural-Information-Processing-Systems-Conference-NIPS-2016 / Generative-Adversarial-Networks …


2
¿Qué nos dice la entropía?
Estoy leyendo sobre entropía y me cuesta mucho conceptualizar lo que significa en el caso continuo. La página wiki dice lo siguiente: La distribución de probabilidad de los eventos, junto con la cantidad de información de cada evento, forma una variable aleatoria cuyo valor esperado es la cantidad promedio de …
32 entropy 


2
¿Las variables altamente correlacionadas en el bosque aleatorio distorsionan la precisión y la selección de características?
En mi opinión, las variables altamente correlacionadas no causarán problemas de multicolinealidad en el modelo de bosque aleatorio (corríjame si me equivoco). Sin embargo, por otro lado, si tengo demasiadas variables que contienen información similar, ¿el modelo pesará demasiado en este conjunto en lugar de los demás? Por ejemplo, hay …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.