Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

5
Intervalo de confianza y probabilidad: ¿dónde está el error en esta declaración?
Si alguien hace una declaración como la siguiente: "En general, los no fumadores expuestos al humo ambiental tenían un riesgo relativo de enfermedad coronaria de 1,25 (intervalo de confianza del 95 por ciento, 1,17 a 1,32) en comparación con los no fumadores no expuestos al humo". ¿Cuál es el riesgo …





2
Referencia para
En su respuesta a mi pregunta anterior, @Erik P. da la expresión donde κ es el exceso de curtosis de la distribución. Se da una referencia a la entrada de Wikipedia sobre ladistribución de la varianza de la muestra, pero la página de Wikipedia dice "cita requerida".V a r [ …

3
Un curso de diseño experimental para mineros de datos.
Soy un informático que trabaja en minería de datos. No es ningún secreto decir que los científicos informáticos son bastante pobres en el diseño y evaluación experimental sistemática: el uso de valores p y estimaciones de confianza se considera avanzado :). Lo que me gustaría saber si hay buenos cursos …

3
¿Media
Estoy trabajando en datos muy sesgados, así que estoy usando la mediana en lugar de la media para resumir la tendencia central. Me gustaría tener una medida de dispersión Si bien a menudo veo personas que informan media desviación estándar±±\pm o mediana cuartiles±±\pm para resumir la tendencia central, ¿está bien …

5
¿Puedo hacer una prueba de hipótesis para datos normales asimétricos?
Tengo una colección de datos, que originalmente pensé que normalmente se distribuía. Luego lo miré y me di cuenta de que no, principalmente porque los datos están sesgados, y también hice una prueba de shapiro-wilks. Todavía me gustaría analizarlo utilizando métodos estadísticos, por lo que me gustaría probar la hipótesis …



2
Usando Adaboost con SVM para la clasificación
Sé que Adaboost intenta generar un clasificador fuerte usando una combinación lineal de un conjunto de clasificadores débiles. Sin embargo, he leído algunos documentos que sugieren que Adaboost y SVM funcionan en armonía (aunque SVM es un clasificador fuerte) en ciertas condiciones y casos . No puedo entender desde una …

3
¿Cómo puedo encontrar la desviación estándar de la desviación estándar de la muestra de una distribución normal?
Perdóname si me he perdido algo bastante obvio. Soy un físico con lo que es esencialmente una distribución (histograma) centrada en un valor medio que se aproxima a una distribución Normal. El valor importante para mí es la desviación estándar de esta variable aleatoria gaussiana. ¿Cómo trataría de encontrar el …

2
¿Existe tal cosa como un dado justo?
¿Existe tal cosa como un dado justo? En los dados donde el número está representado por un punto recogido, ¿seguro que eso marca la diferencia? ¿Alguien ha hecho alguna investigación? De hecho, pensando en ello, ¿por qué sería justo lanzar una moneda? La física en cada lado es completamente diferente.
11 dice 

2
Los predictores significativos se vuelven no significativos en la regresión logística múltiple
Cuando analizo mis variables en dos modelos de regresión logística separados (univariados), obtengo lo siguiente: Predictor 1: B= 1.049, SE=.352, Exp(B)=2.85, 95% CI=(1.43, 5.69), p=.003 Constant: B=-0.434, SE=.217, Exp(B)=0.65, p=.046 Predictor 2: B= 1.379, SE=.386, Exp(B)=3.97, 95% CI=(1.86, 8.47), p<.001 Constant: B=-0.447, SE=.205, Exp(B)=0.64, p=.029 pero cuando los ingreso en …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.