Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
Encontrar las mejores características en modelos de interacción
Tengo una lista de proteínas con sus valores característicos. Una tabla de muestra se ve así: ...............Feature1...Feature2...Feature3...Feature4 Protein1 Protein2 Protein3 Protein4 Las filas son proteínas y las columnas son características. También tengo una lista de proteínas que también interactúan; por ejemplo Protein3, Protein4 Protein1, Protein2 Protein4, Protein1 Problema : para …

2
¿Por qué utilizar una distribución beta en el parámetro Bernoulli para la regresión logística jerárquica?
Actualmente estoy leyendo el excelente libro de Kruschke "Doing Bayesian Data Analysis". Sin embargo, el capítulo sobre regresión logística jerárquica (Capítulo 20) es algo confuso. La figura 20.2 describe una regresión logística jerárquica donde el parámetro de Bernoulli se define como la función lineal en los coeficientes transformados a través …

2
¿Problema con e1071 libsvm?
Tengo un conjunto de datos con dos clases superpuestas, siete puntos en cada clase, los puntos están en un espacio bidimensional. En R, y estoy corriendo svmdesde el e1071paquete para construir un hiperplano de separación para estas clases. Estoy usando el siguiente comando: svm(x, y, scale = FALSE, type = …

1
¿Secuencia de Halton vs secuencia de Sobol?
De una respuesta en una pregunta anterior , fui dirigido hacia la secuencia de Halton, para crear un conjunto de vectores que cubrieran un espacio de muestra uniforme de manera bastante uniforme. Pero la página de wikipedia menciona que los números primos más altos a menudo están altamente correlacionados al …




2
Predicción de regresión cuantil
Estoy interesado en usar la regresión cuantil para algunos de mis modelos, pero me gustaría tener algunas aclaraciones sobre qué puedo lograr con esta metodología. Entiendo que puedo obtener un análisis más robusto de IV / DV relación , especialmente cuando se enfrentan con valores atípicos y heteroscedasticidad, pero en …



4
Sidak o Bonferroni?
Estoy usando un modelo lineal generalizado en SPSS para observar las diferencias en el número promedio de orugas (no normal, usando distribución Tweedie) en 16 especies diferentes de plantas. Quiero realizar comparaciones múltiples, pero no estoy seguro de si debo usar una prueba de corrección Sidak o Bonferroni. ¿Cuál es …


5
lme4 u otro código de paquete R de código abierto equivalente a asreml-R
Quiero ajustar el modelo mixto usando lme4, nlme, paquete de regresión baysiana o cualquier otro disponible. Modelo mixto en convenciones de codificación Asreml-R antes de entrar en detalles, es posible que deseemos tener detalles sobre las convenciones asreml-R, para aquellos que no están familiarizados con los códigos ASREML. y = …
13 r 



Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.