Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.



1
¿Qué modelo para un conjunto de datos desafiante? (cientos de series de tiempo con muchos anidamientos)
Tengo un conjunto de datos bastante complicado para analizar, y no puedo encontrar una buena solución para ello. Aquí está la cosa: 1. los datos en bruto son esencialmente grabaciones de canciones de insectos. Cada canción está compuesta de varias ráfagas, y cada ráfaga está compuesta de subunidades. Todos los …



1
¿Cómo adaptar el modelo Bradley – Terry – Luce en R, sin una fórmula complicada?
El modelo Bradley – Terry – Luce (BTL) establece que , donde es la probabilidad de que el objeto se considere "mejor", más pesado, etc., que el objeto , y , y son parámetros.pji=logit−1(δj−δi)pji=logit−1(δj−δi)p_{ji} = logit^{-1}(\delta_j - \delta_i)pijpijp_{ij}jjjiiiδiδi\delta_iδjδj\delta_j Esto parece ser un candidato para la función glm, con family = …


3
auto.arima advierte NaNs producidos en error estándar
Mis datos son una serie temporal de población ocupada, L, y el lapso de tiempo, año. n.auto=auto.arima(log(L),xreg=year) summary(n.auto) Series: log(L) ARIMA(2,0,2) with non-zero mean Coefficients: ar1 ar2 ma1 ma2 intercept year 1.9122 -0.9567 -0.3082 0.0254 -3.5904 0.0074 s.e. NaN NaN NaN NaN 1.6058 0.0008 sigma^2 estimated as 1.503e-06: log likelihood=107.55 …
9 r  regression  arima 

1
Predecir poisson GLM con desplazamiento
Sé que esta es probablemente una pregunta básica ... Pero parece que no encuentro la respuesta. Estoy adaptando un GLM con una familia de Poisson, y luego intenté echar un vistazo a las predicciones, sin embargo, el desplazamiento parece tenerse en cuenta: model_glm=glm(cases~rhs(data$year,2003)+lhs(data$year,2003), offset=(log(population)), data=data, subset=28:36, family=poisson()) predict (model_glm, type="response") …


1
¿Cómo obtener límites de decisión de SVM lineal en R?
Necesito un paquete que me pueda dar la ecuación para un modelo SVM lineal. Actualmente estoy usando e1071 así: library(e1071) m = svm(data, labels, type='C', kernel='linear', cost=cost, probability=FALSE, scale=scale) w = t(m$coefs) %*% data[m$index,] #Weight vector b = -model$rho #Offset Sin embargo, no estoy seguro de cómo e1071::svm()selecciona las clases …
9 r  svm  e1071 


1
Clasificación con un predictor dominante
Tengo un problema de clasificación ( clase ), con del orden de 100 predictores con valores reales, uno de los cuales parece tener mucho más poder explicativo que cualquiera de los otros. Me gustaría profundizar en los efectos de las otras variables. Sin embargo, las técnicas estándar de aprendizaje automático …



Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.