Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

2
Generando con precisión variantes de distribución discreta de la ley de potencia
¿Cuáles son los mejores métodos para generar con precisión enteros aleatorios distribuidos de acuerdo con una ley de potencia? La probabilidad de obtener ( ) debería ser igual a y el método debería funcionar bien para cualquier .kkkk=1,2,…k=1,2,…k=1,2,\ldotspk=k−γ/ζ(γ)pk=k−γ/ζ(γ)p_k = k^{-\gamma} / \zeta(\gamma)γ>1γ>1\gamma > 1 Puedo ver dos enfoques ingenuos: Calcule …


1
Determinar las mejores series de tiempo correlacionadas
Antes de preguntar, leí preguntas similares, pero ninguna de ellas condujo a respuestas satisfactorias para mi interés específico. Quiero homogeneizar una serie de precipitaciones climáticas de la República Dominicana durante 64 años (1940-2003). Para eso, es realmente importante seleccionar una serie de referencia entre un grupo de candidatos. Digamos que …

1
Probability puzzle about zombies [cerrado]
Cerrada . Esta pregunta necesita detalles o claridad . Actualmente no está aceptando respuestas. ¿Quieres mejorar esta pregunta? Agregue detalles y aclare el problema editando esta publicación . Cerrado hace 10 meses . Estoy pensando en escribir un juego simple sobre zombies. Me quedé atascado tratando de calcular cuántas personas …

4
Conectando los puntos en un gráfico
Dado un gráfico que es el producto de una ecuación, podemos calcular significativamente cualquier punto que resuelva la ecuación y, en consecuencia, también una línea que pase por los puntos. La línea, en cualquiera de sus puntos, es la respuesta. Pero ¿qué pasa con medidas como "número de automóviles por …






2
¿Cómo manejar datos incompletos en Kalman Filter?
¿Cuáles son algunos enfoques típicos para manejar datos incompletos en el filtro de Kalman? Estoy hablando de la situación en la que faltan algunos elementos del vector observado , distinto del caso en el que se pierde un vector completo observado . Otra forma de pensar sobre esto sería que …

2
¿Importa una gran diferencia en los tamaños de muestra junto con una diferencia en las variaciones para una prueba t (o prueba de permutación)?
Hay una pregunta muy confusa en mi mente. Tengo datos y me gustaría comparar las puntuaciones numéricas entre hombres y mujeres. Hay una gran diferencia en esos dos grupos: el número de hombres es 34, mientras que el número de mujeres es 310, y las variaciones no son iguales. Hasta …

2
Regresión lineal en una muestra que abarca muchos órdenes de magnitud.
La ley de Beer de la química dice que la absorbancia de un líquido es proporcional a la concentración , entonces: Lo que hay que hacer entonces es preparar un conjunto de soluciones con concentraciones conocidas, medir la absorbancia para formar una 'curva estándar '(una curva de calibración básicamente), y …

3
Errores en optim al ajustar el modelo arima en R
Estoy usando el método arima del paquete de estadísticas de R con mi serie temporal de 17376 elementos. Mi objetivo es obtener el valor del criterio AIC, he observado en mi primera prueba esto: ts <- arima(serie[,1], order = c(2,1,1), seasonal = list(order=c(2,0,1),period = 24), method = "CSS", optim.method = …

1
¿RandomForest ignora la independencia espacial?
Tengo 5 variables para cada país del mundo y necesito analizar sus efectos e interacciones en una variable independiente. Random Forest sería adecuado para mi alcance ya que trata con relaciones no lineales y predice la importancia de las variables. Sin embargo, me pregunto si la dependencia espacial puede ser …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.