Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.

6
Clasificación estadística del texto.
Soy un programador sin antecedentes estadísticos, y actualmente estoy buscando diferentes métodos de clasificación para una gran cantidad de documentos diferentes que quiero clasificar en categorías predefinidas. He estado leyendo sobre kNN, SVM y NN. Sin embargo, tengo algunos problemas para comenzar. ¿Qué recursos me recomiendan? Conozco bastante bien el …

7
¿Existen algoritmos para calcular parámetros de regresión logística o lineal "en ejecución"?
Un documento "Cálculo preciso de la varianza de carrera" en http://www.johndcook.com/standard_deviation.html muestra cómo calcular la media de carrera, la varianza y las desviaciones estándar. ¿Existen algoritmos en los que los parámetros de un modelo de regresión lineal o logística puedan actualizarse "dinámicamente" de manera similar a medida que se proporciona …



2
¿Por qué no hay motores de aprendizaje de refuerzo profundo para el ajedrez, similares a AlphaGo?
Las computadoras han podido jugar al ajedrez durante mucho tiempo utilizando una técnica de "fuerza bruta", buscando a cierta profundidad y luego evaluando la posición. Sin embargo, la computadora AlphaGo solo usa un ANN para evaluar las posiciones (hasta donde yo sé, no realiza ninguna búsqueda profunda). ¿Es posible crear …

2
Función de costo en regresión lineal de MCO
Estoy un poco confundido con una conferencia sobre regresión lineal dada por Andrew Ng en Coursera sobre el aprendizaje automático. Allí, le dio una función de costo que minimiza la suma de cuadrados como: 12m∑i=1m(hθ(X(i))−Y(i))212m∑i=1m(hθ(X(i))−Y(i))2 \frac{1}{2m} \sum _{i=1}^m \left(h_\theta(X^{(i)})-Y^{(i)}\right)^2 Entiendo de dónde viene el . Creo que lo hizo para …


4
¿Cómo calcular el error relativo cuando el valor verdadero es cero?
¿Cómo calculo el error relativo cuando el valor verdadero es cero? Digamos que tengo xtrue=0xtrue=0x_{true} = 0 y . Si defino error relativo como:xtestxtestx_{test} relative error=xtrue−xtestxtruerelative error=xtrue−xtestxtrue\text{relative error} = \frac{x_{true}-x_{test}}{x_{true}} Entonces el error relativo siempre está indefinido. Si en cambio uso la definición: relative error=xtrue−xtestxtestrelative error=xtrue−xtestxtest\text{relative error} = \frac{x_{true}-x_{test}}{x_{test}} Entonces …




2
Varianza del producto de variables dependientes
¿Cuál es la fórmula para la varianza del producto de variables dependientes? En el caso de variables independientes, la fórmula es simple: var(XY)=E(X2Y2)−E(XY)2=var(X)var(Y)+var(X)E(Y)2+var(Y)E(X)2var(XY)=E(X2Y2)−E(XY)2=var(X)var(Y)+var(X)E(Y)2+var(Y)E(X)2 {\rm var}(XY) = E(X^{2}Y^{2}) - E(XY)^{2} = {\rm var}(X){\rm var}(Y) + {\rm var}(X)E(Y)^2 + {\rm var}(Y)E(X)^2 Pero, ¿cuál es la fórmula para las variables correlacionadas? Por cierto, …

3
¿Cómo maneja R los valores perdidos en lm?
Me gustaría hacer una regresión de un vector B contra cada una de las columnas de una matriz A. Esto es trivial si no faltan datos, pero si la matriz A contiene valores faltantes, entonces mi regresión contra A está limitada a incluir solo filas donde todos los valores están …


4
¿Cómo ajusto un modelo multinivel para resultados de Poisson sobredispersos?
Quiero ajustar un GLMM multinivel con una distribución de Poisson (con sobredispersión) usando R. En este momento estoy usando lme4 pero noté que recientemente la quasipoissonfamilia fue eliminada. He visto en otras partes que puede modelar la sobredispersión aditiva para distribuciones binomiales agregando una intercepción aleatoria con un nivel por …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.