Estadísticas y Big Data

Preguntas y respuestas para personas interesadas en estadísticas, aprendizaje automático, análisis de datos, minería de datos y visualización de datos.




1
Límites de generalización en SVM
Estoy interesado en los resultados teóricos para la capacidad de generalización de las máquinas de vectores de soporte, por ejemplo, límites en la probabilidad de error de clasificación y en la dimensión Vapnik-Chervonenkis (VC) de estas máquinas. Sin embargo, al leer la literatura he tenido la impresión de que algunos …



2
Si la contracción se aplica de manera inteligente, ¿siempre funciona mejor para estimadores más eficientes?
Supongamos que tengo dos estimadores y que son estimadores consistentes del mismo parámetro y tal que con en el sentido psd. Por lo tanto, asintóticamente es más eficiente que . Estos dos estimadores se basan en diferentes funciones de pérdida.βˆ1β^1\widehat{\beta}_1βˆ2β^2\widehat{\beta}_2β0β0\beta_0n−−√(βˆ1−β0)→dN(0,V1),n−−√(βˆ2−β0)→dN(0,V2)n(β^1−β0)→dN(0,V1),n(β^2−β0)→dN(0,V2)\sqrt{n}(\widehat{\beta}_1 -\beta_0) \stackrel{d}\rightarrow \mathcal{N}(0, V_1), \quad \sqrt{n}(\widehat{\beta}_2 -\beta_0) \stackrel{d}\rightarrow \mathcal{N}(0, V_2)V1≤V2V1≤V2V_1 …

2
¿Aprendizaje supervisado con datos inciertos?
¿Existe una metodología existente para aplicar un modelo de aprendizaje supervisado a un conjunto de datos incierto? Por ejemplo, supongamos que tenemos un conjunto de datos con clases A y B: +----------+----------+-------+-----------+ | FeatureA | FeatureB | Label | Certainty | +----------+----------+-------+-----------+ | 2 | 3 | A | 50% …


2
¿Qué sucede con la razón de probabilidad a medida que se recopilan cada vez más datos?
Permiten , y sean densidades y supongamos que tiene , . ¿Qué sucede con la razón de probabilidad como ? (¿Converge? ¿A qué?)fffggghhhxi∼hxi∼hx_i \sim hi∈Ni∈Ni \in \mathbb{N}∏i=1nf(xi)g(xi)∏i=1nf(xi)g(xi) \prod_{i=1}^n \frac{f(x_i)}{g(x_i)} n→∞n→∞n \rightarrow \infty Por ejemplo, podemos suponer . El caso general también es de interés.h=gh=gh = g

1
Regresión logística para datos de distribuciones de Poisson
De algunas notas de aprendizaje automático que hablan sobre algunos métodos de clasificación discriminativos, en particular la regresión logística, donde y es la etiqueta de clase (0 o 1) y x son los datos, se dice que: si , y , entonces será logístico.x|y=0∼Poisson(λ0)x|y=0∼Poisson(λ0)x|y = 0 \sim \mathrm{Poisson}(λ_0)x|y=1∼Poisson(λ1)x|y=1∼Poisson(λ1)x|y = 1 …

3
Contraejemplos donde la mediana está fuera [Modo-Media]
Este artículo está por encima de mi liga, pero habla sobre un tema que me interesa, la relación entre la media, la moda y la mediana. Dice : Se cree ampliamente que la mediana de una distribución unimodal es "generalmente" entre la media y la moda. Sin embargo, esto no …
11 mean  median  mode 

2
Cómo comenzar a construir un modelo de regresión cuando el predictor más fuertemente asociado es binario
Tengo un conjunto de datos que contiene 365 observaciones de tres variables pm, a saber , tempy rain. Ahora quiero verificar el comportamiento de pmen respuesta a los cambios en otras dos variables. Mis variables son: pm10 = Respuesta (dependiente) temp = predictor (independiente) rain = predictor (independiente) La siguiente …


3
Fiabilidad de una curva ajustada?
Me gustaría estimar la incertidumbre o la fiabilidad de una curva ajustada. Intencionalmente no nombro una cantidad matemática precisa que estoy buscando, ya que no sé qué es. Aquí (energía) es la variable dependiente (respuesta) y (volumen) es la variable independiente. Me gustaría encontrar la curva de Energía-Volumen, , de …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.