Ciencia de los datos

Preguntas y respuestas para profesionales de la ciencia de datos, especialistas en aprendizaje automático y aquellos interesados ​​en aprender más sobre el campo


1
Datos desequilibrados que causan una clasificación errónea en el conjunto de datos multiclase
Estoy trabajando en la clasificación de texto donde tengo 39 categorías / clases y 8,5 millones de registros. (En el futuro, los datos y las categorías aumentarán). La estructura o el formato de mis datos es el siguiente. ---------------------------------------------------------------------------------------- | product_title | Key_value_pairs | taxonomy_id | ---------------------------------------------------------------------------------------- Samsung S7 Edge …

2
Qué algoritmo aplicar para elegir el punto correcto
La siguiente imagen muestra 7 puntos alrededor del origen. Uno de ellos ha sido seleccionado por un humano basado en reglas y experiencia y es de color rojo (el que está en el cuadrante inferior izquierdo). Ahora tenemos más de 1000 de estos conjuntos de puntos y para cada conjunto, …



2
"Teorema del profundo Noether": Construyendo restricciones de simetría
Si tengo un problema de aprendizaje que debería tener una simetría inherente, ¿hay alguna forma de someter mi problema de aprendizaje a una restricción de simetría para mejorar el aprendizaje? Por ejemplo, si estoy haciendo reconocimiento de imagen, podría querer simetría rotacional 2D. Lo que significa que la versión girada …




4
Clasificar series de tiempo multivariadas
Tengo un conjunto de datos compuesto por series de tiempo (8 puntos) con aproximadamente 40 dimensiones (por lo que cada serie de tiempo es de 8 por 40). La salida correspondiente (los posibles resultados para las categorías) es 0 o 1. ¿Cuál sería el mejor enfoque para diseñar un clasificador …



4
Interpretación del árbol de decisiones en el contexto de las características importantes
Estoy tratando de entender cómo entender completamente el proceso de decisión de un modelo de clasificación de árbol de decisión construido con sklearn. Los dos aspectos principales que estoy viendo son una representación gráfica del árbol y la lista de características importantes. Lo que no entiendo es cómo se determina …

3
¿Por qué usar NN convolucionales para una tarea de inspección visual sobre la coincidencia clásica de plantillas de CV?
Tuve una discusión interesante sobre la base de un proyecto en el que estábamos trabajando: ¿por qué usar un sistema de inspección visual CNN sobre un algoritmo de coincidencia de plantillas? Antecedentes: había mostrado una demostración de un sistema simple de visión CNN (cámara web + computadora portátil) que detectaba …


Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.