Ciencia de los datos

Preguntas y respuestas para profesionales de la ciencia de datos, especialistas en aprendizaje automático y aquellos interesados ​​en aprender más sobre el campo


1
Minería de datos relacionales sin ILP
Tengo un gran conjunto de datos de una base de datos relacional para la que necesito crear un modelo de clasificación. Normalmente para esta situación, usaría Programación Lógica Inductiva (ILP), pero debido a circunstancias especiales no puedo hacer eso. La otra forma de abordar esto sería tratar de agregar los …



4
PhD de matemática (programación no lineal) que cambia a ciencia de datos?
Soy un doctorado en matemáticas. estudiante que está interesado en ir a la industria como Data Scientist después de graduarse. Daré brevemente algunos antecedentes sobre mi educación antes de plantear mi pregunta, para que se entienda mejor: Cursos de matemáticas: Esto ha sido principalmente en matemática pura: topología, análisis funcional, …


1
¿Qué son "VGG54" y "VGG22" derivados de la CNG VGG19?
En el artículo Super-resolución de imagen única fotorrealista utilizando una red generativa adversaria de Christian Ledig et al., La distancia entre imágenes (utilizada en la función de pérdida) se calcula a partir de mapas de características extraídos de la red VGG19. Los dos utilizados en el artículo son (un poco …

1
Diferencia entre interpolar () y fillna () en pandas
Dado que el método interpolar y llenar hace el mismo trabajo de llenar valores n. ¿Cuál es la diferencia básica entre los dos? ¿Cuál es el significado de tener estos dos métodos diferentes? ¿Alguien puede explicarme en términos simples? Ya visité la documentación oficial y quería saber la diferencia.

2
¿Cómo se pueden usar los codificadores automáticos para la agrupación?
Supongamos que tengo un conjunto de señales en el dominio del tiempo sin absolutamente ninguna etiqueta . Quiero agruparlos en 2 o 3 clases. Los codificadores automáticos son redes sin supervisión que aprenden a comprimir las entradas. Entonces dado una entradax(i)x(i)x^{(i)}pesas W1W1W_1 y W2W2W_2sesgos b1b1b_1 y b2b2b_2y salida x^(i)x^(i)\hat{x}^{(i)}, podemos …


1
¿Se puede usar la confianza de la etiqueta de entrenamiento para mejorar la precisión de la predicción?
Tengo datos de entrenamiento que están etiquetados con valores binarios. También he recopilado la confianza de cada una de estas etiquetas, es decir, 0,8 de confianza significaría que el 80% de los etiquetadores humanos están de acuerdo con esa etiqueta. ¿Es posible utilizar estos datos de confianza para mejorar la …




1
Calcular similitud de coseno en Apache Spark
Tengo un DataFrame con IDF de ciertas palabras calculadas. Por ejemplo (10,[0,1,2,3,4,5],[0.413734499590671,0.4244680552337798,0.4761400657781007, 1.4004620708967006,0.37876590175292424,0.48374466516332]) .... and so on Ahora proporcione una consulta Q, puedo calcular el TF-IDF de esta consulta. ¿Cómo calculo la similitud de coseno de la consulta con todos los documentos en el marco de datos (hay cerca de …

Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.