Ciencia de los datos

Preguntas y respuestas para profesionales de la ciencia de datos, especialistas en aprendizaje automático y aquellos interesados ​​en aprender más sobre el campo


2
Características de los vectores de palabras en word2vec
Estoy tratando de hacer un análisis de sentimientos. Para convertir las palabras en vectores de palabras, estoy usando el modelo word2vec. Supongamos que tengo todas las oraciones en una lista llamada 'oraciones' y estoy pasando estas oraciones a word2vec de la siguiente manera: model = word2vec.Word2Vec(sentences, workers=4 , min_count=40, size=300, …



1
La importancia de la característica a través del bosque aleatorio y la regresión lineal son diferentes
Aplicamos Lasso para clasificar las características y obtuve los siguientes resultados: rank feature prob. ================================== 1 a 0.1825477951589229 2 b 0.07858498115577893 3 c 0.07041793111843796 Tenga en cuenta que el conjunto de datos tiene 3 etiquetas. La clasificación de las características para las diferentes etiquetas es la misma. Luego aplicó bosque …

3
¿Qué algoritmos de aprendizaje automático, si los hay, se aceptan como una buena compensación entre explicabilidad y predicción?
Los textos de aprendizaje automático que describen algoritmos como máquinas de aumento de gradiente o redes neuronales a menudo comentan que estos modelos son buenos para la predicción, pero esto tiene el precio de una pérdida de explicabilidad o interpretabilidad. Por el contrario, los árboles de decisión única y los …

2
Conjuntos de datos de referencia para el filtrado colaborativo
Me gustaría probar un nuevo algoritmo para el filtrado colaborativo . Un caso de uso típico es recomendar películas basadas en las preferencias de los usuarios similares al usuario específico. ¿Cuáles son algunos conjuntos de datos de referencia comunes que los investigadores suelen utilizar para probar sus algoritmos? Sé que …


3
Exportar pesos (fórmula) de Random Forest Regressor en Scikit-Learn
Entrené un modelo de predicción con Scikit Learn en Python (Random Forest Regressor) y quiero extraer de alguna manera los pesos de cada característica para crear una herramienta de Excel para la predicción manual. Lo único que encontré es el model.feature_importances_pero no ayuda. ¿Hay alguna forma de lograrlo? def performRandomForest(X_train, …



2
¿Existen estudios que examinen la deserción escolar versus otras regularizaciones?
¿Hay algún documento publicado que muestre diferencias en los métodos de regularización para redes neuronales, preferiblemente en diferentes dominios (o al menos diferentes conjuntos de datos)? Lo pregunto porque actualmente tengo la sensación de que la mayoría de las personas parecen usar solo el abandono para la regularización en la …




Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.