Ciencia de los datos

Preguntas y respuestas para profesionales de la ciencia de datos, especialistas en aprendizaje automático y aquellos interesados ​​en aprender más sobre el campo



3
Conjuntos de datos clásicos de análisis de red
Existen varios conjuntos de datos clásicos para tareas de clasificación / regresión de aprendizaje automático. Los más populares son: Conjunto de datos de flor de iris ; Conjunto de datos titánicos ; Automóviles de tendencia de motor ; etc. ¿Pero alguien conoce conjuntos de datos similares para el análisis de …
10 dataset  graphs 


2
Depuración de redes neuronales
Construí una red neuronal artificial en Python usando la función de optimización scipy.optimize.minimize (gradiente conjugado). Implementé la verificación de gradiente, verifiqué todo, etc., y estoy bastante seguro de que funciona correctamente. Lo he ejecutado varias veces y llega a 'Optimización finalizada con éxito', sin embargo, cuando aumento el número de …

1
Agrupación de datos de clientes almacenados en ElasticSearch
Tengo un montón de perfiles de clientes almacenados en un clúster de Elasticsearch . Estos perfiles ahora se utilizan para la creación de grupos objetivo para nuestras suscripciones de correo electrónico. Los grupos objetivo ahora se forman manualmente usando las capacidades de búsqueda facetada de búsqueda elástica (como obtener todos …

4
¿Cómo depurar el análisis de datos?
Me he encontrado con el siguiente problema, que reconozco es bastante típico. Tengo algunos datos grandes, por ejemplo, unos pocos millones de filas. Ejecuto algunos análisis no triviales, por ejemplo, una consulta SQL que consta de varias subconsultas. Obtengo algún resultado, indicando, por ejemplo, que la propiedad X aumenta con …

2
¿Cuál es el método más eficiente para la optimización de hiperparámetros en scikit-learn?
Aquí encontrará una descripción general del proceso de optimización de hiperparámetros en scikit-learn . La búsqueda exhaustiva de la cuadrícula encontrará el conjunto óptimo de hiperparámetros para un modelo. La desventaja es que la búsqueda exhaustiva en la red es lenta. La búsqueda aleatoria es más rápida que la búsqueda …

2
¿Es max_depth en scikit el equivalente a la poda en los árboles de decisión?
Estaba analizando el clasificador creado usando un árbol de decisión. Hay un parámetro de ajuste llamado max_depth en el árbol de decisión de scikit. ¿Es esto equivalente a podar un árbol de decisión? Si no, ¿cómo podría podar un árbol de decisión usando scikit? dt_ap = tree.DecisionTreeClassifier(random_state=1, max_depth=13) boosted_dt = …



3
Relación entre convolución en matemáticas y CNN
He leído la explicación de la convolución y la entiendo hasta cierto punto. ¿Alguien puede ayudarme a entender cómo esta operación se relaciona con la convolución en redes neuronales convolucionales? ¿Es el filtro como una función gque aplica peso?
10 machine-learning  neural-network  deep-learning  cnn  convolution  machine-learning  ensemble-modeling  machine-learning  classification  data-mining  clustering  machine-learning  feature-selection  convnet  pandas  graphs  ipython  machine-learning  apache-spark  multiclass-classification  naive-bayes-classifier  multilabel-classification  machine-learning  data-mining  dataset  data-cleaning  data  machine-learning  data-mining  statistics  correlation  machine-learning  data-mining  dataset  data-cleaning  data  beginner  career  python  r  visualization  machine-learning  data-mining  nlp  stanford-nlp  dataset  linear-regression  time-series  correlation  anomaly-detection  ensemble-modeling  data-mining  machine-learning  python  data-mining  recommender-system  machine-learning  cross-validation  model-selection  scoring  prediction  sequential-pattern-mining  categorical-data  python  tensorflow  image-recognition  statistics  machine-learning  data-mining  predictive-modeling  data-cleaning  preprocessing  classification  deep-learning  tensorflow  machine-learning  algorithms  data  keras  categorical-data  reference-request  loss-function  classification  logistic-regression  apache-spark  prediction  naive-bayes-classifier  beginner  nlp  word2vec  vector-space-models  scikit-learn  decision-trees  data  programming 




Al usar nuestro sitio, usted reconoce que ha leído y comprende nuestra Política de Cookies y Política de Privacidad.
Licensed under cc by-sa 3.0 with attribution required.