Digamos que tengo un problema simple de aprendizaje automático como una clasificación. Con algunos puntos de referencia en visión o reconocimiento de audio, yo, como humano, soy un muy buen clasificador. Por lo tanto, tengo una intuición sobre qué tan bueno puede ser un clasificador.
Pero con muchos datos, un punto es que no sé qué tan bueno es el clasificador que entreno. Estos son datos en los que personalmente no soy un buen clasificador (por ejemplo, clasificar el estado de ánimo de una persona a partir de los datos de EEG). No es realmente posible intuir cuán difícil es mi problema.
Ahora, si me presentan un problema de aprendizaje automático, me gustaría saber qué tan bueno puedo ser. ¿Hay algún enfoque basado en principios para esto? ¿Cómo harías esto?
Visualizar datos? Comience con modelos simples? ¿Comenzar con modelos muy complejos y ver si puedo sobreajustar? ¿Qué estás buscando si quieres responder a esta pregunta? ¿Cuándo dejas de intentarlo?