Data Mining 2 Project
Target variables: vocal_channel, sex, emotional_intensity, emotion
- Simone: Gradient Boosting
- Blerta: KNN e DT con class_weight; Random Undersampling con 10 iterazioni (random_state diverso per ogni iterazione); dummy classifier come baseline.
- Giacomo: Regression
- Blerta: riportare valori di accuracy e F1 weighted per logistic
- Per ogni modello-target calcolare anche le probabilità per ROC e riportarle su file DM2_Evaluation
- F1 considerare sempre weighted
- Metodo per outliers: va bene intersezioni tra metodi?
- NN: perché validation alta e test basso?
- Multi-regression task: quali modelli? Selezione dei target?