Salta al contenuto
Note per Studenti Lezione 22 · Support vector machines e kernel

Lezione 22Support vector machines e kernel

In questa pagina 3

Settimana: 8 · Fonte: slide del corso Machine Learning, Ingegneria dell'Automazione UniPD (lezione 22)

Argomenti trattati

  1. Avvertenza d'esame: le SVM sono valutate solo nella parte teorica.
  2. Classificatore a margine massimo: bordo di decisione, margine, sensibilità agli outlier (overfitting e alta varianza).
  3. Margine morbido e Support Vector Classifier: variabili di scarto, parametro CC scelto per cross-validation; esempio sull'Iris (Virginica contro Versicolour, soli attributi del petalo) con CC da 0,010{,}01 a 100100.
  4. Formulazione: iperpiani w⋅x+b=0,±1w\cdot x+b=0,\pm1, margine 2/∥w∥2/\|w\|, problema convesso min⁡12∥w∥2\min\frac12\|w\|^2 con vincoli, forma primale con hinge loss; la discesa del gradiente non è la scelta migliore (meglio SMO e solutori per programmazione quadratica).
  5. Oltre i bordi lineari: espansione di base e suo costo, kernel trick (lineare, polinomiale, RBF, sigmoide), confronto su Moons, Circles e Iris.
  6. Support Vector Regression con tubo ε\varepsilon.
  7. Curva ROC e AUC applicate alle SVM sul dataset Moons (trattate in dettaglio in Metriche di classificazioneIn classificazione binaria ogni previsione è vero positivo (TP), vero negativo (TN), falso positivo (FP, errore di tipo I) o falso negativo (FN, errore di tipo II). Da queste quattro quantità: accuracy $=\frac{TP+TN}{TP+TN+FP+FN}$, specificità $=\frac{TN}{TN+FP}$, precision $=\frac{TP}{TP+FP}$, recall $=\frac{TP}{TP+FN}$, e la loro media armonica $F_1=\frac{2PR}{P+R}$. Con dati sbilanciati l'accuracy inganna (un modello che predice sempre la classe maggioritaria ha 99%): si usano precision, recall, F1, ROC-AUC, la cross-validation stratificata e il riequilibrio con undersampling o oversampling (non SMOTE). Cambiando la soglia sulla probabilità si ottiene la curva ROC (TPR contro FPR) e l'area AUC. Approfondimento: non nel programma di Telecomunicazioni.Metriche di classificazione →).

Teoria

Esercizi

Lezione precedente: Lezione 21 · Laboratorio anomaly detection e clustering Lezione successiva: Lezione 23 · Introduzione al deep learning