Semi-Supervised Learning
Scopri come l'apprendimento semisupervisionato combina dati etichettati e non etichettati per aumentare l'accuratezza del modello. Impara a implementare workflow SSL usando Ultralytics YOLO26.
L'apprendimento semi-supervisionato (SSL) è un paradigma strategico nell'apprendimento automatico (ML) che funge da ponte tra due metodi di addestramento tradizionali. Mentre l'apprendimento supervisionato si basa interamente su dataset completamente annotati e l'apprendimento non supervisionato tenta di individuare schemi nei dati senza alcun tag, l'SSL opera combinando una piccola quantità di dati etichettati con un insieme significativamente più ampio di dati non etichettati. Questo approccio è particolarmente utile negli scenari reali di visione artificiale (CV), dove la raccolta di immagini grezze, come i filmati delle telecamere di sicurezza o dei satelliti, è relativamente economica, mentre il processo di etichettatura dei dati da parte di esperti umani è costoso, lento e laborioso. Utilizzando efficacemente la struttura nascosta negli esempi non etichettati, l'SSL può migliorare significativamente l'accuratezza del modello e la capacità di generalizzazione senza richiedere un budget esaustivo per le annotazioni.
Meccanismi fondamentali dell'apprendimento semi-supervisionato#
L'obiettivo principale dell'SSL è propagare le informazioni presenti nel piccolo insieme di esempi etichettati all'insieme più ampio di dati non etichettati. Questo consente alla rete neurale di apprendere confini decisionali che attraversano regioni a bassa densità dei dati, producendo classificazioni o rilevamenti più robusti.
Due tecniche diffuse guidano la maggior parte dei workflow semi-supervisionati:
- Pseudo-etichettatura: con questo metodo, un modello viene prima addestrato sui dati etichettati disponibili. Viene quindi utilizzato per eseguire l'inferenza sui dati non etichettati. Le predizioni che superano una specifica soglia di confidenza vengono trattate come "pseudo-etichette" o verità di riferimento. Queste predizioni affidabili vengono aggiunte ai dati di addestramento e il modello viene riaddestrato, migliorando iterativamente le proprie prestazioni.
- Regolarizzazione della coerenza: questa tecnica si basa sull'aumento dei dati. L'idea è che un modello debba produrre predizioni simili per un'immagine e per una versione leggermente modificata (aumentata) della stessa immagine. Riducendo al minimo la differenza tra le predizioni della versione originale e di quella aumentata, il modello impara a concentrarsi sulle caratteristiche fondamentali dell'oggetto anziché sul rumore, migliorando la propria capacità di gestire l'overfitting.
Implementazione pratica con YOLO#
Il seguente esempio in Python dimostra un semplice workflow di pseudo-etichettatura utilizzando il pacchetto ultralytics. Qui addestriamo un modello YOLO26 su un piccolo dataset e poi lo utilizziamo per generare etichette per una directory di immagini non etichettate.
from ultralytics import YOLO
# Load the latest YOLO26 model
model = YOLO("yolo26n.pt")
# Train initially on a small available labeled dataset
model.train(data="coco8.yaml", epochs=10)
# Run inference on unlabeled data to generate pseudo-labels
# Setting save_txt=True saves the detections as text files for future training
results = model.predict(source="./unlabeled_images", save_txt=True, conf=0.85)Applicazioni nel mondo reale#
L'apprendimento semi-supervisionato sta trasformando i settori in cui i dati sono abbondanti, ma le competenze specialistiche scarseggiano.
- Imaging medico: nell'IA per la sanità, acquisire scansioni (radiografie, risonanze magnetiche) è una procedura standard, ma incaricare un radiologo abilitato ad annotare ogni pixel per il rilevamento dei tumori è proibitivo. L'SSL consente ai ricercatori di addestrare modelli ad alte prestazioni utilizzando solo una frazione dei casi annotati da esperti, sfruttando migliaia di scansioni archiviate per affinare la comprensione delle strutture biologiche da parte del modello.
- Guida autonoma: le aziende che sviluppano auto a guida autonoma raccolgono quotidianamente petabyte di dati video dai veicoli della propria flotta. Etichettare ogni fotogramma per il rilevamento degli oggetti e la segmentazione semantica è impossibile. Attraverso l'SSL, il sistema può apprendere dalla vasta maggioranza delle ore di guida non etichettate per comprendere meglio ambienti stradali complessi, condizioni meteorologiche e casi limite rari.
Distinzione tra concetti correlati#
Per implementare efficacemente soluzioni di IA, è fondamentale capire in che modo l'SSL differisce da strategie simili:
- vs. Apprendimento attivo: sebbene entrambi gestiscano dati non etichettati, il loro approccio all'etichettatura è diverso. L'SSL assegna automaticamente le etichette in base alle predizioni del modello. Al contrario, l'apprendimento attivo identifica i punti dati più "confusi" o incerti e chiede esplicitamente a una persona nel ciclo di etichettarli, ottimizzando il tempo della persona invece di eliminarla completamente dal processo.
- vs. Apprendimento per trasferimento: l'apprendimento per trasferimento consiste nel prendere un modello preaddestrato su un enorme dataset esterno (come ImageNet) e sottoporlo al fine-tuning per il tuo compito specifico. L'SSL, invece, si concentra sullo sfruttamento della porzione non etichettata della distribuzione del tuo dataset specifico durante il processo di addestramento stesso.
- vs. Apprendimento auto-supervisionato: sebbene i nomi siano simili, l'apprendimento auto-supervisionato si riferisce spesso a "attività pretest" (come risolvere un puzzle composto da frammenti di immagini), in cui i dati generano autonomamente i propri segnali di supervisione senza etichette esterne. L'SSL implica specificamente l'uso di un insieme più piccolo di etichette verificate per guidare il processo.
Strumenti e prospettive future#
Con l'aumento delle dimensioni dei modelli di deep learning (DL), l'efficienza nell'uso dei dati diventa fondamentale. Framework moderni come PyTorch e TensorFlow forniscono il backend computazionale per questi cicli di addestramento avanzati. Inoltre, strumenti come la Ultralytics Platform stanno semplificando il ciclo di vita della gestione dei dataset. Utilizzando funzionalità come l'auto-annotazione, i team possono implementare più facilmente workflow semi-supervisionati, trasformando rapidamente i dati grezzi in pesi del modello pronti per la produzione. Questa evoluzione nell'MLOps garantisce che la barriera d'ingresso per la creazione di sistemi di visione ad alta accuratezza continui ad abbassarsi.









