Semi-Supervised Learning
Découvre comment l’apprentissage semi-supervisé combine des données annotées et non annotées pour améliorer la précision des modèles. Apprends à mettre en œuvre des workflows SSL avec Ultralytics YOLO26.
L'apprentissage semi-supervisé (SSL) est un paradigme stratégique de l'apprentissage automatique (ML) qui fait le lien entre deux méthodes d'entraînement traditionnelles. Alors que l'apprentissage supervisé repose entièrement sur des jeux de données intégralement annotés et que l'apprentissage non supervisé cherche à trouver des motifs dans les données sans aucune étiquette, le SSL fonctionne en combinant une petite quantité de données étiquetées avec un volume nettement plus important de données non étiquetées. Cette approche est particulièrement utile dans les scénarios réels de vision par ordinateur (CV), où la collecte d'images brutes — comme des séquences vidéo provenant de caméras de sécurité ou de satellites — est relativement peu coûteuse, mais où le processus d'étiquetage des données par des experts humains est coûteux, lent et exigeant en main-d'œuvre. En exploitant efficacement la structure cachée dans les exemples non étiquetés, le SSL peut améliorer considérablement la précision du modèle et sa capacité de généralisation sans nécessiter un budget d'annotation exhaustif.
Mécanismes fondamentaux de l'apprentissage semi-supervisé#
L'objectif principal du SSL est de propager les informations présentes dans le petit ensemble d'exemples étiquetés vers l'ensemble non étiqueté, plus vaste. Cela permet au réseau neuronal d'apprendre des frontières de décision qui traversent les régions de faible densité des données, ce qui produit une classification ou une détection plus robuste.
Deux techniques populaires sont au cœur de la plupart des workflows semi-supervisés :
- Pseudo-étiquetage : Avec cette méthode, un modèle est d'abord entraîné sur les données étiquetées limitées. Il est ensuite utilisé pour effectuer des inférences sur les données non étiquetées. Les prédictions qui dépassent un seuil spécifique de confiance sont traitées comme des « pseudo-étiquettes » ou comme la vérité terrain. Ces prédictions fiables sont ajoutées aux données d'entraînement, puis le modèle est réentraîné, ce qui améliore progressivement ses performances.
- Régularisation par cohérence : Cette technique repose sur l'augmentation des données. L'idée est qu'un modèle doit produire des prédictions similaires pour une image et pour une version légèrement modifiée (augmentée) de cette même image. En réduisant la différence entre les prédictions de la version originale et de la version augmentée, le modèle apprend à se concentrer sur les caractéristiques essentielles de l'objet plutôt que sur le bruit, ce qui améliore sa capacité à gérer le surapprentissage.
Mise en œuvre pratique avec YOLO#
L'exemple Python suivant présente un workflow simple de pseudo-étiquetage utilisant le package ultralytics. Ici, nous entraînons un modèle YOLO26 sur un petit jeu de données, puis nous l'utilisons pour générer des étiquettes pour un répertoire d'images non étiquetées.
from ultralytics import YOLO
# Load the latest YOLO26 model
model = YOLO("yolo26n.pt")
# Train initially on a small available labeled dataset
model.train(data="coco8.yaml", epochs=10)
# Run inference on unlabeled data to generate pseudo-labels
# Setting save_txt=True saves the detections as text files for future training
results = model.predict(source="./unlabeled_images", save_txt=True, conf=0.85)Applications concrètes#
L'apprentissage semi-supervisé transforme les secteurs où les données sont abondantes, mais l'expertise rare.
- Imagerie médicale : Dans l'IA appliquée aux soins de santé, l'acquisition d'images médicales (radiographies, IRM) est une procédure courante, mais faire annoter chaque pixel pour la détection de tumeurs par un radiologue certifié est d'un coût prohibitif. Le SSL permet aux chercheurs d'entraîner des modèles très performants en utilisant seulement une fraction des cas annotés par des experts, tout en exploitant des milliers d'images médicales archivées pour affiner la compréhension des structures biologiques par le modèle.
- Conduite autonome : Les entreprises de véhicules autonomes collectent chaque jour des pétaoctets de données vidéo provenant de leurs flottes. Il est impossible d'annoter chaque image pour la détection d'objets et la segmentation sémantique. Grâce au SSL, le système peut apprendre à partir de la grande majorité des heures de conduite non annotées afin de mieux comprendre les environnements routiers complexes, les conditions météorologiques et les cas limites rares.
Distinction entre concepts connexes#
Pour déployer efficacement des solutions d'IA, il est essentiel de comprendre en quoi le SSL diffère des stratégies similaires :
- Par rapport à l'apprentissage actif : Bien que les deux méthodes traitent des données non étiquetées, leur approche de l'étiquetage diffère. Le SSL attribue automatiquement des étiquettes en fonction des prédictions du modèle. En revanche, l'apprentissage actif identifie les points de données les plus « déroutants » ou incertains et demande explicitement à un humain dans la boucle de les étiqueter, afin d'optimiser le temps de la personne plutôt que de la supprimer complètement du processus.
- Par rapport à l'apprentissage par transfert : L'apprentissage par transfert consiste à prendre un modèle pré-entraîné sur un vaste jeu de données externe, comme ImageNet, puis à l'affiner pour ta tâche spécifique. Le SSL se concentre toutefois sur l'exploitation de la partie non étiquetée de la distribution de données de ton jeu de données spécifique au cours même du processus d'entraînement.
- Par rapport à l'apprentissage auto-supervisé : Bien que les noms soient similaires, l'apprentissage auto-supervisé désigne souvent des « tâches prétextes » (comme résoudre un puzzle composé de morceaux d'image), dans lesquelles les données génèrent leurs propres signaux de supervision sans aucune étiquette externe. Le SSL implique spécifiquement l'utilisation d'un ensemble plus restreint d'étiquettes vérifiées pour guider le processus.
Outils et perspectives d'avenir#
À mesure que les modèles d'apprentissage profond (DL) gagnent en taille, l'efficacité de l'utilisation des données devient primordiale. Les frameworks modernes comme PyTorch et TensorFlow fournissent le backend de calcul nécessaire à ces boucles d'entraînement avancées. En outre, des outils comme l'Ultralytics Platform simplifient la gestion du cycle de vie des jeux de données. En utilisant des fonctionnalités comme l'auto-annotation, les équipes peuvent mettre en œuvre plus facilement des workflows semi-supervisés et transformer rapidement des données brutes en poids de modèle prêts pour la production. Cette évolution du MLOps garantit que la barrière à l'entrée pour créer des systèmes de vision haute précision continue de s'abaisser.









