Ultralytics YOLO27 :
Vision par IA

L’apprentissage actif accélère le développement de la vision par ordinateur

Découvre comment l’apprentissage actif est utilisé en vision par ordinateur pour réduire les efforts d’annotation et explore ses applications concrètes dans divers secteurs.

ABAbirami Vina11 min read
L’apprentissage actif accélérant le développement de la vision par ordinateur

Entraîner un modèle de vision par ordinateur ressemble beaucoup à apprendre à un enfant à reconnaître les couleurs. Tout d’abord, il te faudrait une collection d’objets colorés. Ensuite, tu guiderais l’enfant pour qu’il identifie correctement chaque couleur, une tâche souvent chronophage et répétitive.

Tout comme un enfant a besoin de nombreux exemples pour apprendre, un modèle de vision a besoin d’un vaste ensemble de données annotées pour reconnaître les motifs et les objets dans les images. Cependant, annoter de grandes quantités de données demande beaucoup de temps et d’efforts, sans parler des ressources nécessaires. Des techniques comme l’apprentissage actif peuvent contribuer à simplifier ce processus.

L’apprentissage actif est un processus étape par étape au cours duquel les données les plus importantes d’un vaste jeu de données sont sélectionnées et annotées. Le modèle apprend à partir de ces données annotées, ce qui le rend plus précis et plus performant. En se concentrant uniquement sur les données les plus utiles, on réduit la quantité d’annotations nécessaires et on accélère le développement du modèle.

Dans cet article, nous examinerons comment l’apprentissage actif facilite l’entraînement des modèles, réduit les coûts d’annotation et améliore la précision globale du modèle.

Les jeux de données d’images ne sont pas faciles à constituer#

Les jeux de données constituent le fondement des modèles de vision par ordinateur et d’apprentissage profond. Les jeux de données populaires comme ImageNet proposent des millions d’images couvrant diverses catégories d’objets. Cependant, créer et gérer de si vastes volumes de jeux de données de haute qualité comporte plusieurs difficultés.

Par exemple, la collecte et l’annotation des données nécessitent du temps, des ressources et des annotateurs qualifiés, ce qui rend le processus difficile selon l’application concernée. Des solutions innovantes et plus efficaces sont nécessaires pour répondre à la demande croissante de jeux de données d’images, et c’est précisément ce que l’apprentissage actif cherche à résoudre.

L’apprentissage actif offre une solution idéale en optimisant le processus d’annotation des données. En sélectionnant stratégiquement les points de données les plus informatifs à annoter, l’apprentissage actif maximise les performances du modèle tout en réduisant les efforts d’annotation.

Qu’est-ce que l’apprentissage actif ?#

L’apprentissage actif est une technique itérative d’apprentissage automatique dans laquelle le modèle sélectionne les points de données les plus importants à annoter parmi un vaste ensemble de données non annotées. Ces points de données sélectionnés sont annotés manuellement, puis ajoutés au jeu de données d’entraînement.

Le modèle est ensuite réentraîné sur le jeu de données mis à jour et sélectionne le prochain ensemble de points de données à annoter. Ce processus se répète, le modèle s’améliorant continuellement en se concentrant sur les points de données les plus informatifs. Le cycle se poursuit jusqu’à ce que le modèle atteigne la précision souhaitée ou respecte les critères d’annotation définis à l’avance.

Vue d’ensemble de l’apprentissage actif

Fig. 1 Vue d’ensemble de l’apprentissage actif.

Comprendre le fonctionnement de l’apprentissage actif#

Tu te demandes peut-être comment la technique d’apprentissage actif détermine quels points de données doivent être annotés manuellement et lesquels annoter ensuite. Comprenons son fonctionnement en le comparant aux révisions pour un examen : tu te concentres sur les sujets dont tu n’es pas sûr et tu veilles également à couvrir différents thèmes pour être bien préparé.

Pour les premières étapes de sélection des données, l’apprentissage actif utilise des stratégies comme l’échantillonnage par incertitude et l’échantillonnage fondé sur la diversité. L’échantillonnage par incertitude donne la priorité aux points de données pour lesquels le modèle est le moins sûr de ses prédictions, afin d’améliorer la précision dans les cas difficiles. L’échantillonnage fondé sur la diversité sélectionne des points de données couvrant un large éventail de caractéristiques, afin que le modèle se généralise bien à des données inédites grâce à des exemples variés.

Échantillonnage par incertitude à gauche et échantillonnage fondé sur la diversité à droite

Fig. 2 Échantillonnage par incertitude (à gauche) et échantillonnage fondé sur la diversité (à droite).

Après la sélection initiale des données, l’apprentissage actif utilise deux approches principales pour l’annotation : l’échantillonnage fondé sur un pool et l’échantillonnage fondé sur un flux. Elles ressemblent à la façon dont un enseignant aide un élève à se concentrer sur ce qui est le plus important.

Avec l’échantillonnage fondé sur un pool, le modèle parcourt un vaste ensemble de données non annotées et sélectionne les exemples les plus difficiles ou les plus informatifs à annoter, comme un élève qui donne la priorité aux fiches de révision qu’il trouve les plus difficiles. Dans le cas de l’échantillonnage fondé sur un flux, le modèle traite les données au fur et à mesure de leur arrivée et décide de les annoter ou de les ignorer, comme un élève qui demande de l’aide uniquement lorsqu’il est bloqué. Dans les deux cas, les données annotées sont ajoutées à l’ensemble d’entraînement et le modèle se réentraîne, s’améliorant progressivement à chaque itération.

Explorer les applications de l’apprentissage actif#

L’apprentissage actif joue un rôle essentiel dans les applications de vision par ordinateur, comme l’imagerie médicale et la conduite autonome, en améliorant la précision des modèles et en rationalisant le processus d’annotation des données. Un exemple intéressant concerne les modèles de vision par ordinateur utilisés dans les voitures autonomes pour détecter les piétons ou les objets dans des conditions de faible luminosité ou de brouillard. L’apprentissage actif peut améliorer la précision en se concentrant sur des scénarios de conduite variés et difficiles.

Plus précisément, l’apprentissage actif peut servir à identifier les données ou les images présentant une incertitude dans ces scénarios, afin de les annoter de manière sélective. L’ajout de ces exemples annotés à l’ensemble d’entraînement permet au modèle de mieux reconnaître les piétons et les objets dans des environnements difficiles, par exemple par mauvais temps ou lors de trajets nocturnes.

Par exemple, NVIDIA a utilisé l’apprentissage actif pour améliorer la détection des piétons de nuit dans ses modèles de conduite autonome. En sélectionnant stratégiquement les données les plus informatives pour l’entraînement, notamment dans les scénarios difficiles, les performances du modèle augmentent considérablement.

Détection d’un piéton avec un parapluie grâce à l’apprentissage actif

Fig. 3 Détection d’un piéton avec un parapluie grâce à l’apprentissage actif.

L’apprentissage actif peut réduire les coûts d’annotation#

Un autre aspect essentiel de l’apprentissage actif est sa capacité potentielle à réduire les coûts d’annotation. Il y parvient en se concentrant uniquement sur les points de données les plus importants, au lieu d’exiger l’annotation de l’ensemble du jeu de données. Cette approche ciblée permet d’économiser du temps, des efforts et de l’argent. En ciblant les échantillons incertains ou variés, l’apprentissage actif réduit le nombre d’annotations nécessaires tout en maintenant une grande précision du modèle.

En fait, les recherches montrent que l’apprentissage actif peut réduire les coûts d’annotation de 40 à 60 % sans sacrifier les performances. Cela est particulièrement utile dans des secteurs comme la santé et la fabrication, où l’annotation des données est coûteuse. En simplifiant le processus d’annotation, l’apprentissage actif aide les entreprises à développer des modèles plus rapidement et à les déployer plus efficacement, tout en maintenant leur précision.

Avantages de l’apprentissage actif#

Voici quelques-uns des autres avantages clés que l’apprentissage actif peut offrir :

  • Résoudre le déséquilibre des classes : l’apprentissage actif peut contribuer à résoudre les problèmes de déséquilibre des classes en annotant des instances issues des classes de données minoritaires. Le modèle peut ainsi être plus performant dans les scénarios rares où les données sont limitées.
  • Cycles de développement plus rapides : annoter moins de données accélère indirectement le processus de développement des modèles d’apprentissage automatique et de vision par ordinateur, ce qui laisse davantage de temps et de ressources pour les itérations et les expérimentations supplémentaires.
  • Adaptabilité : cette approche peut améliorer continuellement les données d’entraînement en itérant sur des échantillons incertains ou correspondant à des cas limites, ce qui la rend particulièrement adaptée aux jeux de données dynamiques ou évolutifs.

L’apprentissage actif et AutoML peuvent fonctionner ensemble#

L’apprentissage automatique (AutoML) vise à automatiser les tâches chronophages et itératives liées à la création et au déploiement de modèles d’apprentissage automatique. Il simplifie les workflows d’apprentissage automatique en automatisant des tâches comme la sélection des modèles et l’évaluation de leurs performances, afin de réduire le recours au travail manuel.

Lorsqu’il est intégré à l’apprentissage actif, AutoML peut accélérer et optimiser le cycle de vie du développement des modèles. Le composant d’apprentissage actif sélectionne stratégiquement les points de données les plus informatifs à annoter, tandis qu’AutoML améliore le modèle en automatisant le choix de l’architecture, des paramètres et de leur réglage.

Workflow AutoML

Fig. 4 Workflow AutoML.

Examinons cette combinaison de technologies à l’aide d’un exemple.

Supposons que tu essaies de détecter des pathologies rares dans l’imagerie médicale (un cas d’usage où les jeux de données annotées sont limités et coûteux à obtenir). L’apprentissage actif peut identifier et sélectionner des données incertaines, comme de subtiles variations dans des radiographies que le modèle ne parvient pas à classer. Ces données incertaines peuvent ensuite être traitées en priorité pour une annotation manuelle afin d’améliorer la compréhension du modèle.

Avec les données annotées, AutoML peut optimiser le modèle en explorant diverses architectures, des hyperparamètres et d’autres techniques d’augmentation des données. Ce processus itératif accélère le développement de modèles de vision fiables comme Ultralytics YOLO11, qui aident les professionnels de santé à établir des diagnostics précis.

Les défis de l’apprentissage actif#

L’apprentissage actif et ses techniques offrent de nombreux avantages, mais certains points doivent être pris en compte lors de la mise en œuvre de ces stratégies :

  • Choix de la stratégie de requête : l’apprentissage actif fait appel à de nombreuses techniques, et le choix de la meilleure méthode a un impact significatif sur l’efficacité du modèle. Une stratégie inadaptée peut réduire les performances du modèle pour une application donnée.
  • Coûts de réentraînement : la nature itérative de l’apprentissage actif nécessite des ressources de calcul coûteuses, en particulier pour les grands jeux de données. Le modèle est réentraîné après chaque cycle d’annotation, ce qui augmente sa complexité.
  • Qualité du modèle initial : l’efficacité de l’apprentissage actif dépend de la qualité du modèle initial. Un modèle initial peu performant risque de ne pas identifier correctement les points de données informatifs, ce qui entraîne des demandes d’annotation de qualité insuffisante et une baisse des performances globales.

L’avenir de l’apprentissage actif et d’AutoML#

Grâce aux avancées récentes en IA et en vision par ordinateur, l’apprentissage actif est appelé à relever des défis plus complexes et à rationaliser les workflows d’apprentissage automatique. Combiner l’apprentissage actif à des techniques comme l’apprentissage fédéré et l’apprentissage auto-supervisé peut encore améliorer l’efficacité et l’évolutivité des modèles de vision.

L’apprentissage fédéré permet d’entraîner un modèle sur plusieurs appareils ou serveurs dans un cadre distribué, sans que les données aient à quitter leur emplacement d’origine. Dans des secteurs comme la santé, où la confidentialité des données est essentielle, l’apprentissage fédéré permet d’entraîner directement le modèle sur des données locales sensibles tout en les conservant en sécurité. Au lieu de partager les données brutes, seuls les mises à jour ou les enseignements du modèle sont partagés, ce qui garantit la protection des informations privées tout en contribuant au processus d’entraînement.

Parallèlement, l’apprentissage auto-supervisé contribue à réduire le besoin de données annotées en préentraînant les modèles sur des données non annotées. Ce processus crée une base solide pour le modèle. L’apprentissage actif peut ensuite s’appuyer sur cette base en identifiant et en sélectionnant les points de données les plus importants pour une annotation humaine, afin d’affiner davantage le modèle.

De l’apprentissage actif à l’impact actif#

L’apprentissage actif offre un moyen pratique de relever des défis majeurs de la vision par ordinateur, comme le coût élevé de l’annotation des données et le besoin de modèles plus précis. En se concentrant uniquement sur l’annotation des points de données les plus utiles, il réduit l’effort demandé aux humains tout en améliorant les performances du modèle.

Associé à des technologies comme AutoML, l’apprentissage actif rationalise le développement des modèles en automatisant les tâches chronophages. À mesure que les avancées se poursuivent, l’apprentissage actif est appelé à devenir un outil essentiel pour créer des systèmes de vision par ordinateur plus intelligents et plus efficaces.

Explore notre dépôt GitHub et rejoins notre communauté pour en savoir plus sur l’IA et les modèles de vision par ordinateur. Découvre davantage d’applications de la vision par ordinateur dans l’industrie et dans le secteur de la santé sur nos pages consacrées aux solutions. Tu peux également consulter nos options de licence pour commencer dès aujourd’hui ton parcours dans le domaine de l’IA appliquée à la vision.

Explore solutions

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus

Construisons ensemble l'avenir de l'IA !

Commence ton parcours vers l'avenir de l'apprentissage automatique