Ultralytics YOLO27 :
Vision par IA

Types de techniques d’apprentissage de l’IA utilisées en vision par ordinateur

Explore les différents types de techniques d’apprentissage automatique et d’apprentissage profond utilisés dans les applications de vision par ordinateur, de l’apprentissage supervisé à l’apprentissage par transfert.

ABAbirami Vina10 min read
Types de techniques d’apprentissage de l’IA utilisées en vision par ordinateur

L’apprentissage automatique est un type d’intelligence artificielle (AI) qui aide les ordinateurs à apprendre à partir de données afin de prendre des décisions de manière autonome, sans nécessiter une programmation détaillée pour chaque tâche. Il consiste à créer des modèles algorithmiques capables d’identifier des tendances dans les données. En identifiant des tendances dans les données et en apprenant à partir de celles-ci, ces algorithmes peuvent progressivement améliorer leurs performances au fil du temps.

L’un des domaines où l’apprentissage automatique joue un rôle crucial est la vision par ordinateur, un domaine de l’IA axé sur les données visuelles. La vision par ordinateur utilise l’apprentissage automatique pour aider les ordinateurs à détecter et à reconnaître des tendances dans les images et les vidéos. Grâce aux avancées de l’apprentissage automatique, la valeur du marché mondial de la vision par ordinateur devrait atteindre environ 175,72 milliards de dollars d’ici 2032.

Dans cet article, nous allons examiner les différents types d’apprentissage automatique utilisés en vision par ordinateur, notamment l’apprentissage supervisé, non supervisé, par renforcement et par transfert, ainsi que le rôle de chacun dans différentes applications. C’est parti !

Présentation de l’apprentissage automatique en vision par ordinateur#

La vision par ordinateur s’appuie sur l’apprentissage automatique, notamment sur des techniques comme l’apprentissage profond et les réseaux neuronaux, pour interpréter et analyser les informations visuelles. Ces méthodes permettent aux ordinateurs d’effectuer des tâches de vision par ordinateur, comme la détection d’objets dans les images, la classification d’images par catégorie et la reconnaissance faciale. L’apprentissage automatique est également essentiel pour les applications de vision par ordinateur en temps réel, comme le contrôle qualité dans le secteur de la fabrication et l’imagerie médicale dans le domaine de la santé. Dans ces cas, les réseaux neuronaux aident les ordinateurs à interpréter des données visuelles complexes, par exemple en analysant des scanners cérébraux pour détecter des tumeurs.

En fait, de nombreux modèles avancés de vision par ordinateur, comme Ultralytics YOLO11, sont conçus à partir de réseaux neuronaux.

Segmentation de scanners cérébraux avec Ultralytics YOLO11

Fig. 1. Segmentation de scanners cérébraux avec Ultralytics YOLO11.

Il existe plusieurs méthodes d’apprentissage automatique, comme l’apprentissage supervisé, l’apprentissage non supervisé, l’apprentissage par transfert et l’apprentissage par renforcement, qui repoussent les limites de ce qui est possible en vision par ordinateur. Dans les sections suivantes, nous examinerons chacun de ces types afin de comprendre comment ils contribuent à la vision par ordinateur.

Exploration de l’apprentissage supervisé#

L’apprentissage supervisé est le type d’apprentissage automatique le plus utilisé. Dans l’apprentissage supervisé, les modèles sont entraînés à l’aide de données étiquetées. Chaque entrée est associée à la sortie correcte, ce qui aide le modèle à apprendre. Comme un élève qui apprend auprès d’un enseignant, ces données étiquetées servent de guide ou de supervision.

Pendant l’entraînement, le modèle reçoit à la fois des données d’entrée (les informations qu’il doit traiter) et des données de sortie (les réponses correctes). Cette configuration aide le modèle à apprendre le lien entre les entrées et les sorties. L’objectif principal de l’apprentissage supervisé est que le modèle découvre une règle ou une tendance reliant précisément chaque entrée à sa sortie correcte. Grâce à cette correspondance, le modèle peut effectuer des prédictions précises lorsqu’il rencontre de nouvelles données. Par exemple, la reconnaissance faciale en vision par ordinateur s’appuie sur l’apprentissage supervisé pour identifier les visages à partir de ces tendances apprises.

Une utilisation courante consiste à déverrouiller ton smartphone grâce à la reconnaissance faciale. Le modèle est entraîné sur des images étiquetées de ton visage afin que, lorsque tu déverrouilles ton téléphone, il compare l’image en direct avec ce qu’il a appris. S’il détecte une correspondance, ton téléphone se déverrouille.

Reconnaissance faciale utilisée pour déverrouiller ton smartphone

Fig. 2. La reconnaissance faciale peut être utilisée pour déverrouiller ton smartphone.

Comment fonctionne l’apprentissage non supervisé en IA ?#

L’apprentissage non supervisé est un type d’apprentissage automatique qui utilise des données non étiquetées : le modèle ne reçoit aucune indication ni réponse correcte pendant l’entraînement. Il apprend plutôt à découvrir lui-même des tendances et des informations utiles.

L’apprentissage non supervisé identifie les tendances à l’aide de trois méthodes principales :

  • Regroupement : regroupe les points de données similaires. Cette méthode est utile pour des tâches comme la segmentation de la clientèle, où des clients similaires peuvent être regroupés en fonction de leurs comportements ou de leurs attributs.
  • Association : elle sert à identifier les relations entre les éléments et à révéler les liens au sein des données (par exemple, trouver les produits souvent achetés ensemble dans le cadre de l’analyse du panier de marché).
  • Réduction de dimensionnalité : simplifie les jeux de données en supprimant les caractéristiques redondantes, ce qui facilite leur visualisation et leur traitement.

Une application clé de l’apprentissage non supervisé est la compression d’images, dans laquelle des techniques comme le regroupement k-means réduisent la taille des images sans en altérer la qualité visuelle. Les pixels sont regroupés en clusters, et chaque cluster est représenté par une couleur moyenne, ce qui produit une image comportant moins de couleurs et une taille de fichier réduite.

Exemple de compression d’image non supervisée

Fig. 3. Exemple de compression d’image non supervisée.

Cependant, l’apprentissage non supervisé présente certaines limites. En l’absence de réponses prédéfinies, il peut avoir des difficultés en matière de précision et d’évaluation des performances. Il faut souvent intervenir manuellement pour interpréter les résultats et étiqueter les groupes, et cette méthode est sensible à des problèmes tels que les valeurs manquantes et le bruit, qui peuvent nuire à la qualité des résultats.

L’apprentissage par renforcement expliqué#

Contrairement aux apprentissages supervisé et non supervisé, l’apprentissage par renforcement ne repose pas sur des données d’entraînement. Il utilise plutôt des agents basés sur des réseaux neuronaux qui interagissent avec un environnement pour atteindre un objectif précis.

Le processus comprend trois composants principaux :

  • Agent : l’apprenant ou le décideur.
  • Environnement : tout ce avec quoi l’agent interagit, que cela soit réel ou virtuel.
  • Signal de récompense : une valeur numérique fournie après chaque action, qui guide l’agent vers l’objectif.

Lorsque l’agent agit, il influence l’environnement, qui lui répond ensuite par un retour d’information. Ce retour aide l’agent à évaluer ses choix et à ajuster son comportement. Le signal de récompense permet à l’agent de comprendre quelles actions le rapprochent de son objectif.

L’apprentissage par renforcement joue un rôle clé dans des cas d’utilisation comme la conduite autonome et la robotique. Dans la conduite autonome, des tâches comme le contrôle du véhicule, la détection et l’évitement d’objets apprennent à partir des retours d’information. Les modèles sont entraînés à l’aide d’agents basés sur des réseaux neuronaux pour détecter les piétons ou d’autres objets et prendre les mesures appropriées afin d’éviter les collisions. De même, en robotique, l’apprentissage par renforcement permet d’effectuer des tâches comme la manipulation d’objets et le contrôle des mouvements.

Un excellent exemple d’apprentissage par renforcement en action est un projet d’OpenAI, dans lequel des chercheurs ont entraîné des agents d’IA à jouer au célèbre jeu vidéo multijoueur Dota 2. À l’aide de réseaux neuronaux, ces agents traitaient d’énormes quantités d’informations provenant de l’environnement de jeu afin de prendre rapidement des décisions stratégiques. Grâce à un retour d’information continu, les agents ont appris et se sont améliorés au fil du temps, atteignant finalement un niveau suffisamment élevé pour battre certains des meilleurs joueurs du jeu.

Interprétation humaine et IA de la matrice de Dota

Fig. 4. Interprétation humaine et IA de la matrice de Dota.

Comprendre les bases de l’apprentissage par transfert#

L’apprentissage par transfert se distingue des autres types d’apprentissage. Au lieu d’entraîner un modèle à partir de zéro, il utilise un modèle pré-entraîné sur un vaste jeu de données et l’ajuste pour une nouvelle tâche qui lui est liée. Les connaissances acquises pendant l’entraînement initial servent à améliorer les performances de la nouvelle tâche. L’apprentissage par transfert réduit le temps nécessaire pour entraîner un modèle à une nouvelle tâche, selon la complexité de celle-ci. Il conserve les premières couches du modèle, qui capturent les caractéristiques générales, et remplace les dernières couches par celles correspondant à la nouvelle tâche spécifique.

Le transfert de style artistique est une application intéressante de l’apprentissage par transfert en vision par ordinateur. Cette technique permet à un modèle de transformer une image pour lui appliquer le style de différentes œuvres d’art. Pour cela, un réseau neuronal est d’abord entraîné sur un vaste jeu de données d’images associées à leurs styles artistiques. Grâce à ce processus, le modèle apprend à identifier les caractéristiques générales des images et les tendances stylistiques.

Une fois le modèle entraîné, il peut être ajusté pour appliquer le style d’une peinture donnée à une nouvelle image. Le réseau s’adapte à la nouvelle image tout en conservant les caractéristiques stylistiques apprises, ce qui lui permet de créer un résultat unique combinant le contenu original et le style artistique sélectionné. Par exemple, tu peux prendre une photo d’une chaîne de montagnes et lui appliquer le style du Cri d’Edvard Munch, pour obtenir une image qui restitue la scène tout en adoptant le style audacieux et expressif du tableau.

Exemple de transfert de style artistique utilisant l’apprentissage par transfert

Fig. 5. Exemple de transfert de style artistique utilisant l’apprentissage par transfert.

Comparaison des différents types d’apprentissage automatique#

Maintenant que nous avons couvert les principaux types d’apprentissage automatique, examinons chacun d’eux plus en détail afin de t’aider à comprendre lequel convient le mieux à différentes applications.

  • Apprentissage supervisé : ce type est très précis lorsqu’il travaille avec des données étiquetées, mais il nécessite beaucoup de données et peut être sensible au bruit.
  • Apprentissage non supervisé : il est utile pour explorer des données non étiquetées afin d’y trouver des tendances cachées, même si les résultats peuvent être moins précis et plus difficiles à interpréter.
  • Apprentissage par renforcement : il entraîne des agents à prendre des décisions étape par étape dans des environnements complexes, mais il nécessite souvent une puissance de calcul importante.
  • Apprentissage par transfert : cette approche utilise des modèles pré-entraînés pour accélérer l’entraînement et améliorer les performances sur de nouvelles tâches, en particulier lorsque les données sont limitées.

Comparaison de tous les types d’apprentissage automatique

Fig. 6. Comparaison de tous les types d’apprentissage automatique. Image réalisée par l’auteur.

Le choix du type d’apprentissage automatique adapté dépend de plusieurs facteurs. L’apprentissage supervisé convient bien si tu disposes de nombreuses données étiquetées et d’une tâche clairement définie. L’apprentissage non supervisé est utile pour explorer les données ou lorsque les exemples étiquetés sont rares. L’apprentissage par renforcement est idéal pour les tâches complexes nécessitant une prise de décision étape par étape, tandis que l’apprentissage par transfert est particulièrement adapté lorsque les données sont limitées ou que les ressources sont restreintes. En tenant compte de ces facteurs, tu peux sélectionner l’approche la plus adaptée à ton projet de vision par ordinateur.

Pour conclure#

Les techniques d’apprentissage automatique peuvent relever une grande variété de défis, notamment dans des domaines comme la vision par ordinateur. En comprenant les différents types — apprentissage supervisé, non supervisé, par renforcement et par transfert —, tu peux choisir l’approche la mieux adaptée à tes besoins.

L’apprentissage supervisé est idéal pour les tâches nécessitant une grande précision et des données étiquetées, tandis que l’apprentissage non supervisé convient pour trouver des tendances dans des données non étiquetées. L’apprentissage par renforcement est efficace dans les contextes complexes fondés sur la prise de décision, et l’apprentissage par transfert est utile lorsque tu veux t’appuyer sur des modèles pré-entraînés avec peu de données.

Chaque méthode possède ses propres atouts et applications, de la reconnaissance faciale à la robotique en passant par le transfert de style artistique. Choisir le bon type peut ouvrir de nouvelles possibilités dans des secteurs comme la santé, l’automobile et le divertissement.

Pour en savoir plus, consulte notre dépôt GitHub et rejoins notre communauté. Découvre les applications de l’AI dans les voitures autonomes et l’agriculture sur nos pages consacrées aux solutions. 🚀

Explore solutions

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus

Construisons ensemble l'avenir de l'IA !

Commence ton parcours vers l'avenir de l'apprentissage automatique