Ultralytics YOLO27 :
Guides

Qu'est-ce que le surapprentissage en vision par ordinateur et comment l'éviter ?

Découvre ce qu'est le surapprentissage en vision par ordinateur et comment l'éviter grâce à l'augmentation des données, à la régularisation et aux modèles préentraînés.

ABAbdelrahman Elgendy10 min read
Le surapprentissage des modèles de vision par ordinateur et comment l'éviter

Les modèles de vision par ordinateur sont conçus pour reconnaître des motifs, détecter des objets et analyser des images. Cependant, leurs performances dépendent de leur capacité à généraliser à partir de données inédites. La généralisation est la capacité d’un modèle à fonctionner correctement sur de nouvelles images, et pas seulement sur celles utilisées pour son entraînement. Un problème courant lors de l’entraînement de ces modèles est le surapprentissage, qui survient lorsqu’un modèle apprend trop de choses à partir de ses données d’entraînement, notamment du bruit inutile, au lieu d’identifier des motifs pertinents.

Lorsque cela se produit, le modèle fonctionne bien sur les données d’entraînement, mais rencontre des difficultés avec de nouvelles images. Par exemple, un modèle de détection d’objets entraîné uniquement sur des images haute résolution et bien éclairées peut échouer lorsqu’il reçoit des images floues ou ombragées dans des conditions réelles. Le surapprentissage limite l’adaptabilité d’un modèle et restreint son utilisation dans des applications concrètes comme la conduite autonome, l’imagerie médicale et les systèmes de sécurité.

Dans cet article, nous allons examiner ce qu’est le surapprentissage, pourquoi il se produit et comment l’éviter. Nous verrons également comment les modèles de vision par ordinateur comme Ultralytics YOLO11 contribuent à réduire le surapprentissage et à améliorer la généralisation.

Qu’est-ce que le surapprentissage ?#

Le surapprentissage se produit lorsqu’un modèle mémorise les données d’entraînement au lieu d’apprendre des motifs applicables à de nouvelles entrées. Le modèle se concentre trop sur les données d’entraînement et rencontre donc des difficultés avec des images ou des situations inédites.

En vision par ordinateur, le surapprentissage peut affecter différentes tâches. Un modèle de classification entraîné uniquement sur des images lumineuses et nettes peut rencontrer des difficultés dans des conditions de faible luminosité. Un modèle de détection d’objets qui apprend à partir d’images parfaites peut échouer dans des scènes encombrées ou désordonnées. De même, un modèle de segmentation d’instances peut fonctionner correctement dans des environnements contrôlés, mais avoir des difficultés avec les ombres ou les objets qui se chevauchent.

Cela devient problématique dans les applications d’IA du monde réel, où les modèles doivent pouvoir généraliser au-delà de conditions d’entraînement contrôlées. Les voitures autonomes, par exemple, doivent pouvoir détecter des piétons dans différentes conditions d’éclairage, météorologiques et environnementales. Un modèle qui est en surapprentissage sur son ensemble d’entraînement ne donnera pas des résultats fiables dans des scénarios aussi imprévisibles.

Quand et pourquoi le surapprentissage se produit-il ?#

Le surapprentissage survient généralement en raison de jeux de données déséquilibrés, d’une complexité excessive du modèle et d’un entraînement trop long. Voici les principales causes :

  • Données d’entraînement limitées : les petits jeux de données amènent les modèles à mémoriser les motifs plutôt qu’à les généraliser. Un modèle entraîné sur seulement 50 images d’oiseaux peut avoir des difficultés à détecter des espèces d’oiseaux absentes de ce jeu de données.
  • Modèles complexes avec trop de paramètres : les réseaux profonds comportant un nombre excessif de couches et de neurones ont tendance à mémoriser les détails fins plutôt qu’à se concentrer sur les caractéristiques essentielles.
  • Absence d’augmentation des données : sans transformations comme le recadrage, le retournement ou la rotation, un modèle risque de n’apprendre qu’à partir des images exactes utilisées pour son entraînement.
  • Entraînement prolongé : si un modèle parcourt les données d’entraînement trop de fois, ce qui correspond au nombre d’époques, il mémorise les détails au lieu d’apprendre des motifs généraux, ce qui le rend moins adaptable.
  • Étiquettes incohérentes ou bruitées : des données mal étiquetées amènent un modèle à apprendre des motifs erronés. Ce problème est fréquent dans les jeux de données annotés manuellement.

Une approche équilibrée de la complexité du modèle, de la qualité du jeu de données et des techniques d’entraînement garantit une meilleure généralisation.

Surapprentissage et sous-apprentissage#

Le surapprentissage et le sous-apprentissage sont deux problèmes totalement opposés de l’apprentissage profond.

Comparaison du sous-apprentissage, de l’apprentissage optimal et du surapprentissage dans les modèles de vision par ordinateur

Fig 1. Comparaison du sous-apprentissage, de l’apprentissage optimal et du surapprentissage dans les modèles de vision par ordinateur.

Le surapprentissage se produit lorsqu’un modèle est trop complexe et se concentre excessivement sur les données d’entraînement. Au lieu d’apprendre des motifs généraux, il mémorise de petits détails, même ceux qui ne sont pas pertinents, comme le bruit d’arrière-plan. Le modèle fonctionne alors bien sur les données d’entraînement, mais rencontre des difficultés avec de nouvelles images, ce qui signifie qu’il n’a pas réellement appris à reconnaître les motifs applicables à différentes situations.

Le sous-apprentissage se produit lorsqu’un modèle est trop élémentaire et ne détecte pas les motifs importants dans les données. Cela peut arriver lorsque le modèle comporte trop peu de couches, que la durée d’entraînement est insuffisante ou que les données sont limitées. Il ne reconnaît alors pas les motifs importants et produit des prédictions inexactes. Ses performances sont mauvaises à la fois sur les données d’entraînement et sur les données de test, car il n’a pas suffisamment appris pour comprendre correctement la tâche.

Un modèle bien entraîné trouve l’équilibre entre complexité et généralisation. Il doit être suffisamment complexe pour apprendre les motifs pertinents, sans l’être au point de mémoriser les données au lieu de reconnaître les relations sous-jacentes.

Comment identifier le surapprentissage#

Voici quelques signes indiquant qu’un modèle est en situation de surapprentissage :

  • Si la précision sur les données d’entraînement est nettement supérieure à celle obtenue sur les données de validation, le modèle est probablement en situation de surapprentissage.
  • Un écart croissant entre la perte d’entraînement et la perte de validation est un autre indicateur important.
  • Le modèle est trop sûr de réponses erronées, ce qui montre qu’il a mémorisé des détails au lieu de comprendre les motifs.

Pour garantir qu’un modèle généralise correctement, il doit être testé sur des jeux de données variés qui reflètent les conditions du monde réel.

Comment éviter le surapprentissage en vision par ordinateur#

Le surapprentissage n’est pas inévitable et peut être évité. Grâce aux bonnes techniques, les modèles de vision par ordinateur peuvent apprendre des motifs généraux au lieu de mémoriser les données d’entraînement, ce qui les rend plus fiables dans les applications concrètes.

Voici cinq stratégies clés pour éviter le surapprentissage en vision par ordinateur.

Augmenter la diversité des données grâce à l’augmentation et aux données synthétiques#

La meilleure façon d’aider un modèle à fonctionner correctement sur de nouvelles données consiste à élargir le jeu de données grâce à l’augmentation des données et aux données synthétiques. Les données synthétiques sont générées par ordinateur plutôt que collectées à partir d’images du monde réel. Elles contribuent à combler les lacunes lorsqu’il n’y a pas suffisamment de données réelles.

Combinaison de données réelles et synthétiques pour réduire le surapprentissage et améliorer la précision de la détection

Fig 2. La combinaison de données réelles et synthétiques réduit le surapprentissage et améliore la précision de la détection d’objets.

L’augmentation des données modifie légèrement les images existantes en les retournant, en les faisant pivoter ou en les recadrant, ou en ajustant leur luminosité. Le modèle ne se contente ainsi pas de mémoriser les détails, mais apprend à reconnaître les objets dans différentes situations.

Les données synthétiques sont utiles lorsque les images réelles sont difficiles à obtenir. Par exemple, les modèles de voitures autonomes peuvent être entraînés sur des scènes routières générées par ordinateur afin d’apprendre à détecter des objets dans différentes conditions météorologiques et d’éclairage. Le modèle devient ainsi plus flexible et plus fiable sans nécessiter des milliers d’images réelles.

Optimiser la complexité et l’architecture du modèle#

Un réseau neuronal profond, c’est-à-dire un type de modèle d’apprentissage automatique comportant de nombreuses couches qui traitent les données au lieu d’une seule couche, n’est pas toujours préférable. Lorsqu’un modèle comporte trop de couches ou de paramètres, il mémorise les données d’entraînement au lieu de reconnaître des motifs plus généraux. Réduire la complexité inutile peut contribuer à éviter le surapprentissage.

Pour y parvenir, une approche consiste à effectuer un élagage, qui supprime les neurones et les connexions redondants afin de rendre le modèle plus léger et plus efficace.

Une autre approche consiste à simplifier l’architecture en réduisant le nombre de couches ou de neurones. Les modèles préentraînés comme Ultralytics YOLO11 sont conçus pour bien généraliser à différentes tâches avec moins de paramètres, ce qui les rend plus résistants au surapprentissage que l’entraînement d’un modèle profond à partir de zéro.

Trouver le bon équilibre entre la profondeur et l’efficacité du modèle l’aide à apprendre des motifs utiles sans se contenter de mémoriser les données d’entraînement.

Appliquer des techniques de régularisation#

Les techniques de régularisation empêchent les modèles de devenir trop dépendants de caractéristiques spécifiques des données d’entraînement. Voici quelques techniques couramment utilisées :

  • Dropout désactive aléatoirement certaines parties du modèle pendant l’entraînement, afin qu’il apprenne à reconnaître différents motifs au lieu de trop dépendre de quelques caractéristiques.
  • La décroissance des poids (régularisation L2) limite les valeurs extrêmes des poids et permet de maîtriser la complexité du modèle.
  • La normalisation par lots contribue à stabiliser l’entraînement en rendant le modèle moins sensible aux variations du jeu de données.

Ces techniques contribuent à préserver la flexibilité et l’adaptabilité du modèle, en réduisant le risque de surapprentissage tout en maintenant la précision.

Surveiller l’entraînement avec la validation et l’arrêt anticipé#

Pour éviter le surapprentissage, il est important de suivre la manière dont le modèle apprend et de vérifier qu’il généralise correctement à de nouvelles données. Voici quelques techniques qui peuvent t’aider :

  • Arrêt anticipé : interrompt automatiquement l’entraînement lorsque le modèle cesse de s’améliorer, afin qu’il ne continue pas à apprendre des détails inutiles.
  • Validation croisée : divise les données en plusieurs parties et entraîne le modèle sur chacune d’elles. Cela l’aide à apprendre des motifs au lieu de mémoriser des images spécifiques.

Ces techniques aident le modèle à rester équilibré : il apprend suffisamment pour être précis sans se concentrer excessivement sur les seules données d’entraînement.

Utiliser des modèles préentraînés et améliorer l’étiquetage du jeu de données#

Plutôt que d’entraîner un modèle à partir de zéro, l’utilisation de modèles préentraînés comme Ultralytics YOLO11 peut réduire le surapprentissage. YOLO11 est entraîné sur des jeux de données à grande échelle, ce qui lui permet de bien généraliser dans différentes conditions.

Les modèles de vision par ordinateur préentraînés améliorent la précision et évitent le surapprentissage

Fig 3. Les modèles de vision par ordinateur préentraînés améliorent la précision et évitent le surapprentissage.

Le réglage fin d’un modèle préentraîné l’aide à conserver ce qu’il sait déjà tout en apprenant de nouvelles tâches, afin qu’il ne se contente pas de mémoriser les données d’entraînement.

Il est également essentiel de garantir un étiquetage de haute qualité du jeu de données. Des données mal étiquetées ou déséquilibrées peuvent inciter les modèles à apprendre des motifs incorrects. Nettoyer les jeux de données, corriger les images mal étiquetées et équilibrer les classes améliorent la précision et réduisent le risque de surapprentissage. Une autre approche efficace est l’entraînement antagoniste, qui expose le modèle à des exemples légèrement modifiés ou plus difficiles, conçus pour tester ses limites.

Points clés à retenir#

Le surapprentissage est un problème courant en vision par ordinateur. Un modèle peut fonctionner correctement sur les données d’entraînement, mais rencontrer des difficultés avec des images du monde réel. Pour l’éviter, des techniques comme l’augmentation des données, la régularisation et l’utilisation de modèles préentraînés comme Ultralytics YOLO11 contribuent à améliorer la précision et l’adaptabilité.

En appliquant ces méthodes, les modèles d’IA peuvent rester fiables et fonctionner correctement dans différents environnements. À mesure que l’apprentissage profond progresse, garantir une bonne généralisation des modèles sera essentiel à la réussite des applications d’IA dans le monde réel.

Rejoins notre communauté grandissante ! Consulte notre dépôt GitHub pour en savoir plus sur l’IA. Tu es prêt à commencer tes propres projets de vision par ordinateur ? Découvre nos options de licence. Découvre la vision par IA pour la conduite autonome et l’IA dans le secteur de la santé en consultant nos pages consacrées aux solutions !

Explore solutions

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus

Construisons ensemble l'avenir de l'IA !

Commence ton parcours vers l'avenir de l'apprentissage automatique