Ultralytics YOLO27 :
Guides

Améliore la robustesse des modèles d’IA grâce à l’augmentation des données

Découvre comment l’ajout de variations réalistes aux données d’entraînement grâce à l’augmentation des données contribue à améliorer la robustesse des modèles d’IA et leurs performances dans le monde réel.

ABAbirami Vina11 min read
Améliorer la robustesse des modèles d’IA grâce à l’augmentation des données

Les tests constituent une étape cruciale dans la création de toute solution technologique. Ils montrent aux équipes comment un système fonctionne réellement avant sa mise en production et leur permettent de résoudre les problèmes rapidement. Cela s’applique à de nombreux domaines, notamment à l’IA, où les modèles doivent gérer des conditions imprévisibles du monde réel une fois déployés.

Par exemple, la vision par ordinateur est une branche de l’IA qui apprend aux machines à comprendre les images et les vidéos. Les modèles de vision par ordinateur tels que Ultralytics YOLO26 prennent en charge des tâches comme la détection d’objets, la segmentation d’instances et la classification d’images.

Ils peuvent être utilisés dans de nombreux secteurs pour des applications telles que la surveillance des patients, l’analyse du trafic, le paiement automatisé et l’inspection qualité dans l’industrie manufacturière. Cependant, même avec des modèles avancés et des données d’entraînement de haute qualité, les solutions d’IA pour la vision peuvent encore rencontrer des difficultés lorsqu’elles sont confrontées à des variations du monde réel, comme des changements d’éclairage, des mouvements ou des objets partiellement obstrués.

Cela se produit parce que les modèles apprennent à partir des exemples qui leur sont fournis pendant l’entraînement. S’ils n’ont jamais été confrontés à des conditions telles que des reflets, un flou de mouvement ou une visibilité partielle, ils sont moins susceptibles de reconnaître correctement les objets dans ces situations.

Une façon d’améliorer la robustesse d’un modèle consiste à utiliser l’augmentation des données. Plutôt que de recueillir de grandes quantités de nouvelles données, les ingénieurs peuvent apporter de petites modifications pertinentes aux images existantes, par exemple en ajustant l’éclairage, en recadrant ou en mélangeant des images. Cela aide le modèle à apprendre à reconnaître les mêmes objets dans un éventail plus large de situations.

Dans cet article, nous allons voir comment l’augmentation des données améliore la robustesse des modèles et la fiabilité des systèmes d’IA pour la vision lorsqu’ils sont déployés en dehors de conditions contrôlées. Commençons !

Comment vérifier la robustesse d’un modèle#

Avant d’aborder l’augmentation des données, voyons comment déterminer si un modèle de vision par ordinateur est réellement prêt à être utilisé dans le monde réel.

Un modèle robuste continue à fournir de bonnes performances même lorsque les conditions changent, au lieu de fonctionner uniquement sur des images nettes et parfaitement annotées. Voici quelques facteurs pratiques à prendre en compte pour évaluer la robustesse d’un modèle d’IA :

  • Changements d’éclairage : Les modèles peuvent se comporter différemment lorsqu’ils sont exposés à une lumière vive, une faible luminosité, des reflets ou des ombres, ce qui peut affecter le niveau de confiance de la détection des objets.
  • Occlusion partielle : Dans les scènes du quotidien, les objets sont souvent masqués par d’autres éléments ou ne sont que partiellement visibles. Un modèle plus robuste est capable de les reconnaître même lorsque certaines informations visuelles sont manquantes.
  • Scènes encombrées : Les environnements contenant de nombreux objets qui se chevauchent peuvent rendre la détection plus difficile. Les modèles performants dans ces situations sont généralement plus fiables dans les contextes complexes.

De bons résultats sur des images nettes et parfaitement capturées ne se traduisent pas toujours par de bonnes performances dans le monde réel. Des tests réguliers dans des conditions variées permettent de déterminer dans quelle mesure un modèle reste performant une fois déployé.

Qu’est-ce que l’augmentation des données ?#

L’apparence d’un objet sur une photo peut varier selon l’éclairage, l’angle, la distance ou l’arrière-plan. Lorsqu’un modèle de vision par ordinateur est entraîné, le jeu de données à partir duquel il apprend doit inclure ce type de variation afin qu’il puisse fonctionner correctement dans des environnements imprévisibles.

L’augmentation des données enrichit un jeu de données d’entraînement en créant des exemples supplémentaires à partir des images dont tu disposes déjà. Pour cela, on applique des modifications intentionnelles, comme faire pivoter ou retourner une image, ajuster sa luminosité ou en recadrer une partie.

Par exemple, imagine que tu ne disposes que d’une seule photo d’un chat. Si tu fais pivoter l’image ou modifies sa luminosité, tu peux créer plusieurs nouvelles versions à partir de cette seule image. Chaque version est légèrement différente, mais il s’agit toujours d’une photo du même chat. Ces variations aident à apprendre au modèle qu’un objet peut avoir une apparence différente tout en restant le même objet.

Exemple d’augmentation d’une image de chat

Fig. 1. Exemple d’augmentation d’une image de chat (Source)

Comment l’augmentation des données améliore les performances des modèles#

Pendant l’entraînement d’un modèle, l’augmentation des données peut être intégrée directement au pipeline d’entraînement. Plutôt que de créer et de stocker manuellement de nouvelles copies des images, des transformations aléatoires peuvent être appliquées au chargement de chaque image.

Cela signifie que le modèle voit une version légèrement différente de l’image à chaque fois : elle peut être plus lumineuse, retournée ou partiellement masquée. Des techniques comme l’effacement aléatoire peuvent même supprimer de petites régions de l’image afin de simuler des situations réelles où un objet est bloqué ou seulement partiellement visible.

Exemples d’augmentation fondée sur l’effacement aléatoire

Fig. 2. Exemples d’augmentation fondée sur l’effacement aléatoire (Source)

Le fait d’observer de nombreuses versions différentes d’une même image permet au modèle d’apprendre quelles caractéristiques sont importantes, plutôt que de dépendre d’un seul exemple parfait. Cette diversité renforce la robustesse du modèle d’IA afin qu’il puisse fonctionner de manière plus fiable dans des conditions réelles.

Techniques courantes d’augmentation des données#

Voici quelques techniques d’augmentation des données utilisées pour introduire de la variation dans les images d’entraînement :

  • Transformations géométriques : Ces techniques modifient la position et l’apparence spatiale d’un objet dans une image. Faire pivoter, retourner, redimensionner, recadrer ou décaler une image permet au modèle de comprendre qu’un objet peut être vu sous différents angles ou à différentes distances.
  • Ajustements des couleurs et de l’éclairage : L’éclairage du monde réel est rarement constant. Les images peuvent être trop lumineuses, trop sombres ou présenter une légère dominante de couleur, selon l’environnement ou la caméra utilisée. L’ajustement de la luminosité, du contraste, de la teinte et de la saturation permet aux modèles de gérer ces changements visuels et de bien fonctionner dans différentes scènes.
  • Variations de la qualité d’image : Le flou ou le bruit visuel peuvent rendre les images difficiles à distinguer. L’ajout de flou ou de bruit pendant l’entraînement aide le modèle à gérer le flou de mouvement, les images prises en faible luminosité ou les résultats de caméras de moindre qualité, le rendant ainsi moins sensible aux imperfections visuelles.
  • Augmentations fondées sur l’occlusion : Dans les environnements réels, les objets sont souvent partiellement masqués par d’autres objets. On parle alors d’occlusions d’image. Masquer ou recouvrir de petites zones d’une image pendant l’entraînement aide le modèle à apprendre à détecter les objets même lorsqu’une seule partie est visible.
  • Augmentations multi-images : Ces techniques combinent des parties de plusieurs images en un seul exemple d’entraînement, ce qui peut augmenter le nombre d’objets visibles et améliorer la capacité du modèle à gérer des scènes complexes ou encombrées.

Exemple d’augmentation multi-images

Fig. 3. Exemple d’augmentation multi-images (Source)

Simplifier l’augmentation des données avec le package Python Ultralytics#

La gestion des jeux de données, la création de variations d’images et l’écriture du code de transformation peuvent ajouter des étapes à la création d’une application de vision par ordinateur. Le package Python Ultralytics simplifie ce processus en fournissant une interface unique pour entraîner, exécuter et déployer des modèles Ultralytics YOLO tels que YOLO26. Dans le cadre de cette volonté de simplifier les workflows d’entraînement, le package inclut des augmentations de données intégrées, testées par Ultralytics et optimisées pour les modèles YOLO.

Il prend également en charge des intégrations utiles qui évitent d’avoir recours à des outils distincts ou à du code personnalisé. Plus précisément, pour l’augmentation des données, le package s’intègre à Albumentations, une bibliothèque d’augmentation d’images largement utilisée. Cette intégration permet d’appliquer automatiquement les augmentations pendant l’entraînement, sans scripts supplémentaires ni code personnalisé.

Gérer les annotations et les jeux de données augmentés#

Un autre facteur qui influence la robustesse d’un modèle est la qualité des annotations. Des étiquettes propres et précises, créées et gérées avec des outils d’annotation tels que Roboflow, aident le modèle à comprendre où se trouvent les objets et à quoi ils ressemblent.

Pendant l’entraînement, des augmentations de données telles que les retournements, les recadrages et les rotations sont appliquées dynamiquement, et les annotations sont automatiquement ajustées pour correspondre à ces changements. Lorsque les étiquettes sont précises, ce processus se déroule sans problème et fournit au modèle de nombreux exemples réalistes d’une même scène.

Si les annotations sont imprécises ou incohérentes, ces erreurs peuvent être répétées dans les images augmentées, ce qui peut rendre l’entraînement moins efficace. Commencer par des annotations précises évite la propagation de ces erreurs et contribue à améliorer la robustesse du modèle.

Améliorer les applications d’IA pour la vision grâce à l’augmentation des données#

Passons maintenant en revue des exemples montrant comment l’augmentation des données contribue à la robustesse des modèles d’IA dans des applications réelles.

Améliorer la précision de la détection d’objets dans des environnements réels#

Les images synthétiques sont souvent utilisées pour entraîner des systèmes de détection d’objets lorsque les données réelles sont limitées, sensibles ou difficiles à collecter. Elles permettent aux équipes de générer rapidement des exemples de produits, d’environnements et d’angles de caméra sans devoir capturer chaque scénario dans la vie réelle.

Cependant, les jeux de données synthétiques peuvent parfois sembler trop propres par rapport aux séquences vidéo réelles, où l’éclairage change, les objets se chevauchent et les scènes comportent des éléments parasites en arrière-plan. L’augmentation des données aide à combler cet écart en introduisant des variations réalistes, comme différents éclairages, niveaux de bruit ou placements d’objets, afin que le modèle apprenne à gérer les conditions auxquelles il sera confronté une fois déployé.

Par exemple, dans une étude récente, un modèle Ultralytics YOLO11 a été entraîné entièrement sur des images synthétiques, et une augmentation des données a été ajoutée pour introduire davantage de variations. Cela a contribué à ce que le modèle apprenne à reconnaître les objets de manière plus générale. Il a obtenu de bonnes performances lors de tests sur des images réelles, bien qu’il n’ait jamais vu de données du monde réel pendant son entraînement.

Rendre les solutions d’imagerie médicale plus fiables#

Les jeux de données d’imagerie médicale sont souvent limités, et les examens eux-mêmes peuvent varier selon le type d’équipement, les paramètres d’imagerie ou l’environnement clinique. Les différences d’anatomie des patients, d’angles, d’éclairage ou de bruit visuel peuvent compliquer l’apprentissage de motifs capables de se généraliser correctement d’un patient ou d’un hôpital à l’autre pour les modèles de vision par ordinateur.

L’augmentation des données contribue à résoudre ce problème en créant plusieurs variations d’un même examen pendant l’entraînement, par exemple en ajoutant du bruit, en décalant légèrement l’image ou en appliquant de petites distorsions. Ces modifications rendent les données d’entraînement plus représentatives des conditions cliniques réelles.

Par exemple, dans une étude d’imagerie pédiatrique, des chercheurs ont utilisé Ultralytics YOLO11 pour la segmentation anatomique et l’ont entraîné sur des données médicales augmentées. Ils ont introduit des variations telles que l’ajout de bruit, de légers décalages de position et de petites distorsions afin de rendre les images plus réalistes.

Images médicales pédiatriques originales et augmentées

Fig. 4. Images médicales pédiatriques originales et augmentées (Source)

En apprenant à partir de ces variations, le modèle s’est concentré sur les caractéristiques anatomiques pertinentes plutôt que sur les différences superficielles. Ses résultats de segmentation sont ainsi devenus plus stables d’un examen et d’un cas patient à l’autre.

Points clés à retenir#

La collecte de données diversifiées est difficile, mais l’augmentation des données permet aux modèles d’apprendre à partir d’un éventail plus large de conditions visuelles. Il en résulte une meilleure robustesse des modèles face aux occlusions, aux changements d’éclairage et aux scènes encombrées. Globalement, cela les aide à fonctionner de manière plus fiable en dehors des environnements d’entraînement contrôlés.

Rejoins notre communauté et découvre les dernières avancées en IA pour la vision sur notre dépôt GitHub. Consulte nos pages de solutions pour découvrir comment des applications telles que l’IA dans l’industrie manufacturière et la vision par ordinateur dans le secteur de la santé favorisent le progrès, et consulte nos options de licence pour alimenter ta prochaine solution d’IA.

Explore solutions

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus
Vision par ordinateur en sécurité

Vision par ordinateur en sécurité

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus
Vision par ordinateur en sécurité

Vision par ordinateur en sécurité

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus
Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur pour l'imagerie aérienne

Transforme les images de drones et aériennes en informations en temps réel pour l'agriculture, l'aquaculture, la surveillance environnementale, la conservation et l'analyse géospatiale avec Ultralytics YOLO.
En savoir plus
Vision par ordinateur dans l'aérospatiale

Vision par ordinateur dans l'aérospatiale

Apporte l'IA de vision à la surveillance aérienne grâce aux modèles Ultralytics YOLO. Alimente les drones, les flux de travail aérospatiaux, la conservation de l'environnement et les industries géospatiales avec des solutions de vision par ordinateur.
En savoir plus
Vision par ordinateur en sécurité

Vision par ordinateur en sécurité

Protège chaque site avec les modèles Ultralytics YOLO. L'IA de vision alimente la surveillance du périmètre, la détection des menaces, la reconnaissance des plaques d'immatriculation et la sécurité au travail.
En savoir plus
Vision par ordinateur en robotique

Vision par ordinateur en robotique

Donne plus d’intelligence à tes machines avec les modèles Ultralytics YOLO. L’IA visuelle en robotique permet la navigation autonome, la perception, le suivi d’objets et le contrôle en temps réel.
En savoir plus
Vision par ordinateur en logistique

Vision par ordinateur en logistique

Optimise la logistique avec les modèles Ultralytics YOLO. L’IA visuelle permet l’inspection des colis, le tri, le suivi des véhicules et la surveillance de la sécurité des entrepôts en temps réel.
En savoir plus
Vision par ordinateur dans le commerce de détail

Vision par ordinateur dans le commerce de détail

Réinvente le commerce de détail avec les modèles Ultralytics YOLO. L’IA visuelle permet le suivi des stocks, la surveillance des rayons, la gestion des files d’attente et l’obtention d’informations plus pertinentes sur les clients.
En savoir plus
La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans le secteur de la santé

Développe des solutions de santé avec les modèles Ultralytics YOLO. L'IA de vision dans le secteur de la santé accélère l'imagerie médicale, améliore les diagnostics et renforce la surveillance des patients.
En savoir plus
La vision par ordinateur dans l'industrie manufacturière

La vision par ordinateur dans l'industrie manufacturière

Optimise la production industrielle avec les modèles Ultralytics YOLO. L'IA de vision améliore le contrôle qualité, la détection des défauts, le respect des règles relatives aux EPI et l'automatisation des lignes d'assemblage.
En savoir plus
Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’automobile

Applique la vision par ordinateur à l’automobile avec les modèles Ultralytics YOLO. L’IA de vision améliore la sécurité routière, l’aide à la conduite et l’automatisation des véhicules pour des routes plus intelligentes.
En savoir plus
Vision par ordinateur dans l’agriculture

Vision par ordinateur dans l’agriculture

Apporte l’IA de vision à l’agriculture intelligente avec les modèles Ultralytics YOLO. Optimise la surveillance des cultures, le suivi du bétail et l’agriculture de précision pour des rendements plus élevés et plus intelligents.
En savoir plus

Construisons ensemble l'avenir de l'IA !

Commence ton parcours vers l'avenir de l'apprentissage automatique