YOLO Vision 2026:
Руководства

Полное руководство по аугментации данных в 2025 году

Узнай, как аугментация изображений помогает моделям Vision AI лучше обучаться, повышать точность и эффективнее работать в реальных условиях.

ABAbirami Vina6 min read
Аугментация изображений создает разнообразные вариации для обучения Vision AI

Благодаря буму ИИ такие явления, как роботы на заводах и беспилотные автомобили на улицах, все чаще попадают в заголовки новостей. ИИ меняет то, как машины взаимодействуют с миром: от улучшения медицинской визуализации до контроля качества на производственных линиях.

Большая часть этого прогресса обусловлена computer vision, ветвью искусственного интеллекта, которая позволяет машинам понимать и интерпретировать изображения. Подобно тому, как люди со временем учатся распознавать объекты и закономерности, модели vision AI, такие как Ultralytics YOLO11, должны обучаться на больших объемах данных изображений для развития своего зрительного восприятия.

Однако сбор такого огромного объема визуальных данных не всегда прост. Несмотря на то, что сообщество computer vision создало множество крупных datasets, в них все еще могут отсутствовать определенные вариации — например, изображения с объектами при слабом освещении, частично скрытыми элементами или объектами, снятыми под разными углами. Эти различия могут сбивать с толку модели computer vision, обученные только на определенных условиях.

Аугментация data augmentation изображений — это метод, который решает эту проблему путем внесения новых вариаций в существующие данные. Внося изменения в изображения, такие как настройка цветов, поворот или сдвиг перспективы, датасет становится более разнообразным, помогая моделям vision AI лучше распознавать объекты в реальных ситуациях.

В этой статье мы разберем, как работает аугментация данных изображений и какое влияние она может оказать на приложения компьютерного зрения.

Что такое аугментация данных изображений?#

Представь, что ты пытаешься узнать друга в толпе, но он в солнечных очках или стоит в тени. Даже с учетом этих незначительных изменений во внешности ты все равно понимаешь, кто это. С другой стороны, модель компьютерного зрения может испытывать трудности с такими вариациями, если ее не научили распознавать объекты в разных условиях.

Аугментация данных изображений повышает производительность модели компьютерного зрения за счет добавления модифицированных версий существующих изображений в обучающие данные вместо сбора тысяч новых снимков.

Изменения изображений, такие как отражение, поворот, настройка яркости или добавление небольших искажений, открывают моделям компьютерного зрения доступ к более широкому спектру условий. Вместо того чтобы полагаться на массивные наборы данных, модели могут эффективно обучаться на меньших наборах данных с аугментированными изображениями.

Примеры аугментированных изображений автомобиля

Рис. 1. Примеры аугментированных изображений автомобиля.

Важность аугментации данных в компьютерном зрении#

Вот несколько ключевых причин, почему аугментация необходима для компьютерного зрения:

  • Снижение требований к данным: сбор больших наборов данных изображений требует времени и ресурсов. Аугментация может быть использована для эффективного обучения моделей без необходимости в огромных наборах данных.
  • Предотвращение переобучения: модель, обученная на слишком малом количестве примеров, может запомнить детали вместо распознавания общих закономерностей. Добавление разнообразия с помощью аугментации гарантирует, что модели компьютерного зрения учатся таким образом, чтобы применять знания к новым и ранее не виденным данным.
  • Имитация несовершенных изображений: изображения в наборах данных часто слишком идеальны, но реальные фотографии могут быть размытыми, скрытыми или искаженными. Аугментация изображений с помощью шума, окклюзий или других вариаций делает их более реалистичными.
  • Повышение устойчивости модели: обучение с использованием разнообразных изображений помогает ИИ справляться с изменениями в реальном мире, делая его более надежным в различных средах, условиях освещения и ситуациях.

Когда следует использовать аугментацию данных изображений?#

Аугментация данных изображений особенно полезна, когда модели компьютерного зрения нужно распознавать объекты в разных ситуациях, но не хватает разнообразных изображений.

Например, если исследователи обучают модель vision AI распознавать редких подводных обитателей, которых редко фотографируют, набор данных может быть небольшим или не содержать вариаций. Путем аугментации изображений — настройки цветов для имитации разной глубины воды, добавления шума для имитации мутных условий или небольшого изменения форм с учетом естественных движений — модель может научиться более точно detect underwater objects.

Вот некоторые другие ситуации, где аугментация имеет большое значение:

  • Балансировка набора данных: некоторые объекты могут появляться реже в обучающих данных, что делает модели компьютерного зрения предвзятыми. Аугментация помогает создать больше примеров редких объектов, чтобы модель могла распознавать все категории справедливо.
  • Адаптация к разным камерам: изображения могут выглядеть по-разному в зависимости от устройства. Аугментация помогает моделям компьютерного зрения хорошо работать с фотографиями разного разрешения, освещения и качества.
  • Исправление мелких ошибок разметки: небольшие сдвиги, кадрирование или повороты помогают моделям компьютерного зрения правильно распознавать объекты, даже если исходная разметка не идеально выровнена.

Как работает аугментация данных изображений#

На заре развития computer vision аугментация данных изображений в основном включала базовые методы image processing, такие как отражение, поворот и обрезка для увеличения разнообразия датасета. По мере совершенствования ИИ были внедрены более продвинутые методы, такие как настройка цветов (преобразования цветового пространства), повышение резкости или размытие изображений (фильтры ядер) и смешивание нескольких изображений вместе (смешивание изображений) для улучшения обучения.

Аугментация может происходить до и во время model training. Перед обучением измененные изображения могут быть добавлены в датасет для обеспечения большего разнообразия. Во время обучения изображения могут случайно изменяться в реальном времени, помогая моделям vision AI адаптироваться к различным условиям.

Эти изменения выполняются с помощью математических преобразований. Например, поворот наклоняет изображение, обрезка удаляет части для имитации разных видов, а изменения яркости имитируют вариации освещения. Размытие смягчает изображения, повышение резкости делает детали более четкими, а смешивание изображений объединяет части разных изображений. Vision AI frameworks и такие инструменты, как OpenCV, TensorFlow и PyTorch, могут автоматизировать эти процессы, делая аугментацию быстрой и эффективной.

Основные методы аугментации данных изображений#

Теперь, когда мы обсудили, что такое аугментация данных изображений, давайте подробнее рассмотрим некоторые фундаментальные методы аугментации данных, используемые для улучшения обучающих данных.

Настройка ориентации и положения#

Computer vision models, такие как YOLO11, часто должны распознавать объекты с различных углов и точек зрения. Для этого изображения можно отражать по горизонтали или вертикали, чтобы модель ИИ училась распознавать объекты с разных точек зрения.

Точно так же небольшое вращение изображений меняет их угол, позволяя модели идентифицировать объекты с разных перспектив. Кроме того, смещение изображений в разных направлениях (трансляция) помогает моделям адаптироваться к небольшим позиционным изменениям. Эти преобразования гарантируют, что модели лучше обобщаются для реальных условий, где расположение объекта на изображении непредсказуемо.

Различные методы аугментации, связанные с ориентацией и положением

Рис. 2. Различные методы аугментации, связанные с ориентацией и положением.

Изменение размера и кадрирование#

Что касается реальных computer vision solutions, объекты на изображениях могут появляться на разном расстоянии и иметь разные размеры. Модели vision AI должны быть достаточно надежными, чтобы обнаруживать их независимо от этих различий.

Для улучшения адаптивности можно использовать следующие методы аугментации:

  • Масштабирование: изменение размера меняет размер изображения при сохранении его пропорций, позволяя моделям ИИ обнаруживать объекты на разном расстоянии.
  • Кадрирование: удаляет ненужные части изображения, помогая модели сосредоточиться на ключевых областях и уменьшая отвлекающие факторы фона.
  • Сдвиг (Shearing): небольшое искажение изображения имитирует наклоненный или растянутый вид, помогая ИИ распознавать объекты под разными углами.

Эти корректировки помогают моделям компьютерного зрения распознавать объекты, даже если их размер или форма немного меняются.

Корректировка перспективы и искажений#

Объекты на изображениях могут выглядеть по-разному в зависимости от угла камеры, что затрудняет распознавание для моделей компьютерного зрения. Чтобы помочь моделям справляться с этими вариациями, методы аугментации могут корректировать способ представления объектов на изображениях.

Например, преобразования перспективы могут менять угол обзора, заставляя объект выглядеть так, как будто на него смотрят с другой позиции. Это позволяет моделям компьютерного зрения распознавать объекты, даже если они наклонены или сняты с необычного ракурса.

Другой пример — эластичная деформация, которая растягивает, изгибает или коробит изображения для имитации естественных искажений, чтобы объекты выглядели так, как они выглядели бы в отражениях или под давлением.

Модификации цвета и освещения#

Условия освещения и цветовые различия могут значительно повлиять на то, как модели компьютерного зрения интерпретируют изображения. Поскольку объекты могут выглядеть по-разному при различных настройках освещения, следующие методы аугментации могут помочь справиться с этими ситуациями:

  • Настройка яркости и контрастности: имитация различных условий освещения помогает моделям компьютерного зрения распознавать объекты как в ярких, так и в темных условиях.
  • Цветовой джиттер (Color jittering): случайное изменение оттенка, насыщенности и цветового баланса делает модели компьютерного зрения более адаптируемыми к различным камерам и условиям освещения.
  • Преобразование в оттенки серого: преобразование изображений в черно-белые побуждает модели компьютерного зрения сосредоточиться на формах и текстурах, а не на цвете.

Примеры аугментаций, связанных с вариациями цветов

Рис. 3. Примеры аугментаций, связанных с вариациями цветов.

Продвинутые методы аугментации данных изображений#

До сих пор мы рассматривали только методы аугментации, которые изменяют одно изображение. Однако некоторые продвинутые методы включают объединение нескольких изображений для улучшения обучения ИИ.

Например, MixUp смешивает два изображения, помогая моделям компьютерного зрения понимать взаимосвязи между объектами и улучшая их способность обобщать знания в различных сценариях. CutMix идет еще дальше, заменяя часть одного изображения частью другого, позволяя моделям учиться на нескольких контекстах в рамках одного изображения. Тем временем, CutOut работает иначе, удаляя случайные части изображения, обучая модели компьютерного зрения распознавать объекты, даже если они частично скрыты или заслонены.

Продвинутые методы аугментации данных изображений, такие как MixUp, CutMix и CutOut

Рис. 4. Продвинутые методы аугментации данных изображений.

Роль генеративного ИИ в аугментации данных изображений#

Generative AI набирает популярность во многих отраслях и повседневных приложениях. Ты наверняка сталкивался с ней в связи с изображениями, созданными ИИ, дипфейк-видео или приложениями, создающими реалистичные аватары. Но помимо творчества и развлечений, генеративный ИИ играет важнейшую роль в обучении моделей vision AI, генерируя новые изображения из существующих.

Вместо того чтобы просто отражать или поворачивать картинки, она может создавать реалистичные вариации — менять выражения лиц, стили одежды или даже симулировать различные погодные условия. Эти вариации помогают моделям computer vision становиться более адаптивными и точными в различных сценариях реального мира. Продвинутые модели генеративного ИИ, такие как GAN (генеративно-состязательные сети) и diffusion models, также могут заполнять недостающие детали или создавать высококачественные синтетические изображения.

Ограничения аугментации данных изображений#

Хотя аугментация данных улучшает обучающие наборы данных, существуют также некоторые ограничения, которые следует учитывать. Вот несколько ключевых проблем, связанных с аугментацией данных изображений:

  • Ограниченное разнообразие данных: аугментированные изображения берутся из существующих данных и не могут привнести совершенно новые паттерны или редкие ракурсы.
  • Потенциальное искажение данных: чрезмерные преобразования могут сделать изображения нереалистичными, потенциально снижая точность модели в реальных условиях.
  • Повышенная вычислительная нагрузка: аугментация в реальном времени, происходящая во время обучения модели, может требовать довольно много вычислительной мощности, замедляя обучение и увеличивая использование памяти.
  • Сохранение дисбаланса классов: аугментация не создает полностью новые образцы, поэтому недостаточно представленные категории все равно могут приводить к предвзятому обучению.

Реальное применение аугментации данных изображений#

Интересным применением аугментации данных изображений являются беспилотные автомобили, где важнейшую роль играют решения, принимаемые за доли секунды такими моделями компьютерного зрения, как Ultralytics YOLO11. Модель должна уметь точно обнаруживать дороги, людей и другие объекты.

Однако условия, с которыми сталкивается беспилотный автомобиль в реальном мире, могут быть непредсказуемыми. Плохая погода, размытие при движении и скрытые знаки могут усложнить работу решений ИИ в этом секторе. Обучения моделей компьютерного зрения только на реальных изображениях часто недостаточно. Наборы данных изображений для моделей в беспилотных автомобилях должны быть разнообразными, чтобы модель могла научиться справляться с непредвиденными ситуациями.

Аугментация данных изображений решает эту проблему путем имитации тумана, настройки яркости и искажения форм. Эти изменения помогают моделям распознавать объекты в разных условиях. В результате модели становятся умнее и надежнее.

Благодаря аугментированному обучению vision AI solutions in self-driving cars лучше адаптируются и принимают более безопасные решения. Более точные результаты означают меньше аварий и улучшенную навигацию.

Аугментация данных изображений, применяемая к кадрам беспилотных автомобилей

Рис. 5. Пример аугментации данных изображений применительно к беспилотным автомобилям.

Беспилотные автомобили — это лишь один пример. На самом деле, аугментация данных изображений имеет решающее значение во многих секторах, от медицинской визуализации до розничной аналитики. Любое приложение, которое полагается на компьютерное зрение, потенциально может выиграть от аугментации данных изображений.

Основные выводы#

Системам Vision AI необходимо распознавать объекты в различных условиях, однако сбор бесконечного количества реальных изображений для обучения может быть сложной задачей. Аугментация данных изображений решает эту проблему, создавая вариации существующих изображений, что помогает моделям учиться быстрее и лучше работать в реальных условиях. Она повышает точность, гарантируя, что такие модели Vision AI, как Ultralytics YOLO11, смогут справляться с различным освещением, углами обзора и окружением.

Для бизнеса и разработчиков аугментация данных изображений экономит время и усилия, делая модели компьютерного зрения более надежными. От здравоохранения до беспилотных автомобилей, многие отрасли зависят от нее. Поскольку ИИ компьютерного зрения продолжает развиваться, аугментация будет оставаться неотъемлемой частью создания более умных и адаптивных моделей для будущего.

Присоединяйся к our community и посети our GitHub repository, чтобы увидеть ИИ в действии. Изучи our licensing options и узнай больше об AI in agriculture и computer vision in manufacturing на наших страницах решений.

Explore solutions

Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше
Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше
Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше

Давай строить будущее ИИ вместе!

Начни свой путь в будущее машинного обучения