YOLO Vision 2026:
Vision AI

Активное обучение ускоряет разработку компьютерного зрения

Узнай, как активное обучение используется в компьютерном зрении для минимизации усилий по аннотированию, и изучи его реальные применения в различных отраслях.

ABAbirami Vina3 min read
Активное обучение ускоряет разработку компьютерного зрения

Обучение модели компьютерного зрения во многом похоже на обучение ребенка распознаванию цветов. Сначала тебе понадобится коллекция цветных объектов. Затем ты будешь направлять ребенка, чтобы он правильно определял каждый цвет — задача, которая часто требует много времени и повторяющихся действий.

Точно так же, как ребенку нужно много примеров для обучения, модели машинного зрения требуется большой набор размеченных данных, чтобы распознавать закономерности и объекты на изображениях. Однако разметка огромных объемов данных отнимает много времени, сил и ресурсов. Такие методы, как активное обучение, помогают упростить этот процесс.

Active learning — это пошаговый процесс, при котором самые важные данные из большого датасета отбираются и размечаются. Модель учится на этих размеченных данных, становясь точнее и эффективнее. Фокус исключительно на самых ценных данных уменьшает объем необходимой разметки и ускоряет разработку модели.

В этой статье мы рассмотрим, как активное обучение помогает в процессе тренировки модели, снижает расходы на разметку и повышает общую точность модели.

Создавать наборы данных для изображений непросто#

Датасеты служат фундаментом для моделей компьютерного зрения и глубокого обучения. Популярные датасеты вроде ImageNet предлагают миллионы изображений с разнообразными категориями объектов. Тем не менее, создание и поддержка таких гигантских объемов high-quality datasets сопряжены с различными трудностями.

Например, сбор и разметка данных требуют времени, ресурсов и квалифицированных аннотаторов, что делает процесс сложным в зависимости от конкретного применения. Нужны инновационные и более эффективные решения, чтобы справляться с растущим спросом на image datasets, и именно это призвана решить active learning.

Активное обучение предлагает идеальное решение, оптимизируя процесс разметки данных. Стратегически отбирая наиболее информативные точки данных для аннотирования, активное обучение максимизирует производительность модели при минимальных затратах на разметку.

Что такое активное обучение?#

Активное обучение — это итеративная техника машинного обучения, при которой модель выбирает из большого пула неразмеченных данных наиболее важные точки для разметки. Эти выбранные точки вручную размечаются и добавляются в тренировочный набор данных.

Затем модель дообучается на обновленном наборе и выбирает следующий комплект данных для разметки. Этот процесс повторяется, при этом модель постоянно улучшается, концентрируясь на самых информативных данных. Цикл продолжается до тех пор, пока модель не достигнет желаемой точности или не выполнит критерии разметки, заданные заранее.

An overview of active learning

Fig 1. Обзор active learning.

Понимание того, как работает активное обучение#

Возможно, тебе интересно, как техника активного обучения решает, какие данные нужно разметить вручную и что делать дальше. Давай разберемся, как работает активное обучение, сравнив его с подготовкой к экзамену: ты концентрируешься на темах, в которых не уверен, и в то же время стараешься охватить разнообразие предметов, чтобы быть готовым ко всему.

Для начальных процессов выбора данных активное обучение использует такие стратегии, как сэмплирование по неопределенности (uncertainty sampling) и сэмплирование на основе разнообразия (diversity-based sampling). Сэмплирование по неопределенности отдает приоритет тем данным, в которых модель наименее уверена, что направлено на улучшение точности в сложных случаях. Сэмплирование на основе разнообразия выбирает данные, охватывающие широкий спектр характеристик, что гарантирует хорошую обобщающую способность модели на невидимых данных благодаря воздействию разнообразных примеров.

Uncertainty sampling on the left and diversity-based sampling on the right

Fig 2. Сэмплирование на основе неопределенности (слева) и сэмплирование на основе разнообразия (справа).

После первичного отбора данных активное обучение использует два основных подхода к разметке: пуловое сэмплирование (pool-based sampling) и потоковое сэмплирование (stream-based sampling). Они похожи на то, как учитель помогает ученику сфокусироваться на самом важном.

При пуловом сэмплировании модель сканирует большой массив неразмеченных данных и выбирает самые сложные или информативные примеры для разметки, подобно ученику, который уделяет внимание самым трудным карточкам для запоминания. В случае с потоковым сэмплированием модель обрабатывает данные по мере их поступления, решая, размечать их или пропустить, что похоже на ученика, который просит помощи только тогда, когда застрял. В обоих случаях размеченные данные добавляются в обучающий набор, и модель дообучается, стабильно улучшаясь с каждой итерацией.

Исследование применения активного обучения#

Active learning играет ключевую роль в computer vision applications, таких как медицинская визуализация и автономное вождение, за счет повышения точности моделей и оптимизации процесса разметки данных. Интересным примером являются computer vision models, которые используются в самоуправляемых автомобилях для обнаружения пешеходов или объектов в условиях низкой освещенности или тумана. Active learning может повысить точность, фокусируясь на разнообразных и сложных сценариях вождения.

В частности, активное обучение можно использовать для идентификации неопределенных данных или кадров из таких сценариев для выборочной разметки. Добавление этих размеченных примеров в тренировочный набор помогает модели лучше распознавать пешеходов и объекты в сложных условиях, например, в плохую погоду или при ночном вождении.

Например, NVIDIA использовала активное обучение для улучшения обнаружения пешеходов ночью в своих моделях автономного вождения. Благодаря стратегическому отбору наиболее информативных данных для обучения, особенно в сложных сценариях, производительность модели существенно возрастает.

Detecting a pedestrian with an umbrella using active learning

Fig 3. Обнаружение пешехода с зонтом с использованием active learning.

Активное обучение может снизить затраты на разметку#

Еще один ключевой аспект активного обучения — это его потенциал для снижения затрат на разметку. Оно делает это, фокусируясь только на самых важных точках данных, вместо того чтобы требовать аннотаций для всего набора. Такой целевой подход экономит время, силы и деньги. Сосредоточиваясь на неопределенных или разнообразных образцах, активное обучение уменьшает количество необходимых аннотаций, сохраняя при этом высокую точность модели.

Фактически, исследования показывают, что active learning может cut labeling costs на 40-60% без ущерба для производительности. Это особенно полезно в таких отраслях, как здравоохранение и производство, где разметка данных стоит дорого. Упрощая процесс аннотирования, active learning помогает бизнесу разрабатывать модели быстрее и эффективнее развертывать их, сохраняя при этом точность.

Преимущества активного обучения#

Вот некоторые другие ключевые преимущества, которые может предложить активное обучение:

  • Устранение дисбаланса классов: активное обучение может помочь решить проблемы дисбаланса классов путем разметки примеров из миноритарных классов данных. Модель может лучше работать со сценариями, где мало примеров.
  • Более быстрые циклы разработки: разметка меньшего объема данных косвенно означает ускорение процесса разработки моделей машинного и компьютерного зрения, что высвобождает время и ресурсы для дополнительных итераций и экспериментов.
  • Адаптивность: оно может постоянно улучшать обучающие данные, итерируясь на неопределенных или пограничных примерах, что делает его хорошо подходящим для динамичных или развивающихся наборов данных.

Активное обучение и AutoML могут работать вместе#

Automated Machine Learning (AutoML) фокусируется на автоматизации трудоемких и итеративных задач, связанных с созданием и развертыванием моделей машинного обучения. Он упрощает рабочие процессы машинного обучения, автоматизируя такие задачи, как выбор модели и оценка производительности, чтобы снизить потребность в ручном труде.

При интеграции с активным обучением AutoML может ускорить и оптимизировать жизненный цикл разработки модели. Компонент активного обучения стратегически выбирает наиболее информативные точки данных для разметки, в то время как AutoML совершенствует модель за счет автоматизации выбора архитектуры, параметров и настройки.

AutoML workflow

Fig 4. Рабочий процесс AutoML.

Давай разберемся с этим сочетанием технологий на примере.

Допустим, ты пытаешься обнаружить редкие патологии в medical imaging (вариант использования, где размеченные датасеты ограничены и дороги в получении). Active learning может выявлять и отбирать неоднозначные данные — например, едва заметные изменения на рентгеновских снимках, которые модель не может классифицировать. Затем эти неопределенные данные можно отправить в приоритетном порядке на ручную аннотацию для улучшения понимания модели.

Имея аннотированные данные, AutoML может оптимизировать модель, исследуя различные архитектуры, гиперпараметры и другие методы аугментации данных. Этот итеративный процесс ускоряет разработку надежных моделей компьютерного зрения, таких как Ultralytics YOLO11, которые помогают медицинским работникам ставить точные диагнозы.

Проблемы активного обучения#

Активное обучение и его методы предлагают многочисленные преимущества, но при реализации этих стратегий следует учитывать несколько моментов:

  • Выбор стратегии запроса: активное обучение включает множество методов, и выбор лучшего из них существенно влияет на эффективность модели. Выбор неподходящей стратегии может снизить производительность модели для конкретного приложения.
  • Затраты на дообучение: итеративная природа активного обучения требует значительных вычислительных ресурсов, особенно для больших наборов данных. Модель дообучается после каждого раунда разметки, что увеличивает сложность.
  • Качество начальной модели: эффективность активного обучения зависит от качества начальной модели. Плохо работающая исходная модель может неточно определять информативные точки данных, что приведет к некачественным запросам на разметку и снижению общей производительности.

Путь вперед для активного обучения и AutoML#

Благодаря недавним достижениям в области ИИ и компьютерного зрения, активное обучение готово справиться с более сложными задачами и оптимизировать рабочие процессы машинного обучения. Объединение активного обучения с такими методами, как федеративное обучение и самообучение, может еще больше повысить эффективность и масштабируемость моделей машинного зрения.

Federated learning позволяет обучать модель на нескольких устройствах или серверах с помощью распределенного фреймворка без необходимости покидания данными их исходного местоположения. Рассмотрим такие отрасли, как здравоохранение, где важна конфиденциальность данных: federated learning дает возможность обучать модель напрямую на конфиденциальных локальных данных, обеспечивая их безопасность. Вместо передачи сырых данных передаются только обновления модели или инсайты, гарантируя защиту личной информации при одновременном участии в процессе обучения.

В то же время self-supervised learning помогает снизить потребность в размеченных данных за счет предварительного обучения моделей на неразмеченных данных. Этот процесс создает прочную основу для модели. Затем active learning может развить этот успех, определяя и выбирая наиболее важные точки данных для аннотирования человеком, что дополнительно совершенствует модель.

От активного обучения к активному результату#

Активное обучение предоставляет практический способ решения главных проблем компьютерного зрения, таких как высокая стоимость аннотирования данных и потребность в более точных моделях. Фокусируясь на разметке только самых ценных точек данных, оно уменьшает усилия, требуемые от людей, при этом повышая производительность модели.

В сочетании с такими технологиями, как AutoML, активное обучение оптимизирует разработку моделей за счет автоматизации трудоемких задач. По мере появления новых достижений активное обучение станет важным инструментом для создания более умных и эффективных систем компьютерного зрения.

Изучи наш GitHub repository и присоединяйся к нашему community, чтобы узнать больше об ИИ и моделях компьютерного зрения. Узнай о других примерах применения computer vision in manufacturing и healthcare на наших страницах решений. Ты также можешь ознакомиться с нашими licensing options, чтобы начать свой путь в сфере vision AI уже сегодня.

Explore solutions

Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше
Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше
Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше

Давай строить будущее ИИ вместе!

Начни свой путь в будущее машинного обучения