Что такое пороговая обработка при обработке изображений?
Изучи пороговую обработку изображений с помощью этого руководства. Узнай, что такое пороговая обработка, и познакомься с различными методами, включая метод Оцу.

Чтобы наглядно ознакомиться с концепциями, рассмотренными в этой статье, посмотри видео ниже.
Мы воспринимаем изображения как цельные, осмысленные картины, а компьютеры видят их как сетки из крошечных пикселей — мельчайших компонентов цифрового изображения. В процессе, называемом обработкой изображений, эти пиксели можно изменять или анализировать, чтобы улучшить изображение и извлечь полезную информацию.
Распространённая техника обработки изображений называется пороговой обработкой. Этот метод преобразует изображения в градациях серого (где каждый пиксель представляет оттенок серого) в чёрно-белые, сравнивая каждый пиксель с заданным значением. Он создаёт чёткое разделение между важными областями и фоном.
Пороговую обработку часто используют в сегментации изображений — технике, которая разделяет изображение на осмысленные области, чтобы упростить его анализ. Обычно это один из первых этапов, помогающих машинам интерпретировать визуальные данные. В этой статье мы рассмотрим, что такое пороговая обработка, как она работает и где применяется в реальных сценариях. Начнём!
Основные термины пороговой обработки изображений#
Прежде чем подробно разбирать принцип работы пороговой обработки, давай сначала внимательнее рассмотрим основные идеи этого метода и его применение в обработке изображений.
Бинарный порог изображения#
Представь, что ты работаешь с изображением и хочешь отделить объекты на нём от фона. Один из способов сделать это — применить пороговую обработку. Она упрощает изображение, так что каждый пиксель становится либо полностью чёрным, либо полностью белым. В результате получается бинарное изображение, где каждый пиксель имеет значение 0 (чёрный) или 255 (белый). Этот этап часто полезен в обработке изображений, поскольку важные части изображения становятся хорошо заметны.

Рис. 1. Изображение в градациях серого и его бинарный результат после пороговой обработки. (Источник: blog.devops.dev)
Гистограмма#
А если ты хочешь понять, как значения яркости распределены по изображению, может помочь гистограмма. Это график, показывающий, как часто встречается каждая интенсивность пикселей — от чёрного (0) до белого (255).
Изучив гистограмму, ты можешь определить, является ли изображение тёмным, светлым или промежуточным. Это упрощает выбор подходящего порогового значения при преобразовании изображения в чёрно-белое, поскольку закономерности и уровни контрастности сразу становятся заметны.
Передний план и фон#
После пороговой обработки изображение разделяется на две части: передний план и фон. Передний план, обычно отображаемый белым цветом, выделяет важные элементы, например текст, формы или объекты, которые ты хочешь обнаружить. Фон, отображаемый чёрным, — это всё остальное. Такое разделение помогает машинам сосредоточиться на значимых элементах изображения.
Сегментация#
Как упоминалось ранее, сегментация разделяет изображение на осмысленные области на основе таких признаков, как яркость или текстура. Пороговая обработка — простой способ сделать это, и часто она является одним из первых этапов конвейера компьютерного зрения.
Компьютерное зрение — это область AI, которая позволяет машинам обрабатывать и интерпретировать визуальные данные подобно человеку. Используя пороговую обработку на раннем этапе, системы компьютерного зрения могут отделять объекты от фона, благодаря чему последующие этапы, такие как обнаружение или распознавание, работают точнее.
Глобальная пороговая обработка#
Теперь, когда мы лучше понимаем, что такое пороговая обработка, давай разберёмся, как обработать изображение пороговым методом и какие существуют типы пороговой обработки изображений.
Например, глобальная пороговая обработка — один из самых простых способов создать бинарное изображение. Она применяет одно значение интенсивности ко всему изображению. Пиксели, более яркие, чем этот порог, становятся белыми, а более тёмные — чёрными. Это помогает отделить объект от фона.
Лучше всего этот метод работает при равномерном освещении и сильном контрасте. Однако при неравномерном освещении или низкой контрастности один порог может не учитывать детали или размывать границы.
Для решения этой проблемы применяют такие методы, как пороговая обработка Отсу. Вместо ручной установки значения метод Отсу анализирует гистограмму изображения и выбирает порог, который лучше всего разделяет интенсивности пикселей на передний план и фон.

Рис. 2. Изображение Сатурна до и после применения пороговой обработки Отсу. (Источник)
Локальная (адаптивная) пороговая обработка#
В отличие от глобальной пороговой обработки, адаптивная, или локальная, пороговая обработка вычисляет пороговое значение отдельно для разных частей изображения. Это делает её более эффективной для изображений с неравномерным освещением, например отсканированных документов с тенями или текстурированных поверхностей.
Изображение разделяется на небольшие области, для каждой из которых вычисляется локальный порог. Это помогает сохранить контраст между передним планом и фоном. Такой подход широко используется в задачах распознавания текста, медицинской визуализации и контроля поверхностей, где освещение меняется по изображению.
К распространённым методам адаптивной пороговой обработки изображений относятся адаптивная пороговая обработка по среднему значению и адаптивная гауссова пороговая обработка. При адаптивной пороговой обработке по среднему значению средняя интенсивность пикселей в локальной окрестности используется как порог для центрального пикселя. Адаптивная гауссова пороговая обработка, напротив, использует взвешенное среднее с гауссовым окном, придавая большее значение пикселям, расположенным ближе к центру.
Применение пороговой обработки изображений в реальном мире#
Теперь рассмотрим, где пороговая обработка изображений используется в реальных приложениях.
Пороговая обработка изображений для бинаризации документов и OCR#
Старые книги и рукописные письма часто сканируют, чтобы сохранить их или преобразовать в цифровой текст с помощью OCR (распознавание оптических символов) — технологии, которая считывает печатные или рукописные символы. Прежде чем извлекать текст, документ обычно необходимо очистить или предварительно обработать. На отсканированных изображениях часто присутствуют тени, выцветшие чернила или неравномерное освещение, что может затруднять распознавание символов.
Для повышения чёткости пороговую обработку используют для преобразования изображений в градациях серого в бинарный формат, помогая отделить текст от фона. Тёмные области, например буквы, становятся чёрными, а светлый фон — белым, благодаря чему системам OCR гораздо проще прочитать текст.

Рис. 3. Пример исторического документа и его изображения после пороговой обработки. (Источник)
Использование пороговой обработки в медицинской визуализации#
Аналогично, в медицинской визуализации пороговую обработку часто используют для выделения определённых структур на снимках, например костей или лёгких на рентгеновских изображениях. Преобразование изображений в градациях серого в бинарный формат упрощает отделение интересующих областей от окружающих тканей и подготовку изображения к дальнейшему анализу. В более сложных случаях можно применять многоуровневую пороговую обработку, чтобы разделить изображение на несколько отдельных областей и одновременно выявить разные типы тканей или структур.

Рис. 4. Применение методов многоуровневой пороговой обработки к рентгеновским снимкам грудной клетки. (Источник: sciencedirect.com)
Преимущества и недостатки пороговой обработки изображений#
Вот некоторые ключевые преимущества использования пороговой обработки изображений:
- Низкие требования к ресурсам: Пороговая обработка хорошо работает на маломощных устройствах и не требует доступа к облаку или высокопроизводительного оборудования, что делает её подходящей для встраиваемых систем и автономных решений.
- Простота интерпретации: Благодаря простой логике результаты пороговой обработки легко понимать и отлаживать, что особенно важно в таких областях, как здравоохранение или обработка документов, где важна прозрачность.
- Быстрое тестирование: Пороговая обработка позволяет командам быстро исследовать идеи сегментации на ранних этапах проектов, прежде чем переходить к более сложным моделям.
Хотя пороговая обработка изображений полезна во многих сценариях, у неё есть определённые ограничения. Вот какие связанные с пороговой обработкой сложности стоит учитывать:
- Недостаточная адаптивность: Пороговая обработка следует фиксированным правилам и не адаптируется к новым условиям освещения или изменениям в данных без ручной настройки.
- Чувствительность к шуму: Небольшие изменения яркости из-за теней или отражений могут ухудшить результаты, особенно при работе с детализированными или текстурированными изображениями.
- Статичность и зависимость от правил: В отличие от AI-моделей, пороговая обработка не обучается на данных и не совершенствуется со временем. Она работает только в узких условиях, для которых была разработана.
За пределами пороговой обработки изображений: когда стоит использовать компьютерное зрение#
Пороговая обработка хорошо подходит для простых задач сегментации в контролируемых условиях. Однако при работе со сложными изображениями, содержащими несколько объектов или фоновый шум, она часто испытывает трудности. Поскольку она опирается на фиксированные правила, ей не хватает гибкости, необходимой для большинства реальных приложений.
Чтобы преодолеть эти ограничения, многие современные системы теперь используют компьютерное зрение. В отличие от пороговой обработки, модели vision AI обучаются обнаруживать сложные закономерности и признаки, поэтому они гораздо точнее и адаптивнее.
Например, модели компьютерного зрения, такие как Ultralytics YOLO11, могут обнаруживать объекты и сегментировать изображения в реальном времени. Это делает их идеальными для таких задач, как обнаружение светофоров в автономных транспортных средствах или выявление проблем с урожаем в сельском хозяйстве.
В частности, Ultralytics YOLO11 поддерживает широкий спектр задач компьютерного зрения, включая сегментацию экземпляров, при которой каждый объект на изображении сегментируется отдельно. Модель также может выполнять другие задачи компьютерного зрения, включая оценку позы (определение положения или позы объекта) и отслеживание объектов (слежение за объектом при его перемещении между кадрами видео).

Рис. 5. YOLO11 упрощает обнаружение и сегментацию объектов. (Источник)
Пороговая обработка хорошо подходит для простых задач или проверки первоначальных идей, но приложениям, которым нужны скорость, точность и гибкость, обычно лучше использовать компьютерное зрение.
Основные выводы#
Пороговая обработка — важный инструмент обработки изображений, поскольку она позволяет быстро и просто отделять объекты от фона. Она хорошо работает со сканированными документами, медицинскими изображениями и задачами выявления дефектов продукции на производстве.
Однако по мере усложнения изображений и видео базовые методы обработки изображений, такие как пороговая обработка, могут испытывать трудности. Здесь на помощь приходят современные модели компьютерного зрения. Такие модели, как Ultralytics YOLO11, способны понимать и выполнять больше задач, одновременно обнаруживать множество объектов и работать в реальном времени, поэтому они полезны во многих сценариях применения.
Хочешь узнать больше об AI? Загляни в наше сообщество и репозиторий GitHub. Изучи страницы наших решений, чтобы узнать больше об AI в робототехнике и компьютерном зрении в сельском хозяйстве. Ознакомься с вариантами нашего лицензирования и начни создавать решения с компьютерным зрением уже сегодня!









