¿Qué es la umbralización en el procesamiento de imágenes?
Explora la umbralización en el procesamiento de imágenes con esta guía. Descubre qué es la umbralización y conoce distintas técnicas de umbralización de imágenes, incluida la umbralización de Otsu.

Para ver una explicación visual de los conceptos tratados en este artículo, mira el vídeo siguiente.
Los seres humanos vemos las imágenes como escenas coherentes y llenas de significado, mientras que los ordenadores las ven como cuadrículas de diminutos píxeles, los componentes más pequeños de una imagen digital. En un proceso llamado procesamiento de imágenes, estos píxeles se pueden ajustar o analizar para mejorar la imagen y extraer información útil.
Una técnica habitual de procesamiento de imágenes se denomina umbralización. Este método convierte las imágenes en escala de grises (donde cada píxel representa un tono de gris) en imágenes en blanco y negro comparando cada píxel con un valor establecido. Esto crea una separación clara entre las regiones importantes y el fondo.
La umbralización se utiliza a menudo en la segmentación de imágenes, una técnica que divide una imagen en regiones relevantes para facilitar su análisis. Normalmente, es uno de los primeros pasos para ayudar a las máquinas a interpretar datos visuales. En este artículo veremos qué es la umbralización, cómo funciona y dónde se aplica en situaciones reales. ¡Empecemos!
Terminología básica de la umbralización de imágenes#
Antes de profundizar en cómo funciona la umbralización, veamos más de cerca las ideas básicas en las que se basa y cómo se utiliza en el procesamiento de imágenes.
Umbral de imagen binaria#
Supongamos que estás trabajando con una imagen y quieres separar los objetos del fondo. Una forma de hacerlo es mediante la umbralización. Esta simplifica la imagen de modo que cada píxel sea completamente negro o completamente blanco. El resultado es una imagen binaria, en la que cada píxel tiene un valor de 0 (negro) o 255 (blanco). Este paso suele ser útil en el procesamiento de imágenes porque hace que las partes importantes de la imagen destaquen con claridad.

Fig. 1. Una imagen en escala de grises y su resultado binario después de la umbralización. (Fuente: blog.devops.dev)
Histograma#
Del mismo modo, si quieres entender cómo se distribuyen los valores de brillo en una imagen, un histograma puede ayudarte. Es un gráfico que muestra la frecuencia con la que aparece cada intensidad de píxel, desde el negro (0) hasta el blanco (255).
Al observar el histograma, puedes ver si la imagen es oscura, brillante o se encuentra en un punto intermedio. Esto facilita la elección de un buen valor de umbral al convertir la imagen a blanco y negro, ya que puedes identificar patrones y niveles de contraste de un vistazo.
Primer plano y fondo#
Una vez aplicada la umbralización a una imagen, esta se divide en dos partes: el primer plano y el fondo. El primer plano, que normalmente se muestra en blanco, resalta los elementos importantes, como texto, formas u objetos que quieres detectar. El fondo, que se muestra en negro, es todo lo demás. Esta separación ayuda a las máquinas a centrarse en lo importante de la imagen.
Segmentación#
Como hemos mencionado antes, la segmentación divide una imagen en regiones relevantes basándose en características como el brillo o la textura. La umbralización es una forma sencilla de hacerlo y suele ser uno de los primeros pasos de una canalización de visión artificial.
La visión artificial es una rama de la IA que permite a las máquinas procesar e interpretar datos visuales, de forma similar a los seres humanos. Al utilizar la umbralización al principio del proceso, los sistemas de visión artificial pueden separar los objetos del fondo, lo que facilita que los pasos posteriores, como la detección o el reconocimiento, funcionen con precisión.
Umbralización global#
Ahora que entendemos mejor qué es la umbralización, veamos cómo aplicar un umbral a una imagen y los distintos tipos de umbralización en el procesamiento de imágenes.
Por ejemplo, la umbralización global es una de las formas más sencillas de crear una imagen binaria. Aplica un único valor de intensidad a toda la imagen. Los píxeles más brillantes que este umbral se vuelven blancos, mientras que los más oscuros se vuelven negros. Esto ayuda a separar el objeto del fondo.
Funciona mejor cuando la imagen tiene una iluminación uniforme y un contraste intenso. Sin embargo, con una iluminación desigual o en zonas de bajo contraste, un único umbral puede pasar por alto detalles o difuminar los bordes.
Para abordar este problema se utilizan métodos como la umbralización de Otsu. En lugar de establecer un valor manualmente, el método de umbralización de Otsu analiza el histograma de la imagen y elige el umbral que mejor separa las intensidades de los píxeles entre el primer plano y el fondo.

Fig. 2. Una imagen de Saturno antes y después de aplicar la umbralización de Otsu. (Fuente)
Umbralización local (adaptativa)#
A diferencia de la umbralización global, la umbralización adaptativa o local calcula el valor del umbral por separado para distintas partes de la imagen. Esto la hace más eficaz en imágenes con una iluminación desigual, como documentos escaneados con sombras o superficies con textura.
Funciona dividiendo la imagen en regiones pequeñas y calculando un umbral local para cada bloque, lo que ayuda a mantener el contraste entre el primer plano y el fondo. Este enfoque se utiliza ampliamente en tareas como el reconocimiento de texto, las imágenes médicas y la inspección de superficies, donde la iluminación varía a lo largo de la imagen.
Algunos enfoques habituales de umbralización adaptativa en el procesamiento de imágenes son la umbralización adaptativa de la media y la umbralización adaptativa gaussiana. En la umbralización adaptativa de la media, la intensidad media de los píxeles de un vecindario local se utiliza como umbral para el píxel central. La umbralización adaptativa gaussiana, en cambio, utiliza una media ponderada con una ventana gaussiana, dando más importancia a los píxeles más cercanos al centro.
Aplicaciones de la umbralización en el procesamiento de imágenes en situaciones reales#
A continuación, veamos dónde se utiliza la umbralización de imágenes en aplicaciones reales.
Umbralización de imágenes para la binarización de documentos y el OCR#
Los libros antiguos y las cartas manuscritas se suelen escanear para conservarlos o convertirlos en texto digital mediante el OCR (reconocimiento óptico de caracteres), una tecnología que lee caracteres impresos o manuscritos. Antes de poder extraer el texto, normalmente es necesario limpiar o preprocesar el documento. Las imágenes escaneadas suelen presentar sombras, tinta descolorida o una iluminación desigual, lo que puede dificultar el reconocimiento de caracteres.
Para mejorar la claridad, se utiliza la umbralización para convertir las imágenes en escala de grises a un formato binario, lo que ayuda a aislar el texto del fondo. Las zonas más oscuras, como las letras, se vuelven negras, mientras que el fondo más claro se vuelve blanco, lo que facilita mucho que los sistemas de OCR lean el texto.

Fig. 3. Un ejemplo de un documento histórico y su imagen umbralizada. (Fuente)
Uso de la umbralización en el procesamiento de imágenes médicas#
Del mismo modo, en las imágenes médicas, la umbralización se utiliza habitualmente para aislar estructuras específicas en las exploraciones, como huesos o pulmones en imágenes de rayos X. Al convertir las imágenes en escala de grises a un formato binario, resulta más fácil separar las regiones de interés del tejido circundante y preparar la imagen para análisis posteriores. En casos más complejos, se puede aplicar una umbralización multinivel para dividir la imagen en varias regiones diferenciadas, lo que permite identificar simultáneamente distintos tipos de tejido o estructuras.

Fig. 4. Uso de métodos de umbralización multinivel en radiografías de tórax. (Fuente: sciencedirect.com)
Ventajas e inconvenientes de la umbralización en el procesamiento de imágenes#
Estas son algunas de las principales ventajas de utilizar la umbralización en el procesamiento de imágenes:
- Bajo consumo de recursos: La umbralización funciona bien en dispositivos de baja potencia y no necesita acceso a la nube ni hardware de alta gama, por lo que es adecuada para sistemas embebidos y configuraciones sin conexión.
- Fácil de interpretar: Su lógica sencilla hace que los resultados de la umbralización sean fáciles de entender y depurar, algo crucial en ámbitos como la sanidad o el procesamiento de documentos, donde la transparencia es importante.
- Pruebas rápidas: La umbralización permite a los equipos explorar rápidamente ideas de segmentación en proyectos en sus primeras fases antes de pasar a modelos más complejos.
Aunque la umbralización de imágenes resulta útil en muchas situaciones, también presenta ciertas limitaciones. Estos son algunos desafíos relacionados con la umbralización que debes tener en cuenta:
- Carece de adaptabilidad: La umbralización sigue reglas fijas y no se adapta a nuevas condiciones de iluminación ni a variaciones en los datos sin realizar ajustes manuales.
- Sensible al ruido: Pequeños cambios de brillo provocados por sombras o reflejos pueden alterar los resultados, especialmente al trabajar con imágenes detalladas o con textura.
- Estática y basada en reglas: A diferencia de los modelos de IA, la umbralización no aprende de los datos ni mejora con el tiempo. Solo funciona dentro de las condiciones limitadas para las que se diseñó.
Más allá de la umbralización de imágenes: cuándo la visión artificial es la herramienta adecuada#
La umbralización funciona bien para tareas sencillas de segmentación en entornos controlados. Sin embargo, suele tener dificultades al trabajar con imágenes complejas que contienen varios objetos o ruido de fondo. Como depende de reglas fijas, la umbralización carece de la flexibilidad necesaria para la mayoría de las aplicaciones reales.
Para superar estas limitaciones, muchos sistemas avanzados utilizan ahora visión artificial. A diferencia de la umbralización, los modelos de IA de visión se entrenan para detectar patrones y características complejos, por lo que son mucho más precisos y adaptables.
Por ejemplo, los modelos de visión artificial como Ultralytics YOLO11 pueden detectar objetos y segmentar imágenes en tiempo real. Esto los hace ideales para tareas como detectar señales de tráfico en vehículos autónomos o identificar problemas en cultivos agrícolas.
En particular, Ultralytics YOLO11 admite una variedad de tareas de visión artificial, como la segmentación de instancias, en la que cada objeto de una imagen se segmenta por separado. También puede realizar otras tareas basadas en la visión, como la estimación de poses (determinar la posición o postura de un objeto) y el seguimiento de objetos (seguir un objeto mientras se desplaza por los fotogramas de un vídeo).

Fig. 5. YOLO11 facilita la detección y segmentación de objetos. (Fuente)
Aunque la umbralización funciona bien para tareas sencillas o para probar ideas iniciales, las aplicaciones que necesitan velocidad, precisión y flexibilidad suelen gestionarse mejor con visión artificial.
Conclusiones clave#
La umbralización es una herramienta esencial en el procesamiento de imágenes porque permite separar objetos del fondo de forma rápida y sencilla. Funciona bien con documentos escaneados, imágenes médicas y la comprobación de defectos en productos en fábricas.
Sin embargo, a medida que las imágenes y los vídeos se vuelven más complejos, los métodos básicos de procesamiento de imágenes, como la umbralización, pueden tener dificultades. Ahí es donde pueden intervenir los modelos avanzados de visión artificial. Modelos como Ultralytics YOLO11 pueden comprender y realizar más tareas, detectar muchos objetos a la vez y trabajar en tiempo real, por lo que resultan útiles en numerosos casos de uso.
¿Quieres saber más sobre AI? Visita nuestra comunidad y nuestro repositorio de GitHub. Explora nuestras páginas de soluciones para obtener más información sobre la AI en robótica y la visión por ordenador en la agricultura. Descubre nuestras opciones de licencia y empieza hoy mismo a desarrollar con visión por ordenador.









