YOLO Vision 2026:
Anleitungen

Was ist Schwellenwertbildung in der Bildverarbeitung?

Erkunde die Schwellenwertbildung (Thresholding) in der Bildverarbeitung mit diesem Leitfaden. Lerne, was Thresholding ist und welche verschiedenen Techniken es gibt, einschließlich der Otsu-Schwellenwertbildung.

ABAbirami Vina5 min read
Ein Graustufenbild, das mittels Schwellenwertbildung in Schwarz-Weiß konvertiert wurde

Für eine visuelle Übersicht der in diesem Artikel behandelten Konzepte, schau dir das Video unten an.

Als Menschen sehen wir Bilder als zusammenhängende, bedeutungsvolle Aufnahmen, während Computer sie als Raster aus winzigen Pixeln betrachten, den kleinsten Bestandteilen eines digitalen Bildes. In einem Prozess namens image processing können diese Pixel angepasst oder analysiert werden, um das Bild zu verbessern und nützliche Informationen zu extrahieren.

Eine gängige Technik der Bildverarbeitung wird Bildschwellenwertbildung genannt. Diese Methode wandelt Graustufenbilder (bei denen jedes Pixel einen Grauton darstellt) in Schwarz-Weiß-Bilder um, indem jedes Pixel mit einem festgelegten Wert verglichen wird. Dadurch entsteht eine klare Trennung zwischen wichtigen Bereichen und dem Hintergrund.

Thresholding wird häufig bei der image segmentation verwendet, einer Technik, die ein Bild in aussagekräftige Bereiche unterteilt, um die Analyse zu erleichtern. Es ist typischerweise einer der ersten Schritte, um Maschinen bei der Interpretation visueller Daten zu helfen. In diesem Artikel schauen wir uns an, was Thresholding ist, wie es funktioniert und wo es in realen Szenarien eingesetzt wird. Legen wir los!

Grundlegende Terminologie der Bildschwellenwertbildung#

Bevor wir uns damit befassen, wie die Schwellenwertbildung funktioniert, werfen wir zunächst einen genaueren Blick auf die grundlegenden Konzepte dahinter und wie sie in der Bildverarbeitung eingesetzt wird.

Binärer Bildschwellenwert#

Stell dir vor, du arbeitest mit einem Bild und möchtest die Objekte darin vom Hintergrund trennen. Eine Möglichkeit hierfür ist die Schwellenwertbildung. Sie vereinfacht das Bild so, dass jedes Pixel entweder vollständig schwarz oder vollständig weiß ist. Das Ergebnis ist ein binäres Bild, bei dem jedes Pixel einen Wert von 0 (schwarz) oder 255 (weiß) hat. Dieser Schritt ist in der Bildverarbeitung oft nützlich, da er wichtige Bildteile klar hervortreten lässt.

A grayscale image and its binary output after thresholding

Abb. 1: Ein Graustufenbild und seine binäre Ausgabe nach der Schwellenwertbildung. (Quelle: blog.devops.dev)

Histogramm#

Wenn du verstehen möchtest, wie die Helligkeitswerte in einem Bild verteilt sind, kann dir ein Histogramm helfen. Es ist eine Grafik, die zeigt, wie häufig jede Pixelintensität vorkommt, von schwarz (0) bis weiß (255).

Durch den Blick auf das Histogramm kannst du sehen, ob das Bild dunkel, hell oder mittelmäßig ist. Dies erleichtert die Wahl eines guten Schwellenwerts bei der Umwandlung des Bildes in Schwarz-Weiß, da du Muster und Kontraststufen auf einen Blick erkennen kannst.

Vordergrund und Hintergrund#

Sobald ein Bild einer Schwellenwertbildung unterzogen wurde, wird es in zwei Teile unterteilt: den Vordergrund und den Hintergrund. Der Vordergrund, typischerweise in Weiß dargestellt, hebt die wichtigen Elemente hervor, wie Text, Formen oder Objekte, die du erkennen möchtest. Der Hintergrund, in Schwarz dargestellt, ist alles andere. Diese Trennung hilft Maschinen, sich auf das Wesentliche im Bild zu konzentrieren.

Segmentierung#

Wie bereits erwähnt, unterteilt die Segmentierung ein Bild in bedeutungsvolle Regionen basierend auf Merkmalen wie Helligkeit oder Textur. Die Schwellenwertbildung ist eine einfache Methode, dies zu erreichen, und oft einer der ersten Schritte in einer Computer-Vision-Pipeline.

Computer vision ist ein Zweig der KI, der Maschinen in die Lage versetzt, visuelle Daten ähnlich wie Menschen zu verarbeiten und zu interpretieren. Durch den Einsatz von Schwellenwertverfahren (Thresholding) früh im Prozess können Computer-Vision-Systeme Objekte von ihrem Hintergrund trennen, was spätere Schritte wie Detektion oder Erkennung präziser macht.

Globale Schwellenwertbildung#

Nachdem wir nun ein besseres Verständnis davon haben, was Schwellenwertbildung ist, gehen wir durch, wie man ein Bild schwellwertbasiert verarbeitet und welche verschiedenen Arten der Schwellenwertbildung es in der Bildverarbeitung gibt.

Beispielsweise ist die globale Schwellenwertbildung eine der einfachsten Methoden, um ein binäres Bild zu erzeugen. Sie wendet einen einzigen Intensitätswert auf das gesamte Bild an. Pixel, die heller als dieser Schwellenwert sind, werden weiß, während dunklere schwarz werden. Dies hilft dabei, das Objekt vom Hintergrund zu trennen.

Sie funktioniert am besten, wenn das Bild eine gleichmäßige Beleuchtung und einen starken Kontrast aufweist. Bei ungleichmäßiger Beleuchtung oder Bereichen mit geringem Kontrast kann ein einzelner Schwellenwert jedoch Details übersehen oder Kanten verwischen.

Um dem entgegenzuwirken, werden Methoden wie die Otsu-Schwellenwertbildung verwendet. Anstatt einen Wert manuell festzulegen, analysiert die Otsu-Methode das Histogramm des Bildes und wählt einen Schwellenwert, der die Pixelintensitäten am besten in Vordergrund und Hintergrund trennt.

An image of Saturn before and after applying Otsu's thresholding

Abb. 2: Ein Bild des Saturn vor und nach der Anwendung von Otsu-Schwellenwerteinzelung. (Source)

Lokale (adaptive) Schwellenwertbildung#

Im Gegensatz zur globalen Schwellenwertbildung berechnet die adaptive oder lokale Schwellenwertbildung den Schwellenwert separat für verschiedene Teile des Bildes. Das macht sie effektiver bei Bildern mit ungleichmäßiger Beleuchtung, wie zum Beispiel bei eingescannten Dokumenten mit Schatten oder strukturierten Oberflächen.

Es funktioniert, indem das Bild in kleine Regionen unterteilt und ein lokaler Schwellenwert für jeden Block berechnet wird, was dazu beiträgt, den Kontrast zwischen Vorder- und Hintergrund aufrechtzuerhalten. Dieser Ansatz wird häufig bei Aufgaben wie Texterkennung, medical imaging und Oberflächenprüfung eingesetzt, bei denen die Beleuchtung über das Bild hinweg variiert.

Einige gängige Ansätze zur adaptiven Schwellenwertbildung in der Bildverarbeitung sind die adaptive Mittelwert-Schwellenwertbildung und die adaptive Gauß-Schwellenwertbildung. Bei der adaptiven Mittelwert-Schwellenwertbildung wird die durchschnittliche Pixelintensität in einer lokalen Nachbarschaft als Schwellenwert für das zentrale Pixel verwendet. Die adaptive Gauß-Schwellenwertbildung hingegen verwendet einen gewichteten Mittelwert mit einem Gauß-Fenster, wobei Pixeln, die näher am Zentrum liegen, mehr Bedeutung beigemessen wird.

Reale Anwendungen der Schwellenwertbildung in der Bildverarbeitung#

Als Nächstes erkunden wir, wo Bildschwellenwertbildung in realen Anwendungen eingesetzt wird.

Bildschwellenwertbildung für Dokumenten-Binarisierung und OCR#

Alte Bücher und handgeschriebene Briefe werden oft eingescannt, um sie zu erhalten oder mit OCR (Optical Character Recognition), einer Technologie zum Lesen gedruckter oder handschriftlicher Zeichen, in digitalen Text umzuwandeln. Bevor der Text extrahiert werden kann, muss das Dokument normalerweise bereinigt oder vorverarbeitet werden. Gescannte Bilder weisen häufig Schatten, verblasste Tinte oder ungleichmäßige Beleuchtung auf, was die Zeichenerkennung erschweren kann.

Um die Klarheit zu verbessern, wird die Schwellenwertbildung verwendet, um Graustufenbilder in ein binäres Format zu konvertieren, was hilft, den Text vom Hintergrund zu isolieren. Dunklere Bereiche, wie die Buchstaben, werden schwarz, während der hellere Hintergrund weiß wird – was es OCR-Systemen erheblich erleichtert, den Text zu lesen.

A historical document and its thresholded image

Abb. 3: Ein Beispiel für ein historisches Dokument und dessen schwellenwertbehandeltes Bild. (Source)

Verwendung von Schwellenwertbildung in der medizinischen Bildverarbeitung#

Ähnlich wird in der medizinischen Bildgebung die Schwellenwertbildung häufig verwendet, um spezifische Strukturen in Scans zu isolieren, wie etwa Knochen oder Lungen in Röntgenbildern. Durch die Konvertierung von Graustufenbildern in ein binäres Format wird es einfacher, Regionen von Interesse vom umliegenden Gewebe zu trennen und das Bild für eine weitere Analyse vorzubereiten. In komplexeren Fällen kann eine mehrstufige Schwellenwertbildung angewendet werden, um das Bild in mehrere unterschiedliche Regionen zu unterteilen, wodurch verschiedene Arten von Gewebe oder Strukturen gleichzeitig identifiziert werden können.

Using multi-level thresholding methods on chest X-rays

Abb. 4: Verwendung von mehrstufigen Schwellenwertmethoden bei Röntgenaufnahmen der Brust. (Quelle: sciencedirect.com)

Vor- und Nachteile der Schwellenwertbildung in der Bildverarbeitung#

Hier sind einige der wichtigsten Vorteile der Verwendung von Schwellenwertbildung in der Bildverarbeitung:

  • Ressourcenschonend: Die Schwellenwertbildung funktioniert gut auf Geräten mit geringer Leistung und benötigt keinen Cloud-Zugriff oder High-End-Hardware, was sie für eingebettete Systeme und Offline-Setups geeignet macht.
  • Leicht zu interpretieren: Seine einfache Logik macht Thresholding-Ergebnisse leicht verständlich und debugierbar, was in Bereichen wie dem healthcare-Sektor oder der Dokumentenverarbeitung, wo Transparenz zählt, von entscheidender Bedeutung ist.
  • Schnelles Testen: Die Schwellenwertbildung ermöglicht es Teams, schnell Segmentierungsideen in Projekten der Frühphase zu erkunden, bevor sie zu komplexeren Modellen übergehen.

Obwohl die Bildschwellenwertbildung in vielen Szenarien nützlich ist, bringt sie auch gewisse Einschränkungen mit sich. Hier sind einige Herausforderungen im Zusammenhang mit der Schwellenwertbildung, die es zu berücksichtigen gilt:

  • Mangelnde Anpassungsfähigkeit: Die Schwellenwertbildung folgt festen Regeln und passt sich nicht ohne manuelle Anpassung an neue Lichtverhältnisse oder Datenvariationen an.
  • Empfindlich gegenüber Rauschen: Kleine Helligkeitsänderungen durch Schatten oder Reflexionen können die Ergebnisse verfälschen, insbesondere bei der Arbeit mit detaillierten oder strukturierten Bildern.
  • Statisch und regelbasiert: Im Gegensatz zu KI-Modellen lernt die Schwellenwertbildung nicht aus Daten und verbessert sich nicht mit der Zeit. Sie funktioniert nur unter den engen Bedingungen, für die sie konzipiert wurde.

Jenseits der Bildschwellenwertbildung: Wann Computer Vision das richtige Werkzeug ist#

Die Schwellenwertbildung funktioniert gut für einfache Segmentierungsaufgaben in kontrollierten Umgebungen. Sie hat jedoch oft Probleme bei der Verarbeitung komplexer Bilder, die mehrere Objekte oder Hintergrundrauschen enthalten. Da sie auf festen Regeln basiert, fehlt der Schwellenwertbildung die Flexibilität, die für die meisten realen Anwendungen erforderlich ist.

Um diese Grenzen zu überwinden, nutzen viele hochmoderne Systeme mittlerweile Computer Vision. Im Gegensatz zu Schwellenwertverfahren werden Vision-KI-Modelle darauf trainiert, komplexe Muster und Merkmale zu erkennen, wodurch sie weitaus präziser und anpassungsfähiger sind.

Zum Beispiel können Computer-Vision-Modelle wie Ultralytics YOLO11 Objekte in Echtzeit erkennen und Bilder segmentieren. Das macht sie ideal für Aufgaben wie das Erkennen von Ampeln in autonomen Fahrzeugen oder das Identifizieren von Pflanzenproblemen in der Landwirtschaft.

Insbesondere unterstützt Ultralytics YOLO11 eine Reihe von Computer-Vision-Aufgaben wie die Instanzsegmentierung, bei der jedes Objekt in einem Bild separat segmentiert wird. Es kann auch andere visionbasierte Aufgaben ausführen, darunter Pose Estimation (Bestimmung der Position oder Haltung eines Objekts) und Object Tracking (Verfolgung eines Objekts, während es sich über Videoframes hinweg bewegt).

Ultralytics YOLO11 detecting and segmenting objects in an image

Abb. 5: YOLO11 macht das Erkennen und Segmentieren von Objekten einfach. (Source)

Während die Schwellenwertbildung für einfache Aufgaben oder das Testen erster Ideen gut funktioniert, sind Anwendungen, die Geschwindigkeit, Genauigkeit und Flexibilität erfordern, in der Regel mit Computer Vision besser bedient.

Wichtige Erkenntnisse#

Die Schwellenwertbildung ist ein wichtiges Werkzeug in der Bildverarbeitung, da sie schnell und einfach zur Trennung von Objekten vom Hintergrund eingesetzt werden kann. Sie funktioniert gut bei eingescannten Dokumenten, medizinischen Bildern und der Überprüfung von Produktfehlern in Fabriken.

Da Bilder und Videos jedoch immer komplexer werden, können grundlegende Bildverarbeitungsmethoden wie Image Thresholding an ihre Grenzen stoßen. Hier kommen fortschrittliche Computer-Vision-Modelle ins Spiel. Modelle wie Ultralytics YOLO11 können mehr Aufgaben verstehen und ausführen, viele Objekte gleichzeitig erkennen und in Echtzeit arbeiten, was sie für zahlreiche Anwendungsfälle nützlich macht.

Möchtest du mehr über KI erfahren? Schau dir unsere community und unser GitHub repository an. Entdecke unsere Lösungsseiten, um mehr über AI in robotics und computer vision in agriculture zu erfahren. Entdecke our licensing-Optionen und beginne noch heute mit der Entwicklung von Computer Vision!

Explore solutions

Real-time AI that works with your team

KI in der Robotik

Stärke intelligentere Maschinen mit Ultralytics YOLO Modellen. Vision AI in der Robotik treibt autonome Navigation, Wahrnehmung, Objektverfolgung und Echtzeitsteuerung voran.
Erfahre mehr
Real-time AI that works with your team

KI in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Paketkontrolle, Sortierung, Fahrzeugverfolgung und Echtzeit-Überwachung der Lagersicherheit.
Erfahre mehr
Real-time AI that works with your team

KI im Einzelhandel

Erfinde den Einzelhandel neu mit Ultralytics YOLO-Modellen. Vision AI fördert Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und intelligentere Kundeneinblicke.
Erfahre mehr
Real-time AI that works with your team

KI im Gesundheitswesen

Baue Gesundheitslösungen mit Ultralytics YOLO Modellen. Vision AI im Gesundheitswesen ermöglicht schnellere medizinische Bildgebung, intelligentere Diagnostik und Patientenüberwachung.
Erfahre mehr
Real-time AI that works with your team

KI in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI treibt Qualitätskontrolle, Fehlererkennung, PSA-Einhaltung und die Automatisierung von Montagelinien voran.
Erfahre mehr
Real-time AI that works with your operation

KI in der Automobilbranche

Nutze Computer Vision in der Automobilindustrie mit Ultralytics YOLO Modellen. Vision AI steigert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Erfahre mehr
Real-time AI tailored to your operation

KI in der Landwirtschaft

Bringe Vision AI mit Ultralytics YOLO Modellen in die smarte Landwirtschaft. Optimiere die Ernteüberwachung, Viehverfolgung und Präzisionslandwirtschaft für höhere, intelligentere Erträge.
Erfahre mehr
Real-time AI that works with your team

KI in der Robotik

Stärke intelligentere Maschinen mit Ultralytics YOLO Modellen. Vision AI in der Robotik treibt autonome Navigation, Wahrnehmung, Objektverfolgung und Echtzeitsteuerung voran.
Erfahre mehr
Real-time AI that works with your team

KI in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Paketkontrolle, Sortierung, Fahrzeugverfolgung und Echtzeit-Überwachung der Lagersicherheit.
Erfahre mehr
Real-time AI that works with your team

KI im Einzelhandel

Erfinde den Einzelhandel neu mit Ultralytics YOLO-Modellen. Vision AI fördert Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und intelligentere Kundeneinblicke.
Erfahre mehr
Real-time AI that works with your team

KI im Gesundheitswesen

Baue Gesundheitslösungen mit Ultralytics YOLO Modellen. Vision AI im Gesundheitswesen ermöglicht schnellere medizinische Bildgebung, intelligentere Diagnostik und Patientenüberwachung.
Erfahre mehr
Real-time AI that works with your team

KI in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI treibt Qualitätskontrolle, Fehlererkennung, PSA-Einhaltung und die Automatisierung von Montagelinien voran.
Erfahre mehr
Real-time AI that works with your operation

KI in der Automobilbranche

Nutze Computer Vision in der Automobilindustrie mit Ultralytics YOLO Modellen. Vision AI steigert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Erfahre mehr
Real-time AI tailored to your operation

KI in der Landwirtschaft

Bringe Vision AI mit Ultralytics YOLO Modellen in die smarte Landwirtschaft. Optimiere die Ernteüberwachung, Viehverfolgung und Präzisionslandwirtschaft für höhere, intelligentere Erträge.
Erfahre mehr
Real-time AI that works with your team

KI in der Robotik

Stärke intelligentere Maschinen mit Ultralytics YOLO Modellen. Vision AI in der Robotik treibt autonome Navigation, Wahrnehmung, Objektverfolgung und Echtzeitsteuerung voran.
Erfahre mehr
Real-time AI that works with your team

KI in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Paketkontrolle, Sortierung, Fahrzeugverfolgung und Echtzeit-Überwachung der Lagersicherheit.
Erfahre mehr
Real-time AI that works with your team

KI im Einzelhandel

Erfinde den Einzelhandel neu mit Ultralytics YOLO-Modellen. Vision AI fördert Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und intelligentere Kundeneinblicke.
Erfahre mehr
Real-time AI that works with your team

KI im Gesundheitswesen

Baue Gesundheitslösungen mit Ultralytics YOLO Modellen. Vision AI im Gesundheitswesen ermöglicht schnellere medizinische Bildgebung, intelligentere Diagnostik und Patientenüberwachung.
Erfahre mehr
Real-time AI that works with your team

KI in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI treibt Qualitätskontrolle, Fehlererkennung, PSA-Einhaltung und die Automatisierung von Montagelinien voran.
Erfahre mehr
Real-time AI that works with your operation

KI in der Automobilbranche

Nutze Computer Vision in der Automobilindustrie mit Ultralytics YOLO Modellen. Vision AI steigert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Erfahre mehr
Real-time AI tailored to your operation

KI in der Landwirtschaft

Bringe Vision AI mit Ultralytics YOLO Modellen in die smarte Landwirtschaft. Optimiere die Ernteüberwachung, Viehverfolgung und Präzisionslandwirtschaft für höhere, intelligentere Erträge.
Erfahre mehr

Lass uns gemeinsam die Zukunft der KI bauen!

Beginne deine Reise mit der Zukunft des maschinellen Lernens