Ultralytics YOLO27:
Anleitungen

Was ist Bildverarbeitung? Eine kurze Einführung

Erfahre, was Bildverarbeitung ist, wie sie funktioniert und wie sie im Gesundheitswesen, beim autonomen Fahren und in anderen modernen intelligenten Systemen eingesetzt wird.

ABAbirami Vina7 min read
Maschinen interpretieren visuelle Daten durch Bildverarbeitung

Wenn du durch ein Einkaufszentrum oder eine belebte Straße gehst, zeichnen Kameras über Eingängen und an Gehwegen die Aktivitäten auf. Sie erzeugen jede Sekunde visuelle Daten, und meistens bemerken wir das nicht einmal.

Dieser kontinuierliche Datenstrom versorgt moderne KI-gestützte Systeme – von intelligenten Sicherheitssystemen bis hin zu selbstfahrenden Autos. Diese Innovationen werden durch Bildverarbeitung ermöglicht, ein vielseitiges Gebiet, das Informatik, Mathematik und Physik verbindet.

Bildverarbeitung hilft Maschinen zu verstehen, was sie in einem Bild sehen. Sie ermöglicht es Systemen, zu erkennen, was in einer Szene geschieht, und zu entscheiden, wie sie funktionieren oder reagieren sollen, etwa indem ein selbstfahrendes Auto angehalten wird, wenn ein Hindernis auftaucht.

In diesem Artikel sehen wir uns an, was Bildverarbeitung ist und wie sie in modernen Systemen der künstlichen Intelligenz (AI) eingesetzt wird. Legen wir los!

Bildverarbeitung verstehen#

Bildverarbeitung ist der Prozess der Erfassung, Verarbeitung und Analyse von Bildern mithilfe fortschrittlicher Algorithmen. Dabei werden Bilder als Daten behandelt, die Maschinen verstehen und verarbeiten können.

Anders gesagt wird jedes Bild als Raster aus Zahlen verarbeitet. Dazu werden Pixel, die kleinsten Einheiten eines Bildes, in eine aus Zeilen und Spalten bestehende Matrix umgewandelt. Jeder Pixel hat einen numerischen Wert, der der Maschine angibt, wie hell oder dunkel ein bestimmter Bildbereich ist.

Die Anordnung dieser Werte hängt davon ab, ob das Bild in Graustufen oder in Farbe vorliegt. Bei Graustufenbildern reichen die Pixelwerte typischerweise von 0 (Schwarz) bis 255 (Weiß). Bei Farbbildern werden mehrere Matrizen verwendet, um verschiedene Farbkanäle darzustellen, etwa Rot, Grün und Blau (RGB) oder Farbton, Sättigung und Wert (HSV).

Matrixdarstellungen digitaler Bilder

Abb. 1. Matrixdarstellungen von Bildern (Quelle)

Zusätzlich zu den Pixelmatrizen enthält ein Bild häufig verborgene Kontextinformationen, die als Metadaten bezeichnet werden. Metadaten liefern wichtige Details wie Bildauflösung, Bittiefe, Kamera- oder Sensoreinstellungen sowie den genauen Zeitpunkt der Bildaufnahme. Bilder werden in bestimmten Dateiformaten gespeichert, um sowohl visuelle Daten als auch Metadaten zu bewahren.

In der biomedizinischen Bildverarbeitung werden Bilder beispielsweise häufig im Format Digitale Bildgebung und Kommunikation in der Medizin (DICOM) gespeichert. DICOM verbindet visuelle Bilddaten mit Patienteninformationen wie Identifikationsdaten und Geräteeinstellungen und stellt so sicher, dass die medizinische Bildanalyse genau, konsistent und sicher ist.

So funktioniert Bildverarbeitung#

Nachdem wir nun besser verstehen, was Bildverarbeitung ist, gehen wir die Schritte durch, mit denen ein Kamerabildstrom in verwertbare Erkenntnisse umgewandelt wird.

Obwohl der genaue Ablauf je nach Anwendung variieren kann, durchlaufen die meisten Bildverarbeitungssysteme diese Hauptphasen:

  • Bilderfassung: Zunächst werden visuelle Daten mithilfe von Kameras und Sensoren erfasst oder aus frei verfügbaren Bilddatensätzen bezogen.
  • Bildvorverarbeitung: Anschließend werden die erfassten Bilder in der Größe angepasst, entrauscht, verbessert und in einen bestimmten Farbraum umgewandelt, um die Eingaben zu standardisieren.
  • Merkmalsextraktion: Deep-Learning-Algorithmen werden eingesetzt, um wichtige Muster im Bild zu erlernen, etwa Kanten, Formen und Texturen.
  • Interpretation: Die extrahierten Merkmale werden analysiert, um Aufgaben wie Objekterkennung, Bildsegmentierung und Objektverfolgung auszuführen.
  • Ausgabe: Schließlich erzeugt das System strukturierte Ausgaben wie Klassenbezeichnungen oder Begrenzungsrahmen und stellt sie so dar, dass Menschen oder andere Systeme sie leicht verstehen, nutzen und visualisieren können.

Bildverarbeitung vs. Computer Vision vs. Bildaufbereitung#

Wenn du auf den Begriff Bildverarbeitung stößt, siehst du möglicherweise auch Begriffe wie Bildaufbereitung und Computer Vision. Obwohl diese Begriffe häufig synonym verwendet werden, beschreiben sie unterschiedliche Arten, wie KI-Systeme mit visuellen Daten interagieren.

Bildaufbereitung konzentriert sich beispielsweise auf die Verbesserung von Bildern oder der Qualität von Eingabebildern mithilfe grundlegender Operationen wie Rauschunterdrückung, Größenanpassung und Kontrastanpassung. Computer Vision hingegen, ein Teilgebiet der KI, baut auf der Bildaufbereitung auf und ermöglicht es Maschinen, Objekte zu erkennen, Szenen zu interpretieren und zu verstehen, was in Bildern oder Videos geschieht.

Bildverarbeitung kombiniert Bildaufbereitung und Computer Vision, um visuelle Daten in aussagekräftige und nutzbare Ausgaben für intelligente Systeme umzuwandeln.

Vergleich von Bildaufbereitung, Computer Vision und Bildverarbeitung

Abb. 2. Bildaufbereitung vs. Computer Vision vs. Bildverarbeitung. Bild vom Autor.

So wird Bildverarbeitung heute umgesetzt#

Als Nächstes sehen wir uns an, wie Bildverarbeitung heute umgesetzt wird.

In den frühen Phasen der Bildverarbeitung wurden Merkmale wie Kanten, Ecken und Texturen mithilfe regelbasierter und manuell entwickelter Algorithmen von Hand definiert. Obwohl diese Methoden in kontrollierten Umgebungen recht gut funktionierten, ließen sie sich nur schwer skalieren und an komplexe Bedingungen in der realen Welt anpassen.

Moderne Bildverarbeitungssysteme begegnen diesen Einschränkungen mit Deep-Learning-basierten Ansätzen. Modelle wie faltende neuronale Netze (CNNs) und Vision Transformer lernen relevante Merkmale automatisch aus großen Bilddatensätzen. Dadurch können sie Aufgaben wie Objekterkennung, Instanzsegmentierung und Objektverfolgung genauer und robuster ausführen.

Heute stützen sich Bildverarbeitungs-Workflows häufig auf Echtzeitmodelle für Computer Vision, die für den Einsatz in modernen KI-Systemen entwickelt wurden. So ermöglichen Vision-KI-Modelle wie Ultralytics YOLO26 schnelle und effiziente Computer-Vision-Funktionen wie Objekterkennung und Instanzsegmentierung sowohl auf Edge-Geräten als auch in Cloud-Umgebungen.

Ultralytics YOLO26 bei der Erkennung und Segmentierung von Objekten in einem Bild

Abb. 3. Beispiel für den Einsatz von Ultralytics YOLO26 zur Erkennung und Segmentierung von Objekten in einem Bild

Praktische Anwendungen der Bildverarbeitung#

Bildverarbeitung wird in zahlreichen praktischen Anwendungen eingesetzt, um visuelle Daten zu verstehen und darauf zu reagieren. Sehen wir uns an, wie Bildverarbeitung in verschiedenen Bereichen eingesetzt wird.

Medizinische Bildverarbeitung zur frühzeitigen Erkennung von Krankheiten#

Bildverarbeitung kann Ärzten und medizinischem Fachpersonal helfen, Krankheiten früher zu erkennen und medizinische Aufnahmen effizienter zu analysieren. Diese innovativen Gesundheitssysteme können medizinische Bilddaten wie Röntgenaufnahmen und Aufnahmen der Magnetresonanztomografie (MRI) schnell verarbeiten und liefern häufig konsistentere Ergebnisse als eine manuelle Prüfung.

Modelle wie Ultralytics YOLO26 können beispielsweise mit großen Mengen an Röntgenaufnahmen des Brustkorbs trainiert werden, um Muster zu erlernen, die mit Infektionen und Auffälligkeiten zusammenhängen. Nach dem Training können diese Modelle dabei helfen festzustellen, ob eine Aufnahme normal erscheint oder Anzeichen von Erkrankungen wie einer Lungenentzündung oder COVID-19 zeigt.

Bildverarbeitung für autonomes Fahren#

Autonome Fahrzeuge nutzen Bildverarbeitung, um zu verstehen, was um sie herum geschieht, und Fahrentscheidungen zu treffen. Die Technologie wandelt unbearbeitetes Kameramaterial in Echtzeitinformationen um, die dem Fahrzeug helfen, sich sicher und reibungslos fortzubewegen.

Bildverarbeitung wird häufig in fortschrittlichen Fahrerassistenzsystemen (ADAS) eingesetzt. Statt einfach nur Videos aufzuzeichnen, analysieren diese Module jedes Einzelbild, um Fahrbahnmarkierungen, andere Fahrzeuge, Fußgänger und Hindernisse zu erkennen. Dadurch kann das Auto mit wenig menschlichem Eingreifen auf veränderte Straßenbedingungen reagieren.

Ein weiterer häufiger Anwendungsfall ist die Kombination von Bildern mehrerer Kameras, um eine 360-Grad-Ansicht der Fahrzeugumgebung zu erzeugen. Bildverarbeitung hilft dabei, Objektivverzerrungen zu korrigieren, die Bildschärfe zu verbessern und Helligkeit und Farben über alle Kamerabilder hinweg abzugleichen. Das Ergebnis ist eine klare, nahtlose Ansicht, mit der das Fahrzeug auch bei schlechtem Wetter oder schlechten Lichtverhältnissen sicher navigieren kann.

Zusammenfügen von Bildern mithilfe von Deep Learning

Abb. 4. Zusammenfügen von Bildern mithilfe von Deep Learning (Quelle)

Vor- und Nachteile der Bildverarbeitung#

Hier sind einige der Vorteile der Bildverarbeitung:

  • Skalierbarkeit: Nach dem Training können Bildverarbeitungssysteme große Mengen visueller Daten kontinuierlich und in großem Maßstab analysieren.
  • Entscheidungsfindung: Sie unterstützt zeitkritische Anwendungen wie autonomes Fahren, medizinische Untersuchungen und die industrielle Überwachung.
  • Langfristige Kosteneffizienz: Auch wenn die Ersteinrichtung teuer sein kann, lassen sich durch automatisierte visuelle Analysen die langfristigen Betriebskosten senken.

Neben den vielen Vorteilen der Bildverarbeitung gibt es auch einige Einschränkungen. Hier sind einige Faktoren, die du berücksichtigen solltest:

  • Datenqualität: Methoden der Bildverarbeitung hängen stark von einer genauen Beschriftung und hochwertigen Datensätzen ab, deren Erstellung kostspielig und zeitaufwendig sein kann.
  • Empfindlichkeit gegenüber Bedingungen: Veränderungen bei Beleuchtung, Verdeckung, Bewegungsunschärfe, Wetter oder Kamerawinkeln können die Modellleistung beeinträchtigen.
  • Eingeschränkte Erklärbarkeit: Bildmodelle auf Basis von Deep Learning können als Blackbox agieren, sodass sich nur schwer erklären lässt, wie Entscheidungen getroffen werden.

Wichtige Erkenntnisse#

Bildverarbeitung hat sich von der einfachen Bildaufbereitung zu einer Technologie entwickelt, die es KI-Systemen ermöglicht, die reale Welt in Echtzeit wahrzunehmen und zu verstehen. Mit den Fortschritten im Deep Learning wird Bildverarbeitung zu einem wesentlichen Bestandteil der Entwicklung intelligenterer und praxisnäherer Werkzeugsammlungen und Anwendungen.

Tritt unserer Community bei und sieh dir unser GitHub-Repository an, um mehr über KI zu erfahren. Besuche unsere Lösungsseiten und lies mehr über Anwendungen von KI in der Landwirtschaft und Computer Vision in der Logistik. Entdecke unsere Lizenzoptionen und beginne mit der Entwicklung von Vision-KI-Modellen.

Explore solutions

Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren
Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren
Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren

Lass uns gemeinsam die Zukunft der KI gestalten!

Beginne deine Reise in die Zukunft des maschinellen Lernens