Image Classification
Entdecke die Grundlagen der Bildklassifizierung – von CNNs bis zu praktischen KI-Anwendungen. Erfahre, wie du hochmoderne Klassifizierungsmodelle mit Ultralytics YOLO26 trainierst und bereitstellst.
Die Bildklassifizierung ist eine grundlegende Aufgabe im Bereich Computer Vision (CV), bei der ein Machine-Learning-Modell ein vollständiges Bild analysiert und ihm ein einzelnes Label aus einer vordefinierten Kategorienmenge zuweist. Im Wesentlichen beantwortet sie die Frage: „Was ist das Hauptmotiv dieses Bildes?“ Als zentraler Bestandteil der künstlichen Intelligenz (AI) ermöglicht dieser Prozess automatisierten Systemen, visuelle Daten in großem Maßstab zu organisieren, zu kategorisieren und zu interpretieren. Auch wenn dies für das menschliche Auge einfach erscheinen mag, erfordert die Erkennung von Mustern durch Computer ausgefeilte Algorithmen des maschinellen Lernens (ML), um die Lücke zwischen Rohpixeln und aussagekräftigen Konzepten zu überbrücken.
Der Mechanismus hinter der Klassifizierung#
Die moderne Bildklassifizierung stützt sich stark auf Architekturen des Deep Learning (DL), die als Faltungsneuronale Netze (CNNs) bekannt sind. Diese Netze sind darauf ausgelegt, die Verarbeitung von Informationen durch den biologischen visuellen Kortex nachzuahmen. Durch einen Prozess namens Merkmalsextraktion lernt das Modell, in den frühen Schichten grundlegende Merkmale wie Kanten und Texturen zu erkennen und sie schließlich in tieferen Schichten zu komplexen Formen und Objekten zu kombinieren.
Um einen Klassifikator zu erstellen, verwenden Entwickler überwachtes Lernen und versorgen das Modell mit großen Mengen an Trainingsdaten, die gekennzeichnete Beispiele enthalten. Große öffentliche Datensätze wie ImageNet waren maßgeblich daran beteiligt, die Genauigkeit dieser Systeme zu verbessern. Während der Inferenzphase gibt das Modell für jede Kategorie einen Wahrscheinlichkeitswert aus und verwendet häufig eine Softmax-Funktion, um die wahrscheinlichste Klasse zu bestimmen.
Klassifizierung im Vergleich zu anderen Aufgaben der Bildverarbeitung#
Es ist wichtig, die Bildklassifizierung von verwandten Funktionen der Computer Vision zu unterscheiden, da die Wahl der Technik vom jeweiligen Problem abhängt:
- Klassifizierung im Vergleich zur Objekterkennung: Bei der Klassifizierung wird dem gesamten Bild ein Label zugewiesen. Im Gegensatz dazu erkennt die Objekterkennung die Position mehrerer Objekte innerhalb einer Szene, indem sie um jedes Objekt eine Begrenzungsbox zeichnet.
- Klassifizierung im Vergleich zur Bildsegmentierung: Während die Klassifizierung den globalen Kontext betrachtet, bietet die Segmentierung Präzision auf Pixelebene. Die semantische Segmentierung klassifiziert jedes einzelne Pixel und ermöglicht so eine exakte Abgrenzung zwischen Objekten und Hintergrund.
Anwendungen in der Praxis#
Die Bildklassifizierung bildet die Grundlage für eine große Bandbreite an KI-Anwendungen in der Praxis in verschiedensten Branchen:
Medizinische Diagnostik#
Im medizinischen Bereich unterstützen Klassifizierungsmodelle Radiologen, indem sie diagnostische Aufnahmen analysieren. Tools zur Analyse medizinischer Bilder können Röntgenaufnahmen oder MRIs schnell als „normal“ oder „auffällig“ kategorisieren oder bestimmte Erkrankungen wie Tumorerkennung identifizieren. Dadurch werden eine schnellere Ersteinschätzung und Diagnose von Patienten ermöglicht.
Qualitätskontrolle in der Fertigung#
Fabriken nutzen automatisierte visuelle Inspektionen, um Produktstandards einzuhalten. Kameras an Fertigungslinien erfassen Bilder von Komponenten, und Klassifizierungsmodelle kennzeichnen sie anhand sichtbarer Defekte sofort als „bestanden“ oder „nicht bestanden“. Diese automatisierte Qualitätskontrolle stellt sicher, dass nur fehlerfreie Produkte die Verpackungsphase erreichen.
Intelligente Landwirtschaft#
Landwirte nutzen KI in der Landwirtschaft, um den Zustand von Nutzpflanzen zu überwachen. Durch die Klassifizierung von Bildern, die mit Drohnen oder Smartphones aufgenommen wurden, können Systeme Anzeichen von Krankheiten, Nährstoffmangel oder Schädlingsbefall erkennen und so gezielte Maßnahmen der Präzisionslandwirtschaft ermöglichen.
Klassifizierung mit Ultralytics YOLO26 implementieren#
Das Framework Ultralytics YOLO26 ist zwar vor allem für die Objekterkennung bekannt, bietet aber auch modernste Leistung für Aufgaben der Bildklassifizierung. Seine Architektur ist auf Geschwindigkeit und Genauigkeit optimiert und eignet sich daher für Echtzeitanwendungen.
Hier ist ein kurzes Beispiel dafür, wie du ein vortrainiertes Modell lädst und ein Bild mit dem ultralytics-Python-Paket klassifizierst:
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Run inference on an image source
results = model("https://ultralytics.com/images/bus.jpg")
# Print the top predicted class name
print(f"Prediction: {results[0].names[results[0].probs.top1]}")Für Teams, die ihren Workflow optimieren möchten, vereinfacht die Ultralytics Platform die gesamte Pipeline. Sie ermöglicht es dir, Klassifizierungsdatensätze zu verwalten, Training in der Cloud durchzuführen und Modelle ohne umfangreiche Programmierinfrastruktur in verschiedene Formate wie ONNX oder TensorRT bereitzustellen.









