Überwachtes vs. unüberwachtes Lernen in der Computer Vision im Überblick
Lerne die Unterschiede zwischen überwachtem und unüberwachtem Lernen in der Computer Vision kennen und erfahre, wie du den richtigen Ansatz für deine Daten und Projektziele auswählst.

Künstliche Intelligenz (AI) basiert auf dem grundlegenden Konzept, Maschinen so zu lehren, dass sie auf eine der menschlichen Intelligenz ähnliche Weise lernen und schlussfolgern. Ähnlich wie Menschen durch unterschiedliche Methoden lernen, etwa durch direkte Anleitung oder durch das Beobachten von Mustern und Erfahrungen, werden AI- und Machine-Learning-Systeme darauf ausgelegt, diesen Ansätzen zu folgen.
Insbesondere bei Machine-Learning-Algorithmen werden Systeme darauf trainiert, aus Daten zu lernen, anstatt für jede Aufgabe explizit programmiert zu werden. Anstatt sich auf feste Regeln zu stützen, erkennen Machine-Learning-Modelle Muster in Daten und nutzen diese Muster, um Vorhersagen zu treffen oder Entscheidungen zu fällen.
Beispielsweise ist Computer Vision ein Teilgebiet von AI und Machine Learning, das darauf ausgerichtet ist, Systeme zur Interpretation und zum Verständnis visueller Informationen wie Bildern und Videos zu befähigen. Von der Erkennung von Objekten bis hin zur Identifizierung verborgener Muster in großen Datensätzen hängt die Leistungsfähigkeit dieser Systeme stark davon ab, wie sie trainiert werden.
Je nach verfügbaren Daten und zu lösender Aufgabe werden verschiedene AI-Lernverfahren zum Trainieren dieser Systeme eingesetzt.
Einige Computer-Vision-Modelle lernen aus annotierten Daten, bei denen jede Eingabe mit einer korrekten Antwort verknüpft ist. Das bedeutet, dass jedes Bild oder jeder Datenpunkt mit einem vordefinierten Label versehen ist, das dem Modell mitteilt, was dargestellt wird. Dadurch kann das Modell die Beziehung zwischen Eingabe und erwarteter Ausgabe erlernen und seine Fähigkeit verbessern, genaue Vorhersagen für neue, bisher unbekannte Daten zu treffen.
Andere Vision-Modelle lernen aus nicht annotierten Daten, für die keine vordefinierten Antworten vorliegen, und konzentrieren sich stattdessen darauf, Muster und Beziehungen innerhalb der Daten selbst zu erkennen. Diese Ansätze werden als überwachtes Lernen beziehungsweise unüberwachtes Lernen bezeichnet und bilden die Grundlage vieler hochmoderner Computer-Vision-Systeme.
In diesem Artikel sehen wir uns überwachtes und unüberwachtes Lernen, ihre Verwendung in der Computer Vision und die Auswahl des Ansatzes an, der am besten zu deinem Vision-AI-Projekt passt. Legen wir los!
Wie AI-Lernansätze Computer Vision voranbringen#
Du kannst dir künstliche Intelligenz wie einen Regenschirm vorstellen, der eine Reihe von Technologien umfasst, mit denen Maschinen Aufgaben ausführen können, die normalerweise menschliche Intelligenz erfordern. Innerhalb dieses Schirms ist Machine Learning ein zentraler Bereich, der es Systemen ermöglicht, aus Daten zu lernen, anstatt sich ausschließlich auf feste Regeln zu stützen.
Innerhalb des Machine Learnings bestimmen verschiedene Lernverfahren, wie ein Modell lernt und sich im Laufe der Zeit verbessert. Ansätze wie überwachtes Lernen (Lernen aus annotierten Daten mit korrekten Antworten), unüberwachtes Lernen (Erkennen von Mustern in nicht annotierten Daten), bestärkendes Lernen (Lernen durch Versuch und Irrtum mithilfe von Feedback oder Belohnungen) und teilüberwachtes Lernen (Kombination einer kleinen Menge annotierter Daten mit einer großen Menge nicht annotierter Daten) legen fest, wie Systeme Eingabedaten verarbeiten und Ausgabedaten erzeugen.

Abb. 1. Ein Überblick über AI-Lernverfahren (Quelle)
Insbesondere werden Computer-Vision-Systeme mithilfe solcher Lernansätze entwickelt, um visuelle Daten zu interpretieren und zu verstehen. Überwachtes Lernen ist die am häufigsten eingesetzte Methode, da Modelle damit aus eindeutig annotierten Beispielen lernen und genaue, zuverlässige Ergebnisse liefern können.
Beispielsweise kann ein Modell mit Bildern trainiert werden, die als „Katze“ und „Hund“ gekennzeichnet sind. Dabei lernt es Merkmale wie Form, Ohren und Gesichtsstruktur, sodass es neue Bilder mithilfe von Klassifikationsalgorithmen korrekt klassifizieren kann. Unüberwachtes und teilüberwachtes Lernen werden ebenfalls in der Computer Vision eingesetzt, häufig um Muster in Daten zu untersuchen oder die Leistung bei begrenzten annotierten Daten zu verbessern.
Überwachtes Lernen in Computer-Vision-Modellen#
Du kannst überwachtes Lernen mit einer Unterrichtssituation vergleichen, in der eine Lehrkraft Beispiele zusammen mit den richtigen Antworten gibt, damit die Schülerinnen und Schüler lernen, was richtig und was falsch ist. Beim Machine Learning lernen Modelle auf ähnliche Weise anhand annotierter Daten, bei denen jede Eingabe mit einer bekannten Ausgabe verknüpft ist.
Angenommen, du entwickelst ein Computer-Vision-System zur automatisierten Analyse von Baseballspielen. Du könntest ein Modell wie Ultralytics YOLO26 mit Bildern oder Videoframes trainieren, auf denen Objekte wie Ball, Schläger und Spieler annotiert sind.
Jedes Objekt würde mit seiner Position und Kategorie gekennzeichnet, sodass das Modell lernen kann, wonach es suchen soll. Mit der Zeit kann das Modell diese Objekte in neuem Videomaterial erkennen und lokalisieren und so Anwendungsfälle wie die Ballverfolgung und die Erkennung von Spielern über mehrere Frames hinweg unterstützen.

Abb. 2. Ein Beispiel für durch überwachtes Lernen ermöglichte Objekterkennung (Quelle)
Über die Objekterkennung hinaus wird überwachtes Lernen für zahlreiche Computer-Vision-Aufgaben eingesetzt, etwa Bildklassifikation, Instanzsegmentierung und Posenschätzung, bei denen Genauigkeit und Konsistenz wichtig sind. Bei all diesen Aufgaben lernen Modelle aus annotierten Daten, bestimmte Muster zu erkennen und zuverlässige Vorhersagen für neue Eingaben zu treffen.
Diese Modelle werden typischerweise mithilfe von Deep Learning entwickelt, einer Form des Machine Learnings, bei der neuronale Netze Muster direkt aus Daten lernen. Neuronale Netze sind darauf ausgelegt, Informationen auf eine Weise zu verarbeiten, die lose von der Funktionsweise des menschlichen Gehirns inspiriert ist. Dadurch können Modelle komplexe visuelle Merkmale aus großen Datensätzen lernen.
Frühere Computer-Vision-Ansätze stützten sich häufig auf manuell entwickelte Merkmale in Kombination mit Algorithmen wie Support-Vector-Maschinen (SVMs sind Modelle, die Daten klassifizieren, indem sie die beste Grenze zwischen Kategorien finden) oder Entscheidungsbäumen (Modelle, die Entscheidungen treffen, indem sie Daten in Zweige aufteilen).
Im Gegensatz dazu nutzen Computer-Vision-Modelle heute Deep Learning, um diese Merkmale automatisch aus Daten zu lernen. Dadurch können sie groß angelegte und sehr detaillierte visuelle Aufgaben effektiver bewältigen.
Warum Modelle für unüberwachtes Lernen in der Vision AI benötigt werden#
Obwohl überwachtes Lernen der bevorzugte Ansatz in der Computer Vision ist, gibt es bestimmte Vision-Anwendungen, für die keine annotierten Daten verfügbar oder deren Erstellung zu teuer und zeitaufwendig ist.
In diesen Fällen können Algorithmen für unüberwachtes Lernen eine nützliche Alternative sein. Angenommen, du verfügst über eine große Sammlung nicht annotierter Fotos von einer Wildtierkamera.
Es gibt keine Labels, die angeben, was jedes Bild enthält, aber du möchtest die Daten trotzdem organisieren oder verstehen. Ein unüberwachtes Modell kann diese Bilder analysieren und ähnliche Bilder gruppieren. So kann es ähnlich aussehende Tiere in Cluster aufteilen, selbst wenn ihre genauen Labels unbekannt sind.
So funktioniert unüberwachtes Lernen in der Computer Vision#
Wie funktioniert unüberwachtes Machine Learning also? Anstatt aus korrekten Antworten zu lernen, erkennt das Modell selbstständig Muster und Strukturen innerhalb der Daten. Es sucht nach Ähnlichkeiten und Unterschieden in den Daten, ohne sich auf annotierte Beispiele zu stützen.
Ein häufiger Anwendungsfall ist die Anomalieerkennung, bei der das Modell lernt, wie normale Daten aussehen, und anschließend Abweichungen davon erkennt. Die Erkennung von Anomalien und Ausreißern zählt zu den wirkungsvollsten industriellen Anwendungen. Beispiele sind das Erkennen fehlerhafter Produkte in einer Fertigungslinie, das Markieren ungewöhnlicher medizinischer Aufnahmen zur Überprüfung durch Radiologen oder das Erkennen verdächtiger Aktivitäten in Überwachungsvideos. Da Fehler und Anomalien oft selten und vielfältig sind, ist es unpraktisch, jeden möglichen Fall zu annotieren, wodurch sich unüberwachte Ansätze besonders anbieten.
Dafür werden häufig Verfahren wie Clustering und Dimensionsreduktion eingesetzt, meist auf Merkmalen, die aus Bildern extrahiert wurden, und nicht auf den Rohbildern selbst. Clustering-Verfahren wie k-Means gruppieren ähnliche Bilder anhand gemeinsamer Muster, während Verfahren zur Dimensionsreduktion wie die Hauptkomponentenanalyse (PCA) die Daten vereinfachen, indem sie sich auf die wichtigsten Merkmale konzentrieren.
Dadurch kann das Modell aussagekräftige Muster und Strukturen in großen und komplexen Datensätzen leichter erkennen. Der wichtigste Vorteil des unüberwachten Lernens besteht darin, dass es gut mit nicht annotierten Daten funktioniert und Muster aufdecken kann, die nicht sofort offensichtlich sind. Allerdings ist es schwieriger zu bewerten und bietet im Vergleich zum überwachten Lernen weniger Kontrolle über die endgültige Ausgabe.
Selbstüberwachtes und teilüberwachtes Lernen in der Computer Vision#
Wenn du dich mit überwachtem und unüberwachtem Lernen beschäftigst, fragst du dich vielleicht, ob es einen Mittelweg zwischen beiden gibt. Interessanterweise schließen selbstüberwachtes und teilüberwachtes Lernen die Lücke zwischen überwachtem und unüberwachtem Lernen.
Diese Ansätze ermöglichen es Modellen, effektiver aus nicht annotierten Daten zu lernen. Anstatt sich ausschließlich auf annotierte Beispiele zu stützen, erstellen sie entweder eigene Lernaufgaben aus den Daten oder kombinieren einen kleinen annotierten Datensatz mit einem größeren nicht annotierten Datensatz.
Beim selbstüberwachten Lernen lernt das Modell, indem es aus den Daten selbst erstellte Aufgaben löst. Beispielsweise kann ihm ein Bild mit einem fehlenden Bereich gegeben werden, sodass es vorhersagen lernt, was diesen Bereich ausfüllen sollte. Alternativ kann es lernen, verschiedene Ansichten desselben Objekts zu erkennen. Dadurch erlernt das Modell nützliche Merkmale, ohne manuelle Labels zu benötigen.
Beim teilüberwachten Lernen wird dagegen eine kleine Menge annotierter Daten zusammen mit einer größeren Menge nicht annotierter Daten verwendet, um die Leistung zu verbessern. In manchen Fällen kann das Modell Labels für die nicht annotierten Daten erzeugen und diese zum weiteren Lernen verwenden.
Der entscheidende Vorteil dieser Ansätze besteht darin, dass sie den Bedarf an großen annotierten Datensätzen reduzieren, deren Erstellung häufig teuer und zeitaufwendig ist. Allerdings können sie im Vergleich zu vollständig überwachten Methoden komplexer zu entwickeln und zu bewerten sein.
Wichtige Unterschiede zwischen überwachtem und unüberwachtem Lernen#
Der Unterschied zwischen überwachtem und unüberwachtem Lernen hängt davon ab, wie ein Modell lernt und was es erreichen soll. Während sich überwachtes Lernen auf annotierte Daten und klare Vorgaben stützt, um bestimmte Aufgaben zu erlernen, funktioniert unüberwachtes Lernen ohne vordefinierte Antworten und konzentriert sich darauf, Muster und Strukturen in den Daten zu entdecken.
Beispielsweise kann ein Modell für überwachtes Lernen in einem System zur Verkehrsüberwachung mit annotierten Bildern trainiert werden, um Fahrzeuge, Fußgänger oder Verkehrssignale zu erkennen. Ein unüberwachtes Modell könnte dagegen große Mengen an Videomaterial analysieren, um ähnliche Verkehrsmuster zu gruppieren oder ungewöhnliche Ereignisse wie unerwartete Verkehrsstaus oder abnormale Bewegungen zu erkennen, ohne dass ihm ausdrücklich vorgegeben wird, wonach es suchen soll.
Wann du überwachtes Lernen in der Computer Vision einsetzen solltest#
Überwachtes Lernen eignet sich hervorragend für Computer-Vision-Aufgaben mit einem klar definierten Ziel, bei denen das Modell Eingabedaten auf genaue Ausgaben abbilden muss. Es funktioniert besonders gut, wenn du über einen zuverlässigen annotierten Datensatz verfügst und konsistente, vorhersehbare Ergebnisse benötigst.

Abb. 3. Computer-Vision-Aufgaben, die durch überwachtes Lernen gesteuert werden (Quelle)
Es wird häufig für Probleme eingesetzt, bei denen das Modell zwischen bekannten Kategorien unterscheiden oder bestimmte Ergebnisse vorhersagen muss. Anstatt Muster zu untersuchen, liegt der Fokus darauf, präzise Beziehungen aus annotierten Daten zu erlernen. Dadurch lässt sich das Modell leichter zu einem gewünschten Ergebnis führen.
Ein weiterer wichtiger Vorteil ist die Kontrolle. Beim überwachten Lernen lassen sich die Leistung mithilfe eindeutiger Metriken messen, das Modell feinabstimmen und ein stabiles Verhalten während der Bereitstellung sicherstellen. Das macht diesen Ansatz ideal für Systeme, die langfristig Konsistenz und Zuverlässigkeit erfordern.
Dies bringt jedoch einen Nachteil mit sich. Das Modell hängt stark von der Qualität und dem Umfang der annotierten Daten ab, deren Erfassung und Annotation zeitaufwendig sein kann.
Praxisbeispiele für überwachtes Lernen in der Computer Vision#
Vision-AI-Modelle wie Ultralytics-YOLO-Modelle nutzen überwachtes Lernen, um Aufgaben wie die Objekterkennung mit hoher Genauigkeit auszuführen, insbesondere in Echtzeitanwendungen. Hier sind einige gängige Praxisanwendungen von Vision, bei denen überwachtes Lernen einen Unterschied macht:
- Gesundheitswesen und medizinische Bildgebung: Ärzte können Computer-Vision-Systeme verwenden, die mit annotierten Aufnahmen wie Röntgenbildern oder MRTs trainiert wurden und Klassifikatoren einsetzen, um Erkrankungen wie Tumoren oder Frakturen zu erkennen. Das unterstützt schnellere und genauere Diagnosen.
- Industrielle Qualitätsprüfung: In Fertigungsumgebungen können mit annotierten Daten trainierte Vision-Systeme Produkte prüfen, indem sie verschiedene qualitätsrelevante Merkmale wie Form, Oberflächenfehler, Textur und Größe analysieren. Indem sie aus Beispielen akzeptabler und fehlerhafter Produkte lernen, können diese Systeme Fehler konsistent erkennen und Produktionsstandards einhalten.
- Autonomes Fahren: Systeme für autonomes Fahren stützen sich auf Modelle, die mit annotierten Fahrdaten trainiert wurden, um Fahrspuren, Fahrzeuge, Fußgänger und Verkehrsschilder zu erkennen und Fahrzeugen so eine sichere Navigation in Echtzeit zu ermöglichen.
- Einzelhandel und Kassensysteme: Geschäfte verwenden Modelle, die mit annotierten Produktbildern trainiert wurden, um Artikel in Regalen oder an der Kasse zu erkennen. Dadurch werden automatisierte Abrechnungen und eine effizientere Bestandsverwaltung ermöglicht. In Kombination mit zusätzlichen Daten können diese Systeme auch Aufgaben wie die Kundensegmentierung unterstützen und Unternehmen helfen, Einkaufsmuster besser zu verstehen.
- Landwirtschaft und Überwachung von Nutzpflanzen: Landwirte können mit annotierten Bildern trainierte Modelle verwenden, um Nutzpflanzen zu erkennen und zu klassifizieren, etwa um gesunde und beschädigte Kartoffeln zu identifizieren und zu zählen. Das verbessert die Qualitätskontrolle und reduziert Verluste.

Abb. 4. YOLO zur Erkennung und Zählung gesunder und fehlerhafter Kartoffeln verwenden
Welche Computer-Vision-Probleme kann unüberwachtes Lernen lösen?#
Unüberwachtes Lernen ist nützlich, wenn du nicht über genügend annotierte Daten verfügst oder deine Daten keine eindeutigen Antworten enthalten. In solchen Situationen besteht das Ziel nicht darin, exakte Vorhersagen zu treffen, sondern Muster und Strukturen in den Daten zu verstehen.
Es wird häufig eingesetzt, wenn ein nicht annotierter Datensatz zum ersten Mal untersucht wird. Anstatt dem Modell vorzugeben, wonach es suchen soll, lässt du es selbstständig Ähnlichkeiten erkennen, verwandte Bilder gruppieren oder ungewöhnliche Muster hervorheben.
Bei einer großen Bildsammlung kann ein unüberwachter Ansatz dabei helfen, ähnliche Bilder zusammenzufassen oder Ausreißer zu markieren, die weitere Aufmerksamkeit erfordern. Das macht ihn zu einem nützlichen Ausgangspunkt für Data-Science-Projekte.
Generative Modelle, darunter GANs, Variational Autoencoders und Diffusionsmodelle, lernen die zugrunde liegende Verteilung von Bildern, um vollständig neue Bilder zu erzeugen. Diese Modelle ermöglichen Anwendungen wie Bildsynthese, Inpainting, Super-Resolution und Stilübertragung und bilden das Rückgrat der heutigen generativen AI-Systeme.
Bei der unüberwachten Segmentierung gruppieren einige Verfahren Pixel oder Regionen zu zusammenhängenden Segmenten, ohne sich auf annotierte Masken zu stützen. Das ist nützlich, wenn die Annotation zu kostspielig ist oder wenn es darum geht, Strukturen zu entdecken, anstatt vordefinierte Kategorien nachzubilden.
Unüberwachtes Lernen ist auch bei der Arbeit mit großen Datensätzen von großer Bedeutung, wenn deren Annotation zeitaufwendig oder nicht praktikabel ist. In solchen Fällen kannst du Erkenntnisse aus den Daten gewinnen, ohne auf annotierte Trainingsdaten angewiesen zu sein.
Es wird außerdem häufig in Bereichen wie generativer AI (Modelle, die neue Daten wie Bilder, Text oder Audio erzeugen) und Repräsentationslernen (Modelle, die nützliche Merkmale oder Muster aus Rohdaten lernen) eingesetzt, in denen Modelle allgemeine Merkmale aus großen Datenmengen lernen. Wenn dein Problem insgesamt die Untersuchung, die Entdeckung von Mustern oder die Arbeit mit nicht annotierten Daten umfasst, ist unüberwachtes Lernen ein flexibler und praktischer Ansatz, den du in Betracht ziehen solltest.
Praxisbeispiele für unüberwachtes Lernen in der Computer Vision#
Hier sind einige Beispiele für Anwendungsfälle, in denen unüberwachtes Lernen in der Computer Vision eingesetzt wird:
- Anomalieerkennung in der Fertigung: Modelle können lernen, wie normale Produkte aussehen, und Fehler oder Unregelmäßigkeiten erkennen, ohne annotierte Beispiele für jeden möglichen Fehler zu benötigen.
- Bildorganisation und -suche: Große Bildsammlungen wie Fotobibliotheken oder E-Commerce-Kataloge können automatisch anhand visueller Ähnlichkeiten gruppiert werden. Dadurch wird es für Data Scientists einfacher, große Datensätze zu organisieren, zu untersuchen und zu durchsuchen.
- Überwachung und Sicherheit: Systeme können Videomaterial analysieren, um ungewöhnliche Muster oder Verhaltensweisen wie unerwartete Bewegungen oder Veränderungen in Menschenmengen zu erkennen, ohne ausdrücklich mit annotierten Ereignissen trainiert worden zu sein.
- Vorverarbeitung und Datenuntersuchung: Unüberwachte Methoden werden häufig eingesetzt, um Rohbilddaten vor dem Training überwachter Modelle zu untersuchen und zu strukturieren. Das trägt dazu bei, die Datenqualität zu verbessern und den manuellen Aufwand zu reduzieren.
Praktische Einschränkungen des überwachten und unüberwachten Lernens#
Trotz der Vorteile beider Lernansätze gibt es bestimmte Einschränkungen, die du berücksichtigen solltest. Beim Entwickeln von Computer-Vision-Modellen solltest du die folgenden praktischen Faktoren im Blick behalten:
- Überanpassung bei überwachten Modellen: Beim überwachten Lernen kann ein Modell die Trainingsdaten zu genau erlernen, anstatt allgemeine Muster zu erfassen. Das geschieht häufig, wenn der Datensatz klein oder nicht vielfältig genug ist. Beispielsweise kann ein Modell, das zur Erkennung von Fehlern bei einer Produktart trainiert wurde, versagen, wenn es mit neuen Daten getestet wird, die leicht abweichende Produkte oder Lichtverhältnisse enthalten.
- Herausforderungen bei Clustering-Algorithmen: Beim unüberwachten Lernen kann ein Modell ähnliche Datenpunkte gruppieren. Dieser Ansatz kann jedoch scheitern, wenn die Daten verrauscht oder uneinheitlich sind oder keine klare Struktur aufweisen. Bei Aufgaben zur Bildgruppierung könnten beispielsweise Bilder mit ähnlichen Farben, aber unterschiedlichen Objekten fälschlicherweise zusammen gruppiert werden.
- Bedeutung der richtigen Vorverarbeitung: Vor dem Training müssen Daten bereinigt und vorbereitet werden. Dies geschieht typischerweise mithilfe von Python-Bibliotheken, die Bildverarbeitung und Datentransformation übernehmen. Das ist besonders in der Computer Vision wichtig, da sich Bilder in Größe, Qualität oder Beleuchtung unterscheiden können. Ohne geeignete Vorverarbeitung lernen Modelle möglicherweise Rauschen statt aussagekräftiger Muster, was zu einer schlechten Leistung führt.
Wichtige Erkenntnisse#
In der Computer Vision spielen sowohl überwachtes als auch unüberwachtes Lernen wichtige Rollen. Der richtige Ansatz hängt von der Art deiner Daten ab, also davon, ob sie annotiert oder nicht annotiert sind, sowie von dem Problem, das du lösen möchtest, und deinen Anforderungen an die Bereitstellung.
Wenn dein Ziel eine hohe Genauigkeit und klar definierte Ausgaben sind, ist überwachtes Machine Learning häufig die bessere Wahl. Wenn du Daten untersuchst oder ohne Labels arbeitest, kann unüberwachtes Lernen besser geeignet sein.
Möchtest du mehr über AI erfahren? Besuche unsere Community und unser GitHub-Repository. Erfahre auf unseren Lösungsseiten mehr über AI in der Robotik und Computer Vision in der Landwirtschaft. Entdecke unsere Lizenzierungsoptionen und beginne noch heute mit der Entwicklung von Computer-Vision-Anwendungen!






