Ultralytics YOLO27:
Vision-KI

Arten von KI-Lernverfahren für Computer Vision

Entdecke die verschiedenen Arten des maschinellen Lernens und der Deep-Learning-Verfahren, die in Computer-Vision-Anwendungen eingesetzt werden – vom überwachten Lernen bis zum Transferlernen.

ABAbirami Vina9 min read
Arten von KI-Lernverfahren für Computer Vision

Maschinelles Lernen ist eine Form der künstlichen Intelligenz (AI), die Computern hilft, aus Daten zu lernen, damit sie eigenständig Entscheidungen treffen können, ohne dass für jede Aufgabe eine detaillierte Programmierung erforderlich ist. Dazu werden algorithmische Modelle erstellt, die Muster in Daten erkennen können. Indem diese Algorithmen Muster in Daten erkennen und daraus lernen, können sie ihre Leistung mit der Zeit schrittweise verbessern.

Ein Bereich, in dem maschinelles Lernen eine entscheidende Rolle spielt, ist Computer Vision, ein Teilgebiet der KI, das sich auf visuelle Daten konzentriert. Computer Vision nutzt maschinelles Lernen, damit Computer Muster in Bildern und Videos erkennen und identifizieren können. Aufgrund der Fortschritte beim maschinellen Lernen wird der weltweite Marktwert von Computer Vision bis 2032 voraussichtlich etwa 175,72 Milliarden US-Dollar erreichen.

In diesem Artikel sehen wir uns die verschiedenen Arten des maschinellen Lernens an, die in Computer Vision eingesetzt werden, darunter überwachtes, unüberwachtes, bestärkendes und Transferlernen, und betrachten, welche Rolle sie in verschiedenen Anwendungen spielen. Legen wir los!

Überblick über maschinelles Lernen in Computer Vision#

Computer Vision stützt sich auf maschinelles Lernen, insbesondere auf Verfahren wie Deep Learning und neuronale Netze, um visuelle Informationen zu interpretieren und zu analysieren. Diese Methoden ermöglichen es Computern, Computer-Vision-Aufgaben wie die Objekterkennung in Bildern, die Klassifizierung von Bildern nach Kategorien und die Gesichtserkennung auszuführen. Maschinelles Lernen ist außerdem für Echtzeit-Computer-Vision-Anwendungen wie die Qualitätskontrolle in der Fertigung und die medizinische Bildgebung im Gesundheitswesen unverzichtbar. In diesen Fällen helfen neuronale Netze Computern, komplexe visuelle Daten zu interpretieren, etwa bei der Analyse von Gehirnscans, um Tumoren zu erkennen.

Tatsächlich basieren viele fortschrittliche Computer-Vision-Modelle wie Ultralytics YOLO11 auf neuronalen Netzen.

Segmentierung von Gehirnscans mit Ultralytics YOLO11

Abb. 1: Segmentierung von Gehirnscans mit Ultralytics YOLO11.

Es gibt verschiedene Lernverfahren im maschinellen Lernen, etwa überwachtes Lernen, unüberwachtes Lernen, Transferlernen und bestärkendes Lernen, die die Grenzen des Machbaren in Computer Vision erweitern. In den folgenden Abschnitten sehen wir uns diese Verfahren einzeln an, um zu verstehen, wie sie zu Computer Vision beitragen.

Überwachtes Lernen im Detail#

Überwachtes Lernen ist die am häufigsten verwendete Form des maschinellen Lernens. Beim überwachten Lernen werden Modelle anhand von markierten Daten trainiert. Jeder Eingabe ist die korrekte Ausgabe zugeordnet, wodurch das Modell lernen kann. Ähnlich wie ein Schüler beim Lernen von einer Lehrkraft dienen diese markierten Daten als Orientierung oder Anleitung.

Während des Trainings erhält das Modell sowohl Eingabedaten (die zu verarbeitenden Informationen) als auch Ausgabedaten (die korrekten Antworten). Dadurch kann das Modell den Zusammenhang zwischen Ein- und Ausgaben lernen. Das Hauptziel des überwachten Lernens besteht darin, dass das Modell eine Regel oder ein Muster entdeckt, das jede Eingabe zuverlässig mit der korrekten Ausgabe verknüpft. Mithilfe dieser Zuordnung kann das Modell bei neuen Daten genaue Vorhersagen treffen. So basiert beispielsweise die Gesichtserkennung in Computer Vision auf überwachtem Lernen, um Gesichter anhand dieser erlernten Muster zu identifizieren.

Eine häufige Anwendung ist das Entsperren deines Smartphones per Gesichtserkennung. Das Modell wird anhand markierter Bilder deines Gesichts trainiert. Wenn du dein Telefon entsperren möchtest, vergleicht es das Livebild mit dem, was es gelernt hat. Erkennt es eine Übereinstimmung, wird dein Telefon entsperrt.

Gesichtserkennung zum Entsperren deines Smartphones

Abb. 2: Gesichtserkennung kann zum Entsperren deines Smartphones verwendet werden.

Wie funktioniert unüberwachtes Lernen in der KI?#

Unüberwachtes Lernen ist eine Form des maschinellen Lernens, die nicht markierte Daten verwendet – das Modell erhält während des Trainings weder Anleitungen noch korrekte Antworten. Stattdessen lernt es, selbstständig Muster und Erkenntnisse zu entdecken.

Unüberwachtes Lernen erkennt Muster mithilfe von drei Hauptverfahren:

  • Clustering: Gruppiert ähnliche Datenpunkte. Das ist für Aufgaben wie die Kundensegmentierung nützlich, bei der ähnliche Kunden anhand ihres Verhaltens oder ihrer Merkmale gruppiert werden können.
  • Assoziation: Dient dazu, Beziehungen zwischen Elementen zu erkennen und Zusammenhänge in den Daten aufzudecken, etwa Produkte zu finden, die bei der Warenkorbanalyse häufig zusammen gekauft werden.
  • Dimensionsreduktion: Vereinfacht Datensätze durch das Entfernen redundanter Merkmale, was die Visualisierung und Verarbeitung erleichtert.

Eine wichtige Anwendung des unüberwachten Lernens ist die Bildkomprimierung, bei der Verfahren wie das K-Means-Clustering die Bildgröße reduzieren, ohne die visuelle Qualität zu beeinträchtigen. Pixel werden zu Clustern zusammengefasst, und jedes Cluster wird durch eine durchschnittliche Farbe dargestellt. So entsteht ein Bild mit weniger Farben und einer kleineren Dateigröße.

Ein Beispiel für unüberwachte Bildkomprimierung

Abb. 3: Ein Beispiel für unüberwachte Bildkomprimierung.

Unüberwachtes Lernen hat jedoch auch gewisse Einschränkungen. Ohne vorgegebene Antworten kann es bei der Genauigkeit und Bewertung der Leistung zu Schwierigkeiten kommen. Häufig ist manueller Aufwand erforderlich, um Ergebnisse zu interpretieren und Gruppen zu kennzeichnen. Außerdem reagiert das Verfahren empfindlich auf Probleme wie fehlende Werte und Rauschen, die die Qualität der Ergebnisse beeinträchtigen können.

Bestärkendes Lernen erklärt#

Im Gegensatz zum überwachten und unüberwachten Lernen ist bestärkendes Lernen nicht auf Trainingsdaten angewiesen. Stattdessen nutzt es Agenten auf Basis neuronaler Netze, die mit einer Umgebung interagieren, um ein bestimmtes Ziel zu erreichen.

Der Prozess umfasst drei Hauptkomponenten:

  • Agent: Die lernende oder entscheidende Instanz.
  • Umgebung: Alles, womit der Agent interagiert, unabhängig davon, ob es real oder virtuell ist.
  • Belohnungssignal: Ein numerischer Wert, der nach jeder Aktion vergeben wird und den Agenten zum Ziel führt.

Wenn der Agent Aktionen ausführt, beeinflusst er die Umgebung, die daraufhin mit Feedback reagiert. Dieses Feedback hilft dem Agenten, seine Entscheidungen zu bewerten und sein Verhalten anzupassen. Das Belohnungssignal hilft dem Agenten zu verstehen, welche Aktionen ihn dem Erreichen seines Ziels näherbringen.

Bestärkendes Lernen ist entscheidend für Anwendungsfälle wie autonomes Fahren und Robotik. Beim autonomen Fahren lernen Aufgaben wie die Fahrzeugsteuerung sowie die Objekterkennung und -vermeidung auf Grundlage von Feedback. Modelle werden mithilfe von Agenten auf Basis neuronaler Netze trainiert, um Fußgänger oder andere Objekte zu erkennen und geeignete Maßnahmen zur Vermeidung von Kollisionen zu ergreifen. In der Robotik ermöglicht bestärkendes Lernen beispielsweise die Objektmanipulation und Bewegungssteuerung.

Ein hervorragendes Beispiel für bestärkendes Lernen in der Praxis ist ein Projekt von OpenAI, bei dem Forschende KI-Agenten trainierten, das beliebte Mehrspieler-Videospiel Dota 2 zu spielen. Mithilfe neuronaler Netze verarbeiteten diese Agenten riesige Informationsmengen aus der Spielumgebung, um schnelle strategische Entscheidungen zu treffen. Durch kontinuierliches Feedback lernten und verbesserten sich die Agenten mit der Zeit und erreichten schließlich ein Leistungsniveau, das hoch genug war, um einige der besten Spieler des Spiels zu besiegen.

Menschliche und KI-Interpretation der Dota-Matrix

Abb. 4: Menschliche und KI-Interpretation der Dota-Matrix.

Die Grundlagen des Transferlernens verstehen#

Transferlernen unterscheidet sich von anderen Lernformen. Statt ein Modell von Grund auf zu trainieren, wird ein auf einem großen Datensatz vortrainiertes Modell für eine neue, aber verwandte Aufgabe feinabgestimmt. Das während des ursprünglichen Trainings erworbene Wissen wird genutzt, um die Leistung bei der neuen Aufgabe zu verbessern. Transferlernen reduziert je nach Komplexität der neuen Aufgabe die dafür erforderliche Trainingszeit. Dabei bleiben die anfänglichen Modellschichten erhalten, die allgemeine Merkmale erfassen, während die letzten Schichten durch Schichten für die spezifische neue Aufgabe ersetzt werden.

Die Übertragung künstlerischer Stile ist eine interessante Anwendung des Transferlernens in Computer Vision. Mit diesem Verfahren kann ein Modell ein Bild so umwandeln, dass es dem Stil verschiedener Kunstwerke entspricht. Dafür wird zunächst ein neuronales Netz mit einem großen Datensatz von Bildern trainiert, die ihren jeweiligen künstlerischen Stilen zugeordnet sind. Dabei lernt das Modell, allgemeine Bildmerkmale und Stilstrukturen zu erkennen.

Nach dem Training kann das Modell feinabgestimmt werden, um den Stil eines bestimmten Gemäldes auf ein neues Bild anzuwenden. Das Netz passt sich an das neue Bild an und bewahrt zugleich die erlernten Stilmerkmale. So kann es ein einzigartiges Ergebnis erzeugen, das den ursprünglichen Inhalt mit dem ausgewählten künstlerischen Stil verbindet. Du könntest beispielsweise ein Foto einer Bergkette nehmen und den Stil von Edvard Munchs Der Schrei anwenden. Das Ergebnis würde die Szene darstellen, jedoch im ausdrucksstarken, markanten Stil des Gemäldes.

Ein Beispiel für die Übertragung eines künstlerischen Stils mithilfe von Transferlernen

Abb. 5: Ein Beispiel für die Übertragung eines künstlerischen Stils mithilfe von Transferlernen.

Die Unterschiede zwischen den Arten des maschinellen Lernens#

Nachdem wir die wichtigsten Arten des maschinellen Lernens behandelt haben, sehen wir uns nun jede einzelne genauer an, damit du die passende Methode für verschiedene Anwendungen bestimmen kannst.

  • Überwachtes Lernen: Dieses Verfahren ist bei markierten Daten sehr genau, erfordert jedoch große Datenmengen und kann empfindlich auf Rauschen reagieren.
  • Unüberwachtes Lernen: Es eignet sich zur Untersuchung nicht markierter Daten, um verborgene Muster zu finden, wobei die Ergebnisse möglicherweise weniger präzise und schwieriger zu interpretieren sind.
  • Bestärkendes Lernen: Es trainiert Agenten darauf, in komplexen Umgebungen schrittweise Entscheidungen zu treffen, erfordert jedoch häufig erhebliche Rechenleistung.
  • Transferlernen: Dieser Ansatz nutzt vortrainierte Modelle, um das Training zu beschleunigen und die Leistung bei neuen Aufgaben zu verbessern, insbesondere wenn nur wenige Daten verfügbar sind.

Ein Vergleich aller Arten des maschinellen Lernens

Abb. 6: Ein Vergleich aller Arten des maschinellen Lernens. Bild vom Autor.

Die Wahl der passenden Art des maschinellen Lernens hängt von mehreren Faktoren ab. Überwachtes Lernen eignet sich gut, wenn du viele markierte Daten und eine klar definierte Aufgabe hast. Unüberwachtes Lernen ist nützlich zur Datenexploration oder wenn nur wenige markierte Beispiele verfügbar sind. Bestärkendes Lernen ist ideal für komplexe Aufgaben, die schrittweise Entscheidungen erfordern, während Transferlernen eine gute Wahl ist, wenn die Datenmenge begrenzt oder die verfügbaren Ressourcen eingeschränkt sind. Wenn du diese Faktoren berücksichtigst, kannst du den am besten geeigneten Ansatz für dein Computer-Vision-Projekt auswählen.

Zum Abschluss#

Verfahren des maschinellen Lernens können verschiedenste Herausforderungen bewältigen, insbesondere in Bereichen wie Computer Vision. Wenn du die verschiedenen Arten – überwachtes, unüberwachtes, bestärkendes und Transferlernen – verstehst, kannst du den besten Ansatz für deine Anforderungen auswählen.

Überwachtes Lernen eignet sich hervorragend für Aufgaben, die hohe Genauigkeit und markierte Daten erfordern, während unüberwachtes Lernen ideal ist, um Muster in nicht markierten Daten zu finden. Bestärkendes Lernen funktioniert gut in komplexen, entscheidungsbasierten Umgebungen, und Transferlernen ist hilfreich, wenn du mit begrenzten Daten auf vortrainierten Modellen aufbauen möchtest.

Jedes Verfahren hat einzigartige Stärken und Anwendungsbereiche – von der Gesichtserkennung über die Robotik bis hin zur Übertragung künstlerischer Stile. Die Wahl des passenden Verfahrens kann in Branchen wie Gesundheitswesen, Automobilindustrie und Unterhaltung neue Möglichkeiten eröffnen.

Weitere Informationen findest du in unserem GitHub-Repository und in unserer Community. Entdecke auf unseren Lösungsseiten Anwendungen von KI in selbstfahrenden Autos und in der Landwirtschaft. 🚀

Explore solutions

Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren
Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren
Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren

Lass uns gemeinsam die Zukunft der KI gestalten!

Beginne deine Reise in die Zukunft des maschinellen Lernens