Active Learning beschleunigt die Entwicklung von Computer Vision
Erfahre, wie Active Learning in Computer Vision eingesetzt wird, um den Aufwand für Annotationen zu minimieren, und entdecke seine praktischen Anwendungen in verschiedenen Branchen.

Das Training eines Computer-Vision-Modells ist vergleichbar damit, einem Kind beizubringen, Farben zu erkennen. Zuerst bräuchtest du eine Sammlung farbiger Gegenstände. Anschließend würdest du das Kind dabei anleiten, jede Farbe richtig zu identifizieren – eine Aufgabe, die häufig sowohl zeitaufwendig als auch eintönig ist.
So wie ein Kind viele Beispiele zum Lernen benötigt, braucht ein Vision-Modell eine große Menge gelabelter Daten, um Muster und Objekte in Bildern zu erkennen. Das Labeln großer Datenmengen erfordert jedoch viel Zeit und Aufwand, ganz zu schweigen von den benötigten Ressourcen. Techniken wie Active Learning können dabei helfen, diesen Prozess zu vereinfachen.
Active Learning ist ein schrittweiser Prozess, bei dem die wichtigsten Daten aus einem großen Datensatz ausgewählt und gelabelt werden. Das Modell lernt aus diesen gelabelten Daten und wird dadurch genauer und leistungsfähiger. Indem nur die wertvollsten Daten berücksichtigt werden, verringert sich der erforderliche Labelaufwand und die Entwicklung des Modells wird beschleunigt.
In diesem Artikel sehen wir uns an, wie Active Learning das Modelltraining unterstützt, Labelkosten senkt und die allgemeine Genauigkeit des Modells verbessert.
Bilddatensätze sind nicht einfach zu erstellen#
Datensätze bilden die Grundlage für Computer Vision und Deep-Learning-Modelle. Beliebte Datensätze wie ImageNet bieten Millionen von Bildern mit vielfältigen Objektkategorien. Die Erstellung und Pflege solch großer Mengen an hochwertigen Datensätzen bringt jedoch verschiedene Herausforderungen mit sich.
Das Erfassen und Labeln von Daten erfordert beispielsweise Zeit, Ressourcen und erfahrene Annotatoren. Dadurch wird der Prozess je nach konkreter Anwendung anspruchsvoll. Innovative und effizientere Lösungen sind erforderlich, um mit der steigenden Nachfrage nach Bilddatensätzen Schritt zu halten – genau dieses Problem soll Active Learning lösen.
Active Learning bietet eine optimale Lösung, indem es den Prozess der Datenannotation optimiert. Durch die gezielte Auswahl der aussagekräftigsten Datenpunkte für die Annotation maximiert Active Learning die Modellleistung und minimiert gleichzeitig den Labelaufwand.
Was ist Active Learning?#
Active Learning ist eine iterative Machine-Learning-Technik, bei der das Modell aus einer großen Menge ungelabelter Daten die wichtigsten Datenpunkte zum Labeln auswählt. Diese ausgewählten Datenpunkte werden manuell gelabelt und dem Trainingsdatensatz hinzugefügt.
Anschließend wird das Modell mit dem aktualisierten Datensatz neu trainiert und wählt die nächste Gruppe zu labelnder Datenpunkte aus. Dieser Prozess wiederholt sich, wobei sich das Modell kontinuierlich verbessert, indem es sich auf die aussagekräftigsten Datenpunkte konzentriert. Der Zyklus wird fortgesetzt, bis das Modell entweder die gewünschte Genauigkeit erreicht oder die zuvor festgelegten Kriterien für das Labeln erfüllt.

Abb. 1 Eine Übersicht über Active Learning.
So funktioniert Active Learning#
Vielleicht fragst du dich, wie die Active-Learning-Technik entscheidet, welche Datenpunkte manuell gelabelt werden müssen und welche als Nächstes gelabelt werden sollen. Sehen wir uns die Funktionsweise von Active Learning anhand eines Vergleichs mit der Prüfungsvorbereitung an: Du konzentrierst dich auf Themen, bei denen du unsicher bist, und stellst gleichzeitig sicher, dass du eine Vielzahl von Themen abdeckst, um gut vorbereitet zu sein.
Für die anfängliche Auswahl der Daten verwendet Active Learning Strategien wie Uncertainty Sampling und auf Vielfalt basierendes Sampling. Uncertainty Sampling priorisiert Datenpunkte, bei denen das Modell am wenigsten Vertrauen in seine Vorhersagen hat, mit dem Ziel, die Genauigkeit in schwierigen Fällen zu verbessern. Beim auf Vielfalt basierenden Sampling werden Datenpunkte ausgewählt, die ein breites Spektrum an Merkmalen abdecken. So kann das Modell gut auf unbekannte Daten generalisieren, da es mit vielfältigen Beispielen konfrontiert wird.

Abb. 2 Uncertainty Sampling (links) und auf Vielfalt basierendes Sampling (rechts).
Nach der anfänglichen Datenauswahl verwendet Active Learning zwei Hauptansätze für das Labeln: Pool-basiertes Sampling und Stream-basiertes Sampling. Sie ähneln der Art und Weise, wie eine Lehrkraft einem Schüler hilft, sich auf das Wichtigste zu konzentrieren.
Beim Pool-basierten Sampling durchsucht das Modell eine große Menge ungelabelter Daten und wählt die schwierigsten oder aussagekräftigsten Beispiele zum Labeln aus – ähnlich wie ein Schüler die Lernkarten priorisiert, die er am schwierigsten findet. Beim Stream-basierten Sampling verarbeitet das Modell die Daten, sobald sie eintreffen, und entscheidet, ob sie gelabelt oder übersprungen werden – vergleichbar mit einem Schüler, der nur dann um Hilfe bittet, wenn er nicht weiterkommt. In beiden Fällen werden die gelabelten Daten dem Trainingssatz hinzugefügt und das Modell trainiert sich selbst neu, sodass es sich mit jeder Iteration stetig verbessert.
Anwendungen von Active Learning#
Active Learning spielt eine wichtige Rolle bei Computer-Vision-Anwendungen wie medizinischer Bildgebung und autonomem Fahren, da es die Modellgenauigkeit verbessert und den Prozess der Datenannotation optimiert. Ein interessantes Beispiel sind Computer-Vision-Modelle, die in selbstfahrenden Autos eingesetzt werden, um Fußgänger oder Objekte bei schlechten Lichtverhältnissen oder Nebel zu erkennen. Active Learning kann die Genauigkeit verbessern, indem es sich auf vielfältige und anspruchsvolle Fahrsituationen konzentriert.
Konkret kann Active Learning verwendet werden, um unsichere Daten oder Einzelbilder aus solchen Situationen für eine gezielte Annotation zu identifizieren. Werden diese gelabelten Beispiele dem Trainingssatz hinzugefügt, kann das Modell Fußgänger und Objekte in schwierigen Umgebungen besser erkennen, etwa bei schlechtem Wetter oder während Nachtfahrten.
NVIDIA hat Active Learning beispielsweise eingesetzt, um die Erkennung von Fußgängern bei Nacht in seinen Modellen für autonomes Fahren zu verbessern. Durch die gezielte Auswahl der aussagekräftigsten Trainingsdaten, insbesondere in anspruchsvollen Situationen, steigt die Modellleistung deutlich.

Abb. 3 Erkennung eines Fußgängers mit einem Regenschirm mithilfe von Active Learning.
Active Learning kann Labelkosten senken#
Ein weiterer wichtiger Aspekt von Active Learning ist das Potenzial zur Senkung der Labelkosten. Dafür konzentriert es sich nur auf die wichtigsten Datenpunkte, anstatt Annotationen für den gesamten Datensatz zu erfordern. Dieser gezielte Ansatz spart Zeit, Aufwand und Geld. Indem Active Learning den Fokus auf unsichere oder vielfältige Stichproben richtet, verringert es die Anzahl der benötigten Annotationen und erhält gleichzeitig eine hohe Modellgenauigkeit.
Forschungen zeigen sogar, dass Active Learning die Labelkosten senken kann, und zwar um 40–60 %, ohne die Leistung zu beeinträchtigen. Das ist besonders hilfreich in Branchen wie dem Gesundheitswesen und der Fertigung, in denen das Labeln von Daten teuer ist. Durch die Vereinfachung des Annotationsprozesses hilft Active Learning Unternehmen, Modelle schneller zu entwickeln und effizienter bereitzustellen, während die Genauigkeit erhalten bleibt.
Vorteile von Active Learning#
Hier sind einige weitere wichtige Vorteile von Active Learning:
- Klassenungleichgewicht ausgleichen: Active Learning kann dabei helfen, Probleme mit dem Klassenungleichgewicht zu beheben, indem Instanzen aus Minderheitsklassen gelabelt werden. Das Modell kann bei seltenen Szenarien mit begrenzten Daten bessere Ergebnisse erzielen.
- Schnellere Entwicklungszyklen: Das Labeln von weniger Daten beschleunigt indirekt den Entwicklungsprozess von Machine-Learning- und Computer-Vision-Modellen und schafft mehr Zeit und Ressourcen für zusätzliche Iterationen und Experimente.
- Anpassungsfähigkeit: Durch wiederholte Verarbeitung unsicherer Stichproben oder Stichproben aus Sonderfällen können Trainingsdaten kontinuierlich verbessert werden. Dadurch eignet sich die Methode besonders für dynamische oder sich weiterentwickelnde Datensätze.
Active Learning und AutoML können zusammenarbeiten#
Automatisiertes maschinelles Lernen (AutoML) konzentriert sich auf die Automatisierung der zeitaufwendigen und iterativen Aufgaben, die beim Erstellen und Bereitstellen von Machine-Learning-Modellen anfallen. Es vereinfacht Machine-Learning-Workflows, indem es Aufgaben wie die Modellauswahl und Leistungsbewertung automatisiert und so den Bedarf an manueller Arbeit verringert.
In Kombination mit Active Learning kann AutoML den Lebenszyklus der Modellentwicklung beschleunigen und optimieren. Die Active-Learning-Komponente wählt gezielt die aussagekräftigsten Datenpunkte zum Labeln aus, während AutoML das Modell verbessert, indem es die Auswahl der Architektur, der Parameter und der Abstimmung automatisiert.

Abb. 4 AutoML-Workflow.
Sehen wir uns diese Kombination von Technologien anhand eines Beispiels an.
Nehmen wir an, du möchtest seltene Krankheitsbilder in der medizinischen Bildgebung erkennen – ein Anwendungsfall, bei dem gelabelte Datensätze nur begrenzt verfügbar und teuer zu beschaffen sind. Active Learning kann unsichere Daten identifizieren und auswählen, etwa subtile Veränderungen in Röntgenbildern, die das Modell nicht klassifizieren kann. Diese unsicheren Daten können anschließend für die manuelle Annotation priorisiert werden, um das Verständnis des Modells zu verbessern.
Mit den annotierten Daten kann AutoML das Modell optimieren, indem es verschiedene Architekturen, Hyperparameter und weitere Techniken zur Datenerweiterung untersucht. Der iterative Prozess beschleunigt die Entwicklung zuverlässiger Vision-Modelle wie Ultralytics YOLO11, die medizinisches Fachpersonal bei der Erstellung genauer Diagnosen unterstützen.
Herausforderungen von Active Learning#
Active Learning und seine Techniken bieten zahlreiche Vorteile. Bei der Umsetzung dieser Strategien solltest du jedoch einige Aspekte berücksichtigen:
- Auswahl der Abfragestrategie: Active Learning umfasst viele Techniken, und die Wahl der besten Methode wirkt sich erheblich auf die Effektivität des Modells aus. Eine ungeeignete Strategie kann die Modellleistung für eine bestimmte Anwendung verringern.
- Kosten des erneuten Trainings: Die iterative Natur von Active Learning erfordert erhebliche Rechenressourcen, insbesondere bei großen Datensätzen. Das Modell wird nach jeder Labelrunde neu trainiert, wodurch die Komplexität steigt.
- Qualität des Ausgangsmodells: Die Effektivität von Active Learning hängt von der Qualität des Ausgangsmodells ab. Ein schlecht leistungsfähiges Ausgangsmodell erkennt die aussagekräftigen Datenpunkte möglicherweise nicht zuverlässig, was zu unzureichenden Anfragen zum Labeln und einer geringeren Gesamtleistung führt.
Die Zukunft von Active Learning und AutoML#
Dank der jüngsten Fortschritte in AI und Computer Vision ist Active Learning auf dem Weg, komplexere Herausforderungen zu bewältigen und Machine-Learning-Workflows zu optimieren. Die Kombination von Active Learning mit Techniken wie föderiertem Lernen und selbstüberwachtem Lernen kann die Effizienz und Skalierbarkeit von Vision-Modellen weiter verbessern.
Föderiertes Lernen ermöglicht das Trainieren eines Modells auf mehreren Geräten oder Servern in einem verteilten Framework, ohne dass Daten ihren ursprünglichen Speicherort verlassen müssen. In Branchen wie dem Gesundheitswesen, in denen der Datenschutz wichtig ist, ermöglicht föderiertes Lernen das direkte Training mit sensiblen lokalen Daten, während diese geschützt bleiben. Statt Rohdaten werden nur Modellaktualisierungen oder Erkenntnisse geteilt. So bleiben private Informationen geschützt und können dennoch zum Trainingsprozess beitragen.
Selbstüberwachtes Lernen trägt unterdessen dazu bei, den Bedarf an gelabelten Daten zu verringern, indem Modelle mit ungelabelten Daten vortrainiert werden. Dieser Prozess schafft eine solide Grundlage für das Modell. Darauf aufbauend kann Active Learning die wichtigsten Datenpunkte für die Annotation durch Menschen identifizieren und auswählen und das Modell so weiter verbessern.
Vom Active Learning zu konkreten Ergebnissen#
Active Learning bietet eine praktische Möglichkeit, zentrale Herausforderungen in Computer Vision zu bewältigen, etwa die hohen Kosten der Datenannotation und den Bedarf an genaueren Modellen. Indem nur die wertvollsten Datenpunkte gelabelt werden, verringert sich der erforderliche menschliche Aufwand und gleichzeitig steigt die Modellleistung.
In Kombination mit Technologien wie AutoML optimiert Active Learning die Modellentwicklung, indem es zeitaufwendige Aufgaben automatisiert. Mit den weiteren Fortschritten wird sich Active Learning voraussichtlich zu einem unverzichtbaren Werkzeug für die Entwicklung intelligenterer und effizienterer Computer-Vision-Systeme entwickeln.
Erkunde unser GitHub-Repository und werde Teil unserer Community, um mehr über AI und Computer-Vision-Modelle zu erfahren. Entdecke auf unseren Lösungsseiten weitere Anwendungsbereiche von Computer Vision in der Fertigung und im Gesundheitswesen. Du kannst dir auch unsere Lizenzoptionen ansehen und noch heute mit deiner Reise in die Vision AI beginnen.









