Ultralytics YOLO27:
Anleitungen

Was ist OpenPose? Ein Meilenstein der Posenschätzung im Überblick

Entdecke, wie OpenPose für die Posenschätzung in Computer-Vision-Anwendungen eingesetzt werden kann. Erfahre mehr über seine Funktionen und seine Bedeutung für Vision AI.

ABAbirami Vina8 min read
Posenschätzung für mehrere Personen mit OpenPose

Heutzutage sind Bilder und Kameras überall – in unseren Smartphones, Wohnungen und sogar im öffentlichen Raum. Wir nutzen sie nicht nur, um Momente festzuhalten, sondern auch, um die Welt um uns herum zu verstehen und mit ihr zu interagieren.

Hinter den Kulissen macht Computer Vision, ein Teilgebiet der künstlichen Intelligenz (AI), dies möglich, indem sie Maschinen befähigt, visuelle Daten zu interpretieren. Sie ermöglicht es Systemen, Objekte zu erkennen, Gesichter zu identifizieren und Bewegungen zu verfolgen, und spielt damit eine zentrale Rolle in vielen Technologien, die wir täglich nutzen.

Dank der jüngsten Fortschritte in der AI können Computer-Vision-Modelle heute komplexere Daten und Erkenntnisse analysieren und extrahieren. Ein Beispiel dafür ist die Posenschätzung, eine Computer-Vision-Aufgabe, die sich auf das Verständnis menschlicher Bewegungen konzentriert.

Dabei werden wichtige Punkte des Körpers, etwa Schultern, Ellenbogen und Knie, in Bildern oder Videos identifiziert. So lässt sich analysieren, wie sich Menschen bewegen, wodurch Anwendungen in der Fitnessüberwachung, Animation, Gesundheitsversorgung und vielen weiteren Bereichen möglich werden.

Unter den zahlreichen für die Posenschätzung entwickelten Werkzeugen sticht OpenPose als bedeutender Durchbruch hervor. Das von Forschern am Perceptual Computing Lab der Carnegie Mellon University entwickelte System war eines der ersten Open-Source-Systeme, das Ganzkörperposen mehrerer Personen in Echtzeit allein mit einer Kamera erkennen konnte, einschließlich Händen, Füßen und Gesichtsschlüsselpunkten (bis zu 135 Schlüsselpunkte pro Person).

In diesem Artikel sehen wir uns OpenPose, seine Funktionsweise und seine Bedeutung als Meilenstein der Computer Vision an.

Posenschätzung mehrerer Personen mit OpenPose

Abb. 1. Posenschätzung mehrerer Personen mit OpenPose.

Ein Blick auf die Geschichte der Posenschätzung#

Bevor sich AI weit verbreitete, wurde die Verfolgung menschlicher Bewegungen in Videos mit spezieller Ausrüstung durchgeführt. In Branchen wie Film und Animation trugen Schauspieler häufig Anzüge mit reflektierenden Markierungen, damit Kameras ihre Bewegungen in einer kontrollierten Studio-Umgebung erfassen konnten.

Obwohl diese markerbasierten Motion-Capture-Verfahren präzise waren, waren sie auch teuer und auf bestimmte Umgebungen beschränkt. Mit den Fortschritten der Computer Vision suchten Forscher nach Möglichkeiten, Körperbewegungen ohne Markierungen zu verfolgen. Dazu nutzten sie Kanten, Konturen und Vorlagen, um menschliche Formen in Bildern zu finden.

Diese frühen Systeme funktionierten in einfachen und überschaubaren Situationen, hatten aber Schwierigkeiten mit Szenarien aus der realen Welt. Häufig lieferten sie schlechte Ergebnisse, wenn sich Menschen unerwartet bewegten oder mehr als eine Person in einem Bildausschnitt zu sehen war.

Ende der 2010er-Jahre brachte Deep Learning einen bedeutenden Wandel für die Posenschätzung. Vision-AI-Modelle konnten mit großen Datensätzen menschlicher Posen trainiert werden. Statt sich auf Kanten und Vorlagen zu stützen, lernten die Modelle durch die Analyse Tausender annotierter Bilder, Körpergelenke und Körperstrukturen zu erkennen. Dadurch wurde die Posenschätzung in einem größeren Spektrum von Einsatzbereichen präziser, flexibler und leistungsfähiger.

Zeitachse der Modelle zur menschlichen Posenschätzung von 2017 bis 2023

Abb. 2. Die Entwicklung der Modelle zur menschlichen Posenschätzung von 2017 bis 2023.

OpenPose: Der Durchbruch der modernen Posenschätzung#

OpenPose wurde erstmals 2017 veröffentlicht und kann die Posen mehrerer Personen gleichzeitig in einem einzelnen Bild schätzen. Anders als ältere Systeme benötigt OpenPose keine speziellen Anzüge oder Markierungen. Es funktioniert mit Standardkameras und kann Bilder und Videos in Echtzeit verarbeiten. Diese Eigenschaften machten die Posenschätzung für Entwickler und Forscher zugänglicher.

Das Fundament, das OpenPose für die Computer Vision gelegt hat, half anderen dabei, neuere Architekturen für viele weitere Anwendungen zu entwickeln. Heute liefern Vision-AI-Modelle wie Ultralytics YOLOv8 und Ultralytics YOLO11, die Aufgaben der Posenschätzung unterstützen, schnellere Ergebnisse und geringere Latenzen.

Verwendung von Ultralytics YOLO11 für die Posenschätzung

Abb. 3. Verwendung von YOLO11 für die Posenschätzung.

Wenn du neugierig bist, wie sich die Posenschätzung entwickelt hat, ist OpenPose jedoch ein guter Ausgangspunkt. Das System führte wichtige Konzepte ein, auf denen auch heute noch viele neuere Systeme aufbauen.

Die wichtigsten Funktionen von OpenPose#

Nachdem wir nun besser verstehen, warum OpenPose wichtig ist, sehen wir uns genauer an, was das System tatsächlich leisten kann.

Im Zentrum der Funktionen von OpenPose steht die sogenannte Schlüsselpunkterkennung. Schlüsselpunkte sind bestimmte Orientierungspunkte am menschlichen Körper, etwa die Nasenspitze, die Mitte der Schultern sowie Ellenbogen, Handgelenke, Hüften, Knie und Knöchel. OpenPose kann bis zu 135 dieser Punkte pro Person erkennen, einschließlich detaillierter Bereiche wie Finger und Gesichtszüge.

Wenn diese Punkte miteinander verbunden werden, bilden sie eine vereinfachte Darstellung des menschlichen Körpers – du kannst sie dir als digitales Skelett vorstellen. Diese Skelet kontur zeigt nicht nur, wo sich eine Person befindet, sondern auch, welche Haltung sie einnimmt: ob sie sitzt, steht, winkt, lächelt oder geht. Mithilfe dieser Skelette können Computer menschliche Bewegungen visuell interpretieren, ähnlich wie wir intuitiv die Körpersprache anderer Menschen verstehen.

Die Skelettverfolgung ist besonders nützlich, weil sie Hintergrundrauschen und Ablenkungen ausblendet und das System dadurch ganz auf die Körperhaltung und Bewegung konzentrieren kann. Anstatt jedes Pixel zu analysieren, fokussiert sich OpenPose auf aussagekräftige Punkte, die zeigen, wie sich eine Person bewegt oder mit ihrer Umgebung interagiert.

Durch die Extraktion dieser strukturierten Informationen aus alltäglichen Bildern oder Videos ermöglicht OpenPose die Entwicklung von Anwendungen, die auf Gesten reagieren, körperliche Aktivitäten überwachen, emotionale Signale bewerten oder sogar digitale Figuren animieren.

Wie funktioniert OpenPose?#

Hier ist ein Überblick darüber, wie OpenPose Schlüsselpunkte des menschlichen Körpers aus visuellen Eingaben erkennt und miteinander verbindet:

  • Beginnt mit einem Bild: OpenPose übernimmt ein einzelnes Bild aus einem Foto, Video oder einem Live-Feed einer Kamera.
  • Erkennt wichtige Körperteile: Das System sucht nach Schlüsselpunkten am Körper, etwa Nase, Ellenbogen, Handgelenken, Knien und Knöcheln. Sie werden überall dort markiert, wo das System sicher ist, dass sich ein Körperteil befindet.
  • Ermittelt, welche Teile zusammengehören: Anschließend prüft OpenPose, wie die Schlüsselpunkte miteinander verbunden sind. Mithilfe mathematischer Berechnungen entscheidet das System, welche Gelenke zur selben Person gehören – beispielsweise, indem es ein Handgelenk dem rechten Ellenbogen und der rechten Schulter zuordnet.
  • Zeichnet für jede Person ein Skelett: Nachdem die Schlüsselpunkte gruppiert wurden, verbindet OpenPose sie zu einer „Strichfigur“, die die Pose jeder Person darstellt. Das funktioniert auch dann, wenn mehrere Personen im selben Bildausschnitt zu sehen sind.
  • Gibt die Posendaten zurück: Schließlich liefert das System die exakten Positionen aller erkannten Schlüsselpunkte. Diese können zur Bewegungsverfolgung, Gestenerkennung oder Entwicklung interaktiver Werkzeuge verwendet werden – alles in Echtzeit.

Erkennung und Verfolgung menschlicher Schlüsselpunkte mit OpenPose

Abb. 4. Erkennung und Verfolgung menschlicher Schlüsselpunkte mit OpenPose.

Anwendungen der Posenschätzung in verschiedenen Branchen mit OpenPose#

OpenPose war eines der ersten fortschrittlichen Werkzeuge, die die Posenschätzung für eine Vielzahl praxisnaher Anwendungsfälle nutzbar machten. Obwohl es heute nicht häufig in Echtzeit-Computer-Vision-Lösungen eingesetzt wird, spielte es eine wichtige Rolle bei der frühen Entwicklung in Bereichen wie Sport, Unterhaltung, Bildung und Sicherheit.

Sehen wir uns genauer an, wie OpenPose in diesen Bereichen den Weg bereitet hat.

Posenschätzung mit OpenPose für Fitness und Sport#

Wenn du Baseball schaust, ist es leicht zu verstehen, was passiert – du erkennst sofort einen Pitch, einen Schlag oder einen gestohlenen Base. Als Menschen lesen wir Körperbewegungen intuitiv und verstehen sie ohne großen Aufwand. Für Maschinen ist das Erkennen dieser Aktionen jedoch deutlich komplexer. Sie benötigen präzise Informationen darüber, wie sich jeder Körperteil im Raum bewegt.

OpenPose war in diesem Bereich der Computer Vision ein bedeutender Fortschritt. Es war ein praxisnahes Werkzeug zur Analyse sportlicher Bewegungsabläufe in verschiedenen Umgebungen.

Viele Forschungsprojekte nutzten OpenPose, um Bewegungen wie Schläge und Sprünge zu analysieren und sogar bestimmte Baseballaktionen anhand der Bewegungen der Spieler zu klassifizieren. Da das System in offenen Umgebungen mit Standardvideo funktionierte, konnten Forscher testen, wie solche Systeme in realen Trainings- oder Coaching-Szenarien eingesetzt werden könnten.

Diese frühen Studien legten den Grundstein für die heute in fortschrittlicher Sporttechnologie eingesetzten Werkzeuge zur Leistungsverfolgung.

Pipeline zur Klassifizierung von Baseballaktionen mit OpenPose

Abb. 5. Ein Blick auf eine Pipeline zur Klassifizierung von Baseballaktionen mit OpenPose.

OpenPose in Sicherheits- und Schutzsystemen#

Ähnlich nutzten Forscher OpenPose, um zu untersuchen, wie videobasierte Posenv​​erfolgung die Sicherheitsüberwachung unterstützen kann. Das System wurde zur Erkennung von Verhaltensweisen wie Stürzen, unerwarteten Gesten oder Bewegungsmustern in öffentlichen Bereichen getestet.

Da OpenPose mit Standardkameras funktionierte, machte es frühe Experimente in Umgebungen wie Krankenhäusern und Verkehrsknotenpunkten zugänglicher. Diese Studien trieben die Entwicklung neuerer Modelle voran, die heute in Überwachungs-, Sturzerkennungs- und Notfallreaktionssystemen eingesetzt werden.

Sturzerkennung mit OpenPose

Abb. 6. Sturzerkennung mit OpenPose.

Vor- und Nachteile von OpenPose#

Hier ist ein Überblick über einige der Vorteile von OpenPose:

  • Nützlich für Forschung und Prototyping: OpenPose wurde in der akademischen Forschung breit eingesetzt, insbesondere in Bereichen wie Mensch-Computer-Interaktion, Biomechanik und Verhaltensanalyse.
  • Plattformübergreifende Unterstützung: OpenPose kann unter Windows, Linux und macOS ausgeführt werden und unterstützt sowohl zentrale Recheneinheiten (CPUs) als auch Grafikprozessoren (GPUs).
  • Fähigkeit zur Offline-Verarbeitung: OpenPose kann in Umgebungen ohne Internetzugang ausgeführt werden und eignet sich dadurch ideal für datenschutzsensible Bereiche wie Gesundheitsversorgung oder Bildung.

Obwohl OpenPose ein bedeutender Fortschritt war, weist es auch technische Einschränkungen auf, die du berücksichtigen solltest. Hier sind einige der wichtigsten Herausforderungen im Zusammenhang mit OpenPose:

  • Hohe Anforderungen an die Verarbeitung: Die Ausführung von OpenPose in Echtzeit erfordert eine leistungsstarke GPU und erhebliche Rechenressourcen.
  • Umgebungsempfindlich: Die Leistung kann bei schlechten Lichtverhältnissen, in belebten Bereichen oder bei ungünstigen Kamerawinkeln abnehmen.
  • Schwergewichtig im Vergleich zu neueren Modellen: Im Vergleich zu neueren Posenschätzungsmodellen ist OpenPose relativ groß und langsamer. Für die Bereitstellung auf ressourcenbeschränkten Geräten wie Smartphones, Tablets oder eingebetteten Systemen ist es nicht gut geeignet.

Wichtige Erkenntnisse#

OpenPose spielte eine wichtige Rolle dabei, die Posenschätzung zugänglicher zu machen. Das System zeigte, dass sich Körperbewegungen mit einer einfachen Kamera verfolgen lassen, ohne auf Anzüge oder spezielle Ausrüstung angewiesen zu sein.

Es legte den Grundstein für viele praxisnahe Anwendungen in den Bereichen Gesundheitsversorgung, Bildung, Unterhaltung und Forschung. Obwohl neuere Modelle heute höhere Geschwindigkeiten und eine geringere Rechenlast bieten, bleibt OpenPose ein wichtiger Bezugspunkt für das Verständnis der Entwicklung der Posenschätzung.

Tritt unserer Community bei und besuche unser GitHub-Repository, um mehr über AI zu erfahren. Wenn du deine eigenen Computer-Vision-Lösungen entwickeln möchtest, sieh dir unsere Lizenzoptionen an. Erfahre außerdem, wie Computer Vision im Gesundheitswesen und AI in der Logistik Wirkung zeigen!

Explore solutions

Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren
Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren
Computer Vision für Luftbilder

Computer Vision für Luftbilder

Verwandle Drohnen- und Luftbilder mit Ultralytics YOLO in Echtzeiterkenntnisse für Landwirtschaft, Aquakultur, Umweltüberwachung, Naturschutz und Geodatenanalyse.
Mehr erfahren
Computer Vision in der Luft- und Raumfahrt

Computer Vision in der Luft- und Raumfahrt

Bringe KI-gestützte Bildverarbeitung mit Ultralytics YOLO-Modellen in die Luftüberwachung. Unterstütze Drohnen, Luft- und Raumfahrt-Workflows, Umweltschutz und Geodatenbranchen mit Computer-Vision-Lösungen.
Mehr erfahren

Schütze jeden Standort mit Ultralytics YOLO-Modellen. Vision AI unterstützt Perimeterüberwachung, Bedkennung, Kennzeichenerkennung und Arbeitssicherheit.
Mehr erfahren
Computer Vision in der Robotik

Computer Vision in der Robotik

Mache Maschinen mit Ultralytics YOLO-Modellen intelligenter. Vision AI in der Robotik ermöglicht autonome Navigation, Wahrnehmung, Objektverfolgung und Steuerung in Echtzeit.
Mehr erfahren
Computer Vision in der Logistik

Computer Vision in der Logistik

Optimiere die Logistik mit Ultralytics YOLO-Modellen. Vision AI ermöglicht die Paketinspektion, Sortierung, Fahrzeugverfolgung und Überwachung der Lagersicherheit in Echtzeit.
Mehr erfahren
Computer Vision im Einzelhandel

Computer Vision im Einzelhandel

Gestalte den Einzelhandel mit Ultralytics YOLO-Modellen neu. Vision AI ermöglicht Bestandsverfolgung, Regalüberwachung, Warteschlangenmanagement und aussagekräftigere Einblicke in das Kundenverhalten.
Mehr erfahren
Computer Vision im Gesundheitswesen

Computer Vision im Gesundheitswesen

Entwickle Lösungen für das Gesundheitswesen mit Ultralytics YOLO-Modellen. Vision AI im Gesundheitswesen ermöglicht eine schnellere medizinische Bildgebung, intelligentere Diagnosen und die Überwachung von Patienten.
Mehr erfahren
Computer Vision in der Fertigung

Computer Vision in der Fertigung

Optimiere die Fertigung mit Ultralytics YOLO-Modellen. Vision AI ermöglicht Qualitätskontrolle, Fehlererkennung, die Einhaltung von Vorgaben zur persönlichen Schutzausrüstung und die Automatisierung von Montagelinien.
Mehr erfahren
Computer Vision in der Automobilindustrie

Computer Vision in der Automobilindustrie

Setze Computer Vision mit Ultralytics YOLO-Modellen in der Automobilindustrie ein. Vision AI verbessert die Verkehrssicherheit, Fahrerassistenz und Fahrzeugautomatisierung für intelligentere Straßen.
Mehr erfahren
Computer Vision in der Landwirtschaft

Computer Vision in der Landwirtschaft

Bring Vision AI mit Ultralytics YOLO-Modellen in die intelligente Landwirtschaft. Ermögliche die Überwachung von Nutzpflanzen, die Verfolgung von Nutztieren und Präzisionslandwirtschaft für höhere und intelligentere Erträge.
Mehr erfahren

Lass uns gemeinsam die Zukunft der KI gestalten!

Beginne deine Reise in die Zukunft des maschinellen Lernens