Che cos'è OpenPose? Esplorando una pietra miliare nella stima della posa
Esplora come OpenPose può essere utilizzato per la stima della posa nelle applicazioni di computer vision. Scopri le sue funzionalità e la sua importanza nell'IA per la visione.

Al giorno d'oggi, immagini e fotocamere sono ovunque: integrate nei nostri telefoni, nelle nostre case e persino negli spazi pubblici. Non ci affidiamo a loro solo per catturare momenti, ma anche per aiutarci a comprendere e interagire con il mondo che ci circonda.
Dietro le quinte, la visione artificiale, un sottocampo dell'intelligenza artificiale (AI), rende tutto questo possibile consentendo alle macchine di interpretare i dati visivi. Permette ai sistemi di rilevare oggetti, riconoscere volti e tracciare movimenti, svolgendo un ruolo fondamentale in molte delle tecnologie che utilizziamo ogni giorno.
Grazie ai recenti progressi nell'AI, i modelli di visione artificiale possono ora analizzare ed estrarre dati e informazioni più complessi. Un esempio è la stima della posa, un'attività di visione artificiale incentrata sulla comprensione del movimento umano.
Funziona identificando punti chiave sul corpo, come spalle, gomiti e ginocchia, in immagini o video. Questo permette di analizzare come si muovono le persone, abilitando applicazioni nel monitoraggio del fitness, nell'animazione, nell'assistenza sanitaria e in molto altro.
Tra i numerosi strumenti sviluppati per la stima della posa, OpenPose si distingue come una svolta importante. Creato dai ricercatori del Perceptual Computing Lab della Carnegie Mellon University, è stato uno dei primi sistemi open source in grado di rilevare pose del corpo intero, comprese mani, piedi e punti chiave del viso, per più persone in tempo reale utilizzando solo una fotocamera (con fino a 135 punti chiave per persona).
In questo articolo esploreremo OpenPose, il suo funzionamento e la sua importanza come pietra miliare nella visione artificiale.

Fig. 1. Stima della posa di più persone con OpenPose.
Uno sguardo alla storia della stima della posa#
Prima che l'AI fosse adottata su larga scala, il monitoraggio dei movimenti umani nei video richiedeva l'uso di apparecchiature specializzate. In settori come cinema e animazione, gli attori indossavano spesso tute con marcatori riflettenti, così che le fotocamere potessero acquisire i loro movimenti in un ambiente di studio controllato.
Sebbene queste tecniche di motion capture basate su marcatori fossero accurate, erano anche costose e limitate a configurazioni specifiche. Con l'avanzare della visione artificiale, i ricercatori cercarono modi per tracciare i movimenti del corpo senza utilizzare marcatori. Usarono bordi, contorni e modelli per individuare le forme umane nelle immagini.
Questi primi sistemi funzionavano in situazioni semplici e lineari, ma incontravano difficoltà negli scenari del mondo reale. Spesso producevano risultati scadenti quando le persone si muovevano in modi imprevisti o quando nell'inquadratura compariva più di una persona.
Alla fine degli anni 2010, il deep learning portò una svolta importante nella stima della posa. I modelli di AI per la visione potevano essere addestrati su grandi dataset di pose umane. Invece di affidarsi a bordi e modelli, i modelli imparavano a riconoscere le articolazioni e la struttura del corpo studiando migliaia di immagini annotate. Questo rese la stima della posa più accurata, flessibile e utile in una gamma più ampia di contesti.

Fig. 2. L'evoluzione dei modelli di stima della posa umana dal 2017 al 2023.
OpenPose: l'inizio della moderna stima della posa#
OpenPose è stato rilasciato per la prima volta nel 2017 ed è in grado di stimare simultaneamente le pose di più persone in una singola immagine. A differenza dei sistemi precedenti, OpenPose non richiede tute o marcatori speciali. Funziona con fotocamere standard e può elaborare immagini e video in tempo reale. Queste caratteristiche hanno reso la stima della posa più accessibile a sviluppatori e ricercatori.
Le basi gettate da OpenPose per la visione artificiale hanno aiutato altri a sviluppare architetture più recenti per una varietà di applicazioni. Oggi, modelli di AI per la visione come Ultralytics YOLOv8 e Ultralytics YOLO11, che supportano le attività di stima della posa, offrono risultati più rapidi e una latenza inferiore.

Fig. 3. Utilizzo di YOLO11 per la stima della posa.
Tuttavia, OpenPose è un ottimo punto di partenza se ti interessa scoprire come si è evoluta la stima della posa. Ha introdotto idee fondamentali su cui ancora oggi si basano molti sistemi più recenti.
Funzionalità principali di OpenPose#
Ora che abbiamo compreso meglio perché OpenPose è importante, osserviamo più da vicino che cosa può fare concretamente.
Al centro delle funzionalità di OpenPose c'è qualcosa chiamato rilevamento dei punti chiave. I punti chiave sono punti di riferimento specifici del corpo umano, come la punta del naso, il centro delle spalle, gomiti, polsi, fianchi, ginocchia e caviglie. OpenPose può rilevare fino a 135 di questi punti per persona, comprese aree dettagliate come dita e tratti del viso.
Quando questi punti vengono collegati, formano una rappresentazione semplificata del corpo umano: puoi immaginarla come uno scheletro digitale. Questo profilo scheletrico mostra non solo dove si trova una persona, ma anche la sua posizione: se è seduta, in piedi, sta salutando, sorridendo o camminando. I computer possono interpretare visivamente i movimenti umani usando questi scheletri, proprio come noi comprendiamo istintivamente il linguaggio del corpo di qualcuno.
Il tracciamento scheletrico è particolarmente utile perché elimina il rumore e le distrazioni dello sfondo, consentendo al sistema di concentrarsi esclusivamente sulla postura e sul movimento umano. Invece di analizzare ogni pixel, OpenPose si concentra sui punti significativi che raccontano come una persona si sta muovendo o interagendo.
Estraendo queste informazioni strutturate da immagini o video di uso quotidiano, OpenPose permette di creare applicazioni che rispondono ai gesti, monitorano l'attività fisica, valutano gli indizi emotivi o animano persino personaggi digitali.
Come funziona OpenPose?#
Ecco una panoramica di come OpenPose rileva e collega i punti chiave del corpo umano a partire da un input visivo:
- Inizia da un'immagine: OpenPose acquisisce una singola immagine da una foto, un video o un flusso della fotocamera in diretta.
- Individua le parti importanti del corpo: Il sistema cerca i punti chiave del corpo, come naso, gomiti, polsi, ginocchia e caviglie. Li contrassegna nei punti in cui è sicuro che si trovi una parte del corpo.
- Determina quali parti sono collegate: Successivamente, OpenPose verifica come sono collegati i punti chiave. Utilizza calcoli matematici per stabilire quali articolazioni appartengono alla stessa persona, ad esempio associando un polso al gomito e alla spalla destri.
- Disegna uno scheletro per ogni persona: Dopo aver raggruppato i punti chiave, OpenPose li collega in una "figura stilizzata" che mostra la posa di ogni persona. Funziona anche quando nella stessa inquadratura compaiono più persone.
- Restituisce i dati della posa: Infine, fornisce le posizioni esatte di tutti i punti chiave rilevati. Questi dati possono essere utilizzati per tracciare i movimenti, riconoscere i gesti o creare strumenti interattivi, tutto in tempo reale.

Fig. 4. Rilevamento e tracciamento dei punti chiave umani con OpenPose.
Applicazioni della stima della posa in diversi settori con OpenPose#
OpenPose è stato uno dei primi strumenti avanzati a rendere pratica la stima della posa per una varietà di casi d'uso reali. Sebbene oggi non venga comunemente utilizzato nelle soluzioni di visione artificiale in tempo reale, ha svolto un ruolo importante nel plasmare i primi lavori in settori come sport, intrattenimento, istruzione e sicurezza.
Vediamo più da vicino come ha contribuito a spianare la strada in questi ambiti.
Stima della posa con OpenPose per fitness e sport#
Quando guardi una partita di baseball, è facile capire cosa sta succedendo: riconosci immediatamente un lancio, una battuta o una base rubata. Noi esseri umani leggiamo intuitivamente i movimenti del corpo e li comprendiamo senza grande sforzo. Per le macchine, invece, riconoscere queste azioni è molto più complesso. Hanno bisogno di informazioni precise su come ogni parte del corpo si muove nello spazio.
OpenPose ha rappresentato un notevole passo avanti in questo ambito della visione artificiale. Era uno strumento pratico per analizzare la tecnica atletica in diversi contesti.
Molti progetti di ricerca hanno utilizzato OpenPose per scomporre movimenti come battute e salti, classificando persino specifiche azioni del baseball in base al modo in cui si muovevano i giocatori. Poiché funzionava in ambienti aperti con video standard, consentiva ai ricercatori di testare come tali sistemi potessero funzionare in scenari reali di allenamento o coaching.
Questi primi studi hanno contribuito a gettare le basi per gli strumenti di monitoraggio delle prestazioni oggi utilizzati nella moderna tecnologia sportiva.

Fig. 5. Uno sguardo a una pipeline di classificazione delle azioni nel baseball con OpenPose.
Utilizzo di OpenPose nei sistemi di sicurezza e protezione#
Allo stesso modo, i ricercatori hanno utilizzato OpenPose per studiare come il tracciamento della posa basato sui video potesse supportare il monitoraggio della sicurezza. È stato testato per il rilevamento di comportamenti come cadute, gesti imprevisti o schemi di movimento nelle aree pubbliche.
Poiché funzionava con fotocamere standard, OpenPose ha reso più accessibili le prime sperimentazioni in ambienti come ospedali e snodi dei trasporti. Questi studi hanno contribuito a promuovere lo sviluppo di modelli più recenti, oggi utilizzati nei sistemi di videosorveglianza, rilevamento delle cadute e risposta alle emergenze.

Fig. 6. Rilevamento delle cadute abilitato da OpenPose.
Vantaggi e svantaggi di OpenPose#
Ecco una panoramica di alcuni dei vantaggi offerti da OpenPose:
- Utile per la ricerca e la prototipazione: È stato ampiamente utilizzato nella ricerca accademica, soprattutto in ambiti come l'interazione uomo-computer, la biomeccanica e l'analisi comportamentale.
- Supporto multipiattaforma: Può essere eseguito su Windows, Linux e macOS, con supporto sia per le unità di elaborazione centrale (CPUs) sia per le unità di elaborazione grafica (GPUs).
- Funzionalità di elaborazione offline: Può essere eseguito in ambienti senza accesso a Internet, risultando ideale in contesti sensibili alla privacy come l'assistenza sanitaria o l'istruzione.
Sebbene OpenPose abbia rappresentato un importante passo avanti, presenta anche limitazioni tecniche che è importante tenere presenti. Ecco alcune delle principali difficoltà associate a OpenPose:
- Elevati requisiti di elaborazione: L'esecuzione di OpenPose in tempo reale richiede una GPU potente e notevoli risorse di calcolo.
- Sensibile all'ambiente: Le prestazioni possono diminuire in condizioni di scarsa illuminazione, in spazi affollati o quando gli angoli della fotocamera non sono ottimali.
- Pesante rispetto ai modelli più recenti: Rispetto ai modelli di stima della posa più recenti, OpenPose è relativamente grande e più lento. Non è adatto alla distribuzione su dispositivi con risorse limitate come smartphone, tablet o sistemi embedded.
Punti chiave#
OpenPose ha svolto un ruolo importante nel rendere la stima della posa più accessibile. Ha dimostrato che era possibile tracciare i movimenti del corpo con una semplice fotocamera, senza ricorrere a tute o apparecchiature specializzate.
Ha gettato le basi per molte applicazioni pratiche nell'assistenza sanitaria, nell'istruzione, nell'intrattenimento e nella ricerca. Sebbene i modelli più recenti offrano ora velocità maggiori e prestazioni più leggere, OpenPose rimane un riferimento fondamentale per comprendere come si è evoluta la stima della posa.
Unisciti alla nostra community e visita il nostro repository GitHub per saperne di più sull'AI. Se vuoi creare le tue soluzioni di visione artificiale, scopri le nostre opzioni di licenza. Dai anche un'occhiata a come la visione artificiale nell'assistenza sanitaria e l'AI nella logistica stanno facendo la differenza!









