Ultralytics YOLO27:
Guias

O que é o OpenPose? Explorando um marco na estimativa de pose

Explora como o OpenPose pode ser utilizado para a estimativa de pose em aplicações de visão computacional. Aprende sobre as suas funcionalidades e a sua importância na IA para visão.

ABAbirami Vina10 min read
Estimativa de pose de várias pessoas com OpenPose

Hoje em dia, as imagens e as câmaras estão por todo o lado — integradas nos nossos telemóveis, casas e até espaços públicos. Dependemos delas não só para captar momentos, mas também para nos ajudar a compreender e interagir com o mundo à nossa volta.

Nos bastidores, a visão computacional, um subcampo da inteligência artificial (AI), torna isto possível ao permitir que as máquinas interpretem dados visuais. Permite aos sistemas detetar objetos, reconhecer rostos e acompanhar movimentos, desempenhando um papel fundamental em muitas das tecnologias que usamos diariamente.

Graças aos avanços recentes na AI, os modelos de visão computacional conseguem agora analisar e extrair dados e insights mais complexos. Um exemplo disso é a estimativa de pose, uma tarefa de visão computacional centrada na compreensão do movimento humano.

Funciona através da identificação de pontos-chave no corpo, como ombros, cotovelos e joelhos, em imagens ou vídeos. Isto permite analisar como as pessoas se movem, possibilitando aplicações no acompanhamento de atividade física, animação, cuidados de saúde e muito mais.

Entre as muitas ferramentas desenvolvidas para a estimativa de pose, o OpenPose destaca-se como um grande avanço. Criado por investigadores do Perceptual Computing Lab da Carnegie Mellon University, foi um dos primeiros sistemas de código aberto capazes de detetar poses de corpo inteiro, incluindo mãos, pés e pontos-chave faciais, para várias pessoas em tempo real utilizando apenas uma câmara (com até 135 pontos-chave por pessoa).

Neste artigo, vamos explorar o OpenPose, o seu funcionamento e a sua importância como um marco na visão computacional.

Estimativa de pose de várias pessoas utilizando o OpenPose

Fig 1. Estimativa de pose de várias pessoas utilizando o OpenPose.

Uma análise da história da estimativa de pose#

Antes de a AI ser amplamente adotada, o acompanhamento do movimento humano em vídeos envolvia a utilização de equipamento especializado. Em setores como cinema e animação, os atores usavam frequentemente fatos com marcadores refletores para que as câmaras pudessem captar os seus movimentos num ambiente de estúdio controlado.

Embora estas técnicas de captura de movimento baseadas em marcadores fossem precisas, também eram dispendiosas e limitadas a configurações específicas. À medida que a visão computacional avançava, os investigadores procuraram formas de acompanhar o movimento corporal sem utilizar marcadores. Usaram contornos, arestas e modelos para encontrar formas humanas em imagens.

Estes primeiros sistemas funcionavam em situações simples e diretas, mas tinham dificuldades em cenários do mundo real. Muitas vezes produziam resultados fracos quando as pessoas se moviam de formas inesperadas ou quando aparecia mais do que uma pessoa num enquadramento.

No final da década de 2010, a aprendizagem profunda trouxe uma grande mudança à estimativa de pose. Os modelos de AI de visão podiam ser treinados com grandes conjuntos de dados de poses humanas. Em vez de dependerem de contornos e modelos, os modelos aprenderam a reconhecer articulações e estruturas corporais através do estudo de milhares de imagens anotadas. Isto tornou a estimativa de pose mais precisa, flexível e eficaz numa maior variedade de contextos.

Cronologia dos modelos de estimativa de pose humana de 2017 a 2023

Fig 2. A evolução dos modelos de estimativa de pose humana de 2017 a 2023.

OpenPose: o início da estimativa de pose moderna#

O OpenPose foi lançado pela primeira vez em 2017 e é capaz de estimar simultaneamente as poses de várias pessoas numa única imagem. Ao contrário dos sistemas mais antigos, o OpenPose não requer fatos especiais nem marcadores. Funciona com câmaras comuns e consegue processar imagens e vídeos em tempo real. Estas funcionalidades tornaram a estimativa de pose mais acessível a programadores e investigadores.

As bases estabelecidas pelo OpenPose para a visão computacional ajudaram outros a desenvolver arquiteturas mais recentes para várias outras aplicações. Atualmente, modelos de AI de visão como o Ultralytics YOLOv8 e o Ultralytics YOLO11, que suportam tarefas de estimativa de pose, oferecem resultados mais rápidos e menor latência.

Utilização do Ultralytics YOLO11 para estimativa de pose

Fig 3. Utilização do YOLO11 para estimativa de pose.

No entanto, o OpenPose é um excelente ponto de partida se tiveres curiosidade em saber como a estimativa de pose evoluiu. Introduziu ideias fundamentais nas quais muitos sistemas mais recentes ainda se baseiam atualmente.

Principais capacidades do OpenPose#

Agora que compreendemos melhor por que razão o OpenPose é importante, vamos analisar mais de perto o que ele consegue realmente fazer.

No centro das capacidades do OpenPose está algo chamado deteção de pontos-chave. Os pontos-chave são referências específicas no corpo humano, como a ponta do nariz, o centro dos ombros, os cotovelos, pulsos, ancas, joelhos e tornozelos. O OpenPose consegue detetar até 135 destes pontos por pessoa, incluindo áreas detalhadas como os dedos e as características faciais.

Quando estes pontos são ligados, formam uma representação simplificada do corpo humano — podes imaginá-la como um esqueleto digital. Este contorno esquelético mostra não só onde uma pessoa está, mas também como está posicionada: se está sentada, de pé, a acenar, a sorrir ou a caminhar. Os computadores conseguem interpretar visualmente o movimento humano utilizando estes esqueletos, tal como compreendemos instintivamente a linguagem corporal de alguém.

O acompanhamento esquelético é especialmente útil porque elimina o ruído e as distrações do fundo, permitindo que o sistema se concentre exclusivamente na postura e no movimento humanos. Em vez de analisar cada píxel, o OpenPose concentra-se em pontos relevantes que revelam como uma pessoa se está a mover ou a interagir.

Ao extrair esta informação estruturada de imagens ou vídeos do dia a dia, o OpenPose torna possível criar aplicações que respondem a gestos, monitorizam a atividade física, avaliam sinais emocionais ou até animam personagens digitais.

Como funciona o OpenPose?#

Eis uma visão geral de como o OpenPose deteta e liga pontos-chave do corpo humano a partir de dados visuais:

  • Começa com uma imagem: o OpenPose obtém uma única imagem a partir de uma fotografia, vídeo ou transmissão em direto de uma câmara.
  • Identifica partes importantes do corpo: o sistema procura pontos-chave no corpo, como o nariz, os cotovelos, os pulsos, os joelhos e os tornozelos. Estes são assinalados nos locais onde o sistema tem confiança de que se encontra uma parte do corpo.
  • Determina que partes pertencem umas às outras: em seguida, o OpenPose verifica como os pontos-chave estão ligados. Utiliza cálculos matemáticos para decidir que articulações pertencem à mesma pessoa — por exemplo, associando um pulso ao cotovelo e ao ombro direitos.
  • Desenha um esqueleto para cada pessoa: depois de agrupar os pontos-chave, o OpenPose liga-os numa "figura de palitos" que mostra a pose de cada pessoa. Isto funciona mesmo quando aparecem várias pessoas no mesmo enquadramento.
  • Devolve os dados da pose: por fim, fornece as posições exatas de todos os pontos-chave detetados. Estes podem ser utilizados para acompanhar movimentos, reconhecer gestos ou criar ferramentas interativas — tudo em tempo real.

Deteção e acompanhamento de pontos-chave humanos utilizando o OpenPose

Fig 4. Deteção e acompanhamento de pontos-chave humanos utilizando o OpenPose.

Aplicações da estimativa de pose em vários setores utilizando o OpenPose#

O OpenPose foi uma das primeiras ferramentas avançadas que tornaram a estimativa de pose prática para uma variedade de casos de utilização no mundo real. Embora atualmente não seja habitualmente utilizado em soluções de visão computacional em tempo real, desempenhou um papel importante na orientação dos primeiros trabalhos em áreas como o desporto, o entretenimento, a educação e a segurança.

Vamos analisar mais de perto como ajudou a abrir caminho nestas áreas.

Estimativa de pose com o OpenPose para fitness e desporto#

Quando vês um jogo de basebol, é fácil compreender o que está a acontecer — reconheces instantaneamente um lançamento, uma tacada ou uma base roubada. Enquanto seres humanos, lemos intuitivamente os movimentos corporais e compreendemo-los sem grande esforço. Para as máquinas, porém, reconhecer estas ações é muito mais complexo. Precisam de informações precisas sobre como cada parte do corpo se move no espaço.

O OpenPose representou um avanço significativo nesta área da visão computacional. Era uma ferramenta prática para analisar a técnica atlética em vários contextos.

Muitos projetos de investigação utilizaram o OpenPose para decompor movimentos como tacadas e saltos, classificando inclusivamente ações de basebol específicas com base na forma como os jogadores se moviam. Como funcionava em ambientes abertos com vídeo comum, permitiu aos investigadores testar como estes sistemas poderiam funcionar em cenários reais de treino ou orientação.

Estes primeiros estudos ajudaram a estabelecer as bases das ferramentas de acompanhamento do desempenho atualmente utilizadas na tecnologia desportiva avançada.

Pipeline de classificação de ações de basebol utilizando o OpenPose

Fig 5. Uma análise de um pipeline de classificação de ações de basebol utilizando o OpenPose.

Utilização do OpenPose em sistemas de segurança e proteção#

De forma semelhante, os investigadores também utilizaram o OpenPose para explorar como o acompanhamento de poses baseado em vídeo poderia apoiar a monitorização da segurança. Foi testado na deteção de comportamentos como quedas, gestos inesperados ou padrões de movimento em áreas públicas.

Como funcionava com câmaras comuns, o OpenPose tornou as primeiras experiências mais acessíveis em ambientes como hospitais e terminais de transporte. Estes estudos ajudaram a impulsionar o desenvolvimento de modelos mais recentes, agora utilizados em sistemas de vigilância, deteção de quedas e resposta a emergências.

Deteção de quedas possibilitada pelo OpenPose

Fig 6. Deteção de quedas possibilitada pelo OpenPose.

Vantagens e desvantagens do OpenPose#

Eis uma breve visão geral de algumas das vantagens oferecidas pelo OpenPose:

  • Útil para investigação e prototipagem: foi amplamente utilizado em investigação académica, especialmente em áreas como interação pessoa-computador, biomecânica e análise comportamental.
  • Suporte multiplataforma: pode ser executado em Windows, Linux e macOS, com suporte para unidades centrais de processamento (CPUs) e unidades de processamento gráfico (GPUs).
  • Capacidade de processamento offline: pode ser executado em ambientes sem acesso à Internet, sendo ideal para contextos sensíveis em termos de privacidade, como os cuidados de saúde ou a educação.

Embora o OpenPose tenha representado um grande avanço, também apresenta limitações técnicas importantes a ter em conta. Eis alguns dos principais desafios associados ao OpenPose:

  • Elevados requisitos de processamento: executar o OpenPose em tempo real requer uma GPU potente e recursos computacionais significativos.
  • Sensível ao ambiente: o desempenho pode diminuir com pouca luz, em espaços lotados ou quando os ângulos da câmara não são ideais.
  • Pesado em comparação com modelos mais recentes: em comparação com modelos de estimativa de pose mais recentes, o OpenPose é relativamente grande e mais lento. Não é adequado para implementação em dispositivos com recursos limitados, como smartphones, tablets ou sistemas incorporados.

Principais conclusões#

O OpenPose desempenhou um papel importante ao tornar a estimativa de pose mais acessível. Demonstrou que era possível acompanhar os movimentos do corpo com uma câmara simples, sem depender de fatos ou equipamento especializado.

Estabeleceu as bases para muitas aplicações práticas nos setores dos cuidados de saúde, da educação, do entretenimento e da investigação. Embora os modelos mais recentes ofereçam agora velocidades superiores e um desempenho mais leve, o OpenPose continua a ser uma referência importante para compreender como a estimativa de pose evoluiu.

Junta-te à nossa comunidade e visita o nosso repositório no GitHub para saberes mais sobre AI. Se estás a pensar criar as tuas próprias soluções de visão computacional, explora as nossas opções de licenciamento. Consulta também como a visão computacional nos cuidados de saúde e a AI na logística estão a causar impacto!

Explore solutions

Visão computacional para imagens aéreas

Visão computacional para imagens aéreas

Transforma imagens de drones e aéreas em insights em tempo real para agricultura, aquicultura, monitoramento ambiental, conservação e análise geoespacial com Ultralytics YOLO.
Saiba mais
Visão computacional no setor aeroespacial

Visão computacional no setor aeroespacial

Leva a IA de visão para o monitoramento aéreo com os modelos do Ultralytics YOLO. Potencializa drones, fluxos de trabalho aeroespaciais, conservação ambiental e indústrias geoespaciais com soluções de visão computacional.
Saiba mais

Protege cada local com os modelos do Ultralytics YOLO. A IA de visão alimenta monitoramento de perímetro, detecção de ameaças, reconhecimento de placas e segurança no local de trabalho.
Saiba mais
Visão computacional na robótica

Visão computacional na robótica

Dê mais inteligência às suas máquinas com os modelos Ultralytics YOLO. A IA de visão na robótica permite a navegação autónoma, a perceção, o rastreamento de objetos e o controlo em tempo real.
Saiba mais
Visão computacional na logística

Visão computacional na logística

Simplifique a logística com os modelos Ultralytics YOLO. A IA de visão permite a inspeção de encomendas, a triagem, o rastreamento de veículos e a monitorização da segurança dos armazéns em tempo real.
Saiba mais
Visão computacional no retalho

Visão computacional no retalho

Reinvente o retalho com os modelos Ultralytics YOLO. A IA de visão permite o rastreamento do inventário, a monitorização de prateleiras, a gestão de filas e informações mais inteligentes sobre os clientes.
Saiba mais
Visão computacional na área da saúde

Visão computacional na área da saúde

Cria soluções de saúde com modelos Ultralytics YOLO. A Vision AI na área da saúde permite obter imagens médicas mais rapidamente, diagnósticos mais inteligentes e monitorização de pacientes.
Saiba mais
Visão computacional na produção

Visão computacional na produção

Otimiza a produção com modelos Ultralytics YOLO. A Vision AI impulsiona o controlo de qualidade, a deteção de defeitos, a conformidade com EPI e a automatização das linhas de montagem.
Saiba mais
Visão computacional no setor automóvel

Visão computacional no setor automóvel

Aplique visão computacional no setor automóvel com modelos Ultralytics YOLO. A IA de visão melhora a segurança rodoviária, a assistência ao condutor e a automatização de veículos para estradas mais inteligentes.
Saiba mais
Visão computacional na agricultura

Visão computacional na agricultura

Leve a IA de visão para a agricultura inteligente com modelos Ultralytics YOLO. Potencie a monitorização das culturas, o acompanhamento do gado e a agricultura de precisão para obter colheitas maiores e mais inteligentes.
Saiba mais
Visão computacional para imagens aéreas

Visão computacional para imagens aéreas

Transforma imagens de drones e aéreas em insights em tempo real para agricultura, aquicultura, monitoramento ambiental, conservação e análise geoespacial com Ultralytics YOLO.
Saiba mais
Visão computacional no setor aeroespacial

Visão computacional no setor aeroespacial

Leva a IA de visão para o monitoramento aéreo com os modelos do Ultralytics YOLO. Potencializa drones, fluxos de trabalho aeroespaciais, conservação ambiental e indústrias geoespaciais com soluções de visão computacional.
Saiba mais

Protege cada local com os modelos do Ultralytics YOLO. A IA de visão alimenta monitoramento de perímetro, detecção de ameaças, reconhecimento de placas e segurança no local de trabalho.
Saiba mais
Visão computacional na robótica

Visão computacional na robótica

Dê mais inteligência às suas máquinas com os modelos Ultralytics YOLO. A IA de visão na robótica permite a navegação autónoma, a perceção, o rastreamento de objetos e o controlo em tempo real.
Saiba mais
Visão computacional na logística

Visão computacional na logística

Simplifique a logística com os modelos Ultralytics YOLO. A IA de visão permite a inspeção de encomendas, a triagem, o rastreamento de veículos e a monitorização da segurança dos armazéns em tempo real.
Saiba mais
Visão computacional no retalho

Visão computacional no retalho

Reinvente o retalho com os modelos Ultralytics YOLO. A IA de visão permite o rastreamento do inventário, a monitorização de prateleiras, a gestão de filas e informações mais inteligentes sobre os clientes.
Saiba mais
Visão computacional na área da saúde

Visão computacional na área da saúde

Cria soluções de saúde com modelos Ultralytics YOLO. A Vision AI na área da saúde permite obter imagens médicas mais rapidamente, diagnósticos mais inteligentes e monitorização de pacientes.
Saiba mais
Visão computacional na produção

Visão computacional na produção

Otimiza a produção com modelos Ultralytics YOLO. A Vision AI impulsiona o controlo de qualidade, a deteção de defeitos, a conformidade com EPI e a automatização das linhas de montagem.
Saiba mais
Visão computacional no setor automóvel

Visão computacional no setor automóvel

Aplique visão computacional no setor automóvel com modelos Ultralytics YOLO. A IA de visão melhora a segurança rodoviária, a assistência ao condutor e a automatização de veículos para estradas mais inteligentes.
Saiba mais
Visão computacional na agricultura

Visão computacional na agricultura

Leve a IA de visão para a agricultura inteligente com modelos Ultralytics YOLO. Potencie a monitorização das culturas, o acompanhamento do gado e a agricultura de precisão para obter colheitas maiores e mais inteligentes.
Saiba mais
Visão computacional para imagens aéreas

Visão computacional para imagens aéreas

Transforma imagens de drones e aéreas em insights em tempo real para agricultura, aquicultura, monitoramento ambiental, conservação e análise geoespacial com Ultralytics YOLO.
Saiba mais
Visão computacional no setor aeroespacial

Visão computacional no setor aeroespacial

Leva a IA de visão para o monitoramento aéreo com os modelos do Ultralytics YOLO. Potencializa drones, fluxos de trabalho aeroespaciais, conservação ambiental e indústrias geoespaciais com soluções de visão computacional.
Saiba mais

Protege cada local com os modelos do Ultralytics YOLO. A IA de visão alimenta monitoramento de perímetro, detecção de ameaças, reconhecimento de placas e segurança no local de trabalho.
Saiba mais
Visão computacional na robótica

Visão computacional na robótica

Dê mais inteligência às suas máquinas com os modelos Ultralytics YOLO. A IA de visão na robótica permite a navegação autónoma, a perceção, o rastreamento de objetos e o controlo em tempo real.
Saiba mais
Visão computacional na logística

Visão computacional na logística

Simplifique a logística com os modelos Ultralytics YOLO. A IA de visão permite a inspeção de encomendas, a triagem, o rastreamento de veículos e a monitorização da segurança dos armazéns em tempo real.
Saiba mais
Visão computacional no retalho

Visão computacional no retalho

Reinvente o retalho com os modelos Ultralytics YOLO. A IA de visão permite o rastreamento do inventário, a monitorização de prateleiras, a gestão de filas e informações mais inteligentes sobre os clientes.
Saiba mais
Visão computacional na área da saúde

Visão computacional na área da saúde

Cria soluções de saúde com modelos Ultralytics YOLO. A Vision AI na área da saúde permite obter imagens médicas mais rapidamente, diagnósticos mais inteligentes e monitorização de pacientes.
Saiba mais
Visão computacional na produção

Visão computacional na produção

Otimiza a produção com modelos Ultralytics YOLO. A Vision AI impulsiona o controlo de qualidade, a deteção de defeitos, a conformidade com EPI e a automatização das linhas de montagem.
Saiba mais
Visão computacional no setor automóvel

Visão computacional no setor automóvel

Aplique visão computacional no setor automóvel com modelos Ultralytics YOLO. A IA de visão melhora a segurança rodoviária, a assistência ao condutor e a automatização de veículos para estradas mais inteligentes.
Saiba mais
Visão computacional na agricultura

Visão computacional na agricultura

Leve a IA de visão para a agricultura inteligente com modelos Ultralytics YOLO. Potencie a monitorização das culturas, o acompanhamento do gado e a agricultura de precisão para obter colheitas maiores e mais inteligentes.
Saiba mais

Vamos construir juntos o futuro da IA!

Começa a tua jornada com o futuro da aprendizagem automática