OpenPose란 무엇인가요? 포즈 추정의 이정표 살펴보기
컴퓨터 비전 애플리케이션에서 포즈 추정에 OpenPose를 활용하는 방법을 살펴보세요. OpenPose의 기능과 비전 AI에서의 중요성을 알아보세요.

오늘날 이미지와 카메라는 어디에나 있습니다. 휴대폰과 가정은 물론 공공장소에도 내장되어 있습니다. 우리는 카메라를 단순히 순간을 기록하는 데만 사용하는 것이 아니라, 주변 세계를 이해하고 상호작용하는 데에도 활용합니다.
이 과정의 이면에서는 인공지능 (AI)의 하위 분야인 컴퓨터 비전이 머신이 시각 데이터를 해석할 수 있도록 하여 이를 가능하게 합니다. 컴퓨터 비전을 통해 시스템은 객체를 탐지하고, 얼굴을 인식하며, 움직임을 추적할 수 있어 우리가 매일 사용하는 다양한 기술에서 핵심적인 역할을 합니다.
최근 AI의 발전 덕분에 컴퓨터 비전 모델은 이제 더욱 복잡한 데이터와 인사이트를 분석하고 추출할 수 있습니다. 그중 한 가지 예가 포즈 추정으로, 사람의 움직임을 이해하는 데 초점을 둔 컴퓨터 비전 작업입니다.
포즈 추정은 이미지나 동영상에서 어깨, 팔꿈치, 무릎과 같은 신체의 주요 지점을 식별하는 방식으로 작동합니다. 이를 통해 사람이 어떻게 움직이는지 분석할 수 있어 피트니스 추적, 애니메이션, 헬스케어 등 다양한 분야에서 활용할 수 있습니다.
포즈 추정을 위해 개발된 여러 도구 중 OpenPose는 중요한 획기적 발전으로 손꼽힙니다. Carnegie Mellon University의 Perceptual Computing Lab 연구자들이 개발한 OpenPose는 카메라 하나만 사용해 여러 사람의 전신 포즈를 실시간으로 탐지할 수 있는 최초의 오픈 소스 시스템 중 하나였습니다. 여기에는 손, 발, 얼굴 키포인트가 포함되며, 사람당 최대 135개의 키포인트를 지원합니다.
이 글에서는 OpenPose와 작동 방식, 그리고 컴퓨터 비전의 이정표로서 OpenPose가 갖는 의미를 살펴봅니다.

그림 1. OpenPose를 사용한 다중 인물 포즈 추정.
포즈 추정의 역사 살펴보기#
AI가 널리 도입되기 전에는 동영상에서 사람의 움직임을 추적하려면 특수 장비를 사용해야 했습니다. 영화 및 애니메이션과 같은 산업에서는 배우가 반사 마커가 부착된 슈트를 착용하는 경우가 많았으며, 카메라는 통제된 스튜디오 환경에서 배우의 움직임을 촬영할 수 있었습니다.
이러한 마커 기반 모션 캡처 기술은 정확했지만 비용이 많이 들고 특정 환경으로 제한되었습니다. 컴퓨터 비전이 발전하면서 연구자들은 마커 없이 신체 움직임을 추적하는 방법을 모색했습니다. 이들은 이미지에서 사람의 형태를 찾기 위해 에지, 윤곽선, 템플릿을 사용했습니다.
이러한 초기 시스템은 단순하고 명확한 상황에서는 작동했지만 실제 환경에서는 어려움을 겪었습니다. 사람이 예상치 못한 방식으로 움직이거나 한 프레임에 두 명 이상의 사람이 나타나면 결과가 좋지 않은 경우가 많았습니다.
2010년대 후반, 딥러닝은 포즈 추정에 큰 변화를 가져왔습니다. Vision AI 모델은 사람 포즈로 구성된 대규모 데이터셋을 사용해 학습할 수 있었습니다. 모델은 에지와 템플릿에 의존하는 대신 수천 개의 라벨링된 이미지를 분석하며 신체 관절과 구조를 인식하는 방법을 학습했습니다. 이로 인해 포즈 추정은 더욱 정확하고 유연해졌으며, 더 다양한 환경에서 큰 영향을 미칠 수 있게 되었습니다.

그림 2. 2017년부터 2023년까지 사람 포즈 추정 모델의 발전.
현대적인 포즈 추정의 출발점이 된 OpenPose#
OpenPose는 2017년에 처음 출시되었으며, 하나의 이미지에서 여러 사람의 포즈를 동시에 추정할 수 있습니다. 기존 시스템과 달리 OpenPose는 특수 슈트나 마커가 필요하지 않습니다. 일반 카메라로 작동하며 이미지와 동영상을 실시간으로 처리할 수 있습니다. 이러한 특징 덕분에 개발자와 연구자가 포즈 추정 기술에 더 쉽게 접근할 수 있게 되었습니다.
OpenPose가 컴퓨터 비전을 위해 마련한 기반은 다른 연구자들이 다양한 애플리케이션을 위한 새로운 아키텍처를 구축하는 데 도움을 주었습니다. 오늘날 Ultralytics YOLOv8 및 Ultralytics YOLO11처럼 포즈 추정 작업을 지원하는 Vision AI 모델은 더 빠른 결과와 더 낮은 지연 시간을 제공합니다.

그림 3. 포즈 추정에 YOLO11 사용.
하지만 포즈 추정의 발전 과정이 궁금하다면 OpenPose는 훌륭한 출발점입니다. OpenPose는 오늘날에도 많은 최신 시스템이 의존하는 핵심 아이디어를 제시했습니다.
OpenPose의 주요 기능#
이제 OpenPose가 중요한 이유를 더 잘 이해했으므로, OpenPose가 실제로 무엇을 할 수 있는지 자세히 살펴보겠습니다.
OpenPose 기능의 핵심에는 키포인트 탐지라는 기술이 있습니다. 키포인트는 코끝, 어깨 중앙, 팔꿈치, 손목, 엉덩이, 무릎, 발목과 같은 인체의 특정 랜드마크입니다. OpenPose는 손가락이나 얼굴 특징과 같은 세부 영역을 포함해 사람마다 최대 135개의 키포인트를 탐지할 수 있습니다.
이 지점들을 연결하면 인체를 단순화한 표현이 만들어지며, 이를 디지털 스켈레톤이라고 생각할 수 있습니다. 이 스켈레톤 윤곽은 사람이 어디에 있는지만 보여주는 것이 아니라 어떤 자세를 취하고 있는지도 나타냅니다. 예를 들어 앉아 있는지, 서 있는지, 손을 흔드는지, 웃고 있는지, 걷고 있는지를 알 수 있습니다. 컴퓨터는 우리가 본능적으로 사람의 보디랭귀지를 이해하는 것과 유사하게 이러한 스켈레톤을 사용해 사람의 움직임을 시각적으로 해석할 수 있습니다.
스켈레탈 추적은 배경의 노이즈와 방해 요소를 제거하여 시스템이 사람의 자세와 움직임에만 집중할 수 있게 하므로 특히 유용합니다. OpenPose는 모든 픽셀을 분석하는 대신 사람이 어떻게 움직이거나 상호작용하는지 보여주는 의미 있는 지점에 집중합니다.
OpenPose는 일상적인 이미지나 동영상에서 이러한 구조화된 정보를 추출함으로써 제스처에 반응하고, 신체 활동을 모니터링하며, 감정적 신호를 평가하거나, 디지털 캐릭터를 애니메이션으로 구현하는 애플리케이션을 구축할 수 있도록 합니다.
OpenPose는 어떻게 작동하나요?#
다음은 OpenPose가 시각 입력에서 인체의 키포인트를 탐지하고 연결하는 방식에 대한 개요입니다.
- 이미지로 시작: OpenPose는 사진, 동영상 또는 실시간 카메라 피드에서 하나의 이미지를 가져옵니다.
- 중요한 신체 부위 탐지: 시스템은 코, 팔꿈치, 손목, 무릎, 발목과 같은 신체의 주요 지점을 찾습니다. 신체 부위가 위치해 있다고 시스템이 확신하는 지점에 표시합니다.
- 어떤 부위가 서로 연결되는지 판단: 다음으로 OpenPose는 키포인트가 어떻게 연결되는지 확인합니다. 수학적 계산을 사용해 어떤 관절이 같은 사람에게 속하는지 판단합니다. 예를 들어 손목을 오른쪽 팔꿈치 및 어깨와 연결합니다.
- 사람마다 스켈레톤 생성: 키포인트를 그룹화한 후 OpenPose는 키포인트를 연결해 각 사람의 포즈를 보여주는 "막대 인형"을 만듭니다. 여러 사람이 동일한 프레임에 나타나는 경우에도 작동합니다.
- 포즈 데이터 반환: 마지막으로 탐지된 모든 키포인트의 정확한 위치를 제공합니다. 이 데이터는 실시간으로 움직임을 추적하고, 제스처를 인식하거나, 인터랙티브 도구를 구축하는 데 사용할 수 있습니다.

그림 4. OpenPose를 사용한 사람 키포인트 탐지 및 추적.
OpenPose를 활용한 산업 전반의 포즈 추정 애플리케이션#
OpenPose는 다양한 실제 사용 사례에서 포즈 추정을 실용적으로 활용할 수 있도록 만든 최초의 고급 도구 중 하나였습니다. 오늘날 실시간 컴퓨터 비전 솔루션에는 일반적으로 사용되지 않지만, 스포츠, 엔터테인먼트, 교육, 안전과 같은 분야의 초기 연구 발전에 중요한 역할을 했습니다.
이러한 분야에서 OpenPose가 어떻게 기반을 마련했는지 자세히 살펴보겠습니다.
피트니스 및 스포츠 분야에서 OpenPose를 활용한 포즈 추정#
야구를 관람할 때 무슨 일이 일어나는지 이해하는 것은 쉽습니다. 투구, 스윙 또는 도루를 즉시 알아볼 수 있습니다. 사람은 신체 움직임을 직관적으로 읽고 큰 노력 없이 그 의미를 파악합니다. 하지만 머신이 이러한 동작을 인식하는 일은 훨씬 더 복잡합니다. 머신에는 신체 각 부분이 공간에서 어떻게 움직이는지에 대한 정밀한 정보가 필요합니다.
OpenPose는 이 컴퓨터 비전 분야에서 중요한 진전이었습니다. 다양한 환경에서 운동 자세를 분석할 수 있는 실용적인 도구였습니다.
많은 연구 프로젝트에서 OpenPose를 사용해 스윙과 점프 같은 움직임을 분석했으며, 선수가 어떻게 움직였는지를 바탕으로 특정 야구 동작을 분류하기도 했습니다. OpenPose는 일반 동영상을 사용해 개방된 환경에서 작동했기 때문에 연구자들은 이러한 시스템이 실제 훈련이나 코칭 상황에서 어떻게 작동할 수 있는지 테스트할 수 있었습니다.
이러한 초기 연구는 현재 고급 스포츠 기술에 사용되는 경기력 추적 도구의 기반을 마련하는 데 도움을 주었습니다.

그림 5. OpenPose를 사용한 야구 동작 분류 파이프라인 살펴보기.
보안 및 안전 시스템에서 OpenPose 활용#
이와 마찬가지로 연구자들은 동영상 기반 포즈 추적이 안전 모니터링을 어떻게 지원할 수 있는지 탐구하기 위해 OpenPose를 사용했습니다. OpenPose는 공공장소에서의 낙상, 예상치 못한 제스처 또는 움직임 패턴과 같은 행동 탐지에 테스트되었습니다.
일반 카메라로 작동했기 때문에 OpenPose는 병원과 교통 허브 같은 환경에서 초기 실험에 더 쉽게 접근할 수 있도록 했습니다. 이러한 연구는 현재 감시, 낙상 탐지, 비상 대응 시스템에 사용되는 최신 모델의 개발을 촉진하는 데 도움을 주었습니다.

그림 6. OpenPose를 활용한 낙상 탐지.
OpenPose의 장단점#
OpenPose가 제공하는 몇 가지 장점을 간략히 살펴보겠습니다.
- 연구 및 프로토타이핑에 유용: 인간-컴퓨터 상호작용, 생체역학, 행동 분석과 같은 분야를 중심으로 학술 연구에서 광범위하게 사용되었습니다.
- 크로스 플랫폼 지원: Windows, Linux, macOS에서 실행할 수 있으며 중앙 처리 장치 (CPUs)와 그래픽 처리 장치 (GPUs)를 모두 지원합니다.
- 오프라인 처리 기능: 인터넷에 연결되지 않은 환경에서도 실행할 수 있으므로 헬스케어나 교육처럼 개인정보 보호가 중요한 환경에 적합합니다.
OpenPose는 큰 진전을 이루었지만, 고려해야 할 기술적 한계도 있습니다. OpenPose와 관련된 주요 과제는 다음과 같습니다.
- 높은 처리 요구 사항: OpenPose를 실시간으로 실행하려면 강력한 GPU와 상당한 컴퓨팅 리소스가 필요합니다.
- 환경에 민감: 조도가 낮거나 공간이 혼잡한 경우, 또는 카메라 각도가 적절하지 않은 경우 성능이 저하될 수 있습니다.
- 최신 모델에 비해 무거움: 최신 포즈 추정 모델과 비교하면 OpenPose는 상대적으로 크고 느립니다. 스마트폰, 태블릿 또는 임베디드 시스템과 같은 리소스가 제한된 디바이스에 배포하기에는 적합하지 않습니다.
핵심 요점#
OpenPose는 포즈 추정에 더 쉽게 접근할 수 있도록 만드는 데 중요한 역할을 했습니다. 슈트나 특수 장비에 의존하지 않고 간단한 카메라만으로 신체 움직임을 추적할 수 있다는 것을 보여주었습니다.
OpenPose는 헬스케어, 교육, 엔터테인먼트, 연구 전반에서 다양한 실용적 애플리케이션의 기반을 마련했습니다. 최신 모델이 이제 더 빠른 속도와 가벼운 성능을 제공하지만, OpenPose는 포즈 추정의 발전 과정을 이해하는 데 여전히 중요한 참고점으로 남아 있습니다.
커뮤니티에 참여하고 GitHub 저장소를 방문하여 AI에 대해 자세히 알아보세요. 자체 컴퓨터 비전 솔루션을 구축하려는 경우 라이선스 옵션을 살펴보세요. 또한 헬스케어 분야의 컴퓨터 비전과 물류 분야의 AI가 어떻게 영향을 미치고 있는지도 확인해 보세요!









