Vision AI 애플리케이션을 위한 다양한 데이터 유형 살펴보기
열화상, LiDAR 및 적외선 이미지와 같은 시각 데이터 유형이 산업 전반에서 다양한 컴퓨터 비전 애플리케이션을 지원하는 방법을 알아보세요.

드론과 같은 기술은 과거에는 제한적이었고 연구자와 전문가만 이용할 수 있었지만, 오늘날에는 최첨단 하드웨어가 더 많은 사람에게 접근 가능해지고 있습니다. 이러한 변화는 시각 데이터를 수집하는 방식을 바꾸고 있습니다. 기술에 대한 접근성이 높아지면서 이제 기존 카메라뿐 아니라 다양한 소스에서 이미지와 동영상을 캡처할 수 있습니다.
이와 동시에 인공지능(AI)의 한 분야인 컴퓨터 비전을 통해 구현되는 이미지 분석이 빠르게 발전하면서, 기계가 시각 데이터를 더욱 효과적으로 해석하고 처리할 수 있게 되었습니다. 이러한 발전은 자동화, 객체 감지, 실시간 분석을 위한 새로운 가능성을 열었습니다. 이제 기계는 패턴을 인식하고 움직임을 추적하며 복잡한 시각 입력을 이해할 수 있습니다.
주요 시각 데이터 유형으로는 객체 인식에 일반적으로 사용되는 RGB(빨강, 초록, 파랑) 이미지, 저조도 환경에서 열 신호를 감지하는 데 도움이 되는 열화상 데이터, 기계가 3D 환경을 이해할 수 있도록 하는 깊이 데이터 등이 있습니다. 이러한 각 데이터 유형은 감시부터 의료 영상에 이르기까지 다양한 비전 AI 애플리케이션을 구현하는 데 중요한 역할을 합니다.
이 글에서는 비전 AI에 사용되는 주요 시각 데이터 유형을 살펴보고, 각 유형이 다양한 산업 분야에서 정확도, 효율성 및 성능 향상에 어떻게 기여하는지 알아보겠습니다. 시작해 보겠습니다!
가장 일반적인 AI 이미지 및 동영상 데이터셋 유형#
일반적으로 스마트폰으로 사진을 찍거나 CCTV 영상을 볼 때는 RGB 이미지를 사용합니다. RGB는 빨강, 초록, 파랑을 의미하며, 디지털 이미지에서 시각 정보를 나타내는 세 가지 색상 채널입니다.
RGB 이미지와 동영상은 모두 표준 카메라로 캡처되는, 컴퓨터 비전에 사용되는 밀접하게 관련된 시각 데이터 유형입니다. 주요 차이점은 이미지가 하나의 순간을 캡처하는 반면, 동영상은 시간에 따른 변화를 보여 주는 프레임의 연속이라는 점입니다.
RGB 이미지는 일반적으로 컴퓨터 비전 작업에서 객체 감지, 인스턴스 세그멘테이션, 포즈 추정 등에 사용되며, Ultralytics YOLO11과 같은 모델이 이를 지원합니다. 이러한 애플리케이션은 단일 프레임에서 패턴, 형태 또는 특정 특징을 식별하는 데 의존합니다.
반면 동영상은 제스처 인식, 감시 또는 동작 추적과 같이 움직임이나 시간이 중요한 경우에 필수적입니다. 동영상은 이미지의 연속으로 볼 수 있으므로 Ultralytics YOLO11과 같은 컴퓨터 비전 모델은 시간에 따른 움직임과 동작을 이해하기 위해 프레임 단위로 동영상을 처리합니다.
예를 들어 Ultralytics YOLO11을 사용하면 RGB 이미지 또는 동영상을 분석하여 농경지의 잡초를 감지하고 식물 수를 셀 수 있습니다. 이를 통해 작물 모니터링을 개선하고 생장 주기 전반의 변화를 추적하여 농장 관리를 더욱 효율적으로 수행할 수 있습니다.

그림 1. YOLO11은 더욱 스마트한 작물 모니터링을 위해 식물을 감지하고 개수를 셀 수 있습니다.
비전 AI의 깊이 데이터: LiDAR와 3D 인식#
깊이 데이터는 객체가 카메라 또는 센서에서 얼마나 떨어져 있는지를 나타내 시각 정보에 세 번째 차원을 추가합니다. 색상과 질감만 캡처하는 RGB 이미지와 달리 깊이 데이터는 공간적 맥락을 제공합니다. 객체와 카메라 사이의 거리를 보여 주므로 장면의 3D 배치를 해석할 수 있습니다.
이러한 유형의 데이터는 LiDAR, 스테레오 비전(사람의 깊이 인식을 모방하기 위해 두 대의 카메라를 사용하는 방식), ToF(Time-of-Flight, 비행 시간) 카메라와 같은 기술을 사용하여 캡처합니다.
이 가운데 LiDAR(광 탐지 및 거리 측정)는 깊이 측정에 가장 신뢰할 수 있는 기술인 경우가 많습니다. LiDAR는 빠른 레이저 펄스를 발사하고 펄스가 반사되어 돌아오는 데 걸리는 시간을 측정하는 방식으로 작동합니다. 그 결과 포인트 클라우드라고 하는 매우 정확한 3D 지도가 생성되며, 이를 통해 객체의 형태, 위치 및 거리를 실시간으로 파악할 수 있습니다.
비전 AI 시스템에서 점점 중요해지는 LiDAR의 역할#
LiDAR 기술은 두 가지 주요 유형으로 나눌 수 있으며, 각 유형은 특정 애플리케이션과 환경에 맞게 설계되었습니다. 두 유형을 자세히 살펴보겠습니다.
- 공중 LiDAR: 일반적으로 넓은 영역을 매핑하는 데 사용되는 공중 LiDAR 스캐너는 드론이나 항공기에 장착되어 대규모 지형 매핑을 위한 고해상도 데이터를 캡처합니다. 지형, 숲, 경관을 측량하는 데 적합합니다.
- 지상 LiDAR: 이 유형의 LiDAR 데이터는 인프라 모니터링, 건설, 실내 매핑 등의 애플리케이션을 위해 차량이나 고정 플랫폼에 장착된 센서로 수집합니다. 더 작고 국지적인 영역에 대해 매우 상세한 데이터를 제공하므로 도시 계획이나 특정 구조물 측량과 같은 작업에 유용합니다.
LiDAR 데이터의 효과적인 활용 사례 중 하나는 자율주행 차량입니다. 자율주행 차량에서 LiDAR는 차선 감지, 충돌 방지, 주변 객체 식별과 같은 작업에서 핵심적인 역할을 합니다. LiDAR는 환경의 상세한 실시간 3D 지도를 생성하여 차량이 객체를 확인하고 거리를 계산하며 안전하게 주행할 수 있도록 합니다.

그림 2. LiDAR 기술은 자율주행 차량이 깊이를 매핑하고 객체를 감지할 수 있도록 지원합니다.
AI 애플리케이션에서 열화상 및 적외선 데이터 활용하기#
RGB 이미지는 가시광선 스펙트럼에서 우리가 보는 것을 캡처하지만, 열화상 및 적외선 영상과 같은 다른 영상 기술은 이를 넘어섭니다. 적외선 영상은 객체에서 방출되거나 반사되는 적외선을 캡처하므로 저조도 환경에서 유용합니다.
반면 열화상 영상은 객체에서 방출되는 열을 감지하고 온도 차이를 표시하므로 완전한 어둠 속에서도, 또는 연기와 안개 및 기타 장애물을 통과해서도 작동할 수 있습니다. 이러한 유형의 데이터는 온도 변화가 잠재적인 문제를 나타낼 수 있는 산업 분야를 비롯해 문제를 모니터링하고 감지하는 데 특히 유용합니다.
흥미로운 사례로 과열 징후를 확인하기 위해 전기 부품을 열화상으로 모니터링하는 방법이 있습니다. 열화상 카메라는 온도 차이를 감지하여 장비 고장, 화재 또는 비용이 많이 드는 손상으로 이어지기 전에 문제를 식별할 수 있습니다.

그림 3. 전기 부품 모니터링에 열화상 영상을 사용하는 예입니다.
마찬가지로 적외선 이미지는 온도 차이를 식별하여 파이프라인이나 단열재의 누출을 감지하는 데 도움이 될 수 있습니다. 이러한 온도 차이는 가스나 유체가 새고 있음을 나타내며, 위험한 상황을 방지하고 에너지 효율성을 개선하는 데 중요합니다.
AI의 다중분광 및 초분광 영상#
적외선 및 열화상 영상이 전자기 스펙트럼의 특정 측면을 캡처하는 반면, 다중분광 영상은 여러 선택된 파장 범위에서 빛을 수집합니다. 각 파장 범위는 건강한 식생을 감지하거나 표면 물질을 식별하는 등 특정 목적에 맞게 선택됩니다.
초분광 영상은 수백 개의 매우 좁고 연속적인 파장 범위에서 빛을 캡처하여 이를 한 단계 더 발전시킵니다. 이를 통해 이미지의 각 픽셀에 대한 상세한 광학 시그니처를 제공하고, 관찰 중인 물질을 훨씬 더 깊이 이해할 수 있습니다.

그림 4. 다중분광 영상과 초분광 영상을 비교한 모습입니다.
다중분광 영상과 초분광 영상은 모두 특수 센서와 필터를 사용하여 서로 다른 파장에서 빛을 캡처합니다. 그런 다음 데이터를 스펙트럴 큐브라는 3D 구조로 구성하며, 각 레이어는 서로 다른 파장을 나타냅니다.
AI 모델은 이러한 데이터를 분석하여 일반 카메라나 사람의 눈으로는 볼 수 없는 특징을 감지할 수 있습니다. 예를 들어 식물 표현형 분석에서는 초분광 영상을 사용하여 잎이나 줄기의 미묘한 변화, 예를 들어 영양 결핍이나 스트레스를 감지함으로써 식물의 건강과 생장을 모니터링할 수 있습니다. 이를 통해 연구자는 침습적인 방법을 사용하지 않고도 식물의 건강을 평가하고 농업 관행을 최적화할 수 있습니다.
AI를 사용한 레이더 및 소나 영상 분석#
레이더와 소나 영상은 LiDAR와 유사하게 신호를 발사하고 반사 신호를 분석하여 객체를 감지하고 매핑하는 기술입니다. 시각 정보를 캡처하기 위해 광파에 의존하는 RGB 영상과 달리, 레이더는 일반적으로 전파와 같은 전자기파를 사용하며 소나는 음파를 사용합니다. 레이더와 소나 시스템은 모두 펄스를 방출하고 신호가 객체에서 반사되어 돌아오는 데 걸리는 시간을 측정하여 객체의 거리, 크기 및 속도에 대한 정보를 제공합니다.
레이더 영상은 안개, 비 또는 야간과 같이 가시성이 낮은 상황에서 특히 유용합니다. 빛에 의존하지 않기 때문에 완전한 어둠 속에서도 항공기, 차량 또는 지형을 감지할 수 있습니다. 따라서 레이더는 항공, 기상 모니터링 및 자율 항법에서 신뢰할 수 있는 선택지입니다.
반면 소나 영상은 빛이 도달할 수 없는 수중 환경에서 일반적으로 사용됩니다. 소나는 물속을 이동하고 잠긴 객체에 반사되는 음파를 사용하므로 잠수함 감지, 해저 매핑 및 수중 구조 임무 수행이 가능합니다. 최근 컴퓨터 비전의 발전으로 소나 데이터와 지능형 분석을 결합하여 감지 및 의사 결정을 개선하는 방식으로 수중 감지를 더욱 향상할 수 있게 되었습니다.

그림 5. SONAR 시스템이 초음파 펄스를 사용하여 해저 깊이를 측정하는 방식입니다. (출처: bbc.co.uk)
AI 모델 학습을 위한 합성 및 시뮬레이션 시각 데이터#
지금까지 살펴본 다양한 데이터 유형은 현실 세계에서 수집할 수 있는 데이터였습니다. 그러나 합성 시각 데이터와 시뮬레이션 시각 데이터는 모두 인공적으로 생성된 콘텐츠 유형입니다. 합성 데이터는 3D 모델링 또는 생성형 AI를 사용하여 처음부터 생성되며, 실제와 유사한 이미지나 동영상을 만듭니다.

그림 6. 합성으로 생성된 이미지의 모습입니다.
시뮬레이션 데이터는 이와 유사하지만 빛의 반사, 그림자 형성, 객체의 움직임을 비롯해 물리적 세계의 작동 방식을 재현하는 가상 환경을 생성합니다. 모든 시뮬레이션 시각 데이터는 합성 데이터이지만, 모든 합성 데이터가 시뮬레이션 데이터인 것은 아닙니다. 핵심적인 차이점은 시뮬레이션 데이터가 단순한 외형이 아니라 현실적인 동작을 재현한다는 점입니다.
이러한 데이터 유형은 컴퓨터 비전 모델을 학습하는 데 유용하며, 특히 현실 세계의 데이터를 수집하기 어렵거나 특정하고 드문 상황을 시뮬레이션해야 할 때 효과적입니다. 개발자는 전체 장면을 만들고 객체 유형, 위치 및 조명을 선택한 다음 학습을 위한 바운딩 박스와 같은 레이블을 자동으로 추가할 수 있습니다. 이를 통해 비용과 시간이 많이 드는 실제 사진이나 수동 라벨링 없이도 크고 다양한 데이터셋을 신속하게 구축할 수 있습니다.
예를 들어 의료 분야에서는 실제 이미지의 대규모 데이터셋을 수집하고 라벨링하기 어려운 유방암 세포 세그멘테이션 모델을 학습하는 데 합성 데이터를 사용할 수 있습니다. 합성 및 시뮬레이션 데이터는 유연성과 제어 기능을 제공하여 현실 세계의 시각 데이터가 부족한 부분을 보완합니다.
AI 애플리케이션에 적합한 시각 데이터 유형 선택하기#
이제 다양한 시각 데이터 유형이 어떻게 작동하고 무엇을 할 수 있는지 살펴보았으므로, 특정 작업에 어떤 데이터 유형이 가장 적합한지 자세히 알아보겠습니다.
- RGB 이미지: 이미지 분류 및 객체 감지와 같은 일반적인 컴퓨터 비전 작업에 적합합니다. 색상과 질감을 캡처하지만 저조도나 낮은 가시성과 같은 까다로운 조건에서는 한계가 있습니다.
- LiDAR 영상: 이 영상 유형은 레이저 펄스를 사용하여 고정밀 3D 매핑을 제공합니다. 로보틱스, 자율주행 차량 및 인프라 검사와 같이 정확한 거리 측정이 필요한 애플리케이션에 적합합니다.
- 열화상 영상: 온도 차이를 감지할 수 있으므로 야간 모니터링, 소방 또는 기계와 건물의 열 누출 감지와 같은 낮은 가시성 환경에서 유용합니다.
- 다중분광 및 초분광 영상: 농업 모니터링, 제약 품질 관리 또는 원격 감지와 같이 상세한 물질 분석이 필요한 작업에 유용합니다. 이러한 방법은 가시광선을 넘어서는 넓은 범위의 파장에서 데이터를 캡처하여 더욱 심층적인 인사이트를 제공합니다.
- 레이더 및 소나 영상: 낮은 가시성 환경에서 선호됩니다. 레이더는 전파를 사용하여 항공 및 항법에 유용하며, 소나는 음파를 사용하여 수중 감지를 수행합니다.
- 합성 및 시뮬레이션 시각 데이터: 현실 세계의 데이터가 제한적이거나, 이용할 수 없거나, 라벨링하기 어려울 때 AI 모델 학습에 적합합니다. 이러한 인공 시각 데이터는 희귀한 사건이나 안전이 중요한 조건과 같은 복잡한 시나리오를 위한 다양한 데이터셋을 구축하는 데 도움이 됩니다.
때로는 단일 데이터 유형만으로는 현실 세계의 상황에서 충분한 정확도나 맥락을 제공하지 못할 수 있습니다. 이때 멀티모달 센서 융합이 핵심적인 역할을 합니다. RGB를 열화상, 깊이 또는 LiDAR와 같은 다른 데이터 유형과 결합하면 시스템이 각 데이터 유형의 개별적인 한계를 극복하여 신뢰성과 적응성을 향상할 수 있습니다.
예를 들어 창고 자동화에서는 객체 인식에 RGB를 사용하고, 거리 측정에 깊이 데이터를 사용하며, 과열된 장비 감지에 열화상 데이터를 사용하면 운영을 더욱 효율적이고 안전하게 수행할 수 있습니다. 궁극적으로 최상의 결과는 애플리케이션의 구체적인 요구 사항에 따라 데이터 유형을 선택하거나 결합할 때 얻을 수 있습니다.
핵심 요점#
비전 AI 모델을 구축할 때는 적합한 시각 데이터 유형을 선택하는 것이 중요합니다. 객체 감지, 세그멘테이션 및 동작 추적과 같은 작업은 알고리즘뿐 아니라 입력 데이터의 품질에도 좌우됩니다. 정제되고 다양하며 정확한 데이터셋은 노이즈를 줄이고 성능을 향상하는 데 도움이 됩니다.
RGB, 깊이, 열화상 및 LiDAR와 같은 데이터 유형을 결합하면 AI 시스템이 환경을 더욱 완전하게 파악할 수 있어 다양한 조건에서 신뢰성이 향상됩니다. 기술이 계속 발전함에 따라 비전 AI는 산업 전반에서 더욱 빠르고 적응력이 뛰어나며 영향력 있는 기술로 발전할 가능성이 큽니다.
커뮤니티에 참여하고 GitHub 리포지토리를 살펴보며 컴퓨터 비전에 대해 자세히 알아보세요. 솔루션 페이지에서 의료 분야의 AI 및 리테일 분야의 컴퓨터 비전과 관련된 다양한 애플리케이션을 확인해 보세요. 비전 AI를 시작하려면 라이선스 옵션을 살펴보세요.









