Ultralytics YOLO27:
가이드

단안 깊이 추정이란 무엇인가요? 개요

단안 깊이 추정의 작동 방식, 센서 기반 깊이 측정 방법과의 비교, 그리고 비전 시스템에서 확장 가능한 3D 인식을 지원하는 방식을 알아보세요.

ABAbirami Vina15 min read
단안 깊이 추정을 사용해 생성한 예측 깊이 맵

자율주행 자동차는 안전하게 주행할 수 있도록 주변에서 일어나는 일을 이해하도록 설계되었습니다. 이를 위해서는 보행자나 다른 차량과 같은 객체를 단순히 인식하는 것 이상이 필요합니다.

또한 올바르게 대응하려면 해당 객체가 얼마나 멀리 있는지 알아야 합니다. 하지만 기계에 이러한 거리 감각을 부여하는 일은 간단하지 않습니다. 인간과 달리 기계는 이미지에서 자연스럽게 깊이를 인식하지 못하므로, 이를 학습하도록 명시적으로 가르쳐야 합니다.

그 이유 중 하나는 대부분의 카메라가 세상을 평면적인 2차원 이미지로 캡처하기 때문입니다. 이러한 이미지를 실제 세계의 깊이와 3D 구조를 반영하는 정보로 변환하는 일은 까다롭습니다. 특히 시스템이 일상적인 환경에서 안정적으로 작동해야 할 때 더욱 그렇습니다.

흥미롭게도 시각 데이터를 해석하고 이해하는 데 중점을 둔 AI 분야인 컴퓨터 비전을 활용하면 기계가 이미지에서 세상을 더 잘 이해할 수 있습니다. 예를 들어 단안 깊이 추정은 단일 카메라 이미지 만으로 객체의 거리를 추정하는 컴퓨터 비전 기술입니다.

이러한 모델은 객체 크기, 원근, 텍스처, 음영과 같은 시각적 단서를 학습하여 LiDAR(빛 감지 및 거리 측정)나 스테레오 카메라와 같은 추가 센서 없이도 깊이를 예측할 수 있습니다. 이 글에서는 단안 깊이 추정이 무엇인지, 어떻게 작동하는지, 실제 응용 분야에는 어떤 것들이 있는지 살펴보겠습니다. 시작해 보겠습니다!

단안 깊이 추정 빠르게 알아보기#

단안 깊이 추정을 사용하면 기계가 단일 이미지만으로 객체가 얼마나 멀리 있는지 이해할 수 있습니다. 하나의 카메라만 사용하므로 비용이 낮고 하드웨어 요구 사항이 간단하다는 등 여러 장점이 있습니다.

예를 들어 단일 카메라로 작동하는 경제적인 가정용 로봇에 사용할 수 있습니다. 로봇 시스템은 단일 이미지만으로도 어느 벽이 더 가까이 있고 어느 문이 더 멀리 있는지 식별하며 공간의 전반적인 깊이를 추론할 수 있습니다.

단일 이미지에는 정확한 스케일의 정보가 포함되지 않는 경우가 많으므로, 단안 깊이 추정은 일반적으로 상대적 깊이에 초점을 맞춥니다. 즉, 정확한 거리를 알 수 없더라도 어떤 객체가 더 가깝고 어떤 객체가 더 먼지 판단할 수 있습니다.

모델을 LiDAR와 같은 센서에서 얻은 깊이 측정값처럼 실제 거리 또는 절대 깊이의 정답 데이터로 학습하면 미터와 같은 실제 단위로 거리를 예측하는 방법을 학습할 수 있습니다. 이러한 참조 데이터가 없으면 모델은 상대적 깊이를 추론할 수는 있지만 절대 거리를 안정적으로 추정할 수는 없습니다.

단안 깊이 추정의 출력은 일반적으로 깊이 맵입니다. 깊이 맵은 각 픽셀이 장면의 해당 부분이 얼마나 가깝거나 먼지를 나타내는 이미지입니다. 깊이 맵은 비전 시스템이 환경의 기본적인 3D 구조를 이해하도록 돕습니다.

단안 깊이 추정을 사용해 생성한 예측 깊이 맵의 예시

그림 1. 단안 깊이 추정을 사용해 생성한 예측 깊이 맵의 예시 (출처)

센서에서 이미지까지: 깊이 추정#

깊이 추정은 사용 가능한 센서, 하드웨어 제약, 정확도 요구 사항에 따라 여러 방식으로 접근할 수 있습니다. 기존 방법은 여러 시점이나 특수 센서를 사용하여 거리를 직접 측정하는 경우가 많습니다.

일반적인 접근 방식 중 하나는 스테레오 비전입니다. 스테레오 비전은 서로 조금 다른 시점에서 캡처한 동기화된 두 이미지를 비교하여 깊이를 추정합니다. 두 이미지에서 대응하는 점 사이의 차이를 측정하면 시스템이 객체가 카메라에서 얼마나 멀리 떨어져 있는지 추론할 수 있습니다.

또 다른 접근 방식은 RGB-D(적색, 녹색, 청색 및 깊이) 시스템입니다. RGB-D 시스템은 능동 깊이 센서를 사용하여 각 픽셀의 거리를 직접 측정합니다. 이러한 시스템은 통제된 환경에서 정확한 깊이 정보를 제공할 수 있지만 추가 하드웨어가 필요합니다.

한편 LiDAR 기반 방법은 레이저 펄스를 사용하여 장면의 정밀한 3차원 표현을 생성합니다. LiDAR 센서는 매우 정확하지만 대체로 비용이 높고 하드웨어 복잡성을 크게 증가시킵니다.

반면 단안 깊이 추정은 단일 RGB 이미지만 사용하여 깊이를 추론합니다. 여러 카메라나 특수 센서에 의존하지 않으므로 대규모로 배포하기가 더 쉽고, 비용과 하드웨어 리소스가 제한된 경우에 적합합니다.

단일 이미지에서 깊이 학습하기#

단일 이미지에서 깊이를 추정할 때 단안 깊이 모델은 인간이 본능적으로 거리를 판단할 때 사용하는 시각적 단서를 인식하도록 학습합니다. 이러한 단서에는 원근선, 객체 크기, 텍스처 밀도, 객체 간 겹침, 음영이 포함되며, 모두 객체가 카메라에서 얼마나 멀리 있는지에 대한 정보를 제공합니다.

이러한 단서가 함께 작용하여 깊이감을 만듭니다. 더 작게 보이거나 일부가 가려진 객체는 대개 더 멀리 있으며, 더 선명한 세부 정보와 더 크게 보이는 외형은 일반적으로 무언가가 더 가까이 있음을 나타냅니다.

이러한 패턴을 학습하기 위해 단안 깊이 모델은 대규모 이미지 데이터셋으로 학습하며, 여기에 LiDAR나 스테레오 시스템과 같은 다른 소스에서 얻은 깊이 정보가 함께 제공되는 경우가 많습니다. 학습 중 모델은 시각적 단서와 깊이의 관계를 학습하므로 추론 시 단일 이미지에서 거리를 추론할 수 있습니다.

다양한 학습 데이터를 사용하면 최신 비전 모델이 실내 및 실외 장면을 포함한 광범위한 환경에서 학습한 이해를 일반화하고 익숙하지 않은 시점에도 대응할 수 있습니다.

다양한 단안 깊이 추정 기법 살펴보기#

이제 단일 이미지에서 깊이를 추정하는 데 사용되는 주요 접근 방식과 이러한 방법이 시간에 따라 어떻게 발전해 왔는지 살펴보겠습니다.

고전적 접근 방식과 기하학 기반 접근 방식#

초기의 깊이 추정 방법은 카메라 기하학에 기반한 단순한 시각적 규칙에 의존했습니다. 원근, 객체 크기, 한 객체가 다른 객체를 가리는지 여부와 같은 단서를 사용하여 거리를 추정했습니다.

예를 들어 두 개의 유사한 객체가 서로 다른 크기로 보이면 더 작은 객체가 더 멀리 있다고 가정했습니다. 이러한 접근 방식은 조명, 카메라 위치, 장면 배치와 같은 요소가 일정하게 유지되는 통제된 환경에서 비교적 잘 작동했습니다.

하지만 실제 장면에서는 이러한 가정이 자주 무너집니다. 조명의 변화, 시점의 변화, 장면 복잡성의 증가는 신뢰하기 어려운 깊이 추정으로 이어질 수 있으며, 통제되지 않은 환경에서 고전적 방법의 효과를 제한합니다.

초기 머신 러닝 접근 방식#

초기의 머신 러닝 방법은 데이터에서 직접 패턴을 학습하여 깊이 추정에 더 큰 유연성을 제공했습니다. 고정된 기하학 규칙에만 의존하는 대신, 이러한 모델은 시각 정보와 거리 사이의 관계를 학습하려 했으며, 에지, 텍스처, 색상 변화와 같은 단서를 기반으로 깊이 예측을 회귀 문제로 다루었습니다.

이러한 특징을 선택하는 일은 과정의 핵심 부분이었습니다. 엔지니어는 어떤 시각적 신호를 추출하고 어떻게 표현할지 결정해야 했으며, 모델의 성능은 이러한 선택에 크게 좌우되었습니다.

이 접근 방식은 이전 방법보다 더 잘 작동했지만 여전히 한계가 있었습니다. 선택한 특징에 중요한 맥락이 부족하면 깊이 예측의 정확도가 낮아졌습니다. 장면이 더 복잡하고 다양해짐에 따라 이러한 모델은 신뢰할 수 있는 결과를 생성하는 데 어려움을 겪는 경우가 많았습니다.

딥 러닝 알고리즘#

대부분의 최신 단안 깊이 추정 시스템은 데이터에서 복잡한 패턴을 학습할 수 있는 다층 신경망을 의미하는 딥 러닝을 사용합니다. 이러한 모델은 이미지에서 직접 깊이를 예측하고 깊이 맵을 생성하도록 학습합니다.

많은 접근 방식은 합성곱 신경망(CNN)을 사용하여 구축됩니다. CNN은 에지와 형태 같은 패턴을 감지하여 이미지를 처리하도록 설계된 신경망입니다. 이러한 모델은 인코더-디코더 구조를 사용하는 경우가 많습니다. 인코더는 이미지에서 시각적 특징을 추출하고, 디코더는 이러한 특징을 깊이 맵으로 변환합니다. 여러 스케일에서 이미지를 처리하면 모델이 장면의 전체적인 배치를 파악하면서도 명확한 객체 경계를 포착할 수 있습니다.

보다 최근의 모델은 이미지의 서로 다른 부분 간 관계를 이해하는 데 중점을 둡니다. Transformer 기반 모델과 비전 Transformer(ViT) 모델은 어텐션 메커니즘을 사용하여 이미지에서 가장 관련성 높은 영역을 식별하고 멀리 떨어진 영역들을 서로 연결할 수 있습니다. 이를 통해 모델은 장면 전체에서 깊이에 대한 더 일관된 이해를 구축합니다.

일부 시스템은 두 가지 아이디어를 결합합니다. 하이브리드 CNN-Transformer 모델은 CNN을 사용하여 세밀한 로컬 정보를 포착하고 Transformer를 사용하여 장면의 전역 맥락을 모델링합니다. 이는 정확도를 향상시키는 경우가 많지만 추가 메모리와 처리 성능 같은 더 많은 컴퓨팅 리소스가 일반적으로 필요합니다.

비전 AI 시스템에서 깊이 이해가 중요한 이유#

단안 깊이 추정에 대해 알아가면서 깊이 이해가 비전 기반 AI 시스템에서 왜 중요한 부분인지 궁금할 수 있습니다.

시스템이 객체와 표면이 얼마나 멀리 있는지 추정할 수 있으면 장면이 어떻게 배치되어 있고 서로 다른 요소가 어떤 관계를 맺는지 더 잘 이해할 수 있습니다. 이러한 공간 인식은 특히 자율주행과 같은 실제 응용 분야에서 신뢰할 수 있는 결정을 내리는 데 필수적입니다.

깊이 정보는 다른 컴퓨터 비전 작업에도 중요한 맥락을 더해 줍니다. 예를 들어 Ultralytics YOLO26과 같은 모델이 지원하는 객체 검출은 장면에 무엇이 있는지 시스템에 알려주지만, 깊이 정보는 해당 객체가 카메라와 서로에 대해 어디에 위치하는지 파악하는 데 도움을 줍니다.

이러한 기능을 함께 사용하면 3D 맵 구축, 복잡한 환경 탐색, 장면 전체 이해와 같은 광범위한 비전 AI 응용 분야를 구현할 수 있습니다.

로봇과 자율주행 차량은 안전하게 이동하고 장애물을 피하며 실시간으로 변화에 대응하기 위해 이러한 정보에 의존합니다. 예를 들어 Tesla의 비전 전용 주행 방식은 LiDAR 대신 카메라 이미지와 깊이 추정을 결합하여 객체가 얼마나 멀리 있고 도로에서 어떻게 배치되어 있는지 이해합니다.

단안 깊이 추정 모델의 작동 방식#

모델 아키텍처는 다양하지만 대부분의 단안 깊이 추정 모델은 단일 이미지를 깊이 맵으로 변환하기 위해 유사한 과정을 따릅니다. 주요 단계를 간단히 살펴보겠습니다.

  • 입력 및 전처리: 워크플로는 입력 이미지로 시작합니다. 원본 이미지는 일반적으로 모델에 입력되기 전에 크기가 조정되고 정규화되며 텐서로 변환됩니다. 텐서는 신경망이 이미지 데이터를 효율적으로 처리하는 데 사용하는 형식입니다.
  • 특징 추출: 인코더 네트워크는 이미지를 분석하여 의미 있는 시각적 특징을 추출합니다. 이러한 특징은 텍스처, 객체 경계, 장면의 전체적인 배치와 같은 정보를 포착합니다. 대부분의 모델은 여러 스케일에서 작동하므로 세밀한 정보와 전역 구조를 모두 이해할 수 있습니다.
  • 깊이 추론: 모델은 추출된 특징을 사용하여 로컬 세부 정보와 전역 맥락을 결합하고 장면의 공간적 관계를 추론합니다. 이 단계에서 이미지의 어느 영역이 카메라에 더 가깝고 어느 영역이 더 먼지 학습합니다.
  • 깊이 맵 생성: 그런 다음 디코더가 이 정보를 밀집 깊이 맵으로 변환합니다. 이미지의 각 픽셀에는 깊이 값이 할당되며, 정확도와 일관성을 높이기 위해 서로 다른 스케일의 예측을 혼합하는 경우가 많습니다.

단안 깊이 추정 모델의 학습 방식#

앞서 설명한 과정은 이미 학습되었거나 사전 학습된 모델이 있다고 가정합니다. 그렇다면 단안 깊이 추정 모델의 학습은 실제로 어떻게 이루어질까요?

학습은 네트워크가 효율적으로 처리할 수 있도록 이미지 데이터를 준비하는 일부터 시작합니다. 입력 이미지는 일정한 스케일로 크기가 조정되고 정규화된 다음 모델을 통과하여 각 픽셀의 거리를 추정하는 예측 깊이 맵을 생성합니다.

그런 다음 예측 깊이 맵을 손실 함수를 사용하여 참조 깊이 데이터와 비교합니다. 손실 함수는 모델의 예측이 정답 깊이에서 얼마나 벗어났는지 측정합니다. 이 손실 값은 모델의 현재 오류를 나타내며 개선을 위한 신호를 제공합니다.

옵티마이저는 이 신호를 사용하여 내부 가중치를 조정함으로써 모델을 업데이트합니다. 이를 위해 옵티마이저는 각 모델 파라미터에 대해 손실이 어떻게 변하는지 나타내는 그래디언트를 계산하고, 여러 에포크, 즉 학습 데이터셋을 처음부터 끝까지 통과하는 과정을 반복하며 이러한 업데이트를 적용합니다.

이 반복적인 지도 학습 과정은 각 업데이트 단계의 크기를 조절하는 학습률과 한 번에 처리할 이미지 수를 결정하는 배치 크기와 같은 하이퍼파라미터의 지도를 받습니다. 학습에는 많은 수의 수학적 연산이 필요하므로 일반적으로 병렬 계산에 적합한 그래픽 처리 장치(GPU)를 사용하여 가속합니다.

학습이 완료되면 학습 중 사용하지 않은 이미지로 구성된 검증 세트에서 표준 평가 지표를 사용하여 모델을 평가합니다. 이 평가를 통해 모델이 새로운 데이터에 얼마나 잘 일반화되는지 측정할 수 있습니다.

그런 다음 학습된 모델을 새로운 시나리오에 재사용하거나 파인 튜닝할 수 있습니다. 전반적으로 이러한 학습 과정을 통해 단안 깊이 추정 모델은 일관된 깊이 추정 결과를 생성할 수 있으며, 이는 3D 재구성 및 실제 환경 배포와 같은 다운스트림 작업에 필수적입니다.

최첨단 모델과 연구 동향 살펴보기#

모델이 작은 시각적 세부 정보뿐 아니라 장면 전체를 더 잘 이해하게 되면서 단안 깊이 추정은 빠르게 발전했습니다. 초기 접근 방식은 특히 복잡한 환경에서 균일하지 않은 깊이 맵을 생성하는 경우가 많았습니다.

arXiv에 최근 발표된 연구에서 볼 수 있듯이 최신 모델은 전역 맥락에 더 집중하며, 그 결과 깊이 예측이 더 안정적이고 현실적으로 보입니다. MiDaS와 DPT 같은 잘 알려진 모델은 다양하고 고해상도인 데이터셋에서 깊이를 학습하고 여러 장면에 잘 일반화함으로써 이러한 변화를 이끄는 데 기여했습니다.

ZoeDepth와 Depth Anything V2를 포함한 최신 모델은 광범위한 환경에서 높은 성능을 유지하면서 스케일 일관성을 향상하여 이러한 연구를 발전시켰습니다. 이러한 발전은 실외와 실내 장면을 모두 포함하는 KITTI 및 NYU와 같은 일반적인 벤치마크 데이터셋을 사용하여 측정하는 경우가 많습니다.

또 다른 분명한 동향은 정확도와 실용성 사이의 균형을 맞추는 것입니다. 소형 모델은 속도에 맞게 최적화되어 엣지 또는 모바일 디바이스에서 실시간으로 실행할 수 있는 반면, 대형 모델은 더 높은 해상도와 장거리 깊이 정확도를 우선시합니다.

단안 깊이 추정의 응용 분야#

이제 단안 깊이 추정이 단일 이미지에서 장면의 3D 구조를 추론하는 데 어떻게 사용되는지 보여주는 실제 사례를 살펴보겠습니다.

이 모든 사례에서 깊이 정보는 정밀한 측정값이 아니라 시각적 단서에서 추론한 추정값이라는 점을 기억하는 것이 중요합니다. 따라서 단안 깊이 추정은 상대적인 배치와 공간적 관계를 이해하는 데 유용하지만, LiDAR나 스테레오 시스템처럼 거리를 정확하게 측정하도록 설계된 센서를 대체할 수는 없습니다.

드론 기반 지형 매핑 및 내비게이션#

드론은 숲, 건설 현장, 재난 지역, 밀집된 도심과 같이 GPS 신호를 신뢰하기 어려운 환경에서 작동하는 경우가 많습니다. 이러한 조건에서 안전하게 비행하려면 주변 지형을 이해하고 장애물이 얼마나 멀리 있는지 파악해야 합니다. 과거에는 일반적으로 LiDAR나 스테레오 카메라와 같은 센서를 추가해야 했으며, 이는 무게와 전력 소비 및 전체 비용을 증가시켰습니다.

단안 깊이 추정은 더 간단한 대안입니다. 단일 RGB 카메라만 사용하여 드론이 이미지에서 깊이를 추정하고 주변 환경에 대한 기본적인 3D 이해를 구축할 수 있습니다. 이를 통해 건물, 나무 또는 갑작스러운 지형 변화와 같은 장애물을 감지하고 실시간으로 비행 경로를 조정할 수 있습니다.

이러한 깊이 추정은 장애물 회피, 고도 제어, 안전한 착륙을 비롯한 주요 내비게이션 작업을 지원합니다. 따라서 경량 드론은 특수 깊이 센서에 의존하지 않고도 매핑, 검사, 내비게이션 작업을 수행할 수 있습니다.

드론 이미지 분석에 사용되는 단안 깊이 추정

그림 2. 단안 깊이 추정을 드론 이미지 분석에 사용할 수 있습니다 (출처)

자율주행 레이싱 차량의 사각지대 보완#

자율주행 차량은 일반적으로 레이저 펄스를 사용하여 거리를 측정하고 도로의 3D 뷰를 구축하는 LiDAR 센서에 크게 의존합니다. LiDAR는 매우 정확하지만 급격한 도로 마루, 가파른 경사, 가림, 갑작스러운 차량 피치 변화에 취약할 수 있으며, 때로는 희소하거나 누락된 깊이 데이터를 반환합니다.

단안 깊이 추정은 LiDAR 데이터가 불완전한 경우에도 단일 RGB 이미지에서 밀집 깊이 정보를 제공하여 이러한 공백을 보완할 수 있습니다. 자율주행 자동차가 빠른 속도로 언덕 마루에 접근하는 상황을 생각해 보겠습니다. LiDAR 빔이 마루 너머의 도로를 지나쳐 앞에 무엇이 있는지 불확실해질 수 있습니다.

하지만 카메라 기반 깊이 추정은 원근과 텍스처 같은 시각적 단서에서 도로의 형태를 여전히 추론할 수 있으므로 LiDAR 데이터가 안정화될 때까지 차량이 신뢰할 수 있는 인식을 유지하도록 돕습니다. LiDAR와 단안 깊이 추정을 함께 사용하면 까다로운 주행 조건에서 더 안정적인 인식과 안전한 제어가 가능합니다.

자율주행 레이싱에 단안 깊이 추정을 사용하는 시각화

그림 3. 자율주행 레이싱에 단안 깊이 추정을 사용하는 시각화 (출처)

로봇 내비게이션 및 장애물 회피#

로봇은 상세한 지도를 사용할 수 없고 조건이 끊임없이 변하는 장소에서 작동하는 경우가 많습니다. 안전하게 이동하려면 주변에 얼마나 많은 공간이 있고 장애물이 어디에 있는지 안정적으로 파악해야 합니다.

단안 깊이 추정은 무겁거나 값비싼 하드웨어에 의존하지 않고 단일 RGB 카메라를 사용하여 이러한 공간 인식 기능을 제공할 수 있습니다. 깊이 추정 모델은 스케일과 원근 같은 시각적 단서를 학습하여 주변 환경의 밀집 깊이 맵을 생성할 수 있습니다. 이를 통해 로봇은 표면과 객체까지의 거리를 명확하게 파악할 수 있습니다.

특히 깊이 정보를 객체 검출 및 의미론적 세그멘테이션과 같은 컴퓨터 비전 작업과 결합하면 로봇이 환경을 더 완전하게 파악할 수 있습니다. 로봇은 객체를 식별하고 거리를 이해하며 안전하게 이동할 위치를 결정할 수 있습니다. 이는 장애물 회피, 자유 공간 검출, 실시간 경로 계획을 지원합니다.

단안 깊이 추정 및 객체 검출을 사용한 객체 검출

그림 4. 단안 깊이 추정 및 객체 검출을 사용한 객체 검출 (출처)

단안 깊이 추정의 장단점#

단안 깊이 추정을 사용할 때의 주요 장점은 다음과 같습니다.

  • 경량 및 전력 효율: 단일 카메라를 사용하면 시스템 무게와 전력 소비가 줄어들며, 이는 모바일 로봇, 드론, 임베디드 시스템에서 특히 중요합니다.
  • 센서 퓨전에 적합: 단안 깊이는 LiDAR나 레이더와 같은 다른 센서를 보완하여 누락된 정보를 채우거나 중복성을 제공할 수 있습니다.
  • 다양한 환경에서 작동: 동일한 카메라 기반 접근 방식을 실내와 실외 및 다양한 플랫폼에서 하드웨어 변경 없이 사용할 수 있습니다.

단안 깊이 추정은 분명한 이점을 제공하지만 다음과 같은 한계도 고려해야 합니다.

  • 능동 센서보다 낮은 정확도: 단안 깊이 추정은 빠르게 발전하고 있지만 통제된 조건에서 LiDAR나 구조광 센서의 절대 정확도에는 일반적으로 미치지 못합니다.
  • 조명 조건에 대한 민감성: 저조도 환경, 강한 그림자, 눈부심 또는 텍스처가 부족한 장면에서는 성능이 저하될 수 있습니다.
  • 일반화의 어려움: 한 환경에서 학습한 모델은 적응이나 파인 튜닝 없이는 보지 못한 도메인으로 항상 안정적으로 전이되지 않을 수 있습니다.

단안 깊이 추정에 의존하지 않아야 하는 경우#

단안 깊이 추정은 흥미로운 연구 분야이지만 실제로 어디에 사용할 수 있고 어디에 사용할 수 없는지 이해하는 것이 중요합니다. 단안 깊이 추정이 산출하는 거리는 실제 세계에서 측정한 정확한 값이 아니라 모델이 이미지에서 본 내용을 기반으로 한 추정값입니다.

따라서 조명, 장면의 복잡성, 해당 장면이 모델의 학습 환경과 얼마나 유사한지에 따라 결과의 품질이 달라질 수 있습니다. 단안 깊이 추정은 일반적으로 무엇이 더 가깝고 무엇이 더 먼지 판단하는 데는 능숙하지만 정확한 거리가 필요할 때는 신뢰하기 어렵습니다.

안전이 중요한 시스템, 산업 검사, 객체와 매우 정밀하게 상호작용해야 하는 로봇처럼 정밀도가 정말 중요한 상황에서는 깊이를 직접 측정해야 합니다. LiDAR, 레이더, 스테레오 카메라, 구조광 시스템과 같은 센서는 이를 위해 설계되었으며 훨씬 더 신뢰할 수 있는 거리 정보를 제공합니다.

단안 깊이 추정은 시각적으로 어려운 조건에서도 문제가 발생할 수 있습니다. 열악한 조명, 강한 그림자, 반사 또는 투명한 표면, 안개, 연기, 시각적 텍스처가 거의 없는 장면은 모두 깊이 추정의 신뢰도를 낮출 수 있습니다. 장거리에서 깊이를 추정하는 경우에도 일반적으로 전용 센서가 더 잘 작동합니다.

실제 환경의 솔루션에서 단안 깊이 추정은 독립형 솔루션이라기보다 보조 도구로 사용할 때 가장 효과적입니다. 유용한 공간적 맥락을 추가하고, 다른 센서의 성능이 제한될 때 부족한 정보를 보완하며, 전반적인 장면 이해도를 높이는 데 도움이 될 수 있습니다. 그러나 정확성, 안전성 또는 엄격한 신뢰성 요구 사항이 중요한 경우에는 깊이 정보의 유일한 출처로 사용해서는 안 됩니다.

핵심 요점#

단안 깊이 추정은 단일 카메라 이미지만 사용하여 기계가 객체까지의 거리를 추정할 수 있도록 하는 컴퓨터 비전 기술입니다. 이러한 AI 모델은 원근, 객체 크기, 텍스처, 명암과 같은 시각적 단서를 학습하여 LiDAR나 스테레오 카메라와 같은 센서에 의존하지 않고 장면의 3D 구조를 추론할 수 있습니다. 따라서 단안 깊이 추정은 자율주행, 로보틱스, 3D 장면 이해와 같은 애플리케이션에 비용 효율적이고 확장 가능한 접근 방식을 제공합니다.

비전 AI에 대해 더 알아보려면 GitHub 저장소를 방문하고 커뮤니티에 참여해 보세요. 로보틱스의 AI제조업의 컴퓨터 비전에 대해 알아보려면 솔루션 페이지를 확인하세요. 지금 컴퓨터 비전을 시작하려면 라이선스 옵션을 살펴보세요!

Explore solutions

항공 이미지를 위한 컴퓨터 비전

항공 이미지를 위한 컴퓨터 비전

Ultralytics YOLO을 활용하여 드론 및 항공 이미지를 농업, 수산업, 환경 모니터링, 자연 보호, 지리 공간 분석을 위한 실시간 인사이트로 변환합니다.
자세히 알아보기
항공우주 분야의 컴퓨터 비전

항공우주 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 항공 모니터링에 비전 AI를 도입하세요. 컴퓨터 비전 솔루션으로 드론, 항공우주 워크플로, 환경 보전 및 지리 공간 산업을 지원합니다.
자세히 알아보기

Ultralytics YOLO 모델로 모든 사이트를 보호하세요. 비전 AI는 경계 모니터링, 위협 탐지, 번호판 인식 및 작업장 안전을 지원합니다.
자세히 알아보기
로보틱스 컴퓨터 비전

로보틱스 컴퓨터 비전

Ultralytics YOLO 모델로 더 스마트한 기계의 성능을 구현하세요. 로보틱스의 Vision AI는 자율 주행, 인식, 객체 추적 및 실시간 제어를 지원합니다.
자세히 알아보기
물류 컴퓨터 비전

물류 컴퓨터 비전

Ultralytics YOLO 모델로 물류를 효율화하세요. Vision AI는 패키지 검사, 분류, 차량 추적 및 창고의 실시간 안전 모니터링을 지원합니다.
자세히 알아보기
소매 컴퓨터 비전

소매 컴퓨터 비전

Ultralytics YOLO 모델로 소매업을 새롭게 혁신하세요. Vision AI는 재고 추적, 선반 모니터링, 대기열 관리 및 더 스마트한 고객 인사이트를 지원합니다.
자세히 알아보기
헬스케어 분야의 컴퓨터 비전

헬스케어 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 헬스케어 솔루션을 구축하십시오. 헬스케어 분야의 Vision AI는 더 빠른 의료 영상 처리, 더욱 스마트한 진단, 환자 모니터링을 지원합니다.
자세히 알아보기
제조 분야의 컴퓨터 비전

제조 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 제조를 최적화하십시오. Vision AI는 품질 관리, 결함 탐지, PPE 준수, 조립 라인 자동화를 지원합니다.
자세히 알아보기
자동차 산업의 컴퓨터 비전

자동차 산업의 컴퓨터 비전

Ultralytics YOLO 모델을 활용해 자동차 산업에 컴퓨터 비전을 적용합니다. 비전 AI는 도로 안전, 운전자 보조, 차량 자동화를 향상해 더 스마트한 도로를 구현합니다.
자세히 알아보기
농업의 컴퓨터 비전

농업의 컴퓨터 비전

Ultralytics YOLO 모델로 스마트 농업에 비전 AI를 도입합니다. 작물 모니터링, 가축 추적, 정밀 농업을 강화해 더 높은 수확량을 스마트하게 실현합니다.
자세히 알아보기
항공 이미지를 위한 컴퓨터 비전

항공 이미지를 위한 컴퓨터 비전

Ultralytics YOLO을 활용하여 드론 및 항공 이미지를 농업, 수산업, 환경 모니터링, 자연 보호, 지리 공간 분석을 위한 실시간 인사이트로 변환합니다.
자세히 알아보기
항공우주 분야의 컴퓨터 비전

항공우주 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 항공 모니터링에 비전 AI를 도입하세요. 컴퓨터 비전 솔루션으로 드론, 항공우주 워크플로, 환경 보전 및 지리 공간 산업을 지원합니다.
자세히 알아보기

Ultralytics YOLO 모델로 모든 사이트를 보호하세요. 비전 AI는 경계 모니터링, 위협 탐지, 번호판 인식 및 작업장 안전을 지원합니다.
자세히 알아보기
로보틱스 컴퓨터 비전

로보틱스 컴퓨터 비전

Ultralytics YOLO 모델로 더 스마트한 기계의 성능을 구현하세요. 로보틱스의 Vision AI는 자율 주행, 인식, 객체 추적 및 실시간 제어를 지원합니다.
자세히 알아보기
물류 컴퓨터 비전

물류 컴퓨터 비전

Ultralytics YOLO 모델로 물류를 효율화하세요. Vision AI는 패키지 검사, 분류, 차량 추적 및 창고의 실시간 안전 모니터링을 지원합니다.
자세히 알아보기
소매 컴퓨터 비전

소매 컴퓨터 비전

Ultralytics YOLO 모델로 소매업을 새롭게 혁신하세요. Vision AI는 재고 추적, 선반 모니터링, 대기열 관리 및 더 스마트한 고객 인사이트를 지원합니다.
자세히 알아보기
헬스케어 분야의 컴퓨터 비전

헬스케어 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 헬스케어 솔루션을 구축하십시오. 헬스케어 분야의 Vision AI는 더 빠른 의료 영상 처리, 더욱 스마트한 진단, 환자 모니터링을 지원합니다.
자세히 알아보기
제조 분야의 컴퓨터 비전

제조 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 제조를 최적화하십시오. Vision AI는 품질 관리, 결함 탐지, PPE 준수, 조립 라인 자동화를 지원합니다.
자세히 알아보기
자동차 산업의 컴퓨터 비전

자동차 산업의 컴퓨터 비전

Ultralytics YOLO 모델을 활용해 자동차 산업에 컴퓨터 비전을 적용합니다. 비전 AI는 도로 안전, 운전자 보조, 차량 자동화를 향상해 더 스마트한 도로를 구현합니다.
자세히 알아보기
농업의 컴퓨터 비전

농업의 컴퓨터 비전

Ultralytics YOLO 모델로 스마트 농업에 비전 AI를 도입합니다. 작물 모니터링, 가축 추적, 정밀 농업을 강화해 더 높은 수확량을 스마트하게 실현합니다.
자세히 알아보기
항공 이미지를 위한 컴퓨터 비전

항공 이미지를 위한 컴퓨터 비전

Ultralytics YOLO을 활용하여 드론 및 항공 이미지를 농업, 수산업, 환경 모니터링, 자연 보호, 지리 공간 분석을 위한 실시간 인사이트로 변환합니다.
자세히 알아보기
항공우주 분야의 컴퓨터 비전

항공우주 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 항공 모니터링에 비전 AI를 도입하세요. 컴퓨터 비전 솔루션으로 드론, 항공우주 워크플로, 환경 보전 및 지리 공간 산업을 지원합니다.
자세히 알아보기

Ultralytics YOLO 모델로 모든 사이트를 보호하세요. 비전 AI는 경계 모니터링, 위협 탐지, 번호판 인식 및 작업장 안전을 지원합니다.
자세히 알아보기
로보틱스 컴퓨터 비전

로보틱스 컴퓨터 비전

Ultralytics YOLO 모델로 더 스마트한 기계의 성능을 구현하세요. 로보틱스의 Vision AI는 자율 주행, 인식, 객체 추적 및 실시간 제어를 지원합니다.
자세히 알아보기
물류 컴퓨터 비전

물류 컴퓨터 비전

Ultralytics YOLO 모델로 물류를 효율화하세요. Vision AI는 패키지 검사, 분류, 차량 추적 및 창고의 실시간 안전 모니터링을 지원합니다.
자세히 알아보기
소매 컴퓨터 비전

소매 컴퓨터 비전

Ultralytics YOLO 모델로 소매업을 새롭게 혁신하세요. Vision AI는 재고 추적, 선반 모니터링, 대기열 관리 및 더 스마트한 고객 인사이트를 지원합니다.
자세히 알아보기
헬스케어 분야의 컴퓨터 비전

헬스케어 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 헬스케어 솔루션을 구축하십시오. 헬스케어 분야의 Vision AI는 더 빠른 의료 영상 처리, 더욱 스마트한 진단, 환자 모니터링을 지원합니다.
자세히 알아보기
제조 분야의 컴퓨터 비전

제조 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 제조를 최적화하십시오. Vision AI는 품질 관리, 결함 탐지, PPE 준수, 조립 라인 자동화를 지원합니다.
자세히 알아보기
자동차 산업의 컴퓨터 비전

자동차 산업의 컴퓨터 비전

Ultralytics YOLO 모델을 활용해 자동차 산업에 컴퓨터 비전을 적용합니다. 비전 AI는 도로 안전, 운전자 보조, 차량 자동화를 향상해 더 스마트한 도로를 구현합니다.
자세히 알아보기
농업의 컴퓨터 비전

농업의 컴퓨터 비전

Ultralytics YOLO 모델로 스마트 농업에 비전 AI를 도입합니다. 작물 모니터링, 가축 추적, 정밀 농업을 강화해 더 높은 수확량을 스마트하게 실현합니다.
자세히 알아보기

AI의 미래를 함께 만들어가세요!

머신러닝의 미래와 함께 여정을 시작하세요