데이터를 다양화하기 위한 Albumentations 증강 사용
다양한 학습 데이터로 모델 성능을 향상시키기 위해 Ultralytics YOLO11을 커스텀 학습할 때 Albumentations를 사용하여 증강하는 방법을 배워보세요.

컴퓨터 비전 솔루션을 구축할 때, 비전 AI 모델 학습을 위한 다양한 이미지 세트를 수집하는 것은 프로세스의 핵심적인 부분이 될 수 있습니다. 이는 종종 많은 시간과 비용을 요구하며, 때로는 수집된 이미지가 모델이 효과적으로 학습하기에 충분히 다양하지 않을 수도 있습니다.
예를 들어, Ultralytics YOLO11과 같은 컴퓨터 비전 모델은 다양한 애플리케이션과 관련된 다양한 컴퓨터 비전 태스크를 위해 이미지 데이터셋으로 커스텀 학습될 수 있습니다. 다양한 데이터는 모델이 더 잘 일반화하도록 돕고, 광범위한 실제 시나리오에서 객체와 패턴을 인식할 수 있게 해주기 때문에 매우 중요합니다.
데이터 다양성 부족으로 어려움을 겪고 있다면, 이미지 데이터 증강 기법이 훌륭한 해결책이 될 수 있습니다. 회전, 뒤집기, 밝기 조절과 같은 방법들은 데이터셋의 다양성을 높여 모델이 더 광범위한 조건을 처리할 수 있도록 성능을 향상시킵니다.
그렇기 때문에 Ultralytics는 이미지 데이터 증강(augmentation) 통합을 지원합니다. 다양한 변환 모음을 제공하는 인기 있는 도구인 Albumentations를 사용하여 다양한 시각적 데이터를 생성할 수 있습니다. 이 통합은 학습 이미지를 자동으로 증강하여 YOLO11 학습 프로세스를 단순화하며, 향상된 모델 성능으로 이어집니다.
본 글에서는 Albumentations 통합 기능을 사용하는 방법과 그 이점, 그리고 모델 학습에 미치는 영향에 대해 알아봅니다.
Albumentations이란 무엇인가요?#
컴퓨터 비전 모델은 다양한 고품질 이미지 세트로부터 학습하여 다양한 환경에서 객체를 인식할 수 있습니다. 실제 소스에서 대규모 데이터셋을 수집하는 것은 느리고, 비용이 많이 들며, 비효율적일 수 있습니다. 이 작업을 간소화하기 위해 이미지 데이터 증강을 사용하여 기존 이미지의 새로운 변형을 생성함으로써, 더 많은 데이터를 수집하지 않고도 모델이 다양한 시나리오에서 학습할 수 있도록 도울 수 있습니다.
구체적으로는 2018년에 효율적인 이미지 데이터 증강을 위해 도입된 오픈 소스 라이브러리인 Albumentations을 활용할 수 있습니다. 회전이나 뒤집기와 같은 단순한 기하학적 변경부터 밝기, 대비, 노이즈 추가와 같은 복잡한 조정에 이르기까지 다양한 작업을 지원합니다.

그림 1. 다양한 유형의 이미지 데이터 증강 예시.
Albumentations의 주요 특징#
Albumentations는 고성능으로 잘 알려져 있으며, 이는 이미지를 빠르고 효율적으로 처리할 수 있음을 의미합니다. OpenCV 및 NumPy와 같은 최적화된 라이브러리를 기반으로 구축되어 최소한의 처리 시간으로 대규모 데이터셋을 처리할 수 있으므로, 모델 학습 중 빠른 데이터 증강에 이상적입니다.
Albumentations의 다른 주요 특징은 다음과 같습니다:
- 다양한 변환: Albumentations은 70가지 이상의 증강 유형을 제공합니다. 이러한 변화는 모델이 조명, 각도 또는 배경 변화에도 불구하고 객체를 감지하는 방법을 학습하도록 돕습니다.
- 속도 최적화: SIMD(Single Instruction, Multiple Data)와 같은 고급 최적화 기술을 사용하여 여러 데이터 포인트를 동시에 처리함으로써 이미지 증강 속도를 높이고 대규모 데이터셋을 효율적으로 처리합니다.
- 세 가지 수준의 증강: 세 가지 방식으로 데이터를 강화합니다. 예를 들어, 픽셀 수준 증강은 객체를 변경하지 않고 밝기와 색상을 조정합니다. 반면 공간 수준 증강은 핵심 세부 정보를 유지하면서 객체 위치를 수정하며, 혼합 수준 증강은 여러 이미지의 일부를 결합하여 새로운 샘플을 생성합니다.
왜 Albumentations 통합 기능을 사용해야 할까요?#
데이터셋에 증강을 적용하는 방법은 많으며, OpenCV와 같은 도구를 사용하여 직접 만들 수도 있는데 왜 Albumentations 같은 라이브러리를 지원하는 통합 기능을 선택해야 할지 궁금할 수 있습니다.
OpenCV와 같은 도구로 수동으로 증강을 생성하는 것은 많은 시간이 소요될 수 있으며 전문 지식이 필요합니다. 또한 최고의 결과를 얻기 위해 변환을 미세 조정하는 것이 까다로울 수 있습니다. Albumentations 통합은 이 과정을 더 쉽게 만들어 줍니다. 데이터셋을 준비할 때 시간과 노력을 절약할 수 있는 다양한 즉시 사용 가능한 변환을 제공합니다.
Albumentations 통합을 선택해야 하는 또 다른 이유는 Ultralytics 모델 학습 파이프라인과 원활하게 작동하기 때문입니다. 학습 중에 증강이 자동으로 적용되므로 YOLO11을 커스텀 학습하는 것이 훨씬 쉬워집니다. 프로세스를 단순화하여 데이터 준비를 처리하는 것보다 모델 개선에 더 집중할 수 있게 해줍니다.
Albumentations 통합 시작하기#
흥미롭게도 Albumentations 연동을 사용하여 Ultralytics YOLO11을 학습시키는 것은 생각보다 훨씬 간단합니다. 올바른 라이브러리가 설정되면, 연동 기능이 학습 과정에서 자동으로 이미지 데이터 증강을 적용합니다. 이는 모델이 동일한 데이터셋을 사용하여 다양한 이미지 변형으로부터 학습할 수 있도록 돕습니다.
다음으로, Ultralytics YOLO11을 커스텀 학습할 때 Albumentations 연동을 설치하고 사용하는 방법을 살펴보겠습니다.
Ultralytics Python 패키지 및 Albumentations 설치#
증강을 적용하기 전에 Ultralytics Python 패키지와 Albumentations를 모두 설치해야 합니다. 이 통합은 기본적으로 두 라이브러리가 원활하게 함께 작동하도록 구축되었으므로 복잡한 구성에 대해 걱정할 필요가 없습니다.
전체 설치 과정은 아래 이미지와 같이 Python 라이브러리 설치를 위한 패키지 관리 도구인 pip 명령 하나로 단 몇 분 만에 완료할 수 있습니다.

그림 2. Ultralytics 및 Albumentations 설치.
Albumentations가 설치되면 Ultralytics 모델 학습 모드가 학습 중에 이미지 증강을 자동으로 적용합니다. Albumentations가 설치되어 있지 않으면 이러한 증강이 적용되지 않습니다. 자세한 내용은 공식 Ultralytics 문서를 참조하십시오.
Albumentations 연동을 활용한 Ultralytics YOLO11 학습#
Albumentations 통합 기능의 내부에서 어떤 일이 일어나는지 더 자세히 알아보겠습니다.
다음은 Ultralytics YOLO11 학습 중에 적용되는 증강 기법들에 대한 자세한 내용입니다.
- Blur(흐림 효과): 이 변환은 이미지에 약간의 흐림 효과를 추가합니다. 모델이 초점이 맞지 않는 객체도 감지할 수 있도록 돕습니다.
- Median blur(중앙값 흐림 효과): 이미지의 객체 가장자리를 보존하면서 무작위 노이즈를 줄입니다. 이를 통해 모델이 복잡한 환경에서 객체를 더 쉽게 감지할 수 있습니다.
- Grayscale(회색조): 이미지를 흑백으로 변환하여 모델이 색상 대신 형태와 질감에 집중하도록 도울 수 있습니다.
- CLAHE(대비 제한 적응형 히스토그램 평활화): 이 증강은 이미지의 대비를 높이며, 특히 조명이 어둡거나 가시성이 낮은 조건에서 잘 보이지 않는 영역의 대비를 개선합니다. 이렇게 하면 해당 영역의 객체가 더 명확해져 모델이 식별하기 쉬워집니다.

그림 3. 고양이 이미지에 적용된 그레이스케일 증강의 예시.
Ultralytics YOLO11 및 Albumentations 연동의 활용 사례#
특정 애플리케이션을 위해 Ultralytics YOLO11을 커스텀 학습하는 경우, Albumentations 연동은 다양한 조건에 적응하여 모델의 성능을 향상시키는 데 도움을 줄 수 있습니다. 몇 가지 실제 활용 사례와 이 연동이 해결할 수 있는 과제들에 대해 논의해 보겠습니다.
의료 영상 개선#
의료 분야의 비전 AI는 의사들이 의료 이미지를 더 정확하게 분석하여 진단을 돕고 환자 케어를 개선할 수 있도록 지원하고 있습니다. 실제로 약 5분의 1의 의료 조직이 이미 AI 솔루션을 사용하고 있습니다.
그러나 이러한 컴퓨터 비전 솔루션을 구축하는 데는 어려움이 따릅니다. 의료 스캔 영상은 장비, 설정, 심지어 기술자의 경험과 같은 요인에 따라 병원마다 크게 다를 수 있습니다. 밝기, 대비, 노출의 차이는 비전 AI 모델의 일관성과 정확성에 영향을 미칠 수 있으며, 다양한 환경에서 안정적으로 작동하기 어렵게 만듭니다.
이때 Albumentations와 같은 도구의 통합이 필수적입니다. 동일한 스캔 영상의 다양한 증강 버전을 생성함으로써 Albumentations은 모델이 여러 이미지 품질을 학습할 수 있게 합니다. 이는 모델을 더 강력하게 만들어 고품질 이미지와 저품질 이미지 모두에서 질병을 정확하게 감지할 수 있도록 돕습니다.

그림 4. 증강된 X선 이미지.
보안 및 감시 강화#
비전 AI의 또 다른 흥미로운 응용 분야는 보안 및 감시입니다. 실시간 객체 감지는 보안 팀이 잠재적 위협을 신속하게 식별하는 데 도움을 줄 수 있습니다.
이 애플리케이션과 관련된 주요 우려 사항은 보안 카메라가 하루 종일 다양한 조명 조건에서 영상을 촬영한다는 점이며, 이러한 조건은 모델이 이미지를 이해하는 방식에 큰 영향을 줄 수 있습니다. 저조도 환경, 눈부심 또는 낮은 가시성과 같은 요소들은 컴퓨터 비전 모델이 객체를 감지하거나 잠재적인 위협을 일관되게 인식하기 어렵게 만듭니다.
Albumentations 통합은 다양한 조명 조건을 모방하도록 변환을 적용함으로써 도움을 줍니다. 이를 통해 모델은 밝은 환경과 저조도 환경 모두에서 객체를 감지하는 법을 학습하며, 더 신뢰할 수 있게 되고 까다로운 조건에서도 대응 시간을 개선합니다.
소매 워크플로우 및 고객 경험 재정의#
슈퍼마켓 통로의 액체 유출, 매장을 뛰어다니는 개, 또는 제품 진열대를 쓰러뜨리는 아이는 소매 환경의 비전 AI 환경에서 엣지 케이스가 될 수 있는 일상적인 이벤트의 몇 가지 예에 불과합니다. 컴퓨터 비전은 쇼퍼 행동 추적, 유동 인구 모니터링, 선반 위의 제품 식별을 통해 고객 경험을 개선하는 데 점점 더 많이 사용되고 있습니다. 그러나 이러한 실제 상황은 AI 시스템이 이해하고 정확하게 처리하기 어려울 수 있습니다.
모든 시나리오를 컴퓨터 비전 데이터셋에 반영할 수는 없지만, Albumentations 통합은 예상치 못한 조명, 독특한 각도 또는 장애물과 같은 많은 가능한 상황을 다룰 수 있도록 데이터를 증강하여 도움을 줍니다. 이는 컴퓨터 비전 모델이 다양한 조건에 적응하도록 하여 에지 케이스를 처리하고 역동적인 소매 환경에서 정확한 예측을 수행하는 능력을 향상시킵니다.
핵심 요약#
모델 학습을 위해 다양한 실제 데이터를 수집하는 것은 복잡할 수 있지만, Albumentations은 모델이 다른 조건에 적응하도록 돕는 이미지 변형을 생성하여 이를 더 쉽게 만듭니다.
Ultralytics에서 지원하는 Albumentations 통합은 YOLO11 커스텀 학습 중에 이러한 증강을 적용하는 과정을 간소화합니다. 이는 더 정확하고 신뢰할 수 있는 비전 AI 모델을 생성함으로써 광범위한 산업에 혜택을 주는 더 나은 데이터셋 품질로 이어집니다.
저희 커뮤니티에 가입하고 GitHub 리포지토리를 탐색하여 AI에 대해 자세히 알아보세요. 또한 라이선스 옵션을 확인하여 비전 AI 프로젝트를 시작해 보세요. 제조업에서의 AI나 자율 주행에서의 컴퓨터 비전과 같은 혁신에 관심이 있으신가요? 솔루션 페이지를 방문하여 더 많은 정보를 확인해 보세요.






