Ultralytics YOLO27:
가이드

컴퓨터 비전 프로젝트에서 강화 학습 활용하기

컴퓨터 비전 애플리케이션에서 강화 학습이 시스템이 보고, 의사 결정을 내리고, 다양한 산업의 실제 애플리케이션에서 개선되도록 지원하는 방법을 알아보세요.

ABAbirami Vina8 min read
컴퓨터 비전 프로젝트에 적용된 강화 학습

인공지능 (AI)을 설명하는 간단한 방법은 인간이 사고하고 학습하는 방식을 재현하는 데 초점을 둔 분야라고 말하는 것입니다. 여기서 AI의 학습 기법이라는 개념이 나오며, 이는 사람이 하는 것처럼 기계가 시간이 지남에 따라 성능을 향상할 수 있도록 하는 다양한 방법입니다.

이전에는 지도 학습, 비지도 학습, 강화 학습, 전이 학습을 포함한 주요 AI 학습 기법과 각 기법이 AI 모델이 정보를 처리하고 의사 결정을 내리는 데 중요한 역할을 하는 방식을 살펴보았습니다.

오늘은 강화 학습을 자세히 살펴보겠습니다. 강화 학습은 환경과 상호작용하고 피드백을 바탕으로 개선하면서 AI 시스템이 경험을 통해 학습하도록 가르치는 기법입니다. 특히 강화 학습을 컴퓨터 비전 애플리케이션에 적용하는 방법을 살펴보겠습니다. 컴퓨터 비전은 기계가 세상의 시각 정보를 해석하고 이해할 수 있도록 하는 시스템입니다.

강화 학습과 컴퓨터 비전 같은 개념을 결합하면서 새로운 가능성이 열리고 있으며, 이는 활발한 연구 분야입니다. 이를 통해 AI 시스템은 자신이 보는 것을 인식하고 해당 시각 정보를 바탕으로 합리적인 의사 결정을 내릴 수 있습니다.

강화 학습이란 무엇입니까?#

강화 학습은 AI 에이전트가 행동을 수행하고 보상이나 벌점 형태의 피드백을 받으면서 학습하는 머신 러닝의 한 분야입니다. 목표는 시간이 지남에 따라 어떤 행동이 최상의 결과로 이어지는지 파악하는 것입니다.

강화 학습은 개를 훈련하는 것과 비슷하다고 생각할 수 있습니다. 개가 명령에 따라 앉으면 간식을 줍니다. 시간이 지나면 개는 앉는 행동이 보상으로 이어진다는 것을 학습합니다. 강화 학습에서 AI 에이전트 또는 모델은 개와 같고, 환경은 에이전트를 둘러싼 세상이며, 보상은 올바른 행동을 했는지 이해하도록 돕습니다.

이는 AI 모델에 정답의 예시를 많이 보여 주는 지도 학습과 다릅니다. 예를 들어 모델에 개 사진을 보여 주고 "이것은 개입니다."라고 알려 줄 수 있습니다.

반면 강화 학습은 라벨링된 데이터에 의존하지 않습니다. 대신 다양한 행동을 시도하고 그 결과에서 학습하는 방식으로 진행되며, 게임을 하면서 승리에 도움이 되는 수를 파악하는 것과 매우 비슷합니다.

강화 학습과 지도 학습 비교

그림 1. 강화 학습과 지도 학습 비교.

강화 학습은 단계별로 의사 결정을 내리고 각 선택이 다음 상황에 영향을 미치는 작업에 매우 중요합니다. 이러한 학습 방식은 전략 비디오 게임에서 게임 플레이를 더욱 도전적이고 흥미롭게 만들어 플레이어의 참여를 높이는 데 사용됩니다.

AI 솔루션에서 강화 학습이 작동하는 방식#

자전거 타는 법을 배우는 과정을 생각해 보십시오. 처음에는 넘어질 수 있습니다. 하지만 연습을 거듭하면 균형을 유지하는 데 도움이 되는 방법을 파악하기 시작합니다. 더 많이 탈수록 실력이 향상됩니다. 무엇을 해야 하는지 단순히 듣는 것이 아니라 직접 행동하면서 학습합니다.

강화 학습은 AI에서도 이와 유사한 방식으로 작동합니다. 다양한 행동을 시도하고, 어떤 일이 일어나는지 관찰하며, 시간이 지남에 따라 올바른 선택을 하는 능력을 점진적으로 향상하는 등 경험을 통해 학습합니다.

강화 학습의 작동 방식 이해하기

그림 2. 강화 학습의 작동 방식 이해하기.

강화 학습의 주요 구성 요소를 살펴보겠습니다.

  • 에이전트: 에이전트는 학습자 또는 의사 결정자입니다. 행동을 수행하여 환경과 상호작용하고 특정 목표를 달성하려고 합니다.
  • 환경: 환경에는 에이전트가 상호작용하는 모든 것이 포함됩니다. 에이전트의 행동에 따라 변화하며 결과를 바탕으로 피드백을 제공합니다.
  • 상태: 상태는 환경의 현재 상황을 나타내는 스냅샷입니다. 에이전트는 상태를 관찰하여 주변 상황을 이해하고 다음에 취할 행동을 결정합니다.
  • 행동: 행동은 환경에 영향을 미치는 에이전트의 움직임 또는 의사 결정입니다. 각 행동은 새로운 상태로 이어지며 향후 보상에 영향을 줄 수 있습니다.
  • 보상: 보상은 에이전트의 행동이 유익했는지 여부를 알려 주는 환경의 피드백입니다. 양의 보상은 에이전트가 좋은 행동을 반복하도록 장려하고, 음의 보상은 좋지 않은 행동을 억제합니다.
  • 정책: 정책은 현재 상태를 바탕으로 행동을 선택하는 에이전트의 전략입니다. 에이전트는 시간이 지나면서 얻을 수 있는 총 보상을 최대화하도록 정책을 개선합니다.

이러한 구성 요소를 함께 사용하면 강화 학습을 통해 AI 시스템이 지속적인 시행착오를 거치며 효과적인 행동을 학습할 수 있습니다. 시도할 때마다 에이전트의 성능이 향상되어 더 높은 보상과 나은 결과로 이어지는 행동을 선택할 수 있게 됩니다.

컴퓨터 비전 혁신에서의 강화 학습#

컴퓨터 비전은 이미지에서 객체를 감지하거나, 사진에 무엇이 있는지 분류하거나, 이미지를 여러 부분으로 세분화하는 작업에 사용됩니다. Ultralytics YOLO11과 같은 컴퓨터 비전 모델은 이러한 작업을 지원하며, 시각적 인사이트를 수집할 수 있는 영향력 있는 애플리케이션을 구축하는 데 사용할 수 있습니다.

그러나 이러한 비전 AI 작업을 강화 학습과 결합하면 단순히 보는 데 그치지 않고 시각적 인사이트를 바탕으로 행동하는 방법을 학습하며 시간이 지날수록 향상되는 AI 솔루션을 구현할 수 있습니다.

컴퓨터 비전 애플리케이션에서 강화 학습을 활용하는 흥미로운 사례로 창고에서 로봇을 사용하는 경우를 들 수 있습니다. 카메라와 컴퓨터 비전 시스템을 탑재한 로봇은 주변 환경을 분석하고, 각 물품의 위치를 감지하며, 형태와 크기를 식별하고, 선반에 어떻게 배치되어 있는지 파악할 수 있습니다.

로봇이 물품을 집으려고 시도할 때마다 피드백을 받습니다. 물품을 올바르게 집으면 성공이고, 떨어뜨리면 실패입니다. 시간이 지나면서 로봇은 물품별로 어떤 행동이 가장 효과적인지 학습합니다. 고정된 지침을 따르는 대신 경험을 통해 지속적으로 향상됩니다.

비전 AI와 강화 학습을 사용해 객체를 집는 로봇 팔

그림 3. 비전 AI와 강화 학습을 사용해 객체를 집는 로봇 팔.

컴퓨터 비전에서 강화 학습의 활용 사례#

이제 강화 학습이 무엇이며 컴퓨터 비전에서 어떤 역할을 하는지 더 잘 이해했으므로, 강화 학습과 컴퓨터 비전이 함께 사용되는 몇 가지 사례를 자세히 살펴보겠습니다.

더 스마트한 차량을 위한 비전 AI와 강화 학습의 통합#

자율주행 차량은 비전 AI를 통해 주변 환경을 이해하고 강화 학습을 통해 본 내용을 바탕으로 의사 결정을 내릴 수 있습니다. 이를 실제로 보여 주는 대표적인 사례가 AWS DeepRacer입니다.

AWS DeepRacer는 카메라와 강화 학습을 사용해 주행 방법을 학습하는 완전 자율형 1/18 스케일 경주용 자동차입니다. 무엇을 해야 하는지 지시받는 대신 스스로 시도하고 실수하며 그 과정에서 학습해 문제를 해결합니다.

이 소형 자동차의 카메라는 눈처럼 작동하여 앞에 있는 트랙을 촬영합니다. 자동차는 본 내용을 바탕으로 조향 방법과 주행 속도를 학습합니다. 랩을 거듭할 때마다 성능이 향상됩니다. 예를 들어 과거의 시도에서 학습하여 더 넓게 회전하거나 급커브 전에 속도를 줄이는 방법을 익힐 수 있습니다.

DeepRacer의 훈련은 가상 환경에서 시작되며, 이곳에서 모델은 주행 기술을 연습하고 개선합니다. 일정 수준의 성능에 도달하면 해당 기술은 실제 자동차가 주행하는 현실 세계의 트랙으로 전이됩니다.

비전과 강화 학습을 사용해 자율 주행하는 AWS DeepRacer

그림 4. AWS DeepRacer는 비전과 강화 학습을 사용해 자율 주행합니다. 이미지 출처: Amazon.

자율 수술 로봇을 향한 발전#

주목받고 있는 흥미로운 연구 분야 중 하나는 로봇 수술에 비전 AI와 강화 학습을 통합하는 것입니다. 현재 이 애플리케이션은 여전히 대부분 이론적인 단계에 머물러 있습니다. 연구자들은 가상 환경에서 시뮬레이션을 실행하고 있습니다.

그러나 초기 실험에서 유망한 결과가 나타나고 있으며, 이는 수술 로봇이 궁극적으로 더 높은 정밀도와 적응성을 갖추고 사람의 개입을 최소화하면서 복잡하고 섬세한 시술을 수행할 수 있음을 시사합니다.

점점 더 발전하는 수술 로봇

그림 5. 수술 로봇이 점점 더 발전하고 있습니다.

예를 들어 수술 부위에서 거즈 한 조각을 조심스럽게 들어 올려야 하는 상황을 생각해 보십시오. 비전 AI를 탑재한 로봇은 먼저 장면을 분석하고 세그멘테이션을 사용해 거즈와 주변 조직을 식별합니다.

그런 다음 강화 학습은 수술 로봇이 작업에 접근하는 방법을 결정하도록 돕습니다. 여기에는 거즈를 잡기에 가장 적합한 각도, 가해야 할 압력의 크기, 주변의 민감한 부위를 건드리지 않고 들어 올리는 방법을 결정하는 과정이 포함됩니다. 시간이 지나고 시뮬레이션 환경에서 반복적으로 연습하면 로봇은 이러한 미세하고 중요한 움직임을 점점 더 능숙하고 자신 있게 수행하는 방법을 학습할 수 있습니다.

비전 AI에서 강화 학습의 장단점#

강화 학습을 사용하면 비전 AI 시스템이 단순한 인식을 넘어 자신이 보는 것을 바탕으로 의사 결정을 내리기 시작할 수 있습니다. 이를 통해 로보틱스, 자동화, 실시간 상호작용과 같은 분야에서 새로운 가능성이 열립니다.

비전 AI 워크플로에 강화 학습을 통합할 때 얻을 수 있는 주요 이점은 다음과 같습니다.

  • 라벨링된 데이터에 대한 의존도 감소: 이러한 시스템은 상호작용을 통해 학습할 수 있으므로 시작하는 데 방대한 라벨링 데이터셋이 필요하지 않습니다.
  • 불확실성에 대한 대응력 향상: 강화 학습은 완벽한 데이터에만 의존하지 않고 피드백을 바탕으로 행동을 조정하여 불완전하거나 노이즈가 있는 시각 정보에 대응할 수 있습니다.
  • 장기 학습 지원: 단일 단계의 의사 결정이 아니라 일련의 행동에서 학습하여 모델이 시간이 지남에 따라 개선되도록 돕습니다.

반면 강화 학습에는 다음과 같은 한계도 고려해야 합니다.

  • 공헌도 할당 문제: 특히 의사 결정의 순서가 긴 경우, 어떤 특정 행동이 최종 결과에 기여했는지 에이전트가 파악하기 어려울 수 있습니다.
  • 안전하지 않은 탐색의 위험: 학습 중 에이전트가 의료 또는 자율 주행과 같은 실제 애플리케이션에서 허용되지 않는 위험하거나 바람직하지 않은 행동을 시도할 수 있습니다.
  • 느린 수렴: 특히 복잡한 작업에서는 모델이 실제로 우수한 성능에 도달하는 데 오랜 시간이 걸릴 수 있습니다.

핵심 요점#

컴퓨터 비전 프로젝트에서 강화 학습을 사용하면 AI 시스템이 주변 환경을 이해하고 경험을 통해 행동하는 방법을 학습할 수 있습니다. Ultralytics YOLO11과 같은 모델이 실시간 객체 감지를 제공하므로 시스템은 자신이 본 내용을 바탕으로 합리적인 의사 결정을 내릴 수 있습니다.

이 접근 방식은 라벨링된 데이터에만 의존하는 대신 시행착오와 피드백을 통해 AI가 개선되도록 하여 기존 방법을 뛰어넘습니다. 지속적인 학습을 지원하고 시간이 지날수록 성능이 향상되는 더욱 유연하고 적응력 있으며 지능적인 비전 AI 시스템을 구축하는 데 도움이 됩니다.

성장하는 커뮤니티에 참여해 보십시오. GitHub 저장소를 방문하여 AI를 더 깊이 알아보십시오. 직접 컴퓨터 비전 프로젝트를 시작하고 싶으십니까? 라이선스 옵션을 살펴보십시오. 솔루션 페이지에서 제조 분야의 AI자동차 산업의 비전 AI에 대해 자세히 알아보십시오.

Explore solutions

항공 이미지를 위한 컴퓨터 비전

항공 이미지를 위한 컴퓨터 비전

Ultralytics YOLO을 활용하여 드론 및 항공 이미지를 농업, 수산업, 환경 모니터링, 자연 보호, 지리 공간 분석을 위한 실시간 인사이트로 변환합니다.
자세히 알아보기
항공우주 분야의 컴퓨터 비전

항공우주 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 항공 모니터링에 비전 AI를 도입하세요. 컴퓨터 비전 솔루션으로 드론, 항공우주 워크플로, 환경 보전 및 지리 공간 산업을 지원합니다.
자세히 알아보기

Ultralytics YOLO 모델로 모든 사이트를 보호하세요. 비전 AI는 경계 모니터링, 위협 탐지, 번호판 인식 및 작업장 안전을 지원합니다.
자세히 알아보기
로보틱스 컴퓨터 비전

로보틱스 컴퓨터 비전

Ultralytics YOLO 모델로 더 스마트한 기계의 성능을 구현하세요. 로보틱스의 Vision AI는 자율 주행, 인식, 객체 추적 및 실시간 제어를 지원합니다.
자세히 알아보기
물류 컴퓨터 비전

물류 컴퓨터 비전

Ultralytics YOLO 모델로 물류를 효율화하세요. Vision AI는 패키지 검사, 분류, 차량 추적 및 창고의 실시간 안전 모니터링을 지원합니다.
자세히 알아보기
소매 컴퓨터 비전

소매 컴퓨터 비전

Ultralytics YOLO 모델로 소매업을 새롭게 혁신하세요. Vision AI는 재고 추적, 선반 모니터링, 대기열 관리 및 더 스마트한 고객 인사이트를 지원합니다.
자세히 알아보기
헬스케어 분야의 컴퓨터 비전

헬스케어 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 헬스케어 솔루션을 구축하십시오. 헬스케어 분야의 Vision AI는 더 빠른 의료 영상 처리, 더욱 스마트한 진단, 환자 모니터링을 지원합니다.
자세히 알아보기
제조 분야의 컴퓨터 비전

제조 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 제조를 최적화하십시오. Vision AI는 품질 관리, 결함 탐지, PPE 준수, 조립 라인 자동화를 지원합니다.
자세히 알아보기
자동차 산업의 컴퓨터 비전

자동차 산업의 컴퓨터 비전

Ultralytics YOLO 모델을 활용해 자동차 산업에 컴퓨터 비전을 적용합니다. 비전 AI는 도로 안전, 운전자 보조, 차량 자동화를 향상해 더 스마트한 도로를 구현합니다.
자세히 알아보기
농업의 컴퓨터 비전

농업의 컴퓨터 비전

Ultralytics YOLO 모델로 스마트 농업에 비전 AI를 도입합니다. 작물 모니터링, 가축 추적, 정밀 농업을 강화해 더 높은 수확량을 스마트하게 실현합니다.
자세히 알아보기
항공 이미지를 위한 컴퓨터 비전

항공 이미지를 위한 컴퓨터 비전

Ultralytics YOLO을 활용하여 드론 및 항공 이미지를 농업, 수산업, 환경 모니터링, 자연 보호, 지리 공간 분석을 위한 실시간 인사이트로 변환합니다.
자세히 알아보기
항공우주 분야의 컴퓨터 비전

항공우주 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 항공 모니터링에 비전 AI를 도입하세요. 컴퓨터 비전 솔루션으로 드론, 항공우주 워크플로, 환경 보전 및 지리 공간 산업을 지원합니다.
자세히 알아보기

Ultralytics YOLO 모델로 모든 사이트를 보호하세요. 비전 AI는 경계 모니터링, 위협 탐지, 번호판 인식 및 작업장 안전을 지원합니다.
자세히 알아보기
로보틱스 컴퓨터 비전

로보틱스 컴퓨터 비전

Ultralytics YOLO 모델로 더 스마트한 기계의 성능을 구현하세요. 로보틱스의 Vision AI는 자율 주행, 인식, 객체 추적 및 실시간 제어를 지원합니다.
자세히 알아보기
물류 컴퓨터 비전

물류 컴퓨터 비전

Ultralytics YOLO 모델로 물류를 효율화하세요. Vision AI는 패키지 검사, 분류, 차량 추적 및 창고의 실시간 안전 모니터링을 지원합니다.
자세히 알아보기
소매 컴퓨터 비전

소매 컴퓨터 비전

Ultralytics YOLO 모델로 소매업을 새롭게 혁신하세요. Vision AI는 재고 추적, 선반 모니터링, 대기열 관리 및 더 스마트한 고객 인사이트를 지원합니다.
자세히 알아보기
헬스케어 분야의 컴퓨터 비전

헬스케어 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 헬스케어 솔루션을 구축하십시오. 헬스케어 분야의 Vision AI는 더 빠른 의료 영상 처리, 더욱 스마트한 진단, 환자 모니터링을 지원합니다.
자세히 알아보기
제조 분야의 컴퓨터 비전

제조 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 제조를 최적화하십시오. Vision AI는 품질 관리, 결함 탐지, PPE 준수, 조립 라인 자동화를 지원합니다.
자세히 알아보기
자동차 산업의 컴퓨터 비전

자동차 산업의 컴퓨터 비전

Ultralytics YOLO 모델을 활용해 자동차 산업에 컴퓨터 비전을 적용합니다. 비전 AI는 도로 안전, 운전자 보조, 차량 자동화를 향상해 더 스마트한 도로를 구현합니다.
자세히 알아보기
농업의 컴퓨터 비전

농업의 컴퓨터 비전

Ultralytics YOLO 모델로 스마트 농업에 비전 AI를 도입합니다. 작물 모니터링, 가축 추적, 정밀 농업을 강화해 더 높은 수확량을 스마트하게 실현합니다.
자세히 알아보기
항공 이미지를 위한 컴퓨터 비전

항공 이미지를 위한 컴퓨터 비전

Ultralytics YOLO을 활용하여 드론 및 항공 이미지를 농업, 수산업, 환경 모니터링, 자연 보호, 지리 공간 분석을 위한 실시간 인사이트로 변환합니다.
자세히 알아보기
항공우주 분야의 컴퓨터 비전

항공우주 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 항공 모니터링에 비전 AI를 도입하세요. 컴퓨터 비전 솔루션으로 드론, 항공우주 워크플로, 환경 보전 및 지리 공간 산업을 지원합니다.
자세히 알아보기

Ultralytics YOLO 모델로 모든 사이트를 보호하세요. 비전 AI는 경계 모니터링, 위협 탐지, 번호판 인식 및 작업장 안전을 지원합니다.
자세히 알아보기
로보틱스 컴퓨터 비전

로보틱스 컴퓨터 비전

Ultralytics YOLO 모델로 더 스마트한 기계의 성능을 구현하세요. 로보틱스의 Vision AI는 자율 주행, 인식, 객체 추적 및 실시간 제어를 지원합니다.
자세히 알아보기
물류 컴퓨터 비전

물류 컴퓨터 비전

Ultralytics YOLO 모델로 물류를 효율화하세요. Vision AI는 패키지 검사, 분류, 차량 추적 및 창고의 실시간 안전 모니터링을 지원합니다.
자세히 알아보기
소매 컴퓨터 비전

소매 컴퓨터 비전

Ultralytics YOLO 모델로 소매업을 새롭게 혁신하세요. Vision AI는 재고 추적, 선반 모니터링, 대기열 관리 및 더 스마트한 고객 인사이트를 지원합니다.
자세히 알아보기
헬스케어 분야의 컴퓨터 비전

헬스케어 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 헬스케어 솔루션을 구축하십시오. 헬스케어 분야의 Vision AI는 더 빠른 의료 영상 처리, 더욱 스마트한 진단, 환자 모니터링을 지원합니다.
자세히 알아보기
제조 분야의 컴퓨터 비전

제조 분야의 컴퓨터 비전

Ultralytics YOLO 모델로 제조를 최적화하십시오. Vision AI는 품질 관리, 결함 탐지, PPE 준수, 조립 라인 자동화를 지원합니다.
자세히 알아보기
자동차 산업의 컴퓨터 비전

자동차 산업의 컴퓨터 비전

Ultralytics YOLO 모델을 활용해 자동차 산업에 컴퓨터 비전을 적용합니다. 비전 AI는 도로 안전, 운전자 보조, 차량 자동화를 향상해 더 스마트한 도로를 구현합니다.
자세히 알아보기
농업의 컴퓨터 비전

농업의 컴퓨터 비전

Ultralytics YOLO 모델로 스마트 농업에 비전 AI를 도입합니다. 작물 모니터링, 가축 추적, 정밀 농업을 강화해 더 높은 수확량을 스마트하게 실현합니다.
자세히 알아보기

AI의 미래를 함께 만들어가세요!

머신러닝의 미래와 함께 여정을 시작하세요