YOLO Vision 2026:

YOLOv10 대 DAMO-YOLO#

현대적인 computer vision 파이프라인을 구축할 때 적절한 실시간 객체 검출 아키텍처를 선택하는 것은 매우 중요합니다. 이 종합적인 기술 분석에서는 YOLOv10DAMO-YOLO의 아키텍처, 성능 지표, 그리고 이상적인 사용 사례를 살펴봅니다. 두 모델 모두 객체 검출 기능에서 상당한 도약을 이루었지만, 목표를 달성하기 위해 서로 다른 아키텍처 경로를 취합니다.

프로젝트가 제약된 edge AI 하드웨어에서의 배포를 요구하든 클라우드 GPU에서의 최대 정확도를 요구하든, 이러한 아키텍처의 미묘한 차이를 이해하면 정보에 입각한 결정을 내리는 데 도움이 됩니다.

YOLOv10 살펴보기#

칭화대학교 연구진이 발표한 YOLOv10은 네이티브 엔드투엔드 방식을 도입하여 YOLO 패밀리를 혁신했으며, 후처리 과정에서 비최대 suppression (NMS)의 필요성을 효과적으로 없애주었습니다.

YOLOv10 세부 정보:

주요 아키텍처 특징#

YOLOv10의 주요 혁신은 NMS 없는 학습을 위한 Consistent Dual Assignments 전략입니다. 기존 객체 검출기는 겹치는 bounding box를 필터링하기 위해 NMS에 크게 의존하며, 이는 예측 불가능한 지연 시간을 유발합니다. 이는 autonomous vehicles 및 고속 로보틱스와 같은 실시간 애플리케이션에서 심각한 병목 현상입니다. YOLOv10은 객체당 단일 최적의 bounding box를 직접 예측함으로써 예측 가능하고 초저지연인 추론을 달성합니다.

또한 이 모델은 Holistic Efficiency-Accuracy Driven Design을 채택하고 있습니다. 아키텍처는 경량 분류 헤드와 공간-채널 분리 다운샘플링을 포함한 다양한 컴포넌트를 최적화하여 연산 중복성을 크게 줄입니다. 그 결과 경쟁력 있는 mean Average Precision (mAP)을 유지하면서도 더 적은 매개변수 수와 적은 FLOPs를 자랑하는 아키텍처가 탄생했습니다.

프로덕션을 위한 간소화된 내보내기

YOLOv10은 추론 그래프에서 NMS 연산을 제거하므로, ONNXTensorRT 같은 형식으로 모델을 내보내는 과정이 매우 단순화되어 엣지 배포에 탁월한 적합성을 보입니다.

YOLOv10에 대해 더 알아보기

사용 예시#

YOLOv10은 Ultralytics 생태계에 깊이 통합되어 있어 Ultralytics Python package를 통해 매우 쉽게 사용할 수 있습니다.

from ultralytics import YOLO

# Load a pre-trained YOLOv10 nano model
model = YOLO("yolov10n.pt")

# Train the model on the COCO8 dataset
results = model.train(data="coco8.yaml", epochs=100, imgsz=640)

# Run inference on a test image
results = model("https://ultralytics.com/images/bus.jpg")

# Export the model to TensorRT format
model.export(format="engine", quantize=16)

DAMO-YOLO 살펴보기#

Alibaba Group에서 개발한 DAMO-YOLO는 자동화된 신경망 구조 탐색(NAS)을 통해 매우 효율적인 네트워크 구조를 발견하는 데 중점을 두며, 속도와 정확도의 파레토 프런티어를 확장하는 것을 목표로 합니다.

DAMO-YOLO 세부 정보:

주요 아키텍처 특징#

DAMO-YOLO는 산업용 애플리케이션에 맞춘 여러 새로운 기술을 도입했습니다. 모델의 기반은 다목적 진화 탐색(Multi-Objective Evolutionary search)을 통해 생성된 MAE-NAS 백본입니다. 이 자동화된 프로세스는 미리 정의된 계산 예산을 엄격하게 준수하는 백본 구조를 찾아내어 정확도와 추론 지연 시간 사이의 미세한 균형을 유지합니다.

또한 아키텍처는 Efficient RepGFPN 넥을 활용합니다. 이 피라미드 네트워크는 다양한 스케일에 걸쳐 특징 융합을 개선하도록 설계되었으며, 이는 객체의 크기가 크게 달라지는 aerial imagery analysis와 같은 복잡한 작업에 매우 중요합니다. 이를 보완하기 위해 DAMO-YOLO는 최종 예측 레이어의 복잡성을 크게 줄이고 추론 중 소중한 연산 시간을 절약하는 미니멀리스트 검출 헤드인 ZeroHead를 구현합니다.

DAMO-YOLO에 대해 더 알아보기

성능 비교#

객체 탐지 아키텍처를 평가할 때 추론 속도, 파라미터 효율성 및 탐지 정확도 간의 올바른 절충안을 찾는 것이 가장 중요합니다. 아래 표는 각 모델 크기에 걸쳐 YOLOv10과 DAMO-YOLO의 성능을 비교합니다.

모델크기
(픽셀)
mAPval
50-95
속도
CPU ONNX
(ms)
속도
T4 TensorRT10
(ms)
파라미터
(M)
FLOPs
(B)
YOLOv10n64039.5-1.562.36.7
YOLOv10s64046.7-2.667.221.6
YOLOv10m64051.3-5.4815.459.1
YOLOv10b64052.7-6.5424.492.0
YOLOv10l64053.3-8.3329.5120.3
YOLOv10x64054.4-12.256.9160.4
DAMO-YOLOt64042.0-2.328.518.1
DAMO-YOLOs64046.0-3.4516.337.8
DAMO-YOLOm64049.2-5.0928.261.8
DAMO-YOLOl64050.8-7.1842.197.3

벤치마크에서 볼 수 있듯이, YOLOv10은 특히 나노 변형 모델에서 TensorRT 상에서 일관되게 뛰어난 지연 시간 프로필을 제공하며, DAMO-YOLO의 유사 모델보다 훨씬 적은 파라미터와 FLOP를 요구합니다. DAMO-YOLO는 tiny 변형 모델에서 강력한 mAP를 제공하지만, YOLOv10 제품군의 파라미터 효율성과 추론 지연 시간은 제약이 있는 배포 환경에서 뚜렷한 이점을 제공합니다.

활용 사례 및 권장 사항#

YOLOv10과 DAMO-YOLO 중 선택하는 것은 귀하의 특정 프로젝트 요구 사항, 배포 제약 조건 및 생태계 선호도에 따라 다릅니다.

YOLOv10을 선택해야 할 때#

YOLOv10은 다음 용도에 강력한 선택지입니다:

  • NMS 없는 실시간 탐지: Non-Maximum Suppression 없이 엔드 투 엔드 탐지를 수행하여 배포 복잡성을 줄이는 애플리케이션.
  • 균형 잡힌 속도-정확도 트레이드오프: 다양한 모델 스케일 전반에서 추론 속도와 탐지 정확도 사이의 강력한 균형이 필요한 프로젝트.
  • 일관된 지연 시간 애플리케이션: robotics 또는 자율 시스템과 같이 예측 가능한 추론 시간이 중요한 배포 시나리오.

DAMO-YOLO를 선택해야 할 때#

DAMO-YOLO는 다음의 경우 권장됩니다:

  • 고처리량 영상 분석: 배치-1(batch-1) 처리량이 주요 지표인 고정 NVIDIA GPU 인프라에서 높은 FPS 영상 스트림을 처리할 때.
  • 산업 제조 라인: 조립 라인의 실시간 품질 검사와 같이 전용 하드웨어에서 엄격한 GPU 지연 시간 제약이 있는 시나리오.
  • 신경망 아키텍처 탐색 연구: 자동화된 아키텍처 탐색(MAE-NAS) 및 효율적인 재매개변수화 백본이 탐지 성능에 미치는 영향을 연구할 때.

Ultralytics (YOLO26)를 선택해야 할 때#

대부분의 신규 프로젝트의 경우, Ultralytics YOLO26은 성능과 개발자 경험의 최상의 조합을 제공합니다.

  • NMS 미사용 엣지 배포: 비최대 억제 후처리의 복잡성 없이 일관되고 낮은 지연 시간의 추론이 필요한 애플리케이션.
  • CPU 전용 환경: 전용 GPU 가속이 없는 디바이스에서, 최대 43% 더 빠른 YOLO26의 CPU 추론 속도가 결정적인 이점을 제공합니다.
  • 소형 객체 감지: 항공 드론 이미지나 IoT 센서 분석과 같은 까다로운 시나리오에서 ProgLoss와 STAL이 아주 작은 객체의 정확도를 크게 향상시킵니다.

Ultralytics의 장점#

두 모델 모두 기술적으로 인상적이지만, 프로덕션을 위해 아키텍처를 선택할 때는 단순한 수치를 넘어선 고려가 필요합니다. Ultralytics ecosystem에서 기본적으로 지원하는 모델로 빌드하면 개발자와 연구원 모두에게 비교할 수 없는 이점이 제공됩니다.

사용 편의성 및 잘 유지 관리되는 생태계#

자주 방치되는 독립형 학술 리포지토리와 달리, Ultralytics는 강력하고 활발하게 유지 관리되는 생태계를 제공합니다. NAS 파이프라인에 크게 의존하는 모델을 위해 복잡한 환경을 설정하는 것은 벅찰 수 있습니다. 대조적으로, Ultralytics는 광범위한 documentation의 지원을 받는 표준화되고 직관적인 Python API 및 강력한 CLI를 제공합니다. 이는 맞춤형 비전 솔루션의 시장 출시 시간을 대폭 단축합니다.

학습 효율성 및 메모리 요구 사항#

대규모 모델 학습은 빠르게 연산 비용이 많이 들 수 있습니다. Ultralytics YOLO 아키텍처는 역사적으로 학습 및 추론 중 낮은 CUDA 메모리 사용량으로 유명합니다. 이러한 효율성 덕분에 개발자는 RT-DETR과 같은 Transformer 기반 모델을 사용할 때 흔히 발생하는 메모리 부족(out-of-memory) 오류 없이 소비자용 하드웨어나 비용 효율적인 클라우드 인스턴스에서 모델을 학습할 수 있습니다.

실험 추적

Ultralytics는 주요 MLOps 도구와 기본적으로 통합됩니다. 추가적인 상용구 코드 없이 Weights & Biases, Comet, 또는 ClearML과의 통합을 사용하여 모델 학습 진행 상황을 쉽게 추적할 수 있습니다.

작업 전반의 범용성#

많은 특화된 탐지 모델들의 중요한 한계는 좁은 초점입니다. Ultralytics 생태계 내에서는 객체 탐지만으로 제한되지 않습니다. 이 도구들은 인스턴스 세그멘테이션, 이미지 분류, 포즈 추정, 지향 바운딩 박스(OBB) 탐지를 포함하여 여러 컴퓨터 비전 태스크로 원활하게 확장됩니다.

향후 전망: YOLO26의 진화#

YOLOv10이 NMS 없는 추론을 개척하고 DAMO-YOLO가 NAS의 힘을 보여주었지만, 컴퓨터 비전 분야는 빠르게 발전합니다. 최고 수준의 최신 솔루션을 찾는 개발자라면 Ultralytics YOLO26을 확인해 보시는 것을 권장합니다.

YOLO11의 확고한 후속작으로 출시된 YOLO26은 YOLOv10이 설정한 NMS 없는 기반을 바탕으로 이를 훨씬 더 발전시킵니다.

YOLO26의 주요 발전 사항은 다음과 같습니다:

  • 최대 43% 더 빠른 CPU 추론: 에지 컴퓨팅 및 저전력 장치에 특별히 최적화되었습니다.
  • DFL 제거: Distribution Focal Loss가 제거되어 더 간단한 내보내기와 다양한 배포 대상과의 향상된 호환성을 보장합니다.
  • MuSGD 최적화 도구: SGD와 Muon의 하이브리드로, 고급 LLM 학습 안정성과 더 빠른 수렴을 컴퓨터 비전에 직접 도입합니다.
  • ProgLoss + STAL: agriculture 및 원격 탐사와 같은 사용 사례에 필수적인 소형 객체 인식에서 눈에 띄는 향상을 제공하는 대폭 개선된 손실 함수.

새롭게 개편된 Ultralytics Platform을 활용하여 개발자는 단 몇 번의 클릭만으로 YOLO26과 같은 차세대 모델을 매끄럽게 어노테이션하고, 학습하고, 배포할 수 있으며, 이를 통해 컴퓨터 비전 파이프라인이 최첨단이면서도 미래 지향적임을 보장할 수 있습니다.

댓글