YOLO Vision 2026:
No license

CIFAR-10 데이터셋#

CIFAR-10 (Canadian Institute For Advanced Research) 데이터셋은 10개 클래스(비행기, 자동차, 새, 고양이, 사슴, 개, 개구리, 말, 배, 트럭)에 균등하게 분할된 60,000개의 32x32 컬러 이미지로 구성된 고전적인 image classification 벤치마크입니다. 50,000개의 학습 이미지와 10,000개의 테스트 이미지(클래스당 6,000개)로 미리 정의된 분할을 제공하여, 분류 모델을 학습하고 벤치마킹하기 위한 가볍고 균형 잡힌 시작점을 제공합니다. 더 세분화된 도전 과제를 원하시면 관련 CIFAR-100 데이터셋을 참조하세요.



Watch: How to Train an Image Classification Model with CIFAR-10 Dataset using Ultralytics YOLO

주요 특징#

  • CIFAR-10은 10개의 클래스로 균등하게 나뉜 32x32 픽셀의 컬러 이미지 60,000개를 포함하고 있습니다.
  • 각 클래스는 정확히 6,000개의 이미지(학습용 5,000개, 테스트용 1,000개)를 보유하고 있어 데이터셋이 완벽하게 균형을 이루고 있습니다.
  • 10개의 클래스는 비행기, 자동차, 새, 고양이, 사슴, 개, 개구리, 말, 배, 트럭입니다.
  • 이 데이터셋은 학습/테스트 분할이 미리 정의되어 제공되므로 수동 또는 자동 분할이 필요하지 않습니다.
  • CIFAR-10은 image classification 및 객체 인식 연구를 위한 표준 벤치마크입니다.

데이터셋 구조#

CIFAR-10은 공식적으로 미리 정의된 분할을 포함하고 있어 자동 또는 수동 파티셔닝이 필요하지 않습니다:

  • 클래스: 10개(비행기, 자동차, 새, 고양이, 사슴, 개, 개구리, 말, 배, 트럭)
  • 총 이미지 수: 60,000개(32x32 컬러)
  • 학습 세트: 50,000개 이미지(클래스당 5,000개)
  • 테스트 세트: 10,000개 이미지(클래스당 1,000개)
검증 분할

CIFAR-10에는 별도의 검증 폴더가 없으므로, Ultralytics는 학습 중 기본적으로 10,000개의 이미지로 구성된 테스트 세트를 검증 분할로 사용합니다.

응용 분야#

CIFAR-10은 고전적인 Convolutional Neural Networks (CNN) 및 Support Vector Machines (SVM)부터 현대의 딥 아키텍처에 이르기까지 image classification 모델을 학습하고 평가하는 데 널리 사용됩니다. 작은 이미지 크기와 균형 잡힌 클래스 덕분에 빠른 실험, 새로운 알고리즘 벤치마킹, 그리고 computer vision 기초 교육에 이상적입니다.

사용법#

이미지 크기 32로 100 epochs 동안 CIFAR-10에서 YOLO 모델을 학습합니다. 사용 가능한 모든 인수 목록은 Training 페이지와 image classification 작업 가이드를 참조하세요.

훈련 예제
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-cls.pt")  # load a pretrained model (recommended for training)

# Train the model
results = model.train(data="cifar10", epochs=100, imgsz=32)

샘플 이미지 및 주석#

CIFAR-10 데이터셋에는 다양한 객체의 컬러 이미지가 포함되어 있어 image classification 작업을 위한 잘 구조화된 데이터셋을 제공합니다. 데이터셋의 이미지 예시는 다음과 같습니다.

CIFAR-10 image classification dataset samples

이 샘플들은 CIFAR-10 데이터셋에 포함된 객체의 다양성을 보여주며, 강력한 이미지 분류 모델 학습을 위해 다양한 데이터셋이 갖는 가치를 강조합니다.

인용 및 감사의 글#

연구나 개발 작업에 CIFAR-10 데이터셋을 사용하는 경우 다음 논문을 인용해 주십시오:

인용
@TECHREPORT{Krizhevsky09learningmultiple,
            author={Alex Krizhevsky},
            title={Learning multiple layers of features from tiny images},
            institution={},
            year={2009}
}

machine learningcomputer vision 연구 커뮤니티를 위한 소중한 리소스로서 CIFAR-10 데이터셋을 생성하고 유지 관리해 주신 Alex Krizhevsky님께 감사를 표합니다. CIFAR-10 데이터셋과 제작자에 대한 자세한 내용은 CIFAR-10 dataset website를 방문하세요.

FAQ#

CIFAR-10 데이터셋은 머신러닝에서 어떤 용도로 사용됩니까?#

CIFAR-10 데이터셋은 image classification 및 객체 인식 모델을 학습하고 벤치마킹하는 데 널리 사용됩니다. 10개 클래스에 걸쳐 균등하게 분포된 60,000개의 32x32 컬러 이미지를 포함하고 있으며, 작은 크기와 균형 잡힌 클래스 덕분에 Convolutional Neural Networks (CNN) 및 Support Vector Machines (SVM)과 같은 알고리즘을 위한 빠르고 신뢰할 수 있는 벤치마크가 됩니다.

CIFAR-10 데이터셋에서 Ultralytics YOLO 모델을 어떻게 학습할 수 있습니까?#

CIFAR-10에서 Ultralytics YOLO 모델을 학습하려면 아래 코드 스니펫을 사용하세요. 데이터셋은 처음 사용할 때 자동으로 다운로드됩니다. 전체 인수 목록은 모델 Training 페이지를 참조하세요.

훈련 예제
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-cls.pt")  # load a pretrained model (recommended for training)

# Train the model
results = model.train(data="cifar10", epochs=100, imgsz=32)

CIFAR-10 데이터셋에는 몇 개의 클래스가 있습니까?#

CIFAR-10에는 10개의 클래스(비행기, 자동차, 새, 고양이, 사슴, 개, 개구리, 말, 배, 트럭)가 있으며, 각 클래스마다 정확히 6,000개의 이미지가 포함되어 총 60,000개의 이미지가 있습니다. 클래스들은 상호 배타적이며 완벽하게 균형을 이루고 있어 카테고리 간 중복이 없습니다.

CIFAR-10 데이터셋은 어떻게 학습 세트와 테스트 세트로 분할됩니까?#

CIFAR-10은 50,000개의 학습 이미지와 10,000개의 테스트 이미지로 사전에 정의된 분할을 제공하며, 클래스당 정확히 5,000개의 학습 이미지와 1,000개의 테스트 이미지가 포함되어 있습니다. Ultralytics가 자동으로 분할하는 폴더 기반 분류 데이터셋과 달리, CIFAR-10의 공식 파티션은 그대로 사용되며 테스트 세트는 기본적으로 학습 중 검증 분할로 사용됩니다.

CIFAR-10 데이터셋에서 모델을 학습하기 위해 Ultralytics Platform을 사용할 수 있습니까?#

네. Ultralytics Platform을 사용하면 광범위한 코딩 없이도 데이터셋을 관리하고, image classification 모델을 학습하며, 배포할 수 있습니다. 클라우드에서 CIFAR-10 실험을 실행하는 편리한 방법이며, classification datasets overview에서 더 많은 옵션을 살펴볼 수 있습니다.

댓글