Ultralytics YOLO27:

COCO8-Pose 데이터셋#

소개#

Ultralytics COCO8-Pose는 COCO train 2017 세트의 처음 8개 이미지(학습용 4개, 검증용 4개)로 구성된 작지만 다목적으로 활용할 수 있는 포즈 추정 데이터셋이며, 단일 "person" 클래스를 대상으로 17개 키포인트 스키마를 사용합니다. 이 데이터셋은 포즈 추정 모델을 테스트하고 디버깅하거나 새로운 키포인트 검출 접근 방식을 실험하는 데 적합합니다. 이미지가 8개뿐이므로 쉽게 관리할 수 있을 만큼 작으면서도, 전체 COCO-Pose 데이터셋으로 학습하기 전에 학습 파이프라인의 오류를 테스트하고 정상 작동 여부를 확인할 수 있을 만큼 다양합니다.

데이터셋 구조#

  • 총 이미지 수: 8개(학습 4개 / 검증 4개).
  • 클래스: 1개(person), 어노테이션마다 17개의 키포인트 유형이 있습니다.
  • 다운로드 크기: ~1 MB.
  • 권장 디렉터리 구조: datasets/coco8-pose/images/{train,val}datasets/coco8-pose/labels/{train,val}에 YOLO 형식 키포인트를 .txt 파일로 저장합니다.

Ultralytics Platform에서 COCO8-Pose 살펴보기에서는 모든 이미지와 해당 키포인트 스켈레톤을 확인하고, Charts 탭에서 키포인트 및 클래스 분포를 확인하며, 데이터셋을 복제하여 클라우드에서 자체 모델을 학습할 수 있습니다.

데이터셋 YAML#

YAML 파일을 사용하여 데이터셋 구성을 정의합니다. 이 파일에는 데이터셋의 경로, 클래스 및 기타 관련 정보가 포함됩니다. COCO8-Pose 데이터셋의 경우 coco8-pose.yaml 파일이 https://github.com/ultralytics/ultralytics/blob/main/ultralytics/cfg/datasets/coco8-pose.yaml에 유지 관리됩니다.

ultralytics/cfg/datasets/coco8-pose.yaml
# Ultralytics 🚀 AGPL-3.0 License - https://ultralytics.com/license

# COCO8-pose dataset (first 8 images from COCO train2017) by Ultralytics
# Documentation: https://docs.ultralytics.com/datasets/pose/coco8-pose
# Example usage: yolo train data=coco8-pose.yaml
# parent
# ├── ultralytics
# └── datasets
#     └── coco8-pose ← downloads here (1 MB)

# Train/val/test sets as 1) dir: path/to/imgs, 2) file: path/to/imgs.txt, or 3) list: [path/to/imgs1, path/to/imgs2, ..]
path: coco8-pose # dataset root dir
train: images/train # train images (relative to 'path') 4 images
val: images/val # val images (relative to 'path') 4 images
test: # test images (optional)

# Keypoints
kpt_shape: [17, 3] # number of keypoints, number of dims (2 for x,y or 3 for x,y,visible)
flip_idx: [0, 2, 1, 4, 3, 6, 5, 8, 7, 10, 9, 12, 11, 14, 13, 16, 15]

# Classes
names:
  0: person

# Keypoint names per class
kpt_names:
  0:
    - nose
    - left_eye
    - right_eye
    - left_ear
    - right_ear
    - left_shoulder
    - right_shoulder
    - left_elbow
    - right_elbow
    - left_wrist
    - right_wrist
    - left_hip
    - right_hip
    - left_knee
    - right_knee
    - left_ankle
    - right_ankle

# Download script/URL (optional)
download: https://github.com/ultralytics/assets/releases/download/v0.0.0/coco8-pose.zip

사용법#

이미지 크기 640으로 COCO8-Pose 데이터셋에서 YOLO26n-pose 모델을 100개 에포크 동안 학습하려면 다음 코드 스니펫을 사용할 수 있습니다. 사용 가능한 인수의 전체 목록은 모델 Training 페이지를 참조하세요.

학습 예제
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-pose.pt")  # load a pretrained model (recommended for training)

# Train the model
results = model.train(data="coco8-pose.yaml", epochs=100, imgsz=640)

샘플 이미지 및 주석#

다음은 COCO8-Pose 데이터셋의 이미지와 해당 어노테이션 예시입니다.

COCO8-pose keypoint estimation dataset mosaic
  • 모자이크 처리된 이미지: 이 이미지는 모자이크 처리된 데이터셋 이미지로 구성된 학습 배치를 보여줍니다. 모자이크 처리는 학습 중 여러 이미지를 하나의 이미지로 결합하여 각 학습 배치에 포함되는 객체와 장면의 다양성을 높이는 기법입니다. 이를 통해 다양한 객체 크기, 종횡비 및 컨텍스트에 대한 모델의 일반화 성능을 향상할 수 있습니다.

인용 및 감사의 글#

연구 또는 개발 작업에서 COCO 데이터셋을 사용하는 경우 다음 논문을 인용해 주세요:

인용문
@misc{lin2015microsoft,
      title={Microsoft COCO: Common Objects in Context},
      author={Tsung-Yi Lin and Michael Maire and Serge Belongie and Lubomir Bourdev and Ross Girshick and James Hays and Pietro Perona and Deva Ramanan and C. Lawrence Zitnick and Piotr Dollár},
      year={2015},
      eprint={1405.0312},
      archivePrefix={arXiv},
      primaryClass={cs.CV}
}

이 귀중한 리소스를 만들고 유지 관리해 주신 COCO Consortium에 감사드립니다. 컴퓨터 비전 커뮤니티를 위해 COCO 데이터셋과 제작자에 대한 자세한 정보를 확인하려면 COCO 데이터셋 웹사이트를 방문하세요.

FAQ#

  • COCO8-Pose 데이터셋은 COCO train 2017 세트의 처음 8개 이미지(학습용 4개, 검증용 4개)를 포함하는 작고 다목적으로 활용할 수 있는 포즈 추정 데이터셋입니다. 포즈 추정 모델을 테스트하고 디버깅하며 새로운 키포인트 검출 접근 방식을 실험할 수 있도록 설계되었습니다. 이 데이터셋은 Ultralytics YOLO26을 빠르게 실험하는 데 적합합니다. 데이터셋 구성에 대한 자세한 내용은 데이터셋 YAML 파일을 확인하세요.

  • yolo26n-pose.pt을 로드하고 model.train(data="coco8-pose.yaml", epochs=100, imgsz=640)을 호출하세요. 전체 Python 및 CLI 코드 스니펫은 위의 학습 예제를, 인자 전체 목록은 모델 학습 페이지를 참조하세요.

  • 총 이미지 8개(학습 4개 / 검증 4개), 클래스 1개, 17개 키포인트 스키마, 약 ~1 MB의 다운로드 용량으로 구성된 COCO8-Pose는 몇 초 안에 관리할 수 있을 만큼 작으면서도, 전체 COCO-Pose 데이터셋으로 확장하기 전에 포즈 학습 파이프라인의 오류를 빠르게 확인할 수 있을 만큼 다양합니다. 기능 및 사용 방법에 대한 자세한 내용은 Dataset Introduction 섹션을 참조하세요.

  • 모자이싱은 여러 이미지를 하나로 결합하여 각 학습 배치에 포함되는 객체와 장면의 다양성을 높이며, 이를 통해 모델이 객체 크기, 종횡비 및 맥락 전반에 걸쳐 일반화하는 데 도움이 됩니다. 예시는 Sample Images and Annotations 섹션을 참조하세요.

  • COCO8-Pose 데이터셋 YAML 파일은 https://github.com/ultralytics/ultralytics/blob/main/ultralytics/cfg/datasets/coco8-pose.yaml에서 찾을 수 있습니다. 이 파일은 경로, 클래스 및 기타 관련 정보를 포함한 데이터셋 구성을 정의합니다. Train Example 섹션에 설명된 대로 YOLO26 학습 스크립트에서 이 파일을 사용하세요.

    키포인트 모델에 대한 자세한 내용은 포즈 추정 작업 문서를 참조하십시오.

댓글