YOLO Vision 2026:

Набор данных COCO8-Pose#

Введение#

Ultralytics COCO8-Pose — это небольшой, но универсальный датасет для оценки позы, состоящий из первых 8 изображений из набора данных COCO train 2017 (4 для обучения, 4 для валидации) и использующий схему из 17 ключевых точек для единственного класса "person". Этот датасет идеально подходит для тестирования и отладки моделей оценки позы, а также для экспериментов с новыми подходами к обнаружению ключевых точек. Благодаря 8 изображениям он достаточно мал, чтобы с ним было легко работать, и в то же время достаточно разнообразен, чтобы проверять пайплайны обучения на наличие ошибок и служить проверкой работоспособности перед началом обучения на полном датасете COCO-Pose.

Структура набора данных#

  • Всего изображений: 8 (4 обучающих / 4 валидационных).
  • Классы: 1 (person) с 17 типами ключевых точек для каждой аннотации.
  • Размер загрузки: ~1 МБ.
  • Рекомендуемая структура каталогов: datasets/coco8-pose/images/{train,val} и datasets/coco8-pose/labels/{train,val} с ключевыми точками в формате YOLO, сохраненными в виде файлов .txt.

Изучи COCO8-Pose на Ultralytics Platform, чтобы просмотреть каждое изображение со скелетами ключевых точек, посмотреть распределение ключевых точек и классов на вкладке Charts, а также клонировать его для обучения собственной модели в облаке.

YAML набора данных#

YAML-файл используется для определения конфигурации датасета. Он содержит информацию о путях датасета, классах и другую релевантную информацию. В случае с датасетом COCO8-Pose файл coco8-pose.yaml поддерживается по адресу https://github.com/ultralytics/ultralytics/blob/main/ultralytics/cfg/datasets/coco8-pose.yaml.

ultralytics/cfg/datasets/coco8-pose.yaml
# Ultralytics 🚀 AGPL-3.0 License - https://ultralytics.com/license

# COCO8-pose dataset (first 8 images from COCO train2017) by Ultralytics
# Documentation: https://docs.ultralytics.com/datasets/pose/coco8-pose
# Example usage: yolo train data=coco8-pose.yaml
# parent
# ├── ultralytics
# └── datasets
#     └── coco8-pose ← downloads here (1 MB)

# Train/val/test sets as 1) dir: path/to/imgs, 2) file: path/to/imgs.txt, or 3) list: [path/to/imgs1, path/to/imgs2, ..]
path: coco8-pose # dataset root dir
train: images/train # train images (relative to 'path') 4 images
val: images/val # val images (relative to 'path') 4 images
test: # test images (optional)

# Keypoints
kpt_shape: [17, 3] # number of keypoints, number of dims (2 for x,y or 3 for x,y,visible)
flip_idx: [0, 2, 1, 4, 3, 6, 5, 8, 7, 10, 9, 12, 11, 14, 13, 16, 15]

# Classes
names:
  0: person

# Keypoint names per class
kpt_names:
  0:
    - nose
    - left_eye
    - right_eye
    - left_ear
    - right_ear
    - left_shoulder
    - right_shoulder
    - left_elbow
    - right_elbow
    - left_wrist
    - right_wrist
    - left_hip
    - right_hip
    - left_knee
    - right_knee
    - left_ankle
    - right_ankle

# Download script/URL (optional)
download: https://github.com/ultralytics/assets/releases/download/v0.0.0/coco8-pose.zip

Использование#

Чтобы обучить модель YOLO26n-pose на датасете COCO8-Pose в течение 100 эпох с размером изображения 640, ты можешь использовать следующие фрагменты кода. Полный список доступных аргументов см. на странице обучения модели.

Пример обучения
from ultralytics import YOLO

# Load a model
model = YOLO("yolo26n-pose.pt")  # load a pretrained model (recommended for training)

# Train the model
results = model.train(data="coco8-pose.yaml", epochs=100, imgsz=640)

Примеры изображений и аннотации#

Вот несколько примеров изображений из набора данных COCO8-Pose вместе с соответствующими аннотациями:

COCO8-pose keypoint estimation dataset mosaic
  • Мозаичное изображение: это изображение демонстрирует обучающий пакет, составленный из мозаично собранных изображений. Мозаика — это техника, используемая во время обучения, которая объединяет несколько изображений в одно, чтобы увеличить разнообразие объектов и сцен в каждом обучающем пакете. Это помогает улучшить способность модели к обобщению при работе с объектами различных размеров, соотношений сторон и контекстов.

Цитирование и благодарности#

Если ты используешь набор данных COCO в своей исследовательской или разработческой работе, пожалуйста, процитируй следующую статью:

Цитата
@misc{lin2015microsoft,
      title={Microsoft COCO: Common Objects in Context},
      author={Tsung-Yi Lin and Michael Maire and Serge Belongie and Lubomir Bourdev and Ross Girshick and James Hays and Pietro Perona and Deva Ramanan and C. Lawrence Zitnick and Piotr Dollár},
      year={2015},
      eprint={1405.0312},
      archivePrefix={arXiv},
      primaryClass={cs.CV}
}

Мы выражаем благодарность консорциуму COCO за создание и поддержку этого ценного ресурса для сообщества компьютерного зрения. Для получения дополнительной информации о датасете COCO и его создателях посети сайт набора данных COCO.

FAQ#

  • Датасет COCO8-Pose представляет собой небольшой универсальный датасет для оценки позы, который включает первые 8 изображений из набора данных COCO train 2017 (4 изображения для обучения и 4 для валидации). Он разработан для тестирования и отладки моделей оценки позы, а также для экспериментов с новыми подходами к обнаружению ключевых точек. Этот датасет идеально подходит для быстрых экспериментов с Ultralytics YOLO26. Более подробную информацию о конфигурации датасета смотри в YAML-файле датасета.

  • Загрузи yolo26n-pose.pt и вызови model.train(data="coco8-pose.yaml", epochs=100, imgsz=640) — полный код для Python и CLI смотри в примере Train Example выше, а полный список аргументов — на странице обучения модели.

  • Имея в общей сложности 8 изображений (4 для обучения / 4 для валидации), 1 класс, схему из 17 ключевых точек и загружаемый объем ~1 МБ, COCO8-Pose достаточно мал, чтобы справиться с ним за секунды, и в то же время достаточно разнообразен, чтобы протестировать пайплайн обучения позы на наличие ошибок перед масштабированием до полного датасета COCO-Pose. Подробнее о его возможностях и использовании читай в разделе Dataset Introduction.

  • Мозаичное объединение (мозаика) объединяет несколько изображений в одно, увеличивая разнообразие объектов и сцен в каждом обучающем батче, что помогает модели обобщать данные по размерам объектов, соотношениям сторон и контекстам. Пример смотри в разделе Sample Images and Annotations.

  • YAML-файл датасета COCO8-Pose можно найти по адресу https://github.com/ultralytics/ultralytics/blob/main/ultralytics/cfg/datasets/coco8-pose.yaml. Этот файл определяет конфигурацию датасета, включая пути, классы и другую релевантную информацию. Используй этот файл со скриптами обучения YOLO26, как упомянуто в разделе Train Example.

    Подробнее о моделях ключевых точек см. в документации по задаче Оценка позы.

Комментарии